La réponse devient l'application
La version courte
ChatGPT ne tient plus absolument à répondre avec du chat.
Le 7 octobre, OpenAI a présenté GPT-6 avec Intelligent UI, un système capable de composer une réponse avec du texte, des images, des graphiques, des boutons, des formulaires, des cartes, des schémas et des outils interactifs. Posez une question sur un vélo, il peut produire un schéma à explorer. Parlez d'épargne retraite, il peut créer un calculateur. Demandez un menu pour recevoir des amis, il peut construire un planning qui s'adapte au nombre d'invités.
Le déploiement a commencé le 7 octobre pour les abonnements payants, puis le 8 octobre pour les utilisateurs Free et Go. OpenAI dit que ChatGPT compte désormais plus de 1,2 milliard d'utilisateurs hebdomadaires.
Le vrai lancement, c'est cette échelle.
Les interfaces générées ne sont pas nouvelles. Google propose de l'interface générative dans AI Mode. Anthropic permet depuis longtemps de construire des Artifacts interactifs. Les développeurs génèrent des sites et des dashboards avec des modèles depuis encore plus longtemps.
Ce qui change, c'est la surface par défaut.
L'interface générée n'est plus nécessairement un projet que vous décidez de construire.
Elle peut simplement être la réponse.
Le chat vient d'acquérir un compilateur d'interface
OpenAI explique qu'Intelligent UI s'appuie sur une bibliothèque de composants natifs et streamables, ainsi que sur un compilateur qui traite l'interface pendant que GPT-6 la génère. Le modèle a été entraîné à décider quand une question appelle du texte, quand elle mérite un visuel et quand l'utilisateur gagnerait à manipuler quelque chose.
Ce détail d'implémentation compte.
ChatGPT ne semble pas écrire du code applicatif arbitraire et le lancer sans limites dans chaque réponse. Le modèle paraît plutôt composer à partir d'un vocabulaire de composants contrôlé, qu'OpenAI peut afficher de façon cohérente sur le web et sur mobile.
C'est une déduction à partir de l'architecture décrite par OpenAI, pas une spécification de sécurité complète. L'annonce n'explique pas chaque frontière d'exécution, transition d'état, flux de données ou permission de composant.
Mais la forme est raisonnable.
Donnez au modèle de la liberté sur la composition.
Gardez le renderer, les composants et la grammaire d'interaction sous le contrôle du produit.
C'est le même compromis qui se dessine dans les systèmes agentiques. Les modèles sont flexibles. Les environnements de production ne le sont pas. Le vrai produit utile est souvent le langage contraint entre les deux.
Google l'explicite avec A2UI, un format indépendant des frameworks qui permet aux agents d'exprimer une intention d'interface à travers le catalogue de composants approuvé d'une application. OpenAI n'annonce pas ici un standard ouvert, mais résout un problème produit similaire à l'échelle de ChatGPT.
Le modèle n'a pas besoin d'inventer chaque pixel.
Il doit choisir la bonne interaction.
La réponse devient un logiciel temporaire
Un paragraphe explique.
Une interface permet de manipuler.
Cette différence est utile.
Si je demande comment fonctionnent les intérêts composés, une explication correcte aide. Un slider qui permet de modifier la durée, le taux et la contribution mensuelle peut rendre la relation évidente. Si je demande comment fonctionne une transmission à sept vitesses, des boutons qui isolent la chaîne, la cassette, le dérailleur et la manette peuvent réduire la charge cognitive d'une longue description.
Le produit ne génère plus seulement de l'information.
Il génère le plus petit morceau de logiciel nécessaire pour travailler avec cette information.
Parfois, ce logiciel vivra trente secondes.
C'est suffisant.
La plupart des gens n'ont pas besoin de sauvegarder, déployer, maintenir et habiller chaque calculateur, tableau comparatif, chronologie ou simulateur qu'ils utilisent. Ils ont besoin d'un outil pour la décision qui se trouve devant eux. Une interface jetable peut être plus adaptée qu'une application permanente.
C'est pour cela qu'Intelligent UI est plus important qu'un rafraîchissement visuel.
L'unité de sortie de l'IA n'est plus le message, mais l'interaction.
Une erreur élégante reste une erreur
Le danger, c'est que les interfaces font autorité.
Un paragraphe peut exprimer un doute.
Un calculateur possède une case de résultat.
Un graphique a des axes.
Un tableau comparatif met un gagnant en évidence.
Un formulaire propose un bouton qui demande à être pressé.
Le design transforme l'interprétation du modèle en structure. Il décide quelles options sont visibles, quels choix sont présélectionnés, quel chiffre est mis en avant et quelle action paraît être la prochaine étape logique.
Si la réponse sous-jacente est fausse, l'interface peut rendre l'erreur plus facile à utiliser.
Prenons l'exemple du calculateur d'épargne retraite donné par OpenAI. Distingue-t-il les rendements nominaux des rendements corrigés de l'inflation ? Intègre-t-il les frais et la fiscalité ? Que se passe-t-il si l'utilisateur entre une valeur impossible ? L'hypothèse de croissance apparaît-elle à côté du résultat, ou se cache-t-elle derrière un réglage ? L'utilisateur voit-il qu'il s'agit d'une illustration plutôt que d'un conseil financier ?
Ce ne sont pas des questions cosmétiques.
Ce sont des questions de qualité de réponse.
La même logique vaut pour une carte de voyage construite sur des horaires périmés, un schéma médical qui simplifie une exception importante, ou une comparaison qui choisit discrètement les critères permettant à un produit de gagner.
Quand le modèle génère l'interface, le jugement UX devient une partie de la fiabilité factuelle.
L'interface générée a besoin d'une couche de preuves
Chaque interface générée devrait pouvoir répondre à cinq questions ennuyeuses.
Quelles données ont produit ce résultat ?
Quelles hypothèses le modèle a-t-il faites ?
Qu'est-ce qui a changé quand j'ai manipulé ce contrôle ?
Quel état sera conservé ?
Puis-je reproduire ou partager le résultat exact ?
Cette dernière question est facile à sous-estimer.
Le logiciel traditionnel possède des versions. Un tableur peut conserver les formules et les entrées. Un dashboard peut enregistrer une requête et son heure d'actualisation. Une application web publiée a une URL, un déploiement et une révision de code.
Une interface générée dans un chat peut être différente à chaque fois. À partir de la même demande, le modèle peut choisir une autre mise en page, d'autres contrôles, d'autres valeurs par défaut ou une autre explication. OpenAI explique aussi que GPT-6 peut commencer à répondre pendant qu'il continue de réfléchir, en ajoutant progressivement des informations au lieu d'attendre la réponse complète.
Cela peut sembler plus rapide.
Cela signifie aussi que l'objet à l'écran peut évoluer pendant que l'utilisateur le lit et le manipule.
Pour une recette, c'est surtout agaçant.
Pour un modèle financier, une explication médicale, une comparaison réglementaire ou une décision professionnelle, cela crée un problème de traçabilité.
Le produit devrait conserver le prompt, la version du modèle, l'ensemble des sources, l'arbre de composants généré, les entrées, les hypothèses, l'état d'interaction et le résultat final. Partager la réponse devrait partager l'état qui lui donnait son sens, pas seulement une capture du dernier écran.
L'interface a besoin d'un reçu.
Ce n'est pas la même chose que construire une application
Il faut garder les catégories claires.
Anthropic décrit les Artifacts comme des contenus autonomes que l'utilisateur peut modifier, versionner, réutiliser, publier et remixer. Canvas dans Google AI Mode permet d'inspecter le code généré et d'améliorer un outil au fil du temps. Ce sont des environnements de création.
L'annonce d'OpenAI est plus étroite. Intelligent UI est une fonctionnalité de l'onglet Chat de ChatGPT. Elle n'annonce ni plateforme publique de création d'interfaces, ni format d'export, ni stockage persistant, ni déploiement vers des services tiers, ni moyen de publier chaque réponse générée comme une application indépendante. OpenAI précise aussi que les modèles derrière Work et Codex ne changent pas avec ce déploiement.
Cette frontière est saine.
Une interface de la taille d'une réponse et une application maintenue n'ont pas le même métier.
La première doit être immédiate, légère et jetable.
La seconde a besoin d'un propriétaire, de tests, de permissions, d'une revue d'accessibilité, de gouvernance des données, de gestion des changements et de support.
Les ennuis commencent quand une interface temporaire devient discrètement une infrastructure opérationnelle parce qu'elle était pratique et avait l'air terminée.
Une interface très bien finie n'est pas pour autant maintenue.
L'interface est aussi une surface commerciale
OpenAI a annoncé la publicité visuelle dans ChatGPT deux jours avant Intelligent UI.
L'entreprise affirme que les publicités seront labellisées, visuellement séparées des réponses et sans influence sur la réponse elle-même. Gardez cette frontière.
Les interfaces générées créent davantage d'endroits où un choix commercial peut devenir difficile à distinguer d'un choix produit. Un planificateur de voyage peut mettre un hôtel en avant. Un comparateur shopping peut choisir un réglage par défaut. Un calculateur financier peut placer une action partenaire à côté du résultat. Un bouton généré peut sembler être la conclusion logique de l'analyse même s'il mène à une relation commerciale.
Le problème n'est pas que chaque bouton soit une publicité.
Le problème est qu'une interface générée réunit explication, recommandation et action sur une même surface.
Cela rend la provenance plus importante, pas moins.
L'utilisateur devrait pouvoir voir quels éléments viennent du modèle, lesquels viennent des données sources, lesquels sont des placements payants, lesquels se connectent à des services externes et quelles informations quittent la conversation lors d'une interaction.
L'interface ne peut pas être à la fois la mention légale et l'outil de persuasion.
Ce qu'il me faudrait pour lui faire confiance
D'abord, un mode texte brut.
Parfois, la meilleure interface reste un paragraphe. L'utilisateur devrait pouvoir désactiver les interfaces générées globalement ou réponse par réponse, surtout lorsqu'elles distraient, sont inaccessibles ou plus difficiles à vérifier.
Ensuite, les hypothèses et sources visibles dans le composant qui les utilise.
Une liste de citations sous le chat ne suffit pas si le graphique, le calculateur ou le comparateur masque quelle source alimente quelle affirmation.
Troisièmement, un partage et un replay stables.
Conservez la structure des composants générés, la version du modèle, l'horodatage des données, les entrées et l'état final. Permettez au destinataire de voir ce qui a changé depuis la réponse d'origine.
Quatrièmement, l'accessibilité comme contrainte de génération.
Navigation au clavier, labels, ordre de focus, contraste, sémantique pour les lecteurs d'écran, taille des cibles tactiles, réduction des mouvements et alternatives textuelles ne peuvent pas être une finition facultative ajoutée après les choix du modèle.
Enfin, une frontière nette entre exploration et action.
Laissez l'utilisateur manipuler librement une simulation. Rendez chaque action externe importante explicite, attribuable et soumise à confirmation.
Plus l'interface paraît naturelle, plus il est facile d'oublier qu'elle a été assemblée de manière probabiliste quelques secondes plus tôt.
Le chatbot était une interface de transition
La boîte de chat vide avait du sens quand le produit principal était le langage.
Elle en a moins quand le système peut chercher, calculer, cartographier, comparer, simuler, générer des images, connecter des données, appeler des outils et préparer des actions.
Forcer chaque capacité à revenir dans un flux de prose devait forcément sembler temporaire.
Intelligent UI d'OpenAI est une réponse. L'interface générative de Google et les Artifacts d'Anthropic en sont d'autres. Les détails d'implémentation diffèrent, mais la direction est cohérente : le modèle devient un runtime qui choisit l'interface adaptée à la tâche.
Cela peut rendre le logiciel beaucoup plus accessible.
Cela peut aussi donner à chaque réponse les responsabilités d'un logiciel.
Exactitude.
État.
Provenance.
Accessibilité.
Permissions.
Reproductibilité.
La réponse devient l'application.
Il lui faut maintenant aussi les parties ennuyeuses d'une application.