OpenAI Dots : des agents ChatGPT actifs en continu

OpenAI Dots : des agents ChatGPT actifs en continu

OpenAI veut que ChatGPT cesse d'attendre la prochaine requête. Lors de sa conférence pour développeurs DevDay, le 29 septembre, l'entreprise a présenté Dots, un ensemble d'agents IA actifs en permanence au sein de ChatGPT. Chacun fonctionne sur son propre ordinateur dans le cloud et peut continuer à poursuivre ses objectifs sans recevoir d'instructions à chaque étape.

Le principe est simple : au lieu d'échanger des messages une demande après l'autre, l'utilisateur confie un objectif à un agent et le laisse faire avancer le travail. L'agent peut mener plusieurs projets de front, apprendre les préférences de son propriétaire à partir de ses retours et, selon OpenAI, livrer parfois un travail avant même que quiconque l'ait demandé.

Comment fonctionne Dots

Les agents reposent sur GPT-6 Astra, le modèle le plus avancé d'OpenAI à ce jour. Chaque agent dispose d'un ordinateur dédié dans le cloud, que l'utilisateur peut ouvrir à tout moment pour voir ce que fait l'agent. Cette transparence compte pour un système censé agir de manière autonome.

Grâce aux plugins d'OpenAI, les agents peuvent accéder à plus de 4 000 applications. Avec l'autorisation de son propriétaire, un agent peut aussi travailler directement sur son ordinateur portable, et pas seulement sur sa machine dans le cloud.

Les utilisateurs peuvent échanger avec leur agent à plusieurs endroits :

  • ChatGPT sur ordinateur, sur le web ou sur mobile, par message ou par appel vocal
  • Slack
  • Microsoft Teams

Le contexte suit l'agent d'un canal à l'autre. Un projet lancé dans ChatGPT peut passer à une équipe sur Slack sans que personne n'ait à briefer de nouveau l'agent. En cours de route, les agents envoient des points d'avancement et posent des questions à leurs propriétaires.

Premiers usages chez OpenAI et ailleurs

OpenAI indique que ses propres équipes utilisent déjà les agents. Lorsqu'un bug est signalé sur le Slack de l'entreprise, les agents se mettent immédiatement à enquêter. Les nouvelles maquettes sont transformées en applications fonctionnelles, ce qui permet aux équipes de se concentrer sur les retours des clients.

Un testeur externe donne un exemple plus modeste. Il avait oublié de facturer une publication. Son agent s'en est aperçu, a préparé la facture et l'a gardée en attente jusqu'à ce qu'il en approuve l'envoi.

Une recherche proactive, mais encadrée

Lorsqu'un agent n'a aucune tâche assignée, il cherche des moyens de se rendre utile. OpenAI appelle cela la recherche proactive. Dans ce mode, les connexions de l'agent aux applications de son propriétaire sont en lecture seule. Il peut consulter, mais ne peut ni envoyer de messages ni modifier quoi que ce soit.

D'autres garde-fous sont placés autour de l'agent plutôt qu'en son sein. Toute action susceptible de toucher aux comptes d'un utilisateur ou de partager des informations doit passer un contrôle baptisé auto-review. Un système de surveillance distinct peut mettre en pause ou arrêter un agent s'il soulève un problème de sécurité. OpenAI est également franc sur les limites : l'entreprise invite les utilisateurs à vérifier les travaux importants, car les agents "peuvent encore faire des erreurs".

Des agents spécialisés pour les entreprises

OpenAI a aussi présenté en avant-première des agents spécialisés. Un employeur les configure avec leur propre identité et leurs propres identifiants pour une mission précise. Chez OpenAI, les missions testées comprenaient les achats et le traitement des factures.

Les clients commencent par des projets pilotes ciblés, au cours desquels des ingénieurs d'OpenAI aident à définir le périmètre de chaque agent. Microsoft travaille avec OpenAI pour que ces agents puissent être gérés via les contrôles de gouvernance et de sécurité d'Agent 365, le produit de Microsoft destiné à superviser les agents en entreprise.

La concurrence de Meta

Avec Dots, OpenAI entre en concurrence directe avec Meta Platforms, qui a lancé son agent personnel Muse aux États-Unis le 8 septembre. Muse fonctionne lui aussi sur un ordinateur dédié dans le cloud. Meta affirme que la plupart des usages sont gratuits, avec des abonnements pour les utilisateurs les plus intensifs.

Disponibilité et tarifs

Le déploiement de Dots a commencé le 29 septembre pour les abonnés ChatGPT Pro et Business Premium, même si certains comptes devront patienter plusieurs jours. Les abonnés Pro de l'Espace économique européen (l'UE plus l'Islande, le Liechtenstein et la Norvège), de Suisse et du Royaume-Uni en sont exclus pour l'instant. Les clients Enterprise, y compris ceux des offres Edu et Healthcare, peuvent tester une bêta dès qu'un administrateur de l'espace de travail l'active.

Un agent est inclus sans surcoût dans les forfaits Pro et Business Premium. Selon la documentation d'aide d'OpenAI, l'utilisation des agents ne sera pas décomptée des quotas du forfait pendant le premier mois ; les conditions propres à chaque forfait s'appliqueront ensuite. Des agents supplémentaires, ainsi que davantage de vitesse ou de capacité mensuelle pour les agents existants, sont prévus plus tard. OpenAI n'a pas communiqué de prix.

Notre analyse

Dots tient moins d'un nouveau modèle que d'un nouveau mode de fonctionnement : des agents qui persistent, conservent le contexte d'un outil à l'autre et agissent sans qu'on les sollicite. Ce changement fait monter les enjeux. Un agent qui répond à des questions peut vous induire en erreur ; un agent connecté à 4 000 applications, avec un accès à votre ordinateur portable et une présence sur Slack, peut agir sur la base de cette erreur.

OpenAI semble en avoir conscience. La conception place plusieurs contrôles en dehors du modèle : un accès en lecture seule pendant la recherche proactive, un filtre auto-review pour les actions sensibles, un système de surveillance capable d'arrêter un agent et un ordinateur dans le cloud que les utilisateurs peuvent inspecter. Cela laisse penser que l'entreprise traite le comportement du modèle et les autorisations du système comme des couches de défense distinctes, ce qui est le bon réflexe. Reste à savoir si l'auto-review résistera aux injections de prompt arrivant par les applications connectées, et il faudra suivre de près la manière dont les testeurs indépendants le mettront à l'épreuve.

Les tarifs et le calendrier de déploiement sont eux aussi révélateurs. Commencer par les offres haut de gamme, exclure l'Europe et repousser l'annonce des prix traduit un lancement prudent, contraint par les capacités. Cela s'inscrit aussi dans l'effort plus large d'OpenAI sur les coûts, visible dans ses travaux sur des modèles moins chers qui se rapprochent d'Astra. Pour que les agents actifs en continu touchent davantage d'utilisateurs, les faire tourner à moindre coût comptera autant que leurs capacités.

Pour les lecteurs, le choix se précise. Les agents hébergés dans le cloud par OpenAI et Meta offrent praticité et portée. D'autres préféreront des agents de programmation locaux tournant sur leur propre GPU, en sacrifiant des capacités au profit du contrôle. Prochaines étapes à surveiller : les tarifs après la période d'essai, le calendrier du lancement européen et la manière dont les entreprises encadreront des agents spécialisés dotés de leurs propres identifiants.