Résumé :
Dès que Meta's Muse est devenu populaire, les produits concurrents d'OpenAI sont arrivés.
Tôt le matin du 30 septembre, heure de Pékin, OpenAI a lancé l'agent intelligent tout temps Dots lors de la conférence des développeurs. Les utilisateurs peuvent créer leur propre point directement dans la page Web ChatGPT et le laisser utiliser l'ordinateur cloud pour naviguer sur le Web, appeler des applications et gérer plusieurs tâches en même temps ; il peut continuer à fonctionner après avoir quitté la fenêtre de discussion et revenir vers vous lorsqu'il rencontre des éléments nécessitant une confirmation.
La conférence a également apporté un espace collaboratif, ChatGPT Space, permettant aux membres de l'équipe et à l'IA de travailler ensemble sur des projets ; le nouveau modèle GPT-6.1 Sol se concentre sur la rentabilité. OpenAI affirme que ses capacités sont proches de celles du produit phare Astra, et que les prix d'entrée et de sortie de l'API standard représentent environ un cinquième de ces derniers.
L'outil de programmation Codex a également été mis à jour : l'environnement de travail cloud peut être utilisé à plusieurs reprises et les utilisateurs peuvent toujours continuer à avancer dans les tâches d'origine lors du changement d'appareil. Avec le nouveau forfait Pro mensuel de 500 $, OpenAI a cette fois mis à jour son assistant personnel, son bureau d'équipe et ses outils de développement.

01 Dots : confiez continuellement une tâche à l'IA
Les tâches répertoriées par OpenAI pour Dots incluent la surveillance des rapports de pannes entrants, les tests de correctifs ou la découverte des raisons pour lesquelles l'application ralentit. Pendant qu'il gère ces tâches, les utilisateurs peuvent également signaler de nouvelles choses sans avoir à ouvrir une fenêtre de discussion distincte pour chaque projet.

Dans la vidéo promotionnelle d'ouverture, un Dot nommé Alfred a déjà commencé à s'occuper de ces tâches pour les utilisateurs : mettre à jour les présentations du tableau en fonction des données nouvellement reçues, trier les informations du soir et rappeler les questions urgentes avant d'aller travailler. Le fournisseur de gâteaux de mariage a temporairement annulé la commande. Il a trouvé des alternatives et a laissé les utilisateurs décider quand les essayer.
Dans le film, l'utilisateur vérifie le nouveau design du site Web et demande à échanger deux photos et à confirmer avant de publier ; les documents du tableau sont prêts et peuvent être modifiés avant d'être envoyés à l'équipe.
Dot conserve l'arrière-plan de la tâche précédente, afin que les utilisateurs n'aient pas à l'expliquer depuis le début à chaque fois.

Powering Dots est le GPT-6 Astra publié. Dot peut utiliser les applications auxquelles l'utilisateur s'est connecté ; après avoir obtenu l'autorisation, il peut également se connecter à l'ordinateur de l'utilisateur.
Le PDG Sam Altman a cité une tâche plus longue : migrer l'application avant que l'ancienne API ne soit retirée. Selon la société, Dot suivra les dépendances, identifiera les zones qui nécessitent des modifications, rédigera du code, exécutera des tests et enfin soumettra une modification de code pour examen humain.
Holly Li, employée d'OpenAI, a fait une démonstration en direct de l'application musicale fictive Blossom Music. Son Dot s'appelle Dotty et elle peut accéder à Slack et mobiliser le Codex. Lorsque l'application est sur le point d'être mise en ligne, Dotty suivra les ajustements du calendrier et les commentaires des utilisateurs, et enverra les conceptions qui nécessitent son examen.
La démonstration vocale n'était pas aussi fluide que la vidéo promotionnelle.
Holly a simulé une question sur la situation du test utilisateur de la nuit précédente alors qu'elle se rendait au travail. Dotty a répondu qu'elle le cherchait, mais elle n'a toujours pas donné la réponse attendue. Elle a ensuite modifié ses instructions et a demandé à Dotty de mettre les informations pertinentes sur la page. Une autre démo demandant au Codex de créer une application a également rencontré une erreur. Elle a expliqué la situation sur scène et a continué à attendre que la tâche soit exécutée.
Holly a également présenté un cas d'utilisation interne d'OpenAI : quelqu'un a envoyé l'ID de session et le problème de l'utilisateur au canal de commentaires, et Dot d'un ingénieur a reçu l'indice et a soumis le code de réparation. Les ingénieurs d'OpenAI font déjà en sorte que leurs Dots résolvent des dizaines de problèmes logiciels chaque jour, a-t-elle déclaré.

En plus de ChatGPT, les utilisateurs peuvent également contacter Dot via Slack et Microsoft Teams, et peuvent également passer des appels vocaux avec ChatGPT. OpenAI prévoit également d'ajouter la communication par SMS, permettant aux utilisateurs d'utiliser des messages texte pour expliquer des choses, recevoir des progrès ou exprimer leur position sur une décision.
La quantité d'informations accessibles et les outils pouvant être utilisés sont déterminés par l'autorisation de l'utilisateur. Dots respecte les autorisations d'accès des applications connectées et les utilisateurs peuvent spécifier comment il fait les choses avec des instructions personnalisées.
La recherche active en arrière-plan est en lecture seule par défaut et vous ne pouvez pas l'utiliser pour envoyer des messages, modifier du contenu ou contrôler des appareils ; il y a un examen automatique lors de l'exécution d'opérations, et les opérations sensibles telles que la modification des mots de passe sont toujours laissées aux humains.
Dots est disponible pour les utilisateurs Pro et Business Premium qualifiés au niveau régional, tandis que les espaces de travail Enterprise, Edu et Healthcare nécessitent que les administrateurs activent la version bêta.
Le premier Dot est inclus dans l'abonnement éligible et les conversations avec celui-ci ne seront pas comptées dans le quota d'utilisation de ChatGPT ; les tâches Codex et ChatGPT Work qu'il démarre ou gère consommeront toujours le quota correspondant.
Pour les entreprises, OpenAI a également lancé un pilote de Dots professionnels. Ce type d'agent est au service de l'ensemble de l'équipe, possède sa propre identité organisationnelle, ses propres informations d'identification et autorisations système, et est responsable d'une activité claire. L'entreprise a expérimenté en interne l'approvisionnement, le traitement des factures, le marketing par courrier électronique, le support client et les contrats commerciaux et a travaillé avec les clients pour définir les responsabilités, les outils disponibles et les processus d'approbation.
OpenAI travaille avec Microsoft pour permettre à ces agents professionnels de se connecter à Microsoft Agent 365 et d'utiliser les systèmes de gestion et de sécurité existants de l'entreprise.
02 Espace ChatGPT : Les résultats sont rendus et l'équipe continue d'apporter des modifications
Le travail effectué par Dot peut être intégré au nouvel espace ChatGPT et transmis à des collègues pour examen et modification.

Space remplacera la bibliothèque d'origine des utilisateurs éligibles. Le matériel de travail de l'équipe est placé dans Page. Une page peut contenir du texte, des images, des tableaux, des graphiques interactifs et des outils.
Les membres peuvent modifier ensemble, ou ils peuvent @ChatGPT ou Dot dans les commentaires pour vérifier les dépendances, ajouter du contenu et continuer à faire avancer le projet.
Pendant la démo de Blossom Music, Holly a mis les commentaires de l'équipe dans Page et a appelé Dotty pour organiser le contenu dans un graphique à barres. Les graphiques peuvent être filtrés par type de commentaires, afficher des points de données spécifiques ou être laissés à Dotty pour qu'ils soient mis à jour toutes les heures.
Lorsqu'elle a besoin de compléter des informations, elle n'a pas besoin de parcourir les messages un par un : elle peut demander à Dotty de retrouver les données de guidage utilisateur mentionnées par un ingénieur dans un message privé Slack et de les ajouter à la page ; elle peut également demander à Dotty d'inclure davantage de commentaires de sa collègue Laura.
Ces mises à jour peuvent être exécutées à plusieurs reprises selon un planning. L'utilisateur spécifie les sources à vérifier, les parties de la page à modifier et à quelle fréquence l'exécuter, et ChatGPT gère la page selon les besoins. OpenAI a également présenté en avant-première des fonctionnalités telles que des présentations partagées, permettant aux équipes et à leurs Dots respectifs de collaborer sur la modification des diapositives dans ChatGPT.

Une fois la page partagée, la visibilité des informations changera également. Les règles de partage pour les espaces de travail existants continuent de s'appliquer, les membres peuvent obtenir des autorisations d'affichage ou de modification, et les autorisations peuvent être ajustées ou révoquées. Les fichiers téléchargés directement sur la page héritent des autorisations de la page.
Mettre un lien vers un fichier externe dans Page n'accordera pas automatiquement aux collègues l'accès au fichier d'origine ; cependant, si le texte du fichier est extrait ou résumé sur la page, les personnes disposant des autorisations de page peuvent voir le contenu.
Il en va de même pour les discussions privées et les souvenirs personnels : le partage d'une Page n'ouvrira pas directement les conversations ou les souvenirs privés de l'utilisateur, mais si ChatGPT écrit les informations dans la page partagée, cette partie du contenu sera affichée aux collaborateurs.
Dans le même projet, plusieurs employés peuvent modifier la page en même temps, chacun appelant ChatGPT pour traiter le même matériel. Une fois que Dot a renvoyé les résultats, les collègues peuvent commenter, ajouter ou continuer à attribuer des tâches directement à côté des résultats. Il n’est pas nécessaire d’exposer d’abord les réponses dans la conversation privée, puis de réexpliquer les tenants et les aboutissants.
03 Sol réduit les coûts, Ultrafast améliore la vitesse et Pro a un nouveau prix de 500 $
Une fois qu'un travail est confié à un agent, il passe souvent par plusieurs séries de lectures de documents, d'outils d'appel et de modifications. OpenAI a également ajusté cette fois le prix du modèle, la vitesse de sortie et le montant de l'abonnement.
OpenAI a déclaré que les capacités du nouveau GPT-6.1 Sol sont proches de celles du GPT-6 Astra publié. Le prix standard de l'API est de 2 USD par million de jetons d'entrée et de 10 USD par million de jetons de sortie.
L'entreprise positionne Sol comme le modèle de référence dans le travail quotidien, en mettant l'accent sur la programmation, les opérations informatiques et les tâches professionnelles. À l'heure actuelle, il est entré dans ChatGPT Work, Codex et API, mais n'est pas encore entré en mode Chat normal.

Selon Bloomberg, la veille de la conférence, OpenAI a annulé le plan de publication de GPT-6.1 Astra en raison de risques de sécurité.
L'Astra Ultrafast a été lancée pour réduire le temps d'attente. Selon la documentation officielle, dans Codex, sa vitesse de génération de jetons peut être jusqu'à 8 fois supérieure à celle du mode standard, atteignant environ 300 jetons par seconde. L’exécution des outils, les tests et l’attente de réponses externes prendront toujours du temps.
Lors de la démonstration côte à côte en direct, les deux parties ont reçu la même invite. La démonstration de fusée générée par Ultrafast avait décollé, mais le mode standard n'était pas encore terminé. La version Ultrafast de GPT-6.1 Sol devrait être lancée ultérieurement.

Les modes plus rapides consommeront également du crédit plus rapidement.
Dans Codex, Ultrafast consomme le quota d'utilisation du package à un taux 8 fois supérieur au mode standard. Les utilisateurs peuvent choisir le mode vitesse en fonction des besoins de la tâche.

En termes d'abonnement, le nouveau Pro 500 est au prix de 500 USD par mois, offrant 25 fois l'utilisation de ChatGPT Plus et incluant un accès Ultrarapide.
Pro 200, qui coûte 200 USD par mois, est également ouvert à l'abonnement, mais certaines limites d'utilisation ont été réduites. Les anciens utilisateurs éligibles peuvent conserver le quota initial jusqu'au 29 octobre 2026. Il sera ajusté par la suite et les frais mensuels resteront de 200 USD.
Pour un jugement rapide, OpenAI a également lancé l'API Decisions. Le développeur propose d'abord un ensemble d'options prédéfinies, qui sont ensuite sélectionnées par le modèle Luna, éliminant ainsi le besoin de générer une réponse complète. Il convient à des tâches bien définies telles que le triage et le triage, et la société affirme que les réponses peuvent être compressées en une fraction de seconde. Cette API est initialement disponible dans un aperçu limité.
Tejal Patwardhan, responsable de la recherche post-formation chez OpenAI, a présenté sur scène que l'entreprise disposait déjà de ses propres stagiaires en recherche en IA. Elle a montré des exemples de modèles gérant des tâches juridiques, concevant des actifs de jeu, créant des tableaux de bord et remplissant des informations fiscales, et a déclaré que les modèles avaient participé à des améliorations de formation qui ont contribué à améliorer les opérations informatiques et les performances de rejet.

Selon Patwardhan, de juillet à août de cette année, le modèle a été capable d'accomplir plus d'un tiers des tâches de recherche qui devraient statistiquement prendre une journée à des humains sans intervention humaine.
Auparavant, les modèles échouaient dans la plupart des tentatives lorsqu'ils étaient confrontés à des tâches plus longues comme celle-ci.
OpenAI a également déclaré que son modèle a aidé à résoudre plus de 100 problèmes mathématiques ouverts depuis des décennies et a participé à la recherche sur de nouveaux antibiotiques, des langues anciennes et des robots de fabrication.
04 API Codex et agents : les développeurs peuvent également créer leurs propres agents
Le cadre d'orchestration partagé par Dots et Codex est responsable de la gestion du contexte, de l'appel des outils et de la planification des tâches. Les développeurs peuvent également utiliser ce framework pour créer leurs propres agents.
Lorsque Codex sera publié en mai 2025, il sera déjà capable d'effectuer des tâches dans le bac à sable du cloud.
Ce que DevDay met à jour cette fois-ci, c'est l'expérience de travail dans le cloud : les utilisateurs peuvent démarrer, suivre et transférer des tâches sur plusieurs appareils, réutiliser l'environnement de développement et quitter le travail à long terme dans le cloud.

Romain Huet, responsable des relations développeurs chez OpenAI, a montré sur scène comment lancer une grande tâche : réécrire l'intégralité du backend du projet dans Rust. Il a envoyé la tâche dans le cloud, l'a laissée continuer à s'exécuter et a ensuite présenté d'autres fonctions, prévoyant de revenir plus tard pour vérifier et transmettre.
Pour les tâches plus courtes, vous pouvez voir le processus de modification complet. Il a utilisé la ligne de commande pour demander au Codex de créer une candidature sélectionnant au hasard trois participants et a donné aux candidats sélectionnés des billets pour le prochain DevDay. Une fois la candidature générée, il a porté le nombre de participants à six, puis a sélectionné les candidats sélectionnés sur place.
Cette démonstration était initialement destinée à utiliser la voix, mais il a rencontré des difficultés pour démarrer la voix, il a donc utilisé la ligne de commande pour la compléter. Lors d'une autre démonstration, il a remis une capture d'écran de l'application au Codex et lui a demandé de vérifier les performances sur différentes tailles d'écran. L’agent a ensuite utilisé le simulateur, ouvert l’application et vérifié la fonctionnalité.
Le cadre d'orchestration Codex qui prend en charge ces opérations est open source, et les développeurs peuvent visualiser la mise en œuvre et la créer eux-mêmes.
La nouvelle API Agents intègre des fonctionnalités telles que l'utilisation de l'ordinateur, le contrôle multi-agents, l'appel d'outils et la gestion du contexte dans les services d'hébergement permettant aux développeurs d'accéder à leurs produits.
Par exemple, un agent de test de site Web peut ouvrir un navigateur, cliquer sur différentes pages et vérifier le processus de fonctionnement de l'utilisateur. OpenAI travaille également avec AWS pour fournir des fonctionnalités connexes dans les agents gérés Amazon Bedrock, permettant aux entreprises de créer des agents à côté des applications et des données existantes.
En termes de vitesse de réponse, OpenAI a également signalé que le temps d'attente pour le premier jeton de l'API avait été réduit de 45 %.
L'agent doit accéder aux informations de l'entreprise, et l'entreprise se souciera également de la manière dont ce contenu est traité. L'intelligence privée introduite par OpenAI inclut cette fois des mécanismes de confidentialité tels que la conservation zéro des données et le traitement de sécurité privée ; Private Inference, qui utilise l'informatique confidentielle, prévoit de lancer une version préliminaire cet automne.

Private Safety Processing stocke les enregistrements cryptés pertinents dans un stockage contrôlé par le client, effectue des examens de sécurité automatisés via un environnement informatique protégé et limite l'accès du personnel au contenu.
Le client conserve le contrôle du stockage et OpenAI utilise des signaux de sécurité limités pour déterminer si des mesures doivent être prises pour éviter de permettre au personnel de lire directement le contenu original lors de l'examen quotidien.
05 Le crédit de l'abonnement ChatGPT sera utilisé pour des applications tierces

Une fois que les développeurs ont créé une application, ils ont toujours besoin de personnes pour l'utiliser. OpenAI a annoncé lors de la conférence que ChatGPT compte plus de 1,2 milliard d'utilisateurs actifs hebdomadaires ; les nouvelles modalités de connexion et de distribution permettront cette fois à certains utilisateurs d'essayer plus facilement des produits tiers.
La connexion avec ChatGPT a commencé avec 16 partenaires de publication.
Les utilisateurs Plus et Pro éligibles peuvent utiliser le quota IA dans le cadre de l'abonnement ChatGPT dans les applications participantes sans fournir de clé API supplémentaire. Cette utilisation sera comptabilisée dans le quota partagé correspondant.
Les utilisateurs peuvent acheter un crédit d'appel de modèle en double de moins, mais les applications tierces peuvent toujours facturer leurs propres abonnements, infrastructures, services ou fonctionnalités premium, comme déterminé par le développeur.
Les extensions de plug-in permettent aux développeurs d'intégrer davantage d'interfaces dans ChatGPT et Codex. En plus de permettre à un modèle d'appeler un service, les utilisateurs peuvent directement ouvrir un éditeur, un tableau de bord ou un espace de travail et travailler sur des éléments parallèlement à la conversation.
Des exemples de démonstrations sur site incluent l'affichage des réunions dans le calendrier, la prise de notes dans ChatGPT, l'ouverture de fichiers de conception, l'affichage des commentaires de collègues, puis la demande à ChatGPT de les modifier. Adobe est également l'un des partenaires présentés à la conférence, et les opérations de conception peuvent être réalisées dans l'environnement de travail actuel.

ChatGPT peut également recommander des plug-ins appropriés pendant la conversation, et l'utilisateur peut décider de se connecter sur place. Les développeurs n’ont pas besoin de recommencer tout le processus de soumission lorsqu’ils postulent à une révision manuelle.
Ces plugins donnent également accès aux sites ChatGPT. Selon Altman sur scène, les utilisateurs ont créé des millions de sites Web de différents types au cours des mois qui ont suivi le lancement de Sites. Après avoir accédé au plug-in, le même site Web peut combiner des applications et des informations autorisées par différents utilisateurs pour offrir leur propre expérience utilisateur.
Les achats d'entreprise sont effectués par OpenAI Marketplace, avec 32 partenaires dans le premier lot.
Les entreprises clientes éligibles peuvent utiliser une partie de leurs engagements d'achat OpenAI existants pour des produits tiers approuvés.
Les développeurs pourront également toucher les entreprises clientes qui achètent déjà des services auprès d'OpenAI.
La conférence a également mentionné la coopération avec Baseten, qui offre aux développeurs davantage de canaux pour accéder aux modèles ouverts.
06 Muse a attiré les utilisateurs en premier, Dots a réuni l'équipe
Meta Muse, sorti le 8 septembre, fonctionne également sur une machine virtuelle dédiée, dispose d'un navigateur, peut fonctionner sur les applications connectées, mémorise les préférences de l'utilisateur et continue de travailler pour l'utilisateur.
Selon VentureBeat citant TechCrunch, Sensor Tower estime que Muse a été téléchargé plus de 3,4 millions de fois au 24 septembre. Les estimations d'autres agences varient : Apptopia donne 4,3 millions, App chiffre environ 2,3 millions. Moins de trois semaines après son lancement, Muse est en tête des classements des magasins d'applications américains d'Apple et de Google.

Meta apporte également cette chaleur sur la scène du travail. Le 29 septembre, il a étendu les intégrations pour les petites entreprises pour inclure des outils tels que Shopify, QuickBooks, Stripe et Canva. VentureBeat a cité le Wall Street Journal disant qu'environ un tiers des utilisateurs de Muse ont connecté des comptes professionnels et que plus de 1 500 entreprises ont demandé l'intégration de Muse.
Sur le site de sortie de Dots, les tâches de l'équipe ont été définies dès le début : suivre le lancement du logiciel, trier les retours des collègues, corriger les bugs et mettre à jour les pages partagées.
Les Personal Dots sont chargés de faire des choses pour les utilisateurs, Space permet à des collègues de se joindre et les pilotes professionnels de Dots confient les achats, les contrats et d'autres tâches aux agents qui servent toute l'équipe.
D'autres sociétés se disputent également un tel accès. Instinct connecte les assistants aux e-mails, aux messages et aux appareils, permettant aux utilisateurs de passer des appels téléphoniques ou d'envoyer des messages texte ; Manus 2.0 apporte de nouvelles fonctionnalités de cloud computing et d'automatisation ; Grok Bot de xAI permet également aux agents de se connecter aux applications existantes et de continuer à les exécuter ; OpenClaw permet aux utilisateurs de confier des tâches dans des services de messagerie familiers.
En plus des tâches, les utilisateurs donnent à ces assistants l'accès à leur boîte aux lettres, leur calendrier et leurs applications professionnelles. L'agent mémorise progressivement les habitudes de travail de l'utilisateur et assure le suivi du travail inachevé.
Lors du passage à un assistant, ces connexions, autorisations et antécédents de travail accumulés peuvent également devoir être migrés.
Les entreprises doivent également clarifier les autorisations des assistants personnels et des agents d'entreprise. Un employé peut disposer de ses propres données de traitement Dot, et l'équipe peut également avoir un Dot professionnel responsable des achats ; les systèmes auxquels ils peuvent accéder, l'identité de qui ils agissent et l'endroit où les résultats sont placés doivent être conformes aux règles de compte et de partage existantes.
À la fin de la conférence, Altman a déclaré qu'il espérait que l'IA apporterait une renaissance plutôt que de transformer les gens en rouages d'une machine industrielle. OpenAI espère qu'une fois que les gens auront accompli certaines de leurs tâches quotidiennes, ils pourront libérer de l'énergie pour faire des choses qu'ils n'avaient pas le temps de faire auparavant.
Actuellement, chaque utilisateur éligible recevra un Dot en premier.
OpenAI prévoit de permettre aux utilisateurs de gérer un groupe de Dots à l'avenir, mais le prix commercial spécifique pour les Dots supplémentaires et les Dots professionnels n'a pas encore été annoncé.
Commentaires