Produits d'IA

OpenAI présente sa présence pour les agents IA d'entreprise

OpenAI a introduit Presence, un produit d'entreprise à disponibilité limitée pour le déploiement d'agents vocaux et de chat avec des politiques, des évaluations, des actions approuvées et une escalade humaine.

Publié Mis à jour
OpenAIAI agentsEnterprise AICustomer support

Ce qu'OpenAI a annoncé

OpenAI a annoncé Presence le 22 juillet 2026 en tant que produit déployé pour les entreprises clientes éligibles qui souhaitent utiliser des agents IA dans des flux de travail vocaux et de chat. OpenAI le décrit comme un produit destiné aux agents capables de répondre aux questions, de résoudre les problèmes, d'utiliser les systèmes d'entreprise connectés, de prendre des mesures approuvées et de confier une conversation à une personne lorsque la situation l'exige. Il ne s'agit pas d'un produit en libre-service au lancement : les déploiements sont dirigés par des ingénieurs OpenAI Forward Deployed et des intégrateurs de systèmes sélectionnés.

L'annonce est remarquable car elle se concentre moins sur un seul modèle que sur le système d'exploitation autour d'un agent. Presence combine le raisonnement modèle avec les politiques de l'entreprise, les procédures opérationnelles standard, les garde-fous, les actions approuvées, les simulations, les évaluations et les règles de remontée d'informations. L'objectif est de rendre un flux de travail spécifique suffisamment fiable pour la production tout en permettant à l'organisation de garder le contrôle sur ce qu'un agent peut accéder et faire.

Un travail restreint est le point de départ

La description d'OpenAI met l'accent sur le fait de commencer par une tâche définie, telle qu'une demande de facturation, une réclamation d'assurance ou un problème de service informatique d'un employé. Pour chaque tâche, l'agent doit recevoir uniquement les connaissances et l'accès au système nécessaires. L'entreprise décide de ses limites d'autorisation : quelles actions peuvent être effectuées automatiquement, lesquelles nécessitent une étape d'approbation et quels cas doivent être transmis à un humain.

Cette conception a une implication pratique pour les acheteurs. Un agent capable de converser naturellement n’est pas automatiquement prêt à modifier un compte, à appliquer une politique ou à prendre une décision à fort impact. Les équipes doivent séparer l'interface linguistique de la couche d'action, documenter chaque action autorisée et tester les cas dans lesquels le système doit refuser, demander plus d'informations ou escalader. Un pilote sensé a des limites mesurables : une file d'attente unique, un ensemble restreint d'intentions, des données représentatives et un propriétaire clair pour les exceptions.

L'évaluation se poursuit après le lancement

Presence présente également le déploiement d’agents comme un processus de qualité continu. Avant la sortie, les équipes peuvent utiliser des simulations et des évaluateurs pour tester les demandes de routine, les cas extrêmes et les scénarios à plus haut risque. Les vérifications indiquées incluent si l'agent a atteint le bon résultat, a suivi la politique, a utilisé correctement les outils et a fait remonter le cas échéant. Des garde-corps peuvent intervenir lorsqu’une interaction sort des limites définies.

Après la sortie, les sessions de production, les escalades et les signaux de qualité peuvent révéler les domaines dans lesquels le flux de travail doit être ajusté. OpenAI indique que Codex peut étudier ces signaux via un plugin Presence et proposer des modifications que les équipes doivent tester et approuver par rapport à la version en production. Cette boucle de rétroaction peut être précieuse, mais elle rend également la gestion du changement essentielle : conserver les politiques et les invites versionnées, évaluer les mises à jour proposées sur les cas en attente et exiger l'approbation humaine responsable avant d'étendre l'accès ou l'autonomie.

Ce que font et n'établissent pas les exemples publiés

OpenAI affirme que Presence alimente son canal d'assistance téléphonique en anglais et rapporte que le système résout 75 % des problèmes entrants sans assistance humaine ; il indique également qu'une boucle d'amélioration alimentée par le Codex a réduit les transferts humains de 15 points de pourcentage en 10 jours. BBVA, SoftBank et IAG sont décrits comme explorant ou testant des utilisations client-agent liées. Ces exemples illustrent la direction envisagée, mais ils ne constituent pas une garantie de performance universelle.

Les organisations doivent valider leur propre couverture linguistique, la résidence des données, la vérification de l'identité, la journalisation d'audit, les objectifs de fiabilité et le processus de récupération. Ils devraient également mesurer le coût des erreurs, et pas seulement leur confinement ou le temps de traitement. La question utile est de savoir si un flux de travail limité peut être rendu plus sûr, plus clair et plus utile pour les clients et les employés que le processus actuel, et non si un agent peut réaliser une démonstration convaincante.

Disponibilité et prochaines étapes pratiques

Selon OpenAI, Presence est disponible via un programme de disponibilité générale limité pour les entreprises clientes éligibles, plutôt que sous la forme d'un produit que tout le monde peut activer directement. Les organisations intéressées doivent confirmer l'éligibilité, les conditions commerciales, le support régional, la portée de l'intégration et la répartition des responsabilités entre leur propre équipe, OpenAI et tout intégrateur de systèmes.

Pour une évaluation responsable, sélectionnez un flux de travail volumineux mais réversible, mappez ses données et ses autorisations, définissez des règles de remontée d'informations avant de connecter les outils et établissez une cadence de révision pour de vraies conversations. Gardez un moyen d'interrompre rapidement les actions, de préserver les preuves d'audit et de donner aux utilisateurs un chemin simple vers un humain. Ces contrôles transforment une démonstration d'agent en un service opérationnel.