AI製品

OpenAI がエンタープライズ AI エージェントのプレゼンスを導入

OpenAI は、ポリシー、評価、承認されたアクション、人間によるエスカレーションを備えた音声およびチャット エージェントを展開するための、可用性が限定されたエンタープライズ製品である Presence を導入しました。

公開日 更新日
OpenAIAI agentsEnterprise AICustomer support

OpenAI が発表した内容

OpenAI は、2026 年 7 月 22 日に、音声およびチャット ワークフローで AI エージェントを操作したい対象となる企業顧客向けに展開される製品として Presence を発表しました。 OpenAIは、これを、質問に答え、問題を解決し、接続された企業システムを使用し、承認されたアクションを実行し、状況に応じて担当者に会話を渡すことができるエージェント向けの製品であると説明しています。これは発売時のセルフサービス製品ではありません。導入は OpenAI Forward Deployed Engineer と選ばれたシステム インテグレータによって主導されます。

この発表は、単一のモデルではなく、エージェント周辺のオペレーティング システムに重点を置いているため、注目に値します。 Presence は、モデル推論を企業ポリシー、標準操作手順、ガードレール、承認されたアクション、シミュレーション、評価、エスカレーション ルールと組み合わせます。目標は、特定のワークフローを実稼働環境に十分な信頼性を持たせながら、エージェントがアクセスして実行できる内容を組織が制御できるようにすることです。

狭いジョブが出発点です

OpenAI の説明では、請求リクエスト、保険請求、従業員の IT サービスの問題など、定義されたジョブから始めることを強調しています。各ジョブについて、エージェントは必要な知識とシステム アクセスのみを受け取る必要があります。企業は、どのアクションを自動的に実行できるか、どのアクションに承認手順が必要か、どのケースを人間に引き継がなければならないかなど、許可の境界を決定します。

そのデザインは購入者にとって実用的な意味を持ちます。自然に会話できるエージェントは、アカウントを変更したり、ポリシーを適用したり、大きな影響を与える意思決定を自動的に行う準備ができているわけではありません。チームは言語インターフェイスをアクション層から分離し、許可されているすべてのアクションを文書化し、システムが拒否するか、詳細情報を要求するか、エスカレーションする必要があるケースをテストする必要があります。賢明なパイロットには、単一のキュー、狭いインテントのセット、代表的なデータ、例外の明確な所有者など、測定可能な制限があります。

評価は発売後も継続されます

また、プレゼンスは、継続的な品質プロセスとしてエージェントの展開を示します。リリース前に、チームはシミュレーションとグレーダーを使用して、日常的なリクエスト、エッジケース、およびよりリスクの高いシナリオをテストできます。記載されているチェックには、エージェントが正しい結果に達したか、ポリシーに従っていたか、ツールを正しく使用したか、必要に応じてエスカレーションされたかどうかが含まれます。インタラクションが定義された境界の外に移動すると、ガードレールが介入することがあります。

リリース後、実稼働セッション、エスカレーション、および品質シグナルによって、ワークフローの調整が必要な箇所が明らかになる可能性があります。 OpenAI によれば、Codex は Presence プラグインを通じてこれらの信号を調査し、実稼働バージョンに対してテストして承認するための変更をチームに提案できると述べています。このフィードバック ループは貴重かもしれませんが、変更管理も不可欠になります。つまり、バージョン管理されたポリシーとプロンプトを保持し、保留されたケースについて提案された更新を評価し、アクセスや自律性を拡大する前に責任ある人間の承認を必要とすることです。

公開された例で何が行われ、何が確立されていないのか

OpenAI は、Presence が同社の英語電話サポート チャネルを強化しており、このシステムが人間の支援なしでインバウンドの問題の 75% を解決すると報告していると述べています。また、Codex を活用した改善ループにより、人による引き継ぎが 10 日間で 15 パーセント ポイント減少したとも述べています。 BBVA、SoftBank、および IAG は、関連する顧客エージェントの使用を調査またはテストしていると説明されています。これらの例は意図した方向性を示していますが、普遍的なパフォーマンスを保証するものではありません。

組織は、独自の言語範囲、データの所在地、本人確認、監査ログ、信頼性の目標、および回復プロセスを検証する必要があります。また、単に封じ込めや処理時間だけでなく、エラーのコストも測定する必要があります。有益な疑問は、限定されたワークフローを現在のプロセスよりも安全、明確、顧客や従業員にとってより有益なものにできるかどうかであり、エージェントが説得力のあるデモンストレーションを完了できるかどうかではありません。

可用性と実際的な次のステップ

OpenAI によると、Presence は誰でも直接アクティベートできる製品としてではなく、適格な企業顧客を対象とした限定的な一般提供プログラムを通じて利用可能です。関心のある組織は、資格、商業条件、地域サポート、統合範囲、および自社のチーム、OpenAI、およびシステム インテグレータの間での責任分担を確認する必要があります。

責任ある評価を行うには、大量だが可逆的なワークフローを 1 つ選択し、そのデータと権限をマッピングし、ツールを接続する前にエスカレーション ルールを定義し、実際の会話のレビュー頻度を確立します。アクションを迅速に一時停止し、監査証拠を保存し、ユーザーに人間への直接的なルートを提供する方法を確保してください。これらの制御により、エージェントのデモンストレーションが運用サービスに変わります。