OpenAIが9月10日、長時間動き続けるAIエージェントを組むための「Agents API」をパブリックベータとして全開発者に公開しました。中身はCodexやChatGPTを支えてきたハーネスと実行基盤をそのまま外に出したもので、タスク、モデル、ツール、実行環境の4つを指定するだけで本番運用に耐えるエージェントを作れるとしています。追加の利用料は設定されず、費用はトークンとツールの実費だけです。
自作をやめてよくなったのは「配管」の部分
エージェントを実際に動かそうとすると、モデルの呼び出しそのものより周辺の仕組みで手が止まります。会話の文脈が上限に達したときの詰め直し、増えすぎたツール定義の管理、途中成果物を置いておく作業領域、数時間単位で落ちずに走り続けるセッション管理。こうした配管を各社がそれぞれ書いてきました。
今回のAgents APIは、その配管をOpenAI側が運用・保守する形にまとめたものです。既存の選択肢との違いははっきりしていて、Agents SDKは開発者のアプリケーション内でハーネスが動き、Responses APIは進行の管理を自分で書く必要があります。Agents APIはその層をまるごと預ける代わりに、ツールと知識と業務の流れという、アプリケーション固有の部分に集中できる設計です。
文脈の詰め直しとツール検索
ハーネス側の改良として説明されているのが3点あります。
1つめは文脈の自動圧縮です。セッションが文脈の上限に近づくと、続きに必要な情報を残しながら前半を自動で圧縮します。複数の文脈ウィンドウをまたぐ作業を、圧縮処理を自前で実装せずに組めるようになります。
2つめはツール検索です。すべてのツール定義を最初に読み込ませるのではなく、必要になった時点で関連する定義だけを読み込みます。トークン消費と費用を抑えつつ、モデル側のキャッシュを壊さない点が要点として挙げられています。
3つめはプログラム的なツール呼び出しです。複数の呼び出しを並列で走らせ、関連する処理を数珠つなぎにし、結果の絞り込みや結合をコード側で済ませてから文脈に戻せます。大量のデータを扱っても、必要な結果だけを持ち帰る形になります。ツールはMCP、独自関数、web検索などの組み込みツールに対応します。
サブエージェントは並列、文脈は別々
複雑な仕事を独立した単位に割り、サブエージェントへ委譲して並列に走らせる機能も入りました。各サブエージェントは自分だけの文脈を持ち、担当範囲から逸れにくくなります。親エージェントは全体を調整して結果をまとめる役です。同時実行数は設定で制御でき、リサーチや分析、コーディングのように分割が効く作業で所要時間を縮められます。
ここは注意して読みたいところで、並列化が縮めるのは待ち時間であって、推論の総量ではありません。3本を同時に走らせれば時間は3分の1に近づきますが、消費されるトークンはおおむね3本分のままです。
実行環境は自分で選ぶ
エージェントがコードを実行したりファイルを扱ったりする場所は、開発者が選びます。OpenAIが提供・管理するホスト型サンドボックス、自社のインフラ、そしてエコシステム側の事業者の3択です。連携先として名前が挙がっているのはBlaxel、Cloudflare、Daytona、DigitalOcean、E2B、Modal、Oracle、Runloop、Vercelの9社で、VPC内への展開、ファイルや秘密情報の保管方式、CPUやGPUやメモリの構成、コールドスタートや費用の特性といった軸で選び分けられます。
ホスト型サンドボックスはCodexやChatGPTと同じ基盤で、ファイルやパッケージ、スキル、プラグインを載せて構成できます。ハーネスと実行環境を分けて考えられる構造になっているのが、この設計の実質的な中身です。
先行事例で示された数字
OpenAIが挙げた導入例では、Ciridaeが評価スコアを0.71から0.85へ引き上げ、標準で備わるサブエージェント機能によって遅延を4分の1に短縮したとしています。SafetyKitは案件レビューの処理を移した結果、1件あたりの費用が60パーセント下がったと報告しました。Hyphaはハーネスと実行環境を切り離したことで、失敗した応答が86パーセント減ったとしています。
ハーネスはオープンソースのCodexハーネスが土台で、公開されたコードから中核の処理を読めます。運用と保守はOpenAIが担う一方、モデルの呼び出しやツール、文脈をどう調整しているのかを開発者が確認できる構成です。
検討する前に確かめたい制約
現時点での制約も明示されています。データの所在地は米国のみで、ゼロデータリテンションには対応していません。これは自社インフラ側でサンドボックスを動かす場合も同じです。規制の厳しい業務でそのまま採用できるかは、この2点を先に確認する必要があります。
費用の考え方にも触れておきます。Agents API自体に追加料金は乗らず、支払うのはトークンとツールの実費、そしてホスト型サンドボックスを使う場合のコンテナ稼働分です。ただし数時間から数日にわたって走り続ける前提の仕組みである以上、トークン消費は積み上がります。配管を外注できた分の開発工数と、走らせ続ける実費を並べて見る必要があるでしょう。
なお、パブリックベータの位置づけで、OpenAIは一般提供に向けて利用者の声を見ながら速く回していくとしています。仕様が動く前提で触り始めるのが無難です。
まとめ
OpenAIは9月10日、CodexとChatGPTを支えてきたハーネスと実行基盤を「Agents API」としてパブリックベータで公開しました。文脈の自動圧縮、必要時に読み込むツール検索、並列で走るサブエージェント、そして9社のパートナーを含む実行環境の選択肢が、1回のAPI呼び出しの裏側にまとまっています。追加料金がない一方、米国限定のデータ所在地とゼロデータリテンション非対応という制約が残るため、扱う情報の性質から先に判断するのが現実的です。
※サムネイル画像はAI生成のイメージです
