OpenAI エージェント API

2026/09/11 4:43

OpenAI エージェント API

RSS: https://news.ycombinator.com/rss

要約

Japanese Translation:

Agents API は OpenAI が管理する Codex ハーネスへのアクセスを提供し、アプリケーションが実行ロジックおよびツールの定義を担う一方で、セッション管理、オーケストレーション、コンテキストの圧縮についてはプロバイダーに依存します。このシステムは、Agent、Environment(サンドボックスまたはコンピュータ)、Session、Events/Items という 4 つの中核概念を中心に動作します。このアーキテクチャにより、エージェントは永続的なステートフルインスタンス内でコードを実行し、ファイルを編集し、MCP サーバーに接続し、アートを生成することが可能になります。また、タスクをサブエージェント(最大 4 つの同時実行)に分解したり、Webhooks を使用して一時停止されたセッションを再開したりするなど高度なワークフローを支援します。課金体系は、モデルの使用料とホスティングされたサンドボックス料金を分離していますが、プラットフォームでは現時点でデータ所在を米国のみ限定しており、Zero Data Retention ポリシーのサポートはありません。このソリューションは、インシデント対応ボット、データアナリスト、ドキュメントレビューア、GitHub イシュー調査官など多様なユースケースに対応しています。

本文

OpenAI Agents API 概要

エージェント API の基本機能

  • API メカニズム:OpenAI が管理する API を介して Codex ハーネスにアクセス可能。
  • 役割分担
    • OpenAI の担当:セッション管理、オーケストレーション、コンテキストの圧縮と回復。
    • ユーザーアプリケーションの担当:ツールの提供、実行環境の選択。
  • 実行可能な動作:コード実行、ファイル編集、MCP サーバーへの接続、画像(アート)生成など。サンドボックス内でも稼働可能。

課金構造

  • 基本原則:選択されたモデルの API レートに基づき課金される。
  • 適用レート詳細
    • OpenAI ツール:標準レート適用。
    • OpenAI 運営のサンドボックス:標準的なコンテナレート適用。

使用例とシナリオ

完全な例(OpenAI 運営サンドボックス)

  • ディレクトリツリーのスクリプト作成・実行。
  • サブエージェントによるリリースノート比較、発見事項の統合回答。

アプリケーション実装例

  • インシデント対応:アラート調査と回復操作承認のリクエスト。
  • Slack ボット:職場ツールを活用したリクエスト調査。
  • データアナリスト:只読みの SQL でデータウェアハウス質問への回答。
  • GitHub 問題調査者:バグ再現および GitHub 上の結果共有。
  • ドキュメントレビューア:ポリシースキルと専門家エージェントを用いた審査。

Agents API の構成概念

  • エージェント:モデル、指示書(インストラクション)、ツール、MCP サーバー。
  • 環境:ファイルアクセス、スキルロード、コマンド実行が可能なサンドボックスまたはコンピューター。
  • セッション:タスク処理と入力応答を行う耐久性のあるインスタンス。
  • イベントとアイテム:エージェントへの入力情報と、セッション中に生成される出力データ。

セッション全体の流れ

  1. 初期化:OpenAI 運営のサンドボックスからスタート。
  2. セットアップ:セッション作成とエージェント設定(OpenAI が環境を調達)。
  3. タスク開始:環境準備完了後、ユーザー入力で作業ターンを開始。
  4. 進捗追跡:ストリーミング出力、Webhook を使用して完了状況や追加入力要否を確認。
  5. 継続・誘導:同じセッションへ別のタスクを送信、または現在のターン間でのエージェント誘導。

OpenAI 運営セッションの特徴:アプリケーションが入力を送信・イベントを受け取り、OpenAI がエージェント実行とサンドボックス管理を担当します。環境オプションで設定と制限を確認してください。

マネージド Codex ハーネスのサポート機能

  • コマンドおよびコードの実行(サンドボックス内)。
  • 関連スキルと指示書の適用。
  • 外部データへの接続(ツールまたは MCP 経由)。
  • アクション中ステアリング:エージェントが動作している間の誘導。
  • コンテキスト管理:前回の作業サマライズによるコンテキストウィンドウ制御。
  • タスク分割:サブタスクへの分解とサブエージェントへの委任。
  • 再開機能:中断したセッションの再開。

セットアップとコード例

前提条件:API キー権限と SDK のセットアップについては、クイックスタートの要件を確認してください。セッション作成時に以下の設定を行います。

from openai import OpenAI

client = OpenAI()

session = client.beta.agents.sessions.create(
    agent={
        "model": "gpt-6-astra",
        "instructions": "OpenAI ドキュメント MCP およびウェブ検索を活用して、技術的な質問に正確に答えてください。独立した調査タスクは、必要であればサブエージェントへ委任してください。",
        "tools": [
            {"type": "programmatic_tool_calling"},
            {
                "type": "mcp",
                "server_label": "openai_docs",
                "transport": {
                    "type": "http",
                    "server_url": "https://developers.openai.com/mcp",
                },
            },
            {"type": "web_search"},
        ],
        "multi_agent": {"enabled": True, "max_concurrent_subagents": 4},
    },
    environment={
        "type": "self_hosted",
        "workspace_directory": "/workspace",
        "capability_directories": ["/workspace/capabilities/skills"],
    },
    input=[
        {
            "role": "user",
            "content": [
                {
                    "type": "input_text",
                    "text": "MCP サーバーを OpenAI エージェントに接続する方法、最新アップデートの有無、推奨されるセットアップのサマリーを作成してください。",
                }
            ],
        }
    ],
)

print(session.id)

制限事項と注意事項

  • 継続性:Agents API はセッションステートを保持するため、会話コンテキストを再構築せずにターンを超えて作業を継続できます。不要になった場合は、セッションと公開されたアートを削除可能。
  • データ所在地:現在は米国のみでサポートされています。
  • ZDR サポートゼロデータリテンション(ZDR)はサポートされていません。自己管理型サンドボックスを選択した場合でも、Agents API は ZDR に準拠しません。詳細は OpenAI プラットフォームの「データコントロール」をご参照ください。

同じ日のほかのニュース

一覧に戻る →

2026/09/11 0:29

Cognition が新たな SWE-2 モデルを発表。Fable 5.1 や GPT-Astra と競合する性能を誇ります。

## Japanese Translation: Cognition は、Fable 5.1 や GPT-5.6 Sol といったトップクラス競合に匹敵する最新コーディングモデルである SWE-2 を発表しました。SWE-2 は、大規模な Kimi K3 ベースモデル(パラメータ数 2.8 兆)での後学習により実現され、コストペナルティ付き報酬とファーストプリンシプルに基づくアプローチ、そして長さに基づく報酬ベースラインを採用してトレーニングを安定化させながら、多兆パラメータ領域への強化学習のスケーリングを達成しました。FrontierCode 1.1 Main では 50.0% のスコア(Fable 5.1 より僅か 1 ポイント下)を記録しながらコストは 64% 削減され、DeepSWE 1.1 では 73.0% を達成しました。単なるスコアを超え、SWE-2 は「エンジニアリング的判断」の優位性も示し、不要な迂回を避けることで初期コードエディットの中央値ステップ数を 48 から 18 に削減しました。また、モデルは安全性と信頼性を最優先しており、プロパガンダおよび検閲テストのうち 98% をパスしています。Devin Desktop と CLI 経由で即時利用可能(Web および Fusion では段階的展開中)の SWE-2 は、高パフォーマンス AI をアクセス可能な価格点で提供し、信頼性や安定性を損なうことなくソフトウェア開発サイクルの効率化を目的としています。 ## Text to translate: Cognition has introduced SWE-2, its most advanced coding model, which rivals top competitors like Fable 5.1 and GPT-5.6 Sol while offering significant efficiency gains. Achieved through post-training on the massive 2.8 trillion-parameter Kimi K3 base model, SWE-2 scales Reinforcement Learning to a multi-trillion parameter regime using cost-penalized rewards derived from first principles and a length-weighted reward baseline to stabilize training. On FrontierCode 1.1 Main, it scores 50.0% (just one point behind Fable 5.1) while being 64% cheaper; on DeepSWE 1.1, it achieves 73.0%. Beyond raw scores, SWE-2 demonstrates superior "engineering judgment," reducing the median steps to an initial code edit from 48 down to 18 by avoiding unnecessary detours. The model also prioritizes safety and reliability, passing 98% of propaganda and censorship tests. Available immediately via Devin Desktop and CLI (with rolling deployments on Web and Fusion), SWE-2 is designed to streamline software development cycles by delivering high-performance AI at an accessible price point without compromising trustworthiness or stability.

2026/09/11 6:30

米運輸安全委員会、マイアミでのボーイング767滑走路逸脱事故調査結果更新発表

## Japanese Translation: 9月6日のマイアミ国際空港におけるランウェイ逸脱事故に巻き込まれたボーイング7598貨物機からフライトレコーダーが回収され、正常に読み出されたことが、2026年9月9日に国立輸送安全委員会(NTSB)によって確認されました。アクロン航空社(Acron Aviation)のCVRからの高品質な音声および54時間以上にも及ぶフライトデータレコーダーのデータ——400以上のパラメータを記録——が確保されました。予備的分析によると、飛行機は conflicting なパイロットによる離陸再行(ゴーアラウンド)指令を受けながら、危険に甚だしい速度(ノーズギア158ノット)で接地しており、スピードブレーキやスラストリバーサの展開はされていなかったとのことです。現時点での記録は同期されていませんが、ワシントンDCのNTSBチームによって書面による要約が作成され、フラップ調整、オートパイロットの離脱、地形警告など特定の行動を含む事件の経過を明確にします。詳細なコックピット会話とデータパラメータのタイムラインは、専用調査ウェブページで確認できます。あるいは24時間365日の対応オペレーションセンター(1-844-373-9922)にお問い合わせいただくことも可能です。すべての所見は、公式要約が確定するまで予備的なものとされています。

2026/09/11 0:29

火星用に開発されたNASAの色彩トリックが、今や地球で岩壁画を解読する役割を果たすことになった

## Japanese Translation: 考古学者のジョン・ハーマンは、NASA の decorrelation stretch 手法を応用して古代岩絵の研究を行ないました。この手法は当初、JPL で 1978 年にジム・ソーハによってリモートセンシング画像の強化のために開発され、後にロナルド・アレイによって速度と精度の向上を目的として 1996 年に改良されました。ハーマンはこの研究成果に基づき、数学および医療イメージングの背景を応用し、Karhunen–Loève 変換定理に基づく Dstretch プラグインを開発しました。このソフトウェアは単なるコントラストの引き上げではなく、色彩を拡張された範囲へマッピングします。Dstretch を用いることで、研究者たちは複数の遺跡において以前は目に見えなかった図像を発見しました:カリフォルニア州バイアのカベ・デ・サン・ボルヒタスで新たな黄色の図像が確認され、カンボジアのアングルワット周辺で 200 点以上の色あせた絵画が発見されています。エジプトのベニハッサンではコウモリや豚の画像が、カナダ・アルバーツアのライティングオンストーン州立公園ではクロ族の戦士による初期のグラフィティと解釈される馬と騎士を描いたピクトグラフが、ノルウェーのアールサンド 1 遺跡では新たに約 15 点の図像に加え、28 点で新たな詳細が浮き彫りになりました。このプラグインのカスタムカラー空間は岩絵のイメージングに特に有用であることが実証されています。火星イメージングの強化に元々使用された既確立のリモートセンシング手法を適用することで、Dstretch は低コントラストの写真に対して侵襲のないデジタルアクセスを提供し、世界中の隠れた芸術作品の解明に貢献しています。