研究者1万人が最先端モデルを無料で業務研究に活用可能にリポジトリを素早くスキャンしセキュリティ問題を追跡できますHugging Faceインシデントの安全レビュー結果を技術報告で共有予定Opus 5が全有料プランとAPIで即利用可能に音声だけでPC操作やエージェント連携ができるようになります健康記録を安全に連携し、症状変化や検査結果を文脈で把握できます企業向け信頼エージェントを即展開できますノートにコードを入れて調べ物と分析を一つにできますGPT-Redでプロンプトインジェクション耐性が大幅向上授業準備をAIで短くしやすくなります会話から資料作成まで、仕事をひと通り速く進めやすくなりますブラウザだけでAI推論を動かして待ち時間を減らせますClaudeの使い方を振り返って無駄を減らせます長い作業を下書きから資料化まで一気に進めやすくなります大きくなるモデルの安全確認ルールを最新版で追えます危険な使い方の判定基準を共有し、安全対策を見直しやすくなります日常業務の多段階作業を安価に自動化しやすくなりますClaudeをAWS経由で導入しやすくなります研究資料と解析作業を一つの作業台に集めやすくなります日常のコード作業をClaudeに広く任せやすくなります研究者1万人が最先端モデルを無料で業務研究に活用可能にリポジトリを素早くスキャンしセキュリティ問題を追跡できますHugging Faceインシデントの安全レビュー結果を技術報告で共有予定Opus 5が全有料プランとAPIで即利用可能に音声だけでPC操作やエージェント連携ができるようになります健康記録を安全に連携し、症状変化や検査結果を文脈で把握できます企業向け信頼エージェントを即展開できますノートにコードを入れて調べ物と分析を一つにできますGPT-Redでプロンプトインジェクション耐性が大幅向上授業準備をAIで短くしやすくなります会話から資料作成まで、仕事をひと通り速く進めやすくなりますブラウザだけでAI推論を動かして待ち時間を減らせますClaudeの使い方を振り返って無駄を減らせます長い作業を下書きから資料化まで一気に進めやすくなります大きくなるモデルの安全確認ルールを最新版で追えます危険な使い方の判定基準を共有し、安全対策を見直しやすくなります日常業務の多段階作業を安価に自動化しやすくなりますClaudeをAWS経由で導入しやすくなります研究資料と解析作業を一つの作業台に集めやすくなります日常のコード作業をClaudeに広く任せやすくなります
公式発表のみ掲載。噂・リーク・情報商材は除外します。
← トップに戻る
AI要約OpenAI機能アップデート23:57

AIが複数ソースを照合して要約

Responses APIと推論保持・圧縮でベンチマークスコアが3倍になります

API開発者はResponses APIと推論保持設定でモデル性能を効率的に高められます。

参照確認

参照ソース 2

確認済み

参照ソース

要点整理

  • 1Responses API使用で推論保持が可能
  • 2コンテキスト圧縮によりトークン効率向上
  • 3ARC-AGI-3スコア188%向上を実証

OpenAIはARC-AGI-3ベンチマークで、Responses APIを使い推論を保持しコンテキストを圧縮する設定を適用しました。これによりGPT-5.6 Solのスコアが188%向上し、出力トークンも6分の1に減りました。標準ハーネスでは推論が破棄されコンテキストが埋まると以前の学習が失われていましたが、この変更でモデルが蓄積した知識を活かせます。API開発者は自社製品と同じ設定を採用することで実運用性能を高められます。

何が起きたか

OpenAIがARC-AGI-3ベンチマークのハーネスをResponses APIに切り替え、推論保持とコンテキスト圧縮を有効化しました。これによりGPT-5.6 Solのスコアが大幅に向上しました。

影響

APIユーザーは同じ設定を採用することで、長期エージェントタスクでの性能向上とトークン削減が期待できます。ベンチマーク結果が設定依存である点も明らかになりました。

hayamiの重要度メモ

公式X投稿とブログリンクありで実務向けAPI設定の具体例を示し、開発者の再現可能性が高いためP2。