GPT-5.6 SolのAPI・クレジット価格を20%以上引き下げClaude SecurityがMythos 5でGitHubリポジトリをスキャンZero Data Retention継続とPrivate Safety Processingプレビューで安全性を強化ClaudeがGmailでメールを送信しGoogle Driveのファイルを管理できます高リスク訓練の監視を強化しRL訓練を一時停止できます承認済み防御者がGPT-5.6-Cyberで高度な脆弱性調査を進めやすくなりますサイクロン予測で1日以上の余裕を持った対策が可能になります声で話しながら推論やツールを使っても会話が途切れませんAIが長年の数学難問10件に新結果、証明書を公開GPT-5.6 LunaとTerraの価格が80%・20%下がり、高速オプションも追加されますOpus 5が全有料プランとAPIで即利用可能に健康記録を安全に連携し、症状変化や検査結果を文脈で把握できますノートにコードを入れて調べ物と分析を一つにできますGPT-Redでプロンプトインジェクション耐性が大幅向上授業準備をAIで短くしやすくなります会話から資料作成まで、仕事をひと通り速く進めやすくなりますブラウザだけでAI推論を動かして待ち時間を減らせますClaudeの使い方を振り返って無駄を減らせます長い作業を下書きから資料化まで一気に進めやすくなります大きくなるモデルの安全確認ルールを最新版で追えますGPT-5.6 SolのAPI・クレジット価格を20%以上引き下げClaude SecurityがMythos 5でGitHubリポジトリをスキャンZero Data Retention継続とPrivate Safety Processingプレビューで安全性を強化ClaudeがGmailでメールを送信しGoogle Driveのファイルを管理できます高リスク訓練の監視を強化しRL訓練を一時停止できます承認済み防御者がGPT-5.6-Cyberで高度な脆弱性調査を進めやすくなりますサイクロン予測で1日以上の余裕を持った対策が可能になります声で話しながら推論やツールを使っても会話が途切れませんAIが長年の数学難問10件に新結果、証明書を公開GPT-5.6 LunaとTerraの価格が80%・20%下がり、高速オプションも追加されますOpus 5が全有料プランとAPIで即利用可能に健康記録を安全に連携し、症状変化や検査結果を文脈で把握できますノートにコードを入れて調べ物と分析を一つにできますGPT-Redでプロンプトインジェクション耐性が大幅向上授業準備をAIで短くしやすくなります会話から資料作成まで、仕事をひと通り速く進めやすくなりますブラウザだけでAI推論を動かして待ち時間を減らせますClaudeの使い方を振り返って無駄を減らせます長い作業を下書きから資料化まで一気に進めやすくなります大きくなるモデルの安全確認ルールを最新版で追えます
公式発表のみ掲載。噂・リーク・情報商材は除外します。
← トップに戻る
AI要約OpenAIポリシー20:07

AIが複数ソースを照合して要約

OpenAI、思考連鎖制御の評価スイートを公開

AIの内部思考を監視しやすくなり、安全運用が簡単になります

参照確認

参照ソース 2

確認済み

参照ソース

要点整理

  • 1CoT-Control: 13,000タスク超のオープンソース評価
  • 2制御率0.1-15.4%、監視有効
  • 3大規模モデルで制御向上、長思考で低下

OpenAIがCoT-Controlという評価スイートを公開しました。13以上のベンチマークで13モデルをテストし、思考連鎖(CoT)を隠蔽する能力が低いことを確認。モデル規模が大きくなるほど制御しやすくなる一方、長思考では難しく、安全監視に有効です。業務ではAIエージェントの行動監視が信頼できます。

何が起きたか

OpenAIがCoT-Controlという評価スイートを公開しました。13以上のベンチマークで13モデルをテストし、思考連鎖(CoT)を隠蔽する能力が低いことを確認。モデル規模が大きくなるほど制御しやすくなる一方、長思考では難しく、安全監視に有効です。業務ではAIエージェントの行動監視が信頼できます。

なぜ重要か

AIの内部思考を監視しやすくなり、安全運用が簡単になります

使う人への影響

AIの内部思考を監視しやすくなり、安全運用が簡単になります 確認ポイントは、CoT-Control: 13,000タスク超のオープンソース評価 / 制御率0.1-15.4%、監視有効 / 大規模モデルで制御向上、長思考で低下です。