TOP 98 OpenAI Blog 2026年7月29日

OpenAI、GPT-5.6でARC-AGI-3ベンチマークのスコアを3倍に向上させた2つの設定を公開

なぜ重要か

AIの知能と効率を飛躍的に向上させる新たなアプローチは、広範なAIアプリケーション開発と社会実装を加速させる。

要約

OpenAIは、GPT-5.6のARC-AGI-3ベンチマークにおける性能を劇的に向上させた2つのAPI設定(推論保持と圧縮)の詳細を公開しました。これにより、複雑な問題解決能力と効率が大幅に強化され、より低コストで高度な知能が提供可能になります。

要点

  • 推論保持で多段階タスクを効率化
  • 圧縮でコンテキスト利用を最適化
  • ARC-AGI-3スコア3倍に向上
  • エージェントワークフローを強化
  • AI活用コスト削減に貢献

詳細解説

OpenAIは、最先端のAIモデル「GPT-5.6」の性能と効率を大幅に向上させるための画期的な知見を公開しました。同社は、複雑な問題解決能力を測るARC-AGI-3ベンチマークにおいて、わずか2つのAPI設定(推論保持と圧縮)を導入することでスコアを3倍に引き上げることに成功しました。これは、単にモデルの規模を拡大するだけでなく、既存モデルの活用方法を最適化することで、知能と効率のフロンティアを融合させるというOpenAIの戦略を示しています。

「推論保持」は、モデルが思考プロセスを長期にわたって維持し、以前の推論を再利用できるようにするものです。これにより、複雑な多段階タスクにおいて、各ステップでゼロから考える必要がなくなり、一貫性と効率が向上します。一方、「圧縮」は、大量の情報をよりコンパクトな表現にまとめることで、コンテキストウィンドウの効率を高め、より少ないトークンでより多くの情報を処理できるようにする技術です。これにより、長い対話や大規模なデータセットにおいても、モデルが関連情報を効果的に利用できるようになります。

これらの技術的ブレイクスルーは、特にエージェントワークフローにおいて大きな意義を持ちます。AIエージェントは、推論保持によってタスク間の連続性を保ち、過去の成功体験から学習してより複雑な目標を達成できるようになります。また、圧縮はエージェントが利用できる情報量を増やし、より広範な知識ベースに基づいて意思決定することを可能にします。

これらの進展は、開発者にとって、より高性能なAIアプリケーションを構築するための基盤を提供し、企業にとっては、AI導入コストを削減しつつ、より高度な自動化や意思決定支援を実現する機会を意味します。エンドユーザーは、より一貫性があり、知的なAI体験を享受できるようになるでしょう。

今後、これらの最適化技術は、GPTシリーズのさらなる進化だけでなく、学術研究や科学計算といった専門分野でのAI活用を加速させると期待されます。OpenAIが10万人の研究者にChatGPTの最先端モデルへの無料アクセスを提供するなど、研究コミュニティとの連携も強化されており、新たな発見やイノベーションが加速するでしょう。また、エージェントAIの領域では、より自律的で複雑なタスクをこなせるAIシステムの開発が進み、社会や産業の多くの側面で変革をもたらす可能性を秘めています。

元記事を読む

OpenAI Blog で読む →
← 2026年7月30日(木) の一覧に戻る