2026年8月18日(火)
12件OpenAI、PORTS-Pikeプロジェクトに参加し、南部オハイオ州の雇用創出を支援
OpenAIがPORTS-Pikeプロジェクトに参画し、米南部オハイオ州へのコミュニティ投資を拡大します。これにより、数千人規模の雇用創出が期待され、技術イノベーションと地域経済活性化の両面で大きな影響が予測されます。
AIがサイバーセキュリティを再構築:OpenAIの防衛強化と企業が今すべきこと
AIは攻撃者と防御者の双方にとってサイバーセキュリティの状況を一変させています。OpenAIは自社の防御を強化し、セキュリティチームがAI時代に直面する新たな脅威に対処するための実践的なアプローチを共有しています。
AIエージェントの自己修復ループ設計:テスト失敗から自動修正まで
AIにコード生成させる際に発生するエラーに対し、テスト失敗を自動検知し、原因分析から修正、再テストまでを自動で行う「自己修復ループ」の設計と実装が紹介されました。DebuggerAgent、PostmortemAgent、GuardianAgentの3つのエージェントが連携し、開発効率を大幅に向上させます。
Google、AIオートメーションスタートアップRelayをシャットダウンし、スタッフがChromeチームに合流
AIオートメーションスタートアップRelayが事業を停止し、そのスタッフがGoogleのChromeチームに合流することが発表されました。Relayの技術と人材は、ChromeにおけるAI機能の強化に活用される見込みです。
NVIDIAがソフトバンクのデータセンター開発に15億ドル投資、OpenAIプロジェクトを後押し
NVIDIAは、OpenAIプロジェクトを支援するソフトバンクのデータセンター開発に15億ドルを投資すると発表しました。この投資により、OpenAIがNVIDIAのチップを独占的に利用できるデータセンターを確保し、AI開発能力を大幅に強化する見込みです。
LLMエージェント評価における過剰評価を低減する報酬フリー判定基準の導入
大規模言語モデル(LLM)エージェントの評価において、自動判定モデルによる過剰評価の問題に対処するため、報酬フリーの判定基準を導入するRubricForgeが提案されました。これは、真の成果に基づいたルブリックを少量の教師データから進化させ、高信頼な評価を可能にします。
大規模言語モデルにモジュール型認知アーキテクチャが出現
人間の脳に見られるような機能的特化、すなわち言語、形式的推論、社会的推論、物理的推論を司る明確なモジュール構造が、大規模言語モデル(LLM)内部でも出現することが回路解析により示されました。これは、知能システムの基本的な設計原理が生物学的脳とLLMの間で共通している可能性を示唆しています。
Agentao:ツール利用型LLMエージェントのための統制されたローカルファーストランタイム
LLMエージェントがツール利用、ローカル状態変更、永続メモリ、外部プロトコルとの対話を行う中で生じる過剰な権限、監査性の低さ、プロンプトインジェクションといったリスクに対処するため、統制されたローカルファーストランタイム「Agentao」が提案されました。これは、モデルが提案するアクションとホストが許可する実行を分離する多層アーキテクチャを採用しています。
Anthropicが公開したClaudeのシステムプロンプトから学ぶ設計ノウハウ
Anthropic社がClaude 3.5 SonnetやOpusなどの公式システムプロンプトを公開し、プロンプトエンジニアリングの重要な設計ノウハウが明らかになりました。これにより、AIアプリケーション開発者は、Anthropicが推奨する最適なプロンプト設計アプローチを実践的に学ぶことができます。
ChatGPT、Claude、Geminiのモデル自己申告が当てにならない理由と最新モデル確認法
2026年7月にChatGPT、Claude、Geminiが新モデルに切り替わったものの、AIモデルに直接「あなたは何のモデルか」と尋ねる自己申告は信頼できません。モデルピッカーのUI操作や挙動の変化から最新モデルを確認する3つのステップが提示されています。
マネーフォワードが法人向けAIトークン管理サービスを無料提供開始
マネーフォワードは、ChatGPTやClaudeなどのAIサービスの利用量とコストを一元管理できる法人向けサービス「マネーフォワード クラウドAIトークン管理」を無料で提供開始しました。これにより、企業は複数のAIサービスのコストを効率的に可視化・管理できます。