2026年9月19日(土)
12件OpenAIとMicrosoft、Webの「破滅的ループ」を認識していた:NYT訴訟で明らかに
ニューヨーク・タイムズによるOpenAIとMicrosoftへの訴訟で公開された文書によると、両社は自社のAIモデルによるデータスクレイピングがウェブに「破滅的ループ」をもたらし、「人類史上最大の労働窃盗」であると内部で認識していました。
Anthropicが生物学実験室を運営、AIによる疾患治療とリスクの両面を追求
Anthropicが生物学実験を行うラボを運営していることが明らかになりました。AIが人類の疾患治療に貢献する可能性を追求しつつ、一方でAIがもたらす潜在的な危険性についても警鐘を鳴らし続けています。
AIの幻覚が米軍事作戦を寸前で引き起こす危機
AIの「幻覚」(ハルシネーション)が原因で、米軍が中国船舶に対する軍事作戦を準備する寸前まで至ったという驚くべき報告がありました。この事例は、LLMに内在する不確実性を軍事用途で理解することの重要性を浮き彫りにしています。
TypeSafe AIが「Jev」を発表:判断に特化したAIモデルで高速処理を実現
TypeSafe AIが「Jev」という、分類・判定・スコアリングといった意思決定に特化した新型AIモデルを公開しました。LLMのように文章生成をせず、判断のみを行うことで、中央値55msという超高速応答を実現し、AIエージェントの基盤設計に新たな選択肢を提示します。
ヒューマノイド向け頭脳「Helix 2.5」発表、未知の住宅で家事タスクを実演
米Figure AIが、ヒューマノイドロボット向けの新しい基盤モデル「Helix 2.5」を発表しました。このモデルを搭載したロボットは、事前にデータ収集を行っていない30軒の住宅で、部屋の片付けやベッドメイキングなどの家事タスクを自律的に実行することに成功しました。
大規模言語モデルの評価基準をマッピング:LLMに何を期待するか
大規模言語モデル(LLM)の評価方法が急速に多様化しており、研究者がLLMに何を期待し、成功と見なすかが変化していることが、arXivの論文で体系的に分析されました。特に、行動、相互作用、専門的応用への重点が高まっています。
OpenAIのGPT-6 AstraとAnthropicのClaude Fable 5.1を徹底比較:類似点と相違点
2026年9月に同時に発表されたOpenAIのGPT-6 AstraとAnthropicのClaude Fable 5.1は、コンテキストウィンドウやAPI料金体系が類似しているものの、ベンチマークだけでは見えない両者の戦略的差異が存在します。特に、両モデルは大規模なコンテキスト処理、コーディング、推論、ツール利用能力に重点を置いています。
財団モデルの仮想化と自己進化型OSレイヤーの必要性:FMOSの提言
AIアプリケーションが単一の基盤モデルから複合的なエージェントシステムへと移行する中、現在のスタックの断片化が課題となっています。この問題を解決するため、本ポジションペーパーでは、物理ハードウェアを仮想化するOSのように、財団モデルの相互作用を仮想化する「財団モデルOS(FMOS)」の必要性を提言しています。
AnthropicがAccentureを初の組み込み評価者として採用
Anthropicが、AIモデルの安全性と性能評価のために、コンサルティング大手Accentureを初の「組み込み評価者(embedded evaluator)」として契約しました。これは、AI開発における外部評価の重要性が高まっていることを示しています。
Cooley、ChatGPT WorkでIPOプロセスを加速
法律事務所Cooleyは、ChatGPT Workを活用してIPO(新規株式公開)プロセスを効率化する「GO Public」を開発しました。これにより、弁護士は問題を早期に特定し、より重要な判断業務に集中できるようになります。
Radio-Frequency Convolutional Neural Networks (RF-CNNs)が既存通信ハードウェアを再利用
AIモデルをエッジデバイスで実行する際のSWaP-C(サイズ、重量、電力、コスト)制約を解決するため、RF-CNNsが開発されました。これは、無線機が持つ周波数ミキサーを再利用してCNN推論を行う技術で、既存の通信ハードウェアをAI処理に活用します。