タグ
2件 · 1週間分
OpenAIは、開発中の次期モデル「Astra」が、同社の安全評価フレームワークにおける最上位「Critical」レベルのサイバー攻撃能力を持つ可能性を否定できないと発表しました。この懸念を受け、Astraの一部開発を一時停止し、安全性対策を強化しています。
Anthropicは、AIモデル「Claude Fable 5」において、生物学分野での過剰な安全保護機能を緩和したと発表しました。これにより、無害な質問に対する誤検知や下位モデルへのフォールバックを約85%削減し、専門的な二重用途研究への制限は維持しつつ、一般的な健康・教育用途での利便性を向上させました。