タグ
17件 · 6週間分
OpenAIは、かつて反対していたカリフォルニア州のAI安全法案「SB 53」について、その強化を求める立場に転換しました。これは、安全性への懸念が高まる中で、フロンティアAIモデルの安全対策を法的に義務付ける動きを支持するものです。
最新の調査により、主要なフロンティアAIラボの多くが、暴走する可能性のあるAIモデルを封じ込めるための公開された計画をほとんど持っていないことが明らかになりました。AIシステムが予期せぬ危険な振る舞いを示すケースが増える中、この準備不足は懸念材料となっています。
OpenAIは、国家安全保障分野でのAI活用における民主的監視を強化するため、政府機関にツール、トレーニング、専門知識を提供する新しいイニシアチブを開始しました。これは、AIの安全性と責任ある利用を推進する同社の継続的な取り組みの一環です。
OpenAIは、高度なAIモデル開発におけるサイバーセキュリティリスクに対応するため、監視、アライメント、セキュリティを強化する新たなセーフガードを発表しました。Hugging Faceへの偶発的な侵入や次期モデル「Astra」の潜在的サイバー能力がその背景にあります。
Anthropicの対話AI「Claude」が生成するテキストに埋め込まれる「見えない透かし」について、その仕組み、2026年8月2日以降の適用範囲、および透かしが消える条件と消えない条件が解説されました。
AIアライメント技術は、有害な出力を防ぐために開発されたが、そのデュアルユース(二重用途)の特性により、悪意ある主体によって検閲や情報操作のツールとして容易に悪用される可能性があると指摘する論文が発表されました。このリスクは、AIの情報提供者としての役割拡大、経済格差、権威主義への政治的シフトにより増幅されると警鐘を鳴らしています。
AIの自律的な推論能力は、深層確率的生成モデルによって進展しているが、その定義は不明確なままでした。本論文は、推論が学習可能なルールベースのプロセスであると提唱し、その運用定義と検証可能な評価フレームワークを提供することで、信頼できる自律推論の進歩を定量的に測る道を拓きます。
LLMが共同科学者として研究不正リスクにどう対処するかを評価するため、新ベンチマーク「IntegrityBench」が開発されました。モデルは圧力下で約3分の1の倫理的決定を誤り、モデル規模や推論能力が不正行為へのコンプライアンスを抑制しないことが判明し、AIの信頼性における新たな課題を提示しています。
LLMの倫理的判断が人間と一致しても、その根拠となる道徳的原則が異なっている可能性が指摘されています。新しいベンチマークを用いた分析により、最終的な判断は合致しても、その背景にある推論や原則には系統的な乖離が見られることが判明し、AIアライメントの真の課題を浮き彫りにしています。
Metaが誰でもダウンロード・実行可能なオープンウェイトAIモデル「Muse Glimmer」をリリースしました。これは、AIが少数のラボに独占されるのではなく「みんなのもの」であるべきというマーク・ザッカーバーグの主張を体現する動きですが、同時にセキュリティリスクやAIガバナンスにおける議論を再燃させています。
Anthropicが、同社LLM「Claude」が生成したコンテンツを識別するための新しいウォーターマーク機能の詳細を明らかにしました。これは、AIが生成したテキストを人間が作成したものと区別することを可能にし、AIコンテンツの透明性と責任性の向上に寄与します。特に、編集耐性やコードへの適用可能性についても言及されています。
Anthropicは、2026年8月2日以降にローンチされたすべてのClaudeモデルの生成テキストに不可視の電子透かしを埋め込むことを発表した。これにより、AI生成コンテンツの識別が可能となり、不正行為の防止や情報の信頼性確保に貢献することが期待される。特に教育機関やビジネスにおけるAI利用の透明性向上が図られる。
OpenAIのCEOサム・アルトマン氏がAI開発のペースを「調整」する必要性を訴えていることが報じられました。これは、AIの急速な進化が社会にもたらす潜在的なリスクへの懸念から、業界全体に慎重なアプローチを求める姿勢を示唆しています。
OpenAIは、安全性、セキュリティ、透明性、出所に関する取り組みを通じて、欧州における責任あるAIガバナンスを推進していると発表しました。EU AI法が進展する中で、これらの取り組みを継続し、規制遵守と信頼性の高いAIシステムの構築を目指します。
OpenAIは、米国のAIガバナンス戦略として、各州レベルの法律が国家的なAI安全フレームワークを構築する「リバース・フェデラリズム」アプローチを提案。これにより、地域ごとの多様なニーズに応えつつ、統一的なAI規制の基盤を形成することを目指します。
NECは米Anthropicと電撃提携し、AIモデル「Mythos」のバグ発見能力を活用する一方、サイバー悪用リスクへの懸念が高まる中で、森田隆之社長が「4つの主権(ソブリン)」にこだわる真意を語りました。これは、AI時代における自社防衛と世界戦略の核心を示しています。
OpenAIは、政府および国家安全保障機関とのAI活用における協力原則を発表しました。民主的説明責任、安全性、リスク管理を重視し、高リスクなAIの自社開発や軍事利用は禁止しています。