デイリーインテリジェンス · 2026年7月29日

知性の最前線を、
毎朝あなたに。

人工知能が生み出す知の断片を収集・要約。
12件の記事を Gemini 2.5 Flash が厳選しました。

速報インテリジェンス

3件
CNET Japan TOP 95

Claudeの共有チャットがGoogle検索に流出、企業の内部データも含まれる可能性

米AnthropicのAIチャットボット「Claude」で共有された会話が、GoogleやBingなどの検索エンジンから一般に閲覧可能な状態になっていたことが判明しました。これにより、医療記録や企業の内部データを含む機密情報が露呈する恐れがあり、ユーザーとAnthropic双方にとって深刻なプライバシー問題として浮上しています。

LLMAnthropicプライバシー
7/28
OpenAI Blog TOP 90

AIエージェントによる科学計算の近代化:OpenAIがレポート公開

OpenAIが発表したレポートによると、AIコーディングエージェントが科学計算の分野でソフトウェア開発と発見を加速させています。これによりゲノミクスなどの分野で研究プロセスが効率化され、科学者たちはより複雑な問題解決に集中できるようになります。

エージェント研究開発効率化
7/28
dev.to AI TOP 88

Claude Opus 5リリース:API変更と実運用への影響

Anthropicが最新モデル「Claude Opus 5」をリリースし、APIの振る舞いに一部変更がありました。ベンチマーク性能の向上だけでなく、既存コードに影響を与える可能性のあるAPI契約の変更点が詳細に分析されており、開発者は注意が必要です。

LLMAnthropicAPI
7/24

詳報

9件
ITmedia AI+ TOP 85

AIリーダーが米政府に「AI開発のペース調整」を提言、制御不能リスクを懸念

OpenAIやAnthropic、Google、MetaなどのAI企業従業員1000人以上が、AIの急速な自律化がもたらす制御不能リスクを懸念し、米政府に対しAI開発のペース調整と国際的なガバナンス強化を求める公開書簡を発表しました。

OpenAIAnthropicGoogle
7/29
ArXiv AI HOT 83

QFoldAgent:タンパク質構造予測のための自律型量子最適化マルチエージェントシステム

QFoldAgentは、タンパク質構造予測を目的とした閉ループのマルチエージェントフレームワークです。量子アルゴリズムと機械学習エージェントを組み合わせることで、ハミルトニアンのペナルティ重みを自律的に最適化し、量子計算によるタンパク質折り畳みの精度向上を目指します。

研究エージェント量子AI
7/28
ArXiv AI HOT 80

LLMの信頼性評価:同じ質問でも言い換えで回答が変わる問題

LLMはベンチマークで高精度を達成する一方で、同じ意味の質問でも表現が異なると回答が変わることが判明しました。この信頼性の欠如は、特に事実Q&Aや数学的推論タスクで顕著であり、実世界でのLLMの堅牢性に関する重要な課題を提示しています。

LLM研究倫理
7/28
ArXiv AI HOT 78

DeepLens Diagnosis Agent: 小規模推論モデルがフロンティアLLMに匹敵する診断性能

DeepLens Diagnosis Agentは、5段階のハーネスパイプラインと小規模な医療推論モデル、RAGを組み合わせることで、フロンティアLLMに匹敵する医療診断性能を実現しました。これにより、限られたリソースでも高精度な医療AIエージェントが構築可能になることを示しています。

エージェントLLM研究
7/28
ArXiv ML HOT 75

Semalith v1.4:パラメータ数44分の1でLlama-Guard-3-8Bに匹敵するプロンプトインジェクション検出

Semalith v1.4は、わずか1億8400万パラメータで、プロンプトインジェクション、一般的な危害、金融サービス規制遵守の3軸同時分類を行う最先端のセーフティ分類器です。Llama-Guard-3-8Bと比較して44分の1のパラメータ数で同等の性能を達成し、効率的な安全対策を提供します。

LLMエージェント研究
7/28
Zenn LLM HOT 73

NVIDIA DGX SparkでGemma 4モデル(31B vs 26B)を検証:ソフトウェア開発に最適なLLM

NVIDIA DGX Spark環境において、NVIDIAが提供するGemma 4モデルの31Bと26Bバージョンのベンチマークが実施されました。ソフトウェア開発タスクにおける両モデルのコーディング能力と論理的推論能力を比較検証し、開発パートナーとしての最適な選択肢を評価しています。

LLM開発効率化研究
7/28
Zenn LLM HOT 70

AIコーディング定点観測:Claude Codeに「コード付き機能要望」が急増、並行運用と自己認識に集中

週次のAIコーディングツール関連の定点観測レポートによると、Claude Codeにおける「コード付き機能要望」が急増しており、特に並行運用とAIエージェントの自己認識機能に関する要望が中心であることが明らかになりました。これは、ユーザーがAIをより高度な開発パートナーとして活用しようとしている動向を示唆しています。

LLMエージェント開発効率化
7/28
ArXiv ML

CORVUS:LLMコーディングエージェントのためのコンテキスト最適化と削減

LLMコーディングエージェントの課題であるコンテキストの陳腐化と重複を解決するため、CORVUSは、ファイル読み取りと観測を分離し同期を維持する新しい軌道アーキテクチャを提案します。これにより、推論エラーを減らし、トークン消費を大幅に削減します。

LLMエージェント開発効率化
7/28
Zenn ChatGPT

ChatGPTで新規顧客リサーチを15分で完了させる:業界分析・ターゲット仮説・初回メール作成

新規開拓営業の非効率なリサーチを解決するため、ChatGPTを活用し、業界分析、ターゲット仮説、初回メール作成までの一連のプロセスを15分で完了させる手法が提案されています。これにより、営業担当者は質の高いアプローチを効率的に行えるようになります。

ChatGPTLLM実践
7/28