2026年7月18日(土)

17件
ロボスタ TOP 90

NVIDIAがフィジカルAI世界モデル推進コミュニティ「Cosmos Coalition」を日本企業に拡大、新モデル「Cosmos 3 Edge」も発表

NVIDIAは、物理世界と相互作用するAI「フィジカルAI」の世界モデル推進コミュニティ「Cosmos Coalition」を日本企業に拡大し、エッジ推論向けの新モデル「Cosmos 3 Edge」を発表しました。これにより、日本のロボティクス・製造業の企業がNVIDIAのAIスタックを活用し、開発を加速します。

ロボティクスNVIDIA研究
7/16
CNET Japan TOP 88

中国Moonshot AI、2.8兆パラメータのAIモデル「Kimi K3」を発表、Claude Fable 5を部分的に上回る

中国のAI企業Moonshot AIが、2.8兆パラメータを持つ大規模AIモデル「Kimi K3」を発表しました。このモデルは、チャットサービス「Kimi」や開発者向けAPIで利用可能となり、一部の性能でClaude Fable 5を上回るとされています。

LLMオープンソース研究
7/17
VentureBeat AI TOP 85

エンタープライズAIにおけるエージェントのセキュリティ問題:半数以上がインシデントを経験し、多くが資格情報を共有

VentureBeatの調査によると、企業でAIエージェントがシステムやデータへのアクセス権を持つ一方で、そのセキュリティ対策が追いついていません。54%の企業が既にエージェント関連のセキュリティインシデントを経験し、多くのエージェントが資格情報を共有している実態が明らかになりました。

エージェントセキュリティ実践
7/17
VentureBeat AI TOP 85

企業におけるAIエージェントの評価と実世界アラインメントの課題:半数が本番環境で失敗を経験

VentureBeatの調査によると、企業はAIエージェントに自律性を持たせながらも、その評価結果への信頼度が低い状況です。157社中半数以上が内部評価をクリアしたエージェントが本番環境で顧客対応に失敗したと報告しており、評価の現実世界との乖離が問題となっています。

エージェント評価実践
7/17
Zenn LLM TOP 85

RAGの精度評価で見つかった「ものさし」のバグ:埋め込みモデル変更による効果

RAG(検索拡張生成)システムの精度評価を行った際、当初はモデルの差が問題と思われたが、実際には評価に使用していた「ものさし」である埋め込みモデルに問題があったことが判明しました。text-embedding-ada-002からtext-embedding-3-smallへの変更で、同一条件でも評価結果が大幅に改善することが示されました。

LLMRAG実践
7/17
VentureBeat AI HOT 80

企業AI組織の「コンテキストギャップ」:信頼性不足が課題、RAGの利用とセマンティックレイヤー構築の動向

VentureBeatの調査によると、企業AI組織はAIエージェントに供給するビジネスコンテキストの信頼性に課題を抱えています。半数以上の企業が、欠落または矛盾するコンテキストに起因するAIエージェントの間違った回答を経験しており、この「コンテキストギャップ」を解決するため、多くの企業が統治されたセマンティックレイヤーの構築を進めています。

エージェントRAG実践
7/17
Zenn LLM HOT 78

LLMの起源と「言葉を当てるだけ」で賢く見える理由:シャノンからTransformerまで

LLMがなぜ「言葉を当てるだけ」で賢く見えるのかを、情報理論の父クロード・シャノンの時代から現代のTransformer、そして大規模学習に至るまでの進化の過程を通じて解説しています。LLMは情報を確率として扱い、言葉を予測する訓練、文脈を見るTransformer、大量データによる圧縮、人間指示への追加訓練の組み合わせによって構成されています。

LLM研究Transformer
7/17
ArXiv NLP HOT 75

大規模言語モデル(LLM)エージェント間の「潜在的コミュニケーション」の可能性とテキストの限界

マルチエージェントシステムにおいて、LLMエージェントがテキストを介して情報をやり取りする際に情報が失われる可能性が指摘されています。本研究は、Sparse Autoencoder(SAE)を用いた特徴分析により、テキストによる通信が複雑な概念の表現において限界を持つことを示唆しています。

LLMエージェント研究
7/17
ArXiv AI HOT 72

自律型UAV群のためのインテリジェント三層学習アーキテクチャ:探索救助活動での応用

本論文は、探索救助活動を行う自律型UAV(無人航空機)群のために、生物学的階層(反射、スキル、推論)に対応する三層学習アーキテクチャを提案しています。これは、個体適応のためのヘッブ型神経可塑性、戦術調整のためのマルチエージェント強化学習、そして戦略的意思決定のためのモデルにとらわれないメタ学習を統合したものです。

ロボティクスエージェント研究
7/17
ArXiv AI HOT 70

階層型知識グラフのためのHierarchy-Guided RAG(HG-RAG):構造化知識の効率的な取得

RAG(検索拡張生成)システムは、大規模言語モデル(LLM)の出力品質を向上させる上で有効ですが、階層的または関係的推論が必要な構造化知識の扱いに課題があります。本論文は、階層型知識グラフをトラバースして構造化されたコンテキストをLLMに提供する「HG-RAG」フレームワークを提案しています。

LLMRAG研究
7/17
ArXiv AI

対話型視覚位置認識:人間のような会話で場所を特定する「DialogueVPR」

自然言語による空間情報の伝達に着想を得て、静的なワンショット検索から対話型の推論検索へのパラダイムシフトを提案する「Dialogue Place Recognition(DlgPR)」が導入されました。これは、大規模な対話ベースの場所認識ベンチマーク「DlgQuest-Cities」と、クロスモーダルな多段階リトリーバーと推論フレームワークを組み合わせたものです。

マルチモーダル研究自然言語処理
7/17
ArXiv ML

XAI研究は「アドホックな手法」から「基礎的課題」へ:実世界への影響不足の指摘

Explainable AI (XAI) の技術が多数存在するにもかかわらず、それが実世界のワークフローに影響を与えることが稀であると指摘されています。本論文は、XAI研究が「アドホックな手法」の開発から、問題の定式化、評価目的の不明確さ、フィードバックパイプラインの欠如といった「基礎的・構造的課題」に取り組む方向へ転換すべきだと主張しています。

XAI研究倫理
7/17
dev.to AI

教師向けChatGPTプロンプト50選(2026年版):思考力と創造性を育む活用術

教育者がAIツールを活用する上で不可欠な、ChatGPTの「教師向けプロンプト50選」が公開されました。このプロンプト集は、批判的思考、創造的執筆、個人学習支援など、多岐にわたる教育シーンでAIを効果的に利用するための実践的なガイドを提供します。

ChatGPTプロンプト実践
7/17
Zenn LLM

LLMとの作業にGitを活用:コードを書かなくてもカオスを避けるためのバージョン管理

LLM(大規模言語モデル)との共同作業では、生成されたドキュメントやコードのバージョン管理が煩雑になりがちです。本記事では、コードを書かないLLMユーザーにもGitの活用を推奨し、作業履歴の整理、変更点の追跡、複数パターンの比較を効率的に行う方法を提案しています。

LLM開発効率化Git
7/17
TechCrunch AI

Databricksが1880億ドルの評価額を達成:AI時代の主役としての地位を確立

Databricksは、その企業イメージをAI企業へと転換し、評価額が1880億ドルに達しました。同社は、オープンウェイトAIモデルがコーディングコストを大幅に削減できるという研究も発表しており、AI業界における存在感を強めています。

AILLMオープンソース
7/17
dev.to AI

オープンソースAIモーション・アニメーションツールキット「RokMotion」発表

AI駆動のアニメーションをよりスムーズかつ実験的に制作するためのオープンソースツールキット「RokMotion」が発表されました。これは、クリエイター、開発者、AI愛好家向けに設計され、GitHubで公開されています。

AI画像生成オープンソース
7/17