タグ
14件 · 4週間分
集中治療室(ICU)における死亡率予測の精度は高いものの、その説明性には課題がありました。本研究では、スタンドアロン型LLMと、データ解釈、ガイドラインチェック、最終的な説明生成を分離したマルチステップのエージェントパイプラインを比較することで、臨床現場で利用可能な説明の生成におけるLLMの実現可能性を検証しています。
電気自動車やグリッド蓄電など、多様な分野でバッテリーの安全性と信頼性が重要性を増しています。本レビューでは、従来のBPHM手法が抱える課題を克服するため、Transformerアーキテクチャと自己教師あり事前学習に基づく大規模モデル(LMs)の応用を包括的に調査し、その将来のロードマップを提示しています。
オンライン教育における学生の学業リスク早期予測は、学生の定着率と学習成果を向上させる上で極めて重要です。本研究では、既存モデルの早期検出能力と解釈性の課題を克服するため、時系列Transformerベースの予測器とF-Logicシンボリック推論を統合したニューロシンボリックフレームワーク「EduRiskX」を提案しています。
PICassoは、自然言語仕様からフォトニック集積回路(PICs)の自動合成、検証、最適化を行うAI支援型フレームワークである。構造化された自然言語処理パイプラインをPDK知識、自動配置・配線、DRC/LVS検証、SAXベースのフォトニックシミュレーションと連携させ、設計効率を大幅に向上させる。
金融分野の質問応答は、正確な計算と複雑なルール適用が必要なため、LLMはしばしば誤った数値を生成します。CIFQAは、言語理解と数値実行を分離し、専門エージェント群が連携することで、正確な金融計算応答を可能にする決定論的ツール連携型マルチエージェントLLMフレームワークです。
Contextは、従来のチャットボットを置き換え、構成可能なサンドボックスプログラム、宣言的な配線、構造化された対話を通じて、ユーザーのプロンプトを待たずに共有タスクを推進するプロアクティブな目標指向エージェントです。
Raon-Speechは、英語と韓国語の音声理解、応答、生成に特化した9Bパラメータの高性能な音声言語モデル(SpeechLM)です。既存のLLMに音声機能を統合しつつ、強力なテキスト能力を維持することで、自然なリアルタイム会話を可能にします。
LLMの信頼性キャリブレーションに関する研究で、現在のLLMは人間と同様に過度に自信過剰である傾向が示されました。特に難しい問題で過信が大きく、簡単な問題では過小評価する「ハード・イージー効果」が顕著であることが判明しました。
大規模言語モデル(LLM)の推論プロセスにおける冗長性を定量化し、そのメカニズムを解明する研究が発表されました。LLMが長い思考連鎖(チェーン・オブ・ソート)を用いる際に発生する、不必要な再定式化や自己反省の度合いを測定し、その削減方法を探ります。
LLMエージェントのコードレビューにおけるハルシネーション(幻覚)問題への構造的対策や、複数エージェント間の連携による科学的ワークフロー自動化の研究が進んでいます。これらの進化は、エージェントの実用性と信頼性を大きく向上させます。
SOLAR(Self-Optimizing Lifelong Autonomous Reasoner)は、概念ドリフトや勾配ベース適応の高いコストといった課題を克服し、動的な実世界環境でLLMを継続的に適応させるための自己最適化型自律エージェントです。モデルの重みを探索環境として利用するパラメータレベルのメタ学習を導入しています。
金融取引の時系列ダイナミクスを捕捉するため、自己教師あり対照学習目的で訓練されたTemporal Contrastive Transformer(TCT)が導入されました。これにより、下流の不正検出タスクをサポートする行動パターンをエンコードした埋め込みが生成されます。
言語モデル(LLM)に研究アイデアの経験的成功を予測させる研究が進行中です。既存のアイデアペアを比較評価する形でモデルをファインチューニング(SFT)することで、8Bパラメータモデルで30%だった精度が77.1%に向上し、GPT-5(61.1%)を上回る結果を示しました。
LLMの進化に伴い、AIエージェントが単一タスクの自動化を超え、業務プロセス全体を自律的に実行する時代が到来しています。OpenAIのSymphonyやChocoの事例、さらには医療画像処理、創薬、社会科学研究におけるエージェントフレームワークの論文が発表され、AIが人間のように思考し行動する世界が現実味を帯びてきました。