タグ
9件 · 3週間分
Contextは、従来のチャットボットを置き換え、構成可能なサンドボックスプログラム、宣言的な配線、構造化された対話を通じて、ユーザーのプロンプトを待たずに共有タスクを推進するプロアクティブな目標指向エージェントです。
Raon-Speechは、英語と韓国語の音声理解、応答、生成に特化した9Bパラメータの高性能な音声言語モデル(SpeechLM)です。既存のLLMに音声機能を統合しつつ、強力なテキスト能力を維持することで、自然なリアルタイム会話を可能にします。
LLMの信頼性キャリブレーションに関する研究で、現在のLLMは人間と同様に過度に自信過剰である傾向が示されました。特に難しい問題で過信が大きく、簡単な問題では過小評価する「ハード・イージー効果」が顕著であることが判明しました。
大規模言語モデル(LLM)の推論プロセスにおける冗長性を定量化し、そのメカニズムを解明する研究が発表されました。LLMが長い思考連鎖(チェーン・オブ・ソート)を用いる際に発生する、不必要な再定式化や自己反省の度合いを測定し、その削減方法を探ります。
LLMエージェントのコードレビューにおけるハルシネーション(幻覚)問題への構造的対策や、複数エージェント間の連携による科学的ワークフロー自動化の研究が進んでいます。これらの進化は、エージェントの実用性と信頼性を大きく向上させます。
SOLAR(Self-Optimizing Lifelong Autonomous Reasoner)は、概念ドリフトや勾配ベース適応の高いコストといった課題を克服し、動的な実世界環境でLLMを継続的に適応させるための自己最適化型自律エージェントです。モデルの重みを探索環境として利用するパラメータレベルのメタ学習を導入しています。
金融取引の時系列ダイナミクスを捕捉するため、自己教師あり対照学習目的で訓練されたTemporal Contrastive Transformer(TCT)が導入されました。これにより、下流の不正検出タスクをサポートする行動パターンをエンコードした埋め込みが生成されます。
言語モデル(LLM)に研究アイデアの経験的成功を予測させる研究が進行中です。既存のアイデアペアを比較評価する形でモデルをファインチューニング(SFT)することで、8Bパラメータモデルで30%だった精度が77.1%に向上し、GPT-5(61.1%)を上回る結果を示しました。
LLMの進化に伴い、AIエージェントが単一タスクの自動化を超え、業務プロセス全体を自律的に実行する時代が到来しています。OpenAIのSymphonyやChocoの事例、さらには医療画像処理、創薬、社会科学研究におけるエージェントフレームワークの論文が発表され、AIが人間のように思考し行動する世界が現実味を帯びてきました。