タグ
1件 · 1週間分
大規模深層学習ネットワーク(DNN)を使わずに動作する新しいLLMアーキテクチャが提案されました。このモデルは、RBFネットワークを基盤とし、閉形式解により損失関数のグローバル最適解を1回のイテレーションで発見するため、従来の複雑なトレーニングステップが不要となります。