HOT 73 Google DeepMind Blog 2026年8月13日

Google DeepMind、手話からテキストへの変換AIモデルを発表し、聴覚障がい者向け新機能を提供

なぜ重要か

手話とテキストのリアルタイム変換AIは、聴覚障がいを持つ人々のコミュニケーションを劇的に改善し、社会のアクセシビリティと包摂を大きく進めます。

要約

Google DeepMindは、手話をテキストに変換する画期的なAIモデル「SL2T(Sign Language to Text)」を発表しました。このモデルは、聴覚に障がいを持つユーザーが手話を通じてより円滑にコミュニケーションできるよう支援するための新機能の基盤となります。

要点

  • 手話からテキストへの変換モデル発表
  • 「SL2T」モデルを開発
  • 聴覚障がい者向け新機能
  • コミュニケーションの障壁を低減
  • アクセシビリティ向上に貢献

詳細解説

Google DeepMindが開発した「Sign Language to Text (SL2T)」モデルは、聴覚障がいを持つ人々にとってのコミュニケーションの障壁を大きく取り払う可能性を秘めた技術です。これまで手話の自動認識は、その複雑な動作、個人差、多様な環境要因により非常に困難な課題でした。SL2Tモデルは、高度なコンピュータビジョンとシーケンス認識技術を組み合わせることで、手話の動きをリアルタイムに近い速度でテキストに変換することを目指しています。技術的な意義として、このモデルは単なる手の動きの認識に留まらず、顔の表情や体の動きといった非言語的要素も考慮に入れることで、より自然で正確な手話通訳を実現する可能性があります。これにより、聴覚障がいを持つ人々は、手話話者でない人々との間で、よりスムーズなコミュニケーションが可能になります。教育、職場、公共サービスなど、多様な場面での情報アクセスが改善され、社会的な包摂が促進されることが期待されます。Googleは、この技術をスマートフォンアプリやウェアラブルデバイスに統合することで、より多くのユーザーが手軽に利用できる未来を描いています。今後、さらに多くの手話言語への対応や、双方向翻訳、さらには音声認識と組み合わせたマルチモーダルコミュニケーションの実現が期待されます。

← 2026年8月14日(金) の一覧に戻る