Putting sign language AI into users’ hands カバー画像

Google DeepMind が Putting sign language AI into users’ hands を投入 ── Pixel 11で手話入力開始

GOOGLE DEEPMIND

最終更新: 2026年08月15日 16:06 元記事 →

音声AIが成熟した一方で、200を超える手話言語には技術が追いついていなかった。今回、Google DeepMindがその壁を破る「SL2T」モデルを発表し、ついに消費者向けデバイスへの実装へ踏み切った。これは単なる翻訳機能の追加ではなく、ろう者コミュニティの日常を変えるインフラ整備だと言える。

何が変わったのか

多言語対応の手話からテキストへの変換モデル「SL2T」が初めて商業製品に組み込まれた。GboardとLive Transcribe(Pixel 11)で、アメリカ手話(ASL)を英語テキストへ変換する機能が利用可能になる。従来の型ではなく、自然な文法を持つ独立した言語として処理するため、単純な音韻マッピングではない真の機械翻訳を行う。ユーザーは通常タイピングをする場面で、検索やメッセージ作成、Geminiへの質問まで手話だけで完結できるようになる。テストユーザーからは「英語でのタイピングより速く、自然で楽しい」という声が挙がっている。

前モデル / 競合との比較

提供テキストには具体的な競合モデルとの数値比較やベンチマークスコアは記載されていない。ただし、「実験室から消費者製品への移行」が初めてである点と、従来の逐次マッピング方式とは異なる「真の機械翻訳」アプローチを採用している点が技術的な差異として示されている。

技術背景と意義

音声認識は音と文字を同じ言語内で対応させる「逐次マッピング」だが、手話は文法や語彙を持つ独立した自然言語だ。そのため、音声のトランスクリプション(書き起こし)ではなく、異言語間の機械翻訳に近い複雑な処理が必要になる。SL2Tはこの構造的な違いを理解し、手話の動きや表情を解釈して意味のあるテキストに変換するよう設計されている。

こんな人・用途に

・Pixel 11ユーザー:Gboardでの検索やSNS投稿、メール作成を手話で入力
・ろう者コミュニティ:Live Transcribeを使ったリアルタイムな会話における返信の手話入力
・アクセシビリティ重視の企業・開発者:手話対応UIの実装参考

Hacker Newsの反応

提供されたHacker Newsの反応データを確認しましたが、「Putting sign language AI into users’ hands」という投稿や、それに紐づくコメントが含まれていませんでした。そのため、ご指定のテーマに関する反応を抽出することができません。

入手方法・リンク

現時点ではOSS(オープンソース)ではなく、クローズドソースとして提供される。Pixel 11搭載のGboardおよびLive Transcribeアプリで利用可能となる予定だが、APIやGitHubリポジトリの公開情報はなし。

SOURCE: Google DeepMind (2026-08-12)

← LLM Watch トップへ

類似投稿

コメントを残す

メールアドレスが公開されることはありません。 が付いている欄は必須項目です