AIニュース

Google DeepMind、手話をテキスト化するAI「SL2T」を発表 Pixel 11に搭載

公開日: ・出典: Google DeepMind公式ブログ

Google DeepMindは、手話を認識してテキストに変換するAIモデル「SL2T(sign-language-to-text)」を発表した。世界で推定7000万人とされるろう者・難聴者向けのアクセシビリティ機能として位置づけられており、スマートフォンに搭載される手話認識AIとしては初の事例だとしている。まずはPixel 11のGboardおよびLive Transcribeに組み込まれ、アメリカ手話(ASL)から英語への変換機能として提供が始まった。

SL2Tは50以上の手話に及ぶ10万時間超の手話データ(うち約4分の1がASL)で学習されており、ろう者のユーザーがスマートフォンのカメラに向かって手話をするだけで、ウェブ検索やメッセージの下書き、Geminiへの問いかけなどをタイピングなしで行えるようにする。これまで音声認識や文字起こしと比べて手話認識AIの開発が遅れていた背景には、世界に200種類以上存在するとされる手話言語ごとにデータの蓄積が乏しいという事情があった。

Google DeepMindは開発にあたり、全米ろう協会(National Association of the Deaf)、世界ろう連盟(World Federation of the Deaf)、Deaf Professional Arts Network、ロチェスター工科大学の国立ろう工科大学(NTID)などで構成する「AI手話諮問委員会」を組織し、当事者コミュニティの意見を反映させたという。現時点で対応するのはASLのみで、他の手話言語への対応は今後の課題として残る。

出典: Google DeepMind公式ブログ

Xでシェア