AI時短ラボ
研究· 約8

Googleが「300言語超・70億人・世界人口の86%」と数字を出した言語AIの現在地──Gemini 3.5 Live Translateは70言語・2,000超の言語ペア、目標は「話者数上位1,000言語」、端末内翻訳TranslateGemmaは55言語、フィーチャーフォンでもGemini

Googleは2026年9月15日、James Manyika氏名義で言語AIの取り組みをまとめた記事を公開した。Googleの技術と製品は300言語超・70億人超(世界人口の86%)の日常のやり取りを支え、Google翻訳は250言語超へ。文字の翻訳を越えて音声をそのまま処理する方向で、Gemini 3.5 Live Translateは70言語・2,000超の言語ペア、目標は「話者数上位1,000言語」(1,200万時間の音声で訓練したUniversal Speech Modelの転移学習)。データはWAXAL(アフリカ27言語)・Project Vaani(インド109言語)・Amplify Initiativeの共同収集、端末で動く55言語のTranslateGemma、フィーチャーフォン向けAsk Viamo Anything(ルワンダで200万問超)、50超の手話に対応するSL2Tまで。日本語がどこに入るかは書かれていない。

Googleが「300言語超・70億人・世界人口の86%」と数字を出した言語AIの現在地──Gemini 3.5 Live Translateは70言語・2,000超の言語ペア、目標は「話者数上位1,000言語」、端末内翻訳TranslateGemmaは55言語、フィーチャーフォンでもGemini
執筆・編集:
目次

2026年9月18日・日本時間時点の情報です。 Googleの公式ブログに、研究・ラボ・技術と社会担当のSVP、James Manyika氏名義で言語AIの取り組みをまとめた記事が9月15日に出た。個々の製品発表ではなく「数字と方針の棚卸し」で、Google翻訳・Gemini Live・Transcribe・Gemma・Pixelの機能がひとつの文脈に並んでいる。翻訳ツールの横並びはAI翻訳ツール比較に、用語の索引は/terms

3行まとめ

  1. 現在地の数字。 Googleの技術と製品は300言語超で日常のやり取りを支え、それを話す人は70億人超=世界人口の86%。Google翻訳は2006年の開始時の数言語から250言語超へ。一方で「何千もの生きた言語と方言がデジタルの世界にほとんど、あるいは全く存在しない」ことを記事自身が課題として置いている。
  2. 文字の翻訳から「音声をそのまま理解する」へ。 従来の「音声→文字→処理→音声」の直列処理は声色・間・感情・文脈を落とす、として、Geminiに音声を直接処理させる方向に。Gemini 3.5 Live Translate70言語・2,000超の言語ペアのリアルタイム音声翻訳で、SpanglishやHinglishのような会話途中の言語切り替え(コードスイッチ)と感情の手がかりを拾う。Gemini 3.5 Transcribeは雑音や専門用語の中でも整った文字起こしで、Android Gboardの「Rambler」(つなぎ言葉を除き、文法と句読点を直し、声で編集)も動かす。
  3. 目標は「上位1,000言語」と、届かない場所への対応。 1,200万時間の音声で訓練したUniversal Speech Modelの言語間転移学習で、データの少ない言語に多い言語の学習を移す。データは現地の共同収集(下表)。ネットに届かない30億人超に向けて、端末内で動くTranslateGemma(Gemini由来・55言語)と、フィーチャーフォンで動く音声アシスタントAsk Viamo Anything(ルワンダで試験、Geminiで200万問超に回答)。日本語がどの取り組みのどこに入るかは、記事に書かれていない。

データ収集の共同プロジェクト(記事の記載)

名前 相手 中身
WAXAL(ウォロフ語で「話す」) Makerere大学、Digital Umugandaなど サハラ以南アフリカの27言語・1億人超・26か国超の大規模オープン音声データ。声調や会話のリズムを収録
Project Vaani インド科学大学院(IISc)、Bhashini 言語ではなく地域を起点にインドの多様性を地図化。これまで109言語・15万5,000人超・3万時間超の音声
Amplify Initiative 4大陸の1,600人超の専門家・20大学(ブラジルUFMG、インドIIT Kharagpur、ウガンダMakerereなど) 地域のニュアンスを捉える1万5,000件のマルチモーダルデータ
Language Explorer 世界最大のオープンソース言語データ集LinguaMetaを可視化する対話型ツール。7,000超の話し言葉・書き言葉・手話を継続的に地図化

Google.orgが支援するCentre for Digital Language InclusionやAI SingaporeのProject Aquariumが、農家・医療従事者・教師に多言語ツールを届ける役を担う、とある。

音声以外の「言語」

  • 手話:50超の手話で訓練したSL2T(Sign Language-to-Text)が、Pixel 11のGboardとLive Transcribeで手話→テキストの入力を動かす。まずアメリカ手話(ASL)→英語から。世界で手話を使う7,000万人に向けた「最初の一歩」(SL2Tの記事
  • 地名の発音:ニュージーランドでマオリ語の専門家と協力し、Google Mapsの地名の発音を改善。音声合成モデルに文化的に正しい発音を組み込む

当サイトの既存記事との対応

筆者が確かめた点

この記事の下調べで、筆者はGoogle公式ブログの本文を9月18日に取得し、上の数字(300言語超・70億人・86%・250言語超・70言語・2,000超ペア・1,200万時間・27言語・109言語・15万5,000人・3万時間・1,600人・20大学・1万5,000件・7,000言語超・55言語・200万問・50超の手話・7,000万人)がその原文にあることを確認した。記事はGoogleの自己申告で、当サイトが各数字を独立に検証したものではない。

書かれていないこと

  • 日本語の位置づけ(Live Translateの70言語、TranslateGemmaの55言語に日本語が含まれるかは、この記事の本文には無い)
  • 「300言語超」「70億人」の算出方法
  • 1,000言語の目標の期限

出典はGoogle公式ブログ

  • Google「AI for everyone in every language」(James Manyika・2026年9月15日)
  • 本記事は1,000言語の進捗や日本語への言及が出たら追記する

関連記事

シェア: ポスト はてブ

出典・参照資料

AIニュースの解説を動画でも

YouTubeでは注目ニュースの背景を解説し、Xでは新着記事をお知らせしています。

コメント

まだコメントはありません。最初のコメントを書いてみませんか?

AIについて聞きたいことはありますか?

質問箱で無料で受け付けています。回答は公開され、他の方の参考にもなります。

質問箱を見る →

新しい記事をメールで受け取る

AIの新しい発表を、出典付きで整理して届けます。

関連記事