Gemma 4 12BをMacのローカルで「エージェント用の土台」にするGoogle AI Edgeの手順。LiteRT-LM CLIの新コマンド`serve`でOpenAI互換のローカルサーバーを立て、OpenClaw・Hermes・OpenCode・Aiderをそのまま向ける。AI Edge GalleryのmacOS版はPythonを書いて実行、Eloquentは音声で書き換え
Google AI Edgeチームは2026年6月3日、Gemma 4 12Bを普通のノートPCで動かしエージェント的な用途に使う手順を公開した。①Google AI Edge GalleryがmacOSに対応し、Gemma 4 12Bが自然言語の指示からPythonを生成してその場で実行、2つのテキストファイルから比較グラフのPNGを描いた。②音声入力アプリEloquentのmacOS版は全機能が端末内で動き、ホットキーで任意のアプリに口述でき、新機能Voice Editで段落を選んで「経営向け要約に組み直して」と言えば書き換える。前モデル比で総合品質が60%超向上。③LiteRT-LM CLIに`serve`が加わり、`litert-lm import`でHugging Faceからモデルを取り込み、`litert-lm serve`でOpenAI互換のローカルサーバー(localhost:9379)を立てられる。OpenClaw・Hermes・OpenCode・Pi、Continue・Aiderのような既存の道具をそのまま向けられ、完全にローカルなエージェントの土台になる。

2026年9月19日・日本時間時点の情報です。 Google Developersのブログ(6月3日)を読んだ。3か月前の記事だが、当サイトのEloquentの記事で扱わなかった**serveコマンド**(LiteRT-LMをOpenAI互換のローカルサーバーにする)は、LM StudioやOllamaの代わりにGoogle純正の経路でローカルエージェントを組める話なので残す。
3行まとめ
- Gallery(macOS)でコードを書いて実行。 Google AI Edge Gallery(ローカルAIの見本アプリ)がmacOSに対応し、Gemma 4 12Bが自然言語の指示からPythonを生成してその場で実行する。例は2つのテキストファイルを渡して「2024年と2025年の女児名トップ10を比べるグラフのPNGをPythonで描いて」→コード生成→ローカル実行→可視化。trimeshで.objファイルを描画する課題では、依存関係の指定・コード生成・自己修正を1ターンで行った。
- Eloquent(macOS)は完全オフラインの口述と書き換え。 全機能が端末内で動き、カスタマイズできるホットキーで任意のアプリに口述でき、音声・動画ファイルの書き起こしもローカル。新機能Voice Editは、段落を選んで「経営向けの要約に組み直して」「ヒンディー語に訳して」と声で指示すると書き換える。Gemma 4 12Bにより前モデル比で指示追従と範囲の遵守が改善し、総合品質が60%超向上した、と。
serveでOpenAI互換のローカルサーバー。 LiteRT-LM CLIに**serveが加わり、litert-lm import --from-huggingface-repo=litert-community/gemma-4-12B-it-litert-lm …でモデルを取り込み、litert-lm serveでlocalhost:9379**にOpenAI互換のエンドポイントが立つ(モデル名をgemma4-12b,gpuのように指定してGPUで動かす)。OpenClaw・Hermes・OpenCode・Piのようなエージェント、Continue・Aiderのような拡張を、そのままローカルの端点に向けられる。「完全にローカルなエージェントの道具・ハーネス・作業の流れを動かす、能力と効率の高い選択肢」。
GoogleがOpenAI互換の入口も持つ意味
- 「OpenAI互換のローカルサーバー」はLM Studio・Ollama・llama-serverで既にできることだが、Googleの公式ランタイム(LiteRT-LM)で同じ入口が付いた意味は、Gemma系の最適化と更新をGoogle側で追える点にある。Raspberry Pi 5の記事のLiteRT-LMと同じ系統
- 「60%超の品質向上」はEloquentの内部評価で、指標は書かれていない
- 12Bをノートで動かす要件(メモリ)はモデルカード参照とだけあり、本文に数字はない。筆者はM5 Max 64GBの環境で試していない
- NVIDIA IFA 2026で見たHermes・OpenClawのワンクリック設定は同じアプリ群のNVIDIA側の入口で、Mac側はこの
serveが対応する
コマンドは原文確認、自環境は未試行
この記事の下調べで、筆者は9月19日にGoogle Developersのブログを取得し、Gallery・Eloquentの機能・Voice Editの例・60%超・importとserveのコマンドとポート番号・対応する道具の一覧がその原文にあることを確認した。Gemma 4 12Bのモデルカードは開いていない。筆者は自分のMacでlitert-lm serveを試していない。
メモリ要件と対応OSは本文になし
- 12Bをノートで動かす際のメモリ要件と速度
serveの対応OS(LinuxとWindows)- Eloquentの日本語での品質
出典はAI Edgeチームの記事1本
- Bringing Gemma 4 12B to your Laptop: Unlocking Local, Agentic Workflows with Google AI Edge(Google Developers・2026年6月3日)
関連記事
出典・参照資料
大きいニュースはYouTubeでも解説しています。Xでは新着記事をお知らせしています。
コメント
まだコメントはありません。最初のコメントを書いてみませんか?
AIについて聞きたいことはありますか?
質問箱で無料で受け付けています。回答は公開され、他の方の参考にもなります。
質問箱を見る →