
Googleが、Raspberry Pi 5で動く音声翻訳機「Gemma Translator」をGitHubで公開した。マイクで拾った声を文字に起こし、翻訳して読み上げるまでを、すべて機器の中だけで処理する。モデルの導入を終えたあとはインターネット接続が要らない。ライセンスはApache License 2.0で、筐体の3Dプリント用データも同じリポジトリに入る。同社のGemma公式アカウントは2026年8月6日にこれを告知した。
処理は3つの部品に分かれる。話した内容を文字に起こすのと、訳した文を音声にして返すのはMoonshineが担う。その間の翻訳を受け持つのがGemma 4のE2Bモデルで、機器上で言語モデルを走らせるLiteRT-LMに載せて動かす。利用者が触る画面はReactで作ったWebの画面で、Pythonで書いたAPIサーバーが橋渡しをする。組み合わせの重さから、動作にはRAMを8GB積んだRaspberry Pi 5が必要になる。
画面の作りは、2人が向かい合って使う前提で決めてある。表示は2つのレーンに分かれ、片方が話した内容がもう一方の言語で読み上げられる。それぞれのレーンには言語を回して選ぶ表示があり、押している間だけ録音するボタンで話しかける。キーボードからの操作は2通り用意され、横向きでは1人が両方のレーンを切り替えながら操作し、縦向きでは2人がそれぞれ別のキーを持つ。画面まわりは480×320ドットのような小型タッチスクリーンに合わせて設計され、見た目は古い端末を思わせる作りになっている。
導入の手間も抑えてある。Raspberry Pi向けの自動導入スクリプトを1本走らせると、必要なパッケージの導入からモデルの取得、常駐サービスとしての登録、起動時にChromiumをキオスクモードで立ち上げる設定までが片付く。想定される使い道は、通信が届かない場所や、音声を外部へ送りたくない場面になる。クラウドへの往復がないぶん、返ってくるまでの間も短く抑えられる。ただしこれは製品ではなく、公開された試作にあたる。リポジトリには、開発にGoogleのAI開発環境Antigravityの支援を受けたと明記されている。

