Google、Gemma 4を3倍を高速化。出力品質はそのまま
Googleは5月5日、最新の高性能オープンモデル「Gemma 4」向けに、出力品質を維持しながら推論速度を最大3倍引き上げる「Multi-Token Prediction(MTP) drafters」を提供開始した。Apache 2.0ライセンスのもとオープンソースで公開しており、モデルウェイトはHugging FaceやKaggleにて入手できる。
グーグル・ディープマインドは4月2日、オープンAIモデルの新シリーズ「Gemma 4」を発表しました。このモデルは、小型でありながら最先端の性能を実現していることが最大の特徴です。開発者や研究者が利用可能なオープンなモデルとして提供され、効率的なAI開発を支援することを目的としています。具体的な価格についての言及はありませんが、オープンモデルとして公開されることで、限られた計算リソース環境下でも高度なAI処理が可能となります。小型化と高性能の両立により、幅広いデバイスやアプリケーションでの活用が期待される次世代のAIモデルです。

Googleは5月5日、最新の高性能オープンモデル「Gemma 4」向けに、出力品質を維持しながら推論速度を最大3倍引き上げる「Multi-Token Prediction(MTP) drafters」を提供開始した。Apache 2.0ライセンスのもとオープンソースで公開しており、モデルウェイトはHugging FaceやKaggleにて入手できる。

Googleが2026年4月にリリースしたローカルLLM「Gemma-4-31B」で画像認識をしているところImage:かみやまたくみ「これが無料でいいの?」ってレベル。2026年4月にGoogleが新しいローカルLLM「Gemma4」シリーズをリリースしました。Gemma4シリーズは前世代から大きく性能・機能が向上し、現在、非常に高い評価を得ています。実際に利用してみましたが、日本語能力が高く、
![[みんなのケータイ]スマホに載せたローカルAI「Gemma4」に未来を感じる](https://k-tai.watch.impress.co.jp/img/ktw/list/2101/682/51.jpg)
スマホやパソコンで「AIが使える」と言っても、多くの場合、“窓口”に過ぎません。実際の処理は、インターネットの向こう側、データセンターの巨大なコンピュータで動いています。AIはそれだけ大量のメモリーと計算能力を必要とするからです。

Google(グーグル)は、新たなオープンAIモデル「Gemma 4」シリーズを公開した。Google AI Studioや「Google AI Edge Gallery」アプリで試すことができる。

Googleは4月2日、オープンモデルの最新LLMとして「Gemma 4」を発表した。Androidデバイス、ノートPCのGPU、そしてワークステーションやアクセラレータまで、あらゆるハードウェアで効率的に動作し、微調整できるよう特別に設計されているという。

グーグル・ディープマインドは4月2日、オープンAIモデルの新シリーズ「Gemma 4」を発表した。