新系列基於與 Gemini 3 相同的研究而構建,從在 Raspberry Pi 上運行的邊緣 2B 模型擴展到目前在 Arena AI 開放模型排行榜上排名第三的密集 31B 模型。 Apache 2.0 授權是與先前的 Gemma 版本相比的重大轉變。
谷歌發布了 Gemma 4是最新一代開放重量模型系列,有四種尺寸,旨在涵蓋從智慧型手機上的裝置端推理到工作站級部署的所有內容。
這些模型採用與 Gemini 3 相同的研究和技術構建,Gemini 3 是 Google 擁有的前沿模型,並在 Apache 2.0 許可證下發布,條款比前幾代 Gemma 更寬鬆,Hugging Face 聯合創始人 Clement DeLange 將這一變化描述為 “一個偉大的里程碑。”
谷歌 DeepMind 執行長 Demis Hassabis 稱新模型… “世界上就其尺寸而言最好的開放式模型。”
TNW 的共享辦公空間 – 在這裡您可以完成最好的工作
專為技術核心領域的成長、協作和無盡的社交機會而設計的工作空間。
這四個變體是 Edge Efficient 2B (E2B) 和 Efficient 4B (E4B) 型號,旨在在手機、Raspberry Pi 和 Jetson Nano 設備上運行,與 Pixel、Qualcomm 和 MediaTek 團隊合作開發; 26B Mixture-of-Experts (Mo GPUE) 旨在使用消費者使用 31B 設備。
目前,31B Dense 模型在 Arena AI 文字排行榜上所有解鎖模型中排名第三; 26B 教育部排名第六。谷歌聲稱,在這個標準上,這兩個較大的模型的性能比其尺寸的模型高出 20 倍。
非定量的31B權重與80GB Nvidia H100 GPU成正比;量子版本適用於消費性設備。
所有四個模型都是多媒體的,可以本地處理視訊和圖像,並經過 140 多種語言的訓練。 E2B和E4B還支援本地語音輸入以進行語音辨識。邊緣模型的上下文視窗為 128k 個標記,兩個較大變體的上下文視窗為 256k。
在功能方面,Google強調了多步驟邏輯最佳化、本機函數呼叫和代理程式工作流程的結構化 JSON 輸出以及離線程式碼生成。在性能方面,Android 開發者部落格指出,E2B 型號的運行速度比 E4B 快三倍,而 Edge 系列整體速度比以前的 Gemma 版本快四倍,並且電池使用量最多減少 60%。
E2B 和 E4B 也是 Gemini Nano 4 的基礎,Gemini Nano 4 是 Google 的下一代 Android 裝置模型,將於今年稍後登陸消費裝置。
自首次發布以來,Gemma 已累積了超過 4 億次下載和超過 10 萬個社群創建的變體,Google將這一數字視為開發者廣泛採用的證據。
Gemma 4 可立即在 Hugging Face、Kaggle 和 Ollama 上使用,31B 和 26B 型號可透過 Google AI Studio 訪問,Edge 模型可透過 AI Edge Gallery 存取。
授予 Apache 2.0 許可的決定是此次發布最重要的商業信號:它消除了先前 Gemma 條款下阻止某些企業和商業部署的限制,為廣泛的生產用例開放了生態系統。







