Gemma 4是Google发布的开源大语言模型系列,参数规模为310亿(31B)。该模型基于Transformer架构,支持文本理解、生成与多步推理等任务,面向研究者和开发者开放权重,可用于本地部署与下游任务微调。作为Gemma系列的迭代版本,其设计目标是在保持较低资源需求的同时提供较强的通用语言处理能力。
使用Gemma 4 2B版本本地运行Codex时,处理速度大约每秒30到40个Token
Gemma 4采用Apache 2.0许可证,允许完全的商业自由使用
所有Gemma 4模型原生支持多模态(文本、图像、最多30秒音频输入),上下文窗口为128K Token,支持超过40种语言
Gemma 4的31B模型在M2026评测中得分89.2%,代码模型的Elo评分约为2500
Firebase AI Logic支持设备端推理时指定模型,目前支持基于Gemma 4的Gemini Nano 4预览版
Gemma 4的1B/2B模型量化后仅需4GB显存即可运行
手机用户可通过Google的AI Edge Gallery直接下载使用Gemma 4模型
Gemma 4的强项包括文档识别、发票解析、代码补全、长文档问答和Agent自动化任务,且所有处理在本地完成
通过Ollama部署Gemma 4的e4b版本,模型下载总计约9.6GB
在三台手机离线测试中,iQOO 15运行Gemma 4 1/2B模型的速度最快
还有 40 条时间轴事件
Google发布了Gemma 4系列开源模型,包含四款不同参数规模的模型
90%待验证通过Ollama部署Gemma 4的e4b版本,模型下载总计约9.6GB
85%待验证所有Gemma 4模型原生支持多模态(文本、图像、最多30秒音频输入),上下文窗口为128K Token,支持超过40种语言
85%待验证Google在Gemma 4中实际应用了MTP技术
80%待验证Gemma 4的强项包括文档识别、发票解析、代码补全、长文档问答和Agent自动化任务,且所有处理在本地完成
80%待验证Google Gemma 4模型信息通过GitHub仓库的Pull Request中Google机器人账户的引用被意外泄露
80%待验证在三台手机离线测试中,iQOO 15运行Gemma 4 1/2B模型的速度最快
80%待验证Gemma 4的1B/2B模型自带语音识别功能
80%待验证手机用户可通过Google的AI Edge Gallery直接下载使用Gemma 4模型
80%待验证使用Gemma 4 2B版本本地运行Codex时,处理速度大约每秒30到40个Token
75%已验证Gemma 4是Google最新发布的多模态开源模型
75%已验证Gemma 4系列包含1B、2B、4B、26B(MOE)和31B(Dense)四款模型
75%待验证Gemma 4的31B模型在M2026评测中得分89.2%,代码模型的Elo评分约为2500
75%部分验证Gemma 4的26B MOE模型采用混合专家架构,拥有260亿总参数但任意时刻仅约40亿参数处于激活状态
75%已验证Gemma 4采用Apache 2.0许可证,允许完全的商业自由使用
70%待验证Gemma 4的1B/2B模型量化后仅需4GB显存即可运行
60%待验证Firebase AI Logic支持设备端推理时指定模型,目前支持基于Gemma 4的Gemini Nano 4预览版
20%