Gemma
谷歌轻量开源模型
官网: 立即访问
所属分类: AI训练模型
工具介绍
Gemma具体信息
Gemma是谷歌(Google DeepMind)推出的新一代轻量级开放模型系列,于2024年2月首次发布,名称源自拉丁语中"宝石"之意。它基于与谷歌旗舰级Gemini相同的研究和技术体系构建,定位为可本地运行、开放权重的高性能小模型。
与Gemini云端订阅制闭源模式不同,Gemma以Apache 2.0协议全面开源,模型权重免费下载,支持个人、商业和企业用途,允许自由修改与再分发。自发布以来,Gemma系列累计下载量已超过4亿次,社区衍生变体超过10万个。从手机、树莓派等边缘设备到高性能工作站,Gemma提供多种尺寸规格,让前沿AI能力不再局限于云端数据中心,而是真正落到每一位开发者和用户手中。
多尺寸模型矩阵:从专为手机和IoT设备设计的E2B、E4B轻量版本,到采用混合专家(MoE)架构的26B模型,再到追求极致性能的31B密集模型,覆盖全场景硬件。
多模态理解:全系列支持图片和视频输入,部分版本原生支持音频输入,可完成OCR识别、图表理解、语音转录与翻译等任务。
超长上下文窗口:轻量版支持128K上下文,26B与31B版本扩展至256K,可在单次提示中处理完整代码库或长篇文档。
多语言与智能体能力:预训练覆盖140多种语言;原生支持函数调用、JSON结构化输出和系统指令,可构建与外部工具和API交互的自主Agent应用。
强大推理与代码能力:在数学推理、多步逻辑、代码生成等基准测试中表现优异,手机端的2B模型推理能力已接近上一代270亿参数的桌面模型。
在线快速体验:在Hugging Face等平台可直接在线试玩Gemma模型,无需任何本地配置。
本地命令行部署:推荐使用Ollama,一条命令即可完成下载与运行,例如 ollama run gemma4:e2b,无需配置复杂的深度学习环境。
手机端运行:通过谷歌官方应用AI Edge Gallery,可在Android和iOS设备上离线运行Gemma模型,飞行模式下也能正常使用。
云端规模化部署:企业可通过Google Vertex AI、Cloud Run、GKE等云服务快速接入,实现弹性扩展。
主流框架集成:Gemma已支持Transformers、vLLM、llama.cpp、MLX、Keras等主流推理与训练框架,方便开发者深度集成到自有应用中。
轻量高效:以极小参数量实现接近大模型的性能,2B手机端模型在科学知识基准上的得分已追平上一代27B桌面模型,单位参数智能密度高。
全面开源:Apache 2.0协议下商用无版税、无用途限制,内置专利保护机制,为企业级用户提供额外法律保障。
数据主权:模型完全本地运行,对话数据不离开设备,契合医疗、金融、工业等对数据安全和合规有严格要求的行业。
零使用成本:本地部署后免Token费用,无使用次数限制,彻底告别Token焦虑。
部署门槛低:小尺寸版本量化后仅需3-5GB内存,普通手机、入门级电脑乃至树莓派皆可运行。
生态完善:与NVIDIA等硬件厂商深度合作,从推理到微调的完整流程均有成熟工具链支持。
在开源模型领域,Gemma的主要竞品包括Meta的Llama系列和阿里Qwen系列等。
与Llama相比:Gemma原生多模态更全面,全系支持图像、视频及部分音频输入;Gemma 4采用Apache 2.0全面开源,而Llama部分版本采用自定义社区许可,商用限制更多;Gemma在边缘设备适配与推理速度上更优,Llama 8B则在复杂逻辑推理上表现稳健。
与Qwen相比:Qwen同样提供多尺寸与超长上下文,而Gemma背靠Gemini同源技术,在多模态、函数调用与Agent能力上整合更完善,并与Vertex AI、AICore等Google生态深度打通。
总体而言,Gemma的差异化优势在于轻量级尺寸下的高智能密度、原生多模态能力、Apache 2.0全面开源,以及从手机到数据中心的完整部署生态。
Q1: Gemma和Gemini是什么关系?
A1: 两者基于同一套研究和技术体系构建,Gemma可理解为Gemini的轻量开放版。区别在于Gemini是云端订阅制的闭源产品,而Gemma是免费下载、可本地运行的开放模型。
Q2: Gemma完全免费吗?
A2: 是的。Gemma采用Apache 2.0协议,权重免费下载,个人、商业和企业用途均可,无Token费用和使用次数限制。
Q3: Gemma可以在手机上运行吗?
A3: 可以。E2B和E4B轻量版本专为移动端设计,量化后仅需3-5GB内存,可通过谷歌AI Edge Gallery应用在Android和iOS设备上完全离线运行。
Q4: Gemma支持中文吗?
A4: 支持。Gemma预训练覆盖140多种语言,在中文问答、写作和翻译等任务上均有良好表现。
Q5: 运行Gemma需要什么样的硬件配置?
A5: E2B量化后约需3.2GB内存,E4B约需5GB,普通手机或入门电脑即可运行;26B MoE版建议32GB以上内存;31B Dense版建议搭配高性能GPU或64GB内存设备。
Q6: 我可以将Gemma集成到自己的商业产品中吗?
A6: 可以。Apache 2.0协议允许将Gemma合法打包进产品、服务和硬件设备中交付,可用于商业用途,且允许自由修改和再分发。
Gemma数据分析
数据更新于 2026-08-01,每月更新一次,预计15号之前完成更新,数据仅统计主域名:google.dev。
总访问量
9,430,000
环比变化
-8.72%
平均停留
00:01:59
跳出率
51.87%
- 直接访问 40.50%
- 搜索引擎 30.06%
- 展示广告 0.44%
- 引荐流量 14.23%
- 社交媒体 3.57%
- 邮件 0.53%
- 其他 10.67%
- United States 15.32%
- India 11.48%
- Russia 6.54%
- China 5.56%
- Republic of 3.87%