Gemma

Gemma

谷歌轻量开源模型

官网: 立即访问

所属分类: AI训练模型

工具介绍
Gemma是谷歌DeepMind推出的新一代轻量级开放大语言模型,开源免费可商用,支持本地部署与多模态处理,覆盖多种参数版本,性能媲美大型模型,助力开发者高效构建AI应用。
Gemma具体信息

Gemma是谷歌(Google DeepMind)推出的新一代轻量级开放模型系列,于2024年2月首次发布,名称源自拉丁语中"宝石"之意。它基于与谷歌旗舰级Gemini相同的研究和技术体系构建,定位为可本地运行、开放权重的高性能小模型。

与Gemini云端订阅制闭源模式不同,Gemma以Apache 2.0协议全面开源,模型权重免费下载,支持个人、商业和企业用途,允许自由修改与再分发。自发布以来,Gemma系列累计下载量已超过4亿次,社区衍生变体超过10万个。从手机、树莓派等边缘设备到高性能工作站,Gemma提供多种尺寸规格,让前沿AI能力不再局限于云端数据中心,而是真正落到每一位开发者和用户手中。

多尺寸模型矩阵:从专为手机和IoT设备设计的E2B、E4B轻量版本,到采用混合专家(MoE)架构的26B模型,再到追求极致性能的31B密集模型,覆盖全场景硬件。

多模态理解:全系列支持图片和视频输入,部分版本原生支持音频输入,可完成OCR识别、图表理解、语音转录与翻译等任务。

超长上下文窗口:轻量版支持128K上下文,26B与31B版本扩展至256K,可在单次提示中处理完整代码库或长篇文档。

多语言与智能体能力:预训练覆盖140多种语言;原生支持函数调用、JSON结构化输出和系统指令,可构建与外部工具和API交互的自主Agent应用。

强大推理与代码能力:在数学推理、多步逻辑、代码生成等基准测试中表现优异,手机端的2B模型推理能力已接近上一代270亿参数的桌面模型。

在线快速体验:在Hugging Face等平台可直接在线试玩Gemma模型,无需任何本地配置。

本地命令行部署:推荐使用Ollama,一条命令即可完成下载与运行,例如 ollama run gemma4:e2b,无需配置复杂的深度学习环境。

手机端运行:通过谷歌官方应用AI Edge Gallery,可在Android和iOS设备上离线运行Gemma模型,飞行模式下也能正常使用。

云端规模化部署:企业可通过Google Vertex AI、Cloud Run、GKE等云服务快速接入,实现弹性扩展。

主流框架集成:Gemma已支持Transformers、vLLM、llama.cpp、MLX、Keras等主流推理与训练框架,方便开发者深度集成到自有应用中。

轻量高效:以极小参数量实现接近大模型的性能,2B手机端模型在科学知识基准上的得分已追平上一代27B桌面模型,单位参数智能密度高。

全面开源:Apache 2.0协议下商用无版税、无用途限制,内置专利保护机制,为企业级用户提供额外法律保障。

数据主权:模型完全本地运行,对话数据不离开设备,契合医疗、金融、工业等对数据安全和合规有严格要求的行业。

零使用成本:本地部署后免Token费用,无使用次数限制,彻底告别Token焦虑。

部署门槛低:小尺寸版本量化后仅需3-5GB内存,普通手机、入门级电脑乃至树莓派皆可运行。

生态完善:与NVIDIA等硬件厂商深度合作,从推理到微调的完整流程均有成熟工具链支持。

在开源模型领域,Gemma的主要竞品包括Meta的Llama系列和阿里Qwen系列等。

与Llama相比:Gemma原生多模态更全面,全系支持图像、视频及部分音频输入;Gemma 4采用Apache 2.0全面开源,而Llama部分版本采用自定义社区许可,商用限制更多;Gemma在边缘设备适配与推理速度上更优,Llama 8B则在复杂逻辑推理上表现稳健。

与Qwen相比:Qwen同样提供多尺寸与超长上下文,而Gemma背靠Gemini同源技术,在多模态、函数调用与Agent能力上整合更完善,并与Vertex AI、AICore等Google生态深度打通。

总体而言,Gemma的差异化优势在于轻量级尺寸下的高智能密度、原生多模态能力、Apache 2.0全面开源,以及从手机到数据中心的完整部署生态。

Q1: Gemma和Gemini是什么关系?
A1: 两者基于同一套研究和技术体系构建,Gemma可理解为Gemini的轻量开放版。区别在于Gemini是云端订阅制的闭源产品,而Gemma是免费下载、可本地运行的开放模型。
Q2: Gemma完全免费吗?
A2: 是的。Gemma采用Apache 2.0协议,权重免费下载,个人、商业和企业用途均可,无Token费用和使用次数限制。
Q3: Gemma可以在手机上运行吗?
A3: 可以。E2B和E4B轻量版本专为移动端设计,量化后仅需3-5GB内存,可通过谷歌AI Edge Gallery应用在Android和iOS设备上完全离线运行。
Q4: Gemma支持中文吗?
A4: 支持。Gemma预训练覆盖140多种语言,在中文问答、写作和翻译等任务上均有良好表现。
Q5: 运行Gemma需要什么样的硬件配置?
A5: E2B量化后约需3.2GB内存,E4B约需5GB,普通手机或入门电脑即可运行;26B MoE版建议32GB以上内存;31B Dense版建议搭配高性能GPU或64GB内存设备。
Q6: 我可以将Gemma集成到自己的商业产品中吗?
A6: 可以。Apache 2.0协议允许将Gemma合法打包进产品、服务和硬件设备中交付,可用于商业用途,且允许自由修改和再分发。

Gemma
社交媒体

Gemma数据分析

数据更新于 2026-08-01,每月更新一次,预计15号之前完成更新,数据仅统计主域名:google.dev。

总访问量

9,430,000

环比变化

-8.72%

平均停留

00:01:59

跳出率

51.87%

Gemma访问来源占比
  • 直接访问 40.50%
  • 搜索引擎 30.06%
  • 展示广告 0.44%
  • 引荐流量 14.23%
  • 社交媒体 3.57%
  • 邮件 0.53%
  • 其他 10.67%
Gemma地区分布
  • United States 15.32%
  • India 11.48%
  • Russia 6.54%
  • China 5.56%
  • Republic of 3.87%
Gemma搜索关键词
gemini
流量 1,120,000 搜索量 130,000,000 CPC 0.24
google ai studio
流量 616,870 搜索量 6,050,000 CPC 0.33
gemini ai
流量 338,800 搜索量 18,630,000 CPC 0.19
gemini api
流量 264,850 搜索量 606,260 CPC 1.78
google gemini
流量 152,520 搜索量 9,230,000 CPC 0.21
Gemma访问趋势(最近2个月)

Gemma同类推荐

腾讯混元大模型
腾讯混元大模型

腾讯自研中文大模型

Scale AI
Scale AI

AI数据标注训练平台

HuggingFace
HuggingFace

全球AI模型开源社区

DeepSpeed
DeepSpeed

低成本大模型训练