Gemma 3 3
Gemma系列 · Google · 2025-03发布
模型介绍
Google 的开源多模态模型系列,升级支持图像输入,1B 到 27B 覆盖轻量到中端,128K 上下文,在自有硬件上表现优秀,适合端侧与私有化。
模型基础信息
免费额度与收费政策
免费规则详情
权重免费,遵守 Gemma 使用条款可商用。
收费标准简介
本地零成本;Vertex AI 托管按 token 计费。
模型能力介绍
✅ 核心优势
- 开源多模态(可看图)
- 轻量尺寸端侧友好
- 128K 长上下文
- 与 Gemini 同源技术
⚠️ 短板与局限
- 视觉能力弱于专精模型
- 中文一般
- 许可为自定义条款
🎯 适用场景
- 端侧多模态应用
- 图像理解入门
- 低成本本地推理
- 隐私敏感场景
模型使用教程
本章节整理 Gemma 3 的在线体验、API调用、本地部署全套入门教程,快速上手使用该模型。
Gemma 3 是 Google 的开源多模态模型,可输入文本+图像。轻量版(1B/4B)适合手机端与边缘设备。
HF_ENDPOINT=https://hf-mirror.com huggingface-cli download google/gemma-3-12b-it --local-dir ./gemma3
from transformers import pipeline
pipe = pipeline("text-generation", model="google/gemma-3-12b-it")
print(pipe("介绍一下Gemma 3")[0]["generated_text"])
Gemma 3 是 Google 开源的多模态模型(1B/4B/12B/27B),支持图像理解与 128K 上下文,4B 量化后 6GB 显存可跑。
- Ollama 一键:
ollama pull gemma3:4b
- 交互使用:
ollama run gemma3:4b
- transformers 加载 12B:
python -c "from transformers import AutoModelForCausalLM; AutoModelForCausalLM.from_pretrained('google/gemma-3-12b-it', device_map='auto')"
Tips:27B 建议 48GB 显存;12B 支持多模态图像输入(Ollama 直接传图)。
💡 使用小技巧
ollama pull gemma3 一键体验。
多模态选 12B 及以上版本效果更好。
❓ 常见问题 FAQ
Q1:Gemma 3 能看图吗?
A1:能,支持图像输入的多模态。
Q2:27B 需要多大显存?
A2:Q4 约 16GB。
访问备注与注意事项
- 权重 hf-mirror 可下
- 需同意 Gemma 条款
Aitishiku.com