Gemma 4Google多模态开源 开源模型

Google Gemma 4 4

Gemma系列 · Google · 2026-04发布

开源支持本地部署多模态国内可直连有免费额度长上下文代码专用

模型介绍

Google 2026 开源旗舰 Gemma 4,四种架构五档尺寸,31B 与 26B MoE 分别在 Arena 排名开源第 3/6,140+ 语言、最多 256K 上下文,Apache-2.0 可商用。

模型基础信息

模型系列Gemma系列
开发机构Google
发布时间2026-04
参数规模E2B / E4B / 12B / 26B-A4B / 31B
上下文窗口256K
模型类型多模态(文本+图像)
中文能力良好
使用方式网页体验 / API调用 / 本地部署

免费额度与收费政策

开源免费

免费规则详情

Apache-2.0 自由商用。

收费标准简介

本地零成本。

模型能力介绍

✅ 核心优势

  • 开源 SOT
  • 多尺寸
  • 140+ 语�
  • 256K 上下文

⚠️ 短板与局限

  • 中文一般
  • 31B 显存需求高

🎯 适用场景

  • 本地部署
  • gent
  • 端侧
  • 编码

模型使用教程

本章节整理 Google Gemma 4 的在线体验、API调用、本地部署全套入门教程,快速上手使用该模型。

  • 本地体验:ollama run gemma-4 或 Transformers / vLLM 加载。
  • 云端:HF 托管模型可在线体验。
ollama run gemma-4 "用中文介绍一下Google Gemma 4"
HF_ENDPOINT=https://hf-mirror.com huggingface-cli download Google/Gemma 4 --local-dir ./gemma-4

或 ModelScope 国内直连下载。

from transformers import AutoModelForCausalLM, AutoTokenizer
model = AutoModelForCausalLM.from_pretrained('Google/Gemma 4')
tok = AutoTokenizer.from_pretrained('Google/Gemma 4')
code = tok.apply_chat_template([{'role':'user','content':'你好'}], tokenize=False)
print(model.generate(**tok(code, return_tensors='pt')))

Gemma 4 是 Google 开源多模态系列(E2B/E4B/12B/26B-A4B/31B),Apache-2.0。

  1. 端侧(E2B/E4B)Ollama:

ollama pull gemma4:e2b

  1. 交互使用:

ollama run gemma4:e2b

  1. 31B 用 vLLM:

pip install vllm && vllm serve google/gemma-4-31b-it --port 8000

  1. 26B-A4B MoE 专为低延迟设计,泛化好且速度快。

Tips:31B 量化 Q4 约 17.5GB、26B MoE 量化约 14GB;按显存选档。

💡 使用小技巧

ollama pull gemma4 体验。

❓ 常见问题 FAQ

Q1:Gemma 4 亮点?\nA1:开源最强多尺寸。

访问备注与注意事项