Google Gemini 3.1 Flash-Lite 3.1 Flash-Lite
Gemini 3.1 Flash系列 · Google DeepMind · 2026-05发布
模型介绍
Gemini 3 系列中成本最低、延迟最低的模型,1M 上下文,支持文本/图像/视频/音频/PDF 输入,面向高频轻量任务与 Agent 工作流,2026-05-07 GA。
模型基础信息
免费额度与收费政策
免费规则详情
Google AI Studio 提供免费层;API 按 token 计费。
收费标准简介
输入 $0.25/M(文本/图片/视频)、$0.50/M(音频),输出 $1.50/M。
模型能力介绍
✅ 核心优势
- 成本与延迟最低
- 1M 上下文
- 原生多模态输入
- 免费层可用
⚠️ 短板与局限
- 闭源仅云端
- 能力弱于 Flash 更大档位
- 国内直连受限
🎯 适用场景
- 翻译
- 分类
- 内容审核
- 简单数据抽取
- 高并发低成本业务
- gent 工作流
模型使用教程
本章节整理 Google Gemini 3.1 Flash-Lite 的在线体验、API调用、本地部署全套入门教程,快速上手使用该模型。
- 体验网址:[Google AI Studio](https://aistudio.google.com) 免费体验,或 Gemini API 调用。
- 能力简介:Gemini 3 系列中成本最低、延迟最低的模型,1M 上下文,支持文本/图像/视频/音频/PDF 输入,面向高频轻量任务与 Agent 工作流。
- 适用场景:翻译、分类、内容审核、简单数据抽取、高并发低成本业务。
- 使用建议:支持思考等级切换(最低/低/中/高),可兼顾成本与准确度;有免费层。
- 开发接入:模型 ID
gemini-3.1-flash-lite,2026-05-07 GA。
- 访问 [Google AI Studio](https://aistudio.google.com),创建 API Key(免费层可用)。
- 也可通过 Google Cloud Vertex AI 获取密钥。
- 安装 SDK:
pip install -U google-genai
- 设置环境变量:
export GOOGLE_API_KEY=你的Key。
Python 调用
from google import genai
client = genai.Client(api_key="YOUR_API_KEY")
resp = client.models.generate_content(
model="gemini-3.1-flash-lite",
contents="把这句话翻译成英文:今天天气很好。",
)
print(resp.text)
curl 调用
curl -X POST https://generativelanguage.googleapis.com/v1beta/models/gemini-3.1-flash-lite:generateContent \
-H "Content-Type: application/json" \
-H "x-goog-api-key: $GOOGLE_API_KEY" \
-d '{"contents":[{"parts":[{"text":"总结这段文字"}]}]}'
> 提示:输入 1M tokens / 输出 64K tokens;支持上下文缓存降低费用。
💡 使用小技巧
支持思考等级切换(最低/低/中/高);上下文缓存可降低费用。
❓ 常见问题 FAQ
Q1:有免费层吗?
A1:有,AI Studio 免费层可用。
Q2:上下文多长?
A2:输入 1M / 输出 64K tokens。
访问备注与注意事项
- 2026-05-07 GA,Gemini 3 系列性价比之选
Aitishiku.com