闭源大模型·海外

Google Gemini 3.1 Flash-Lite 3.1 Flash-Lite

Gemini 3.1 Flash系列 · Google DeepMind · 2026-05发布

闭源多模态有免费额度长上下文

模型介绍

Gemini 3 系列中成本最低、延迟最低的模型,1M 上下文,支持文本/图像/视频/音频/PDF 输入,面向高频轻量任务与 Agent 工作流,2026-05-07 GA。

模型基础信息

模型系列Gemini 3.1 Flash系列
开发机构Google DeepMind
发布时间2026-05
参数规模闭源(未公开)
上下文窗口1M
模型类型多模态(文本+图像+视频+音频)
中文能力良好
使用方式网页体验 / API调用

免费额度与收费政策

AI Studio 免费层 API 按量

免费规则详情

Google AI Studio 提供免费层;API 按 token 计费。

收费标准简介

输入 $0.25/M(文本/图片/视频)、$0.50/M(音频),输出 $1.50/M。

模型能力介绍

✅ 核心优势

  • 成本与延迟最低
  • 1M 上下文
  • 原生多模态输入
  • 免费层可用

⚠️ 短板与局限

  • 闭源仅云端
  • 能力弱于 Flash 更大档位
  • 国内直连受限

🎯 适用场景

  • 翻译
  • 分类
  • 内容审核
  • 简单数据抽取
  • 高并发低成本业务
  • gent 工作流

模型使用教程

本章节整理 Google Gemini 3.1 Flash-Lite 的在线体验、API调用、本地部署全套入门教程,快速上手使用该模型。

  • 体验网址:[Google AI Studio](https://aistudio.google.com) 免费体验,或 Gemini API 调用。
  • 能力简介:Gemini 3 系列中成本最低、延迟最低的模型,1M 上下文,支持文本/图像/视频/音频/PDF 输入,面向高频轻量任务与 Agent 工作流。
  • 适用场景:翻译、分类、内容审核、简单数据抽取、高并发低成本业务。
  • 使用建议:支持思考等级切换(最低/低/中/高),可兼顾成本与准确度;有免费层。
  • 开发接入:模型 ID gemini-3.1-flash-lite,2026-05-07 GA。
  1. 访问 [Google AI Studio](https://aistudio.google.com),创建 API Key(免费层可用)。
  2. 也可通过 Google Cloud Vertex AI 获取密钥。
  3. 安装 SDK:
pip install -U google-genai
  1. 设置环境变量:export GOOGLE_API_KEY=你的Key

Python 调用

from google import genai
client = genai.Client(api_key="YOUR_API_KEY")
resp = client.models.generate_content(
    model="gemini-3.1-flash-lite",
    contents="把这句话翻译成英文:今天天气很好。",
)
print(resp.text)

curl 调用

curl -X POST https://generativelanguage.googleapis.com/v1beta/models/gemini-3.1-flash-lite:generateContent \
  -H "Content-Type: application/json" \
  -H "x-goog-api-key: $GOOGLE_API_KEY" \
  -d '{"contents":[{"parts":[{"text":"总结这段文字"}]}]}'

> 提示:输入 1M tokens / 输出 64K tokens;支持上下文缓存降低费用。

💡 使用小技巧

支持思考等级切换(最低/低/中/高);上下文缓存可降低费用。

❓ 常见问题 FAQ

Q1:有免费层吗?

A1:有,AI Studio 免费层可用。

Q2:上下文多长?

A2:输入 1M / 输出 64K tokens。

访问备注与注意事项