Google 会使用 AI 技术将内容翻译成您偏好的语言。AI 翻译可能包含错误。
Gemini 3.1 Flash-Lite
使用集合让一切井井有条
根据您的偏好保存内容并对其进行分类。
Gemini 3.1 Flash-Lite 是我们最经济高效的 Gemini 模型,专为大体量、成本敏感型大语言模型 (LLM) 流量而设计,并针对低延迟应用场景进行了优化。
与
Gemini 2.5 Flash-Lite 相比,它在质量方面有了显著提升,在关键功能领域与 Gemini 2.5 Flash 的性能相当:
- 回答质量有所提升: 旨在与 2.5 Flash 的性能相当。
- 指令遵循能力有所提升: 针对性改进,可作为复杂聊天机器人和指令繁重型工作流的可靠迁移路径。
- 音频输入能力有所提升: 提升了自动语音识别 (ASR) 等任务的音频输入质量。
- 扩展了思考支持: 您可以选择最低、低、中或高思考级别,以控制模型执行的推理量
。借助此功能,您可以针对特定应用场景平衡回答质量和速度。
在 Agent Studio 中试用
部署示例应用
查看价格
注意:“部署示例应用”需要启用结算功能和 Agent Platform API 的 Google Cloud 项目。
| 模型
ID |
gemini-3.1-flash-lite |
| 模态 |
description
photo
mic
videocam
|
| token 数量上限 |
上下文窗口 |
1,048,576 |
| 输出词元数上限 |
65536 |
| 功能 |
|
| 工具 |
|
| 使用选项 |
|
| 技术规范 |
图片
photo
|
|
|
文本
description
|
|
|
视频
videocam
|
|
|
音频
mic
|
|
| 参数默认值 tune |
|
| 支持的区域 |
模型可用性
|
|
|
机器学习处理
|
|
| 版本 |
gemini-3.1-flash-lite
- 发布阶段:正式版
- 发布日期:2026 年 5 月 7 日
- 停用日期:2027 年 5 月 7 日或之后
|
| 安全控制 |
在线预测 |
|
| 批量推理 |
|
| 上下文缓存 |
|
| 如需了解详情,请参阅安全控制。 |
如未另行说明,那么本页面中的内容已根据知识共享署名 4.0 许可获得了许可,并且代码示例已根据 Apache 2.0 许可获得了许可。有关详情,请参阅 Google 开发者网站政策。Java 是 Oracle 和/或其关联公司的注册商标。
最后更新时间 (UTC):2026-08-08。
[[["易于理解","easyToUnderstand","thumb-up"],["解决了我的问题","solvedMyProblem","thumb-up"],["其他","otherUp","thumb-up"]],[["很难理解","hardToUnderstand","thumb-down"],["信息或示例代码不正确","incorrectInformationOrSampleCode","thumb-down"],["没有我需要的信息/示例","missingTheInformationSamplesINeed","thumb-down"],["翻译问题","translationIssue","thumb-down"],["其他","otherDown","thumb-down"]],["最后更新时间 (UTC):2026-08-08。"],[],[]]