Gemini 3.8 Flash
gemini-3.8-flash
面向长流程软件工程、自主智能体和复杂企业工作流的 Flash 模型。适合作为新项目的通用模型评估起点。
能力与使用提示
输入支持文本、图片、视频、音频和 PDF;输出为文本。支持思考、结构化输出与搜索接地。
从日常问答到代码、图片与实时语音,
按任务了解各个型号的能力、区别和使用边界。
资料核对:基于 Google 官方文档 · Gemini API 口径
查看资料来源 ↗以下是选型起点,最终用你的真实任务比较效果、延迟与费用。
涵盖主要通用与专用型号。点开使用提示,了解能力边界。
gemini-3.8-flash
面向长流程软件工程、自主智能体和复杂企业工作流的 Flash 模型。适合作为新项目的通用模型评估起点。
输入支持文本、图片、视频、音频和 PDF;输出为文本。支持思考、结构化输出与搜索接地。
gemini-3.1-pro-preview
面向复杂问题求解、软件工程和需要准确使用工具的智能体工作流,强调推理质量与多步执行可靠性。
多模态输入、文本输出。另有 customtools 端点,面向混合使用 Bash 与自定义工具的应用。
gemini-3.5-flash-lite
面向高调用量、低延迟应用的轻量多模态模型,适合将大量边界明确的任务分配给子智能体。
支持思考、函数调用和结构化输出;不支持图片生成、Live API 或计算机使用。
gemini-3.7-flash
上一代 Flash 模型,侧重复杂编码、智能体工作流与多步任务执行。
已有集成可继续评估;新项目可同时测试 3.8 Flash。版本号不能替代真实业务评测。
gemini-3.6-flash
在一般智能体任务、日常任务与多模态理解之间平衡速度和能力的上一代 Flash 模型。
官方仍列为稳定版;不要将“上一代”理解为“已经关停”。
gemini-3.5-flash
较早的 3.x Flash 稳定型号,面向日常高吞吐量工作负载。
适合与较新 Flash 型号做质量、延迟及成本回归对比。
gemini-3.1-flash-lite
3.1 系列的轻量多模态型号,偏向高频任务和成本敏感的应用。
官方列出的最早关停日期为 2027-05-07,建议替换为 3.5 Flash-Lite。
gemini-3.1-flash-image
Gemini 3.1 Flash 的图片生成与编辑型号,强调生成效率和规模化视觉内容生产。
这是图片专用型号。其计费与通用 Flash 不同,图片输出价格随分辨率变化。
gemini-3-pro-image
侧重上下文理解、复杂画面布局和文字渲染的图片生成与编辑模型,官方介绍包含最高 4K 视觉输出。
当前稳定 ID 不带 preview;旧 gemini-3-pro-image-preview 已关闭。
gemini-3.1-flash-lite-image
面向高流量交互场景的图片生成与编辑型号,主打低延迟和成本效率。
Lite 是图片模型变体,不能用通用 gemini-3.1-flash-lite ID 替代。
gemini-3.8-live
Google 推荐用于多数低延迟实时语音代理的 Live API 模型,支持音频流式传输与异步函数调用。
通过 Live API 使用。需要文字转写时启用音频转写;不支持普通文本模型的全部工具。
gemini-3.8-live-extended-thinking
面向需要在语音互动中进行更多背景推理的场景,是 3.8 Live 家族的扩展思考变体。
按实时对话需求选择;普通低延迟语音场景可先评估标准 3.8 Live。
gemini-3.1-flash-tts-preview
可通过提示引导语音风格的文字转语音模型,支持表现力音频标记以细化旁白控制。
TTS 用于合成语音;双向实时对话应选择 Live API 型号。
gemini-3.5-transcribe
专门将语音转成文字,支持语言检测、说话人区分、字词级时间戳和自定义词汇纠偏。
实时流式转写另用 gemini-3.5-transcribe-live;转写不等同于语音生成。
gemini-3.5-live-translate-preview
面向低延迟实时语音翻译,官方介绍支持 70 多种语言。
这是专门的实时翻译型号;接入前核对目标语言与 Live API 的要求。
gemini-omni-1.1-flash
用于视频生成、视频编辑、关键帧插值与视频扩展,支持原生音频。
价格页已列为付费层级正式版;旧 gemini-omni-flash-preview 的最早关停日期为 2026-09-30。
gemini-embedding-2
将文本、图片、视频、音频和 PDF 映射到统一向量空间,用于跨模态检索与相似度计算。
输入上限 8,192 tokens;支持 128 至 3,072 维,推荐 768、1,536 或 3,072 维。输出是向量。
gemini-embedding-001
面向文本语义搜索、分类和 RAG 的嵌入模型,适合已有文本向量库。
官方列出的最早关停日期为 2028-05-14。迁移 Embedding 2 时需评估向量兼容性并重建索引。
gemini-robotics-er-2-preview
面向机器人任务的具身推理模型,涵盖视频理解、空间推理、多步工具编排和多机器人协作。
属于专用模型;ER 1.6 预览版已到官方列出的关停日期,新项目应核对 ER 2 接入文档。
试试其他名称或用途,或清除搜索条件。
同样叫 Gemini,不代表输入、输出和调用方式相同。
| 型号 | 输入上限 | 输出上限 / 维度 | 输入 → 输出 | 选型重点 |
|---|---|---|---|---|
| 3.8 Flash ↗ | 1,048,576 | 65,536 tokens | 文本、图片、视频、音频、PDF → 文本 | 通用任务与智能体 |
| 3.1 Pro Preview ↗ | 1,048,576 | 65,536 tokens | 文本、图片、视频、音频、PDF → 文本 | 复杂推理与软件工程 |
| 3.5 Flash-Lite ↗ | 1,048,576 | 65,536 tokens | 文本、图片、视频、音频、PDF → 文本 | 高吞吐、成本敏感 |
| 3.8 Live ↗ | 131,072 | 65,536 tokens | 文本、图片、音频、视频 → 音频 / 转写 | 实时双向语音 |
| Embedding 2 ↗ | 8,192 | 128 至 3,072 维 | 文本、图片、视频、音频、PDF → 向量 | 检索与相似度计算 |
输入和输出限制分别列示,不代表每次请求都能达到两项上限。文件、音视频时长及会话还有独立限制;Live 的文字结果需按文档启用转写。
通用模型通常分别计量输入与输出 token;图片要看分辨率,语音要看音频输入输出,视频也有独立计费口径。缓存、Batch、搜索工具与免费层级各有条件,不能只按模型名称推算总价。
查看官方实时价格 ↗旧版本不一定已关闭;带 Preview 的 ID 也不能直接当成稳定版使用。
适合需要固定版本的正式应用。仍需关注生命周期公告。
可用于评估新能力,可能有更严格的限额和版本变动。
会随新发布切换到不同版本,需要可复现结果时优先固定 ID。
gemini-2.5-pro、gemini-2.5-flash、gemini-2.5-flash-lite。分别面向复杂推理、低延迟任务与成本敏感应用。官方当前未公布这三个稳定型号的关停日期。gemini-3-flash-preview 仍列为预览型号;弃用页建议替换为 gemini-3.6-flash,新应用也可评估较新的 Flash 稳定版。gemini-3.1-flash-live-preview 与 gemini-2.5-flash-native-audio-preview-12-2025 建议迁移至 3.8 Live。gemini-2.5-flash-preview-tts、gemini-2.5-pro-preview-tts 建议评估 3.1 Flash TTS。gemini-2.5-flash-image 已弃用,官方列出 2026-10-02 关停计划。价格页建议迁移至 Nano Banana 2 或 Nano Banana 2 Lite。gemini-3-pro-preview、gemini-3.1-flash-lite-preview,以及旧的 Nano Banana 2 / Pro 图片预览端点。不要直接复制旧教程中的 ID。官方弃用表列示的日期是最早关停日期;最终可用性与确切通知请查阅 模型弃用公告 ↗。
先看任务,再看后缀。Flash 可以作为通用与智能体应用的评估起点;复杂推理可对比 Pro;大量简单、边界明确的任务可以先测 Flash-Lite。不同代际不能仅凭后缀排序,也没有对所有任务都最好的一个模型。
不能这样推断。3.8 Flash、3.1 Pro 等支持图片输入,但输出是文本。生成或编辑图片需要 Nano Banana 系列的 Image 型号;生成视频则需要 Omni Flash 等视频模型。
不完全相同。Gemini App 的模式、套餐与功能入口和开发者 API 的具体端点是不同层次。本文以 Gemini API 文档为准,不把 App 套餐或界面名称当作 API ID,也不据此承诺所有账号都能使用。
不是同一种分类。Deep Think 是产品中的深度推理能力名称,不应自行拼成 API 型号;Deep Research 是研究型代理。Veo 属于视频生成系列,Lyria 属于音乐生成系列,虽然出现在 Gemini API 生态中,也不等同于 Gemini 通用文本模型。
不是。Preview 表示版本状态,免费层级表示计费与配额。预览型号可能需要付费,稳定型号也可能提供有限免费额度。具体区域、模型访问权限及价格以官方文档和账户可用项为准。
核对日期:2026-09-20。内容为官方资料的中文整理,选型建议是本站的使用建议。
官方总目录与详情页可能存在更新时差。本文对 Embedding 2 的 ID 采用型号详情页的稳定版信息,对 Omni 的正式版状态参考价格页与弃用页。接入前请再次核对具体型号文档。