官方资料核对 · 2026年9月20日

Google Gemini
让科研与创造更进一步

以 Gemini 3.8 Flash 为通用起点,按任务选择推理、图片与语音模型。
Gemini 模型特别适合科研工作人员,辅助文献阅读、数据分析和科研编程。

Gemini 官网入口:Google AI Gemini 3.8 国内使用指南【2026年9月更新】 →

Gemini 官网入口:Google AI Gemini 3.1 国内使用指南,包括 Gemini 3.1、Gemini 3.8 Flash →

ChatGPT 官方下载入口:Windows、Mac、iPhone、Android 安装指南 →

认识最新的 Gemini 模型家族

通用推理、轻量任务、图片创作与实时语音,各有合适的型号。

推理与工具协作

Gemini 3.8 Flash 与 3.1 Pro 支持思考和函数调用,可辅助拆解研究问题、编写代码,并接入检索与数据处理工具。

多模态资料理解

文本、图片、音频、视频和 PDF 都能成为分析材料。理解图像与生成图像是不同能力,图片创作请选 Nano Banana 系列。

长上下文阅读

3.8 Flash、3.1 Pro 与 3.5 Flash-Lite 的输入上限为 1,048,576 tokens,适合处理长文档和代码。实际还受文件、媒体及输出限制影响。

当前值得了解的 Gemini 型号

不同系列分别更新,不能把所有型号统一叫作“Gemini 3.8”。

查看完整模型目录与版本状态 →

Gemini 3.8 Flash

稳定版 · 通用

面向软件工程、自主智能体和复杂工作流的最新 Flash 型号。

  • 适用场景:文献整理、科研代码、多步工具调用。
  • 使用提示:支持多模态输入、文本输出、结构化输出及搜索接地。
了解型号与官方资料 →

Gemini 3.1 Pro

预览版 · 推理

面向复杂问题求解、软件工程与精确工具使用的 Pro 型号。

  • 适用场景:复杂推理、方法比较、代码审查。
  • 使用提示:API ID 为 gemini-3.1-pro-preview,当前仍是预览版。
了解型号与官方资料 →

Gemini 3.5 Flash-Lite

稳定版 · 轻量

为高调用量、低延迟和成本敏感的应用设计。

  • 适用场景:批量分类、信息提取、文本翻译。
  • 使用提示:支持多模态输入与文本输出,适合边界明确的重复任务。
了解型号与官方资料 →

Nano Banana 2

稳定版 · 图片

Gemini 3.1 Flash Image 的图片生成与编辑型号。

  • 适用场景:概念示意图、演示配图、视觉创意。
  • 使用提示:API ID 为 gemini-3.1-flash-image;科研数据图应由真实数据绘制。
了解型号与官方资料 →

Gemini 3.8 Live

稳定版 · 语音

面向低延迟实时语音代理,支持音频流式传输和异步函数调用。

  • 适用场景:语音助理、交互演示、实时对话。
  • 使用提示:通过 Live API 接入;更复杂的背景推理可评估 Extended Thinking 变体。
了解型号与官方资料 →

Gemini Embedding 2

稳定版 · 检索

将文本、图片、音频、视频和 PDF 映射到统一向量空间。

  • 适用场景:文献知识库、多模态检索、RAG。
  • 使用提示:API ID 为 gemini-embedding-2,输出为向量而不是聊天回答。
了解型号与官方资料 →

把问题拆开,让工具参与

Gemini 3.8 Flash 支持函数调用、代码执行和搜索接地。开发者可以把模型接入检索、数据处理与计算流程,让它辅助完成多步任务。

例如先检索论文,再提取研究方法,最后生成对比表。任务是否可靠完成,仍取决于工具配置、输入材料与结果验证。

查看 3.8 Flash 能力说明 →
本站绘制的任务拆解、工具调用与反馈流程示意图

一起理解文字、图像与文档

把论文正文、图表和补充材料放进同一个问题中,借助多模态理解梳理研究结论、比较实验设置,并找出需要继续查证的细节。

3.8 Flash 和 3.1 Pro 主要输出文本;需要生成与编辑图片时选择 Nano Banana 2 或 Nano Banana Pro,需要视频创作时了解 Gemini Omni Flash。

按输入输出选择模型 →
本站绘制的 Gemini 3.8 Flash 文本、图片、音频和视频输入示意图

Gemini 模型特别适合科研工作人员

把文献阅读、数据整理和科研编程中的重复工作交给 AI 辅助,让更多时间留给问题本身。

文献阅读与研究综述

辅助阅读长篇 PDF、解释术语、提取研究问题与方法,并整理不同论文的样本、指标和局限。要求回答对应到原文页码或段落,再逐项核对引用。

选型:3.8 Flash / 3.1 Pro →

数据分析与科研编程

辅助编写 Python / R 数据清洗脚本、排查报错、解释统计方法,并根据真实数据生成绘图代码。用实际运行结果验证单位、假设和计算过程。

选型:3.1 Pro / 3.8 Flash →

研究资料与知识库

用 Embedding 2 为论文、图像和音视频建立检索索引;再由通用模型依据检索结果回答问题。适合团队资料整理、方法查找与跨模态检索。

选型:Embedding 2 + Flash →

科研选型建议基于模型的文档理解、代码与检索能力。模型输出可作为研究辅助,论文引用、实验结论和统计结果仍需由研究人员核验。

开发者中心

使用 Google Gen AI SDK,从一次文本请求开始。

Python
# 安装:pip install -U google-genai
# 在环境变量中配置 GEMINI_API_KEY
from google import genai

client = genai.Client()
interaction = client.interactions.create(
    model="gemini-3.8-flash",
    input="请设计一份文献比较表模板,包含研究问题、"
             "方法、样本、指标、局限与待核验引用。"
)
print(interaction.output_text)

从真实型号开始接入

示例调用 Gemini 3.8 Flash 的文本生成功能。文献处理需另外提供原文或文件;联网检索、代码执行与函数调用需要按文档配置相应工具。API 权限、额度和费用以账户与官方说明为准。

查看 API 文档

用官方规格做模型比较

先比较输入输出与版本状态,再用真实科研任务测试质量、延迟和费用。

常用型号参数,资料核对于 2026-09-20
模型状态输入上限输出上限 / 维度
Gemini 3.8 Flash稳定版1,048,576 tokens65,536 tokens
Gemini 3.1 Pro预览版1,048,576 tokens65,536 tokens
Gemini 3.5 Flash-Lite稳定版1,048,576 tokens65,536 tokens
Gemini 3.8 Live稳定版131,072 tokens65,536 tokens
Gemini Embedding 2稳定版8,192 tokens128 至 3,072 维

Token 不等同于字数。文件、音视频与会话有独立限制;Embedding 输出为向量。查看完整说明与官方来源 →

从一个具体的科研任务开始

下面是可自行调整的提示词示例。

读懂一篇论文

“根据我提供的论文,按研究问题、方法、实验设置、主要结论和局限整理摘要;每项标出对应页码,原文没有的信息请注明。”

检查分析代码

“检查这段数据分析代码的缺失值处理、单位、统计假设和可复现性。先指出潜在问题,再给修改建议,不要编造运行结果。”

比较研究方法

“只根据我提供的三篇论文,对比研究对象、数据来源、评估指标和适用条件。区分作者的结论与推测,并列出尚待验证的问题。”

关于 Gemini 与科研应用的常见问题

现在最新的 Gemini 模型是什么?

截至 2026 年 9 月 20 日,官方目录中的最新通用 Flash 型号为 Gemini 3.8 Flash,实时语音系列为 Gemini 3.8 Live。Pro、Flash-Lite、Image 和 Embedding 分别迭代,不能用单一版本号概括整个家族。

科研人员该选 Flash 还是 Pro?

文献整理、常规科研代码与工具流程可先评估 3.8 Flash;复杂推理、方法比较和代码审查可对比 3.1 Pro 预览版。批量分类、翻译和简单信息提取可尝试 3.5 Flash-Lite,用自己的任务集比较质量与成本。

Gemini 能直接生成可靠的论文引用吗?

不要把模型生成的引文直接当作已核验来源。优先提供原始论文或配置检索工具,要求返回出处,再核对标题、作者、DOI、页码与结论。论文摘要和实验数据也应回到原文检查。

如何开始使用 Gemini?

普通用户可通过 Gemini App 查看当前账户可用的功能;开发者可在 Google AI Studio 获取 API 密钥,并参考官方文档接入。App 中的模式、订阅与 API 型号不是同一个概念,访问范围取决于地区与账户。

最新 Gemini 模型都免费吗?

不是。不同模型的免费层级、速率限制和收费方式不同,图片、语音、视频也有独立计费口径。稳定版或预览版表示版本状态,不代表是否免费;实际费用请查看官方价格页。

研究材料可以直接上传吗?

上传前确认材料授权与所在机构的数据要求。官方价格页区分免费层级和付费层级的数据使用政策;未公开论文、受试者资料和合作方数据应按适用条款处理,避免把付费直接理解为任何数据都可上传。

Gemini 官方网页版和 API 有什么区别?

官方网页版更适合直接对话、上传资料和个人体验;API 面向开发者,需要在 Google AI Studio 或相关开发平台中配置密钥,并按接口文档处理模型、额度和费用。网页版的订阅、功能入口与 API 权限不是同一个概念。

使用 Gemini 分析 PDF 前要注意什么?

先确认文件来源、分享权限和隐私要求,再上传论文、报告或合同。可以要求模型按章节、页码或原文段落给出依据;涉及关键数据、引用和实验结论时,仍应回到 PDF 原文逐项核对。

资料来源:官方模型目录 · API 价格与数据使用说明 · 型号生命周期。能力介绍按官方资料整理,科研应用与提示词为本站建议。