All models

gemini-3-flash-preview

GoogleChatreasoningvision
Input 1.0512 Credits / 1MOutput 6.3074 Credits / 1M
Get your API key
gemini-3-flash-preview

兼顾交互效率与长上下文的多模态推理模型

Gemini 3 Flash Preview 是 Google 的多模态思考模型,面向需要交互效率、长材料理解与编码协作的应用。它能结合文字和视觉信息进行分析,并以文本或结构化结果交付。原生还具备视频、音频与 PDF 理解能力,适合把复杂材料整理为可阅读、可处理的答案。

Google模型品牌
对话模型类型
推理、视觉理解任务能力

规格与接口特性

在选型前明确容量、输入输出与调用方式。

版本定位
Gemini 3 Flash 预览版;调用 ID:gemini-3-flash-preview
原生输入上限
1,048,576 Token
原生输出上限
65,536 Token
原生输入输出
文本、图像、视频、音频、PDF 输入;文本输出
推理与组织
Thinking、结构化输出、函数调用
图文调用
/gemini/chat/completions;messages 支持 text 与 image_url 内容块
会话调用
/aichat2/conversations;支持会话 ID、图像块与文件链接块

原生容量与模态说明模型能力边界;本平台的输入组织、会话管理和工具操作分别按所用入口提供。

核心能力

了解 gemini-3-flash-preview 能为你的工作带来什么。

把图文线索放在一起理解

不仅描述图片,也能结合问题、背景文字和多张图像展开分析。适合读取界面截图、理解图表含义、比较设计方案,并把观察整理成说明或字段。输入时明确关注区域和判断标准,比只问“图片里有什么”更容易得到可用结果。

长材料与思考能力协同

较大的原生输入容量适合容纳长文档、代码片段与连续对话,Thinking 则用于分析约束、梳理关系和形成答案。可以要求它先列关键依据,再输出修改建议或总结;长上下文用于保持材料连贯,不代表所有细节都能被无误检出。

从自然语言走向结构化交付

支持结构化输出与函数调用,可把材料转换成业务字段、检查结果或工具参数。应用可通过 response_format 描述目标格式,通过函数定义说明可执行动作。模型负责理解和提出调用,实际执行、权限检查与结果回填由应用工作流承担。

适用场景

从具体任务出发,找到模型发挥作用的位置。

截图驱动的产品评审

提交产品页面截图、需求说明和验收标准,让模型识别布局问题、文案歧义与流程缺口,交付按页面区域组织的修改清单。图文放在同一条消息中,能让建议紧贴可见界面,适合原型讨论和测试问题归类,而非自动操作浏览器。

代码审阅与实现讨论

输入相关代码、错误日志和预期行为,让模型解释可能的问题路径、提出修改方案并生成测试思路。长材料能力有助于同时讨论多个关联片段,交付可包含补丁草稿与验证步骤;运行代码、安装依赖和提交变更仍应放在受控环境中。

文件问答与持续分析

通过会话入口提交文件链接和问题,借助文件读取流程整理报告要点、提取条款或比较材料。返回会话 ID 后可继续追问,逐步形成摘要、差异表和待办清单。文件链接输入是一种工作流,不应与模型原生直接接收 PDF 的方式混为一谈。

如何选择这个模型

结合任务复杂度、输入材料与预期结果选择。

日常复杂任务选 Flash,深度难题评估 Pro

当任务同时涉及图文理解、代码辅助和多轮交互,且希望兼顾处理效率时,Gemini 3 Flash Preview 是值得评估的选择。若核心任务是高难度推理或复杂方案推演,可与 Gemini 3.1 Pro Preview 用同一组材料比较。选择应看实际答案质量与工作流适配,而非假定版本名称对应固定性能差距。

分析与生成图片要分开选择

该型号擅长理解图片并输出文字,不是图像生成型号。需要审阅截图、解释图表或提炼视觉信息时选择它;需要交付新图片或图像编辑结果时,应选择相应的图像模型。gemini-3-flash-preview 也不等同于其他 Flash 版本,已有应用迁移时应保留代表性任务做回归测试。

开始使用

从一次小规模任务到正式接入。

01

准备任务与材料

明确目标、必要输入与输出要求,使用真实业务样例作为起点。

02

在 API 调试区试用

打开试用页,确认此入口支持的参数,再提交小规模任务查看结果。

03

按 API 文档接入

保留完整模型 ID,使用文档规定的请求格式,并在 Pricing 页确认计费规则。

使用边界

在正式使用前,了解输出质量与能力范围。

  • 音频输入理解不等于语音输出:该型号不生成音频,也不支持 Live API。它同样不生成图片,因此不能直接交付配音、实时语音会话或图像成品;这些需求应使用对应的生成服务。
  • 原生长上下文上限不是每次调用都能用满的预算。消息历史、材料内容与输出需求需要共同规划;思考也会消耗 Token。调用指南建议 max_tokens 设置为 512 以上,避免预算过小而没有可见回答。
  • 原生工具能力不表示一次图文请求会自动运行代码或控制电脑。Chat Completions 的函数调用需要执行与回填流程;文件和外部系统操作还受入口能力、连接状态与授权约束,不能仅靠提示词绕过。

常见问题

解答使用 gemini-3-flash-preview 时的常见疑问。

Gemini 3 Flash Preview 是固定日期版本吗?

不是。其官方代码为 gemini-3-flash-preview,属于预览版本,名称中没有固定日期。它也不是 Gemini 3.1 Pro 或其他 Flash 型号的别名。应用应明确保存所用模型 ID,并在调整版本后测试关键任务。

怎样提交图片并取得文字回答?

调用 /gemini/chat/completions,将 model 设为 gemini-3-flash-preview,在 messages 的 content 数组中组合 text 与 image_url。图片可使用可访问 URL 或 Base64 data URI;非流式答案从 choices 的 message.content 读取。

可以直接分析 PDF、视频和录音吗?

原生模型支持 PDF、视频和音频理解,但这不等于两个平台入口都支持直接提交这些媒体。PDF 可通过 /aichat2/conversations 的 file_url 块配合文件读取流程分析;/gemini/chat/completions 的 image_url 用于图片,不应当作通用文件字段。使用这里的图文入口分析视频或录音时,可先将视频提取为关键帧、将录音转写为文字,再提交图片和文本;这种方式分析的是提取后的材料,不等同于直接理解完整音视频。

为什么有时消耗了 Token,却没有正文?

它是思考模型,生成可见答案前可能先消耗推理 Token,输出预算过小便可能没有剩余空间写正文。建议按指南把 max_tokens 设置为 512 以上,再结合任务复杂度增加预算,并查看 usage 与结束原因。

多轮对话和流式展示应该选哪个入口?

希望自行维护历史并控制图文请求时,可用 Chat Completions,设置 stream: true 接收增量内容。希望保存会话并凭 id 继续追问时,可用 /aichat2/conversations;它还提供 SSE 和 NDJSON 格式,便于展示回答及工具事件。

模型资料 · 更新日期:2026-10-01。调用参数与计费规则请查看 API 和定价栏目。

把 gemini-3-flash-preview 用到你的下一项任务

从清晰的目标开始,在实际结果中判断它是否适合你的工作。