All models

gemini-3.7-flash

GoogleChatreasoningvision
Input 1.5769 Credits / 1MOutput 7.8843 Credits / 1M
Get your API key
gemini-3.7-flash

面向长文档与代码协作的多模态推理模型

Gemini 3.7 Flash 是 Google 的 Gemini 3 系列稳定版多模态推理模型,适合把代码、文档和图像放在同一任务中分析。它结合长输入容量、可调思考等级、函数调用与结构化输出,可用于编码辅助、资料整理和多步助手。本平台提供图文对话与托管会话两种使用方式。

Google模型品牌
对话模型类型
推理、视觉理解任务能力

规格与接口特性

在选型前明确容量、输入输出与调用方式。

原生输入上限
1,048,576 tokens
原生输出上限
65,536 tokens
原生输入与输出
文本、图像、视频、音频、PDF 输入;文本输出
思考等级
low、medium、high;不支持 minimal
图文对话
文本与 image_url 混合消息,支持流式响应
结构化与工具
JSON、JSON Schema 输出及函数调用
托管会话
会话 ID 续聊、文件链接输入、SSE 与 NDJSON 事件

原生容量与模态描述模型能力,本平台的图文对话和文件工具工作流分别由所选入口提供。

核心能力

了解 gemini-3.7-flash 能为你的工作带来什么。

把关联材料放在一起推理

长输入容量适合同时纳入需求、关联代码、接口约定和历史讨论,围绕同一问题进行比较与归纳。实际组织材料时,按文件或章节分组,并明确要解决的问题,比单纯堆入全部内容更有用;输出可整理成修改清单、摘要或待确认事项。

图像理解结合文字任务

可以将图表、页面截图与文字说明组合提交,让模型围绕指定问题解释画面、比较信息或整理观察结果。图文消息使用文本块与 image_url 块,图片可采用公开链接或 Base64 data URI;交付物是文字分析,不是重新生成图片。

从回答延伸到工具协作

函数调用用于描述模型希望执行的操作和参数,结构化输出则便于把结果接入业务程序。自行编排时应保存完整工具调用和结果;使用托管会话时,可结合文件读取及已授权工具完成多步任务,执行权限仍由应用和工具配置决定。

适用场景

从具体任务出发,找到模型发挥作用的位置。

代码修改与审查辅助

输入相关源码、错误日志、需求和测试条件,让模型先定位影响范围,再提出修改方案、代码片段与测试建议。适合需要跨文件理解的日常维护任务;交付时要求说明改动依据与未验证假设,实际编译和测试仍在开发环境中完成。

长资料整理与问答

将报告文本、条款或会议记录按主题组织,要求输出摘要、差异表和问题清单。需要处理 PDF、CSV 或 TXT 链接时,可选托管会话的 file_url 工作流,让文件工具读取内容后分析,并在后续问题中沿用同一会话继续追问。

图表与界面分析

提交图表截图或产品页面,并注明分析目标,例如解释趋势、核对文字与图形是否一致,或整理界面改进项。输出可以是逐项说明,也可以是预先定义的 JSON 字段;涉及精确数值时,同时提供原始表格有助于交叉核对。

如何选择这个模型

结合任务复杂度、输入材料与预期结果选择。

已有 3.7 工作流,按任务决定是否迁移

Gemini 3.7 Flash 是稳定型号,但不是最新 Flash;Gemini 3.8 Flash 已可用。已有经过验证的 3.7 提示词和工具流程,可以先保持现有配置,再用相同任务比较新版本。相对 3.6 是否值得切换,应看答案可用性、工具参数正确性和返工次数,而非假定每次任务都会更省。

按复杂度与集成方式取舍

需要关联多份材料、看图并输出结构化结果时,3.7 Flash 值得纳入候选;简单分类未必需要长上下文和较高思考等级,复杂推理则可与 Pro 系列比较。自行维护消息历史和工具循环,选 Chat Completions;希望按会话 ID 续聊并使用文件工具,选 AI Chat v2。

开始使用

从一次小规模任务到正式接入。

01

准备任务与材料

明确目标、必要输入与输出要求,使用真实业务样例作为起点。

02

在 API 调试区试用

打开试用页,确认此入口支持的参数,再提交小规模任务查看结果。

03

按 API 文档接入

保留完整模型 ID,使用文档规定的请求格式,并在 Pricing 页确认计费规则。

使用边界

在正式使用前,了解输出质量与能力范围。

  • 它是理解与文本生成模型,不提供图像生成、音频生成或 Live API。原生支持分析视频、音频,不意味着可把媒体随意放进图像字段;图文入口宜使用文本和图片,文件资料可采用托管会话的文件读取方式。
  • 思考等级应选择 low、medium 或 high,不能将 minimal 当作有效原生选项。回答预算还需留出思考空间,过低的 max_tokens 可能造成空内容或答案截断;长报告宜按章节生成,并检查结束原因。
  • 长输入上限不等于模型会同等关注全部材料,也不代表能够直接运行项目或操作电脑。应优先提供相关片段、明确验收条件,并在多轮任务中保留工具状态;代码执行与外部写入需要相应环境和授权。

常见问题

解答使用 gemini-3.7-flash 时的常见疑问。

Gemini 3.7 Flash 应使用哪个调用 ID?

使用 gemini-3.7-flash,保留数字之间的点。图文对话可调用 /gemini/chat/completions,托管会话可调用 /aichat2/conversations;前者提交 model 与 messages,后者可用 model 与 question 开始对话。

支持多少输入和输出?

原生输入上限是 1,048,576 tokens,输出上限是 65,536 tokens,两者不是同一个预算。组织长任务时仍应筛选相关材料,并按交付物设置回答长度;这些原生数字不等于每次调用都应使用全部容量。

怎样设置它的思考强度?

可选择 low、medium、high,原生不支持 minimal。简单归纳可以从 low 开始,多条件分析再尝试 medium 或 high。不要把极小回答预算当作关闭思考的办法;Gemini 3.x Flash 使用指南建议 max_tokens 设到 512 以上。

可以读 PDF,也能生成图片或语音吗?

原生支持 PDF 理解,但不生成图片或语音。本平台的托管会话可通过 file_url 提交 PDF 链接,结合文件读取工具进行分析;普通图文消息采用 text 和 image_url 内容块,两种资料输入方式应分别处理。

调用工具后怎样继续对话?

自行编排函数调用时,保留调用 ID、函数参数及执行结果,再把工具结果交回模型。托管会话可使用返回的 id 续聊;若任务暂停等待补充信息,应通过 tool_results 回填,并保持 tool_use_id 与暂停事件中的工具 ID 一致。

模型资料 · 更新日期:2026-10-01。调用参数与计费规则请查看 API 和定价栏目。

把 gemini-3.7-flash 用到你的下一项任务

从清晰的目标开始,在实际结果中判断它是否适合你的工作。