

开始使用 Gemini 3.5 Flash 聊天
使用 Gemini 3.5 Flash 及其完整模型系列,每天可获得更多消息额度。
Gemini 3.5 Flash:面向智能体与编程的快速前沿模型
Gemini 3.5 Flash 是 Google 的稳定 Flash 模型,在保持高速度与低成本的同时提供前沿级智能能力。Google 将其定位为适用于智能体执行、编程、长流程任务、多步骤工作流以及大规模实际应用的模型。
Gemini 3.5 Flash 面向开发者、产品团队、研究人员和企业用户,适用于需要强多模态推理、快速编程循环、工具调用以及长上下文执行的场景。相比 Gemini 3.1 Flash-Lite,它具备更深的推理能力与更强的智能体能力;相比 Gemini 3.1 Pro Preview,它更强调生产稳定性与 Flash 系列的速度优势。
Gemini 3.5 Flash:关键规格
以下是 Gemini 3.5 Flash 的主要规格,以及其在实际使用中的表现。
- 上下文窗口 - 1,048,576 输入 tokens: 1M token 输入上限使 Gemini 3.5 Flash 能处理大型代码库、长文档、视频、PDF 以及多源项目上下文,适用于长流程智能体任务。
- 最大输出长度 - 65,536 tokens: 输出上限支持详细报告、长代码生成、结构化计划与扩展推理结果,无需频繁拆分回答。
- 速度与效率 - 前沿智能+高速设计: Gemini 3.5 Flash 在保持高级推理能力的同时优化了 Flash 系列响应速度,适用于快速编程迭代、子代理与大规模任务。
- 成本效率 - 每 100万 tokens 输入 $1.50 / 输出 $9.00: 标准定价使其成为高级 Flash 模型,适用于需要更强推理与工具能力的专业工作负载。
- 推理能力 - 支持可调思考强度: Gemini 3.5 Flash 支持从低到高的思考等级,用户可根据任务复杂度平衡速度、成本与推理深度。
- 多模态能力 - 支持文本、图像、视频、音频与 PDF 输入: 可处理多种输入类型组合,适用于文档分析、视频理解、音频推理与多模态研究任务。
对比 Gemini 3.5 Flash、Gemini 3.1 Pro Preview 与 Gemini 3.1 Flash-Lite
简要介绍各模型在性能、速度与应用场景上的差异。
| 功能 | Gemini 3.5 Flash | Gemini 3.1 Pro Preview | Gemini 3.1 Flash-Lite |
|---|---|---|---|
| 知识截止 | 2025年1月 | 2025年1月 | 2025年1月 |
| 上下文窗口(Token) | 1,048,576 输入 tokens | 1,048,576 输入 tokens | 1,048,576 输入 tokens |
| 最大输出长度(Token) | 65,536 | 65,536 | 65,536 |
| 输入模式 | 文本、图像、视频、音频、PDF | 文本、图像、视频、音频、PDF | 文本、图像、视频、音频、PDF |
| 输出模式 | 文本 | 文本 | 文本 |
| 延迟(OpenRouter 数据) | 未公开 | 未公开 | 低延迟 |
| 速度 | 快速 | 未公开 | 快速 |
| 每百万 Token 输入/输出成本 | $1.50 / $9.00 | $2.00 / $12.00(≤200K prompts);$4.00 / $18.00(>200K prompts) | 文本/图像/视频输入 $0.25;音频输入 $0.50 / 输出 $1.50 |
| 推理性能 | 高级 | 高级 | 实用级 |
| 编码性能 (基于 SWE-bench Verified) | SWE-Bench Pro 55.1%;Terminal-Bench 2.1 76.2% | SWE-Bench Pro 54.2%;Terminal-Bench 2.1 70.3% | 未公开 |
| 适用场景 | 智能体编程、多步骤工作流、长上下文推理、多模态任务与规模化专业应用 | 高级多模态推理、软件工程、智能体工作流、工具使用与复杂分析 | 高频轻量任务、翻译、提取、路由、摘要、多模态处理与低成本智能体工作流 |
适合使用 Gemini 3.5 Flash 的场景
Gemini 3.5 Flash 最适合需要快速执行、强推理能力、多模态输入处理以及长上下文能力的复杂工作流。
- 开发者: 用于快速编程循环、调试、代码生成、重构以及多步骤工程任务。
- 智能体工作流: 构建可调用工具、执行多步骤任务并保持上下文的子代理系统。
- 研究团队: 分析长文档、PDF、视频与音频,并生成结构化总结与研究结论。
- 业务生产力: 用于生成报告、处理文件集合、会议总结与企业级分析任务。
- 多模态分析: 结合文本、图像、视频、音频与 PDF 进行统一理解与分析。
- 工具增强应用: 支持函数调用、代码执行、搜索增强、文件检索与结构化输出等能力。
如何访问 Gemini 3.5 Flash
访问 Gemini 3.5 Flash 非常简单,你可以选择 API 集成或聊天界面使用。
1. 官方 API
你可以通过 Gemini 官方 API 使用 Gemini 3.5 Flash,模型 ID 为 gemini-3.5-flash。它支持多模态输入、思考模式、结构化输出、函数调用、代码执行、搜索增强、文件检索以及批量与优先推理选项。
2. EssayDone AI Chat
如果你不想进行 API 配置,可以通过 EssayDone AI Chat 使用 Gemini 3.5 Flash。
该方式适合用于编程、写作、研究、多模态分析、学习与日常生产力任务,无需配置 API 密钥或开发环境。
探索更多AI模型
找到你需要的模型——搜索或选择查看完整资料。
常见问题
以下是关于 Gemini 3.5 Flash 的常见问题。
是的。Gemini 3.5 Flash 支持思考模式与可调思考强度,适用于编程、智能体工作流、长上下文推理与复杂多模态任务。
Gemini 3.5 Flash 标准 API 价格为每 100万输入 tokens $1.50 / 每 100万输出 tokens $9.00。Batch 与 flex 模式更便宜,priority inference 更贵。
Gemini 3.5 Flash 优化用于智能体编程、多步骤工作流、长流程任务、多模态分析、搜索增强任务与规模化应用。
Gemini 3.5 Flash 支持文本、图像、视频、音频与 PDF 输入,并输出文本,适用于多模态分析与理解任务。
相比 Gemini 3.1 Pro Preview,它更偏生产稳定的 Flash 模型;相比 Flash-Lite,它在复杂推理与智能体能力上更强,但成本更高。
在 EssayDone AI Chat 中使用 Gemini 3.5 Flash,可以无需 API 配置,通过聊天界面完成编程、研究、写作与多模态任务。