
Gemini 3.6 Flash 发布:免费用户能得到什么
Gemini 3.6 Flash 已成为 Gemini 应用的默认免费模型。了解免费用户能获得什么、15 RPM 的限制、付费升级路径,以及各种 API 接入方案的对比。
如果我只是拿 Gemini 处理日常任务,如今的免费档已经比以前覆盖多得多了。 自 2026 年 7 月 23 日起,Gemini 3.6 Flash 成为美国 Gemini 应用的默认免费模型,取代了 Gemini 3.5 Flash。
以下是简要版本:
- 免费用户现在默认使用 Gemini 3.6 Flash
- 它可以处理文本、图像和文档
- 它很适合摘要、PDF 问答、短篇写作和简单的编程辅助
- 免费使用仍有严格限制,包括每分钟 15 次请求
- 付费方案提供更强隐私、更高限额和更长上下文
- Google AI Plus 售价 $19.99/月
- 开发者定价方面,Gemini 3.5 Flash 起价为每 100 万输入 token $1.50
- Gemini 3.1 Pro 支持最高 200 万 token 的上下文窗口
- API 接入最高可达每分钟 2,000 次请求
- APIMart 面向想用一个 API 搞定 Gemini 相关工作流的用户
简单说,我会这样选:轻度使用就留在免费档,处理更大文件或更重的编程工作就付费,只有需要自动化时才考虑 API 工具。

我替你测试了 Google Gemini 3.6 Flash

快速对比
| 选项 | 最适合 | 主要优势 | 主要限制 | 价格 |
|---|---|---|---|---|
| Gemini 3.6 Flash(免费) | 日常使用 | 零成本使用文本、图像和文档输入 | 15 RPM、无 SLA、提示词可能被用于改进模型 | 免费 |
| Gemini 3.5 Flash | 旧的免费基线 | 支持 100 万 token 上下文的快速免费模型 | 不再是默认免费选项 | 免费 |
| Gemini Advanced / Google AI Plus | 较重的个人使用 | 更多空间、更强隐私、应用升级路径 | 每月付费 | $19.99/月 |
| Gemini API | 应用与开发者使用 | 最高 2,000 RPM、3.1 Pro 支持 200 万 token 上下文 | 按 token 计费,成本随用量增长 | 按量付费 |
| APIMart | 统一 API 工作流 | 用一个端点搞定 Gemini 工作流 | 只用单一模型时价值有限 | 按量付费 |
如果用一句话总结:Gemini 3.6 Flash 让免费版 Gemini 应用在日常工作中更有用了,但在规模、隐私和长上下文任务上,付费方案依然重要。
1. Gemini 3.6 Flash(免费 Gemini 应用)
免费档能力
在免费档,Gemini 3.6 Flash 可以零成本处理文本提示、图像理解、文档摘要、基础编程辅助、短篇草稿、大纲和配文。免费应用还支持多模态输入,包括文本、图像和文档。
这意味着你可以上传一个文件并要求提炼要点,或者丢进一张照片问它照片里发生了什么。
速度与编程表现
它对日常问题和简短追问响应很快。在编程方面,它可以调试代码片段、编写简单函数,并用大白话解释代码。
接下来,把这个免费基线与 Gemini 3.5 Flash 对比一下。
升级路径
免费档对轻度日常使用来说够用了。但当你需要更强的推理能力或办公协作功能时,它就开始碰到天花板。
而这正是付费档开始展现免费版做不到的地方。
2. Gemini 3.5 Flash(此前的免费基线)
免费档能力
Gemini 3.5 Flash 是此前的免费基线。Gemini 3.6 Flash 保留了同样快速轻量的体验,但现在接替它成为默认模型。
它曾被用于聊天机器人、实时仪表盘摘要,以及借助统一 LLM API 自动化日常任务 [3]。
在免费档,提示词可能被用于改进 Google 的产品和模型 [1][3]。
速度与上下文限制
Gemini 3.5 Flash 为快速、低延迟的响应而生,支持 100 万 token 的上下文窗口 [1][3]。
这给了用户充足的空间进行长对话和处理大文件,同时保持响应轻快。不过,它的空间仍然比付费接入要小。
升级路径
需要更高限额或更高级功能的用户会转向付费档。
一旦免费档的限制开始让人觉得局促,付费方案就给了他们更多空间和更多控制权。
3. Gemini Advanced 与 Gemini API 接入

如果免费版 Gemini 3.6 Flash 应用足以应付休闲使用,付费接入则给你更大的工作空间。你会获得更好的隐私保护、大得多的上下文窗口和更高的请求限额。
隐私与数据使用
付费接入让你的提示词不进入模型改进流水线。如果你处理的是敏感文件、内部笔记或专有代码,这一点很重要。
多模态与上下文限制
通过 API 使用的 Gemini 3.1 Pro 支持 200 万 token 的上下文窗口。当你面对长文档、大型代码库或原本需要拆分成小块的输入时,这是件大事。
速度与编程表现
API 接入支持最高每分钟 2,000 次请求,并包含上下文缓存。在生产环境中,当你的应用反复引用相同材料时,这可以削减重复输入的成本 [2]。
升级路径与定价
付费 Gemini 应用方案从 Google AI Plus 开始,售价 $19.99/月。该方案包含应用内的 Gemini 3 Pro 和 Google Workspace。Google AI Pro 售价 $249.99/月 [2]。
以下是按量付费的费率:
| 模型 | 输入(每 100 万 token) | 输出(每 100 万 token) | 上下文窗口 |
|---|---|---|---|
| Gemini 3.5 Flash | $1.50 | $9.00 | 100 万 token |
| Gemini 3.1 Pro(≤200K) | $2.00 | $12.00 | 200 万 token |
| Gemini 3.1 Pro(>200K) | $4.00 | $18.00 | 200 万 token |
上下文缓存有助于压低成本。写入缓存免费,读取缓存只需标准输入费率的 25%。如果应用反复引用相同的大型文档,这个定价能带来显著差异 [2]。
对于想要统一模型接入和更精细用量控制的用户,下一节介绍 APIMart。
4. APIMart 统一 AI API 平台

如果你需要在 API 工作流中使用 Gemini,APIMart 为 Gemini 模型提供一个端点和一个密钥。这省去了大量搭建工作,让你从随手测试走向完整自动化容易得多。
免费档能力
你可以创建账户并开始测试,无需信用卡 [4][7]。免费入口包含 playground 访问权限,你可以在花钱之前先试跑工作流。
准备好从测试进入正式使用时,可以充值并创建 API Key。没有月度最低消费,也没有隐藏费用 [4][7]。
多模态与上下文限制
APIMart 支持文本、图像、视频和音频的原生多模态输入。说白了,你可以把混合输入直接发给 Gemini 模型,而无需先改造你的流水线 [4]。
速度与编程表现
对于更重的工作负载,APIMart 采用全球 CDN 加速、自动故障转移和智能模型路由。如果某个提供商出现问题,这些特性能让请求继续流转,而不是让你的工作流卡住 [4][5]。
升级路径与定价
APIMart 采用按量付费定价,用多少付多少 [4][7]。Gemini 模型按 token 计费,没有订阅要求。
一个实用小技巧:使用 APIMart 控制台查看实时用量统计和日志 [6]。这是在配额问题干扰正在运行的 Gemini 工作流之前发现它们的简单方法。
哪个选项适合你的使用场景
对免费用户来说,核心问题其实很简单:Gemini 3.6 Flash 能把哪些日常工作处理得足够好,好到你不需要付费?
对许多常见任务来说,答案是:相当多。Gemini 3.6 Flash 在快速摘要、图像问答、简短代码辅助和轻量起草上表现不错,而且分文不花。一旦你进入更大的文件、更难的编程工作或基于应用的自动化,付费 Gemini 或 APIMart 会给你更大的工作空间、更强的隐私,以及对自动化流程更好的支持。
与此前的免费基线相比,新的默认模型主要改变了哪些日常任务不升级也变得切实可行。下表展示了每类任务对应的最轻量选项:
| 使用场景 | 最合适的选项 | 预期优势 | 可能的限制 |
|---|---|---|---|
| 学业与研究摘要 | Gemini 3.6 Flash(免费) | 速度快,标准文本处理良好 | 超出免费应用上下文窗口的超长论文可能吃力 |
| PDF 文档问答 | Gemini 3.6 Flash(免费)或 Gemini Advanced | 常规长度文档表现良好 | 超大文档集可能需要付费接入 [2] |
| 图像与图表理解 | Gemini 3.6 Flash(免费) | 原生多模态支持,无需额外配置 | 复杂的多图表分析可能触及质量上限 |
| 编程与调试 | Gemini 3.6 Flash(免费)或 Gemini Advanced | 擅长代码片段和常见 bug | 复杂的智能体编程和长程任务需要 Gemini Advanced 或 API 接入 [2] |
| 轻量创意起草 | Gemini 3.6 Flash(免费) | 输出快、零成本 | 不适合高风险或需要细腻拿捏的长文内容 |
| 多模态 API 工作流 | APIMart | 一个 API 搞定多模态 Gemini 工作流,涵盖图像、语言和视频模型 | 最适合需要多种模型类型的应用和流水线 |
直白地说,免费版 Gemini 已经覆盖了大量日常阅读、写作和简单代码工作。当你需要更大规模、更严格的隐私控制或自动化时,付费 Gemini 或 APIMart 才登场。而如果你的团队想用一个 API 搞定多模态工作流,APIMart 显然是那个答案。
接下来,权衡一下成本、隐私和规模上的取舍。
各选项的优缺点
比较这些选项最快的方式,是看成本、隐私和规模。
| 选项 | 优点 | 缺点 |
|---|---|---|
| Gemini 3.6 Flash(免费) | 零成本;原生支持文本、图像和文档的多模态输入;Flash 优化的快速响应 | 严格的 15 RPM 限制;数据可能被用于产品开发和模型训练;无 SLA [1] |
| Gemini 3.5 Flash(此前的免费基线) | 免费使用;曾经的基线 | 已被 Gemini 3.6 Flash 取代;免费档限制相同 |
| Gemini Advanced / Gemini API(付费) | 更高吞吐量;99.9% SLA;数据不用于训练;内置 Google 搜索接地能力 [1] | 按量计费在规模化时开销会累积 |
| APIMart 统一 API | 用单一 API 搞定 Gemini 工作流;99.9% SLA 加自动故障转移;更高请求限额 | 只需要单一模型时价值有限 |
说白了,选择取决于你打算怎么用。
如果你只是随便试试或跑轻量任务,**Gemini 3.6 Flash(免费)**是轻松之选。你分文不花,还能获得文本、图像和文档的多模态支持。代价是严格的 15 RPM 上限,加上你的数据可能被用于产品开发和模型训练,而且没有 SLA [1]。
Gemini 3.5 Flash 是此前的免费基线,但现在已被 Gemini 3.6 Flash 取代。所以它虽然仍有参考价值,却不再是主要的免费选项。
如果你需要更大的余量,付费路线就开始更有意义。Gemini Advanced / Gemini API 提供更高吞吐量、99.9% 的 SLA,以及更清晰的隐私立场——数据不用于训练。它还内置了 Google 搜索接地能力 [1]。缺点很简单:按量计费会随用量增长而攀升。
然后是 APIMart 统一 API。这个选项适合想用一个 API 搞定 Gemini 工作流、而不是自己东拼西凑的团队。你同样获得 99.9% 的 SLA、自动故障转移和更高的请求限额。但如果你只需要访问单个模型,它可能超出你的实际需要。
这些取舍最终指向一个相当简单的分野:休闲使用选免费,规模化选付费,统一 API 工作流选 APIMart。
结论
Gemini 3.6 Flash 对免费用户来说是一次扎实的升级。如果你的日常工作包括摘要、图像理解、文档问答、编程辅助和短篇起草,免费档通常就能胜任。对于偶尔使用来说,它是很好的匹配。
如果你只需要偶尔做摘要、看图片和轻量起草,留在免费档。
当你的工作开始需要更长上下文或更大用量时,付费接入就更有意义了。如果你需要长上下文推理和更重的工作流,考虑 $19.99/月的 Gemini Advanced [2]。
如果你想用一个 API 搞定文本、图像和视频工作流,使用 APIMart。这样你就有三条简单的路径:留在免费档、升级换取更多深度,或者用 APIMart 实现统一工作流。
一句话:轻度使用免费够用,重度工作付费更好,灵活的多模态流水线选 APIMart。
常见问题
Gemini 3.6 Flash 对所有人都免费吗?
不是。Gemini 3.6 Flash 并非对所有人免费。
Google 有几个 Gemini 接入层级,而 Gemini 3.6 Flash 通常属于付费按量计费的阵营。它更像是专业模型,而不是随手可用的免费工具。
一些较早的模型(如 Gemini 2.5 Flash)曾提供有限的免费档用于测试或原型开发。但一旦进入更高端的 Gemini 模型,你通常需要付费方案或开通 API 计费。
免费档可以上传哪些文件?
免费档支持多模态上传,包括文本、图像、视频、音频和 PDF 文档。
你可以用这些文件完成文档摘要、图像理解和数据推理等任务。需要知道的一点是:在免费档提交的数据可能被用于模型训练和产品开发。
什么时候应该从免费升级到付费?
当免费档开始拖你后腿时就该考虑升级了,尤其是在容量、速度或可用性方面。
如果你需要更大用量、面向客户场景下更稳定的性能,或者用于自动化流水线的 API 接入,付费方案就更合适。免费档最适合原型开发、测试和日常探索。
去模型市场挑选你想要的模型
在 APIMart 模型市场尝试聊天、图像和视频模型,用统一 API 快速体验模型能力。