Gemini 3.7 Flash 适合谁?
Gemini 3.7 Flash 适合预算有限、需要生成代码和处理文档的团队。它在成品代码、Web 开发、专业 PDF 理解与长内容理解都有领先项目。
开发者可以在 Google Antigravity 使用,也能通过 Google AI Studio、Android Studio 调用 Gemini API。企业端有 Gemini Enterprise Agent Platform 与 Enterprise app;个人用户则可通过 Gemini Spark 使用,面向 Google AI Pro 与 Ultra 订阅用户。
代码产出强,自主任务落后
Google 同时对比 Gemini 3.6 Flash、Claude Sonnet 5、GPT-5.6 Terra 与 Muse Spark 1.2。先看最能说明位置的几项:
| 测试项目 | 3.7 Flash | 3.6 Flash | Claude Sonnet 5 | GPT-5.6 Terra | Muse Spark 1.2 |
|---|---|---|---|---|---|
| Artificial Analysis Intelligence Index | 56 | 52 | 55 | 57 | 57 |
| FrontierCode 1.1 Main | 43.6% | 34.4% | 42.7% | 41.3% | – |
| DeepSWE v1.1 | 65.3% | 48.6% | 53.8% | 69.6% | 54.9% |
| Code Arena(Elo) | 1588 | 1538 | 1541 | 1523 | 1535 |
| AutomationBench | 30.4% | 17.0% | 10.7% | 23.6% | – |
| GDPVal-AA v2(Elo) | 1525 | 1422 | 1598 | 1578 | 1628 |
| CharXiv Reasoning(no tools) | 84.5% | 85.2% | 77.0% | 85.9% | – |
| CharXiv Reasoning(with tools) | 88.7% | 89.4% | 88.3% | – | – |
从完整表格看,它领先的多半是把代码、文档或长内容变成实际成果:写出可用的代码和网页,读完 PDF 或视频后完成专业工作。代码测试则分成两边。Gemini 3.7 Flash 在 FrontierCode 与 Code Arena 领先,成品代码质量与 Web 开发能力更强;GPT-5.6 Terra 拿下 DeepSWE v1.1 与 Terminal-bench 2.1,擅长长时间自主软件工程。
不过,CharXiv Reasoning 低于前代。不使用工具时从 85.2% 降至 84.5%;使用工具时从 89.4% 降至 88.7%。

低价到年底,2027 年翻倍
Gemini 3.7 Flash 的价格约为 Claude Sonnet 5 或 GPT-5.6 Terra 的三分之一至四分之一。2026 年 12 月 31 日以前,每百万 token 的输入/输出价格为 $0.75/$3.75;两款对手分别为 $2.00/$10.00 与 $2.00/$12.00。
| 生效期间 | 输入/每百万 token | 输出/每百万 token |
|---|---|---|
| 至 2026-12-31 | $0.75 | $3.75 |
| 2027-01-01 起 | $1.50 | $7.50 |
目前是到年底的优惠价。3.6 与 3.7 Flash 都会在 2027 年 1 月 1 日起将输入与输出价格翻倍。
如果项目会持续到 2027 年,使用 $0.75/$3.75 估算长期成本,得到的只有正式价格的一半。我会直接用 $1.50/$7.50 规划预算,再把年底前的差额看作短期折扣。

图上的取舍很直接:Gemini 3.7 Flash 以较低成本换来接近第一梯队的能力,最高成绩也更贵。
速度和上下文仍未公布
Flash 这个名称让人联想到速度,公告却没有延迟或每秒输出量。 没有第一个 token 需要等待多久,也没有每秒输出多少 token。用于实时产品时,仍要使用自己的提示词和部署地区进行测试。
上下文窗口没有公布。 技术发布通常会说明一次能读入多少内容,这次官方公告没有提供。
我的判断
我会优先尝试用 Gemini 3.7 Flash 写组件、做网页、读 PDF 和处理长内容。长时间自主软件工程或需要连续调用工具的任务,要和其他模型实际对比;长期预算则直接按 2027 年翻倍后的价格计算。