AREX Feed Article
Gemini 3.7 Flash 转正 GA:Antigravity 默认换芯,聊天全员开放
美国时间 8 月 14 日,Google AI Studio 发布开发指南《What's new in Gemini 3.7 Flash》,宣布 Gemini 3.7 Flash(模型 ID gemini-3.7-flash)进入 GA、可投入生产使用。同一天,Gemini 聊天(网页与应用)向所有 Pro 和 Ultra 用户开放新模型;Gemini Managed Agents 与 Google Antigravity SDK 里的 Antigravity agent 也默认改用 3.7 Flash。
这款模型 8 月 13 日才随发布,定位是"面向编程与智能体的主力模型"。一天之内,它被标为生产就绪,成了 Antigravity agent 的默认模型,并向全部 Pro/Ultra 用户的聊天界面铺开。
一份指南,把 3.7 Flash 标成生产就绪
开头第一句就是"generally available (GA) and ready for production use"。指南给出的规格:1M token 上下文窗口、64k 最大输出 token、low/medium/high 三档 thinking 级别(默认 medium)、与 3.6 Flash 相同的内置工具套件。
三档 thinking 各有分工:low 面向事件响应管道、实时聊天等延迟敏感任务;medium 是多数任务的最佳质量档,推荐用于复杂代码和智能体用例;high 允许扩展思考和函数调用,代价是更高的 token 消耗和成本。
GA 背后是官方博客发布时给出的对比数据:DeepSWE v1.1 成绩 65.3%(3.6 Flash 为 49.0%),FrontierCode 1.1 Main 上 43.6%(34.4%)。博客里的成绩与成本对比图,直接把 3.7 Flash 与 Claude Opus 5、GPT-5.6 Sol 等模型放进同一坐标系。
Antigravity 默认换芯,迁移清单同步发布
指南确认,由于性能和推理提升,Gemini 3.7 Flash 现在是 Gemini Managed Agents 与 Google Antigravity SDK 中 Antigravity agent 的新默认模型。底层 Gemini 模型仍可通过 agent_config 配置,指南示例里就是把 model 设回 gemini-3.6-flash。
与换芯同步发布的还有一份迁移清单:模型 ID 改成 gemini-3.7-flash;删除 generation config 中已弃用的 temperature、top_p、top_k;用字符串枚举 thinking_level 替换 thinking_budget;移除 candidate_count;多轮对话统一改用服务端 previous_interaction_id;删除预填的模型轮次。
指南要求,从 3.5 Flash、3 Flash (Preview) 或 3.1 Pro 升级的工作负载必须完成这些清理。
清单本身也可以自动化:开发者若使用支持 skills 的编程 agent(比如 Antigravity),安装 Gemini Interactions API skill 后,运行 /gemini-interactions-api migrate my app to Gemini 3.7 Flash 即可。
聊天侧全员开放,网页和 App 一起上
8 月 14 日, 宣布 Gemini 3.7 Flash 向 Gemini 聊天中的所有 Pro 和 Ultra 用户开放,网页和 App 均可使用。推文给出的典型场景是多步任务:把几十份文件和邮件串成一份主文档。
前一天,官方博客刚宣布个人智能体 Gemini Spark 当天起改用 3.7 Flash(面向 160 多个国家的 Pro/Ultra 订阅者)。聊天产品本身随后跟进,Pro 和 Ultra 用户在网页与 App 里都能直接用上新模型。
独立实测:56 分、约 340 tokens/s
给出一组第三方数据:3.7 Flash(high)在 Intelligence Index 上得 56 分,比 3.6 Flash 高 4 分,仅次于 GPT-5.6 Terra (max) 和 Muse Spark 1.2 (xhigh) 的 57 分。
输出速度约 340 tokens/s,接近 GPT-5.6 Terra 和 GLM-5.2 的三倍;Time per Task 均值 1.7,比 GPT-5.6 Terra (max) 快 40%。
评测机构据此把 3.7 Flash 放在"Intelligence vs Time per Task"的 Pareto 前沿上。medium 档 53 分,与 DeepSeek V4 Pro 0813 (max)、GLM-5.2 (max) 持平;low 档 51 分。按促销价计算,high 档每任务成本 0.40 美元,比 3.6 Flash 低 30%,medium 档降至 0.26 美元;缓存输入 token 保持 90% 折扣。
一天后的反馈,和年底到期的价签
8 月 14 日盘点发布一天后的社区玩法:在 AI Studio 和 Antigravity 里搭教育游戏、一条提示词生成日式宝塔花园、让模型玩 RuneScape、SVG+CSS 熔岩灯、Three.js 遥控车原型。
促销价 0.75 美元/1M 输入、3.75 美元/1M 输出同时适用于 3.6 Flash 与 3.7 Flash,覆盖 Google AI Studio 与 GE Agent Platform,2026 年 12 月 31 日到期;2027 年 1 月 1 日起按标准价 1.50 美元/7.50 美元收费。想以半价跑生产工作负载的团队,窗口期是四个半月。