Gemini 3.7 Flash发布:性能、价格与Antigravity使用指南
Gemini 3.7 Flash是面向编程与智能体工作流的新一代高效率模型。根据Google Antigravity团队发布的信息,新模型重点提升了代码生成、多步骤规划、工具调用和网页开发能力,并通过限时价格降低智能体的规模化使用成本。
对于开发者而言,这次更新的价值可以概括为三点:首次生成的代码更准确,复杂任务执行更稳定,单位Token成本更低。不过,公告中的测试成绩来自特定基准环境,实际表现仍会受到提示词、项目规模和工具配置等因素影响。
Gemini 3.7 Flash有哪些主要升级
复杂任务规划更稳
传统编程模型在处理长任务时,容易遗漏步骤或偏离目标。Gemini 3.7 Flash加强了多步骤推理能力,可以先拆解目标,再按顺序调用工具、检查结果并继续执行。
这项升级尤其适合智能体开发,常见应用包括:
- 分析需求并生成项目结构;
- 调用外部工具查询数据;
- 根据运行结果修改代码;
- 跨文件完成连续开发任务;
- 自动执行测试、检查与修复。
它并不意味着模型生成的内容完全不需要审核。涉及生产环境、权限配置和数据操作时,仍应保留人工确认环节。
首次代码生成准确率提高
公告数据显示,Gemini 3.7 Flash在多项编程测试中超过3.6 Flash:
| 测试项目 | Gemini 3.7 Flash | Gemini 3.6 Flash |
|---|---|---|
| DeepSWE v1.1 | 65.3% | 49.0% |
| FrontierCode 1.1 Main | 43.6% | 34.4% |
| WebDev Arena | 1588 Elo | 未公布 |
这些数据说明,新模型在首次生成可用代码、解决真实开发任务和创建网页界面方面有所进步。对于重视交付速度的团队,更高的首轮准确率有助于减少反复修改和Token消耗。
不过,编程基准测试只能作为选型参考。实际项目还应测试代码可维护性、框架兼容性、安全性和长期任务稳定性。
Google Antigravity能完成哪些工作
跨平台移动界面生成
Google Antigravity可以根据自然语言需求创建移动端页面,并为不同移动框架分配子智能体。生成结果还可在模拟器或仿真器中运行,方便开发者检查布局、交互和兼容性。
这种方式适合快速制作原型,但正式发布前仍需检查设备适配、无障碍功能、性能和应用商店规范。
云端数据异常分析
面对分布在多个云环境中的大型数据集,系统可以协助定位异常、分析可能原因,并构建自动化生产管道。它更适合处理步骤明确、数据接口稳定的任务。
建议为数据操作设置以下限制:
- 只授予任务必需的权限;
- 对删除、覆盖等操作增加审批;
- 保存完整的工具调用日志;
- 使用测试环境验证自动化流程;
- 对敏感数据进行脱敏处理。
网站现代化改造
结合MCP服务器、多模态识别和长任务跟随能力,Antigravity能够检查现有网站,提出技术升级方案,并围绕Lighthouse指标持续优化。
可执行的任务通常包括:
- 检查页面性能和资源加载情况;
- 识别过时的前端依赖;
- 优化图片、脚本和样式文件;
- 改善SEO与无障碍体验;
- 运行测试并继续修复问题。
需要注意的是,Lighthouse满分可以作为优化目标,但不应成为唯一标准。真实用户访问速度、业务转化率和不同设备上的稳定性同样重要。
Gemini 3.7 Flash价格怎么算
公告称,Gemini 3.7 Flash在2026年12月31日前执行限时价格:
- 输入:每100万Token为0.75美元;
- 输出:每100万Token为3.75美元。
该价格约为原Gemini 3.6 Flash单位Token成本的一半,而且优惠同样延伸至3.6 Flash。自2027年1月1日起,公告所列标准价格为:
- 输入:每100万Token为1.50美元;
- 输出:每100万Token为7.50美元。
评估令牌价格时,不能只看单价。输出长度、任务成功率、失败重试次数和工具调用成本都会影响最终账单。正式接入前,可以选取一批真实任务进行小规模测试,再估算月度用量。
哪些开发者适合使用
Gemini 3.7 Flash更适合以下场景:
- 需要批量完成代码修改的研发团队;
- 希望搭建自动化智能体的企业;
- 经常创建页面原型的前端开发者;
- 需要处理长流程数据任务的工程团队;
- 重视性能与成本平衡的模型使用者。
如果任务主要是简单问答或短文本处理,未必需要完整的智能体工作流。若任务包含连续规划、外部工具和代码执行,则更能体现工具调用能力的价值。
如何开始使用
根据发布信息,用户需要下载Antigravity 2.0,并在产品中选择Gemini 3.7 Flash。建议按以下顺序试用:
- 使用非核心项目进行功能验证;
- 准备包含简单、中等和复杂任务的测试集;
- 记录成功率、耗时和Token用量;
- 检查生成代码的安全性与可维护性;
- 确认效果后再逐步扩大使用范围。
总体来看,Gemini 3.7 Flash的核心优势不是单纯追求更高的模型参数,而是让代码生成、工具协作和长流程任务更可靠。限时价格也降低了试用门槛,但计划长期部署的团队,应同时按照2027年后的标准价格测算预算,避免只依据优惠期成本作出决策。
创建: 2026-08-15
关联文章推荐
- Google Workspace CLI 争议始末:开源爆红后,Justin Poehnelt 为何被开除
- step-3.7-flash实测:多模态Agent、代码生成和工具调用到底强不强
- Claude Code + Codex 混合工作流爆火:Fable 5 负责大脑,Codex 负责执行
- Grok 4.5发布:更快更便宜的旗舰AI,性能直追Opus 4.8
- GPT-5.6 模型家族怎么选?Sol、Terra、Luna 一篇看懂
- Qwen-Audio-3.0-Realtime发布:语音模型不只会聊,还能办事
- Kimi K3发布:全球首个开源3万亿级模型,长程Agent能力惊艳
- 性价比之王!Anthropic 发布 Claude 5 Opus 性能倍增价格减半,智能体开发迎来黄金期
- 提前实测Opus 5:3D细节惊艳,但高耗能与识图短板成焦点
- MCP协议第五版重磅升级:无状态请求响应正式落地
- DeepSeek Harness 四种模式详解:轨迹透明、PTC 提速与自定义 Agent
- Gemini 3.7 Flash解析:谷歌为何押注编程、Agent与低成本
- Gemini 3.7 Flash发布:性能、价格与Antigravity使用指南
- AI会员Token额度值多少钱?ChatGPT与Claude高频使用成本解析
- 算力全开!B.AI大模型全量免费狂欢:突破5.7万亿Token吞吐与全场景实操指南
- 断崖式领先!Anthropic发布Fable 5.1 (Max),斩获Code Arena WebDev榜首
登录后才能发布评论哦
立即登录/注册