Google Gemini 3.6 Flash实测:速度与成本领先,编码能力存明显短板

谷歌一次发布三款Flash模型
近日,Google一口气推出了三款Flash系列模型:Gemini 3.6 Flash、Gemini 3.5 Flash Lite以及面向网络安全领域的Gemini 3.5 Flash Cyber。从整体定位来看,这次发布的核心卖点并非能力的飞跃,而是极致的Token节省与响应速度提升——这恰恰是谷歌目前主推的方向:更快、更便宜。
三款模型各有专长,形成了清晰的产品矩阵:
- Gemini 3.5 Flash Lite:主打性价比与速度的平衡,专注于超高速、高吞吐量任务,例如大规模产品数据抓取、批量发票翻译、高并发的Agent设计任务。
- Gemini 3.5 Flash Cyber:专为网络安全场景设计,能够自动检测项目中的漏洞并辅助修复,是一款典型的垂直领域定制模型。
- Gemini 3.6 Flash:本次发布的旗舰Flash模型,主打速度与成本优势。

从定价来看,3.6 Flash的输出Token为7.5美元/百万,输入为1.5美元/百万。相比3.5 Flash,输入价格保持不变,输出价格进一步下降。谷歌显然希望用更低的成本和更快的响应速度吸引大规模、高并发的应用场景,而非追求单点能力的极限。
如何免费使用这几款新模型
对于普通用户来说,体验这几款模型的门槛非常低,目前有两条免费路径。
路径一:通过 Google AI Studio 体验
第一种方式是通过 AI Studio。打开 AI Studio 官网,使用 Google 账号登录后,进入模型选择界面,在 Gemini 系列中即可看到刚发布的 3.6 Flash、3.5 Flash Lite 等模型,全部免费可用。
AI Studio 还支持自定义思考程度(Thinking Level),用户可根据任务复杂度调整模型的推理深度,非常适合做横向测评对比。
路径二:通过 Gemini 网页端体验
第二种方式是直接访问 Gemini 网页端(gemini.google.com)。选择 3.6 Flash 后即可输入提示词获取结果。经实测,网页端与 AI Studio 的生成结果基本一致,底层调用的是同一模型,用户可根据使用习惯自由选择入口。
实测:3.6 Flash 的编码能力令人意外
为了检验 Gemini 3.6 Flash 的真实水平,测试采用了一个相对典型的前端编码任务——「帮我开发一个3D坦克大战」,思考程度设置为 High。
结果出人意料。3.6 Flash 仅用 42 秒便完成了代码编写,速度确实惊人。但点击预览时,画面却是一片黑屏,游戏无法正常运行。

随后反馈黑屏问题并要求修复,模型很快给出了新版本,预览依然是黑屏。说个细节,模型甚至将问题归咎于「可能是网络原因」,但从后续的复现测试来看,这与网络毫无关系。
与 Gemini 3.5 Flash 的横向对比
为了排除平台或偶然因素,测试者用完全相同的提示词让 3.5 Flash 执行同样的任务。

对比结果非常鲜明:
- Gemini 3.5 Flash:生成速度明显慢于 3.6 Flash,但一次成型,生成的 3D 坦克大战可以正常运行,具备完整的 3D 效果和可玩性,重新开始等交互功能均正常。
- Gemini 3.6 Flash:速度快、价格低,但连续多次尝试均未能生成可运行的成品,始终停留在黑屏状态。
这一对比揭示了一个反直觉的现象:尽管 3.6 Flash 定位更新、输出成本更低、响应更快,但在实际的前端编码任务中,表现反而弱于上一代的 3.5 Flash。
网页端复现:问题并非来自平台
为进一步排除 AI Studio 平台本身的影响,测试者在 Gemini 网页端用 3.6 Flash 执行了同样的任务,并将生成结果保存为 HTML 文件本地打开。

结果与 AI Studio 完全一致——同样是纯黑屏,游戏无法运行。这也印证了黑屏并非平台 Bug 或网络波动造成的,而是 Gemini 3.6 Flash 模型本身在前端游戏开发类任务上的能力短板。
总结:适合工具型场景,复杂任务建议另择模型
综合本次实测,可以得出以下几点判断:
第一,3.6 Flash 的速度与成本优势是真实的。 42 秒完成代码生成的速度远超 3.5 Flash,输出成本也进一步降低,与谷歌「更快、更便宜」的产品定位高度吻合。
第二,3.6 Flash 在前端复杂编码任务上存在明显短板。 一个并不算复杂的 3D 游戏开发任务,3.6 Flash 多次尝试均告失败,反而是上一代 3.5 Flash 一次成型。新模型未必在所有维度都优于旧模型,这一点值得开发者注意。
第三,模型选择应回归实际场景。 对于简单任务、高并发、大批量处理场景,3.6 Flash 或 3.5 Flash Lite 凭借速度和成本优势更具性价比;需要高质量、一次成型的编码任务,3.5 Flash 仍是更稳妥的选择;网络安全场景则可优先考虑专项优化的 3.5 Flash Cyber。
对开发者和普通用户而言,好消息是这几款模型都可以通过 Google AI Studio 或 Gemini 网页端免费体验。在正式投入生产使用前,建议结合自己的实际任务做几轮对比测试,用真实数据而非营销话术来决定最终的模型选型。
相关推荐

LangGraph Studio隐藏功能:可视化调试Agent工作流的实战技巧
深入解析LangGraph Studio的隐藏功能,包括时间旅行调试、交互式状态编辑和人在回路测试,帮助开发者高效调试AI Agent工作流,大幅提升LangGraph应用开发效率。

麦克纳姆轮动感模拟平台:低成本VR体感方案详解
详解基于麦克纳姆轮的全向移动机器人动感模拟平台,利用VR追踪器实现三自由度运动模拟与重定心校正,为低成本VR沉浸体验提供可行方案。

LangChain Managed DeepAgents:托管Agent基础设施,专注核心逻辑
LangChain推出Managed DeepAgents公测版,托管评估、记忆、OAuth授权、Slack集成和沙箱等Agent基础设施,让开发者专注Agent核心逻辑。深度解析其功能架构与行业影响。