[控场AI]
模型Gemini 2.5 Flash / Gemini 3.1 Flash / Gemini 3.1 Flash TTS

Gemini 3.5 Flash

核心事实

时间轴 (近 90 天)

6月1日

Google在LM Arena中保留了Gemini 3 Flash的model slug不变,但模型输出质量出现了显著提升

待验证80%
6月1日

Step 3.5 Flash在编码测试(如SWE-Bench)等特定基准测试中分数超越了Google的Gemini 3 Flash

待验证85%
6月1日

Gemini 3 Flash在生成收音机前控制面板SVG时,细节表现不如Gemini 3 Pro

待验证60%
6月1日

Gemini 3 Flash在前端代码生成测试中,生成的页面包含流畅的电风扇转动动画和鼠标悬停提示等交互细节

待验证75%
6月1日

Gemini 3 Flash在最高思考级别下处理日常任务时,比2.5 Pro平均减少30%的Token消耗

待验证80%
6月1日

Gemini 3 Flash支持4个思考级别,比Pro版本更灵活

已验证90%
5月31日

在俄罗斯方块游戏生成测试中,Mercury 2 仅用 18 秒生成了完全可玩的游戏,而 Gemini 3 Flash 耗时约 1 分 08 秒且无法运行,Claude Haiku 4.5 耗时 1 分 24 秒

待验证75%

全部知识事实 (6)

来源文章