北京时间5月20日凌晨,谷歌在年度I/O开发者大会上正式推出Gemini3.5Flash模型,这是Gemini3.5系列的首个产品,被谷歌定义为"迄今最强大的智能体与编程模型"。谷歌首席执行官桑达尔·皮查伊在台上宣布,该模型即日起向全球所有用户免费开放,用户可在模型下拉菜单中选择"3.5Flash"进行体验。
这款新模型在多模态输入能力上实现全面进化,可以接受文本、图像、音频、视频等任何形式的输入,用户甚至可以利用自然语言直接编辑视频。不过,谷歌真正强调的核心转变,并非多模态本身,而是从"对话式AI"向"代理式AI"的战略性迈进。皮查伊表示,Gemini3.5Flash"在提供尖端能力的同时,成本仅为同类顶尖模型的一半,甚至有时不到三分之一"。
在速度与性能上,Gemini3.5Flash树立了新的行业标杆。其输出速度超过每秒280个token,达到了GPT-5.5和ClaudeOpus4.7的四倍。在多项关键基准测试中,该模型不仅超越了谷歌自家的上一代旗舰模型Gemini3.1Pro,还在多个领域领跑竞争对手。在衡量现实世界编程能力的GDPval-AA测试中取得1656Elo评分,在多模态理解测试MMMU-Pro中以84%的成绩创下最高纪录,在智能体工具调用MCPAtlas中也以83.6%的成绩领先ClaudeOpus4.7的79.1%和GPT-5.5的75.3%。
代理式能力的突破是本次发布的最大看点。据谷歌DeepMind首席技术官KorayKavukcuoglu介绍,Gemini3.5Flash与谷歌的代理开发平台Antigravity深度协同,能够支撑多智能体同时在长时间任务中运行。在谷歌内部测试中,团队使用Antigravity工具和该模型,仅用12小时、启动93个子智能体、生成26亿个token,就从零构建了一套可运行的操作系统核心,且API费用不到1000美元。
与强大性能相配套,谷歌同步调整了商业模式。即日起,Gemini3.5Flash成为Gemini应用和谷歌搜索AI模式的全球默认模型。谷歌还推出了100美元/月的新开发者订阅计划,而最高等级的AIUltra订阅月费从250美元降至200美元。同时发布的还有GeminiSpark个人AI智能体,可24小时在后台执行任务,由Gemini3.5系列模型驱动。谷歌预计今年的AI资本支出将达到1800亿至1900亿美元,皮查伊在演讲中算了一笔账:头部大客户若将80%的工作负载从其他前沿模型切换至Gemini3.5Flash,一年可节省超过10亿美元。
此次发布正值AI行业估值飙升之际,OpenAI与Anthropic均计划最早于今年IPO,竞争日趋白热化。谷歌选择以"全球免费+极致性价比"的策略入局,无疑将加速整个AI大模型行业的重新洗牌。