大模型之家讯 7月22日,谷歌 DeepMind 在发布 Gemini 3.6 Flash、3.5 Flash-Lite 和 3.5 Flash Cyber 三款新模型的同时,宣布已启动公司史上最大规模的预训练任务,目标直指下一代旗舰模型 Gemini 4。三款新模型均围绕 Agent 工作流优化:3.6 Flash 主打降低 Token 消耗,在 DeepSWE 测试中输出 Token 减少约 65%;3.5 Flash-Lite 每秒输出 350 Token,速度位列行业前茅。谷歌还计划于 2028 年部署 Frozen v2 芯片,将 Gemini 部分架构固化以提升推理能效 6 至 10 倍。