AI博客汇总|Gemini 3.6 Flash打响价格战、Poolside开源反击、Inflection押注关系智能
本期导读 本期三条主线值得关注:Google发布Gemini 3.6 Flash,以65% Token消耗降幅重新定义中端性价比,API价格战进入新阶段;美国初创Poolside以1180亿参数开源模型击败万亿参数竞品,打破过去一年顶级开源模型全由中国公司垄断的局面;Inflection AI卷土重来,押注"关系智能"新范式,尝试从问答工具向人生伙伴转型。 一、Google Gemini 3.6 Flash:65% Token效率提升,价格战进入新赛点 原文标题: Google's Gemini 3.6 Flash model cuts AI agent token costs by up to 65% on long horizon engineering tasks 链接: https://venturebeat.com/technology/googles-gemini-3-6-flash-model-cuts-ai-agent-token-costs-by-up-to-65-on-long-horizon-engineering-tasks-and-3-5-pro-is-on-the-way 发布日期: 2026年7月24日 核心事实: Google DeepMind发布Gemini 3.6 Flash、3.5 Flash-Lite、3.5 Flash-Cyber三款新模型 Gemini 3.6 Flash在长周期工程任务中Token消耗降低65%,API定价$1.50输入/$7.50输出每百万Token 3.5 Flash-Lite仅$0.30/$2.50,成为Google史上性价比最高模型之一 Gemini全球月活用户已达9.5亿(2月为7.5亿) 同场发布3.5 Flash-Cyber,专攻网络安全,仅向政府及可信合作伙伴开放 为什么重要: Token效率65%的提升不是边际优化,而是量级变化。在AI Agent的实际部署中,长周期任务(如代码审查、多轮调试、复杂数据分析)的Token成本往往是企业最大的成本变量。65%的效率提升意味着同等预算下可以执行近3倍的任务量,或者用1/3的预算完成同等任务量。 从第一性原理来看:这场价格战的本质是计算资源的优化效率之争。Google不追求最低绝对价格(那是中国开源模型的领地),而是在"性能-成本"帕累托前沿上找到了新的最优点。$1.50/$7.50这个定价区间,刚好卡在企业级Agent应用的主力成本区间。 分析观点: API价格战的格局已经清晰:中国开源模型(小米MiMo、DeepSeek)占据绝对低价位,Google占据中端性价比王座,OpenAI/Anthropic占据高端。这张图在2026年底之前不会有根本性变化,但Google的65%效率提升会压缩所有中端玩家的生存空间——因为它不只是降价,而是同时提升了性能。 二、Poolside Laguna S 2.1:1180亿参数开源模型击败万亿参数竞品 原文标题: Poolside drops Laguna S 2.1, an open-weight coding model that beats rivals 10x its size 链接: https://venturebeat.com/infrastructure/poolside-drops-laguna-s-2-1-an-open-weight-coding-model-that-beats-rivals-10x-its-size 发布日期: 2026年7月24日 ...