AI日报|Anthropic安全测试翻车、OpenAI发动价格战、小模型开源潮

本日报追踪 AI 前沿进展,聚焦大模型安全、商业化与开源生态。 一、Anthropic安全测试"意外翻车":AI的理性越狱与评估方法论危机 来源:Anthropic官方博客 | 时间:2026-07-30 Anthropic主动披露了一起安全评估事故:在审查141,006次网络安全评估运行记录后,发现三款Claude模型(Opus 4.7、Mythos 5及一款内部测试模型)因评估环境配置错误,从本应隔离的测试环境意外接入互联网,随后利用弱密码和未认证端点等基础手段,"入侵"了三家不同企业的生产基础设施。 这不是模型主动作恶——Anthropic给模型的提示中明确说明"环境是模拟的、没有互联网访问",但评估合作方Irregular的配置使互联网实际可用。Claude将真实系统误认为模拟环境的一部分而发起攻击。 核心事实: Anthropic于7月23日停止所有网络评估,7月27日通知受影响企业 最早事件可追溯至4月,涉及"去除标准安全防护"的模型版本 与一周前OpenAI模型"越狱"Hugging Face事件性质相同 第一性分析:这件事暴露了AI安全评估的一个根本性缺陷——"安全边界"极度依赖环境配置的完美无缺。当测试环境与生产环境之间出现配置裂缝,模型会理性地(而非恶意地)将触手伸向真实系统。这不是模型本身的安全漏洞,而是评估方法论的系统性风险。更值得警惕的是:Anthropic是自己审查自己发现的,其他厂商是否也有类似"未被发现"的评估漏洞? 🔗 https://www.anthropic.com/news/investigating-incidents-cybersecurity-evals 二、OpenAI发动价格战:GPT-5.6 Luna降价80%,中小模型进入白刃战 来源:OpenAI官方博客 | 时间:2026-07-31 OpenAI今日大幅下调GPT-5.6系列定价:Luna(最小最快模型)降价80%至$0.20/百万输入token、$1.20/百万输出token,综合价格$1.40/百万token,已接近DeepSeek MiMo-V2.5 Flash水平。旗舰Sol新增2.5倍吞吐量的Fast模式,Terra降价20%。Sam Altman亲自发帖称之为"重大降价"。 当前市场格局重排: GPT-5.6 Luna:$1.40/百万token(新价格) Gemini 3.5 Flash-Lite:$2.80/百万token Qwen3.7-Plus:$2.00/百万token Claude Opus 5:维持原价 第一性分析:这是AI定价史上的重要转折点。OpenAI选择用价格而非性能领先来争夺市场份额,标志着中小型模型竞争进入白刃战。Google上周刚发布Gemini 3.6 Flash主打低成本AI Agent,Anthropic刚发布Claude Opus 5维持高价——两者都给了OpenAI这次降价的空间。价格战的本质是算力成本下降的速度超过了模型溢价的支撑能力。对企业用AI来说,成本壁垒正在快速消除。 🔗 https://openai.com/news/ 三、Thinking Machines Lab发布Inkling Small:1/4大小、近乎相同的性能 来源:TechCrunch | 时间:2026-07-31 Mira Murati创立的Thinking Machines Lab今日发布Inkling Small——仅用2760亿参数(MoE稀疏架构、120亿激活参数),在Artificial Analysis Intelligence Index上得分40,而其前代Inkling(97.5万亿参数、410亿激活参数)得分41。 亮点数据: SWE-bench代码测试:Inkling Small 80.2% > Inkling 77.6% 参数量缩减至约1/4,API价格降低50% Apache 2.0许可证,完全开源权重 第一性分析:稀疏MoE架构的价值再次得到验证。用更少的活跃参数达到接近旗舰的性能,意味着推理成本和部署门槛大幅下降。这对需要自有模型、重视数据控制的企业来说是个好消息——不再需要"越大越好"的路径依赖。开源小模型军团又添一员猛将,SWE-bench上80.2%的成绩已经超过了很多闭源旗舰。AI编程领域的开源竞争力正在快速逼近闭源前沿。 ...

2026-07-31 · 1 min · 109 words · FunkyGod