人工智能竞赛持续升温。过去一周,谷歌、Anthropic 和 Mistral AI 密集发布新款 AI 模型,覆盖从大众可用到高度专属的不同层级。这些新品不仅在基准测试中刷新纪录,更在速度、成本及安全性上带来实质性升级。

Claude Haiku 5.5:成本骤降 75%

Anthropic 推出了 Claude 系列中最便宜、最快的 Haiku 模型一年来的首次重大更新——Haiku 5.5。该模型专为高容量、对成本敏感的任务设计,能高效处理快速且重复的工作负载。

相比前代,Haiku 5.5 的运行成本降低约 75%。同时,其在计算机操作、知识工作、代理式编码(agentic coding)及视觉推理等基准测试中表现显著提升。值得一提的是,这是首款支持调节“努力程度”的 Haiku 级模型,用户可在成本与智能水平间进行优化选择。此外,新版本在对齐性和网络安全方面也建立了更强大的防护机制。

Claude Sonnet 5.5:安全能力媲美旗舰

定位高于 Haiku 的 Claude Sonnet 5.5 迎来了较 5.0 版本的明显升级,重点优化速度与性价比。Anthropic 表示,新模型在性能与协作能力上均有显著改善,尤其在代理式编码和知识工作方面进步可观。

安全性是此次升级的另一大亮点。Sonnet 5.5 的对齐性与网络安全能力大幅增强,已可与前代旗舰 Opus 5 相媲美。新模型还能更有效抵御“蒸馏攻击”(distillation attacks),防止攻击者通过提取模型能力来绕过内置安全防护。

Gemini 4 Argon:面向受信任用户的深度推理

谷歌上周发布了最新前沿模型 Gemini 4 Argon,目前仅通过 Fairwind 计划向受信任的网络安全从业人员开放。该模型具备 100 万 token 的输出上限,并增强了深度推理能力,旨在支持更大型的项目开发。这与 Anthropic 和 OpenAI 的策略类似,即先在小范围验证,再逐步向普通用户普及。在推理、编码及多模态能力方面,Gemini 4 Argon 也继承了 Gemini 系列的增强特性。

Mistral Large 4:开源权重的强力竞争者

Mistral AI 的最新旗舰模型 Mistral Large 4(昵称“Le Chonk”)已于本周进入公开预览阶段。据官方介绍,该模型在全球开源权重模型中名列前茅,重点聚焦网络安全、地理空间、 grounding 能力以及代理式 AI 应用。

公开预览将于 10 月 27 日结束,随后模型将正式推出。开发者目前可通过 API 尝试体验预览版本。