日前,Anthropic正式发布Claude Opus 5.5,同时其也是Claude 5.5系列的首款模型。据Anthropic方面透露,Opus 5.5在智能编码、计算机使用和知识工作等方面进行了升级,在多数工作中的表现可媲美Claude Fable 5.1,同时其运行成本较Opus 5降低40%。

此次发布的Opus 5.5,重点提升了复杂任务处理能力。Anthropic方面透露,一位测试者曾使用该模型在不到一天内完成68万行代码迁移,原本预计需要数周;在网页应用性能优化测试中,Opus 5.5经过40次尝试成功了39次。此外,该模型在Anthropic的自动化行为审计中取得了迄今为止所有模型的最高分数,其测试覆盖数千个模拟场景,并进一步扩大了对齐测试范围。

据悉,Opus 5.5在生物学和网络安全领域与Claude Fable 5.1相当,Anthropic部署时采取了类似于Claude Fable 5.1的防护措施。经过审核的机构已可申请生命科学验证项目,未来几周Anthropic还将扩大网络安全验证项目的访问范围,通过认证的网络安全从业者也可使用Opus 5.5开展相关工作。
价格与运行效率方面,Opus 5.5的输出速度较Opus 5提升30%以上,典型工作负载下运行成本降低40%。据悉,Opus 5.5输入和输出价格分别为4美元/百万Token和20美元/百万Token,较Opus 5降低20%,缓存命中价格为0.20美元/百万Token,较Opus 5降低60%。

此外,Anthropic还放宽了Pro、Max、Team等套餐的使用时间限制,并为订阅用户提供速率限制重置功能,Claude Sonnet 5.5和Claude Haiku 5.5则计划在未来几周推出。
近期,Anthropic持续在推动旗下模型的迭代,今年5月其推出Claude Opus 4.8,紧接着在6月发布Claude Fable 5和Claude Sonnet 5,其中Fable 5定位为更高能力级别的模型,重点覆盖软件工程、知识工作、视觉和科学研究等场景。随后在7月推出Claude Opus 5,进一步强化长时间运行的智能体、编程和专业工作能力。
9月1日,Anthropic发布了Claude Fable 5.1和Claude Mythos 5.1。其中,Fable 5.1面向编程和知识工作,重点强化了长时间、多步骤任务的处理能力,并在保持模型能力提升的同时进一步降低使用成本;Mythos 5.1则需要Mythos访问权限,采取邀请制方式开放。
【本文图片来自网络】
