Anthropic 发布 Claude Opus 5.5 模型:成本降四成

AI 驱动中国 苏木 1,234次阅读
分享 微 Q 信
AI摘要
由 AI 生成 · 仅供参考

Anthropic 正式发布全新 Claude Opus 5.5 模型。该模型在复杂任务处理能力上有所提升,运行成本较 Opus 5 降低 40%,输出速度提升超 30%。官方数据显示其在编码、计算机使用等领域保持领先,并加强了安全对齐与防注入能力,相关订阅套餐限制同步放宽。

驱动中国9月23日消息,Anthropic 正式推出 Claude Opus 5.5 模型。作为 Claude 5.5 家族的首款模型,官方称其在多数任务中的表现可媲美 Claude Fable 5.1,且运行成本较 Opus 5 降低 40%。

在性能表现方面,Claude Opus 5.5 较前代 Opus 5 有显著提升。早期测试数据显示,一名测试人员在不到一天的时间内完成了 68 万行代码的迁移工作,该任务原本预计耗时数周。此外,该模型在识别并修复软件低效程序方面表现突出。在要求缩短网页应用加载时间的测试中,Opus 5.5 在 40 次尝试中成功 39 次,而 Opus 5 仅做出微小改进并改变了应用行为。在根据单一提示构建游戏的测试中,Opus 5.5 凭借画面表现与精致度获得了高于其他模型的评分。

安全性方面,Claude Opus 5.5 在 Anthropic 的自动化行为审计中取得了所有模型中的最高分数。该审计套件在数千个模拟场景中对模型进行测试。结果显示,该模型比其他近期发布的模型更少采取难以逆转的行动或超出既定界限,且比 Opus 5 更具备抵抗提示注入的能力。官方还扩大了对齐测试范围,涵盖长任务、不可完成任务及基于真实事件的场景。

鉴于 Claude Opus 5.5 在生物学和网络安全领域的能力与 Claude Mythos 5.1 相当,Anthropic 部署了类似 Claude Fable 5.1 的防护措施。经过审核的机构即日起可申请生命科学验证项目,使用 Opus 5.5 进行生物学研究。未来几周,Anthropic 计划扩大网络验证项目的访问权限,允许认证的网络安全从业者使用该模型开展工作。

成本与速度方面,Claude Opus 5.5 所需的计算量低于 Opus 5。官方测试表明,在默认设置及典型工作负载下,其成本较 Opus 5 低 40%,输出速度则快 30% 以上。具体定价方面,输入和输出 Token 的价格分别为 4 美元/百万 Token 和 20 美元/百万 Token,较 Opus 5 低 20%;缓存命中价格为 0.20 美元/百万 Token,较 Opus 5 低 60%。

除价格调整外,Anthropic 放宽了 Pro、Max、Team 等企业套餐的使用时间限制,并新增速率限制重置功能,允许订阅用户随时保存和使用该功能。

在交互能力上,Claude Opus 5.5 的沟通风格较之前模型更为自然。早期测试者反馈其文字表达更清晰易懂,能够优先呈现关键信息,并在长时间交互中表现更佳。有测试者表示其写作方式与人类相似。

据官方介绍,Claude Sonnet 5.5 和 Claude Haiku 5.5 将在未来几周推出,届时将在性能、效率和安全性方面同步相关改进。在 Anthropic 的基准测试中,Claude Opus 5.5 在智能编码、计算机使用和知识工作领域保持领先。

版权声明:本文由驱动中国整理发布,转载需注明出处与原文链接。如有疑问请联系 editor@qudong.com。
本文价值 ★★★★★ 3.3 3 人已评
登录后为本文打分
网友评论0 条评论
正在回复 的评论取消
评论加载中…
🔐

登录后参与互动

评论、点赞均可赚积分
连续签到、邀请好友也有奖励 🎁

电脑端: 微信扫码登录 微信内: 一键登录

微信扫一扫

打开微信「扫一扫」,分享本文到朋友圈或好友

分享卡已生成

长按下方图片保存,转发到朋友圈或微信群

分享卡