桃子桃子快讯
返回首页
模型发布

Anthropic 发布 Claude Opus 5,主打主动性与漏洞发现能力

Anthropic 推出 Claude Opus 5,据称在 Artificial Analysis 榜单领先,价格与上…

2026.07.25 · 周六2 分钟阅读

据知名 AI 博主 Simon Willison 报道,Anthropic 正式推出新一代旗舰模型 Claude Opus 5。Willison 表示自己当天大部分时间都在与海獭一起划皮划艇,未能及时对 Opus 5 进行全面测试,但社区反馈普遍积极。Anthropic 在官方介绍中将 Opus 5 描述为「一款深思熟虑且主动的模型,以一半的价格接近前沿智能水平」。该模型目前据称在 Artificial Analysis 排行榜上领先,甚至超过了 Fable 5。

性能与定位

Anthropic 介绍称,Opus 5 是一款「深思熟虑且主动」的模型,强调主动完成任务的能力。Willison 在博文中引用了一段来自发布说明的轶事:在 Frontier-Bench 任务中,Opus 5 被给到一张机器零件的图纸并要求编写代码将其重建为 3D FreeCAD 模型,但任务设置中故意让模型无法直接查看图纸。Opus 5 据此自行编写了一套计算机视觉管线,从原始像素中提取几何信息,并成功重建了整个机器零件。

定价与可用模式

Opus 5 的定价与前代 Opus 4.8 保持一致,并继续提供「快速模式」(fast mode),价格为基础模型的 2 倍。Anthropic 同时发布了配套的 Opus 5 提示工程指南,供开发者参考。

安全考量

Anthropic 强调,与前代 Opus 4.8 一样,Opus 5 并未针对网络攻击任务进行专门训练。尽管如此,由于整体能力提升,模型在漏洞发现方面仍有显著进步,接近 Mythos 5 的水平。不过在将漏洞转化为实际网络威胁的利用环节,Opus 5 仍明显落后于 Mythos 5。Willison 略带调侃地评论说,希望这意味着美国政府不会因此将其关停。

社区初步观察

Willison 在图像生成方面也做了简单尝试:第一次生成的鹈鹕缺少自行车轮子,第二次尝试明显改善。整体而言,博主对 Opus 5 的初步印象偏正面,但仍待更多系统性测试加以验证。

信源