首页 AI实时资讯内容详情

Anthropic Opus 5 发布:性能逼近 Fable 5 但价格砍半,刷新 ARC-AGI-3 纪录

2026-07-27 2 暗号导航联盟

谢谢 IT 之家网友 SJJ, 谢谢爱上无脸男, 谢谢软媒用户, 谢谢一只 Zenon, 谢谢 Nuc_F, 谢谢软媒新友, 谢谢 LL J, 谢谢 HH_KK, 谢谢始终瘦不下, 谢谢非液化, 谢谢汪汪的主人是喵喵, 谢谢华南吴彦祖, 谢谢乌蝇哥的左手, 谢谢软媒新友, 谢谢软媒新友, 谢谢对的时间点的线索投递!

根据 IT 之家 7 月 25 日所传来的消息, 就在今日, 发布新款 Opus 系列最新旗舰模型, 也就是 Opus 5, 相较于上一代 Opus 4.8, 这款 Opus 5 在性能得以提升的状况下始终维持价格没有发生变化。

将其表述为, Opus 5 被定位成是面向日常运用的具备高性能的模型, 官方声称它在部分能力方面接近于更高规格的Fable 5, 然而其价格大约是后者的一半。此模型当前已然成为Max服务的默认模型, 同时也是Pro用户能够运用的拥有最高能力的模型, 在多项代码、知识工作以及科学研究测验里达到了当前的最高水准。

据相关介绍表明, Opus 5在, -Bench项、-AA等各代码以及知识工作评测之中, 取得了处于第一位置的成绩, 于, -Bench v0.1测试期间, Opus 5超过了别的其他模型, 而且就将自己与Opus 4.8进行比较之后, 其各项任务性能提高了超过一倍, 与此同时, 每一项任务花费的成本更低。

在3.2测试期间,Opus 5于最高努力模式里所取得的成绩, 仅有比Fable 5顶峰成绩低0.5%的情况, 然而其单项任务成本大约是后者的一半。另外, 在高、中高以及最高努力设置状况下, Opus 5在单位成本性能层面,均超越了其他模型。

关于知识处理以及问题解决能力这方面, 所公布出来的测试结果表明, 那名为Opus 5的在ARC - AGI 3、还有2.0等评测里皆获取到了较高的成绩。当中, 于ARC - AGI 3测试之时, Opus 5的得分大概是第二名得分的3倍;在用来衡量模型完成完整业务流程能力的那个测评中, 它的通过率大约是成本差不多模型通过率的1.5倍。

表明, Opus 5相较于Opus 4.8, 于科研任务方面也存在显著提高, 覆盖面涵括结构生物学、有机化学、生物信息学等范畴。于有机化学任务当中, 像依据光谱数据去推断分子结构这种情况, Opus 5较Opus 4.8高出10.2个百分点;在对蛋白质序列变化对功能影响进行预测的任务里, 高出7.7个百分点。

Anthropic Opus 5 发布:性能逼近 Fable 5 但价格砍半,刷新 ARC-AGI-3 纪录__Anthropic Opus 5 发布:性能逼近 Fable 5 但价格砍半,刷新 ARC-AGI-3 纪录

在实际应用这块儿, 着重指出 Opus 5 在验证自身得出的结果以及持续进行迭代修正这两方面的能力更为突出。比如说, 在一项测试里头, 模型得依据机器零件的图纸去生成三维模型, 可它没办法直接去查看图纸的具体内容。而 Opus 5 编写了属于它自己的计算机视觉流程, 从原始像素当中提取几何信息, 并且成功地完成了模型重建。

在另一项测试里, Opus 5 察觉到了一个存在于开源软件包管理器当中的实际漏洞, 并且将社区补丁遗漏的问题给修复了。除此之外, 有一名交易公司工程师运用 Opus 5 在一次会话之际构建了一个新交易所的数据接口。在缺少实时数据源验证的情形下, 模型还打造了测试工具去检查代码解析结果。

于安全范畴当中, 表明 Opus 5 的安全限定相较 Fable 5 要少一些。这家公司所预估的是, Opus 5 的安全分类器触发频次会比 Fable 5 降低大概 85%。

然而, Opus 5 依旧针对某些高风险情形设定了限制, 比如说, 在网络安全范畴, 模型能够协助剖析源代码中的破绽, 不过会阻拦凭依二进制文件的破绽扫描、渗透测试以及破绽利用代码生成等行为。

宣称, Opus 5 未曾历经专门针对网络攻击任务的训练, 然而伴随整体能力的提高, 其漏洞发觉能力出现了强化。于 OSS-Fuzz 测试里, Opus 5 针对漏洞发现这一情况与 5 表现得较为相近, 可是在把漏洞转变为实际可用的攻击工具这方面依旧显著落后于 5。

于生物范畴之中, Opus 5 将 Opus 4.8 的安全构架予以延续, 当下已然成为朝着公众敞开大门的、具备最强能力的科研型号。然而, 存在这样的观点, Opus 5 在历经长时间、自行开展科研工作的任务领域里依旧存有局限, 并且, 此类任务被认定为或许会引发更高的风险。

在价格这一方面, Opus 5 已经借助各平台实现上线, 其输入价格有着明确规定, 为每百万词元 5 美元, 按照当前的汇率来换算, 大约折合人民币 33.9 元呢, 而输出价格是每百万词元 25 美元, 同样依据现汇率来算, 大概折合人民币 169.6 元, 并且这份价格与 Opus 4.8 保持一模一样的标准。至于开发者, 他们能够通过 API 去调用 -opus-5。

另外, 推出了 Opus 5 Fast 模式, 此模式运行速度大概是默认模式的 2.5 倍, 其价格是基础价格的两倍。与此同时, 开放测试两项功能, 一项是平台里的对话中途工具切换, 另一项是 API 中的自动回退功能。

用户在安全分类器去拦截请求的情形之下, 自动回退功能是准许其能把任务自动移交到其他可被使用的模型那儿去进行处理的, 这样做的目的在于防止直接返回错误的信息。还阐述 Opus 5 和之前 Opus 系列的模型相同在于, 当面对普通用户开放之际是不会去设置数据保留方面的要求的。

相关标签: # AnthropicOpus5 # AI模型 # 性能提升 # 价格优惠 # 安全性