Introducing Claude Opus 5
TL;DR · AI 摘要
Claude Opus 5在保持低价的同时显著提升性能,尤其在3D重建和漏洞发现任务中表现突出。
核心要点
- Opus 5通过自主构建计算机视觉管道完成3D零件重建任务
- 与Fable 5性能接近但价格仅为一半
- 漏洞发现能力接近Mythos 5但不包含利用方法
结构提纲
按章节快速跳转。
思维导图
用一张图看清主题之间的关系。
查看大纲文本(无障碍 / 无 JS 友好)
- Claude Opus 5
- 核心能力
- 自主计算机视觉管道
- 漏洞发现优化
- 性能对比
- 接近Fable 5
- 落后Mythos 5(利用能力)
- 应用场景
- 3D建模
- 网络安全
金句 / Highlights
值得收藏与分享的关键句。
在无直接视觉输入情况下,Opus 5自主构建计算机视觉管道完成3D零件重建
Opus 5价格与Opus 4.8相同但性能接近Fable 5
漏洞发现能力接近Mythos 5但利用能力仍落后约50%
介绍 Claude Opus 5
Simon Willison 的博客
订阅
#smallhead
由以下公司赞助:
Cursor — 即使笔记本电脑关闭时,也可将工程任务委托给 Cursor 云代理。
尝试 Cursor,首月享受 50% 折扣
2026 年 7 月 24 日 - 链接博客
介绍 Claude Opus 5。今天大部分时间我都在离线进行海獭皮划艇活动,因此尚未有机会全面测试 Anthropic 新模型 Claude Opus 5 的性能。目前业界反响积极,Anthropic 将其描述为“一款富有远见且主动的模型,其智能水平接近 Claude Fable 5,但价格仅为后者的一半”,这一描述颇具吸引力。目前该模型在人工智能分析排行榜上领先,甚至超过了 Fable 5。
其定价与 Opus 4.8 相同,并继续提供“快速模式”,成本是基础模型的两倍。
根据发布文章中的轶事描述,该模型似乎表现出强烈的主动性:
在一项 Frontier-Bench 任务中,Opus 5 被提供了一幅机械零件的图纸,并要求编写代码将其重建为 3D FreeCAD 模型。然而在这个任务中,模型被刻意设计为无法直接查看图纸。Opus 5 的应对方式是编写自己的计算机视觉流程,从原始像素中提取几何信息,然后重建完整的机械零件。
该模型在发现漏洞方面表现更出色,但刻意未接受如何利用漏洞的训练。希望这意味着美国政府不会因此关闭它!
与前代产品 Opus 4.8 一样,我们刻意避免对 Opus 5 进行网络攻击相关任务的训练。然而由于模型通用能力的提升,其在这些任务上的表现仍显著提高,并在发现网络安全漏洞方面接近 Mythos 5 的水平。不过在将漏洞转化为实际网络威胁方面,它仍明显落后于 Mythos 5——即在将漏洞转化为实质性网络威胁方面。
Anthropic 已发布 Claude Opus 5 的提示指南。Thariq Shihipar 也撰写了《Claude 5 生成模型的上下文工程新规则》。
我收到的第一只鹈鹕缺少自行车轮;第二次尝试更好了。
发布于
2026 年 7 月 24 日
晚上 11:48
最新文章
- OpenAI 对 Hugging Face 的意外网络攻击是科幻小说般的真实事件 - 2026 年 7 月 22 日
- 与 Claude 代码团队的 Cat 和 Thariq 的炉边对话 - 2026 年 7 月 21 日
- Kimi K3 以及我们仍能从鹈鹕基准测试中学习的内容 - 2026 年 7 月 16 日
#primary
这是 Simon Willison 于 2026 年 7 月 24 日发布的链接文章。
ai
2,142
generative-ai
1,894
llms
1,861
anthropic
315
claude
294
llm-release
218
月度简报
每月赞助 10 美元,获取本月最重要的 LLM 发展精选电子邮件摘要。
支付我以发送更少的邮件!
赞助并订阅
.metabox
#secondary
#wrapper
- 披露信息
- 制作团队
- ©
- 2002
- 2003
- 2004
- 2005
- 2006
- 2007
- 2008
- 2009
- 2010
- 2011
- 2012
- 2013
- 2014
- 2015
- 2016
- 2017
- 2018
- 2019
- 2020
- 2021
- 2022
- 2023
- 2024
- 2025
- 2026