歸藏(guizang.ai)(@op7418)
笑死 Anthropic 这么草台? 这 Opus 5 的测试成绩分数标红不太对吧 53.4 大于 53.5?
6.0内容质量

TL;DR · AI 摘要
Anthropic 的 Opus 5 模型在测评中表现优于前代,但测试成绩标红引发争议。
核心要点
- Opus 5 测评成绩优于 Opus 4.8 和 Fable 5
- 用户质疑 53.4 分大于 53.5 的标红逻辑
- Opus 5 的性价比可能影响 Claude Max 续订决策
结构提纲
按章节快速跳转。
用户质疑 Opus 5 测评成绩标红逻辑是否正确。
Opus 5 在多项测评中优于 Opus 4.8 和 Fable 5。
- ›用户反馈
用户认为 Opus 5 性价比超过 Claude Max。
思维导图
用一张图看清主题之间的关系。
查看大纲文本(无障碍 / 无 JS 友好)
- Opus 5 模型测评
- 测试成绩争议
- 53.4 vs 53.5 标红问题
- 性能对比
- 优于 Opus 4.8
- 优于 Fable 5
- 用户反馈
- 性价比优势
- Claude Max 续订建议
金句 / Highlights
值得收藏与分享的关键句。
53.4 大于 53.5?用户质疑测试成绩标红逻辑
Opus 5 测评成绩大幅优于 Opus 4.8
Claude Max 续订性价比过低,4.8 跟屎一样
#Anthropic#模型测评#AI#Opus 5
打开原文歸藏(guizang.ai) on X: "笑死 Anthropic 这么草台? 这 Opus 5 的测试成绩分数标红不太对吧 53.4 大于 53.5? https://t.co/ZB6p8bhKo9" / X
歸藏(guizang.ai)
@op7418
笑死 Anthropic 这么草台? 这 Opus 5 的测试成绩分数标红不太对吧 53.4 大于 53.5?
9h
来了!Opus 5 模型发布,价格跟 Opus 4.8 相同 在测评成绩上大幅优于 Opus 4.8,同时相当多的测评成绩都高于 Fable 5。 终于有个能用的模型了! 要再不出,我感觉 Claude Max 都没必要续订了,性价比过低,4.8 跟屎一样
5:15 PM · Jul 24, 2026
56.2K
Views
36
1
110
9