歸藏(guizang.ai)(@op7418)

笑死 Anthropic 这么草台? 这 Opus 5 的测试成绩分数标红不太对吧 53.4 大于 53.5?

6.0内容质量
笑死 Anthropic 这么草台?

这 Opus 5 的测试成绩分数标红不太对吧

53.4 大于 53.5?

TL;DR · AI 摘要

Anthropic 的 Opus 5 模型在测评中表现优于前代,但测试成绩标红引发争议。

核心要点

  • Opus 5 测评成绩优于 Opus 4.8 和 Fable 5
  • 用户质疑 53.4 分大于 53.5 的标红逻辑
  • Opus 5 的性价比可能影响 Claude Max 续订决策

结构提纲

按章节快速跳转。

  1. 用户质疑 Opus 5 测评成绩标红逻辑是否正确。

  2. Opus 5 在多项测评中优于 Opus 4.8 和 Fable 5

  3. 用户认为 Opus 5 性价比超过 Claude Max

思维导图

用一张图看清主题之间的关系。

查看大纲文本(无障碍 / 无 JS 友好)
  • Opus 5 模型测评
    • 测试成绩争议
      • 53.4 vs 53.5 标红问题
    • 性能对比
      • 优于 Opus 4.8
      • 优于 Fable 5
    • 用户反馈
      • 性价比优势
      • Claude Max 续订建议

金句 / Highlights

值得收藏与分享的关键句。

#Anthropic#模型测评#AI#Opus 5
打开原文

歸藏(guizang.ai) on X: "笑死 Anthropic 这么草台? 这 Opus 5 的测试成绩分数标红不太对吧 53.4 大于 53.5? https://t.co/ZB6p8bhKo9" / X

歸藏(guizang.ai)

@op7418

笑死 Anthropic 这么草台? 这 Opus 5 的测试成绩分数标红不太对吧 53.4 大于 53.5?

9h

来了!Opus 5 模型发布,价格跟 Opus 4.8 相同 在测评成绩上大幅优于 Opus 4.8,同时相当多的测评成绩都高于 Fable 5。 终于有个能用的模型了! 要再不出,我感觉 Claude Max 都没必要续订了,性价比过低,4.8 跟屎一样

5:15 PM · Jul 24, 2026

56.2K

Views

36

1

110

9