Perplexity(@perplexity_ai)

Perplexity 发布内部基准 WANDR

3.5内容质量
Perplexity 发布内部基准 WANDR

TL;DR · AI 摘要

Perplexity 发布内部基准 WANDR,旨在模拟真实专业研究负载,Search as Code 性能领先竞品 0.234 分。

核心要点

  • WANDR 是 Perplexity 内部构建的广泛基准,模拟真实专业研究工作负载。
  • Search as Code 在 WANDR 上得分 0.386,领先次优系统 0.152。
  • WANDR 基准尚未饱和,未来仍有性能提升空间。

思维导图

用一张图看清主题之间的关系。

查看大纲文本(无障碍 / 无 JS 友好)
  • Perplexity 发布 WANDR 基准
#Perplexity#AI Benchmark#Search as Code
打开原文

Perplexity 在 X 上发文:“WANDR 是我们内部构建的广泛基准测试,旨在模拟真实的专业研究工作负载。Search as Code 的得分比次优系统高出 0.386(次优系统得分为 0.152),且该基准测试远未达到饱和。我们将在未来几周内发布 WANDR。https://t.co/AkxqOdisaA” / X

不要错过正在发生的事情