Wide Research is now available in Perplexity Agent API
Perplexity 推出 WANDR 基准,聚焦宽研究领域,包含 500 个真实知识任务。
入选理由:WANDR 是首个针对宽研究的基准测试,包含 500 个任务
概念
别名:Wide Research Benchmark
用于评估大规模研究能力的基准测试
已跟踪 3 条高相关材料
最近变化
2026-08-28 · GLM 5.3在WANDR基准测试中击败GLM 5.2
为什么值得关注
WANDR 被反复提及时,通常意味着它正在影响产品路线、开发者工作流或 AI 产业判断。这个页面把分散材料合并成一个可持续更新的观察入口。
Wide Research is now available in Perplexity Agent API
Aravind Srinivas(@AravSrinivas) · 7 分
Perplexity 推出 WANDR 基准,聚焦宽研究领域,包含 500 个真实知识任务。
Perplexity is very good at building these benchmarks. Whenever I study them in-depth, it’s always th...
Suhail(@Suhail) · 6.5 分
Perplexity开源了其内部基准WANDR,用于提升深度和广泛研究能力,但技术细节披露有限。
GLM 5.3 is now available in Perplexity Computer. Built for long-context, multimodal agent workloads...
Perplexity(@perplexity_ai) · 5 分
Perplexity Computer现已支持GLM 5.3模型,该模型在长上下文和多模态任务中表现优于GLM 5.2但缺乏技术细节。
已收录 3 条与 WANDR 相关的内容,按评分排序。
Perplexity 推出 WANDR 基准,聚焦宽研究领域,包含 500 个真实知识任务。
入选理由:WANDR 是首个针对宽研究的基准测试,包含 500 个任务
Perplexity开源了其内部基准WANDR,用于提升深度和广泛研究能力,但技术细节披露有限。
入选理由:Perplexity开源了名为WANDR的内部研究基准
Perplexity Computer现已支持GLM 5.3模型,该模型在长上下文和多模态任务中表现优于GLM 5.2但缺乏技术细节。
入选理由:GLM 5.3在WANDR基准测试中击败GLM 5.2