Aravind Srinivas(@AravSrinivas)

We have started serving a lot of our inference on NVLink Blackwells. Vera Rubins next!

7.0内容质量
We have started serving a lot of our inference on NVLink Blackwells. Vera Rubins next!

TL;DR · AI 摘要

Perplexity AI利用NVIDIA的NVLink Blackwell芯片和Nemotron 3 Ultra模型,实现每天5000万次查询的高性能推理服务。

核心要点

  • Perplexity AI每天处理5000万次查询,使用NVIDIA Nemotron 3 Ultra模型
  • NVLink Blackwell芯片提升大规模推理的性能和效率
  • 智能路由技术确保服务质量、速度和成本的平衡

结构提纲

按章节快速跳转。

  1. 介绍Perplexity AINVLink Blackwell上的推理服务进展

  2. NVLink Blackwell芯片的性能优势及部署规模

  3. Nemotron 3 Ultra模型在每日5000万次查询中的表现

  4. 如何通过路由优化平衡质量、速度和成本

  5. Vera Rubins项目的下一步技术路线

思维导图

用一张图看清主题之间的关系。

查看大纲文本(无障碍 / 无 JS 友好)
  • Perplexity AI的高性能推理架构
    • NVLink Blackwell芯片
      • 大规模推理部署
    • Nemotron 3 Ultra模型
      • 5000万次/日查询处理
    • 智能路由技术
      • 质量-速度-成本平衡

金句 / Highlights

值得收藏与分享的关键句。

#NVIDIA#AI推理#NVLink Blackwell#Perplexity AI#大规模查询处理
打开原文

Aravind Srinivas on X: "We have started serving a lot of our inference on NVLink Blackwells. Vera Rubins next!" / X

Aravind Srinivas

@AravSrinivas

我们已经开始在NVLink Blackwells上运行大量推理任务。接下来是Vera Rubins!

NVIDIA AI Infrastructure

@NVIDIAAIInfra

9月8日

在大规模场景下实现秒级高质量结果需要什么?

@

perplexity_ai

每天通过15个模型处理超过5000万次查询,包括NVIDIA Nemotron 3 Ultra。这需要高性能基础设施和更智能的路由策略,同时不牺牲质量、速度或

显示更多

$

00:00

/$

2026年9月8日 下午5:10

42.3K

浏览量

23

22

320

25