NVIDIA AI(@NVIDIAAI)

You're welcome 👊

6.5内容质量
You're welcome 👊

TL;DR · AI 摘要

NVIDIA发布75B参数MoE模型,基于Iterative Puzzle框架压缩而来,支持1M token上下文。

核心要点

  • NVIDIA推出75.3B参数的Nemotron-3-Puzzle-75B模型
  • 采用Iterative Puzzle框架从120B模型压缩得到
  • 支持1M token上下文长度,适合大模型推理场景

结构提纲

按章节快速跳转。

  1. NVIDIA宣布推出75B参数的新型MoE模型。

  2. 模型基于Iterative Puzzle框架从120B参数模型压缩而来。

  3. 支持1M token上下文长度,参数量为75.3B。

思维导图

用一张图看清主题之间的关系。

查看大纲文本(无障碍 / 无 JS 友好)
  • NVIDIA发布75B MoE模型
    • 模型参数
      • 75.3B总参数 / 9.3B激活参数
    • 技术框架
      • Iterative Puzzle压缩方法
    • 性能特性
      • 1M token上下文支持

金句 / Highlights

值得收藏与分享的关键句。

#AI模型#NVIDIA#MoE#大模型
打开原文

NVIDIA AI on X: "You're welcome 👊" / X

NVIDIA AI

@NVIDIAAI

You're welcome 👊

mr-r0b0t

@mr_r0b0t

10h

@

NVIDIAAI

刚刚赠送了我们一个75B MoE 🤩🤩🤩 nvidia/NVIDIA-Nemotron-Labs-3-Puzzle-75B-A9B-NVFP4 75.3B总参数 / 9.3B激活压缩参数,基于Nemotron-3-Super-120B模型通过迭代拼图框架训练。支持1M token上下文!非常适合你的单GB10 ♥️

2026年7月8日 凌晨1:37

36.1K

Views

1

2

12

9

19

4

0

409

100

阅读12条回复 /