Hunyuan(@TXhunyuan)
Hy4 preview runs in vLLM
6.5内容质量

TL;DR · AI 摘要
腾讯Hy4-preview模型在vLLM框架上成功运行,验证于NVIDIA GPU,具备高参数量和高效路由机制。
核心要点
- Hy4-preview模型总参数770B,活跃参数49B,采用256个路由专家架构
- 支持1M上下文长度但单次查询仅处理2048个token,提升计算效率
- 78层网络中仅21层计算独立稀疏索引,其余57层复用计算结果
结构提纲
按章节快速跳转。
思维导图
用一张图看清主题之间的关系。
查看大纲文本(无障碍 / 无 JS 友好)
- Hy4-preview在vLLM的运行
- 技术验证
- NVIDIA GPU兼容性
- 模型架构
- 770B总参数
- 256路由专家
- 性能优化
- 1M上下文长度
- 2048token处理
金句 / Highlights
值得收藏与分享的关键句。
Hy4-preview在vLLM框架上实现从第一天就兼容NVIDIA GPU验证
256个路由专家加1个共享专家构成模型核心架构
78层网络中仅21层执行独立稀疏索引计算,其余层复用结果
#vLLM#模型优化#AI框架#大模型
打开原文Tencent Hy on X: "Hy4 preview runs in vLLM" / X
Tencent Hy
@TencentHunyuan
Hy4 preview runs in vLLM
vLLM
@vllm_project
Aug 28
@
TencentHunyuan
's Hy4-preview runs in vLLM from day 0, verified on NVIDIA GPUs. 🎉 - 770B total, 49B active, 256 routed experts plus one shared - 1M context, but each query attends to just 2048 tokens - Only 21 of the 78 layers compute their own sparse index, the other 57 reuse
Show more
4:06 PM · Aug 29, 2026
13.4K
Views
1
6
138
5