Amazing! 🥳 Thanks @vllm_project for getting Qwen3.8-Flash-Next running on NVIDIA and AMD from day 0...
Qwen(@Alibaba_Qwen)114 字 (约 1 分钟)
65
通义千问模型Qwen3.8-Flash-Next在vLLM框架下实现NVIDIA和AMD GPU的原生支持,但技术细节披露有限。
入选理由:Qwen3.8-Flash-Next采用125B参数的超稀疏MoE架构,仅6B参数处于激活状态
精选推文#Qwen#vLLM#AI模型#GPU支持中英混合
