ParallelKernelBench: Frontier LLMs can't write fast multi-GPU kernels (yet)
Together AI Blog2146 字 (约 9 分钟)
85
当前前沿大语言模型在多GPU内核生成任务中表现不佳,正确率不足三分之一,且多数未超越基准。
入选理由:前沿模型如GPT-5.5、Gemini 3 Pro在多GPU内核生成任务中正确率不足三分之一。
FeaturedArticle#LLM#CUDA#多GPU#AI#性能优化英文
产品
别名:NeMo-RL
NVIDIA的强化学习框架,包含GRPO训练循环。
已跟踪 2 条高相关材料
最近变化
2026-06-23 · 前沿模型如GPT-5.5、Gemini 3 Pro在多GPU内核生成任务中正确率不足三分之一。
为什么值得关注
NVIDIA NeMo-RL 被反复提及时,通常意味着它正在影响产品路线、开发者工作流或 AI 产业判断。这个页面把分散材料合并成一个可持续更新的观察入口。
ParallelKernelBench: Frontier LLMs can't write fast multi-GPU kernels (yet)
Together AI Blog · 8.5 分
当前前沿大语言模型在多GPU内核生成任务中表现不佳,正确率不足三分之一,且多数未超越基准。
@vllm_project Get started with the code👇 https://t.co/S1cNx6qc8L
NVIDIA AI(@NVIDIAAI) · 4 分
NVIDIA AI 官方账号转发 vLLM 项目启动链接,并附带指向 NVIDIA-NeMo/RL GitHub 仓库的短链,内容无技术细节或上下文。
已收录 2 条与 NVIDIA NeMo-RL 相关的内容,按评分排序。
当前前沿大语言模型在多GPU内核生成任务中表现不佳,正确率不足三分之一,且多数未超越基准。
入选理由:前沿模型如GPT-5.5、Gemini 3 Pro在多GPU内核生成任务中正确率不足三分之一。
NVIDIA AI 官方账号转发 vLLM 项目启动链接,并附带指向 NVIDIA-NeMo/RL GitHub 仓库的短链,内容无技术细节或上下文。
入选理由:仅含推广性短链接,无代码说明、性能数据或使用指南