NVIDIA Nemotron Achieves Benchmark-Leading Performance With LangChain Deep Agents Harness

TL;DR · AI 摘要
NVIDIA Nemotron 3 Ultra在LangChain Deep Agents Harness上实现行业领先的性能,成本降低10倍,任务完成率提升。
核心要点
- Nemotron 3 Ultra任务完成率比封闭模型高10倍,推理成本降低90%
- 无需模型微调,通过系统工程优化实现性能突破
- NVIDIA NemoClaw提供开源参考架构,支持企业自定义部署
结构提纲
按章节快速跳转。
思维导图
用一张图看清主题之间的关系。
查看大纲文本(无障碍 / 无 JS 友好)
- Nemotron与LangChain合作
- 性能突破
- 10倍任务完成率
- 90%成本降低
- 技术方案
- 系统工程优化
- 无需模型微调
- 应用价值
- 开源架构
- 企业定制部署
金句 / Highlights
值得收藏与分享的关键句。
Nemotron 3 Ultra在LangChain基准测试中达到封闭模型同等业务任务表现,但成本仅为1/10
通过调整系统提示和工具描述,无需模型再训练即可提升性能
NVIDIA NemoClaw提供开源参考架构,支持企业自定义部署
NVIDIA Nemotron 通过 LangChain Deep Agents 框架实现基准领先的性能 | NVIDIA 博客
标题
NVIDIA Nemotron 通过 LangChain Deep Agents 框架实现基准领先的性能
为 NVIDIA Nemotron 3 Ultra 优化 LangChain Deep Agents 框架,在企业可运行、自定义和控制的开源堆栈上实现了领先的性能和更快的任务完成速度。
2026年7月8日
作者
Adel El Hallak
/inner3
META
0条评论
分享
分享本文
- X
- 复制链接 链接已复制!
特色图片/视频
NVIDIA Nemotron 3 Ultra 在成本低于顶级封闭模型的情况下,提供了领先的性能,并结合了最大且最广泛采用的 AI 代理编排平台。
LangChain 为 NVIDIA Nemotron 3 Ultra 优化了其 Deep Agents 框架,在开源模型中实现了最高的准确性,同时以更高的吞吐量完成更多任务,且每次运行的推理成本仅为领先封闭模型的十分之一。
根据 LangChain 的 Deep Agents 基准测试,Nemotron 3 Ultra 在商业任务表现上也与最高分的封闭模型达成一致。无需对模型进行重新训练,所有提升均来自于围绕模型的环境工程,而非模型本身。
成本仅为十分之一时,使用 NVIDIA Nemotron 3 Ultra 的团队可以持续运行评估,加速实验,并在更多业务场景中构建专用代理。
LangChain 的代理工程平台每月下载量超过 2 亿次。通过为 NVIDIA Nemotron 3 Ultra 特别优化其 Deep Agents 框架,企业可以构建性能更优的代理,完成更多任务,运行速度更快,并拥有可自定义、可拥有且可在任何地方运行的完全开源堆栈。
“构建更优秀的代理系统的关键在于持续改进围绕模型的系统,”LangChain 联合创始人兼首席执行官 Harrison Chase 表示。“当团队能够共同调整记忆、工具使用、评估和模型行为时,这些因素会相互叠加产生复利效应。我们与 NVIDIA 的合作表明,企业可以通过开源堆栈实现强大性能,同时保持对代理系统的控制权。”
Abridge、Amdocs 和 Box 正在将专用代理直接嵌入其平台和全球系统中,而全球系统集成商 EY 正在扩展其围绕 NVIDIA NemoClaw 蓝图的 NVIDIA 实施能力,用于 LangChain Deep Agents,帮助客户在高价值工作流程中自定义、评估和治理专用代理。
NVIDIA 创始人兼首席执行官 Jensen Huang 最近与 Chase 进行了对话,讨论为什么过去六个月企业可用 AI 的实用性实现了飞跃。
框架工程,而非微调
LangChain 团队将 Nemotron 3 Ultra 与公开的 Deep Agents 基准测试套件进行对比,随后分析了深度代理的执行轨迹,以确定其失分的确切位置。团队没有重新训练模型,而是围绕模型优化了框架——调整系统提示、工具描述和中间件。
所有使用 LangChain Deep Agents 与 Nemotron 3 Ultra 的开发者今天都可以直接应用这一优化成果——通过 LangChain 可直接获取调优后的配置文件。
为自主可控而构建的开源堆栈
NVIDIA NemoClaw for LangChain Deep Agents 是面向企业构建专用 AI 的开源参考蓝图,将模型、工具和运行时系统打包成适用于自身工作流程的专用系统。它结合了为 Nemotron 3 Ultra 优化的 LangChain Deep Agents 代码,以及用于安全执行代理操作的 NVIDIA OpenShell 安全运行时环境。
一个开放的模型、一个开放的框架和一个开放的安全运行时环境意味着企业可以拥有从端到端的全栈技术。他们可以根据自身独特的业务专长进行定制,持续改进,并在任意环境运行——无论是自有基础设施、自有云平台还是自有治理体系。
随着代理(agent)承担更具挑战性的任务,这种区别变得愈发重要。从回答问题的AI助手转向在核心系统中执行操作的代理,改变了企业从AI中获得的价值。
NemoClaw for LangChain Deep Agents 和优化后的 Nemotron 3 Ultra 模型配置现已发布。开发者可以直接从 LangChain 拉取优化后的 Deep Agents 框架,或使用 NemoClaw for LangChain Deep Agents 模板作为构建专用代理的起点。
如何开始
LangChain 开发者可通过 Baseten、Crusoe Cloud、DeepInfra、Fireworks、Nebius 和 Together AI 平台访问 Nemotron 3 Ultra,这些平台为他们提供了直接部署优化框架的托管路径。
安永(EY)可协助企业今天就开始构建自己的专用代理,使用这套开放的软件栈。
了解更多关于 NVIDIA NemoClaw for LangChain Deep Agents 和 NVIDIA Nemotron 的信息。
通过订阅 NVIDIA 新闻、加入社区,并关注 NVIDIA AI 的 LinkedIn、Instagram、X 和 Facebook 账号,获取关于代理AI、NVIDIA Nemotron 等的最新动态。
探索自定进度的视频教程和直播课程。
#secondary
- 分类:
- 深度学习
- 标签:
- Nemotron
相关新闻
AI 基础设施
NVIDIA Vera Rubin 推动每瓦特性能提升,为全球合作伙伴提供最低的每 token 成本
2026年7月21日
超级计算
安进(Bristol Myers Squibb)在 NVIDIA Vera Rubin 上构建生命科学行业最先进的AI工厂
2026年7月20日
NVIDIA 与日本推动全栈AI和机器人技术覆盖所有行业
2026年7月15日
为什么每瓦特性能是衡量AI基础设施效率的终极指标
2026年7月14日