NVIDIA Nemotron 3 Ultra 经 LangChain 调优,以十分之一成本实现基准领先
不更新模型,只优化工程环境,就能以更低成本获得更强性能,这对企业构建专用 AI 代理意义重大。
LangChain 通过调整系统提示、工具描述等工程手段,让 NVIDIA Nemotron 3 Ultra 在不重新训练的情况下,在 Deep Agents 基准测试中达到最高准确率,完成任务更多、吞吐更高,而每次推理成本仅为顶级闭源模型的十分之一。
正文摘录
NVIDIA Nemotron 借助 LangChain Deep Agents 挂载系统 实现基准测试领先性能 NVIDIA Nemotron 3 Ultra 在最大、应用最广泛的 AI 智能体编排平台上,以低于顶级闭源模型的成本,提供了领先性能。 LangChain 为 NVIDIA Nemotron 3 Ultra 调优了其 Deep Agents 挂载系统,在开放模型中达到了最高准确率,同时以每推理成本比顶级闭源模型低 10 倍 的价格,完成更多任务、吞吐量更高。 根据 LangChain Deep Agents 基准测试的测量,Nemotron 3 Ultra 在业务任务上还与得分最高的闭源模型持平。无需重新训练模型 —— 所有提升均来自对模型运行环境的工程优化,而非模型本身。 以十分之一的成本,使用 NVIDIA Nemotron 3 Ultra 的团队可以持续运行评测、更快迭代,并在更多业务场景中构建专用智能体。 LangChain 的智能体工程平台每月下载量超过 2 亿次。通过针对 [NVIDIA Nemotron](https://www.nvidia.com/en-us/ai-data-science/foundation-models/nemotron/) 3 Ultra 专门调优其 Deep Agents 挂载系统,它可以构建高性能智能体,完成更多任务、运行更快,并为企业提供完全开放的堆栈,企业可自行定制、拥有并部署在任何地方。 “构建更好智能体的方法是持续改进模型周围的系统,”LangChain 联合创始人兼 CEO Harrison Chase 表示。“当团队能够将记忆、工具使用、评测和模型行为协同调优时,会产生叠加效应。我们与 NVIDIA 的合作表明,企业可以在使用开放堆栈的同时,保持对正在构建的智能体系统的控制,并获得强劲性能。