11

08

星期二

08月11日 23:08

英伟达开源Nemotron 3.5 Lightning:专门替Agent跑工具调用

据动察 Beating 监测,英伟达发布开源模型 Nemotron 3.5 Lightning,专门给长时间运行的 Agent 干「执行活」。模型总参数 300 亿,每个 Token 只激活 30 亿,主要负责工具调用、结果检查和子 Agent 调度等高频任务。 英伟达的思路是把 Agent 分工做得更彻底。复杂规划交给 Nemotron 3 Ultra 等大模型,大量重复执行交给 Lightning。官方称,其输出速度最高可达同级模型的 4 倍。PinchBench 上,Lightning 准确率达到 86%,在准确率接近的情况下,跑完 1 万个任务比 Qwen3.6 35B 快 30%。 模型采用 MoE 架构,还专门针对 Agent Harness 做了训练,并加入多 Token 预测和推测解码。官方提供 BF16 和 NVFP4 权重,可在 RTX 5090、DGX Spark 等本地设备运行,也支持 llama.cpp、Ollama、LM Studio 和 Unsloth。 它也强调可定制。英伟达开放了权重、部分训练数据和训练配方,企业可以继续针对代码、安全、法律等任务做后训练。官方展示的案例中,Lightning 后训练后在多个专业任务上都有明显涨分。

「查看原文」

本内容旨在传递行业动态,不构成投资建议或承诺。