数据状态

同步自 OpenRouter · 337 个模型 · source=openrouter · 2026-08-01T22:41:24.611Z

nvidia

Nemotron 3 Super

nvidia/nemotron-3-super-120b-a12b

NVIDIA Nemotron 3 Super是一款开放权重的大语言模型,总参数120B、激活参数12B,采用LatentMoE混合架构(Mamba-2 + MoE + Attention)并支持多token预测。具备1M token超长上下文窗口,在agentic reasoning、工具调用、代码生成、规划与多代理协作等任务上表现突出,吞吐量较前代显著提升,适合构建高效的多代理AI系统、复杂软件开发、网络安全分析及长文档跨文档推理场景。支持英语、法语、德语、意大利语、日语、西班牙语及中文等多语言。以厂商/网关为准。

120B总/12B激活混合Mamba-Transformer MoE,1M上下文,专精agentic推理与多代理应用

ToolsReasoning开源倾向text->text
上下文1M
输入 $/M$0.085
输出 $/M$0.400
智力指数25.4
代码指数37.7
Agent / Arena8.7
nemotron-3-super · NVIDIA: Nemotron 3 Super 配图
模型家族 · 历史版本 · 知识库

nemotron-3-super

NVIDIA · 知识库 159 模 / 31 族

120B总/12B激活混合Mamba-Transformer MoE,1M上下文,专精agentic推理与多代理应用

NVIDIA Nemotron 3 Super是一款开放权重的大语言模型,总参数120B、激活参数12B,采用LatentMoE混合架构(Mamba-2 + MoE + Attention)并支持多token预测。具备1M token超长上下文窗口,在agentic reasoning、工具调用、代码生成、规划与多代理协作等任务上表现突出,吞吐量较前代显著提升,适合构建高效的多代理AI系统、复杂软件开发、网络安全分析及长文档跨文档推理场景。支持英语、法语、德语、意大利语、日语、西班牙语及中文等多语言。以厂商/网关为准。

NVIDIA Nemotron 3 Super is a 120B-parameter open hybrid MoE model, activating just 12B parameters for maximum compute efficiency and accuracy in complex multi-agent applications. Built on a hybrid Mamba-Transformer...

  • 120B总/12B激活混合Mamba-Transformer MoE,1M上下文,专精agentic推理与多代理应用
  • 参数量档位 120B-A12B
  • 归并版本 2 个
  • 120B总参数、12B激活参数的LatentMoE混合架构模型(id推断)

适用场景

  • 多代理AI系统构建
  • 复杂推理与长上下文任务
  • 代码与软件工程场景

能力 / 优势

  • agentic reasoning
  • tool calling与规划
  • 代码生成与调试
  • 长上下文多代理协作

边界 / 不适合

  • 多模态图像/视频生成
  • 极低延迟简单对话

接入提示:OpenRouter兼容OpenAI API,短ID nvidia/nemotron-3-super-120b-a12b;支持NVIDIA NIM部署;测速入口OpenRouter playground

NVIDIAMoEAgenticReasoningCodingLong Context120B-A12B

常见问题

该模型上下文长度是多少?

原生支持1M token上下文窗口,适合长时agent coherence。

主要优势是什么?

12B激活的高效率MoE架构,在多代理、推理、coding任务上兼顾准确率与吞吐量。

历史版本 / 相关变体

版本模型参数来源说明
当前Nemotron 3 Super
nvidia/nemotron-3-super-120b-a12b
120B-A12BOpenRouter
Nemotron 3 Super (free)
nvidia/nemotron-3-super-120b-a12b:free
120B-A12BOpenRouter 免费/网关

定价与限制

输入$0.085 / 百万 tokens
输出$0.400 / 百万 tokens
缓存读 / 写 /
最大输出16k
输入模态text
输出模态text
HFnvidia/NVIDIA-Nemotron-3-Super-120B-A12B-FP8

支持参数

frequency_penaltyinclude_reasoninglogit_biaslogprobsmax_tokensmin_ppresence_penaltyreasoningreasoning_effortrepetition_penaltyresponse_formatseedstopstructured_outputstemperaturetool_choicetoolstop_ktop_logprobstop_p

价格与基准分优先同步自 OpenRouter;网关短 ID 由本站平台清单补全,介绍/历史版本融合 Hugging Face 检索与家族知识库。能力验真请用 bench_v1 实验室 · OCR 天梯