数据状态

同步自 OpenRouter · 337 个模型 · source=openrouter · 2026-08-01T22:58:38.791Z

nvidia

Nemotron 3 Super (free)

nvidia/nemotron-3-super-120b-a12b:free

NVIDIA Nemotron 3 Super 是一款 120B 参数的开放混合 MoE 模型,总参数 120B 但每次前向仅激活 12B 参数,采用混合 Mamba-Transformer 架构,支持高达 1M token 上下文(OpenRouter 免费版显示 262K)。它在代理推理、编码、规划、工具调用和多代理应用中表现出色,生成速度比领先开放模型高 50% 以上,适合复杂任务规划、长文档跨文档推理和协作代理系统。支持英语、中文、法语、德语、日语、西班牙语等多种语言。完全开放权重、数据集和训练配方,便于自定义和安全部署。适用于需要高效率和高准确性的代理系统开发与运行。以厂商/网关为准。

NVIDIA 120B 参数混合 MoE 模型,激活 12B 参数,专注代理推理与多代理应用(免费版)

免费/网关ToolsReasoning开源倾向text->text
上下文262k
输入 $/M免费
输出 $/M免费
智力指数25.4
代码指数37.7
Agent / Arena8.7
nemotron-3-super-120b-a12b:free · NVIDIA: Nemotron 3 Super (free) 配图
模型家族 · 历史版本 · 知识库

nemotron-3-super-120b-a12b:free

NVIDIA · 知识库 159 模 / 31 族

NVIDIA 120B 参数混合 MoE 模型,激活 12B 参数,专注代理推理与多代理应用(免费版)

NVIDIA Nemotron 3 Super 是一款 120B 参数的开放混合 MoE 模型,总参数 120B 但每次前向仅激活 12B 参数,采用混合 Mamba-Transformer 架构,支持高达 1M token 上下文(OpenRouter 免费版显示 262K)。它在代理推理、编码、规划、工具调用和多代理应用中表现出色,生成速度比领先开放模型高 50% 以上,适合复杂任务规划、长文档跨文档推理和协作代理系统。支持英语、中文、法语、德语、日语、西班牙语等多种语言。完全开放权重、数据集和训练配方,便于自定义和安全部署。适用于需要高效率和高准确性的代理系统开发与运行。以厂商/网关为准。

NVIDIA Nemotron 3 Super is a 120B-parameter open hybrid MoE model, activating just 12B parameters for maximum compute efficiency and accuracy in complex multi-agent applications. Built on a hybrid Mamba-Transformer...

  • NVIDIA 120B 参数混合 MoE 模型,激活 12B 参数,专注代理推理与多代理应用(免费版)
  • 参数量档位 120B-A12B
  • 归并版本 1 个
  • 120B 总参数,激活 12B 参数的混合 Mamba-Transformer MoE 架构,2026 年 3 月发布

适用场景

  • 多代理应用开发
  • 复杂编码与推理任务
  • 长文档规划与工具使用

能力 / 优势

  • 代理推理
  • 编码与工具调用
  • 多步规划
  • 长上下文多代理协作

边界 / 不适合

  • 图像或视频生成
  • 简单闲聊对话

接入提示:OpenAI 兼容 API,通过 OpenRouter 网关访问,短 ID nvidia/nemotron-3-super-120b-a12b:free,免费 tier;测速入口为 OpenRouter 平台 Playground。

nvidiamoeagenticfreeopenrouterreasoning120B-A12B

常见问题

该模型上下文长度是多少?

官方支持 1M tokens,OpenRouter 免费版为 262K tokens。

主要优势是什么?

高计算效率(仅激活 12B 参数)、强代理推理能力和完全开放权重。

历史版本 / 相关变体

版本模型参数来源说明
当前Nemotron 3 Super (free)
nvidia/nemotron-3-super-120b-a12b:free
120B-A12BOpenRouter 免费/网关

定价与限制

输入免费 / 百万 tokens
输出免费 / 百万 tokens
缓存读 / 写 /
最大输出262k
输入模态text
输出模态text
HFnvidia/NVIDIA-Nemotron-3-Super-120B-A12B-FP8

支持参数

include_reasoningmax_tokensreasoningreasoning_effortresponse_formatseedstructured_outputstemperaturetool_choicetoolstop_p

价格与基准分优先同步自 OpenRouter;网关短 ID 由本站平台清单补全,介绍/历史版本融合 Hugging Face 检索与家族知识库。能力验真请用 bench_v1 实验室 · OCR 天梯