数据状态

同步自 OpenRouter · 337 个模型 · source=openrouter · 2026-08-01T22:35:05.584Z

nvidia

Nemotron 3 Nano 30B A3B

nvidia/nemotron-3-nano-30b-a3b

NVIDIA Nemotron 3 Nano 30B A3B是Nemotron 3系列的Nano变体,采用Mamba-2与Transformer混合MoE架构,总参数30B,激活参数约3.5B(每token激活6专家)。模型专为推理与非推理任务统一设计,支持可配置推理轨迹(enable_thinking flag),默认生成思考过程以提升复杂任务准确率。适用于英语、代码及部分欧洲/日语任务,上下文最高支持1M tokens(OpenRouter等网关默认256K)。在Agentic系统、工具调用、数学/科学推理、长上下文RAG和生产级高吞吐部署中表现突出,具备开源权重、数据集与训练配方,便于定制与本地部署。以厂商及OpenRouter网关实际支持为准。

高效混合MoE推理模型,30B总参激活约3.5B,优化Agentic与高吞吐场景

ToolsReasoning开源倾向text->text
上下文262k
输入 $/M$0.050
输出 $/M$0.200
智力指数14.2
代码指数14.4
Agent / Arena2.0
nemotron-3-nano · NVIDIA: Nemotron 3 Nano 30B A3B 配图
模型家族 · 历史版本 · 知识库

nemotron-3-nano

NVIDIA · 知识库 159 模 / 31 族

高效混合MoE推理模型,30B总参激活约3.5B,优化Agentic与高吞吐场景

NVIDIA Nemotron 3 Nano 30B A3B是Nemotron 3系列的Nano变体,采用Mamba-2与Transformer混合MoE架构,总参数30B,激活参数约3.5B(每token激活6专家)。模型专为推理与非推理任务统一设计,支持可配置推理轨迹(enable_thinking flag),默认生成思考过程以提升复杂任务准确率。适用于英语、代码及部分欧洲/日语任务,上下文最高支持1M tokens(OpenRouter等网关默认256K)。在Agentic系统、工具调用、数学/科学推理、长上下文RAG和生产级高吞吐部署中表现突出,具备开源权重、数据集与训练配方,便于定制与本地部署。以厂商及OpenRouter网关实际支持为准。

NVIDIA Nemotron 3 Nano 30B A3B is a small language MoE model with highest compute efficiency and accuracy for developers to build specialized agentic AI systems. The model is fully...

  • 高效混合MoE推理模型,30B总参激活约3.5B,优化Agentic与高吞吐场景
  • 参数量档位 30B-A3B
  • 归并版本 3 个
  • 30B总参数,A3B指激活约3.5B的混合MoE架构(128 routed +1 shared expert,激活6个),Nemotron 3 Nano变体,预训练截止2025年6月,后训练11月

适用场景

  • Agentic AI系统构建
  • 高吞吐生产推理部署
  • 数学科学与编码辅助
  • 长上下文RAG与多步工具使用

能力 / 优势

  • 多步推理与思考轨迹
  • 代码生成理解与工具调用
  • Agentic多环境任务
  • 高效长上下文处理
  • 指令遵循与结构化输出

边界 / 不适合

  • 多模态视觉音频输入
  • 非英语主导的多语言任务
  • 极致低延迟实时聊天

接入提示:OpenAI兼容Chat Completions API,通过OpenRouter使用ID nvidia/nemotron-3-nano-30b-a3b;支持reasoning flag;测速入口参考OpenRouter playground或网关文档

reasoningMoEcodingagentopen-weightshigh-throughput30B-A3B

常见问题

模型参数量与架构?

总参数30B,激活约3.5B,23层Mamba-2 MoE +6层Attention的混合架构。

上下文长度支持?

最高1M tokens,OpenRouter默认256K,以网关配置为准。

是否支持多模态?

目前为纯文本模型,Omni变体另行支持。

如何开启/关闭推理思考?

chat template中enable_thinking=true/false,默认true以获得更高准确率。

历史版本 / 相关变体

版本模型参数来源说明
Nemotron 3 Nano Omni (free)
nvidia/nemotron-3-nano-omni-30b-a3b-reasoning:free
30B-A3BOpenRouter 免费/网关
当前Nemotron 3 Nano 30B A3B
nvidia/nemotron-3-nano-30b-a3b
30B-A3BOpenRouter
Nemotron 3 Nano 30B A3B (free)
nvidia/nemotron-3-nano-30b-a3b:free
30B-A3BOpenRouter 免费/网关

定价与限制

输入$0.050 / 百万 tokens
输出$0.200 / 百万 tokens
缓存读 / 写$0.030 /
最大输出262k
输入模态text
输出模态text
HFnvidia/NVIDIA-Nemotron-3-Nano-30B-A3B-BF16

支持参数

frequency_penaltyinclude_reasoninglogit_biaslogprobsmax_tokensmin_ppresence_penaltyreasoningrepetition_penaltyresponse_formatseedstopstructured_outputstemperaturetool_choicetoolstop_ktop_logprobstop_p

价格与基准分优先同步自 OpenRouter;网关短 ID 由本站平台清单补全,介绍/历史版本融合 Hugging Face 检索与家族知识库。能力验真请用 bench_v1 实验室 · OCR 天梯