数据状态

同步自 OpenRouter · 337 个模型 · source=openrouter · 2026-08-01T22:45:09.530Z

nvidia

Nemotron 3 Nano 30B A3B (free)

nvidia/nemotron-3-nano-30b-a3b:free

NVIDIA Nemotron 3 Nano 30B A3B是NVIDIA发布的第三代Nano系列模型,采用混合Mamba-2与MoE架构,总参数量约30B,激活参数约3.5B。该模型在推理、代码生成、工具调用、指令遵循和长上下文处理上表现突出,适合作为企业Agent系统中的感知与上下文子代理。支持最高1M tokens上下文,推理吞吐显著优于同类模型。模型完全开源,提供权重、数据集和训练配方,便于开发者定制优化与本地部署。免费版通过OpenRouter提供,但所有提示与输出会被记录以改进模型,不适用于生产或关键业务系统。以厂商/网关为准。

NVIDIA开源MoE模型,30B总参激活约3.5B,专为高效Agentic AI与代码推理设计。

免费/网关ToolsReasoning开源倾向text->text
上下文256k
输入 $/M免费
输出 $/M免费
智力指数14.2
代码指数14.4
Agent / Arena2.0
nemotron-3-nano-30b-a3b:free · NVIDIA: Nemotron 3 Nano 30B A3B (free) 配图
模型家族 · 历史版本 · 知识库

nemotron-3-nano-30b-a3b:free

NVIDIA · 知识库 159 模 / 31 族

NVIDIA开源MoE模型,30B总参激活约3.5B,专为高效Agentic AI与代码推理设计。

NVIDIA Nemotron 3 Nano 30B A3B是NVIDIA发布的第三代Nano系列模型,采用混合Mamba-2与MoE架构,总参数量约30B,激活参数约3.5B。该模型在推理、代码生成、工具调用、指令遵循和长上下文处理上表现突出,适合作为企业Agent系统中的感知与上下文子代理。支持最高1M tokens上下文,推理吞吐显著优于同类模型。模型完全开源,提供权重、数据集和训练配方,便于开发者定制优化与本地部署。免费版通过OpenRouter提供,但所有提示与输出会被记录以改进模型,不适用于生产或关键业务系统。以厂商/网关为准。

NVIDIA Nemotron 3 Nano 30B A3B is a small language MoE model with highest compute efficiency and accuracy for developers to build specialized agentic AI systems. The model is fully...

  • NVIDIA开源MoE模型,30B总参激活约3.5B,专为高效Agentic AI与代码推理设计。
  • 参数量档位 30B-A3B
  • 归并版本 1 个
  • 30B总参数,A3B指激活约3.5B参数的混合MoE架构,结合23层Mamba-2/MoE与6层注意力,支持Granular Reasoning Budget Control。

适用场景

  • Agent系统开发
  • 代码辅助与调试
  • 复杂推理与数学任务
  • 长文本分析与工具集成

能力 / 优势

  • 高效推理与代码生成
  • 工具调用与Agent任务
  • 长上下文处理
  • 指令遵循与多任务

边界 / 不适合

  • 生产环境或关键业务系统
  • 隐私敏感场景(免费版日志记录)

接入提示:OpenAI兼容API,通过OpenRouter网关接入,免费端点ID nvidia/nemotron-3-nano-30b-a3b:free;上下文256K-1M;测速入口OpenRouter平台或NVIDIA NIM。

开源MoENVIDIA免费Agent代码30B-A3B

常见问题

该模型主要用途是什么?

专为构建高效专用Agentic AI系统设计,擅长代码、推理与工具调用。

免费版有哪些限制?

提示和输出会被记录,不推荐用于生产或敏感场景。

如何快速测试?

通过OpenRouter使用OpenAI兼容接口,模型ID为nvidia/nemotron-3-nano-30b-a3b:free。

历史版本 / 相关变体

版本模型参数来源说明
当前Nemotron 3 Nano 30B A3B (free)
nvidia/nemotron-3-nano-30b-a3b:free
30B-A3BOpenRouter 免费/网关

定价与限制

输入免费 / 百万 tokens
输出免费 / 百万 tokens
缓存读 / 写 /
最大输出
输入模态text
输出模态text
HFnvidia/NVIDIA-Nemotron-3-Nano-30B-A3B-BF16

支持参数

include_reasoningmax_tokensreasoningseedtemperaturetool_choicetoolstop_p

价格与基准分优先同步自 OpenRouter;网关短 ID 由本站平台清单补全,介绍/历史版本融合 Hugging Face 检索与家族知识库。能力验真请用 bench_v1 实验室 · OCR 天梯