数据状态

同步自 OpenRouter · 337 个模型 · source=openrouter · 2026-08-01T20:21:24.699Z

nvidia

Nemotron 3 Ultra (free)

nvidia/nemotron-3-ultra-550b-a55b:free

NVIDIA Nemotron 3 Ultra是NVIDIA推出的开源前沿推理与编排模型,采用混合Transformer-Mamba MoE架构,总参数550B、激活参数55B。它支持文本输入输出,上下文窗口高达1M tokens,特别适合长时运行的代理工作流,包括代理编排、编码代理、深度研究和复杂企业任务。模型在多步推理、规划和工具调用方面表现突出,具备高吞吐推理能力,适合高容量代理管道。作为Nemotron家族成员,专注于代理AI场景。免费版通过OpenRouter提供,兼容OpenAI API,支持reasoning思考令牌。实际性能以厂商与网关为准,基准显示AA智力37.8、代码49.3、Agent 27.4。

NVIDIA开源MoE前沿推理与编排模型,55B激活/550B总参数,支持1M上下文。

免费/网关ToolsReasoning开源倾向text->text
上下文1M
输入 $/M免费
输出 $/M免费
智力指数37.8
代码指数49.3
Agent / Arena27.4
nemotron-3-ultra-550b-a55b:free · NVIDIA: Nemotron 3 Ultra (free) 配图
模型家族 · 历史版本 · 知识库

nemotron-3-ultra-550b-a55b:free

NVIDIA · 知识库 159 模 / 31 族

NVIDIA开源MoE前沿推理与编排模型,55B激活/550B总参数,支持1M上下文。

NVIDIA Nemotron 3 Ultra是NVIDIA推出的开源前沿推理与编排模型,采用混合Transformer-Mamba MoE架构,总参数550B、激活参数55B。它支持文本输入输出,上下文窗口高达1M tokens,特别适合长时运行的代理工作流,包括代理编排、编码代理、深度研究和复杂企业任务。模型在多步推理、规划和工具调用方面表现突出,具备高吞吐推理能力,适合高容量代理管道。作为Nemotron家族成员,专注于代理AI场景。免费版通过OpenRouter提供,兼容OpenAI API,支持reasoning思考令牌。实际性能以厂商与网关为准,基准显示AA智力37.8、代码49.3、Agent 27.4。

NVIDIA Nemotron 3 Ultra is an open frontier-reasoning and orchestration model from NVIDIA, with 55B active parameters out of 550B total (MoE). Built on a hybrid Transformer-Mamba mixture-of-experts architecture, it...

  • NVIDIA开源MoE前沿推理与编排模型,55B激活/550B总参数,支持1M上下文。
  • 参数量档位 550B-A55B
  • 归并版本 1 个
  • Nemotron 3 Ultra,550B总参数(55B激活),混合Mamba-Transformer MoE架构,2026年6月发布

适用场景

  • 长时代理工作流
  • 编码代理开发
  • 深度研究与企业任务
  • 高吞吐推理管道

能力 / 优势

  • 多步推理与规划
  • 代理编排与工具调用
  • 编码与终端代理
  • 长上下文处理

边界 / 不适合

  • 图像/视频生成
  • 实时低延迟交互
  • 多模态输入处理

接入提示:OpenAI兼容API,OpenRouter网关免费接入,模型ID nvidia/nemotron-3-ultra-550b-a55b:free,支持reasoning参数;测速入口见OpenRouter Playground

open-sourcemoeagenticreasoningcodingfreelong-context550B-A55B

常见问题

上下文长度是多少?

支持高达1M tokens上下文窗口,适合长时代理状态保持。

是否完全免费?

OpenRouter免费tier提供,注意数据日志用于NVIDIA改进。

支持哪些能力?

擅长代理推理、编码、规划、工具调用和多步任务。

如何接入?

使用OpenRouter API,模型slug为nvidia/nemotron-3-ultra-550b-a55b:free。

历史版本 / 相关变体

版本模型参数来源说明
当前Nemotron 3 Ultra (free)
nvidia/nemotron-3-ultra-550b-a55b:free
550B-A55BOpenRouter 免费/网关

定价与限制

输入免费 / 百万 tokens
输出免费 / 百万 tokens
缓存读 / 写 /
最大输出66k
输入模态text
输出模态text
HFnvidia/NVIDIA-Nemotron-3-Ultra-550B-A55B-BF16

支持参数

include_reasoningmax_tokensreasoningreasoning_effortseedtemperaturetool_choicetoolstop_p

价格与基准分优先同步自 OpenRouter;网关短 ID 由本站平台清单补全,介绍/历史版本融合 Hugging Face 检索与家族知识库。能力验真请用 bench_v1 实验室 · OCR 天梯