本地部署 / 开源权重? 开源模型频道:HF / Ollama / GGUF / ModelScope 下载 + 显存筛选 + 部署计算器(含双方案对比)。

Model Catalog · AA / Arena 对标

模型目录与家族版本

在 GrokCode 内容体系中,models-catalog 枢纽是模型目录与家族版本的核心模块。它整合主流 AI 模型的树状家族关系、发布迭代时间线及参数规格等公开数据,与 ladder-system 的多维天梯和 ocr-ecosystem 的工具生态互补。用户路径包括从订阅比价或天梯入口进入目录检索模型、浏览版本历史、对比规格,并跳转验证性能,帮助开发者与研究者高效完成模型选型与追踪。

数据更新于 2026-08-03 · AA 260 · Arena 44 · OR-AA 107 · 知识库 161 模 / 36 族 / 26 维 · 配图 177

对标 Artificial Analysis + Arena Agent + 用量榜

目录表已补 AA 智力(OpenRouter 实时 / OR 快照 / AA 公开榜)与 Arena 排名。完整条形图见天梯;真实流量热度见用量 / 任务消费榜。

OCR 与文档理解生态

在 GrokCode 全站内容体系中,ocr-ecosystem 枢纽定位为 OCR 与文档理解生态模块,衔接模型目录、模型天梯及 API 订阅比价三大核心。它聚焦 PaddleOCR 等开源项目、支持文档理解的多模态模型历史版本与性能数据。用户可通过主站多模态天梯或模型目录入口进入,探索工具对比、基准佐证及部署路径,实现从模型评估到实际应用的平滑过渡。该枢纽为开发者、研究人员和企业提供专业、可核验的资源,帮助优化文档处理流程中的 AI

数据状态

同步自 OpenRouter · 445 个模型 · 含网关上架 47 个短 ID · source=openrouter · 2026-09-17T21:28:03.858Z

nemotron-3-nano · NVIDIA: Nemotron 3 Nano 30B A3B 配图
模型家族 · 历史版本 · 知识库

nemotron-3-nano

NVIDIA · 知识库 161 模 / 36 族

高效混合MoE推理模型,30B总参激活约3.5B,优化Agentic与高吞吐场景

NVIDIA Nemotron 3 Nano 30B A3B是Nemotron 3系列的Nano变体,采用Mamba-2与Transformer混合MoE架构,总参数30B,激活参数约3.5B(每token激活6专家)。模型专为推理与非推理任务统一设计,支持可配置推理轨迹(enable_thinking flag),默认生成思考过程以提升复杂任务准确率。适用于英语、代码及部分欧洲/日语任务,上下文最高支持1M tokens(OpenRouter等网关默认256K)。在Agentic系统、工具调用、数学/科学推理、长上下文RAG和生产级高吞吐部署中表现突出,具备开源权重、数据集与训练配方,便于定制与本地部署。以厂商及OpenRouter网关实际支持为准。

NVIDIA Nemotron 3 Nano 30B A3B is a small language MoE model with highest compute efficiency and accuracy for developers to build specialized agentic AI systems. The model is fully...

  • 高效混合MoE推理模型,30B总参激活约3.5B,优化Agentic与高吞吐场景
  • 参数量档位 30B-A3B
  • 归并版本 2 个
  • 30B总参数,A3B指激活约3.5B的混合MoE架构(128 routed +1 shared expert,激活6个),Nemotron 3 Nano变体,预训练截止2025年6月,后训练11月

适用场景

  • Agentic AI系统构建
  • 高吞吐生产推理部署
  • 数学科学与编码辅助
  • 长上下文RAG与多步工具使用

能力 / 优势

  • 多步推理与思考轨迹
  • 代码生成理解与工具调用
  • Agentic多环境任务
  • 高效长上下文处理
  • 指令遵循与结构化输出

边界 / 不适合

  • 多模态视觉音频输入
  • 非英语主导的多语言任务
  • 极致低延迟实时聊天

接入提示:OpenAI兼容Chat Completions API,通过OpenRouter使用ID nvidia/nemotron-3-nano-30b-a3b;支持reasoning flag;测速入口参考OpenRouter playground或网关文档

reasoningMoEcodingagentopen-weightshigh-throughput30B-A3B

常见问题

模型参数量与架构?

总参数30B,激活约3.5B,23层Mamba-2 MoE +6层Attention的混合架构。

上下文长度支持?

最高1M tokens,OpenRouter默认256K,以网关配置为准。

是否支持多模态?

目前为纯文本模型,Omni变体另行支持。

如何开启/关闭推理思考?

chat template中enable_thinking=true/false,默认true以获得更高准确率。

历史版本 / 相关变体

版本模型参数来源说明
Nemotron 3 Nano Omni (free)
nvidia/nemotron-3-nano-omni-30b-a3b-reasoning:free
30B-A3BOpenRouter 免费/网关
当前Nemotron 3 Nano 30B A3B
nvidia/nemotron-3-nano-30b-a3b
30B-A3BOpenRouter
模型492
厂商69
免费72
Tools415
有智力分145
重置天梯对标 →用量榜 →

匹配 1 / 492 · 第 1/1 页 · 价格 USD/M tokens · AA 智力 = OpenRouter 透出优先,缺则用公开榜快照 · Arena = lmarena.ai

模型上下文输入输出能力AA 智力代码Arena操作
Nemotron 3 Nano 30B A3B
nvidia/nemotron-3-nano-30b-a3b
262k$0.060$0.240
ToolsReason开源
8.914.4

数据源:OpenRouter 公开 Models API(缓存约 1 小时)。本站聚合展示,不构成购买建议;实测能力请用实验室。