数据状态

同步自 OpenRouter · 337 个模型 · source=openrouter · 2026-08-01T22:44:21.785Z

qwen

Qwen3 Next 80B A3B Thinking

qwen/qwen3-next-80b-a3b-thinking

Qwen3-Next-80B-A3B-Thinking是Qwen推出的新一代混合注意力MoE模型,总参数80B,激活约3B。采用Gated DeltaNet与Gated Attention混合布局,支持仅thinking模式,默认输出结构化思考轨迹,适合高度复杂的推理任务,如数学证明、代码合成、逻辑分析和Agent规划。它在多个基准上超越前代Qwen3思考模型,甚至优于Gemini-2.5-Flash-Thinking。原生支持262K上下文,可扩展至百万级,支持100+语言。模态以文本为主,未知细节以厂商或OpenRouter网关为准。适用于需要深度思考的场景,但输出可能包含较长思考内容,推荐用于专业分析而非简单对话。

Qwen3-Next系列稀疏MoE思考模型,专攻复杂推理与长上下文任务。

ToolsReasoning开源倾向text->text
上下文262k
输入 $/M$0.150
输出 $/M$1.20
智力指数16.7
代码指数17.4
Agent / Arena2.1
通义千问 · Qwen: Qwen3 Next 80B A3B Thinking 配图
模型家族 · 历史版本 · 知识库

通义千问

阿里云 · 知识库 159 模 / 31 族

Qwen3-Next系列稀疏MoE思考模型,专攻复杂推理与长上下文任务。

Qwen3-Next-80B-A3B-Thinking是Qwen推出的新一代混合注意力MoE模型,总参数80B,激活约3B。采用Gated DeltaNet与Gated Attention混合布局,支持仅thinking模式,默认输出结构化思考轨迹,适合高度复杂的推理任务,如数学证明、代码合成、逻辑分析和Agent规划。它在多个基准上超越前代Qwen3思考模型,甚至优于Gemini-2.5-Flash-Thinking。原生支持262K上下文,可扩展至百万级,支持100+语言。模态以文本为主,未知细节以厂商或OpenRouter网关为准。适用于需要深度思考的场景,但输出可能包含较长思考内容,推荐用于专业分析而非简单对话。

通义千问(Qwen)是阿里云推出的系列大模型,覆盖轻量到旗舰多种规模,支持文本、视觉、音频等多模态。早期Qwen1奠定中文与多语言基础,Qwen2及2.5强化推理与代码能力,Qwen3系列引入MoE架构与大规模训练数据,持续迭代至3.7等版本。适用于中文内容创作、代码开发调试、多模态分析、AI Agent构建等场景。边界在于部分旗舰模型需API调用,开源版本性能优秀但特定基准可能略逊闭源前沿;不适合需要实时物理交互或超专业垂直领域的应用。

阿里通义千问大模型系列,覆盖通用对话、代码、视觉与端侧尺寸。

Qwen3-Next-80B-A3B-Thinking is a reasoning-first chat model in the Qwen3-Next line that outputs structured “thinking” traces by default. It’s designed for hard multi-step problems; math proofs, code synthesis/debugging, logic, and agentic...

  • Qwen3-Next系列稀疏MoE思考模型,专攻复杂推理与长上下文任务。
  • 阿里云通义实验室打造的多语言多模态大模型家族
  • 参数量档位 80B-A3B
  • 当前版本线 3
  • 归并版本 51 个
  • 80B总参数、A3B激活参数的Qwen3-Next首款Thinking变体,采用混合注意力与高稀疏MoE架构,支持thinking模式。
  • Qwen系列自2023年Qwen1起步,2024年Qwen2及2.5大幅提升性能与开源覆盖,2025年Qwen3引入MoE与36万亿tokens训练,强化推理与Agent;2026年迭代3.5至3.7版本,扩展全模态、图像生成及Agent世

适用场景

  • 中文内容创作与翻译
  • 代码生成与调试优化
  • 多模态理解与生成
  • 智能Agent与工具调用

能力 / 优势

  • 中文与多语言理解领先
  • 代码与数学推理能力强
  • 开源模型丰富且性价比高

边界 / 不适合

  • 旗舰模型多为闭源API服务
  • 多模态生成在创意细节上仍有提升空间

接入提示:OpenAI兼容API,通过OpenRouter使用ID qwen/qwen3-next-80b-a3b-thinking;支持SGLang/vLLM部署,推荐context >128K;测速入口参考OpenRouter或网关。

大模型家族中文模型代码AgentreasoningMoEqwenthinkingopenrouter对话代码多模态中国80B-A3Bv3

常见问题

什么是thinking模式?

模型默认强制thinking模式,输出包含结构化思考内容,适合复杂任务。

参数量与激活情况如何?

总80B参数,推理时激活约3B参数,高效MoE架构。

历史版本 / 相关变体

版本模型参数来源说明
3.7Qwen3.7 Flash
qwen/qwen3.7-flash
OpenRouter
3.7Qwen3.7 Plus
qwen/qwen3.7-plus
OpenRouter
3.7Qwen3.7 Max
qwen/qwen3.7-max
OpenRouter
3.6Qwen3.6 Flash
qwen/qwen3.6-flash
OpenRouter
3.6Qwen3.6 35B A3B
qwen/qwen3.6-35b-a3b
35B-A3BOpenRouter
3.6Qwen3.6 Max Preview
qwen/qwen3.6-max-preview
OpenRouter
3.6Qwen3.6 27B
qwen/qwen3.6-27b
27BOpenRouter
3.6Qwen3.6 Plus
qwen/qwen3.6-plus
OpenRouter
3.6qwen3.6:27b
qwen3.6:27b
27B本站网关 免费/网关
3.6qwen3.6:35b-a3b
qwen3.6:35b-a3b
35B-A3B本站网关 免费/网关
3.5Qwen3.5 Plus 2026-04-20
qwen/qwen3.5-plus-20260420
OpenRouter
3.5Qwen3.5-9B
qwen/qwen3.5-9b
9BOpenRouter
3.5Qwen3.5-35B-A3B
qwen/qwen3.5-35b-a3b
35B-A3BOpenRouter
3.5Qwen3.5-27B
qwen/qwen3.5-27b
27BOpenRouter
3.5Qwen3.5-122B-A10B
qwen/qwen3.5-122b-a10b
122B-A10BOpenRouter
3.5Qwen3.5-Flash
qwen/qwen3.5-flash-02-23
OpenRouter
3.5Qwen3.5 Plus 2026-02-15
qwen/qwen3.5-plus-02-15
OpenRouter
3.5Qwen3.5 397B A17B
qwen/qwen3.5-397b-a17b
397B-A17BOpenRouter
3.5qwen3.5:4b
qwen3.5:4b
4B本站网关 免费/网关
3Qwen3 Max Thinking
qwen/qwen3-max-thinking
OpenRouter
3Qwen3 Coder Next
qwen/qwen3-coder-next
OpenRouter
3Qwen3 VL 32B Instruct
qwen/qwen3-vl-32b-instruct
32BOpenRouter
3Qwen3 VL 8B Thinking
qwen/qwen3-vl-8b-thinking
8BOpenRouter
3Qwen3 VL 8B Instruct
qwen/qwen3-vl-8b-instruct
8BOpenRouter

定价与限制

输入$0.150 / 百万 tokens
输出$1.20 / 百万 tokens
缓存读 / 写 /
最大输出33k
输入模态text
输出模态text
HFQwen/Qwen3-Next-80B-A3B-Thinking

支持参数

frequency_penaltyinclude_reasoninglogit_biaslogprobsmax_tokenspresence_penaltyreasoningrepetition_penaltyresponse_formatseedstopstructured_outputstemperaturetool_choicetoolstop_ktop_logprobstop_p

价格与基准分优先同步自 OpenRouter;网关短 ID 由本站平台清单补全,介绍/历史版本融合 Hugging Face 检索与家族知识库。能力验真请用 bench_v1 实验室 · OCR 天梯