数据状态

同步自 OpenRouter · 400 个模型 · source=openrouter · 2026-08-10T01:41:24.920Z

deepseek

DeepSeek V3

deepseek/deepseek-chat

DeepSeek V3 0324 是 DeepSeek 团队 2025 年 3 月发布的旗舰聊天模型,基于 685B 参数 MoE 架构(37B 激活)。相较前代,在推理性能、代码生成(尤其是前端开发)及工具使用能力上有显著提升,支持函数调用、JSON 输出和长上下文对话。适用于复杂推理、软件开发、Agent 工作流及数学问题求解等场景。模态以文本为主,具体能力、价格与限制以厂商或网关为准。知识截止 2024 年 7 月,上下文约 164K tokens。

DeepSeek 团队旗舰 MoE 聊天模型,强化推理、编码与工具使用。

Tools开源倾向text->text
上下文164k
输入 $/M$0.257
输出 $/M$1.03
智力指数15.4
代码指数21.2
Agent / Arena1.5
DeepSeek · DeepSeek: DeepSeek V3 0324 配图
模型家族 · 历史版本 · 知识库

DeepSeek

DeepSeek · 知识库 159 模 / 31 族

DeepSeek 团队旗舰 MoE 聊天模型,强化推理、编码与工具使用。

DeepSeek V3 0324 是 DeepSeek 团队 2025 年 3 月发布的旗舰聊天模型,基于 685B 参数 MoE 架构(37B 激活)。相较前代,在推理性能、代码生成(尤其是前端开发)及工具使用能力上有显著提升,支持函数调用、JSON 输出和长上下文对话。适用于复杂推理、软件开发、Agent 工作流及数学问题求解等场景。模态以文本为主,具体能力、价格与限制以厂商或网关为准。知识截止 2024 年 7 月,上下文约 164K tokens。

DeepSeek 是中国 AI 公司深度求索推出的模型家族,以混合专家(MoE)架构为核心,提供高性能且成本低廉的开源大模型。当前主力包括 V4-Pro(超大规模 MoE)、V4-Flash(高效版)、R1 推理系列及 V3 基座,上下文窗口已扩展至百万级 token,适合处理大型代码库、长文档分析与复杂推理。模型在数学、编程、逻辑推理基准上表现突出,支持中英双语,权重开放便于本地部署与微调。适用场景涵盖软件开发、学术研究、Agent 构建与高吞吐 API 服务。边界在于:对中文敏感话题存在内容限制;多模态能力(VL/OCR)为独立子系列,非主力;作为 LLM 仍可能出现幻觉或事实偏差,复杂开放域任务建议结合工具验证。整体定位为技术向高性价比选择,而非全能闭源前沿模型。

DeepSeek 开源/API 模型系列,强调推理与性价比。

DeepSeek-V3 is the latest model from the DeepSeek team, building upon the instruction following and coding abilities of the previous versions. Pre-trained on nearly 15 trillion tokens, the reported evaluations...

  • DeepSeek 团队旗舰 MoE 聊天模型,强化推理、编码与工具使用。
  • 高性价比开源 MoE 模型家族,专注推理、代码与数学任务
  • 归并版本 13 个
  • 685B 参数 MoE 模型(37B 激活),2025 年 3 月 24 日发布版,基于 DeepSeek-V3 架构优化后训练。
  • DeepSeek 家族从早期 Coder 与 V2 起步,V3 推出 671B MoE 基座奠定通用与效率基础;R1 系列通过强化学习强化推理链条,在数学编码基准接近 o1 水平;2026 年 V4 系列(Flash 与 Pro)进一步升级

适用场景

  • 代码生成与软件工程
  • 数学与逻辑推理
  • 长上下文文档分析
  • Agent 工具调用与工作流

能力 / 优势

  • MoE 架构实现低激活参数高性能
  • 开源权重与 API 低价部署
  • 百万级上下文与强代码/数学能力

边界 / 不适合

  • 中文敏感话题内容限制
  • 非原生多模态主力,幻觉风险同其他 LLM

接入提示:OpenAI 兼容 API;OpenRouter 网关短 ID deepseek-chat-v3-0324;测速入口 OpenRouter 官网 playground。

开源推理代码高性价比MoEDeepSeek开源权重高性能聊天编码专家开源倾向中国

常见问题

该模型参数量和架构如何?

总参数约 685B,激活参数 37B 的 MoE 架构。

主要优势是什么?

推理、代码(尤其是前端)和工具使用能力显著提升,支持函数调用。

历史版本 / 相关变体

版本模型参数来源说明
3.2DeepSeek V3.2
deepseek/deepseek-v3.2
OpenRouter
3.2DeepSeek V3.2 Exp
deepseek/deepseek-v3.2-exp
OpenRouter
3.1DeepSeek V3.1 Terminus
deepseek/deepseek-v3.1-terminus
OpenRouter
3.1DeepSeek V3.1
deepseek/deepseek-chat-v3.1
OpenRouter
DeepSeek V4 Flash Latest
~deepseek/deepseek-v4-flash-latest
OpenRouter
DeepSeek V4 Flash 0731
deepseek/deepseek-v4-flash-0731
OpenRouter
DeepSeek V4 Pro
deepseek/deepseek-v4-pro
OpenRouter
DeepSeek V4 Flash 0423
deepseek/deepseek-v4-flash
OpenRouter
R1 0528
deepseek/deepseek-r1-0528
OpenRouter
DeepSeek V3 0324
deepseek/deepseek-chat-v3-0324
OpenRouter
R1 Distill Llama 70B
deepseek/deepseek-r1-distill-llama-70b
70BOpenRouter
R1
deepseek/deepseek-r1
OpenRouter
当前DeepSeek V3
deepseek/deepseek-chat
OpenRouter

定价与限制

输入$0.257 / 百万 tokens
输出$1.03 / 百万 tokens
缓存读 / 写 /
最大输出16k
输入模态text
输出模态text
HFdeepseek-ai/DeepSeek-V3

支持参数

frequency_penaltylogit_biasmax_tokensmin_ppresence_penaltyrepetition_penaltyresponse_formatseedstopstructured_outputstemperaturetool_choicetoolstop_ktop_p

价格与基准分优先同步自 OpenRouter;网关短 ID 由本站平台清单补全,介绍/历史版本融合 Hugging Face 检索与家族知识库。能力验真请用 bench_v1 实验室 · OCR 天梯

About this entity

DeepSeek V3: how to use this page

DeepSeek V3: live quotes and risk signals on GrokCode. Aggregation only — not a storefront.

Use related guides for methodology; use the tables above for numbers that change hourly.

Model catalog All guides

Related guides

FAQ

Where do DeepSeek V3 prices come from?
From public catalogs and lab snapshots. Prefer official pages for final billing truth.