数据状态

同步自 OpenRouter · 400 个模型 · source=openrouter · 2026-08-10T03:08:40.329Z

deepseek

DeepSeek V4 Flash 0423

deepseek/deepseek-v4-flash

DeepSeek V4 Flash 是 DeepSeek-V4 系列的效率优化版 Mixture-of-Experts 模型,总参数 284B、激活参数 13B,支持 1M token 上下文窗口。模型采用混合注意力机制,优化长上下文处理,推理能力接近 V4-Pro,在简单 Agent 任务上表现相当。适合高吞吐量、成本敏感场景,如快速代码实现、指令遵循和结构化任务执行。模态以文本为主,支持 OpenAI Chat Completions 兼容接口。通过 OpenRouter 等网关访问,具体定价与可用性以厂商/网关为准。模型于 2026 年 4 月发布预览,强调低延迟与高性价比,适合实时应用与批量处理。

DeepSeek V4 系列高效 MoE 模型,284B 总/13B 激活参数,1M 上下文,专注快速推理与编码。

ToolsReasoning开源倾向text->text
上下文1.0M
输入 $/M$0.140
输出 $/M$0.280
智力指数49.9
代码指数69.1
Agent / Arena45.7
DeepSeek · DeepSeek: DeepSeek V4 Flash 配图
模型家族 · 历史版本 · 知识库

DeepSeek

DeepSeek · 知识库 159 模 / 31 族

DeepSeek V4 系列高效 MoE 模型,284B 总/13B 激活参数,1M 上下文,专注快速推理与编码。

DeepSeek V4 Flash 是 DeepSeek-V4 系列的效率优化版 Mixture-of-Experts 模型,总参数 284B、激活参数 13B,支持 1M token 上下文窗口。模型采用混合注意力机制,优化长上下文处理,推理能力接近 V4-Pro,在简单 Agent 任务上表现相当。适合高吞吐量、成本敏感场景,如快速代码实现、指令遵循和结构化任务执行。模态以文本为主,支持 OpenAI Chat Completions 兼容接口。通过 OpenRouter 等网关访问,具体定价与可用性以厂商/网关为准。模型于 2026 年 4 月发布预览,强调低延迟与高性价比,适合实时应用与批量处理。

DeepSeek 是中国 AI 公司深度求索推出的模型家族,以混合专家(MoE)架构为核心,提供高性能且成本低廉的开源大模型。当前主力包括 V4-Pro(超大规模 MoE)、V4-Flash(高效版)、R1 推理系列及 V3 基座,上下文窗口已扩展至百万级 token,适合处理大型代码库、长文档分析与复杂推理。模型在数学、编程、逻辑推理基准上表现突出,支持中英双语,权重开放便于本地部署与微调。适用场景涵盖软件开发、学术研究、Agent 构建与高吞吐 API 服务。边界在于:对中文敏感话题存在内容限制;多模态能力(VL/OCR)为独立子系列,非主力;作为 LLM 仍可能出现幻觉或事实偏差,复杂开放域任务建议结合工具验证。整体定位为技术向高性价比选择,而非全能闭源前沿模型。

DeepSeek 开源/API 模型系列,强调推理与性价比。

DeepSeek V4 Flash is an efficiency-optimized Mixture-of-Experts model from DeepSeek with 284B total parameters and 13B activated parameters, supporting a 1M-token context window. It is designed for fast inference and...

  • DeepSeek V4 系列高效 MoE 模型,284B 总/13B 激活参数,1M 上下文,专注快速推理与编码。
  • 高性价比开源 MoE 模型家族,专注推理、代码与数学任务
  • 归并版本 13 个
  • V4 Flash 版本,284B 总参数(13B 激活),MoE 架构,1M 上下文窗口。
  • DeepSeek 家族从早期 Coder 与 V2 起步,V3 推出 671B MoE 基座奠定通用与效率基础;R1 系列通过强化学习强化推理链条,在数学编码基准接近 o1 水平;2026 年 V4 系列(Flash 与 Pro)进一步升级

适用场景

  • 代码生成与软件工程
  • 数学与逻辑推理
  • 长上下文文档分析
  • Agent 工具调用与工作流

能力 / 优势

  • MoE 架构实现低激活参数高性能
  • 开源权重与 API 低价部署
  • 百万级上下文与强代码/数学能力

边界 / 不适合

  • 中文敏感话题内容限制
  • 非原生多模态主力,幻觉风险同其他 LLM

接入提示:支持 OpenAI Chat Completions 兼容接口,通过 OpenRouter 网关使用短 ID deepseek/deepseek-v4-flash。

开源推理代码高性价比MoE高效编码Agent长上下文OpenRouter开源倾向中国

常见问题

模型参数量与上下文如何?

总参数 284B,激活 13B,支持 1M token 上下文。

适合哪些主要场景?

快速编码、简单 Agent 执行、高吞吐量任务,复杂规划建议用 Pro 版。

历史版本 / 相关变体

版本模型参数来源说明
3.2DeepSeek V3.2
deepseek/deepseek-v3.2
OpenRouter
3.2DeepSeek V3.2 Exp
deepseek/deepseek-v3.2-exp
OpenRouter
3.1DeepSeek V3.1 Terminus
deepseek/deepseek-v3.1-terminus
OpenRouter
3.1DeepSeek V3.1
deepseek/deepseek-chat-v3.1
OpenRouter
DeepSeek V4 Flash Latest
~deepseek/deepseek-v4-flash-latest
OpenRouter
DeepSeek V4 Flash 0731
deepseek/deepseek-v4-flash-0731
OpenRouter
DeepSeek V4 Pro
deepseek/deepseek-v4-pro
OpenRouter
当前DeepSeek V4 Flash 0423
deepseek/deepseek-v4-flash
OpenRouter
R1 0528
deepseek/deepseek-r1-0528
OpenRouter
DeepSeek V3 0324
deepseek/deepseek-chat-v3-0324
OpenRouter
R1 Distill Llama 70B
deepseek/deepseek-r1-distill-llama-70b
70BOpenRouter
R1
deepseek/deepseek-r1
OpenRouter
DeepSeek V3
deepseek/deepseek-chat
OpenRouter

定价与限制

输入$0.140 / 百万 tokens
输出$0.280 / 百万 tokens
缓存读 / 写$0.028 /
最大输出393k
输入模态text
输出模态text
HFdeepseek-ai/DeepSeek-V4-Flash

支持参数

frequency_penaltyinclude_reasoninglogit_biaslogprobsmax_tokensmin_ppresence_penaltyreasoningreasoning_effortrepetition_penaltyresponse_formatseedstopstructured_outputstemperaturetool_choicetoolstop_atop_ktop_logprobstop_p

价格与基准分优先同步自 OpenRouter;网关短 ID 由本站平台清单补全,介绍/历史版本融合 Hugging Face 检索与家族知识库。能力验真请用 bench_v1 实验室 · OCR 天梯

关于本页实体

DeepSeek V4 Flash 0423:怎么用本页做决策

DeepSeek V4 Flash 0423: live quotes and risk signals on GrokCode. Aggregation only — not a storefront.

Use related guides for methodology; use the tables above for numbers that change hourly.

模型目录 全部指南

相关指南

常见问题

Where do DeepSeek V4 Flash 0423 prices come from?
From public catalogs and lab snapshots. Prefer official pages for final billing truth.

主题柱

slug:deepseek/deepseek-v4-flash · 主题柱讲方法,实时数字以本页表格为准