同步自 OpenRouter · 400 个模型 · source=openrouter · 2026-08-10T01:41:17.834Z
DeepSeek V4 Flash 0423
deepseek/deepseek-v4-flash
DeepSeek V4 Flash 是 DeepSeek-V4 系列的效率优化版 Mixture-of-Experts 模型,总参数 284B、激活参数 13B,支持 1M token 上下文窗口。模型采用混合注意力机制,优化长上下文处理,推理能力接近 V4-Pro,在简单 Agent 任务上表现相当。适合高吞吐量、成本敏感场景,如快速代码实现、指令遵循和结构化任务执行。模态以文本为主,支持 OpenAI Chat Completions 兼容接口。通过 OpenRouter 等网关访问,具体定价与可用性以厂商/网关为准。模型于 2026 年 4 月发布预览,强调低延迟与高性价比,适合实时应用与批量处理。
DeepSeek V4 系列高效 MoE 模型,284B 总/13B 激活参数,1M 上下文,专注快速推理与编码。

DeepSeek
DeepSeek · 知识库 159 模 / 31 族
DeepSeek V4 系列高效 MoE 模型,284B 总/13B 激活参数,1M 上下文,专注快速推理与编码。
DeepSeek V4 Flash 是 DeepSeek-V4 系列的效率优化版 Mixture-of-Experts 模型,总参数 284B、激活参数 13B,支持 1M token 上下文窗口。模型采用混合注意力机制,优化长上下文处理,推理能力接近 V4-Pro,在简单 Agent 任务上表现相当。适合高吞吐量、成本敏感场景,如快速代码实现、指令遵循和结构化任务执行。模态以文本为主,支持 OpenAI Chat Completions 兼容接口。通过 OpenRouter 等网关访问,具体定价与可用性以厂商/网关为准。模型于 2026 年 4 月发布预览,强调低延迟与高性价比,适合实时应用与批量处理。
DeepSeek 是中国 AI 公司深度求索推出的模型家族,以混合专家(MoE)架构为核心,提供高性能且成本低廉的开源大模型。当前主力包括 V4-Pro(超大规模 MoE)、V4-Flash(高效版)、R1 推理系列及 V3 基座,上下文窗口已扩展至百万级 token,适合处理大型代码库、长文档分析与复杂推理。模型在数学、编程、逻辑推理基准上表现突出,支持中英双语,权重开放便于本地部署与微调。适用场景涵盖软件开发、学术研究、Agent 构建与高吞吐 API 服务。边界在于:对中文敏感话题存在内容限制;多模态能力(VL/OCR)为独立子系列,非主力;作为 LLM 仍可能出现幻觉或事实偏差,复杂开放域任务建议结合工具验证。整体定位为技术向高性价比选择,而非全能闭源前沿模型。
DeepSeek 开源/API 模型系列,强调推理与性价比。
DeepSeek V4 Flash is an efficiency-optimized Mixture-of-Experts model from DeepSeek with 284B total parameters and 13B activated parameters, supporting a 1M-token context window. It is designed for fast inference and...
- DeepSeek V4 系列高效 MoE 模型,284B 总/13B 激活参数,1M 上下文,专注快速推理与编码。
- 高性价比开源 MoE 模型家族,专注推理、代码与数学任务
- 归并版本 13 个
- V4 Flash 版本,284B 总参数(13B 激活),MoE 架构,1M 上下文窗口。
- DeepSeek 家族从早期 Coder 与 V2 起步,V3 推出 671B MoE 基座奠定通用与效率基础;R1 系列通过强化学习强化推理链条,在数学编码基准接近 o1 水平;2026 年 V4 系列(Flash 与 Pro)进一步升级
适用场景
- 代码生成与软件工程
- 数学与逻辑推理
- 长上下文文档分析
- Agent 工具调用与工作流
能力 / 优势
- MoE 架构实现低激活参数高性能
- 开源权重与 API 低价部署
- 百万级上下文与强代码/数学能力
边界 / 不适合
- 中文敏感话题内容限制
- 非原生多模态主力,幻觉风险同其他 LLM
接入提示:支持 OpenAI Chat Completions 兼容接口,通过 OpenRouter 网关使用短 ID deepseek/deepseek-v4-flash。
常见问题
模型参数量与上下文如何?
总参数 284B,激活 13B,支持 1M token 上下文。
适合哪些主要场景?
快速编码、简单 Agent 执行、高吞吐量任务,复杂规划建议用 Pro 版。
历史版本 / 相关变体
| 版本 | 模型 | 参数 | 来源 | 说明 |
|---|---|---|---|---|
| 3.2 | DeepSeek V3.2 deepseek/deepseek-v3.2 | — | OpenRouter | |
| 3.2 | DeepSeek V3.2 Exp deepseek/deepseek-v3.2-exp | — | OpenRouter | |
| 3.1 | DeepSeek V3.1 Terminus deepseek/deepseek-v3.1-terminus | — | OpenRouter | |
| 3.1 | DeepSeek V3.1 deepseek/deepseek-chat-v3.1 | — | OpenRouter | |
| — | DeepSeek V4 Flash Latest ~deepseek/deepseek-v4-flash-latest | — | OpenRouter | |
| — | DeepSeek V4 Flash 0731 deepseek/deepseek-v4-flash-0731 | — | OpenRouter | |
| — | DeepSeek V4 Pro deepseek/deepseek-v4-pro | — | OpenRouter | |
| —当前 | DeepSeek V4 Flash 0423 deepseek/deepseek-v4-flash | — | OpenRouter | |
| — | R1 0528 deepseek/deepseek-r1-0528 | — | OpenRouter | |
| — | DeepSeek V3 0324 deepseek/deepseek-chat-v3-0324 | — | OpenRouter | |
| — | R1 Distill Llama 70B deepseek/deepseek-r1-distill-llama-70b | 70B | OpenRouter | |
| — | R1 deepseek/deepseek-r1 | — | OpenRouter | |
| — | DeepSeek V3 deepseek/deepseek-chat | — | OpenRouter |
定价与限制
| 输入 | $0.140 / 百万 tokens |
| 输出 | $0.280 / 百万 tokens |
| 缓存读 / 写 | $0.028 / — |
| 最大输出 | 393k |
| 输入模态 | text |
| 输出模态 | text |
| HF | deepseek-ai/DeepSeek-V4-Flash |
支持参数
价格与基准分优先同步自 OpenRouter;网关短 ID 由本站平台清单补全,介绍/历史版本融合 Hugging Face 检索与家族知识库。能力验真请用 bench_v1 实验室 · OCR 天梯。
关于本页实体
DeepSeek V4 Flash 0423:怎么用本页做决策
DeepSeek V4 Flash 0423 模型页汇总价格、上下文与能力线索,并与天梯/排行联动。
深度解读见相关指南;跑分与挂价会更新,请以当日快照为准。
相关指南
- 2026 本地部署 DeepSeek-R1 蒸馏版与 Qwen2.5 天梯:7B-32B GPU 算力账本与 vLLM/SGLang 实战 — 针对 DeepSeek-R1-Distill-Qwen 系列 7B 到 32B 模型,提供从单卡 RTX 4090 到 8卡 H20 的完整本地部署指南、量化策
- 2026 模型天梯实测:DeepSeek R1、Qwen3、Grok 4、Claude Opus 5 工程选型指南 — 基于最新基准与真实 API 延迟、成本、编码/推理表现,构建 2026 年中转与本地混合部署的模型天梯。包含量化对比表、场景推荐及避坑清单,帮助开发者快速定位最
- 2026 AI 模型天梯实测:Claude Opus 5 vs Grok 4.5 vs Qwen3 vs DeepSeek R1 选型指南 — 基于最新 LMSYS、Artificial Analysis 和本地基准,深度对比 2026 当前主流闭源与开源模型在编码、推理、速度、价格四维度的真实表现,提
- 2026 本地 LLM VRAM 天梯:从 8GB 到 80GB+ 最佳开源模型匹配指南 — 基于 2026 年最新开源模型(如 Qwen3、DeepSeek V4、GLM-5.2)与 RTX 50 系列、消费级 GPU 实测,构建完整 VRAM 消耗天
- 2026 本地部署实战:vLLM + Ollama 运行 Qwen3-32B 与 DeepSeek-R1 硬件选型与优化指南 — 从 RTX 4090 单卡到多卡机房集群,详解 2026 年主流开源模型(Qwen3、DeepSeek、Llama 4)的 GGUF 量化、vLLM 推理加速、
- 2026 本地部署实用 LLM 天梯:7B-70B 模型选型与量化实测 — 基于最新开源模型基准,详解 Gemma 4、Qwen3、DeepSeek-V4 等在消费级 GPU 和服务器上的本地运行方案、VRAM 需求、量化策略及推理速度
- 2026 本地大模型推理框架天梯实测:vLLM vs Ollama vs SGLang 吞吐量与显存账 — 基于 2026 年最新开源模型(如 Qwen2.5、DeepSeek-R1)在消费级与企业级 GPU 上的基准测试,详细对比 vLLM、Ollama、SGLan
- 2026 GPU 服务器算力选型指南:DeepSeek/Qwen 本地部署从 7B 到 70B 避坑全攻略 — 深入解析 2026 年企业与个人 AI 算力需求,从单卡工作站到多卡机房配置,提供 DeepSeek、Qwen 等模型的显存/功耗/性价比计算公式、采购清单与部
常见问题
- DeepSeek V4 Flash 0423 的价格与能力数据从哪来?
- 公开目录、官方价表与本站监测/天梯快照。账单以官方或供应商当日为准。
主题柱
slug:deepseek/deepseek-v4-flash · 主题柱讲方法,实时数字以本页表格为准
站内推荐
同系工具:Clavue CLI / imux IDE / clavue-2.1
Clavue · CLI 与 Agent 平台
CLI / GUI Agent 运行时、设备登录、会员额度与 OpenAI 兼容 API(api.clavue.com)。开发脚本、CI 与本地工具一条链路。
打开 Clavue ↗imux · 原生 macOS AI IDE
Clavue 平台的原生 IDE:多 Agent 分屏、Ghostty 级终端、Agent Chat、浏览器自动化与 Supervisor——不是又一个 Electron 壳。
了解 imux ↗Clavue 2.1 · 产品级大模型
旗舰模型 clavue-2.1(及 fast / pro / rev):适合复杂推理与长程 Agent 循环。Chat、imux、API 共用会员额度。
查看模型 ↗