同步自 OpenRouter · 400 个模型 · source=openrouter · 2026-08-10T01:41:09.836Z
Step 3.7 Flash
stepfun/step-3.7-flash
Step 3.7 Flash 是 StepFun 推出的高效率多模态 MoE 模型,总参数 198B(196B 语言骨干 + 1.8B ViT 视觉编码器),每 token 激活约 11B 参数。支持原生图像和视频理解,上下文窗口达 256K,支持可调节推理级别(高/中/低)。专为真实世界 Agent 工作流设计,包括工具调用、迭代推理、编码代理、多步搜索与多模态文档/UI/图表分析。吞吐量高达 400 TPS,适合高吞吐生产环境。适用于编码、结构化输出和长上下文生产力任务。以厂商/网关为准。
高效率198B MoE多模态模型,专为Agent、编码与视觉理解优化。
step-3.7-flash
StepFun · 知识库 159 模 / 31 族
高效率198B MoE多模态模型,专为Agent、编码与视觉理解优化。
Step 3.7 Flash 是 StepFun 推出的高效率多模态 MoE 模型,总参数 198B(196B 语言骨干 + 1.8B ViT 视觉编码器),每 token 激活约 11B 参数。支持原生图像和视频理解,上下文窗口达 256K,支持可调节推理级别(高/中/低)。专为真实世界 Agent 工作流设计,包括工具调用、迭代推理、编码代理、多步搜索与多模态文档/UI/图表分析。吞吐量高达 400 TPS,适合高吞吐生产环境。适用于编码、结构化输出和长上下文生产力任务。以厂商/网关为准。
Step 3.7 Flash is StepFun's latest high-efficiency multimodal Mixture-of-Experts model. It pairs a 196B-parameter language backbone with a vision encoder for native image and video understanding, activating roughly 11B parameters...
- 高效率198B MoE多模态模型,专为Agent、编码与视觉理解优化。
- 当前版本线 3.7
- 归并版本 1 个
- 198B 稀疏 MoE(激活 ~11B),Step 3.7 Flash 版本,基于 Step 3.5 Flash 升级新增视觉能力。
适用场景
- Agent 与编码工作流
- 多模态文档/UI/图表分析
- 多步搜索与验证
- 高吞吐生产代理
能力 / 优势
- 原生多模态理解与行动
- Agentic 工具调用与多步迭代
- 高吞吐编码与结构化推理
- 长上下文与视觉搜索增强
- 可调节推理深度
边界 / 不适合
- 纯文本简单问答
- 非多模态通用任务
接入提示:OpenAI 兼容 API;OpenRouter 短 ID stepfun/step-3.7-flash;支持 reasoning levels;测速与 Playground 见 OpenRouter 页面;官方平台 platform.stepfun.ai
常见问题
上下文长度是多少?
支持 256K tokens 上下文窗口。
是否支持图像输入?
是的,支持原生图像和视频理解。
推理级别如何使用?
支持 high/medium/low 可调节推理深度,平衡速度与效果。
历史版本 / 相关变体
| 版本 | 模型 | 参数 | 来源 | 说明 |
|---|---|---|---|---|
| 3.7当前 | Step 3.7 Flash stepfun/step-3.7-flash | — | OpenRouter |
定价与限制
| 输入 | $0.200 / 百万 tokens |
| 输出 | $1.15 / 百万 tokens |
| 缓存读 / 写 | $0.040 / — |
| 最大输出 | 256k |
| 输入模态 | text, image, video |
| 输出模态 | text |
| HF | stepfun-ai/Step-3.7-Flash |
支持参数
价格与基准分优先同步自 OpenRouter;网关短 ID 由本站平台清单补全,介绍/历史版本融合 Hugging Face 检索与家族知识库。能力验真请用 bench_v1 实验室 · OCR 天梯。
关于本页实体
Step 3.7 Flash:怎么用本页做决策
Step 3.7 Flash 模型页汇总价格、上下文与能力线索,并与天梯/排行联动。
深度解读见相关指南;跑分与挂价会更新,请以当日快照为准。
相关指南
- 2026 Grok 编码模型天梯:性价比与选型实战榜 — 聚焦Grok Build 0.1编码代理天梯,实测多场景性价比、上下文长度与工具调用稳定性;对比主流模型,提供工程选型清单与硬件适配建议。
- 2026 GrokCode vLLM 本地部署生产清单:并发、显存、量化与模型天梯实战 — vLLM本地部署生产级配置全指南,聚焦并发处理能力、显存优化、量化策略与编码模型天梯性价比对比。结合GrokCode实验室实测数据,提供工程可核验的硬件搭配方案
- Grok / xAI 模型天梯在 vLLM 本地部署的性价比排行榜 — 2026年 GrokCode 模型天梯在 vLLM 本地部署场景下的编码模型排行榜,覆盖 70B 级 TCO 实测、量化策略与业务选型路径。
- 本地部署 70B 模型天梯:TCO 实测与电费卡费量化 — GrokCode 针对 70B 级别本地部署的算力账单化方案,涵盖电费、硬件卡费、量化策略实测数据与 vLLM 生产清单,助力模型天梯性价比选型。
- 编码模型天梯怎么读:Grok 4.5 性价比榜与业务选型实战 — 2026 年最新 Grok 4.5 / Grok 4.20 编码模型天梯拆解:BenchAlign v5、LM Arena、HighWalk 实测数据 + 与
- 2026 模型天梯实测:DeepSeek R1、Qwen3、Grok 4、Claude Opus 5 工程选型指南 — 基于最新基准与真实 API 延迟、成本、编码/推理表现,构建 2026 年中转与本地混合部署的模型天梯。包含量化对比表、场景推荐及避坑清单,帮助开发者快速定位最
- 2026 本地推理模型天梯:7B-70B GPU 量化部署与 TCO 实测指南 — 基于 2026 年最新开源模型基准,构建从 4B 到 70B 参数的本地部署天梯。包含 RTX 5090/4090 实测吞吐、4bit/8bit 量化策略、vL
- 编码模型天梯怎么读:性价比榜与业务选型 — GrokCode 品牌专题:编码模型天梯怎么读:性价比榜与业务选型。 锚点:天梯。
常见问题
- Step 3.7 Flash 的价格与能力数据从哪来?
- 公开目录、官方价表与本站监测/天梯快照。账单以官方或供应商当日为准。
主题柱
slug:stepfun/step-3.7-flash · 主题柱讲方法,实时数字以本页表格为准
站内推荐
同系工具:Clavue CLI / imux IDE / clavue-2.1
Clavue · CLI 与 Agent 平台
CLI / GUI Agent 运行时、设备登录、会员额度与 OpenAI 兼容 API(api.clavue.com)。开发脚本、CI 与本地工具一条链路。
打开 Clavue ↗imux · 原生 macOS AI IDE
Clavue 平台的原生 IDE:多 Agent 分屏、Ghostty 级终端、Agent Chat、浏览器自动化与 Supervisor——不是又一个 Electron 壳。
了解 imux ↗Clavue 2.1 · 产品级大模型
旗舰模型 clavue-2.1(及 fast / pro / rev):适合复杂推理与长程 Agent 循环。Chat、imux、API 共用会员额度。
查看模型 ↗