同步自 OpenRouter · 400 个模型 · source=openrouter · 2026-08-10T01:43:30.641Z
Ling-2.6-flash
inclusionai/ling-2.6-flash
Ling-2.6-flash 是 inclusionAI 推出的即时 instruct 模型,采用 MoE 架构,拥有 104B 总参数与 7.4B 激活参数。它专为真实世界代理设计,强调快速响应、强执行力与高 token 效率,在编码、文档处理和轻量级代理工作流中表现优异,性能可媲美同规模 SOTA 模型,同时显著降低 token 消耗。支持 262K 上下文窗口,适合代码补全调试、快速文档分析及 prompt caching 等场景。模型已开源至 Hugging Face,2026 年 4 月发布。以厂商/网关为准。
104B MoE指令模型,专注快速代理、代码与高效token使用
ling-2.6-flash
inclusionAI · 知识库 159 模 / 31 族
104B MoE指令模型,专注快速代理、代码与高效token使用
Ling-2.6-flash 是 inclusionAI 推出的即时 instruct 模型,采用 MoE 架构,拥有 104B 总参数与 7.4B 激活参数。它专为真实世界代理设计,强调快速响应、强执行力与高 token 效率,在编码、文档处理和轻量级代理工作流中表现优异,性能可媲美同规模 SOTA 模型,同时显著降低 token 消耗。支持 262K 上下文窗口,适合代码补全调试、快速文档分析及 prompt caching 等场景。模型已开源至 Hugging Face,2026 年 4 月发布。以厂商/网关为准。
Ling-2.6-flash is an instant (instruct) model from inclusionAI with 104B total parameters and 7.4B active parameters, designed for real-world agents that require fast responses, strong execution, and high token efficiency....
- 104B MoE指令模型,专注快速代理、代码与高效token使用
- 当前版本线 2.6
- 归并版本 1 个
- 104B 总参数、7.4B 激活参数的 MoE instruct 模型,Ling-2.6 系列 flash 变体,2026 年 4 月发布
适用场景
- 代码补全与调试
- 文档处理与分析
- 轻量级代理任务
- 高效 token 使用场景
能力 / 优势
- 快速响应与执行
- 代码生成与调试
- 文档处理
- 轻量级 Agent 工作流
- 函数调用与结构化输出
边界 / 不适合
- 复杂多步长链推理
- 多模态输入输出
接入提示:OpenAI 兼容 API,OpenRouter 网关短 ID: inclusionai/ling-2.6-flash,支持 prompt caching,测速入口参考 OpenRouter 平台
常见问题
Ling-2.6-flash 的上下文长度是多少?
支持 262K tokens 上下文。
该模型主要适合哪些使用场景?
快速代理、代码补全调试、文档处理和轻量级 Agent 工作流。
历史版本 / 相关变体
| 版本 | 模型 | 参数 | 来源 | 说明 |
|---|---|---|---|---|
| 2.6当前 | Ling-2.6-flash inclusionai/ling-2.6-flash | — | OpenRouter |
定价与限制
| 输入 | $0.010 / 百万 tokens |
| 输出 | $0.030 / 百万 tokens |
| 缓存读 / 写 | $0.0020 / — |
| 最大输出 | 33k |
| 输入模态 | text |
| 输出模态 | text |
| HF | — |
支持参数
价格与基准分优先同步自 OpenRouter;网关短 ID 由本站平台清单补全,介绍/历史版本融合 Hugging Face 检索与家族知识库。能力验真请用 bench_v1 实验室 · OCR 天梯。
关于本页实体
Ling-2.6-flash:怎么用本页做决策
Ling-2.6-flash 模型页汇总价格、上下文与能力线索,并与天梯/排行联动。
深度解读见相关指南;跑分与挂价会更新,请以当日快照为准。
相关指南
- 2026 Grok 编码模型天梯:性价比与选型实战榜 — 聚焦Grok Build 0.1编码代理天梯,实测多场景性价比、上下文长度与工具调用稳定性;对比主流模型,提供工程选型清单与硬件适配建议。
- 2026 GrokCode vLLM 本地部署生产清单:并发、显存、量化与模型天梯实战 — vLLM本地部署生产级配置全指南,聚焦并发处理能力、显存优化、量化策略与编码模型天梯性价比对比。结合GrokCode实验室实测数据,提供工程可核验的硬件搭配方案
- Grok / xAI 模型天梯在 vLLM 本地部署的性价比排行榜 — 2026年 GrokCode 模型天梯在 vLLM 本地部署场景下的编码模型排行榜,覆盖 70B 级 TCO 实测、量化策略与业务选型路径。
- 本地部署 70B 模型天梯:TCO 实测与电费卡费量化 — GrokCode 针对 70B 级别本地部署的算力账单化方案,涵盖电费、硬件卡费、量化策略实测数据与 vLLM 生产清单,助力模型天梯性价比选型。
- 编码模型天梯怎么读:Grok 4.5 性价比榜与业务选型实战 — 2026 年最新 Grok 4.5 / Grok 4.20 编码模型天梯拆解:BenchAlign v5、LM Arena、HighWalk 实测数据 + 与
- 2026 模型天梯实测:DeepSeek R1、Qwen3、Grok 4、Claude Opus 5 工程选型指南 — 基于最新基准与真实 API 延迟、成本、编码/推理表现,构建 2026 年中转与本地混合部署的模型天梯。包含量化对比表、场景推荐及避坑清单,帮助开发者快速定位最
- 2026 本地推理模型天梯:7B-70B GPU 量化部署与 TCO 实测指南 — 基于 2026 年最新开源模型基准,构建从 4B 到 70B 参数的本地部署天梯。包含 RTX 5090/4090 实测吞吐、4bit/8bit 量化策略、vL
- 编码模型天梯怎么读:性价比榜与业务选型 — GrokCode 品牌专题:编码模型天梯怎么读:性价比榜与业务选型。 锚点:天梯。
常见问题
- Ling-2.6-flash 的价格与能力数据从哪来?
- 公开目录、官方价表与本站监测/天梯快照。账单以官方或供应商当日为准。
主题柱
slug:inclusionai/ling-2.6-flash · 主题柱讲方法,实时数字以本页表格为准
站内推荐
同系工具:Clavue CLI / imux IDE / clavue-2.1
Clavue · CLI 与 Agent 平台
CLI / GUI Agent 运行时、设备登录、会员额度与 OpenAI 兼容 API(api.clavue.com)。开发脚本、CI 与本地工具一条链路。
打开 Clavue ↗imux · 原生 macOS AI IDE
Clavue 平台的原生 IDE:多 Agent 分屏、Ghostty 级终端、Agent Chat、浏览器自动化与 Supervisor——不是又一个 Electron 壳。
了解 imux ↗Clavue 2.1 · 产品级大模型
旗舰模型 clavue-2.1(及 fast / pro / rev):适合复杂推理与长程 Agent 循环。Chat、imux、API 共用会员额度。
查看模型 ↗