同步自 OpenRouter · 400 个模型 · source=openrouter · 2026-08-10T01:43:50.656Z
Kimi K3
moonshotai/kimi-k3
Moonshot AI发布的Kimi K3是目前最强开源权重模型,参数量达2.8万亿,采用MoE架构(896专家中16个激活),原生支持视觉理解与文本输入输出。具备100万token上下文窗口,基于Kimi Delta Attention (KDA)和Attention Residuals架构优化长序列效率,专为长程编码、大型仓库导航、工具调用、调试迭代及深度推理设计。适合复杂知识工作、多模态Agent工作流,在编码基准和Agent任务上表现突出。实际性能以厂商及OpenRouter网关为准,支持OpenAI兼容接口调用。
2.8T原生多模态Agentic旗舰,1M上下文强长程编码推理

Kimi / Moonshot
Moonshot AI · 知识库 159 模 / 31 族
2.8T原生多模态Agentic旗舰,1M上下文强长程编码推理
Moonshot AI发布的Kimi K3是目前最强开源权重模型,参数量达2.8万亿,采用MoE架构(896专家中16个激活),原生支持视觉理解与文本输入输出。具备100万token上下文窗口,基于Kimi Delta Attention (KDA)和Attention Residuals架构优化长序列效率,专为长程编码、大型仓库导航、工具调用、调试迭代及深度推理设计。适合复杂知识工作、多模态Agent工作流,在编码基准和Agent任务上表现突出。实际性能以厂商及OpenRouter网关为准,支持OpenAI兼容接口调用。
月之暗面 Kimi 系列,以长上下文与 Agent 能力见长。
Kimi K3 is a 2.8T parameter open-weight multimodal reasoning model from Moonshot AI. It is suited for complex coding, knowledge work, and long-horizon agentic workflows, and is particularly strong at...
- 2.8T原生多模态Agentic旗舰,1M上下文强长程编码推理
- 归并版本 9 个
- K3版本,2.8T MoE(16/896专家激活),2026年7月发布
适用场景
- 长程编码与仓库导航
- 多模态Agent代理任务
- 大型知识工作与推理
- 工具迭代调试
能力 / 优势
- 长上下文处理
- 原生多模态视觉
- 复杂编码与调试
- Agentic工具调用
- 深度推理与知识工作
边界 / 不适合
- 轻量快速查询
- 资源受限本地部署
接入提示:OpenAI兼容API,OpenRouter短ID moonshotai/kimi-k3,测速入口见OpenRouter平台
常见问题
Kimi K3上下文长度是多少?
支持1,048,576 token上下文窗口,适合长文档与代码库处理。
是否开源权重?
是,提供开放权重(Hugging Face moonshotai/Kimi-K3),但自托管需极高算力。
主要适用场景?
长程编码、Agent工作流、多模态推理与知识工作,以厂商/网关为准。
历史版本 / 相关变体
| 版本 | 模型 | 参数 | 来源 | 说明 |
|---|---|---|---|---|
| —当前 | Kimi K3 moonshotai/kimi-k3 | — | OpenRouter | |
| — | Kimi K2.7 Code moonshotai/kimi-k2.7-code | — | OpenRouter | |
| — | Kimi K2.7 Code (batch) moonshotai/kimi-k2.7-code:batch | — | OpenRouter | |
| — | MoonshotAI Kimi Latest ~moonshotai/kimi-latest | — | OpenRouter | |
| — | Kimi K2.6 moonshotai/kimi-k2.6 | — | OpenRouter | |
| — | Kimi K2.5 moonshotai/kimi-k2.5 | — | OpenRouter | |
| — | Kimi K2 Thinking moonshotai/kimi-k2-thinking | — | OpenRouter | |
| — | Kimi K2 0905 moonshotai/kimi-k2-0905 | — | OpenRouter | |
| — | Kimi K2 0711 moonshotai/kimi-k2 | — | OpenRouter |
定价与限制
| 输入 | $3.00 / 百万 tokens |
| 输出 | $15.0 / 百万 tokens |
| 缓存读 / 写 | $0.300 / — |
| 最大输出 | — |
| 输入模态 | text, image |
| 输出模态 | text |
| HF | moonshotai/Kimi-K3 |
支持参数
价格与基准分优先同步自 OpenRouter;网关短 ID 由本站平台清单补全,介绍/历史版本融合 Hugging Face 检索与家族知识库。能力验真请用 bench_v1 实验室 · OCR 天梯。
关于本页实体
Kimi K3:怎么用本页做决策
Kimi K3: live quotes and risk signals on GrokCode. Aggregation only — not a storefront.
Use related guides for methodology; use the tables above for numbers that change hourly.
相关指南
- 2026 最新模型天梯实测:Claude Opus 5、GPT-5.6 Sol、Grok-3 与 Kimi K3 路由策略 — 基于 SWE-Bench、ARC-AGI 与长上下文 Agent 任务的跨模型基准对比,结合价格、上下文长度与本地/云部署可行性,提供 2026 年最优路由决策
- 2026 Grok 编码模型天梯:性价比与选型实战榜 — 聚焦Grok Build 0.1编码代理天梯,实测多场景性价比、上下文长度与工具调用稳定性;对比主流模型,提供工程选型清单与硬件适配建议。
- 2026 GrokCode vLLM 本地部署生产清单:并发、显存、量化与模型天梯实战 — vLLM本地部署生产级配置全指南,聚焦并发处理能力、显存优化、量化策略与编码模型天梯性价比对比。结合GrokCode实验室实测数据,提供工程可核验的硬件搭配方案
- Grok / xAI 模型天梯在 vLLM 本地部署的性价比排行榜 — 2026年 GrokCode 模型天梯在 vLLM 本地部署场景下的编码模型排行榜,覆盖 70B 级 TCO 实测、量化策略与业务选型路径。
- 本地部署 70B 模型天梯:TCO 实测与电费卡费量化 — GrokCode 针对 70B 级别本地部署的算力账单化方案,涵盖电费、硬件卡费、量化策略实测数据与 vLLM 生产清单,助力模型天梯性价比选型。
- 编码模型天梯怎么读:Grok 4.5 性价比榜与业务选型实战 — 2026 年最新 Grok 4.5 / Grok 4.20 编码模型天梯拆解:BenchAlign v5、LM Arena、HighWalk 实测数据 + 与
- Ollama 到 vLLM 生产升级:硬件门槛与推理性能天梯 — 本地部署模型天梯实测:Ollama 原型 vs vLLM 生产,显存量化与并发实测
- Qwen 2.5 本地部署 vLLM 实战:硬件配置与推理速度天梯 — Qwen 系列模型通过 vLLM 本地部署的硬件档位选择、量化策略与实际推理速度对比,助力开发者快速进入模型天梯实验室。
常见问题
- Where do Kimi K3 prices come from?
- From public catalogs and lab snapshots. Prefer official pages for final billing truth.
主题柱
slug:moonshotai/kimi-k3 · 主题柱讲方法,实时数字以本页表格为准
関連ツール
Clavue CLI / imux IDE / clavue-2.1
Clavue · CLI 与 Agent 平台
CLI / GUI Agent 运行时、设备登录、会员额度与 OpenAI 兼容 API(api.clavue.com)。开发脚本、CI 与本地工具一条链路。
打开 Clavue ↗imux · 原生 macOS AI IDE
Clavue 平台的原生 IDE:多 Agent 分屏、Ghostty 级终端、Agent Chat、浏览器自动化与 Supervisor——不是又一个 Electron 壳。
了解 imux ↗Clavue 2.1 · 产品级大模型
旗舰模型 clavue-2.1(及 fast / pro / rev):适合复杂推理与长程 Agent 循环。Chat、imux、API 共用会员额度。
查看模型 ↗