olmo2
OLMo 2 is a new family of 7B and 13B models trained on up to 5T tokens. These models are on par with or better than equivalently sized fully open models, and competitive with open-weight models such as Llama 3.1 on English academic benchmarks.
许可 unknownQ4 ~4GB舒适 8GB3–9B 入门档本地优先
部署预估(启发式)
默认推荐卡 RTX 4060 8GB · 量化 Q4 · ctx 8k · 并发 1
适配偏紧
需 / 有效显存7.4/8G
吞吐 tok/s~26.5
引擎Ollama / llama.cpp / llama-server
推荐:ollama → llamacpp,量化 Q4,先单流压测再开并发。
下载与部署入口
一键本地拉取
ollama run olmo2
参数7b/13b
默认量化Q4
默认上下文8K
发布—
推荐引擎
- Ollama(上手最快)
- llama.cpp / llama-server
标签:对话 · 家族 Other open:Command-R、Solar、RWKV、MiniCPM 等。
同家族
- GPT-OSS 20B · 20B · Q4~12GB
- gpt-oss · ~7B · Q4~4GB
- aya · ~7B · Q4~4GB
- cogito · ~7B · Q4~4GB
- command-r · ~7B · Q4~4GB
- deepscaler · 1.5b · Q4~4GB
Related tools
Clavue CLI / imux IDE / clavue-2.1
Clavue · CLI 与 Agent 平台
CLI / GUI Agent 运行时、设备登录、会员额度与 OpenAI 兼容 API(api.clavue.com)。开发脚本、CI 与本地工具一条链路。
打开 Clavue ↗imux · 原生 macOS AI IDE
Clavue 平台的原生 IDE:多 Agent 分屏、Ghostty 级终端、Agent Chat、浏览器自动化与 Supervisor——不是又一个 Electron 壳。
了解 imux ↗Clavue 2.1 · 产品级大模型
旗舰模型 clavue-2.1(及 fast / pro / rev):适合复杂推理与长程 Agent 循环。Chat、imux、API 共用会员额度。
查看模型 ↗