Community · 7b/13b

olmo2

OLMo 2 is a new family of 7B and 13B models trained on up to 5T tokens. These models are on par with or better than equivalently sized fully open models, and competitive with open-weight models such as Llama 3.1 on English academic benchmarks.

许可 unknownQ4 ~4GB舒适 8GB3–9B 入门档本地优先

部署预估(启发式)

默认推荐卡 RTX 4060 8GB · 量化 Q4 · ctx 8k · 并发 1

适配偏紧
需 / 有效显存7.4/8G
吞吐 tok/s~26.5
引擎Ollama / llama.cpp / llama-server

推荐:ollama → llamacpp,量化 Q4,先单流压测再开并发。

下载与部署入口

一键本地拉取

ollama run olmo2
参数7b/13b
默认量化Q4
默认上下文8K
发布

推荐引擎

  • Ollama(上手最快)
  • llama.cpp / llama-server

标签:对话 · 家族 Other openCommand-R、Solar、RWKV、MiniCPM 等。

入门阅读:本地部署 · 显存对照 · 量化

同家族

olmo2 · 开源下载与本地部署 · GrokCode 倍率榜