Open Models · Local Deploy

全球开源模型频道

策展 + Ollama Library 全量 + HF GGUF 热门 合并目录:参数/显存、许可、 Hugging Face / GGUF / Ollama / ModelScope 下载,并跳转 本地算力计算器 。HF 全库十万+——本频道做可跑清单、深链与算力账,不镜像权重。 同步于 2026-08-03T07:33:50Z

合并总量325
策展精选42
同步条数303
本地优先318
含 Ollama238
含 HF/GGUF192

全库入口(全球)

要「全部开源」请用下列权威源检索;本站策展负责选型 + 部署路径 + 算力账

按家族

我的显卡一键筛:

匹配 26 · 展示 26 · 点「设为 A/B」后底部一键对比 · 本站不托管权重

llama3.2

Meta · 1b/3b · unknown · 本地优先 · ollama-library · 79M pulls

Q4 ~4GB舒适 8GB

Meta's Llama 3.2 goes small with 1B and 3B models.

Agent对话
ollama run llama3.2
llama3

Meta · ~7B · unknown · 本地优先 · ollama-library · 25M pulls

Q4 ~4GB舒适 8GB

Meta Llama 3: The most capable openly available LLM to date

对话
ollama run llama3
codellama

Meta · ~7B · unknown · 本地优先 · ollama-library · 5.9M pulls

Q4 ~4GB舒适 8GB

A large language model that can use text prompts to generate and discuss code.

代码对话
ollama run codellama
llama2

Meta · 7b/70b · unknown · 本地优先 · ollama-library · 7.3M pulls

Q4 ~4GB舒适 8GB

Llama 2 is a collection of foundation language models ranging from 7B to 70B parameters.

对话
ollama run llama2
tinyllama

Meta · 1.1b · unknown · 本地优先 · ollama-library · 5.3M pulls

Q4 ~4GB舒适 8GB

The TinyLlama project is an open endeavor to train a compact 1.1B Llama model on 3 trillion tokens.

对话
ollama run tinyllama
dolphin-llama3

Meta · 8b/70b · unknown · 本地优先 · ollama-library · 2.0M pulls

Q4 ~4.4GB舒适 8.8GB

Dolphin 2.9 is a new model with 8B and 70B sizes by Eric Hartford based on Llama 3 that has a variety of instruction, conversational, and coding skills.

代码对话
ollama run dolphin-llama3
llama-guard3

Meta · ~7B · unknown · 本地优先 · ollama-library · 1.0M pulls

Q4 ~4GB舒适 8GB

Llama Guard 3 is a series of models fine-tuned for content safety classification of LLM inputs and responses.

对话
ollama run llama-guard3
llama2-chinese

Meta · ~7B · unknown · 本地优先 · ollama-library · 1.0M pulls

Q4 ~4GB舒适 8GB

Llama 2 based model fine tuned to improve Chinese dialogue ability.

对话
ollama run llama2-chinese
llama2-uncensored

Meta · ~7B · unknown · 本地优先 · ollama-library · 2.7M pulls

Q4 ~4GB舒适 8GB

Uncensored Llama 2 model by George Sung and Jarrad Hope.

对话
ollama run llama2-uncensored
llama3-chatqa

Meta · ~7B · unknown · 本地优先 · ollama-library · 1.0M pulls

Q4 ~4GB舒适 8GB

A model from NVIDIA based on Llama 3 that excels at conversational question answering (QA) and retrieval-augmented generation (RAG).

对话
ollama run llama3-chatqa
llama3.2-vision

Meta · 11b/90b · unknown · 本地优先 · ollama-library · 4.9M pulls

Q4 ~49GB舒适 84GB

Llama 3.2 Vision is a collection of instruction-tuned image reasoning generative models in 11B and 90B sizes.

视觉推理对话
ollama run llama3.2-vision
llama4

Meta · ~7B · unknown · 本地优先 · ollama-library · 1.8M pulls

Q4 ~6GB舒适 12GB

Meta's latest collection of multimodal models.

视觉Agent对话
ollama run llama4
llava-llama3

Meta · ~7B · unknown · 本地优先 · ollama-library · 2.3M pulls

Q4 ~6GB舒适 12GB

A LLaVA model fine-tuned from Llama 3 Instruct with better scores in several benchmarks.

视觉对话
ollama run llava-llama3
llama-pro

Meta · ~7B · unknown · 本地优先 · ollama-library · 887K pulls

Q4 ~4GB舒适 8GB

An expansion of Llama 2 that specializes in integrating both general language understanding and domain-specific knowledge, particularly in programming and mathematics.

数学对话
ollama run llama-pro
llama3-gradient

Meta · 8b · unknown · 本地优先 · ollama-library · 979K pulls

Q4 ~4.4GB舒适 8.8GB

This model extends LLama-3 8B's context length from 8k to over 1m tokens.

对话
ollama run llama3-gradient
llama3-groq-tool-use

Meta · ~7B · unknown · 本地优先 · ollama-library · 973K pulls

Q4 ~4GB舒适 8GB

A series of models from Groq that represent a significant advancement in open-source AI capabilities for tool use/function calling.

Agent对话
ollama run llama3-groq-tool-use
medllama2

Meta · ~7B · unknown · 本地优先 · ollama-library · 634K pulls

Q4 ~4GB舒适 8GB

Fine-tuned Llama 2 model to answer medical questions based on an open source medical dataset.

对话
ollama run medllama2
yarn-llama2

Meta · ~7B · unknown · 本地优先 · ollama-library · 945K pulls

Q4 ~4GB舒适 8GB

An extension of Llama 2 that supports a context of up to 128k tokens.

对话
ollama run yarn-llama2

与竞品对齐的能力

  • ApX / VRAM 计算器类:本站 /tools/local-deploy 覆盖显存适配、多卡 TP、产出与 vs API 费用。
  • Ollama Library / HF Hub:每条模型直链下载与 ollama run,不二次托管权重。
  • Model Picker(按 GPU 筛模型):列表「显存上限」筛选 + 计算器预填。
  • 价格/中转对照:有 OpenRouter id 的可回 /models · /official-api
Open-source models hub · HF / Ollama / GGUF deploy · GrokCode 倍率榜