同步自 OpenRouter · 400 个模型 · source=openrouter · 2026-08-10T01:43:49.621Z
Gemma 4 26B A4B
google/gemma-4-26b-a4b-it
Google Gemma 4 26B A4B IT 是 Google DeepMind 推出的指令微调 Mixture-of-Experts (MoE) 模型。总参数约 25.2B,推理时仅激活 3.8B 参数,提供接近更大模型的性能,同时降低计算成本。支持文本、图像和视频(最长 60 秒,1fps)多模态输入,上下文窗口达 262K tokens。具备原生函数调用、可配置思考/推理模式以及结构化输出支持。适用于复杂推理、多模态内容理解、Agent 开发等场景。发布于 Apache 2.0 许可下。详细规格以 OpenRouter 及厂商为准。
Google DeepMind MoE 多模态指令模型,26B 总参激活约 3.8B,支持文本/图像/视频与长上下文。
gemma-4-26b-a4b-it
Google · 知识库 159 模 / 31 族
Google DeepMind MoE 多模态指令模型,26B 总参激活约 3.8B,支持文本/图像/视频与长上下文。
Google Gemma 4 26B A4B IT 是 Google DeepMind 推出的指令微调 Mixture-of-Experts (MoE) 模型。总参数约 25.2B,推理时仅激活 3.8B 参数,提供接近更大模型的性能,同时降低计算成本。支持文本、图像和视频(最长 60 秒,1fps)多模态输入,上下文窗口达 262K tokens。具备原生函数调用、可配置思考/推理模式以及结构化输出支持。适用于复杂推理、多模态内容理解、Agent 开发等场景。发布于 Apache 2.0 许可下。详细规格以 OpenRouter 及厂商为准。
Gemma 4 26B A4B IT is an instruction-tuned Mixture-of-Experts (MoE) model from Google DeepMind. Despite 25.2B total parameters, only 3.8B activate per token during inference — delivering near-31B quality at...
- Google DeepMind MoE 多模态指令模型,26B 总参激活约 3.8B,支持文本/图像/视频与长上下文。
- 参数量档位 26B-A4B
- 归并版本 2 个
- 26B A4B 指总参数约 26B(实际 25.2B)、激活参数约 4B(实际 3.8B)的 MoE 架构;IT 表示指令微调版本。
适用场景
- 长上下文多模态任务
- 函数调用与 Agent 开发
- 科学与代码推理
能力 / 优势
- MoE 高效推理
- 多模态输入处理
- 长上下文理解
- 原生函数调用
- 可配置推理模式
- 结构化输出
边界 / 不适合
- 以厂商/网关为准
接入提示:OpenAI 兼容 API,通过 OpenRouter 接入,模型短 ID: google/gemma-4-26b-a4b-it;支持 reasoning 参数启用思考模式。测速入口参考 OpenRouter 文档。
常见问题
什么是 A4B?
A4B 表示激活参数约 4B(实际 3.8B)的 MoE 模型,总参数 25.2B。
支持哪些模态?
文本、图像、视频输入(视频最长 60 秒 1fps)。
上下文长度是多少?
262K tokens。
如何启用推理模式?
通过 reasoning 参数配置思考/推理行为。
历史版本 / 相关变体
| 版本 | 模型 | 参数 | 来源 | 说明 |
|---|---|---|---|---|
| —当前 | Gemma 4 26B A4B google/gemma-4-26b-a4b-it | 26B-A4B | OpenRouter | |
| — | Gemma 4 26B A4B (free) google/gemma-4-26b-a4b-it:free | 26B-A4B | OpenRouter | 免费/网关 |
定价与限制
| 输入 | $0.120 / 百万 tokens |
| 输出 | $0.400 / 百万 tokens |
| 缓存读 / 写 | $0.050 / — |
| 最大输出 | 262k |
| 输入模态 | image, text, video |
| 输出模态 | text |
| HF | google/gemma-4-26B-A4B-it |
支持参数
价格与基准分优先同步自 OpenRouter;网关短 ID 由本站平台清单补全,介绍/历史版本融合 Hugging Face 检索与家族知识库。能力验真请用 bench_v1 实验室 · OCR 天梯。
关于本页实体
Gemma 4 26B A4B:怎么用本页做决策
Gemma 4 26B A4B: live quotes and risk signals on GrokCode. Aggregation only — not a storefront.
Use related guides for methodology; use the tables above for numbers that change hourly.
相关指南
- 2026 本地大模型天梯实测:Qwen3.6、Llama4 Scout、Gemma4 量化后 VRAM 与性能对比 — 基于 2026 年最新开源模型发布,详细拆解消费级 GPU(RTX 5090/4090/4060)下 7B-70B 量化模型的实际推理速度、上下文支持与编码能力
- 2026 本地部署实用 LLM 天梯:Gemma 4、Phi-4 与 Qwen 3 硬件匹配指南 — 基于 2026 年最新开源模型基准,详细对比 Gemma 4 26B、Phi-4、Qwen 3 7B/27B 在消费级 GPU 和 Mac 上的量化部署方案、显
- 2026 本地部署实用 LLM 天梯:7B-70B 模型选型与量化实测 — 基于最新开源模型基准,详解 Gemma 4、Qwen3、DeepSeek-V4 等在消费级 GPU 和服务器上的本地运行方案、VRAM 需求、量化策略及推理速度
- 2026 Grok 编码模型天梯:性价比与选型实战榜 — 聚焦Grok Build 0.1编码代理天梯,实测多场景性价比、上下文长度与工具调用稳定性;对比主流模型,提供工程选型清单与硬件适配建议。
- 2026 GrokCode vLLM 本地部署生产清单:并发、显存、量化与模型天梯实战 — vLLM本地部署生产级配置全指南,聚焦并发处理能力、显存优化、量化策略与编码模型天梯性价比对比。结合GrokCode实验室实测数据,提供工程可核验的硬件搭配方案
- Grok / xAI 模型天梯在 vLLM 本地部署的性价比排行榜 — 2026年 GrokCode 模型天梯在 vLLM 本地部署场景下的编码模型排行榜,覆盖 70B 级 TCO 实测、量化策略与业务选型路径。
- 本地部署 70B 模型天梯:TCO 实测与电费卡费量化 — GrokCode 针对 70B 级别本地部署的算力账单化方案,涵盖电费、硬件卡费、量化策略实测数据与 vLLM 生产清单,助力模型天梯性价比选型。
- 编码模型天梯怎么读:Grok 4.5 性价比榜与业务选型实战 — 2026 年最新 Grok 4.5 / Grok 4.20 编码模型天梯拆解:BenchAlign v5、LM Arena、HighWalk 实测数据 + 与
常见问题
- Where do Gemma 4 26B A4B prices come from?
- From public catalogs and lab snapshots. Prefer official pages for final billing truth.
主题柱
slug:google/gemma-4-26b-a4b-it · 主题柱讲方法,实时数字以本页表格为准
関連ツール
Clavue CLI / imux IDE / clavue-2.1
Clavue · CLI 与 Agent 平台
CLI / GUI Agent 运行时、设备登录、会员额度与 OpenAI 兼容 API(api.clavue.com)。开发脚本、CI 与本地工具一条链路。
打开 Clavue ↗imux · 原生 macOS AI IDE
Clavue 平台的原生 IDE:多 Agent 分屏、Ghostty 级终端、Agent Chat、浏览器自动化与 Supervisor——不是又一个 Electron 壳。
了解 imux ↗Clavue 2.1 · 产品级大模型
旗舰模型 clavue-2.1(及 fast / pro / rev):适合复杂推理与长程 Agent 循环。Chat、imux、API 共用会员额度。
查看模型 ↗