Arena Mirror (China)
Google

Gemma 4 26b A4b

Google2026-04-03● 开源 · APACHE-2.0🤗 google/gemma-4-26B-A4B-it972.71,409

Gemma 4 26B A4B IT 是 Google DeepMind 推出的指令微调混合专家(MoE)模型。总参数 252 亿,但推理时每个 token 仅激活 38 亿参数,实现接近 310 亿参数模型的质量。

模态
参数量 (MoE)
25.2B
激活 3.8B / token
上下文
262Ktokens
最大输出 16K tokens
能力
工具调用 (Tools)
结构化输出
并行工具调用
视觉输入
音频输入
多服务商价格对比数据来自 OpenRouter
8 个服务商1 USD ≈ 6.7569 CNY · 更新于 2026-08-19
服务商量化精度上下文输入/M输出/M缓存读取/M近1天可用率
DeepInfraDeepInfrafp8262K¥0.47¥2.30-99.2%
CloudflareCloudflare256K¥0.68¥2.03-99.8%
N
NextBit
bf16262K¥0.68¥2.70¥0.3499.0%
S
SiliconFlow
fp8262K¥0.81¥2.70-96.5%
NovitaNovitabf16262K¥0.88¥2.70-94.2%
ParasailParasailbf16262K¥0.88¥2.70¥0.3498.8%
VeniceVenicebf16256K¥0.88¥2.70¥0.3498.9%
GoogleGoogle Vertex262K¥1.01¥4.05-96.6%
DeepInfraDeepInfrafp8
¥0.47
输入/M
¥2.30
输出/M
-
缓存/M
99.2%
可用率
CloudflareCloudflare
¥0.68
输入/M
¥2.03
输出/M
-
缓存/M
99.8%
可用率
N
NextBitbf16
¥0.68
输入/M
¥2.70
输出/M
¥0.34
缓存/M
99.0%
可用率
S
SiliconFlowfp8
¥0.81
输入/M
¥2.70
输出/M
-
缓存/M
96.5%
可用率
NovitaNovitabf16
¥0.88
输入/M
¥2.70
输出/M
-
缓存/M
94.2%
可用率
ParasailParasailbf16
¥0.88
输入/M
¥2.70
输出/M
¥0.34
缓存/M
98.8%
可用率
VeniceVenicebf16
¥0.88
输入/M
¥2.70
输出/M
¥0.34
缓存/M
98.9%
可用率
GoogleGoogle Vertex
¥1.01
输入/M
¥4.05
输出/M
-
缓存/M
96.6%
可用率
📊 Artificial Analysis 综合指数
26.1
智能指数
39.3
编程指数
11
Agent 指数