Gemma 4 26b A4b
Gemma 4 26B A4B IT 是 Google DeepMind 推出的指令微调混合专家(MoE)模型。总参数 252 亿,但推理时每个 token 仅激活 38 亿参数,实现接近 310 亿参数模型的质量。
模态
参数量 (MoE)
25.2B总
激活 3.8B / token
上下文
262Ktokens
最大输出 16K tokens
能力
工具调用 (Tools)
结构化输出
并行工具调用
视觉输入
音频输入
多服务商价格对比数据来自 OpenRouter
| 服务商 | 量化精度 | 上下文 | 输入/M | 输出/M | 缓存读取/M | 近1天可用率 |
|---|---|---|---|---|---|---|
| fp8 | 262K | ¥0.47 | ¥2.30 | - | 99.2% | |
| — | 256K | ¥0.68 | ¥2.03 | - | 99.8% | |
N NextBit | bf16 | 262K | ¥0.68 | ¥2.70 | ¥0.34 | 99.0% |
S SiliconFlow | fp8 | 262K | ¥0.81 | ¥2.70 | - | 96.5% |
| bf16 | 262K | ¥0.88 | ¥2.70 | - | 94.2% | |
| bf16 | 262K | ¥0.88 | ¥2.70 | ¥0.34 | 98.8% | |
| bf16 | 256K | ¥0.88 | ¥2.70 | ¥0.34 | 98.9% | |
| — | 262K | ¥1.01 | ¥4.05 | - | 96.6% |
¥0.47
输入/M
¥2.30
输出/M
-
缓存/M
99.2%
可用率
¥0.68
输入/M
¥2.03
输出/M
-
缓存/M
99.8%
可用率
N
NextBitbf16¥0.68
输入/M
¥2.70
输出/M
¥0.34
缓存/M
99.0%
可用率
S
SiliconFlowfp8¥0.81
输入/M
¥2.70
输出/M
-
缓存/M
96.5%
可用率
¥0.88
输入/M
¥2.70
输出/M
-
缓存/M
94.2%
可用率
¥0.88
输入/M
¥2.70
输出/M
¥0.34
缓存/M
98.8%
可用率
¥0.88
输入/M
¥2.70
输出/M
¥0.34
缓存/M
98.9%
可用率
¥1.01
输入/M
¥4.05
输出/M
-
缓存/M
96.6%
可用率
📊 Artificial Analysis 综合指数
26.1
智能指数
39.3
编程指数
11
Agent 指数