Arena Mirror (China)
Google

Gemma 4 31B

Google2026-04-02● 开源 · APACHE-2.0🤗 google/gemma-4-31B-it940.23,591

Gemma 4 31B Instruct 是 Google DeepMind 推出的 307 亿参数稠密多模态模型,支持文本与图像输入、文本输出,拥有 25.6 万 token 上下文窗口,支持可配置思考/推理模式与原生函数调用。

模态
上下文
262Ktokens
最大输出 16K tokens
能力
工具调用 (Tools)
结构化输出
并行工具调用
视觉输入
音频输入
多服务商价格对比数据来自 OpenRouter
18 个服务商1 USD ≈ 6.7569 CNY · 更新于 2026-08-19
服务商量化精度上下文输入/M输出/M缓存读取/M近1天可用率
O
OpenInference
bf16262K¥0.54¥2.36¥0.0794.5%
DeepInfraDeepInfrafp4262K¥0.61¥2.30¥0.3499.0%
C
CoreWeave
bf16262K¥0.68¥2.30¥0.6897.8%
VeniceVenicebf16256K¥0.81¥2.43¥0.6199.8%
C
Chutes
fp4131K¥0.81¥2.50¥0.0887.2%
DeepInfraDeepInfrafp8262K¥0.88¥2.57-97.1%
S
SiliconFlow
fp8262K¥0.88¥2.70-94.6%
NovitaNovitabf16262K¥0.95¥2.70-80.3%
FriendliFriendli262K¥0.95¥2.70-99.5%
CrusoeCrusoe262K¥0.95¥2.70¥0.9599.0%
ParasailParasailfp8262K¥1.01¥2.70¥0.4199.2%
P
Phala
262K¥1.01¥3.11¥0.5196.7%
DeepInfraDeepInfrafp8131K¥1.82¥5.14-75.8%
TogetherTogether262K¥1.89¥5.81-78.8%
SambaNovaSambaNova131K¥2.57¥7.77-99.0%
TogetherTogether262K¥2.64¥6.55-90.9%
M
ModelRun
fp4262K¥5.07¥6.76¥5.0799.9%
CerebrasCerebrasfp16131K¥6.69¥10.07¥6.69100.0%
O
OpenInferencebf16
¥0.54
输入/M
¥2.36
输出/M
¥0.07
缓存/M
94.5%
可用率
DeepInfraDeepInfrafp4
¥0.61
输入/M
¥2.30
输出/M
¥0.34
缓存/M
99.0%
可用率
C
CoreWeavebf16
¥0.68
输入/M
¥2.30
输出/M
¥0.68
缓存/M
97.8%
可用率
VeniceVenicebf16
¥0.81
输入/M
¥2.43
输出/M
¥0.61
缓存/M
99.8%
可用率
C
Chutesfp4
¥0.81
输入/M
¥2.50
输出/M
¥0.08
缓存/M
87.2%
可用率
DeepInfraDeepInfrafp8
¥0.88
输入/M
¥2.57
输出/M
-
缓存/M
97.1%
可用率
S
SiliconFlowfp8
¥0.88
输入/M
¥2.70
输出/M
-
缓存/M
94.6%
可用率
NovitaNovitabf16
¥0.95
输入/M
¥2.70
输出/M
-
缓存/M
80.3%
可用率
FriendliFriendli
¥0.95
输入/M
¥2.70
输出/M
-
缓存/M
99.5%
可用率
CrusoeCrusoe
¥0.95
输入/M
¥2.70
输出/M
¥0.95
缓存/M
99.0%
可用率
ParasailParasailfp8
¥1.01
输入/M
¥2.70
输出/M
¥0.41
缓存/M
99.2%
可用率
P
Phala
¥1.01
输入/M
¥3.11
输出/M
¥0.51
缓存/M
96.7%
可用率
DeepInfraDeepInfrafp8
¥1.82
输入/M
¥5.14
输出/M
-
缓存/M
75.8%
可用率
TogetherTogether
¥1.89
输入/M
¥5.81
输出/M
-
缓存/M
78.8%
可用率
SambaNovaSambaNova
¥2.57
输入/M
¥7.77
输出/M
-
缓存/M
99.0%
可用率
TogetherTogether
¥2.64
输入/M
¥6.55
输出/M
-
缓存/M
90.9%
可用率
M
ModelRunfp4
¥5.07
输入/M
¥6.76
输出/M
¥5.07
缓存/M
99.9%
可用率
CerebrasCerebrasfp16
¥6.69
输入/M
¥10.07
输出/M
¥6.69
缓存/M
100.0%
可用率
📊 Artificial Analysis 综合指数
29.7
智能指数
43.4
编程指数
14.4
Agent 指数