GLM 5.2
GLM 5.2 是智谱(Z.ai)推出的大规模推理模型,支持文本输入输出,拥有 100 万 token 上下文窗口,适用于长周期 Agent 工作流、工程级软件开发等场景。
模态
上下文
1.05Mtokens
最大输出 131K tokens
能力
工具调用 (Tools)
结构化输出
并行工具调用
视觉输入
音频输入
多服务商价格对比数据来自 OpenRouter
| 服务商 | 量化精度 | 上下文 | 输入/M | 输出/M | 缓存读取/M | 近1天可用率 |
|---|---|---|---|---|---|---|
S Sail Research | fp8 | 1.05M | ¥3.38 | ¥21.28 | ¥0.78 | 99.5% |
A Ambient | fp8 | 203K | ¥4.05 | ¥13.51 | ¥1.01 | 82.3% |
D Decart限时 -43% | fp4 | 1.05M | ¥4.62 | ¥15.41 | ¥0.77 | 99.5% |
| — | 262K | ¥4.73 | ¥14.87 | ¥0.71 | 98.5% | |
| fp8 | 1.02M | ¥4.96 | ¥15.58 | ¥0.92 | 99.6% | |
| fp8 | 1.05M | ¥5.00 | ¥15.73 | ¥0.93 | 98.8% | |
G GMICloud限时 -47% | fp8 | 1.05M | ¥5.01 | ¥15.76 | ¥0.93 | 99.2% |
| fp4 | 1.05M | ¥5.07 | ¥16.22 | ¥0.95 | 99.0% | |
I Inceptron | fp4 | 1.05M | ¥5.07 | ¥19.60 | ¥1.15 | 96.2% |
C CoreWeave | fp4 | 262K | ¥5.14 | ¥16.35 | ¥0.95 | 98.9% |
A AkashML限时 -45% | fp8 | 97K | ¥5.20 | ¥16.35 | ¥0.97 | 96.0% |
| fp8 | 1.05M | ¥6.53 | ¥20.51 | ¥1.31 | 99.6% | |
| fp4 | 1.05M | ¥7.43 | ¥27.70 | ¥1.49 | 96.4% | |
P Phala | fp8 | 1.05M | ¥7.66 | ¥20.27 | ¥1.42 | 99.6% |
S SiliconFlow限时 -15% | fp8 | 1.05M | ¥8.04 | ¥25.27 | ¥1.49 | 99.8% |
W Wafer | fp4 | 1.05M | ¥8.51 | ¥26.76 | ¥1.58 | 98.2% |
| fp8 | 1.05M | ¥8.51 | ¥26.76 | ¥1.58 | 96.8% | |
| fp8 | 1.05M | ¥9.46 | ¥29.73 | ¥1.76 | 98.6% | |
| — | 1.05M | ¥9.46 | ¥29.73 | ¥0.95 | 97.6% | |
| — | 262K | ¥9.46 | ¥29.73 | ¥1.76 | 99.7% | |
| — | 1.05M | ¥9.46 | ¥29.73 | ¥1.76 | 99.7% | |
| fp4 | 262K | ¥9.46 | ¥29.73 | ¥1.76 | 99.8% | |
| fp8 | 1.00M | ¥9.46 | ¥29.73 | ¥1.76 | 97.7% | |
| — | 512K | ¥9.46 | ¥29.73 | ¥1.76 | 93.0% | |
| fp8 | 1.05M | ¥9.46 | ¥29.73 | ¥1.76 | 99.7% | |
| fp8 | 1.05M | ¥9.46 | ¥29.73 | ¥1.76 | 99.7% | |
| fp8 | 1.05M | ¥9.46 | ¥29.73 | ¥0.95 | 99.9% | |
| — | 1.05M | ¥14.19 | ¥44.60 | ¥1.42 | 94.1% | |
| — | 262K | ¥14.19 | ¥44.60 | ¥1.42 | 99.8% | |
| fp8 | 1.05M | ¥14.19 | ¥44.60 | ¥1.42 | 99.8% | |
| fp8 | 1.05M | ¥15.61 | ¥49.06 | ¥3.12 | 99.9% |
S
Sail Researchfp8¥3.38
输入/M
¥21.28
输出/M
¥0.78
缓存/M
99.5%
可用率
A
Ambientfp8¥4.05
输入/M
¥13.51
输出/M
¥1.01
缓存/M
82.3%
可用率
D
Decartfp4限时 -43%¥4.62
输入/M
¥15.41
输出/M
¥0.77
缓存/M
99.5%
可用率
¥4.73
输入/M
¥14.87
输出/M
¥0.71
缓存/M
98.5%
可用率
¥4.96
输入/M
¥15.58
输出/M
¥0.92
缓存/M
99.6%
可用率
¥5.00
输入/M
¥15.73
输出/M
¥0.93
缓存/M
98.8%
可用率
G
GMICloudfp8限时 -47%¥5.01
输入/M
¥15.76
输出/M
¥0.93
缓存/M
99.2%
可用率
¥5.07
输入/M
¥16.22
输出/M
¥0.95
缓存/M
99.0%
可用率
I
Inceptronfp4¥5.07
输入/M
¥19.60
输出/M
¥1.15
缓存/M
96.2%
可用率
C
CoreWeavefp4¥5.14
输入/M
¥16.35
输出/M
¥0.95
缓存/M
98.9%
可用率
A
AkashMLfp8限时 -45%¥5.20
输入/M
¥16.35
输出/M
¥0.97
缓存/M
96.0%
可用率
¥6.53
输入/M
¥20.51
输出/M
¥1.31
缓存/M
99.6%
可用率
¥7.43
输入/M
¥27.70
输出/M
¥1.49
缓存/M
96.4%
可用率
P
Phalafp8¥7.66
输入/M
¥20.27
输出/M
¥1.42
缓存/M
99.6%
可用率
S
SiliconFlowfp8限时 -15%¥8.04
输入/M
¥25.27
输出/M
¥1.49
缓存/M
99.8%
可用率
W
Waferfp4¥8.51
输入/M
¥26.76
输出/M
¥1.58
缓存/M
98.2%
可用率
¥8.51
输入/M
¥26.76
输出/M
¥1.58
缓存/M
96.8%
可用率
¥9.46
输入/M
¥29.73
输出/M
¥1.76
缓存/M
98.6%
可用率
¥9.46
输入/M
¥29.73
输出/M
¥0.95
缓存/M
97.6%
可用率
¥9.46
输入/M
¥29.73
输出/M
¥1.76
缓存/M
99.7%
可用率
¥9.46
输入/M
¥29.73
输出/M
¥1.76
缓存/M
99.7%
可用率
¥9.46
输入/M
¥29.73
输出/M
¥1.76
缓存/M
99.8%
可用率
¥9.46
输入/M
¥29.73
输出/M
¥1.76
缓存/M
97.7%
可用率
¥9.46
输入/M
¥29.73
输出/M
¥1.76
缓存/M
93.0%
可用率
¥9.46
输入/M
¥29.73
输出/M
¥1.76
缓存/M
99.7%
可用率
¥9.46
输入/M
¥29.73
输出/M
¥1.76
缓存/M
99.7%
可用率
¥9.46
输入/M
¥29.73
输出/M
¥0.95
缓存/M
99.9%
可用率
¥14.19
输入/M
¥44.60
输出/M
¥1.42
缓存/M
94.1%
可用率
¥14.19
输入/M
¥44.60
输出/M
¥1.42
缓存/M
99.8%
可用率
¥14.19
输入/M
¥44.60
输出/M
¥1.42
缓存/M
99.8%
可用率
¥15.61
输入/M
¥49.06
输出/M
¥3.12
缓存/M
99.9%
可用率
📊 Artificial Analysis 综合指数
52.6
智能指数
68.8
编程指数
45.7
Agent 指数