GLM 4.6
相比 GLM-4.5,本代模型带来了几项关键提升:上下文窗口从 128K 扩展到 200K token,使模型能够处理更复杂的任务。
模态
上下文
205Ktokens
最大输出 131K tokens
能力
工具调用 (Tools)
结构化输出
并行工具调用
视觉输入
音频输入
多服务商价格对比数据来自 OpenRouter
| 服务商 | 量化精度 | 上下文 | 输入/M | 输出/M | 缓存读取/M | 近1天可用率 |
|---|---|---|---|---|---|---|
| fp4 | 198K | ¥2.91 | ¥11.82 | ¥0.54 | 98.5% | |
| fp4 | 203K | ¥3.38 | ¥13.51 | ¥0.68 | 98.9% | |
| bf16 | 205K | ¥3.72 | ¥14.87 | ¥0.74 | 97.1% | |
| fp4 | 203K | ¥4.05 | ¥14.87 | ¥0.74 | 92.0% | |
| fp8 | 203K | ¥4.05 | ¥14.87 | ¥0.74 | 99.6% |
¥2.91
输入/M
¥11.82
输出/M
¥0.54
缓存/M
98.5%
可用率
¥3.38
输入/M
¥13.51
输出/M
¥0.68
缓存/M
98.9%
可用率
¥3.72
输入/M
¥14.87
输出/M
¥0.74
缓存/M
97.1%
可用率
¥4.05
输入/M
¥14.87
输出/M
¥0.74
缓存/M
92.0%
可用率
¥4.05
输入/M
¥14.87
输出/M
¥0.74
缓存/M
99.6%
可用率
📊 Artificial Analysis 综合指数
29.3
智能指数
45.8
编程指数
18.6
Agent 指数