GLM 4.7 Flash
作为 30B 级别的业界领先模型,GLM-4.7-Flash 在性能与效率之间取得了新的平衡,针对 Agent 编程场景做了进一步优化,强化了编程能力和长周期任务规划能力。
模态
上下文
200Ktokens
最大输出 118K tokens
排名与分数走势
排名
Elo 评分
能力
工具调用 (Tools)
结构化输出
并行工具调用
视觉输入
音频输入
多服务商价格对比数据来自 OpenRouter
| 服务商 | 量化精度 | 上下文 | 输入/M | 输出/M | 缓存读取/M | 近1天可用率 |
|---|---|---|---|---|---|---|
| fp8 | 128K | ¥0.40 | ¥2.69 | ¥0.07 | 99.2% | |
| — | 131K | ¥0.41 | ¥2.69 | - | 99.0% | |
| bf16 | 200K | ¥0.47 | ¥2.69 | ¥0.07 | 68.5% |
¥0.40
输入/M
¥2.69
输出/M
¥0.07
缓存/M
99.2%
可用率
¥0.41
输入/M
¥2.69
输出/M
-
缓存/M
99.0%
可用率
¥0.47
输入/M
¥2.69
输出/M
¥0.07
缓存/M
68.5%
可用率