GLM 4.7 Flash
作为 30B 级别的业界领先模型,GLM-4.7-Flash 在性能与效率之间取得了新的平衡,针对 Agent 编程场景做了进一步优化,强化了编程能力和长周期任务规划能力。
模态
上下文
203Ktokens
最大输出 16K tokens
能力
工具调用 (Tools)
结构化输出
并行工具调用
视觉输入
音频输入
多服务商价格对比数据来自 OpenRouter
| 服务商 | 量化精度 | 上下文 | 输入/M | 输出/M | 缓存读取/M | 近1天可用率 |
|---|---|---|---|---|---|---|
| bf16 | 203K | ¥0.41 | ¥2.70 | ¥0.07 | 99.3% | |
| fp8 | 128K | ¥0.41 | ¥2.70 | ¥0.07 | 97.9% | |
| — | 131K | ¥0.41 | ¥2.70 | - | 98.5% | |
| bf16 | 200K | ¥0.47 | ¥2.70 | ¥0.07 | 93.0% |
¥0.41
输入/M
¥2.70
输出/M
¥0.07
缓存/M
99.3%
可用率
¥0.41
输入/M
¥2.70
输出/M
¥0.07
缓存/M
97.9%
可用率
¥0.41
输入/M
¥2.70
输出/M
-
缓存/M
98.5%
可用率
¥0.47
输入/M
¥2.70
输出/M
¥0.07
缓存/M
93.0%
可用率