Arena Mirror (China)
Z.ai

GLM 4.7 Flash

Z.ai2026-01-19● 开源 · MIT🤗 zai-org/GLM-4.7-Flash201.21,820

作为 30B 级别的业界领先模型,GLM-4.7-Flash 在性能与效率之间取得了新的平衡,针对 Agent 编程场景做了进一步优化,强化了编程能力和长周期任务规划能力。

模态
上下文
203Ktokens
最大输出 16K tokens
能力
工具调用 (Tools)
结构化输出
并行工具调用
视觉输入
音频输入
多服务商价格对比数据来自 OpenRouter
4 个服务商1 USD ≈ 6.7569 CNY · 更新于 2026-08-19
服务商量化精度上下文输入/M输出/M缓存读取/M近1天可用率
DeepInfraDeepInfrabf16203K¥0.41¥2.70¥0.0799.3%
VeniceVenicefp8128K¥0.41¥2.70¥0.0797.9%
CloudflareCloudflare131K¥0.41¥2.70-98.5%
NovitaNovitabf16200K¥0.47¥2.70¥0.0793.0%
DeepInfraDeepInfrabf16
¥0.41
输入/M
¥2.70
输出/M
¥0.07
缓存/M
99.3%
可用率
VeniceVenicefp8
¥0.41
输入/M
¥2.70
输出/M
¥0.07
缓存/M
97.9%
可用率
CloudflareCloudflare
¥0.41
输入/M
¥2.70
输出/M
-
缓存/M
98.5%
可用率
NovitaNovitabf16
¥0.47
输入/M
¥2.70
输出/M
¥0.07
缓存/M
93.0%
可用率