Qwen 3 32b
Qwen3-32B 是 Qwen3 系列中的稠密 328 亿参数因果语言模型,针对复杂推理和高效对话两方面均做了优化,支持「思考」模式与常规对话模式无缝切换。
模态
上下文
131Ktokens
最大输出 16K tokens
能力
工具调用 (Tools)
结构化输出
并行工具调用
视觉输入
音频输入
多服务商价格对比数据来自 OpenRouter
| 服务商 | 量化精度 | 上下文 | 输入/M | 输出/M | 缓存读取/M | 近1天可用率 |
|---|---|---|---|---|---|---|
| fp8 | 41K | ¥0.54 | ¥1.89 | - | 99.0% | |
| fp8 | 41K | ¥0.68 | ¥2.03 | - | 97.0% | |
S SiliconFlow | fp8 | 131K | ¥0.95 | ¥3.85 | - | 88.9% |
| — | 131K | ¥1.96 | ¥3.99 | ¥0.98 | 100.0% |
¥0.54
输入/M
¥1.89
输出/M
-
缓存/M
99.0%
可用率
¥0.68
输入/M
¥2.03
输出/M
-
缓存/M
97.0%
可用率
S
SiliconFlowfp8¥0.95
输入/M
¥3.85
输出/M
-
缓存/M
88.9%
可用率
¥1.96
输入/M
¥3.99
输出/M
¥0.98
缓存/M
100.0%
可用率
📊 Artificial Analysis 综合指数
11.4
智能指数
15.3
编程指数
1.8
Agent 指数