Qwen 3 30b A3b Instruct
Qwen3-30B-A3B-Instruct-2507 是 Qwen 推出的 305 亿参数混合专家语言模型,每次推理激活 33 亿参数,以非思考模式运行,面向高质量指令遵循和多语言理解设计。
模态
上下文
262Ktokens
最大输出 32K tokens
能力
工具调用 (Tools)
结构化输出
并行工具调用
视觉输入
音频输入
多服务商价格对比数据来自 OpenRouter
| 服务商 | 量化精度 | 上下文 | 输入/M | 输出/M | 缓存读取/M | 近1天可用率 |
|---|---|---|---|---|---|---|
| — | 128K | ¥0.33 | ¥1.30 | - | 99.7% | |
S SiliconFlow | fp8 | 262K | ¥0.61 | ¥2.03 | - | 90.4% |
| fp8 | 262K | ¥0.68 | ¥2.03 | - | 93.7% | |
C CoreWeave | bf16 | 262K | ¥0.68 | ¥2.03 | ¥0.68 | 99.4% |
| — | 131K | ¥0.88 | ¥3.51 | - | 99.9% |
¥0.33
输入/M
¥1.30
输出/M
-
缓存/M
99.7%
可用率
S
SiliconFlowfp8¥0.61
输入/M
¥2.03
输出/M
-
缓存/M
90.4%
可用率
¥0.68
输入/M
¥2.03
输出/M
-
缓存/M
93.7%
可用率
C
CoreWeavebf16¥0.68
输入/M
¥2.03
输出/M
¥0.68
缓存/M
99.4%
可用率
¥0.88
输入/M
¥3.51
输出/M
-
缓存/M
99.9%
可用率