Qwen 3 30b A3b Instruct
Qwen3-30B-A3B-Instruct-2507 是 Qwen 推出的 305 亿参数混合专家语言模型,每次推理激活 33 亿参数,以非思考模式运行,面向高质量指令遵循和多语言理解设计。
模态
上下文
262Ktokens
最大输出 32K tokens
排名与分数走势
排名
Elo 评分
能力
工具调用 (Tools)
结构化输出
并行工具调用
视觉输入
音频输入
多服务商价格对比数据来自 OpenRouter
| 服务商 | 量化精度 | 上下文 | 输入/M | 输出/M | 缓存读取/M | 近1天可用率 |
|---|---|---|---|---|---|---|
| — | 128K | ¥0.32 | ¥1.30 | - | 98.5% | |
D DekaLLM | — | 262K | ¥0.60 | ¥2.01 | - | 99.1% |
S SiliconFlow | fp8 | 262K | ¥0.60 | ¥2.01 | - | 98.2% |
| fp8 | 262K | ¥0.67 | ¥2.01 | - | 92.5% | |
| — | 131K | ¥0.87 | ¥3.49 | - | 99.6% |
¥0.32
输入/M
¥1.30
输出/M
-
缓存/M
98.5%
可用率
D
DekaLLM¥0.60
输入/M
¥2.01
输出/M
-
缓存/M
99.1%
可用率
S
SiliconFlowfp8¥0.60
输入/M
¥2.01
输出/M
-
缓存/M
98.2%
可用率
¥0.67
输入/M
¥2.01
输出/M
-
缓存/M
92.5%
可用率
¥0.87
输入/M
¥3.49
输出/M
-
缓存/M
99.6%
可用率