Qwen 3.5 397b A17b
Qwen3.5 系列的 397B-A17B 原生视觉语言模型采用融合线性注意力机制与稀疏混合专家模型的混合架构,实现更高的推理效率。
模态
上下文
262Ktokens
最大输出 66K tokens
能力
工具调用 (Tools)
结构化输出
并行工具调用
视觉输入
音频输入
多服务商价格对比数据来自 OpenRouter
| 服务商 | 量化精度 | 上下文 | 输入/M | 输出/M | 缓存读取/M | 近1天可用率 |
|---|---|---|---|---|---|---|
| — | 131K | ¥2.04 | ¥13.01 | ¥0.75 | 96.5% | |
| — | 262K | ¥2.64 | ¥15.81 | - | 99.8% | |
| fp8 | 262K | ¥3.04 | ¥20.27 | ¥1.49 | 97.1% | |
| fp8 | 262K | ¥3.38 | ¥24.32 | ¥2.03 | 99.6% | |
| fp8 | 262K | ¥3.72 | ¥23.65 | ¥3.72 | 97.5% | |
P Phala | — | 262K | ¥3.72 | ¥23.65 | ¥1.52 | 56.3% |
| — | 262K | ¥4.05 | ¥24.32 | - | 98.0% | |
| — | 256K | ¥4.05 | ¥24.32 | ¥0.81 | 97.6% | |
G GMICloud | fp8 | 262K | ¥4.05 | ¥24.32 | - | - |
| — | 128K | ¥5.07 | ¥30.41 | - | 95.8% |
¥2.04
输入/M
¥13.01
输出/M
¥0.75
缓存/M
96.5%
可用率
¥2.64
输入/M
¥15.81
输出/M
-
缓存/M
99.8%
可用率
¥3.04
输入/M
¥20.27
输出/M
¥1.49
缓存/M
97.1%
可用率
¥3.38
输入/M
¥24.32
输出/M
¥2.03
缓存/M
99.6%
可用率
¥3.72
输入/M
¥23.65
输出/M
¥3.72
缓存/M
97.5%
可用率
P
Phala¥3.72
输入/M
¥23.65
输出/M
¥1.52
缓存/M
56.3%
可用率
¥4.05
输入/M
¥24.32
输出/M
-
缓存/M
98.0%
可用率
¥4.05
输入/M
¥24.32
输出/M
¥0.81
缓存/M
97.6%
可用率
G
GMICloudfp8¥4.05
输入/M
¥24.32
输出/M
-
缓存/M
-
可用率
¥5.07
输入/M
¥30.41
输出/M
-
缓存/M
95.8%
可用率
📊 Artificial Analysis 综合指数
34.3
智能指数
48.2
编程指数
19.8
Agent 指数