Deepseek V3.2
DeepSeek-V3.2 是一款兼顾高计算效率与强大推理及 Agent 工具调用能力的大语言模型,引入了 DeepSeek 稀疏注意力(DSA)这一细粒度稀疏注意力机制。
模态
上下文
164Ktokens
最大输出 66K tokens
能力
工具调用 (Tools)
结构化输出
并行工具调用
视觉输入
音频输入
多服务商价格对比数据来自 OpenRouter
| 服务商 | 量化精度 | 上下文 | 输入/M | 输出/M | 缓存读取/M | 近1天可用率 |
|---|---|---|---|---|---|---|
G GMICloud限时 -28% | fp8 | 164K | ¥1.41 | ¥2.09 | ¥0.15 | 99.4% |
| fp8 | 128K | ¥1.45 | ¥2.17 | ¥0.14 | 99.8% | |
| — | 164K | ¥1.69 | ¥5.41 | ¥0.51 | 95.9% | |
S SiliconFlow | fp8 | 164K | ¥1.75 | ¥2.84 | ¥0.91 | 99.7% |
| fp4 | 164K | ¥1.76 | ¥2.57 | ¥0.88 | 93.8% | |
| fp8 | 164K | ¥1.76 | ¥2.57 | ¥0.88 | 99.9% | |
| fp8 | 164K | ¥1.82 | ¥2.70 | ¥0.91 | 100.0% | |
| fp8 | 131K | ¥1.89 | ¥2.84 | ¥0.19 | 99.1% | |
| — | 160K | ¥2.23 | ¥3.24 | ¥1.08 | 89.1% | |
| fp8 | 131K | ¥2.50 | ¥7.51 | ¥0.50 | 98.1% | |
| — | 164K | ¥3.38 | ¥10.14 | ¥1.69 | 99.9% | |
| — | 164K | ¥3.78 | ¥11.35 | - | 99.6% | |
P Phala | — | 164K | ¥6.76 | ¥6.76 | ¥3.38 | 99.2% |
| — | 33K | ¥20.27 | ¥30.41 | - | 89.7% |
G
GMICloudfp8限时 -28%¥1.41
输入/M
¥2.09
输出/M
¥0.15
缓存/M
99.4%
可用率
¥1.45
输入/M
¥2.17
输出/M
¥0.14
缓存/M
99.8%
可用率
¥1.69
输入/M
¥5.41
输出/M
¥0.51
缓存/M
95.9%
可用率
S
SiliconFlowfp8¥1.75
输入/M
¥2.84
输出/M
¥0.91
缓存/M
99.7%
可用率
¥1.76
输入/M
¥2.57
输出/M
¥0.88
缓存/M
93.8%
可用率
¥1.76
输入/M
¥2.57
输出/M
¥0.88
缓存/M
99.9%
可用率
¥1.82
输入/M
¥2.70
输出/M
¥0.91
缓存/M
100.0%
可用率
¥1.89
输入/M
¥2.84
输出/M
¥0.19
缓存/M
99.1%
可用率
¥2.23
输入/M
¥3.24
输出/M
¥1.08
缓存/M
89.1%
可用率
¥2.50
输入/M
¥7.51
输出/M
¥0.50
缓存/M
98.1%
可用率
¥3.38
输入/M
¥10.14
输出/M
¥1.69
缓存/M
99.9%
可用率
¥3.78
输入/M
¥11.35
输出/M
-
缓存/M
99.6%
可用率
P
Phala¥6.76
输入/M
¥6.76
输出/M
¥3.38
缓存/M
99.2%
可用率
¥20.27
输入/M
¥30.41
输出/M
-
缓存/M
89.7%
可用率
📊 Artificial Analysis 综合指数
智能指数
44.2
编程指数
Agent 指数