Arena Mirror (China)
Alibaba

Qwen 3 235b A22b Instruct

Alibaba2025-07-21● 开源 · APACHE-2.0🤗 Qwen/Qwen3-235B-A22B-Instruct-25075.0793

Qwen3-235B-A22B-Instruct-2507 是基于 Qwen3-235B 架构的多语言指令微调混合专家语言模型,每次前向传播激活 220 亿参数,面向通用文本生成、指令遵循等场景优化。

模态
上下文
262Ktokens
最大输出 16K tokens
能力
工具调用 (Tools)
结构化输出
并行工具调用
视觉输入
音频输入
多服务商价格对比数据来自 OpenRouter
10 个服务商1 USD ≈ 6.7569 CNY · 更新于 2026-08-19
服务商量化精度上下文输入/M输出/M缓存读取/M近1天可用率
DeepInfraDeepInfrafp8262K¥0.61¥3.72-96.5%
NovitaNovitafp8131K¥0.61¥3.92-98.4%
ParasailParasailfp8131K¥0.95¥5.41¥0.3499.7%
AlibabaAlibaba131K¥1.01¥4.04-100.0%
VeniceVenicefp8128K¥1.01¥5.07-95.1%
NebiusNebiusfp8262K¥1.35¥4.05-93.0%
AtlasCloudAtlasCloudfp8131K¥1.35¥5.95¥1.3599.8%
StreamLakeStreamLake限时 -40%128K¥1.42¥5.68-99.8%
GoogleGoogle Vertex (US South1)262K¥1.49¥5.95-99.9%
GoogleGoogle Vertex (US South1)262K¥1.69¥6.76-99.0%
DeepInfraDeepInfrafp8
¥0.61
输入/M
¥3.72
输出/M
-
缓存/M
96.5%
可用率
NovitaNovitafp8
¥0.61
输入/M
¥3.92
输出/M
-
缓存/M
98.4%
可用率
ParasailParasailfp8
¥0.95
输入/M
¥5.41
输出/M
¥0.34
缓存/M
99.7%
可用率
AlibabaAlibaba
¥1.01
输入/M
¥4.04
输出/M
-
缓存/M
100.0%
可用率
VeniceVenicefp8
¥1.01
输入/M
¥5.07
输出/M
-
缓存/M
95.1%
可用率
NebiusNebiusfp8
¥1.35
输入/M
¥4.05
输出/M
-
缓存/M
93.0%
可用率
AtlasCloudAtlasCloudfp8
¥1.35
输入/M
¥5.95
输出/M
¥1.35
缓存/M
99.8%
可用率
StreamLakeStreamLake限时 -40%
¥1.42
输入/M
¥5.68
输出/M
-
缓存/M
99.8%
可用率
GoogleGoogle Vertex (US South1)
¥1.49
输入/M
¥5.95
输出/M
-
缓存/M
99.9%
可用率
GoogleGoogle Vertex (US South1)
¥1.69
输入/M
¥6.76
输出/M
-
缓存/M
99.0%
可用率