Arena AI 中文镜像
USAnthropic

Claude Sonnet 4 20250514 Thinking 32k

Anthropic2025-05-22

Claude Sonnet 4 相比前代 Sonnet 3.7 大幅增强了能力,在编程和推理任务上均有更高的精确度和可控性,在 SWE-bench 上取得了 72.7% 的业界领先成绩。

模态
上下文
200Ktokens
最大输出 64K tokens
排名与分数走势
Claude Sonnet 4Claude Sonnet 4 20250514 Thinking 32k
排名
#113#135#158#1806/197/248/2810/3
Elo 评分
13601384140714316/197/248/2810/3
能力
工具调用 (Tools)
结构化输出
并行工具调用
视觉输入
音频输入
多服务商价格对比数据来自 OpenRouter
2 个服务商1 USD ≈ 6.7144 CNY · 更新于 2026-10-03
服务商量化精度上下文输入/M输出/M缓存读取/M近1天可用率
Amazon BedrockAmazon Bedrock (EU West 1)—200K¥20.14¥100.72¥2.01100.0%
Amazon BedrockAmazon Bedrock—200K¥20.14¥100.72¥2.01100.0%
Amazon BedrockAmazon Bedrock (EU West 1)
¥20.14
输入/M
¥100.72
输出/M
¥2.01
缓存/M
100.0%
可用率
Amazon BedrockAmazon Bedrock
¥20.14
输入/M
¥100.72
输出/M
¥2.01
缓存/M
100.0%
可用率
📊 Artificial Analysis 综合指数
智能指数
37.6
编程指数
Agent 指数