Llama 3.1 70b Instruct
Meta 最新一代 Llama 3.1 模型推出了多种规模和版本。这一 70B 指令微调版本针对高质量对话场景优化,表现出色。
模态
上下文
131Ktokens
最大输出 16K tokens
能力
工具调用 (Tools)
结构化输出
并行工具调用
视觉输入
音频输入
多服务商价格对比数据来自 OpenRouter
| 服务商 | 量化精度 | 上下文 | 输入/M | 输出/M | 缓存读取/M | 近1天可用率 |
|---|---|---|---|---|---|---|
| fp8 | 131K | ¥2.70 | ¥2.70 | - | 99.3% | |
| — | 131K | ¥4.86 | ¥4.86 | - | 99.6% | |
C CoreWeave | bf16 | 128K | ¥5.41 | ¥5.41 | ¥5.41 | 100.0% |
¥2.70
输入/M
¥2.70
输出/M
-
缓存/M
99.3%
可用率
¥4.86
输入/M
¥4.86
输出/M
-
缓存/M
99.6%
可用率
C
CoreWeavebf16¥5.41
输入/M
¥5.41
输出/M
¥5.41
缓存/M
100.0%
可用率