Llama 3.1 8b Instruct
Meta 最新一代 Llama 3.1 模型推出了多种规模和版本。这一 8B 指令微调版本速度快、效率高,表现出色。
模态
上下文
131Ktokens
最大输出 131K tokens
能力
工具调用 (Tools)
结构化输出
并行工具调用
视觉输入
音频输入
多服务商价格对比数据来自 OpenRouter
| 服务商 | 量化精度 | 上下文 | 输入/M | 输出/M | 缓存读取/M | 近1天可用率 |
|---|---|---|---|---|---|---|
| fp8 | 131K | ¥0.14 | ¥0.27 | - | 98.5% | |
| fp8 | 16K | ¥0.14 | ¥0.34 | - | 98.8% | |
| — | 131K | ¥0.34 | ¥0.54 | ¥0.17 | 99.9% | |
| fp8 | 32K | ¥1.03 | ¥1.94 | - | 94.1% | |
C CoreWeave | bf16 | 128K | ¥1.49 | ¥1.49 | ¥1.49 | 100.0% |
¥0.14
输入/M
¥0.27
输出/M
-
缓存/M
98.5%
可用率
¥0.14
输入/M
¥0.34
输出/M
-
缓存/M
98.8%
可用率
¥0.34
输入/M
¥0.54
输出/M
¥0.17
缓存/M
99.9%
可用率
¥1.03
输入/M
¥1.94
输出/M
-
缓存/M
94.1%
可用率
C
CoreWeavebf16¥1.49
输入/M
¥1.49
输出/M
¥1.49
缓存/M
100.0%
可用率
📊 Artificial Analysis 综合指数
智能指数
5.4
编程指数
Agent 指数