Arena Mirror (China)
Google

Gemini 3.1 Flash Lite

Google2026-05-07

Gemini 3.1 Flash Lite 是 Google 推出的正式版高效多模态模型,针对低延迟、高并发工作负载优化,支持文本、图像、视频、音频及 PDF 输入,适用于轻量级 Agent 场景。

模态
上下文
1.05Mtokens
最大输出 66K tokens
能力
工具调用 (Tools)
结构化输出
并行工具调用
视觉输入
音频输入
多服务商价格对比数据来自 OpenRouter
7 个服务商1 USD ≈ 6.7569 CNY · 更新于 2026-08-19
服务商量化精度上下文输入/M输出/M缓存读取/M近1天可用率
GoogleGoogle Vertex (Flex)1.05M¥0.84¥5.07¥0.0898.6%
Google AI StudioGoogle AI Studio (Flex)1.05M¥0.84¥5.07¥0.0899.7%
GoogleGoogle Vertex1.05M¥1.69¥10.14¥0.1798.6%
Google AI StudioGoogle AI Studio1.05M¥1.69¥10.14¥0.1799.7%
GoogleGoogle Vertex (US)1.05M¥1.86¥11.15¥0.19100.0%
GoogleGoogle Vertex (Priority)1.05M¥3.04¥18.24¥0.3098.6%
Google AI StudioGoogle AI Studio (Priority)1.05M¥3.04¥18.24¥0.3099.7%
GoogleGoogle Vertex (Flex)
¥0.84
输入/M
¥5.07
输出/M
¥0.08
缓存/M
98.6%
可用率
Google AI StudioGoogle AI Studio (Flex)
¥0.84
输入/M
¥5.07
输出/M
¥0.08
缓存/M
99.7%
可用率
GoogleGoogle Vertex
¥1.69
输入/M
¥10.14
输出/M
¥0.17
缓存/M
98.6%
可用率
Google AI StudioGoogle AI Studio
¥1.69
输入/M
¥10.14
输出/M
¥0.17
缓存/M
99.7%
可用率
GoogleGoogle Vertex (US)
¥1.86
输入/M
¥11.15
输出/M
¥0.19
缓存/M
100.0%
可用率
GoogleGoogle Vertex (Priority)
¥3.04
输入/M
¥18.24
输出/M
¥0.30
缓存/M
98.6%
可用率
Google AI StudioGoogle AI Studio (Priority)
¥3.04
输入/M
¥18.24
输出/M
¥0.30
缓存/M
99.7%
可用率