Gemini 3.8 Flash 9月2日上线,保持 $0.75/1M 输入、$3.75/1M 输出的促销价,促销期至 2026‑12‑31。与 3.7 Flash 同价,但模型在复杂任务上会多做推理步骤、迭代调用工具,准确率提升但输出量增大。
核心规格:
- 模型 ID:gemini‑3.8‑flash
- 上下文窗口:1,000,000 tokens
- 输出上限:64,000 tokens
- 输入支持:文本、图像、视频、音频、PDF
- 知识截止:2026‑03(部分领域 2025‑01)
- 工具使用:函数调用、搜索、计算机使用
性能亮点
- 在金融、法律、长视频理解和图表推理等领域,3.8 Flash 超越 Claude Opus 5,得分分别为 61.4%、10.0%、87.8% 等。
- 在终端自动化、计算机使用等长周期任务上,表现落后于 Opus 5。
- 由于更多推理步骤,单次请求的输出 token 可能显著增加,需在预算中预留。
价格与使用
- 促销期:$0.75/1M 输入、$3.75/1M 输出;2027‑01‑01 起双倍。
- 可通过 Google AI Studio、Gemini API、Android Studio、Stitch、Google Antigravity 等渠道调用。
- 仅限 API 付费使用,Google AI Pro/Ultra 订阅者可在 Gemini App 体验。
Gemini 3.8 Flash Cyber
- 仅限 Fairwind Program 参与者(政府、关键基础设施运营商、软件维护者)。
- 重点用于自主漏洞发现,公开测试中 70%+ 的真实漏洞发现率。
使用建议
- 对于高频量化、分类或短摘要任务,建议使用低 effort 级别以降低成本。
- 对同一系统提示或文档多次调用时,开启缓存可显著节省费用。
- 任何 2026‑03 之后的知识需通过搜索工具补充,避免幻觉。
Gemini 3.8 Flash 继续巩固 Flash 系列在高吞吐量场景的地位,同时通过 Cyber 变体开启安全专属产品线。
资源链接
GitHub
#开发者 #工具 #Gemini38Flash #GoogleAI #LLM
@DevToolboxHub