谷歌上线 Gemini 3.8 Flash 模型,面向软件工程和智能体任务
谷歌于9月2日在 Google DeepMind 网站上线了 Gemini 3.8 Flash 模型。该模型基于 Gemini 3.7 Flash 构建,主要改进集中在软件工程和智能体知识工作流方面,并继续支持可调节的努力水平,以便在质量、成本和延迟之间进行取舍。

在能力规格上,Gemini 3.8 Flash 提供最高 1M token 的上下文窗口,文本输出上限为 64K token。官方给出的基准测试覆盖编程、知识处理、多模态、长上下文、计算机使用和科学推理等方向,结果截至 2026 年 9 月。
据介绍,该模型面向个人用户、开发者和企业,适合以较低成本大规模部署可直接用于生产环境的通用智能体,典型场景包括软件工程、智能体任务和复杂知识处理流程。谷歌也提示,模型仍可能出现幻觉等基础模型常见问题;官方正在持续提升其抵御越狱攻击的能力,并加强了前沿安全防护。
此外,Gemini 3.8 Flash 偶尔会响应较慢或超时。在较高推理强度下,模型有时会消耗更多 token 以换取更好表现。其知识截止日期为 2026 年 3 月,部分领域可能更新更晚,也有部分领域停留在 2025 年 1 月,与 Gemini 3 模型家族一致。









