谷歌发布Gemini 3.8 Flash模型:支持1M上下文窗口,强化软件工程与智能体工作流

SmartHey9月3日消息,谷歌于9月2日在Google DeepMind官网低调推出Gemini 3.8 Flash模型。该模型基于Gemini 3.7 Flash升级而来,在软件工程能力与智能体知识工作流方面实现显著性能提升,并延续了可调节的“努力水平”机制,让用户能灵活平衡响应质量、计算成本与延迟。

Gemini 3.8 Flash具备最高达100万token的上下文窗口,单次文本输出支持最长64K token。官方同步公布了多项权威基准测试结果,覆盖编程能力、知识理解与推理、多模态理解、超长上下文处理、计算机操作模拟以及科学逻辑推演等核心维度。

截至2026年9月的最新评测表现如下:

据官方介绍,Gemini 3.8 Flash面向个人用户、开发者及企业客户,特别适用于低成本、大规模部署面向生产环境的通用智能体。典型应用场景包括自动化代码开发、端到端智能任务执行,以及需深度知识整合与推理的复杂业务流程。

需要指出的是,该模型仍存在大语言模型普遍面临的局限性,例如偶发幻觉现象。谷歌正持续优化其安全防护体系,近期重点加强了对越狱攻击的防御能力,并在前沿AI安全领域部署了更严格的对抗训练与内容审核机制。

在实际使用中,部分请求可能出现响应延迟或超时情况。为保障高精度输出,模型在启用更高推理强度时会动态增加token消耗量,建议用户根据任务需求合理配置参数。

Gemini 3.8 Flash的知识截止时间为2026年3月。不同领域的信息更新存在差异:部分技术领域(如开源框架、云服务)知识可能延至2026年中更新,而少数基础学科或政策类内容则与Gemini 3系列保持一致,最晚更新至2025年1月。