IT时代网9月3日消息,谷歌在9月2日于Google DeepMind网站低调上线了Gemini 3.8 Flash模型。它基于Gemini 3.7 Flash打造,在软件工程和智能体知识工作流方面有性能提升,并继续支持可定制的努力水平,用来控制质量、成本与延迟之间的组合。
有意思的是,直到相关消息传出,谷歌官方仍未通过新闻稿或社交平台正式官宣这一模型的存在。
规格层面,Gemini 3.8 Flash具有最高1M的token上下文窗口,文本支持64K token输出。官方同时公布了多项基准测试评估结果,覆盖编程、知识处理、多模态处理能力、长上下文处理、计算机使用能力以及科学推理能力,数据截至2026年9月。
按谷歌的介绍,这款模型面向个人用户、开发者和企业,适合以较低成本大规模部署通用型、可直接用于生产环境的智能体,典型用途包括软件工程、智能体任务以及复杂的知识处理流程。
局限也写进了官方说明。Gemini 3.8 Flash存在可能产生幻觉等基础模型常见问题,谷歌称正持续提升模型抵御越狱攻击的能力,近期还进一步加强了前沿安全领域的防护措施。此外,模型偶尔会出现响应较慢或超时的情况;为了获得更好的性能,它有时会消耗更多token,在较高推理强度下尤为明显。
知识截止日期定在2026年3月。部分领域的信息可能更新得更晚,另一些领域的知识则可能仍停留在2025年1月,这与Gemini 3模型家族保持一致。
注:本文综合自IT之家等,文中包含AI辅助创作的内容。