警告:若访客所在地区法律不允许,请自觉离开本站!

谷歌Gemini 3.8 Flash发布:主打低延迟与实时交互

优选小编 2026-09-20 19:39 1 浏览 AI前沿

谷歌在本月推出Gemini 3.8 Flash,定位为面向实时交互场景的快速模型。与旗舰版Gemini不同,Flash系列更加注重响应速度与部署灵活性,此次更新将首token延迟进一步压缩,语音对话与视频理解等场景的体验更接近实时。

Gemini 3.8 Flash在图像与视频理解任务上有所增强,能够更准确地描述画面细节并回答关于视频内容的问题。谷歌同时下调了Flash系列的API定价,吸引开发者将其集成到客服、翻译、会议记录等高频调用场景中。

业内观点认为,谷歌通过"旗舰模型+快速模型"的双轨策略覆盖不同需求层级,短期目标是在多模态助手与端侧设备上扩大应用范围。开发者可以在Gemini API控制台直接申请Flash模型访问权限。