-
_NEWSDATE: 2026-07-21 | News by: 腾讯科技 | 有0人参与评论 | 专栏: 谷歌 | _FONTSIZE: _FONT_SMALL _FONT_MEDIUM _FONT_LARGE

文丨晓静
编辑丨徐青阳
美国当地时间7月21日,谷歌DeepMind团队一口气放出三款新的Gemini模型:Gemini 3.6 Flash、Gemini 3.5 Flash-Lite以及Gemini 3.5 Flash Cyber。
其中,主力模型Gemini 3.6 Flash在编码和多模态任务上表现更强,但更关键的是,它处理相同工作所消耗的输出token比前代减少了17%到65%。
Gemini 3.5 Flash-Lite主打极致的速度与性价比,每秒可生成350个输出token。
而Gemini 3.5 Flash Cyber则是一款针对网络安全漏洞检测与修复进行微调的专用模型,目前仅向政府和特定合作伙伴开放。
与此同时,外界期待已久的旗舰模型Gemini 3.5 Pro依然没有露面,谷歌表示它正在与合作伙伴进行测试,并首次透露,更庞大的Gemini 4预训练工作已经启动。
01 告别“啰嗦”的AI
在大语言模型的应用成本中,输出token的数量直接关联到费用与延迟。Gemini 3.6 Flash的设计目标之一,就是降低这种不必要的消耗,同时保持或增强任务完成的质量。
第三方基准测试机构Artificial Analysis Index的实测显示,该模型输出token使用量较前代降低了17%。在需要多步骤推理和工具调用的复杂工程任务中,节省效果更为明显。
例如在Datacurve的DeepSWE基准测试中,token消耗减少了65%,这意味着Gemini 3.6 Flash在完成任务时执行了更少的冗余代码编辑和循环操作。
- 新闻来源于其它媒体,内容不代表本站立场!
-
原文链接
原文链接:
目前还没有人发表评论, 大家都在期待您的高见