核心内容总结
Google刚发布了Gemini的三个新模型(3.6 Flash、3.5 Flash-Lite、3.5 Flash Cyber),官方吹它们“更省钱、更高效、更聪明”,但网友和第三方评测却集体吐槽:智能没进步甚至倒退,性价比不如对手,旗舰模型3.5 Pro还跳票了。大家调侃Gemini像“得了阿尔茨海默症”,越更新越不聪明,Google这波操作反而让网友笑得更大声。
一、官方吹的“省钱高效”,到底是啥意思?
Google给新模型的标签是“主力干活”“便宜大碗”。具体来说:
- 省token:3.6 Flash比上一代少用17%的输出字符(token),复杂任务甚至省65%——简单讲就是回答问题时废话更少,同样的活儿花更少的钱。比如以前回答一个问题要100个字,现在只要83个,账单自然变薄。
- 降价:3.6 Flash输出价格从9美元/百万token降到7.5美元,Flash-Lite更白菜(输入0.3、输出2.5美元),主打“高吞吐、低延迟”,适合批量处理文档、搜索这类简单任务。
- 小升级:知识截止日期终于从2025年1月更到2026年3月(不再用老黄历),代码能力和电脑操作(比如自动用软件)有小提升,还加了更强的安全防护(防化学/网络攻击)。
但这些都是官方说的,实际用起来咋样?网友可不买账。
二、网友为啥笑更大声?实际体验“又笨又坑”
第三方评测和用户实测直接打了官方的脸:
- 智能没进步:第三方机构说3.6 Flash的智能指数和上一代一模一样,甚至不如Meta、GLM等对手的模型。网友吐槽“比GPT的模型贵还笨”——比如同样的任务,GPT花更少的钱能做得更好。
- 实测问题多:有用户测试发现,模型基础解码错误(比如理解错指令)、中文选词离谱(说不通顺)、生成的图片视频质量差(和指令对不上还限额)、经常记混信息或调用错工具。有人甚至阴谋论:Google是不是把算力卖给别人了,才让模型这么拉胯?
- Flash-Lite反超老大哥:有意思的是,定位更低的Flash-Lite在一些任务上居然超过了更老的3 Flash模型,但这也侧面说明老模型有多弱。
三、旗舰模型跳票,背后藏着“技术焦虑”
大家最期待的旗舰3.5 Pro去哪了?官方说“在测试”,但背后真相很尴尬:
- 内部没达标:据报道,3.5 Pro的代码生成能力一直没达到Google自己的要求,6月更新训练数据后还是不行,甚至要推翻重来、从零训练。
- 转移视线:官方索性跳过3.5 Pro,直接吹Gemini 4,说“启动了史上最雄心勃勃的预训练”。这明显是画饼——旗舰都搞不定,4能靠谱吗?网友调侃这是“转移注意力,续命用的”。
四、性价比翻车:Flash系列的立身之本没了
Flash系列本来的卖点是“性价比”(便宜又够用),但这次直接被戳穿:
- 比对手贵还弱:有网友对比,Gemini 3.6 Flash的成本比GPT的5.6 Sol medium还高,但智能程度更低。比如做同样的代码任务,GPT花更少的钱做得更好,Flash系列的优势彻底没了。
- 用户不买账:网友直言“又贵又笨,这组合太尴尬”——本来想靠Flash稳住用户,结果自砸招牌。对比OpenAI的Codex和ChatGPT Work用户还在涨额度,Google的落差感拉满。
五、安全模型锁起来:Google怕啥?
最后一个模型3.5 Flash Cyber是专门找代码漏洞的,但Google把它锁得死死的:
- 只给可信伙伴:这个模型只对“可信合作伙伴”内测,防止有人用它干坏事(比如找漏洞攻击别人)。Google的逻辑是:AI找漏洞比修漏洞快,先给防守方用,赶在黑客之前补锅。
- 双刃剑难题:技术是把双刃剑,Google不敢随便开放,也反映出AI安全的压力——毕竟要是被滥用,后果不堪设想。
总结:Google的“阿尔茨海默”调侃会成真吗?
Google这次发布的新模型,看似“省钱高效”,实则智能没进步、性价比翻车,旗舰还跳票。网友的调侃不是空穴来风——Gemini从去年到现在,确实给人“越来越笨”的感觉。如果Gemini 4再翻车,那“阿尔茨海默”的玩笑可能真要变成现实了。Google这波操作,更像是在“稳住场子”,但能不能挽回用户信任,还得看后续的真本事。
(全文完)