Gemini 4 发布,内部评价两极

Google 终于把 Gemini 4 放出来了,但这次节奏挺微妙。先给一小批网络安全合作伙伴试用,再逐步开放给付费用户,明显是在控制预期。官方口径是多项基准领先,甚至在一项网络安全测试里压过了 OpenAI 的 Astra;可彭博社那边就爆出内部员工吐槽,说跑分好看,真到实际编程任务就拉胯。股价也跟着坐过山车,盘后先涨 1.7%,消息一出又回吐。

我的判断是,Google 现在最大的问题不是模型能不能打,而是内部信心不统一。一边是 DeepMind 负责人说“始终处于前沿”,一边是员工觉得 Anthropic 的 Fable 和 OpenAI 的 Astra 进步更快。更关键的是,Gemini 4 要撑起搜索、Gmail、Chrome 这些十亿级产品,一旦实际体验跟不上跑分,反噬会比对手更猛。原计划 6 月发的 Gemini 3.5 Pro 被砍掉,也说明 Google 在赌这一把。对出海团队来说,别急着把生产环境迁过去,等真实编程和 agent 场景的反馈出来再动。
14

评论

登录后即可发表评论

参与讨论,和出海同行交流想法与经验

还没有评论,来抢沙发吧

说说你的看法,第一条评论最显眼