关于ZAKER Skills GEO服务 合作
量子位 13小时前

轮到谷歌踩油门了!Gemini 4 泄漏、TPU 上天、工程师因「太快」辞职

Gemini 4 这两天,真的快被社媒漏成筛子了。

新检查点、新作品、新对比图,一茬接一茬往外冒。

就在刚刚,Lumina 又放出了一组挺有节目效果的测试:

同一道「鹈鹕骑自行车」,Gemini 4 Pro 前后两个检查点,直接画出了两种完全不同的风格。

Checkpoint 1 走的是鲜艳卡通风;Checkpoint 2 则明显更克制,像一张机械结构草图。

两个检查点放在一起,已经能明显看出后训练留下的痕迹:线条、结构、细节处理都在变。模型能力已经肉眼可见地往前蹿了一截。

而这,已经数不清是 Arena 里,冒出的第几个疑似 Gemini 4 Pro 的新检查点了。

社区这边还在疯狂扒细节,谷歌自己也不藏了。

本周,谷歌 DeepMind 新掌门 Koray Kavukcuoglu首次对媒体确认:Gemini 4 已经进入后训练早期。

△图源 Information

而且他的目标,是尽快发。

我们看到了效果,感到非常兴奋,接下来还会继续以快速迭代的方式推进工作。

好家伙。合着一轮轮冒出的 checkpoint 是给 Gemini 4 提前热场呢?

反正听 Koray 的语气,主打一个:能早发,绝不晚发。

而且这次提速的,还不只是模型。谷歌还准备把 TPU 芯片送上太空。

新项目即将启动原型测试,连 AI 算力基础设施都开始往地球之外伸。

Gemini 4,进入冲刺阶段

大家这么盯着 Gemini 4,也不奇怪。

毕竟从上一代旗舰模型 Gemini 3 走到现在,谷歌中间没少折腾。

原本按计划,今年 6 月应该先等来 Gemini 3.5 Pro。谷歌 CEO 劈柴哥甚至在 5 月 I/O 开发者大会上提前预告过。

结果,没发。

中间虽然陆续更新了 Gemini 3.1 和几款 Flash 型号,但 3.5 Pro 一直没有正式亮相。

Koray 这次也解释,团队中途选择「稍微暂缓一下」,先把精力放到 Flash 系列。

而现在,节奏明显又变了。

Koray 明确说,要在尽可能短的时间内,实现最大的学习速度。

听话听音。这几乎把谷歌现在的打法挑明了。

虽然没有明确说谷歌是否正式取消了 Gemini 3.5 Pro 项目,但可以肯定的是,团队已经将全部注意力转向 Gemini 4。

Gemini 3.5 Pro 可以先放一放,但 Gemini 4 的训练、测试、反馈和再迭代,必须尽快一轮接一轮跑起来。

为此,谷歌已经开始同步搭建 Gemini 4 的内部安全保障和测试流程。目前这套机制已经先在内部 AI 编码工具上跑起来了。

这时候再看最近 Arena 里冒出来的疑似 Gemini 4 检查点,就更有意思了。

Lumina 最新放出的「鹈鹕骑自行车」,大家的讨论中心已经从「哪个检查点更好」,变成了「Gemini 4 到底追到哪一步了?」

有人直接喊出:Gemini is back in the game,认为如果这些检查点真实,谷歌正在快速缩小与 OpenAI /Anthropic 的差距。

也有人觉得它现在无法和 GPT-6 SOL 正面硬刚,和 Anthropic 今年春季推出、近期又完成升级的 Mythos 系列相比,也谈不上占尽优势。

面对质疑,Koray 倒是相当有自信。

我对这个团队充满信心。我们肯定会一直处于前沿位置。

今年 8 月,哈萨比斯卸下 Google DeepMind 日常管理工作后,Koray 正式接手这块业务,同时继续担任谷歌首席 AI 架构师。

Gemini 接下来怎么跑、跑多快,Koray 就是现在最关键的拍板人之一。

反正人家的话已经放这儿了,接下来就看 Gemini 4 自己能不能接住吧。

挑战英伟达,TPU 首次上太空

如果只看 Gemini 4,很容易以为谷歌这轮只是模型团队又开始加速。

其实更夸张的是,连算力都开始同步踩油门了。

Koray 最近明确提到,DeepMind 的前沿模型研发,现在也在直接「反哺」谷歌自己的硬件业务。

以前,TPU 主要藏在 Google Cloud 后面,客户买的是云服务。但现在,谷歌开始直接卖 TPU 芯片了!

目标相当明确,挑战英伟达。

而且模型团队和芯片团队之间,也开始越绑越紧。

DeepMind 做下一代模型时产生的新需求,会提前反馈给硬件工程师,让他们规划未来两到三代 TPU。

模型:兄弟,我下一轮又准备吃算力了。

芯片:收到,现在开始造。

谷歌正与美国商业卫星公司Planet合作,计划通过SpaceX 猎鹰 9 号发射原型卫星,其中将搭载 4 颗 TPU,测试其在轨运行能力。

项目名叫「Project Suncatcher」。

想法也非常谷歌:既然地面 AI 数据中心又吃电、又占地、还需要大量水冷,那能不能干脆把一部分机器学习基础设施,搬到太阳能更充足的轨道上?

不过目前还只是第一步。

太空里没法像地面数据中心那样靠空气对流散热,芯片连续高负载运行会很快碰到热管理问题。

按照方案,芯片在太空中大约可以运行 15 分钟,之后就需要关闭以冷却。

所以这次更像是在验证一件事:TPU 到底能不能先在轨道上活下来、跑起来。

至于真正把几十颗卫星用激光连成网络,变成「太空 AI 数据中心」,那还是后话。

别人还在抢数据中心机房,谷歌已经开始琢磨天上的地皮了。

然而就在谷歌上下都在喊加速的时候,团队有人撂挑子不干了。

前 Mozilla 工程师、后来加入 DeepMind 的 Robert O ’ Callahan,昨天宣布辞职。

理由竟不是嫌弃谷歌 AI 发展太慢,而是「太快了」?

Robert 不直接训练模型,而是负责的是硬件芯片设计工具。

但做着做着,他发现这些工具会加快下一代 AI 芯片设计,进一步降低 AI 的成本和延迟。

在他看来,这意味着,人工智能将变得更加便宜、高效,从而更加普及,也更加强大。

Robert 和 DeepMind 的同事们聊过 AI 风险,几乎所有人都对此深感担忧,只是很多人没有公开表达。

而且,Koray 并没有停下来的意思,甚至觉得「还得再快」。

Robert 起初也没想直接走人,毕竟薪酬颇丰。他只想换去一个完全不加速 AI 的工程岗位。

但受限于自己所在地区和岗位选择,这条路最后也没走通。

One more thing

检查点狂冒、TPU 上天、工程师离职。这些事放在这一周看,多少有点黑色幽默。

想当初,Gemini 3 的表现曾让 OpenAI 进入「红色警戒」,但谷歌自己随后却在旗舰节奏上慢了半拍。

如今,Koray 带队,选择重新加速,并把学习速度拉到最大。并且,不是某一个产品线提速,模型、芯片、组织节奏,全都开始往前压。

谷歌:确实等不起了。

参考链接:

[ 1 ] https://x.com/LuminaBench/status/2103523411645362667

[ 2 ] https://x.com/maxt3chno/status/2103597397691523088

[ 3 ] https://www.theinformation.com/articles/google-nears-release-flagship-gemini-4-ai-model?rc=zbvmxs

[ 4 ] https://x.com/Google/status/2103229008343126519

[ 5 ] https://x.com/rocallahan/status/2103368176369324093

一键三连「点赞」「转发」「小心心」

欢迎在评论区留下你的想法!

— 完 —

点亮星标

科技前沿进展每日见

觉得文章不错,微信扫描分享好友

扫码分享

企业资讯

查看更多内容