
看完 X 上那些演示,很难不想自己上手爽蹬一把。
糖豆人式的闯关游戏、铺满楼房和道路的模拟城市,已经有人用 Astra 做出来了。

这架势,很有点「再不送点额度,大家就都跑去隔壁了」的意思。
OpenAI 这边也在送。Tibo 宣布,Plus、Pro 和 Business 用户还会再拿到一次可留存的完整重置机会。

我们也把 Astra 和 Fable 5.1 拉来试了一轮。开唱片店、做小游戏,顺手还把 APPSO 的 Logo 发给了 Astra。
把 APPSO 做成游戏
这张图里有不少现成的形状。A 有斜面,两个 P 都有一段圆弧,S 可以做弯道,O 可以做环形终点。
我把这些想法写进提示词,具体怎么连接,交给模型。

我要求用 WASD 或方向键控制小球,有障碍、有碰撞,掉下去可以从检查点继续。最后滚进 O,镜头拉远,再看一遍整座 Logo。
GPT-6 交回来的页面叫「APPSO PLAY LAB」。白色字母有了厚度,落在一块红色底板上。字母之间用透明小桥连接,沿途铺着红色圆点。两个 P 的圆洞、A 左下角的独立圆点,都复现的特别好。

它还给页面写了「让灵感,滚起来」,把玩法带进了标题。红白配色从关卡延续到按钮,页面周围留了不少空白。
点下「开始冒险」,就能控制那颗小白球。录下的这段试玩里,下方进度从 A 走到了第一个 P,途中也掉下去过几次。界面会提示「掉下去也没关系,马上回到检查点」。

Matthew Berman 在 X 上发过一个糖豆人式闯关游戏,说用了两条提示词。我也想试一款闯关游戏,把场景换成中式鬼怪世界。

周围可以有浮岛、石像和红灯笼。远处的青铜门要够大,玩家一开始就能看见自己要去哪里。
这道题没有给参考图。角色长什么样,云海铺在哪里,灯笼和石像怎么摆,都要模型自己安排。除了画面,我还要求有其他小妖一起跑,让这条赛道热闹一点。
控制方式仍然简单:移动、跳跃,掉落后重来。镜头跟着角色走,要能看清起跳点和落脚处。
先看 GPT-6 做的这一版。小妖戴着黑帽子,提着灯笼,不同颜色的围巾能把角色区分开。桥头是青绿色屋顶和红色立柱,石桥两侧挂着铜钟,远处的山石隐在雾里。

这局画面里有 9 只小妖,晋级名额只有 6 个。出发时大家挤在桥头,没多久,其他小妖就跑到了前面。途中出现过「小妖不服,再跑一次」的提示,角色回到前面的路段继续跑。
到了第二段,石桥变成一连串圆形八卦台。红色横杆在台面上旋转,其他小妖也会从旁边经过。

最后一段是开合的鬼门。这局跑到终点时,画面显示第 4 名,已经占了一个晋级位置。终点亮起一片金光,几只先到的小妖留在那里庆祝。

Fable 5.1 的版本先用一段镜头带着我看赛道。红色门板一扇接一扇,暖黄色的灯笼沿着石桥排开。浮岛下面是青色的雾,石砖和铜钟上的纹理也更显眼。

它把小妖做成了不同颜色的圆团子,起点排着 6 只。石桥边的灯笼有很明显的光晕,远处的岩石轮廓藏在雾里。这道题里,我更喜欢 Fable 的画面。


这轮试下来,如果继续打磨小妖游戏,我会先留下 Fable 这版画面,把方向和镜头的问题处理好。GPT-6 这边,我更想给 APPSO Logo 乐园加一关,看看它能不能把那个 logo 结合 APPSO 的理念再魔改一波。
回到跑分表现上,APPSO 特意整理了六个维度的指标,把 GPT-6 和 Fable5.1 放在一起对比一下。两家对比下来还是各有胜负。

除了改 Logo,我们也让两边做了老生常谈的测试——网页制作。
第一家店叫「凌晨一点」。两边都摆着《雨停以前》《便利店凌晨三点》等唱片,做出来的感觉却差得很远。
GPT-6 用了米白底和大块红色。首屏左边写着「把夜晚,放慢一面」,右边是一张露出黑胶的红色唱片封套。下面的商品封面各有颜色,标题和价格都比较醒目。

顶部还显示了「现在 09:50,天亮了,我们还没走」

只看这两张页面,我更喜欢 Fable 的封面。GPT-6 的页面更亮,商品信息更容易扫到。Fable 的小字偏暗,缩到手机上看会费力一些
GPT-6 和 Fable 5.1 谁的审美更好
再来一个没有标准答案的测试:做一个自己认为最有美感的动态 HTML 页面,内容不限。
GPT-6 做了「月屿 LUN 」。左边是大幅英文排版,右边是一片海,光从海平面一直照到近处。页面下方有「月夜」「蓝调」「破晓」三个选项,还有一条潮汐滑杆。

录屏里从暖色的破晓切到蓝调,太阳换成了弯月,水面的反光也跟着变冷。拖动潮汐滑杆时,水面仍然在动。暂停按钮按下后,旁边的文字变成「让此刻停留」

它还做了一个隐藏大部分文字的沉浸画面。只留下月亮、海和一句「Breathe in. Breathe out.」


Fable 5.1 选了二十四节气。页面是浅灰蓝底,大号的「立冬」竖着放在左边,右边画了一圈节气刻度。往下是三候和全年节气表。

还有一些进步,这些案例都看不出来
刷多了这些演示,其实也会有点眼熟。又是一个小游戏,又是一个漂亮网页。
连我们自己,这次也没少做。
因为它们确实好展示。画面够不够漂亮,放一张 GIF 就有感觉。但一个要做很久的任务,模型能不能记住前面的要求,遇到问题能不能接着往下做,就很难用十秒钟讲清楚。科学推理也是如此,一段解答到底有没有推进问题,需要懂这个领域的人仔细看。

我手头还有一个叫 Paperweave 的项目,是自己搭的研究工作台。读论文、记笔记和写作,甚至命令行,都放在了同一个地方。这个学习小工具一开始是测试 Fable5.1 能力的,今天又被 Astra 接手继续完善。
这个由 Fable5.1 创建,GPT-6 继续完善的小工具,解决了我在日常工作流程中绝大部分的割裂感。

Google DeepMind 联合创始人 Demis Hassabis 在今年 2 月的一场校园对谈里,被问到怎么借助 AI 加深理解,同时保留自己思考的过程。

了解一个领域多一点,问题往往也会具体一点。遇到没学过的东西,也可以边问边读。AI 解释完,再拿原文对照一遍。
OpenAI 这次也把分析科研数据、操作专业软件列进了 Astra 的应用介绍。官方介绍这些用途不像小游戏那样,一打开就能吸引人。

这就到 AGI 了吗?
这次发布 GPT-6,OpenAI 总裁 Greg Brockman 表示,已经来到了 AGI 时代。

OpenAI 在这次介绍里,专门提到了一个改进:用户中途补充要求或改变方向,GPT-6 要能接着做原来的任务,保留之前的要求。
而且,任何你在电脑上做的工作,GPT-6 都能很快地帮你完成咯。
下面这个短片里,大概是我们喊了几年 AGI 之后,第一次感受到贾维斯已经要成为现实了。
这其实也是大家想接着用下去的地方。
游戏虽然做出来了,后面说一句「这关不好玩」,它能不能理解我的意思,改出让我愿意再玩一局的版本?
是不是 AGI 我不知道,但我对下一次更新的愿望倒是很清楚:画面继续好看,修改时少让我来回解释,交付满意率越来越高。
这样,做自己的小游戏,也能多留点时间给自己玩。
我们正在招募伙伴
简历投递邮箱hr@ifanr.com
邮件标题「姓名 + 岗位名称」(请随简历附上项目 / 作品或相关链接)
