关于ZAKER Skills GEO服务 合作
钛媒体 1小时前

RSI “出圈”背后:AI 自我进化,卡在了哪里?

图片来源:unsplash

RSI(递归自我改进)火了。

这个聚焦于 AI 自我演进的概念,似乎在业界、学界连定义和标准都来不及统一的情况下,就快速进入了落地阶段。

近半年来,OpenAI、Anthropic、Google DeepMind 等前沿 AI 实验室和初创公司频频提及 RSI 方面的进展。尤其 9 月中旬以来,Anthropic 和 OpenAI 数次预警 RSI 的失控风险,甚至呼吁放缓研发进度,为安全保障争取时间。国内方面,RSI 的技术演进和判断也更多走向台前,智谱创始人兼首席科学家唐杰 9 月 17 日披露公司首个 RSI 方向的工程化实践,并将下一代 " 完全自训练 " 模型 GLM-6.0 的核心技术定位类比为 RSI;小米则在 9 月 22 日发布 MiMo-V2.6 系列模型,称之为 " 探索 RSI 的关键一步 ";阿里巴巴集团 CEO 吴泳铭则在云栖大会演讲中提到,目前人们摸索出通往超级人工智能的具体技术路径就是 RSI,他还透露,Qwen 团队正在进行 RSI 方面的探索,并取得了一定的进展。

相关呼吁、讨论和实践引发的观感不一,但资本市场的反馈则相对积极。对 " 减速 " 的焦虑短暂导致波动后即被抛诸脑后,RSI 叙事迅速被推向前台,再加之 Meta 发布消费级个人 AI 代理 Muse 等爆点事件,让此前因 2028 年 Capex 能见度不足、开源模型竞争压力、头部 AI 厂 ARR 增速放缓等承压的美股科技板块明显回暖。

资本市场的热度也进一步提高了 RSI 的讨论度。

一位国内 Vibe Coding 领域初创公司 CTO 称,近期已有多位不同领域的朋友跑来咨询 RSI 相关问题,但在他看来,很多理解还是 " 过于科幻 "。

他称,将 RSI 理解为模型能无间隔、利用一切时间来提升自己、完成进化 " 显得不切实际,至少离现实很远 "。目前的技术路径中,大模型不存在 " 在线实时学习能力 ",训练完权重就固定了,这与人类大脑有本质区别。而如果将其简单理解为模型的自我调整、优化,那在目前来说也不算是特别有开创性的新鲜事。

" 比如模型的迭代,0.1 的迭代也是研究员来定义和发起的。还是更类似于在一个固定态,将目标、方向和框架定下来,AI 在其中写了多少代码、完成多少研发,依然是执行者的角色。" 此前,Anthropic 公布数据称,旗下模型 Claude" 主导 " 的 AI 研发任务从 2 月的不到 1%,到 8 月已提升到约 26%。在该公司的界定中," 主导 " 在 AL0-AL5 的六级自动化标准中属于 AL4 级别,主要指人类在给出一个高层目标后,AI 完成大部分端到端工作,人类再负责监督和最终决策。前述 CTO 则认为,只要方向、目标和评估、决策两头的工作仍由人类负责,就意味着 AI 的改进仍被限制在一个固定线段中,其中的过程管理似乎都交给了 AI,看似是黑盒运行,但考虑到目前的自动化实践主要在代码领域,可以说这是确定性最高也最适配 AI 的任务了。他认为,总的来说,将目前披露的相关实践和演进视为现有技术路径的延续而非新故事的开端可能更为合适。但他也同时补充称,AI 在研发任务贡献中所占比例的提升,AI 研发规模的扩大,每达到一定数量级确实会带来新的技术、工程问题,也进而取得新的进展,但这其中是否存在一个技术上量变达到质变的奇点,目前还看不清楚。

而从这种理解延伸来看,当 AI 能胜任 " 发起到决策 " 的 " 两头 " 工作时,可能才更符合目前讨论中关于 RSI 的想象。而这既涉及技术、算法、训练范式等问题,更涉及组织、流程问题。

在此前 2026 ITValue Summit 数字价值年会的 AI Coding 专题闭门会中,多个团队透露,在自身开发流程中,AI 编程的端到端交付今年来取得显著提升,Agent 已能作为数字员工批量上岗。AI Agent 的贡献度很大程度上也被视为衡量一个组织 AI Native 成色的关键指标。但他们也同时给出一个共识判断,即总体目标、关键判断、最终结果仍由人类负责。在垂类行业中事情则更为复杂,AI 面临更多行业隐性知识、隐私数据的壁垒,传统程序员则被期待成为更懂业务的技术从业者,近期爆火的 FDE(前沿部署工程师)则直接将开发角色放置在业务现场。

而目前来看,对于 RSI 来说,能让 AI 接手 " 两头 " 工作的更多还是实验型任务,这些实验会让 Agent 在没有明确任务指令的情况下主动探索代码库、寻找潜在问题,或者让 AI 根据实验结果调整下一轮研究方向,比如近期较受关注的是 Weco AI 团队让 AI Agent 在 8 天的试验中自我改进自身代码的 AIDE 案例。但在真实的组织层面,AI 的 " 端到端 " 仍然被局限在较短的链路中,是否应该或如何在组织层面授予 AI 更高的权限,又如何界定其权责、进行问责,配套的监督、纠错、评估机制如何更新,这些显然超越了目前的人机协作范式,在成规模的组织中也少有探索。

或许,当 AI 在开发流程中贡献度占比达到一定量级,AI 落地真实场景达到一定阶段后,会出现更为前沿的 AI 组织形态,那可能才是 RSI 的最强加速器和验证器。

当然,需要提及的是,目前也有不少声音认为,RSI 本身是 " 伪概念 ",或认为延续当前技术路径不可能出现 RSI。一位本地模型初创公司创始人即认为,目前的云端大模型、Transformer+ 自回归生成范式无法形成创造力,无法解决人类未解决过的问题,只能在人类设定的框架中运行," 路越走越窄 "。

在 RSI 概念热度升高、逐渐 " 破圈 " 之际,更多技术路径、底层架构、组织形态的探索和理论框架也在被重新讨论。在一种关于未来的想象逐渐具象化的过程中,往往会诞生更多意料之外的变革和突破。(本文首发于钛媒体 APP,文|飞向 Tai 空,作者|胡珈萌,编辑|杨林)

觉得文章不错,微信扫描分享好友

扫码分享

热门推荐

查看更多内容

企业资讯

查看更多内容