3D 行业的 "Agent 时刻 " 要来了?
文 / 秋秋
AI 时代,很多行业的工作方式都在经历巨变。
前段时间 GPT-6 Astra 上线,它能直接操作其他软件的特性,吸引了不少从业者的关注和讨论,游戏行业也不例外。有朋友表示,已经有不少团队开始拿它修模了。那这么说的话,现在 LLM(大语言模型)开始进入 3D 软件了,未来它会不会进一步,全面占领 3D 管线?
另一些从业者则有不同意见,他们认为能操作建模软件,不等于就能覆盖所有 3D 生成任务。涉及复杂几何、表面细节还原度、可控修改和审美表达的地方,AI 专业 3D 生成工具仍有自己的价值。

其实两边说的都有道理,那这道题还有没有第三种解法?比如把 GPT-6 和 AI 3D 生成工具结合起来,让 Agent 调用专业工具,做专业的事?
3D 生成的头部玩家影眸 Hyper3D就在做这件事。他们在 9 月 12 日分享了一个案例,一位 3D 艺术家用 GPT-6 和他们旗下的 AI 3D 生成产品 Hyper3D,一晚上做出了一款 3D 赛车游戏。

这个案例可以说把上面讨论的内容落在了实处,说明工具的组合使用,对大部分人来说已经没有太大的门槛了,甚至想用什么工具,Agent 自己选择和调用就行。换句话说,Agent 已经成为了 3D 生成的下一代用户。
巧的是,影眸 Hyper3D 刚好沿着这条路又往前走了一步。今天,Hyper3D 最新推出了智能交互模式 Agentic Mode,这相当于赋予了工具 Agent 化的能力:能理解意图、处理不完美输入、判断该走哪条建模路径。你想要手办雕像,它就给你高精度模型;你给一张工程图,它就换一条路,做出来比例准确还能修改的模型。
那些原本要用户来做的专业判断,直接被 AI 接手了,门槛又往下走了一截。叠加此前的自然语言编辑、拆件和 MCP 的基础上,影眸 Hyper3D 把这一整套与 AI 融合、为 AI 适配的全套能力 "Agent-Ready",其中 Agentic Mode 是这套能力的最后一块拼图。
过去,大家衡量 AI 3D 的成熟可能是看生成质量,但当 Agent 开始成为专业工具的新使用者,竞争维度也在发生变化。就像上面的案例,GPT-6 负责理解目标、调用工具,Hyper3D 提供专业的 3D 生成与后续加工能力。两边的优势一叠加,3D 生成的下半场或许来得比我们想象得更快,游戏行业的开发流程与管线,也将发生更剧烈的变化。
01
"Agent-Ready" 的最后一块拼图
前几天,一位创业公司老板告诉葡萄君,哪怕 AI 写代码再快,但只要还得人来一条条审核、修改,那整个流程的速度照样会卡在人这儿。如果真的想要提效,所有活都应该交给 AI 闭环,人只要做判断,然后动动嘴皮子就够了。
这也是目前 3D 生成面临的挑战。过去建模工具再强也只是工具,得靠老师傅准备素材、检查修改,在一旁盯着给 AI 擦屁股,如果工具自己没法包揽这些工作,那就很难真的实现好用,更别提给 Agent 用了。
而影眸 Hyper3D 过去一年,已经尝试一步步让 Agent 化的功能接手上面的工作:支持自然语言驱动的 3D Editing 和 BANG 递归分件,让用户可以持续深入创作;MCP 则让外部 Agent 可以直接调用 Hyper3D Rodin 的生成能力——现在差的,是工具怎么在输入层主动理解用户意图,并做出最正确的执行判断。
如今 Hyper3D 上线 Agentic Mode,补的就是这最后一块拼图。
具体来说,过去大家使用 3D 生成工具时,开工前多少都会被素材卡一下。比如你喂给工具的素材不完美,或者有文字有图片,又多又杂。
Agentic Mode 的一大功能,便是在素材的自主理解上。
一方面,Agentic Mode 可以消化不完美的输入,自动理解输入图片,并按需增强,减少用户自行处理素材、反复调整输入的负担。




再比如我输入了一张背景杂乱的图片,Agentic Mode 能准确抓住主体,把照片里没拍到的视角也补上,给出一个更完整、更准确的模型,减少背景和构图对生成结果的干扰。




过去你想建模,先得知道哪种生成方式更好用,比如角色雕像这类的模型是不是要追求生成的精细度?工业元件、建筑模型,是不是更看重比例准确、修改空间?这些都得专业知识才能判断。
现在,Agentic Mode 可以在你输入素材后先掂量一下你要什么,再决定怎么建——建模场景也拓展到了工业模型等更多生产领域。
比如它判断这个东西需要更精细的控制,就会用 Low-poly N-GONS 生成,出来的模型可以调尺寸参数、改材质色彩、加预设动画。







如果你觉得这还不够,那这套工具被 Agent 调用后,可能会发挥出更大的价值。
目前 Hyper3D 已经开放了 MCP,Claude Code、Codex、Kimi Code 这些 AI 工作台可以直接调用。比如上文提到生成 3D 游戏的案例,走的便是这条路。现在再加上 Agentic Mode 的能力,或许往后不懂行的普通人,能更有机会用一句话制作 3D 游戏。

02
3D 生成的下半场
当然,让工具接入工作流,甚至让 Agent 调用专业工具并不是新思路。Claude Code 这类 AI 工作台,还有 MCP 协议,这些东西都是大家摸索 Agent 工作流的产物。
GPT-6 的出现,更像是把这条路彻底打开了:大模型开始能直接操作 Blender、游戏引擎这些专业软件,那专门给 Agent 做工具,前景是不是也更大了?3D 工具的下一批用户,会不会就是 Agent?如果下一批用户真的是 Agent,工具需要为它们准备什么?

至此,3D 生成的下半场要开赛了,竞争的方向不再只有模型的生成质量、可控和可用性。
离眼前最近的,是工具理解、规划、生成的综合能力。
比如素材该怎么整理、该使用怎样的建模方式、怎么调整、怎么改……这些以前是人脑里的工作。现在哪个工具能接手更多工作,让每一步可控而非随机抽卡,它就能承接更多原本不熟悉 3D 的用户和任务。Agentic Mode 瞄准的就是这一点。

其次是怎么帮人类和 Agent 减负。
一方面是降低交互门槛。有人说过,自然语言是 AI 时代最好的交互方式,3D 生成工具要是能一句话生成、一句话修改、一句话拆件,对人对 Agent 都是好事,Hyper3D 能用自然语言驱动的 3D Editing 局部编辑和 BANG 递归分件做的就是这件事;
另一方面,则是把建模的能力做完整。如果能在同一平台完成全套建模环节,那自然 Agent 调用起来省心,人也对应可以更轻松了。

比如你可以在 Hyper3D 平台直接建模,可以在引擎中启用建模插件,也可以通过 API 接进自己的产品,或者通过 MCP 交给 Agent 用,适配的场景和流程都相对自由,团队不必为了用某个工具去改整套工作流—— Agent 时代,工具之间的开放和协作,只会越来越重要。

"Agent-Ready",这是影眸 Hyper3D 抵达的全新里程碑。简单来说,工具侧不能只等着被 Agent 调用,得在输入层(Agentic Mode)、互动层(自然语言编辑、拆件)和界面层(MCP)形成完整能力,往后无论是哪一个 Agent、用什么方式接进来,进入的都是同一个专业 3D 工作台。



再比如在游戏行业,MCP 也会让很多专业能力流动起来。
以前你研发游戏,公司用 UE5,你基本上只能在 UE5 里干活,或者自己折腾;但在 Agent 时代,你可以继续在 UE5 里用,也可以让 Agent 把不同的专业工具接进自己的流程里组合使用——当工具可以随意组合的时候,游戏行业的研发流程可能也会随之改变,未来不同规模、品类和背景团队的研发工具和工作流可能截然不同,工作流也会更按任务属性进行组织。

游戏葡萄招聘内容编辑,
点击「阅读原文」可了解详情
推荐阅读

(星标可第一时间收到推送和完整封面)