来源:新浪科技

"AI 很听话,但听懂话很难。" 许俊说,真正有价值的 AI 影像产品,不应只是根据指令生成结果,更重要的是让 AI 融入真实创作流程,降低门槛,让普通用户也能够完成需要专业经验才能实现的影像处理。
据许俊介绍,针对上述痛点,美图正通过 AI 重构影像创作流程,覆盖图像领域和视频领域。许俊以 Wink 举例称,传统视频精修通常需要专业人员逐帧调整,而 Wink 通过 AI 实现视频逐帧精修,用户只需修改单帧效果,AI 即可自动延展至整段视频。
在许俊看来,随着 AI 能力逐渐融入影像创作全流程,美图致力于将复杂技术能力融入精准可控和简单易用的产品体验之中,让 AI 从 " 听话 " 升级为 " 懂需求 "。
据介绍,当前,美图已形成覆盖图像、视频、设计等场景的 AI 产品矩阵。作为美图 AI 影像产品的创新引擎,最新的美图奇想大模型拥有专业视觉决策能力,支持文字、图像、视频、音频的多模态输入,结合美图在用户理解、审美偏好的深度积累,能够精准理解用户意图,并有设计师进行审美校准,助力 AI 产品效果优化。
许俊称,随着模型能力不断迭代,美图希望持续推动 AI 影像在生成质量、精准理解、创作可控性等方面实现突破,让普通用户也能轻松释放创作灵感,享受 AI 带来的生产力革新。