如果说过去几代 X 系列的关键词一直围绕长焦、人像和蔡司展开,那么到了 X500,vivo 明显试图把影像竞争推向另一个方向——动态影像。
发布会上,vivo 第一次将动态影像提升到公司级战略的高度,并提出要把手机做成 " 微电影神器 "。围绕这件事,X500 Pro 系列加入了 17EV 动态范围、4K 240fps、vivo Log 等一系列能力,vivo 还带来了一个颇为特殊的影像外设 " 随拍屏 "。
而在发布会结束后的媒体对话中,vivo 副总裁、产品副总裁黄韬,vivo X 系列产品高级总监赵典,以及 vivo X 系列产品组营销高级总监、vivo 高级产品营销专家丁冠力,又进一步解释了 X500 背后的产品逻辑。

而比单一产品更值得关注的是,vivo 对手机影像下一阶段竞争的判断正在发生变化。以下内容根据群访速记整理,提问和回答有删节。
问:发布会上 vivo 第一次把动态影像提升到了公司级战略。这是否意味着 X 系列未来的影像竞争重点会从拍照转向视频,研发资源也会向视频倾斜?
黄韬:我们确实把动态影像定到了公司级战略的高度,但这不是今天才做的决定。
回顾过去几代产品,无论 Ultra 还是 Pro,我们的视频能力在安卓阵营一直比较领先,影像领域的重大资源投入其实几年前就已经开始。
为什么现在把动态影像放到这么重要的位置?本质还是用户需求和场景决定的。现在大家看得多、转发多、点赞多的内容,绝大部分都是视频,视频已经成为用户表达观点和情绪最主流的内容形式,所以我们一定要把视频做好。
但这并不意味着研发资源从拍照转向视频。我们的思路是在稳固拍照能力的基础上,把视频也做到行业领先,让静态影像和动态影像并驾齐驱。
而且视频对整个系统专业能力的要求远高于静态拍照。如果视频能够真正做好,拍照涉及的很多技术环节其实都可以覆盖。
问:vivo 还准备推出云台相机。为什么要进入这个品类?它是视频战略的一部分吗?
黄韬:蓝厂做事情的逻辑其实很简单,就是围绕用户场景。
视频已经成为用户最主流的表达形式,所以我们要把视频做好。回到视频场景,就要思考应该给用户提供怎样完整的解决方案,需要什么就补什么,只是有先后顺序。
比如这次的随拍屏,不是因为行业里没人做,也不是单纯为了补一个品类,而是我们看到用户在真实场景里的需求。
云台相机也是一样。我们回到内容创作者的创作场景,认为他们需要这种新的影像产品,所以开始筹备这样的产品。大的逻辑就是:用户在这个场景里需要什么,我们就提供什么。
问:X500 Pro 系列这次很多影像能力与天玑 9600 Pro 有关。除了平台本身提供的能力,还有哪些是 vivo 独家的?
丁冠力:vivo 和联发科已经合作很多年,联发科有多位工程师长期在 vivo 设有工位。我们一直把联发科称作 vivo 高端突破之路上的合伙人。
双方合作已经不只是性能上的调校、调优、定义和定制,在 X 系列影像上也进行了长期共研,甚至会参与前置定义。
这一次是双方在影像定义深度和技术覆盖面上最大的一次合作,目前有四项独家能力。
第一是融合 V3+ 和 VS1 两颗芯片的影像能力;第二是 NPU 相比去年大幅升级,带来了最高 60 帧的对焦能力;第三是把 Log 做到硬件化,把过去需要通用算力完成的事情交给专用硬件,降低高规格视频录制的功耗;第四是长焦上的 XDZ 超分算法。
比如 Log 硬件化这件事,其实是双方提前三年共同规划的。我们会把用户洞察带给合作伙伴,再一起去定义未来的芯片能力。
赵典:我补充一个细节。2024 年我们和联发科沟通天玑 9600 Pro 的时候,联发科原本长期重投的主赛道主要是 GPU 和 AI。
当时我们经过很多轮沟通,把影像加入了他们未来的规划。这个过程我印象非常深,因为这不是产品发布前一年才去谈这颗芯片,而是很早就开始共同定义。
问:这次视频防抖的提升,主要来自硬件结构还是算法?
丁冠力:过去谈防抖,首先是 OIS,也就是机械运动;早期的视频防抖更多是算法补偿,本质上是裁切。
但到了 120 帧甚至更高规格的视频,每一帧之间都要稳定,还有一个非常重要的部分是运动感知。手机需要调用重力传感器、加速度传感器等,提前预判机身接下来可能发生的抖动方向,再做算法补偿。
所以这次不是单独某一个环节,而是三件事协同:大角度云台防抖、软件补偿和运动感知补偿。
问:今年 X 系列第一次出现 Pro Max。X500 Pro Max 和 Ultra 到底是什么关系?Ultra 的定位是不是发生了变化?
赵典:我们过去一直坚持 " 做影像最好的手机 ",这个定位主要由 Pro 承担。
但这两年我们发现,高端用户里喜欢小屏的人反而越来越多,此前 X200 Pro mini 的尝试也很成功。所以我们希望形成一个组合:既有大屏,也有小屏,同时影像都很强,Pro Max 就是在这个背景下出现的。
Pro Max 的定位本身没有变,依然是 " 影像最好的手机 ",所以它自然会下放一些 Ultra 的能力。
但 Ultra 依然有非常大的独立空间,它的定位也没有变化。Ultra 会更加聚焦先锋用户和创作者,是公司影像能力集大成的载体。
这些极限影像能力有时会对机身空间以及其他体验产生影响,但专业创作者对这些事情的宽容度更高。有些人会完全把手机作为创作工具,或者把 Ultra 当成第二台手机、备机,所以 Ultra 可以更彻底地释放极限影像能力。
接下来我们还会沿着这条路线继续走。
问:所以 X500 系列还会有 Ultra?Pro Max 以后也会一直存在吗?
黄韬:X500 Ultra 肯定会出,预计明年三四月份发布,目前产品很多方面已经基本定案。
Pro Max 的定位未来应该也会长期保留。
本质还是刚才讲的,高端用户里有两类人,他们对性能和影像都有很高的要求,但对屏幕尺寸的偏好不同:有人喜欢更大的屏幕,有人更看重手感。
这两类用户一直存在,所以我们的产品规划组合也会持续匹配这样的需求。
问:为什么要把 Live Photo 做到 8K?对普通用户来说,4K 电影感 Live 是不是更实用?
赵典:8K 的使用率确实会比 4K 低,但我们还是希望把高规格作为一种工具提供给用户。
而且 8K 没有大家想象得那么 " 高不可攀 "。8K Live Photo 折算成一张照片,也就是 3000 多万像素,而现在手机照片已经经常做到 5000 万、1 亿甚至 2 亿像素。
与此同时,4K 可以叠加更多复合能力,比如电影色彩、人像美颜、不同帧率和画幅选择,也可以做到 " 三步直出 "。
这两件事并不矛盾。
一部分偏专业的用户并不需要我们替他做好色彩和后期,他们需要的是原始素质足够高的素材,然后自己去剪辑。而 Live Photo 这种形式本身也为裁切和后期留下了比较大的空间。
两个方向我们都会继续做。
问:随拍屏是一次尝试,还是 vivo 会长期做这类影像外设?未来有没有可能兼容其他手机?
赵典:最开始的需求来源其实很有意思。
团队里有一位同事给我看了一段视频,一个女性创作者讲自己一个人出去创作时遇到的困扰。她是比较内向的 "i 人 ",摆造型已经觉得不好意思,还要请别人帮忙拍,就更加困难。
这个视频让我们产生了做随拍屏的想法。
后来我们发现,这在专业创作里也是很普遍的需求。无论直播还是俯拍等特殊机位,用户经常看不到手机屏幕。
拍照片还好,但视频对掌控感的要求更高。一段素材可能几百 MB,甚至一两个 GB,拍完以后却不知道到底有没有拍到,这是非常受挫的体验。
市场上其实已经有很多类似产品,但大部分被定义成 " 自拍屏 "。自拍当然很重要,但我们觉得它还应该覆盖更多场景,所以这次拓展了很多模式,尤其针对视频监看重新做了一套 UI。
后续支持更多模式、更多官方应用,包括可能支持更多其他手机产品,都已经在开发中。
这对我们来说是一条长期路线。所有这些外设,都会以手机影像为核心向外拓展。
问:4K 240fps 对 Sensor、ISP、存储和散热的要求都非常高,真正落地最大的难点是什么?下一阶段 vivo 视频竞争的重点又是什么?
丁冠力:4K 240fps 有几个关键点。
首先是 Sensor 自身的读出速度,因为要处理巨大的数据量;第二是算力,系统能不能消化这些数据;第三是自研算法的效率能不能匹配数据读出的需求。
再往整机层面,还有散热、功耗以及持续稳定性等问题,所以这是一项非常系统的能力。
未来我们的方向可以概括成三个部分。
第一,把专业用户创作的上限继续往上抬,让手机真正有机会进入专业创作者的工作流。像 ACES、vivo Log 等,都是在解决这部分需求。
第二,把普通用户拍视频的门槛降下来。视频相比照片对大众用户依然有明显门槛,所以这次我们反复强调 " 三步 " 完成电影感视频。
第三,是底层持续建设蓝图动态影像技术栈。
也就是一个上限、一个门槛,以及一套底层能力。这三件事情会同步向前。
问:现在手机续航、防护、性能和影像都在争夺内部空间,vivo 是怎么决定哪些东西更重要的?
赵典:从前年开始,公司在开发端一直贯彻一套 " 整机工程 " 的方法论。
它不是纯技术层面的事情,而是帮助产品建立决策逻辑。我们会把产品所有赛道放到一张雷达图里,再根据用户需求的重要程度和满意度去做权衡。
这里面会有需要重点突破的 " 进攻型 " 赛道,也有 " 机会型 " 赛道,还有一些用户满意度已经很高,只需要维持的 " 防守型 " 赛道。
因为每个技术团队都希望自己的方向做到最好,但手机内部空间有限,所以必须在整机层面做取舍。
比如续航。前几年电池技术快速发展后,用户满意度已经有了明显提升。现在 7500mAh 和 8000mAh 对实际体验的差异已经没有那么大。
所以我们现在更关注 DOU。如果 95% 的用户一天使用已经绰绰有余,我们宁愿把更多内部空间让给 SoC 或影像。
问:X500 相比上一代,视频真正发生质变的地方是什么?
黄韬:X500 系列是蓝图动态影像技术栈第一次全面落地的产品,五大核心技术标准都在这款产品上落地。
像动态一致性、防抖、电影色彩这些方面,大家的感知提升可能没有那么明显,因为我们过去不是从零开始,X300 Pro、X200 Ultra 的视频表现已经不错。
但动态范围的提升非常明显。
X500 Pro 系列可以做到 17EV,而 X300 Pro 大约是 14EV,相差 3 档,能够容纳的明暗跨度就是 8 倍。
尤其拍摄大光比场景时,这种差异是可以直接看出来的。
对于视频来说,动态范围是非常基础的能力。首先要把眼睛看到的真实场景拍下来。如果这一步都做不到,后面的能力其实都是空中楼阁。
赵典:视频和静态拍照的底层思路确实不太一样。
静态照片里算法可以发挥非常大的作用,但到了动态影像,芯片、算力稳定性、功耗都会产生影响,软件算法也必须一起匹配。
所以它是一个非常系统性的工程。
我们做视频已经做了很多年,但一直没有对外讲 " 视频是下半场 ",直到今天才敢讲。
原因就是到了今天,SoC、Sensor、算法几个方向终于同时达到了匹配的程度。
不是说买一颗 LOFIC Sensor 回来,视频马上就能做好。它需要多个技术方向同时汇合,而且需要很长时间。
丁冠力:如果把话题从视频扩大到整个动态影像,其实还有一个提升非常大的东西,就是 Live Photo。
过去全行业的 Live Photo 更多是 " 会动的照片 ",但这一次我们的 Live Photo 完全按照视频规格去做。
视频的一致性、色彩、风格,Live Photo 全部打通。
我们这次还提出了 Live Moment 的概念:用户不一定需要专门拍视频,每次按下快门的时候,它都会附带一段 3 秒的高质量短片。
所以 Live Photo 本身也是动态影像非常重要的一部分。
问:为什么这一代主摄选择重点突破动态范围,而不是继续做更大的 Sensor 或更高像素?
黄韬:不管静态还是动态影像,最基础的事情都是还原眼睛看到的真实场景。
静态照片里,这件事情现在相对容易解决,可以通过长曝光、多帧合成。但长曝光、多帧合成可能意味着一张照片需要 3 秒,而视频一秒钟可能要拍 120 张,难度完全不一样。
现在视频最基础的问题依然是,拍出来和眼睛看到的差异很大。
比如逆光场景,人脸看不清,落日和晚霞也看不清,那么这段视频本身就失去意义。
所以现阶段动态范围是帮助用户还原真实画面的基础能力。
像素再高,如果最后拍到的还是一片白或者一片黑,也只是让这些白和黑变得更清晰,没有意义。
赵典:我们和索尼定制这颗 Sensor 大概用了两年。
为什么没有继续追求更大的底?因为视频是一个综合结果。
我们现在 1/1.28 英寸的主摄,整个模组尺寸已经和过去的 1 英寸方案接近,但我们还要加入 3 ° 大角度云台防抖,这对空间是很大的考验,同时还要考虑焦段等问题。
手机内部空间毕竟有限。
我们认为动态范围、防抖等几项能力同样重要。动态范围很好,但拍出来一直抖,也没有意义。
问:X500 主打电影感视频。vivo 怎么平衡影像里的 " 真实 " 和 " 出片 "?
丁冠力:首先,真实和风格并不是互斥的。
真正有价值、大家喜欢的经典风格,一定建立在准确的基础上。如果白平衡和色彩本身都是错的,很难说它是一种风格,它可能只是不准确。
所以我们首先会把静态和动态影像的准确还原做好,再在这个基础上叠加风格。
而且我们做风格不是简单套一个滤镜。一方面会学习过去电影、摄影中的经典作品,另一方面会从 Log 管线开始,把我们对于色彩的理解在视频拍摄过程中就进行标记、融合和设计。
赵典:过去我们比较擅长 " 讨喜 ",以前做用户调研,主要面对的也是普通用户。
但这两年我们的沟通对象发生了变化。新一代创作者并不一定需要所谓讨喜的风格,他们更希望准确还原,然后自己做后期。
所以现在我们两条腿都会走,大众用户和专业用户都会覆盖。
像 " 原生光影 " 就是我自己特别喜欢的模式,它暗部的处理很有相机感。我觉得它是 " 最没有数码味的数码胶片 "。
问:现在有一种观点认为移动影像已经进入瓶颈,很难再出现大的突破。vivo 怎么看?
黄韬:" 移动影像到了瓶颈 " 这个说法,我其实是认可的——过去确实到了一个瓶颈期。
因为大家一直在卷静态影像。从最早的夜景,到人像,再到前两年的长焦,最后长焦在专业层面的差异可能只有 100 线左右,需要在电脑上放大很多倍才能明显看出来。
但动态影像不一样。
无论视频还是 Live Photo,我们都认为还有非常大的提升空间。
而且视频是一个比静态拍照复杂得多的系统。一会儿要讨论动态范围,一会儿要谈防抖、Log、色彩。
我们一直有一个理念:越复杂的系统,我们越觉得有机会把它做好。
因为可以把用户体验拆成具体的技术问题,再设定标准,把每一个环节慢慢做到足够好。
我们不希望只把某一个单点拉得特别高,然后拿出来做宣传。蓝厂比较擅长 " 慢跑 ",一点一点去打磨。当一个复杂系统里的很多模块都做到足够好之后,它反而有机会成为我们的护城河。
问:摄影助手已经使用了 AI,但现在更多还是给用户建议。未来它会不会变成一个真正能直接替用户操作的影像 Agent?哪些事情必须留给用户自己决定?
赵典:Agent 就是副驾,Agent 不是主驾。不论普通用户还是专业用户,我们都不可能把按下快门那一下的权利和自主性剥夺掉,AI 一定是尽可能辅助用户。
沿着 Agent 这条路线,我们已经规划了更多能力,尤其是拍摄前和拍摄后,会在后续产品里逐步落地。
拍摄前,可以把用户零零散散的想法整理起来,帮他做规划和拍摄建议;拍摄后,可以帮用户更高效地筛选素材、进行初步粗剪。
有些用户出去一天可能拍八九个小时素材,回来光重新看一遍又要八九个小时,而且连续看下来前面的内容可能已经忘了。
这种工作量非常大,AI 在这里有很大的空间。
黄韬:大家经常开玩笑说,现在 AI 能写诗、能唱歌,我们最喜欢做的事情 AI 都会做;但我们最不想做的事情,AI 反而做不了。
AI 创作助手也是类似的思路。
我们希望 AI 帮用户处理最繁琐、最不能产生价值、最没有乐趣和成就感的事情。
但创作本身,比如用户到底想拍一种什么样的感觉,最终还是应该留给用户。
只有这样,创作才有乐趣和成就感。
问:X 系列现在最突出的标签还是影像。除了影像之外,vivo 怎么让用户长期留在这个品牌?
黄韬:我们非常在乎用户真实的使用体验。
公司评价一款产品时,NPS,也就是净推荐值,是最基础的指标。一款产品卖得再好,如果 NPS 不好,没有做到行业领先,那在我们看来也不是一款优秀的产品。
所以不只是产品团队,影像、信号、耐用,包括 OS,各个技术模块都会非常重视 NPS。
影像在这里扮演的是让用户产生惊喜、超越预期的角色。
不过我也想强调一点。我们今天一晚上都在聊影像,网上也经常有人说 " 蓝厂主要是影像好 ",但这句话背后好像意味着其他地方不太行。
实际上我们的 OS 也非常好用。可能是因为影像这块板现在太突出,导致其他部分容易被忽略。这次 OS 7 我自己也在用,包括原子工作台。我以前用直板机比较少,但现在确实已经离不开 X500 上的原子工作台了。
总结
从这场群访来看,vivo 对 X 系列下一阶段的规划已经相当明确。
Pro Max 和 Ultra 并不是简单的大杯、超大杯关系:前者会成为面向主流高端用户的长期产品形态,后者则继续承担更激进、更专业的影像探索。而从随拍屏到正在筹备的云台相机,X 系列的边界也开始从一台手机向一套围绕移动创作建立的影像系统扩张。
更重要的变化还是视频,当静态影像越来越接近一个需要放大才能看到差距的阶段,vivo 显然希望把下一轮影像竞争放到动态范围、防抖、色彩、Log、Live Photo 以及专业工作流这些更加复杂,也更加难以依靠单一硬件参数解决的问题上。
X500 是蓝图动态影像技术栈第一次完整落地的产品,但从 vivo 对 Ultra、云台相机乃至影像 Agent 的描述来看,它更像是这条路线真正开始产品化的第一步。