关于ZAKER Skills GEO服务 合作
亿欧 5小时前

网易有道段亦涛 :AI 交互从“轮次对话”走向实时 , 人机协作进入“双脑”时代

9 月 16 日,网易有道「NEXT,AGENT|有道 AI Open Day」在北京举办。

亿欧现场获悉,网易有道集中展示了覆盖办公、学习、营销等多场景的 AI Agent 产品矩阵与最新技术成果。

网易有道首席科学家段亦涛在演讲中分享了有道在大模型与 AI 原生产品领域的最新进展,并重点介绍了网易有道围绕实时语音交互以及深度研究 aAgent" 有道有据 " 展开的最新实践。

段亦涛表示,随着大模型能力不断提升,AI 交互正在从传统的 " 轮次式交互 " 走向更加自然的实时交互。过去人与 AI 往往是 " 我说一句、你说一句 ",系统能够明确判断何时输入结束、何时开始回答;但在实时语音场景中,模型每时每刻面对的都是不完整的信息,需要持续判断 " 继续等待还是马上输出 ",因此实时交互本质上是一个同时追求低延迟与高质量的问题。

围绕这一方向,网易有道此次带来了两款开源子曰 Live 模型——流式语音识别模型 R2T2 和流式同声翻译模型 T3PO。其中,R2T2 强调 " 真正的流式 ":与部分流式方案先快速输出、随后再回改结果不同,R2T2 通过稳定前缀学习,让已经输出的内容保持稳定,做到 " 只增不改 "。段亦涛认为,这种能力对于实时字幕、语音输入以及未来的语音 Agent 都有重要价值。

而在实时翻译中,最大的技术挑战同样来自 " 既要又要 ":既要足够快,又要保证翻译质量。为此,T3PO 采用多目标优化思路,在翻译质量和延迟之间寻找更优平衡。随着多模态、推理、翻译、语音以及实时交互能力不断完善,子曰也正在从单一模型进一步发展为覆盖不同 AI 能力的模型矩阵

除了模型能力,段亦涛此次还重点谈到了另一个判断:模型并不等于完整的 AI 产品,Harness 决定了模型如何真正进入工作流、产生价值

基于这一思路,有道推出深度研究工具 " 有道有据 "。不同于单纯依靠大模型生成答案," 有道有据 " 连接了专业论文、文献、专利、法条等专业数据,并重点强化结论与证据之间的核验能力,力求让重要观点能够找到对应的信息和文献支撑。同时,它拥有自己的运行环境,不仅可以完成问答,还可以进一步完成论文、PPT 等复杂任务。

在段亦涛看来,更重要的是," 有道有据 " 背后代表了一种不同的人机协作理念。面对 AI,人们真正需要思考的并不只是 " 哪些职业会不会被 AI 取代 ",而是两个问题:人在完成任务的过程中创造了什么独特价值完成任务之后,人自己有没有获得新的积累和成长?只要人在过程中持续创造价值并形成沉淀,AI 就不只是任务的替代者,而会成为放大个人能力的工具。

因此," 有道有据 " 并没有把人与 AI 的交互限制在传统的线性对话中,而是允许用户从任意一个思考节点继续追问、发散,并通过项目、笔记、标注等方式不断组织和沉淀信息,让 AI 能够跟随人的思考过程共同推进研究和创作。

段亦涛将这种关系总结为一句话:"‘有据’既是一个模型的 Harness,也是一个人脑的 Harness。" 在他的设想中,未来真正有价值的 AI 产品,不应该只是一个替人完成任务的 Chat,而应该成为一个 " 工作台 + 活的助手 "——人在使用 AI 的同时,也不断积累自己的知识、判断和方法,实现 " 双脑合作,1+1>2"。

从实时语音交互到 " 有道有据 ",背后体现的是同一套 AI 原生产品思路:模型能力需要进入具体场景和工作流,而 AI 最终的价值,也不只是帮用户更快完成任务,更在于帮助人与 AI 一起思考、一起成长

相关阅读

最新评论

没有更多评论了

觉得文章不错,微信扫描分享好友

扫码分享

热门推荐

查看更多内容

企业资讯

查看更多内容