千问团队发布Qwen3.8-Omni-Flash 全模态模型,可在同一工作流中处理文本、图像、音频和视频,支持 100 万 Token 上下文。
官方称,该模型在 30 项评测中的平均得分较 Qwen3.5-Omni-Plus 提升超 26%,重点提升了音视频智能体、编程、长上下文及实时多模态交互能力。模型可用于长视频分析、会议纪要、视频研究和多模态工具调用。
千问同时开源了 Qwen-MM-Plugins 和 Qwen-Live Harness,分别面向长程任务和实时交互场景;多模态输入 API 价格最低为 0.8 元 / 百万 Token。