关于ZAKER Skills 合作
手机中国 18小时前

阿里发布 Qwen-Image-3.0:支持 4.5k Token 超长输入

【CNMO 科技消息】7 月 21 日,阿里发布最新图像生成基础模型 Qwen-Image-3.0。该模型支持最大 4.5k Token 超长输入,可一次生成涵盖公式符号、几何图形、逻辑推导步骤等多元素融合的知识图解、复杂 UI 界面,同时支持 12 国语言和 20 多款字体原生渲染。

据 CNMO 科技了解,Qwen-Image-3.0 是千问图像生成和编辑模型系列的第三代基础模型,对于 GPT-Image-2 擅长的直播间页面,Qwen-Image-3.0 也能轻松生成。

Qwen-Image-3.0 着重提升了模型对于复杂信息的承载能力,较前代在文本输入长度上实现了 4.5 倍的跃升。这意味着,在影视短剧分镜、复杂信息图、产品说明页等需要超长提示词输入的场景中,用户不再需要将需求压缩成一句话,而是可以像给设计师撰写需求文档一样,完整描述画面结构、文字内容、视觉风格和排版细节,减少反复生成和人工调试成本。凭借 Qwen-Image-3.0 对语义并置和空间控制能力的把握,新模型可一次性生成涵盖 9 种不同领域的 9 宫格知识图解。

此外,Qwen-Image-3.0 还能轻松理解复杂指令和画面的逻辑嵌套关系,可根据一条指令在同一幅图中生成网页、软件界面、聊天窗口、海报等多类组合式视觉内容。

版权所有,未经许可不得转载

相关阅读

最新评论

没有更多评论了

觉得文章不错,微信扫描分享好友

扫码分享

热门推荐

查看更多内容

企业资讯

查看更多内容