ITBEAR科技资讯
网站首页 科技资讯 财经资讯 分享好友

Qwen-Image-3.0重磅上线千问AI平台 三大升级让AI图像生成从“好看”变“好用”

时间:2026-08-06 04:04:20来源:快讯编辑:快讯

阿里巴巴旗下千问AI平台近日迎来重大更新,其自主研发的图像生成模型Qwen-Image-3.0正式向全球用户开放使用。该模型同步推出旗舰版Qwen-Image-3.0-Pro与标准版Qwen-Image-3.0-Standard,API接口已全面上线,单张文生图价格低至0.18元起。海外用户可通过Qwen Cloud服务直接调用,国内用户则可在千问AI平台及阿里云百炼平台体验。

技术突破方面,Qwen-Image-3.0实现三大核心升级。在输入处理能力上,模型支持最长4.5k token的文本输入,较前代提升4.5倍。用户可像撰写设计需求文档般详细描述画面元素,包括结构布局、文字内容、视觉风格及排版细节,模型能精准生成报纸版面、影视分镜、数学试卷等复杂场景图像。实测显示,在文字对齐、微观细节还原、多图叙事连贯性等维度均有显著提升。

多语言与字体支持成为另一亮点。模型原生兼容12国语言及20余种字体渲染,即使提示词包含中英韩等多语种混合内容,也能确保文字完整输出,避免缺字、乱码或变形问题。在知识图解生成场景中,模型可同时处理公式符号、几何图形、逻辑推导步骤等多元要素,轻松生成包含精确文字、图表及漫画人物的知识卡片。

细节表现力方面,模型突破性实现10像素小字精准渲染,毛孔、发丝等微观质感还原度大幅提升。在人像摄影、古碑拓片等场景中,模型展现出强大的细节还原能力,文字清晰度、画面层次感及复杂构图渲染效果均达到行业领先水平。国际评测平台Arena.ai最新榜单显示,该模型在中文文生图领域位居国内首位。

应用场景覆盖影视制作、内容创作及商业设计三大领域。在影视分镜生成中,模型可一次性输出20个竖版短篇条漫分镜,剧情衔接自然,对话气泡文字清晰可读。内容创作者能通过单次生成获得涵盖9个不同领域的九宫格知识图解,满足多样化创作需求。商业设计领域则支持多语言产品海报、网页原型及游戏界面仿真生成,大幅提升设计效率。

据悉,Qwen-Image-3.0系列模型已全面接入千问AI平台生态。除现有API调用服务外,Qwen Studio专业工具及千问移动端应用即将上线免费体验版本。阿里云百炼平台同步开放模型部署服务,为企业用户提供定制化解决方案,推动AI图像生成技术从"视觉美观"向"功能实用"的深度转型。

更多热门内容
谷歌Pixel 11系列新功能HiLight亮相:来电或AI聊天时背面灯带悄然亮起
IT之家 8 月 5 日消息,科技媒体 9to5Google 昨日(8 月 4 日)发布博文,报道称在 Pixel 11 Pro系列手机上,此前曝光的 RGB 灯效功能 Pixel Glow 上线后名为 H…

2026-08-06

Transformer架构遇瓶颈,Mobius架构能否开启AI模型新篇章?
对于(2),这其实是在 AI 领域存在已久的持续学习问题,狭义上指在学会新知识的同时不遗忘旧知识,并非 Transformer自己的「锅」。Mobius 可以用 60% 的数据达到与 Transforme…

2026-08-06

马斯克定下万亿美元营收目标:SpaceX明年部署太空数据中心 全面拥抱英伟达系统
在约一小时的财报电话会议上,马斯克表示,SpaceX计划到2030年实现1万亿美元营收,较此前设定的2031年提前一年。作为“Starmind”卫星计划的一部分,公司还计划在地面和太空部署英伟达Vera R…

2026-08-06

字节跳动SeedRealtime音视频大模型上线豆包App,技术突破与人才布局双轮驱动AI发展
据介绍,Seedance 2.5将单次视频生成时长从15秒提升至30秒,同时优化了画质、音质以及运动质量;在多模态参考能力上,该模型支持用户单次输入最多30张图片、10段视频、10段音频作为参考素材,还可以…

2026-08-06