header-langage
简体中文
繁體中文
English
Tiếng Việt
한국어
日本語
ภาษาไทย
Türkçe
掃碼下載APP

千问發布生成模型Qwen-Image-3.0:能讀懂超長要求,複雜排版和小字更準確

動察 Beating 監測,千問發布第三代圖像生成模型 Qwen-Image-3.0。新模型最大支持 4.5k Token 輸入,重點提升複雜版面、細小文字和知識型圖像的生成能力。

它可以用一條長指令生成報紙、試卷、短劇分鏡和九宮格資訊圖。模型能在同一張圖裡處理多個主題,並同時生成公式、圖表、人物和中英文文字。官方展示的一張九宮格包含九類獨立內容,描述指令長約 3.7k Token。

文字渲染也進一步加強。千問稱,模型可以清晰生成小至 10px 的文字,並處理 LaTeX 公式、上下標、手寫批註和報紙密集排版。毛孔、髮絲、紙張和繪畫紋理等細節也更真實。

Qwen-Image-3.0 原生支持 12 種語言、100 多種藝術風格和多類 UI 介面。官方還展示了聯網生成天氣圖、修復傳統繪畫和製作專業資訊圖等用法。相比單純生成好看的圖片,這一代更強調 PPT、教育材料、設計和內容製作等實際場景。

举报 糾錯/舉報
糾錯/舉報
提交
新增文庫
僅自己可見
公開
保存
選擇文庫
新增文庫
取消
完成