阿里巴巴旗下 Qwen 團隊正式推出 Qwen-Image-3.0,這是新一代多功能 AI 圖像生成模型,最大特色是能在單次生成中同時包含多種版面元素,如報紙排版、教學圖卡、分鏡腳本與 UI 介面設計。
重點
- 超長 Token 支援:支援高達 4,500 個 Token 的輸入,能處理複雜的圖文排版指令
- 精細文字呈現:支援最小 10px 字體,是目前圖像生成模型中對小字支援最佳的之一
- 多語言能力:可生成包含 12 種語言的圖像內容,涵蓋中、英、日、韓等主要語言
- 多元應用場景:適用於報紙版面、教學素材、故事板(Storyboard)與 UI 原型生成
- 使用限制:模型在複雜佈局的正確性上仍有侷限,官方文件有詳細說明
編輯按
Qwen-Image-3.0 將文字精確渲染與多語言能力結合,對需要精細圖文整合的設計師與內容創作者而言是重要工具升級。相比同類模型,10px 小字支援與 4.5k Token 輸入是相當顯著的技術突破,值得設計、教育與媒體內容製作者關注。
本文由 AI 整理,原文:AI郵報