阿里巴巴發布第三代圖像生成模型Qwen-Image-3.0,強調實用性與細節真實度



阿里巴巴通義千問團隊於7月21日正式發布第三代圖像生成基礎模型Qwen-Image-3.0。這款模型以「實」為核心關鍵字,強調豐富內容、真實細節與深度知識,目標是從「好看」走向「好用」,成為可實際應用於設計、教育與內容創作的生產力工具。

Qwen-Image-3.0支援最長4.5k token的超長提示詞,能一次生成結構複雜的圖像,例如多格資訊圖、分鏡腳本、學術論文頁面、報紙版面或巢狀UI介面。模型在文字渲染上表現突出,可精準呈現小至10像素的文字、LaTeX公式、上下標與希臘字母,並原生支援12種語言與20多種字體。細節方面,皮膚紋理、毛髮、微表情等接近真實攝影水準,同時能還原損壞的傳統畫作並保持原有風格。


與前代相比,Qwen-Image-1.0主打「精準」,2.0強調「精準、多樣、完整、美觀、真實」,3.0則進一步提升至「實用」。早期使用者分享的範例包括代數幾何論文、寫實人像、昆蟲分類資訊圖與多語言海報,認為其在複雜排版與知識型內容上已明顯超越多數現有模型。

使用方式相當多元。一般使用者可直接透過Qwen Chat(chat.qwen.ai)的圖像生成功能免費體驗,或下載Qwen Studio桌面與行動App。開發者則可透過阿里雲百煉(Model Studio)平台呼叫API,模型ID為qwen-image-3.0-pro,採按量計費。目前官方尚未公布3.0的精確單張圖像價格,但阿里雲圖像生成模型通常以每張圖像計費,實際費用需登入控制台查詢最新標準。

安裝與部署方面,Qwen-Image系列早期版本(如原始Qwen-Image)已開源並可在Hugging Face與ModelScope下載權重,支援Diffusers等框架本地運行。然而,截至目前,Qwen-Image-3.0尚未釋出開源權重,主要以雲端服務形式提供。若需本地部署,仍需等待官方後續更新。

使用時需注意幾點:首先,生成內容可能涉及版權或敏感主題,商業用途建議自行確認授權;其次,模型雖具備深度知識,但仍可能出現事實錯誤或幻覺,重要資訊應再交叉驗證;再者,雲端服務會處理提示詞與生成圖像,使用者應避免輸入高度敏感個人資料。最後,API用量需留意費用累積,建議設定預算提醒。

Qwen官方部落格
https://qwen.ai/blog?id=qwen-image-3.0

阿里雲百煉Model Studio
https://modelstudio.console.alibabacloud.com/

Hugging Face Qwen-Image
https://huggingface.co/Qwen/Qwen-Image


相關文章:

阿里巴巴禁用Claude系列AI產品 員工須於7月10日前卸載  [7/4/2026]
阿里巴巴通義千問推出 Qwen-AgentWorld,AI Agent 可先模擬後果再行動  [6/26/2026]
[「擇法善思林之蘭室藏津」的緣起]
台積電前副理涉勾結中共情工!竊取國家核心技術秘密 起訴求刑7年
鄭麗文稱佀廣洋全家被「鞭屍」 李柏瑟酸:別開玩笑了
池秋美約湯蘭花喝咖啡 被竊竊私語淪供人觀賞
基隆信義國小及社寮橋旁停車場將ROT招商 導入智慧停車系統
探索星空奪冠!宜中學子解密疏散星團 勇奪全國科展第一名
遭爆毒油風暴期間應酬跑「酒攤」? 陳時中:吃飯用餐
二輪提案又出手 翁曉玲同一理由大砍總統府等18項部會預算
中俄海軍持續擾日海域 繼沖之鳥礁實彈射擊 再繞行硫磺島外海
第一代水果哥哥姐姐同框掀回憶殺!香蕉哥哥透露飯局心情 「吃小孩」網路梗
弘塑攜手德國Singulus 搶攻面板級封裝商機
新北大巨蛋落腳樹林卓冠廷力挺 陳偉杰要求公布評估報告
嘉市2人獲師鐸獎 林秀香43年「一切為孩子」、蔡邦居宛如「安西教練」
盧秀燕號召725上凱道!楊瓊瓔、顏寬恒將北上聲援
彰化伸港3姊弟事故同路口再傳車禍 汽車與雙載機車碰撞2傷
還記得《誰說我不在乎》機車廣告原唱嗎?消失26年 高明駿露面變這樣
[擇法善思林之蘭室藏津]