阿里巴巴發布第三代圖像生成模型Qwen-Image-3.0,強調實用性與細節真實度
分類: AI 新品報導 發布時間:
阿里巴巴通義千問團隊於7月21日正式發布第三代圖像生成基礎模型Qwen-Image-3.0。這款模型以「實」為核心關鍵字,強調豐富內容、真實細節與深度知識,目標是從「好看」走向「好用」,成為可實際應用於設計、教育與內容創作的生產力工具。
Qwen-Image-3.0支援最長4.5k token的超長提示詞,能一次生成結構複雜的圖像,例如多格資訊圖、分鏡腳本、學術論文頁面、報紙版面或巢狀UI介面。模型在文字渲染上表現突出,可精準呈現小至10像素的文字、LaTeX公式、上下標與希臘字母,並原生支援12種語言與20多種字體。細節方面,皮膚紋理、毛髮、微表情等接近真實攝影水準,同時能還原損壞的傳統畫作並保持原有風格。

與前代相比,Qwen-Image-1.0主打「精準」,2.0強調「精準、多樣、完整、美觀、真實」,3.0則進一步提升至「實用」。早期使用者分享的範例包括代數幾何論文、寫實人像、昆蟲分類資訊圖與多語言海報,認為其在複雜排版與知識型內容上已明顯超越多數現有模型。
使用方式相當多元。一般使用者可直接透過Qwen Chat(chat.qwen.ai)的圖像生成功能免費體驗,或下載Qwen Studio桌面與行動App。開發者則可透過阿里雲百煉(Model Studio)平台呼叫API,模型ID為qwen-image-3.0-pro,採按量計費。目前官方尚未公布3.0的精確單張圖像價格,但阿里雲圖像生成模型通常以每張圖像計費,實際費用需登入控制台查詢最新標準。
安裝與部署方面,Qwen-Image系列早期版本(如原始Qwen-Image)已開源並可在Hugging Face與ModelScope下載權重,支援Diffusers等框架本地運行。然而,截至目前,Qwen-Image-3.0尚未釋出開源權重,主要以雲端服務形式提供。若需本地部署,仍需等待官方後續更新。
使用時需注意幾點:首先,生成內容可能涉及版權或敏感主題,商業用途建議自行確認授權;其次,模型雖具備深度知識,但仍可能出現事實錯誤或幻覺,重要資訊應再交叉驗證;再者,雲端服務會處理提示詞與生成圖像,使用者應避免輸入高度敏感個人資料。最後,API用量需留意費用累積,建議設定預算提醒。
Qwen官方部落格
https://qwen.ai/blog?id=qwen-image-3.0
阿里雲百煉Model Studio
https://modelstudio.console.alibabacloud.com/
Hugging Face Qwen-Image
https://huggingface.co/Qwen/Qwen-Image


