0
| 本文作者: nebula | 2026-04-01 17:46 |
4月1日,阿里巴巴發(fā)布圖像生成與編輯統(tǒng)一模型Wan2.7-Image。直擊當(dāng)前 AI 生圖領(lǐng)域“標(biāo)準(zhǔn)臉”審美疲勞和“色彩盲盒”等痛點(diǎn),該模型可實(shí)現(xiàn)“千人千面”,捏出“活人感”,全新的“調(diào)色盤”功能可精準(zhǔn)控制色彩。
Wan2.7-Image具備文生圖、圖生組圖、圖像指令編輯和交互式編輯等全鏈路能力。在人類偏好盲測(cè)中,“文生圖”能力超過GPT-Image1.5和國(guó)內(nèi)主流模型,在文本渲染、照片級(jí)成像和世界知識(shí)指標(biāo)上,接近Nano Banana Pro。
圖說:Wan2.7-Image的人類偏好盲測(cè)評(píng)分位列國(guó)內(nèi)第一。
為告別千篇一律的“AI臉”,Wan2.7-Image強(qiáng)化了虛擬形象捏臉功能,支持從骨相、眼眸到五官細(xì)微處的全方位定制,比如更換提示詞中的臉型(鵝蛋臉、圓臉、方臉、長(zhǎng)方臉等)、眼部特征(杏仁眼、深邃眼窩、圓眼、丹鳳眼等),實(shí)現(xiàn)“千人千面”。

藝術(shù)家和設(shè)計(jì)師需精準(zhǔn)控制顏色,商業(yè)海報(bào)對(duì)配色還有嚴(yán)格要求,但AI生圖往往是“色彩盲盒”。Wan2.7-Image全新支持“調(diào)色盤”功能,用戶可通過Hex Code,一鍵提取或輸入?yún)⒖紙D的各種顏色和占比,從馬蒂斯?jié)庥舻募t色系、梵高明媚的黃色系,到畢加索清冷的藍(lán)色系,都能參考生成同色系的圖片,并可自由調(diào)控顏色的數(shù)量和占比,自定義配色方案。

超長(zhǎng)文字渲染是AI生圖的痛點(diǎn),容易文字模糊、內(nèi)容錯(cuò)亂甚至直接漏寫。憑借長(zhǎng)上下文文本編碼(Long Context Text Encoder)解析超長(zhǎng)序列,Wan2.7-Image對(duì)超長(zhǎng)文字、表格和復(fù)雜公式的渲染可達(dá)印刷級(jí),支持12種語言,最高3K tokens的超長(zhǎng)文字輸入,可輸出一頁A4紙的論文。

此外,Wan2.7-Image還具備強(qiáng)大的組圖生成能力,可生成多達(dá)12張,用于批量制作同風(fēng)格系列圖、PPT配圖、分鏡腳本、電商模特套圖及多視角建筑圖。
如果說生圖能力是創(chuàng)作的基石,那么編輯功能則賦予了創(chuàng)作者掌控力。Wan2.7-Image原生支持交互式編輯模塊,更懂創(chuàng)作者的需求——“哪里不爽點(diǎn)哪里”,用戶可通過精準(zhǔn)框,在指定區(qū)域元素添加、對(duì)齊、移動(dòng)元素或logo,實(shí)現(xiàn)像素級(jí)意圖對(duì)齊。

Wan2.7-Image的多主體一致性最高支持輸入9張圖片作為參考源。對(duì)于合影、電影海報(bào)及家具組合圖等,可保持風(fēng)格與特征的統(tǒng)一。其他常用的圖像編輯能力,如鏡頭視角控制、光影處理、材質(zhì)參考、照片修復(fù)、虛擬試衣等數(shù)十種實(shí)用功能,Wan2.7-Image也能更穩(wěn)定地輸出,告別“抽卡”式創(chuàng)作。

不只會(huì)生圖,還更懂圖,Wan2.7-Image更強(qiáng)的理解能力源于模型架構(gòu)與訓(xùn)練過程中的技術(shù)突破。
在訓(xùn)練數(shù)據(jù)上,超大規(guī)模的異構(gòu)數(shù)據(jù)底座不僅涵蓋全域品類的視覺素材,還整合了理解類數(shù)據(jù);在模型架構(gòu)上,模型采用了領(lǐng)先的生成與理解統(tǒng)一模型架構(gòu),共享隱空間(Latent Space)來實(shí)現(xiàn)語義映射,文字緊挨著畫面,模型不需費(fèi)力去猜文字對(duì)應(yīng)的畫面;在訓(xùn)練流程中引入多模態(tài)指令(比如文字+圖片),使得模型實(shí)現(xiàn)了從單純“像素?cái)M合”到“底層語義認(rèn)知”的飛躍。
此外,在數(shù)據(jù)工程維度,根據(jù)圖像的布局、文字、光影、拍攝角度和用途等,模型團(tuán)隊(duì)構(gòu)建了多維精細(xì)標(biāo)注體系。配合先進(jìn)的分階段訓(xùn)練策略與多任務(wù)優(yōu)化,模型在長(zhǎng)尾場(chǎng)景下仍然保持了極高的生成穩(wěn)健度。基于更大規(guī)模數(shù)據(jù)及尺寸訓(xùn)練而成的Wan2.7-Image-Pro也同步上線,生成圖像的構(gòu)圖更加穩(wěn)定,語義理解更強(qiáng)更精準(zhǔn)。
Wan2.7-Image的強(qiáng)大功能可應(yīng)用于多個(gè)行業(yè)。對(duì)于短劇與影視團(tuán)隊(duì),借助千人千面的捏臉系統(tǒng)與分鏡生成能力,可低成本完成角色設(shè)定、動(dòng)作模仿與特效預(yù)覽;對(duì)于自媒體與內(nèi)容創(chuàng)作者,可輕松生成多風(fēng)格封面、OOTD穿搭;在電商領(lǐng)域,只需單張模特圖,即可裂變生成特寫圖、不同場(chǎng)景的賣點(diǎn)圖,大幅降低拍攝成本;教育和科研從業(yè)者可直接調(diào)用模型生成論文配圖、信息圖表與兒童繪本。對(duì)于時(shí)下大火的“龍蝦熱”,Wan2.7-Image 現(xiàn)已支持skill調(diào)用,讓龍蝦畫畫,全面解鎖生成模型的應(yīng)用場(chǎng)景。
即日起,用戶可在https://tongyi.aliyun.com/wan/、wan.video網(wǎng)站和阿里云百煉體驗(yàn)Wan2.7-Image,千問App也即將接入。
雷峰網(wǎng)(公眾號(hào):雷峰網(wǎng))