鳳凰網(wǎng)科技訊 7月21日,阿里千問團(tuán)隊(duì)正式推出第三代圖像生成基礎(chǔ)模型Qwen-Image-3.0。該模型主打“內(nèi)容豐實(shí)、細(xì)節(jié)真實(shí)、知識(shí)厚實(shí)”,旨在讓AI圖像生成從“好看”走向“好用”,成為可落地的生產(chǎn)力工具。
核心能力方面,Qwen-Image-3.0將可接受的指令長度提升至4.5k token,能夠理解和渲染極其復(fù)雜的視覺版面,一次生成包含數(shù)學(xué)公式、古文分析、物理圖解、醫(yī)學(xué)圖示等多格內(nèi)容的九宮格信息圖。細(xì)節(jié)渲染精度達(dá)到10px級(jí)別小字清晰可辨,人像毛孔與發(fā)絲逼近攝影級(jí)真實(shí),同時(shí)支持古畫修復(fù)等應(yīng)用。知識(shí)覆蓋上,模型支持12國語言原生渲染,可仿真主流網(wǎng)頁、游戲(881275)及直播界面,并具備對(duì)復(fù)雜UI嵌套結(jié)構(gòu)的理解能力。
目前,Qwen-Image-3.0已在阿里云百煉和千問AI平臺(tái)開放API邀測(cè),Qwen Studio和千問APP也將于近期上線供免費(fèi)體驗(yàn)。該模型被視為阿里在圖像生成領(lǐng)域向真實(shí)生產(chǎn)力場(chǎng)景邁進(jìn)的關(guān)鍵一步。
