動察 Beating AI 快訊,西班牙 AI 初創公司 Speridlabs 嘗試了一種新的生圖方式。如今不少 AI 生圖模型會先在壓縮後的圖像信息中生成畫面,再還原成圖片。這個過程可能損失細節。Speridlabs 想知道,如果跳過這一步,直接生成每個像素,效果會不會更好?
團隊為此訓練了開源模型 Iris-3B,還把另一款現有模型改造成直接生成像素的版本。他們讓這些模型修復低清圖片、判斷照片中物體的遠近,再與原有方案比較。結果都沒有出現預期中的穩定提升,部分指標反而略差。直接生成像素的模型還在部分測試結果中出現了輕微的方格紋。
不過,這項研究也證明了直接生成像素的可行性。Iris-3B 在一項生圖評測中取得 0.540 分,與千問 Qwen-Image 的 0.539 分基本持平。只是去掉圖像壓縮環節,並沒有讓它在細節要求更高的任務中獲得明顯優勢。