通義千問推出多模態統一理解與生成模型 Qwen VLo,圖像生成效果如何?有哪些信息值得關注?
作者: 發布日期:2025-06-29 01:55:10
2025年6月26日,Qwen團隊發布了 Qwen VLo ,一個定位是“unified multimodal understanding and generation model"的模型,包括多模態的理解和生成。
根據官方的介紹博客,Qwen VLo包含下面的功能: 圖像生成:文生圖、2D卡通圖像轉真實圖像圖像編輯:例如修改某個主體、更換顏色、更換風格圖像算法能力:例如檢測框、canny 算子、圖像分割結果經過一段時間的測試,我個人的總結是: 生圖能力:效果比較差,感覺是一兩年前生圖模型…。









