Indi
Yunfeng's Simple Blog vra.github.io

2025年6月26日,Qwen团队发布了 Qwen VLo ,一个定位是“unified multimodal understanding and generation model”的模型,包括多模态的理解和生成。 根据官方的介绍博客,Qwen VLo包含下面的功能: 图像生成:文生图、2D卡通图像转真实图像 图像编辑:例如修改某个主体、更换颜色、更换风格 图像算法能力:例如检测框、canny 算…

讨论

还没有评论,来说第一句吧。

Yunfeng's Simple Blog 的其他文章