厉害!华为发布图像生成模型PixArt-\Sigma 可直出4K图像
发布时间:2024-03-24 09:20:17
技术QQ导航
53浏览
3月8日 消息:华为近日发布了一项名为 PixArt-\Sigma 的图像生成模型,该模型采用了 DiT 架构,可以直接生成4K 分辨率的图像。相比于其前身 PixArt-\alpha,PixArt-\Sigma 在图像保真度上有了明显的提升,并改善了与文本提示的一致性。
PixArt-\Sigma 的一个关键特点是其训练效率。借助 PixArt-\alpha 的基础预训练,它通过整合更高质量的数据,从”较弱”的基线逐步演变为”较强”的模型,这个过程被称为”弱到强训练”。PixArt-\Sigma 的进步主要体现在两个方面:高质量的训练数据和高效的 Token 压缩。PixArt-\Sigma 结合了更高质量的图像数据,配对更精确和详细的图像标题,同时在 DiT 框架内提出了一个新的注意力模块,可以压缩键(Key)和值(Value),显著提高效率,促进超高分辨率图像的生成。
由于这些改进,PixArt-\Sigma 以较小的模型规模(6亿参数)实现了优于现有文本到图像扩散模型(如 SDXL(26亿参数)和 SD Cascade(51亿参数))的图像质量和用户提示遵从能力。
此外,PixArt-\Sigma 能够生成4K 图像,为创建高分辨率海报和壁纸提供了支持,有效地增强了电影和游戏等行业中高质量视觉内容的制作。
其它推荐
- 高德打车评论领取20亓打车券 08/20
- 同程旅行领35减15元火车票券 08/27
- 太惨了!niconico被网络攻击两个月才恢复服务 08/06
- 黑客声称窃取海量数据?腾讯 QQ 回应:信息并不属实,黑产利用历史资料拼凑、注水而成 08/15
- 茶百道抽奶茶买一送一或免单券 08/30
- 同程买火车票领20亓话费或会员 08/24
- 麦当劳59.9元二十翅桶免配送 08/31
- 王者荣耀累计登陆4天抽红包 08/15