产品概述
Animagine XL 3.1 是由 Cagliostro Lab 开发的第二代开源动漫文本生成图像模型,基于 Stable Diffusion XL 架构。它在 3.0 版本基础上进行了大幅改进,通过新增 87 万张有序标注图像的数据集,显著扩展了对经典至现代动漫作品与风格的理解。模型采用标签排序提示模板,并针对过曝问题优化了算法,同时引入美学、质量和年代标签,让生成结果更具艺术感和时代特征。
核心优势
- **数据丰富度与训练深度**:预训练使用了 87 万张有序且标注的动漫图像,覆盖海量角色、风格和主题。该模型在 2 块 A100 80GB GPU 上训练约 350 小时,细节与色彩表现显著提升。
- **过曝问题解决**:3.1 版本重点排查并修复了上一代模型的过曝光缺陷,生成图像更加自然、光线均衡。
- **标签升级与排序**:新增美学标签(如精细、大师级)和年代标签(如昭和、平成),配合标签排序机制,用户通过结构化提示可精准控制角色、系列和风格。
- **开源与兼容性**:采用 Fair AI Public License 1.0-SD,与 Stable Diffusion 生态兼容,允许修改和分发,但要求共享源代码与相同许可证。
适用场景
- 动漫角色设计、同人插画创作
- 游戏资产概念图、漫画分镜草稿
- 个性化头像、壁纸、封面图生成
- 教学演示、AI 艺术实验与二次创作