其实lora训练底模是很重要的,我的1.0版本就是随便选的一个,如果说要通用性好一些,那就得用大模型的低一级模型来训练

我还是用光辉做实现,这里盗用一下大佬的解释图

我们使用的那些大模型,都是基于sdxl官方的底模训练出来的,按照上图可以看出,有些公司把sdxl官方的底模优化,训练出了一些新的,例如illustrious(光辉),这个模型主要是以二次元为主(偏向日系风),然后c站上面某些大佬又在这个上面训练出了很多质量很好的光辉大模型(WAI-illustrious-SDXL)

可以看到基础的训练模型是光辉

大致可以这样理解:

sdxl_base----->illustrious---->WAI-illustrious-SDXL

这时候我们训练lora的时候,最好就用你想用的大模型(就是生图的时候加lora的大模型)的上一级来训练,这样只要是基于illustrious的大模型在你的lora上面效果都还可以

可以看我上一篇,只用触发词,换个大模型直接给我干哪里去了.....

有兴趣可以去看一下illustrious的官网

Illustrious XL | Next-Gen AI for Stunning Anime & Illustration Creationhttps://www.illustrious-xl.ai/于是我用illustrious最开始的模型去训练,训练出了立华奏2.0

开始对照

上次的对照是在床上的关键词,我发现我的训练集有抱枕的图片,所以更换了一下关键词,生成一张训练集没有类似的图片

大模型还是那三个:

oneObsession_1424DNsfw

waiNSFWIllustrious_v150

JANKUV5NSFWTrainedNoobai_v50

关键词:

1girl,lihuazhou,white blue hair,back,upper body,looking back,
masterpiece, best quality, amazing quality,

立华奏1.0

详细看一下

02不像,04崩坏先剔除

在one模型下,感觉08会稍微生动一些

在janku模型上感觉都挺不错,10最后的就背景会有点奇怪....不过我感觉08会生动一些,所以最终选择:

lihuazhou08!!

更换底模

这里就进入刚才的正题了,我用illustrious的官方模型来训练的话,应该效果会好很多

我们看一下huggingface上面的OnomaAI公司的发布的模型(看了一下官网说3.0要收钱了)

我看了一下好多人都用这个最原版的(下载量最高),就是刚开始的0.1版本,于是我点进去看看

看到这个说明,好像挺适合的,虽然说我记得one和wai用的底模好像是2.0和1.0版本,不过先用这个试试吧

经过了一天的训练...(到时候看看能不能提高速度)

立华奏2.0

触发提示词:lihuazhou

我发现了一个问题...为什么头发颜色不对啊?明明我训练的时候删掉了跟头发有关的提示词了!!

先不管,详细看一下:

janku上感觉在权重0.9以上的时候都挺不错

低权重的时候,明显02和04可以初步筛选掉了(权重范围越广越有可变动性)

one模型上,高权重02和04都可以直接排除掉了....02和04可以直接排除了

wai模型则是很明显,08之后才正常,其实这时候我的心里就已经定在08这个模型上了

差异对比

这只是简单的触发词,可能有些人看不出底模对比差异,我给一张1.0版本的只用触发词的图片(不是训练的那个大模型),就知道差很远了

笑死我了,都不知道生成什么东西了.....

发色不准确的原因

头发颜色不对,所以看上去不太像立华奏这个角色...我已经把头发颜色变成lihuazhou这个提示词了才对

于是我找了一下训练集,发现问题了,出了官方动漫的图片,我还给了同人图,而有一些同人图(以及别人ai生成的立华奏)...头发颜色竟然是白色的.....

明显就是ai生成的...而且应该用的就是illustrious模型,不然不会误导的这么夸张.....最终还是倒在了ai的手里....

没事,我们给他加上发色的提示词就行了white blue hair

完善提示词

1girl,lihuazhou,white blue hair,looking at viewer,,school uniform,
masterpiece, best quality, amazing quality,

整体看,都非常不错,不愧是官方底模

详细查看

其实主要是看细节了,因为其他的都挺不错,这里我让她穿上立华奏的校服(为了可以更换衣服,我就没有设置成默认了)

所有模型脸部上面我都看了,都没啥太大问题,先看一下janku模型

02权重1的时候衣服徽章还是错的,欠拟合排除

最让人期待的06--10领带全部畸变,要么多一条,要么少一边,权重应该是过高

权重在0.8左右最正常,0.7很多又开始畸变,要么不像.....其实这里看出来了,08模型明显适应性最好,06模型在0.7权重的时候领带就变成蝴蝶结了

接下来看一下one模型的

一样畸变....继续看0.8左右权重

明显这里只有08和10模型的领带是对的,而且只在0.8权重

再看一下wai模型

都少了右边那条,看0.8

0.8权重08和10都正常,但是你会发现10模型很容易出现崩坏(重叠领带),所以其实答案很明显了

最终选择:lihuazhou-v02-08

tensortboard对比

其实这个我也看不太懂,一般loss值在下降之后的回升那个阶段,据说是最好的

你会发现就在6-8之间,所以说我测试下来,也是06和08的模型表现最好

总结:

用xy图表对比最容易看,从人物特征到衣服细节,崩坏程度等等,最终就可以筛选出自己喜欢的模型

Logo

智能硬件社区聚焦AI智能硬件技术生态,汇聚嵌入式AI、物联网硬件开发者,打造交流分享平台,同步全国赛事资讯、开展 OPC 核心人才招募,助力技术落地与开发者成长。

更多推荐