Stable Diffusion 必学技能——从零开始训练专属 Lora 模型!

SD之lora训练 训练自己的模型可以在现有模型的基础上,让AI懂得如何更精确生成/生成特定的比如,你下载了一个人物的大模型checkpoint,但是你想生成特点的人物,比如迪丽热巴,AI模型是不知道迪丽热巴长什么样子的,这个使用lora就派上用场了。要注意的是,对于一些基础东西,比如长头发、短头发、黑色头发、棕色头发,这些AI 都是知道的,lora并不是做这个的。 阅读详情

接触AI绘画的小伙伴,一定听过Lora。

Lora模型全称是:Low-Rank Adaptation of Large Language Models,可以理解为Stable-Diffusion中的一个插件,在生成图片时,Lora模型会与大模型结合使用,从而实现对输出图片结果的调整。

我们举个更容易懂的例子:大模型就像素颜的人,Lora模型就如同进行了化妆、整容或cosplay,但内在还在大模型的底子。当然Lora模型不仅仅限制于人物,场景、动漫、风格都有相对应的Lora。
在这里插入图片描述

作为公认最具性价比的模型训练手段,只需要不到20张图片和10分钟的训练,就可以将一个人物、物品甚至是风格融入到AI绘画中,所以说训练Lora是每一个AI绘画学者必备的技能!今天就跟着小元老师来进入学习吧~

感兴趣的小伙伴,赠送全套AIGC学习资料,包含AI绘画、AI人工智能等前沿科技教程和软件工具,具体看这里。

_**一、**_

配置要求和训练环境

1、电脑配置: N卡 gpu 6G以上;

2、训练环境: 除了直接用训练脚本直接进行操作外,可以使用不同的训练图形化操作界面方便操作。可以用秋叶Lora模型训练器、朱尼酱的赛博丹炉,kohya-ss gui选一个即可,电脑配置不够用 可以选择 AutoDL、Google Colab青椒云桌面、揽睿星舟等云平台。

二、

训练数据集准备

1、训练素材处理:

首先确定你的训练主题,比如某个人物、某种物品、某种画风等,确定好后准备用于训练的素材图片,素材图的质量直接决定了模型的质量,好的训练集有以下要求:

· 不少于 15 张的高质量图片,一般可以准备 20-50 张图;

· 图片主体内容清晰可辨、特征明显,图片构图简单,避免其它杂乱元素;

· 如果是人物照,尽可能以脸部特写为主(多角度、多表情),再放几张全身像(不同姿势、不同服装);

· 减少重复或相似度高的图片。

素材图准备完毕后,需要对图片做进一步处理:

· 对于低像素的素材图,可以用 Stable Diffusion 的 Extra 功能进行高清处理;

· 统一素材图分辨率,**注意分辨率为 64 的倍数,**显存低的可裁切为 512x512,显存高的可裁切为 768x768,可以通过 birme 网站进行批量裁切,尺寸越大越吃显存,可能会出现报错学习卡死等问题。

2. 图像预处理

这一步的关键是对训练素材进行打标签,从而辅助 AI 学习。这里介绍两种打标签的方法:

方法一:把训练素材文件夹路径填写到 Stable Diffusion 训练模块中的图像预处理功能,勾选生成 DeepBooru,进行 tags 打标签。

方法二:安装 tagger 标签器插件,进行 tags 打标签。https://github.com/toriato/stable-diffusion-webui-wd14-tagger

选择批量处理, 输入目录填写处理好的图片目录,设置标签文件输出目录,阈值设置为 0.3(生成尽可能多的标签来描述图片内容),开始打标签。

3. 打标优化

预处理生成 tags 打标文件后,就需要对文件中的标签再进行优化,一般有两种优化方法:

· 保留全部标签:

优势: 效率快省时省力的训练出模型,拟合度提高,且过拟合出现的情况是最低的。

缺陷: 风格会变化过大,tag调用比较困难,训练时需要把epoch提高时间成本会被拉长。

· 剔除部分特征标签

优势: 整合成少量的触发词tag后,调用方便,更精准还原角色特征。

缺陷: 容易导致过拟合,泛化性也会降低,如果标签删太多会导致生成的画面非常固化。

三、

训练参数调节

至此,准备工作就完成了,可以开始准备正式训练LoRA了,这边使用秋叶大佬的Lora训练器SD-Trainer,选择新手训练模式。
在这里插入图片描述

进入新手模式后,需要选择训练LoRA使用的大模型:

底模文件路径,选择你要训练Lora使用的大模型,直接点击右侧的小文件夹选择即可。
在这里插入图片描述

训练数据集路径:在选择这一步之前,需要现在sd/lora-scripts-v1.7.3/train这个文件夹下建一个文件夹,在文件夹在里面建一个“数字_英文名”的文件夹,将之前打标好的图和标签一起复制到“数字_英文名”的文件中。

修改分辨率(之前数据集的尺寸是多少,这里就用多少)保存设置:保存模型的名称修改成你想要的名称,点击开始训练,就可以在终端看到它正在疯狂训练中…这个时间会比较久,慢慢等待就好。

这个过程会比较久,等待训练成功后会提示你训练成功。至此整个Lora的训练就完成了,你可以拿你训练好的Lora在WebUI上使用了。

写在最后

感兴趣的小伙伴,赠送全套AIGC学习资料,包含AI绘画、AI人工智能等前沿科技教程和软件工具,具体看这里。

AIGC技术的未来发展前景广阔,随着人工智能技术的不断发展,AIGC技术也将不断提高。未来,AIGC技术将在游戏和计算领域得到更广泛的应用,使游戏和计算系统具有更高效、更智能、更灵活的特性。同时,AIGC技术也将与人工智能技术紧密结合,在更多的领域得到广泛应用,对程序员来说影响至关重要。未来,AIGC技术将继续得到提高,同时也将与人工智能技术紧密结合,在更多的领域得到广泛应用。

在这里插入图片描述

一、AIGC所有方向的学习路线

AIGC所有方向的技术点做的整理,形成各个领域的知识点汇总,它的用处就在于,你可以按照下面的知识点去找对应的学习资源,保证自己学得较为全面。

在这里插入图片描述

在这里插入图片描述

二、AIGC必备工具

工具都帮大家整理好了,安装就可直接上手!
在这里插入图片描述

三、最新AIGC学习笔记

当我学到一定基础,有自己的理解能力的时候,会去阅读一些前辈整理的书籍或者手写的笔记资料,这些笔记详细记载了他们对一些技术点的理解,这些理解是比较独到,可以学到不一样的思路。
在这里插入图片描述
在这里插入图片描述

四、AIGC视频教程合集

观看全面零基础学习视频,看视频学习是最快捷也是最有效果的方式,跟着视频中老师的思路,从基础到深入,还是很容易入门的。

在这里插入图片描述

五、实战案例

纸上得来终觉浅,要学会跟着视频一起敲,要动手实操,才能将自己的所学运用到实际当中去,这时候可以搞点实战案例来学习。
在这里插入图片描述

若有侵权,请联系删除

LoRa模型训练教程(炼丹,Stable Diffusion 何为LoRALoRA并不是扩散模型专有的技术,而是从隔壁语言模型(LLM)迁移过来的,旨在解决避免将整个模型参数拷贝下来才能对模型进行调校的问题。因为大型语言模型的参数量过于恐怖,比如最近新出的GPT-4参数量约为100 万亿。LoRA采用的方式是向原有的模型中插入新的数据处理层,这样就避免了去修改原有的模型参数,从而避免将整个模型进行拷贝的情况,同时其也优化了插入层的参数量,最终实现了一种很轻量化的模型调校方法。 阅读详情

相关推荐

Stable Diffusion: Lora

AIGC研究及应用系列

duhaining1976的博客 1948

stable diffusion(Lora训练)

以坤坤为例,上网随便找了几个坤坤的人脸图像,作为训练的数据集。

qq_44963223的博客 1万+

STM32CubeIDE离线安装芯片PACK包全攻略(附离线包下载与导入步骤)

本文详细介绍了在STM32CubeIDE中离线安装芯片PACK包的完整流程,包括官方和第三方资源获取方法、本地安装步骤及常见问题解决方案。特别针对网络隔离环境下的嵌入式开发需求,提供了实用的版本管理和自动化部署技巧,帮助开发者高效完成芯片固件支持包的离线配置。

weixin_30825581的博客 235

Stable Diffusion Lora模型训练详细教程

stable diffusion lora模型训练

程序员深度学习 5万+

AI绘画Stable Diffusion 必学技能——从零开始训练你的专属 Lora 模型!SD模型训练教程

然而,在创作连续性故事或系列插图时,保持人物的一致性成为了不少创作者面临的挑战。当我学到一定基础,有自己的理解能力的时候,会去阅读一些前辈整理的书籍或者手写的笔记资料,这些笔记详细记载了他们对一些技术点的理解,这些理解是比较独到,可以学到不一样的思路。AIGC所有方向的技术点做的整理,形成各个领域的知识点汇总,它的用处就在于,你可以按照下面的知识点去找对应的学习资源,保证自己学得较为全面。观看全面零基础学习视频,看视频学习是最快捷也是最有效果的方式,跟着视频中老师的思路,从基础到深入,还是很容易入门的。

白帽阿叁的博客 1744

AI绘画Stable Diffusion 必学技能——从零开始训练你的专属 Lora 模型模型训练保姆级教程建议收藏!

接触AI绘画的小伙伴,一定听过LoraLora模型全称是:Low-Rank Adaptation of Large Language Models,可以理解为Stable-Diffusion中的一个插件,在生成图片时,Lora模型会与大模型结合使用,从而实现对输出图片结果的调整。 我们举个更容易懂的例子:大模型就像素颜的人,Lora模型就如同进行了化妆、整容或cosplay,但内在还在大模型的底子。当然Lora模型不仅仅限制于人物,场景、动漫、风格都有相对应的Lora

白帽阿叁的博客 1160

AI绘画Stable Diffusion 必学技能从零开始训练你的专属Lora模型模型训练保姆级教程建议收藏!

Lora模型全称是:Low-Rank Adaptation of Large Language Models,可以理解为Stable-Diffusion中的一个插件,在生成图片时,Lora模型会与大模型结合使用,从而实现对输出图片结果的调整。我们举个更容易懂的例子:大模型就像素颜的人,Lora模型就如同进行了化妆、整容或cosplay,但内在还在大模型的底子。当然Lora模型不仅仅限制于人物,场景、动漫、风格都有相对应的Lora

qq_41314882的博客 1807

Stable Diffusion 必学技能——从零开始训练专属 Lora 模型!简单易上手的Lora训练教程(附工具包)

Lora模型全称是:Low-Rank Adaptation of Large Language Models,可以理解为Stable-Diffusion中的一个插件,在生成图片时,Lora模型会与大模型结合使用,从而实现对输出图片结果的调整。

m0_58477260的博客 1638

Stable Diffusion LoRA模型加载实现风格自由

对于模型微调来说,直接进行微调需要的硬件配置和时间都是相当夸张的,但要想实现风格切换自由,也不是只有模型微调一个方式,LoRA技术可以说很完美的解决了这个难题。无论是二次元画风还是复古胶片质感,都只需要加载小巧的LoRA模型,就能立即解锁意料之外的百变创作可能!

Trb201013的博客 1225

AI绘画基础---LORA模型使用详解,超级简单,小白入门必学!

关于AI绘画(基于Stable Diffusion Webui),我之前已经写过三篇文章,分别是。整体来说还是比简单的,搞个别人的模型,搞个提示词就出图了。今天来一个有些难度的,自己训练一个LoRA微调模型。********LoRA的全称是Low-Rank Adaptation of Large Language Models,有专门的论文和开源项目。它主要解决“大模型”太大,一般人玩不转的问题。比如GPT-3 175B的参数,有几个人跑得起来呢?

WANGJUNAIJIAO的博客 5087

sam3.1 部署笔记 推理封装

sam3.1 部署笔记

jacke121的专栏 400

全开源JAVA支付系统jeepay聚合支付四方支付系统.zip

支持多渠道对接,支付网关自动路由;已对接微信服务商和普通商户接口,支持V2和V3接口;已对接支付宝服务商和普通商户接口,支持RSA和RSA2签名;已对接云闪付服务商接口,可选择多家支付机构;提供http形式接口,提供各语言的sdk实现,方便对接;接口请求和响应数据采用签名机制,保证交易安全可靠;系统安全,支持分布式部署,高并发;管理端包括运营平台和商户系统;管理平台操作界面简洁、易用;支付平台到商户系统的订单通知使用MQ实现,保证了高可用,消息可达;支付渠道的接口参数配置界面自动化生成;使用Spring Security实现权限管理;前后端分离架构,方便二次开发;由原XxPay团队开发,有着多年支付系统开发经验。搭建安装方式具体看文件包,带开发文档。

上一篇: [ComfyUI]超级简单的 Flux 扩图方案,简单但好用!
下一篇: 单周涨粉过万,这9种AI绘画风格也太火了!
黑客彤姐
博客等级 码龄2年 1万+粉丝 1307原创
评论
添加红包

请填写红包祝福语或标题

红包个数最小为10个

红包金额最低5元

当前余额3.43前往充值 >
需支付:10.00
成就一亿技术人!
领取后你会自动成为博主和红包主的粉丝 规则
hope_wisdom
发出的红包
实付
使用余额支付
点击重新获取
扫码支付
钱包余额 0

抵扣说明:

1.余额是钱包充值的虚拟货币,按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载,可以购买VIP、付费专栏及课程。

余额充值