1. 硬件与软件准备:你的电脑够格吗?
想在自己电脑上玩转AI绘画,第一步不是急着下载软件,而是得先看看你的“装备”行不行。这就像你想玩最新的3A游戏大作,总得先看看显卡能不能带得动。Stable Diffusion WebUI虽然是个免费开源的工具,但对电脑硬件,尤其是显卡,还是有点小要求的。
最核心的硬件就是显卡,而且强烈推荐使用NVIDIA的显卡(也就是常说的N卡)。这是因为Stable Diffusion底层依赖的PyTorch等AI计算框架,对NVIDIA的CUDA加速技术支持得最好。AMD的显卡(A卡)或者Intel的核显不是完全不行,但配置起来会麻烦很多,性能也可能大打折扣,对于新手来说,我强烈建议你避开这个坑。具体到型号,如果你的显卡是GTX 1060、1650、1660,或者更高级的RTX 20系、30系、40系,那基本都OK。关键指标是显存,我建议至少要有4GB。4GB显存是能跑起来的门槛,你可以生成512x512像素的标准图片。但如果你想玩得爽,生成更高分辨率(比如1024x1024)的图,或者一次性生成多张图(批量生成),那显存越大越好。8GB显存(例如RTX 3060、4060)会是一个比较舒适的起点,让你有更多折腾的空间。
除了显卡,其他硬件也不能太拉胯。内存(RAM)建议16GB或以上。因为在生成图片的过程中,除了显卡要干活,系统内存也会被大量用来加载模型和处理数据。如果内存不足,可能会报错或者直接卡死。硬盘空间方面,你需要预留至少20GB的可用空间。这空间是用来装什么呢?Python运行环境、WebUI的源代码、各种支持库会占掉一部分;但真正的大头是模型文件。一个基础的Stable Diffusion 1.5模型大概2GB,而一些更精细、风格化的大模型(比如你听说的NovelAI模型,或者各种C站上的热门模型)动辄4-7GB。所以硬盘空间多多益善,最好放在固态硬盘(SSD)上,这样模型加载速度会快很多。
软件方面,主要是两个必备工具:Git和Python。Git是一个版本管理工具,我们用它来一键下载WebUI的最新源代码,这比手动去网站下载压缩包要方便和可靠。Python则是整个项目的运行环境,因为Stable Diffusion就是用Python写的。安装它们非常简单,都是去官网下载安装程序,然后一路“Next”就行。安装Python时有个小细节要注意:记得勾选“Add Python to PATH”(将Python添加到系统路径)这个选项,这能避免后面很多不必要的麻烦。安装完成后,你可以打开命令行(在Windows上按Win+R,输入cmd回车),分别输入git --version和python --version(或python3 --version)来检查是否安装成功。如果能看到版本号,那就准备就绪了。
2. 一步步部署WebUI:跟着做,准没错
环境准备好,我们就可以开始动手部署了。这个过程其实就像搭积木,步骤是固定的,只要网络通畅,大部分时候都能一键搞定。我会把步骤拆解得非常细,你跟着做就行。
2.1 获取WebUI源代码
首先,我们需要把Stable Diffusion WebUI的“蓝图”拿到本地。这里强烈推荐使用Git命令,这是最标准、后续更新最方便的方式。在你打算安装的硬盘上(比如D盘),打开命令行。你可以直接在文件夹地址栏输入cmd然后回车,这样打开的终端就直接在当前路径了。
输入以下命令:
git clone https://github.com/AUTOMATIC1111/stable-diffusion-webui.git
这行命令会让Git工具去GitHub上把AUTOMATIC1111大神维护的WebUI项目完整地复制到你当前的目录。你会看到一个名为stable-diffusion-webui的新文件夹被创建出来,里面就是所有源代码。如果因为网络问题克隆失败(比如连接被重置),可以多试几次,或者尝试使用一些开发者常用的镜像加速服务。一个常见的方法是修改系统的Hosts文件,或者为Git配置代理,但鉴于网络环境的复杂性,这里不展开,你可以根据实际情况搜索“GitHub加速”来找到解决方案。
2.2 配置启动脚本
进入刚才克隆好的stable-diffusion-webui文件夹,你会找到一个名为webui-user.bat的文件(Windows系统)。这个批处理文件就是我们启动和安装的入口。右键点击它,选择“编辑”,用记事本打开。
你会看到里面有几行配置。对于大多数初次安装的用户,最关键的一行是:
set COMMANDLINE_ARGS=
这一行是留给高级用户传递参数的,比如我们后面会提到的解决低显存问题的参数。初次安装可以先不动它。另外,你可能会看到set PYTHON=和set VENV_DIR=这样的行。通常你不需要修改它们,脚本会自动发现已安装的Python并在当前目录创建虚拟环境(venv文件夹)。除非你的Python安装在了很特别的路径且脚本找不到,才需要手动指定PYTHON的完整路径(例如set PYTHON=C:\Users\你的用户名\AppData\Local\Programs\Python\Python310\python.exe)。
2.3 运行安装脚本
保存好webui-user.bat文件后,直接双击运行它。这时,一个命令行窗口会弹出,并开始自动执行安装流程。这是最激动人心也最可能遇到问题的时刻。脚本会自动做以下几件事:1. 创建一个Python虚拟环境(用于隔离项目依赖,避免和你电脑上其他Python项目冲突)。2. 在这个虚拟环境里,通过pip安装所有必需的Python库,包括PyTorch、gradio(Web界面框架)等一大堆东西。3. 下载一些必要的辅助模型(如CLIP)。4. 最后启动Web服务。
这个过程需要从网上下载大量数据,所以保持网络稳定非常重要。安装时间取决于你的网速,可能需要十几分钟到半小时。你会看到命令行里飞速滚动着各种下载和安装信息。只要它一直在跑,没有红色的报错信息,就请耐心等待。常见的“卡住”点通常是下载PyTorch或某些GitHub上的组件时网络超时。如果遇到这种情况,可以尝试直接关闭命令行窗口,然后重新双击webui-user.bat,安装程序会从中断的地方继续。
2.4 安装完成与首次启动
当安装最终成功时,命令行窗口的最后几行会显示类似这样的信息:
Running on local URL: http://127.0.0.1:7860
看到这个,就大功告成了!它告诉你WebUI服务已经在你的电脑本地(127.0.0.1)的7860端口上运行起来了。你只需要打开电脑上的任意浏览器(Chrome、Edge等),在地址栏输入http://127.0.0.1:7860并回车,就能看到Stable Diffusion WebUI的界面了。
这个界面就是你未来进行AI绘画创作的主战场。第一次打开可能会因为加载一些资源而稍慢,稍等片刻即可。至此,一个最基础的、搭载了官方SD 1.5模型的WebUI环境就部署完成了。但要想画出你想要的风格,比如精美的二次元人物,我们还需要最关键的一步:安装大模型。
3. 模型安装与配置:赋予AI灵魂
如果说WebUI是画布和画笔,那么模型就是AI画家的“绘画风格”和“知识库”。没有模型,WebUI什么也画不出来;而不同的模型,决定了AI能画出什么风格的作品——是写实照片、二次元动漫,还是奇幻插画。我们常说的“NovelAI模型”就是一个在二次元风格上训练得非常出色的模型。
3.1 如何获取与安装模型
模型文件通常以.ckpt或.safetensors为后缀,大小在2GB到7GB之间。获取模型有多个渠道。最知名的模型分享社区是CivitAI,上面有成千上万个由社区训练和分享的各类模型,风格包罗万象。你可以根据喜好下载。另一个来源是Hugging Face,这里是很多AI模型的原发地。
下载好模型文件后,安装非常简单,就是“复制粘贴”。回到你的stable-diffusion-webui文件夹,找到models文件夹,再进入Stable-diffusion子文件夹。把你下载的模型文件(例如novelaiv3.ckpt)直接复制到这里即可。WebUI会自动扫描这个目录下的所有模型文件。
3.2 在WebUI中切换与使用模型
复制完成后,你需要重启WebUI来加载新模型。回到之前那个命令行窗口,按Ctrl+C来停止服务,然后再次双击webui-user.bat启动。启动后,刷新你的浏览器页面。
在WebUI界面的左上角,你会看到一个下拉菜单,通常默认显示“SD 1.5”之类的。点击这个下拉菜单,你就能看到刚才放入Stable-diffusion文件夹的所有模型了。选择你新加入的模型(比如NovelAI模型),WebUI需要一点时间来加载它,界面顶部会有进度提示。加载完成后,这个模型就处于激活状态了。
3.3 VAE与超网络:画龙点睛的微调
有时候,为了达到更好的效果,除了主模型(.ckpt),你可能还需要搭配VAE和超网络(Hypernetwork)文件。VAE(变分自编码器)主要负责改善图像的色彩和细节。有些模型自带内嵌的VAE,有些则需要外挂。如果你下载的模型包里有单独的.vae.pt文件,把它同样放到models/Stable-diffusion文件夹里,然后在WebUI设置页面的“Stable Diffusion”分类下,找到“VAE”选项进行选择。
超网络则是一种更轻量级的模型微调方式,可以用来强化某种特定的画风、角色特征或艺术手法。超网络文件(.pt)需要放入models/hypernetworks文件夹。放入后,同样在生成图片的界面,你会看到一个“Hypernetwork”下拉选项,选择你想要的超网络,它就会对生成结果施加额外的影响。对于新手,我建议先从玩转主模型开始,等熟悉了再尝试组合这些高级功能。
4. 解决常见问题与性能优化
部署和使用过程中,你几乎一定会遇到一些问题。别担心,这都是学习过程的一部分。我把最常见的问题和解决方案整理出来,你遇到时可以来这里找找答案。
4.1 显存不足(CUDA Out Of Memory)
这是最常见的问题,尤其是显存只有4GB或6GB的用户。当你尝试生成分辨率过高(比如超过512x512)的图片,或者使用一些比较耗资源的模型时,命令行窗口可能会弹出一大段红色错误,核心提示是torch.cuda.OutOfMemoryError。
解决方法就是给启动命令添加参数。还记得我们编辑过的webui-user.bat文件吗?找到set COMMANDLINE_ARGS=这一行,在等号后面添加优化参数。根据你的显存大小,可以这样设置:
- 4GB显存:
set COMMANDLINE_ARGS=--medvram --opt-split-attention--medvram:启用中等显存优化模式,让模型不是全部加载到显存,而是部分留在内存,需要时交换。--opt-split-attention:一种优化注意力机制的算法,能进一步节省显存。
- 如果上述设置仍报错(或想生成稍大点的图):
set COMMANDLINE_ARGS=--lowvram --always-batch-cond-uncond --opt-split-attention--lowvram:低显存模式,更激进地使用内存交换,速度会慢一些,但能让你在低显存下运行。
- 2-3GB显存(非常吃力):你可能需要额外使用
--xformers参数(需单独安装xformers库),并将生成分辨率设置为512x512或更低。
修改保存后,关闭WebUI并重新启动webui-user.bat,参数就会生效。你会发现生成单张图片的速度可能变慢了,但至少能成功运行起来。
4.2 安装时网络错误与依赖问题
安装过程中,可能会因为连接GitHub不稳定而失败,提示Connection was reset或HTTP 403/404错误。除了重试,一个有效的办法是手动安装缺失的依赖。当脚本卡在某个包的安装时(比如open_clip),它会给出错误信息和该包的GitHub地址。你可以按照原始文章中提到的方法,手动去下载那个包的ZIP文件,然后放到虚拟环境的Scripts目录下,用python setup.py install的方式手动安装。虽然麻烦点,但能从根本上解决问题。
另一种思路是使用国内镜像源来加速Python包的下载。你可以修改虚拟环境中的pip.ini文件,或者临时在命令行中设置镜像源。例如,在安装脚本运行前,在命令行执行:
pip config set global.index-url https://pypi.tuna.tsinghua.edu.cn/simple
这能显著提升pip安装包的速度。
4.3 生成图片不理想:提示词的艺术
成功生成图片后,你可能会发现画出来的东西很奇怪,比如人物多手指、脸部扭曲、或者背景杂乱。这通常不是软件问题,而是提示词(Prompt) 使用技巧的问题。AI绘画是高度依赖文本描述的。你需要学习如何撰写有效的提示词。
正向提示词(Prompt):描述你想要什么。要具体、详细。例如,不要只写“一个女孩”,而是写“1girl, masterpiece, best quality, detailed face, beautiful eyes, long silver hair, standing in a cherry blossom garden”。加入“masterpiece, best quality”这类质量标签能有效提升出图品质。
反向提示词(Negative Prompt):描述你不想要什么。这非常重要!可以帮你过滤掉常见瑕疵。一个通用的基础反向提示词可以这样写:lowres, bad anatomy, bad hands, text, error, missing fingers, extra digit, fewer digits, cropped, worst quality, low quality, normal quality, jpeg artifacts, signature, watermark, username, blurry, bad feet。你可以把它复制到WebUI的Negative Prompt输入框里,作为默认值。
此外,调整采样步数(Sampling Steps) 和采样方法(Sampling method) 也会影响效果。步数太低(如20以下)可能细节不足,太高(如80以上)则收益不大且耗时。对于Euler a、DPM++ 2M Karras等常用方法,步数在20-40之间通常效果就不错。多尝试,找到最适合当前模型的组合。
最后,记得探索WebUI丰富的扩展(Extensions)功能。在“Extensions”标签页,你可以一键安装像ControlNet(用于姿势控制)、TAG自动补全、图片信息查看等强大插件,它们能让你的AI绘画创作能力提升好几个维度。本地部署的魅力就在于此,整个生态是开放且不断进化的,你可以完全掌控自己的创作环境。

6664

被折叠的 条评论
为什么被折叠?



