ARTICLE DETAIL

资讯详情

深耕郑州网站建设与运营推广的一线实战洞察。

kohya_ss Stable Diffusion LoRA 训练:5 张图跑出自己的风格模型

kohya_ss Stable Diffusion LoRA 训练:5 张图跑出自己的风格模型 kohya_ss Stable Diffusion LoRA 训练5 张图跑出自己的风格模型【免费下载链接】kohya_ss项目地址: https://gitcode.com/GitHub_Trending/ko/kohya_ss输入提示词点生成出来的图带着和你自己作品一样的色调、光影和笔触——这就是训练完成后的第一次回报。kohya_ss 是带图形界面的 Stable Diffusion 训练工具通过它的 Web 界面就能完成 LoRA只微调少量参数、小而快的训练方式和 Dreambooth教会模型某个特定角色或物体的训练方式全程不用碰命令行。![Stable Diffusion 训练素材示例512x512 蒸汽朋克风格角色图](https://raw.gitcode.com/GitHub_Trending/ko/kohya_ss/raw/f44226cfccca008094f958d829c49c74a7e9289d/test/img/10_darius kawasaki person/Dariusz_Zawadzki.jpg?utm_sourcegitcode_repo_files)它能帮你做什么 / 不能帮你做什么三个输入到输出的场景帮你判断它是不是你要的东西输入你拍的照片或你画的 10~20 张同风格图 一个基础模型如 SDXL→操作LoRA 标签页里加载一个预设、点开始训练 →输出一个几十 MB 的.safetensorsLoRA 模型文件放进 WebUI / ComfyUI 就能按你的风格出图。输入某个特定角色或道具的若干张照片 →操作Dreambooth 标签页填触发词和配置 →输出一个完整微调后的模型用触发词调用这个角色。输入一堆没写描述的照片 →操作跑tools/caption.py或界面里的标注功能 →输出每张图片配一个同名.txt描述文件。它不能做的不是日常出图软件。训练好的模型要拿到 WebUI / ComfyUI 里生成图片kohya_ss 负责造模型训练中会出预览图但不适合当画板用。 最短路径跑通四个检查点每过一个就知道下一步没白干检查点 1仓库完整。git clone --recursive https://gitcode.com/GitHub_Trending/ko/kohya_ss cd kohya_ss通过标准目录里能看到gui-uv.shLinux/macOS和gui-uv.batWindows。检查点 2环境就绪。Windows 双击gui-uv.batLinux/macOS 执行下面这行。脚本会检测并自动安装uv、拉依赖、建虚拟环境第一次跑几分钟到十几分钟都正常。./gui-uv.sh通过标准终端走完安装流程没有红色报错。检查点 3界面起来。通过标准浏览器出现 7860 端口的 Gradio 界面能看到 LoRA、Dreambooth、Finetune 等标签页。检查点 4出第一个模型。LoRA 标签页 → 加载预设 → 指定数据集目录放你图片的文件夹和基础模型 → 点开始训练。通过标准控制台开始滚动输出 loss 值训练结束后输出目录里出现.safetensors文件和预览图。想以后少手动选目录可以把仓库里的config example.toml拷一份改名为config.toml填上你的默认路径。![SDXL LoRA 训练数据集示例同一角色不同构图的 512x512 插画](https://raw.gitcode.com/GitHub_Trending/ko/kohya_ss/raw/f44226cfccca008094f958d829c49c74a7e9289d/test/img/10_darius kawasaki person/Dariusz_Zawadzki_5.jpg?utm_sourcegitcode_repo_files)素材达标标准仓库里test/img/10_darius kawasaki person/放了一组标准数据集8 张 512x512 同风格插画各配一个同名.txt照着它对齐即可。项目达标不达标数量10~20 张高质量图3 张随手截图或 300 张风格混杂的图分辨率主体清晰统一为 512x512 这类方形尺寸长条图、模糊图、边长低于 256px 的图风格一致性同一色调、笔触、光感一眼能认出是一个系列照片、水彩、3D 渲染混在一个文件夹里描述文件每张图配同名.txt一句话说明主体和风格完全没有.txt或堆大量与画面无关的词![LoRA 训练风格一致性示例同系列不同场景的角色插画](https://raw.gitcode.com/GitHub_Trending/ko/kohya_ss/raw/f44226cfccca008094f958d829c49c74a7e9289d/test/img/10_darius kawasaki person/Dariusz_Zawadzki_3.jpg?utm_sourcegitcode_repo_files)预设配置怎么选LoRA 标签页有加载预设按钮从presets/lora/挑 JSON 即可。按你的风格类型对号入座风格类型推荐文件只需改什么首次训练 / 常规插画角色SDXL 底模SDXL - LoRA AI_characters standard v1.0.jsonmax_train_epochs训练轮数先给 10~20和输出模型名图很少只有 1~3 张SDXL - 1 image LoRA v1.0.jsonLoKr Prodigy 优化器对小数据更宽容触发词和输出模型名底模是老的 SD1.5sd15 - EDG_LoraOptiSettings.jsonmax_resolution改成你图片的实际尺寸想先粗练再精修先SDXL - LoRA finetuning phase 1_v1.1.json再跑phase 2_v1.1.json两阶段间检查预览图再决定继续⚡ 翻车速查症状原因30 秒修复浏览器打不开、7860 端口无响应端口被占或远程环境未开监听浏览器手动访问http://localhost:7860远程机启动时加--listen 0.0.0.0 --headless训练中途报 CUDA out of memory显存不够或分辨率设太高max_resolution降一档如 1024,1024 改 768,768batch 保持 1Linux 启动报 no module named tkinter系统 Python 缺 GUI 组件改用uv方式gui-uv.sh重建环境venv 里已包含所需依赖训练完成但模型模糊、风格漂移轮数太少或学习率偏高换用更低学习率的预设重跑轮数先减半再逐步加Tesla V100 上 GPU 利用率低V100 已知兼容性问题按docs/troubleshooting_tesla_v100.md改环境变量再启动今晚就能跑完的最小任务挑你最喜欢的 5 张图各写一行.txt描述加载 AI_characters 预设把轮数改成 10启动 LoRA 训练睡前看一眼输出目录的预览图——方法对不对第一晚就有答案。【免费下载链接】kohya_ss项目地址: https://gitcode.com/GitHub_Trending/ko/kohya_ss创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考
返回列表