问问大家训练画风lora一般是用多少张图的
stablediffusion吧
全部回复
仅看楼主
level 7
陈树文
楼主
前几天炼了快十多炉了没有一炉是满意的,在换了一个画师之后居然一次就成功炼出效果不错的lora了,所以想请教一下大家以下问题:
1.一般会使用多少张图?会对不同分辨率(竖直和横屏)有比例要求吗?比如50%竖直50%横屏这样子
2.大家使用的图体积大概都是多大呢?几百kb和未压缩过的原图训练效果区别大吗?对于大体积的png格式图片大家会怎么处理?
3.大家一般在多少等效batch下的多少步数时lora拟合?
求助各位大佬,希望有经验的大佬愿开金口传授一些经验
2026年08月10日 14点08分
1
level 7
陈树文
楼主
这是那炉的参数
2026年08月10日 14点08分
2
level 8
望见🎀
50以下,50-100,100-400,1000-2000,4000,1w以上都练过,个人体感是30-400之间比较好,拟合速度会慢点,然后用的4 batch。
2026年08月10日 14点08分
3
level 11
阿良良木眉
anima的大概在50-60吧,图体积不大于1536x1536就行了,大体积就等体积裁剪到合适的尺寸,比例要求没注意不过横屏竖屏都来点肯定没错的,等效bs2的情况下我看3000步左右效果就差不多了
2026年08月10日 15点08分
4
阿良良木眉
画风最重要的是数据集的质量吧,我每次都是扒完图后一张张看挑选哪些适合哪些不适合
2026年08月10日 15点08分
谈笑间重伤倒🌐
请问anima能像il一样训练多个画师的融合画风吗
2026年08月10日 23点08分
阿良良木眉
@谈笑间重伤倒🌐
可以
2026年08月11日 04点08分
谈笑间重伤倒🌐
@阿良良木眉
总步数还是保持在3000步左右就可以吗
2026年08月11日 06点08分
level 6
Goodnuee
如果训练集的多数图片单纯用tag打标不太能准确描述,那就会训练得不太好,虽然我也不知道引入自然语言会如何
2026年08月10日 21点08分
5
想飞的鱼&
你可以用qwen或者kimi,豆包也行。把原始tags和图片一起丢给他,让他参考原始tags打标,并且把Anima的提示词风格告诉他
2026年08月11日 01点08分
Goodnuee
@想飞的鱼&
那些AI写的提示词感觉都有点太夸张
而且很多图片不能用这种方法打标。虽然本地有专门的一些小尺寸LLM,但是能用的一般太吃显存,不吃显存的一般脑子不好。
2026年08月11日 01点08分
想飞的鱼&
@Goodnuee
我最近炼画风直接调用的KIMI的API,黄土也无所谓,因为他觉得自己的任务是打标而不是生成刘备文
。最后用下来感觉还不错。夸大的问题我觉得还ok,反正Anima对提示词都处理能力很强,而且除了这些好像没别的更好的选择了
2026年08月11日 01点08分
Goodnuee
@想飞的鱼&
最近手动自然语言了一个数据集,苦不堪言
2026年08月11日 01点08分
level 1
期待特雷西5S
哇哦,是没有蛋蛋的猫咪。
2026年08月11日 05点08分
7
level 10
阿波利亚的呆毛
我炼wan2.2的lora是把素材加上黑边,凑成1024×1024的正方形,你可以试试,没准通用呢
2026年08月11日 06点08分
8
陈树文
问问大佬等效batch和步数是多少呀
2026年08月11日 08点08分
阿波利亚的呆毛
@陈树文
你找豆包商量看看吧,我也是问豆包的,然后步数1.5倍以防万一
2026年08月11日 08点08分
1