用了 fp4 模型,好像内存,显存都不是问题了。
stablediffusion吧
全部回复
仅看楼主
level 9
职业killer 楼主
lz 用的是 5080。 前一年玩比较火的视频模型wan2.2 ,只要爆了显存跑起来都非常慢,4 步 10 秒 121 帧 视频要 50 分钟。跑个 5 秒 61 帧小图不爆显存也要个几分钟。所以一直都用 gguf 量化,而且要卡着单个高低噪模型大小 12-13gb 左右的来跑,不然不光 16gb 显存不够,内存也不够,两个高低噪模型 64 内存很容易占满跑硬盘上,电脑直接卡死。今年新出的 ltx2.3,有 fp8 和 nvfp4 版本。fp8 模型大小 20+ g 一如既往显存占到 24g,内存直接爆了 64g 跑硬盘动不了一点。上了 nvfp4 模型模型大小也有 20g,显存占用到 20g 也爆掉了,但内存占用只有 30g,而且 10 秒 241 帧视频含 961 帧音频的只需要 2 分钟。爆不爆显存好像也没那么重要了,内存需求也降低了很多。
2026年06月14日 03点06分 1
level 8
我 4060 笔记本,32g 内存都能跑得动 ltx2.3 fp8 精度的模型啊,生成 24 帧 720p 大小 10s 的视频需要 10 分钟左右,楼主你是不是帧率太高或者分辨率太高了啊,大几十分钟有点夸张了
2026年06月14日 04点06分 2
之前是跑的 wan2.2。之后的 ltx2.3 爆了内存就直接暂停不跑了,太卡了。
2026年06月14日 04点06分
level 5
fp4是50系专用模型来着,我5080用fp4也很快
2026年06月14日 04点06分 3
[阴险][阴险]但是黑心装机的会向你推大显存矿卡,什么2080ti22g,3080 20g,3090之类的,就算新点的40系,也没有fp4不知道有啥明显优势,50系的16g能办很多事了
2026年06月14日 09点06分
@boafightin 魔改的大概率没有售后,高强度炼丹迟早会炸的,买50系至少有质保,个人玩家16g也够用了
2026年06月14日 10点06分
所以40系是不能用nvfp4模型吗
2026年06月14日 10点06分
@网友飞爸粪前 应该也可以用吧,只是没有50系的加速
2026年06月14日 10点06分
level 5
wan2.2也有单采模型,比双采速度快一倍,但是无法兼容首尾帧工作流。
2026年06月14日 04点06分 4
level 1
wan2.2也出了NVFP4版本的模型了
2026年06月14日 06点06分 5
level 6
但是效果变差了
2026年06月14日 09点06分 6
@as85931892010 没办法的事,能跑 fp8 版本的显卡太贵了。而且内存保险也要加到 128,太贵了。
2026年06月14日 14点06分
效果不会差太多,用来自娱自乐足够了
2026年06月15日 02点06分
level 8
效果质量如何呢?为什么我出来的视频都挺烂的呀
2026年06月15日 02点06分 7
图生视频还可以,感觉二次元nsfw比wan2.2那堆莫名其妙脸部崩坏,跑跑着跑着变写实的微调好。文生视频还没试过。
2026年06月15日 06点06分
level 10
是分辨率设置过高了吧?我5060ti 16g+64g跑wan2.2 fp8模型图生视频960*720/121 4步,大概500秒。
2026年06月15日 06点06分 9
@职业killer 我用enhanced、dasiwa的fp8高低噪各14g,也有用官改的gguf q8是15g。
2026年06月15日 11点06分
不记得了,你的fp8模型有多大啊。
2026年06月15日 06点06分
@金拱门上校 那 8g 肯定跑不动啊,是用了什么低显存的插件吧。没用过。
2026年06月15日 11点06分
level 11
我宁愿用时间换精度。
你的消耗时长肯定不对,还不如我的4060。自己好好检查下吧。
2026年06月15日 07点06分 10
AI玩的是抽卡吧,生成速度还是比较重要的。4060才8g显存哦,你跑的什么量化级别的模型。
2026年06月15日 08点06分
@职业killer 16G显存到底有多LOW? 看我这帖子,写的很详细。
2026年06月15日 11点06分
level 4
不应该啊,我搭建的wan2.2工作流加对口型等节点24g显存大约八九分钟就可以了
2026年06月15日 12点06分 11
5080 16G
2026年06月15日 13点06分
level 4
你不要把分辨率设置过高,可以分两个工作流,一步出ftp16 480p的视频,一步用seedvr插帧高分
2026年06月15日 12点06分 12
我是直出的,然后如果把时间设置10S,帧数一多,一开始还好就占用15G+,跑到后面就逐渐爆了,很慢。
2026年06月15日 13点06分
level 7
受楼主提示,把Q8替换为nvfp4跑了几轮,感觉就只是占用低了些,速度稍快一点点,画质还是够不上Q8水平,跟fp8有一拼,有没有玩wan2.2跟我观感相同的?还是有什么优化lora要加上?
2026年06月17日 03点06分 13
fp4精度低,画质肯定不如fp8和q8的,优势是资源占用和速度。之前问过AI,量化模型的质量方面q8质量最好,其次是fp8,然后llm方面还有iq系列的,比一般的q质量更好。
2026年06月17日 08点06分
level 1
不至于啊,肯定设置有问题,本人的4070tis跑720p,24帧,8秒视频也只要300-400秒左右
2026年07月23日 07点07分 14
建议用fp8模型,gguf又慢又不节省显存,中间因为要转换数据浪费时间
2026年07月23日 07点07分
1