求助Minimaxh3多角色对话音色参考问题
comfyui吧
全部回复
仅看楼主
level 7
不知道吧里有没有大佬尝试过多角色对话(2个)音色参考,我这几天鼓捣这个,用两个角色图1图2分别参考音频1音频2,提示词是用gpt5.6装了官方skill写的,结果怎么写,图1只要先说话必定会参考音频2的声线,然后图2就会参考音频1,而且还有个问题,如果连续两段对话都是图2说的,就会第一句先参考音频1,第二句参考音频2,到底是什么问题,折腾好几天了都是这样[喷]。想做个正片完全做不了。
2026年08月15日 01点08分 1
level 6
minimax好像不支持参考音色,我之前也想搞,codex跟我说不支持
2026年08月16日 10点08分 0
支持的,还原的还挺好,就是老反向参考
2026年08月16日 10点08分
level 7
坏了,没有遇到的[喷]
2026年08月15日 02点08分 2
全网都没有我遇到的问题,看来只有一个真相了,我显卡可能要报废了。[喷]
2026年08月15日 02点08分
level 6
用一张图片和一段音频生成一段视频,不就是这个角色的参考视频了
2026年08月15日 08点08分 3
level 1
你求助至少把提示词贴出来啊,是不是按官方ref2va的6段式格式写的?音频参考怎么定义的?
2026年08月16日 01点08分 4
是6段,我gpt5.6安装了官方skill输出的提示词,甚至提供了所有参考让g导照着写的[喷]
2026年08月16日 10点08分
level 1
我也遇到了,一样的问题
2026年08月16日 09点08分 5
level 5
这个问题我还没发现,有个更大的问题,比如10秒的视频,角色的台词有7秒,剩下的3秒他会循环之前的部分台词甚至是几里哇啦乱叫一通硬生生填满,这个咋解决[泪]
2026年08月22日 17点08分 7
level 7
我也经常遇到这样的,不过我用的f模型,因为据说f模型画质好
2026年08月22日 21点08分 8
1