@Acely实际上,Shift+F8这个功能,我本人只用过三次,只用于测试,此后再也没用过。
这个功能,过于理想主义,没有考虑到现实中一些客观存在的变数,复杂的因素。
它有个很重要的前提:你切了100条轴(100个空白字幕块),必须要有100条字幕,跟它一一对应。
1、在数量上,多一条少一条都不行,否则一定错位。
很可能,你切出了100条字幕块,但只有99条字幕。或者你做出了100条字幕,但只切出了99条字幕块。
这样一来,查错、纠错的时间成本很高,因为你很难迅速判断:哪个节点出了问题,必须全面抽查或排查。
一二十分钟的短片子还好办,一两个小时的长片子就很棘手,从何查起?会把人搞得抓耳挠腮,心神不宁。
Shift+F8的设计初衷,本意是为了提高效率,结果事与愿违,时间都浪费在排查环节,跟初衷相违背。
2、即便数量上做到了相同,每条字幕跟实际的波形是否真正的一一对应,这是个很大的问号。
因为你切字幕块的时候,有可能考虑到了断句,但做字幕文本的时候,没有断句。反过来也一样,你做字幕文本的时候,考虑到了断句,但切字幕块的时候,没有断句。
因为这两道工序是分开来做的,有先后顺序的,甚至是两个人通过协作完成的,既然是两个人,思想上就不太可能统一。无论主观意识、客观意志,都难以做到统一。
一个人都难以做到统一,何况两个不同的人?
以上两条,由于冥冥之中存在不确定性,不可控因素,很容易卡壳,会导致Shift+F8的实用性大打折扣。听起来似乎很美好,操作起来很不容易。
象我这样的熟手,利用自已熟悉的长视频,测试三次,前两次都是失败的,第三次才成功。其它缺乏经验的网友,成功率可想而知。
再说说字幕稿这件事。
官方的所有教程,都建立在事先有字幕稿的前提下,这也是理想主义的体现,严重脱离现实,不了解用户的现实状况。
现实当中,大部分人(至少90%以上)是没有字幕稿的,只有少数情况会有字幕稿。
有了自动切轴、语音识别功能,是否就可以取代、取消字幕稿?
答案是否定的!字幕稿这一传统习惯,在长时期内将持续存在。
道理很简单:自动切轴,做不到100%的准确率,语音识别做不到100%的识别率,无论你再怎么智能,人工校正,依然不可或缺。
用户受惯性驱使,会把字幕稿这个人工作业方式,视为主流方式。自动切轴、语音识别,视为辅助手段。
大部分人、大多数的视频,都有背景音乐。对于自动切轴、语音识别,是一大技术挑战。
如果大多数人,只能做到75%以下的成功率,用户会怎么做?
——回归传统,采用人工打轴,手工做字幕稿。
因为25%的不成功率,还不如手工作业,来得顺手。25%的失败,会掩盖75%的光芒。
现在断言:可以取消字幕稿,过于乐观,为时尚早。必须清醒地认识到一点。