之前尝试过各种本地大模型识别日语字幕,但是准确率都不够满意,尤其是时间轴很混乱,没法正常用。 时隔数月,突然想到,时间轴如果是确定的,那把音频切割开来,一句一句识别,加上 Codex 根据本地识别结果和中文翻译再联网 review ,可能可行。 本地用 whipser-v3 做初步识别,置信度低的找 whisper-v2 再次识别,随后让 Codex 对有争议的结果进行判断和联网查询。最后仍然会有个别结果不确定需要人工确认,但一集动漫一般就几句。 之所以要这么做是因为一些动漫只有精确的中文字幕,但网上公开的日语字幕,例如 jimaku.cc 下载的,不太符合中国人的使用习惯,经常将 2 句合并到一起,而且有不少内部换行。 另外,Bang Dream 的第二季和第三季我没找到任何日语字幕,中文字幕是有的,利用这个我今天制作了几集双语字幕,准确率接近 100%了。 所以大家可以考虑用这个方法复活自己喜欢的动漫的日语字幕了,大部分动漫还是有外挂中文字幕的。
利用精确时间轴精确识别日语字幕
内容版权声明:除非注明,否则皆为本站原创文章。
上一篇
没有了
下一篇
我惊了,梁文锋还活着么?