File tree Expand file tree Collapse file tree
Expand file tree Collapse file tree Original file line number Diff line number Diff line change 55脚本编写于 python 3.7
66
77说明:
8- 谷歌云服务及SRT转换均参考了该项目:https://github.com/darshan-majithiya/Generate-SRT-File-using-Google-Cloud-s-Speech-to-Text-API.git
8+ 谷歌云服务及SRT转换均参考了该项目:
9+ https://github.com/darshan-majithiya/Generate-SRT-File-using-Google-Cloud-s-Speech-to-Text-API.git
910使用过程中发现,对于上面项目中仅仅按照时间段分割英语单词的方式,非常不适合中国人以字为单位的语言习惯,
1011经过反复测试修改,始终有语句中断错乱、时码偏差较大的问题,
1112最后干脆将分割方式按照我的预想进行了重写,并添加了自动判断发音习惯参考值的功能(比较简陋,但是可以自适应不同人的语速了),
1213现在的版本是我正在使用,感觉比较良好的一个版本,现只分享出转换SRT字幕部分的代码,
1314完整的谷歌云语音识别服务的上传、接收脚本,请参考上面的项目。
1415
1516已知问题:
16- 1.鉴于谷歌声音识别服务的一些缺陷(个人感觉是谷歌开发人员不怎么用这个服务吧)转换出来的内容 ,会分为几个段落,
17+ 1.谷歌声音识别服务转换出来的内容 ,会分为几个段落,但鉴于转换之后的一些缺陷(个人感觉是谷歌开发人员不怎么用这个服务吧)
1718 SRT转换以后,对于每段最后一个字的时长无法与下一段落的起始字时间对接,导致每个段落最后一句显示的时长不够。
1819 现将毫秒数x2以便不至于过短,我也懒得继续尝试,反正还需要用字幕软件校对一遍内容及部分时码。
19202.语音识别服务产生的时码,跟音频时码有偏差,基本上整体会慢不到1秒(也有部分句子时码刚好),
You can’t perform that action at this time.
0 commit comments