Skip to content

Commit e458c0f

Browse files
authored
Update SRT_for_Chinese_v2.py
1 parent a7800f1 commit e458c0f

1 file changed

Lines changed: 3 additions & 2 deletions

File tree

SRT_for_Chinese_v2.py

Lines changed: 3 additions & 2 deletions
Original file line numberDiff line numberDiff line change
@@ -5,15 +5,16 @@
55
脚本编写于 python 3.7
66
77
说明:
8-
谷歌云服务及SRT转换均参考了该项目:https://github.com/darshan-majithiya/Generate-SRT-File-using-Google-Cloud-s-Speech-to-Text-API.git
8+
谷歌云服务及SRT转换均参考了该项目:
9+
https://github.com/darshan-majithiya/Generate-SRT-File-using-Google-Cloud-s-Speech-to-Text-API.git
910
使用过程中发现,对于上面项目中仅仅按照时间段分割英语单词的方式,非常不适合中国人以字为单位的语言习惯,
1011
经过反复测试修改,始终有语句中断错乱、时码偏差较大的问题,
1112
最后干脆将分割方式按照我的预想进行了重写,并添加了自动判断发音习惯参考值的功能(比较简陋,但是可以自适应不同人的语速了),
1213
现在的版本是我正在使用,感觉比较良好的一个版本,现只分享出转换SRT字幕部分的代码,
1314
完整的谷歌云语音识别服务的上传、接收脚本,请参考上面的项目。
1415
1516
已知问题:
16-
1.鉴于谷歌声音识别服务的一些缺陷(个人感觉是谷歌开发人员不怎么用这个服务吧)转换出来的内容,会分为几个段落,
17+
1.谷歌声音识别服务转换出来的内容,会分为几个段落,但鉴于转换之后的一些缺陷(个人感觉是谷歌开发人员不怎么用这个服务吧)
1718
SRT转换以后,对于每段最后一个字的时长无法与下一段落的起始字时间对接,导致每个段落最后一句显示的时长不够。
1819
现将毫秒数x2以便不至于过短,我也懒得继续尝试,反正还需要用字幕软件校对一遍内容及部分时码。
1920
2.语音识别服务产生的时码,跟音频时码有偏差,基本上整体会慢不到1秒(也有部分句子时码刚好),

0 commit comments

Comments
 (0)