一段文字转语音,往往只差一两个字。
整段内容都读得自然,唯独其中几个字读错了。内容没有问题,问题只在读音;但要修正,你只能回到文字内容改写,再重新生成一次——而每一次重新生成,都会扣除分钟。
如果你经常使用文字转语音,应该试过这种情况:今天终于试出正确的写法,下星期写新稿时,同样的字又要从头试一次。经验无法累积,分钟却一直在扣。
所以我们做了「读音替换」。同一个字,只需要教系统一次。
下次写新稿:同一个字,从头再兜一次。
下次写新稿:列表自动应用,不必再试。
一、为什么 AI 会读错字
中文有大量同形异音字,语音模型需要靠上下文判断读音,而判断不会每次都准确。粤语尤其明显:口语用字与书面写法本来就不完全对应,模型看见的字形,未必等于你心中的读音。
以这句为例:
「我地返到公司搵咗好耐,都無人應,唯有當佢放咗假,但佢咁樣做係唔啱架。」
模型可能会把「搵」读成「温」、「無」读成「毛」、「架」读成「假」。逐个字都说得通,合起来却不是你想说的那句话。
解决方法其实一直都在:把「搵」写成「穩」、把「架」写成「嫁」,读出来就对了。难的不是知道方法,而是每次都要重新记起自己上次是怎样写的。
二、把写法交给系统记住
第一步:打开「读音替换」

在文字转语音页面,文字内容框下方就是「读音替换」。
第二步:新增替换

面板分为「本次应用」与「我的列表」。按左下角的「新增替换」开始。
第三步:填入原字与替换字

左边填原字、右边填替换字,例如「搵 → 穩」、「架 → 嫁」、「當 → 檔」。下方备有常见例子,按一下即可填入表单,你确认后才会保存。
列表就是这样一条一条累积起来。

第四步:贴上文字,系统立即告诉你有多少处

把同一段文字贴回文字内容框,入口会即时显示「读音替换 · 5 处」。你不需要自己再逐句对照。
第五步:生成前先确认

按下「生成语音」,确认窗口会列出本次应用的处数,按「查看/调整」可以逐条查看。
第六步:逐条查看,决定今次应用什么

系统会列出每一条命中的规则、命中次数,以及该字在原文中的上下文。全部默认勾选;某一条这次不想应用,取消勾选即可——只影响今次生成,列表不会被改动。
按「完成」,再按「确认生成」。这一次听到的,就是正确的读音。
三、几件值得知道的事
- 只影响读音,不影响你想说的内容。 应用后,作品的文字内容会同步更新为实际读出的文字,让你能分辨问题出在内容还是读音。
- 规则会应用到全文所有相同字词,在按下生成时才替换,请先检查上下文。
- 语气、笑声与停顿标签不会被替换,例如 (laughs) 与停顿标记都受保护。
- 每个账户最多 200 条,全部集中在同一份列表。 无论选用哪一种发音语言,同一份列表都会应用。
- 加入、修改或删除替换都不会扣除分钟。 分钟只在生成语音时计算。
省下的不只是分钟
一个读错的字,本身是小事。但小事乘以每次重新生成的分钟,再乘以每一份稿,就不再是小事。
这个功能没有让 AI 变得更聪明,它只是记住了你已经知道的答案。
如果你希望我们加入什么改进,欢迎通过网站的在线对话,或发邮件至 support@heysubtitle.com 告诉我们。
