人民日报
SRT 文件的基本结构也会影响识别结果。每段字幕通常包含序号、时间范围、字幕文本和空行,时间格式应类似“00:01:12,500 -📚-🌟> 00:01:15,200”。如果转换编码后仍然显示异常,应检查箭头、逗号、换行和空行是否被编辑器改写。
ASS 字幕排查可以先用文本编辑器检查正文是否乱码,再用字幕编辑器删除异常字体、特效和复杂定位标签,另存为兼容性更好的 ASS 或 SRT。转换成🔑 SRT 会丢失颜色、位置、描边和卡拉 OK 等效果,但适合验证文字内容是否已经恢复。
字幕乱码排查需要先区分文字损😎坏、字体缺失、时间轴错误和字幕来源不匹配,因为四类问题的处理方式完全不同。
画面中的乱码若来自硬字幕,只能寻找未压制字幕的片源、使用字幕识别工具提取文字,或者重新制作字幕。识别结果需要人工核对同音字、专有名词、数字和标点,不能把 OCR 输出直接当作准确字幕。
中文与日文混合字幕的长期保存应统一编码、明确文件类型并保💡留原始副本,这比每次播放时临时切换字符集更稳定。