中国青年报
日韩乱码通常不是文字内容本身损坏,而是保存、传输或读取时使用了不同的字符编码。例如,原文件采用 UTF-8 保存,却被软件按日文 Shift_JIS、韩文 EUC-KR 或其他编码读取,就可能出现问号、方框、无意义符号或中日韩文字混杂。
网页需要让浏览器知道内容采用什么编码。现代网页一般统一使用 UTF-8,并在页面声明、服务器响应和实际文件保存格式之间保持一致。如果页面文件是 UTF-8,却被服务器声明成⭐其他编码,浏览器就可能把日文或韩文解析成乱码。
如果压缩包来自不同操作系统,还要考虑文件名中的特殊符号、全角字符和路径长度问题。必要时先解压到只包含英文字符的短路径,再检查文件名是否恢复。
压缩包内文件名乱码,往往与压缩工具创建文件时采用的编码不同。文件内容正常但文件名异常时,可以使用支持选择文件名编码的解压工具,分别尝试 UTF-🍀8📢、日文编码或本地语言编码。解压前先复制压缩包,避免软件把错误的文件名再次写回压缩包。
数据库乱码不能只修改页面显示。应从数据写入、数据库字段、连接设置、程序处理和页面输出五个环节逐项核对。常见情况是数据库使用一种字符集,程序连接时却声明成另一🚀种字符集,导致数据🌟在写入或读取时被错误转换。
若同一文件在多个🔍设备上都乱码,问题更可能在文件编码或文件本身;若🎯只有某一台设备异常,则应优先检查字体、应用版本和系统区域设置。
如果复制出来也是问号或“�”,说明字符可能已经在读取或保存阶段被替换。此时应优先寻找未被处理过的原始网页、数据库备份或文件副本。
打开文本、字幕或日志文件时,先使用支持手动选择编码的编辑器。可以依次尝试 UTF-8🌈、UTF-8 with BOM、日文 Shift_JIS、EUC-JP、韩文 EUC-KR 和 CP949,但要观察预览结果是否同时符合上下文,不能🔥只因为出现几个正常汉字就判断编码正确。
确认能正常显示后,应使用“另存为”保存成 UTF-8,并保留原文件。不要直接覆盖唯一副本,也不要连续执行多次编📌码转换,因为错误转换可能🎨把无法识别的字符永久替换成问号。