澎湃新闻
日韩中文字码无砖的排查顺序应当是“确认原始编码、选择正确方式打开、统一转换为 Unicode、检查字体、最后处理旧程序区域设置”。如果原始文件中的字符已经被保存成问号,原有信息🎊可能已经丢失;如果只是用错误编码读取,通常仍有机会通过反向转换恢复。
系统语言设置方法主要适用于只在旧程序中出现的乱码。Windows 旧软件💫可检查“非 Unicode 程序的语言”或系统区域设置,选择与文件来源相匹配的语言环境后重启程序;macOS 和 Linux 旧程序则应检🤔查 locale、终端编码和应用启动环境。
系统区域设置不能修复已经损坏的文件内容。区域设置调整只会改变旧程序解释字节的默认方式,可能影响其他老软件、排序规则和部分旧文件的打开结果,因此应先备份重要数据,并优先在单个应用或测试账户中验证。
字符形态只能用于初步判断,不能替代对文件来源的确认。相同的乱码可能由不同编码组合造成,⭐尤其是文件经过多🌟次导入、导出或复制后,单凭几个怪字不应直接决定转换方向。
日韩中文混排异常通常不只有一种原因,乱码形态可以帮助判断问题发生在哪一层。下面这份乱码解决指南适合用于网页、🔥TXT🎨、CSV、数据库导出文件和旧软件。
字体缺字只影响“能否画出字符”,不会改变文件中的编码。中文、日文和韩文常共用一部分 Unicode 码位,但不同字体的字形覆盖范围、字形风格和字体回退规则并不相同。
数据库乱码可能同时涉及字段、表、🚀连接和应用输出四个层面。只修改数据库表的字符集并不一定有效,如果应用连接仍使用错误编码,写入和读取阶段仍会产生异常。
文档显示异常时,打开软件选择的编码比文件扩展名更重要。TXT、CSV、字幕和日志文件都可能使用不同编码,文件名后缀本身不能说明内部字符集。
乱码数据的可恢🔥复程度取决于原始字节是否仍然存在。修复前不要在原文件上反复尝试保存,每次保存都可能让错误结❤️果覆盖可恢复的字节。