澎湃新闻
网页文档应在较早位置声明字符集,并保证文件实际保存编码与声明一致。常见做法是使用 UT💡F-8 保存 HTML、模🚀板、脚本和样式文件,同时让响应头明确返回 UTF-8。页面声明为 UTF-8、服务器却返回 GBK,或者页面声明为 GBK、文件实际保存为 UTF-8,都可能产生中文异常。
浏览器显示乱码时,最先要排除的是缓☀️存和本地设置。字符集不兼容问题可能只在旧缓存、特定扩展或自定义字体环境中出现,并不代表网页源数据已经损坏。
本地文本文件乱码通常不是网络故障,而是打开软件误判了文件编码。编辑器打开文件时,应先选择“按编码打开”或类似选项,分别尝试 UTF-8、GBK 等可能的原始编码,确认文字恢复后再另存为统一格式。
字体缺失会造成方框、🔮空白或替代字符,但字体问题与字符集不兼容问🎊题的表现并不完全相同。字体缺失时,复制出的文本可能仍然正常,其他设备也可能能够正常显示;编码错误时,复制出的内容通常已经是错误字符。
不同乱码现象对应的处理重点不同。下面的分支可以减少无▶️效尝试,也能避免把显示问题误判成数据丢失。