乱码修复工具:针对"中文变成测试""çœ‹ä¸æ‡‚"这类典型乱码,自动推断原编码与错误转换路径并还原文本。省去逐个试编码组合的过程。
适用场景
- 打开老项目源码、日志、CSV 全是西文杂字符
- 数据库导出数据中文变问号或替身字符
- 邮件、网页正文出现成对古怪符号
常见问题
乱码是怎么产生的?
几乎所有乱码都是"编码被搞混":文本按 A 编码(如 UTF-8)存储,却按 B 编码(如 Latin-1)解码显示。字符本身没坏,只是被错误翻译了一遍——所以多数乱码可以还原。
为什么有些乱码修复不回来?
若解码时遇到目标编码里不存在的字符,被替换成问号(?)或 U+FFFD,原始字节已丢失,信息不可逆。看到成片的 ? 或方框时,要回到数据源头重新按正确编码读取。
怎么避免再出现乱码?
全链路统一 UTF-8:文件保存、数据库连接、HTTP 响应头、终端编码都显式声明 UTF-8。中文 Windows 上的老工具默认 GBK,是重灾区,注意导出时手动选择。