返回首页

乱码修复 - MyTools在线工具

🧰 MyTools

乱码修复

原理:把文本按「误读时用的编码」还原为字节,再以正确编码重新解码。 常见场景:Javanew String(bytes)用错字符集、文件被浏览器/编辑器以错误编码打开、 数据库连接编码不一致。GBK/UTF-8 双向、Latin1→UTF-8 方向自动尝试,按中文可读性排序,全程本地计算。

乱码修复工具:针对"中文变成测试""çœ‹ä¸æ‡‚"这类典型乱码,自动推断原编码与错误转换路径并还原文本。省去逐个试编码组合的过程。

适用场景

  • 打开老项目源码、日志、CSV 全是西文杂字符
  • 数据库导出数据中文变问号或替身字符
  • 邮件、网页正文出现成对古怪符号

常见问题

乱码是怎么产生的?

几乎所有乱码都是"编码被搞混":文本按 A 编码(如 UTF-8)存储,却按 B 编码(如 Latin-1)解码显示。字符本身没坏,只是被错误翻译了一遍——所以多数乱码可以还原。

为什么有些乱码修复不回来?

若解码时遇到目标编码里不存在的字符,被替换成问号(?)或 U+FFFD,原始字节已丢失,信息不可逆。看到成片的 ? 或方框时,要回到数据源头重新按正确编码读取。

怎么避免再出现乱码?

全链路统一 UTF-8:文件保存、数据库连接、HTTP 响应头、终端编码都显式声明 UTF-8。中文 Windows 上的老工具默认 GBK,是重灾区,注意导出时手动选择。

相关工具