
一、这个插件能做什么
“TXT编码转换”用于检测并批量转换 .txt 文本文件的字符编码。它可以在 UTF-8、UTF-16、GBK、GB18030、Big5 和 Shift-JIS 等编码之间转换,并把结果保存到单独目录。
它适合以下场景:
TXT 文件打开后出现乱码,需要转换为正确编码。
某个系统只接受 UTF-8、GBK 或其他指定编码。
一批旧的简体中文 TXT 文件需要统一转为 UTF-8。
需要保留原文件名和子文件夹结构,批量生成转换结果。
需要检查文件是否能被严格解码,避免用错误编码产生不可逆乱码。
插件会保留:
原文件名。
文件相对于 TXT 目录的子文件夹结构。
解码后的字符内容。
原有换行符,包括 CRLF 和 LF 混合换行。
插件不会覆盖原文件。转换结果写入另外的“保存目录”。
重要:编码转换的关键不是“选一个看起来常用的编码”,而是先正确识别来源编码,再选择目标编码。来源编码选错时,文件即使能够解码,也可能得到错误文字。遇到不确定的传统编码时,应先用少量文件验证。
二、什么是“文本编码”
TXT 文件在磁盘中保存的是字节。编码规定这些字节如何对应中文、英文、日文、符号和表情等字符。
同一串字节用不同编码读取,可能显示为不同文字或乱码。例如,一个本来使用 GBK 保存的中文文件,如果被软件当作 UTF-8 打开,通常会出现乱码或读取失败。
常见概念:
“来源编码”:原 TXT 文件当前使用的编码。
“目标编码”:希望转换结果使用的编码。
“BOM”:位于文件开头的编码标记,常用于 UTF-8 BOM、UTF-16LE 和 UTF-16BE。
“自动检测”:插件先检查 BOM,再严格检查 UTF-8,最后比较多个传统编码候选;无法唯一判断时不会冒险猜测。
编码转换不会翻译语言。把 GBK 转为 UTF-8,只改变保存文字的字节方式,不会把中文翻译成英文。

三、开始前请先准备
正式操作前,请完成以下准备:
确认待处理文件的扩展名是
.txt;其他扩展名不会进入列表。把同一批次中来源编码相近的文件放在一起。若文件编码混杂且自动检测无法确定,应分批处理。
准备一个与 TXT 目录不同的保存目录。
如果开启“包含子文件夹”,保存目录不要放在 TXT 目录内部。
关闭正在编辑这些 TXT 文件的软件,避免扫描后内容又发生变化。
对重要文件保留独立备份。虽然插件不覆盖原文件,但正确备份仍是最可靠的保护。
如果文件来自移动硬盘、共享盘或网盘,确认连接稳定并等待同步完成。
多选单独文件时,尽量让它们位于同一个磁盘和同一个公共目录下;不同磁盘的文件请分批处理,以免无法建立统一的相对目录。
建议先拿 2~3 个具有代表性的文件试转换,再用记事本、Notepad++、VS Code 或业务系统检查结果文字是否正确。
四、如何打开插件
打开吉米工具箱。
进入工具箱的“本地应用”列表。
找到名称为“TXT编码转换”的插件。
单击插件卡片或打开按钮。
窗口顶部有两个标签页:
“操作”:选择 TXT、扫描检测、选择保存目录、开始转换和查看状态。
“配置”:选择来源编码和目标编码。
窗口右上角还有:
“返回”:返回本地应用列表。
“置顶”:让窗口保持在其他窗口上方;再次单击可取消。
五、认识完整操作流程
推荐按以下顺序使用:
在“配置”页先把“来源编码”设为“自动检测”,选择所需“目标编码”。
回到“操作”页,选择 TXT 目录或多个 TXT 文件。
决定是否开启“包含子文件夹”。
等待文件检测完成。
查看每个文件的“检测编码”“置信状态”和“状态”。
如果出现“需要指定源编码”,按提示分批选择正确来源编码并重新加载验证。
选择与 TXT 目录分离的保存目录。
确认列表和目标编码无误,单击“开始转换”。
等待任务结束,检查成功、已跳过、待指定和失败数量。
到保存目录中打开转换结果并抽查内容。
“加载文件”阶段会读取文件并检测编码,但不会写转换结果。只有单击“开始转换”后,插件才会在保存目录中创建文件。
本插件没有单独的“生成预览”按钮。加载后的编码检测表格就是转换前检查页。本插件也没有撤销功能,因为原文件从不被覆盖;已经生成的结果如不需要,应到保存目录中手工删除。
六、添加 TXT 文件和文件夹
方法一:选择一个 TXT 目录
在“操作”页找到“TXT目录”。
单击右侧“选择”按钮。
在出现的菜单中选择“选择 TXT 目录”。
在 Windows 文件夹选择窗口中找到目标文件夹。
确认选择。
插件立即扫描目录并检测 TXT 文件编码。
方法二:选择一个或多个 TXT 文件
单击“TXT目录”右侧“选择”。
选择“选择 TXT 文件”。
在 Windows 文件选择窗口中找到文件。
如需多选,可按住
Ctrl再逐个单击,或用鼠标框选。单击“打开”。
插件只接收扩展名为
.txt的文件,并立即进行检测。
选择多个单独文件后,界面中的“TXT目录”会显示这些文件的公共父目录。当前列表仍以本次明确选中的文件为准。
注意:以后如果直接单击“加载文件”,插件会按“TXT目录”中显示的公共目录重新扫描,可能把同目录里的其他 TXT 文件也加入列表。只想处理刚才单独选择的文件时,选择完成后直接检查列表并开始转换,不要额外单击“加载文件”。
方法三:拖入 TXT 文件或文件夹
打开 Windows 文件资源管理器。
选择一个或多个
.txt文件,或者选择文件夹。把它们拖到上方“TXT目录”区域,或者下方“文件列表”区域。
看到高亮提示后松开鼠标。
插件会扫描本次拖入的路径并重新生成文件列表。
拖入操作会按本次拖入内容重新加载列表,不会在现有检测结果后简单追加。需要同时处理多个文件时,请在同一次拖拽中一起选中,或使用“选择 TXT 文件”的多选功能。
手工输入路径
“TXT目录”和“保存目录”输入框允许填写路径。手工填写时应使用完整 Windows 路径,例如:
D:\资料\待转换TXT
手工填写 TXT 目录后,要单击“加载文件”才会扫描。电脑操作经验较少时,优先使用“选择”按钮,能减少路径输入错误。
七、理解“包含子文件夹”
关闭:只扫描 TXT 目录最外层的
.txt文件。开启:扫描 TXT 目录及所有下级文件夹中的
.txt文件。
切换开关后,如果已经有 TXT 目录,插件会自动重新加载。
示例:
D:\待转换
├─ 说明.txt
└─ 资料
└─ 内容.txt
关闭时只加载
说明.txt。开启时加载
说明.txt和资料/内容.txt。
非 TXT 文件会被忽略,包括 .csv、.log、.docx 等。.TXT 大写扩展名也会被识别。
开启子文件夹时,保存目录不能位于 TXT 目录内部,否则下一次扫描可能把输出再次当作输入。插件会直接阻止这种目录布局。
八、选择保存目录
在“操作”页找到“保存目录”。
单击右侧“选择”。
选择一个与 TXT 目录不同的文件夹。
也可以把文件夹拖到“保存目录”区域。拖入多个路径时只使用第一个路径,因此请只拖入一个明确的文件夹。
如果手工填写一个尚不存在的完整目录,插件在开始转换时会尝试创建它;为减少权限和输入问题,普通用户建议直接选择一个已有文件夹。
目录限制:
TXT 目录和保存目录不能是同一个目录。
开启“包含子文件夹”时,保存目录不能位于 TXT 目录内部。
保存目录必须可创建、可访问并允许当前 Windows 账号写入。
转换结果会保持相对目录。例如:
TXT目录:D:\待转换
源文件:D:\待转换\章节1\内容.txt
保存目录:D:\转换结果
结果文件:D:\转换结果\章节1\内容.txt
九、来源编码选项详解
打开“配置”标签页,在“来源编码”中选择原文件编码。这个设置对本次列表中的所有文件统一生效,不是逐文件单独设置。
1. 自动检测(推荐先用)
插件按以下顺序判断:
检查 UTF-8 BOM、UTF-16LE BOM、UTF-16BE BOM。
没有 BOM 时,使用严格规则验证 UTF-8。
UTF-8 不成立时,分别尝试 GBK、GB18030、Big5、Shift-JIS。
传统编码候选必须能够严格解码,并且重新编码后字节完全一致。
如果多个候选会得到不同文字,插件不猜测,状态显示“需要指定源编码”。
自动检测可避免很多常见乱码,但任何没有明确标记的传统编码都可能存在歧义。看到“需要指定源编码”时,必须人工确认。
2. UTF-8 无 BOM
适用于明确知道原文件是 UTF-8 且开头没有 BOM 的情况。
手动选择该项时,如果文件实际带有 UTF-8 或 UTF-16 BOM,插件会认为来源设置与文件不一致并报错。
3. UTF-8 BOM
适用于明确带 UTF-8 BOM 的文件。手动选择此项时,文件必须真的以 UTF-8 BOM 开头,否则会失败。
4. UTF-16LE
适用于 UTF-16 小端文本。可以处理带匹配 BOM 的文件,也可在用户明确指定时尝试无 BOM 的 UTF-16LE 文件。若文件带的是其他 BOM,会被拒绝。
5. UTF-16BE
适用于 UTF-16 大端文本。规则与 UTF-16LE 类似,但字节顺序不同。不要仅凭名称相似随意互换。
6. GBK / 代码页 936
常见于旧版 Windows 简体中文软件和历史中文 TXT 文件。GBK 能表示的字符范围比 GB18030 小。
7. GB18030
中国国家标准编码,字符覆盖范围比 GBK 更广,也能表示一些 GBK 无法保存的字符。部分 GBK 内容也可能同时是有效的 GB18030,因此自动检测会根据严格结果判断是否存在歧义。
8. Big5 / 代码页 950
常见于繁体中文旧系统。简体中文文件通常不应选择 Big5。
9. Shift-JIS / 代码页 932
常见于日文旧系统和日文文本。非日文文件不要因为“能打开”就直接选择该编码。
手动指定来源编码的建议
手动编码会应用到整批文件。若一批文件实际包含 GBK、Big5、UTF-8 等多种编码,请分批选择同类文件,分别转换。不要用同一个手动来源编码强行处理混合文件。
选择手动来源编码后,建议重新单击“加载文件”,确认列表中的“检测编码”和“置信状态”变为预期结果,再开始转换。
十、目标编码选项详解
“目标编码”决定结果文件的保存方式。
1. UTF-8 无 BOM
默认选项。兼容现代软件、网站、程序和跨平台系统,通常是最推荐的通用格式。
如果接收软件明确要求“UTF-8 不带 BOM”,选择此项。
2. UTF-8 BOM
在 UTF-8 文件开头添加 BOM。一些旧版 Windows 软件或表格工具依赖 BOM 识别 UTF-8 中文时,可选择此项。
3. UTF-16LE BOM
输出 UTF-16LE,并写入 BOM。文件通常比 UTF-8 更大。只有目标系统明确要求时再选择。
4. UTF-16BE BOM
输出 UTF-16BE,并写入 BOM。适用于明确要求大端 UTF-16 的系统。
5. GBK
适用于只接受简体中文 Windows 代码页 936 的旧系统。GBK 无法表示部分生僻字、其他语言字符和 emoji;遇到无法表示的字符时,插件会失败,不会用问号偷偷替换。
6. GB18030
适用于明确要求 GB18030 的系统,字符覆盖比 GBK 更广。
7. Big5
适用于明确要求繁体中文 Big5 的旧系统。无法表示的字符会导致失败。
8. Shift-JIS
适用于明确要求日文 Shift-JIS 的旧系统。中文、emoji 或其他字符可能无法表示并导致失败。
如果客户或业务系统没有指定,通常选择“UTF-8 无 BOM”。若对方明确写了“UTF-8 BOM”“ANSI/GBK”“UTF-16LE”等要求,应严格按要求选择。
十一、理解检测结果表格
加载完成后,列表包含以下列:
文件
显示文件相对于 TXT 目录的路径。把鼠标停在该项上可查看绝对路径;单击路径会尝试复制到剪贴板。
检测编码
插件本次实际使用或检测出的来源编码。
目标编码
当前计划输出的编码。空闲时修改“目标编码”,列表会同步显示新目标;任务开始后,本批次目标固定,不会被中途修改。
置信状态
“BOM确定”:文件有明确 BOM,编码由标记确定。
“严格确定”:通过严格字节规则确定。
“兼容子集”:多个候选编码得到完全相同文字,插件按安全优先顺序选定其中一个。
“手动指定”:来源编码由用户指定。
“需指定”:多个传统编码候选会产生不同文字,必须人工选择来源编码。
原大小
源文件字节大小。
结果大小
成功转换后的结果文件字节大小。未生成结果、空文件或跳过时可能显示 -。
状态
“等待中”:检测完成,等待转换,或尚未开始处理。
“处理中”:当前文件正在处理。
“已完成”:转换结果已成功写入保存目录。
“已跳过”:目标已存在,或来源与目标编码相同,因此没有新建结果。
“需要指定源编码”:自动检测存在歧义,没有转换。
“已取消”:任务取消时尚未完成。
“失败”:严格解码、编码、校验、路径或写入失败。
错误
显示失败、跳过或待指定的具体原因。文字较长时,把鼠标停在该单元格上查看完整提示。
列表顶部状态标签可以筛选对应项目。完成后应依次检查“已跳过”“待指定”和“失败”,不要只看“成功”数量。
十二、开始转换
转换前检查:
文件列表不为空。
来源编码和检测结果合理。
目标编码符合接收软件要求。
保存目录正确,并且与 TXT 目录分离。
没有尚未处理的“需要指定源编码”文件,或已决定让这些文件保持不转换。
然后:
回到“操作”页。
单击“开始转换”。
等待每行状态更新。
不要在任务期间修改、移动或删除源文件。
任务结束后检查所有状态数量。
每个文件的处理流程为:
从磁盘重新读取源文件字节。
按所选来源编码严格解码。
拒绝明显包含大量 NUL 或二进制控制字符的非文本内容。
按目标编码严格编码;目标编码不能表示某个字符时直接失败。
先写入同目录临时文件。
重新读取临时文件,并按目标编码严格解码。
逐字符比较回读内容与源解码内容。
只有字符完全一致时,才把临时文件提交为最终结果。
这个过程保护“字符内容”不被编码转换悄悄改变。它不会把无法表示的字符自动替换成 ?。
十三、为什么会显示“已跳过”
“已跳过”不是成功生成了新文件。它表示插件有意没有写入结果,常见原因有两种。
1. 来源与目标编码相同
例如自动检测出原文件已经是 UTF-8 无 BOM,而目标也选择 UTF-8 无 BOM。插件认为不需要转换,因此不在保存目录中复制该文件。
如果你的目的只是把原文件原样复制到另一个目录,本插件不适合该操作;请使用 Windows 复制功能。
2. 目标文件已存在
保存目录中已经存在同名、同相对路径文件时,插件不会覆盖它,而是跳过并显示“目标文件已存在”。
处理方法:
确认已有结果正确:保留并接受跳过。
需要重新生成:先人工备份或删除保存目录中的旧结果,再重新开始。
不确定旧结果来源:换一个新的空保存目录最安全。
插件不会自动添加 (1) 或覆盖已有 TXT 结果。
十四、暂停、继续和取消
暂停
暂停仅用于已经开始的“转换”任务。单击“暂停”后,当前文件会先处理完,队列在领取下一个文件前暂停。因此按钮按下后,当前行仍可能从“处理中”变为“已完成”或“失败”。
暂停期间不要修改源文件或保存目录中的结果。
继续
暂停后按钮变为“继续”。单击后,插件继续处理剩余文件。
取消
单击“取消”会请求停止当前任务:
已经成功提交到保存目录的文件会保留,不会自动删除。
尚未处理的文件会显示“已取消”。
当前文件未提交的临时文件会被清理。
取消不是整批回滚。
因此,如果取消后希望从头重做,最简单的方法是检查并清理保存目录,或者选择一个新的空保存目录再运行。
离开插件
任务运行时单击“返回”、关闭插件或退出工具箱,会提示 TXT 编码转换仍在进行。确认离开将取消任务。请优先在页面中单击“取消”,等待任务完全停止后再离开。
本插件没有“撤销”。原文件没有被改动,已成功输出的文件需要在保存目录中手工管理。
十五、完整操作示例:GBK 转 UTF-8
假设目录结构为:
D:\旧资料
├─ 说明.txt
└─ 章节
└─ 第一章.txt
希望把其中的 GBK 文本转换为 UTF-8,并保存到 D:\转换后。
打开插件,进入“配置”页。
“来源编码”先选择“自动检测”。
“目标编码”选择“UTF-8 无 BOM”。
回到“操作”页。
单击“选择”→“选择 TXT 目录”。
选择
D:\旧资料。开启“包含子文件夹”。
等待加载完成。
检查“说明.txt”和“章节/第一章.txt”的检测编码。
如果都正确显示为 GBK 或兼容候选,并且没有“需指定”,继续下一步。
在“保存目录”中选择或填写
D:\转换后。单击“开始转换”。
等待两行都显示“已完成”。
打开
D:\转换后\说明.txt。打开
D:\转换后\章节\第一章.txt。检查中文、标点、特殊字符和换行是否正确。
如果自动检测显示“需要指定源编码”,先确认文件确实是 GBK,再把来源编码改为“GBK / 代码页 936”,重新加载并验证,然后开始转换。
十六、完整操作示例:只转换几个 TXT 文件
打开“配置”页,选择来源和目标编码。
回到“操作”页。
单击“选择”→“选择 TXT 文件”。
按住
Ctrl选中需要的几个文件。单击“打开”,等待检测完成。
检查列表中只有刚才选择的文件。
不要再次单击“加载文件”,避免按公共父目录扩展扫描范围。
选择保存目录。
单击“开始转换”。
到保存目录检查结果。
十七、常见问题与解决办法
1. 提示“没有找到 TXT 文件”
请检查:
文件扩展名是否为
.txt。文件是否只在子文件夹中;若是,请开启“包含子文件夹”。
路径是否仍存在,移动硬盘或共享盘是否在线。
当前 Windows 账号是否有读取权限。
2. 显示“需要指定源编码”
说明 GBK、GB18030、Big5、Shift-JIS 等候选会产生不同文字,插件拒绝猜测。
处理步骤:
找到能正确打开该文件的软件,查看或确认原编码。
将不确定文件与其他编码文件分开处理。
在“配置”页手动选择来源编码。
重新加载文件。
打开少量转换结果确认文字正确后,再处理整批。
3. 提示“所选源编码与文件 BOM 不一致”
手动来源编码与文件开头的明确 BOM 冲突。改回“自动检测”,或选择与提示一致的 UTF 编码,不要忽略 BOM 强行处理。
4. 提示“包含非法字节”
当前手动来源编码无法严格解码该文件。可能是来源编码选错,或文件已损坏。重新确认原编码,不要反复试错后直接使用看似能打开的乱码结果。
5. 提示“非文本文件”
文件虽然使用 .txt 扩展名,但内容包含大量 NUL 或明显二进制控制字符。它可能不是普通文本,或已经损坏。请用原业务软件确认文件类型。
6. 提示“目标编码无法表示字符”
目标编码字符范围不足。例如 GBK 通常无法表示 emoji 或部分生僻字。
解决方法:
改用 UTF-8、UTF-8 BOM、UTF-16 或 GB18030 等覆盖更广的目标编码。
如果业务系统强制要求旧编码,请先与业务方确认如何处理无法表示的字符,不能由插件静默替换。
7. 显示“来源与目标编码相同”
文件不需要转换,所以插件没有生成副本。需要复制文件时,请使用 Windows 文件资源管理器复制。
8. 显示“目标文件已存在”
插件为防止覆盖而跳过。换一个空保存目录,或在确认旧结果不需要后人工删除对应文件,再重新转换。
9. 提示“TXT目录与保存目录必须分离”
重新选择另一个保存目录。不能把转换结果直接写回源目录。
10. 提示“递归扫描时保存目录不能位于TXT目录中”
把保存目录移到 TXT 目录外,例如:
TXT目录:D:\项目\原文
保存目录:D:\项目\转换结果
不要使用 D:\项目\原文\转换结果。
11. 暂停后当前文件仍然完成了
这是设计行为。暂停只阻止领取下一个文件,不会中断当前文件正在进行的安全写入和验证。
12. 取消后保存目录中仍有文件
取消不回滚已经成功完成的文件。请根据列表状态检查已完成项目,必要时人工清理保存目录或换新目录重做。
13. 转换结果大小与原文件不同
不同编码使用的字节数不同,大小变化是正常的。例如 UTF-16 通常比 UTF-8 更大。判断成功应以“已完成”、字符内容正确和目标编码正确为准,不能只比较文件大小。
14. 为什么空文件大小显示 -
界面把 0 字节显示为 -。空文件仍可正常处理;请结合状态列和保存目录中的实际文件判断。
15. 选了多个单独文件,后来列表里多出其他文件
选择多个文件后,“TXT目录”会变成公共父目录。如果随后单击“加载文件”,插件会扫描这个目录,因此可能加入其他 TXT 文件。重新使用“选择 TXT 文件”选中目标文件,然后直接转换。
16. 多选文件中有其他磁盘的文件没有转换
转换结果需要按照同一个 TXT 根目录计算相对路径。不同盘符之间没有共同的 Windows 根目录,因此应按磁盘分批选择和转换。例如先处理 C: 盘文件,再单独处理 D: 盘文件。
17. 无 BOM 的 UTF-16 文件为什么自动检测失败
自动检测只会通过 BOM 明确识别 UTF-16。没有 BOM 的 UTF-16 文件可能被判为无法确定或非文本。只有在已经从文件来源、编辑器信息或业务说明中确认字节顺序后,才手动选择 UTF-16LE 或 UTF-16BE,并先用少量文件验证。
十八、内容保护与数据安全
插件采用以下保护措施:
只处理
.txt文件。原文件只读,不在原位置覆盖。
保存目录与 TXT 目录必须分离。
开启递归时禁止把保存目录放在 TXT 目录内部。
自动检测优先使用 BOM 和严格 UTF-8,不对冲突的传统编码随意猜测。
来源解码和目标编码都使用严格错误规则,不用替代字符掩盖问题。
拒绝明显的二进制内容。
转换结果先写临时文件,再回读并逐字符比对。
目标文件已存在时跳过,不覆盖。
任务失败或取消时清理未提交的临时文件。
仍需用户注意:
手动选择错误来源编码时,某些字节组合可能仍能被另一编码合法解释,但文字含义会错误。严格校验无法替代人工确认语言内容。
不同文件混用不同来源编码时,应分批处理。
已成功输出的文件在取消后不会自动删除。
路径和文件名可能包含客户或项目敏感信息,截图、录屏或发送日志前应检查。
插件在本机完成转换,不会自动上传文件;用户后续发送结果的行为需要自行管理。
重要数据必须保留备份,不能只依赖工具状态。
十九、完成前检查清单
开始转换前请确认:
所选项目确实是需要处理的
.txt文件。“包含子文件夹”状态正确。
文件总数与预期一致。
来源编码优先使用自动检测,或已人工确认手动编码。
已检查“检测编码”和“置信状态”。
“需要指定源编码”的文件已分批确认。
目标编码符合接收软件要求。
TXT 目录和保存目录不是同一个目录。
开启递归时,保存目录位于 TXT 目录外部。
保存目录可写入,旧结果不会造成误判。
重要原文件已有备份。
任务结束后请确认:
任务已经停止,暂停和取消按钮不可用。
已查看“成功”“已跳过”“待指定”和“失败”的数量。
已逐项处理“已跳过”的原因。
“需要指定源编码”和“失败”项目都已核对。
已在保存目录中找到预期结果。
子文件夹结构和文件名保持正确。
已抽查中文、英文、标点、生僻字、emoji 和换行。
已用目标业务软件打开至少一个结果文件。
确认无误后,才将结果发送给客户或导入正式系统。