【浏览器执行模式】 : 您的所有数据均在浏览器中处理,不会上传服务器,数据安全有保障。不放心的,可等待页面加载完成后 断网使用!(需提前登录账号)
【速度及稳定性】 : 处理速度由您的机器配置决定。由于浏览器差异,少数工具可能出现无法使用或异常:请使用:软件版工具
工具使用
返回旧版工具
请先选择文件并确认转换设置,再开始处理
DOCX 使用本地文档解析组件提取文本;DOC 旧格式会尝试本地提取可读内容,复杂文档建议另存为 DOCX 后处理。
本地处理
批量ZIP
可保存设置
导入Word文档
仅显示前20个,处理时会处理全部文件
点击选择 DOC / DOCX 文件
也可以把文件拖到这里。支持批量选择;同名输出会自动追加数字,避免压缩包内文件互相覆盖。
文件队列
尚未选择文件
请选择或拖入 Word 文档。建议先完成第二步设置,再进入处理下载。
文本提取与清理
设置会影响全部文件
建议先按文档类型配置提取模式与换行方式,再开始转换;常用配置可保存到本地,下次打开自动恢复。
结构化模式更适合含表格、标题、列表的 DOCX。
输出与命名
默认沿用原文件名
转换与下载
请先选择文件并确认设置
DOCX解析组件
检测中
Mammoth
检测中
ZIP打包组件
检测中
JSZip
检测中
0%
等待开始。请先完成设置后再处理。
已选择0
成功0
失败0
总字符0
转换结果
暂无结果
点击“开始转换”后,这里会显示前20个结果;其余结果仍会加入ZIP。
结果预览
未生成
尚未生成TXT内容。
使用说明
软件使用说明
- 选择Word文档:点击“选择文件”按钮,添加需要转换的DOC或DOCX文件。支持一次选择多个文件,界面仅展示前20个文件,其余文件会继续参与处理。
- 设置提取模式:可选择“结构化文本”保留段落、列表和表格列分隔,也可选择“纯文本”按文档原始文本顺序提取。
- 配置清理选项:按需要设置空行处理、空格清理、全角空格转换、表格制表符保留和TXT换行格式。
- 设置输出命名:默认沿用原文件名并改为.txt;如遇同名文件,会自动在文件名后追加数字。也可以填写前缀、后缀和压缩包名称。
- 保存常用设置:点击“保存设置”可保存当前转换参数,便于后续继续使用相同配置。
- 开始转换并下载:进入“处理下载”后点击“开始转换”,完成后可预览结果、复制当前文本、下载单个TXT,或下载全部结果ZIP。
常见问题
答:支持DOCX文件解析,也支持旧版DOC文件的可读文本提取。DOC属于旧版二进制格式,复杂排版、特殊编码或受保护内容可能提取不完整,建议另存为DOCX后再处理。
答:结构化文本模式会尽量保留段落、列表和表格列分隔,适合整理资料;纯文本模式更接近文档原始文本顺序,适合只需要正文内容的场景。
答:默认使用原Word文件名并将扩展名改为.txt。如果多个文件转换后名称重复,工具会自动追加数字区分,也可以在设置中添加统一前缀或后缀。
答:结构化文本模式会把表格单元格按制表符分隔,便于复制到表格软件或继续做数据清理。图片、复杂样式和对象内容不会保留到TXT中。
答:常见原因包括文件损坏、文档加密、格式并非真实Word文件,或旧版DOC内容编码复杂。可以先确认文件能正常打开,再另存为DOCX后重新转换。
答:不会。文档读取、文本提取、TXT生成和ZIP打包都在当前设备本地完成,原始文件不会提交到服务器。