点击上传,或把 PDF 拖到这里
一个 PDF —— 在浏览器中转换为 Word,绝不上传关于这个工具
这个免费的 PDF 转 Word 工具能把 PDF 转成可编辑的 .docx 文档,可以用 Word、Google 文档、LibreOffice 或 Pages 打开。标题、段落、项目符号以及粗体和斜体都会保留下来,所以你得到的是真正可以编辑的文档,而不是一整块黏在一起的文字。
一切都在你的浏览器中运行。你的 PDF 绝不会上传到服务器,也没有注册和水印。
功能
- 真正的 .docx —— 可直接在 Word、文档、Pages 和 LibreOffice 中打开
- 可编辑的文字,而不是页面的图片
- 根据字号识别标题,并保留为 Word 的标题样式
- 保留粗体和斜体
- 项目符号保留为列表段落
- 页码范围 —— 只转换你需要的部分
- 只想要文字的话,还可以导出纯文本 .txt
- 下载前先在屏幕上预览
哪些能转好,哪些不行
这一点必须说清楚,否则容易失望——"PDF 转 Word"这句话,承诺的比任何转换器能做到的都多。
PDF 里并没有段落、标题或列表。它装的是按坐标摆放的字形,也就是一组绘制指令。通常没有任何记录说明这两行属于同一个句子,或者这一行是标题。这些都只能从几何位置推断出来:按垂直位置把文字归拢成行,比正文大的行判定为标题;当下一行明显更靠下,或者上一行远远没到右边距就结束了,就判定这一段落已经结束。
对于普通的文章——报告、书信、文章、合同、论文——这种推断非常可靠。真正吃力的地方,恰恰也是人看了会犹豫的地方:
- 多栏排版 —— 报纸、学术论文、宣传册。跨栏的阅读顺序本身就有歧义,文字可能交错在一起
- 复杂表格 —— 你能拿到文字,但拿不到表格结构。表格请用专门的 PDF 转 Excel
- 图片和图表 —— 旁边的文字能转过来,图形本身不行
- 精确的页面版式 —— 这里恢复的是*内容*,而不是像素级的复制品。Word 会用自己的页边距和字体重新排版
如果你真正需要的是原本的外观而不是可编辑的文字,那转换就走错了方向——请改用给 PDF 添加文字在原文件上批注。
两种换行处理方式
这个选项值得花点时间理解,因为它决定了转换结果编辑起来顺不顺手。
把断行合并成段落(默认)会还原出真正的段落。在 PDF 中折成四行的一句话,到了 Word 里会变成一个段落,输入时能正常重新折行;行尾被连字符断开的单词也会被接回去。凡是打算编辑的文档,都该选这个。
保留每一处换行会把每一个视觉上的行都变成独立段落。当版式本身就是含义时,这才是正确选择——诗歌、地址、代码清单、歌词、表单,把行合并起来就全毁了。
常见用途
- 原始文件丢失时,编辑一份文档
- 不用重新打字,直接复用报告、合同或论文里的文字
- 更新只剩 PDF 版本的简历或信件
- 翻译文档时,先把文字变成可编辑的形式
- 从长篇 PDF 中摘取引文
使用方法
- 上传 PDF —— 点击上传区域,或把文件拖进来
- 查看预览 —— 标题、段落和项目符号会按它们在 Word 中的样子显示
- 如果版式比行文更重要,把"换行处理"切换成"保留每一处换行"
- 只需要文档的一部分时,缩小页码范围
- 下载 .docx —— 只要文字的话就选 .txt
需要了解
- 不会上传任何内容。 PDF 在你的设备上读取,Word 文件也在本地生成
- 扫描版 PDF 里没有文字。 如果页面本身就是一张文档照片,就没有东西可以提取——工具会如实告诉你。请先用图片转文字
- 不嵌入字体。 .docx 使用 Calibri,以保证在任何地方都能正常打开;想还原原本的样式,可以在 Word 里改
- 页眉、页脚和页码都属于页面文字,因此可能会变成一些短段落。打开后很容易删掉
- 有密码保护的 PDF 必须先解锁——参见 PDF 解除密码
- 如果标题没被识别出来,多半是这个 PDF 把标题设成了和正文一样的字号,仅靠加粗来区分;这时可取消勾选该选项,自己在 Word 里套用标题样式
- 生成的 .docx 是一份干净朴素的文档 —— 没有修订记录,没有宏,也没有隐藏内容
相关工具
- Word 转 PDF —— 反方向转换
- PDF 转 Excel —— 当 PDF 是表格而不是文章时
- PDF 转图片 —— 完整保留页面外观
- 图片转文字 —— 扫描页面的 OCR 识别
- PDF 解除密码 —— 转换前先去掉密码