PDF 转 Word
在本地将 PDF 文字及十种语言的印刷扫描件转换为可编辑 Word 文档。下载前校对重建的段落、带标签的标题和列表、表格、分栏及裁剪图像。
把 PDF 文字带入 Word。
将一个 PDF 拖到这里,最多 50 MB。
选择纯文本或重建文档结构。结构模式会检测段落、带标签的标题和列表、表格、分栏及图像裁剪,供您校对。请检查姓名、数字和阅读顺序;不保证字体和分页完全一致。
最多选择 50 页,其中 OCR 最多 10 页。自动模式优先使用已有文字。若页面既有可选择文字又有图片内文字,请选择对所有页面进行 OCR。支持印刷的英语、简体中文、印地语、西班牙语、法语、阿拉伯语、孟加拉语、德语、意大利语和葡萄牙语。不支持手写及列表外的语言。即使置信度较高,OCR 也可能漏掉整行;请逐页对照并纠正姓名和数字。
三个简单步骤。
- 选择不超过 50 MB 的 PDF 和所需页面,再选择读取已有文字或按印刷语言进行 OCR。
- 启用结构重建来处理标题、列表、表格、分栏和图像,然后逐页对照原文校对文字、阅读顺序和格式。
- 选择原页面尺寸、Letter 或 A4,创建 Word 文档,下载校对后的 DOCX 或文字。也可直接将文字送至字数统计检查长度。
使用须知。
重建结果需要校对:支持带标签的标题和简单列表、单列或双列区域、带标签或简单对齐的表格、基本样式及受支持的图像裁剪。列表支持项目符号、数字、字母及罗马数字,最多九级。自定义或复合标记保留为文字;跨页列表作为独立列表保留可见编号。保留受支持的字体族名称和纯色文字,不嵌入字体。透明、图案或无法匹配的文字颜色需手动检查。可手动添加下划线。不保留精确排版、分页、链接和交互表单。源文件最多 300 页,选择最多 50 页,OCR 最多 10 页,文字最多 100 万字符,结构区块最多 2,000 个。表格最多 200 行、12 列及 2,000 个单元格;图像最多 100 张、合计 50 MB。OCR 支持英语、简体中文、印地语、西班牙语、法语、阿拉伯语、孟加拉语、德语、意大利语和葡萄牙语,每次一种语言。结构模式需要正向扫描页。不支持复杂布局、手写和其他 OCR 语言。支持在本地输入密码。
了解隐私保护 →常见问题。
Word 文档会与 PDF 完全一样吗?
不会。结构重建创建可编辑段落、受支持的带标签标题和列表及表格,检测单列或双列区域,并加入受支持的裁剪图像。您可以更改标题级别、列表样式和编号,编辑单元格及样式,重排区块、跨列移动区块并裁剪缺失图像。保留受支持的字体族名称和纯色文字。可选字体、颜色和下划线;文字处理软件中缺少的字体会被替换。不保留精确位置,Word 可能重新分页。导出前请对照原页面预览。
能转换扫描 PDF 吗?
可以,支持印刷的英语、简体中文、印地语、西班牙语、法语、阿拉伯语、孟加拉语、德语、意大利语和葡萄牙语。请先选择语言。自动模式仅在页面没有已有文字时使用 OCR。若页面同时包含可选择文字和图片内文字,请对所有选定页面进行 OCR。OCR 可能识别错字,请仔细校对姓名和数字。
OCR 会上传 PDF 或密码吗?
不会。页面渲染、文字识别和 DOCX 创建均在此设备运行。需要 OCR 时,从本站加载所选语言模型和引擎。PDF、编辑内容和密码不会上传,也不会保存到浏览器存储。
每张 PDF 页面都会变成一张 Word 页面吗?
分页选项让每张原页面从新的 Word 页面开始。但文字仍可能因长度、Word 中可用字体及输出纸张大小而延续到更多页。