操作步骤
- 先判断 PDF 类型。能逐字选中文本的是电子版;整页只能选中一张图的通常是扫描件,需要 OCR。
- 在 PDFCore 中选择 PDF 转 Word 并打开源文件。受保护文件只能在你有权转换并提供相应密码时处理。
- 普通报告先用可编辑排版;表单或复杂版面可试精确排版;只关心连续阅读和改写时用流式文本。
- 页码输入
all,或像1-3, 7这样指定范围。扫描件还要选择 Windows 已安装的中文 OCR 语言。 - 按需要保留图片、生成可编辑表格、识别页眉页脚,然后保存 DOCX。
中文扫描件要先在 Windows 中安装对应的中文 OCR 语言包。简体和繁体模型不同,选错会明显影响姓名、地址和生僻字。
转换后检查
- 对照首页、中间页和末页,检查分页、标题层级和栏顺序。
- 逐项核对姓名、金额、日期、编号以及小数点。
- 点击表格,确认内容是真正的 Word 单元格,而不是整张图片。
实际限制
PDF 固定字符在页面上的位置,Word 会重新排版。缺失字体、复杂表单、竖排文字、手写内容和低清扫描可能需要人工修正。合同、财务或合规文件应逐页复核。
下载 PDFCore 8.0.1