应该说,PDF 文档的规范性使得浏览者在阅读上方便了许多,但倘若要从里面
提取些资料,实在是麻烦的可以。回忆起当初做毕业设计时规定的英文翻译,
痛苦的要命,竟然傻到用 Print Screen 截取画面到画图板,再回粘到 word 中,
够白了:(最近连做几份商务标书,从 Honeywell 本部获取的业绩资料全部是
英文版的 PDF,为了不再被折磨,花费了一个晚上的时间研究 PDF 和 Word 文
件的转换,找到下面 2 种方法,出于无产阶级所谓的同甘共苦之心,共享
下:)
1、实现工具:Office 2003 中自带的 Microsoft Office Document Imaging
应用情景:目前国外很多软件的支持信息都使用 PDF 方式进行发布,如果没有
Adobe Reader,无法查看其内容,如果没有相关的编辑软件又无法编辑 PDF 文
件。转换为 DOC 格式则可以实现编辑功能。尽管有些软件也可以完成 PDF 转
换为 DOC 的工作,但很多都不支持中文,我们利用 Office 2003 中的 Microsoft
Office Document Imaging 组件来实现这一要求最为方便。
使用方法:
第一步:首先使用 Adobe Reader 打开待转换的 PDF 文件,接下来选择“文
件→打印”菜单,在打开的“打印”设置窗口中将“打印机”栏中的“名称”设置为
“Microsoft Office Document Image Writer”,确认后将该 PDF 文件输出为 MDI 格
式的虚拟打印文件。
编辑提示:如果你在“名称”设置的下拉列表中没有找到“Microsoft Office
Document Image Writer”项,那证明你在安装 Office 2003 的时候没有安装该组件,
请使用 Office 2003 安装光盘中的“添加/删除组件”更新安装该组件。
第二步:运行 Microsoft Office Document Imaging,并利用它来打开刚才保
存的 MDI 文件,选择“工具→将文本发送到 Word”菜单,并在弹出的窗口中勾
选“在输出时保持图片版式不变”,确认后系统提示“必须在执行此操作前重新运
行 OCR。这可能需要一些时间”,不管它,确认即可。
编辑提示:目前,包括此工具在内的所有软件对 PDF 转 DOC 的识别率都
不是特别完美,而且转换后会丢失原来的排版格式,所以大家在转换后还需要
手工对其进行后期排版和校对工作。
2、实现工具:Solid Converter PDF
应用情景:利用 Office 2003 中的 Microsoft Office Document Imaging 组件来实现
PDF 转 Word 文档在一定程度上的确可以实现 PDF 文档到 Word 文档的转换,
但是对于很多“不规则”的 PDF 文档来说,利用上面的方法转换出来的 Word 文档
中常常是乱码一片。为了恢复 PDF 的原貌,推荐的这种软件可以很好地实现版
式的完全保留,无需调整,而且可以调整成需要的样板形式。
&&&&& 使用方法:
&&&&& 1、下载安装文件 Solid Converter PDF,点击安装。
&&&&& 编辑提示:安装前有个下载安装插件的过程,因此需要保证网络连接通畅。
&&&&& 2、运行软件,按工具栏要求选择需要转换的 PDF 文档,点击右下的“转换”
(Convert)按扭,选择自己需要的版式,根据提示完成转换。