怎样快速提取PDF格式里的文字啊

 我来答
零粉丝做起
高能答主

2022-07-20 · 从头开始啊
零粉丝做起
采纳数:4758 获赞数:52915

向TA提问 私信TA
展开全部

要实现pdf的提取就必须要用到百度网盘,功能强大,使用方法简单。是一款必备的软件。

 第一步,打开百度网盘主界面选择文档。 

第二步,在文档页面选择全部工具。

 第三步,在全部工具里找到,选择pdf提取。

 第四步,选择网盘中的的文件。pdf文件开始提取。

第五步,等待提取完成。

注意事项

百度网盘一次可以提取20张pdf的文件,现在还是免费使用的,除了提取pdf还能把pdf转换成各种你需要的文档,ppt,word,Excel都不在话下。

蹉蕴风中
2019-12-18 · TA获得超过3861个赞
知道大有可为答主
回答量:3252
采纳率:27%
帮助的人:203万
展开全部
1、实现工具:office
2003中自带的microsoft
office
document
imaging
应用情景:目前国外很多软件的支持信息都使用pdf方式进行发布,如果没有adobe
reader,无法查看其内容,如果没有相关的编辑软件又无法编辑pdf文件。转换为doc格式则可以实现编辑功能。尽管有些软件也可以完成pdf转换为doc的工作,但很多都不支持中文,我们利用office
2003中的microsoft
office
document
imaging组件来实现这一要求最为方便。
使用方法:
第一步:首先使用adobe
reader打开待转换的pdf文件,接下来选择“文件→打印”菜单,在打开的“打印”设置窗口中将“打印机”栏中的“名称”设置为“microsoft
office
document
image
writer”,确认后将该pdf文件输出为mdi格式的虚拟打印文件。
编辑提示:如果你在“名称”设置的下拉列表中没有找到“microsoft
office
document
image
writer”项,那证明你在安装office
2003的时候没有安装该组件,请使用office
2003安装光盘中的“添加/删除组件”更新安装该组件。
第二步:运行microsoft
office
document
imaging,并利用它来打开刚才保存的mdi文件,选择“工具→将文本发送到word”菜单,并在弹出的窗口中勾选“在输出时保持图片版式不变”,确认后系统提示“必须在执行此操作前重新运行ocr。这可能需要一些时间”,不管它,确认即可。
编辑提示:目前,包括此工具在内的所有软件对pdf转doc的识别率都不是特别完美,而且转换后会丢失原来的排版格式,所以大家在转换后还需要手工对其进行后期排版和校对工作。
2、实现工具:solid
converter
pdf
应用情景:利用office
2003中的microsoft
office
document
imaging组件来实现pdf转word文档在一定程度上的确可以实现pdf文档到word文档的转换,但是对于很多“不规则”的pdf文档来说,利用上面的方法转换出来的word文档中常常是乱码一片。为了恢复pdf的原貌,推荐的这种软件可以很好地实现版式的完全保留,无需调整,而且可以调整成需要的样板形式。
使用方法:
1、下载安装文件solid
converter
pdf,点击安装。
编辑提示:安装前有个下载安装插件的过程,因此需要保证网络连接通畅。
2、运行软件,按工具栏要求选择需要转换的pdf文档,点击右下的“转换”(convert)按扭,选择自己需要的版式,根据提示完成转换。
说白了就是不能直接提取
需要下载第三方软件
已赞过 已踩过<
你对这个回答的评价是?
评论 收起
推荐律师服务: 若未解决您的问题,请您详细描述您的问题,通过百度律临进行免费专业咨询

为你推荐:

下载百度知道APP,抢鲜体验
使用百度知道APP,立即抢鲜体验。你的手机镜头里或许有别人想知道的答案。
扫描二维码下载
×

类别

我们会通过消息、邮箱等方式尽快将举报结果通知您。

说明

0/200

提交
取消

辅 助

模 式