问答文章1 问答文章501 问答文章1001 问答文章1501 问答文章2001 问答文章2501 问答文章3001 问答文章3501 问答文章4001 问答文章4501 问答文章5001 问答文章5501 问答文章6001 问答文章6501 问答文章7001 问答文章7501 问答文章8001 问答文章8501 问答文章9001 问答文章9501

复制粘贴pdf文档内容中英文和数字会变乱码

发布网友 发布时间:2022-04-22 18:54

我来回答

4个回答

热心网友 时间:2023-07-15 01:44

那是应为 字体支持的原因

我用的是CAJViewer
CAJViewer5.5_OCR v5.5.0 Build 4030

说明:带OCR识别,带多语言包,OCR识别支持中英文识别。 大小:32.911 MB

1)局部文字识别:直接使用caj浏览器的ocr
2)全文件识别:打印到Microsoft Office Document Image Writer打印机,选择打印形成的文件的保存位置,然后会自动形成一个MDI文件,并且自动用Microsoft Office Document Image打开此文件,然后选择“工具”菜单下的“使用ocr识别文本”,识别完成后,在选择“工具”下的,“将文本发送到word”,最后将把整个 PDF文件识别输出到word文件中。

注意:Microsoft Office Document Image可以非常准确的全文件识别转化中文、英文、表格,但是无法将图形输出到word,而是把文件中的所有图形单独形成一个个独立的图片文件,放在相同位置的一个相同名称的文件夹中,因此可用snagit软件将图形打开,然后复制到word中。(所有的识别软件都不能很好的处理图形的识别问题, Microsoft Office Document Image的这种处理方法已经是非常好的解决这个问题了。)

推荐快速方法:
从CAJ文件中提取文本前需要做好以下准备工作,安装CAJ文件浏览器5.5,安装Office2003,并完全安装Office工具 Microsoft Office Document Imaging,然后在打印机里面会增加Microsoft Office Document Image Writer打印机。 Microsoft Office Document Image可以非常准确的全文件识别转化中文、英文、表格。
CAJ文件的识别:
(一)首先,从网上下载CAJ格式的资料文件保存到本地硬盘上。
(二)然后,启动CAJViewer浏览器程序,并在该程序中打开刚才保存的CAJ格式的文件。浏览文件到最后一页后,不要关闭CAJ浏览器程序。
(三)在CAJ浏览器程序窗口中,选择“文件”→“打印”,并选择打印机为Microsoft Office Document Image Writer打印机,勾选打印到文件选项和确定打印页数。
(四)保存打印文件(*.prn)到适当位置。等待打印完成后,Microsoft Office Document Image 自动打开刚才保存的打印文件。
(五)在Microsoft Office Document Image窗口中,选择“页面”菜单中的“选择所有页面”菜单项,然后选择“工具”菜单中的“使用OCR识别文本”提取文本。
(六)选择“工具”下的 “将文本发送到word”,最后将把整个CAJ文件识别输出到word文件中。

热心网友 时间:2023-07-15 01:44

pdf(Portable Document Format的简称,意为“便携式文档格式”),是由Adobe Systems用于与应用程序、操作系统、硬件无关的方式进行文件交换所发展出的文件格式。PDF文件以PostScript语言图象模型为基础,无论在哪种打印机上都可保证精确的颜色和准确的打印效果,即PDF会忠实地再现原稿的每一个字符、颜色以及图象。
复制PDF文件文稿到word中去时变成乱码的原因是由于PDF文件一般内嵌的字体在电脑上没有,因为word是调用系统字体的,而PDF文件是优先调用内嵌字体的。
解决办法:1. 可以尝试用第三方的转换工具把PDF转成WORD格式,有些能够解决乱码问题,但是有时候不一定能够解决。
2. 使用OCR识别软件进行文件识别处理。比如ABBYY finereader 10/11 ,可以直接把 PDF文件识别出来成WORD文件,不过OCR识别不会100%正确,需要人工校对。

热心网友 时间:2023-07-15 01:45

我的解决方法是找个能复制的电脑,把那台电脑C盘window中fonts里的所有字体都复制到自己电脑的相应文件夹下,重复的尽量不要替换

热心网友 时间:2023-07-15 01:45

我遇到过类似的,不过是在Authorware和Win Runner,
在Authorware里我是先把文字复制到 MS 的 Word里,然后,再复制别的地方。
Win Runner 我一直没有解决的办法。
声明声明:本网页内容为用户发布,旨在传播知识,不代表本网认同其观点,若有侵权等问题请及时与本网联系,我们将在第一时间删除处理。E-MAIL:11247931@qq.com
...怎么插入耳机时 耳机和外放都有声音?我用驱动人生驱动过显示声卡是正... USB耳机插入听不到声音,用什么软件可以听到声音?我的耳机是赛德斯的,听... 用USB71耳机看电影和用35mm立体声耳机杜比音效看电影哪个效果好 学生和家庭情况如何填写呢? 当初老板帮我租房子,租了半年,老板说干满半年才能退,现在没有干满半年... 博湖县在哪买辣椒酱 宝宝都一岁多了,要记得做这款高钙食物,不要浪费长身体的机会 高钙零食可不可以帮助孩子长高呢? 文艺一些的纹身店名字 宝马325li是三缸吗? 从CAJ复制到word上的英文改不了字体了 英语打字,太忙了,能否把图片里的文字打出来供我复制 粘贴 ,谢谢 WORD上面的艺术字复制到网页上怎么又变成普通字了 qq字体怎么改 教你简单修改qq字体的方法? 为什么复制粘贴到word中的文字有格子呢? 手机上面在哪里能把转换好的艺术字体进行复制粘贴? 字母转换成连笔或者艺术字 谁能帮我把“sunny”这个英文单词转换成艺术字体了? 驾照考来是什么照?可以开什么车呢? 开货车需要什么驾照 考哪种驾照开什么车子都可以? C1D驾驶证能开什么车 考驾照A B C D票都是开什么车的 考驾照c照可以开哪些车 考哪种驾驶证能开的车的种类最多? 微信朋友圈只开放3天,是什么心态? 微信可以设置只能让对方看到十几天朋友圈? 微信朋友圈,最多能容纳多少人呢 '这是给你的一些苹果'用英语怎么说 建设银行账单在哪里查 颐和园长廊的介绍 颐和园长廊多少米 颐和园长廊简介 颐和园的长廊为什么是最著名的 急!颐和园长廊故事! 北京颐和园长廊简介 颐和园长廊的资料 颐和园长廊有多长? 颐和园长廊导游词 关于颐和园的故事 颐和园长廊作文 请介绍颐和园长廊上的画 第一次去北京旅游要注意什么? 张恨水的三个妻子都是谁?给介绍一下,谢谢了 颐和园长廊导游词50子 调查组织计划的内容有什么? 调查计划怎么写? 怎样制定调查计划 制定调查计划包括哪些内容