caj文件转word文件怎麽转,这个比较难啊
现在网上的许多资料都是以CAJ、PDF等文件格式提供的,其中的文本不能被直接编辑。
网上提供了许多处理这种情况的软件,但是它们不是效率低,就是只能提取其中部分文本。本文所述利用微软提供的OCR识别技术从CAJ、PDF等文件中提取全部文本的方法,简便快捷,效率很高。
从不同格式的文件中提取文本前需要做好以下准备工作,安装CAJViewer5.5浏览器软件和acrobat 5 专业版浏览器软件安装Office2003,并完全安装Of?鄄fice工具Microsoft Office Document Imaging,然后在打印机里面会增加Microsoft Office Document Image Writer打印机。 Microsoft Office Document Image可以非常准确的全文件识别转化中文、英文、表格。
一、CAJ文件的识别 (一)首先,从网上下载CAJ格式的资料文件保存到本地硬盘上。 (二)然后,启动CAJViewer浏览器程序,并在该程序中打开刚才保存的CAJ格式的文件。
浏览文件到最后一页后,不要关闭CAJ浏览器程序。 (三)在CAJ浏览器程序窗口中,选择“文件”→“打印”,并选择打印机为Microsoft Office Document Image Writer打印机,勾选打印到文件选项和确定打印页数。
(四)保存打印文件(*.prn)到适当位置。等待打印完成后,Microsoft Office Document Image 自动打开刚才保存的打印文件。
(五)在Microsoft Office Document Image窗口中,选择“页面”菜单中的“选择所有页面”菜单项,然后选择“工具”菜单中的“使用OCR识别文本”提取文本。 (六)选择“工具”下的 “将文本发送到word”,最后将把整个CAJ文件识别输出到word文件中。
二、PDF文件的识别 (一)以文本形式保存的PDF文件,用acrobat 5 专业版,识别整个文件。直接打开从网上下载的PDF格式文件另存为RTF文件,或者选择工具栏上的文字选择按钮,然后选择文字区域,然后复制到Word中即可。
(二)以图片形式保存的PDF文件,将PDF文件打印到Microsoft Office Document Image Writer打印机,选择打印形成的文件的保存位置,然后会自动形成一个MDI文件,并且自动用Microsoft Office Document Image打开此文件,然后在Microsoft Office Document Im?鄄age中选择“工具”菜单中的“使用OCR识别文本”,识别完成后,在选择“工具”下的,“将文本发送到word”,最后将把整个PDF文件识别输出到word文件中。 (三)加密的PDF文件先下载解密软件,解密后在参照上述步骤1),2) 进行。
(四)繁体PDF文件用上述步骤2)的方法识别到word后,用word中的“工具”→“语言”→“中文繁简转换” 三、超星文件的识别 (一)全文件识别打印到Microsoft Office Document Image Writer打印机,然后按上述PDF文件的识别步骤中第二点操作,要注意的是,超星打印功能有点区别,因为超星是目录和全文分开的,所以打印时,需要分别把目录和正文识别到Word中,再合并到一起。打印时要填入打印页码从1到最后一页,不要选择打印全部。
在打印选项中,要将页面比例设成真实大小,而不是整宽。注意识别速度比其他格式要慢很多,请保持耐心。
一般一本200多页的书,识别需要几分钟的时间。 (二)超星文件识别相对比较麻烦一些,如果还有问题,可以先把超星打印成完整的PDF文件,然后再用上述识别PDF文件的方法转成Word。
四、后记 经过试验,发现Microsoft Office Document Image 存在一些不稳定的问题,如在用CAJ打印到Microsoft Office Document Image Writer时,发现用CAJ5.5版本比较快,而CAJ5.0有时出现假死机。页面显示大时,转化的识别率较高。
如果页数多的文件,包括超星,可以分多次转化。 由于虚拟打印到Microsoft Office Document Image Writer 比较慢,并且形成的虚拟文件很大,1本200多页的书大约是60M,因此会严重影响机器的运行速度、C盘和内存空间。
建议配置好的机器一次转化不要超过200页,配置差的不要超过100页,同时打印时在任务栏中会出现打印机图标,可以双击,看到打印任务的进度,避免误以为死机。转化完成后请删除c:\windows\temp目录下的虚拟打印文件,否则C盘很快会被用光。
怎么把CAJ文件变成WORD格式
caj转word的方法比较--------------------------------------------------------------------------------一篇论文,caj格式,想转成word工具 CAJViewer 5.0,acrobat Reader 5.0 清华紫光Thocr2000 miniOcr文字识别软件1.0方法一CAJViewer -- 工具栏 -- 选择文本 -- 功能失效方法二CAJViewer -- 工具栏 -- 选择图象 -- 文字识别结果显示“四”方法三CAJViewer ---打开文件————另存为----*.txt ------打开txt文件结果显示乱码一堆方法四CAJViewer ---打开文件————打印----选取Acrobat Distiller虚拟打印机----确定----acrobat Reader自动打开---将文件另存为tif文件---使用清华紫光Thocr2000识别结果白板一块方法五CAJViewer ---打开文件————全屏浏览----printscreen ------打开附件画图工具---粘贴保存---运行MINIOCR屏幕图像识别结果:文字正确,英文和数字符号无法准确显示方法六下载最新版CAJViewer6.0带Ocr-- 工具栏 -- 选择图象 -- 文字识别。
怎样把CAJ文件直接变为word文件
caj转word的方法比较--------------------------------------------------------------------------------一篇论文,caj格式,想转成word工具 CAJViewer 5.0,acrobat Reader 5.0 清华紫光Thocr2000 miniOcr文字识别软件1.0方法一CAJViewer -- 工具栏 -- 选择文本 -- 功能失效方法二CAJViewer -- 工具栏 -- 选择图象 -- 文字识别结果显示“四”方法三CAJViewer ---打开文件————另存为----*.txt ------打开txt文件结果显示乱码一堆方法四CAJViewer ---打开文件————打印----选取Acrobat Distiller虚拟打印机----确定----acrobat Reader自动打开---将文件另存为tif文件---使用清华紫光Thocr2000识别结果白板一块方法五CAJViewer ---打开文件————全屏浏览----printscreen ------打开附件画图工具---粘贴保存---运行MINIOCR屏幕图像识别结果:文字正确,英文和数字符号无法准确显示方法六下载最新版CAJViewer6.0带Ocr-- 工具栏 -- 选择图象 -- 文字识别。
怎样把CAJ转换成可编辑的WORD形式
可使用OCR文字识别软件就可以将CAJ转换测好难过可编辑的Word形式了,具体的操作方法如下,你可以拿来参考一下:
1、打开迅捷OCR文字识别软件,打开后会有这样一个页面,在点击添加图片、文件的地方将CAJ文件添加进来。
2、 CAJ文件添加进来后,在文件上方将文件的“识别格式”修改为DOCX或DOC格式,这两种都是Word文档的保存格式,识别效果没有过多要求,根据自己的需要进行选择就好。
3、 等待上面的修改好后,在软件的左下角,可根据需要修改识别后的文件的“输出目录”,可以点击放在原文件夹,也可以自定义在电脑中的其它地方都是可以的,这样识别后,就知道识别过后的软件放在哪里了。
4、 上述的步骤操作完之后,我们就可以点击“开始识别”按钮,对CAJ文件进行识别转换了。
5、待识别完成之后,就可以点击打开文件查看CAJ文件识别转换到Word里面的效果了,这样整个步骤就结束了。
方法是不是很简单呢?你们学会了没有?
怎么把CAJ文件变成WORD格式
caj转word的方法比较
--------------------------------------------------------------------------------
一篇论文,caj格式,想转成word
工具 CAJViewer 5.0,acrobat Reader 5.0 清华紫光Thocr2000 miniOcr文字识别软件1.0
方法一
CAJViewer -- 工具栏 -- 选择文本 -- 功能失效
方法二
CAJViewer -- 工具栏 -- 选择图象 -- 文字识别
结果显示“四”
方法三
CAJViewer ---打开文件————另存为----*.txt ------打开txt文件
结果显示乱码一堆
方法四
CAJViewer ---打开文件————打印----选取Acrobat Distiller虚拟打印机----确定----acrobat Reader自动打开---将文件另存为tif文件---使用清华紫光Thocr2000识别
结果白板一块
方法五
CAJViewer ---打开文件————全屏浏览----printscreen ------打开附件画图工具---粘贴保存---运行MINIOCR屏幕图像识别
结果:文字正确,英文和数字符号无法准确显示
方法六
下载最新版CAJViewer6.0带Ocr-- 工具栏 -- 选择图象 -- 文字识别
转载请注明出处51数据库 » caj转word什么格式的文件