第一篇:CAJ格式转换成WORD的方法
CAJ格式转换成WORD的方法
现在网上许多资料都是以CAJ、PDF等文件格式提供的,其中的文本不能被直接编辑。网上提供了许多处理这种情 况的软件,但是它们不是效率低,就是只能提取其中部分文本。本文所述利用微软提供的OCR识别技术从CAJ、PDF等文件中提取全部文本的方法,简便快 捷,效率很高。从不同格式的文件中提取文本前需要做好以下准备工作,安装CAJViewer5.5浏览器软件和acrobat 5 专业版浏览器软件安装Office2003,并完全安装Of?鄄fice工具Microsoft Office Document Imaging,然后在打印机里面会增加Microsoft Office Document Image Writer打印机。Microsoft Office Document Image可以非常准确的全文件识别转化中文、英文、表格。
一、CAJ文件的识别
(一)首先,从网上下载CAJ格式的资料文件保存到本地硬盘上。
(二)然后,启动CAJViewer浏览器程序,并在该程序中打开刚才保存的CAJ格式的文件。浏览文件到最后一页后,不要关闭CAJ浏览器程序。
(三)在CAJ浏览器程序窗口中,选择“文件”→“打印”,并选择打印机为Microsoft Office Document Image Writer打印机,勾选打印到文件选项和确定打印页数。
(四)保存打印文件(*.prn)到适当位置。等待打印完成后,Microsoft Office Document Image 自动打开刚才保存的打印文件。
(五)在Microsoft Office Document Image窗口中,选择“页面”菜单中的“选择所有页面”菜单项,然后选择“工具”菜单中的“使用OCR识别文本”提取文本。
(六)选择“工具”下的 “将文本发送到word”,最后将把整个CAJ文件识别输出到word文件中。
二、PDF文件的识别
(一)以文本形式保存的PDF文件,用acrobat 5 专业版,识别整个文件。直接打开从网上下载的PDF格式文件另存为RTF文件,或者选择工具栏上的文字选择按钮,然后选择文字区域,然后复制到Word中 即可。
(二)以图片形式保存的PDF文件,将PDF文件打印到Microsoft Office Document Image Writer打印机,选择打印形成的文件的保存位置,然后会自动形成一个MDI文件,并且自动用Microsoft Office Document Image打开此文件,然后在Microsoft Office Document Im?鄄age中选择“工具”菜单中的“使用OCR识别文本”,识别完成后,在选择“工具”下的,“将文本发送到word”,最后将把整个PDF文件识别 输出到word文件中。
(三)加密的PDF文件先下载解密软件,解密后在参照上述步骤1),2)进行。
(四)繁体PDF文件用上述步骤2)的方法识别到word后,用word中的“工具”→“语言”→“中文繁简转换”
三、超星文件的识别
(一)全文件识别打印到Microsoft Office Document Image Writer打印机,然后按上述PDF文件的识别步骤中第二点操作,要注意的是,超星打印功能有点区别,因为超星是目录和全文分开的,所以打印时,需要分 别把目录和正文识别到Word中,再合并到一起。打印时要填入打印页码从1到最后一页,不要选择打印全部。在打印选项中,要将页面比例设成真实大小,而不 是整宽。注意识别速度比其他格式要慢很多,请保持耐心。一般一本200多页的书,识别需要几分钟的时间。
(二)超星文件识别相对比较麻烦一些,如果还有问题,可以先把超星打印成完整的PDF文件,然后再用上述识别PDF文件的方法转成Word。
四、后记 经过试验,发现Microsoft Office Document Image 存在一些不稳定的问题,如在用CAJ打印到Microsoft Office Document Image Writer时,发现用CAJ5.5版本比较快,而CAJ5.0有时出现假死机。页面显示大时,转化的识别率较高。如果页数多的文件,包括超星,可以分多 次转化。由于虚拟打印到Microsoft Office Document Image Writer 比较慢,并且形成的虚拟文件很大,1本200多页的书大约是60M,因此会严重影响机器的运行速度、C盘和内存空间。建议配置好的机器一次转化不要超过 200页,配置差的不要超过100页,同时打印时在任务栏中会出现打印机图标,可以双击,看到打印任务的进度,避免误以为死机。转化完成后请删除 c:windowstemp目录下的虚拟打印文件,否则C盘很快会被用光
很喜欢CAJViewer这个软件,就算是不能直接复制的文档,也可以用其自带的文字识别功能来准确的识别。
关于乱码问题,自己很少碰到,可以试下这两个方法:
(1)复制后先粘贴到记事本里,之后在转到Word里,或者用【选择性粘贴】粘贴为无格式文本。
(2)直接用CAJViewer的文字识别功能进行识别——点“选择图像”按钮,框选需要的文字后,右键选择【文字识别】。(这里还有一个发送到Word,同样可以试试)
自我我认为用其他软件转换没什么用,就算转换成功,那格式的修改也是一大问题!
其实你只要懂得一些编辑文本的技巧,也能达到很好的效率,下面是我自己常用的技巧:
(1)CAJ复制来的文本每行后都有一段落标记,很是讨厌,其实可以用Word的替换功能很快去掉——选择刚刚粘贴进来的文本,执行【编辑】-【替换】,替换【^p】为空白就行了(^p即为段落标记),注意只“全部替换”一次,别不小心把全文都整成一段了……
(2)文档中可能会有很多空白行,一行行删除太过费劲,同样用替换功能,先将文本中的空格全部替换为空白(空格可能看不出来,全部替换就是了),再将
【^p^p】全部替换为【^p】,多替换几次就能把空白行删除干净了……
如果是word2007的话,【替换】在开始的最右边。可以使用【替换】最下面的【特殊格式】把那些变成空白。
第二篇:如何把PPT课件转换成Word文档
如何把PPT课件转换成Word文档 PPT, 课件, 文档, Word 你是不是因为不能把PPT课件转换成Word讲义而感到烦恼?或者对大量的PPT幻灯片内容需要打印出来而犯愁呢?下面向大家介绍4种将PPT演示文稿里的文字转换成Word文档的方法,以供参考。
1.利用“大纲”视图
打开PPT演示文稿,单击“大纲”,在左侧“幻灯片/大纲”任务窗格的“大纲”选项卡里单击一下鼠标,按“Ctrl+A”组合健全选内容,然后使用“Ctrl+C”组合键或右键单击在快捷菜单中选择“复制”命令,然后粘贴到Word里。
小提示:
这种方法会把原来幻灯片中的行标、各种符号原封不动的复制下来。
2.利用“发送”功能巧转换
打开要转换的PPT幻灯片,单击“文件”→“发送”→“Microsoft Word”菜单命令。
然后选择“只使用大纲”单选按钮并单击“确定”按钮,等一会就发现整篇PPT文档在一个Word文档里被打开。
小提示:
在转换后会发现Word有很多空行。在Word里用替换功能全部删除空行可按“Ctrl+H”打开“替换”对话框,在“查找内容”里输入“^p^p”,在“替换为”里输入“^p”,多单击几次“全部替换”按钮即可。(“^”可在英文状态下用“Shift+6”键来输入。)
3.利用“另存为”直接转换
打开需要转换的幻灯片,点击“文件”→“另存为”,然后在“保存类型”列表框里选择存为“rtf”格式。现在用Word打开刚刚保存的rtf文件,再进行适当的编辑即可实现转换。
4.PPTConverttoDOC软件转换
PPTConverttoDOC是绿色软,解压后直接运行,在运行之前请将Word和PPT程序都关闭。
选中要转换的PPT文件,直接拖曳到“PPTConverttoDOC”程序里。单击工具软件里的“开始”按钮即可转换,转换结束后程序自动退出。
小提示:
如果选中“转换时加分隔标志”,则会在转换好的word文档中显示当前内容在原幻灯片的哪一页。
转换完成后即可自动新建一个Word文档,显示该PPT文件中的所有文字。
第三篇:PPT课件转换成电子白板课件方法1
PPT课件转换成HHT方法
(1)打开电子白板软件,点击工具栏菜单的“开始选项卡”(即第1个选项卡)中的返回按钮切换至桌面模式;
(2)在桌面模式下,打开准备转换的PPT课件;
(3)在该PPT工具栏中点击“幻灯片放映”,在其下拉菜单中选择“设置放映方式”,将“幻灯片放映分辨率”修改成1024*768;
(4)将该PPT课件设置成全屏播放:在“幻灯片放映”中点击“观看放映”,或者按电脑键盘快捷键F5;
(5)点击桌面工具栏中的返回按钮切换至白板模式,在“页面选项卡”(即第2个选项卡)中点击新建页面按钮,在下拉菜单中选择“新建屏幕页”,PPT课件当前播放的页面内容即成功转换成HHT的课件内容;
(6)余下的PPT页面亦可依此方法进行转换:返回到桌面模式,点击PPT画面翻页后返回到白板模式,继续新建屏幕页即可。2.值得注意的是PPT 的动画及其他特效内容只能转换成平面背景图形,为弥补此缺憾让课件变得更加生动,可以利用白板软件功能在相应的页面内容中插入课程内容相关的资源图片、音视频文件、文本框等等来丰富课件内容。也可利用白板的抓屏及动作面板功能添加页面效果,实现一些特效,如遮挡、超链接等(具体功能操作详见说明书)
第四篇:把数码相机拍下来的书转换成word文档
把数码相机拍下来的书转换成word文档
在工作中,我常常在想,要是能把纸上有用的文字快速输入到电脑中,不用打字录入便可以大大提高工作效率该有多好呀!随着科技的发展,这个问题在不断的解决,例如,现在市场上的扫描仪就带有OCR软件,可以把扫描的文字转换到电脑中进行编辑。但是,对于我们平常人来说,大多数人都是即不想多花钱购买不常用的设备,又不想费力气打字录入,那我就给大家提供一个我刚刚发现的方法吧!现在数码相机很普遍,也很常用,我们就从这里下手吧。
工具准备:
硬件: 电脑一台 数码相机
软件: word2003(其它的版本我没有实验)
doPDF(百度可以搜索下载,是一款免费的PDF制作软件)AJViewer软件(在百度可以搜索下载,是一款免费的阅读器)步骤:
1、在电脑中安装 doPDF和AJViewer
2、用数码相机把需要的文字拍下来(相机和照像水平就不多谈了。照片效果越好,可以大大缩小转换文字的误差率)
例如:
3、在word中插入你用数码相机照的书上的文字(打开word——插入菜单——图片——来自文件——选择照片——插入)
4、在word中选择文件菜单——打印——在打印机选项中选择doPDF——确定——点击“浏览”选项——选择文件保存的位置和填写文件名称——保存——确定
5、按照上面的步骤,电脑会自动打开AJViewer软件,若没有自动打开该软件,可以自己打开AJViewer软件,然后在AJViewer中打开刚刚转换的PDF文件。
6、选择AJViewer中的,然后在需要的文字部分拖动鼠标画出虚线。
7、点击发送到word按钮,就可以转换成word文件了。可以编辑了第6、7步骤图片如下:。
要点提示:
1、照片一定要平整,最好对比强烈。(最最关键的部分)
2、用doPDF生成PDF文件不只一种用法,你也可以选择其它更好、更便捷的方法,这里只提供我本此的实验软件。
3、如果熟练的使用我的方法,用不了一分钟就可以转出若干的文字,大大提高了工作效率。
4、切记:输出的文字一定要校对呀!
第五篇:PPT中文字转换成Word文档的4大绝招专题
1.利用“大纲”视图
打开PPT演示文稿,单击“大纲”,在左侧“幻灯片/大纲”任务窗格的“大纲”选项卡里单击一下鼠标,按”Ctrl+A“组合健全选内容,然后使用”Ctrl+C“组合键或右键单击在快捷菜单中选择”复制“命令,然后粘贴到Word里。
小提示:
这种方法会把原来幻灯片中的行标、各种符号原封不动的复制下来。
2.利用”发送“功能巧转换
打开要转换的PPT幻灯片,单击”文件“→”发送“→”MicrosoftWord“菜单命令。
然后选择”只使用大纲“单选按钮并单击”确定“按钮,等一会就发现整篇PPT文档在一个Word文档里被打开。
小提示:
在转换后会发现Word有很多空行。在Word里用替换功能全部删除空行可按”Ctrl+H“打开”替换“对话框,在”查找内容“里输入”^p^p“,在”替换为“里输入”^p“,多单击几次”全部替换“按钮即可。(”^“可在英文状态下用”Shift+6“键来输入。)
3.利用”另存为“直接转换
打开需要转换的幻灯片,点击”文件“→”另存为“,然后在”保存类型“列表框里选择存为”rtf“格式。现在用Word打开刚刚保存的rtf文件,再进行适当的编辑即可实现转换。
4.PPTConverttoDOC软件转换
PPTConverttoDOC是绿色软,解压后直接运行,在运行之前请将Word和PPT程序都关闭。
选中要转换的PPT文件,直接拖曳到”PPTConverttoDOC“程序里。
单击工具软件里的”开始“按钮即可转换,转换结束后程序自动退出。
小提示:
如果选中”转换时加分隔标志",则会在转换好的word文档中显示当前内容在原幻灯片的哪一页。
转换完成后即可自动新建一个Word文档,显示该PPT文件中的所有文字