扫描的文件,都是图片文件,不可能被编辑的。
想编辑它,必须把图片文字识别为文本文字——这叫OCR。OCR (Optical Character Recognition,光学字符识别)是指电子设备(例如扫描仪或数码相机)检查纸上打印的字符,通过检测暗、亮的模式确定其形状,然后用字符识别方法将形状翻译成计算机文字的过程;即,针对印刷体字符,采用光学的方式将纸质文档中的文字转换成为黑白点阵的图像文件,并通过识别软件将图像中的文字转换成文本格式,供文字处理软件进一步编辑加工的技术。如何除错或利用辅助信息提高识别正确率,是OCR最重要的课题,ICR(Intelligent Character Recognition)的名词也因此而产生。衡量一个OCR系统性能好坏的主要指标有:拒识率、误识率、识别速度、用户界面的友好性,产品的稳定性,易用性及可行性等。
OCR软件有“尚书七号OCR”。想进行OCR,必须把扫描分辨率设置得尽量大,这样才容易OCR出来。
有一款文件阅读软件叫“CAJViewer”带有文字识别功能,但需要把图片文件转换到PDF文件中才行。
运行“Adobe Acrobat Professional”软件,把图片拖进去,保存,就成为PDF文档了。
这个软件我用过OCR功能,只要图片的文字够大(宽8毫米),文字虽然有点模糊,也有95%的识别率!
温馨提示:内容为网友见解,仅供参考