光学字符识别,简称OCR,是一种可以使你转换不同文档的技术,比如将扫描纸质文档,PDF文件或者数码相机拍摄的图片转换成可以编辑的文档。
假设你获得了一个纸质文件-比如,杂志、彩页或者你合作伙伴发给你的PDF合同。很明显,光是一台扫描仪是不足以让这些文档转变成可以编辑的文档,也就是Microsoft Word。扫描仪可以做的只是创建图片或者一张黑白或者彩色的图像文档。为了从扫描文档、PDF或者数码图片中提取文字和数据,你需要OCR软件识别图片上的信息,从单词到句子,然后变成整个可以编辑的文档。
软件支持图片转文本(Text)、图片转表格(Excel)、PDF转演示文稿(PowerPoint)、图片转文档(Word)。
它还支持中文、英文、法文、德文等二十多种语言,还支持识别C++、Java等编程语言。
地址:https://zhcn.109876543210.com/