C#使用OneNote的图片文字识别功能（OCR）

http://www.cnblogs.com/Charltsing/p/OneNoteOCR.html

有需要技术咨询的，联系QQ564955427

前段时间有人问我能不能通过OneNote扫描图片，并返回文本。经过几天的测试，以及对网上若干个代码的测试，写了一个OneNote 2013下的OCR导入导出工具。

在测试的时候，发现OneNote 2013 提供的API还是有一些问题的，总结如下：

1、OneNote 2013务必升级到最新版，否则调用API的时候，可能会发生异常。本人目前的版本是15.0.4787.1000简体中文版。

2、扫描的语言支持中文和英文，简体版当然默认使用中文识别，但貌似没有办法修改默认语言。也许只能通过修改控制面板中的语言及地区才可以。

3、通过OneNote API做扫描步骤也不复杂，一般都是三~四步，

onenoteApp.CreateNewPage 建立新page

onenoteApp.UpdatePageContent 加入图片的base64数据

onenoteApp.GetPageContent 从返回的XML里面提取OCR Data文本

onenoteApp.DeleteHierarchy 删除新建的page

4、有一些需要注意的问题：

OneNote扫描图片功能如果没有禁用的话，是自动进行的，而且不能获知什么时候识别完毕。只能通过延时语句来估计时间。

onenoteApp.DeleteHierarchy 不太可靠，有的时候没有删除新建的page。建议增加Dispose删除多出来的page（通过title识别即可）

OneNote的DLL不支持嵌入资源，所以不同版本的OneNote需要引用不同的DLL，这可能会给程序的发布带来一些问题。

下图是OneNote2010的识别结果

OneNote2013识别情况要略好些。

***************************************************************************************

最后我把这个OCR封装到了XLL里面，给Excel vba调用，方便批量识别图片文本，并存入Excel。VBA调用代码如下：

C#使用OneNote的图片文字识别功能（OCR）的更多相关文章

小试Office OneNote 2010的图片文字识别功能（OCR）
原文:小试Office OneNote 2010的图片文字识别功能(OCR) 自Office 2003以来,OneNote就成为了我电脑中必不可少的软件,它集各种创新功能于一身,可方便的记录下各种类型 ...
Python图像处理之图片文字识别（OCR）
OCR与Tesseract介绍将图片翻译成文字一般被称为光学文字识别(Optical Character Recognition,OCR).可以实现OCR 的底层库并不多,目前很多库都是使用共同 ...
python3 图片文字识别
最近用到了图片文字识别这个功能,从网上搜查了一下,决定利用百度的文字识别接口.通过测试发现文字识别率还可以.下面就测试过程简要说明一下 1.注册用户链接:https://login.bce.baid ...
JAVA的图片文字识别技术
从2013年的记录看,JAVA中图片文字识别技术大部分采用ORC的tesseract的软件功能,后来渐渐开放了java-api调用接口. 图片文字识别技术,还是采用训练的方法.并未从根本上解决图片与文 ...
一篇文章搞定百度OCR图片文字识别API
一篇文章搞定百度OCR图片文字识别API https://www.jianshu.com/p/7905d3b12104
刚破了潘金莲的身份信息（图片文字识别），win7、win10实测可用(免费下载)
刚破了潘金莲的身份信息(图片文字识别),win7.win10实测可用效果如下: 证照,车牌.身份证.名片.营业执照等图片文字均可识别电脑版本人出品大小1.3MB 下载地址:https://p ...
Python人工智能之图片识别，Python3一行代码实现图片文字识别
1.Python人工智能之图片识别,Python3一行代码实现图片文字识别 2.tesseract-ocr安装包和中文语言包注意:
【图片识别】java 图片文字识别 ocr （转）
http://www.cnblogs.com/inkflower/p/6642264.html 最近在开发的时候需要识别图片中的一些文字,网上找了相关资料之后,发现google有一个离线的工具,以下为 ...
【原】Coursera—Andrew Ng机器学习—课程笔记 Lecture 18—Photo OCR 应用实例:图片文字识别
Lecture 18—Photo OCR 应用实例:图片文字识别 18.1 问题描述和流程图 Problem Description and Pipeline 图像文字识别需要如下步骤: 1.文字侦测 ...

随机推荐

C# DBHelper类参考
using System;using System.Collections.Generic;using System.Text;using System.Configuration;using Sys ...
Gradle: Gradle Wrapper
[Gradle 安装] 安装完毕后,记得设置一下环境变量.Environment Variables:GRADLE_HOME=D:\Program Files\Gadle\gradle-4.7Path ...
mysql中的升序和降序以及一个字段升序和一个字段降序
mySql中,升序为asc,降序为desc.例如: 升序:select * from 表名 order by 表中的字段 asc(mysql中默认是升序排列,可不写) 降序:select ...
mybatis根据数据库表结构自动生成实体类，dao，mapper
首先, pom需要引入  <dependency> <groupId>mysql</groupId> <artifac ...
ESLint笔记
ESLint是JavaScript的代码检查工具.因为JS是弱类型的语言,不需要编译,代码错误是在运行时调适的,所以需要个工具在编码的过程发现问题.ESLint的初衷是为了让程序员可以创建自己的检测规 ...
vue源码分析—数据绑定
放进沙里附件拉萨就发牢骚:剑飞:啊撒
为什么二流程序员都喜欢黑php？
为什么二流程序员都喜欢黑php? 为什么程序员都喜欢黑php?这个嘛!你骂一句php是垃圾试试,保准php程序员不揍扁你!这就好像自己的母校,纵然有很多不好的地方,但是只允许自己调侃,不允许外人骂半句 ...
自己动手写处理器之第二阶段（1）——可编程逻辑器件与PLD电路设计流程
将陆续上传本人写的新书<自己动手写处理器>(尚未出版),今天是第五篇,我尽量每周四篇通过上一章的介绍,读者应该知道CPU内部有一些主要的电路,比方:译码电路.运算电路.控 ...
[JXOI2018]排序问题
嘟嘟嘟这是今天做的第二道九条可怜的题,现在对他的题的印象是:表面清真可做,实则毒瘤坑人. 首先要感谢吉司机,我期望学的特烂,好在样例直接告诉我们期望怎么求了. 令\(b_i\)表示第\(i\)个不同 ...
P2370 yyy2015c01的U盘（二分+背包）
思路:先说一下题意吧.就是给你n个文件大小为v,价值为c, 但是硬盘的大小为S, 而且要存的总价值大于等于p.问每次传输k大小的文件.问k的最大值是多少? 我们以k为二分对象. 直接讲检验函数吧. 假 ...

C#使用OneNote的图片文字识别功能（OCR）

C#使用OneNote的图片文字识别功能（OCR）的更多相关文章

随机推荐

热门专题