二维码开源库ZBar-实现中文解码
中文乱码
上篇《ZBar-windows下编译和使用》已经成功解析了条形码,但目标是二维码,经测试二维码中文会出现乱码。
下图二维码的内容是“http123测试456”,解析后的内容为“http123娴嬭瘯456”
搜索了一下关键词,解决方案如下http://blog.csdn.net/zizi7/article/details/51880129
修改文件 zbar/qrcode/qrdectxt.c:
latin1_cd=iconv_open("GB18030","UTF-8");
/*But this one is often used, as well.*/
sjis_cd=iconv_open("GB2312","UTF-8");
/*This is a trivial conversion just to check validity without extra code.*/
utf8_cd=iconv_open("UTF-8","UTF-8");
...
enc_list[]=sjis_cd;
enc_list[]=latin1_cd;
enc_list[]=utf8_cd;
重新编译运行后,正确输出“http123测试456”
自己实现中文解码
ZBar解析后的字符原始输出是UTF-8格式,然后使用了iconv将其转换为相应的字符编码,但最终目标是移植到STM32F4上,如果要直接输出中文编码,有几种方案:
1. 把iconv移植到STM32F4上
2. 自己实现UTF8-8转中文编码
3. 把编码工作交给上位机
字符集和编码格式
搜索了一下字符编码规则,觉得方案2比方案1,3更容易实现。这里先简单介绍下与本文相关的字符集和编码格式。
1. Unicode
Unicode是字符集,也叫万国码,顾名思义就是包含所有国家的文字。
2. GB18030
GB18030是中文字符集,可以认为是Unicode的一个子集,还有其他GBXXXXX的中文字符集,他们的关系简单来说就是包含的中文字符个数不一样。简单起见,这里只是使用2个字节的GB18030,一共20902个汉字,也基本覆盖常见的汉字了。书读得少,4个字节的汉字也没认识几个。
3. UTF-8
UTF-8是Unicode字符集的一种编码格式,还有其他UTF-16,UTF-32,ZBar使用了 UTF-8。
UTF-8最大的一个特点,就是它是一种变长的编码方式。它可以使用1~6个字节表示一个符号,根据不同的符号而变化字节长度。
UTF-8的编码规则很简单,只有二条:
1)对于单字节的符号,字节的第一位设为0,后面7位为这个符号的unicode码。因此对于英语字母,UTF-8编码和ASCII码是相同的。
2)对于n字节的符号(n>1),第一个字节的前n位都设为1,第n+1位设为0,后面字节的前两位一律设为10。剩下的没有提及的二进制位,全部为这个符号的unicode码。
(具体例子可以参考http://blog.csdn.net/xiaolei1021/article/details/52093706)
下表总结了编码规则,字母x表示可用编码的位。
4. GB18030,Unicode,UTF-8的关系
UTF-8转GB18030实现
了解相关字符集和编码格式,可以开始写转换代码了。
1. 需要一个GB18030字符集,其实就是一个数组,实现代码如下(VS下编译)
调用UnicodeToGB18030Table函数生成一个GB18030字符集数组。
char* UnicodeToGB18030String(const wchar_t* unicode_str)
{
UINT code_page = ; //GB2312 :936 GB18030: 54936
int len=WideCharToMultiByte(code_page,,unicode_str,-,NULL,,NULL,NULL);
char* buf=new char[len+];
WideCharToMultiByte(code_page,,unicode_str,-,buf,len,NULL,NULL);
buf[len]=;
return buf;
}
int UnicodeToGB18030Table(void)
{
FILE *table;
wchar_t unicode[]={0x4E00,};
char* gb18030;
int cnt=;
table = fopen("unicode_to_gb18030_table.c","w");
if(table == NULL)
{
printf("can not open unicode_to_gb18030_table.c\n");
system("pause");
exit();
}
fprintf(table, "%s", "const char unicode_to_gb18030_table1[] = {\n");
for(unicode[]=0x4E00; unicode[]<=0x9FA5; unicode[]++)
{
gb18030 = UnicodeToGB18030String(unicode); if(unicode[]==0x9FA5)
{
fprintf(table, "0x%X,0x%X ", (UINT8)gb18030[],(UINT8)gb18030[]);
}
else
{
fprintf(table, "0x%X,0x%X, ", (UINT8)gb18030[],(UINT8)gb18030[]);
} cnt ++;
if(cnt == )
{
cnt = ;
fprintf(table, "\n");
}
} fprintf(table, "\n};");
fclose(table);
}
2. 通过查表,将UTF-8转为GB18030
int zbar_utf8_to_gb18030 (uint8_t* utf8_code, uint32_t utf8_len, uint8_t* gb18030)
{
uint8_t utf8_bytes[];//该数组最大为6个字节,但这里只考虑3个字节的中文编码
uint32_t i = , j = ;
uint16_t unicode_value;
uint8_t* unicode = gb18030; for(i=; i< utf8_len; i+=) {
utf8_bytes[] = utf8_code[i+] & 0x0F;
utf8_bytes[] = utf8_code[i+] & 0x3F;
utf8_bytes[] = utf8_code[i+] & 0x3F; unicode[j] = (utf8_bytes[] >> ) | ((utf8_bytes[]) << );
unicode[j+] = utf8_bytes[] | ((utf8_bytes[] & 0x03) << );
unicode_value = (unicode[j]<<) + unicode[j+];
if(unicode_value>=0x4E00){
gb18030[j] = unicode_to_gb18030_table1[(unicode_value-0x4E00)*];
gb18030[j+] = unicode_to_gb18030_table1[(unicode_value-0x4E00)* + ];
}
j += ;
}
return ;
}
中文字符集和编码转码函数有了,下一步就是替换ZBar源码的编码转换部分。
删掉zbar/qrcode/qrdectxt.c 中iconv相关的代码,将zbar_utf8_to_gb18030函数加入
qr_code_data_list_extract_text函数中:
int qr_code_data_list_extract_text(const qr_code_data_list *_qrlist,
zbar_image_scanner_t *iscn,
zbar_image_t *img)
{
....
case QR_MODE_BYTE:{
int gb18030_cnt = zbar_utf8_to_gb18030(entry->payload.data.buf, entry->payload.data.len, sa_text+sa_ntext);
sa_ntext += gb18030_cnt;
}
break;
....
}
重新编译运行后
正确输出“http123测试456”
坐等下班,回家过年...................
二维码开源库ZBar-实现中文解码的更多相关文章
- 二维码开源库zbar、zxing使用心得
首先说明我的测试场景是“识别打印在纸上的二维码”,在扫描结果中寻找二维码并进行识别,而不是直接让摄像头对着二维码扫描. zbar和zxing用的都是自己从github上clone的c++源码/接口编译 ...
- 二维码开源库ZBar-吐槽篇
前不久在网上看到一篇文章<QR-Decoder-OV5640 二维码识别> ,是某开发板的教程.记得对应的开发板以前购买过,当初只是为了看OV5640的JPG的输出效果,结果由于公司奇葩的 ...
- 二维码开源库ZBar-MDK STM32F429移植
前两篇文章已经实现ZBar在Windows平台下的编译和使用,本文将介绍如何把ZBar移植到STM32F429,IDE使用MDK. 1. MDK工程设置 (1)不勾选Use MicroLIB ,使用I ...
- 二维码开源库ZBar-windows下编译和使用
源码 下载最新Zbar源码(http://zbar.sourceforge.net/),网站的WIKI是空白的,所以只能在源码包里找使用说明了,很遗憾Windows下怎么编译没说明,只是说明了Wind ...
- C++二维码相关库编译
一.瞎想 坐在地铁上闲来无聊,突然想到了二维码,顺手就百度了下相关的资料,目前C++二维码相关的库不多,也就zbar(开源中国上下了半天也没下载下来).zxing,不过这两个库据说都是解析二维码的,不 ...
- Android二维码开源项目zxing用例简化和生成二维码、条形码
上一篇讲到:Android二维码开源项目zxing编译,编译出来后有一个自带的測试程序:CaptureActivity比較复杂,我仅仅要是把一些不用的东西去掉,用看起来更方便,二维码和条形码的流行性自 ...
- 个性二维码开源专题<替换元素点>
基础方法:ChangeFillShape //修改填充形状 ChangeFillShape(...) // 摘要: // 修改填充形状 // // 参数: // g: // 图形画板 // // Fo ...
- 个性二维码开源专题<替换定位点>
基础方法: ChangeFillShape //修改填充形状 ChangeFillShape(...) // 摘要: // 修改填充形状 // // 参数: // g: // 图形画板 // // F ...
- 个性二维码开源专题<液化/圆角/效果>
基础方法: ChangeFillShape //修改填充形状 ChangeFillShape(...) // 摘要: // 修改填充形状 // // 参数: // g: // 图形画板 // // F ...
随机推荐
- spring boot容器启动详解
目录 一.前言 二.容器启动 三.总结 =======正文分割线====== 一.前言 spring cloud大行其道的当下,如果不了解基本原理那么是很纠结的(看见的都是约定大于配置,但是原理呢?为 ...
- 程序员是这样区分Null和Undefined
Null类型 Null类型是第二个只有一个值的数据类型,这个特殊的值是null.从逻辑角度来看,null值表示一个空对象指针,而这也正是使用typeof操作符检测null值时会返回"obje ...
- navicat将多个表导出为一个sql文件
1.shift选中多个表 2右键选择--转储sql文件---结构和数据
- linux利用sendmail发送邮件的方法
Linux利用sendmail发送邮件, 方法1 安装sendmail即可使用, mail -s "test" user@sohu.com bin/mail会默认使用本地sendm ...
- 商品鼠标移过去hover效果---图片放大1.1倍
.home-standard-layout .middle-goods-list ul li:hover{ box-shadow: 0 0 10px gray;} .home-standard-lay ...
- mysql 多列索引的生效规则
mysql中 myisam,innodb默认使用的是 Btree索引,至于btree的数据结构是怎样的都不重要,只需要知道结果,既然是索引那这个数据结构最后是排好序:就像新华字典他的目录就是按照a,b ...
- sersync+rsync同步
(一)目标服务器(rsync):10.60.50.192 1.安装rsync yum -y install rsync 2.创建rsyncd.conf配置文件 vi /etc/rsyncd.conf ...
- linux_DNS
linux其配置文件 : /etc/resolv.conf nameserver 223.5.5.5 nameserver 223.6.6.6 # 这两个解析地址为阿里云解析地址,格式也是这样 什么是 ...
- JDK 中的设计模式应用实例
在 JDK(Java Development Kit)类库中,开发人员使用了大量设计模式,正因为如此,我们可以在不修改 JDK 源码的前提下开发出自己的应用软件.研究 JDK 类库中的模式实例也不 ...
- 【Python3之迭代器,生成器】
一.可迭代对象和迭代器 1.迭代的概念 上一次输出的结果为下一次输入的初始值,重复的过程称为迭代,每次重复即一次迭代,并且每次迭代的结果是下一次迭代的初始值 注:循环不是迭代 while True: ...