msyql存储数据时字段被截断
关于mysql中字段类型为text文本存储json格式数据,字段被截断的问题
背景:
字段类型 MEDIUMTEXT
确定存储内容5548个字符,换算为字节不超过16M
数据库内已经存在更长内容的存储成功,短的内容存储失败
有几率出现截断概率,
日志看入库前参数json都是完整的,入库后内容被截断,导致前端读取数据结构解析失败而报错
发生这种情况的原因有两种可能:
1. 建表时数据库字段设置长度不足
- 当输入内容的字符长度大于当前字段设置长度时,数据库会自动截断内容
字段类型以下几种:
字符串类型
| 类型 | 范围 | 说明 | |
|---|---|---|---|
| Char(N) [ binary] | N=1~255 个字节 binary :分辨大小写 | 固定长度 | std_name cahr(32) not null |
| VarChar(N) [binary] | N=1~255 个字节 binary :分辨大小写 | 可变长度 | std_address varchar(256) |
| TinyBlob | 最大长度255个字节(2^8-1) Blob (Binary large objects) | 储存二进位资料,且有分大小写 | memo text not null |
| TinyText | 最大长度255个字节(2^8-1) | ||
| Blob | 最大长度65535个字节(2^16-1) | ||
| Text | 最大长度65535个字节(2^16-1) | ||
| MediumBlob | 最大长度 16777215 个字节(2^24-1) | ||
| MediumText | 最大长度 16777215 个字节(2^24-1 | ||
| LongBlob | 最大长度4294967295个字节 (2^32-1) | ||
| LongText | 最大长度4294967295个字节 (2^32-1) | ||
| Enum | 集合最大数目为65535 | 列举(Enumeration),Enum单选、Set复选 | sex enum(1,0) habby set(‘玩电玩’,’睡觉’,’看电影’,’听音乐’) |
| Set | 集合最大数目为64 |
- 数字/数值类型
| 类型 | 范围 | 说明 |
|---|---|---|
| TinyInt[M] [UNSIGNED] | -128~127 UNSIGNED : 0~255 | num tinyint unsigned |
| SmallInt[M] [UNSIGNED] | -32768~32767 UNSIGNED :0~ 65535 | |
| MediumInt[M] [UNSIGNED] | -8388608~8388607 UNSIGNED :0~16777215 | |
| Int[M] [UNSIGNED] | -2^31~2^31-1 UNSIGNED : 0~2^32 | |
| BigInt[M] [UNSIGNED] | -2^63~2^63-1 UNSIGNED : 0~2^64 | |
| Float [(M,D)] | -3.4E+38~3.4E+38( 约 ) |
注: M 为长度, D 为小数,Float 4 bytes,Double 8 bytes Double [(M,D)] -1.79E+308~1.79E+308( 约 )Decimal [(M,D)] 辨別ZeroFill:当宣告关键字ZeroFill为自动填满0,如 000021
- 日期时间类型
| 类型 | 范围 |
|---|---|
| Date | 日期(yyyy-mm-dd) |
| Time | 时间(hh:mm:ss) |
| DateTime | 日期与时间組合(yyyy-mm-dd hh:mm:ss) |
| TimeStamp | yyyymmddhhmmss |
| Year | 年份yyyy |
- 根据计算转换字符长度可知,并没有超过长度限制,故此种原因排除
2. 字符编码格式数据库不支持
- 原数据库字符集设置为CHARSET=utf8,有些数据编码格式例如emoji的表情符号mysql 中的utf8并不支持
- 据官方文档的解释:
mysql 支持的 utf8 编码最大字符长度为 3 字节,如果遇到 4 字节的宽字符就会插入异常了。三个字节的 UTF-8 最大能编码的 Unicode 字符是 0xffff,也就是 Unicode 中的基本多文种平面(BMP)。
也就是说,任何不在基本多文本平面的 Unicode字符,都无法使用 Mysql 的 utf8 字符集存储。包括 Emoji 表情(Emoji 是一种特殊的 Unicode 编码,常见于 ios 和 android 手机上),和很多不常用的汉字,以及任何新增的 Unicode 字符等等。
观察日志数据发现linux下打印出的日志存在类似 <u+1f44d> 样式的字符,属于unicode编码的特殊字符,文本内容也是在此截断的,由此可以判断为字符编码格式问题
3. 解决方案
3.1 升级 mysql 版本,并将utf8字符集升级到utf8mb4
升级你的 mysql 到 5.5.3 之后即可,查看当前环境版本:
select version();
- MySQL在5.5.3之后增加了这个utf8mb4的编码,mb4就是most bytes 4的意思,专门用来兼容四字节的unicode。好在utf8mb4是utf8的超集,除了将编码改为utf8bp4外不需要做其他转换。当然,为了节省空间,一般情况下使用utf8也就够了。
- 所以好的技术就是,采用对当前而言最好的解决方案,然后再逐步迭代满足新的需求。
3.1.1 直接修改表结构
--修改数据库字符集
ALTER DATABASE test CHARACTER SET = utf8mb4;
--修改表字符集
alter table test convert to character set utf8mb4;
--修改字符字符集
ALTER TABLE `test` CHANGE COLUMN `name` `name` varchar(12) CHARACTER SET utf8mb4;
3.1.2 修改数据库默认配置
[client]
default-character-set = utf8mb4
[mysqld]
character-set-server=utf8mb4
collation-server=utf8mb4_unicode_ci
[mysql]
default-character-set = utf8mb4
3.2 修改数据库字段类型
修改字段类型为二进制存储,通过样可以达到目的,进行兼容
--修改字符字符集
ALTER TABLE `test` CHANGE COLUMN `name` `name` MediumBlob ;
3.3 强行过滤掉生僻字符串
- 从业务和技术的角度综合考虑,可以做个折中,将生僻字符串提前过滤掉,因为这类字符串本来就使用的很少,即使存进数据库了,展示、查询的时候也会多少有其它的问题,不如直接过滤掉,mysql 不支持四字节的 utf8 一方面可能是历史包袱,另一方面估计也是为了省空间。
有意者可以进行测试
先向在数据库中建表以utf8字符集,字段设置为二进制文本类型或者
CREATE TABLE `ts_test` (
`id` int(10) NOT NULL,
`content` text NOT NULL CHARACTER SET utf8mb4, --或者 `content` BLOB NOT NULL,
PRIMARY KEY (`id`)
) ENGINE=InnoDB DEFAULT CHARSET=utf8 COLLATE=utf8_unicode_ci;
插入表情符号emoji
insert into ts_test ('id','content') values (1,'aaaaaaaamsyql存储数据时字段被截断的更多相关文章
- PHPExcel导出数据时字段超过26列出错Invalid cell coordinate [1
http://blog.csdn.net/dl425134845/article/details/46650961 以下是解决方案函数 /** * 方法名: getExcel * 作用 ...
- python 大量使用json 存储数据时,格式化输出的方式
import json, pprint dic = {'name': 234, 'user_name': 'yan xia ting yu ', 'list': ['ds', 'a', 2], '你好 ...
- PlayerPrefs存储数据在本地的存储位置
PlayerPrefs存储数据时,其在windows的存储路径是注册表: HKEY_CURRENT_USER Software CompanyName ProjectName 其中的CompanyNa ...
- sql server的缺陷 将截断字符串或二进制数据 哪个字段
将截断字符串或二进制数据 哪个字段 消息 8152,级别 16,状态 14,第 2 行将截断字符串或二进制数据. sql server2000 sql server2014 也不能直接提示出哪个字段的 ...
- [MySQL]load data local infile向MySQL数据库中导入数据时,无法导入和字段不分离问题。
利用load data将文件中的数据导入数据库表中的时候,遇到了两个问题. 首先是load data命令无法执行的问题: 命令行下输入load data local infile "path ...
- MSSQL导入数据时,出现“无法截断表 因为表正由Foreign key引用”错误
* 错误 0xc002f210: 准备 SQL 任务: 执行查询“TRUNCATE TABLE [dsc100552_db].[dbo].[ALV_SalesBigClass] ”失败,错误如下:“无 ...
- 在向"带有自增字段的数据库表"中插入数据时,自定义"该自增字段"的数据
在设计数据库表的时候,经常会使用自增主键或其他自增字段.比如: DB_UserGroups表中GroupID为该表主键,并为自增字段. 但在将某字段设置自增后,想在插入数据时,人为指定自增字段的数据内 ...
- Android提供了5种方式存储数据:
--使用SharedPreferences存储数据: --文件存储数据: --SQLite数据库存储数据: --使用ContentProvider存储数据: --网络存储数据: 一:使用SharedP ...
- Android开发手记(18) 数据存储三 SQLite存储数据
Android为数据存储提供了五种方式: 1.SharedPreferences 2.文件存储 3.SQLite数据库 4.ContentProvider 5.网络存储 SQLite 是以嵌入式为目的 ...
随机推荐
- linux的一些命令,面试经常碰到的
1 查询所有java进程ps -A | grep java解释一下这个命令的意思,ps 是查看系统当前进程的命令,参数 -A(注意,是大写,linux中是区分大小写的)是显示所有程序,| 这个是管道符 ...
- php禁用函数设置及查看方法详解
这篇文章主要介绍了php禁用函数设置及查看方法,结合实例形式分析了php禁用函数的方法及使用php探针查看禁用函数信息的相关实现技巧,需要的朋友可以参考下 本文实例讲述了php禁用函数设置及查看方法. ...
- iOS----------Bad Gateway
今天项目因为元数据被拒,再次提交去编辑APP时,发现进不了我的APP界面,出现了如下情况,大概有10多分钟 ,一直进不去 ,公司网络一直不稳定,于是打开了我的VPN,然后就可以了.
- mpvue学习笔记-之微信小程序数据请求封装
简介 美团出品的mpvue已经开源出来很久了,一直说要进行一次实践,这不最近一次个人小程序开发就用上了它. 看了微信官方的数据请求模块--request,对比了下get和post请求的代码,发现如果在 ...
- 一种解决Android studio 3.0 Build报错的方法
问题背景: 最近在开始使用AndroidStudio3.0,刚好有一个开源的项目(Material-Movies),需要学习下.因为该项目比较早(2015年),而这段时间AndroidStudio和G ...
- 软件工程实践-WC项目之C实现
1.Github项目地址 https://github.com/ShadowEvan/homework 基本功能 -c 统计文件字符数(实现) -w 统计文件词数(实现) -l 统计文件行数(实现) ...
- WebSocket-java实践
websocket 主要用于 前端页面hmtl/jsp 与 后端进行socket得连接. 本例简单实现:一但后端接收到数据或者根据某些规则主动发送数据,那么可以根据不同用户等区别,发送给某个登陆得 ...
- DbGridEh根据某一个字段的值显示对应底色或字体变化
改变行底色: procedure TForm1.dggrideh1DrawColumnCell(Sender: TObject;const Rect: TRect; DataCol: Integer; ...
- MVC 伪静态路由、MVC路由配置,实现伪静态。
前段时间,研究了一下mvc路由配置伪静态,在网上扒了很多最后还是行不通,所以我现在把这些心得整理出来,供大家分享: 1.mvc中默认路由配置是:http://localhost:24409/Home/ ...
- SimpleDateFormat日期格式化总结
1.new一个java.util.Date对象,调用它的setYear.setMonth等等方法,设置你要的年月日.不过这种做法不推荐,因为setYear等方法已经过时了.2.new一个java.ut ...
- PHPExcel导出数据时字段超过26列出错Invalid cell coordinate [1