[oeasy]python0122_日韩字符_日文假名_JIS_Shift_韩国谚文
- 上次回顾了非ascii的拉丁字符编码的进化过程
- 0-127 是 ascii 的领域
- 世界各地编码分布
- 拉丁字符扩展 ascii 共 16 种
- 由iso组织制定
- 从iso-8859-1
- 到iso-8859-16
- 无法同时显示俄文和法文
- 此时中日韩的文字也需要进入计算机
- 象形文字的字符集超级巨大
- 日本、韩国也用汉字
- 数量2万起步
- 真能把 如此巨大的字符集
- 编码进入计算机吗?
- 日本汉字我们可以直接看懂
- 地铁里的 标记
- 日文中 为什么
- 这么多汉字呢?
- 皇子公卿僧侣
- 都要 专门
- 来中国 朝圣
- 学文化
- 日文 很多词
- 都 能看懂
- 管 老师 叫做 先生
- 管 火车 叫做 机车
- 管 学习 叫做 勉强
- 管 辣 叫 辛
- 特别辣
- 叫 激辛
- 这些汉字怎么来的呢?
- 从日本来的 留学僧
- 不但学习 汉语佛法
- 也学习 汉字书法
- 并把这些文化带回日本
- 汉字 成为 书写符号
- 口头系统的 日语
- 可以 记录下来了
- 正如同
- 使用圣书体的一些字型
- 将腓尼基的口语记录下来
- “叶” 是 “世”
- 即时代
- 希望能流传到万世
- 各种各样的歌
- 敬畏自然山神、河神 的歌
- 男女恋爱 的歌
- 挽歌
- 汉字
- 数量很多
- 记起来、写起来也比较复杂
- 只有 最有文化的人
- 才能 都写下来
- 自己 写东西 的时候
- 有些字 忘了 怎么写
- 就拿一个 同音字
- 来 假借
- 假借的 次数 多了
- 就 固定了下来
- 形成了
- 专门的 日语拼音 字符
- 假名
- 存在着多个体系
- 不同的时代
- 不同的地域
- 直到明治33年
- 发行公文才得以统一
- 万葉仮名(假名)
- 草书风格的符号
- 有女性的柔美
- 抄文众多
- 《枕草子》
- 《源氏物语》
- 把写法也固定了下来
- 成为铅字
- 万葉仮名(假名)
- 形成了
- 现代假名系统 中的 平假名
- 除了平假名之外
- 还有片假名
- 片假名来自 汉字 的 一片
- 也是一种 假名系统
- 有 硬朗的 楷书 转化而来
- 明治维新时期
- 大量欧美外来语涌入日本
- 日语只取其读音
- 用片假名将其表示出来
- 假名系统
- 是 拼音文字 系统
- 字符数量 不多
- 在ascii的基础上
- 把片假名加了上去
- 字型什么样呢?
- 可以把这些片假名输出出来吗?
- 下面的代码是将a1到e0
- 封包进入一个字节
- 然后再将字节解码
- 可以动手试试
- 以后我们会详细讲解封包解包
- 范围[0xa1, 0xe0)
- 当时的日文
- 能显示出ascii和假名的字型
- 就已经很厉害
- 想显示出中文字型
- 是不可能的
- 是中文的拼音文字
- 只是假名都加在一起就至少 100+
- 128 根本不够用
- 更何况日文里面用日本汉字
- 虽然只有2000个不到
- 但是是文化的象征
- 不过假名毕竟是假的
- 日文中最厉害的还是汉字
- 日语中混有各种汉字
- 感觉根本不用翻译
- 也会造一些日本汉字
|
汉字
|
发音
|
含义
|
|---|---|---|
|
凪
|
なぎ
|
风平 浪静
|
|
雫
|
しずく
|
水滴 如雨下
|
|
躾
|
しつけ
|
教育
|
|
榊
|
さかき
|
寺庙里的 树
|
- 所以日文中的字符直接超过2000+
- 1 个字节 是不够了
- 至少需要 2 个字节
- 日本规格协会制定标准
- JIS X 0212
- 点阵字库 产生了
- 日本汉字的黑体模式
- 无衬线
- 黑体
- 注重实效
- 注重清晰度
- 任何字帖一般都有两种风格
- 板正规范的生硬风格
- 圆润灵动的手写风格
- 不像大写字母
- 那么生硬
- 就像小写字母
- 那么圆滑
- 韩文字符又是如何编码的呢?
- 韩文也是一种拼音文字
- 基础字母有二十四个
- 符号是朝鲜王朝世宗大王时创作的
- 从此韩文有了谚文
- 但是韩国士大夫会写汉字
- 不愿意推广谚文
- 不过拼音文字
- 更容易一些
- 谚文书写 普及速度 比汉字书写 快得多
- 拼音 是有结构的
- 谚文是由表音符号组合而成的
- 有各种间架结构
- 这些声旁都发什么音呢?
- 韩文名字
- 宋仲基(송중기)
- 金喜善(김희선)
- 李英爱(이영애)
- 阿一古(아이구)
- 圆圈不发音
- 从此就连哎呦喂(阿一古)
- 都有了标准发音方法
- 用拼音文字把读音固化下来
- 谚文有多少字符呢?
- 声母韵母拼写在一起算一个
- 共 554 个
- 而且这还不算朝鲜汉字
- 这554个基础字符导致
- 1 个字节不够
- 2 个字节才够
- 韩文的字符集为
- KS X 1001
- 日韩各有 编码格式
- 日本
- 有假名
- 五十音
- 一字节 可以勉强放下
- 有日本汉字
- 字符数量超过20000+
- 韩国
- 有谚文
- 数量超过500
- 一个字节 放不下
- 有朝鲜汉字
- 字符数量超过20000+
- 作为 汉字源头的中国
- 究竟应该 如何对汉字 进行编码 呢?
- 我们下次再说!
[oeasy]python0122_日韩字符_日文假名_JIS_Shift_韩国谚文的更多相关文章
- 《中日韩联合开发 - Asianux Server 3》(Asianux Server 3.0)[ISO]
中文名: 中日韩联合开发 - Asianux Server 3英文名: Asianux Server 3.0资源格式: 光盘镜像发行时间: 2007年制作发行: 红旗软件(中国)MiracleLinu ...
- BZOJ_4566_[Haoi2016]找相同字符_后缀自动机
BZOJ_4566_[Haoi2016]找相同字符_后缀自动机 Description 给定两个字符串,求出在两个字符串中各取出一个子串使得这两个子串相同的方案数.两个方案不同当且仅当这两 个子串中有 ...
- C#中的流_字节_字符_字符串之间的相互转换
using System; using System.Collections.Generic; using System.Linq; using System.Text; using System.I ...
- 学界 | Yann LeCun新作,中日韩文本分类到底要用哪种编码?
https://www.wxwenku.com/d/102093756 AI科技评论按:前几天,Yann LeCun与其学生 张翔在arXiv上发表了一篇新作「Which Encoding is th ...
- 字节与字符_字节流与字符流_ASCII与Unicode_GB2312_GBK_GB18030_BIG-5
字节(Byte):通常将可表示经常使用英文字符8位二进制称为一字节. 一个英文字母(不分大写和小写)占一个字节的空间,一个中文汉字占两个字节的空间. 符号:英文标点2占一个字节,中文标点占两个字节. ...
- Tesseract-OCR 3.05 躲过语言文字识别(运行程序+中英日韩语言包)
最新版本 静态编译 tesseract 3.05.00dev leptonica-1.73 libgif 5.1.3 : libjpeg 8c : libpng 1.6.16 : libtiff 3. ...
- 关于PHP程序员技术职业生涯规划 2017年3月5日韩 天峰
看到很多PHP程序员职业规划的文章,都是直接上来就提Linux.PHP.MySQL.Nginx.Redis.Memcache.jQuery这些,然后就直接上手搭环境.做项目,中级就是学习各种PHP框架 ...
- Tesseract-OCR 3.05 多过语言文字识别(运行程序+中英日韩语言包)
最新版本 静态编译 tesseract 3.05.00dev leptonica-1.73 libgif 5.1.3 : libjpeg 8c : libpng 1.6.16 : libtiff 3. ...
- 680. Valid Palindrome II【Easy】【双指针-可以删除一个字符,判断是否能构成回文字符串】
Given a non-empty string s, you may delete at most one character. Judge whether you can make it a pa ...
- Java 连接数据库及字符编码
通过JDBC方式连接MYSQL数据库: public static Connection getConnection(){ String username="root" ; Str ...
随机推荐
- ansible api调用及二次封装详解
ansible 2.7调用 程序 import json from collections import namedtuple from ansible.parsing.dataloader impo ...
- 一文搞懂 Spring Bean 的生命周期
一. 前言 在学习Spring框架的IOC.AOP两大功能之前,首先需要了解这两个技术的基础--Bean.在Spring框架中,Bean无处不在,IOC容器管理的对象就是各种各样的Bean.理解Bea ...
- FFmpeg下载编译、代码结构以及编译系统
从这里开始,就要踏上学习FFmpeg的旅程了,使用的FFmpeg版本5.0.1 1.ubuntu下,如何下载并编译FFmpeg源码 打开FFmpeg官网 Download FFmpeg,我们可以通过g ...
- 前端使用 Konva 实现可视化设计器(12)- 连接线 - 直线
这一章实现的连接线,目前仅支持直线连接,为了能够不影响原有的其它功能,尝试了2.3个实现思路,最终实测这个实现方式目前来说最为合适了. 请大家动动小手,给我一个免费的 Star 吧~ 大家如果发现了 ...
- Kubernetes监控手册06-监控APIServer
写在前面 如果是用的公有云托管的 Kubernetes 集群,控制面的组件都交由云厂商托管的,那作为客户的我们就省事了,基本不用操心 APIServer 的运维.个人也推荐使用云厂商这个服务,毕竟 K ...
- 项目管理--PMBOK 读书笔记(13)【项目相关方管理】
1.相关方分矩阵 工具与技术 核查表 又叫检查表,计数表,收集属性数据,解决问题. 焦点小组&访谈: 特点:慢,焦点小组是一对多,访谈时多对多. 抽样统计&控制图: 控制图反应 ...
- new 和 delete 运算符
C++ 支持使用操作符 new 和 delete 来动态分配和释放对象. new 运算符调用特殊函数 operator new,delete 运算符调用特殊函数 operator delete. 如果 ...
- 嵌入式 Arduino 期末复习
1 基础知识 1.1 概述 对嵌入式的定义 国内定义:以应用为中心,以计算机技术为基础,软件硬件可裁剪,且适应系统对功能,可靠性,成本,体积,功耗严格要求的专用计算机系统. IEEE定义:用于控制,监 ...
- Ubuntu下nvidia驱动卸载
Ubuntu下nvidia驱动卸载的一种方法 卸掉已经安装的驱动: sudo apt-getremove --purge '^nvidia-.*' sudo apt-getremove --purge ...
- Apache Kylin(一)Kylin介绍
1. 传统大数据分析的问题 在基于Hadoop 生态的传统大数据分析中,主要使用的技术是MPP(Massively Parallel Processing)大规模并行处理和列式存储.MPP使用线性增加 ...