HanLP 学习
学习 HanLP 需要了解,
pip install hanlp[full] -i https://pypi.tuna.tsinghua.edu.cn/simple
HanLP词性标注集
| 标签 | 含义 |
|---|---|
| a | 形容词 |
| ad | 副形词 |
| ag | 形容词性语素 |
| al | 形容词性惯用语 |
| an | 名形词 |
| b | 区别词 |
| begin | 仅用于始##始 |
| bg | 区别语素 |
| bl | 区别词性惯用语 |
| c | 连词 |
| cc | 并列连词 |
| d | 副词 |
| dg | 辄,俱,复之类的副词 |
| dl | 连语 |
| e | 叹词 |
| end | 仅用于终##终 |
| f | 方位词 |
| g | 学术词汇 |
| gb | 生物相关词汇 |
| gbc | 生物类别 |
| gc | 化学相关词汇 |
| gg | 地理地质相关词汇 |
| gi | 计算机相关词汇 |
| gm | 数学相关词汇 |
| gp | 物理相关词汇 |
| h | 前缀 |
| i | 成语 |
| j | 简称略语 |
| k | 后缀 |
| l | 习用语 |
| m | 数词 |
| mg | 数语素 |
| Mg | 甲乙丙丁之类的数词 |
| mq | 数量词 |
| n | 名词 |
| nb | 生物名 |
| nba | 动物名 |
| nbc | 动物纲目 |
| nbp | 植物名 |
| nf | 食品,比如“薯片” |
| ng 名词性语素 | |
| nh | 医药疾病等健康相关名词 |
| nhd | 疾病 |
| nhm | 药品 |
| ni | 机构相关(不是独立机构名) |
| nic | 下属机构 |
| nis | 机构后缀 |
| nit | 教育相关机构 |
| nl | 名词性惯用语 |
| nm | 物品名 |
| nmc | 化学品名 |
| nn | 工作相关名词 |
| nnd | 职业 |
| nnt | 职务职称 |
| nr | 人名 |
| nr1 | 复姓 |
| nr2 | 蒙古姓名 |
| nrf | 音译人名 |
| nrj | 日语人名 |
| ns | 地名 |
| nsf | 音译地名 |
| nt | 机构团体名 |
| ntc | 公司名 |
| ntcb | 银行 |
| ntcf | 工厂 |
| ntch | 酒店宾馆 |
| nth | 医院 |
| nto | 政府机构 |
| nts 中小学 | |
| ntu | 大学 |
| nx | 字母专名 |
| nz | 其他专名 |
| o | 拟声词 |
| p | 介词 |
| pba | 介词“把” |
| pbei | 介词“被” |
| q | 量词 |
| qg | 量词语素 |
| qt | 时量词 |
| qv | 动量词 |
| r | 代词 |
| rg | 代词性语素 |
| Rg | 古汉语代词性语素 |
| rr | 人称代词 |
| ry | 疑问代词 |
| rys | 处所疑问代词 |
| ryt | 时间疑问代词 |
| ryv | 谓词性疑问代词 |
| rz | 指示代词 |
| rzs | 处所指示代词 |
| rzt | 时间指示代词 |
| rzv | 谓词性指示代词 |
| s | 处所词 |
| t | 时间词 |
| tg | 时间词性语素 |
| u | 助词 |
| ud | 助词 |
| ude1 | 的 底 |
| ude2 | 地 |
| ude3 | 得 |
| udeng | 等 等等 云云 |
| udh | 的话 |
| ug | 过 |
| uguo | 过 |
| uj | 助词 |
| ul | 连词 |
| ule | 了 喽 |
| ulian | 连 (“连小学生都会”) |
| uls | 来讲 来说 而言 说来 |
| usuo | 所 |
| uv | 连词 |
| uyy | 一样 一般 似的 般 |
| uz | 着 |
| uzhe | 着 |
| uzhi | 之 |
| v | 动词 |
| vd | 副动词 |
| vf | 趋向动词 |
| vg | 动词性语素 |
| vi | 不及物动词(内动词) |
| vl | 动词性惯用语 |
| vn | 名动词 |
| vshi | 动词“是” |
| vx | 形式动词 |
| vyou | 动词“有” |
| w | 标点符号 |
| wb | 百分号千分号,全角:% ‰ 半角:% |
| wd | 逗号,全角:, 半角:, |
| wf | 分号,全角:; 半角: ; |
| wh | 单位符号,全角:¥ $ £ ° ℃ 半角:$ |
| wj | 句号,全角:。 |
| wky | 右括号,全角:) 〕 ] } 》 】 〗 〉 半角: ) ] { > |
| wkz | 左括号,全角:( 〔 [ { 《 【 〖 〈 半角:( [ { < |
| wm | 冒号,全角:: 半角: : |
| wn | 顿号,全角:、 |
| wp | 破折号,全角:—— -- ——- 半角:— —- |
| ws | 省略号,全角:…… … |
| wt | 叹号,全角:! |
| ww | 问号,全角:? |
| wyy | 右引号,全角:” ’ 』 |
| wyz | 左引号,全角:“ ‘ 『 |
| x | 字符串 |
| xu | 网址URL |
| xx | 非语素字 |
| y | 语气词(delete yg) |
| yg | 语气语素 |
| z | 状态词 |
| zg | 状态词 |
HanLP 学习的更多相关文章
- Hanlp学习笔记
一.首先要引入mawen依赖包: <dependency> <groupId>com.hankcs</groupId> <artifactId>hanl ...
- 菜鸟如何使用hanlp做分词的过程记录
菜鸟如何使用hanlp做分词的过程记录 最近在学习hanlp的内容,准备在节后看看有没有时间整理一波hanlp分享下,应该还是会像之前分享DKHadoop一样的方式吧.把整个学习的过程中截图在配文字的 ...
- Elasticsearch集成HanLP分词器-个人学习
1.通过git下载分词器代码. 连接如下:https://gitee.com/hualongdata/hanlp-ext hanlp官网如下:http://hanlp.linrunsoft.com/ ...
- 13.深度学习(词嵌入)与自然语言处理--HanLP实现
笔记转载于GitHub项目:https://github.com/NLP-LOVE/Introduction-NLP 13. 深度学习与自然语言处理 13.1 传统方法的局限 前面已经讲过了隐马尔可夫 ...
- NLP入门学习中关于分词库HanLP导入使用教程
大家好,时隔多年再次打开我的博客园写下自己的经验和学习总结,开园三年多,文章数少得可怜,一方面自己技术水平局限,另一方面是自己确实想放弃写博客.由于毕业工作的原因,经常性的加班以及仅剩下少的可怜的休息 ...
- 【HanLP】资料链接汇总
Java中调用HanLP配置 HanLP自然语言处理包开源官方文档 了解HanLP的全部 自然语言处理HanLP 开源自由的汉语言处理包主页 GitHub源码 基于hanLP的中文分词详解-MapRe ...
- 机器学习(Machine Learning)&深度学习(Deep Learning)资料【转】
转自:机器学习(Machine Learning)&深度学习(Deep Learning)资料 <Brief History of Machine Learning> 介绍:这是一 ...
- NLP+词法系列(二)︱中文分词技术简述、深度学习分词实践(CIPS2016、超多案例)
摘录自:CIPS2016 中文信息处理报告<第一章 词法和句法分析研究进展.现状及趋势>P4 CIPS2016 中文信息处理报告下载链接:http://cips-upload.bj.bce ...
- AI 学习路线
[导读] 本文由知名开源平台,AI技术平台以及领域专家:Datawhale,ApacheCN,AI有道和黄海广博士联合整理贡献,内容涵盖AI入门基础知识.数据分析挖掘.机器学习.深度学习.强化学习.前 ...
- Hanlp自然语言处理工具之词法分析器
本章是接前两篇<分词工具Hanlp基于感知机的中文分词框架>和<基于结构化感知机的词性标注与命名实体识别框架>的.本系统将同时进行中文分词.词性标注与命名实体识别3个任务的子系 ...
随机推荐
- golang在win10安装、环境配置 和 goland开发工具golang配置 及Terminal的git配置
前言 本人在使用goland软件开发go时,对于goland软件配置网上资料少,为了方便自己遗忘.也为了希望和我一样的小白能够更好的使用,所以就写下这篇博客,废话不多说开搞. 一.查看自己电脑系统版本 ...
- OpenGL 着色器详解
1. GLSL语言 glsl语言是用来编写着色器的,通过一段一段包含main函数的程序片段,告诉渲染引擎怎么去渲染内容. glsl语言的语法有点类似c语言风格,只是增加了一些特有的关键字来修饰变量,下 ...
- mysql 代码适配 postgresql 适配改写,优化案例(行转列 + 标量子查询改写)
最近在适配个MySQL应用的项目,各种SQL改成PG兼容的语法真的是脑壳痛,今天遇到个有意思的案例. 原 MySQL SQL语句: SELECT DISTINCT l.MALL_NAME '项目', ...
- 基于Spark对消费者行为数据进行数据分析开发案例
原创/朱季谦 本文适合入门Spark RDD的计算处理. 在日常工作当中,经常遇到基于Spark去读取存储在HDFS中的批量文件数据进行统计分析的案例,这些文件一般以csv或者txt文件格式存在.例如 ...
- Android Sutdio 编入System API 等隐藏API 方法
1. 将 classes.jar 放入 app/libs 文件夹下 右键点击 jar 包,点击 Add as Library 2. 项目级 Gradle 文件新增以下配置 gradle.project ...
- DX后台截图C++实现代码
DX后台截图C++实现代码 文章仅发布于https://www.cnblogs.com/Icys/p/DXGI.html和知乎上. 传统的GDI API (BitBlt)虽然可以完美的完成后台截图的任 ...
- 本地训练,开箱可用,Bert-VITS2 V2.0.2版本本地基于现有数据集训练(原神刻晴)
按照固有思维方式,深度学习的训练环节应该在云端,毕竟本地硬件条件有限.但事实上,在语音识别和自然语言处理层面,即使相对较少的数据量也可以训练出高性能的模型,对于预算有限的同学们来说,也没必要花冤枉钱上 ...
- 黑客玩具入门——9、Burp Suite
Burp Suite是一款集成化的渗透测试工具,包含了很多功能,可以帮助我们快速完成对web应用程序的渗透测试和攻击.Burp Suite是由Java语言编写,因为Java是可以跨平台的,所以Burp ...
- Nim 枚举类型 对性能的影响
Nim 枚举类型 对性能的影响 继上一篇文章<Nim 概念 Concept 对性能的影响>后,我在想,既然 method 虚方法造成性能的影响很大,那么有没有更快的方法实现,当然是有的,那 ...
- Java自定义ClassLoader实现插件类隔离加载 - 原理篇
书接上回 在 Java自定义ClassLoader实现插件类隔离加载文章中,我们通过 自定义ClassLoader + 插件独立打包引入的方式,实现了同依赖不同版本的隔离加载 这次咱们来分析下具体实现 ...