2013.6.21 - OpenNER第一天
下午去实验室继续写实验报告,跟伟杰要了一个实验报告,然后大师兄叫我,我们在走廊唠了一会儿。
大
师兄想做Open
NE,他说这个会比较难,目前没有人做,因为还没有发现相关的文章,大家研究的都是指定了哪种实体之后的识别,这种Open的还不是很成熟,目前的想法就
是挖掘实体结构,然后来确定实体边界。目前想让我在几个现成的实体上试试能不能挖掘出来有效的结构,或者其他有效的方法。
所以今天的任务有这些:
- 做实验
- 写报告
- YY一下OpenNE
晚
上跟家伟吃饭的时候也讨论了一下如果是他,他怎么办,因为他是分析图像的,所以就相当于给几个图片,中间标出主题的轮廓。比如给几个猫的图片和房子的图
片,标出来,然后让他识别车图片和人的图片等其他图片里的内容的轮廓。他说如果是他他会选择强化学习,然后具体怎么样他也没想法。其实和后来在跟师兄讨
论,感觉这个比喻并不恰当。在黑店吃完饭之后我们去实验室楼下一家新开的饮品店喝点咖啡,接到了大师兄的电话,商量了一下最近的情况,因为现在跟少磊坐一
起,所以周一、周二、周三、周日的下午和晚上过来合计合计,尽快拿出个方案。这周六和周日打算做一些自己的调查和分析。然后周一晚上过来跟师兄碰头。
晚
上写完报告之后,师兄给了我一些搜狗细胞词库里面的词,初步感觉上不同种类的命名实体有很大区别,有的可能用最后一个词就能识别的很好了,有的实体就能且
仅能靠词典。所以我现在觉得我们应该大概统计一下,针对单独的NE大家都有哪些办法,然后看是否能进行组合什么的,如果耦合性不是很强,那最好了,那不同
的方法就可以拆开然后重组。这样我们就对新的实体类进行测试,看哪种组合最合适,就用哪种。比
如对于甲类实体,命名实体研究者的方法可以分解为手段A、手段B、手段C,而对乙类实体,研究者的方法可以分解为手段D、手段E、手段F,然后我们把它们
都整合在一起,提纯,对于未知的实体,讲A、B、C、D、E、F这几种手段 进行组合,分别对这种实体进行测试,看哪种组合效果最好,就用哪种。
不过如果每种实体用的方法的耦合都很强的话就得换别的思路了,总的来说现在的工作就两方面:
- 看看对于不同的实体都有什么不同的方法。需要看一些论文,综述什么的,找一找感觉。
- 然后多看一些词库,看看能不能看出公共的部分,有没有安全通用的方法。
2013.6.21 - OpenNER第一天的更多相关文章
- 2013.9.3 - OpenNER第十一天
下午接受了天猫某高管的交叉面试,在图书馆电面的,感觉面的不怎么好,他先问了我飞天的情况,还有我做了什么,他感觉和我聊不到一起去,我感觉应该是下午在地下铁喝的那杯咖啡让我慌了神,后来他又问了大数组抽取最 ...
- 2013/11/21工作随笔-PHP开启多进程
今天被问到一个问题,php如何开启多进程才比较稳定. php开启多进程执行一个操作有哪些方法: 首先想到的是使用pcntl的fork 具体可以参考之前的文章:PHP的pcntl多进程 其次想到的方法是 ...
- Kali Linux 1.0 新手折腾笔记(2013.3.21更新)
rootoorotor昨天折腾了 Kali Linux 1.0,把大概的配置过程记录下来,希望对想接触或使用Kali Linux的同学有所帮助. 请注意: 1.本文为面向新手的教程,没技术含量,没事瞎 ...
- 2013.6.29 - OpenNER第九天
上午看计算机网络,下午做计算机实验.晚上写计算机实验报告,还有OpenStack的实验报告. 写完之后跟师兄讨论了一下OpenNER的事情,觉得OpenNE很像是化学物质,里面很多都可以构成原子团,原 ...
- 2013.4.19 - KDD第一天
其实昨天KDD就开始了,不过今天算是我跟KDD的第一天. 昨天夜里就短信跟中秋聊了一会儿,然后中秋说他一天都在弄数据库,连不上怒了.然后我跟他说明天我来.于是今天就在图书馆弄KDD,数据是用数据库 ...
- Cheatsheet: 2013 07.21 ~ 07.31
Mobile Android vs. iOS: Comparing the Development Process of the GQueues Mobile Apps Android Studio ...
- 2013.6.26 - OpenNER第六天
今例会的时候看CRF,突然感觉到ANN模型可能没有问题了,问题出在评价函数,不能接过好就说好,或者说收敛方法有问题,并不是打得对就答得好.还有就是我们应该让他能够根据需要而自己产生问题,问我们,然后我 ...
- 2013.5.21 - KDD第三十三天
实验室例会,上到一半之后发现今天下午第二节课是Android,上次两节Android都没跟中秋碰头,这次又不能碰头了,然 后就赶紧给中秋发了个短信,说我在开会,晚上约个时间再谈.正好也称这一下午加一晚 ...
- MySQL 5.6 复制:GTID 的优点和限制(第一部分)
全局事务标示符(Global Transactions Identifier)是MySQL 5.6复制的一个新特性.它为维护特定的复制拓扑结构下服务器的DBA们大幅度改善他们的工作状况提供了多种可能性 ...
随机推荐
- matlab学习笔记7-定时器
一起来学matlab-matlab学习笔记7-定时器 觉得有用的话,欢迎一起讨论相互学习~Follow Me 参考书籍 <matlab 程序设计与综合应用>张德丰等著 感谢张老师的书籍,让 ...
- 关于C语言中的结构体内嵌函数(转)
https://blog.csdn.net/qq_39490500/article/details/80457831 看门见山 1.内嵌函数定义举例:经过真实测试 在函数中声明定义结构体 #inclu ...
- [LeetCode] 136. Single Number 单独数
Given a non-empty array of integers, every element appears twice except for one. Find that single on ...
- 密码工具:KeePassXC
KeePassXC 开源免费 只支持数据库存放在本地, 跨平台 自动填充 使用浏览器插件时,软件必须启动着 KeePassXC is a community fork of KeePassX, a n ...
- 算法练习之二叉树的最大深度,二叉树的层次遍历 II
1.二叉树的最大深度 给定一个二叉树,找出其最大深度. 二叉树的深度为根节点到最远叶子节点的最长路径上的节点数. 说明: 叶子节点是指没有子节点的节点. 示例:给定二叉树 [3,9,20,null,n ...
- 托马斯·贝叶斯 (Thomas Bayes)
朴素贝叶斯 Day15,开始学习朴素贝叶斯,先了解一下贝爷,以示敬意. 托马斯·贝叶斯 (Thomas Bayes),英国神学家.数学家.数理统计学家和哲学家,1702年出生于英国伦敦,做过神甫: ...
- Jackson 动态Bean
为了解决json字符串有很多属性, 但是不必每个属性都映射到pojo的属性. @JsonProperty : 标记一个方法是一个属性的getter或setter方法, 也即把java属性和json域关 ...
- AttributeError: 'sys.flags' object has no attribute 'utf8_mode'
AttributeError: 'sys.flags' object has no attribute 'utf8_mode' pycharm工程的py版本是3.6,结果即使使用py3.7编译后的py ...
- Python开发【源码剖析】 List对象
前言 本文探讨的Python版本为2.7.16,可从官网上下载,把压缩包Python-2.7.16.tgz解压到本地即可 需要基本C语言的知识(要看的懂) PyListObject对象 PyListO ...
- Mybatis @Many注解一对多关联映射
@Many注解:fetchType属性用于配置是否延迟加载