下午去实验室继续写实验报告,跟伟杰要了一个实验报告,然后大师兄叫我,我们在走廊唠了一会儿。


师兄想做Open
NE,他说这个会比较难,目前没有人做,因为还没有发现相关的文章,大家研究的都是指定了哪种实体之后的识别,这种Open的还不是很成熟,目前的想法就
是挖掘实体结构,然后来确定实体边界。目前想让我在几个现成的实体上试试能不能挖掘出来有效的结构,或者其他有效的方法。

所以今天的任务有这些:

  1. 做实验
  2. 写报告
  3. YY一下OpenNE


上跟家伟吃饭的时候也讨论了一下如果是他,他怎么办,因为他是分析图像的,所以就相当于给几个图片,中间标出主题的轮廓。比如给几个猫的图片和房子的图
片,标出来,然后让他识别车图片和人的图片等其他图片里的内容的轮廓。他说如果是他他会选择强化学习,然后具体怎么样他也没想法。其实和后来在跟师兄讨
论,感觉这个比喻并不恰当。在黑店吃完饭之后我们去实验室楼下一家新开的饮品店喝点咖啡,接到了大师兄的电话,商量了一下最近的情况,因为现在跟少磊坐一
起,所以周一、周二、周三、周日的下午和晚上过来合计合计,尽快拿出个方案。这周六和周日打算做一些自己的调查和分析。然后周一晚上过来跟师兄碰头。


上写完报告之后,师兄给了我一些搜狗细胞词库里面的词,初步感觉上不同种类的命名实体有很大区别,有的可能用最后一个词就能识别的很好了,有的实体就能且
仅能靠词典。所以我现在觉得我们应该大概统计一下,针对单独的NE大家都有哪些办法,然后看是否能进行组合什么的,如果耦合性不是很强,那最好了,那不同
的方法就可以拆开然后重组。这样我们就对新的实体类进行测试,看哪种组合最合适,就用哪种。比
如对于甲类实体,命名实体研究者的方法可以分解为手段A、手段B、手段C,而对乙类实体,研究者的方法可以分解为手段D、手段E、手段F,然后我们把它们
都整合在一起,提纯,对于未知的实体,讲A、B、C、D、E、F这几种手段 进行组合,分别对这种实体进行测试,看哪种组合效果最好,就用哪种。

不过如果每种实体用的方法的耦合都很强的话就得换别的思路了,总的来说现在的工作就两方面:

  1. 看看对于不同的实体都有什么不同的方法。需要看一些论文,综述什么的,找一找感觉。
  2. 然后多看一些词库,看看能不能看出公共的部分,有没有安全通用的方法。

2013.6.21 - OpenNER第一天的更多相关文章

  1. 2013.9.3 - OpenNER第十一天

    下午接受了天猫某高管的交叉面试,在图书馆电面的,感觉面的不怎么好,他先问了我飞天的情况,还有我做了什么,他感觉和我聊不到一起去,我感觉应该是下午在地下铁喝的那杯咖啡让我慌了神,后来他又问了大数组抽取最 ...

  2. 2013/11/21工作随笔-PHP开启多进程

    今天被问到一个问题,php如何开启多进程才比较稳定. php开启多进程执行一个操作有哪些方法: 首先想到的是使用pcntl的fork 具体可以参考之前的文章:PHP的pcntl多进程 其次想到的方法是 ...

  3. Kali Linux 1.0 新手折腾笔记(2013.3.21更新)

    rootoorotor昨天折腾了 Kali Linux 1.0,把大概的配置过程记录下来,希望对想接触或使用Kali Linux的同学有所帮助. 请注意: 1.本文为面向新手的教程,没技术含量,没事瞎 ...

  4. 2013.6.29 - OpenNER第九天

    上午看计算机网络,下午做计算机实验.晚上写计算机实验报告,还有OpenStack的实验报告. 写完之后跟师兄讨论了一下OpenNER的事情,觉得OpenNE很像是化学物质,里面很多都可以构成原子团,原 ...

  5. 2013.4.19 - KDD第一天

    其实昨天KDD就开始了,不过今天算是我跟KDD的第一天.   昨天夜里就短信跟中秋聊了一会儿,然后中秋说他一天都在弄数据库,连不上怒了.然后我跟他说明天我来.于是今天就在图书馆弄KDD,数据是用数据库 ...

  6. Cheatsheet: 2013 07.21 ~ 07.31

    Mobile Android vs. iOS: Comparing the Development Process of the GQueues Mobile Apps Android Studio ...

  7. 2013.6.26 - OpenNER第六天

    今例会的时候看CRF,突然感觉到ANN模型可能没有问题了,问题出在评价函数,不能接过好就说好,或者说收敛方法有问题,并不是打得对就答得好.还有就是我们应该让他能够根据需要而自己产生问题,问我们,然后我 ...

  8. 2013.5.21 - KDD第三十三天

    实验室例会,上到一半之后发现今天下午第二节课是Android,上次两节Android都没跟中秋碰头,这次又不能碰头了,然 后就赶紧给中秋发了个短信,说我在开会,晚上约个时间再谈.正好也称这一下午加一晚 ...

  9. MySQL 5.6 复制:GTID 的优点和限制(第一部分)

    全局事务标示符(Global Transactions Identifier)是MySQL 5.6复制的一个新特性.它为维护特定的复制拓扑结构下服务器的DBA们大幅度改善他们的工作状况提供了多种可能性 ...

随机推荐

  1. 【Python学习之七】类和对象

    环境 虚拟机:VMware 10 Linux版本:CentOS-6.5-x86_64 客户端:Xshell4 FTP:Xftp4 python3.6 一.面向对象编程1.概念(1)面向对象编程(OOP ...

  2. Unreal Engine 4 中的 UI 优化技巧

    转自:https://mp.weixin.qq.com/s/bybEHM9tF-jBPxxqXfrPOQ## Unreal Open Day 2017 活动上 Epic Games 开发者支持工程师郭 ...

  3. LVS的基础使用

    LVS的基础使用 LVS的介绍 A:什么是LVS B:cluster(集群的概念) C:LVS的介绍 LVS的使用 A:ipvsadm命令的使用 ♣一:LVS的介绍 A:什么是lvs LVS的英文全称 ...

  4. HDU6608-Fansblog(Miller_Rabbin素数判定,威尔逊定理应用,乘法逆元)

    Problem Description Farmer John keeps a website called ‘FansBlog’ .Everyday , there are many people ...

  5. Java字符串无意识的递归

    Java中的每个类基本上都继承自Object,标准容器类自然也不例外.因此容器类都有toString()方法,并且重写了该方法,使得它生成的String结果能够表达容器本身,以及容器所包含的对象.例如 ...

  6. [转帖]IOC Security: Indicators of Attack vs. Indicators of Compromise

    IOC Security: Indicators of Attack vs. Indicators of Compromise https://www.crowdstrike.com/blog/ind ...

  7. postman接口测试-参数化-测试数据Text文本

    全局变量参数化 在环境变量里面设置好参数,比如url=http://www.baidu.com 某一类型的BaseUrl全部都是www.baidu.com,参数化之后倘若哪天URL变更之后,改一个环境 ...

  8. 24 枚举Enum类

    引用声明:部分内容来自文章:http://c.biancheng.net/view/1100.html 枚举Enum类是java.lang下的一个类. 枚举的命名规范 枚举名:大驼峰 枚举值:全大写, ...

  9. linux系统调整磁盘分区

    xfs分区格式调整分区大小 调整前备份: mkdir /tmp/home cp -r /home/* /tmp/home/ umount /home 卸载时报错有占用 fuser -m -v -i - ...

  10. werkzeug.routing.BuildError: Could not build url for endpoint 'index'. Did you mean 'user.index' instead?

    werkzeug.routing.BuildError: Could not build url for endpoint 'index'. Did you mean 'user.index' ins ...