http://blog.csdn.net/joey_su/article/details/17289621

官方下载地址

http://www.nltk.org/nltk_data/

把python自然语言处理的nltk_data打包到360云盘,然后共享给朋友们

回家前,把Python自然语言处理的nltk_data打包到360云盘,然后共享给朋友们,省的大家像我一样浪费时间。

一次性下载解压后即可使用。官方的nltk.download()老是下载失败。无数遍了。浪费了我很多很多时间。

打包下载(推荐):

http://l3.yunpan.cn/lk/QvLSuskVd6vCU?sid=305

下载后放在python/nltk_data目录下即可.

记录下错误提示,以便于朋友们搜索找到。

当时遇到的错误是:

nltk.download()

could not find maxent_treebank_pos_tagger / english .XXX

searched index:

C:\\Python27\\nltk_data\

C:\\nltk_data

D:\\nltk_data

E:\\nltk_data

然后我通过,nltk.download()下载,一直出现错误,只好到

官方下载http://nltk.org/nltk_data/

另外,也可以到nltk.code.google.com 下载,

但是又遇到了下载后,直接放在nltk_data目录,却发现还是不行,程序找不到数据集。

因此我就用nltk.download()试着下载了一个,观察他的文件位置,这才发现原来有好几个文档目录。

用tree命令的到其目录结构如下:

文件夹 PATH 列表

卷序列号为 00000200 B2F8:ED9D

├─chunkers #这一级为nltk_data下的文件夹

│ └─maxent_ne_chunker #这一级为相对应文件夹下的数据文件

├─corpora      #这一级为nltk_data下的文件夹

│ ├─abc        #这一级为相对应文件夹下的数据文件

│ ├─alpino

│ ├─basque_grammars

│ ├─biocreative_ppi

│ ├─book_grammars

│ ├─brown

│ ├─brown_tei

│ ├─cess_cat

│ ├─cess_esp

│ ├─chat80

│ ├─city_database

│ ├─cmudict

│ ├─comtrans

│ ├─conll2000

│ ├─conll2002

│ ├─conll2007

│ ├─dependency_treebank

│ ├─europarl_raw

│ │ 

│ ├─floresta

│ ├─gazetteers

│ ├─genesis

│ ├─gutenberg

│ ├─hmm_treebank_pos_tagger

│ ├─ieer

│ ├─inaugural

│ ├─indian

│ ├─jeita

│ ├─kimmo

│ ├─knbc

│ │ 

│ ├─langid

│ ├─large_grammars

│ ├─machado

│ │ 

│ ├─mac_morpho

│ ├─maxent_ne_chunker

│ ├─maxent_treebank_pos_tagger

│ ├─movie_reviews

│ │ 

│ ├─names

│ ├─nombank.1.0

│ │ 

│ ├─nps_chat

│ ├─oanc_masc

│ │ 

│ ├─paradigms

│ ├─pe08

│ ├─pil

│ ├─pl196x

│ ├─ppattach

│ ├─problem_reports

│ ├─propbank

│ │ 

│ ├─ptb

│ ├─punkt

│ ├─qc

│ ├─reuters

│ │ 

│ ├─rslp

│ ├─rte

│ ├─sample_grammars

│ ├─semcor

│ │ 

│ ├─senseval

│ ├─shakespeare

│ ├─sinica_treebank

│ ├─smultron

│ ├─spanish_grammars

│ ├─state_union

│ ├─stopwords

│ ├─swadesh

│ ├─switchboard

│ ├─tagsets

│ ├─timit

│ │

│ ├─toolbox

│ │ 

│ ├─treebank

│ │ 

│ ├─udhr

│ ├─udhr2

│ ├─unicode_samples

│ ├─verbnet

│ ├─webtext

│ ├─wordnet

│ ├─wordnet_ic

│ ├─words

│ └─ycoe

├─grammars

│ ├─basque_grammars

│ ├─book_grammars

│ ├─large_grammars

│ ├─sample_grammars

│ └─spanish_grammars

├─help

│ └─tagsets

├─stemmers

│ └─rslp

├─taggers

│ ├─hmm_treebank_pos_tagger

│ ├─maxent_ne_chunker

│ └─maxent_treebank_pos_tagger

└─tokenizers

└─punkt

nltk.download()出错解决的更多相关文章

  1. ARM64平台编译stream、netperf出错解决办法 解决办法:指定编译平台为alpha [root@localhost netperf-2.6.0]# ./configure –build=alpha

    ARM64平台编译stream.netperf出错解决办法 http://ilinuxkernel.com/?p=1738 stream编译出错信息: [root@localhost stream]# ...

  2. make menuconfig出错解决方法

     make menuconfig出错解决方法 2011-06-11 22:22:49 分类: 系统运维 错误现象: make menuconfig In file included from scri ...

  3. vs连接mysql出错解决方法

    vs连接mysql出错解决方法 先按以下的步骤配置一下: **- (1)打开VC6.0 工具栏Tools菜单下的Options选项.在Directories的标签页中右边的"Show dir ...

  4. paip.vs2010 或.net 4.0安装出错解决大法.

    paip.vs2010 或.net 4.0安装出错解决大法. 作者Attilax ,  EMAIL:1466519819@qq.com  来源:attilax的专栏 地址:http://blog.cs ...

  5. nltk download失败

    之前在台式机win10的系统,python 2.7,用的pycharm执行nltk download(),很顺利.然而到了我的笔记本只是换个一个win8的系统,Python的配置都是一样的,但是这时候 ...

  6. 黄聪:C#使用Application.Restart重启程序出错解决办法

    调用 Application.Restart重启程序出错 解决办法,就是给程序的.exe文件,加上下面的设置

  7. $ sudo python -m pip install pylint 出错解决方法

    问题:在unbuntu执行$ sudo python -m pip install pylint出错解决方法支行以下命令sudo pip install pylint==1.9.3这样roboware ...

  8. linux下python3离线加载nltk_data,不用nltk.download()

    在不能上网的服务器上把nltk_data关联到python3,已经安装anaconda3所以不需要安装nltk,环境是linux 首先没有nltk_data在使用nltk会报错 LookupError ...

  9. npm中npm install 始终出错解决办法

    npm中npm install 始终出错解决办法 错误信息: C:\Windows\System32>npm install -g gulp npm ERR! Windows_NT 6.1.76 ...

随机推荐

  1. yii2权限控制rbac之菜单menu最详细教程

    前面我们在博文 yii2搭建完美后台并实现rbac权限控制实例教程中完美实现了yii2的后台搭建和rbac权限控制,如果你还没有实现,请先看上文再回来参考本文,因为本文是在上文的基础上进行完善和补充. ...

  2. JS日历制作获取时间

    1.直接获取 var myDate = new Date(); myDate.getYear(); 获取当前年份(2位) myDate.getFullYear(); 获取完整的年份(4位,1970-? ...

  3. android 调用电话功能

    今天用到了打电话的功能,这要如何实现呢? 很简单 1.创建对应对的xml展示页面喝java文件 2.在manifest中添加权限 下面上代码吧: 这是布局的一部分 <LinearLayout a ...

  4. linux基础-第六单元 用户、群组和权限

    用户及passwd文件 /etc/passwd文件的功能 /etc/passwd文件每个字段的具体含义 shadow文件 /etc/shadow文件的功能 /etc/shadow文件每个字段的具体含义 ...

  5. 由 excel 转换为 markdown,及收获

    由 excel 转换为 markdown,及收获 1 问题 构建之法(现代软件工程)东北师大站[http://www.cnblogs.com/younggift/]的每周学生作业成绩,执行教学团队[h ...

  6. git flow的使用

    简介 Gitflow工作流程围绕项目发布定义了严格的分支模型.尽管它比Feature Branch Workflow更复杂一些,但它也为管理更大规模的项目提供了坚实的框架. 与Feature Bran ...

  7. KVM 内存虚拟化

    内存虚拟化的概念     除了 CPU 虚拟化,另一个关键是内存虚拟化,通过内存虚拟化共享物理系统内存,动态分配给虚拟机.虚拟机的内存虚拟化很象现在的操作系统支持的虚拟内存方式,应用程序看到邻近的内存 ...

  8. linux 配置java 环境

    下载jdk 并解压到 /usr/local/java/ 目录下 地址:http://www.oracle.com/technetwork/java/javase/downloads/jdk8-down ...

  9. JSP 中的 tag 文件

    在jsp文件中,可以引用 tag 和tld 文件,本文主要针对 tag 对于tag 文件 1)将此类文件放在 WEB-INF 下,比如 /WEB-INF/tags,tags 是目录,其下可以有多个.t ...

  10. 问题-栈S最多能容纳4个元素,现有6个元素按A、B、C、D、E、F顺序进栈,问可能的出栈顺序。

    住栈的特性:对于取出栈内元素每次只能从栈顶开始取(后进先出(栈满时,只能先出后进)) 由于栈内只能容纳4个元素: 所以 E F不可能第一个出栈: 当栈内少于四个元素时 既可以选择进栈,也可以选择出栈 ...