Zeppelin的入门使用系列之创建新的Notebook(一)
不多说,直接上干货!
前期博客
hadoop-2.6.0.tar.gz + spark-1.6.1-bin-hadoop2.6.tgz + zeppelin-0.5.6-incubating-bin-all.tgz(master、slave1和slave2)(博主推荐)(图文详解)
hadoop-2.7.3.tar.gz + spark-2.0.2-bin-hadoop2.7.tgz + zeppelin-0.6.2-incubating-bin-all.tgz(master、slave1和slave2)(博主推荐)(图文详解)
测试
配置Spark解释器

创建Note

运行官网的例子:

然后我们点Notebook->Zeppelin Tutorial
然后点击save
然后在最上面的部分点击如下图所示的位置:

运行结果在截取两张图给大家:


最后一个要注意的是,这是我自己摸索着搞得,有问题发生是正常的,所以标题加上了初探两个字!
ml-100k推荐数据集的下载
官网
https://grouplens.org/datasets/movielens/

因为,这里,考虑到测试入门而已。只要跑通,数据量大小其次。所以,选择下载ml-100k。


[hadoop@master data]$ pwd
/home/hadoop/data
[hadoop@master data]$ ll
total
drwxrwxr-x hadoop hadoop Apr : es
drwxrwxr-x hadoop hadoop Apr : flume
drwxrwxr-x hadoop hadoop May : jar
drwxrwxr-x hadoop hadoop Jul : storm
drwxrwxr-x. hadoop hadoop Apr : tmp
drwxrwxr-x. hadoop hadoop Apr : zookeeper
[hadoop@master data]$ mkdir zeppelin
[hadoop@master data]$ ll
total
drwxrwxr-x hadoop hadoop Apr : es
drwxrwxr-x hadoop hadoop Apr : flume
drwxrwxr-x hadoop hadoop May : jar
drwxrwxr-x hadoop hadoop Jul : storm
drwxrwxr-x. hadoop hadoop Apr : tmp
drwxrwxr-x hadoop hadoop Sep : zeppelin
drwxrwxr-x. hadoop hadoop Apr : zookeeper
[hadoop@master data]$

[hadoop@master zeppelin]$ pwd
/home/hadoop/data/zeppelin
[hadoop@master zeppelin]$ ll
total
[hadoop@master zeppelin]$ wget http://files.grouplens.org/datasets/movielens/ml-100k.zip
---- ::-- http://files.grouplens.org/datasets/movielens/ml-100k.zip
Resolving files.grouplens.org... 128.101.34.235
Connecting to files.grouplens.org|128.101.34.235|:... connected.
HTTP request sent, awaiting response... OK
Length: (4.7M) [application/zip]
Saving to: “ml-100k.zip” %[=====================================================================================================================================================>] ,, 238K/s in 19s -- :: ( KB/s) - “ml-100k.zip” saved [/] [hadoop@master zeppelin]$ ll
total
-rw-rw-r-- hadoop hadoop Jan ml-100k.zip
[hadoop@master zeppelin]$


创建完成后就可以看到ml-100k页面,单击Zeppelin可以回到首页。

回到Zeppelin首页,就可以看到如下图的页面。


或者

http://192.168.80.145:8099/#/

Zeppelin的入门使用系列之创建新的Notebook(一)的更多相关文章
- Zeppelin的入门使用系列之创建新的Notebook
前期博客 hadoop-2.6.0.tar.gz + spark-1.6.1-bin-hadoop2.6.tgz + zeppelin-0.5.6-incubating-bin-all.tgz(mas ...
- Zeppelin的入门使用系列之使用Zeppelin运行shell命令(二)
不多说,直接上干货! 前期博客 Zeppelin的入门使用系列之创建新的Notebook(一) 接下来,我将以ml-100k数据集,示范如何使用Spark SQL进行数据分析与数据可视化 因为 [ha ...
- Zeppelin的入门使用系列之使用Zeppelin来创建临时表UserTable(三)
不多说,直接上干货! 前期博客 Zeppelin的入门使用系列之使用Zeppelin运行shell命令(二) 我们必须要先使用Spark 语句创建临时表UserTable,后续才能使用Spark SQ ...
- Zeppelin的入门使用系列之使用Zeppelin来运行Spark SQL(四)
不多说,直接上干货! 前期博客 Zeppelin的入门使用系列之使用Zeppelin来创建临时表UserTable(三) 1. 运行年龄统计的Spark SQL (1) 输入Spark SQL时,必 ...
- Windows Azure入门教学系列 (一): 创建第一个WebRole程序
原文 Windows Azure入门教学系列 (一): 创建第一个WebRole程序 在第一篇教学中,我们将学习如何在Visual Studio 2008 SP1中创建一个WebRole程序(C#语言 ...
- WPF入门教程系列(一) 创建你的第一个WPF项目
WPF入门教程系列(一) 创建你的第一个WPF项目 WPF基础知识 快速学习绝不是从零学起的,良好的基础是快速入手的关键,下面先为大家摞列以下自己总结的学习WPF的几点基础知识: 1) C#基础语法知 ...
- Windows Azure中文博客 Windows Azure入门教学系列 (一): 创建第一个WebRole程序
http://blogs.msdn.com/b/azchina/ 本文转自:http://blogs.msdn.com/b/azchina/archive/2010/02/09/windows-azu ...
- Lucene.net入门学习系列(1)
Lucene.net入门学习系列(1) Lucene.net入门学习系列(1)-分词 Lucene.net入门学习系列(2)-创建索引 Lucene.net入门学习系列(3)-全文检索 这几天在公 ...
- Lucene.net入门学习系列(2)
Lucene.net入门学习系列(2) Lucene.net入门学习系列(1)-分词 Lucene.net入门学习系列(2)-创建索引 Lucene.net入门学习系列(3)-全文检索 在使用Luce ...
随机推荐
- 分布式文件存储——GlusterFS
一.概论 1.简介 GlusterFS (Gluster File System) 是一个开源的分布式文件系统,主要由 Z RESEARCH 公司负责开发. GlusterFS 是 Scale-Out ...
- python读取文件存到excel中
用xlwt模块执行代码报下面的错 ValueError: column index (256) not an int in range(256) xlwt 模块看源码说最大列只支持255列,所以超过这 ...
- LeetCode:移除K位数字【402】
LeetCode:移除K位数字[402] 题目描述 给定一个以字符串表示的非负整数 num,移除这个数中的 k 位数字,使得剩下的数字最小. 注意: num 的长度小于 10002 且 ≥ k. nu ...
- ubuntu 16.04 jenkins pipline的实现 最终docker启动服务
准备工作:两台虚拟机A:192.168.1.60 B:192.168.1.61 C:一个存放代码的代码库(github)A:jenkins git docker openssh-server(ssh) ...
- 【转载】xtrabackup原理及实施
转载于:http://www.baidu-ops.com/2013/05/26/xtrabackup/ xtrabackup是基于InnoDB存储引擎灾难恢复的.它复制InnoDB的数据文件,尽管数据 ...
- 多图切换jQuery图片滑块插件
在线演示 本地下载
- django配置文件环境分离后celery的启动方式整理
django项目中,当配置文件分离时: 启动方式1: 硬编码写死在manage.py中: os.environ.setdefault("DJANGO_SETTINGS_MODULE" ...
- <再看TCP/IP第一卷>关于网络层及协议细节---IP协议(2)--移动IP及DHCP
题外话:本来想按照互联网的层级自下向上回顾这些协议的,但是今天实在得破个例,DHCP不得不说! 主机从一个网络迁移到另一个网络,那么IP编址的结构就要发生改变,当今主流有如下几种修改方案: (一)改变 ...
- 算法(Algorithms)第4版 练习 2.1.24
代码实现: package com.qiusongde; import edu.princeton.cs.algs4.In; import edu.princeton.cs.algs4.StdOut; ...
- 使用JobControl控制MapReduce任务
代码结构 BeanWritable:往数据库读写使用的bean ControlJobTest:JobControl任务控制 DBInputFormatApp:将关系型数据库的数据导入HDFS,其中包含 ...