1. Spark1.0.0 应用程序部署工具spark-submit

2. Spark Streaming的编程模型

3. 使用java api操作HDFS文件

4. 用SBT编译Spark的WordCount程序

5. 在Spark上运行TopK程序

6. 在Spark上运行WordCount程序

7. Spark一个简单案例

8. Spark源码分析

9. Spark SQL

10. HDFS常用命令

11. Spark SQL之调优

12. Spark调优

13. Spark学习视频整合

14. HDFS命令行工具

15. MapReduce调度器

16. 在Spark程序中使用压缩

17. Spark集群基于Zookeeper的HA搭建部署笔记(转)

18. 使用 Kafka 和 Spark Streaming 构建实时数据处理系统(转)

19. spark streaming 接收 kafka 数据java代码WordCount示例

20. Spark+Kafka的Direct方式将偏移量发送到Zookeeper实现(转)

21. 使用Spark读写CSV格式文件(转)

22. 在Spark中尽量少使用GroupByKey函数(转)

23. Spark应用程序运行的日志存在哪里(转)

24. Spark Streaming性能调优详解(转)

25. 在Spark中自定义Kryo序列化输入输出API(转)

26. Spark Streaming中空batches处理的两种方法(转)

27. 【采集层】Kafka 与 Flume 如何选择(转)

28. Spark RDD API扩展开发

29. Storm和Spark Streaming框架对比(转)

30. Spark源码分析:多种部署方式之间的区别与联系(转)

31. Spark入门实战系列--6.SparkSQL(上)--SparkSQL简介

32.  sparkSQL1.1入门之一:为什么sparkSQL

33. Spark Streaming:大规模流式数据处理的新贵(转)

34. HBase系统架构及数据结构(转)

35. 错误Name node is in safe mode的解决方法 (转)

36. flume学习(三):flume将log4j日志数据写入到hdfs(转)

37. Spark中加载本地(或者hdfs)文件以及SparkContext实例的textFile使用

38. Spark从HDFS上读取JSON数据

39. Spark向HDFS中存储数据

40. Spark GraphX图处理编程实例

41. GraphX中Pregel单源点最短路径(转)

Spark亚太研究院系列丛书——Spark实战高手之路 从零开始_读书频道_51CTO.COM_领先的中文IT技术网站
http://book.51cto.com/art/201408/448416.htm

Spark目录的更多相关文章

  1. Spark运行模式与Standalone模式部署

    上节中简单的介绍了Spark的一些概念还有Spark生态圈的一些情况,这里主要是介绍Spark运行模式与Spark Standalone模式的部署: Spark运行模式 在Spark中存在着多种运行模 ...

  2. Spark on YARN的部署

    Spark on YARN的原理就是依靠yarn来调度Spark,比默认的Spark运行模式性能要好的多,前提是首先部署好hadoop HDFS并且运行在yarn上,然后就可以开始部署spark on ...

  3. Spark快速入门 - Spark 1.6.0

    Spark快速入门 - Spark 1.6.0 转载请注明出处:http://www.cnblogs.com/BYRans/ 快速入门(Quick Start) 本文简单介绍了Spark的使用方式.首 ...

  4. 在 Azure HDInsight 中安装和使用 Spark

    Spark本身用Scala语言编写,运行于Java虚拟机(JVM).只要在安装了Java 6以上版本的便携式计算机或者集群上都可以运行spark.如果您想使用Python API需要安装Python解 ...

  5. Mac 配置Spark环境scala+python版本(Spark1.6.0)

    1. 从官网下载Spark安装包,解压到自己的安装目录下(默认已经安装好JDK,JDK安装可自行查找): spark官网:http://spark.apache.org/downloads.html ...

  6. 使用sbt构建spark 程序

    今日在学习scala和spark相关的知识.之前在eclipse下编写了wordcount程序.但是关于导出jar包这块还是很困惑.于是学习sbt构建scala. 关于sbt的介绍网上有很多的资料,这 ...

  7. Windows下Spark单机环境配置

    1. 环境配置 a)  java环境配置: JDK版本为1.7,64位: 环境变量配置如下: JAVA_HOME为JDK安装路径,例如D:\software\workSoftware\JAVA 在pa ...

  8. spark on centos6.5 安装

    第一步在centos 6.5上安装java 运行环境 http://www.oracle.com/technetwork/java/javase/downloads/jdk7-downloads-18 ...

  9. Spark:利用Eclipse构建Spark集成开发环境

    前一篇文章“Apache Spark学习:将Spark部署到Hadoop 2.2.0上”介绍了如何使用Maven编译生成可直接运行在Hadoop 2.2.0上的Spark jar包,而本文则在此基础上 ...

随机推荐

  1. 通过VMware Tools 将主机windows的目录共享给linux虚拟机

    之前有写过 本地虚拟机挂载windows共享目录搭建开发环境 这篇,里面讲通过使用samba来实现网络共享 最近发现其实完全不用这么麻烦,VMware tools就可以帮助我们轻松的共享文件夹 这里引 ...

  2. geeksforgeeks@ Largest Number formed from an Array

    http://www.practice.geeksforgeeks.org/problem-page.php?pid=380 Largest Number formed from an Array G ...

  3. INTEL XDK 真机调试

    需要安装 1.google服务框架 2.google play 3.app preview

  4. gradle gradlew 的使用

    jcenter() 仓库比 mavenCentral() 仓库快,因此最好将jcenter 放前面,这样下载速度最快. 使用本地软件仓库:repositories { flatDir { dirs ' ...

  5. how to javafx hide background header of a tableview?

    http://stackoverflow.com/questions/12324464/how-to-javafx-hide-background-header-of-a-tableview ———— ...

  6. AutoCAD DxfCode组码值说明

    值 说明 -5 APP:永久反应器链 -4 APP:条件运算符(仅与 ssget 一起使用) -3 APP:扩展数据 (XDATA) 标记(固定) -2 APP:图元名参照(固定) -1 APP:图元 ...

  7. lambda表达式和ef的语句转化

    这两者转化可以用linqpad进行转化, 首先推荐一个网站可以了解一下orderby的排序方式 http://www.csharpwin.com/csharpspace/614.shtml 然后下面有 ...

  8. HDU2553N皇后问题(状态压缩)

    这道题其实最简单的方法就是打表,直接DFS会超时,那就先运行一遍,找出1~10的值,打表即可,这里提供DFS和打表的数据 DFS:(白书上的)TLE #include <stdio.h> ...

  9. URAL 2068 Game of Nuts (博弈)

    题意:给定 n 堆石子,每次一个人把它们分成三堆都是奇数的,谁先不能分,谁输. 析:因为每堆都是奇数,那么最后肯定都是要分成1的,那么就把不是1的全加和,然后判断奇偶就OK了. 代码如下: #prag ...

  10. Objc基础学习记录3

    在学习Objective-c中, 数组 1.NSArray, 这是一个不可变的数组,不能修改和删除其中的对象,可以存储任意objective的对象指针. 不能存储int,char类型的,,需要转换为需 ...