Spark源码分析

ExecutorBackend

很简单的接口

package org.apache.spark.executor

/**

 * A pluggable interface used by the Executor to send updates to the cluster scheduler.

 */

private[spark] trait ExecutorBackend {

  def statusUpdate(taskId: Long, state: TaskState, data: ByteBuffer)

}

StandaloneExecutorBackend

维护executor, 并负责注册executor以及executor和driver之间的通信

private[spark] class StandaloneExecutorBackend(

    driverUrl: String,

    executorId: String,

    hostPort: String,

    cores: Int)

  extends Actor

  with ExecutorBackend

  with Logging {

  var executor: Executor = null

  var driver: ActorRef = null

  override def preStart() {

    logInfo("Connecting to driver: " + driverUrl)

    driver = context.actorFor(driverUrl) // 创建driver actor ref, 以便于和driver通信

    driver ! RegisterExecutor(executorId, hostPort, cores) // 向driver注册executor

  }

  override def receive = {

    case RegisteredExecutor(sparkProperties) =>

      logInfo("Successfully registered with driver")

      // Make this host instead of hostPort ?

      executor = new Executor(executorId, Utils.parseHostPort(hostPort)._1, sparkProperties) // 当注册成功后, 创建Executor

    case RegisterExecutorFailed(message) =>

      logError("Slave registration failed: " + message)

      System.exit(1)

    case LaunchTask(taskDesc) =>

      logInfo("Got assigned task " + taskDesc.taskId)

      if (executor == null) {

        logError("Received launchTask but executor was null")

        System.exit(1)

      } else {

        executor.launchTask(this, taskDesc.taskId, taskDesc.serializedTask) // 调用executor.launchTask,启动task

      }

    case Terminated(_) | RemoteClientDisconnected(_, _) | RemoteClientShutdown(_, _) =>

      logError("Driver terminated or disconnected! Shutting down.")

      System.exit(1)

  }

  override def statusUpdate(taskId: Long, state: TaskState, data: ByteBuffer) {

    driver ! StatusUpdate(executorId, taskId, state, data) // 当task状态变化时, 报告给driver actor

  }

}

Executor

对于Executor, 维护一个threadPool, 可以run多个task, 取决于core的个数

所以对于launchTask, 就是在threadPool中挑个thread去run TaskRunner

private[spark] class Executor(

    executorId: String,

    slaveHostname: String,

    properties: Seq[(String, String)])

  extends Logging

{

  // Initialize Spark environment (using system properties read above)

  val env = SparkEnv.createFromSystemProperties(executorId, slaveHostname, 0, false, false)

  SparkEnv.set(env)

  // Start worker thread pool

  val threadPool = new ThreadPoolExecutor(

    1, 128, 600, TimeUnit.SECONDS, new SynchronousQueue[Runnable])

  def launchTask(context: ExecutorBackend, taskId: Long, serializedTask: ByteBuffer) {

    threadPool.execute(new TaskRunner(context, taskId, serializedTask))

  }

TaskRunner

  class TaskRunner(context: ExecutorBackend, taskId: Long, serializedTask: ByteBuffer)

    extends Runnable {

    override def run() {

      try {

        SparkEnv.set(env)

        Accumulators.clear()

        val (taskFiles, taskJars, taskBytes) = Task.deserializeWithDependencies(serializedTask) // 反序列化

        updateDependencies(taskFiles, taskJars)

        val task = ser.deserialize[Task[Any]](taskBytes, Thread.currentThread.getContextClassLoader) // 反序列化

        attemptedTask = Some(task)

        logInfo("Its epoch is " + task.epoch)

        env.mapOutputTracker.updateEpoch(task.epoch)

        taskStart = System.currentTimeMillis()

        val value = task.run(taskId.toInt)  // 调用task.run执行真正的逻辑

        val taskFinish = System.currentTimeMillis()

        val accumUpdates = Accumulators.values

        val result = new TaskResult(value, accumUpdates, task.metrics.getOrElse(null)) // 生成TaskResult

        val serializedResult = ser.serialize(result) // 将TaskResult序列化

        logInfo("Serialized size of result for " + taskId + " is " + serializedResult.limit)

        context.statusUpdate(taskId, TaskState.FINISHED, serializedResult) // 将任务完成和taskresult,通过statusUpdate报告给driver

        logInfo("Finished task ID " + taskId)

      } catch { // 处理各种fail, 同样也要用statusUpdate event通知driver

        case ffe: FetchFailedException => {

          val reason = ffe.toTaskEndReason

          context.statusUpdate(taskId, TaskState.FAILED, ser.serialize(reason))

        }

        case t: Throwable => {

          val serviceTime = (System.currentTimeMillis() - taskStart).toInt

          val metrics = attemptedTask.flatMap(t => t.metrics)

          for (m <- metrics) {

            m.executorRunTime = serviceTime

            m.jvmGCTime = getTotalGCTime - startGCTime

          }

          val reason = ExceptionFailure(t.getClass.getName, t.toString, t.getStackTrace, metrics)

          context.statusUpdate(taskId, TaskState.FAILED, ser.serialize(reason))

          // TODO: Should we exit the whole executor here? On the one hand, the failed task may

          // have left some weird state around depending on when the exception was thrown, but on

          // the other hand, maybe we could detect that when future tasks fail and exit then.

          logError("Exception in task ID " + taskId, t)

          //System.exit(1)

        }

      }

    }

  }

Spark源码分析 – Executor的更多相关文章

Spark源码分析 – 汇总索引
http://jerryshao.me/categories.html#architecture-ref http://blog.csdn.net/pelick/article/details/172 ...
Spark源码分析（三）-TaskScheduler创建
原创文章,转载请注明: 转载自http://www.cnblogs.com/tovin/p/3879151.html 在SparkContext创建过程中会调用createTaskScheduler函 ...
【转】Spark源码分析之-deploy模块
原文地址:http://jerryshao.me/architecture/2013/04/30/Spark%E6%BA%90%E7%A0%81%E5%88%86%E6%9E%90%E4%B9%8B- ...
Spark源码分析：多种部署方式之间的区别与联系（转）
原文链接:Spark源码分析:多种部署方式之间的区别与联系(1) 从官方的文档我们可以知道,Spark的部署方式有很多种:local.Standalone.Mesos.YARN.....不同部署方式的 ...
Spark 源码分析 -- task实际执行过程
Spark源码分析 – SparkContext 中的例子, 只分析到sc.runJob 那么最终是怎么执行的? 通过DAGScheduler切分成Stage, 封装成taskset, 提交给Task ...
Spark源码分析 – BlockManager
参考, Spark源码分析之-Storage模块对于storage, 为何Spark需要storage模块?为了cache RDD Spark的特点就是可以将RDD cache在memory或dis ...
Spark源码分析 -- TaskScheduler
Spark在设计上将DAGScheduler和TaskScheduler完全解耦合, 所以在资源管理和task调度上可以有更多的方案现在支持, LocalSheduler, ClusterSched ...
Spark源码分析 – SchedulerBackend
SchedulerBackend, 两个任务, 申请资源和task执行和管理对于SparkDeploySchedulerBackend, 基于actor模式, 主要就是启动和管理两个actor De ...
Spark源码分析 – Deploy
参考, Spark源码分析之-deploy模块 Client Client在SparkDeploySchedulerBackend被start的时候, 被创建, 代表一个application和s ...

随机推荐

CGPathCreateMutable
ios 图形与动画学习笔记构造路径(CGPathCreateMutable) 一系列点放在一起,构成了一个形状.一系列的形状放在一起,构成了一个路径. /* 路径属于我们正在绘制他们的上下文.路 ...
mysql5.5和5.6版本间的坑
mysql 5.5 int类型设置不为null,无填充,添加新数据会自动填充0 而5.6同样的配置新建数据没值时,不让添加 5.5 datetime 不能设置默认时间(可以通过某些复杂的方式,这里说 ...
chrome 控制台js调试与断点调试
这篇文章是根据目前 chrome 稳定版(19.0.1084.52 m)写的,因为 google 也在不断完善chrome developer tool,所以 chrome 版本不同可能稍有差 ...
Groovy学习专栏
今天新开了一个groovy的学习专栏,因为最近工作中会用到Groovy模板. 然后就是在网上找了一下Groovy模板相关的东西发现ibm中在2005年就有讲到这个的,我勒个去,这么早,我初中都还没毕业 ...
PHP——修改数据库2-加提示框，加登录页面
登录页面:0127lianxi.php <body> <h1>登陆</h1> <form action="0127lianxi.php" ...
Redis-stat is not found
$ruby -v ruby 2.1.3p242 (2014-09-19 revision 47630) [x86_64-linux] $gem -v 2.2.2 $which ruby /usr/lo ...
Android Studio 编写 JNI
之前一直都不知怎么编写JNI,今天刚好学习一下,感谢梦真的指教,以及提供的文档. 参考链接 http://blog.csdn.net/u011168565/article/details/518781 ...
多媒体开发之rtp 打包发流--- 从h264中获取分辨率
http://blog.csdn.net/DiegoTJ/article/details/5541877 http://www.cnblogs.com/lidabo/p/4482684.html 分辨 ...
php -- 文件操作类（文件或文件夹的：创建、删除、复制、移动）
<? /** * 操纵文件类 * * 例子: * FileUtil::createDir('a/1/2/3'); 测试建立文件夹建一个a/1/2/3文件夹 * FileUtil::create ...
【vijos】1164 曹冲养猪（中国剩余定理）
https://vijos.org/p/1164 好赞orz. 对于求一组线性同余方程 x=a[i](mod m[i]) 这里任意两个m[i]和m[j]都互质那么可以用中国剩余定理来做. 对中国剩余 ...

Spark源码分析 – Executor

ExecutorBackend

StandaloneExecutorBackend

Executor

Spark源码分析 – Executor的更多相关文章

随机推荐

热门专题