CELF算法原理

影响力传播模型中的独立层叠模型（independent cascading model，IC模型），影响力传播过程中，种子的影响力具备子模性（submodularity），即种子的边际影响力增量会呈现递减趋势，CELF算法（Cost-effective Lazy-forward）利用这个发现改进了Kempe&Kleinberg的原始的Greedy算法，使得算法的速度大幅提升。下面说说具体是怎么回事。

原始的Greedy算法：

input:图G={V,E}，种子集合Seeds=空集,种子数量K

output:种子集合Seeds={K个影响力最大的种子}

step 1:在Seeds为空的条件下，一次算出G中每个节点V的边际影响力Δinfs【节点n的Δinfs=（n加入当前种子集Seeds后形成的新种子集Seeds的影响力）-（当前Seeds的影响力）】，并把各个节点按照Δinfs降序排列。

step 2:把Δinfs最大的节点加入Seeds。例如下图中A的边际影响力最大，于是Seeds={A}.

step 3:在新种子集Seeds条件下，重新计算各个节点的边际影响力Δinfs，把Δinfs最大的加入种子集。

step 4:重复step 3，直至种子集的节点个数达到K,输出Seeds,退出。

而CELF算法：根据IC模型条件下，节点的Δinfs符合子模性，于是在A加入Seeds后，在下一轮计算各个节点的边际影响力Δinfs时，如果计算出B的Δinfs大于或等于上一轮中比它小且最接近它的那个节点（这里是C）在上一轮中的Δinfs，那么这一轮就可以直接把B加入到Seeds当中，而不用计算后面C,D,E...等节点的Δinfs了，因为他们在这一轮的Δinfs必定比上一轮自己的Δinfs小，所以B就是这一轮最大的，所以选B没错，因此节省了很多计算步骤。

具体到下图中，如果Δb>=8，那么B就是Δinfs最大的节点，B可直接加入Seeds，不用再计算Δc，Δd，Δe等等，因为依据子模性（即边际递减规律），种子集Seeds加入了A之后，Δc必定小于等于8，Δd必定小于等于7，Δe必定小于等于5。这就是CELF算法能节省时间提高速度的原因。

那，如果这一轮B的Δinfs没有大于或者等于8呢？就逐个算出每个节点的Δinfs，排序再挑最大的，放进Seeds，然后重复上述过程。

CELF算法原理的更多相关文章

Bagging与随机森林算法原理小结
在集成学习原理小结中,我们讲到了集成学习有两个流派,一个是boosting派系,它的特点是各个弱学习器之间有依赖关系.另一种是bagging流派,它的特点是各个弱学习器之间没有依赖关系,可以并行拟合. ...
RSA算法原理
一直以来对linux中的ssh认证.SSL.TLS这些安全认证似懂非懂的.看到阮一峰博客中对RSA算法的原理做了非常详细的解释,看完之后茅塞顿开,关于RSA的相关文章如下 RSA算法原理(一) RSA ...
LruCache算法原理及实现
LruCache算法原理及实现 LruCache算法原理 LRU为Least Recently Used的缩写,意思也就是近期最少使用算法.LruCache将LinkedHashMap的顺序设置为LR ...
MySQL索引背后的数据结构及算法原理【转】
本文来自:张洋的MySQL索引背后的数据结构及算法原理摘要本文以MySQL数据库为研究对象,讨论与数据库索引相关的一些话题.特别需要说明的是,MySQL支持诸多存储引擎,而各种存储引擎对索引的支持 ...
OpenGL学习进程（13）第十课：基本图形的底层实现及算法原理
本节介绍OpenGL中绘制直线.圆.椭圆,多边形的算法原理. (1)绘制任意方向(任意斜率)的直线: 1)中点画线法: 中点画线法的算法原理不做介绍,但这里用到最基本的画0<=k ...
支持向量机原理(四)SMO算法原理
支持向量机原理(一) 线性支持向量机支持向量机原理(二) 线性支持向量机的软间隔最大化模型支持向量机原理(三)线性不可分支持向量机与核函数支持向量机原理(四)SMO算法原理支持向量机原理(五) ...
分布式缓存技术memcached学习（四）—— 一致性hash算法原理
分布式一致性hash算法简介当你看到“分布式一致性hash算法”这个词时,第一时间可能会问,什么是分布式,什么是一致性,hash又是什么.在分析分布式一致性hash算法原理之前,我们先来了解一下这几 ...
Logistic回归分类算法原理分析与代码实现
前言本文将介绍机器学习分类算法中的Logistic回归分类算法并给出伪代码,Python代码实现. (说明:从本文开始,将接触到最优化算法相关的学习.旨在将这些最优化的算法用于训练出一个非线性的函数 ...
GBDT算法原理深入解析
GBDT算法原理深入解析标签: 机器学习集成学习 GBM GBDT XGBoost 梯度提升(Gradient boosting)是一种用于回归.分类和排序任务的机器学习技术,属于Boosting ...

随机推荐

DeepWalk论文精读：（4）总结及不足
模块4 1 研究背景随着互联网的发展,社交网络逐渐复杂化.多元化.在一个社交网络中,充斥着不同类型的用户,用户间产生各式各样的互动联系,形成大小不一的社群.为了对社交网络进行研究分析,需要将网络中的 ...
重新认识Java注解
重新认识Java注解今天Debug看源码的时候,无意间看到这么个东西首先承认我的无知,看到这个我很惊诧. 也勾起了我的好奇心,于是有了这篇认知记录. 下面就来重新认识下注解吧! 注解的本质关于运 ...
JavaSpring中级联查询
一对一级联查询映射文件PersonMapper.xml代码: <?xml version="1.0" encoding="UTF-8"?> < ...
201771010113 李婷华《面向对象程序设计（java）》第七周学习总结
一.理论知识学习部分 1.动态绑定:又称为运行时绑定.程序在运行时会自动选择调用哪个方法. 2.静态绑定:如果方法是private.static.final修饰的,或者是构造器,那么编译器能准确地判断 ...
美团分布式ID生成框架Leaf源码分析及优化改进
本文主要是对美团的分布式ID框架Leaf的原理进行介绍,针对Leaf原项目中的一些issue,对Leaf项目进行功能增强,问题修复及优化改进,改进后的项目地址在这里: Leaf项目改进计划 https ...
推荐一款 python 管理工具：anaconda
1.jpg 2.jpg 3.jpg 4.jpg 5.jpg 6.jpg 7.jpg 8.jpg 9.jpg 10.jpg 11.jpg 12.jpg 13.jpg 14.jpg 15.jpg 16.j ...
vue render 中遇到的问题
以后遇到问题会持续更新 1 render中判断是否显示 2 render中属性可以通过判断的形式显示
TP5整合的导出Excel中没有图片和包含图片两种方法
之前做了个项目需要导出Excel文件 ,我在网上查了许多资料,最后终于搞定了 ,现在把代码贴到下面先导入库文件:将文件phpoffice放在根目录的vendor下.获取文件点击:链接:https:/ ...
java 实现mongoDB 增加，删除，修改，查看,多条件查询，聚合查询，分组查询(史上最全)
首先idea创建一手springboot项目引入如下依赖 <dependency> <groupId>org.mongodb</groupId> <arti ...
快速了解pandas
pandas主要就下面两方面:(只要稍微了解下面两点,那你就会用了) 1.两种数据结构(Series和DataFrame) 2.对这两种数据进行处理(主要是对DataFrame处理) -------- ...

CELF算法原理

CELF算法原理的更多相关文章

随机推荐

热门专题