并行LINQ

.NET4在System.Linq命名空间中包含一个新类ParallelEnumerable,可以分解查询的工作使其分布在多个线程上.尽管Enumerable类给IEnumerable<T>接口定义了扩展方法,但ParallelEnumerable类的大多数扩展方法是ParallelQuery<TSource>类的扩展.一个重要的例外是AsParallel()方法,它扩展了IEnumerable<TSource>接口,返回ParallelQuery<TSource>类,所以正常的集合类可以以平行方式查询.

LINQ比较强大的是还提供了可并行处理的查询,这使得我们可以借助它来完成一些查询处理或处理并行操作.

先来说一下并行集合,并行计算使用的多个线程同时进行计算,所以要控制每个线程对资源的访问,我们先来看一下常用的List<T>集合,在并行计算下的表示:

using System;

using System.Collections.Generic;

using System.Linq;

using System.Text;

using System.Threading.Tasks;

namespace 并行集合和LINQ

{

class Program

{

static void Main(string[] args)

{

List<int> list = new List<int>();

Parallel.For(0, 10000, item =>

{

list.Add(item);

}

);

Console.WriteLine("list的长度为 : {0}",list.Count());

//多测试几次,就是说多运行几次

/*

* 从结构可以看出,我们的结构不是10000.这是为什么呢,这是因为List是费线程安全的

* ,也就是说,任何线程都可以修改他的值

*/

Console.ReadKey();

}

}

}

接下来我们看一下并行集合----线程安全集合,在System.Collections.Concurrent命名空间中,首先看一下ConcurrentBag<T>泛型集合,其用法和List<T>类似:

ConcurrentBag<int> list =new ConcurrentBag<int>();

Parallel.For(0, 10000, item =>

{

list.Add(item);

}

);

Console.WriteLine("ConcurrentBag的长度为 : {0}", list.Count());

//不管运行几次,结果都是10000

分析一下,因为ConcurrentBag是线程安全的,所以每次结果都是正确的.

下面我们来修改代码看看ConcurrentBag里面的数据到底是怎样存放的,修改代码如下:

using System;

using System.Collections.Concurrent;

using System.Collections.Generic;

using System.Linq;

using System.Text;

using System.Threading.Tasks;

namespace 并行集合和LINQ

{

class Program

{

static void Main(string[] args)

{

ConcurrentBag<int> list =new ConcurrentBag<int>();

Parallel.For(0, 10000, item =>

{

list.Add(item);

}

);

Console.WriteLine("ConcurrentBag的长度为 : {0}", list.Count());

//不管运行几次,结果都是10000

int n = 0;

foreach (var item in list)

{

if (n>10)

{

break;

}

n++;

Console.WriteLine("Item[{0}] = {1}",n,item);//,多运行几次,观察这里的输出

}

Console.WriteLine("ConcurrentBag的最大长度为 : {0}",list.Max());

Console.ReadKey();

}

}

}

分析:可以看到ConcurrentBag中的数据并不是按照顺序排列的,顺序是乱的,随机的.我们平时使用的Max,First,Last等LINQ方法都还有.其十分类似Enumerable的用法.

关于线程安全的集合还有很多,和我们平时用的集合都差不多,比如类似Dictionary的ConcurrentDictionary,还有ConcurrentStack,ConcurrentQueue等。

并行LINQ的用法和性能

1.AsParallel

案例:

using System;

using System.Collections.Concurrent;

using System.Collections.Generic;

using System.Diagnostics;

using System.Linq;

using System.Text;

using System.Threading.Tasks;

namespace 并行集合和LINQ

{

class Program

{

static void Main(string[] args)

{

Stopwatch sw = new Stopwatch();//需要添加命名空间 System.Threading.Tasks;

List<Custom> customs = new List<Custom>();

for (int i = 0; i < 2000000; i++)

{

customs.Add(new Custom() { Name = "Jack", Age = 21, Address = "NewYork" });

customs.Add(new Custom() { Name = "Jime", Age = 26, Address = "China" });

customs.Add(new Custom() { Name = "Tina", Age = 29, Address = "ShangHai" });

customs.Add(new Custom() { Name = "Luo", Age = 30, Address = "Beijing" });

customs.Add(new Custom() { Name = "Wang", Age = 60, Address = "Guangdong" });

customs.Add(new Custom() { Name = "Feng", Age = 25, Address = "YunNan" });

}

sw.Start();

var result = customs.Where<Custom>(c => c.Age > 26).ToList();

sw.Stop();

Console.WriteLine("Linq time is {0}.", sw.ElapsedMilliseconds);

sw.Restart();

sw.Start();

var result2 = customs.AsParallel().Where<Custom>(c => c.Age > 26).ToList();

sw.Stop();

Console.WriteLine("Parallel Linq time is {0}.", sw.ElapsedMilliseconds);

Console.WriteLine("运行完毕");//这句话可能需要过一会才能出现

Console.ReadKey();

}

}

public class Custom

{

public string Name { get; set; }

public int Age { get; set; }

public string Address { get; set; }

}

}

分析:多运行即便可以发现,添加了AsParallel()方法的速度差不多快了一倍.其实,AsParallel()这个方法可以应用与任何集合,包括List<T>集合,从而提高查询速度和系统性能。

2.GroupBy方法

在项目中,我们经常要对数据做处理,比如分组统计,我们知道在LINQ中也可以实现,今天来学习以下新的ToLookUp方法,写一个测试方法:其他代码相似,只是测试代码不同

Stopwatch stopWatch = new Stopwatch();

List<Custom> customs = new List<Custom>();

for (int i = 0; i < 2000000; i++)

{

customs.Add(new Custom() { Name = "Jack", Age = 21, Address = "NewYork" });

customs.Add(new Custom() { Name = "Jime", Age = 26, Address = "China" });

customs.Add(new Custom() { Name = "Tina", Age = 29, Address = "ShangHai" });

customs.Add(new Custom() { Name = "Luo", Age = 30, Address = "Beijing" });

customs.Add(new Custom() { Name = "Wang", Age = 60, Address = "Guangdong" });

customs.Add(new Custom() { Name = "Feng", Age = 25, Address = "YunNan" });

}

stopWatch.Restart();

var groupByAge = customs.GroupBy(item => item.Age).ToList();

foreach (var item in groupByAge)

{

Console.WriteLine("Age={0},count = {1}", item.Key, item.Count());

}

stopWatch.Stop();

Console.WriteLine("Linq group by time is: " + stopWatch.ElapsedMilliseconds);

stopWatch.Restart();

var lookupList = customs.ToLookup(i => i.Age);

foreach (var item in lookupList)

{

Console.WriteLine("LookUP:Age={0},count = {1}", item.Key, item.Count());

}

stopWatch.Stop();

Console.WriteLine("LookUp group by time is: " + stopWatch.ElapsedMilliseconds);

Console.WriteLine("运行完毕");//这句话可能需要过一会才能出现

Console.ReadKey();

ToLookup方法是将集合转换成一个只读集合,所以在大数据量分组时性能优于List.

C#编程(六十三)----------并行LINQ的更多相关文章

  1. 四、并行编程 - 并行LINQ(PLINQ) 的使用。AsParallel

    用于对内存中的数据做并行运算,也就是说其只支持 LINQ to Object 的并行运算 一.AsParallel(并行化) 就是在集合后加个AsParallel(). 例如: , ); == ); ...

  2. 5天玩转C#并行和多线程编程 —— 第二天 并行集合和PLinq

    5天玩转C#并行和多线程编程系列文章目录 5天玩转C#并行和多线程编程 —— 第一天 认识Parallel 5天玩转C#并行和多线程编程 —— 第二天 并行集合和PLinq 5天玩转C#并行和多线程编 ...

  3. 孤荷凌寒自学python第六十三天学习mongoDB的基本操作并进行简单封装2

    孤荷凌寒自学python第六十三天学习mongoDB的基本操作并进行简单封装2 (完整学习过程屏幕记录视频地址在文末) 今天是学习mongoDB数据库的第九天. 今天继续学习mongoDB的简单操作, ...

  4. C#5.0之后推荐使用TPL(Task Parallel Libray 任务并行库) 和PLINQ(Parallel LINQ, 并行Linq). 其次是TAP(Task-based Asynchronous Pattern, 基于任务的异步模式)

    学习书籍: <C#本质论> 1--C#5.0之后推荐使用TPL(Task Parallel Libray 任务并行库) 和PLINQ(Parallel LINQ, 并行Linq). 其次是 ...

  5. 并行Linq(一)

    .Net 并行计算 ----并行Linq(一) 本文是.Net 并行计算 的第三篇 欢迎大家拍砖,阅读本文需要有LINQ基础,因为并行LINQ (PLinq) 其实是LINQ To Object 的并 ...

  6. JDBC编程六部曲

    今天初学jdbc,明白了大致的编程流程,在此总结一下: JDBC编程可以分为六步——六部曲: * 第一步:注册驱动. * 1.1 获取驱动对象 * 1.2 注册驱动 * 第二步:获取数据库连接 * 第 ...

  7. C# 多线程八之并行Linq(ParallelEnumerable)

    1.简介 关于并行Linq,Ms官方叫做并行语言集成(PLINQ)查询,其实本质就是Linq的多线程版本,常规的Linq是单线程的,也就是同步的过程处理完所有的查询.如果你的Linq查询足够简单,而且 ...

  8. 并行Linq

    有时候我们对大批量数据进行处理,此时并行linq就起作用了. 并行查询 对于以下查询可以耗时会非常大,如下: ; var r = new Random(); , arraySize).Select(x ...

  9. “全栈2019”Java第六十三章:接口与抽象方法详解

    难度 初级 学习时间 10分钟 适合人群 零基础 开发语言 Java 开发环境 JDK v11 IntelliJ IDEA v2018.3 文章原文链接 "全栈2019"Java第 ...

随机推荐

  1. 通过 EXPLAIN 分析低效 SQL 的执行计划

    每个列的简单解释如下:  select_type:表示 SELECT 的类型,常见的取值有 SIMPLE(简单表,即不使用表连接 或者子查询).PRIMARY(主查询,即外层的查询).UNION(U ...

  2. SpringBoot修改默认端口号,session超时时间

    有时候我们可能需要启动不止一个SpringBoot,而SpringBoot默认的端口号是8080,所以这时候我们就需要修改SpringBoot的默认端口了.修改SpringBoot的默认端口有两种方式 ...

  3. High-Speed Tracking with Kernelized Correlation Filters

          2015年的一篇论文,可参考:http://blog.csdn.net/carrierlxksuper/article/details/46461245.      另参考:http:// ...

  4. HTML5+ App开发入门

    HTML5 Plus应用概述 HTML5 Plus移动App,简称5+App,是一种基于HTML.JS.CSS编写的运行于手机端的App,这种App可以通过扩展的JS API任意调用手机的原生能力,实 ...

  5. 在浏览器输入网址,Enter之后发生了什么?

    启动浏览器,在地址栏输入我们将要访问的网页,然后按一下回车,OK,成功进入! 在我们回车之后,发生了什么事情?为什么我们会访问到期待的网页,我们究竟访问了谁?如何访问到他的? 我简单的向大家介绍一下, ...

  6. [转] 使用moment.js轻松管理日期和时间

    当前时间:moment().format('YYYY-MM-DD HH:mm:ss'); 2017-03-01 16:30:12 今天是星期几:moment().format('d'); 3 Unix ...

  7. 【LOJ】#2888. 「APIO2015」巴邻旁之桥 Palembang Bridges

    题解 发现我们选择一座桥会选择力\(\frac{s + t}{2}\)较近的一座桥 然后我们只需要按照\(s + t\)排序,然后枚举断点,左边取所有s和t的中位数,右边同理 动态求中位数用平衡树维护 ...

  8. hibernate Validator 6.X 的学习,bean的约束(字段,get方法上的验证)

    一:背景说明 验证数据是一个常见的任务,它贯穿于所有应用层,从呈现到持久层.通常在每个层中都执行相同的验证逻辑,耗时且容易出错.为了避免这些验证的重复,开发商往往把验证逻辑直接进入的领域模型,在领域类 ...

  9. EF框架搭建小总结--CodeFirst代码优先

    前言:之前在下总结编写了一篇 EF框架搭建小总结--ModelFirst模型优先 博文,看到一段时间内该博文的访问量蹭.蹭蹭.蹭蹭蹭...往上涨(实际也不是很多,嘿嘿),但是还是按捺不住内心的喜悦(蛮 ...

  10. Java动态性之反射机制(reflection)

    说到反射机制,第一次接触的人可能会比较懵,反射?什么反射?怎么反射?反射是干嘛的?下面我将在这篇文章中讲讲Java的反射机制 不过在这之前,还有一个问题需要解决,标题名中的动态性,说起动态性,我先介绍 ...