2013年12月5日-6日参加了为期两天的2013中国大数据技术大会(Big Data Technology Conference, BDTC2013),本期会议主题是:“应用驱动的架构与技术 ”。大数据概念最近真是火得不行,从大会多达7个的“大数据架构与系统”、“大数据技术”、“大数据应用”、“大数据研究与发展”、“大数据基准测试”“智能交通与大数据”以及“传统行业如何驾驭大数据”主题论坛,再到现场爆棚的人群,可见大家拥抱大数据的高涨热情。

在9月份读完了一本《大数据时代》,后面又听大学老师介绍了一次Hadoop的HDFS以及MapReduce,就敢修改了一篇勘探大数据立项报告。当看了Hadoop生态系统的框架图后,直接被一堆代号搞得晕头转向,慢慢地只明白了其中几个简单意思,随便一个系统就能庞大得把你淹死,大数据,胆小者慎入!

大数据白皮书与发展趋势

5号会议以主席致辞和院士讲话开始。

马上就是程学旗发布《大数据白皮书》,据说这本书马上就会在CSDN免费发布,内容包括:大数据的发展背景、典型的业务大数据、大数据技术体系、大数据产业链与生态环境、大数据人才培养以及大数据发展趋势等。

程学旗报告的后半部分重点介绍了大数据的10大发展趋势,网上有一篇报道发得挺快的讲了这个内容。

1. 大数据从概念化走向价值化

2. 大数据处理架构的多样化模式并存

3. 大数据安全与隐私越来越重要

4. 大数据分析与可视化成为热点

5. 大数据产业成为战略性产业

6. 数据的商品化和数据共享的联盟化

7. 基于大数据推荐和预测正逐步流行

8. 大数据性能成为支撑性的技术

9. 数据科学的兴起

10. 大数据生态环境逐步完善

BDAS

在大数据创新大赛颁奖之后,是一篇主题演讲Taming Big Data with Berkeley Data Analytics Stack(BDAS),这里介绍一个Hadoop之外的一个大数据分析框架,试验室的名称叫AMPLab(来自于Algorithms, Machines, Person)。

BDAS的目标:

腾讯的报告:大数据处理的规模化与实时化演进

云计算是挖掘大数据价值的核心基础这张片子介绍传统处理方式与大数据处理的对比。

后面讲到了RCFile和ORCFile(Optimized Row Columnar)数据的存储格式,还不了解。

The Stae of Apache HBase

下午吃完饭后直接犯困,有2个演讲人的声音几乎没有什么起伏,一会就要睡过去。其中有一篇讲互联网金融的,我也不感兴趣。

只是大概听了一个老外介绍The Stae of Apache HBase,下图中被人头挡住的部分是HDFS。

6号的会议我一直在大数据技术主题论坛里呆着。

百度:基于大数据的硬盘故障预测

从HDFS里学了一个三副本概念,这里才知道还有各种纠删码的方案,有一个重要评价指标叫MTTDL(Mean Time To Data Loss平均无数据丢失时长?)。

浙大:机器学习与大数据

何晓飞教授从人脸识别讲到机器学习,先介绍了机器学习的发展历程。

大数据时代的机器学习现在都在朝着深度学习和在线学习攻关。

后面介绍了最近邻搜索中的哈希索引等技术问题。

大数据时代可视化和可视分析的机遇与挑战

报告从The Top 10 Challenges in Extreme-Scale Visual Analytics这篇论文引出了北大在可视化方面的工作。

下图给出了通过出租车GPS数据来分析北京交通情况。

还讲到一个多维数据拼图系统。http://vis.pku.edu.cn/mddv/val/sketch#CarData

这篇大数据可视化的报告有PDF在CSDN上可以下载

Extending MPI to Big Data Computing: Challenges and Benefits of DataMPI

这篇报告中探讨了如何让MPI改造为大数据时代的并行计算,以前有大量MPI并行代码可以看看这篇文章。

参加2013中国大数据技术大会(BDTC2013)的更多相关文章

  1. 2013中国大数据技术大会——BDTC2013

    阿里飞天平台总架构师唐洪分享了飞天开放平台. 飞天平台特点:同时支持在线和离线应用:安全控制:分布式部署,监控和诊断:无单点故障,可用性99.9%:数据3副本,数据可靠性“10个9”. 阿里飞天平台总 ...

  2. 2016中国大数据技术大会( BDTC ) 共商大数据时代发展之计

    中国大数据技术大会(BDTC)的前身是Hadoop中国云计算大会(HadoopinChina,HiC).从2008年仅60余人参加的技术沙龙发展到当下数千人的技术盛宴,目前已成为国内最具影响力.规模最 ...

  3. 大数据技术人年度盛事! BDTC 2016将于12月8-10日在京举行

    2016年12月8日-10日,由中国计算机学会(CCF)主办,CCF大数据专家委员会承办,中国科学院计算技术研究所和CSDN共同协办的2016中国大数据技术大会(Big Data Technology ...

  4. 中国大数据六大技术变迁记(CSDN)

    大会召开前期,特别梳理了历届大会亮点以记录中国大数据技术领域发展历程,并立足当下生态圈现状对即将召开的BDTC 2014进行展望: 追本溯源,悉大数据六大技术变迁 伴随着大数据技术大会的发展,我们亲历 ...

  5. 自然语言处理工具HanLP被收录中国大数据产业发展的创新技术新书《数据之翼》

    在12月20日由中国电子信息产业发展研究院主办的2018中国软件大会上,大快搜索获评“2018中国大数据基础软件领域领军企业”,并成功入选中国数字化转型TOP100服务商. 图:大快搜索获评“2018 ...

  6. 奥威软件Speed-BI荣获2016年度中国大数据最佳云平台奖

    (原文转自:http://www.powerbi.com.cn/page110?article_id=210) 2016年12月16日,“科技原力觉醒,引领创新巅峰”—2016创新影响力年会暨国家产业 ...

  7. 开源大数据技术专场(上午):Spark、HBase、JStorm应用与实践

    16日上午9点,2016云栖大会“开源大数据技术专场” (全天)在阿里云技术专家封神的主持下开启.通过封神了解到,在上午的专场中,阿里云高级技术专家无谓.阿里云技术专家封神.阿里巴巴中间件技术部高级技 ...

  8. 【学习笔记】大数据技术原理与应用(MOOC视频、厦门大学林子雨)

    1 大数据概述 大数据特性:4v volume velocity variety value 即大量化.快速化.多样化.价值密度低 数据量大:大数据摩尔定律 快速化:从数据的生成到消耗,时间窗口小,可 ...

  9. WOT2016大数据技术峰会——千人技术盛宴

    WOT2016大数据技术峰会是一场聚焦大数据领域最前沿的的技术及经验分享.2016年11月25-26日北京粤财JW万豪酒店如约而至,会议规模达到1000人! 由51CTO主办的千人技术盛宴--WOT2 ...

随机推荐

  1. Haskell 与范畴论

    说到 Haskell,这真是一门逼格极高的编程语言,一般初学者如果没有相关函数式编程的经验,入门直接接触那些稀奇古怪的概念,简直要跪下.现在回想起来,隐隐觉得初学者所拥有的命令式编程语言(impera ...

  2. MySQL批量SQL插入性能优化

    对于一些数据量较大的系统,数据库面临的问题除了查询效率低下,还有就是数据入库时间长.特别像报表系统,每天花费在数据导入上的时间可能会长达几个小时或十几个小时之久.因此,优化数据库插入性能是很有意义的. ...

  3. MyBatis知多少(13)MyBatis如何解决数据库的常见问题

    在现代软件项目中数据库通常被认为是遗留组件.它们一直以来都被认为难以使用,不论是出于技术的还是非技术的原因.大多数软件开发人员宁可从头开始完完全全地重建一个数据库. 如果数据库是遗留下来的,相信一些开 ...

  4. [ML] Concept Learning

    Candidate Elimination Thanks for Sanketh Vedula. This is a good demo to understand candidate elimina ...

  5. Zookeeper集群部署

    一. 部署前的准备工作 保证各个主机之间能够正常通信,最好是在同一网段. 修改host文件,加入IP和主机名的映射.方法为修改/etc/hosts和etc/hostname文件,不同的Linux发行版 ...

  6. EPANET中读取INPUT文件的函数文件——INPUT1.C/INPUT2.C/INPUT3.C

    首先介绍下这3个文件的关系:可以说INPUT1.C的函数粒度最大,它的函数getdata()就完成了整个INPUT文件数据的读入,该函数又调用了INPUT2.C中的部分函数,INPUT2.C文件中的函 ...

  7. IOS开发UI基础之UIButton

    什么是按钮?

  8. EF错误记录

    纯属个人记录错误使用: 1.EntityType“area”未定义键.请为该 EntityType 定义键. 产生原因: 1.命名空间引用错误,可能命名重复导致引用错误 2.实体类无法识别主键或者未设 ...

  9. [Architect] Abp 框架原理解析(3) DynamicFilters

    本节目录 介绍 定义Filter 设置Filter 这是Abp中多租户.软删除.激活\禁用等如此方便的原因 Install-Package EntityFramework.DynamicFilters ...

  10. 在GridView列表中使用图片显示记录是否包含附件

    在我的前面很多文章中,都介绍过通用附件模块的管理,本篇随笔主要介绍在一些应用模块中的列表展示中,包含附件的记录,在GridView列表界面中使用图标来快速显示是否有附件的情况. 1.通用附件模块的应用 ...