大数据读书笔记

整理文档很辛苦,赏杯茶钱您下走!

免费阅读已结束,点击下载阅读编辑剩下 ...

阅读已结束,您可以下载文档离线阅读编辑

资源描述

大数据读书笔记【篇一:大数据读后感】从徐子沛的《大数据》中得到的感悟数据,对于我们现代社社会来说,已经是再熟悉不过了。大量化(volume)、多样化(variety)、快速化(velocity)和大价值(value)。这四个v就是大数据的基本特征。每天我们都不得不和数据打交道,比如我们平常所说得“眼观六路,耳听八方,”就是生活中一个很好的的收集数据的例子。还有,在我们平时的学习中,我们对于一些学习上的数据的整理等等。可以说,数据已经成为了我们的影子一样,无时无刻的在我们的身边活动。拿到《大数据》这本书时,吸引我的不是书评的内容,而是书的封面上的一句话“除了上帝,任何人都可以用数据说话。”也就是说,上帝可以不用数据来说话,但是,作为一个平常人,我们做事,言论等都必须用数据来说话。用数据论来证我们的观点正确性。那么数据真的就是那么重要吗?其实不然,数据果真有那么的重要。作者在书中大量应用世界头号强国美国的例子来说明美国是如何利用数据以及数据在美国人的利用下,是如何造福美国人的。使得美国人走上了民主、发展的道路。书中还引用了大量的利用数据的案例,以及利用数据会有什么样的后果。当然,作者在书中也很明确的表达了自己观点,也就是数据要被人利用,利用的好了,造福人类,否则,祸害无穷。毫无疑问,我们正处在一个真正意义的大数据时代。但是,大数据浪潮的来龙去脉如何?数据技术变革何以能推动政府信息的公开、透明和社会公正?又何以给我们带来无限的商机,既便利又危及我们每个人的生活?《大数据》给了我们一个很好的答案。在拿到徐子沛《大数据》时,与其说这是个新概念,还不如说就是一个现实。信息技术的迅速发展和普遍应用,存储能力的膨胀,网络传输的便捷,必然产生巨大的数据量。即使是一个公司,经过多年的积累,产生的数据也是惊人的。每天繁多的数据,这就是要求企业要很好地存储数据,利用数据通过数据,使得数据说话,提升企业的业绩和知名度。对于一个企业来说,比较实际的倒是关注一下企业微观大数据,如何充分利用现有的、能够得到的和自己创造的数据,采用《大数据》里提及的新技术、新方法、新理念,筛选、组织、关联、分析,精细化管理和挖掘数据,探索规律性的东西,指导企业活动。尽可能多的获取数据,首先是要有心,对于公司员工来说,随时随地注意收集客户数据、需求数据、产品数据、市场数据、资源数据等,经过整理,把它变成公司的数据资产;然后是要有据,信息与数据最大的不同,就是数据是能够度量或者确定的信息,不能“毛估估”,收集数据要精细化,要准确;其次要有序,数据需要存储,更加需要整理,单个数据没有很大意义,静止的数据也没有很大意义,有价值的数据是流动的、与其他数据交互作用的。一个大杂烩的数据库,在需要时让人找不到北,没有任何意义。再次,需要技术支持,大量的数据如何检索,如何关联,单靠人脑是不行的,需要建立基于特定理论的数据处理系统来分析管理。对于一个企业,最理想的是建立一个类似人类神经系统的数据管理系统,采用各种信息终端采集内部和外部信息,通过分析、归纳、筛选,形成管理数据,某些数据可以成为系统的“本能”,一旦触发能够自动做出反应;某些数据可以成为组合信息提交大脑综合分析,作出决策和反应。数据应该为人服务,这是一条基本原则。在大数据时代始终发挥人的主观能动性,采用先进的理念和技术驾驭数据,让人们生活更方便,工作效率更高,劳动强度降低,为社会创造更多的物质财富和精神财富。《大数据》是一本视野独特的书。它以数据为轴线,描绘了美国走过的改革创新的过程,行文如流水,引人入胜。书中,我读到的不是大数据处理技术,更多的是与大数据相关的美国政治、经济、社会和文化的演进,从民主和国家战略的层面细解大数据的影响力。美国是全书的主体,但又处处反观中国当下的现实。内容非常值得我们身处改革开放前沿的政府工作者深思。它让我们更加深刻地理解了汪洋书记提出的“坚持用数据说话、用数据改进管理、用数据推动创新”的深刻内涵和殷切期望。我们只有重视数据,加强对数据的收集、分析和使用,才能更好地应对正在到来的数据革命的挑战。那么,作为与数据打交道、用数据说话的前线统计工作者,如何应对大数据时代的种种挑战?对比《大数据》,结合平时工作和学习的实际情况,我认为最少应该认真思考和解决好三个问题:一、提供什么样的数据?在中国,统计部门提供的数据,是各级政府部门和广大人民群众了解国家社会经济发展和人民生活状况主要渠道。只有真实可靠统计数据,才能使政府决策有的放矢,人民了解国家经济与人民生活的真实状况。如果统计数据虚假不实,就会误导政府和人民,让政府失信于人民。因此,我们一定把握好数据的生命线—质量关,确保给国家和人民提供准确、真实、可靠、无误的数据。二、如何高效有序地收集数据?面对信息大爆炸时代海量数据,必须充分利用高科技手段,高效有序地收集整理各种数据,以满足政府和人民群众越来越广泛的信息需求。为此,我们需要建立完善数据收集网络,包括部门内部的纵向数据收集网络和部门之间的横向数据收集网络,通过这种纵横结合的网络数据收集系统,针对特定主题,持续不断地收集相关数据,为大数据发展提供基础。需要运用互联网、电子计算机等现代技术手段,加快数据收集、加工数据的速度,确保政府和人民及时得到所需数据。三、如何加强数据分析利用能力?收集数据的目的是为分析利用数据。通过数据分析挖掘数据背后隐含的经济规律及有利于提高效率、改进工作的因素,提高政府管理、决策和人民生活水平,实现“用数据改进管理”。因此,作为统计人,不仅要做好数据收集的及时有效和真实正确,更重要的是要善于分析利用数据,写好专业分析报告,发现问题、支撑决策、评估绩效的目的。此外我们还可以看到不少政府机构或者其他一些组织也在开始大数据解决他们遇到的一些问题。在本书的最后一章,作者告诉了我们大数据可能带来的坏处。如:通过大数据可能我们的个人各种信息、隐私会很容易地被大数据的拥有者找到,这些信息,可能被政府用来监管我们等;通过大数据可以预测可能发生的事,或者预测我们人个人本书即将做的行为,书中有个例子:警察通过大数据分析得出一个人即将可能犯罪,并把它逮捕了,但事实上这个人现在并没有犯罪。也许这就限制、约束了我们个人的自由。看完这本书,颠覆了自己之前的一些想法:以前我们认为错误的数据是没有用,我们需要保证统计的数据的准确性,但是在大数据中,错误的数据也是有用的,它和其他所有相对正确的数据一起构成了整体,也就算不了什么了。我们同样可以从这些数据中得出比较正确的预测和分析。google利用人们搜索的关键字来预测和判断某个地区是否发生流感,google通过分析这个地区的人们搜索和流感有关的词的数量等来分析得出。google从互联网抓取数以亿记的各种语言、各种翻译水平的翻译结果,使用其翻译出来的准确率比那些微软使用正确的词库翻译出来的句子准备率更高。我自己的感想是,其实大数据无处不在,只要我们细心,我们就可以挖掘出身边的那些大数据,并做一些有意义的是,就像书中说的那样,我们不需要强求每条数据都那么真实准确,但是从大量的数据中我们就可以得出相对准备的结果。未来成功的公司必定是是那些拥有大量数据、并使用那些数据为大众提供服务的公司。公布官员财产美国是怎么做的,美国能让少部人腐败起来吗,美国式上访是怎么回事,凭什么美国矿难那么少,全民医改美国做得到吗,美国总统大选有什么利器才能赢,下一轮全球洗牌我们世界工厂会被淘汰吗??除了上帝,任何人都必须用数据来说话。也就是是【篇二:《大数据时代》读书笔记-20140203】大数据意味着什么——《大数据时代》读书笔记自英国人维克托.迈克.舍恩伯格(viktormayerschonberger)2013年写了一本叫《大数据时代:生活、工作和思维的大变革》的互联网专著,“大数据”一夜之间成为全球互联网领域的核心关键词,无论国外的谷歌、亚马逊、facebook、twitter,还是国内的新浪、腾讯、淘宝、京东、当当、百度等互联网企业及传播学者、新媒体研究者、媒体人都将注意力转移到这一核心关键词上面,仿佛这年头如果你还对大数据浑然不知,走出去都不好意思跟传播学大家谈互联网,谈新媒体,谈如今如火如荼的电子商务。那么,到底什么是大数据?大数据有哪些特征?大数据对互联网、对普通网民意味着什么呢?去新华书店搬回来这本大部头,一口气读完,维克托用生动的案例幽默的语言,针对上述问题娓娓道来。提起“数据”,大家都知道是一种用0、1等计算机语言表示的信息,而所谓的“大数据”就是一种流量、存储量超级大(以tb计算)数据。谷歌地图街景(图片)是大数据,每一个微博用户在微博上产生的全部内容合起来作为一个整体是一种大数据,淘宝店主和每一位淘宝用户在淘宝这个平台上产生的所有信息作为一个整体是一种大数据,国内最大的搜索引擎百度里面所有的无数条的类目信息合起来也是一种大数据,这些都是互联网企业普遍存在的大数据,事实上,大数据在我们的日常生活中还有更为普遍的应用:超级市场里每一位会员刷卡购物(非会员购物买单时留下的购物清单也是大数据的一部分)时留下来的信息是大数据,百货大楼、大商场里面各个角落里安装的摄像头拍下每一位顾客进出商场及在商场中活动的画面是大数据,甚至汽车里面安装的电子狗、导航系统作业时也能带来大数据。细数身边常接触的这些大数据,仿佛还不得不信维克托这位号称“大数据商业应用第一人”大胆提出的“大数据”这个新概念的存在。大数据最大的特征就是数据量大、庞大、巨大。因为数据量大,所以才能商业特别是互联网企业带来不可估量的现时或潜在的价值,如果百度里面的数据量不够大,可供网民搜索的类目和条目不够多,那它毫无可能成为网民的“移动的百科全书”。如果超级市场里面顾客和会员没有留下大量的数据,那么超级市场根本无从精确判断下个月该进多少货,该进哪些货品。这,就是数据量够大带来的变革之一。其次,大数据还具有巨大的商业价值。除了刚才举到的两个案例,再譬如汽车里面安装的导航系统如果除了导航还增加实时测速、安全气囊爆破记录甚至刹车、加速、减速记录功能,那么它形成的大数据对保险公司定制车险套餐,汽车维修店开发新业务具有强大的参考借鉴价值。再譬如,每一位微博用户,哪怕你从不发微博(内容)只是围观,对于新浪微博也具有商业价值,因为新浪微博大数据的构成离不开每一位微博用户。当然,大数据的商业价值远非于此,下文还会讲到。大数据的第三个特征是具有相关性。因为数据与数据之间具有相关性,大数据才可供分析,分析的结果才能带来更多的价值。但是在本书中,维克托主张一种观点,就是无需在乎数据之间的因果关系,只要能看到数据之间的相关关系即可。譬如汽车安全气囊爆破的概率和车祸之间没有必然的因果关系,但是安全气囊爆破和保险公司为车主定制更为精准的保险套餐之间却有相关关系,用户只要关注后者即可,而不必纠结与因果关系。除此之外,大数据还具有非精确性、免费和可重复利用等特征。第三个问题:大数据对普通人意味着什么,即大数据能给普通人的生活带来哪一些影响呢?当然,提到影响就必然要分正面的和负面的来谈。首先谈谈大数据的正面影响。用维克托在《大数据时代》中提到的两个印象深刻的经典案例来说明这个问题。第一个案例是,facebook前几年通过搜集上亿条有关流感的信息进行分析,从而预测美国各大城市何时会发生流感,以让大家为预防流感提前做好准备。这是大数据给普通人带来实实在在正面影响的典型,此外这一案例还反映了大数据一个强大的功能,那就是预测功能,而维克托的这本书本身就是面向未来的,书中所提到的案例极少是已经实现了的,维克托提出的“大数据”这个新概念给互联网的未来描绘了一幅看起来前途无限光明的蓝图,而他提到的利用大数据进行商业和管理的案例大多有待进一步开发和尝试。当然,facebook、twitter上的信息既然能够预测流感,那它肯定还能够预测像电影票房这样的普通数据。第二个案例是,乔布斯利用大数据治疗癌症的例子。大家都知道乔布斯是因为胰腺癌于2011年去世的,但可能大家并不清楚乔布斯事实上早在好多年前就知道自己患了癌症并让他的医生给他做23对基因碱基配对,根据配对结果再制定

1 / 9
下载文档,编辑使用

©2015-2020 m.777doc.com 三七文档.

备案号:鲁ICP备2024069028号-1 客服联系 QQ:2149211541

×
保存成功