左手中倒影

hadoop技术控 大数据解决方案 hanlp研究爱好者
  博客园  :: 首页  :: 新随笔  :: 联系 :: 订阅 订阅  :: 管理
上一页 1 ··· 15 16 17 18 19

2018年3月16日

摘要: 大数据的应用开发过于偏向底层,具有学习难度大,涉及技术面广的问题,这制约了大数据的普及。现在需要一种技术,把大数据开发中一些通用的,重复使用的基础代码、算法封装为类库,降低大数据的学习门槛,降低开发难度,提高大数据项目的开发效率。 大数据在工作中的应用有三种:与业务相关,比如用户画像、风险控制等;与 阅读全文

posted @ 2018-03-16 14:16 左手中倒影 阅读(641) 评论(0) 推荐(1) 编辑

2018年3月15日

摘要: 自然语言处理(NLP)是计算机科学,人工智能,语言学关注计算机和人类(自然)语言之间的相互作用的领域。自然语言处理是计算机科学领域与人工智能领域中的一个重要方向。它研究能实现人与计算机之间用自然语言进行有效通信的各种理论和方法。自然语言处理是一门融语言学、计算机科学、数学于一体的科学。因此,这一领域 阅读全文

posted @ 2018-03-15 10:51 左手中倒影 阅读(355) 评论(0) 推荐(1) 编辑

2018年3月14日

摘要: 什么是大数据?进入本世纪以来,尤其是2010年之后,随着互联网特别是移动互联网的发展,数据的增长呈爆炸趋势,已经很难估计全世界的电子设备中存储的数据到底有多少,描述数据系统的数据量的计量单位从MB(1MB大约等于一百万字节)、GB(1024MB)、TB(1024GB),一直向上攀升,目前,PB(等于 阅读全文

posted @ 2018-03-14 11:08 左手中倒影 阅读(197) 评论(0) 推荐(1) 编辑

2018年3月13日

摘要: hadoop是一个开源软件框架,可安装在一个商用机器集群中,使机器可彼此通信并协同工作,以高度分布式的方式共同存储和处理大量数据。最初,Hadoop 包含以下两个主要组件:Hadoop Distributed File System (HDFS) 和一个分布式计算引擎,该引擎支持以 MapReduc 阅读全文

posted @ 2018-03-13 10:10 左手中倒影 阅读(254) 评论(0) 推荐(1) 编辑

2018年3月12日

摘要: 如今有很多公司都在努力挖掘他们拥有的大量数据,包括结构化、非结构化、半结构化以及二进制数据等,来探索对数据的深入利用。 大多数公司估计他们只分析了已有数据的12%,剩余88%还没有被充分利用。大量的数据孤岛和分析能力的缺乏是造成这种局面的主要原因。另外一个难题是如何判断数据是否有价值。尤其是在大数据 阅读全文

posted @ 2018-03-12 11:48 左手中倒影 阅读(261) 评论(0) 推荐(1) 编辑

2018年3月10日

摘要: 一、什么是大数据 进入本世纪以来,尤其是2010年之后,随着互联网特别是移动互联网的发展,数据的增长呈爆炸趋势,已经很难估计全世界的电子设备中存储的数据到底有多少,描述数据系统的数据量的计量单位从MB(1MB大约等于一百万字节)、GB(1024MB)、TB(1024GB),一直向上攀升,目前,PB( 阅读全文

posted @ 2018-03-10 13:28 左手中倒影 阅读(4689) 评论(0) 推荐(1) 编辑

上一页 1 ··· 15 16 17 18 19