摘要: 当今技术的发展日新月异,系统架构也跟随技术的发展不断升级和改进,从传统的单一架构演变为如今的微服务分布式架构,我们来看看技术架构的演变过程。 阅读全文
posted @ 2018-11-07 15:44 大快搜索DKHadoop 阅读(275) 评论(0) 推荐(0)
摘要: 云计算、大数据等信息技术正在深刻改变着人们的思维、生产、生活和学习方式,并延深进入人们的日常生活。 阅读全文
posted @ 2018-11-06 14:27 大快搜索DKHadoop 阅读(1154) 评论(0) 推荐(0)
摘要: 所谓服务器大流量高并发指的是:在同时或极短时间内,有大量的请求到达服务端,每个请求都需要服务端耗费资源进行处理,并做出相应的反馈。 阅读全文
posted @ 2018-11-02 14:24 大快搜索DKHadoop 阅读(211) 评论(0) 推荐(0)
摘要: 与云相比,移动系统受计算资源限制。然而众所周知,深度学习模型需要大量资源 。为使设备端深度学习成为可能,应用程序开发者常用的技术之一是压缩深度学习模型以降低其资源需求,但准确率会有所损失。尽管该技术非常受欢迎,而且已被用于开发最先进的移动深度学习系统,但它有一个重大缺陷:由于应用程序开发者独立开发自己的应用,压缩模型的资源-准确率权衡在应用开发阶段的静态资源预算的基础上就被预先确定了,在应用部署后仍然保持不变。 阅读全文
posted @ 2018-10-31 15:38 大快搜索DKHadoop 阅读(488) 评论(0) 推荐(0)
摘要: 在分布式Web程序设计中,解决高并发以及内部解耦的关键技术离不开缓存和队列,而缓存角色类似计算机硬件中CPU的各级缓存。如今的业务规模稍大的互联网项目,即使在最初beta版的开发上,都会进行预留设计。但是在诸多应用场景里,也带来了某些高成本的技术问题,需要细致权衡。 阅读全文
posted @ 2018-10-29 15:44 大快搜索DKHadoop 阅读(700) 评论(0) 推荐(0)
摘要: 数据缺失是数据科学家在处理数据时经常遇到的问题,本文作者基于不同的情境提供了相应的数据插补解决办法。没有完美的数据插补法,但总有一款更适合当下情况。 我在数据清理与探索性分析中遇到的最常见问题之一就是处理缺失数据。首先我们需要明白的是,没有任何方法能够完美解决这个问题。不同问题有不同的数据插补方法— 阅读全文
posted @ 2018-10-26 14:58 大快搜索DKHadoop 阅读(291) 评论(0) 推荐(0)
摘要: 机器学习的模型训练越来越自动化,但特征工程还是一个漫长的手动过程,依赖于专业的领域知识,直觉和数据处理。而特征选取恰恰是机器学习重要的先期步骤,虽然不如模型训练那样能产生直接可用的结果。本文作者将使用Python的featuretools库进行自动化特征工程的示例。 机器学习越来越多地从手动设计模型 阅读全文
posted @ 2018-10-17 16:43 大快搜索DKHadoop 阅读(1122) 评论(0) 推荐(0)
摘要: 深度剖析HBase负载均衡和性能指标 在分布式系统中,负载均衡是一个非常重要的功能,HBase通过Region的数量实现负载均衡,即通过hbase.master.loadbalancer.class实现自定义负载均衡算法。下面将为大家剖析HBase负载均衡的相关内容以及性能指标。 内容 HBase系 阅读全文
posted @ 2018-10-13 10:35 大快搜索DKHadoop 阅读(700) 评论(0) 推荐(0)
摘要: 每家公司现在是一个数据公司,在一定范围能够使用机器学习在云中部署智能应用程序,这归功于三个机器学习的趋势:数据飞轮,算法经济,和智能云托管。 阅读全文
posted @ 2018-10-10 13:27 大快搜索DKHadoop 阅读(293) 评论(0) 推荐(0)
摘要: 区块链的兴起,标志着人类开始构建真正可以信任的互联网,通过梳理区块链的兴起和发展可以发现,区块链引人关注之处在于能够在网络中建立点对点之间可靠的信任,使得价值传递过程去除了中介的干扰,而且还公开数据并又未能透露隐私,既起到共同决策又保护个体利益的效果。 阅读全文
posted @ 2018-10-08 09:49 大快搜索DKHadoop 阅读(174) 评论(0) 推荐(0)