打赏
摘要: 不多说,直接上干货! 注意: 具体,见 Spark Mllib机器学习实战的第4章 Mllib基本数据类型和Mllib数理统计 阅读全文
posted @ 2017-09-02 21:36 大数据和AI躺过的坑 阅读(569) 评论(0) 推荐(0) 编辑
摘要: 不多说,直接上干货! 具体,见 Spark Mllib机器学习实战的第4章 Mllib基本数据类型和Mllib数理统计 阅读全文
posted @ 2017-09-02 21:24 大数据和AI躺过的坑 阅读(525) 评论(0) 推荐(0) 编辑
摘要: 不多说,直接上干货! 问题详解 解决办法 是 阅读全文
posted @ 2017-09-02 16:08 大数据和AI躺过的坑 阅读(911) 评论(0) 推荐(0) 编辑
摘要: 不多说,直接上干货! 问题详解 相关博客是 Zeppelin的入门使用系列之使用Zeppelin运行shell命令(二) 解决办法 是 阅读全文
posted @ 2017-09-02 16:06 大数据和AI躺过的坑 阅读(1326) 评论(0) 推荐(0) 编辑
摘要: 不多说,直接上干货! 前期博客 Zeppelin的入门使用系列之使用Zeppelin来创建临时表UserTable(三) 1、 运行年龄统计的Spark SQL (1) 输入Spark SQL时,必须在第一行输入%sql 。 %sql主要是告诉Zeppelin的解释器(Interpreter),后续 阅读全文
posted @ 2017-09-02 15:37 大数据和AI躺过的坑 阅读(7149) 评论(0) 推荐(0) 编辑
摘要: 不多说,直接上干货! 前期博客 Zeppelin的入门使用系列之使用Zeppelin运行shell命令(二) 我们必须要先使用Spark 语句创建临时表UserTable,后续才能使用Spark SQL进行数据分析以及数据可视化。 1、加载用户数据文件到userText 2、创建UserTable类 阅读全文
posted @ 2017-09-02 15:22 大数据和AI躺过的坑 阅读(2393) 评论(0) 推荐(0) 编辑
摘要: 不多说,直接上干货! 前期博客 Zeppelin的入门使用系列之创建新的Notebook(一) 接下来,我将以ml-100k数据集,示范如何使用Spark SQL进行数据分析与数据可视化 因为 得到 列出ml-100k文件列表 然后,在ml-100k Notebook新的段落中输入命令,如下 Zep 阅读全文
posted @ 2017-09-02 10:42 大数据和AI躺过的坑 阅读(4043) 评论(0) 推荐(0) 编辑