2.安装Spark与Python练习

------------恢复内容开始------------

一、安装Spark

  • 检查基础环境hadoop,jdk

  • 下载spark

  • 解压,文件夹重命名、权限

  • 配置文件

 

 

 

 

  • 环境变量

 

 

 

  • 试运行Python代码

 

 

 

 

 

 

 

二、Python编程练习:英文文本的词频统计

  • 准备文本文件

 

 

  • 读文件

  • 预处理:大小写,标点符号,停用词,分词

 

  • 按词频大小排序,统计每个单词出现的次数

 

 

 

 

 

 

 

 

------------恢复内容结束------------

posted @   xun_11  阅读(23)  评论(0编辑  收藏  举报
相关博文:
阅读排行:
· TypeScript + Deepseek 打造卜卦网站:技术与玄学的结合
· 阿里巴巴 QwQ-32B真的超越了 DeepSeek R-1吗?
· 【译】Visual Studio 中新的强大生产力特性
· 10年+ .NET Coder 心语 ── 封装的思维:从隐藏、稳定开始理解其本质意义
· 【设计模式】告别冗长if-else语句:使用策略模式优化代码结构
点击右上角即可分享
微信分享提示