50_集合_MapReduce
说明:
* 1.map使用高级函数时,注意map的元素类型为二元元组 tp:(dataType,dataType)
* 2.map没有排序函数,如果要排序,必须先转成list
*
* */
/* * 说明: * 1.map使用高级函数时,注意map的元素类型为二元元组 tp:(dataType,dataType) * 2.map没有排序函数,如果要排序,必须先转成list * * */ object MapReduce extends App { //1. 准备数据 val txtList = List("Hello Scala Hbase kafka" , "Hello Scala Hbase" , "Hello Scala" , "Hello") //2. 切分数据 - map def splitRule(e: String) = { e.split(" ") } var list1: Seq[Array[String]] = txtList.map(_.split(" ")) println(list1) //3. 将数据拉平 - flatten var list2: Seq[String] = list1.flatten println(list2) //4. 切分 + 拉平 - flatMap var list3: List[String] = txtList.flatMap(splitRule) println(list3) //5. 分组 - group var list4: Map[String, List[String]] = list3.groupBy(word => word) println(list4) //6. 计数 def countRule(kv: (String, List[String])) = { (kv._1, kv._2.length) } var list5: Map[String, Int] = list4.map(countRule _) var list6: Map[String, Int] = list4.map(kv => (kv._1, kv._2.length)) println(list5) println(list6) //7. 排序 var list7 = list6.toList.sortBy(_._2).reverse.take(3) println(list7) }
【推荐】国内首个AI IDE,深度理解中文开发场景,立即下载体验Trae
【推荐】编程新体验,更懂你的AI,立即体验豆包MarsCode编程助手
【推荐】抖音旗下AI助手豆包,你的智能百科全书,全免费不限次数
【推荐】轻量又高性能的 SSH 工具 IShell:AI 加持,快人一步
· 10年+ .NET Coder 心语,封装的思维:从隐藏、稳定开始理解其本质意义
· .NET Core 中如何实现缓存的预热?
· 从 HTTP 原因短语缺失研究 HTTP/2 和 HTTP/3 的设计差异
· AI与.NET技术实操系列:向量存储与相似性搜索在 .NET 中的实现
· 基于Microsoft.Extensions.AI核心库实现RAG应用
· 10年+ .NET Coder 心语 ── 封装的思维:从隐藏、稳定开始理解其本质意义
· 地球OL攻略 —— 某应届生求职总结
· 提示词工程——AI应用必不可少的技术
· 字符编码:从基础到乱码解决
· SpringCloud带你走进微服务的世界