01 2023 档案

摘要:【博学谷IT技术支持】 一、介绍 进程:进程是资源分配最小单位;进程之间的资源是独立的;进程有自己独立的地址空间,每启动一个进程,系统都会为其分配地址空间;进程是可以并行执行的计算;一个程序可以执行多个进程,一个进程也可以执行多个程序; 线程:线程是程序执行的最小单位。一个进程有多个线程组成;线程没 阅读全文
posted @ 2023-01-30 09:12 牛牛牛牛牛牛牛牛 阅读(33) 评论(0) 推荐(0) 编辑
摘要:【博学谷IT技术支持】 目的: 抓取网站文字 一、使用到的python库 requests库 // 安装 pip install requests // 导入 import requests // header headers = {'user-agent': 'my-app/0.0.1'} r = 阅读全文
posted @ 2023-01-21 21:26 牛牛牛牛牛牛牛牛 阅读(15) 评论(0) 推荐(0) 编辑
摘要:Spark是一种快速、通用、可扩展的大数据分析引擎,2009年诞生,2010年开源,2013年成为Apache孵化项目,2014年成为Apache顶级项目。目前,Spark生态系统已经发展成为一个包含多个子项目的集合,其中包含SparkSQL、Spark Streaming、GraphX、MLlib等子项目,Spark是基于内存计算的大数据并行计算框架。Spark基于内存计算,提高了在大数据环境下数据处理的实时性,同时保证了高容错性和高可伸缩性,允许用户将Spark部署在大量廉价硬件之上,形成集群。PySpark 是 Spark 为 Python 开发者提供的 API 阅读全文
posted @ 2023-01-15 23:20 牛牛牛牛牛牛牛牛 阅读(87) 评论(0) 推荐(0) 编辑

点击右上角即可分享
微信分享提示