摘要: 1. 基本信息 这个项目属于哪个课程 https://edu.cnblogs.com/campus/fzu/2023DataCollectionandFusiontechnology 组名、项目简介 组名为冲就完事项目需求与目标:当我们置身于日常生活或旅途中,常会被美景所震撼,但往往难以找到合适的诗 阅读全文
posted @ 2023-12-14 23:04 困困困zzz 阅读(27) 评论(0) 推荐(0) 编辑
摘要: 作业① 要求: 熟练掌握 Selenium 查找 HTML 元素、爬取 Ajax 网页数据、等待 HTML 元素等内 容。 使用 Selenium 框架+ MySQL 数据库存储技术路线爬取“沪深 A 股”、“上证 A 股”、 “深证 A 股”3 个板块的股票数据信息。 候选网站:东方财富网http 阅读全文
posted @ 2023-11-09 00:36 困困困zzz 阅读(34) 评论(4) 推荐(2) 编辑
摘要: 作业① 要求:指定一个网站,爬取这个网站中的所有的所有图片,例如:中国气象网(http://www.weather.com.cn)。使用scrapy框架分别实现单线程和多线程的方式爬取。 –务必控制总页数(学号尾数2位)、总下载的图片数量(尾数后3位)等限制爬取的措施。 输出信息 将下载的Url信息 阅读全文
posted @ 2023-10-31 13:44 困困困zzz 阅读(44) 评论(0) 推荐(0) 编辑
摘要: 作业① 要求:在中国气象网(http://www.weather.com.cn)给定城市集的7日天气预报,并保存在数据库。 输出信息 Gitee 文件夹链接为:https://gitee.com/zjy-w/crawl_project/tree/master/作业2/1 (1)代码 from bs4 阅读全文
posted @ 2023-10-17 00:13 困困困zzz 阅读(22) 评论(0) 推荐(1) 编辑
摘要: 作业① 要求:用requests和BeautifulSoup库方法定向爬取给定网址(http://www.shanghairanking.cn/rankings/bcur/2020 )的数据,屏幕打印爬取的大学排名信息。 输出信息 排名 学校名称 省市 学校类型 总分 1 清华大学 北京 综合 85 阅读全文
posted @ 2023-09-27 00:14 困困困zzz 阅读(20) 评论(0) 推荐(0) 编辑
摘要: 学号是102102107; 我是张锦瑶; 我的爱好是绘画; 我在福大食堂中最喜欢的一道菜应该是漳州风味小吃(紫荆二楼); 我目前最喜欢的一首歌是沙文; 一句想说的话:希望每天都快乐。 阅读全文
posted @ 2023-09-22 23:53 困困困zzz 阅读(20) 评论(1) 推荐(0) 编辑