上一页 1 ··· 15 16 17 18 19
摘要: 目标: 解决页面加载更多问题。笔记三中,我们只爬取到网页的部分信息,而点击加载更多后的页面内容是没有提取到的。开始我的想法是找到加载更多的数据接口(可参照:http://www.jianshu.com/p/3fdb6ab47aef),但是我又发现一个问题,当我打开一个订阅号页面时,找到数据接口如下图 阅读全文
posted @ 2017-08-02 11:03 半夜打老虎 阅读(3906) 评论(0) 推荐(1)
摘要: 思路:通过笔记(二)中代理的设置,已经可以对YouTube的信息进行爬取了,这几天想着爬取网站下的视频信息。通过分析YouTube,发现可以从订阅号入手,先选择几个订阅号,然后爬取订阅号里面的视频分类,之后进入到每个分类下的视频列表,最后在具体到每一个视频,获取需要的信息。以订阅号YouTube 电 阅读全文
posted @ 2017-07-30 19:10 半夜打老虎 阅读(5580) 评论(0) 推荐(0)
摘要: node爬虫代理设置 最近想爬取YouTube上面的视频信息,利用nodejs爬虫笔记(一)的方法,代码和错误如下 由于国内访问youtube的时候需要FQ,而在代码里我们需要通过设置代理才能获取页面信息。 1、通过nodejs的http/https模块 具体使用可以参考http://nodejs. 阅读全文
posted @ 2017-07-10 20:38 半夜打老虎 阅读(3472) 评论(0) 推荐(0)
摘要: 目标:爬取慕课网里面一个教程的视频信息,并将其存入mysql数据库。以http://www.imooc.com/learn/857为例。 一、工具 1.安装nodejs:(操作系统环境:WiN 7 64位) 在Windows环境下安装相对简单(ps:其他版本我也不太清楚,可以问度娘) http:// 阅读全文
posted @ 2017-07-06 10:50 半夜打老虎 阅读(25105) 评论(2) 推荐(0)
摘要: jQuery 的选择器可谓之强大无比,这里简单地总结一下常用的元素查找方法 $("#myELement") 选择id值等于myElement的元素,id值不能重复在文档中只能有一个id值是myElement所以得到的是唯一的元素 $("div") 选择所有的div标签元素,返回div元素数组 $(" 阅读全文
posted @ 2017-06-28 20:32 半夜打老虎 阅读(933) 评论(0) 推荐(0)
摘要: 本章主要内容: 一、外键 二、表连接 三、子查询 四、索引 一、外键: 1、什么是外键 2、外键语法 3、外键的条件 4、添加外键 5、删除外键 1、什么是外键: 主键:是唯一标识一条记录,不能有重复的,不允许为空,用来保证数据完整性 外键:是另一表的主键, 外键可以有重复的, 可以是空值,用来和其 阅读全文
posted @ 2017-06-26 20:16 半夜打老虎 阅读(530) 评论(0) 推荐(0)
上一页 1 ··· 15 16 17 18 19