会员
周边
新闻
博问
闪存
众包
赞助商
Chat2DB
所有博客
当前博客
我的博客
我的园子
账号设置
会员中心
简洁模式
...
退出登录
注册
登录
费弗里
数据科学玩家
博客园
首页
新随笔
联系
订阅
管理
上一页
1
···
15
16
17
18
19
20
21
22
23
···
26
下一页
2020年2月8日
(数据科学学习手札74)基于geopandas的空间数据分析——数据结构篇
摘要: 本文对应代码已上传至我的Github仓库https://github.com/CNFeffery/DataScienceStudyNotes 1 简介 geopandas是建立在GEOS、GDAL、PROJ等开源地理空间计算相关框架之上的,类似pandas语法风格的空间数据分析Python库,其目标
阅读全文
posted @ 2020-02-08 21:01 费弗里
阅读(21076)
评论(2)
推荐(9)
2020年1月22日
(数据科学学习手札73)盘点pandas 1.0.0中的新特性
摘要: 本文对应脚本及数据已上传至我的 仓库 "https://github.com/CNFeffery/DataScienceStudyNotes" 1 简介 毫无疑问 已经成为基于 的数据分析领域最重要的包,而就在最近, 终于迎来了 1.0.0 版本,对于 来说这是一次更新是里程碑式的,删除了很多旧版本
阅读全文
posted @ 2020-01-22 19:09 费弗里
阅读(1550)
评论(0)
推荐(1)
2020年1月12日
(数据科学学习手札72)用pdpipe搭建pandas数据分析流水线
摘要: 本文对应脚本及数据已上传至我的 仓库 "https://github.com/CNFeffery/DataScienceStudyNotes" 1 简介 在数据分析任务中,从原始数据读入,到最后分析结果出炉,中间绝大部分时间都是在对数据进行一步又一步的加工规整,以流水线(pipeline)的方式完成
阅读全文
posted @ 2020-01-12 16:48 费弗里
阅读(2776)
评论(0)
推荐(1)
2019年11月17日
(数据科学学习手札71)利用Python绘制词云图
摘要: 本文对应脚本及数据已上传至我的 仓库 "https://github.com/CNFeffery/DataScienceStudyNotes" 1 简介 是文本挖掘中用来表征词频的数据可视化图像,通过它可以很直观地展现文本数据中地高频词: 图1 词云图示例 在 中有很多可视化框架可以用来制作词云图,
阅读全文
posted @ 2019-11-17 17:57 费弗里
阅读(3877)
评论(4)
推荐(5)
2019年11月8日
(数据科学学习手札70)面向数据科学的Python多进程简介及应用
摘要: 本文对应脚本已上传至我的 仓库 "https://github.com/CNFeffery/DataScienceStudyNotes" 一、简介 进程是计算机系统中资源分配的最小单位,也是操作系统可以控制的最小单位,在数据科学中很多涉及大量计算、CPU密集型的任务都可以通过多进程并行运算的方式大幅
阅读全文
posted @ 2019-11-08 19:40 费弗里
阅读(1158)
评论(0)
推荐(0)
2019年9月5日
(数据科学学习手札69)详解pandas中的map、apply、applymap、groupby、agg
摘要: *从本篇开始所有文章的数据和代码都已上传至我的github仓库:https://github.com/CNFeffery/DataScienceStudyNotes 一、简介 pandas提供了很多方便简洁的方法,用于对单列、多列数据进行批量运算或分组聚合运算,熟悉这些方法后可极大地提升数据分析的效
阅读全文
posted @ 2019-09-05 21:59 费弗里
阅读(9869)
评论(0)
推荐(5)
2019年9月3日
(数据科学学习手札68)pandas中的categorical类型及应用
摘要: 一、简介 categorical是pandas中对应分类变量的一种数据类型,与R中的因子型变量比较相似,例如性别、血型等等用于表征类别的变量都可以用其来表示,本文就将针对categorical的相关内容及应用进行介绍。 二、创建与应用 2.1 基本特性和适用场景 在介绍具体方法之前,我们需要对pan
阅读全文
posted @ 2019-09-03 19:27 费弗里
阅读(8387)
评论(0)
推荐(4)
2019年9月2日
(数据科学学习手札67)使用Git管理Github仓库
摘要: 一、简介 Git是目前使用最广泛的分布式版本控制系统,通过Git可以方便高效地管理掌握工作过程中项目内容文件的更新变化情况,通过Git我们可以以命令行的形式完成对Github上开源仓库的clone,以及对自己仓库的管理,本文就将针对使用Git管理Github远程仓库的基本方法进行介绍。 二、通过Gi
阅读全文
posted @ 2019-09-02 16:14 费弗里
阅读(545)
评论(0)
推荐(1)
2019年8月9日
(数据科学学习手札66)在ubuntu服务器上部署shiny
摘要: 一、简介 shiny是R中专门用于开发轻量级web应用的框架,在本地写一个shiny应用并调用非常方便,但如果你希望你的shiny应用能够以远程的方式提供给更多人来使用,就需要将写好的shiny应用部署到服务器上,主要有两种方式,第一种是将shiny应用发布在shinyapps上,第二种是将你的sh
阅读全文
posted @ 2019-08-09 16:43 费弗里
阅读(1878)
评论(0)
推荐(0)
2019年8月6日
实用的Python(2)利用Python制作gif动图
摘要: 一、简介 moviepy是一个专门用于视频剪辑制作的模块,可以自动化完成很多繁琐的视频剪辑处理工作,除了处理视频数据之外,moviepy中还内置了可以制作gif动图的功能,通过使用moviepy.editor中的ImageSequenceClip,可以以自动化的方式批量生成指定参数要求的gif动图,
阅读全文
posted @ 2019-08-06 21:17 费弗里
阅读(6508)
评论(0)
推荐(1)
上一页
1
···
15
16
17
18
19
20
21
22
23
···
26
下一页
公告