会员
周边
众包
新闻
博问
闪存
赞助商
所有博客
当前博客
我的博客
我的园子
账号设置
简洁模式
...
退出登录
注册
登录
罗西的思考
一手伸向技术,一手伸向生活
博客园
首页
新随笔
联系
订阅
管理
上一页
1
···
6
7
8
9
10
11
12
13
14
···
30
下一页
2021年10月
[源码解析] PyTorch 流水线并行实现 (6)--并行计算
摘要: 前几篇文章我们介绍了 PyTorch 流水线并行的基本知识,自动平衡机制和切分数据,本文我们结合论文内容来看看如何实现并行。
阅读全文
posted @ 2021-10-10 08:18 罗西的思考
阅读(2921)
评论(2)
推荐(0)
编辑
[源码解析] PyTorch 流水线并行实现 (5)--计算依赖
摘要: 前几篇文章我们介绍了 PyTorch 流水线并行的基本知识,自动平衡机制和切分数据等,本文我们结合论文内容来看看如何实现流水线依赖,核心就是如何建立这些小批次之间的跨设备依赖关系。
阅读全文
posted @ 2021-10-07 10:54 罗西的思考
阅读(2458)
评论(4)
推荐(3)
编辑
2021年9月
[源码解析] PyTorch 流水线并行实现 (4)--前向计算
摘要: 前几篇文章我们介绍了 PyTorch 流水线并行的基本知识,自动平衡机制和切分数据,本文我们结合论文内容来看看如何保证前向计算执行顺序。
阅读全文
posted @ 2021-09-28 21:24 罗西的思考
阅读(1344)
评论(0)
推荐(0)
编辑
[源码解析] PyTorch 流水线并行实现 (3)--切分数据和运行时系统
摘要: 前几篇文章我们介绍了 PyTorch 流水线并行的基本知识和自动平衡机制,本文我们介绍如何切分数据和运行时系统。
阅读全文
posted @ 2021-09-26 20:38 罗西的思考
阅读(1376)
评论(2)
推荐(0)
编辑
[源码解析] PyTorch 流水线并行实现 (2)--如何划分模型
摘要: 上一篇文章我们介绍了 PyTorch 流水线并行的基本知识,本文我们介绍其自动平衡机制和模型分割。
阅读全文
posted @ 2021-09-24 16:24 罗西的思考
阅读(1757)
评论(0)
推荐(0)
编辑
[源码解析] PyTorch 流水线并行实现 (1)--基础知识
摘要: 本系列开始介绍PyTorch的流水线并行实现。实质上,PyTorch就是 GPipe 的PyTorch版本。
阅读全文
posted @ 2021-09-22 08:45 罗西的思考
阅读(3876)
评论(0)
推荐(0)
编辑
[源码解析] 深度学习分布式训练框架 horovod (21) --- 之如何恢复训练
摘要: 本文以 PyTorch on Horovod 为切入点,分析一下 Horovod 弹性训练的恢复流程,具体涉及知识点有:ElasticSampler与PyTorch 原生DistributedSampler 的区别,Horovod 弹性训练如何恢复等。
阅读全文
posted @ 2021-09-18 15:47 罗西的思考
阅读(644)
评论(0)
推荐(0)
编辑
[源码解析] 深度学习流水线并行 PipeDream(6)--- 1F1B策略
摘要: 在前文中,我们介绍了PipeDream的总体架构,Profile阶段,计算分区阶段,模型转换阶段,运行时引擎和通信模块,本文是 PipeDream 系列最后一篇,介绍 1F1B 策略,这是 PipeDream 最大的贡献。
阅读全文
posted @ 2021-09-15 16:46 罗西的思考
阅读(5092)
评论(0)
推荐(2)
编辑
[源码解析] 深度学习流水线并行 PipeDream(5)--- 通信模块
摘要: 在前文中,我们介绍了PipeDream的总体架构,Profile阶段,计算分区阶段,模型转换阶段和运行时引擎,本文我们介绍PipeDream 的通信模块,通信模块是引擎的基础,同时也是PyTorch DDP,P2P 如何使用的一个万花筒和完美示例。
阅读全文
posted @ 2021-09-13 10:13 罗西的思考
阅读(1269)
评论(0)
推荐(0)
编辑
[源码解析] 深度学习流水线并行 PipeDream(4)--- 运行时引擎
摘要: 在前文中,我们介绍了PipeDream的总体架构,Profile阶段,计算分区阶段和模型转换阶段,本文我们介绍运行时执行引擎,这是一个统一基础设施层。
阅读全文
posted @ 2021-09-11 09:39 罗西的思考
阅读(937)
评论(0)
推荐(0)
编辑
上一页
1
···
6
7
8
9
10
11
12
13
14
···
30
下一页
公告