06 2021 档案

摘要:Horovod 是Uber于2017年发布的一个易于使用的高性能的分布式训练框架,在业界得到了广泛应用。本系列将通过源码分析来带领大家了解 Horovod。接下来几篇介绍 horovod 如何运行在 spark 之上。本文是第八篇,介绍 horovod on spark 的总体架构。 阅读全文
posted @ 2021-06-30 08:22 罗西的思考 阅读(1160) 评论(0) 推荐(2) 编辑
摘要:Horovod 是Uber于2017年发布的一个易于使用的高性能的分布式训练框架,在业界得到了广泛应用。本系列将通过源码分析来带领大家了解 Horovod。本文是系列第七篇,看看 Horovod 如何与 TensorFlow 融合。 阅读全文
posted @ 2021-06-28 08:06 罗西的思考 阅读(2104) 评论(0) 推荐(0) 编辑
摘要:Horovod 是Uber于2017年发布的一个易于使用的高性能的分布式训练框架,在业界得到了广泛应用。本文是系列第六篇,看看 Horovod 后台线程架构。 阅读全文
posted @ 2021-06-24 07:39 罗西的思考 阅读(1925) 评论(0) 推荐(0) 编辑
摘要:Horovod 是Uber于2017年发布的一个易于使用的高性能的分布式训练框架,在业界得到了广泛应用。本文是系列第五篇,看看 Horovod 如何融合各个机器学习框架。 阅读全文
posted @ 2021-06-21 08:39 罗西的思考 阅读(1885) 评论(0) 推荐(0) 编辑
摘要:Horovod 是Uber于2017年发布的一个易于使用的高性能的分布式训练框架,在业界得到了广泛应用。本系列将通过源码分析来带领大家了解 Horovod。本文是系列第四篇,看看如何获取 host 之间的路由等网络信息。 阅读全文
posted @ 2021-06-17 19:15 罗西的思考 阅读(1377) 评论(0) 推荐(0) 编辑
摘要:Horovod 是Uber于2017年发布的一个易于使用的高性能的分布式训练框架,在业界得到了广泛应用。本系列将通过源码分析来带领大家了解 Horovod。本文是系列第三篇,从 python 开始进入 Horovod 世界,看看 Horovodrun 背后做了什么。 阅读全文
posted @ 2021-06-15 08:22 罗西的思考 阅读(2927) 评论(1) 推荐(0) 编辑
摘要:Horovod 是Uber于2017年发布的一个易于使用的高性能的分布式训练框架,在业界得到了广泛应用。本系列将通过源码分析来带领大家了解 Horovod。系列大约有15 ~ 18 篇,本文是系列第二篇,从用户角度切入 Horovod。 阅读全文
posted @ 2021-06-10 09:16 罗西的思考 阅读(4068) 评论(1) 推荐(0) 编辑
摘要:Horovod 是Uber于2017年发布的一个易于使用的高性能的分布式训练框架,在业界得到了广泛应用。本系列将通过源码分析来带领大家了解 Horovod。系列大约有15 ~ 18 篇,本文是系列第一篇,介绍相关背景知识。 阅读全文
posted @ 2021-06-07 09:33 罗西的思考 阅读(5352) 评论(4) 推荐(0) 编辑
摘要:Facebook Hydra 允许开发人员通过编写和覆盖配置来简化 Python 应用程序(尤其是机器学习方面)的开发。开发人员可以借助Hydra,通过更改配置文件来更改产品的行为方式,而不是通过更改代码来适应新的用例。 阅读全文
posted @ 2021-06-03 19:26 罗西的思考 阅读(2141) 评论(0) 推荐(0) 编辑