- 13 10月, 2020 1 次提交
-
-
由 Chengmo 提交于
* refine fleetrun.ps_launch * update fleet run for multi device support * ps_graph support ps-gpu * fix heter save * add heter save unittest * fix unittest & simple code * update fleetrun * fix fleetrun * fix launch barrier * fix role maker * add paddlecloud rolemaker unittest * rename heter_worker_device_guard
-
- 16 9月, 2020 1 次提交
-
-
由 danleifeng 提交于
* fix ports conflict when launching multi-nodes in paddlecloud;test=develop * add DISTRIBUTED_TRAINER_ENDPOINTS env for cloud;test=develop
-
- 11 8月, 2020 1 次提交
-
-
由 danleifeng 提交于
-
- 10 8月, 2020 1 次提交
-
-
由 danleifeng 提交于
* support multi-ps training mode for fleetrun; test=develop
-
- 07 8月, 2020 1 次提交
-
-
由 danleifeng 提交于
-
- 05 8月, 2020 1 次提交
-
-
由 danleifeng 提交于
* add fleetrun command for distributed running; test=develop
-
- 03 4月, 2020 1 次提交
-
-
由 gongweibao 提交于
-
- 30 3月, 2020 1 次提交
-
-
由 gongweibao 提交于
-
- 09 3月, 2020 1 次提交
-
-
由 gongweibao 提交于
-
- 21 1月, 2020 1 次提交
-
-
由 gongweibao 提交于
-
- 15 1月, 2020 1 次提交
-
-
由 danleifeng 提交于
-
- 14 1月, 2020 1 次提交
-
-
由 danleifeng 提交于
-
- 18 11月, 2019 1 次提交
-
-
由 danleifeng 提交于
-
- 19 9月, 2019 1 次提交
-
-
由 WangXi 提交于
distribute.launch use poll to query subprocess
-
- 20 8月, 2019 1 次提交
-
-
由 danleifeng 提交于
distribute launch : add use_paddlecloud argument
-
- 08 6月, 2019 1 次提交
-
-
由 gongweibao 提交于
-
- 06 6月, 2019 1 次提交
-
-
由 gongweibao 提交于
-