RuntimeError: Distributed package doesn‘t have NCCL built in

这篇具有很好参考价值的文章主要介绍了RuntimeError: Distributed package doesn‘t have NCCL built in。希望对大家有所帮助。如果存在错误或未考虑完全的地方,请大家不吝赐教,您也可以点击"举报违法"按钮提交疑问。

项目场景:

提示:这里简述项目相关背景:

Improved Diffusion 复现


问题描述

提示:这里描述项目中遇到的问题:

RuntimeError: Distributed package doesn’t have NCCL built in

  File "D:\APP\Anaconda3\envs\diffusion\lib\site-packages\torch\distributed\distributed_c10d.py", line 602, in init_process_group
    default_pg = _new_process_group_helper(
  File "D:\APP\Anaconda3\envs\diffusion\lib\site-packages\torch\distributed\distributed_c10d.py", line 727, in _new_process_group_helper
    raise RuntimeError("Distributed package doesn't have NCCL " "built in")
RuntimeError: Distributed package doesn't have NCCL built in

原因分析:

提示:这里填写问题的分析:

windows不支持NCCL backend


解决方案:

提示:这里填写该问题的具体解决方案:

找到问题代码所在位置
D:\APP\Anaconda3\envs\diffusion\lib\site-packages\torch\distributed\distributed_c10d.py

    dist.init_process_group(backend=backend, init_method="env://")

更换为

    dist.init_process_group(backend="gloo", init_method="env://")

即可文章来源地址https://www.toymoban.com/news/detail-595601.html

到了这里,关于RuntimeError: Distributed package doesn‘t have NCCL built in的文章就介绍完了。如果您还想了解更多内容,请在右上角搜索TOY模板网以前的文章或继续浏览下面的相关文章,希望大家以后多多支持TOY模板网!

本文来自互联网用户投稿,该文观点仅代表作者本人,不代表本站立场。本站仅提供信息存储空间服务,不拥有所有权,不承担相关法律责任。如若转载,请注明出处: 如若内容造成侵权/违法违规/事实不符,请点击违法举报进行投诉反馈,一经查实,立即删除!

领支付宝红包 赞助服务器费用

相关文章

觉得文章有用就打赏一下文章作者

支付宝扫一扫打赏

博客赞助

微信扫一扫打赏

请作者喝杯咖啡吧~博客赞助

支付宝扫一扫领取红包,优惠每天领

二维码1

领取红包

二维码2

领红包