华为云AI开发平台ModelArts日志提示“no socket interface found”_云淘科技
问题现象 在pytorch镜像运行分布式作业时,设置NCCL日志级别,代码如下: import os os.environ[“NCCL_DEBUG”] = “INFO” 会出现如下错误: 图1 错误日志 原因分析 可能原因如下: 原因1:未…
共1项
问题现象 在pytorch镜像运行分布式作业时,设置NCCL日志级别,代码如下: import os os.environ[“NCCL_DEBUG”] = “INFO” 会出现如下错误: 图1 错误日志 原因分析 可能原因如下: 原因1:未…