移出节点组的节点,默认会减少节点组期望节点数,您可以取消勾选同时减少节点组期望节点数,取消勾选节点组会通过继续扩容来维持当前期望实例数量,但不包含移出失败、删除失败的节点。 如果节点上存在Pod需要驱逐,需要勾选 进行节点排水 。但是,节点上由 DaemonSet 管理的 Pod 不会被排水。 移出异常状态的节点请不要勾选 进行节点排水 ,否则可能导致移出失败。
使用本地存储 emptyDir emptyDir 类型的 Volume 在 Pod 分配到 Node 上时被创建,Kubernetes 会在 Node 上自动分配一个目录,因此无需指定宿主机 Node 上对应的目录文件,这个目录的初始内容为空。 说明 当 Pod 从 Node 上移除时,emptyDir 中的数据会被永久删除。
最大训练时长:指定允许的最大训练时长,若不指定,则为不限制时间。 私有仓库凭证:若需要使用私有镜像仓库,请在此处添加对应镜像仓库的访问凭证。 Tensorboard:若需要任务可视化时,可开启Tensorboard功能,开启后需要指定“服务类型”与“ 训练日志读取路径”。 K8S标签:指定任务对应的K8S Label。 注释:指定任务对应的Annotation。
网络配置 节点配置 节点是构成集群的单一服务器资源,支持CPU、GPU多种类型可供选择,后续您创建的业务应用所需要的容器将会分布到各个节点上,构建高可用环境。 配置说明: 操作系统支持由百度智能云配置过的集成GPU驱动版系统,如果用户在自己的BCC中创建了GPU自定义镜像的话,镜像是支持GPU自定义镜像,用户如果使用自定义镜像需要 手动设置集成GPU驱动 。
ClusterIP 网段 是 规划 Service 地址段,避免与现有网段冲突。 LB Service 子网 必选 指定创建负载均衡类型 Service 及 Ingress 时默认使用的子网,不能选择 NAT 子网。 LB Service 子网 是 选择用于负载均衡 Service 与 Ingress 的子网。 弹性网卡安全组 必选 指定为弹性网卡绑定的安全组。
注意:支持添加的节点数量受集群规模限制。 重装操作系统 必选 重装操作系统,将对所选的实例进行操作系统重装,会清除系统盘内数据且不可恢复(云磁盘数据不受影响)。 注意 :添加节点不重装操作系统,服务器实例上的旧数据可能会导致节点添加失败或出现其它问题,推荐选择重装操作系统。 已选节点 必选 支持为已选择的节点配置重装操作系统或使用已有配置直接加入集群,当前示例选择“重装操作系统”。
集群排队任务数、集群调度总任务数、集群Pending Pod数、集群任务排队率。
集群规模 最大管理节点数 推荐最大Pod数 推荐最大Service数 推荐最大ConfigMap数 推荐最大Secret数 推荐最大PV数 推荐最大PVC数 推荐最大CRD数 L50 50 1500 100 300 300 250 250 1000 L200 200 6000 400 1200 1200 1000 1000 4000 L500 500 15000 1000 3000 3000 2500
quot;, 82 "suggestion": "检查副本数异常工作负载,排除异常原因,更新副本数。
Orderer节点数:选择Orderer节点数,最大值为所选集群的最大节点数。 Peer节点数:选择Peer节点数,最大值为所选集群的最大节点数。 上述步骤完成后,用户可以选择“直接部署”进行Fabric网络部署,或者选择“下一步”进入配置智能合约页。