监控资源使用 关注 CPU、内存、GPU 显存、磁盘和网络带宽,避免任务堆积影响体验。 GPU 场景关注显存占用。 CPU 场景关注生成耗时。 多人并发建议升级配置。 推荐配置 GPU 镜像建议按模型大小、显存和并发需求在控制台选择合适规格。 体验验证 适合单人测试工作流和基础模型。
监控资源使用 关注 CPU、内存、GPU 显存、磁盘和网络带宽,避免任务堆积影响体验。 GPU 场景关注显存占用。 CPU 场景关注生成耗时。 多人并发建议升级配置。 推荐配置 GPU 镜像建议按模型大小、显存和并发需求在控制台选择合适规格。 体验验证 适合单人测试工作流和基础模型。
非法侵入系统、非法获取数据等; (6)进行任何改变或试图改变本服务提供的系统配置或破坏系统安全的行为; (7)不可大量占用,且不得导致程序或进程大量占用百度智能云的云计算资源(如云服务器、带宽、存储空间)所组成的平台中服务器的内存、CPU或带宽资源;并给百度智能云其他用户的服务器、网络、产品/应用带来严重的、不合理的负荷,影响百度智能云与互联网、特定网络、内部正常的联系;或导致百度智能云的产品与服务或者其他用户的服务宕机
home/baidu/work/logs/openresty/error.log日志,查看具体的异常信息,如果是端口占用,请关闭服务器上已使用该端口的进程,然后重试;其他无法解决的问题,请联系技术支持。
基于车辆分析模型封装而成的 能够本地化部署的纯软件方案 ,将软件包成功部署在本地服务器(需GPU显卡)上后,启动服务,即可调用与在线API功能基本完全相同的接口(参数有少量区别,请参考接口调用文档)。 本文档主要介绍车辆分析私有化软件包的部署流程 。 前提条件 GPU服务器:车辆分析模型需在GPU服务器上运行,请准备好GPU再提交部署包申请。 获取部署包:部署包的申请、下载,请参考 如何接入 。
规划流程: 根据实际场景进行性能测试,得出单模型实例性能指标(QPS、响应延时、内存占用、显存占用),结合场景高峰流量预估和高可用要求,以及服务器实际显卡数量等计算需要模型应用实例数,根据机器节点硬件资源指标,最终确定硬件节点数。
内存使用率 节点内存资源使用比例。 内存使用量 节点实际占用的内存大小。 磁盘空间使用率 节点磁盘空间已使用比例。 磁盘空间使用量 节点磁盘已占用的存储空间大小。 磁盘IO利用率 磁盘I/O资源使用比例。 数据盘最大使用率 集群内数据盘的最高使用率。 Memory Allocated大小 已分配给服务进程使用的内存大小。 进程文件句柄 Soft 限制数量 进程文件句柄的软限制阈值。
不开启:节点扩容后,即使请求率下降,也不会自动缩容。 开启 自动缩容 后,需要配置以下参数。 配置项 说明 非 GPU 节点的缩容阈值 当非 GPU 类型节点的 CPU、内存资源请求率(单资源请求量÷单资源总量*100%)低于该阈值时,可能会触发自动缩容。默认 50%。 说明:非 GPU 类型节点的 CPU 或内存资源均达到缩容阈值时,才会触发该规则。
目标端云数据库 Redis 实例的存储空间须大于源端云数据库 Redis 实例占用的存储空间。 注意事项 DTS 在执行全量数据迁移时将占用源库和目标库一定的资源,可能会导致数据库服务器负载上升。如果数据库业务量较大或服务器规格较低,可能会加重数据库压力,甚至导致数据库服务不可用。建议您在执行数据迁移前谨慎评估,在业务低峰期执行数据迁移。
且能获取到ip地址 操作系统(64位) CentOS 7及以上、Ubuntu 14/16/18、RedHat 7.2、SUSE 12 网络环境 有线局域网,不支持无线网络 服务端口 8120 端口不能被占用(鉴权服务默认端口),8025/8027(检索服务端口),8103(底库管理端口)