视频按场景切分 简介 视频按场景切分算子,用 scenedetect 检测场景切换并把视频切分为多个片段。 功能描述 • 支持 ContentDetector / AdaptiveDetector / ThresholdDetector 三种场景检测器,可通过 **kwargs 透传各检测器专属参数。
视频美学评分(DOVER) 简介 DOVER 视频美学质量评分算子,复用 DOVER 官方美学分支(aesthetic branch),对输入视频输出 0-9 分的美学质量分数。用于 SILA §5 步骤 ④ 视频美学质量过滤。 功能描述 • 从视频中按 num_clips × num_frames_per_clip 均匀采样帧,送入 DOVER 美学分支推理。
视频二元瑕疵标注 简介 视频二元瑕疵标注算子,基于 QwenVL 多模态大模型 + 结构化 JSON prompt 对视频做多标签二值打标(每个 artifact 标签输出 0/1),是 SILA 自训 tagger 的冷启动版。用于 SILA §5 步骤 ④ 100 binary tags 过滤。
视频全身姿态估计 简介 视频全身 2D 关键点估计算子,用 DWPose(ONNX:yolox_l 检测 + dw-ll_ucoco_384 姿态)对视频抽帧估计全身关键点(body/hands/faces/foot)。离线 GPU 运行(CPU 亦可,慢)。 功能描述 • 从视频均匀抽取 frame_num 帧(BGR),用 DWPose 逐帧推理全身关键点。
登录/注册 个人中心 消息中心 退出登录 1 百度千帆视频 AI 笔记插件五大研究方向:技术深化与场景拓展 AI原生应用开发 / 技术交流 百度AI插件 2025.12.17 49117 看过 百度千帆视频 AI 笔记插件作为连接视频内容与知识沉淀的核心工具,依托千帆大模型的多模态能力与企业级技术底座,已实现 “视频内容提取 - 笔记智能生成 - 格式多样化导出” 的核心闭环,在备考、网课学习、
视频按时间戳切分 简介 视频时间戳切分处理器,支持按指定时间范围分割 功能描述 按给定的时间戳区间切分视频 支持片段二进制输出或BOS存储 提供格式自动推断与自定义 MP4 (.mp4) AVI (.avi) MOV (.mov) MKV (.mkv) 其他常见视频格式 算子参数 输入 输入 含义 video_paths 包含输入视频路径的数组 默认值:None video_binaries 包含视频二进制数据的数组
名词解释 推流 将本地视频源和音频源推送到百度直播云服务器 拉流 即直播播放,指已实现直播推流之后,用指定地址将百度云服务器中的视频源和音频源拉取播放的过程。其视频源是实时生成的,而实时直播在播视频的时候是没有进度条的。 推流域名 指用于推送直播流的域名,必选配置,该域名必须在使用直播服务前完成注册并备案。配置完推流域名后,直播服务会生成对应的推流地址。
名词解释 流媒体上下文(Streaming Context) 包含时间线、预览窗口、采集、资源包管理等相关信息集合的对象,Context被销毁之后,SDk视频制作框架也随之不复存在。 采集(Capture) 捕获摄像头设备画面。 录制(Record) 输出采集画面到指定格式文件中。 动画贴纸(Animated Sticker) 带有动画效果的贴纸,叠加在视频上产生一些特殊效果。
登录/注册 个人中心 消息中心 退出登录 百度千帆视频 AI 笔记组件:技术架构解析与开发者落地实践 AI原生应用开发 / 技术交流 百度AI插件 2025.12.12 36855 看过 在企业培训、会议记录、知识管理等场景中,视频内容的高效转化与结构化提取长期是行业痛点。传统人工整理视频笔记不仅耗时耗力,还易遗漏关键信息、出现理解偏差。
视频手部重建(HaWoR) 简介 视频 3D 手部重建算子,对视频重建双手 3D 位姿,并直接产出下游 HandActionCompute 可消费的 hand_pose_seq ,闭合「人类视频 → 动作」链路。离线 GPU 运行。 功能描述 • 从视频均匀抽取 frame_num 帧,用 MoGe-2 估计 FoV 换算 img_focal,用 YOLO 检测器做手部检测与跟踪。