首页
百度胜算提供首页模块,以场景化方式展示核心能力推荐使用路径,帮助您快速使用产品。
概述
登录百度胜算控制台并进入工作空间后,默认进入首页。首页分为平台核心能力区与快速上手引导区两大板块,用于快速了解平台能力、熟悉完整业务流程、快捷创建前置资源。
首页主要用于功能导航,不替代各功能模块的配置页面。单击场景卡片中的立即前往,可进入对应功能页面继续操作。
平台核心能力区
首页顶部展示百度胜算数据智能平台的三项核心能力,帮助您快速了解平台定位。
表1 平台核心能力说明
| 核心能力 |
说明 |
| 本体构建,智备Agent决策 |
搭建多类业务文件夹完成前期准备,统一归档各类型数据模型,为Agent智能决策筑牢基础。 |
| 全域多模态,一站式治理 |
一站式多模态数据治理,覆盖采集、处理、血缘、质检、检索全流程,统一治理结构化与非结构化数据。 |
| 结构化湖仓,一体化治理 |
标准化管理结构化数据,集成建模、采集、开发能力,实现质量血缘统一治理。 |
快速上手引导区
该区域与平台核心能力区域联动,基于选定的核心能力卡片,展示对应业务的完整执行链路与初始化快捷入口,指引您完成从资源准备到业务落地的全流程操作。
本体构建,智备Agent决策
选中该卡片,左侧业务流程导航将展示本体构建完整业务链路:准备工作>数据采集>本体建模 >数据处理>数据治理>智能分析。
- 准备工作:完成业务顶层资源初始化。右侧提供创建项目、创建采集文件夹、创建本体文件夹、创建处理文件夹、创建逻辑建模文件夹、创建数据搜索文件夹的快捷入口,帮助您完成项目与各类业务文件夹创建,用于分类存放任务、本体模型、逻辑建模文件、检索相关资源。
| 卡片名称 |
说明 |
| 创建项目 |
用于存放文件及团队协作的项目组。 |
| 创建采集文件夹 |
用于存放采集任务的文件夹。 |
| 创建本体文件夹 |
用于存放本体模型的文件夹。 |
| 创建处理文件夹 |
用于存放数据处理脚本及任务的文件夹。 |
| 创建逻辑建模文件夹 |
用于存放逻辑建模文件的文件夹。 |
| 创建数据搜索文件夹 |
用于存放数据搜索文件的文件夹。 |
- 数据采集:完成业务原始数据接入。右侧提供源连接与集成实例、数据源、文件离线采集、库表离线采集、库表实时采集的快捷入口,将业务结构化、非结构化原始数据接入平台结构化数据集/媒体集。
| 卡片名称 |
说明 |
| 源连接与集成实例 |
用于数据采集任务的计算资源。 |
| 数据源 |
配置数据采集所需的数据源连接。 |
| 文件离线采集 |
非结构化数据离线采集存入媒体集。 |
| 库表离线采集 |
结构化数据离线采集存入结构化数据集。 |
| 库表实时采集 |
结构化数据实时采集存入结构化数据集。 |
- 本体建模:定义本体业务模型与检索服务。右侧提供分析与AI搜索实例、通用常驻实例、Object Type、Link Type、Action Type、逻辑建模、数据搜索的快捷入口。
| 卡片名称 |
说明 |
| 分析与AI搜索实例 |
用于存储本体数据及支持多模态检索的实例。 |
| 通用常驻实例 |
用于支撑本体查询服务的计算资源。 |
| Object Type |
维护本体的Object Type。 |
| Link Type |
维护本体的Link Type。 |
| Action Type |
维护本体的Action Type。 |
| 逻辑建模 |
构建由大模型驱动,并与本体数据深度融合的业务逻辑服务。 |
| 数据搜索 |
基于本体模型,配置支持全文、向量、标量的检索服务。 |
- 数据处理:开展数据解析与加工。右侧提供数据处理实例、通用常驻实例、内容理解、数据管道的快捷入口;
| 卡片名称 |
说明 |
| 数据处理实例 |
创建Spark引擎的计算资源,用于处理结构化、非结构化数据。 |
| 通用常驻实例 |
用于支撑内容理解服务的计算资源。 |
| 内容理解 |
用于PDF、Excel、Markdown、图片等文件的内容解析及提取。 |
| 数据管道 |
处理结构化数据集、媒体集的数据,输出至结构化数据集或Object Type。 |
- 数据治理:完成数据质量与血缘管理。右侧提供数据质量、数据血缘的快捷入口。
| 卡片名称 |
说明 |
| 数据质量 |
监控结构化数据集、媒体集的质量,质量任务在工作流中调度。 |
| 数据血缘 |
解析并展示结构化数据集、媒体集的处理过程,包括数据采集、数据管道、本体模型、逻辑模型、数据搜索的全链路血缘关系。 |
- 智能分析:业务 Agent 能力落地。右侧提供DataAgent的快捷入口。基于已建好的本体模型,实现数据查询、业务分析、数据探索与Agent智能决策。
| 卡片名称 |
说明 |
| Data Agent |
基于本体的数据查询、分析、探索与决策。 |
全域多模态,一站式治理
选中该卡片,左侧业务流程导航将展示全域多模态完整业务链路:准备工作>数据采集>数据处理>多模态检索>数据治理。
- 准备工作:完成多模态业务顶层资源初始化。右侧提供创建项目、创建采集文件夹、创建处理文件夹、创建 Catalog的快捷入口,帮助您完成项目、文件夹与 Catalog 创建,用于存放协作文件、采集任务、处理脚本、结构化/非结构化数据资源。
| 卡片名称 |
说明 |
| 创建项目 |
用于存放文件及团队协作的项目组。 |
| 创建采集文件夹 |
用于存放采集任务的文件夹。 |
| 创建处理文件夹 |
用于存放数据处理脚本及任务的文件夹。 |
| 创建 Catalog |
创建用于管理结构化数据表、非结构化数据卷、数据集、算子、模型的数据 Catalog。 |
- 数据采集:完成多模态原始数据接入。右侧提供源连接与集成实例、数据源、文件离线采集、库表离线采集、库表实时采集的快捷入口,完成结构化、非结构化原始数据接入。
| 卡片名称 |
说明 |
| 源连接与集成实例 |
用于数据采集任务的计算资源。 |
| 数据源 |
配置数据采集所需的数据源连接。 |
| 文件离线采集 |
非结构化数据离线采集存入 Catalog 下的数据卷。 |
| 库表离线采集 |
结构化数据离线采集存入 Catalog 下的数据表。 |
| 库表实时采集 |
结构化数据实时采集存入 Catalog 下的数据表。 |
- 数据处理:开展多模态数据解析、加工、向量化。右侧提供数据处理实例、分析与 AI 搜索实例、Notebook 开发、SQL 开发、开发机、工作流的快捷入口。
| 卡片名称 |
说明 |
| 数据处理实例 |
创建 Spark、Ray 引擎的计算资源,用于处理结构化、非结构化数据。 |
| 分析与 AI 搜索实例 |
创建用于存储向量、全文、标量多模态数据的计算资源。 |
| Notebook 开发 |
编写 SQL、Python 语言,对结构化、非结构化数据进行处理。 |
| SQL 开发 |
连接结构化数据源,编写 SQL 查询、处理语句。 |
| 开发机 |
提供自定义算子、Python、R、Shell、Spark 的开发环境。 |
| 工作流 |
编排调度数据采集、非结构化处理算子、Notebook、SQL、R、Python、Spark、数据质量等组件。 |
- 多模态检索:实现向量、全文、标量多模态检索能力。右侧提供分析与 AI 搜索实例、Notebook 开发快捷入口。
| 卡片名称 |
说明 |
| 分析与 AI 搜索实例 |
创建用于存储向量、全文、标量多模态数据的计算资源。 |
| Notebook 开发 |
编写多模态检索代码,对搜索实例、Catalog 下的 Lance 表数据进行多模态检索。 |
- 数据治理:完成多模态数据质量与血缘管理。右侧提供数据质量、数据血缘的快捷入口。
| 卡片名称 |
说明 |
| 数据质量 |
监控 Catalog 下数据表、数据卷的质量。 |
| 数据血缘 |
解析并展示数据表、数据卷的处理过程,包括数据采集、Notebook、SQL、工作流全链路的数据血缘。 |
结构化湖仓,一体化治理
选中该卡片,左侧业务流程导航将展示结构化湖仓完整业务链路:准备工作 > 数据架构 > 数据采集 > 数据处理 > 数据治理 > 数据服务。
- 准备工作:完成湖仓业务顶层资源初始化。右侧提供创建项目、创建采集文件夹、创建处理文件夹、创建 Catalog的快捷入口,完成项目、业务文件夹、数据 Catalog 初始化。
| 卡片名称 |
说明 |
| 创建项目 |
用于存放文件及团队协作的项目组。 |
| 创建采集文件夹 |
用于存放采集任务的文件夹。 |
| 创建处理文件夹 |
用于存放数据处理脚本及任务的文件夹。 |
| 创建 Catalog |
创建用于管理结构化数据表的数据 Catalog。 |
- 数据架构:完成业务主题、指标、模型的定义。右侧提供主题设计、数据标准、数据指标、数据建模快捷入口。
| 卡片名称 |
说明 |
| 主题设计 |
自定义业务主题。 |
| 数据标准 |
建立全局统一的数据标准,收敛至模型。 |
| 数据指标 |
支持原子、衍生、复合指标,收敛至模型。 |
| 数据建模 |
可视化管理数仓模型,支持物化、逆向。 |
- 数据采集:结构化业务数据接入湖仓。右侧提供源连接与集成实例、数据源、库表离线采集、库表实时采集快捷入口。
| 卡片名称 |
说明 |
| 源连接与集成实例 |
用于数据采集任务的计算资源。 |
| 数据源 |
配置数据采集所需的数据源连接。 |
| 库表离线采集 |
结构化数据离线采集存入 Catalog 下的数据表。 |
| 库表实时采集 |
结构化数据实时采集存入 Catalog 下的数据表。 |
- 数据处理:结构化数据加工与计算。右侧提供创建数据处理实例、Notebook 开发、SQL 开发、工作流快捷入口。
| 卡片名称 |
说明 |
| 创建数据处理实例 |
创建 Spark 引擎的计算资源,用于处理结构化数据。 |
| Notebook 开发 |
编写 SQL 语言,对结构化数据进行处理。 |
| SQL 开发 |
连接结构化数据源,编写 SQL 查询、处理语句。 |
| 工作流 |
编排调度数据采集、Notebook、SQL、Spark、数据质量等组件。 |
- 数据治理:湖仓数据质量、血缘运维。右侧提供数据质量、数据血缘快捷入口。
| 卡片名称 |
说明 |
| 数据质量 |
监控 Catalog 下数据表、数据卷的质量。 |
| 数据血缘 |
解析并展示数据表、数据卷的处理过程,包括数据采集、Notebook、SQL、工作流全链路的数据血缘。 |
- 数据服务:对外输出湖仓数据能力。右侧提供服务管理的快捷入口。
| 卡片名称 |
说明 |
| 服务管理 |
将高质量数据生成数据服务。 |
使用建议
- 首次使用平台时,建议按照准备工作、数据采集、本体建模、数据处理、数据治理、智能分析的顺序了解各阶段能力。
- 已明确目标功能时,可直接选择对应阶段并单击立即前往,无需依次完成所有阶段。
- 创建采集或处理任务前,先确认计算实例、数据源和网络连接已准备完成。
- 配置本体模型前,建议先明确业务对象、唯一标识、属性和对象关系。
- 生产环境中执行数据采集、处理或删除操作前,请核对目标资源和影响范围。
- 首页仅提供功能导航;具体参数、权限和限制请参见目标功能的操作指南。