其中一些因素可以由用户控制,而其它的则属于系统下层设计的基本原理。本章我们提供一些有关理解和调节PalopgSQL性能的提示。 PalopgSQL为每个收到查询产生一个 查询计划 。 选择正确的计划来匹配查询结构和数据的属性对于好的性能来说绝对是最关键的,因此系统包含了一个复杂的 优化器 来尝试选择好的计划。可以使用 EXPLAIN 命令察看优化器为任何查询生成的查询计划。
基本原理 在使用 Stream Load 时,需要通过 HTTP 协议发起导入作业给 FE 节点,FE 会以轮询方式,重定向(redirect)请求给一个 BE 节点以达到负载均衡的效果。也可以直接发送 HTTP 请求作业给指定的 BE 节点。在 Stream Load 中,Doris 会选定一个节点作为 Coordinator 节点。
基本原理 Routine Load 会持续消费 Kafka Topic 中的数据,写入 PALO 中。 在 PALO 中,创建 Routine Load 作业后会生成一个常驻的导入作业,包括若干个导入任务: 导入作业(load job):一个 Routine Load Job 是一个常驻的导入作业,会持续不断地消费数据源中的数据。
基本原理 Routine Load 会持续消费 Kafka Topic 中的数据,写入 Doris 中。 在 Doris 中,创建 Routine Load 作业后会生成一个常驻的导入作业,包括若干个导入任务: 导入作业(load job):一个 Routine Load Job 是一个常驻的导入作业,会持续不断地消费数据源中的数据。