资源管理

为了节省Doris集群内的计算、存储资源,Doris需要引入一些其他外部资源来完成相关的工作,如Spark/GPU用于查询,HDFS/S3用于外部存储,Spark/MapReduce用于ETL等,因此我们引入资源管理机制来管理Doris使用的这些外部资源。

基本概念

一个资源包含名字、类型等基本信息,名字为全局唯一,不同类型的资源包含不同的属性,具体参考各资源的介绍。

资源的创建和删除只能由拥有 admin 权限的用户进行操作。一个资源隶属于整个Doris集群。拥有 admin 权限的用户可以将使用权限usage_priv 赋给普通用户。可参考HELP GRANT或者权限文档。

具体操作

资源管理主要有三个命令:CREATE RESOURCEDROP RESOURCESHOW RESOURCES,分别为创建、删除和查看资源。这三个命令的具体语法可以通过MySQL客户端连接到 Doris 后,执行 HELP cmd 的方式查看帮助。

  1. CREATE RESOURCE

    语法

    1. CREATE [EXTERNAL] RESOURCE "resource_name"
    2. PROPERTIES ("key"="value", ...);

    在创建资源的命令中,用户必须提供以下信息:

    • resource_name 为 Doris 中配置的资源的名字。
    • PROPERTIES 是资源相关参数,如下:
      • type:资源类型,必填,目前仅支持 spark。
      • 其他参数见各资源介绍。
  2. DROP RESOURCE

    该命令可以删除一个已存在的资源。具体操作见:HELP DROP RESOURCE

  3. SHOW RESOURCES

    该命令可以查看用户有使用权限的资源。具体操作见:HELP SHOW RESOURCES

支持的资源

目前仅支持Spark资源,完成ETL工作。下面的示例都以Spark资源为例。

Spark

参数

Spark 相关参数如下:

spark.master: 必填,目前支持yarn,spark://host:port。

spark.submit.deployMode: Spark 程序的部署模式,必填,支持 cluster,client 两种。

spark.hadoop.yarn.resourcemanager.address: master为yarn时必填。

spark.hadoop.fs.defaultFS: master为yarn时必填。

其他参数为可选,参考http://spark.apache.org/docs/latest/configuration.html。

如果Spark用于ETL,还需要指定以下参数:

working_dir: ETL 使用的目录。spark作为ETL资源使用时必填。例如:hdfs://host:port/tmp/doris。

broker: broker 名字。spark作为ETL资源使用时必填。需要使用ALTER SYSTEM ADD BROKER 命令提前完成配置。

  • broker.property_key: broker读取ETL生成的中间文件时需要指定的认证信息等。

示例

创建 yarn cluster 模式,名为 spark0 的 Spark 资源。

  1. CREATE EXTERNAL RESOURCE "spark0"
  2. PROPERTIES
  3. (
  4. "type" = "spark",
  5. "spark.master" = "yarn",
  6. "spark.submit.deployMode" = "cluster",
  7. "spark.jars" = "xxx.jar,yyy.jar",
  8. "spark.files" = "/tmp/aaa,/tmp/bbb",
  9. "spark.executor.memory" = "1g",
  10. "spark.yarn.queue" = "queue0",
  11. "spark.hadoop.yarn.resourcemanager.address" = "127.0.0.1:9999",
  12. "spark.hadoop.fs.defaultFS" = "hdfs://127.0.0.1:10000",
  13. "working_dir" = "hdfs://127.0.0.1:10000/tmp/doris",
  14. "broker" = "broker0",
  15. "broker.username" = "user0",
  16. "broker.password" = "password0"
  17. );