数据仓库服务 GaussDB(DWS)

 

GaussDB(DWS)是一款具备分析及混合负载能力的分布式数据库,支持x86和Kunpeng硬件架构,支持行存储与列存储,提供GB~PB级数据分析能力、多模分析和实时处理能力,用于数据仓库、数据集市、实时分析、实时决策和混合负载等场景,广泛应用于汽车、制造、零售、物流、互联网、金融、政府、电信等行业分析决策系统

 
 

    数据仓库表名规范 更多内容
  • Kafka表开发规范

    Kafka开发规范 Kafka开发规则 Kafka开发建议 父主题: FlinkSQL Connector开发规范

    来自:帮助中心

    查看更多 →

  • Doris建表规范

    文件。 创建时的副本数必须至少为2,默认是3,禁止使用单副本。 没有聚合函数列的不应该被创建为AGGREGATE。 创建主键时需保持主键的列唯一,不建议将所有列都设置为主键列,且主键需设置value列。主键不建议用于数据去重场景。 Doris建建议 单物化视图不能

    来自:帮助中心

    查看更多 →

  • 表设计规范

    设计规范 必须指定分布(DISTRIBUTE BY),分布策略选择的原则如下: 目前提供REPLICATION和HASH两种分布策略。REPLICATION分布会在每个节点保留一份相同的完整的数据。HASH分布会根据所提供的分布键值将数据分布到多个节点中。 对于系统配

    来自:帮助中心

    查看更多 →

  • Spark表数据维护规范

    Spark数据维护规范 禁止通过Alter命令修改关键属性信息:type/primaryKey/preCombineField/hoodie.index.type 错误示例,执行如下语句修改关键属性: alter table dsrTable set tblproperties('type'='xx');

    来自:帮助中心

    查看更多 →

  • ClickHouse表开发规范

    ClickHouse开发规范 ClickHouse开发规则 ClickHouse开发建议 父主题: FlinkSQL Connector开发规范

    来自:帮助中心

    查看更多 →

  • 库表设计规范

    避免使用分区,如有需要,可以使用多个独立的代替。 分区的缺点: DDL操作需要锁定所有分区,导致所有分区上操作都被阻塞。 当数据量较大时,对分区进行DDL或其他运维操作难度大风险高。 分区使用较少,存在未知风险。 当单台 服务器 性能无法满足时,对分区进行分拆的成本较高。

    来自:帮助中心

    查看更多 →

  • 数据仓库

    数据仓库 华为云数据仓库高级工程师培训 父主题: 培训服务

    来自:帮助中心

    查看更多 →

  • 数据仓库

    数据仓库 1 数据仓库权限 权限 对应API接口 授权项(Action) IAM项目 (Project) 企业项目 (Enterprise Project) 获取数据仓库 GET /v1.0/{project_id}/common/warehouses octopus:dataWarehouse:list

    来自:帮助中心

    查看更多 →

  • 数据仓库

    数据仓库 获取数据仓库信息 获取数据仓库的数据列 父主题: API

    来自:帮助中心

    查看更多 →

  • 规范

    规范 商家在参与华为云云商店时,必须始终遵守云商店商家合作管理规范,如商家未遵守相关条款或条件,华为云有权采取下架商家产品、终止与商家合作等措施,对华为云造成损失的,华为云有权要求商家赔偿所有损失。 具体的规定和政策见《云商店商家合作管理规范》。

    来自:帮助中心

    查看更多 →

  • 获取数据仓库列表信息

    获取数据仓库信息 功能介绍 获取数据仓库 URI GET /v1.0/{project_id}/common/warehouses 1 路径参数 参数 是否必选 参数类型 描述 project_id 是 String 项目id,获取方法请参见获取项目ID 2 Query参数

    来自:帮助中心

    查看更多 →

  • Hudi表模型设计规范

    批量写 高 低 批量读 低 高 实时入湖,模型采用MOR。 实时入湖一般的性能要求都在分钟内或者分钟级,结合Hudi两种模型的对比,因此在实时入湖场景中需要选择MOR模型。 Hudi以及列采用小写字母。 多引擎读写同一张Hudi时,为了规避引擎之间大小写的支持不同,统一采用小写字母。

    来自:帮助中心

    查看更多 →

  • HBase数据表开发规范

    HBase数据开发规范 HBase数据开发规则 HBase数据开发建议 父主题: FlinkSQL Connector开发规范

    来自:帮助中心

    查看更多 →

  • Flink流式写Hudi表规范

    Flink流式写Hudi规范 Flink流式写Hudi规则 Flink流式写Hudi建议 父主题: Flink on Hudi开发规范

    来自:帮助中心

    查看更多 →

  • Hudi表分区设计规范

    议使用。 建议 事实采用日期分区,维度采用非分区或者大颗粒度的日期分区 是否采用分区要根据的总数据量、增量和使用方式来决定。从的使用属性看事实和维度具有的特点: 事实:数据总量大,增量大,数据读取多以日期做切分,读取一定时间段的数据。 维度:总量相对小,增量小

    来自:帮助中心

    查看更多 →

  • Hudi数据表Compaction规范

    规则 有数据持续写入的,24小时内至少执行一次compaction。 对于MOR,不管是流式写入还是批量写入,需要保证每天至少完成1次Compaction操作。如果长时间不做compaction,Hudi的log将会越来越大,这必将会出现以下问题: Hudi读取很慢,且需要很大的资源。

    来自:帮助中心

    查看更多 →

  • Hudi数据表Clean规范

    Hudi数据Clean规范 Clean也是Hudi的维护操作之一,该操作对于MOR和COW都需要执行。Clean操作的目的是为了清理旧版本文件(Hudi不再使用的数据文件),这不但可以节省HudiList过程的时间,也可以缓解存储压力。 规则 Hudi必须执行Clean。

    来自:帮助中心

    查看更多 →

  • Doris数据表开发规范

    Doris数据开发规范 Doris数据开发规则 父主题: FlinkSQL Connector开发规范

    来自:帮助中心

    查看更多 →

  • Flink流式读Hudi表规范

    Flink流式读Hudi规范 Flink流式读Hudi规则 Flink流式读Hudi建议 父主题: Flink on Hudi开发规范

    来自:帮助中心

    查看更多 →

  • Hudi表索引设计规范

    Hudi索引设计规范 规则 禁止修改索引类型。 Hudi的索引会决定数据存储方式,随意修改索引类型会导致中已有的存量数据与新增数据之间出现数据重复和数据准确性问题。常见的索引类型如下: 布隆索引:Spark引擎独有索引,采用bloomfiter机制,将布隆索引内容写入到Parquet文件的footer中。

    来自:帮助中心

    查看更多 →

  • 数据仓库规格

    情请参见1。 标准数仓(DWS 2.0)本地盘规格,该规格存储容量固定,不能够进行磁盘扩容,只能进行节点扩容,规格详情请参见2。 步长指在集群变配过程中增大或减小磁盘大小的间隔大小。用户在操作时需要按照对应规格的存储步长来选择。 1 标准数仓(DWS 2.0)云盘规格 规格名称

    来自:帮助中心

    查看更多 →

共105条
看了本文的人还看了