
# 数据一致性篇
- Hudi表必须配置preCombine字段， Spark建表时通过"preCombineField"去指定。
  
- Hudi表的分区格式必须统一。 同一条数据以不同分区风格去写会产生两个不同分区。
  ```
  hoodie.datasource.write.hive_style_partitioning = false;
  ```
  ![](https://support.huaweicloud.com/devg-rule-mrs/zh-cn_image_0000002371775781.png)
  ```
  hoodie.datasource.write.hive_style_partitioning = true;
  ```
  ![](https://support.huaweicloud.com/devg-rule-mrs/zh-cn_image_0000002371735973.png)
  
- Hudi表的KeyGenerator必须统一。 从每条数据的_hoodie_record_key字段的值可以看出KeyGenerator是否统一。
  ```
  org.apache.hudi.keygen.ComplexKeyGenerator
  ```
  ![](https://support.huaweicloud.com/devg-rule-mrs/zh-cn_image_0000002371630577.png)
  ```
  org.apache.hudi.keygen.SimpleKeyGenerator
  ```
  ![](https://support.huaweicloud.com/devg-rule-mrs/zh-cn_image_0000002371630581.png)
  
- 涉及多引擎读写Hudi，Hudi表建议统一小写。
- 按照[选择合适的表服务执行方式](https://support.huaweicloud.com/devg-rule-mrs/mrs_07_450207.html)的规范去执行表服务，不要随意改动。
 
