
# Hive输出
#### 概述
"Hive输出"算子，用于配置已生成的字段输出到Hive表的列。
#### 输入与输出
- 输入：需要输出的字段
- 输出：Hive表
 
#### 参数说明
表1算子参数说明 
| 参数           | 含义                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                              | 类型     | 是否必填 | 默认值  |
|:---|:---|:---|:---|:---|
| Hive文件存储格式   | 配置Hive表文件的存储格式（目前支持四种格式：CSV、ORC、RC和PARQUET）。 说明： - PARQUET格式是一种列式存储格式，PARQUET要求Loader的输出字段名和Hive表中的字段名保持一致。  - Hive 1.2.0版本之后，Hive使用字段名称替代字段序号对ORC文件进行解析，因此，Loader的输出字段名和Hive表中的字段名需要保持一致。                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                          | enum   | 是    | CSV  |
| Hive文件压缩格式   | 在下拉菜单中选择Hive表文件的压缩格式，未配置或选择"NONE"表示不压缩数据。                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                       | enum   | 是    | NONE |
| Hive ORC文件版本 | 通过该字段配置ORC文件的版本（当Hive表文件的存储格式是ORC时）。                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                            | enum   | 是    | 0.12 |
| 输出分隔符        | 配置分隔符。                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                          | string | 是    | 无    |
| 输出字段         | 配置输出信息： - 位置：配置输出字段的位置。  - 字段名：配置输出字段的字段名。  - 类型：配置字段类型，字段类型为"DATE"或"TIME"或"TIMESTAMP"时，需指定特定时间格式，其他类型指定无效。时间格式如："yyyyMMdd HH:mm:ss"。  - 十进制格式：配置小数的刻度和精度。  - 长度：配置字段长度，字段值实际长度太长则按配置的长度截取，"类型"为"CHAR"时实际长度不足则空格补齐，"类型"为"VARCHAR"时实际长度不足则不补齐。  - 分区键：配置是否为分区列。可以不指定分区列，也可以指定多个分区列。配置多个列为分区列时，会按照配置列的先后顺序对其进行拼接。   | map    | 是    | 无    |
   
#### 数据处理规则
- 将字段值输出到Hive表中。
- 如果指定了一个或多个列为分区列，则在作业配置第四步"输出设置"页面上，会显示"分割程序"属性，该属性表示使用多少个处理器去对分区数据进行处理。
- 如果没有指定任何列为分区列，则表示不需要对输入数据进行分区处理，"分割程序"属性默认隐藏。
 
#### 样例
通过"CSV文件输入"算子，生成两个字段a_str和b_str。
源文件如下：
![](https://support.huaweicloud.com/cmpntguide-lts-mrs/zh-cn_image_0000001724747633.jpg "点击放大")
配置"Hive输出"算子，将a_str和b_str输出到Hive的表中。
![](https://support.huaweicloud.com/cmpntguide-lts-mrs/zh-cn_image_0000001676908142.png "点击放大")
执行成功后，查看表数据：
![](https://support.huaweicloud.com/cmpntguide-lts-mrs/zh-cn_image_0000001724867497.jpg "点击放大")
