文档首页/ MapReduce服务 MRS/ 开发指南（普通版_2.x）/ Spark开发指南/ 开发Spark应用/ Spark on HBase程序/ 场景说明

更新时间：2022-07-19 GMT+08:00

查看PDF

场景说明

场景说明

用户可以使用Spark调用HBase的接口来操作HBase表的功能。在Spark应用中，用户可以自由使用HBase的接口来实现创建表、读取表、往表中插入数据等操作。

数据规划

首先需要把数据文件放置在HDFS系统里。

本地新建文本文件，将以下内容复制保存到input_data1.txt。
```
20,30,40,xxx
```
在HDFS上建立一个文件夹，“/tmp/input”，并上传input_data1.txt到此目录，命令如下。
1. 在HDFS客户端，执行如下命令获取安全认证。
  cd /opt/client
  
  kinit -kt '/opt/client/Spark/spark/conf/user.keytab' <用于认证的业务用户>
  
  user.keytab文件位置请根据自己实际路径填写。
2. 在Linux系统HDFS客户端使用命令hadoop fs -mkdir /tmp/input（hdfs dfs命令有同样的作用），创建对应目录。
3. 在Linux系统HDFS客户端使用命令hadoop fs -put input_xxx.txt /tmp/input，上传数据文件。

如果开启了kerberos认证，需要将客户端的配置文件“spark-defaults.conf”中的配置项spark.yarn.security.credentials.hbase.enabled置为true。

开发思路

创建HBase表。
往HBase表中插入数据。
通过Spark Application读取HBase表的数据。

父主题： Spark on HBase程序

上一篇：Spark on HBase程序

下一篇：Java样例代码

相关文档

意见反馈

文档内容是否对您有帮助？

有帮助没帮助

提供反馈

提交成功！非常感谢您的反馈，我们会继续努力做到更好！您可在我的云声建议查看反馈及问题处理状态。

系统繁忙，请稍后重试

在使用文档中是否遇到以下问题

内容与产品页面不一致

内容不易理解

缺失示例代码

步骤不可操作

搜不到想要的内容

缺少最佳实践

意见反馈（选填）

0/500

请至少选择一项反馈信息并填写问题反馈

字符长度不能超过500

直接提交取消

如您有其它疑问，您也可以通过华为云社区问答频道来与我们联系探讨

盘古Doer提问云社区提问