深度学习训练实例_导入和预处理训练数据集-华为云

导入和预处理训练数据集

train_labels), (test_images, test_labels) = fashion_mnist.load_data() 对训练数据做预处理，并查看训练集中最开始的25个图片。 1 2 3 4 5 6 7 8 9 10 11 12 13 14 15 class_names

来自：帮助中心

查看更多 →
训练文本分类模型

时说明模型效果较好。同一个自动学习项目可以训练多次，每次训练生成一个版本。如第一次训练版本号为“0.0.1”，下一个版本为“0.0.2”。基于训练版本可以对训练模型进行管理。当训练的模型达到目标后，再执行模型部署的操作。父主题：使用自动学习实现文本分类

来自：帮助中心

查看更多 →
Yaml配置文件参数配置说明

于加速深度学习训练。通过使用DeepSpeed，可以实现如混合精度训练、ZeRO内存优化等高级特性，以提高训练效率和性能 stage sft 表示当前的训练阶段。可选择值：[pt、sft、rm、ppo、dpo]，pt代表预训练，sft代表指令监督微调，rm代表奖励模型训练，ppo代表PPO训练，dpo代表DPO训练。

来自：帮助中心

查看更多 →
Kubeflow部署

旨在为数据科学家、机器学习工程师、系统运维人员提供面向机器学习业务的敏捷部署、开发、训练、发布和管理平台。它利用了云原生技术的优势，让用户更快速、方便地部署、使用和管理当前最流行的机器学习软件。目前Kubeflow 1.0版本已经发布，包含开发、构建、训练、部署四个环节，可全面

来自：帮助中心

查看更多 →
与其他云服务的关系

求。OBS的更多信息请参见《对象存储服务文档》。数据接入服务数据接入服务（Data Ingestion Service，简称DIS）提供推荐数据源的实时日志。DIS的更多信息请参见《数据接入服务文档》。统一身份认证服务统一身份认证服务（Identity and Access

来自：帮助中心

查看更多 →
数据集

数据。导入数据要求建议训练数据和测试数据分成两个实例，方便算法查找训练或测试数据的位置。训练数据可以是带标签或者不带标签的数据，测试数据一定是带标签的数据，方便评估模型执行效果。查看学件项目预置的样例数据等待学件项目创建完成后，在模型训练服务首页的项目列表中，找到创建完成的学件项目。单击项目所在行的图标。

来自：帮助中心

查看更多 →
执行纵向联邦模型训练作业

执行纵向联邦模型训练作业成功 { "job_instance_id" : "7b0df147d6464ef2877b22f6d964d274" } 状态码状态码描述 200 执行纵向联邦模型训练作业成功 401 操作无权限 500 内部服务器错误父主题：可信联邦学习作业管理

来自：帮助中心

查看更多 →
智能文档解析

智能文档解析功能介绍智能文档解析基于领先的深度学习技术，对任意含有结构化信息的文档图像进行键值对提取、表格识别与版面分析并返回相关信息。不限制版式情况，可支持多种证件、票据和规范行业文档，适用于各类行业场景。应用场景金融：银行回单、转账存单、理财信息截图等。政务：身份证、结婚证、居住证、各类企业资质证照。

来自：帮助中心

查看更多 →
使用模型

鲲鹏镜像暂时无法安装TensorFlow，敬请期待后续更新。父主题：基于CodeArts IDE Online、TensorFlow和Jupyter Notebook开发深度学习模型

来自：帮助中心

查看更多 →
模型训练

模型训练使用特征工程处理后生成的训练集进行模型训练。创建联邦学习训练任务（简易编辑器）单击简易编辑器界面右上角的“训练”。进入“训练任务配置”界面，如图1所示。图1 训练任务配置参数说明，如表1所示。表1 参数配置区域参数名称参数描述任务说明任务名称训练任务的名称。

来自：帮助中心

查看更多 →
训练

训练上传数据至OBS并预热到SFS Turbo中创建训练任务父主题：实施步骤

来自：帮助中心

查看更多 →
环境准备

DevServer：在裸金属服务器中，自助配置好存储、安装固件、驱动、配置网络等。 ModelArts Standard ModelArts上昇腾规格如下。表1 昇腾规格规格名称描述 Ascend 1*ascend-snt9b|ARM 24核 192GB Snt9b单卡规格，配搭ARM处

来自：帮助中心

查看更多 →
训练

训练上传数据至OBS并预热到SFS Turbo中创建训练任务父主题：实施步骤

来自：帮助中心

查看更多 →
Yaml配置文件参数配置说明

于加速深度学习训练。通过使用DeepSpeed，可以实现如混合精度训练、ZeRO内存优化等高级特性，以提高训练效率和性能 stage sft 表示当前的训练阶段。可选择值：pt、sft、rm、ppo、dpo。 pt代表预训练； sft代表指令监督微调； rm代表奖励模型训练； ppo代表PPO训练；

来自：帮助中心

查看更多 →
创建工程

单击“创建”，弹出“创建训练”对话框。配置训练工程参数，如表1所示。表1 新建训练工程参数说明参数名称参数说明请选择模型训练方式模型训练方式。包含如下选项：新建模型训练工程新建联邦学习工程新建训练服务新建超参优化服务请选择：新建模型训练工程。模型训练名称模型训练名称。只能以字母（A~Z

来自：帮助中心

查看更多 →
模型训练

模型训练创建图像分类自动学习项目并完成图片标注，训练按钮显示灰色，无法开始训练？自动学习项目中，如何进行增量训练？自动学习训练后的模型是否可以下载？自动学习为什么训练失败？自动学习模型训练图片异常？自动学习使用子账号单击开始训练出现错误Modelarts.0010 自

来自：帮助中心

查看更多 →
如何调整训练参数，使模型效果最优

较小的学习率，反之可以使用较大的学习率。如果您没有专业的调优经验，可以优先使用平台提供的默认值，再结合训练过程中模型的收敛情况动态调整。学习率衰减比率（learning_rate_decay_ratio） 0~1 0.01~0.1 学习率衰减比率用于设置训练过程中的学习率衰减

来自：帮助中心

查看更多 →
创建自监督微调训练任务

其中，训练配置选择LLM（大语言模型），训练类型选择自监督训练，根据所选模型配置训练参数。表1 自监督训练参数说明参数名称说明模型类型选择“LLM”。训练类型选择“自监督训练”。训练模型选择训练所需要的模型，模型详细介绍请参见选择模型与训练方法。训练参数指定用于训练模型的超参数。训练参数说

来自：帮助中心

查看更多 →
创建有监督训练任务

创建有监督训练任务创建有监督微调训练任务登录盘古大模型套件平台。在左侧导航栏中选择“模型开发 > 模型训练”，单击界面右上角“创建训练任务”。图1 模型训练列表在训练配置中，选择模型类型、训练类型、训练方式、训练模型与训练参数。其中，训练配置选择LLM（大语言模型），

来自：帮助中心

查看更多 →
确认学习结果

确认学习结果 HSS学习完白名单策略关联的服务器后，输出的学习结果中可能存在一些特征不明显的可疑进程需要再次进行确认，您可以手动或设置系统自动将这些可疑进程确认并分类标记为可疑、恶意或可信进程。学习结果确认方式，在创建白名单策略时可设置： “学习结果确认方式”选择的“自动确认可

来自：帮助中心

查看更多 →
指令监督微调训练任务

Step3 启动训练脚本启动训练前需修改启动训练脚本demo.sh 内容。具体请参考•修改启动脚本。对于falcon-11B训练任务开始前，需手动替换tokenizer中的config.json，具体请参见falcon-11B模型。修改完yaml配置文件后，启动训练脚本；模型不

来自：帮助中心

查看更多 →