
# 评测指标与失败案例分析
为了尽可能保障真机测试结果的客观，测试过程中请保持场地、灯光、笔筒、机器人位置与采集数据时一致，并在固定的几个点位放置笔进行测试比较基于遥操作数据全参数微调的模型，和DAGGER数据集重训的模型，如果后者成功率高于前者，说明DAGGER有效。
**每个点位可以测三次，减少模型推理随机性，如果第一轮DAGGER数据集成功率高于[创建训练作业](https://support.huaweicloud.com/bestpractice-cloudrobo/cloudrobo_05_0007.html#ZH-CN_TOPIC_0000002658493441__section12568182313214)生成的"SO101把笔放入笔筒-模型"，但是还不够高，可以考虑进行下一轮DAGGER数据采集抓笔任务比较简单，DAGGER2-3轮即可有较高的成功率。**
表1可能的测试结果 
| sft模型 | 第一轮DAgger模型 | 真机点位                                                                                                       |
|:---|:---|:---|
| 成功    | 成功          | ![](https://support.huaweicloud.com/bestpractice-cloudrobo/figure/zh-cn_image_0000002630409698.png "点击放大") |
| 成功    | 成功          | ![](https://support.huaweicloud.com/bestpractice-cloudrobo/figure/zh-cn_image_0000002660529019.png "点击放大") |
| 成功    | 成功          | ![](https://support.huaweicloud.com/bestpractice-cloudrobo/figure/zh-cn_image_0000002630249804.png "点击放大") |
| 失败    | 成功          | ![](https://support.huaweicloud.com/bestpractice-cloudrobo/figure/zh-cn_image_0000002660648961.png "点击放大") |
   
