# Linux云服务器网卡丢包怎么办？
#### 问题描述
Linux实例运行过程中出现丢包现象，表现为：
- 网络连接不稳定：Web服务或数据库等应用程序偶发延迟甚至断连。
- 丢包率高：用ping、traceroute等工具检测时，目标地址存在较高丢包率（如10%\~30%）。
- 日志异常：系统事件日志或业务程序日志中频繁出现关于网络异常的内容。
 
#### 可能原因
- 网络配置异常：如网卡MTU值设置异常或网关/路由表异常。
- 网卡驱动异常或Agent故障：网卡驱动版本过旧或损坏，业务程序服务版本与系统不兼容或与网卡驱动冲突。
- 资源限制或系统瓶颈：CPU、内存或网络带宽不足，多个进程竞争网卡带宽、磁盘IO高导致网络线程阻塞。
- 安全软件误判：防火墙、杀毒软件等安全软件误拦截数据包。
 
#### 处理方法
1. 登录弹性云服务器，具体操作，请参见[Linux ECS登录方法概述](https://support.huaweicloud.com/usermanual-ecs/zh-cn_topic_0013771089.html)。
2. 检查网络连接状态。
   1. 执行以下命令，命令检查丢包率。
      **ping \<目的IP/域名\> -c 20**
      图1检查丢包率   
      ![](https://support.huaweicloud.com/ecs_faq/zh-cn_image_0000002371765769.png "点击放大") 
   
   2. *执行以下命令，* 检查路由路径是否正常。
      **traceroute \<目的IP(可通过ping域名获取IP)\>**
      图2检查路由路径   
      ![](https://support.huaweicloud.com/ecs_faq/zh-cn_image_0000002337927608.png "点击放大") 
   
   3. 执行以下命令，查看IP地址和子网配置。 **ip a**
      图3查看IP地址和子网配置   
      ![](https://support.huaweicloud.com/ecs_faq/zh-cn_image_0000002337767840.png "点击放大") 
   
   4. 执行以下命令，可以查看路由表是否异常。 **route -n**
      图4查看路由表   
      ![](https://support.huaweicloud.com/ecs_faq/zh-cn_image_0000002371805901.png "点击放大") 
    
3. 检查网卡驱动状态。
   1. 执行以下命令，检查网卡状态 **ethtool \<网卡名\>**
      图5检查网卡状态   
      ![](https://support.huaweicloud.com/ecs_faq/zh-cn_image_0000002371765773.png "点击放大") 
   
   2. 执行以下命令，查看网卡硬件信息和驱动状态。 **lspci -v \| grep -i ether -A 10**
      图6查看网卡硬件信息和驱动状态   
      ![](https://support.huaweicloud.com/ecs_faq/zh-cn_image_0000002337927612.png "点击放大") 
   
   3. 若发现网卡驱动异常，可以通过ifdown、ifup重启网卡或用systemctl重启网卡服务。 **ifdown \<网卡名\>**
      **ifup \<网卡名\>**
      图7重启网卡服务   
      ![](https://support.huaweicloud.com/ecs_faq/zh-cn_image_0000002337767844.png "点击放大") 
   
   4. 执行以下命令，查看网络相关的服务，选择自己的系统使用的网络管理工具。 **systemctl list-units \| grep network**
      图8查看网络相关的服务   
      ![](https://support.huaweicloud.com/ecs_faq/zh-cn_image_0000002338128866.png "点击放大") 
   
   5. 执行以下命令，重启网络服务。 **systemctl restart \<networkmanager\>**
      图9重启网络服务   
      ![](https://support.huaweicloud.com/ecs_faq/zh-cn_image_0000002371765785.png "点击放大") 
    
4. 排查业务程序服务。 使用***systemctl status \<agent服务名\>***检查程序状态是否正常。
   图10检查程序状态   
   ![](https://support.huaweicloud.com/ecs_faq/zh-cn_image_0000002337927616.png "点击放大")
   排查日志，若日志中频繁存在Timeout、Connection Reset、Socket Exception或版本冲突提示时，建议修复或重装业务程序。
   
5. 系统级优化及日志日志排查
   1. 检查系统资源，使用top检查是否存在资源占用\>80%的进程。 ***top***
      图11检查资源占用结果   
      ![](https://support.huaweicloud.com/ecs_faq/zh-cn_image_0000002337767848.png "点击放大")
      根据实际业务情况判断该进程是否为正常进程，若不为正常进程，考虑查杀；若为正常进程，考虑优化业务或[变更单台ECS规格](https://support.huaweicloud.com/usermanual-ecs/zh-cn_topic_0013771092.html)。
      
   
   2. 排查防火墙/安全组规则。 检查安全组规则是否配置正常，参考[配置安全组规则](https://support.huaweicloud.com/usermanual-ecs/zh-cn_topic_0030878383.html)。
      使用***iptables -L -n -v***检查系统中配置的过滤规则。
      图12检查安全组规则   
      ![](https://support.huaweicloud.com/ecs_faq/zh-cn_image_0000002371805913.png "点击放大") 
   
   3. 检查内核日志是否有有关于网卡的异常日志。 ***dmesg \| grep -i eth0***
      图13检查异常日志   
      ![](https://support.huaweicloud.com/ecs_faq/zh-cn_image_0000002371765789.png "点击放大") 
    
6. 可以使用tcpdump等抓包工具抓包进行进一步分析。
 
