前段时间把博客的底层主机换了下,本来是在nuc上的exsi 8,然后这次买了个nec 8的小主机,拼多多上买的垃圾佬,顺便为了降低负载装了pve 9.2 。目前用下来还行,但是发现个bug,每隔大概一个月,网卡就死掉了,只能重新插拔网卡。
查询了日志发现报错:
八月 18 21:10:44 pve kernel: e1000e 0000:00:1f.6 nic0: Detected Hardware Unit Hang: TDH <10> TDT <24> next_to_use <24> next_to_clean <f> buffer_info[next_to_clean]: time_stamp <172628cb6> next_to_watch <10> jiffies <187321a80> next_to_watch.status <0> MAC Status <40080083> PHY Status <796d> PHY 1000BASE-T Status <3c00> PHY Extended Status <3000> PCI Status <10>
问了下AI 告诉我 :这是经典的 **Intel e1000e 网卡 Hang死锁**,不是致命错误,但不处理会反复出现,严重时整个网络中断、SSH 失联、VM 失联。PVE 主机上特别常见。
然后先临时运行:
ethtool -K nic0 tso off gso off
这个命令执行了关闭网卡的硬件分片卸载功能。但是重启又会开启。所以继续用下面的永久生效方法
bash
nano /etc/network/interfaces
请谨慎使用此类代码。
iface nic0 inet manual)。 iface nic0 inet manual 的正下方,添加一行 post-up 代码。修改后的结构应该长这样: text
iface nic0 inet manual
post-up ethtool -K nic0 tso off gso off
请谨慎使用此类代码。
(注意:如果你的网卡名不是 nic0,请对应修改。)
Ctrl + O,然后按 Enter (回车) 保存文件。 Ctrl + X 退出编辑器。