跳转到内容

改网络后失联 ​

适用范围 ​

刚刚改过 Proxmox VE 的网络配置(管理 IP、网桥、bond、VLAN 或主机名)之后,Web UI 和 SSH 都连不上了。

不适用于:从来没改过网络、一直连不上的情况,那是Web UI 打不开覆盖的场景——这篇的前提是"网络本身断了",不是"网络正常但某个服务连不上"。

判断你现在有没有退路

继续排查前先确认手上有没有以下任意一条:

  1. 能接显示器和键盘到这台机器(本机控制台)。
  2. 有 IPMI / BMC / iDRAC / iLO 这类带外管理。
  3. 机器就在手边,能物理接触。

一条都没有,意味着这台机器目前只能等有人到现场,远程操作无法恢复。这也是为什么改网络前必须先确认退路——参考改静态 IP 与失联自救里的具体说明。

开始排查前 ​

尽量回忆或翻出记录:改动前的原始配置是什么、这次具体改了哪些字段、有没有执行 ifreload -a 或者重启过。这些信息决定了排查方向,凭空排查会浪费大量时间。

排查步骤 ​

1. 先确认新旧地址是不是都能通 ​

配置修改有时候只生效了一部分,机器可能停在一个中间状态。在另一台设备上都试一遍:

sh
ping <改之前的旧IP>
ping <改之后的新IP>

如果两个都不通,去路由器的管理页面查 DHCP 租约表或 ARP 表,按这台机器的 MAC 地址找它当前实际用的是哪个 IP——很多"失联"其实是记错了地址,机器本身好好的。

找到了实际在用的 IP,而且能连上 → 只是信息记录问题,更新你的笔记,顺便确认 /etc/hosts 里的主机名映射和实际 IP 一致(见改静态 IP 与失联自救第三步),完成。

两个地址都彻底 ping 不通 → 继续下一步。

2. 有物理控制台或 IPMI:直接修 ​

接上显示器和键盘,或者通过 IPMI 的远程控制台登录 root:

sh
# 看看现在的实际地址和接口状态
ip -4 addr
ip link show vmbr0

如果之前按规范做了备份(cp /etc/network/interfaces /root/interfaces.bak),直接恢复:

sh
cp /root/interfaces.bak /etc/network/interfaces
ifreload -a

没有备份的话,对照记忆或笔记手动改回去,重点检查这几个常见笔误:

问题现象
地址漏写 CIDR 前缀写了 address 192.168.1.20 没带 /24,ifupdown2 会拒绝该接口正常工作
bridge-ports 写错网卡名换过网卡或者手滑打错,网桥找不到上联口
多网卡环境接错口网线插在了另一块网卡上,配置指向的却是原来那块

改完执行 ifreload -a 或者干脆重启一次,确认配置在冷启动后依然生效。

3. 没有物理条件,只能临时补救 ​

如果当时还能连上(比如刚改完立刻发现连不上,会话还没断),可以临时加一个不写入配置文件、重启后失效的地址,先连上去再慢慢修:

sh
ip addr add 192.168.1.99/24 dev vmbr0

这只是应急手段

临时地址重启后消失,而且如果连接已经彻底断开,这条命令也无法远程执行——它只在你还没完全失联、会话还活着的那个窗口期有用。真正失联之后,必须回到步骤 2 的物理或带外途径。

一根网线直连也是一个选项:笔记本网线接到 PVE 的网口,两边设同网段的临时静态 IP,绕开原来的路由器/交换机环境连上去处理。

4. 检查是不是 bond 或 VLAN 配置和交换机不匹配 ​

如果这次改动涉及链路聚合(bond)或 VLAN:

  • Bond 模式要求交换机侧配合:比如 802.3ad 需要交换机做对应的端口聚合配置,单方面在 PVE 这边配置模式,交换机不认,链路会整体不通。恢复到单网卡配置先验证基础连通性,再逐步排查 bond,细节见 Bond 链路聚合。
  • VLAN 标签和交换机端口配置不一致:交换机端口没有放行对应的 VLAN,或者搞反了 access/trunk,同样会导致整个接口不通。

5. 集群节点的情况 ​

如果这台机器是集群的一部分(pvecm status 能看到多个节点),改 IP 的复杂度会高很多——corosync 配置和集群证书都和节点 IP 绑定。本文和改静态 IP 与失联自救都只覆盖单机场景,集群节点改 IP 出问题,处理方式不同,不要照搬单机的恢复步骤。

确认恢复 ​

  1. 从预期的地址(旧地址或者确认过的新地址)能访问 Web UI。
  2. ip -4 addr show vmbr0 显示的地址和你的预期一致。
  3. /etc/hosts 里的主机名映射和实际 IP 一致,浏览器打开后节点图标是正常状态而不是红叉。
  4. 重启一次宿主机,确认新配置在冷启动之后依然生效,而不是只在当前运行状态下"临时对了"。
  5. 检查这次网络中断期间客户机是否受影响:客户机的网络走的是网桥转发,通常宿主机自己失联不影响客户机之间以及客户机对外的连通性,但如果改动动到了 bridge-ports 本身,客户机网络会一起断,需要单独确认。

仍未解决 ​

如果排查了以上所有分支依然找不回访问权限,基本可以确定需要有人到现场处理,或者等待带外管理恢复。到场后按如何有效求助整理信息:

  • 改动前后的 /etc/network/interfaces 对比(有备份的话)。
  • 执行过的命令顺序(ifreload -a、是否重启过)。
  • 现在能观察到的接口状态(ip -4 addr、ip link)。

实在无法通过网络配置本身恢复,最后的手段是用安装 U 盘进入救援模式,参考迁移与救援。

参考资料 ​

Proxmox VE 非官方中文使用指南,与 Proxmox Server Solutions GmbH 无隶属关系。