1. 问题背景与现象描述
那天下午运维群突然炸了锅——一台关键业务服务器突然失联。这台机器配备了四块网卡,分别连接管理网络、业务网络、备份网络和测试环境。最初发现异常的是监控系统,显示业务端口全部超时,但神奇的是SSH管理端口依然能连。登录后ping公网域名全报"Network is unreachable",但内网互通完全正常。
这种"半残"状态最让人头疼:既不是完全断网,又不是完全正常。更诡异的是,前一天晚上还一切正常,没人动过网络配置。作为有十年经验的系统工程师,我立刻意识到这八成是路由表出了问题。多网卡服务器就像有多条出口的高速公路,一旦默认路由指向了错误的方向,就会导致这种"部分能通部分不通"的怪异现象。
需要模型API调用? 免费领10W Token,多模型网关一键接入 Claude、DeepSeek 等主流模型。
2. 网络拓扑与初始检查
2.1 网络接口配置确认
首先用ip addr查看各网卡状态:
bash复制1: lo: <LOOPBACK,UP,LOWER_UP> mtu 65536 qdisc noqueue state UNKNOWN
link/loopback 00:00:00:00:00:00 brd 00:00:00:00:00:00
inet 127.0.0.1/8 scope host lo
2: eth0: <BROADCAST,MULTICAST,UP,LOWER_UP> mtu 1500 qdisc pfifo_fast state UP qlen 1000
link/ether 52:54:00:12:34:56 brd ff:ff:ff:ff:ff:ff
inet 192.168.1.100/24 brd 192.168.1.255 scope global eth0
3: eth1: <BROADCAST,MULTICAST,UP,LOWER_UP> mtu 1500 qdisc pfifo_fast state UP qlen 1000
link/ether 52:54:00:12:34:57 brd ff:ff:ff:ff:ff:ff
inet 10.0.0.100/24 brd 10.0.0.255 scope global eth1
4: eth2: <BROADCAST,MULTICAST> mtu 1500 qdisc noop s
