说实话,Linux这东西,平时真没人夸你“命令敲得真溜”,但一旦线上出问题、服务起不来、磁盘被写满,或者新机器要交付,能不能第一时间搞定,考的就是这些最基础的东西。我见过不少开发同学,框架用得飞起,一进终端就懵;也见过运维老哥,几行命令就能把问题捋得明明白白。差距不在天赋,就在基础知识扎不扎实。这篇内容就是Linux系统基础知识的下半篇,围绕文件管理、用户权限、进程端口、网络传输、软件安装这些日常最高频的场景展开,把我踩过的坑和常用的排查思路一起说清楚。适合刚入门想系统补课的同学,也适合已经用了几年Linux、但想查漏补缺的运维和开发。
1. 吃透起点:文件系统、路径与命令的本质
1.1 一切皆文件,不只是个说法
刚学Linux的时候,很多教程都会说“Linux下一切皆文件”,这句话听得耳朵起茧,但真正理解它,对你的排查能力提升是质的改变。设备是文件,/dev/sda 代表一块磁盘;进程信息是文件,/proc/ 目录下每个数字目录对应一个正在运行的进程;内核参数是文件,/proc/sys/ 里的内容可以直接 echo 修改;甚至网络连接也被抽象成了文件,你在 /proc/net/ 下面能看到一堆连接状态。
这个设计带来的好处是,所有操作变得统一了。你不用专门学习“如何读取磁盘信息”“如何查看进程内部数据”,只需要会用 cat、echo、ls 这几招,就能搞定大部分问题。我平时排查问题,第一件事就是去看 /proc 和 /sys 下面的内容,比如 cat /proc/loadavg 看系统负载、cat /proc/meminfo 看内存、cat /proc/$(pgrep nginx)/status 看某个进程的状态。这些在传统教科书里可能不会细讲,但实践里真的高频。
还有一个延伸概念叫文件描述符。进程打开文件时,内核会返回一个编号,0 是标准输入,1 是标准输出,2 是标准错误。这也是为什么你用 nohup command > /var/log/app.log 2>&1 & 能把日志完整保存下来。理解了这三个编号,你就理解了一切重定向的底层逻辑。
1.2 绝对路径与相对路径:别再踩脚本里的坑
路径问题看着简单,但它坑过的人一点也不少。绝对路径以 / 开头,从头到尾是确定的;相对路径以当前目录为基准,依赖你“站在哪里”。在终端里手动操作,问题不大;但在脚本里、在定时任务里、在 systemd 服务里,相对路径经常出大问题。
举个例子,我之前处理过一个排查了很久的问题:用户写了一个备份脚本,手动执行一切正常,crontab 里一跑就报“找不到文件”。原因很简单,脚本里用了相对路径,手动执行时当前目录是 /home/user,cron 执行时工作目录是执行环境的一个固定位置,自然找不到文件。后来我习惯在脚本开头写:cd "$(dirname "$0")",把工作目录切到脚本所在目录,再后续的操作全部基于这个目录。如果是服务类程序,更建议直接在配置里写绝对路径,别偷懒。
还有几个路径符号必须滚瓜烂熟:. 表示当前目录,.. 表示上级目录,~ 表示当前用户主目录,- 表示上一次所在目录。cd - 这个命令在长路径来回切换时非常好用,你们可以试试。
1.3 命令记不住怎么办:学会问系统
我发现很多人有“背命令焦虑”,总觉得自己记得不够多。其实没必要,命令是背不完的,关键是会自己查。Linux 系统帮你准备了三套查询工具:man 手册、--help 参数、还有 type/which 这类定位命令。
man 是最全的,比如 man ls 会列出 ls 的所有参数,连退出状态都告诉你。不过 man 手册内容太密,我通常在忘记某个参数时才翻。ls --help 这种快速帮助更轻量,适合日常回忆。另外,type 命令能告诉你一个命令到底是内部命令、外部命令还是别名,这个信息很关键。比如你敲 type ll,如果系统没有定义别名,它会直接报错;如果定义了,你会看到 ll is aliased to 'ls -alF'。而 which 会告诉你一个外部命令的真实路径,比如 which nginx,当系统里有多个同名的二进制时,这个命令能帮你定位到底用的是哪个。
这套“查”的能力,才是 Linux 里最值得养成的基础习惯。
需要模型API调用? 免费领10W Token,多模型网关一键接入 Claude、DeepSeek 等主流模型。
2. 文件管理:高频命令的实操细节
2.1 ls、cd、cp、mv:看着简单,坑可不少
ls 应该是每天敲得最多的命令。我习惯用 ls -l 看详细属性,ls -a 看隐藏文件,ls -lh 让人能读的大小。这三个参数组合基本覆盖了 90% 的日常需求。但如果只记住这一层,你还没真正会用 ls。比如 ls -lt 按修改时间排序,排查文件何时被改动特别有用;ls -lS 按大小排序,找出大文件也很方便。
cp 和 mv 的坑主要在两个地方。第一,复制目录必须加 -r 或 -a,cp -a 会保留权限、属主、时间戳,备份配置时更推荐;第二,不管是 cp 还是 mv,目标位置已存在同名文件时会直接覆盖,不会默认询问。我就在生产环境上吃过亏,想把一个文件复制过去,结果把原来的好配置覆盖了,服务直接起不来。后来我养成了习惯,要么先建一个带日期的备份目录,要么用 cp -i 或者 mv -i,让系统在覆盖前问我一下。
还有一个 mv 的底层区别,很多人不知道:同一分区内的 mv,本质只是改目录项,秒完成;跨分区 mv,本质是先复制再删除。所以你把一个大文件从一个目录挪到另一个目录,如果跨分区了,耗时和复制一模一样,磁盘空间在中间过程会被双份占用。理解这一点,你就知道为什么有时候 mv 要等那么久了。
2.2 删除文件夹命令:为什么 rm -rf 成了“高危操作”
删除这个动作,在 Linux 里比 Windows 要“果断”得多,没有回收站,rm 掉就是真的没了。rm -rf 目录名 是一个经典组合,r 表示递归,f 表示强制忽略不存在的文件。它之所以被反复强调危险,一是因为参数太顺手,二是因为一旦删错,基本没有后悔药。
我自己遇过两次差点翻车的情况。一次是删日志目录时,手速太快,命令写成了 rm -rf / var/log,中间多了个空格,系统会把 / 当成第一个参数,直接开始删除根目录下的文件。还好当时命令执行到一半报权限不足,我立刻 Ctrl+C 停了,但整台机器的文件已经被删了一部分,最终只能重装。另一次是在脚本里用了变量拼接路径,变量取到空值,命令变成 rm -rf /data/${BACKUP_DIR}/* 里的 ${BACKUP_DIR} 为空,差点把 /data 下的所有文件清空。从那以后,我立了三个规矩:生产环境不用 rm 删目录,改用 mv 把待删目录先挪到一个临时目录,确认无误后再说;写脚本删除时,先 echo 把命令打出来确认一遍;必要的时候,用 find /path -type f -delete 替代 rm,因为 find 的路径写错时至少会在权限上卡一下,不会一刀切。
2.3 find:别只会 find / -name
find / -name "nginx.conf" 是大家最先学的用法,但这样全盘扫一遍非常慢。正确的做法是先缩小范围,比如 find /etc -name "nginx.conf",几秒就出结果。find 的进阶用法能解决不少实际问题:-type f 只要普通文件,-type d 只要目录;-mtime -7 找最近 7 天修改过的文件;-size +1G 找出超大的文件。
我最常用的两个场景是这样的。第一,按时间清理日志:find /var/log -name "*.log" -mtime +30 -delete,这一行就能删掉 30 天前的所有日志,比手动一个个看靠谱得多。第二,批量处理文件:find /data -type f -name "*.tmp" -exec rm {} \;,这里 {} 会替换成每个匹配到的文件,; 表示 exec 命令结束。但也提醒一句,-exec 执行的是外部命令,数量巨大的时候性能不太好,单纯删除的话建议直接用 -delete,它由 find 内部实现,更快。
还有一个非常实用但容易被忽略的参数:-iname,忽略大小写查找文件。Windows 上传上来的文件经常是 AppLog.Txt 这样的命名,用 find / -iname "applog*" 就不会漏了。
3. 用户、组与权限:Linux 安全的第一道门
3.1 新建用户与用户组:最该掌握的基础操作
不管你是在一台刚装好的服务器上部署服务,还是在云主机上给同事开账号,新建用户都是绕不开的操作。Linux 下有两个命令:useradd 和 adduser。很多初学者分不清,其实区别很大:useradd 是底层命令,参数多但不会帮你做太多“贴心”的事;adduser 是一个 Perl 脚本,交互式地引导你完成创建用户、设置密码、创建主目录等操作,适合新手。但我更推荐熟练使用 useradd,因为脚本化部署时完全可控。
useradd -m -s /bin/bash zhangsan 这一条命令的含义是:创建用户 zhangsan,-m 自动创建主目录 /home/zhangsan,-s 指定登录 Shell 为 bash。如果不加 -m,系统只会在 /etc/passwd 里加一行记录,不会建目录,很多新人在这里栽跟头,用户登录进去发现连 home 都没有。接着用 passwd zhangsan 设置密码。如果想给用户加 sudo 权限,不同发行版方法不同,Debian/Ubuntu 系一般执行 usermod -aG sudo zhangsan,CentOS/RHEL 系通常是 wheel 组。注意这里必须加 -a(append),如果你写成 usermod -G sudo zhangsan,会把用户从其他附属组里全部移除,只留下 sudo 组,这是一个很容易被忽略的坑。
删除用户用 userdel -r username,-r 表示连同主目录和邮件一起删。但生产环境我一般只是用 usermod -L 锁定用户,或者直接把用户的 Shell 改成 /sbin/nologin,而不是直接删除,避免出现“用户还在用着某些服务,目录却没了”的问题。
3.2 权限位的计算:rwx 与数字之间的关系
权限模型是 Linux 的底座,理解它,很多 Permission denied 的问题就能一眼看穿。ls -l 输出的第一段类似 -rwxr-xr--,总共 10 个字符:第一个字符表示文件类型(- 普通文件,d 目录,l 软链接);后面 9 个字符分三组,分别是属主、属组、其他人的权限。
每组里的 rwx 对应三个数字:r=4,w=2,x=1。所以 rwx 是 7,r-x 是 5,r-- 是 4。chmod 754 file 的意思就是:属主拥有完整权限(7),属组拥有读和执行(5),其他人只读(4)。这个计算逻辑很简单,网上也有大量表格,但我建议你自己推几遍,因为面试和日常都会遇到。
目录的权限和文件略有不同,这点必须单独说。目录的 r 权限表示“能列出目录里的文件名”,w 表示“能在目录里创建或删除文件”,x 表示“能进入这个目录”。注意,只有 r 没有 x 时,你能用 ls 看到名字,但 cd 不进去,也无法访问里面的文件详情;只有 x 没有 r 时,你能进去,却看不到名字,只能猜路径。这在做网站部署时很常见,你明明给了 nginx 用户对目录的读权限,但没给 x 权限,结果页面 403,日志里报 permission denied,说的其实是缺少执行权限。
改属主属组用 chown,比如 chown www-data:www-data /var/www/html -R,-R 递归处理下面所有文件。运维规范里,我会要求部署脚本里强制加上这一步,不然从 root 复制过去的文件,web 服务根本读不了。
3.3 常见权限问题排查:明明有权限,为什么还是不行
权限报错的排查其实有固定套路。第一步,ls -l 目录 看属主和属组到底是谁;第二步,确认当前进程以什么用户身份运行,比如 ps aux | grep nginx 能看到 master 进程是 root,worker 进程是 nobody;第三步,把两边对上,如果对不上就 chown 或 chmod。
这里还要提两个更隐蔽的情况。一个是 ACL(访问控制列表),某些系统上,普通 chmod 搞不定的权限可能被 ACL 控制了,用 getfacl file 查看,setfacl -m u:zhangsan:rwx file 修改。另一个是 SELinux,CentOS 上默认开启,经常出现权限明明没问题、服务就是起不来的诡异情况,排查时可以用 ls -Z 查看安全上下文,临时测试可以用 setenforce 0,但生产环境不要随意关闭。这两个不是基础中的基础,但遇到疑难杂症时能救命。
4. 进程、端口与系统资源
4.1 进程查看与信号:ps、top、kill 怎么配合
进程管理是运维的基本功。查看进程我习惯用 ps -ef,它输出的每一列分别是 UID、PID、PPID、CPU、内存、TTY、时间、命令行,一屏能扫完很多信息。另一个常用的是 ps aux,BSD 风格,会额外展示进程的 CPU 和内存占用率,排查性能问题更直接。想按资源占用排序,直接在命令上做:ps aux --sort=-%cpu | head -5,一行找到最占 CPU 的进程。
top 是动态视图,能实时看系统负载、CPU 使用率、内存情况。进入 top 之后,按 P 按 CPU 排序,按 M 按内存排序,按 q 退出。我通常会用 top 先看整体,再用 ps 看具体命令行,两者配合效率很高。
kill 是通过发送信号控制进程。默认的 kill 是 SIGTERM(15),相当于“请优雅地退出”;kill -9 是 SIGKILL,直接强制杀掉,不给进程清理的机会。如果不是进程卡死,尽量先用 15,给它几秒时间清理临时文件和释放端口,实在不行再用 9。另外,pkill -f 关键词 可以按命令行匹配杀掉进程,比如 pkill -f "python3 app.py",比先 grep PID 再 kill 快很多,但匹配关键词要写准确,不然容易误杀。
4.2 端口占用排查:9090 端口到底被谁用了
“端口被占”应该是群里提问频率最高的问题之一。我记得有个热搜词是“linux的9090端口什么再用”,这其实是个非常典型的排查场景。9090 端口常见于一些管理面板、监控插件,但到底被谁用了,得自己查。
现在的发行版,我首选 ss -tlnp。t 表示只显示 TCP,l 表示只看监听状态,n 用数字显示端口,p 显示进程信息。执行后你会看到类似 LISTEN 0 128 0.0.0.0:9090 0.0.0.0:* users:(("nginx",pid=1234,fd=10)),这样既知道端口被监听,也知道是哪个进程、哪个 PID。如果机器上 ss 没装或习惯用老命令,netstat -tlnp 也一样,但新系统一般推荐 ss,性能更好,信息更全。
如果只想查 9090 这一个端口,也可以看具体进程:lsof -i:9090。lsof 输出的第一行会显示 COMMAND、PID、USER、FD、TYPE、DEVICE、SIZE、NODE、NAME,信息非常完整。看到 PID 之后,你想处理它,可以用 ps -fp PID 看它到底是什么程序,再决定是 kill 还是留着。千万不要直接见到 9090 被占就 kill,先搞清楚它是不是系统关键服务。
4.3 前台后台、nohup 与系统服务的区别
在终端里启动一个长期运行的程序,如果直接 python3 app.py,你会发现 Ctrl+C 一按,进程就没了,退出 SSH 连接也可能导致进程被杀。早期我部署脚本时踩过这个坑,后来懂了三个工具:& 后台运行、nohup 忽略挂断信号、systemd 做服务托管。
最简单的方式是 nohup python3 app.py > app.log 2>&1 &。nohup 的意思是 no hangup,不让进程因为终端断开而挂掉;> 把标准输出写到日志文件;2>&1 把标准错误也并进去;最后的 & 让命令立即回到 shell。这个组合是临时部署的一把好手。但如果你在正经服务器上部署,我更建议直接写 systemd 服务文件,它有自动重启、开机自启、日志收集等能力。新建 /etc/systemd/system/myapp.service,写 ExecStart、WorkingDirectory、User,然后 systemctl daemon-reload、systemctl enable --now myapp。这两套方案我都用过,临时测试用 nohup,正式环境必须上 systemd。
5. 远程操作与文件传输
5.1 scp 命令实战:端口、目录、密钥一个不能少
scp 是 SSH 体系自带的文件传输工具,语法和 cp 很像,但目标主机是 host:path 格式。从本地传到远端:scp /data/app.zip root@192.168.1.10:/data/。从远端拉回本地:scp root@192.168.1.10:/data/app.zip ./。复制目录要加 -r:scp -r ./site root@192.168.1.10:/var/www/。
端口、密钥这些细节才是实际工作里的坑。如果你的 SSH 不是默认 22 端口,scp 要写 -P 2222,注意是大写 P,小写 p 是 ssh 里的另一个含义,很多人在这栽过。如果公司内网要求用密钥登录,你要先确保本地的 ~/.ssh/id_rsa.pub 已经加到目标机器的 ~/.ssh/authorized_keys 里,否则 scp 会一直提示输入密码。用 ssh-copy-id user@host 可以一键完成这个操作,省心很多。
另外,scp 传大文件、传大量小文件时性能一般。大文件想续传、增量同步,我推荐换用 rsync:rsync -avz --progress /data/app.zip root@192.168.1.10:/data/。rsync 支持断点续传、差量传输、压缩传输,遇到一半断网的情况,重跑一遍会自动跳过已传内容,这在 scp 里做不到。
5.2 网络连通性排查:从 ping 到 curl
网络排障有一条清晰的路径。先用 ping 确认网络通不通,ping -c 4 目标IP;再测端口通不通,可以用 telnet IP 端口,连上会显示 Connected,也可以用 nc -vz IP 端口,一条命令就能拿到结果;如果目标是 HTTP/HTTPS 服务,直接用 curl -v http://IP:9090/,它能打印完整的连接过程和 HTTP 响应头,nginx 返回 200 还是 403 一目了然。
本地验证 nginx 装没装好,我最常用的是 curl -I http://localhost。-I 只拿响应头,不会把整个页面下载下来。如果看到 HTTP/1.1 200 OK,说明服务已经正常响应。而如果 curl 都通了,但外部访问还是不通,那就要去看防火墙和云厂商的安全组规则了。这里也说一句,别忘了一个小命令 ip addr,它查看本机 IP 地址;arp -a 偶尔也能帮你发现同网段设备,虽然使用频率不高,但关键时刻能解围。
6. 软件安装与环境配置
6.1 用包管理器拿下 nginx 和 Python
安装软件在不同发行版上有不同套路。Debian/Ubuntu 系用 apt,CentOS/RHEL 系用 yum 或 dnf。新手最大的误区是上来就编译源码,既慢又容易缺依赖。正确姿势是先从包管理器里找现成的。
装 nginx 很简单:apt update && apt install -y nginx。装完验证一下版本 nginx -v,然后 systemctl start nginx、systemctl enable nginx。如果不需要系统级服务,也可以直接在项目目录下用 nginx -c /path/to/nginx.conf 指定配置文件启动,这个在联调环境很常用。
装 Python 也一样,apt install -y python3 python3-pip,然后 python3 --version 和 pip3 --version 确认。但 Python 有个经典陷阱:不要拿系统 Python 直接当项目环境用。不同项目依赖版本冲突,极难处理。我现在的项目里一律用 venv,python3 -m venv venv,然后 source venv/bin/activate,项目依赖全部装进虚拟环境。这样即使系统升级 Python 版本,也不会影响线上服务。如果你是装 MATLAB 2022b 这类商业软件,那就要认真看它的安装文档,它要求很多图形库和数学库,缺一个就报错,这种软件反而适合提前把依赖列齐了再装。
6.2 安装 Docker 并配置国内镜像加速
Docker 现在已经是部署绕不开的工具了,装它别再用网上那些乱七八糟的脚本,直接到官方文档拿对应发行版的安装命令是最稳的。Debian/Ubuntu 系就是先装依赖,add 官方 GPG key,再添加 apt 源,最后 install docker-ce。装完以后,docker --version 验证一下,systemctl enable --now docker 让守护进程开机自启。
有两个细节我特别想说。一是如果不想每次敲 docker 命令都加 sudo,就把当前用户加入 docker 组:usermod -aG docker $USER,重新登录后生效。二是 Docker 拉镜像的速度经常很让人着急,这里不是在讲特殊手段,而是说官方 Docker Hub 本身速度慢,我们可以配置一个镜像加速器。修改 /etc/docker/daemon.json,加 registry-mirrors 字段,然后重启 docker。这个文件建议提前备份,改错了 docker 可能起不来。配置完用 docker info 查看 Registry Mirrors 一栏是否生效。
6.3 Linux 输入法设置:桌面环境下的刚需
如果你在个人电脑上装了 Linux 桌面版,输入法绝对是最影响幸福感的东西。Linux 下主流的输入法框架是 fcitx5 和 ibus。两者选其一,我推荐 fcitx5,兼容性和卡顿控制都更好。安装中文输入法引擎,比如 fcitx5-chinese-addons,然后在系统设置里把输入法框架切到 fcitx5,再添加拼音输入法。如果某些应用里无法输入中文,多半是环境变量没设置好,需要在 ~/.profile 或 ~/.xprofile 里导出 GTK_IM_MODULE 和 QT_IM_MODULE。这些配置看起来琐碎,但配置好了以后,日常写文档、聊天、查代码注释,体验和 Windows 差距不大。国产 Linux 发行版现在大多预装了类似方案,改动更少,但跨发行版换系统时,这套手动配置的方法还是通用的。
7. 高频面试题自查与避坑清单
7.1 那些面试官最爱问的基础场景
我面过不少候选人,Linux 基础题能问得很细,但翻来覆去就是几个场景。第一组是“文件系统操作”:如何查看磁盘剩余空间?df -h;如何看某个目录占了多少空间?du -sh 目录。这两个命令天天用,但很多人在简历里写过,真让写命令的时候就打磕巴。
第二组是“查找与过滤”:如何找出 /var/log 下最近 7 天被修改过的文件?find /var/log -type f -mtime -7;如何在日志里过滤关键字?grep ERROR app.log 或者 tail -f app.log | grep ERROR 实时查看。
第三组是“shell 脚本判断”:Linux 指令里的 -d 是什么?这是一个高频考点。[ -d /data ] 这个表达式是判断 /data 是否是一个存在的目录,成立返回真。配套的还有 [ -f file ] 判断文件是否存在、[ -z "$var" ] 判断变量是否为空。在脚本里写服务启动逻辑时,[ -d /data ] || mkdir -p /data 这种写法非常常见,掌握了它,脚本的健壮性能上一个台阶。
第四组是“权限与安全”:如何给一个目录递归授权给指定用户?chown -R user:group /data;如何让新文件默认带特定权限?umask 设置。能把这几个场景讲清楚,面试官基本就认可你的 Linux 功底了。
7.2 一页纸常用命令自查:覆盖日常 80% 的场景
我列了一张自己团队新人都要过的自查表,也是我平时帮人救火时最常用的命令集合。每一条都不是学院派示例,而是真实场景里反复出现过的。
| 场景 | 命令 | 说明 |
|---|---|---|
| 查看磁盘空间 | df -h |
按可读大小显示分区占用 |
| 查看目录大小 | du -sh /data |
统计目录总大小 |
| 查找文件 | find /etc -name "*.conf" |
按名字在指定范围找 |
| 实时查看日志 | tail -f /var/log/app.log |
跟踪日志输出 |
| 查看端口监听 | ss -tlnp |
列出监听端口和关联进程 |
| 查端口被谁占用 | lsof -i:9090 |
直接定位 PID |
| 查看进程 | ps -ef 或 ps aux |
全量进程列表 |
| 杀进程 | kill -9 PID |
强制结束 |
| 远程传输 | scp -P 2222 a.txt user@host:/path |
带端口传输 |
| 增量同步 | rsync -avz --progress src/ dst/ |
大文件更稳 |
| 压缩解压 | tar -czvf a.tar.gz dir/ |
打包压缩 |
| 解压 | tar -xzvf a.tar.gz |
解压到当前目录 |
| 权限修改 | chmod 754 file |
数字权限位 |
| 属主修改 | chown -R user:group dir/ |
递归改属主 |
这张表不用背,你只要记住问题场景,命令查一次两次就熟了。我在带人的时候,从来不让他们抄命令,而是让他们先想清楚“我要解决什么问题”,然后再去查对应的命令,这样学到的才是带场景的知识,而不是一串死字符。
7.3 容易忽略但值得深挖的小知识
最后聊几个在基础之上、又容易拉开差距的点。软链接和硬链接经常被问。ln -s target linkname 创建软链接,可以跨文件系统,可以链接目录;ln target linkname 创建硬链接,只能在同文件系统内,且不能链接目录。日常使用中,软链接最常见的场景是切换版本:当前版本目录指向 v1.2,发布新版本后把链接指到 v1.3,服务无需重启就能切换,这个思路在改造部署流程时非常实用。
另外,日志被删了但磁盘空间没释放,也是一个经典坑。原因是文件还在被进程占用,Linux 在删除时如果文件被打开,空间要等进程关闭文件后才释放。遇到磁盘满了、df 显示使用率不变的情况,先用 lsof | grep deleted 找到还在占用已删除文件的进程,再决定重启进程还是直接 kill。
还有一个值得养成的习惯:遇到奇怪问题,先看 /var/log/messages 或 /var/log/syslog。系统日志里经常直接写着根因,比自己瞎猜快得多。我排查过很多“灵异事件”,最后都在内核日志里找到了答案,比如磁盘 IO 错误、网卡断连、PCIe 映射问题,这些在业务日志里根本看不见,但系统日志里全都有。
最后:把基础打牢,比什么都值
写到这里,把 Linux 基础知识的几大块都过了一遍。我个人这几年最深的体会是,学习 Linux 最好不要死记硬背,而是带着问题去操作,错了就查日志,查不到就 man,再不行就搜。踩过几次坑之后,那些命令会牢牢长在你脑子里,比看十遍教程都管用。如果你刚接触 Linux,建议自己装一台虚拟机或者一个云主机,把用户创建、nginx 部署、docker 安装、权限配置整个流程走一遍,中间遇到的所有报错都是你的学习素材。这比你囤一堆命令手册要有用得多。最后再分享一个小技巧:建立一个自己专属的“命令笔记”,每次遇到新问题,把解决方案记下来,半年之后再回头看,你会发现很多当时觉得难的东西,早就变成下意识反应了。
