1. 为什么存储管理是所有操作系统的“硬骨头”
先说个结论:操作系统这门课里,存储管理部分如果没学透,后面学虚拟内存、文件系统、进程调度都会觉得隔了一层。我当年在电子科大网课上啃这部分的时候,最大的感受就是——存储管理不像进程管理那样有“状态机”可以画,也不像设备管理那样可以靠“中断处理”这种具体机制来理解,它更像是操作系统和硬件之间的一场“资源博弈”,而“简单存储管理”就是这场博弈的入门局。
先说清楚存储管理到底解决什么问题。一台计算机的内存是有限的,而运行的程序是很多的。操作系统要做的第一件事,就是把有限的物理内存分配给多个进程使用,同时保证进程之间互不干扰。这听起来简单,但真做起来有三件麻烦事:第一,程序编译出来的地址是逻辑地址,不是物理地址,得有个办法转换;第二,内存分配出去以后会产生碎片,碎片多了内存就浪费了;第三,内存装不下所有进程怎么办,得有个腾挪的办法。
“简单存储管理”这个名字里的“简单”其实隐藏了一个重要信号:这是一套只解决“把一个程序放进内存并让它跑起来”的基本方案。它不是最优解,但是理解后续所有复杂方案的基础。就像你学数据结构,必须先学数组再学链表一样,存储管理也是从“连续分配”这个最朴素的内存使用方式讲起。
这门课的内容其实可以拆成两条主线。一条是“空间管理”——怎么划分内存、怎么分配内存、怎么回收内存;另一条是“地址转换”——怎么把一个程序里的逻辑地址变成物理地址。简单存储管理主要走的是前一条线,但地址转换作为基础也绕不开。实际上这两条线交织在一起,因为不管用哪种分配方式,程序跑起来都需要地址转换做支撑。
这篇文章我按自己的笔记节奏来写,先把地址转换的底层逻辑理清楚,再讲连续分配的三种方式,然后讲覆盖和交换这两个“入门级优化”,最后把碎片问题、常见易错点串一遍。这样学习顺序其实比教材目录更贴近真实的理解过程——你先知道“程序怎么从逻辑地址变到物理地址”,再去看“内存怎么分配”,就不会觉得前面那些概念是飘着的。
需要模型API调用? 免费领10W Token,多模型网关一键接入 Claude、DeepSeek 等主流模型。
2. 逻辑地址到物理地址:地址转换是存储管理的“地基”
2.1 为什么程序里写的地址是“假的”
学存储管理之前,我一直有个挺天真的想法:程序编译成机器码以后,里面的地址就是内存里的真实地址。直到学到地址转换这块才明白,这想法基本错得离谱。
我们平时写的C代码,编译链接之后生成的程序里,地址是从0开始排的。比如一个简单的指令“LOAD 100”,意思是把地址100里的数据读进来。但这个100是“逻辑地址”,是相对程序自己起始位置算出来的距离,不是内存条上的真实位置。为什么这么设计?因为程序在写的时候根本不知道自己会被放到内存的哪个位置——今天可能装在内存地址1000开始的地方,明天可能装在地址2000开始的地方。如果编译时就写死物理地址,那换一台机器、换一种加载方式程序就跑不了了。
所以操作系统或者硬件需要做一件事:把程序里的逻辑地址转换成真实的物理地址,这个过程叫“地址转换”,也叫“重定位”。
2.2 静态重定位和动态重定位的区别
重定位有两种方式:静态重定位和动态重定位。静态重定位是程序装入内存的时候,一次性把程序里所有逻辑地址都修改成物理地址。这种方式实现简单,但有个致命问题:程序一旦装入内存就不能再移动了,否则地址就全错了。
动态重定位则是程序运行时,每次访问内存都做一次“物理地址 = 逻辑地址 + 基址寄存器里的值”的计算。这个方式灵活很多,程序在内存里挪个位置,只要把基址寄存器改一下就行。现代操作系统基本都是用动态重定位,配合后面的虚拟内存机制,还能让程序的一部分在内存、一部分在磁盘,这就是后话了。
电子科大网课里有个比喻我当时印象很深:静态重定位就像是你提前在地图上把每一个地点都标好了坐标,然后拿着这张地图走;动态重定位就像你随身带一个“当前位置偏移量”,走到哪里都用“目标地点相对距离+当前位置”来算真实位置。前者地图做死了,后者走到哪都能算。
2.3 基址寄存器和界限寄存器:保护和转换一起做
动态重定位的实现需要硬件支持,关键就是CPU里的两个寄存器:基址寄存器和界限寄存器(有的书也叫限长寄存器)。
- 基址寄存器(Base Register):存放程序在物理内存中的起始地址。
- 界限寄存器(Limit Register):存放程序的地址范围上限。
每次访问内存时,硬件会先把逻辑地址和界限寄存器比较,如果逻辑地址大于界限寄存器里的值,说明程序在越界访问,马上触发异常,把这个进程干掉。这是内存保护最基础的手段。如果没越界,就执行“物理地址=逻辑地址+基址寄存器值”的加法,去访问真正的物理内存。
这个操作不复杂,但我建议你手写一遍流程,因为它跟后面分页、分段是一脉相承的。分页的时候就是“逻辑地址拆成页号+页内偏移”,再用页表查物理页号;分段的时候是“段号+段内偏移”,用段表查段基址。本质上都是“逻辑地址+某种映射表=物理地址”的游戏。
3. 连续分配方式:简单存储管理的核心方案
3.1 单一连续分配:最原始的方案
整个存储管理里最简单的一种分配方式,就是“单一连续分配”。这种方案把内存分成两个区域:一个给操作系统,剩下的全给一个用户程序。早期单用户单任务的系统(比如最原始的微机系统)就是这种玩法。优点是真的简单,不需要复杂的数据结构,也不用考虑多进程;缺点是内存利用率极低,程序再小,剩下的空间也只能浪费着,而且根本谈不上支持多道程序。
这种方案现在基本见不到了,但它有两个价值:一是帮你理解“内存分区”这个基本思路;二是它直观展示了“整块分配”的局限性,逼着人们去设计固定分区和动态分区。你学的时候别觉得它简单就跳过去,把它当成整个存储管理演进故事的起点来读。
3.2 固定分区分配:划分好了就固定不变
固定分区分配的思路很好理解:系统启动的时候,把内存划分成若干大小相等的或不等的分区,每个分区可以装入一个进程。进程来了,就给它找一个足够大的空闲分区装进去。
这种方案的优点是实现简单,因为分区表一旦建立就基本不变,分配和回收都很容易。但缺点也明显:
- 分区大小是事先定好的,如果进程比分区小,分区剩余的空间就只能内部浪费,这叫“内部碎片”。
- 如果进程大小超过了最大分区,即使内存总空闲空间够大,这个进程也跑不了。
上电科大的网课时,课件里给了个例子我印象很深:内存划分成4个分区,分别是8KB、16KB、32KB、64KB,现在来了一个40KB的作业,它只能放进64KB那个分区,剩下24KB就白瞎了。这种内碎片问题是固定分区方案最被诟病的点。
固定分区还有个变体叫“分区大小不等的多队列法”,就是按分区大小把进程分到不同队列去排队。但这只是在优化“大作业进不了小分区”的尴尬,解决不了内部碎片问题。所以后来才有人想:不如干脆不要固定分区,进程需要多少内存,就动态地给它切一块刚刚好的空间出来,这就是动态分区分配。
3.3 动态分区分配:按需分配的进化之路
动态分区分配的核心思想是:不预先划分内存,系统维护一个空闲分区表(或空闲分区链),进程装入时动态地划分一块刚好足够大的区域给它,剩余的仍作为空闲分区。
先说数据结构。常见的有两种:空闲分区表和空闲分区链。空闲分区表用一个表记录所有空闲分区的起始地址和大小;空闲分区链则用链表把这些空闲分区串起来,每个空闲分区的前几个字节存链表指针和分区大小等信息。两者各有优劣,表适合分区数量少的情况,直观好查;链适合分区数量多、经常变动的情况,插入删除灵活。考试里经常问你“有没有必要同时维护一个已分配分区表”——答案是没必要,因为每个已分配分区的大小信息通常可以在进程的PCB里记录,只要维护空闲的分区状态就够了。
再讲分配算法。这是动态分区里最容易考的大题,也是面试题常客。主流的算法有四个:
| 算法 | 选分区方式 | 优点 | 缺点 |
|---|---|---|---|
| 首次适应算法(FF) | 从低地址开始找第一个能装下进程的空闲分区 | 优先利用低地址内存,查找速度快 | 低地址被频繁拆分,留下很多小碎片 |
| 最佳适应算法(BF) | 找所有能装下的分区中最小那个 | 尽量保证大分区完整 | 会产生大量难以利用的极小碎片 |
| 最差适应算法(WF) | 找所有能装下的分区中最大那个 | 分配后剩余空间仍较大,减少小碎片 | 大分区被迅速拆完,对后续大作业不友好 |
| 循环首次适应(NF) | 从上次分配的位置继续往后找第一个能装下的分区 | 空闲分区分布更均衡 | 查找可能绕一圈才找到,性能波动 |
这四个算法我建议一定要自己画一个内存分布图,拿一组作业进去模拟一遍。比如内存空闲分区是20KB、60KB、120KB,三个作业分别是30KB、50KB、100KB,按FF、BF、WF分别模拟一遍分配结果。实际操作过一遍,比背十遍优缺点都管用。当时我学这块,专门在笔记本上画了四张图,每张图上用箭头标出查找路径,才算真正把区别刻在脑子里。
动态分区最头疼的问题是外部碎片。什么叫外部碎片?就是空闲分区总体积够大,但被切得七零八落,任何一个单独分区都装不下新进程。解决外部碎片的标准手段是“紧凑”,也就是把内存中已分配的分区全部挪到一起,让空闲区合并成一块连续的大空间。但紧凑成本很高,需要修改所有进程的基址寄存器,如果系统频繁紧凑,性能会非常难看。
3.4 动态分区的内存回收:细节里藏着坑
我刚才写笔记到这里时,发现自己一开始根本没重视内存回收,直到做题才发现它也是重头戏。回收空闲分区时,需要判断被回收的分区与哪些空闲分区相邻,有四种情况:
- 回收区与上面一个空闲分区相邻:合并成一个新的空闲分区,起始地址为上面那个空闲分区的起始地址。
- 回收区与下面一个空闲分区相邻:合并,起始地址为回收区自己的起始地址。
- 回收区同时与上下两个空闲分区相邻:三者合并,起始地址为上方空闲分区的起始地址,大小是三个区间之和。
- 回收区孤零零的,上下都不是空闲区:直接把这个回收区作为一个新空闲分区插入链表。
这几种情况的判断逻辑很简单,但考试极爱出。我当时因为没画图,第一遍做题时四种情况搞混了三种。后来自己拿纸条剪了几段代表分区,然后在桌面上摆合并过程,才彻底记住。遇到这种题,最稳的办法也是画图——把分配前的内存布局画出来,标清楚回收区位置,再逐段合并,正确率极高。
另外,在合并空闲分区时还要考虑链表的有序性。如果用的是按地址递增排列的空闲分区链,合并后要把新分区插入到正确位置,同时更新相邻节点的指针。这些内容看起来琐碎,但写代码实现内存分配器时全都会遇到,不是“学科知识”,而是“工程基础”。
4. 内存不够用怎么办:覆盖与交换技术
4.1 覆盖技术:让程序自己“拼拼图”
连续分配方式有个天然天花板:内存里必须有一整块连续空间装下整个进程。但现实中经常出现这种情况——一个程序的代码和数据其实不是同时被用到的。比如一个大型数据处理程序,第一阶段读数据,第二阶段计算,第三阶段输出结果,这几个阶段完全可以轮流占用同一块内存区域。
覆盖技术就是基于这种观察设计的。它把程序划分为若干模块,规定哪些模块之间存在调用关系,哪些模块之间互相独立、可以共用同一块内存区域。覆盖的基本思想是:让不可能同时执行的模块共享同一块内存区,这块区域叫“覆盖区”。
具体做法是,程序员或编译器要为程序建立一张覆盖结构图,把程序划分成常驻部分(必须一直在内存里的主控模块)和覆盖部分(可以换入换出的模块)。运行时,主控模块常驻内存,其他模块需要时才调入覆盖区。比如一个程序的覆盖结构是:主模块M常驻,模块A和B互斥,模块C和D互斥,那么A/C可以放在同一个覆盖区(因为它们不同时运行),B/D放在另一个覆盖区。
覆盖技术最大的问题在于:它把内存管理的复杂工作推给了程序员。程序员必须清楚地知道程序每个模块的执行路径和调用关系,这在实际大型软件里几乎不可行。今天这门技术基本已经退场,但它代表的思路——把“程序代码的局部性”利用起来——后来在虚拟存储的请求分页系统里得到了真正的发扬光大。所以学覆盖技术时,重点不是学会怎么用,而是理解它为什么要这么做、为什么失败了。
4.2 交换技术:从“装不下”到“先挪走”
交换技术思路更操作系统化:内存装不下所有进程时,把一个暂时不运行的进程整个搬到磁盘上(换出),腾出空间给需要运行的进程;当被换出的进程重新被调度时,再把它从磁盘读回内存(换入)。这就是“中级调度”的核心支撑,也是多道程序系统中提高内存利用率的经典手段。
交换技术有几个关键点,考试和面试都容易问:
- 交换的单位是什么?是整个进程,不是进程的一部分。这是交换和覆盖最大的不同。交换对程序员是透明的,不需要程序做什么修改;覆盖则需要程序员参与设计。
- 交换到什么位置?通常是磁盘上专门开辟的对换区。对换区的组织方式比文件区更“扁平”,因为它不需要文件系统的树形目录结构,直接按物理块管理,追求的是换入换出的速度。
- 什么时候交换?一般发生在进程状态变化或内存不足时。比如一个进程从运行态变为阻塞态且长时间不会醒来(比如在等I/O),调度器就可能把它换出去。
- 换出时要考虑什么?优先换出阻塞进程、优先级低的进程,尽量避免换出正在使用的、有大量I/O数据的进程,因为换入换出代价太大。
这里有个很容易忽略的坑:如果进程在换出之前正在执行I/O操作,那I/O的缓冲区是对着物理地址的,换出后I/O还在继续往这块物理地址写数据,就会覆盖别的进程的数据。解决办法有两个:一是换出前先把I/O操作执行完毕或取消;二是I/O操作只能使用操作系统缓冲区,由操作系统负责把数据拷贝到用户进程的内存区。这个知识点在电子科大网课里只是一带而过,但实际面试问“多道程序环境下I/O怎么做”时,就是考的这一点。
4.3 覆盖和交换的结合:现实中的取舍
覆盖和交换经常被放在一起比较。最核心的区别有三点:
| 对比维度 | 覆盖技术 | 交换技术 |
|---|---|---|
| 谁来控制 | 程序员/编译器 | 操作系统 |
| 交换单位 | 程序模块(覆盖段) | 整个进程 |
| 是否需要额外存储空间 | 不需要(在同一内存区复用) | 需要磁盘对换区 |
不难看出,覆盖技术本质是“内存内部的复用”,交换技术是“内存和磁盘之间的搬移”。覆盖技术不做磁盘I/O,速度快,但要求程序员对程序结构非常熟悉;交换技术对程序员透明,但换入换出整个进程的I/O开销很大。
实际系统里两者经常结合使用。早期一些多道批处理系统就是“交换为主、覆盖为辅”:操作系统用交换技术控制多道程序的并发,而单个大作业内部再用覆盖技术降低自身内存需求。这种“系统级+程序级”的组合优化思想,放到今天依然很有启发——你看现在很多云原生应用,既有容器级别的资源限制,也有应用内部的缓存淘汰策略,本质就是分层处理资源问题。
5. 关于分配算法的实战补充:怎样计算和比较
5.1 一个手算实例:三种算法对比
我写这部分的时候,特意从当时的笔记里翻出一个例子,假设内存中的空闲分区链如下:20KB、15KB、30KB、60KB。现在有三个作业要装入,大小分别是12KB、25KB、40KB,只考虑最先装入的一个,看三种算法会选哪个分区。
- 首次适应(FF):从低地址开始找,第一个能装下12KB的分区是20KB,装入后剩余8KB。
- 最佳适应(BF):12KB能装下的分区有20KB、15KB、30KB、60KB,选最小能装下的15KB,装入后剩余3KB。
- 最差适应(WF):选最大的60KB,装入后剩余48KB。
同样的例子,如果第一个作业是25KB,再算一次,三种算法的选择明显不同。FF选30KB,BF也选30KB,WF选60KB。这就是为什么考试喜欢拿这种题来考——它不是死记硬背的题,而是考察你对算法逻辑的理解。
我当时总结了一个口诀帮助记忆:“FF找第一,BF找最小,WF找最大,NF转着找。”但前提是,动手画一遍每个算法的查找路径,把“选分区”变成肌肉记忆。
5.2 碎片问题的量化思维
讲碎片问题时,要看一个叫“碎片率”的概念。碎片率的计算方式可能因教材而异,通常是“无法利用的空闲空间 / 总空闲空间”。碎片率高了,说明内存虽然显示有空闲,但都碎得没法用。
外部碎片和内部碎片是两种不同的东西:
| 碎片类型 | 产生原因 | 发生场景 |
|---|---|---|
| 内部碎片 | 分配的内存比实际需求大,多出来的部分在分区内部 | 固定分区、按页分配 |
| 外部碎片 | 空闲空间被切碎,单个分区不连续不够用 | 动态分区分配 |
动态分区用紧凑可以缓解外部碎片,但代价是CPU时间和搬运数据的开销。教科书上常说“紧凑时机”(比如系统空闲时、进程缺页时),但实际系统不会频繁做全局紧凑,因为代价太高。这也解释了为什么后面会出现分页、分段机制——它们本质上是用更小的分配单位(页、段)来从根源上解决碎片问题,而不是在分配后再想办法合并。
6. 考试高分技巧:这章内容常见易错点梳理
6.1 概念辨析类题目:别被“名字很像”坑了
存储管理这一章概念密集,几组特别容易混淆的词,考试和面试都很爱考:
- “静态重定位”和“动态重定位”。判断标准是“地址转换发生的时间点”。静态在装入时一次性完成;动态在每次访问时实时完成。动态重定位配合紧凑、交换、虚拟内存都好使,属于现代系统的标配,面试时提到这个加分。
- “固定分区”和“可变分区”。固定分区的边界是系统启动后不变的,进程装进去有内部碎片;可变分区(动态分区)是按需划分的,没有内部碎片但有外部碎片。有些教材里提到的“可变分区”其实就是“动态分区分配”,别被名字搞晕。
- “覆盖”和“交换”。重点看控制者和单位,上面那张表记熟了基本不会错。
- “紧凑”和“交换”。紧凑是内存内部移动已分配分区;交换是把进程搬到磁盘。两者都用来解决内存不足,一个靠挪,一个靠搬,别混。
这类题目最好平时就自己做一张对比表,不要等到考前才突击。因为考场上瞬时记忆会混淆,只有理解原理才能稳。
6.2 计算类题目:地址转换三步走
地址转换的计算题是必考题型,套路非常固定。核心公式:
物理地址 = 逻辑地址 + 基址寄存器值
判断是否越界:
逻辑地址 ≥ 界限寄存器值 → 越界,拒绝访问
做题时记住三步走:
- 先看逻辑地址是否小于界限寄存器值,不满足直接报错,不需要继续算。
- 用逻辑地址加基址寄存器值,得到物理地址。
- 检查这个物理地址是否真的落在该进程的已分配区域内(这一步各教材要求不同,但如果题目给了上限,就检查一下)。
举个典型例子:基址寄存器值是2000,界限寄存器值是5000,逻辑地址是3600,那么物理地址是5600,且3600小于5000,合法。如果逻辑地址是5200,那就越界了,触发保护异常。
6.3 错题本上的“经典三坑”
第一个坑:动态分区分配的BF(最佳适应)算法,有人以为“最佳”就是性能最好。实际上性能优劣要看场景,最佳适应算法很容易产生大量极小的、无法分配的碎片,系统运行久了内存状态会很难看。它只是“选出来的分区在视觉上最合适”,不代表整体效果最好。
第二个坑:交换技术的换出对象,很多人只记得“优先换出阻塞进程”,忘了要“避免换出正在I/O的进程”。考试如果给了“正在执行I/O的进程”这个选项,它恰恰是最不该换出的,因为换出后I/O缓冲会写错地方。很多教辅里都拿这个当区分学霸和普通学生的题。
第三个坑:固定分区分配时,进程大小刚好等于某个分区大小,是否有内部碎片?没有,内部碎片是“实际分配空间大于需求”的差值,等于零就没有碎片。但如果进程比分区小,哪怕小1KB,那1KB就变成内部碎片。考试经常在数字上做文章,别看完题目一看是“不足整块”就直接写有碎片。
7. 学习心得:为什么“简单存储管理”值得学透
回到最初的问题——为什么明明现在系统都在用分页、段页式,还要花一整章学“简单存储管理”?我的答案有几个。
第一,简单存储管理把存储管理的基本矛盾摊开了:资源有限、需求多样、碎片难免。这些矛盾在分页、分段中依然存在,只不过换了表现形式。你把连续分配的优点和缺点吃透了,后面学分页的“消除外部碎片”、分段“满足模块化需求”、虚拟存储“放大内存”时,才知道它是在解决什么问题。
第二,它在考试里是“送分题和送命题并存”的一章。送分题是指概念对比题,理解透彻就能拿分;送命题是指分配算法的模拟题,一画错就全错。把这一章弄扎实,后面对付期中和期末都有底气。
第三,它跟实际工程有非常直接的对应关系。很多嵌入式系统、实时操作系统至今仍然使用固定的内存分区或基于伙伴系统的分配方式;自己写一个简单的内存池、实现malloc的初版,用的也是动态分区分配的思路和首次适应算法。操作系统课不是学完就扔的“理论”,而是将来写代码时的底层工具。
电子科大的网课讲这部分用了很多图示和例题,我建议你看的时候手里备好纸笔,每一个分配过程都跟着画一遍。遇到不知道对错的题,就把内存状态化成一组“已分配/空闲”的长条形图,一步步推演。存储管理这东西,看十遍不如画一遍。
最后再分享一个小技巧:学完这一章,找一道综合题,题目里同时包含分区分配、地址转换、碎片计算,不要看答案,限时做一遍,然后对着答案逐行批改。我当时这么练了三道题,考前对存储管理这部分的把握就明显不一样了。别急着往下赶进度,把简单存储管理磨透了,后面的路会顺很多。
