怎樣閱讀內核源碼

来源:互联网 发布:php ddos攻击 编辑:程序博客网 时间:2024/06/08 05:56

1.获取内核
  一般在Linux系统中的/usr/src/linux*.*.*(*.*.*代表的是内核版本,如2.4.23)目录下就是内核源代码(假如没有类似目录,是因为还没安装内核代码)。另外还可从互连网上免费下载。注意,不要总到http://www.kernel.org/去下载,最好使用他的映像站点下载。请在http://www.kernel.org/mirrors/里找一个合适的下载点,再到pub/linux/kernel/v2.6/目录下去下载2.4.23内核。这里有两种类型的代码包,即linux-2.4.23.tar.gz和linux-2.4.23.tar.bz2。两个代码包内容是相同的,只是压缩程式不同。.gz是用gzip压缩的;.bz2是用bzip2压缩的。bzip2的压缩能力比gzip强。


2.代码目录结构
  在阅读源码之前,还应知道Linux内核源码的整体分布情况。现代的操作系统一般由进程管理、内存管理、文档系统、驱动程式和网络等组成。Linux内核源码的各个目录大致和此相对应,其组成如下(假设相对于Linux-2.4.23目录):
  
  ◆arch目录包括了任何和体系结构相关的核心代码。他下面的每一个子目录都代表一种Linux支持的体系结构,例如i386就是Intel CPU及和之相兼容体系结构的子目录。PC机一般都基于此目录。
  
  ◆include目录包括编译核心所需要的大部分头文档,例如和平台无关的头文档在include/linux子目录下。
  
  ◆init目录包含核心的初始化代码(不是系统的引导代码),有main.c和Version.c两个文档。这是研究核心怎样工作的好起点。
  
  ◆mm目录包含了任何的内存管理代码。和具体硬件体系结构相关的内存管理代码位于arch/*/mm目录下。
  
  ◆drivers目录中是系统中任何的设备驱动程式。他又进一步划分成几类设备驱动,每一种有对应的子目录,如声卡的驱动对应于drivers/sound。
  
  ◆ipc目录包含了核心进程间的通信代码。
  
  ◆modules目录存放了已建好的、可动态加载的模块。
  
  ◆fs目录存放Linux支持的文档系统代码。不同的文档系统有不同的子目录对应,如ext3文档系统对应的就是ext3子目录。
  
  Kernel内核管理的核心代码放在这里。同时和处理器结构相关代码都放在arch/*/kernel目录下。
  
  ◆net目录里是核心的网络部分代码,其每个子目录对应于网络的一个方面。
  
  ◆lib目录包含了核心的库代码,但是和处理器结构相关的库代码被放在arch/*/lib/目录下。
  
  ◆scripts目录包含用于配置核心的脚本文档。
  
  ◆documentation目录下是一些文档,是对每个目录作用的具体说明。
  
  一般在每个目录下都有一个.depend文档和一个Makefile文档。这两个文档都是编译时使用的辅助文档。仔细阅读这两个文档对弄清各个文档之间的联系和依托关系很有帮助。另外有的目录下更有Readme文档,他是对该目录下文档的一些说明,同样有利于对内核源码的理解。
  
3.阅读起步
  在阅读方法或顺序上,有纵向和横向之分。所谓纵向就是顺着程式的执行顺序逐步进行;所谓横向,就是按模块进行。他们经常结合在一起进行。对于Linux启动的代码可顺着Linux的启动顺序一步步来阅读;对于像内存管理部分,能够单独拿出来进行阅读分析。实际上这是个反复的过程,不可能读一遍就理解。
  
  LXR(http://lxr.linux.no)是个辅助阅读的好工具,他能对指定的源码文档建立索引数据库,利用Perl脚本动态生成包含源码的Web页面。在此Web页中,任何的变量、常量和函数都以超连接的形式给出,查阅十分方便。另外,LXR还提供标识符搜索和文档搜索,结合程式Glimpse(http://glimpse.cs.arizona.edu)还能够对任何的源码文档进行全文检索,甚至包括注释。其安装方法能够参照其代码中的帮助文档。

原创粉丝点击