linux内核链表解析初学者如何理解内核链表linux内核链表对于大多数的初学者来讲,都是挺难的一部分,不容易搞懂。本篇文章就由华清远见为大家解析linux内核链表,初学者应该如何理解内核链表呢?请往下看!在Linux内核中使用了大量的链表结构来组织数据,包括设备列表以及各种功能模块中的数据组织。这些链表大多采用在[include/linux/list.h]实现的一个相当精彩的链表数据结构。很多linux下的源代码都会使用这个头文件,它里面定义了一个结构,以及定义了和其相关的一组函数,本文详细分析了3.14内核中链表结构的实现,并通过实例对链表操作接口进行了测试。一、链表数据结构简介链表是一种物理存储单元上非连续、非顺序的存储结构,数据元素的逻辑顺序是通过链表中的指针链接次序实现的。链表由一系列结点(链表中每一个元素称为结点)组成,结点可以在运行时动态生成。使用链表结构可以克服数组链表需要预先知道数据大小的缺点,链表结构可以充分利用计算机内存空间,实现灵活的内存动态管理。但是链表失去了数组随机读取的优点,同时链表由于增加了结点的指针域,空间开销比较大。链表最明显的好处就是,常规数组排列关联项目的方式可能不同于这些数据项目在记忆体或磁盘上顺序,数据的存取往往要在不同的排列顺序中转换。链表允许插入和移除表上任意位置上的节点,但是不允许随机存取。链表有很多种不同的类型:单向链表,双向链表以及循环链表。链表可以在多种编程语言中实现。像Lisp和Scheme这样的语言的内建数据类型中就包含了链表的存取和操作。程序语言或面向对象语言,如C,C++和Java依靠易变工具来生成链表。通常链表数据结构至少应包含两个域:数据域和指针域,数据域用于存储数据,指针域用于建立与下一个节点的联系。按照指针域的组织以及各个节点之间的联系形式,链表又可以分为单链表、双链表、循环链表等多种类型,下面分别给出这几类常见链表类型的示意图:1.单链表图1单链表单链表是最简单的一类链表,它的特点是仅有一个指针域指向后继节点(next),因此,对单链表的遍历只能从头至尾(通常是NULL空指针)顺序进行。2.双链表图2双链表通过设计前驱和后继两个指针域,双链表可以从两个方向遍历,这是它区别于单链表的地方。如果打乱前驱、后继的依赖关系,就可以构成二叉树;如果再让首节点的前驱指向链表尾节点、尾节点的后继指向首节点(如图2中虚线部分),就构成了循环链表;如果设计更多的指针域,就可以构成各种复杂的树状数据结构。3.循环链表循环链表的特点是尾节点的后继指向首节点。前面已经给出了双循环链表的示意图,它的特点是从任意一个节点出发,沿两个方向的任何一个,都能找到链表中的任意一个数据。如果去掉前驱指针,就是单循环链表。二、Linux3.14内核链表数据结构的实现链表数据结构的定义很简单(定义文件在linux-3.14-fs4412\include\linux\Types.h中):和第一节介绍的双链表结构模型不同,这里的list_head没有数据域。在Linux内核链表中,不是在链表结构中包含数据,而是在数据结构中包含链表节点。list_head结构包含两个指向list_head结构的指针prev和next,由此可见,内核的链表具备双链表功能,实际上,通常它都组织成双循环链表。在数据结构课本中,链表的经典定义方式通常是这样的(以单链表为例):structlist_node{structlist_node*next;ElemTypedata;};在Linux内核链表中,需要用链表组织起来的数据通常会包含一个structlist_head成员,structlist_node{structlist_headlist;ElemTypedata;};从下图中我们可以看到,这种通用的链表结构避免了为每个数据项类型定义自己的链表的麻烦。图3内核链表链表示意图三、链表操作接口1.声明和初始化实际上Linux只定义了链表节点,并没有专门定义链表头,那么一个链表结构是如何建立起来的呢?让我们来看看LIST_HEAD(和LIST_HEAD_INIT这2个宏:当我们用LIST_HEAD(my_list)声明一个名为t的链表头时,它的next、prev指针都初始化为指向自己,这样,我们就有了一个空链表.Linux用头指针的next是否指向自己来判断链表是否为空:2.插入/删除/合并a)插入对链表的插入操作有两种:在表头插入和在表尾插入。Linux为此提供了两个接口:因为Linux链表是循环表,且表头的next、prev分别指向链表中的第一个和最末一个节点,所以,list_add和list_add_tail的区别并不大,实际上,Linux分别用__list_add(new,head,head-next);和__list_add(new,head-prev,head);来实现两个接口,可见,在表头插入是插入在head之后,而在表尾插入是插入在head-prev之后。__list_add的实现如下:假设有一个新list_node结构变量new_list_node需要添加到my_list链表头,我们应当这样操作:list_add(&new_list_node.list,&my_list);从这里我们看出,my_list链表中记录的并不是new_list_node的地址,而是其中的list元素的地址。如何通过链表访问到new_list_node呢?下面会有详细介绍。b)删除当我们需要删除my_list链表中添加的new_sockopt项时,我们这么操作:list_del(&new_list_node.list);被剔除下来的new_list_node.list,prev、next指针分别被设为LIST_POSITION2和LIST_POSITION1两个特殊值,这样设置是为了保证不在链表中的节点项不可访问--对LIST_POSITION1和LIST_POSITION2的访问都将引起页故障。与之相对应,list_del_init()函数将节点从链表中解下来之后,调用LIST_INIT_HEAD()将节点置为空链状态。c)搬移Linux提供了将原本属于一个链表的节点移动到另一个链表的操作,并根据插入到新链表的位置分为两类:例如list_move(&new_list_node.list,&my_list)会把new_list_node从它所在的链表上删除,并将其再链入my_list的表头。d)合并除了针对节点的插入、删除操作,Linux链表还提供了整个链表的插入功能:假设当前有两个链表,表头分别是list1和list2(都是structlist_head变量),当调用list_splice(&list1,&list2)时,只要list1非空,list1链表的内容将被挂接在list2链表上,位于list2和list2.next(原list2表的第一个节点)之间。新list2链表将以原list1表的第一个节点为首节点,而尾节点不变。当list1被挂接到list2之后,作为原表头指针的list1的next、prev仍然指向原来的节点,为了避免引起混乱,Linux提供了一个list_splice_init()函数:staticinlinevoidlist_splice_init(structlist_head*list,structlist_head*head);该函数在将list合并到head链表的基础上,调用INIT_LIST_HEAD(list)将list设置为空链。3.遍历遍历是链表最经常的操作之一,为了方便核心应用遍历链表,Linux链表将遍历操作抽象成几个宏。在介绍遍历宏之前,我们先看看如何从链表中访问到我们真正需要的数据项。a)由链表节点到数据项变量我们知道,Linux链表中仅保存了数据项结构中list_head成员变量的地址,那么我们如何通过这个list_head成员访问到作为它的所有者的节点数据呢?Linux为此提供了一个list_entry(ptr,type,member)宏,其中ptr是指向该数据中list_head成员的指针,也就是存储在链表中的地址值,type是数据项的类型,member则是数据项类型定义中list_head成员的变量名,例如,我们要访问my_list链表中首个list_node变量,则如此调用:list_entry(my_list-next,structlist_node,list);这里list正是nf_sockopt_ops结构中定义的用于链表操作的节点成员变量名。list_entry的使用相当简单,相比之下,它的实现则有一些难懂:container_of宏定义在[include/linux/kernel.h]中offsetof宏定义在[include/linux/stddef.h]中:size_t最终定义为unsignedint(i386)。这里使用的是一个利用编译器技术的小技巧,即先求得结构成员在与结构中的偏移量,然后根据成员变量的地址反过来得出属主结构变量的地址。container_of()和offsetof()并不仅用于链表操作,这里最有趣的地方是((type*)0)-member,它将0地址强制转换为type结构的指针,再访问到type结构中的member成员。在container_of宏中,它用来给typeof()提供参数(typeof()是gcc的扩展,和sizeof()类似),以获得member成员的数据类型;在offsetof()中,这个member成员的地址实际上就是type数据结构中member成员相对于结构变量的偏移量。b)遍历宏以下是一个遍历内核链表节点的实例……structlist_head*i;……list_for_each(i,&nf_sockopts){structnf_sockopt_ops*ops=(structnf_sockopt_ops*)i;……}……函数首先定义一个(structlist_head*)指针变量i,然后调用list_for_each(i,&my_list)进行遍历。在[include/linux/list.h]中,list_for_each()宏是这么定义的:它实际上是一个for循环,利用传入的pos作为循环变量,从表头head开始,逐项向后(next方向)移动pos,直至又回到head(prefetch()可以不考虑,用于预取以提高遍历速度)。大多数情况下,遍历链表的时候都需要获得链表节点数据项,也就是说list_for_each()和list_entry()总是同时使用。对此Linux给出了一个list_for_each_entry()宏:#definelist_for_each_entry(pos,head,member)与list_for_each()不同,这里的pos是数据项结构指针类型,而不是(structlist_head*)。某些应用需要反向遍历链表,Linux提供了list_for_each_prev()和list_for_each_entry_reverse()来完成这一操作,使用方法和上面介绍的list_for_each()、list_for_each_entry()完全相同。如果遍历不是从链表头开始,而是从已知的某个节点pos开始,则可以使用list_for_each_entry_continue(pos,head,member)。有时还会出现这种需求,即经过一系列计算后,如果pos有值,则从pos开始遍历,如果没有,则从链表头开始,为此,Linux专门提供了一个list_prepare_entry(pos,head,member)宏,将它的返回值作为list_for_each_entry_continue()的pos参数,就可以满足这一要求。4.安全性考虑在并发执行的环境下,链表操作通常都应该考虑同步安全性问题,为了方便,Linux将这一操作留给应用自己处理。Linux链表自己考虑