|
|
楼主 |
发表于 2008-2-27 14:35:05
|
显示全部楼层
从IRQ到IRQL(APIC版)
来自:http://www.nsfocus.net/index.php ... o=view&mid=2534
8 o5 ?( u$ e" h# N7 X# n( d4 E/ z. {3 X$ ~6 e0 B" G" B
从IRQ到IRQL(APIC版)# W- {+ W' W) b# o
1 v" y1 p4 \9 z0 d3 l' t: L
作者:SoBeIt
! B2 r& u' o C' t1 J& I1 O出处:https://www.xfocus.net/bbs/index.php?act=ST&f=2&t=45502" ~- A$ S) B! R
日期:2005-02-04
1 E' A9 D+ M V7 a2 \$ \) d% `) z6 N" M
事实上,老久的PIC在很早以前就被淘汰了,取而代之的是APIC。由于APIC可以兼容PIC,所以在很多单处理器系统上我们看到的PIC实际是APIC的兼容PIC模式。APIC主要应用于多处理器操作系统,是为了解决IRQ太少和处理器间中断而产生的,当然,单处理器操作系统也可以使用APIC(不是模拟PIC)。APIC的HAL和PIC的HAL有很大的不同,很突出的一个特点就是APIC的HAL不用再象PIC的HAL那样虚拟一个中断控制器,IRQL的概念已经可以通过中断向量的形式被APIC支持。事实上,因为被APIC所支持,所以在APIC HAL里IRQL的实现比PIC HAL那样虚拟一个中断控制器要简单得多了。
: u' g+ |: ]8 G6 V9 G5 R7 G4 W' x h$ c" y1 U9 I
现在来简单介绍一下APIC的结构(关于APIC详细的描述请参考《IA-32 Inel Architecture Software Developer's Manual Volume 3 Chapter 8》)。整个APIC系统由本地APIC、IO APIC和APIC串行总线组成(在Pentium 4和Xeon以后,APIC总线放到了系统总线中)组成。每个处理器中集成了一个本地APIC,而IO APIC是系统芯片组中一部分,APIC总线负责连接IO APIC和各个本地APIC。本地APIC接收该处理器产生的本地中断比如时钟中断,以及由该处理器产生的处理器间中断,并从APIC串行总线接收来自IO APIC的消息;IO APIC负责接收所有外部的硬件中断,并翻译成消息选择发给接收中断的处理器,以及从本地APIC接收处理器间中断消息。
; w) B8 I# B) F
. V2 l3 Z/ V5 a* `# B" v4 T: ^3 @4 [ 和PIC一样,控制本地APIC和IO APIC的方法是通过读写该单元中的相关寄存器。不过和PIC不一样的是,Intel把本地APIC和IO APIC的寄存器都映射到了物理地址空间,本地APIC默认映射到物理地址0xffe00000,IO APIC默认映射到物理地址0xfec00000。windows HAL再进一步把本地APIC映射到虚拟地址0xfffe0000,把IO APIC映射到虚拟地址0xffd06000,也就是说对该地址的读写实际就是对寄存器的读写,本地APIC里几个重要的寄存有EOI寄存器,任务优先级寄存器(TPR),处理器优先级寄存器(PPR),中断命令寄存器(ICR,64位),中断请求寄存器(IRR,256位,对应每个向量一位),中断在服务寄存器(ISR,256位)等。IO APIC里几个重要的寄存器有版本寄存器,I/O寄存器选择寄存器、I/O窗口寄存器(用要访问的I/O APIC寄存器的索引设置地址I/O寄存器选择寄存器,此时访问I/O窗口寄存器就是访问被选定的寄存器)还有很重要的是一个IO重定向表,每一个表项是一个64位寄存器,包括向量和目标模式、传输模式等相关位,每一个表项连接一条IRQ线,表项的数目随处理器的版本而不一样,在Pentium 4上为24个表项。表项的数目保存在IO APIC版本寄存器的[16:23]位。APIC系统支持255个中断向量,但Intel保留了0-15向量,可用的向量是16-255。并引进一个概念叫做任务优先级=中断向量/16,因为保留了16个向量,所以可用的优先级是2-15。当用一个指定的优先级设置本地APIC中的任务优先级寄存器TPR后,所有优先级低于TPR中优先级的中断都被屏蔽,是不是很象IRQL的机制?事实上,APIC HAL里的IRQL机制也就是靠着这个任务优先级寄存器得以实现。同一个任务优先级包括了16个中断向量,可以进一步细粒度地区分中断的优先级。
+ P$ l/ Q+ r9 U/ n3 F; e
6 j) t7 [% K$ q 在HAL里虽然HalBeginSystemInterrupt仍然是IRQL机制的发动引擎,但是因为有APIC的支持,它和其它共同实现IRQL的函数要比PIC HAL里对应的函数功能简单得多。HalBeginSystemInterrupt通过用IRQL做索引在HalpIRQLtoTPR数组中获取该IRQL对应的任务优先级,用该优先级设置任务优先级寄存器TPR,并把TPR中原先的任务优先级/16做为索引在HalpVectorToIRQL数组中获取对应的原先的IRQL然后返回。若IRQL是从低于DISPATCH_LEVEL提升到高于DISPATCH_LEVEL,还需要设置KPCR+0x95(0xffdff095)为DISPATCH_LEVEL(0x2),表示是从DISPATCH_LEVEL以下的级别提升IRQL。HalEndSystemInterrupt向本地APIC的EOI寄存发送0,表示中断结束,可以接收新中断。并还要判断要降到的IRQL是否小于DISPATCH_LEVEL,若小于则进一步判断KPCR+0x96(0xffdff096)是否置位,若置位则表示有DPC中断在等待(在IRQL高于DISPATCH_LEVEL被引发,然后等待直到IRQL降到低于DISPATCH_LEVEL),则将KPCR+0x95和KPCR+0x96清0后调用KiDispatchInterrupt响应DPC软中断。否则做的工作就是和HalBeginSystemInterrupt一样的过程:把要降到的IRQL转换成任务优先级设置TRP,并把久的任务优先级转成IRQL返回。KfRaiseIrql、KfLowerIrql之类的函数也是这么一回事,把当前IRQL转成任务优先级修改TPR,并把原先TPR的值转成原先的IRQL并返回。而现在软中断的产生也有了APIC支持,APIC通过产生一个发向自己的处理器间中断,就可以产生一个软中断,因为可以指定该中断的向量,所以软中断就可以区分优先级别,如APC_LEVEL、DISPATCH_LEVEL。产生软中断的函数一样还是HalRequestSoftwareInterrupt,该函数会先判断KPCR+0x95是否和要产生的软中断IRQL一样,若是的话则置位KPCR+0x96并返回,表示现在IRQL大于DISPATCH_LEVEL所以不处理DPC中断。否则以要产生的软中断的IRQL为索引从HalpIRQLtoTPRHAL取出对应任务优先级,并或上0x4000,表示是发向自身的固定处理间中断,并用该值设置中断命令寄存器ICW的低32位,然后读取中断命令寄存器ICW的低32位是否为0x1000,确定中断消息已经发送后就返回,这时候软中断已经产生。值得注意的是APIC HAL里没有HalEndSoftwareInterrupt这个函数。HAL为软中断的IRQL提供了一个固定的中断向量:
+ D1 m, j0 P1 A9 A' o. _# g
$ H4 e3 G( e8 r3 _9 Q( u* s' C#define ZERO_VECTOR 0x00 // IRQL 00
2 @4 I+ W0 l; R- ~# r- W#define APC_VECTOR 0x3D // IRQL 012 N% i. j2 W9 F
#define DPC_VECTOR 0x41 // IRQL 02+ l, Z: h+ v" q2 P3 K" H
#define APIC_GENERIC_VECTOR 0xC1 // IRQL 27. [) E- o, f; I4 _" o
#define APIC_CLOCK_VECTOR 0xD1 // IRQL 28
/ b$ A5 |0 ~$ Q# w* D#define APIC_SYNCH_VECTOR 0xD1 // IRQL 28
1 L: l4 h/ N8 c6 Q+ M#define APIC_IPI_VECTOR 0xE1 // IRQL 29
* u9 F2 g, b3 _, A4 b#define POWERFAIL_VECTOR 0xEF // IRQL 30
2 W% F, k5 i6 t2 q( f7 U, y#define APIC_PROFILE_VECTOR 0xFD // IRQL 319 v) F9 F* F. v3 n: }! Z3 |
/ m) O. g# ^. C/ J7 I8 p, l% z8 e- G. Q! p
现在看一下一些重要的数据:1 c8 m2 `, a+ i: D2 a0 G3 H1 F4 M' [
, S5 f/ @ |6 E$ h! y7 D% Q9 s
这是我写的代码输出的IO APIC重定向表内容:: ^9 t+ h7 C0 G! L5 y" `' a6 Y% c
_$ R& a/ \9 A! XRedirect Table Index: 0x174 @9 {+ i/ c& m0 L/ ~5 M
Redirect Table[ 0]: ff5 u: z1 b$ |0 {+ R. M1 _. [( |. D% M
Redirect Table[ 1]: b3
. P5 R3 N6 X* V/ tRedirect Table[ 2]: ff
& e3 R# [# h0 k( s; MRedirect Table[ 3]: 51
. z0 X2 b5 g. f) t6 uRedirect Table[ 4]: ff
" q: p- h/ A$ z7 sRedirect Table[ 5]: ff
S' H0 T6 G8 x8 f; PRedirect Table[ 6]: 62
+ ~' b: \- z' K- _5 _/ RRedirect Table[ 7]: ff4 i, g4 C/ ~' \. x/ W" g- `
Redirect Table[ 8]: d1
+ l# K* \$ E" C/ M; QRedirect Table[ 9]: b1; M: q, w, Z/ ^3 o1 t- _
Redirect Table[ a]: ff8 N7 B; H2 Z1 d/ R2 {! P
Redirect Table[ b]: ff" y1 {5 K. l3 U% D! }! }( N
Redirect Table[ c]: 52
9 [/ E! v9 z5 D9 i( {0 \! jRedirect Table[ d]: ff; ~7 ?2 E3 t* [! P7 e
Redirect Table[ e]: ff
% B9 T: u5 [* sRedirect Table[ f]: 928 t8 h) q% v& @* I/ Y
Redirect Table[10]: ff
7 {; Z+ p# G/ V. }Redirect Table[11]: a3# t* I1 Z1 A1 a5 L7 h2 C" j
Redirect Table[12]: 83
$ O" e0 |0 q* F/ ?$ U& P5 `Redirect Table[13]: 931 b2 J. w* [ Q {
Redirect Table[14]: ff4 I# [" S2 {8 f* g/ `6 e0 N1 _
Redirect Table[15]: ff4 h$ \+ f3 y: V) ]
Redirect Table[16]: ff
2 I3 |! H1 m" _' h3 K- Z" j8 U8 KRedirect Table[17]: ff
1 H2 ~$ b+ C4 l% @
: @4 p: n3 L2 O9 y; x7 g* t: C) G这是IDT表中被注册的向量:
9 r: F9 q, Q! k! R. l8 G# {+ r5 ]' N6 w! f
1f: 80064908 (hal!HalpApicSpuriousService)
) A, O O$ _1 O( \' @* n0 @37: 800640b8 (hal!PicSpuriousService37)
5 z% Z; T6 T" e- ^! W, _* |3d: 80065254 (hal!HalpApcInterrupt)5 A. U4 q4 h6 v' _, g& p* `/ S, p p1 X
41: 800650c8 (hal!HalpDispatchInterrupt)
5 s2 g7 O+ y- U: d! v50: 80064190 (hal!HalpApicRebootService)
2 }# c9 ?/ p9 c) K) D( J51: 817f59e4- \( M& J* i0 y0 A: K1 ^! ?! ^
(Vector:51,Irql:4,SyncIrql:4,Connected:TRUE,No:0,ShareVector:FALSE,Mode:Latched,ISR:serial!SerialCIsrSw(f3c607c7))
2 o5 r( Y6 q/ G. L* O# v4 Y( d52: 817f5044
+ P" p5 q# x$ Q( Q( D" Q(Vector:52,Irql:4,SyncIrql:a,Connected:TRUE,No:0,ShareVector:FALSE,Mode:Latched,ISR:i8042prt!I8042MouseInterruptService(f3c57a2c))
) g* h' v5 ~5 c! P$ T2 v83: 817d2d44
: ^8 n; f2 q, G& V2 Y' l$ _(Vector:83,Irql:7,SyncIrql:7,Connected:TRUE,No:0,ShareVector:TRUE,Mode:LevelSensitive,ISR:NDIS!ndisMIsr(bff1b794)) B( D; W, E9 G% T
92: 81821384 2 l, l$ \- C/ Q2 Q4 ^
(Vector:92,Irql:8,SyncIrql:8,Connected:TRUE,No:0,ShareVector:FALSE,Mode:Latched,ISR:atapi!ScsiPortInterrupt(bff892be))
3 H8 |& ~7 y0 @0 e; e' B93: 8185ed64
# |4 e' m1 S. `- f" c0 R) I(Vector:93,Irql:8,SyncIrql:8,Connected:TRUE,No:0,ShareVector:TRUE,Mode:LevelSensitive,ISR:uhcd!UHCD_InterruptService(f3f0253e))
+ O$ W/ A! _" E, N: z# Ga3: 8186cdc4 / H) C- E5 B5 j0 b
(Vector:a3,Irql:9,SyncIrql:9,Connected:TRUE,No:0,ShareVector:TRUE,Mode:LevelSensitive,ISR:SCSIPORT!ScsiPortInterrupt(bff719f0))5 k) a1 h9 v% c& J+ V
b1: 818902e4 " Q* F- _! _+ J& }. {
(Vector:b1,Irql:a,SyncIrql:a,Connected:TRUE,No:0,ShareVector:TRUE,Mode:LevelSensitive,ISR:ACPI!ACPIInterruptServiceRoutine(bffe14b4))
& r9 L# e' y2 [" M/ C6 `7 Y# Mb3: 81881664 ) ?6 Q$ U, S$ W6 x) Y3 `. d
(Vector:b3,Irql:a,SyncIrql:a,Connected:TRUE,No:0,ShareVector:FALSE,Mode:Latched,ISR:i8042prt!I8042KeyboardInterruptService(f3c51918))
: G- G# ]' L9 R: q* Mc1: 800642fc (hal!HalpBroadcastCallService)- y% y& Y: X1 \& O/ a+ c
d1: 80063964 (hal!HalpClockInterrupt)# _+ U3 ^+ M+ `% V
e1: 80064858 (hal!HalpIpiHandler)1 h9 m1 x8 _& [
e3: 800645d4 (hal!HalpLocalApicErrorService)2 F7 m% I% A, h3 A
fd: 80064d64 (hal!HalpProfileInterrupt)
* e/ D1 n- |3 l, W3 F$ v* C3 Tfe: 80064eec (hal!HalpPerfInterrupt)
( ~# ~3 J% O2 ]5 c$ W% Q' S2 Y9 f0 Q. }$ R w* C
象a3、b1这类输出内容很多的是被硬件注册的中断向量,而象d1、e3这种输出内容少的是注册为了的HAL内部使用的中断向量和本地APIC中断向量( P; R1 I' F! Q% N N0 F2 C1 y
2 c7 O& B* [. Q9 L" q- o* S0 a; R这是几个重要的数组:
& Z0 v( h4 y" L+ Z. K8 P
0 m0 m, W0 H- ~, t) UHalVectorToIrql(这个数组是以向量除于16做索引):
, \/ F' M( G$ D) Y4 u0 B8006a304 00 ff ff 01 02 04 05 06-07 08 09 0a 1b 1c 1d 1e
: U" R! l" u$ P8 `5 I2 i. M+ V. V3 \# Z# f
HalpIRQLtoTPR:( V& e8 U! h, |8 c, D5 u
8006a1e4 00 3d 41 41 51 61 71 81-91 a1 b1 b1 b1 b1 b1 b1' k1 @" i- H6 Z: X" F: d
8006a1f4 b1 b1 b1 b1 b1 b1 b1 b1-b1 b1 b1 c1 d1 e1 ef ff1 W5 ^- s+ D. C2 A: q* C/ e% x. C
& T9 \- q' m5 H- `HalpINTItoVector:# k; w8 k. |, \: ]3 G6 H* z7 t
8006ada0 00 b3 61 51 a2 b2 62 91-a1 b1 71 81 52 82 72 92. p. V3 V" n4 v3 J3 o5 f
8006adb0 00 a3 83 93 00 00 00 00-00 00 00 00 00 00 00 00
3 d" J( y5 G# t) ^ e F8 M3 P! v. e9 \+ h6 P
HalVectorToINTI:
- ]; j5 ]2 [% }7 M8006a204 ff ff ff ff ff ff ff ff-ff ff ff ff ff ff ff ff i. h0 G5 a: A- l
8006a214 ff ff ff ff ff ff ff ff-ff ff ff ff ff ff ff ff
& b* M/ m1 @3 K5 A7 s4 o7 N1 q8006a224 ff ff ff ff ff ff ff ff-ff ff ff ff ff ff ff ff, V2 p) \# F& Z6 k
8006a234 ff ff ff ff ff ff ff ff-ff ff ff ff ff ff ff ff
9 s2 J% L) L) ^. a) W' U- l8006a244 ff ff ff ff ff ff ff ff-ff ff ff ff ff ff ff ff
' _4 f- N i1 j1 g( f4 @8006a254 ff 03 0c ff ff ff ff ff-ff ff ff ff ff ff ff ff
. | n! B) M8 }$ j O$ q) b5 O8006a264 ff 02 06 ff ff ff ff ff-ff ff ff ff ff ff ff ff
7 c2 a' Z! N! O7 F" m7 d8006a274 ff 0a 0e ff ff ff ff ff-ff ff ff ff ff ff ff ff
6 I! Y' y! ^8 o( W% V: J3 B8006a284 ff 0b 0d 12 ff ff ff ff-ff ff ff ff ff ff ff ff
: Y; O: Z! n! T( @8006a294 ff 07 0f 13 ff ff ff ff-ff ff ff ff ff ff ff ff* a! d- g: M- O2 g' X, E: M
8006a2a4 ff 08 04 11 ff ff ff ff-ff ff ff ff ff ff ff ff7 B1 t7 Q# ~9 P- u: r) e
8006a2b4 ff 09 05 01 ff ff ff ff-ff ff ff ff ff ff ff ff& `# ?$ d3 j5 E2 s2 D- ^, a+ ^0 y
8006a2c4 ff ff ff ff ff ff ff ff-ff ff ff ff ff ff ff ff8 Y( G4 x `9 c! N/ O
8006a2d4 ff 08 ff ff ff ff ff ff-ff ff ff ff ff ff ff ff
2 n- k) E: G- `' e8 ]" N- }* A3 T, T8006a2e4 ff ff ff ff ff ff ff ff-ff ff ff ff ff ff ff ff# _" i B( J0 Z E
8006a2f4 ff ff ff ff ff ff ff ff-ff ff ff ff ff ff ff ' x, ~) ?7 C8 V
. z9 }9 y: @& N+ L }
! n% |* Q+ f& V; gvBucket:2 \0 R2 `3 m. K
8006ae30 02 02 02 03 03 03 03: p6 L; c, N; i: U: ?
8 Z- u6 y- {1 T
举个例子来说明一下,在我虚拟机里SCSI Controller的IRQ是17(注意,已经大于16了),到重定向表中查找第17项,得到中断向量为0xa3,再看IDT,0xa3对应处理例程是SCSIPORT!ScsiPortInterrupt。5 d* l6 _" h: z: O
W4 s% A$ s9 ~1 z
vBucket数组干啥用的?它就是用来分配新的向量。分配算法很简单,当要分配一个新的向量时,就在vBucket数组从右到左搜索最小的一个数i,该数对应在vBucket中索引为Index,新向量为(0x50+Index*16+i+1),新向量对应的IRQL为(4+i+1),同时会把vBucket中这个i加1,i不等大于16。象给出的这个vBucket,下一次计算时i=2, index=2。不过这些用于硬件的向量在IO系统初始化时调用HalpGetSystemInterruptVector分配好了,然后通过IoConnectInterrupt把IDT中注册的向量位置的例程注册为中断处理程序。这里并不是每个注册的向量都会对应中断处理程序,象上面给出的例子中,0xa1、0xa2、0xb1等向量就没有对应。3 y& E" D$ D+ E3 U
7 x. o" S/ `8 O3 b2 q- E5 t& B
IRQL机制为内核同步提供了很大的便利,既对驱动开发者隐藏了底层中断机制,也方便了驱动开发者的内核同步。LINUX从2.5内核开始引进的软中断和任务队列等机制,很大程度上也来自windows这套机制的借鉴。. E7 G+ p0 J3 i3 c# h
6 {; v& Q! |# x$ X
终于考完试,解放了,呵呵。这个东西其实还有很多可写的,只是没空再深入去分析了。在未来的64位系统里,APIC这种基于中断引脚的机制很快也要被SAPIC这种基于消息的更强大的机制所取代 |
|