Linux中断补充_系统运维

在系统结构中，CPU工作的模式有两种，一种是中断，由各种设备发起；一种是轮询，由CPU主动发起。

中断IRQ:

中断允许让设备（如键盘，串口卡，并口等设备）表明它们需要CPU。一旦CPU接收了中断请求，CPU就会暂时停止执行正在运行的程序，并且调用一个称为中断处理器或中断服务程序（interrupt service routine）的特定程序。CPU处理完中断后，就会恢复执行之前被中断的程序。

中断分类：

硬中断+软中断

硬中断：

①非屏蔽中断：不能被屏蔽，硬件发生的错误：内存错误，风扇故障，温度传感器故障等。

②可屏蔽中断：可被CPU忽略或延迟处理。当缓存控制器的外部针脚被触发的时候就会产生这种类型的中断，而中断屏蔽寄存器就会将这样的中断屏蔽掉。我们可以将一个比特位设置为0，来禁用在此针脚触发的中断。

软中断：

是软件实现的中断,也就是程序运行时其他程序对它的中断而硬中断是硬件实现的中断,是程序运行时设备对它的中断。

CPU之间的中断处理（IPI）

处理器间中断允许一个CPU向系统其他的CPU发送中断信号，处理器间中断（IPI）不是通过IRQ线传输的，而是作为信号直接放在连接所有CPU本地APIC的总线上。

CALL_FUNCTION_VECTOR （向量0xfb）

发往所有的CPU，但不包括发送者，强制这些CPU运行发送者传递过来的函数，相应的中断处理程序叫做call_function_interrupt()，例如，地址存放在群居变量call_data中来传递的函数，可能强制其他所有的CPU都停止，也可能强制它们设置内存类型范围寄存器的内容。通常，这种中断发往所有的CPU，但通过smp_call_function()执行调用函数的CPU除外。

RESCHEDULE_VECTOR （向量0xfc）

当一个CPU接收这种类型的中断时，相应的处理程序限定自己来应答中断，当从中断返回时，所有的重新调度都自动运行。

INVALIDATE_TLB_VECTOR （向量0xfd）

发往所有的CPU，但不包括发送者，强制它们的转换后援缓冲器TLB变为无效。相应的处理程序刷新处理器的某些TLB表项。

关于中断嵌套：在linux内核里，如果驱动在申请注册中断的时候没有特别的指定，do_irq在做中断响应的时候，是开启中断的，如果在驱动的中断处理函数正在执行的过程中，出现同一设备的中断或者不同设备的中断，这时候新的中断会被立即处理，还是被pending，等当前中断处理完成后，再做处理。在2.4和2.6内核里，关于这一块是否有什么不同。一般申请中断的时候都允许开中断，即不使用SA_INTERRUPT标志。如果允许共享则加上 SA_SHIRQ，如果可以为内核熵池提供熵值（譬如你写的驱动是ide之类的驱动），则再加上 SA_SAMPLE_RANDOM标志。这是普通的中断请求过程。对于这种一般情况，只要发生中断，就可以抢占内核，即使内核正在执行其他中断函数。这里有两点说明：一是因为linux不支持中断优先级，因此任何中断都可以抢占其他中断，但是同种类型的中断（即定义使用同一个中断线的中断）不会发生抢占，他们会在执行本类型中断的时候依次被调用执行。二是所谓只要发生中断，就可以抢占内核这句是有一定限制的，因为当中断发生的时候系统由中断门进入时自动关中断（对于x86平台就是将eflags寄存器的if位置为0），只有当中断函数被执行（handle_IRQ_event）的过程中开中断之后才能有抢占。对于同种类型的中断，由于其使用同样的idt表项，通过其状态标志（IRQ_PENDING和 IRQ_INPROGRESS）可以防止同种类型的中断函数执行（注意：是防止handle_IRQ_event被重入，而不是防止do_IRQ函数被重入），对于不同的中断，则可以自由的嵌套。因此，所谓中断嵌套，对于不同的中断是可以自由嵌套的，而对于同种类型的中断，是不可以嵌套执行的。以下简单解释一下如何利用状态标志来防止同种类型中断的重入：当某种类型的中断第一次发生时，首先其idt表项的状态位上被赋予IRQ_PENDING标志，表示有待处理。然后将中断处理函数action置为null，然后由于其状态没有IRQ_INPROGRESS标志（第一次），故将其状态置上IRQ_INPROGRESS并去处IRQ_PENDING标志，同时将action赋予相应的中断处理函数指针（这里是一个重点，linux很巧妙的用法，随后说明）。这样，后面就可以顺利执行handle_IRQ_event进行中断处理，当在handle_IRQ_event中开中断后，如果有同种类型的中断发生，则再次进入do_IRQ函数，然后其状态位上加上IRQ_PENDING标志，但是由于前一次中断处理中加上的IRQ_INPROGRESS没有被清除，因此这里无法清除IRQ_PENDING标志，因此action还是为null，这样就无法再次执行handle_IRQ_event函数。从而退出本次中断处理，返回上一次的中断处理函数中，即继续执行handle_IRQ_event函数。当handle_IRQ_event返回时检查IRQ_PENDING标志，发现存在这个标志，说明handle_IRQ_event执行过程中被中断过，存在未处理的同类中断，因此再次循环执行handle_IRQ_event函数。直到不存在IRQ_PENDING标志为止。2.4和2.6的差别，就我来看，主要是在2.6中一进入do_IRQ，多了一个关闭内核抢占的动作，同时在处理中多了一种对IRQ_PER_CPU类型的中断的处理，其他没有什么太大的改变。这类IRQ_PER_CPU的中断主要用在smp环境下将中断绑定在某一个指定的cpu上。例如arch/ppc/syslib/open_pic.c中的openpic_init中初始化ipi中断的时候。其实简单的说，中断可以嵌套，但是同种类型的中断是不可以嵌套的，因为在IRQ上发生中断，在中断响应的过程中，这个IRQ是屏蔽的，也就是这个IRQ的中断是不能被发现的。同时在内核的临界区内，中断是被禁止的关于do_IRQ可能会丢失中断请求：do_IRQ函数是通过在执行完handle_IRQ_event函数之后判断status是否被设置了IRQ_PENDING标志来判断是否还有没有被处理的同一通道的中断请求。但是这种方法只能判断是否有，而不能知道有多少个未处理的统一通道中断请求。也就是说，假如在第一个中断请求执行handle_IRQ_event函数的过程中来了同一通道的两个或更多中断请求，而这些中断不会再来，那么仅仅通过判断status是否设置了IRQ_PENDING标志不知道到底有多少个未处理的中断，handle_IRQ_event只会被再执行一次。这算不算是个bug呢？不算，只要知道有中断没有处理就OK了，知道1个和知道N个，本质上都是一样的。作为外设，应当能够处理自己中断未被处理的情况。不可能丢失的，在每一个中断描述符的结构体内，都有一个链表，链表中存放着服务例程序关于中断中使用的几个重要概念和关系：一、基本概念1. 产生的位置发生的时刻时序中断 CPU外部随机异步异常 CPU正在执行的程序一条指令终止执行后同步 2.由中断或异常执行的代码不是一个进程，而是一个内核控制路径，代表中断发生时正在运行的进程的执行中断处理程序与正在运行的程序无关引起异常处理程序的进程正是异常处理程序运行时的当前进程二、特点（2）能以嵌套的方式执行，但是同种类型的中断不可以嵌套（3）尽可能地限制临界区，因为在临界区中，中断被禁止2.大部分异常发生在用户态，缺页异常是唯一发生于内核态能触发的异常缺页异常意味着进程切换，因此中断处理程序从不执行可以导致缺页的 *** 作3.中断处理程序运行于内核态中断发生于用户态时，要把进程的用户空间堆栈切换到进程的系统空间堆栈，刚切换时，内核堆栈是空的中断发生于内核态时，不需要堆栈空间的切换三、分类1.中断的分类：可屏蔽中断、不可屏蔽中断2.异常的分类：分类解决异常的方法举例故障那条指令会被重新执行缺页异常处理程序陷阱会从下一条指令开始执行调试程序

本文先介绍了cpu上下文切换的基础知识，以及上下文切换的类型（进程，线程等切换）。然后介绍了如何查看cpu切换次数的工具和指标的解释。同时对日常分析种cpu过高的情况下如何分析和定位的方法做了一定的介绍，使用一个简单的案例进行分析，先用top，pidstat等工具找出占用过高的进程id，然后通过分析到底是用户态cpu过高，还是内核态cpu过高，并用perf 定位到具体的调用函数。（来自极客时间课程学习笔记）

1、多任务竞争CPU，cpu变换任务的时候进行CPU上下文切换(context switch)。CPU执行任务有4种方式：进程、线程、或者硬件通过触发信号导致中断的调用。

2、当切换任务的时候，需要记录任务当前的状态和获取下一任务的信息和地址(指针)，这就是上下文的内容。因此，上下文是指某一时间点CPU寄存器(CPU register)和程序计数器(PC)的内容, 广义上还包括内存中进程的虚拟地址映射信息.

3、上下文切换的过程：

4、根据任务的执行形式，相应的下上文切换，有进程上下文切换、线程上下文切换、以及中断上下文切换三类。

5、进程和线程的区别：

进程是资源分配和执行的基本单位；线程是任务调度和运行的基本单位。线程没有资源，进程给指针提供虚拟内存、栈、变量等共享资源，而线程可以共享进程的资源。

6、进程上下文切换：是指从一个进程切换到另一个进程。

(1)进程运行态为内核运行态和进程运行态。内核空间态资源包括内核的堆栈、寄存器等；用户空间态资源包括虚拟内存、栈、变量、正文、数据等

(2)系统调用(软中断)在内核态完成的，需要进行2次CPU上下文切换(用户空间-->内核空间-->用户空间)，不涉及用户态资源，也不会切换进程。

(3)进程是由内核来管理和调度的，进程的切换只能发生在内核态。所以，进程的上下文不仅包括了用户空间的资源，也包括内核空间资源。

(4)进程的上下文切换过程：

(5)、下列将会触发进程上下文切换的场景：

7、线程上下文切换：

8、中断上下文切换

快速响应硬件的事件，中断处理会打断进程的正常调度和执行。同一CPU内，硬件中断优先级高于进程。切换过程类似于系统调用的时候，不涉及到用户运行态资源。但大量的中断上下文切换同样可能引发性能问题。

重点关注信息：

系统的就绪队列过长，也就是正在运行和等待 CPU 的进程数过多，导致了大量的上下文切换，而上下文切换又导致了系统 CPU 的占用率升高。

这个结果中有两列内容是我们的重点关注对象。一个是 cswch ，表示每秒自愿上下文切换（voluntary context switches）的次数，另一个则是 nvcswch ，表示每秒非自愿上下文切换（non voluntary context switches）的次数。

linux的中断使用情况可以从 /proc/interrupts 这个只读文件中读取。/proc 实际上是 Linux 的一个虚拟文件系统，用于内核空间与用户空间之间的通信。/proc/interrupts 就是这种通信机制的一部分，提供了一个只读的中断使用情况。

重调度中断（RES），这个中断类型表示，唤醒空闲状态的 CPU 来调度新的任务运行。这是多处理器系统（SMP）中，调度器用来分散任务到不同 CPU 的机制，通常也被称为处理器间中断（Inter-Processor Interrupts，IPI）。

这个数值其实取决于系统本身的 CPU 性能。如果系统的上下文切换次数比较稳定，那么从数百到一万以内，都应该算是正常的。但当上下文切换次数超过一万次，或者切换次数出现数量级的增长时，就很可能已经出现了性能问题。这时，需要根据上下文切换的类型，再做具体分析。

比方说：

首先通过uptime查看系统负载，然后使用mpstat结合pidstat来初步判断到底是cpu计算量大还是进程争抢过大或者是io过多，接着使用vmstat分析切换次数，以及切换类型，来进一步判断到底是io过多导致问题还是进程争抢激烈导致问题。

CPU 使用率相关的重要指标：

性能分析工具给出的都是间隔一段时间的平均 CPU 使用率，所以要注意间隔时间的设置，特别是用多个工具对比分析时，你一定要保证它们用的是相同的间隔时间。比如，对比一下 top 和 ps 这两个工具报告的 CPU 使用率，默认的结果很可能不一样，因为 top 默认使用 3 秒时间间隔，而 ps 使用的却是进程的整个生命周期。

top 和 ps 是最常用的性能分析工具：

这个输出结果中，第三行 %Cpu 就是系统的 CPU 使用率，top 默认显示的是所有 CPU 的平均值，这个时候你只需要按下数字 1 ，就可以切换到每个 CPU 的使用率了。继续往下看，空白行之后是进程的实时信息，每个进程都有一个 %CPU 列，表示进程的 CPU 使用率。它是用户态和内核态 CPU 使用率的总和，包括进程用户空间使用的 CPU、通过系统调用执行的内核空间 CPU 、以及在就绪队列等待运行的 CPU。在虚拟化环境中，它还包括了运行虚拟机占用的 CPU。

预先安装 stress 和 sysstat 包，如 apt install stress sysstat。

stress 是一个 Linux 系统压力测试工具，这里我们用作异常进程模拟平均负载升高的场景。而 sysstat 包含了常用的 Linux 性能工具，用来监控和分析系统的性能。我们的案例会用到这个包的两个命令 mpstat 和 pidstat。

下面的 pidstat 命令，就间隔 1 秒展示了进程的 5 组 CPU 使用率，

包括：

perf 是 Linux 2.6.31 以后内置的性能分析工具。它以性能事件采样为基础，不仅可以分析系统的各种事件和内核性能，还可以用来分析指定应用程序的性能问题。

第一种常见用法是 perf top，类似于 top，它能够实时显示占用 CPU 时钟最多的函数或者指令，因此可以用来查找热点函数，使用界面如下所示：

输出结果中，第一行包含三个数据，分别是采样数（Samples）如2K、事件类型（event）如cpu-clock:pppH和事件总数量（Event count）如：371909314。

第二种常见用法，也就是 perf record 和 perf report。 perf top 虽然实时展示了系统的性能信息，但它的缺点是并不保存数据，也就无法用于离线或者后续的分析。而 perf record 则提供了保存数据的功能，保存后的数据，需要你用 perf report 解析展示。

1.启动docker 运行进程：

2.ab工具测试服务器性能

ab（apache bench）是一个常用的 HTTP 服务性能测试工具，这里用来模拟 Ngnix 的客户端。

3.分析过程

CPU 使用率是最直观和最常用的系统性能指标，在排查性能问题时，通常会关注的第一个指标。所以更要熟悉它的含义，尤其要弄清楚:

这几种不同 CPU 的使用率。比如说：

碰到 CPU 使用率升高的问题，你可以借助 top、pidstat 等工具，确认引发 CPU 性能问题的来源；再使用 perf 等工具，排查出引起性能问题的具体函数.

欢迎分享，转载请注明来源：内存溢出

原文地址: http://outofmemory.cn/yw/7325395.html

Linux中断补充

发表评论

评论列表（0条）