Linux 进程、线程和CPU的关系,cpu亲和性
Posted
tags:
篇首语:本文由小常识网(cha138.com)小编为大家整理,主要介绍了Linux 进程、线程和CPU的关系,cpu亲和性相关的知识,希望对你有一定的参考价值。
参考技术A1、物理CPU数:机器主板上实际插入的cpu数量,比如说你的主板上安装了一块8核CPU,那么物理CPU个数就是1个,所以物理CPU个数就是主板上安装的CPU个数。
2、物理CPU核数:单个物理CPU上面有多个核,物理CPU核数=物理CPU数✖️单个物理CPU的核
3、逻辑CPU核数:一般情况,我们认为一颗CPU可以有多个核,加上intel的超线程技术(HT), 可以在逻辑上再分一倍数量的CPU core出来。逻辑CPU核数=物理CPU数✖️单个物理CPU的核*2
4、超线程技术(Hyper-Threading):就是利用特殊的硬件指令,把两个逻辑CPU模拟成两个物理CPU,实现多核多线程。我们常听到的双核四线程/四核八线程指的就是支持超线程技术的CPU。
1、并行:两件(多件)事情在同一时刻一起发生。
2、并发:两件(多件)事情在同一时刻只能有一个发生,由于CPU快速切换,从而给人的感觉是同时进行。
3、进程和线程
进程是资源分配的最小单位,一个程序有至少一个进程。线程是程序执行的最小单位。一个进程有至少一个线程。
线程之间的通信更方便,同一进程下的线程共享全局变量、静态变量等数据,而进程之间的通信需要以通信的方式(IPC)进行。多进程程序更健壮,多线程程序只要有一个线程死掉,整个进程也死掉了,而一个进程死掉并不会对另外一个进程造成影响,因为进程有自己独立的地址空间。
4、单核多线程:单核CPU上运行多线程, 同一时刻只有一个线程在跑,系统进行线程切换,系统给每个线程分配时间片来执行,看起来就像是同时在跑, 但实际上是每个线程跑一点点就换到其它线程继续跑。
5、多核多线程:每个核上各自运行线程,同一时刻可以有多个线程同时在跑。
1、对于单核:多线程和多进程的多任务是在单cpu交替执行(时间片轮转调度,优先级调度等),属于并发
2、对于多核:同一个时间多个进程运行在不同的CPU核上,或者是同一个时间多个线程能分布在不同的CPU核上(线程数小于内核数),属于并行。
3、上下文切换:上下文切换指的是内核(操作系统的核心)在CPU上对进程或者线程进行切换。上下文切换过程中的信息被保存在进程控制块(PCB-Process Control Block)中。PCB又被称作切换帧(SwitchFrame)。上下文切换的信息会一直被保存在CPU的内存中,直到被再次使用。
CPU 亲和性(affinity)就是进程要在某个给定的 CPU 上尽量长时间地运行而不被迁移到其他处理器的倾向性。这样可以减少上下文切换的次数,提高程序运行性能。可分为:自然亲和性和硬亲和性
1、自然亲和性:就是进程要在指定的 CPU 上尽量长时间地运行而不被迁移到其他处理器,Linux 内核进程调度器天生就具有被称为 软 CPU 亲和性(affinity) 的特性,这意味着进程通常不会在处理器之间频繁迁移。这种状态正是我们希望的,因为进程迁移的频率小就意味着产生的负载小。Linux调度器缺省就支持自然CPU亲和性(natural CPU affinity): 调度器会试图保持进程在相同的CPU上运行。
2、硬亲和性:简单来说就是利用linux内核提供给用户的API,强行将进程或者线程绑定到某一个指定的cpu核运行。Linux硬亲和性指定API:taskset .
taskset [options] mask command [arg]...
taskset [options] -p [mask] pid
taskset 命令用于设置或者获取一直指定的 PID 对于 CPU 核的运行依赖关系。也可以用 taskset 启动一个命令,直接设置它的 CPU 核的运行依赖关系。
CPU 核依赖关系是指,命令会被在指定的 CPU 核中运行,而不会再其他 CPU 核中运行的一种调度关系。需要说明的是,在正常情况下,为了系统性能的原因,调度器会尽可能的在一个 CPU 核中维持一个进程的执行。强制指定特殊的 CPU 核依赖关系对于特殊的应用是有意义的
CPU 核的定义采用位定义的方式进行,最低位代表 CPU0,然后依次排序。这种位定义可以超过系统实际的 CPU 总数,并不会存在问题。通过命令获得的这种 CPU 位标记,只会包含系统实际 CPU 的数目。如果设定的位标记少于系统 CPU 的实际数目,那么命令会产生一个错误。当然这种给定的和获取的位标记采用 16 进制标识。
0x00000001
代表 #0 CPU
0x00000003
代表 #0 和 #1 CPU
0xFFFFFFFF
代表 #0 到 #31 CPU
-p, --pid
对一个现有的进程进行操作,而不是启动一个新的进程
-c, --cpu-list
使用 CPU 编号替代位标记,这可以是一个列表,列表中可以使用逗号分隔,或者使用 "-" 进行范围标记,例如:0,5,7,9
-h, --help
打印帮助信息
-V, --version
打印版本信息
如果需要设定,那么需要拥有 CAP_SYS_NICE 的权限;如果要获取设定信息,没有任何权限要求。
taskset 命令属于 util-linux-ng 包,可以使用 yum 直接安装。
如何设置 Java 线程的 cpu 核心亲和力?
【中文标题】如何设置 Java 线程的 cpu 核心亲和力?【英文标题】:How to set a Java thread's cpu core affinity? 【发布时间】:2012-11-15 06:08:15 【问题描述】:我搜索了以前关于类似主题的帖子,但找不到合适的答案,因此提出了这个问题。非常感谢您在回答问题方面的帮助。
我知道在 Linux 中通过 taskset 命令设置进程与特定 CPU 内核的亲和性。但是我想设置一个 Java 线程对特定 cpu 核心的亲和性,以便属于同一进程的其他线程可以在所有剩余的核心上运行。例如,如果我有一个包含 4 核机器的 10 个线程的进程,我想为一个线程保留 core-1,并让剩余的 9 个线程在剩余的 3 核上运行。能做到吗?怎么做?
谢谢 萨钦
【问题讨论】:
【参考方案1】:假设 2241 是您的 java 进程的 pid。运行:
jstack 2241
这会给你一个线程列表。在那里找到你的并注意 nid 字段。说 nid=0x8e9,它将以 10 为底转换为 2281。然后运行:
taskset -p -c 0 2281
完成。
【讨论】:
【参考方案2】:很遗憾,您不能将 Java 线程分配给特定的内核。但是,您可以将Thread Priorities 设置为线程的优先级(假设这将完成相同的事情)
或者,您可以使用 JNI,但这完全是矫枉过正。
【讨论】:
是的,否则java不会独立于硬件【参考方案3】:请记住,您运行的 Java 应用程序实际上是在 JVM 中运行,而 JVM 又在操作系统上运行。为了能够直接与 CPU 交互,您需要一种低级编程语言(例如 C)。
正如另一个答案中所建议的,您可以使用 JNI 与较低级别的语言(如 C)进行交互以执行您想要的操作,但是您必须将并发(在该较低级别语言中管理的线程)委托给它...
【讨论】:
【参考方案4】:您可以使用 JNA 在纯 Java 中做到这一点。不需要使用任务集。请记住,线程关联是毫无意义的,除非您之前已将内核与内核/用户线程和硬件中断隔离开来。我隶属于 Coral Blocks,它开发了 CoralThreads,正是这样做的。
【讨论】:
以上是关于Linux 进程、线程和CPU的关系,cpu亲和性的主要内容,如果未能解决你的问题,请参考以下文章