Linux服务器进阶:谁在切换我们的进程?
创始人
2024-07-15 19:10:31
0

我们在做Linux服务器的时候经常会需要知道谁在做进程切换,什么原因需要做进程切换。 因为进程切换的代价很高,我给出一个LMbench测试出来的数字:

Context switching – times in microseconds – smaller is better
————————————————————————-
Host OS 2p/0K 2p/16K 2p/64K 8p/16K 8p/64K 16p/16K 16p/64K
ctxsw ctxsw ctxsw ctxsw ctxsw ctxsw ctxsw
——— ————- —— —— —— —— —— ——- ——-
my174.cm4 Linux 2.6.18- 6.1100 7.0200 6.1100 8.7400 7.7200 8.96000 9.62000

在我的很高端的服务器上,进程切换的开销在8us左右, 这个相对于高性能的服务器是不可接受的, 所以我们要在一个时间片内尽可能的多做事情,而不是把时间浪费在无谓的切换上。

好奇害死猫,我们来调查下谁在切换我们的进程:

[root@my174 admin]# dstat 1
—-total-cpu-usage—- -dsk/total- -net/total- —paging– —system–
usr sys idl wai hiq siq| read writ| recv send| in out | int csw
0 0 100 0 0 0| 0 0 | 796B 1488B| 0 0 |1004 128
0 0 100 0 0 0| 0 0 | 280B 728B| 0 0 |1005 114
0 0 100 0 0 0| 0 0 | 280B 728B| 0 0 |1005 128
0 0 100 0 0 0| 0 0 | 280B 728B| 0 0 |1005 114
0 0 100 0 0 0| 0 320k| 280B 728B| 0 0 |1008 143
…

我们可以看到 csw的数目是 120/S, 但是dstat或者vmstat类似的工具并没有告诉我们谁在干坏事。好吧!我们自己动手行吧。

祭出我们可爱的systemtap!

[root@my174 admin]# cat >cswmon.stp
#! /usr/bin/env stap
#
#
 
global csw_count
global idle_count
 
probe scheduler.cpu_off {
csw_count[task_prev, task_next]++
idle_count+=idle
}
 
function fmt_task(task_prev, task_next)
{
return sprintf(“%s(%d)->%s(%d)”,
task_execname(task_prev),
task_pid(task_prev),
task_execname(task_next),
task_pid(task_next))
}
 
function print_cswtop () {
printf (“%45s %10s\n”, “Context switch”, “COUNT”)
foreach ([task_prev, task_next] in csw_count- limit 20) {
printf(“%45s %10d\n”, fmt_task(task_prev, task_next), csw_count[task_prev, task_next])
}
printf(“%45s %10d\n”, “idle”, idle_count)
 
delete csw_count
delete idle_count
}
 
probe timer.s($1) {
print_cswtop ()
printf(“————————————————————–\n”)
}
CTRL+D

这个脚本会每隔设定的时间打印出TOP 20切换最多的进程和他的pid, 我们来看下结果把:

[root@my174 admin]# stap cswmon.stp 5
Context switch COUNT
swapper(0)->systemtap/11(908) 500
systemtap/11(908)->swapper(0) 498
swapper(0)->fct1-worker(2492) 50
fct1-worker(2492)->swapper(0) 50
swapper(0)->fct0-worker(2191) 50
fct0-worker(2191)->swapper(0) 50
swapper(0)->bond0(3432) 50
bond0(3432)->swapper(0) 50
stapio(879)->swapper(0) 26
swapper(0)->stapio(879) 25
stapio(879)->swapper(0) 19
swapper(0)->stapio(879) 17
swapper(0)->watchdog/9(31) 5
watchdog/9(31)->swapper(0) 5
swapper(0)->mysqld(18346) 5
mysqld(18346)->swapper(0) 5
swapper(0)->watchdog/13(43) 5
watchdog/13(43)->swapper(0) 5
swapper(0)->watchdog/14(46) 5
watchdog/14(46)->swapper(0) 5
idle 859
————————————————————–
…

我们可以看到进程从哪里切换到哪里,并且发生了多少次, ***一行,我打印出来idle的次数,也就是说这时候系统没啥事情做,就切换到idle(0)这个进程去休息去了。

通过上面的调查,我们会很清楚的了解到我们系统的开销发生在那里,方便我们定位问题。

玩的开心!

【编辑推荐】

  1. 四大命令助你玩转Linux进程管理
  2. 如何监测Linux进程的实时IO读写情况
  3. Linux技巧:多核下绑定硬件/进程到不同CPU

相关内容

热门资讯

如何允许远程连接到MySQL数... [[277004]]【51CTO.com快译】默认情况下,MySQL服务器仅侦听来自localhos...
如何利用交换机和端口设置来管理... 在网络管理中,总是有些人让管理员头疼。下面我们就将介绍一下一个网管员利用交换机以及端口设置等来进行D...
施耐德电气数据中心整体解决方案... 近日,全球能效管理专家施耐德电气正式启动大型体验活动“能效中国行——2012卡车巡展”,作为该活动的...
Windows恶意软件20年“... 在Windows的早期年代,病毒游走于系统之间,偶尔删除文件(但被删除的文件几乎都是可恢复的),并弹...
20个非常棒的扁平设计免费资源 Apple设备的平面图标PSD免费平板UI 平板UI套件24平图标Freen平板UI套件PSD径向平...
德国电信门户网站可实时显示全球... 德国电信周三推出一个门户网站,直观地实时提供其安装在全球各地的传感器网络检测到的网络攻击状况。该网站...
着眼MAC地址,解救无法享受D... 在安装了DHCP服务器的局域网环境中,每一台工作站在上网之前,都要先从DHCP服务器那里享受到地址动...
为啥国人偏爱 Mybatis,... 关于 SQL 和 ORM 的争论,永远都不会终止,我也一直在思考这个问题。昨天又跟群里的小伙伴进行...