Thread Basic

基础概念

线程是操作系统能够调度和执行的基本单位,在Linux中也被称之为轻量级进程。从定义中可以看出,线程它是操作系统的概念,在不同的操作系统中的实现是不同的,不过今天分享的猪脚是Linux Thread。

对于Linux操作系统而言,它对Thread的实现方式比较特殊。在Linux内核中,其实是没有线程的概念的,它把所有的线程当做标准的进程来实现,也就是说Linux内核,并没有为线程提供任何特殊的调度语义,也没有为线程实现特定的数据结构。取而代之的是,线程只是一个与其他进程共享某些资源的进程。每一个线程拥有一个唯一的task_struct结构,Linux内核它仅仅把线程当做一个正常的进程,或者说是轻量级进程,LWP(Lightweight processes)。

对于其他的操作系统而言,比如windows,线程相对于进程,只是一个提供了更加轻量、快速执行单元的抽象概念。对于Linux而言,线程只是进程间共享资源的一种方式,非常轻量。举个简单例子,假设有一个进程包含了N个线程。对于那些显示支持线程的操作系统而言,应该是存在一个进程描述符,依次轮流指向N个线程。这个进程描述符指明共享资源,包括内存空间和打开的文件,然后线程描述它们自己独享的资源。相反的是在Linux中,只有N个进程,因此有N个task_struct数据结构,只是这些数据结构的某些资源项是共享的。

这里再总结一下,Linux线程是进程资源共享的一种方式,而其他操作系统,线程则是一种实现轻量、快速执行单元的抽象概念或者实体。这里再深入的理解一下,Linux中的线程和进程的区别。这也是诸多面试题中,最常见的一个。

资源共享

Linux线程与进程的区别,主要体现在资源共享、调度、性能几个方面,首先看一下资源共享方面。上面也提到,线程其实是共享了某一个进程的资源,这些资源包括:

  • 内存地址空间
  • 进程基础信息
  • 大部分数据
  • 打开的文件
  • 信号处理
  • 当前工作目录
  • 用户和用户组属性
  • 等等

哪些是线程独自拥有的呢?

  • 线程ID
  • 一系列的寄存器
  • 栈的局部变量和返回地址
  • 错误码 errno
  • 信号掩码
  • 优先级
  • 等等

这里说一个黑科技,线程拥有独立的调用栈,除了栈之外共享了其他所有的段segment。但是由于线程间共享了内存,也就是说一个线程,理论上是可以访问到其他线程的调用栈的,可以用一个指针变量,去访问其他线程的局部栈帧,以访问其他线程的局部变量。

调度

说到调度,就得提到进程的上下文切换。上下文切换也被称作为进程调度或者任务切换,简单的来说是把CPU从一个进程或者线程切换到另一个执行。概括的来说,线程的上下文切换,要比进程更加快速,因为本质上,线程很多资源都是共享进程的,所以切换时,需要保存和切换的项是很少的。

线程上线文切换时,虚拟地址空间是不变的,但是进程上下文切换时,是需要重新映射虚拟地址空间。进程切换上下文时,进出OS内核&寄存器切换,是最大的时间支出。更模糊的代价是上下文切换时,会干扰处理器的缓存机制。当上下文切换时,处理器需要重新cache一些内存。

这里更大的一个区别时,当更改虚拟地址空间时,CPU 的 TLB 等也会被刷新,导致接下来的内存访问更加耗时,所以相对线程切换来说,进程的切换耗时更大。

性能

从性能方面,来查看一下线程与进程的对比。由于线程更加轻量,导致线程的创建速度、切换速度都要高于进程。这里就有一个疑问了,从上面提到的各个方面来看,好像线程都要优于进程,那么有没有啥缺点呢?

线程缺点

线程同样也有缺点,最大的缺点是线程的不安全性,缺乏保护机制。就是上面提到的黑科技,因为线程间共享数据,一个线程可以重写另外一个线程的堆栈,导致出现一些异常的情况。除此之外,线程还有以下缺点:

  • 共享属性:全局变量是在所有线程间共享的,访问时是需要同步加锁。
  • 很多库函数是线程非安全的,多线程编程时,需要注意这一点。
  • 线程的健壮性不强,如果一个线程crash了,那么整个应用程序就跪了。

应用场景

上面提到了线程与进程的对比,也提到了线程的优点和缺点,那么什么情况下适合用线程呢?简单的来说,计算密集型的任务,适合于多线程来处理。因为计算密集型任务,需要耗费很多CPU,上下文的切换是非常频繁的,而线程切换速度是高于进程的,所以使用线程是更加适合的。在实际的编程过程中,根据业务的场景,再结合进程和线程的优缺点对比,来决定适合的编程模型。

线程创建

那么Linux中线程是如何创建出来的呢?上面也提到,在Linux中线程是一种资源共享的方式,可以在创建进程的时候,指定某些资源是从其他进程共享的,从而在概念上创建了一个线程。在Linux中,可以通过clone系统调用来创建一个进程,它的函数签名如下:

#include <sched.h>
int clone(int (*fn)(void *), void *child_stack, int flags, void *arg, ...);

我们在使用clone创建进程的过程中,可以指明相应的参数,来决定共享某些资源,比如:

clone(CLONE_VM | CLONE_FS | CLONE_FILES | CLONE_SIGHAND, 0);

这个clone系统调用的行为类似于fork,不过新创建出来的进程,它的内存地址、文件系统资源、打开的文件描述符和信号处理器,都是共享父进程的。换句话说,这个新创建出来的进程,也被叫做Linux Thread。从这个例子中,也可以看出Linux中,线程其实是进程实现资源共享的一种方式。

内核线程

在Linux中,还存在一个Kernel Thread的概念,也就是内核线程。内核创建一些内核线程来执行一些后台任务。相对于普通的进程,内核线程完整的存在于内核空间,是没有自己的地址空间的,也就是mm指针为空,它的操作仅存在于内核态,并且也不会上下文切换到用户态。不过内核线程和普通进程类似的是,是可调度和可抢占的。

同步

由于线程间共享了很多资源,所以在多线程的编程环境下,为了保障结果的准确性和一致性,需要对共享资源的访问进行同步。常见的同步方式,也就是加锁,以保障操作共享资源时,不会出错。在Linux中,锁的种类大致有四种:

  • 互斥锁
  • 读写锁
  • 条件变量
  • 自旋锁
  • 内存屏障

有兴趣的同学,看看看下这篇文章:http://blog.lecury.cn/2016/02/21/%E5%90%8C%E6%AD%A5%E4%BA%92%E6%96%A5(%E9%94%81).html 。总结来说,锁的代价是高昂的,所以在设计高并发、高吞吐的程序时,尽量避免锁的使用,或者减少锁的区间。

常见的多线程编程模式

下面谈一下实际工作中,要如何合理的线程呢?这里我简单的提出三种常见的线程模型。

  • leader-follow 模型(主从)

    • 线程与连接对应,并发度等于线程数。
    • 所有线程经历accept->close整个过程。
    • 适用于连接数少、处理时间长、CPU密集型服务。
  • producer-consumer模型(生产者消费者)
    • 主线程用于accept请求,并将fd放置在消费队列pendingpool中。
    • pendingpool进行连接的维护工作。
    • 多个worker竞争pendingpool的连接。
    • 适用于连接数多、处理速度快的业务。
  • 高并发索引模型
    • 无锁设计
    • 将请求或者事务映射到具体线程处理

踩过的坑和小技巧

  • 同步
  • 过载保护
  • 公平调度
  • 析构出core

更加详细的内容,请参考知乎Live:

如何理解和应用Linux线程模型?​www.zhihu.com

感兴趣的同学,可以加QQ群: 853832829 一起学习~

查linux有哪些task_浅谈Linux线程模型相关推荐

  1. linux中sh+$0,浅谈linux中shell变量$#,$@,$0,$1,$2的含义解释

    摘抄自:ABS_GUIDE 下载地址:http://www.tldp.org/LDP/abs/abs-guide.pdf linux中shell变量$#,$@,$0,$1,$2的含义解释: 变量说明: ...

  2. Linux系统常用函数,浅谈linux下的一些常用函数的总结(必看篇)

    1.exit()函数 exit(int n)  其实就是直接退出程序, 因为默认的标准程序入口为int main(int argc, char** argv),返回值是int型的. 一般在shell下 ...

  3. linux的多任务 多进程,浅谈linux模拟多线程崩溃和多进程崩溃

    结论是: 多线程下如果其中一个线程崩溃了会导致其他线程(整个进程)都崩溃: 多进程下如果其中一个进程崩溃了对其余进程没有影响: 多线程 #include #include #include #incl ...

  4. Linux命令删除find,浅谈Linux下通过find命令进行rm文件删除的小技巧

    我们经常会通过find命令进行批量操作,如:批量删除旧文件.批量修改.基于时间的文件统计.基于文件大小的文件统计等,在这些操作当中,由于rm删除操作会导致目录结构变化,如果要通过find结合rm的操作 ...

  5. linux cp mv区别,浅谈Linux下mv和cp命令的区别

    1.功能上的区别 mv:用户可以使用该命令为文件或目录重命名或将文件由一个目录移入另一个目录中. cp: 该命令的功能是将给出的文件或目录拷贝到另一文件或目录中. 2.从inode角度来区分 mv:会 ...

  6. linux gz文件压缩比,浅谈Linux下各种压缩 解压命令和压缩比率对比.doc

    浅谈Linux下各种压缩 解压命令和压缩比率对比 浅谈Linux下各种压缩 解压命令和压缩比率对比 Linux下压缩.解压命令五花八门,不像在windows下一个winrar打遍天下无敌手,清一色的. ...

  7. 实现Linux的whoami命令,浅谈linux中的whoami与 who指令

    whoami 功能说明: 显示用户名称 语法: whoami 补充说明: 显示自身的用户名称,本指令相当于执行  id -un 指令 whoami 与 who am i的区别 who这个命令重点在用来 ...

  8. linux read函数_浅谈Linux内核IO体系之磁盘IO

    前言 Linux I/O体系是Linux内核的重要组成部分,主要包含网络IO.磁盘IO等.基本所有的技术栈都需要与IO打交道,分布式存储系统更是如此.本文主要简单分析一下磁盘IO,看看一个IO请求从发 ...

  9. linux 用户shell 无效,浅谈Linux环境下,为什么设置用户ID位对shell脚本无效

    前言: 博主在前不久的一个项目中,项目组的组员需要删除由daemon守护进程创建的缓存文件.但是删除这些缓存文件需要超级用户权限.博主用root用户创建了一个设置用户id的shell脚本来实现此功能. ...

最新文章

  1. php将图片链接转换为base64编码文件流
  2. C语言,分解质因数一个解法!_只愿与一人十指紧扣_新浪博客
  3. 以演进式的架构来让系统为变化做好准备
  4. 前端基础面试题大全-极乐科技(一)-JS部分
  5. jsonb 查询_如何使用IN运算符查询jsonb数组
  6. 电脑pin重置_如果忘记了如何重置Windows PIN
  7. 论文阅读01:大规模人脸图像检索的深度度量哈希
  8. 在linux环境下com.aspose.words将word文件转为pdf后乱码,window环境下不会
  9. linux下抓包工具 wireshark,网络抓包工具Wireshark的简单使用
  10. 导出数据报ORA-39002: 操作无效 ORA-39070: 无法打开日志文件。 ORA-39087: 目录名 DUMP_DIR 无效...
  11. Linux软件包管理器
  12. python进阶 pdf_Python进阶(Intermediate_Python)_中文PDF彩色版.pdf
  13. 实验05 视图的创建与管理
  14. (四)JMockit 的API:@Injectable 与 @Mocked的不同--基础篇
  15. uniapp mx-datepicker时间范围选择器禁用部分时间
  16. 【基于Web停车场管理系统——开题报告 分享(仅供参考呀)】
  17. 管理信息系统期末报告:大象基金信息管理系统分析与设计报告
  18. ue4 怎么传递变量到另一个蓝图_【UE4】UI注意事项
  19. 期望、方差、协方差性质总结与证明
  20. CentOS7虚拟机安装教程

热门文章

  1. datetime的文本时间处理
  2. Alpha 冲刺报告2
  3. 一条开启勇士王朝的短信
  4. js-jquery-插件开发(一)
  5. 如何导出已有的谷歌插件,又如何把导出的插件安装到360浏览器中,又如何对插件小修小改?...
  6. 《转载》struts旅程《2》
  7. VMware虚拟机三种网络模式的区别
  8. Sr Software Engineer - Big Data Team
  9. 【iOS】利用CocoaPods创建私有库进行组件化开发
  10. struts2整合spring应用实例