产生段错误就是访问了错误的内存段,一般是你没有权限,或者根本就不存在对应的物理内存,尤其常见的是访问0地址。

一般来说,段错误就是指访问的内存超出了系统所给这个程序的内存空间,通常这个值是由gdtr来保存的,它是一个48位的寄存器,其中的32位是保存由它指向的gdt表,后13位保存相应于gdt的下标,最后3位包括了程序是否在内存中以及程序在cpu中的运行级别,指向的gdt是以64位为一个单位的表,在这张表中就保存着程序运行的代码段、数据段的起始地址、与此相应的段限和页面交换、程序运行级别还有内存粒度等等的信息。一旦一个程序发生了越界访问,cpu就会产生相应的异常保护,于是segmentation fault就出现了.

在编程中以下几类做法容易导致段错误,基本是是错误地使用指针引起的:

1)访问系统数据区,尤其是往系统保护的内存地址写数据,最常见的就是给一个指针以0地址;

2)内存越界(数组越界,变量类型不一致等) 访问到不属于你的内存区域。

解决方法

我们在用C/C++语言写程序的时侯,内存管理的绝大部分工作都是需要我们来做的。实际上,内存管理是一个比较繁琐的工作,无论你多高明,经验多丰富, 难免会在此处犯些小错误,而通常这些错误又是那么的浅显而易于消除。但是手工“除虫”(debug),往往是效率低下且让人厌烦的,本文将就“段错误”这个 内存访问越界的错误谈谈如何快速定位这些“段错误”的语句。

下面将就以下的一个存在段错误的程序介绍几种调试方法:

1 dummy_function (void)

2 {

3         unsigned char *ptr = 0x00;

4         *ptr = 0x00;

5 }

6

7 int main (void)

8 {

9         dummy_function ();

10

11       return 0;

12 }

作为一个熟练的C/C++程序员,以上代码的bug应该是很清楚的,因为它尝试操作地址为0的内存区域,而这个内存区域通常是不可访问的禁区,当然就会出错了。我们尝试编译运行它:

xiaosuo@gentux test $ ./a.out

段错误

果然不出所料,它出错并退出了。

1.利用gdb逐步查找段错误:

这种方法也是被大众所熟知并广泛采用的方法,首先我们需要一个带有调试信息的可执行程序,所以我们加上“-g -rdynamic"的参数进行编译,然后用gdb调试运行这个新编译的程序,具体步骤如下:

xiaosuo@gentux test $ gcc -g -rdynamic d.c

xiaosuo@gentux test $ gdb ./a.out

GNU gdb 6.5

Copyright (C) 2006 Free Software Foundation, Inc.

GDB is free software, covered by the GNU General Public License, and you are

welcome to change it and/or distribute copies of it under certain conditions.

Type "show copying" to see the conditions.

There is absolutely no warranty for GDB. Type "show warranty" for details.

This GDB was configured as "i686-pc-linux-gnu"...Using host libthread_db library "/lib/libthread_db.so.1".

(gdb) r

Starting program: /home/xiaosuo/test/a.out

Program received signal SIGSEGV, Segmentation fault.

0x08048524 in dummy_function () at d.c:4

4 *ptr = 0x00;

(gdb)

好像不用一步步调试我们就找到了出错位置d.c文件的第4行,其实就是如此的简单。

从这里我们还发现进程是由于收到了SIGSEGV信号而结束的。通过进一步的查阅文档(man 7 signal),我们知道SIGSEGV默认的处理动作是打印“段错误”的出错信息,并产生Core文件,由此我们又产生了方法二。

2.分析Core文件:

Core文件是什么呢?

The default action of certain signals is to cause a process to terminate and produce a core dump file, a disk file containing an image of the process's memory at the time of termination. A list of the signals which cause a process to dump core can be found in signal(7).

以上资料摘自man page(man 5 core)。不过奇怪了,我的系统上并没有找到core文件。后来,忆起为了减少系统上的拉圾文件的数量(本人有些洁癖,这也是我喜欢Gentoo的原因之一),禁止了core文件的生成,查看了以下果真如此,将系统的core文件的大小限制在512K大小,再试:

xiaosuo@gentux test $ ulimit -c

0

xiaosuo@gentux test $ ulimit -c 1000

xiaosuo@gentux test $ ulimit -c

1000

xiaosuo@gentux test $ ./a.out

段错误 (core dumped)

xiaosuo@gentux test $ ls

a.out core d.c f.c g.c pango.c test_iconv.c test_regex.c

core文件终于产生了,用gdb调试一下看看吧:

xiaosuo@gentux test $ gdb ./a.out core

GNU gdb 6.5

Copyright (C) 2006 Free Software Foundation, Inc.

GDB is free software, covered by the GNU General Public License, and you are

welcome to change it and/or distribute copies of it under certain conditions.

Type "show copying" to see the conditions.

There is absolutely no warranty for GDB. Type "show warranty" for details.

This GDB was configured as "i686-pc-linux-gnu"...Using host libthread_db library "/lib/libthread_db.so.1".

warning: Can't read pathname for load map: 输入/输出错误.

Reading symbols from /lib/libc.so.6...done.

Loaded symbols for /lib/libc.so.6

Reading symbols from /lib/ld-linux.so.2...done.

Loaded symbols for /lib/ld-linux.so.2

Core was generated by `./a.out'.

Program terminated with signal 11, Segmentation fault.

#0 0x08048524 in dummy_function () at d.c:4

4 *ptr = 0x00;

还是一步就定位到了错误所在地,佩服一下Linux/Unix系统的此类设计。

接着考虑下去,以前用windows系统下的ie的时侯,有时打开某些网页,会出现“运行时错误”,这个时侯如果恰好你的机器上又装有windows的编译器的话,他会弹出来一个对话框,问你是否进行调试,如果你选择是,编译器将被打开,并进入调试状态,开始调试。

Linux下如何做到这些呢?我的大脑飞速地旋转着,有了,让它在SIGSEGV的handler中调用gdb,于是第三个方法又诞生了:

3.段错误时启动调试:

#include

#include

#include

#include

void dump(int signo)

{

char buf[1024];

char cmd[1024];

FILE *fh;

snprintf(buf, sizeof(buf), "/proc/%d/cmdline", getpid());

if(!(fh = fopen(buf, "r")))

exit(0);

if(!fgets(buf, sizeof(buf), fh))

exit(0);

fclose(fh);

if(buf[strlen(buf) - 1] == 'n')

buf[strlen(buf) - 1] = '';

snprintf(cmd, sizeof(cmd), "gdb %s %d", buf, getpid());

system(cmd);

exit(0);

}

void

dummy_function (void)

{

unsigned char *ptr = 0x00;

*ptr = 0x00;

}

int

main (void)

{

signal(SIGSEGV, &dump);

dummy_function ();

return 0;

}

编译运行效果如下:

xiaosuo@gentux test $ gcc -g -rdynamic f.c

xiaosuo@gentux test $ ./a.out

GNU gdb 6.5

Copyright (C) 2006 Free Software Foundation, Inc.

GDB is free software, covered by the GNU General Public License, and you are

welcome to change it and/or distribute copies of it under certain conditions.

Type "show copying" to see the conditions.

There is absolutely no warranty for GDB. Type "show warranty" for details.

This GDB was configured as "i686-pc-linux-gnu"...Using host libthread_db library "/lib/libthread_db.so.1".

Attaching to program: /home/xiaosuo/test/a.out, process 9563

Reading symbols from /lib/libc.so.6...done.

Loaded symbols for /lib/libc.so.6

Reading symbols from /lib/ld-linux.so.2...done.

Loaded symbols for /lib/ld-linux.so.2

0xffffe410 in __kernel_vsyscall ()

(gdb) bt

#0 0xffffe410 in __kernel_vsyscall ()

#1 0xb7ee4b53 in waitpid () from /lib/libc.so.6

#2 0xb7e925c9 in strtold_l () from /lib/libc.so.6

#3 0x08048830 in dump (signo=11) at f.c:22

#4

#5 0x0804884c in dummy_function () at f.c:31

#6 0x08048886 in main () at f.c:38

怎么样?是不是依旧很酷?

以上方法都是在系统上有gdb的前提下进行的,如果没有呢?其实glibc为我们提供了此类能够dump栈内容的函数簇,详见 /usr/include/execinfo.h(这些函数都没有提供man page,难怪我们找不到),另外你也可以通过gnu的手册进行学习。

4.利用backtrace和objdump进行分析:

重写的代码如下:

#include

#include

#include

#include

/* A dummy function to make the backtrace more interesting. */

void

dummy_function (void)

{

unsigned char *ptr = 0x00;

*ptr = 0x00;

}

void dump(int signo)

{

void *array[10];

size_t size;

char **strings;

size_t i;

size = backtrace (array, 10);

strings = backtrace_symbols (array, size);

printf ("Obtained %zd stack frames.n", size);

for (i = 0; i < size; i++)

printf ("%sn", strings[i]);

free (strings);

exit(0);

}

int

main (void)

{

signal(SIGSEGV, &dump);

dummy_function ();

return 0;

}

编译运行结果如下:

xiaosuo@gentux test $ gcc -g -rdynamic g.c

xiaosuo@gentux test $ ./a.out

Obtained 5 stack frames.

./a.out(dump+0x19) [0x80486c2]

[0xffffe420]

./a.out(main+0x35) [0x804876f]

/lib/libc.so.6(__libc_start_main+0xe6) [0xb7e02866]

./a.out [0x8048601]

这次你可能有些失望,似乎没能给出足够的信息来标示错误,不急,先看看能分析出来什么吧,用objdump反汇编程序,找到地址0x804876f对应的代码位置:

xiaosuo@gentux test $ objdump -d a.out

8048765: e8 02 fe ff ff call 804856c

我们还是找到了在哪个函数(dummy_function)中出错的,信息已然不是很完整,不过有总比没有好的啊!

后记:

本文给出了分析"段错误"的几种方法,不要认为这是与孔乙己先生的"回"字四种写法一样的哦,因为每种方法都有其自身的适用范围和适用环境,请酌情使用,或遵医嘱

linux内存不足+段错误,Linux系统内存错误产生的原因及调试方法(段错误|core dumped)[转]...相关推荐

  1. 005 Linux系统内存错误产生的原因及调试方法(段错误|core dumped)

    Linux系统内存错误产生的原因及调试方法(段错误|core dumped)[转] Posted on 2008-09-05 14:52 猫头鹰 阅读(84) 评论(0)  编辑 收藏 引用 所属分类 ...

  2. Linux下的段错误(Segmentation fault)产生的原因及调试方法

    段错误 就是访问了错误的内存段,一般是你没有权限,或者根本就不存在对应的物理内存,尤其常见的是访问0地址. 一 般来说,段错误就是指访问的内存超出了系统所给这个程序的内存空间,通常这个值是由gdtr来 ...

  3. linux程序运行段错误,Linux下的段错误产生的原因及调试方法

    Linux下的段错误产生的原因及调试方法 简而言之,产生段错误就是访问了错误的内存段,一般是你没有权限,或者根本就不存在对应的物理内存,尤其常见的是访问0地址. 一般来 说,段错误就是指访问的内存超出 ...

  4. 转Linux环境下段错误的产生原因及调试方法小结

    Linux环境下段错误的产生原因及调试方法小结 转载于:https://www.cnblogs.com/objectDetect/p/7575659.html

  5. 4g内存只有1.6g可用_32位系统可用内存小 遇到32位系统内存小的解决方法

    内存是CPU进行沟通的桥梁,我们计算机上所有的程序都是在内存中运行的,如果内存不够用,可能系统缓慢卡顿,甚至会造成系统崩溃.那今天小编就给大家介绍一下32位系统可用内存小的解决方法,感兴趣的小伙伴一起 ...

  6. U盘装win7系统出现question(1808)的原因与解决方法

    U盘装系统是很多用户和电脑城装机员的首选,这种方法简单快捷,一学就会.但也有用户在安装系统过程中会碰到一些问题,question(1808)便是常见问题之一.这是什么原因呢?下面我们就一起来看看U盘装 ...

  7. windows系统开机自动扫描硬盘的原因及解决方法

    win7系统开机自动扫描硬盘的原因及解决方法 win7系统开机扫描硬盘的原因: 1.BIOS中设置了每次扫描硬盘 2.非法关机 3.文件有错误 4.磁盘坏道引起文件错误. 解决方法 情况一.如果你在B ...

  8. 计算机开机硬盘扫描,win7系统开机自动扫描硬盘的原因及解决方法

    细心的用户发现 win7纯净版系统 开机都会自动扫描检测硬盘,然后在进入桌面,这样减慢系统启动速度.其实win7系统会开机检测硬盘,数据,设备等,这是一种系统检测行为,是安全的,但是开机速度变得非常慢 ...

  9. 浪潮服务器2012系统网卡不亮,Win7系统网卡灯不亮的原因和解决方法

    如今网络普及,我们电脑的网络都需要用到网卡,而网卡故障也经常发生,正常情况下网卡灯是闪烁的,可是有win7 32位系统用户却发现网卡灯不亮,这是什么原因呢?接下来给大家讲解一下Win7系统网卡灯不亮的 ...

最新文章

  1. URAL 1091. Tmutarakan Exams
  2. Vue计算属性、方法、侦听器
  3. c语言 函数的参数传递示例_isunordered()函数与C ++中的示例
  4. 如果在山上挖一个池塘,不放鱼,里面会慢慢有鱼吗?
  5. python怎么使用-如何使用 Python 开始建立
  6. 知名IT公司的年度大会合集
  7. finebi跳转到本地html文件,组件跳转- FineReport帮助文档|报表开发|报表使用|学习教程...
  8. ai 道德_AI如何提升呼叫中心的道德水平?
  9. Python文本数据分析与挖掘,外版畅销书中文版火爆上市
  10. 【IoT】 产品设计与工艺:塑料表面处理工艺
  11. openfire4.2.1 + smack4.2.2即时通信工具开发(android端登录、发送消息、接收消息)
  12. 1g1h1m mysql_mysql服务器优化
  13. 九枝兰专访-----深入解读程序化购买以及行业现状(初篇)
  14. oracle 控制台使用手册,Oracle-ESS-入门手册
  15. 仿新浪抢工长装修招标网站源码老工长装修网源码装修网站源码
  16. Java——一些适合新手练手的Java项目
  17. 数学分析讲义习题解答:(一)
  18. 企业数据无忧 飞客功不可没
  19. ecmall 连接mysql服务器失败_ecmall ECMall的MySQL数据库调用
  20. FANUC机器人控制柜死机或示教器空白故障诊断

热门文章

  1. 2021年中式烹调师(技师)考试题库及中式烹调师(技师)考试资料
  2. 数字逻辑之数字时钟显示与校时
  3. Java遍历Set集合方法
  4. HTML5创作生日蛋糕,three.js创作生日蛋糕,生日快乐3D建模动画
  5. DApp(去中心化应用)未来引导市场主流?
  6. python中bytearray函数_python 内置函数bytearray
  7. 构建springclound项目(详情)
  8. 有关WPF中DataGrid控件的基础应用总结
  9. OpenGL学习五:矢量图形旋转
  10. less 可翻页查看(一页一页翻动)