《Linux/Unix系统编程手册》读书笔记 目录

第13章

这章主要将了关于文件I/O的缓冲。

系统I/O调用(即内核)和C语言标准库I/O函数(即stdio函数)在对磁盘进行操作的时候都会发生缓冲。通过缓冲可以在一定程度上将用户空间与实际的物理设备分离,还可以减少内核访问磁盘的次数。

先来看看关于内核缓冲区高速缓冲:read和write调用在对磁盘文件进行操作的时候不会直接访问磁盘,如下图所示。

例如:write(fd, "abc", 3) write调用会将"abc"从用户空间缓冲区传递内核缓冲区中并随即返回。在之后的某个时刻(缓冲区满了或者需要刷新),内核会将其缓冲区的数据写入到磁盘上,因此write系统调用与访问磁盘的操作不是同步执行的。同理,对于read(fd, buffer, 3):内核会从磁盘读取数据并存在内核的缓冲区上,read调用再从内核缓冲区读取3个字节的数据到用户缓冲区。当缓冲区的全部数据被读取完,内核才会再从磁盘文件读取下一段数据。

这样的设计可以使得read和write系统调用不用等待磁盘操作从而加快操作的速度,还减少了内核访问磁盘的次数。

PS:Linux内核对缓冲区(内核缓冲区)的大小没有固定的上限,但是可用物理内存总量和其他进程对物理内存的需求会影响缓冲区的大小。

内核访问磁盘的字节数是固定的,所以尽量使得每次read(write)传输的字节数达到合适的数目可以减少系统调用所消耗的时间。

下表为书中的一个关于复制100MB大小的文件花费的时间,BUF_SIZE为传输的字节数, Elapsed为总共的用时,Total CPU为CPU的总共用时,User CPU为用户CPU的用时,System CPU为系统CPU用时。测试的文件系统为块大小为4096字节的ext2。

当BUF_SIZE为4096字节的时候,达到最优性能,再继续增大BUF_SIZE不会对性能有太大的影响,是因为系统调用(read和write)花费的时间与在用户空间和内核空间之间传输数据以及实际磁盘操作所花费的时间对比已经微不足道。

再来看看第二个表,是关于写入一个100MB大小的文件所需的时间。

其实再进行write调用后并没有这么快执行磁盘I/O,因为实际计算机的RAM是很大(测试环境是4G),所以结合前表可以知道复制文件耗时绝大部分是用在磁盘的读取。

接着来看stdio库的缓冲。

stdio库的一些函数(fprintf, fscanf, fgets, fputs, fgets, fputc, fgetc)会帮我们自动采取大块数据缓冲以减少系统调用。

通过setvbuf设置stdio库函数的缓冲方式

 #include <stdio.h>

 int setvbuf(FILE *stream, char *buf, int mode, size_t size);

成功调用返回0,失败返回非0值。

其中stream为文件流(PS:先打开文件流再调用setvbuf),buf为使用的缓冲区,size为缓冲区的大小。当buf不为NULL,就指向size大小的内存块作为stream的缓冲区;当buf为NULL,stdio库会为stream自动分配一个缓冲区。mode为缓冲的类型。

mode的取值:

_IONBF 不对I/O进行缓冲,即立即调用write和read
_IOLBF 采用行缓冲I/O(终端设备的流的默认采用)
_IOFBF  单次读写数据的大小与缓冲区相同(磁盘的流默认采用)

除了setvbuf还有setbuf和setbuffer

 #define _BSD_SOURCE   //获取setbuffer的声明
#include <stdio.h> void setbuf(FILE *stream, char *buf); void setbuffer(FILE *stream, char *buf, size_t size);

还有通过fflush刷新stdio缓冲区

 #include <stdio.h>

 int fflush(FILE *stream);

成功调用返回0,失败返回EOF。

如果stream为NULL,fflush会刷新所有的缓冲区。

如果将fflush用在输入流,可以将已缓冲的输入数据全部丢弃。

在C函数库的实现中,如果stdin和stdout指向同一个终端,那么从stdin读取输入时都会隐含调用fflush(stdout)。

----------------------暂时省略同步I/O。。。。这部分翻译的很坑,看不懂。。。。

----------------------还有直接I/O。。。。。。。。。。。。。。。。。。。。。。

下图为I/O缓冲小结:

练习:

13-5. tail [ -n num ] file 命令打印名为file文件的最后路面行(默认为10行)。使用I/O系统调用(lseek()、read()、write()等)来实现该命令。

 /*
* =====================================================================================
*
* Filename: 13.5.c
*
* Description: 简单tail实现,可能存在bug,但是没有找到!!!
*
* Version: 1.0
* Created: 2014年05月02日 18时58分15秒
* Revision: none
* Compiler: gcc
*
* Author: alan (), alan19920626@gmail.com
* Organization:
*
* =====================================================================================
*/ #include <sys/stat.h>
#include <fcntl.h>
#include <ctype.h>
#include "tlpi_hdr.h" #define BUF_SIZE 4096 int main(int argc, char *argv[]){
off_t seek, off, offset = ;
int whence, fd, num, numRead, type = , i, off_cnt = , n_cnt = ;
Boolean flag = FALSE;
struct stat statbuf;
char *file;
char buf[BUF_SIZE+]; if(strcmp(argv[], "--help") == )
usageErr("%s [ -n num ] file", argv[]); //获取文件名
file = argv[]; if(argc == && strcmp(argv[], "-n") == ){
flag = TRUE;
file = argv[];
} //获取最后的行数
num = (flag == TRUE) ? getInt(argv[], GN_GT_0, "num") : ; //打开文件对应的文件描述符
fd = open(file, O_RDONLY);
if(fd == -)
errExit("open"); if(fstat(fd, &statbuf) == -)
errExit("fstat"); //判断文件的大小是否超过4096字节
if(statbuf.st_size <= BUF_SIZE){
off = ;
whence = SEEK_CUR;
type = ;
}
else{
off = - * BUF_SIZE;
whence = SEEK_END;
} //根据换行符判断行数
while((seek = lseek(fd, off_cnt * off, whence)) != -){
numRead = read(fd, buf, BUF_SIZE);
if(numRead == -)
errExit("read");
if(numRead > ){
for(i = numRead-; i >=; --i){
if(buf[i] == '\n')
n_cnt++;
if(n_cnt == num+)
break;
} if(n_cnt == num+){
offset += (numRead- - i);
break;
}
else
offset += numRead;
if(type)
break; //如果行数小于要求的,当文件的偏移量回到文件的开始位置,即buf从数组结尾回到数组的头部时,跳出循环。
}
off_cnt++;
memset(buf, , BUF_SIZE+);
}
if(seek == -)
errExit("lseek"); if(lseek(fd, ( - offset), SEEK_END) == -)
errExit("lseek"); while((numRead = read(fd, buf, BUF_SIZE)) > ){
buf[numRead] = '\0';
printf("%s", buf);
memset(buf, , BUF_SIZE+);
}
if(numRead == -)
errExit("read"); exit(EXIT_SUCCESS);
}

测试结果:

一、

lancelot@debian:~/Code/tlpi$ ./13.5 13.5.c
while((numRead = read(fd, buf, BUF_SIZE)) > ){
buf[numRead] = '\0';
printf("%s", buf);
memset(buf, , BUF_SIZE+);
}
if(numRead == -)
errExit("read"); exit(EXIT_SUCCESS);
}
lancelot@debian:~/Code/tlpi$ tail 13.5.c
while((numRead = read(fd, buf, BUF_SIZE)) > ){
buf[numRead] = '\0';
printf("%s", buf);
memset(buf, , BUF_SIZE+);
}
if(numRead == -)
errExit("read"); exit(EXIT_SUCCESS);
}

二、

lancelot@debian:~/Code/tlpi$ tail -n  13.5.c
errExit("lseek"); if(lseek(fd, ( - offset), SEEK_END) == -)
errExit("lseek"); while((numRead = read(fd, buf, BUF_SIZE)) > ){
buf[numRead] = '\0';
printf("%s", buf);
memset(buf, , BUF_SIZE+);
}
if(numRead == -)
errExit("read"); exit(EXIT_SUCCESS);
}
lancelot@debian:~/Code/tlpi$ ./13.5 -n 13.5.c
errExit("lseek"); if(lseek(fd, ( - offset), SEEK_END) == -)
errExit("lseek"); while((numRead = read(fd, buf, BUF_SIZE)) > ){
buf[numRead] = '\0';
printf("%s", buf);
memset(buf, , BUF_SIZE+);
}
if(numRead == -)
errExit("read"); exit(EXIT_SUCCESS);
}

---------------多点使用系统调用和库函数才会熟练,只要熟练就编程才不会觉得很难上手啊。。。。。。

---------------另外那篇关于动态规划的算法导论学习记录感觉写不下去了。。。。。。。。。。。。。。

---------------继续努力!!!!!!

《Linux/Unix系统编程手册》读书笔记8 (文件I/O缓冲)的更多相关文章

  1. 《Linux/Unix系统编程手册》读书笔记 目录

    <Linux/Unix系统编程手册>读书笔记1  (创建于4月3日,最后更新4月7日) <Linux/Unix系统编程手册>读书笔记2  (创建于4月9日,最后更新4月10日) ...

  2. 《Linux/Unix系统编程手册》读书笔记9(文件属性)

    <Linux/Unix系统编程手册>读书笔记 目录 在Linux里,万物皆文件.所以文件系统在Linux系统占有重要的地位.本文主要介绍的是文件的属性,只是稍微提及一下文件系统,日后如果有 ...

  3. 《Linux/Unix系统编程手册》读书笔记7 (/proc文件的简介和运用)

    <Linux/Unix系统编程手册>读书笔记 目录 第11章 这章主要讲了关于Linux和UNIX的系统资源的限制. 关于限制都存在一个最小值,这些最小值为<limits.h> ...

  4. 《Linux/Unix系统编程手册》读书笔记6

    <Linux/Unix系统编程手册>读书笔记 目录 第9章 这章主要讲了一堆关于进程的ID.实际用户(组)ID.有效用户(组)ID.保存设置用户(组)ID.文件系统用户(组)ID.和辅助组 ...

  5. 《Linux/Unix系统编程手册》读书笔记5

    <Linux/Unix系统编程手册>读书笔记 目录 第8章 本章讲了用户和组,还有记录用户的密码文件/etc/passwd,shadow密码文件/etc/shadow还有组文件/etc/g ...

  6. 《Linux/Unix系统编程手册》读书笔记4

    <Linux/Unix系统编程手册>读书笔记 目录 第7章: 内存分配 通过增加堆的大小分配内存,通过提升program break位置的高度来分配内存. 基本学过C语言的都用过mallo ...

  7. 《Linux/Unix系统编程手册》读书笔记3

    <Linux/Unix系统编程手册>读书笔记 目录 第6章 这章讲进程.虚拟内存和环境变量等. 进程是一个可执行程序的实例.一个程序可以创建很多进程. 进程是由内核定义的抽象实体,内核为此 ...

  8. 《Linux/Unix系统编程手册》读书笔记1

    <Linux/Unix系统编程手册>读书笔记 目录 最近这一个月在看<Linux/Unix系统编程手册>,在学习关于Linux的系统编程.之前学习Linux的时候就打算写关于L ...

  9. 《Linux/Unix系统编程手册》读书笔记2

    <Linux/Unix系统编程手册>读书笔记 目录 第5章: 主要介绍了文件I/O更深入的一些内容. 原子操作,将一个系统调用所要完成的所有动作作为一个不可中断的操作,一次性执行:这样可以 ...

随机推荐

  1. Python爬取百度贴吧图片

    一.获取URL Urllib 模块提供了读取web页面数据的接口,我们可以像读取本地文件一样读取www和ftp上的数据.首先,我们定义了一个getHtml()函数: urllib.urlopen()方 ...

  2. 来自平时工作中的css知识的积累---持续补充中

    ① 现代浏览器中,<img>元素默认情况下底部会有空白,那么这个空白到底是从哪里来的? 解惑: method-one:猛戳 来自知乎的解答 method-two: 延伸阅读 what is ...

  3. winform 记录全局异常捕获

    这篇文章主要是备用 记录winform程序捕获全局异常. /// <summary> /// 应用程序的主入口点. /// </summary> public static A ...

  4. 4-Highcharts 3D图之3D普通饼图

    <!DOCTYPE> <html lang='en'> <head> <title>4-Highcharts 3D图之3D普通饼图</title& ...

  5. Cross Validation done wrong

    Cross Validation done wrong Cross validation is an essential tool in statistical learning 1 to estim ...

  6. POJ 1273 Drainage Ditches(网络流dinic算法模板)

    POJ 1273给出M条边,N个点,求源点1到汇点N的最大流量. 本文主要就是附上dinic的模板,供以后参考. #include <iostream> #include <stdi ...

  7. POJ 1469

    #include<iostream> #include<stdio.h> #include <string.h> #include <vector> # ...

  8. [转载] poll()函数

    原地址:http://baike.baidu.com/view/2997591.htm   poll()函数:这个函数是某些Unix系统提供的用于执行与select()函数同等功能的函数,下面是这个函 ...

  9. hdu 2413(最大匹配+二分)

    题目链接:http://acm.hdu.edu.cn/showproblem.php?pid=2413 思路:由于要求最少的时间,可以考虑二分,然后就是满足在limit时间下,如果地球战舰数目比外星战 ...

  10. QTP10.0安装说明

    QTP10.0 安装手册 注:安装之前检查清理相关注册表:运行->regdit-HKEY_LOCAL_MACHINE->HKEY_LOCAL_MACHINE\SOFTWARE->HK ...