Python，针对指定文件类型，过滤空行和注释，统计行数

参考网络上代码编辑而成，无技术含量，可自行定制：

目前亲测有效，若有待完善之处，还望指出！

强调：将此统计py脚本放置项目的根目录下执行即可。

1、遍历文件，递归遍历文件夹中的所有

def getFile(basedir):

    global filelists

    for parent,dirnames,filenames in os.walk(basedir):

        #for dirname in dirnames:

        #    getFile(os.path.join(parent,dirname)) #递归

        for filename in filenames:

            ext = filename.split('.')[-1]

            #只统计指定的文件类型，略过一些log和cache文件

            if ext in whitelist:

                filelists.append(os.path.join(parent,filename))

2、指定文件类型：项目的代码行数，故只考虑.py文件，当然也可在指定的文件类型列表whitelist中添加其他类型

# 指定想要统计的文件类型

whitelist = ['py']

3、过滤空行和注释，注意采用的读取文件模式为‘rb’

def countLine(fname):

    count = 0

    single_quotes_flag = False

    double_quotes_flag = False

    with open(fname, 'rb') as f:

        for file_line in f:

            file_line = file_line.strip()

            # print(file_line)

            # 空行

            if file_line == b'':

                pass

            # 注释 # 开头

            elif file_line.startswith(b'#'):

                pass

            # 注释 单引号 ''' 开头

            elif file_line.startswith(b"'''") and not single_quotes_flag:

                single_quotes_flag = True

            # 注释 中间 和 ''' 结尾

            elif single_quotes_flag == True:

                if file_line.endswith(b"'''"):

                    single_quotes_flag = False

            # 注释 双引号 """ 开头

            elif file_line.startswith(b'"""') and not double_quotes_flag:

                double_quotes_flag = True

            # 注释 中间 和 """  结尾

            elif double_quotes_flag == True:

                if (file_line.endswith(b'"""')):

                    double_quotes_flag = False

            # 代码

            else:

                count += 1

        print(fname + '----', count)

        # 单个文件行数

        # print(fname,'----count:',count)

        return count

完整源码：

#!/usr/bin/env python

# -*- coding: utf-8 -*-

# @Time    : 2018/05/10 21:50

# @Author  : MJay_Lee

# @File    : python统计行数.py

# @Contact : limengjiejj@hotmail.com

import os

import time

basedir = os.path.dirname(__file__)

filelists = []

# 指定想要统计的文件类型

whitelist = ['py']

#遍历文件, 递归遍历文件夹中的所有

def getFile(basedir):

    global filelists

    for parent,dirnames,filenames in os.walk(basedir):

        #for dirname in dirnames:

        #    getFile(os.path.join(parent,dirname)) #递归

        for filename in filenames:

            ext = filename.split('.')[-1]

            #只统计指定的文件类型，略过一些log和cache文件

            if ext in whitelist:

                filelists.append(os.path.join(parent,filename))

#统计一个文件的行数

def countLine(fname):

    count = 0

    single_quotes_flag = False

    double_quotes_flag = False

    with open(fname, 'rb') as f:

        for file_line in f:

            file_line = file_line.strip()

            # print(file_line)

            # 空行

            if file_line == b'':

                pass

            # 注释 # 开头

            elif file_line.startswith(b'#'):

                pass

            # 注释 单引号 ''' 开头

            elif file_line.startswith(b"'''") and not single_quotes_flag:

                single_quotes_flag = True

            # 注释 中间 和 ''' 结尾

            elif single_quotes_flag == True:

                if file_line.endswith(b"'''"):

                    single_quotes_flag = False

            # 注释 双引号 """ 开头

            elif file_line.startswith(b'"""') and not double_quotes_flag:

                double_quotes_flag = True

            # 注释 中间 和 """  结尾

            elif double_quotes_flag == True:

                if (file_line.endswith(b'"""')):

                    double_quotes_flag = False

            # 代码

            else:

                count += 1

        print(fname + '----', count)

        # 单个文件行数

        # print(fname,'----count:',count)

        return count

if __name__ == '__main__' :

    startTime = time.clock()

    getFile(basedir)

    totalline = 0

    for filelist in filelists:

        totalline = totalline + countLine(filelist)

    print('\033[43m total lines: \033[0m'.center(20,'-'),totalline)

    print('Done! Cost Time: %0.5f second' % (time.clock() - startTime))

测试对象样本，test.py：

#

'''

123

aa

哈哈

'''

"""

123

aa

哈哈

"""

code1

code2

结果为：2

Python，针对指定文件类型，过滤空行和注释，统计行数的更多相关文章

python 读取指定文件夹中的指定文件类型的文件名
import numpy as np import os path = 'F:\\wenjian'#指定文件所在路径 filetype ='.csv'#指定文件类型 def get_filename( ...
HTML input="file" 浏览时只显示指定文件类型 xls、xlsx、csv
html input="file" 浏览时只显示指定文件类型 xls.xlsx.csv <input id="fileSelect" type=" ...
<input type="file" />浏览时只显示指定文件类型
<input type="file" />浏览时只显示指定文件类型 <input type="file" accept="appli ...
findstr 只搜寻指定文件类型
Title:findstr 只搜寻指定文件类型 --2012-05-04 09:27 findstr /i /m /S /C:"关键字" *.php *.asp *.jsp
C# 获得目录下所有文件或指定文件类型文件(包含所有子文件夹)
public partial class FileGet { /// <summary> /// 私有变量 /// </summary> private static List ...
Apache 日志设置不记录指定文件类型的方法和日志轮
Apache日志精准的记录了Web访问的记录,但对于访问量很大的站来说,日志文件过大对于分析和保存很不方便.可以在http.conf(或虚拟主机设置文件httpd-vhosts.conf)中进行设置, ...
nginx不记录指定文件类型的日志
1.指定记录文件日志记录的内容. vim /usr/local/nginx/conf/nginx.conf如下部分: log_format dd '$remote_addr $http_x_forwa ...
nginx不记录指定文件类型日志
1.指定记录文件日志记录的内容. vim /usr/local/nginx/conf/nginx.conf如下部分: log_format dd '$remote_addr $http_x_forwa ...
python 将指定文件夹中的指定文件放入指定文件夹中
import os import shutil import re #获取指定文件中文件名 def get_filename(filetype): name =[] final_name_list = ...

随机推荐

Hive学习（三）Hive的Java客户端操作
Hive的Java客户端操作分为JDBC和Thrifit Client,首先启动Hive远程服务: hive --service hiveserver 一.JDBC 在MyEclipse中首先创建连接 ...
chrome 修改请求头的小工具
chrome 网上应用店中搜索 ModHeader
2019.03.21 读书笔记 ==与Equals
首先得出一个结论:==是比较变量内存的数据,Equals是值比较.但是他们都能被重写,所以object又增加了一个RefrenceEquals不可被重写,只比较数据: [ReliabilityCont ...
python groupby的小技巧
df.groupby('col',as_index=False),agg(ufunk)#as_index=False,可以消除层次索引更多grouby的用法 http://blog.csdn.net ...
centos7.3 安装cuda8.0的坑
1. 安装依赖 yum -y install gcc-c++yum -y install epel-releaseyum -y install --enablerepo=epel dkmsyum -y ...
JavaScript Date学习实例：获取3分钟前的时间“hhmmss”格式
上一篇博客分享了Date对象的理论知识,今天正好看到一段相关的代码,可以继续深化,通过实例加强复习Date 题目:获取3分钟前的时间,并且显示格式是hhmmss 以下是看到的代码 var time=n ...
InnoDB还是MyISAM？
两种类型最主要的差别就是Innodb 支持事务处理与外键和行级锁.而MyISAM不支持.所以MyISAM往往就容易被人认为只适合在小项目中使用. 我作为使用MySQL的用户角度出发,Innodb和My ...
2019.3.26判断是否回文（java实现）
我所有的文章都是对我总结学习的总结,那里不好或者冒犯了那里,我先对您说声对不起,请告知我进行改正. 今天java老师作业题目是判断是一个字符串否是回文: emmmm,我的思路是将字符串逆序,然后使用方 ...
ArcGIS Desktop中面与面之间空隙填充
1.前言再给客户培训过程中被问到这样一个问题,几个面中间有一个空心部分(如下图所示),如何快速绘制中心部分的要素. 2.操作流程 1.打开Editor工具栏,开始编辑操作. 2.点击创建要素按钮,打 ...
MOSS2010中如何用代码给托管元数据类型的栏目赋值
最近项目中遇到如何用代码给托管元数据类型的栏目赋值问题,经过折腾,现把我的思路和实现方法共享出来,让大家一起来学习学习.相互探讨下. /// <summary> /// 托管元数据 /// ...

Python，针对指定文件类型，过滤空行和注释，统计行数

Python，针对指定文件类型，过滤空行和注释，统计行数的更多相关文章

随机推荐

热门专题