时间:2021-05-22
脚本如下:
from openpyxl import load_workbookworkbook = load_workbook(u'/tmp/test.xlsx') #找到需要xlsx文件的位置booksheet = workbook.active #获取当前活跃的sheet,默认是第一个sheet#如果想获取别的sheet页采取下面这种方式,先获取所有sheet页名,在通过指定那一页。# sheets = workbook.get_sheet_names() # 从名称获取sheet# booksheet = workbook.get_sheet_by_name(sheets[0])#获取sheet页的行数据rows = booksheet.rows#获取sheet页的列数据columns = booksheet.columnsi = 0# 迭代所有的行for row in rows: i = i + 1 line = [col.value for col in row] cell_data_1 = booksheet.cell(row=i, column=3).value #获取第i行1 列的数据 cell_data_2 = booksheet.cell(row=i, column=4).value #获取第i行 2 列的数据 cell_data_3 = booksheet.cell(row=i, column=8).value #获取第i行 3 列的数据 cell_data_4 = booksheet.cell(row=i, column=18).value #获取第i行 4 列的数据 print (cell_data_1, cell_data_2, cell_data_3, cell_data_4)实例:python读取excel数据做分类统计
某excel中记录了某个人的通话记录,下面程序将按照通话地点,通话类型等统计通话时间
再优化下代码
# -*- coding:utf-8 -*-import xlrdfrom datetime import timedeltadef read_excel(file_excel):#读excel并将需要的数据分类放在数组里 infos=[] info_file=xlrd.open_workbook(file_excel) info_sheet=info_file.sheets()[0] row_count=info_sheet.nrows for row in range(1,row_count): time_string=info_sheet.cell(row,3).value time_s_sp=time_string.split(':') infos.append( { 'type':info_sheet.cell(row,2).value, 'other_cellphone':info_sheet.cell(row,0).value, 'timespan':timedelta(seconds=int(time_s_sp[2]),minutes=int(time_s_sp[1]),hours=int(time_s_sp[0])), 'gpscity':info_sheet.cell(row,5).value } ) return infosdef count_cell(list_dirs,infotype):#统计总通话及分类统计结果,存在字典里 result_dir={} time_all=timedelta(seconds=0) for list_dir in list_dirs: time_all +=list_dir['timespan'] info_type = list_dir[infotype] if info_type not in result_dir: result_dir[info_type]=list_dir['timespan'] else: result_dir[info_type]+=list_dir['timespan'] return time_all,result_dirdef print_result(result_dir):#打印数据 for k,v in result_dir.items(): print k.encode('utf-8'),vif __name__=="__main__": list_dirs=read_excel('src.xls') time_all,result_type=count_cell(list_dirs,'type') result_cell=count_cell(list_dirs,'other_cellphone') result_gpscity = count_cell(list_dirs, 'gpscity') print '总通话时间:%s' % time_all print '按照通话类型分类:' print_result(result_type) print '按照号码分类:' print_result(result_cell[1]) print '按照归属地分类:' print_result(result_gpscity[1])以上就是本文的全部内容,希望对大家的学习有所帮助,也希望大家多多支持。
声明:本页内容来源网络,仅供用户参考;我单位不保证亦不表示资料全面及准确无误,也不保证亦不表示这些资料为最新信息,如因任何原因,本网内容或者用户因倚赖本网内容造成任何损失或损害,我单位将不会负任何法律责任。如涉及版权问题,请提交至online#300.cn邮箱联系删除。
python使用pandas和xlsxwriter读写xlsx文件已有xlsx文件如下:1.读取前n行所有数据#coding:utf-8importpandas
我想实现读取一个本地的xlsx文件(task_list.xlsx)然后显示在网页上,一开始选择的方法是建个expressserver,通过发送axios请求来实
测试数据:坐标数据:testExcelData.xlsx使用python读取excel文件需要安装xlrd库:xlrd下载后的压缩文件:xlrd-1.2.0.t
前言Python中常用的操作Excel的三方包有xlrd,xlwt和openpyxl等,xlrd支持读取.xls和.xlsx格式的Excel文件,只支持读取,不
之前写过一个循环读取excel的代码,最近又有了新的需求:循环读取xlsx文件中的多个sheet,处理完之后循环输出到xlsx文件中的多个sheet中,总结一下