Python办公自动化【Excel查询重复数据、Excel提取身份证号信息、Python操作Excel模块库文档、Python操作Word基础 】(四)-全面详解(学习总结---从入门到深化)

简介: Python办公自动化【Excel查询重复数据、Excel提取身份证号信息、Python操作Excel模块库文档、Python操作Word基础 】(四)-全面详解(学习总结---从入门到深化)

Excel查询重复数据



代码

def search_data():
  from openpyxl import load_workbook
  # 加载文件
  wb = load_workbook('./base_data/打卡时间.xlsx')
  # 激活Sheet
  sh = wb.active
  # 建立已经读过数据列表
  data = []
  # 建立重复数据列表
  index = []
  # 读取数据
  for i,c in enumerate(sh['B']):
    # 记录是否重复
    # if c.value in data:
    #   flag = True
    # else:
    #   flag = False
    flag = c.value in data
    if flag:
      index.append(i)
    else:
      data.append(c.value)
  # 处理重复数据
  from openpyxl.styles import PatternFill
  fill = PatternFill('solid',fgColor='AEEEEE')
  for i,r in enumerate(sh.rows):
    # 判断是否是重复索引行
    if i in index:
      for c in r:
        c.fill = fill
  # 保存数据
  wb.save('./create_data/25_打卡时间_重复检测.xlsx')
if __name__ =='__main__':
  search_data()


Excel提取身份证号信息



代码

def get_data():
  from openpyxl import load_workbook
  # 加载文件
  wb = load_workbook('./base_data/人员信息.xlsx')
  # 激活Sheet
  sh = wb.active
  # 获取Sheet中最后一列是多少
  max_col = sh.max_column
  # 读取数据-只读取一列-遍历每一行获取具体数据
  for i,cell in enumerate(sh['B']):
    # 从身份证号里提取内容- 6位行政区划 4年 2月 2日 4位个人数字
    pno = cell.value
    # 年
    year = pno[6:10]
    # 月
    mouth = pno[10:12]
    # 日
    day = pno[12:14]
    # 将年存到后面的列
    sh.cell(i+1,max_col+1).value = year
    # 将月存到后面的列
    sh.cell(i+1,max_col+2).value = mouth
    # 将日存到后面的列
    sh.cell(i+1,max_col+3).value = day
  # 保存文件
  wb.save('./create_data/26_提取身份证信息.xlsx')
if __name__ =='__main__':
  get_data()


Python操作Excel模块库文档



https://www.osgeo.cn/openpyxl/index.html 中文

https://openpyxl.readthedocs.io/en/stable/ 英文/可翻译

http://www.python-excel.org/ 汇总网站


Python操作Word基础



在办公自动化的操作,往往可能会存在Word的操作。因为在办公时,对文档的操作是必不可少的。而在Python操作Word时,可以使用一个三方的模块库 Python-docx


安装


pip install python-docx


常用方法与属性

函数名&属性 含义
docx.Document()  创建word文件
doc.add_heading(content,level)  增加word标题
doc.save(path)  保存word文件


代码

from docx import Document
def create_word():
  # 创建word文档
  doc1 = Document()
  # 增加标题
  doc1.add_heading('欢迎使用Python创建Word',0)
  doc1.add_heading('Python操作 增加1级标题',1)
  doc1.add_heading('Python操作 增加2级标题',2)
  # 保存文档
  doc1.save('./create_data/01_创建word文档.docx')
if __name__ == '__main__':
  create_word()


Word写入段落数据



常用方法与属性

函数名&属性  含义
doc.add_paragraph(content,style) 增加word段落
paragraph.add_run(content)  追加word段落内容


# 样式表
from docx.enum.style import WD_STYLE


代码

from docx.enum.style import WD_BUILTIN_STYLE
def create_word():
  from docx import Document
  # 创建一个word文档
  doc1 = Document()
  # 增加段落信息
  doc1.add_paragraph('Python第一阶段','Title')
  # doc1.add_paragraph('Python第一阶段',style = 'Title')
  par1 =doc1.add_paragraph('本阶段是进入“程序员”的门槛,需要学习编程基本的知识。本阶段会从0开始,循序渐进。让小伙伴们学完本阶段,可以掌握:变量、数据类型、控制语句、容器、函数和面向对象等。教程中会穿插一些有趣的案例,寓教于乐,引起大家的兴趣。 ')
  # 给段落后面追加内容
  par1.add_run('“兴趣永远是好的老师,小童只能排第二”。')
  doc1.add_paragraph('本阶段是进入“程序员”的门槛,需要学习编程基本的知识。本阶段会从0开始,循序渐进。让小伙伴们学完本阶段,可以掌握:变量、数据类型、控制语句、容器、函数和面向对象等。教程中会穿插一些有趣的案例,寓教于乐,引起大家的兴趣。 “兴趣永远是好的老师,高淇老师只能排第二”。')
  # 增加列表-无序
  doc1.add_paragraph('哪个不是动物:')
  doc1.add_paragraph('喜洋洋',style='ListBullet')
  doc1.add_paragraph('美羊羊',style='ListBullet')
  doc1.add_paragraph('懒洋洋',style='ListBullet')
  doc1.add_paragraph('苹果',style='ListBullet')
  doc1.add_paragraph('灰太狼',style='ListBullet')
  # 增加列表-有序
  doc1.add_paragraph('今年的学习计划:')
  doc1.add_paragraph('Python',style='ListNumber')
  doc1.add_paragraph('HTML',style='ListNumber')
  doc1.add_paragraph('JS',style='ListNumber')
  doc1.add_paragraph('Flask',style='ListNumber')
  # 增加引用
  doc1.add_paragraph('这个是一个引用内容',style='Intense Quote')
  # 保存word文档
  doc1.save('./create_data/02_增加段落.docx')
if __name__ =='__main__':
  create_word()


Word增加图片



常用方法与属性

函数名&属性 含义
doc.add_picture(path) 增加word图片
pic.height 获取word图片高度
pic.width 获取word图片宽度
doc.sections[0].page_width 获取页面的宽度
doc.sections[0].left_margin 获取页面左边距


代码

def create_word():
  from docx import Document
  # 创建一个文档
  doc1 = Document()
  # 增加图片
  pic = doc1.add_picture('./base_data/backg.jpg')
  # 获取文档的宽度
  page_width = doc1.sections[0].page_width
  # 获取文档的左边距
  page_left_width = doc1.sections[0].left_margin
  print(page_width)
  print(page_left_width)
  # 获取中间内容的宽度
  content_width = page_width-page_left_width*2
  print(content_width)
  # 获取图片应该缩小的比例
  # 如果图片或者页面宽度值太高,有可能程序无法计算,可以考虑同时缩小几倍
  sc =(content_width/100)/(pic.width/100)
  # 修改图片的宽、高
  pic.width = int(pic.width*sc)
  pic.height = int(pic.height*sc)
  # 保存文档
  doc1.save('./create_data/03_增加图片.docx')
if __name__ == '__main__':
  create_word()


Word增加表格



常用方法与属性

函数名&属性 含义
doc.add_table(rows=num,cols=num)  增加word表格
table.add_row().cells  增加一行表格
ell.text 获取/设置单元格
table.rows 获取行数据


代码

def create_table():
  from docx import Document
  # 创建word文档
  doc1 = Document()
  # 增加表格
  table = doc1.add_table(rows=1,cols=3)
  # 设置表格的内容
  cells = table.rows[0].cells
  cells[0].text = '编号'
  cells[1].text = '姓名'
  cells[2].text = '职业'
  data = (
   (1,'吕小布','将军'),
   (2,'诸葛亮','军事'),
   (3,'刘备','主攻'),
 )
  for i,n,w in data:
    # 增加一行数据
    tmp_cell = table.add_row().cells
    '''
   问题1:
   tmp_cell[0] = i
   TypeError: 'tuple' object does not support item assignment 
   有可能是直接给单元格设置内容了!需要给text属性设置内容
   '''
    '''
   问题2:
   for char in text:
   TypeError: 'int' object is not iterable
   给单元格设置值,不能是数字,需要转成str
   '''
    tmp_cell[0].text = str(i)
    tmp_cell[1].text = n
    tmp_cell[2].text = w
  # 保存文档
  doc1.save('./create_data/04_增加表格.docx')
if __name__ =='__main__':
  create_table()
目录
相关文章
|
2天前
|
Python
Python中使用os库管理环境变量
在Python中,可以使用os库来管理操作系统的环境变量。通过os.environ对象,我们可以获取、修改和删除环境变量的值。
11 3
|
2天前
|
存储 JSON JavaScript
Python教程:一文了解Python中的json库
JSON(JavaScript Object Notation)是一种轻量级数据交换格式,易于人类阅读和编写,也易于计算机解析和生成。在Python中,JSON通常用于数据交换和存储,因为它与Python的字典和列表类型相似。
12 2
|
2天前
|
API Python
Python库`openpyxl`是一个用于读取和写入Excel 2010 xlsx/xlsm/xltx/xltm文件的库。
【6月更文挑战第19天】`openpyxl`是Python处理xlsx文件的库,支持读写Excel 2010格式。使用`pip install openpyxl`安装。基本操作包括加载文件、读写单元格、操作行和列。例如,加载Excel后,可以读取单元格`A1`的值,或将“Hello, World!”写入`A1`。还可修改单元格内容,如加1后保存到新文件。更多功能,如样式和公式,见官方文档[1]。 [1]: <https://openpyxl.readthedocs.io/en/stable/>
16 1
|
2天前
|
开发工具 git Python
安装和使用`libnum`是一个用于数字理论函数的Python库
【6月更文挑战第19天】`libnum`是Python的数字理论函数库。安装可通过`git clone`,进入目录后运行`python setup.py install`,也可用`pip install libnum`。示例:使用`int_to_hex`将十进制数42转换为十六进制字符串'2a'。注意,信息可能已过时,应查最新文档以确保准确性。如遇问题,参考GitHub仓库或寻求社区帮助。
10 1
|
29天前
|
Python
办公自动化-Python如何提取Word标题并保存到Excel中?
办公自动化-Python如何提取Word标题并保存到Excel中?
40 2
|
5天前
|
运维 监控 API
自动化运维实践指南:Python脚本优化服务器管理任务
本文探讨了Python在自动化运维中的应用,介绍了使用Python脚本优化服务器管理的四个关键步骤:1) 安装必备库如paramiko、psutil和requests;2) 使用paramiko进行远程命令执行;3) 利用psutil监控系统资源;4) 结合requests自动化软件部署。这些示例展示了Python如何提升运维效率和系统稳定性。
25 8
|
6天前
|
数据采集 人工智能 数据挖掘
让工作自动化起来!无所不能的Python
让工作自动化起来!无所不能的Python
|
14天前
|
JSON 程序员 数据格式
豆瓣评分9.6!用81个项目带你从Python 3零基础到Python自动化
Python的名字来自超现实主义的英国喜剧团体,而不是来自蛇。Python程序员被亲切地称为Pythonistas。Monty Python和与蛇相关的引用常常出现在Python的指南和文档中。
|
16天前
|
数据采集 JSON API
自动化Reddit图片收集:Python爬虫技巧
自动化Reddit图片收集:Python爬虫技巧
|
19天前
|
JSON 程序员 数据格式
豆瓣评分9.6!用81个项目带你从Python 3零基础到Python自动化
Python的名字来自超现实主义的英国喜剧团体,而不是来自蛇。Python程序员被亲切地称为Pythonistas。Monty Python和与蛇相关的引用常常出现在Python的指南和文档中。