精华内容
下载资源
问答
  • 由于文档获取人数太多,大家如有需求,请关注公众号:【数据分析与统计学之美】,回复关键词:【自动化文档】! 目录   章节一:python使用openpyxl操作excel     1、openpyxl库介绍     2、python怎么...

    本文是鉴于有些粉丝的工作需求,有时候需要遇到这些文件的处理。因此,我写了一个文章集合,供大家参考,整篇文章已经整理成册(如下图所示)。由于文档获取人数太多,大家如有需求,请关注公众号:【数据分析与统计学之美】,回复关键词:【自动化文档】!
    在这里插入图片描述

    目录

      章节一:python使用openpyxl操作excel
        1、openpyxl库介绍
        2、python怎么打开及读取表格内容?
           1)Excel表格述语
           2)打开Excel表格并获取表格名称
           3)通过sheet名称获取表格
           4)获取表格的尺寸大小
           5)获取表格内某个格子的数据
             ① sheet[“A1”]方式
             ② sheet.cell(row=, column=)方式
           6)获取某个格子的行数、列数、坐标
           7)获取一系列格子
             ① sheet[]方式
             ② .iter_rows()方式
             ③ sheet.rows()
        3、python如何向excel中写入某些内容?
           1)修改表格中的内容
             ① 向某个格子中写入内容并保存
             ② .append():向表格中插入行数据
             ③ 在python中使用excel函数公式(很有用)
             ④ .insert_cols()和.insert_rows():插入空行和空列
             ⑤ .delete_rows()和.delete_cols():删除行和列
             ⑥ .move_range():移动格子
             ⑦ .create_sheet():创建新的sheet表格
             ⑧ .remove():删除某个sheet表
             ⑨ .copy_worksheet():复制一个sheet表到另外一张excel表
             ⑩ sheet.title:修改sheet表的名称
             ⑪ 创建新的excel表格文件
             ⑫ sheet.freeze_panes:冻结窗口
             ⑬ sheet.auto_filter.ref:给表格添加“筛选器”
        4、批量调整字体和样式
           1)修改字体样式
           2)获取表格中格子的字体样式
           3)设置对齐样式
           4)设置边框样式
           5)设置填充样式
           6)设置行高和列宽
           7)合并单元格
      章节二:python使用PyPDF2和pdfplumber操作pdf
        1、PyPDF2和pdfplumber库介绍
        2、python提取PDF文字内容
           1)利用pdfplumber提取文字
           2)利用pdfplumber提取表格并写入excel
        3、PDF合并及页面的排序和旋转
           1)分割及合并pdf
             ① 合并pdf
             ② 拆分pdf
           2)旋转及排序pdf
             ① 旋转pdf
             ② 排序pdf
        4、pdf批量加水印及加密、解密
           1)批量加水印
           2)批量加密、解密
             ① 加密pdf
             ② 解密pdf并保存为未加密的pdf
      章节三:python使用python-docx操作word
        1、python-docx库介绍
        2、Python读取Word文档内容
           1)word文档结构介绍
           2)python-docx提取文字和文字块儿
             ① python-docx提取文字
             ② python-docx提取文字块儿
           3)利用Python向Word文档写入内容
             ① 添加段落
             ② 添加文字块儿
             ③ 添加一个分页
             ④ 添加图片
             ⑤ 添加表格
             ⑥ 提取word表格,并保存在excel中(很重要)
        3、利用Python调整Word文档样式
           1)修改文字字体样式
           2)修改段落样式
             ① 对齐样式
             ② 行间距调整
             ③ 段前与段后间距

    章节一:python使用openpyxl操作excel

    1、openpyxl库介绍

    • openpyxl最好用的python操作excel表格库,不接受反驳;
    • openpyxl官网链接:openpyxl官网
    • openpyxl只支持【.xlsx / .xlsm / .xltx / .xltm】格式的文件;

    2、python怎么打开及读取表格内容?

    1)Excel表格述语

    这里需要大家仔细查看图中的每一项内容,知道什么是“行(row)、列(column)”?什么是“格子(cell)”?什么是“sheet表”?
    在这里插入图片描述

    2)打开Excel表格并获取表格名称
    from openpyxl import load_workbook
    workbook = load_workbook(filename = "test.xlsx")
    workbook.sheetnames
    

    结果如下:
    在这里插入图片描述

    3)通过sheet名称获取表格
    from openpyxl import load_workbook
    workbook = load_workbook(filename = "test.xlsx")
    workbook.sheetnames
    sheet = workbook["Sheet1"]
    print(sheet)
    

    结果如下:
    在这里插入图片描述

    4)获取表格的尺寸大小
    • 这里所说的尺寸大小,指的是excel表格中的数据有几行几列,针对的是不同的sheet而言。
    sheet.dimensions
    

    结果如下:
    在这里插入图片描述

    5)获取表格内某个格子的数据
    ① sheet[“A1”]方式
    workbook = load_workbook(filename = "test.xlsx")
    sheet = workbook.active
    print(sheet)
    cell1 = sheet["A1"]
    cell2 = sheet["C11"]
    print(cell1.value, cell2.value)
    
    """
    workbook.active 打开激活的表格;
    sheet["A1"] 获取A1格子的数据;
    cell.value 获取格子中的值;
    """
    

    结果如下:
    在这里插入图片描述

    ② sheet.cell(row=, column=)方式
    • 这种方式更简单,大家可以对比这两种方式;
    workbook = load_workbook(filename = "test.xlsx")
    sheet = workbook.active
    print(sheet)
    cell1 = sheet.cell(row = 1,column = 1)
    cell2 = sheet.cell(row = 11,column = 3)
    print(cell1.value, cell2.value)
    

    结果如下:
    在这里插入图片描述

    6)获取某个格子的行数、列数、坐标
    workbook = load_workbook(filename = "test.xlsx")
    sheet = workbook.active
    print(sheet)
    cell1 = sheet["A1"]
    cell2 = sheet["C11"]
    print(cell1.value, cell1.row, cell1.column, cell1.coordinate)
    print(cell2.value, cell2.row, cell2.column, cell2.coordinate)
    """
    .row 获取某个格子的行数;
    .columns 获取某个格子的列数;
    .corordinate 获取某个格子的坐标;
    """
    

    结果如下:
    在这里插入图片描述

    7)获取一系列格子
    ① sheet[]方式
    workbook = load_workbook(filename = "test.xlsx")
    sheet = workbook.active
    print(sheet)
    # 获取A1:C2区域的值
    cell = sheet["A1:C2"]
    print(cell)
    for i in cell:
        for j in i:
            print(j.value)
    

    结果如下:
    在这里插入图片描述
    特别的:如果我们只想获取“A列”,或者获取“A-C列”,可以采取如下方式:

    sheet["A"]    --- 获取A列的数据
    sheet["A:C"]    --- 获取A,B,C三列的数据
    sheet[5]   --- 只获取第5行的数据
    
    ② .iter_rows()方式
    • 当然有.iter_rows()方式,肯定也会有.iter_cols()方式,只不过一个是按行读取,一个是按列读取。
    workbook = load_workbook(filename = "test.xlsx")
    sheet = workbook.active
    print(sheet)
    # 按行获取值
    for i in sheet.iter_rows(min_row=2, max_row=5, min_col=1, max_col=2):
        for j in i:
            print(j.value)
    # 按列获取值
    for i in sheet.iter_cols(min_row=2, max_row=5, min_col=1, max_col=2):
        for j in i:
            print(j.value)      
    

    结果如下:
    在这里插入图片描述

    ③ sheet.rows()
    • 帮助我们获取所有行
    workbook = load_workbook(filename = "test.xlsx")
    sheet = workbook.active
    print(sheet)
    for i in sheet.rows:
            print(i)
    

    结果如下:
    在这里插入图片描述

    3、python如何向excel中写入某些内容?

    1)修改表格中的内容
    ① 向某个格子中写入内容并保存
    workbook = load_workbook(filename = "test.xlsx")
    sheet = workbook.active
    print(sheet)
    sheet["A1"] = "哈喽" # 这句代码也可以改为cell = sheet["A1"] cell.value = "哈喽"
    workbook.save(filename = "哈喽.xlsx")
    """
    注意:我们将“A1”单元格的数据改为了“哈喽”,并另存为了“哈喽.xlsx”文件。
    如果我们保存的时候,不修改表名,相当于直接修改源文件;
    """
    

    结果如下:
    在这里插入图片描述

    ② .append():向表格中插入行数据
    • .append()方式:会在表格已有的数据后面,增添这些数(按行插入);
    • 这个操作很有用,爬虫得到的数据,可以使用该方式保存成Excel文件;
    workbook = load_workbook(filename = "test.xlsx")
    sheet = workbook.active
    print(sheet)
    data = [
        ["唐僧","男","180cm"],
        ["孙悟空","男","188cm"],
        ["猪八戒","男","175cm"],
        ["沙僧","男","176cm"],
    ]
    for row in data:
        sheet.append(row)
    workbook.save(filename = "test.xlsx")
    

    结果如下:
    在这里插入图片描述

    ③ 在python中使用excel函数公式(很有用)
    # 这是我们在excel中输入的公式
    =IF(RIGHT(C2,2)="cm",C2,SUBSTITUTE(C2,"m","")*100&"cm")
    # 那么,在python中怎么插入excel公式呢?
    workbook = load_workbook(filename = "test.xlsx")
    sheet = workbook.active
    print(sheet)
    sheet["D1"] = "标准身高"
    for i in range(2,16):
        sheet["D{}".format(i)] = '=IF(RIGHT(C{},2)="cm",C{},SUBSTITUTE(C{},"m","")*100&"cm")'.format(i,i,i)
    workbook.save(filename = "test.xlsx")
    

    结果如下:
    在这里插入图片描述
    此时,你肯定会好奇,python究竟支持写哪些“excel函数公式”呢?我们可以使用如下操作查看一下。

    import openpyxl
    from openpyxl.utils import FORMULAE
    print(FORMULAE)
    

    结果如下:
    在这里插入图片描述

    ④ .insert_cols()和.insert_rows():插入空行和空列
    • .insert_cols(idx=数字编号, amount=要插入的列数),插入的位置是在idx列数的左侧插入;
    • .insert_rows(idx=数字编号, amount=要插入的行数),插入的行数是在idx行数的下方插入;
    workbook = load_workbook(filename = "test.xlsx")
    sheet = workbook.active
    print(sheet)
    sheet.insert_cols(idx=4,amount=2)
    sheet.insert_rows(idx=5,amount=4)
    workbook.save(filename = "test.xlsx")
    

    结果如下:
    在这里插入图片描述

    ⑤ .delete_rows()和.delete_cols():删除行和列
    • .delete_rows(idx=数字编号, amount=要删除的行数)
    • .delete_cols(idx=数字编号, amount=要删除的列数)
    workbook = load_workbook(filename = "test.xlsx")
    sheet = workbook.active
    print(sheet)
    # 删除第一列,第一行
    sheet.delete_cols(idx=1)
    sheet.delete_rows(idx=1)
    workbook.save(filename = "test.xlsx")
    

    结果如下:
    在这里插入图片描述

    ⑥ .move_range():移动格子
    • .move_range(“数据区域”,rows=,cols=):正整数为向下或向右、负整数为向左或向上;
    # 向左移动两列,向下移动两行
    sheet.move_range("C1:D4",rows=2,cols=-1)
    

    演示效果如下:
    在这里插入图片描述

    ⑦ .create_sheet():创建新的sheet表格
    • .create_sheet(“新的sheet名”):创建一个新的sheet表;
    workbook = load_workbook(filename = "test.xlsx")
    sheet = workbook.active
    print(sheet)
    workbook.create_sheet("我是一个新的sheet")
    print(workbook.sheetnames)
    workbook.save(filename = "test.xlsx")
    

    结果如下:
    在这里插入图片描述

    ⑧ .remove():删除某个sheet表
    • .remove(“sheet名”):删除某个sheet表;
    workbook = load_workbook(filename = "test.xlsx")
    sheet = workbook.active
    print(workbook.sheetnames)
    # 这个相当于激活的这个sheet表,激活状态下,才可以操作;
    sheet = workbook['我是一个新的sheet']  
    print(sheet)
    workbook.remove(sheet)
    print(workbook.sheetnames)
    workbook.save(filename = "test.xlsx")
    

    结果如下:
    在这里插入图片描述

    ⑨ .copy_worksheet():复制一个sheet表到另外一张excel表
    • 这个操作的实质,就是复制某个excel表中的sheet表,然后将文件存储到另外一张excel表中;
    workbook = load_workbook(filename = "a.xlsx")
    sheet = workbook.active
    print("a.xlsx中有这几个sheet表",workbook.sheetnames)
    sheet = workbook['姓名']  
    workbook.copy_worksheet(sheet)
    workbook.save(filename = "test.xlsx")
    

    结果如下:
    在这里插入图片描述

    ⑩ sheet.title:修改sheet表的名称
    • .title = “新的sheet表名”
    workbook = load_workbook(filename = "a.xlsx")
    sheet = workbook.active
    print(sheet)
    sheet.title = "我是修改后的sheet名"
    print(sheet)
    

    结果如下:
    在这里插入图片描述

    ⑪ 创建新的excel表格文件
    from openpyxl import Workbook
    
    workbook = Workbook()
    sheet = workbook.active
    sheet.title = "表格1"
    workbook.save(filename = "新建的excel表格")
    

    结果如下:
    在这里插入图片描述

    ⑫ sheet.freeze_panes:冻结窗口
    • .freeze_panes = “单元格”
    workbook = load_workbook(filename = "花园.xlsx")
    sheet = workbook.active
    print(sheet)
    sheet.freeze_panes = "C3"
    workbook.save(filename = "花园.xlsx")
    """
    冻结窗口以后,你可以打开源文件,进行检验;
    """
    

    结果如下:
    在这里插入图片描述

    ⑬ sheet.auto_filter.ref:给表格添加“筛选器”
    • .auto_filter.ref = sheet.dimension 给所有字段添加筛选器;
    • .auto_filter.ref = “A1” 给A1这个格子添加“筛选器”,就是给第一列添加“筛选器”;
    workbook = load_workbook(filename = "花园.xlsx")
    sheet = workbook.active
    print(sheet)
    sheet.auto_filter.ref = sheet["A1"]
    workbook.save(filename = "花园.xlsx")
    

    结果如下:
    在这里插入图片描述

    4、批量调整字体和样式

    1)修改字体样式
    • Font(name=字体名称,size=字体大小,bold=是否加粗,italic=是否斜体,color=字体颜色)
    from openpyxl.styles import Font
    from openpyxl import load_workbook
    
    workbook = load_workbook(filename="花园.xlsx")
    sheet = workbook.active
    cell = sheet["A1"]
    font = Font(name="微软雅黑",size=20,bold=True,italic=True,color="FF0000")
    cell.font = font
    workbook.save(filename = "花园.xlsx")
    """
    这个color是RGB的16进制表示,自己下去百度学习;
    """
    

    结果如下:
    在这里插入图片描述

    2)获取表格中格子的字体样式
    from openpyxl.styles import Font
    from openpyxl import load_workbook
    
    workbook = load_workbook(filename="花园.xlsx")
    sheet = workbook.active
    cell = sheet["A2"]
    font = cell.font
    print(font.name, font.size, font.bold, font.italic, font.color)
    

    结果如下:
    在这里插入图片描述

    3)设置对齐样式
    • Alignment(horizontal=水平对齐模式,vertical=垂直对齐模式,text_rotation=旋转角度,wrap_text=是否自动换行)
    • 水平对齐:‘distributed’,‘justify’,‘center’,‘leftfill’, ‘centerContinuous’,‘right,‘general’;
    • 垂直对齐:‘bottom’,‘distributed’,‘justify’,‘center’,‘top’;
    from openpyxl.styles import Alignment
    from openpyxl import load_workbook
    
    workbook = load_workbook(filename="花园.xlsx")
    sheet = workbook.active
    cell = sheet["A1"]
    alignment = Alignment(horizontal="center",vertical="center",text_rotation=45,wrap_text=True)
    cell.alignment = alignment
    workbook.save(filename = "花园.xlsx")
    

    结果如下:
    在这里插入图片描述

    4)设置边框样式
    • Side(style=边线样式,color=边线颜色)
    • Border(left=左边线样式,right=右边线样式,top=上边线样式,bottom=下边线样式)
    • style参数的种类: 'double, ‘mediumDashDotDot’, ‘slantDashDot’,‘dashDotDot’,‘dotted’,‘hair’, 'mediumDashed, ‘dashed’, ‘dashDot’, ‘thin’,‘mediumDashDot’,‘medium’, 'thick’from openpyxl.styles import Side,Borderfrom
    openpyxl import load_workbook
    
    workbook = load_workbook(filename="花园.xlsx")
    sheet = workbook.active
    cell = sheet["D6"]
    side1 = Side(style="thin",color="FF0000")
    side2 = Side(style="thick",color="FFFF0000")
    border = Border(left=side1,right=side1,top=side2,bottom=side2)
    cell.border = border
    workbook.save(filename = "花园.xlsx")
    

    结果如下:
    在这里插入图片描述

    5)设置填充样式
    • PatternFill(fill_type=填充样式,fgColor=填充颜色)
    • GradientFill(stop=(渐变颜色1,渐变颜色2……))
    from openpyxl.styles import PatternFill,GradientFill
    from openpyxl import load_workbook
    
    workbook = load_workbook(filename="花园.xlsx")
    sheet = workbook.active
    cell_b9 = sheet["B9"]
    pattern_fill = PatternFill(fill_type="solid",fgColor="99ccff")
    cell_b9.fill = pattern_fill
    cell_b10 = sheet["B10"]
    gradient_fill = GradientFill(stop=("FFFFFF","99ccff","000000"))
    cell_b10.fill = gradient_fill
    workbook.save(filename = "花园.xlsx")
    

    结果如下:
    在这里插入图片描述

    6)设置行高和列宽
    • .row_dimensions[行编号].height = 行高
    • .column_dimensions[列编号].width = 列宽
    workbook = load_workbook(filename="花园.xlsx")
    sheet = workbook.active
    # 设置第1行的高度
    sheet.row_dimensions[1].height = 50
    # 设置B列的宽度
    sheet.column_dimensions["B"].width = 20
    workbook.save(filename = "花园.xlsx")
    """
    sheet.row_dimensions.height = 50
    sheet.column_dimensions.width = 30
    这两句代码,是将整个表的行高设置为50,列宽设置为30;
    """
    

    结果如下:
    在这里插入图片描述

    7)合并单元格
    • .merge_cells(待合并的格子编号)
    • .merge_cells(start_row=起始行号,start_column=起始列号,end_row=结束行号,end_column=结束列号)
    workbook = load_workbook(filename="花园.xlsx")
    sheet = workbook.active
    sheet.merge_cells("C1:D2")
    sheet.merge_cells(start_row=7,start_column=1,end_row=8,end_column=3)
    workbook.save(filename = "花园.xlsx")
    

    结果如下:
    在这里插入图片描述
    当然,也有“取消合并单元格”,用法一致。

    • .unmerge_cells(待合并的格子编号)
    • .unmerge_cells(start_row=起始行号,start_column=起始列号,end_row=结束行号,end_column=结束列号)

    章节二:python使用PyPDF2和pdfplumber操作pdf

    1、PyPDF2和pdfplumber库介绍

    • PyPDF2官网: PyPDF2官网 ,可以更好的读取、写入、分割、合并PDF文件;
    • pdfplumber官网:pdfplumber官网,可以更好地读取PDF文件内容和提取PDF中的表格;
    • 这两个库不属于python标准库,都需要单独安装;

    2、python提取PDF文字内容

    1)利用pdfplumber提取文字
    import PyPDF2
    import pdfplumber
    
    with pdfplumber.open("餐饮企业综合分析.pdf") as p:
        page = p.pages[2]
        print(page.extract_text())
    

    结果如下:
    在这里插入图片描述

    2)利用pdfplumber提取表格并写入excel
    • extract_table():如果一页有一个表格;
    • extract_tables():如果一页有多个表格;
    import PyPDF2
    import pdfplumber
    from openpyxl import Workbook
    
    with pdfplumber.open("餐饮企业综合分析.pdf") as p:
        page = p.pages[4]
        table = page.extract_table()
        print(table)
        
        workbook = Workbook()
        sheet = workbook.active
        for row in table:
            if not "".join() == ""
                sheet.append(row)
        workbook.save(filename = "新pdf.xlsx")
    

    结果如下:
    在这里插入图片描述
    缺陷:可以看到,这里提取出来的表格有很多空行,怎么去掉这些空行呢?
    判断:将列表中每个元素都连接成一个字符串,如果还是一个空字符串那么肯定就是空行。

    import PyPDF2
    import pdfplumber
    from openpyxl import Workbook
    
    with pdfplumber.open("餐饮企业综合分析.pdf") as p:
        page = p.pages[4]
        table = page.extract_table()
        print(table)
        
        workbook = Workbook()
        sheet = workbook.active
        for row in table:
            if not "".join([str(i) for i in row]) == "":
                sheet.append(row)
        workbook.save(filename = "新pdf.xlsx")
    

    结果如下:
    在这里插入图片描述

    3、PDF合并及页面的排序和旋转

    1)分割及合并pdf
    ① 合并pdf

    首先,我们有如下几个文件,可以发现这里共有三个PDF文件需要我们合并。同时可以发现他们的文件名都是有规律的(如果文件名,没有先后顺序,我们合并起来就没有意义了。)
    在这里插入图片描述
    代码如下:

    from PyPDF2 import PdfFileReader, PdfFileWriter
    
    pdf_writer = PdfFileWriter()
    for i in range(1,len(os.listdir(r"G:\6Tipdm\7python办公自动化\concat_pdf"))+1):
        print(i*50+1,(i+1)*50)
        pdf_reader = PdfFileReader("G:\\6Tipdm\\7python办公自动化\\concat_pdf\{}-{}.pdf".format(i*50+1,(i+1)*50))
        for page in range(pdf_reader.getNumPages()):
            pdf_writer.addPage(pdf_reader.getPage(page))
            
    with open("G:\\6Tipdm\\7python办公自动化\\concat_pdf\merge.pdf", "wb") as out:
        pdf_writer.write(out)
    

    结果如下:
    在这里插入图片描述

    ② 拆分pdf

    这里有一个“时间序列.pdf”的文件,共3页,我们将其每一页存为一个PDF文件。
    在这里插入图片描述
    代码如下:

    from PyPDF2 import PdfFileReader, PdfFileWriter
    
    pdf_reader = PdfFileReader(r"G:\6Tipdm\7python办公自动化\concat_pdf\时间序列.pdf")
    for page in range(pdf_reader.getNumPages()):
        pdf_writer = PdfFileWriter()
        pdf_writer.addPage(pdf_reader.getPage(page))
        with open(f"G:\\6Tipdm\\7python办公自动化\\concat_pdf\\{page}.pdf", "wb") as out:
            pdf_writer.write(out)
    

    结果如下:
    在这里插入图片描述

    2)旋转及排序pdf
    ① 旋转pdf
    • .rotateClockwise(90的倍数):顺时针旋转90度
    • .rotateCounterClockwise(90的倍数):逆时针旋转90度
    from PyPDF2 import PdfFileReader, PdfFileWriter
    
    pdf_reader = PdfFileReader(r"G:\6Tipdm\7python办公自动化\concat_pdf\时间序列.pdf")
    pdf_writer = PdfFileWriter()
    for page in range(pdf_reader.getNumPages()):
        if page % 2 == 0:
            rotation_page = pdf_reader.getPage(page).rotateCounterClockwise(90)
        else:
            rotation_page = pdf_reader.getPage(page).rotateClockwise(90)
        pdf_writer.addPage(rotation_page)
        with open("G:\\6Tipdm\\7python办公自动化\\concat_pdf\\旋转.pdf", "wb") as out:
            pdf_writer.write(out)
    """
    上述代码中,我们循环遍历了这个pdf,对于偶数页我们逆时针旋转90°,对于奇数页我们顺时针旋转90°;
    注意:旋转的角度只能是90的倍数;
    """
    

    其中一页效果展示如下:
    在这里插入图片描述

    ② 排序pdf

    需求:我们有一个PDF文件,我们需要倒序排列,应该怎么做呢?
    首先,我们来看python中,怎么倒叙打印一串数字,如下图所示。
    在这里插入图片描述
    那么倒序排列一个pdf,思路同上,代码如下:

    from PyPDF2 import PdfFileReader, PdfFileWriter
    
    pdf_reader = PdfFileReader(r"G:\6Tipdm\7python办公自动化\concat_pdf\时间序列.pdf")
    pdf_writer = PdfFileWriter()
    for page in range(pdf_reader.getNumPages()-1, -1, -1):
        pdf_writer.addPage(pdf_reader.getPage(page))
    with open("G:\\6Tipdm\\7python办公自动化\\concat_pdf\\倒序.pdf", "wb") as out:
            pdf_writer.write(out)
    

    结果如下:
    在这里插入图片描述

    4、pdf批量加水印及加密、解密

    1)批量加水印
    from PyPDF2 import PdfFileReader, PdfFileWriter
    from copy import copy
    
    water = PdfFileReader(r"G:\6Tipdm\7python办公自动化\concat_pdf\水印.pdf")
    water_page = water.getPage(0)
    
    pdf_reader = PdfFileReader(r"G:\6Tipdm\7python办公自动化\concat_pdf\aa.pdf")
    pdf_writer = PdfFileWriter()
    
    for page in range(pdf_reader.getNumPages()):
        my_page = pdf_reader.getPage(page)
        new_page = copy(water_page)
        new_page.mergePage(my_page)
        pdf_writer.addPage(new_page)
    with open("G:\\6Tipdm\\7python办公自动化\\concat_pdf\\添加水印后的aa.pdf", "wb") as out:
            pdf_writer.write(out)  
    """
    这里有一点需要注意:进行pdf合并的时候,我们希望“水印”在下面,文字在上面,因此是“水印”.mergePage(“图片页”)
    """
    

    结果如下:
    在这里插入图片描述

    2)批量加密、解密
    • 这里所说的“解密”,是在知道pdf的密码下,去打开pdf,而不是暴力破解;
    ① 加密pdf
    from PyPDF2 import PdfFileReader, PdfFileWriter
    
    pdf_reader = PdfFileReader(r"G:\6Tipdm\7python办公自动化\concat_pdf\时间序列.pdf")
    pdf_writer = PdfFileWriter()
    for page in range(pdf_reader.getNumPages()):
        pdf_writer.addPage(pdf_reader.getPage(page))
    # 添加密码
    pdf_writer.encrypt("a123456")
    with open("G:\\6Tipdm\\7python办公自动化\\concat_pdf\\时间序列.pdf", "wb") as out:
            pdf_writer.write(out)  
    

    结果如下:
    在这里插入图片描述

    ② 解密pdf并保存为未加密的pdf
    from PyPDF2 import PdfFileReader, PdfFileWriter
    
    pdf_reader = PdfFileReader(r"G:\6Tipdm\7python办公自动化\concat_pdf\时间序列.pdf")
    # 解密pdf
    pdf_reader.decrypt("a123456")
    pdf_writer = PdfFileWriter()
    for page in range(pdf_reader.getNumPages()):
        pdf_writer.addPage(pdf_reader.getPage(page))
    with open("G:\\6Tipdm\\7python办公自动化\\concat_pdf\\未加密的时间序列.pdf", "wb") as out:
            pdf_writer.write(out)  
    

    结果如下:
    在这里插入图片描述

    章节三:python使用python-docx操作word

    1、python-docx库介绍

    • 该模块儿可以创建、修改Word(.docx)文件;
    • 此模块儿不属于python标准库,需要单独安装;
    • python-docx使用官网: python-docx官网
    • 我们在安装此模块儿使用的是pip install python-docx,但是在导入的时候是import docx;

    2、Python读取Word文档内容

    • 注意:每进行一个操作,必须保存一下,否则等于白做;
    1)word文档结构介绍

    在这里插入图片描述

    2)python-docx提取文字和文字块儿
    ① python-docx提取文字

    有一个这样的docx文件,我们想要提取其中的文字,应该怎么做?
    在这里插入图片描述
    代码如下:

    from docx import Document
    
    doc = Document(r"G:\6Tipdm\7python办公自动化\concat_word\test1.docx")
    print(doc.paragraphs)
    for paragraph in doc.paragraphs:
        print(paragraph.text)
    

    结果如下:
    在这里插入图片描述

    ② python-docx提取文字块儿
    from docx import Document
    
    doc = Document(r"G:\6Tipdm\7python办公自动化\concat_word\test1.docx")
    print(doc.paragraphs)
    paragraph = doc.paragraphs[0]
    runs = paragraph.runs
    print(runs)
    for run in paragraph.runs:
        print(run.text)
    ------------------------------
    paragraph = doc.paragraphs[1]
    runs = paragraph.runs
    print(runs)
    for run in paragraph.runs:
        print(run.text)
    

    结果如下:
    在这里插入图片描述

    3)利用Python向Word文档写入内容
    ① 添加段落
    from docx import Document
    
    doc = Document(r"G:\6Tipdm\7python办公自动化\concat_word\test1.docx")
    # print(doc.add_heading("一级标题", level=1))   添加一级标题的时候出错,还没有解决!
    paragraph1 = doc.add_paragraph("这是一个段落")
    paragraph2 = doc.add_paragraph("这是第二个段落")
    doc.save(r"G:\6Tipdm\7python办公自动化\concat_word\test1.docx") 
    """
    添加段落的时候,赋值给一个变量,方便我们后面进行格式调整;
    """
    

    结果如下:
    在这里插入图片描述

    ② 添加文字块儿
    from docx import Document
    
    doc = Document(r"G:\6Tipdm\7python办公自动化\concat_word\test1.docx")
    # 这里相当于输入了一个空格,后面等待着文字输入
    paragraph3 = doc.add_paragraph()
    paragraph3.add_run("我被加粗了文字块儿").bold = True
    paragraph3.add_run(",我是普通文字块儿,")
    paragraph3.add_run("我是斜体文字块儿").italic = True
    doc.save(r"G:\6Tipdm\7python办公自动化\concat_word\test1.docx") 
    

    结果如下:
    在这里插入图片描述

    ③ 添加一个分页
    from docx import Document
    
    doc = Document(r"G:\6Tipdm\7python办公自动化\concat_word\test1.docx")
    doc.add_page_break()
    doc.save(r"G:\6Tipdm\7python办公自动化\concat_word\test1.docx") 
    

    结果如下:
    在这里插入图片描述

    ④ 添加图片
    from docx import Document
    from docx.shared import Cm
    
    doc = Document(r"G:\6Tipdm\7python办公自动化\concat_word\test1.docx")
    doc.add_picture(r"G:\6Tipdm\7python办公自动化\concat_word\sun_wu_kong.png",width=Cm(5),height=Cm(5))
    doc.save(r"G:\6Tipdm\7python办公自动化\concat_word\test1.docx") 
    """
    Cm模块,用于设定图片尺寸大小
    """
    

    结果如下:
    在这里插入图片描述

    ⑤ 添加表格
    from docx import Document
    
    doc = Document(r"G:\6Tipdm\7python办公自动化\concat_word\test1.docx")
    
    list1 = [
        ["姓名","性别","家庭地址"],
        ["唐僧","男","湖北省"],
        ["孙悟空","男","北京市"],
        ["猪八戒","男","广东省"],
        ["沙和尚","男","湖南省"]
    ]
    list2 = [
        ["姓名","性别","家庭地址"],
        ["貂蝉","女","河北省"],
        ["杨贵妃","女","贵州省"],
        ["西施","女","山东省"]
    ]
    
    table1 = doc.add_table(rows=5,cols=3)
    for row in range(5):
        cells = table1.rows[row].cells
        for col in range(3):
            cells[col].text = str(list1[row][col])
    doc.add_paragraph("-----------------------------------------------------------")
    table2 = doc.add_table(rows=4,cols=3)
    for row in range(4):
        cells = table2.rows[row].cells
        for col in range(3):
            cells[col].text = str(list2[row][col])
            
    doc.save(r"G:\6Tipdm\7python办公自动化\concat_word\test1.docx") 
    

    结果如下:
    在这里插入图片描述

    ⑥ 提取word表格,并保存在excel中(很重要)
    from docx import Document
    from openpyxl import Workbook
    
    doc = Document(r"G:\6Tipdm\7python办公自动化\concat_word\test2.docx")
    t0 = doc.tables[0]
    
    workbook = Workbook()
    sheet = workbook.active
    
    for i in range(len(t0.rows)):
        list1 = []
        for j in range(len(t0.columns)):
            list1.append(t0.cell(i,j).text)
        sheet.append(list1)
    workbook.save(filename = r"G:\6Tipdm\7python办公自动化\concat_word\来自word中的表.xlsx")
    

    结果如下:
    在这里插入图片描述

    3、利用Python调整Word文档样式

    1)修改文字字体样式
    from docx import Document
    from docx.shared import Pt,RGBColor 
    from docx.oxml.ns import qn
    
    doc = Document(r"G:\6Tipdm\7python办公自动化\concat_word\test2.docx")
    for paragraph in doc.paragraphs:
        for run in paragraph.runs:
            run.font.bold = True
            run.font.italic = True
            run.font.underline = True
            run.font.strike = True
            run.font.shadow = True
            run.font.size = Pt(18)
            run.font.color.rgb = RGBColor(255,255,0)
            run.font.name = "宋体"
            # 设置像宋体这样的中文字体,必须添加下面2行代码
            r = run._element.rPr.rFonts
            r.set(qn("w:eastAsia"),"宋体")
    doc.save(r"G:\6Tipdm\7python办公自动化\concat_word\_test1.docx")
    

    结果如下:
    在这里插入图片描述

    2)修改段落样式
    ① 对齐样式
    from docx import Document 
    from docx.enum.text import WD_ALIGN_PARAGRAPH
    
    doc = Document(r"G:\6Tipdm\7python办公自动化\concat_word\test1.docx")
    print(doc.paragraphs[0].text)
    doc.paragraphs[0].alignment = WD_ALIGN_PARAGRAPH.CENTER
    # 这里设置的是居中对齐
    doc.save(r"G:\6Tipdm\7python办公自动化\concat_word\对齐样式.docx")
    """
    LEFT,CENTER,RIGHT,JUSTIFY,DISTRIBUTE,JUSTIFY_MED,JUSTIFY_HI,JUSTIFY_LOW,THAI_JUSTIFY
    """
    

    结果如下:
    在这里插入图片描述

    ② 行间距调整
    from docx import Document 
    from docx.enum.text import WD_ALIGN_PARAGRAPH
    
    doc = Document(r"G:\6Tipdm\7python办公自动化\concat_word\test1.docx")
    for paragraph in doc.paragraphs:
        paragraph.paragraph_format.line_spacing = 5.0
    doc.save(r"G:\6Tipdm\7python办公自动化\concat_word\行间距.docx")
    

    结果如下:
    在这里插入图片描述

    ③ 段前与段后间距
    • 这里提供代码,自行下去检验

    在这里插入图片描述

    展开全文
  • word自动化流程如下: 1.1 常用语句 使用的库:docx 二、 实例演示 根据应聘数据,自动生成相对应的聘用信。结合Email,就可实现自动生成各自的聘用信,并自动发送给相应人员。快速有准确,老板再也不用担心发错...

    上章写了excel的处理,本文是word的自动化操作~

    一、word基本操作

    word自动化流程如下:
    在这里插入图片描述
    1.1 常用语句
    使用的库:docx

    二、 实例演示

    根据应聘数据,自动生成相对应的聘用信。结合Email,就可实现自动生成各自的聘用信,并自动发送给相应人员。偷偷吐槽一下,之前收到过发错的的应聘信,收到了其他人的,一来会让人觉得公司有点low,二来存在泄漏他人信息的安全危机。如果没有专门的系统使用,就可以用python,快速有准确,老板再也不用担心发错应聘信了。

    以下是需要生成的聘用信模板,需要把XXX,yyyy等等换成相应人员信息,生成对应新的聘用信。

    在这里插入图片描述
    下面上代码

    1、导入模板,打印段落内容

    import docx
    from docx import Document
    import time,datetime
    import pandas as pd
    
    # 1、导入模板,打印段落内容
    doc = docx.Document('聘用信.docx')
    '''
    for paragraph in doc.paragraphs:
        print(paragraph.text)  #打印各段落内容文本
    a = len(doc.paragraphs)
    '''
    
    for i in range(0,len(doc.paragraphs)):
        print(i)  #打印各段落索引
        print(doc.paragraphs[i].text) #打印各段落内容文本
    

    在这里插入图片描述

    2、替换段落中的参数

    
    #从上图可以看出,需要替换的是:
    ## 段落3:当天日期,年、月、日
    ## 段落4:姓名
    ## 段落5:姓名
    ## 段落10:岗位
    ## 段落16:入职日期,年、月、日
    
    ## 段落3:当天日期,年、月、日
    today = time.strftime("%Y{y}%m{m}%d{d}",time.localtime()).format(y='年',m='月',d='日') #当天日期
    doc.paragraphs[3].text = today #替换段落3
    
    ## 段落4:姓名
    ## 段落5:姓名
    ## 段落10:岗位
    ## 段落16:入职日期,年、月、日
    ## 这些内容是从应聘员工表格中获取,下面读取excel表格获取数据,进行替换
    renyuan = pd.read_excel(r'C:\Users\lmy\Documents\临时\python自动化办公培训\应聘员工表.xls') 
    

    在这里插入图片描述

    ####先替换第一行测试一下######
    ## 段落4:姓名
    doc.paragraphs[4].text = doc.paragraphs[4].text.replace('XXX',renyuan.iloc[0,0])
    
    ## 段落5:姓名
    doc.paragraphs[5].text = doc.paragraphs[5].text.replace('XXX',renyuan.iloc[0,0])
    
    ## 段落10:岗位
    doc.paragraphs[10].text = doc.paragraphs[10].text.replace('XXXX',renyuan.iloc[0,1])
    
    ## 段落16:入职日期,年、月、日
    doc.paragraphs[16].text = doc.paragraphs[16].text.replace('yyyy',str(renyuan.iloc[0,2].date().year))
    doc.paragraphs[16].text = doc.paragraphs[16].text.replace('mm',str(renyuan.iloc[0,2].date().month))
    doc.paragraphs[16].text = doc.paragraphs[16].text.replace('dd',str(renyuan.iloc[0,2].date().day))
    doc.save('%s聘用信.docx'%(renyuan.iloc[0,0]))
    

    在这里插入图片描述
    导出文件如上图,没毛病,可以写个循环批量生成了。

    for i in range(0,len(renyuan)):
        doc = docx.Document(r'C:\Users\lmy\Documents\临时\python自动化办公培训\聘用信.docx')
        doc.paragraphs[3].text = time.strftime("%Y{y}%m{m}%d{d}",time.localtime()).format(y='年',m='月',d='日')
        doc.paragraphs[4].text = doc.paragraphs[4].text.replace('XXX',renyuan.iloc[i,0])
        doc.paragraphs[5].text = doc.paragraphs[5].text.replace('XXX',renyuan.iloc[i,0])
        doc.paragraphs[10].text = doc.paragraphs[10].text.replace('XXXX',renyuan.iloc[i,1])
        doc.paragraphs[16].text = doc.paragraphs[16].text.replace('yyyy',str(renyuan.iloc[i,2].date().year))
        doc.paragraphs[16].text = doc.paragraphs[16].text.replace('mm',str(renyuan.iloc[i,2].date().month))
        doc.paragraphs[16].text = doc.paragraphs[16].text.replace('dd',str(renyuan.iloc[i,2].date().day))
        doc.save('%s聘用信.docx'%(renyuan.iloc[i,0]))
    

    在这里插入图片描述

    # 需要转成pdf文件的可以用下面代码转换
    '''
    import os,win32com
    import win32com.client
    from win32com.client import Dispatch,constants,gencache
    filename = 'lmy1聘用信.docx'
    filepath = os.path.join(os.getcwd(),filename)
    doc = wd.Documnets.Open(filepath,ReadOnly=1)
    doc.SaveAs(filepath.replace(".docx",".pdf"),17)
    doc.close()
    '''
    

    3、邮件自动发送相应应聘信

    # 3、邮件自动发送相应应聘信
    # 生成的附件直接发送邮件
    import smtplib
    from email.mime.text import MIMEText
    from email.mime.multipart import MIMEMultipart
    from email.header import Header
    #设置服务器所需信息
    #qq邮箱服务器地址
    mail_host = 'smtp.qq.com'  
    #qq用户名
    mail_user = '5********@qq.com' 
    #密码(部分邮箱为授权码,qq就是) 
    mail_pass = 'q***********b'
    #邮件发送方邮箱地址
    sender = '5********@qq.com'  
    #邮件接受方邮箱地址,注意需要[]包裹,这意味着你可以写多个邮件地址群发
    receivers = ['5********@qq.com']  
    
    #设置email信息
    message = MIMEMultipart() #创建一个带附件的实例
    message['From'] = Header('才华有限公司','utf-8') #发送方信息
    message['To'] = Header('应聘人员','utf-8') #接受方信息     
    subject = '才华有限公司应聘'
    message['Subject'] = Header(subject,'utf-8') #邮件主题  
    
    
    #邮件正文内容
    message.attach(MIMEText('恭喜入职才华有限公司,具体详见附件','plain','utf-8'))
     
    #构造附件1,传送当前目录下的test.txt文件
    att1 = MIMEText(open('lmy1聘用信.docx','rb').read(),'base64','utf-8')
    att1['Content-Type'] = 'application/octet-stream'
    #这里的filename可以任意写,写什么名字 邮件中就显示什么名字
    att1['Content-Disposition'] = 'attachment;filename:"lmy1聘用信.docx"'
    message.attach(att1)
     
    
    #登录并发送邮件
    try:
        smtpObj = smtplib.SMTP() 
        #连接到服务器
        smtpObj.connect(mail_host,25)
        #登录到服务器
        smtpObj.login(mail_user,mail_pass) 
        #发送
        smtpObj.sendmail(sender,receivers,message.as_string()) 
        #退出
        smtpObj.quit() 
        print('success')
    except smtplib.SMTPException as e:
        print('error',e) #打印错误
    

    开通邮件SMTP授权请看:https://service.mail.qq.com/cgi-bin/help?subtype=1&&id=28&&no=1001256’)

    完整版代码

    import docx
    from docx import Document
    import time,datetime
    import smtplib
    from email.mime.text import MIMEText
    from email.mime.multipart import MIMEMultipart
    from email.header import Header
    
    def generate_doc_email(staff_path,doc_tempo_path):
        renyuan = pd.read_excel(staff_path)   #读取人员信息数据
        
        #循环每个人员信息,生成相对应的应聘信doc,并发送邮件
        for i in range(0,len(renyuan)):
            doc = docx.Document(r'C:\Users\lmy\Documents\临时\python自动化办公培训\聘用信.docx')
            doc.paragraphs[3].text = time.strftime("%Y{y}%m{m}%d{d}",time.localtime()).format(y='年',m='月',d='日')
            doc.paragraphs[4].text = doc.paragraphs[4].text.replace('XXX',renyuan.iloc[i,0])
            doc.paragraphs[5].text = doc.paragraphs[5].text.replace('XXX',renyuan.iloc[i,0])
            doc.paragraphs[10].text = doc.paragraphs[10].text.replace('XXXX',renyuan.iloc[i,1])
            doc.paragraphs[16].text = doc.paragraphs[16].text.replace('yyyy',str(renyuan.iloc[i,2].date().year))
            doc.paragraphs[16].text = doc.paragraphs[16].text.replace('mm',str(renyuan.iloc[i,2].date().month))
            doc.paragraphs[16].text = doc.paragraphs[16].text.replace('dd',str(renyuan.iloc[i,2].date().day))
            doc.save('%s聘用信.doc'%(renyuan.iloc[i,0]))
            
            
            mail_host = 'smtp.qq.com'  #qq邮箱服务器地址
            mail_user = '5********@qq.com'   #qq用户名
            mail_pass = 'q***********b'  #密码(部分邮箱为授权码,qq就是) 
            sender = '5********@qq.com'    #邮件发送方邮箱地址
            receivers = [renyuan.iloc[i,3]]  #邮件接受方邮箱地址,注意需要[]包裹,这意味着你可以写多个邮件地址群发
    
            #设置email信息
            message = MIMEMultipart() #创建一个带附件的实例
            message['From'] = Header('才华有限公司','utf-8') #发送方信息
            message['To'] = Header('应聘人员','utf-8') #接受方信息     
            subject = '才华有限公司应聘'
            message['Subject'] = Header(subject,'utf-8') #邮件主题  
            message.attach(MIMEText('恭喜入职才华有限公司,具体详见附件','plain','utf-8')) #邮件正文内容
            att1 = MIMEText(open('%s聘用信.doc'%(renyuan.iloc[i,0]),'rb').read(),'base64','utf-8') #构造附件1,传送当前目录下的文件
            att1['Content-Type'] = 'application/octet-stream'
            att1['Content-Disposition'] = 'attachment;filename:"lmy1聘用信.docx"' #这里的filename可以任意写,写什么名字 邮件中就显示什么名字
            message.attach(att1)
            smtpObj = smtplib.SMTP()  
            smtpObj.connect(mail_host,25)  #连接到服务器
            smtpObj.login(mail_user,mail_pass)  #登录到服务器
            smtpObj.sendmail(sender,receivers,message.as_string()) #发送
            
        doc.Close() #关闭
        smtpObj.quit()  #退出
    
    
    展开全文
  • 本阶段为python自动化的高级阶段,学员学习之后可以掌握:word自动化办公、ppt自动化办公、邮件自动化办公、网页自动化办公 本系列课程一共包含3个篇章: 《python办公自动化》基础篇 《python办公自动化》进阶篇 ...
  • 这是一个Python编程简单入门的系列教程,课程所有资料(代码、测试文件)可以从百度网盘下载:链接:...- 1 Python快速入门童晶:Python办公自动化 - 3 Excel办公自动化童晶:Python办公自动化 - 4...

    这是一个Python编程简单入门的系列教程,课程所有资料(代码、测试文件)可以从百度网盘下载:

    链接:https://pan.baidu.com/s/1oS27bE9Pyns4Patf05ehLA

    提取码:jz5z

    讲解视频:

    2 Word办公自动化

    ppt:

     

    v2-2af479a80b566522eaf866cafaf2b6be_b.jpg

     

    v2-9423502dbbb106a15725dff00fa2042b_b.jpg

     

    v2-1b6fc29d4f38afea3cfd66ac54459b8a_b.jpg

     

    v2-7f32246df954b5a75f765cfe08e16654_b.jpg

     

    v2-096dbfde61a097e0295e7268e4489350_b.jpg

     

    v2-d9d6e1a19656007bb343ded6136124dd_b.jpg

     

    v2-e3b8336825fe4aa64cdca27d8e447fb6_b.jpg

     

    其他三个教程的链接:

    童晶:Python办公自动化 - 1 Python快速入门童晶:Python办公自动化 - 3 Excel办公自动化童晶:Python办公自动化 - 4 PDF办公自动化

     

    展开全文
  • 办公自动化试题 word部分考试题目所用的文字和图片素材。
  • 办公自动化 word 2003

    2011-06-10 16:12:57
    主要内容将了办公自动化的一些基本操作,希望同学们能够学好办公自动化
  • 上节python办公自动化:自动打开word文档我们一起学会了在python里打开并保存一个word文档。这节我们将会学会如何利用python进行文本处理和将其在word里进行排版等技巧。python进行文本处理和将其在word里进行排版等...

    上节python办公自动化:自动打开word文档我们一起学会了在python里打开并保存一个word文档。这节我们将会学会如何利用python进行文本处理和将其在word里进行排版等技巧。

    20190425131633_cb142425529dfa3ec72a0f15fdd70faf_1.jpeg

    python进行文本处理和将其在word里进行排版等技巧

    使用文本

    要有效地处理文本,首先要了解一些块级元素(如段落)和内联级对象(如运行),这一点很重要。

    块级与内联文本对象

    该段落是Word中的主要块级对象。

    块级项目在其左右边缘之间流动包含的文本,每次文本超出其右边界时添加一条附加行。对于段落,边界通常是页边距,但如果页面按列布局,它们也可以是列边界,如果段落出现在表格单元格内,则它们也可以是单元格边界。

    表也​​是块级对象。

    内联对象是在块级项目内发生的内容的一部分。一个例子是以粗体显示的单词或全部大写的句子。最常见的内联对象是运行。块容器中的所有内容都在内联对象内。通常,段落包含一个或多个运行,每个运行包含段落文本的某些部分。

    块级项目的属性指定其在页面上的位置,例如段落前后的缩进和空格。内联项的属性通常指定内容显示的字体,如字体,字体大小,粗体和斜体。

    段落属性

    段落具有各种属性,用于指定其在容器(通常是页面)中的位置以及将其内容划分为单独行的方式。

    通常,最好定义将这些属性收集到有意义的组中的段落样式,并将适当的样式应用于每个段落,而不是将这些属性直接重复应用于每个段落。这类似于层叠样式表(CSS)如何与HTML一起使用。此处描述的所有段落属性都可以使用样式设置,也可以直接应用于段落。

    使用段落属性可用的对象 访问段落的格式属性 。

    水平对齐(对齐)

    展开全文
  • 这篇博文是 **Python办公自动化** 的第二部分,主要是介绍**World**的自动化处理
  • 办公自动化WORD教程

    2008-10-21 00:54:32
    办公自动化实训教程WORD部分,PPT演示文稿。
  • 想起前几天看过的一篇python自动化办公的帖子,想自己动手试一试 库需求:python-docx、docxcompose、os 输入工作目录,os模块会读取该目录下的文件列表,将其保存在files列表中 遍历该列表,将里面的word文档都插...
  • Python——玩转Word自动化

    千次阅读 多人点赞 2021-07-03 07:56:10
    5. 玩转Word自动化 Office三大办公利器: Excel Word PPT Word常见使用场景: 场景一:手动创建批量制式Word文件,如合同、简历、资讯等 场景二:修改现有大量Word文件存在的共性问题 Word自动化哪家强: ...
  • 通过Python自动化办公把提取word中的表格,填充到到excel当中. 首先通过for循环提取word当中的表格的每个单元格的内容,然后指定excel,进行批量填充
  • 主要介绍了基于python实现自动化办公学习笔记,文中通过示例代码介绍的非常详细,对大家的学习或者工作具有一定的参考学习价值,需要的朋友们下面随着小编来一起学习学习吧
  • Python自动化办公-处理word文档 年底项目投标,需要整理大量的内容,标书的很多内容是其实是之前的标书重复的,可以把对应的各个部分内容合并,然后再处理格式等。如果采用常规操作每次操作需要打开子目录——>...
  • python办公自动化源码集锦-Excel与Word互相转换源码
  • 自己做的一个课程设计,预计时间为2课时,
  • 知乎上有人提问:用python进行办公自动化都需要...自动化办公无非是excel、ppt、word、邮件、文件处理、数据分析处理、爬虫这些,这次我就来理一理python自动化办公的那些知识点。python基础excel自动化ppt自动化...
  • 0基础学习python办公自动化 Excel,word
  • 自己是学计算机的,然而简单的word的使用,由于平常使用的太少,所以……今天我发现了Word 的新用途,希望对大家有所帮助。
  • 办公自动化word+powerpoint+execl)课件
  • 上节python办公自动化:自动打开word文档我们一起学会了在python里打开并保存一个word文档。这节我们将会学会如何利用python进行文本处理和将其在word里进行排版等技巧。python进行文本处理和将其在word里进行排版等...
  • office——Word中的基础知识简介,基本功能的介绍,以及常用的操作,适合初学word的人作为学习的资料,
  • 前言 在前几天的文章中我们讲解了如何从Word表格中提取指定数据并...而我们要做的就是对每一列的数据按照一定的规则进行计算、整理并使用Python自动填入到Word中,大致的要求如下 上面仅是部分要求,真实需要填入wor
  • Python实现自动化办公视频教程:Excel处理、PDF转换、Word和PPT自动生成、Web自动处理。
  • 最近python语言热度一度飙升,因为它简洁的代码,对于初学者平易近人,它在数据分析与爬虫自动化有很好的效果,所以学习Python的人也多了,学习任何一门编程语言,首先都是配置好环境。这里我就介绍一下初学者如何...
  • 知乎上有人提问:用python进行办公自动化都需要学习...自动化办公无非是excel、ppt、word、邮件、文件处理、数据分析处理、爬虫这些,这次就来理一理python自动化办公的那些知识点。python基础excel自动化ppt自动化w...
  • python办公自动化之批量生成docx——根据excel生成word、根据word生成excel,可搜索CSDN原文(https://blog.csdn.net/FIREseeker/article/details/115493270)
  • 自动化办公常用的工具肯定还有很多,今天记录的就是python操作word文档。 首先需要安装的 python-docx 这个库,然后使用导入docx,如下面代码: from docx import Document #新建word文档 document = Document...
  • 自动化办公》Python-操控-Word

    千次阅读 2018-05-02 02:43:27
    虽然Word不好用, 但还必须得用它, python-docx是专门用于编辑Word文档的一个工具库, 它有两大用途, 自动化生成word文档 and 自动化修改文档 1. 自定义样式 python可以自定义三类样式 段落样式 字符样式 表格...

空空如也

空空如也

1 2 3 4 5 ... 20
收藏数 12,375
精华内容 4,950
关键字:

word自动化办公