偷懒神器!用Python自动生成数据日报!

非科班转行数据科学:从业务问题到模型落地的四阶跃迁 数据科学不是编程或算法的堆砌,而是将业务问题转化为可计算、可验证、可交付的数据解决方案的能力。其核心原理在于:以真实业务场景为起点,通过数据探查、特征工程、模型评估与工程部署形成闭环;技术价值体现在降低决策不确定性、提升运营效率与量化业务收益;典型应用场景覆盖零售缺货预警、医疗设备调度、教育辍学预测、制造业故障诊断等垂直领域。尤其对财务、教育、医疗、制造等非计算机背景从业者,领域经验本身就是高阶特征工程的源泉。本文聚焦‘能跑通代码’到‘能交付结果’的关键断层,拆解真实项目驱动的学习路径与工程化补位策略。 阅读详情

日报,是大部分打工人绕不过的难题。

对于管理者来说,日报是事前管理的最好抓手,可以了解团队的氛围和状态。可对于员工来说,那就有的聊了。对于重复性的工作,我非常推荐大家使用Python将其变成模块化、自动化,帮助我们实现高效办公。

63fee1691c4f6474599063c93d82152a.png

下面我们通过一个补写销售日报的案例,展示一下Python自动化办公的优势。本文简化了案例的流程,在文末附有完整代码。

ac83a405ed21cd5041ffd164894bab05.png

需求详解

朋友的需求是这样的,他们平时的销售数据是记录在Excel上,汇总后会按照部门进行统计。但是今年年初时,领导突然要求写日报,大家写了一个月发现并不检查就没继续写下去。

bbe32941b2cfffd0d1a37033c2db0ccf.png
▲Excel日报数据

现在突然被要求明天交本月之前的所有日报,这相当于要补2-5月将近120天的日报,如果靠双手复制粘贴,那估计要吐血了。朋友将其写日报的相关文件都发了过来,发现最终日报效果如下所示。

25f95343f909941691c3f4cbdf3de1e3.png

所以需求也就是比较简单了,只需要从Excel表格中读取每日的数据,使用Python将其处理后,再依次写入Word文档中,即可实现批量生成日报。

正好最近有本新书《快学Python:自动化办公轻松实战》,既是一本Python入门书,又包含了大量Python自动化办公的实战项目。我们只需学习其中的第3章、第5章,即可轻松实现今天的这个需求。

数据处理

在进行数据处理之前,要先了解最终需要哪些数据。如下图所示,在目标日报Word中主要分为两类:红色标记的数值主要是由当日的数据、或者由它们计算后得到的数据构成;绿色标记的表格则更简单了,就是近七日的数据(销售数量、销售金额、销售目标、完成度)。

98c5d10f79d138bc779cc59de9b1fc80.png

首先我们导入Pandas模块进行数据处理,在新书《快学Python:自动化办公轻松实战》的第3章中,正是【学习Python,可以自动化处理数据】。

import pandas as pd
df = pd.read_excel("日报数据.xlsx")
df

输出结果

008ea62faf08fc23f05f5955184df47f.png

导入数据后,接着就可以按照我们的需求,来进行数据运算了。数据运算主要分为两种,一种是利用加 +、减 -、乘 *、除 / 进行数据运算,另一种是利用统计方法进行数据运算。

在交互式环境中输入如下命令:

df["日期"] = df["日期"].apply(lambda x:x.strftime("%Y-%m-%d"))
df["当日完成度"] = (df["销售金额"]/df["销售目标"]*100).round(1)
df["累计销售金额"] = df["销售金额"].cumsum()
df["当年完成度"] = (df["累计销售金额"]/2200000*100).round(1)
df["累计销售金额"] = (df["累计销售金额"]/10000).round(2)
df

输出结果:

346fe0acb1223e355bc8e0983a402547.png

可以看到,最终结果截图中红色标记的数据内容已经全部被计算出来。而绿色标记的表格则更加简单了,使用Pandas模块中的数据选取即可,详见新书《快学Python:自动化办公轻松实战》章节3.2.3。

在交互式环境中输入如下命令:

num = 10
df.iloc[num-7:num, :5]

输出结果:

d76cbd80ba93410a18048b191f9b7fe1.png

通过这种方法就可以轻松得到某一日期的过去7日内的日报数据合集。

自动生成日报

如果想自动生成Word日报,就需要学习新书《快学Python:自动化办公轻松实战》中第5章的内容,即【学习Python,可以自动化操作Word】。

使用Python自动化操作Word通常会使用python-docx模块,而批量生成Word文档一般有两种方法:使用add_ paragraph()add_table()等方法给Word文档添加各种内容。另一种就是我们这次要用的,即按照位置替换原Word文档中的文字和表格数据等。

在交互式环境中输入如下命令:

for index, rows in df.iterrows():
    if index > 30:
        doc.paragraphs[0].runs[1].text = rows[0]
        doc.paragraphs[4].runs[4].text = rows[0]
        doc.paragraphs[4].runs[6].text = str(rows[1])
        doc.paragraphs[4].runs[8].text = str(rows[2])
        doc.paragraphs[5].runs[1].text = str(rows[3])
        doc.paragraphs[5].runs[3].text = str(rows[4])
        doc.paragraphs[9].runs[2].text = str(rows[5])
        doc.paragraphs[9].runs[7].text = str(rows[6])

        table = doc.tables[0]
        data_table = df.iloc[index-6:index+1,:5]    
        for i in range(7):
            for j in range(5):
                table.cell(i+1,j).text = str(df.iloc[i,j])
        
        doc.save(f"销售日报-{rows[0]}.docx")

执行代码,输出结果:

be51f992ec6805263e9bcdc3ce27658a.png

如上图所示,120份有记录的销售日报就写好啦,Python自动化办公就是怎么神奇。

eb43a6db51cadec45884368e32c304c3.png

完整代码获取方式:

链接:https://pan.baidu.com/s/1TPn53r4wd_k_VgqOewlO_A?pwd=kxpy

提取码:kxpy

因为语法简单、容易上手,Python 被称为“最适合初学者学习”的编程语言。而对于工作中各种重复性的电脑工作,都可以考虑用Python来转变为自动化程序。

07f00c6f37b5ee97e71a7d5a8bdbc1b0.png

如果你是一个Python初学者,会发现本文的逻辑非常简单,甚至大家还可以对此进行改进。比如python-docx模块在读取Word文档有优势,但是向模板中写入文本时,可以考虑使用docxtpl模块(学一点Jinja2语法)。


如果你是一个0基础的编程初学者,那也不用怕!

因为正好最近《快学Python:自动化办公轻松实战》上市了,人生苦短,快学Python!这是一本适合初学者的Python入门书,也是进阶学习Python自动化操作Word 、Excel 、PPT、PDF、沟通工具、图片和文件的宝典,更是一本拥有30+实战案例、10+工作项目的参考大全!

今天分享文章的Python自动化办公案例,其中知识点就是来自《快学Python:自动化办公轻松实战》书籍。

如果大家感兴趣,可以点击上方链接查看书籍介绍和目录,绝对是最适合大家的Python入门书,也是大家学习Python自动化办公的进阶书,更是随时可以翻看参考的案例宝典!

推荐阅读:
入门: 最全的零基础学Python的问题  | 零基础学了8个月的Python  | 实战项目 |学Python就是这条捷径
干货:爬取豆瓣短评,电影《后来的我们》 | 38年NBA最佳球员分析 |   从万众期待到口碑扑街!唐探3令人失望  | 笑看新倚天屠龙记 | 灯谜答题王 |用Python做个海量小姐姐素描图 |碟中谍这么火,我用机器学习做个迷你推荐系统电影
趣味:弹球游戏  | 九宫格  | 漂亮的花 | 两百行Python《天天酷跑》游戏!
AI: 会做诗的机器人 | 给图片上色 | 预测收入 | 碟中谍这么火,我用机器学习做个迷你推荐系统电影
小工具: Pdf转Word,轻松搞定表格和水印! | 一键把html网页保存为pdf!|  再见PDF提取收费! | 用90行代码打造最强PDF转换器,word、PPT、excel、markdown、html一键转换 | 制作一款钉钉低价机票提示器! |60行代码做了一个语音壁纸切换器天天看小姐姐!|

Jupyter Notebook实战指南:从数据分析报告到知识操作系统 Jupyter Notebook 是一种融合代码、可视化与叙述性文本的交互式计算环境,其核心在于‘可执行文档’范式——将数据处理逻辑、结果展示与业务解读统一于单个文件中。它基于内核(Kernel)驱动的实时执行机制,支持多语言、单元格(Cell)粒度控制和状态持久化,显著降低数据协作中的信息损耗与复现成本。在数据分析、模型验证、跨团队交付等场景中,Notebook 通过 Markdown 注释、内联图表、参数化运行(如 papermill)和环境隔离(本地/托管)实现工程化表达。尤其适合需要即时验证、业务可 阅读详情

相关推荐

多维聚合后数据操纵:重塑维度、重定义层级与注入上下文

多维聚合是OLAP分析的核心环节,其本质是将原始明细数据按多个维度分组汇总,生成结构化的立方体视图。然而,真正的分析价值不仅在于‘算出总数’,更在于对聚合结果进行二次加工——包括跨维度计算同比环比、动态计算占比排名、构建层级钻取路径等。这类操作依赖于维度重塑(如宽表转长表)、层级重定义(如虚拟父子关系)和上下文注入(如自动附加时间/空间语义),广泛应用于ClickHouse、Doris、Power BI及Pandas等技术栈。它解决了存储成本高、实时性差、口径不一致三大工程痛点,是支撑自助BI、实时看板与自

weixin_38166557的博客 276

使用docxtpl生成巡检word(笔记留档用)

使用docxtpl生成巡检word(笔记留档用)

多维聚合实战:从SQL GROUP BY到OLAP立方体构建

多维聚合是现代数据分析的核心能力,本质是支持时间、地理、产品等多维度的自由切片、钻取与交叉分析。其原理基于OLAP立方体模型,通过维度表与事实表分离、显式层次结构建模及预计算与即席计算协同,实现高效聚合。技术价值在于突破传统GROUP BY的单向降维局限,支撑BI自助分析、实时决策看板与跨部门数据协同。典型应用场景包括销售多维归因、财务成本穿透分析、用户行为路径交叉统计等。本文聚焦多维聚合的数据操作实践,涵盖维度建模、ClickHouse高性能聚合、GROUPING SETS精准分组及Superset语义化

weixin_34401479的博客 318

Python自动生成数据日报

大家好,我是辰哥。今天聊聊怎么用Python自动生成数据日报!其实我觉得蛮简单,核心就是你组装好日报的内容模板,然后将变化的量交给python去填充,需要用到的基本就是python处理excel、word和ppt等相关的库。熟练的使用它们,你就可以自动化一条龙了。正文日报,是大部分打工人绕不过的难题。对于管理者来说,日报是事前管理的最好抓手,可以了解团队的氛围和状态。可对...

公众号:Python研究者 1785

python生成日报

python日报, 报表, 表格

一夜奈何梁山 7647

解放双手,一键运行!Python每日自动生成数据日报

对于一个企业来说,高层看意义,中层看结论,基层看落地,数据日报、周报、月报可以监控销售个人在实际执行过程中的销售动态,而数据季度报、年报可以反映一个销售策略是否与实际的业务场景切合。可见数据日报在我们日常工作中必不可少,本文使用案例数据,构造销售收入、销售单量等关键性指标,借助Python工具一键生成数据日报,下面一起学习吧!示例工具:anconda3.7本文讲解内容:办公自动化适用范围:Python自动生成数据日报导入报表数据,包含销售日期,员工编号,销售员等七个字段。

m0_74942241的博客 1431

日报周报自动生成工具,一句简要描述,自动写出一篇工作日志总结

有了这个工具,再也不用担心每日每周每月的工作日志了,你只需要输入一段简要描述,就可以快速生成完整的工作日志内容,下面我们一起看看效果吧。

w1032233187的博客 5232

程序员越懒越高效?这个AI神器正在改写编码规则

就在准备摔键盘的瞬间,同事老王发来条消息:"试试DeepSeek的代码纠错,比咖啡管用"。抱着死马当活马医的心态点开链接,没想到这个决定竟让我体验到了当"甩手掌柜"的快乐——AI不仅三分钟解决了困扰我三小时的bug,还顺手把注释写得比我毕业论文还规范。前两天用它的自动化测试功能时我就深有体会,原本需要手动模拟的极端场景,现在输入业务规则就能生成测试用例,省下的时间正好用来优化核心算法。下次当你又在深夜调试时,不妨试试这个"编程加速器",说不定明天的日报就能多写两行:"完成需求开发,提前进入性能优化阶段"。

weixin_50019283的博客 760

OpenClaw Windows一键部署指南:零基础运行AI数字员工

数字员工是基于大模型与自动化技术构建的本地化任务执行体,其核心原理是将自然语言指令解析为可执行的桌面操作序列。技术价值在于绕过传统RPA的复杂配置与云端依赖,实现隐私可控、响应实时、开箱即用的办公提效。典型应用场景涵盖Outlook邮件归档、Excel数据清洗、网页表单填报等高频重复事务,尤其适配Windows环境下的非技术人员。本文聚焦OpenClaw这一广受关注的开源框架,详解其免Python环境、免Docker、免WSL的一键部署机制,并覆盖杀软拦截、路径硬编码、COM组件调用等真实落地关键点。

weixin_34185512的博客 435

Linux日志排查三剑客:tail、head、grep高效组合实战

Linux日志分析是系统运维与故障定位的核心能力,其本质是在海量文本中快速提取有效信号。理解日志的时间戳层、来源标识层和内容语义层,是高效查询的前提;而tail、head、grep并非简单文本工具,而是分别承担‘实时雷达’‘历史快照’和‘语义过滤器’角色的时空协同组件。通过I/O优化(如tail优先替代全量grep)、上下文增强(-A/-B参数)、正则降噪(-v排除健康检查)等技术手段,可将排查效率提升10倍以上。该方法论广泛适用于Nginx、MySQL、systemd-journal等主流日志源,并在统信

weixin_33888907的博客 2130

Vega-Lite声明式可视化:用JSON定义可复现交互图表

声明式可视化是一种以‘描述意图’替代‘编写绘制步骤’的数据图表构建范式,其核心原理是通过高层语义规范(如数据映射、视觉通道、交互逻辑)交由专用引擎自动编译渲染。这种技术显著降低协作成本与出错率,具备强可复现性、跨平台一致性和工程可维护性,广泛应用于BI看板、分析报告、教学演示及ML可解释性接口等场景。Vega-Lite作为该范式的典型代表,以简洁JSON语法实现专业级交互式图表,天然支持无障碍访问、主题定制与版本化管理,是数据分析师、工程师与研究者提升可视化交付效率的关键基础设施。

weixin_30298497的博客 365

Managed Agents 是 runtime 层的托管操作系统

Agent 并非新范式,而是 LLM 应用在生产环境落地时必然遭遇的状态管理、安全隔离与可观测性挑战。其核心在于将模型推理、工具执行与会话状态解耦,构建可追踪、可恢复、可审计的托管运行时(managed runtime)。这一架构直面上下文爆炸、凭证泄露、调试困难等工程痛点,本质是借鉴操作系统虚拟化思想,为 AI 工作流提供稳定抽象层。当前主流云厂商已推出类似能力,技术重心正从模型编排转向 runtime 层标准化——Anthropic Managed Agents、AWS Bedrock AgentCor

corg81763的博客 476

Pandas多维聚合实战:生产级groupby性能优化与业务建模

多维聚合是数据分析的核心能力,本质是将业务规则转化为结构化计算逻辑。其原理涉及分组索引构建、向量化函数调度与结果语义建模,技术价值在于支撑实时风控、精准运营和可信报表。典型应用场景包括客户分层分析、YTD滚动指标计算、跨维度交叉统计及高精度金融聚合。本文聚焦Pandas中groupby的生产级实践,深入解析MultiIndex列处理、category类型加速、自定义聚合函数封装、rolling/expanding窗口控制等关键技术,结合银行真实流水场景,提供可直接复用的健壮代码模板与避坑指南。

chenzhuofei4155的博客 362

R语言读Excel实战指南:readxl核心原理与生产级应用

Excel作为最广泛使用的业务数据源,其二进制结构、混合类型、区域格式差异等特性,使数据读取远非简单文件解析——它涉及格式识别、类型映射、跨平台兼容与工程稳定性等多重挑战。readxl凭借纯C++实现、零外部依赖、tibble原生输出和精确字节映射机制,成为R中可靠读取.xlsx/.xls文件的工业级选择。相比依赖JVM的xlsx包或仅限Windows的COM调用方案,readxl在银行风控、医药统计、电商分析等真实生产场景中展现出卓越的鲁棒性与可维护性。本文深入解析其设计哲学、参数控制逻辑(如sheet定

weixin_33698823的博客 375

使用Python自动制作历史上的今天宣传图片

大家好,今天分享一个通过 Python 自动创建相关图片的教程,而这个相关图片就是《历史上的今天》,那么为啥是历史呢,因为萝卜哥是一个历史迷,从小就喜欢啃历史书,随着年龄的增长,这份热情还是没有减退~ 好了闲话不都说,我们直接上干货 数据获取 首先就是数据哪里来,我试过使用网上的一些免费历史查询接口,但是效果都不理想,这些接口不是太不稳定,就是数据不友好。最后我还是选择了一个精简的网站,直接扒网站页面信息即可 http://jintian.160.com/ 网站很简单,也没有任何反爬措施,我们直接抓取

周萝卜的博客 483
上一篇: 12个必备的Python函数,新手看完就入门啦!
下一篇: 今年居然又是美团率先开奖。。
菜鸟学Python
博客等级 码龄9年 7560粉丝 571原创
评论
添加红包

请填写红包祝福语或标题

红包个数最小为10个

红包金额最低5元

当前余额3.43前往充值 >
需支付:10.00
成就一亿技术人!
领取后你会自动成为博主和红包主的粉丝 规则
hope_wisdom
发出的红包
实付
使用余额支付
点击重新获取
扫码支付
钱包余额 0

抵扣说明:

1.余额是钱包充值的虚拟货币,按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载,可以购买VIP、付费专栏及课程。

余额充值