用Python轻松修改Word文件的作者和时间,打造自己的专属效率工具
csdh11 2025-04-01 16:56 8 浏览
你是否曾经遇到过需要批量修改 Word 文件的作者、创建时间或修改时间的情况?手动操作不仅费时费力,还容易出错。可以用 Python 编写一个小工具,轻松解决这个问题!无论你是编程新手还是有一定经验的开发者,这篇文章都将为你提供实用的技巧和完整的代码示例。
为什么要学习这个案例?
在日常工作中,我们经常需要处理大量的 Word 文档,尤其是涉及到文档的元数据(如作者、创建时间等)时,手动修改不仅效率低下,还容易出错。通过学习这个案例,你将掌握如何使用 Python 自动化处理这些任务,提升工作效率。
案例目标:
- 使用 Python 修改 Word 文件的作者、创建时间、修改时间等元数据。
- 使用项目管理工具(uv)和虚拟环境管理项目依赖。
- 将Python脚本打包成可执行文件(exe),方便在没有Python环境的电脑上使用。
实现思路
我们将使用Python的几个强大库来实现这个功能:
- python-docx:用于读取和修改Word文档的元数据。
- pywin32:用于修改文件的创建时间、修改时间和访问时间。
- argparse:用于解析命令行参数,方便用户输入文件路径、日期和作者信息。
代码实现
1. 安装依赖库
首先,我们需要安装所需的Python库。使用uv工具创建项目并安装依赖:
# 创建项目
uv init word
# 切换到项目目录
cd word
# 添加需要的依赖库
uv add python-docx pywin32
# 同步项目依赖
uv sync
# 启动项目虚拟环境
.\.venv\Scripts\activate
2. 编写Python脚本
接下来,我们编写一个Python脚本,用于修改Word文件的作者和时间信息。以下是完整的代码:
#!/usr/bin/env python3
# -*- coding:utf-8 -*-
import os
import time
import argparse
from datetime import datetime
from docx import Document
from win32file import CreateFile, SetFileTime, GetFileTime, CloseHandle
from win32file import GENERIC_READ, GENERIC_WRITE, OPEN_EXISTING
from pywintypes import Time
def set_file_time(file_path, file_date):
"""设置文件创建时间、修改时间"""
try:
format = "%Y-%m-%d %H:%M:%S"
ftime = time.localtime(time.mktime(time.strptime(file_date, format)) + 0)
mtime = time.localtime(time.mktime(time.strptime(file_date, format)) + 1)
atime = time.localtime(time.mktime(time.strptime(file_date, format)) + 2)
file_handle = CreateFile(file_path, GENERIC_READ | GENERIC_WRITE, 0, None, OPEN_EXISTING, 0, 0)
createTimes, accessTimes, modifyTimes = GetFileTime(file_handle)
createTimes = Time(time.mktime(ftime))
accessTimes = Time(time.mktime(atime))
modifyTimes = Time(time.mktime(mtime))
SetFileTime(file_handle, createTimes, accessTimes, modifyTimes)
CloseHandle(file_handle)
return 0
except:
return 1
def show_wordfile_info(document):
"""显示word文件信息"""
core_properties = document.core_properties
print('作者:', core_properties.author)
print('创建时间:', core_properties.created)
print('上次修改人:', core_properties.last_modified_by)
print('上次打印时间:', core_properties.last_printed)
print('上次编辑时间:', core_properties.modified)
print('修订编号:', core_properties.revision)
print('资源名称:', core_properties.title)
print('此包内容的分类:', core_properties.category)
print('资源内容的说明:', core_properties.comments)
print('引用ISBN:', core_properties.identifier)
print('本文档搜索词的描述性词或短语:', core_properties.keywords)
print('编写文档的语言:', core_properties.language)
print('资源内容的主题:', core_properties.subject)
print('版本:', core_properties.version)
print('文档的完成状态:', core_properties.content_status)
return
if __name__ == '__main__':
parser = argparse.ArgumentParser(description="修改docx文件作者和时间")
parser.add_argument("filename", help="指定文件名")
parser.add_argument("new_date", help="指定日期 (YYYY-MM-DD HH:MM:SS)")
parser.add_argument("author", help="指定作者")
args = parser.parse_args()
file_name = args.filename
file_date = datetime.strptime(args.new_date, "%Y-%m-%d %H:%M:%S")
file_timestamp = int(file_date.timestamp())
author = args.author
document = Document(file_name)
print('\n')
print('原文件信息:')
show_wordfile_info(document)
core_properties = document.core_properties
core_properties.author = author
core_properties.last_modified_by = author
core_properties.comments = ''
core_properties.created = file_date
core_properties.modified = file_date
core_properties.last_printed = file_date
core_properties.title = ''
core_properties.revision = 1
core_properties.category = ''
core_properties.identifier = ''
core_properties.keywords = ''
core_properties.subject = ''
core_properties.version = ''
core_properties.content_status = ''
dir2, exname = os.path.splitext(file_name)
dir, file = os.path.split(dir2)
new_name = file + "-new" + exname
new_file = os.path.join(dir, new_name)
document.save(new_file)
r = set_file_time(new_file, args.new_date)
if r == 0:
print('\n---修改文件时间成功!---')
else:
print('\n---修改文件时间失败!---')
3. 运行脚本
将上述代码保存为mdocx.py,然后在命令行中运行以下命令:
python mdocx.py M1.docx "2020-01-01 10:00:00" 老王
其中:
- M1.docx是你要修改的Word文件路径。
- "2020-01-01 10:00:00"是你要设置的日期和时间。
- "老王"是你要设置的作者名称。
运行后,脚本会生成一个新的 Word 文件,文件名在原文件名后加上-new后缀,并且文件的作者和时间信息会被修改为你指定的值。
4. 打包脚本为exe文件
为了方便在没有 Python环 境的电脑上使用这个工具,我们可以将脚本打包成 exe 文件。在虚拟环境终端中执行以下命令:
nuitka --standalone --onefile .\mdocx.py
打包成功后,会生成一个mdocx.exe文件,你可以将它拷贝到其他电脑上直接运行。
总结
通过这个案例,我们不仅学会了如何使用 Python 修改 Word 文件的元数据,还掌握了如何将Python 脚本打包成可执行文件。这个小工具可以帮助你快速批量处理 Word 文档的作者和时间信息,极大地提升工作效率。
如果你对python-docx的更多功能感兴趣,可以参考官方文档。
希望这篇文章对你有所帮助!如果你有任何问题或建议,欢迎在评论区留言讨论。别忘了订阅我的头条号,陆续获取更多实用的编程技巧和工具分享!
订阅我,陆续获取更多Python编程技巧和效率工具!
头条号作者:东西北
发布时间:2025年2月23日
标签:#word #python #效率工具 #编程学习 #uv #nuitka
- 上一篇:插件开发js代码划分(js插件编写)
- 已经是最后一篇了
相关推荐
- 用Python轻松修改Word文件的作者和时间,打造自己的专属效率工具
-
你是否曾经遇到过需要批量修改Word文件的作者、创建时间或修改时间的情况?手动操作不仅费时费力,还容易出错。可以用Python编写一个小工具,轻松解决这个问题!无论你是编程新手还是有一定经验的...
- 插件开发js代码划分(js插件编写)
-
在开发Chrome插件时,将JavaScript代码拆分成多个模块而非集中放置,主要基于性能优化、可维护性提升和浏览器插件特性适配等多方面的考量。以下是具体原因及区别分析:一、拆分的核心原因...
- 5分钟掌握Python中的标准输入、标准输出、标准错误
-
读取用户输入从标准输入获取输入:user_input=input("Impartyourwisdom:")print(f"Youshared:{user_input}")...
- 高大上的解答:在 'packages.pyi' 中找不到引用 'urllib3'
-
DeepSeek的一句代码:...
- Flask 入门教程(flask快速入门)
-
目录什么是Flask?环境配置与安装第一个Flask应用:HelloWorld路由与视图函数模板与Jinja2表单处理与用户输入...
- 每日一库之 Go 语言开发者的神器—Gotx
-
点击上方蓝色“Go语言中文网”关注我们,领全套Go资料,每天学习Go语言简介Gotx是一个Go语言(Golang)的解释器和运行环境,只有单个可执行文件,绿色、跨平台,无需安装任何Go语言环境就可...
- MySQL性能调优工具包制作(mysql性能调整)
-
一、最终工具包内容mysql_tuning_toolkit/├──scripts/#核心脚本│├──sysbench-pro.sh#...
- 掌握TensorFlow核心用法:从安装到实战的完整指南
-
一、为什么TensorFlow值得学习?作为全球使用最广泛的开源机器学习框架,TensorFlow已累计获得超过17万GitHub星标,支撑着Google搜索、Waymo自动驾驶、NASA卫星图像分析...
- 如何把PY 打包成EXE安装文件(pypy 打包exe)
-
将Python脚本打包成EXE文件通常使用第三方工具实现,以下是详细步骤和注意事项:...
- Pygame Zero 详细使用教程(python zerorpc)
-
PygameZero是一个基于Pygame的简化游戏开发框架,特别适合初学者和快速原型开发。它隐藏了许多底层的复杂性,使得开发者可以更专注于游戏逻辑的实现。本文将通过分析提供的代码,详细介绍如...
- Stable diffusion AI画图辅助脚本 Script 的使用(二)
-
本篇为脚本使用介绍的第二部分,主要介绍Promptmatrix提示词矩阵以及UltimateSDUpscale终极SD放大这两个脚本,同时也简单介绍一下如何编写自己的脚本。1、Promp...
- 一文明白Python 的import如何工作
-
Pythonimport系统的基础知识Python的import系统是该语言设计的关键部分,允许模块化编程和代码的轻松重用。了解这个系统对任何Python程序员都很重要,因为它决定了代码的结构...
- Highlight.js - 前端的代码语法高亮库
-
千辛万苦写了篇技术分享,贴了一堆代码,兴高采烈地发到了自己的博客网站上。结果却发现代码全是白底黑字,字体还难看得很,你瞬间就没了兴致。能不能让网页也能像IDE那样,做带语法高亮的炫酷显示呢?来看一...
- xbox xsx/s ps2模拟器 战神12,北欧女神2 配置教程
-
xsxxss下载PS2独立模拟器,Retroarch全能模拟器地址。...
- RetroArch 着色器、金手指怎么用? 重返复古游戏萤幕滤镜效果
-
自从上次分享RetroArch模拟器的一些技巧后,许多模拟器新用户对老旧游戏机感到好奇,为什么游戏画面看起来会有很多马赛克。这主要是因为当年的游戏开发商是针对当时的屏幕进行设计的,所以在现在的高分辨率...
- 一周热门
- 最近发表
-
- 用Python轻松修改Word文件的作者和时间,打造自己的专属效率工具
- 插件开发js代码划分(js插件编写)
- 5分钟掌握Python中的标准输入、标准输出、标准错误
- 高大上的解答:在 'packages.pyi' 中找不到引用 'urllib3'
- Flask 入门教程(flask快速入门)
- 每日一库之 Go 语言开发者的神器—Gotx
- MySQL性能调优工具包制作(mysql性能调整)
- 掌握TensorFlow核心用法:从安装到实战的完整指南
- 如何把PY 打包成EXE安装文件(pypy 打包exe)
- Pygame Zero 详细使用教程(python zerorpc)
- 标签列表
-
- mydisktest_v298 (34)
- document.appendchild (35)
- 头像打包下载 (61)
- acmecadconverter_8.52绿色版 (39)
- word文档批量处理大师破解版 (36)
- server2016安装密钥 (33)
- mysql 昨天的日期 (37)
- parsevideo (33)
- 个人网站源码 (37)
- centos7.4下载 (33)
- mysql 查询今天的数据 (34)
- intouch2014r2sp1永久授权 (36)
- 先锋影音源资2019 (35)
- jdk1.8.0_191下载 (33)
- axure9注册码 (33)
- pts/1 (33)
- spire.pdf 破解版 (35)
- shiro jwt (35)
- sklearn中文手册pdf (35)
- itextsharp使用手册 (33)
- 凯立德2012夏季版懒人包 (34)
- 反恐24小时电话铃声 (33)
- 冒险岛代码查询器 (34)
- 128*128png图片 (34)
- jdk1.8.0_131下载 (34)