介绍
舍友从网上下载的word题库文档很乱,手动改了大半天才改了一点,想起python是大名鼎鼎的自动化脚本,于是乎开始了python对word的一顿瞎操作。
分析需求
对文档中的内容进行分析,只留下题目,选项,并且题号要从1开始。
编写代码
pip安装python-docx模块
读取word文档内容(如果是以.doc后缀的文件需另存为.docx文件!)
from docx import Document # 打开文件 srcdocx = Document(‘src.docx‘) # 遍历所有段落 for p in srcdocx.paragraphs: print(p.text)
输出效果:
分析所需要删除的内容:
需求1:
1
42.对餐后血糖显著升高的2型糖尿病者,可选用下列哪种药物(5.0分)
删除多余数字行
需求2:
42.对餐后血糖显著升高的2型糖尿病者,可选用下列哪种药物(5.0分)
修改正确的题目序号
需求3:
删除“窗体底端”“窗体顶端”
需求4:
A、
阿卡波糖
选项合成一行
需求5:
删除多余空白行
编写代码
本质上来讲,实现就是从源文档中取出一段文字进行处理操作,然后保存到目标文档。
其中,需求1,3,5的实现,只需要判断一下取出的内容是否是需要删除的内容,如果是,则不用保存到目标文档中,这样就实现了“间接删除”。
对于需求2的实现,通过观察我们不难发现,序号后面总有一个". ",所以我们只需要获取到这个的坐标,把前面的错误序号删除,插入正确的序号到处理字符串,最后保存到新文档,这样就完成了“修正题目序号”。
需求4的实现类似需求2,只需要找到 “、” 符号就行,然后进行类似操作,就能实现 “合并两行”。
from docx import Document # 判断字符串是否为数字 def is_number(s): try: float(s) return True except ValueError: pass try: import unicodedata unicodedata.numeric(s) return True except (TypeError, ValueError): pass return False # 修正错误题目序号 # src,源字符串 nPos,序号结束下标 cnt,正确序号 def changeNum(src,nPos,cnt): s = src[:0] + src[nPos:] str_list = list(s) str_list.insert(0, str(cnt)) dest = ‘‘.join(str_list) return dest # 源文档 srcdocx = Document(‘src.docx‘) # 目标文档 outDocx = Document() idx = 0 # 遍历下标 length = len(srcdocx.paragraphs) # 总段落数 cnt = 1 # 遍历序号 sum = 1 # 修改总次数 while(1): if idx >= length: break src = srcdocx.paragraphs[idx].text # 实现需求1,3,5 if((src == "窗体底端") or (src =="窗体顶端") or (src == "") or (is_number(src))) : print(f"正在修改第{sum}处错误 {src}") sum = sum + 1 # 计算修改的次数 idx = idx + 1 continue # 实现需求2 nPos1 = src.find(".") if nPos1 != -1 : # 查找到有序号的行 dest = changeNum(src,nPos1,cnt) print(f"正在修改第{sum}处错误 {src}") sum = sum + 1 # 计算修改的次数 cnt = cnt + 1 # 序号后移 outDocx.add_paragraph(dest) # 写入数据到新word # 实现需求4 nPos2 = src.find(‘、‘) if nPos2 != -1 : src2 = srcdocx.paragraphs[idx+1].text outDocx.add_paragraph(src+src2) idx = idx + 1 print(f"正在修改第{sum}处错误 {src},{src2}") sum = sum + 1 # 计算修改的次数 idx = idx + 1 outDocx.save(‘out.docx‘) print(f"修改完成!共计{sum}个错误!")
运行效果:
最终效果
总结
Python还是一个极为强大的工具,并且门槛低,易入门,以后我要多多学习Python!如果我的博客能给你点思路,那就发挥了很大的作用了!人生苦短,我用Python~
以上就是本文的全部内容,希望对大家的学习有所帮助,也希望大家多多支持。
《魔兽世界》大逃杀!60人新游玩模式《强袭风暴》3月21日上线
暴雪近日发布了《魔兽世界》10.2.6 更新内容,新游玩模式《强袭风暴》即将于3月21 日在亚服上线,届时玩家将前往阿拉希高地展开一场 60 人大逃杀对战。
艾泽拉斯的冒险者已经征服了艾泽拉斯的大地及遥远的彼岸。他们在对抗世界上最致命的敌人时展现出过人的手腕,并且成功阻止终结宇宙等级的威胁。当他们在为即将于《魔兽世界》资料片《地心之战》中来袭的萨拉塔斯势力做战斗准备时,他们还需要在熟悉的阿拉希高地面对一个全新的敌人──那就是彼此。在《巨龙崛起》10.2.6 更新的《强袭风暴》中,玩家将会进入一个全新的海盗主题大逃杀式限时活动,其中包含极高的风险和史诗级的奖励。
《强袭风暴》不是普通的战场,作为一个独立于主游戏之外的活动,玩家可以用大逃杀的风格来体验《魔兽世界》,不分职业、不分装备(除了你在赛局中捡到的),光是技巧和战略的强弱之分就能决定出谁才是能坚持到最后的赢家。本次活动将会开放单人和双人模式,玩家在加入海盗主题的预赛大厅区域前,可以从强袭风暴角色画面新增好友。游玩游戏将可以累计名望轨迹,《巨龙崛起》和《魔兽世界:巫妖王之怒 经典版》的玩家都可以获得奖励。
更新日志
- 罗志祥《舞状元 (Explicit)》[320K/MP3][66.77MB]
- 尤雅.1997-幽雅精粹2CD【南方】【WAV+CUE】
- 张惠妹.2007-STAR(引进版)【EMI百代】【WAV+CUE】
- 群星.2008-LOVE情歌集VOL.8【正东】【WAV+CUE】
- 罗志祥《舞状元 (Explicit)》[FLAC/分轨][360.76MB]
- Tank《我不伟大,至少我能改变我。》[320K/MP3][160.41MB]
- Tank《我不伟大,至少我能改变我。》[FLAC/分轨][236.89MB]
- CD圣经推荐-夏韶声《谙2》SACD-ISO
- 钟镇涛-《百分百钟镇涛》首批限量版SACD-ISO
- 群星《继续微笑致敬许冠杰》[低速原抓WAV+CUE]
- 潘秀琼.2003-国语难忘金曲珍藏集【皇星全音】【WAV+CUE】
- 林东松.1997-2039玫瑰事件【宝丽金】【WAV+CUE】
- 谭咏麟.2022-倾·听【环球】【WAV+CUE】
- 4complete《丛生》[320K/MP3][85.26MB]
- 4complete《丛生》[FLAC/分轨][218.01MB]