skills3 技能库文档四件套:Word、PDF、PPT、Excel 一个 SKILL.md 全搞定
发布时间:2026/8/28 13:08:38 作者:尧图编辑部 阅读量:1,286

skills3 技能库文档四件套Word、PDF、PPT、Excel 一个 SKILL.md 全搞定【免费下载链接】skillsPublic repository for Agent Skills项目地址: https://gitcode.com/GitHub_Trending/skills3/skills这是一套面向 Agent 的文档技能包docx、pdf、pptx、xlsx 四个模块各配一份 SKILL.md 说明加现成脚本专门解决每次处理办公文档都要重新踩一遍 OOXML 和库的坑这件事。️ 四个模块能干什么一表看懂技能适用场景关键工具或做法DOCX新建 Word、改现有文档、修订跟踪、加批注docx-js 新建解压后直接改 document.xmlpandoc 抽文本PDF合并/拆分/旋转、抽文本表格、填表单、加水印、扫描件 OCRpypdf、pdfplumber、reportlab配合 qpdf、pdftotextPPTX从零做 deck、复用公司模板、批量增删幻灯片pptxgenjs 生成thumbnail.py 出幻灯片缩略总览图add_slide.py / clean.py 管结构XLSX建模、公式维护、清洗脏数据openpyxl 写公式pandas 批量进出recalc.py 重算校验每个模块的入口文档都放在自己目录里例如 DOCX 技能说明、PDF 表单填写指南。 DOCX 修订跟踪怎么做H3 什么时候用它多人协作改合同、报告需要每一处改动都留痕、可审查或者要往带跟踪修订的文档里加批注。H3 怎么上手用 pandoc 把文档转成 markdown先把要改的内容看明白。解压 .docx先跑 merge_runs.py 把碎片化的文本 run 合并文字才找得到。把改动按 3-10 个一批分组用w:ins/w:del包住实际改动的文字不要重复未改部分。重新打包跑 validate.py 并带--author参数确认没有漏标修订的地方。要出一份接受全部修订的干净版用 accept_changes.py 生成。H3 一条实用提示Word 会把一行字拆进几十个w:r片段你看得见的短语在 XML 里可能根本不是一个连续字符串——先合并 run 再搜索能省一大半时间。 PDF 合并拆分与表单填写常用方法H3 什么时候用它把多份材料拼成一份、按页拆分、抽表格进 Excel或者要往政府、银行的官方表单里填字。H3 怎么上手定任务类型合并拆分旋转用 pypdf抽文本表格用 pdfplumber从零造 PDF 用 reportlab。合并操作长这样from pypdf import PdfWriter, PdfReader writer PdfWriter() for f in [a.pdf, b.pdf]: for page in PdfReader(f).pages: writer.add_page(page) with open(merged.pdf, wb) as out: writer.write(out)填表单前先用 check_fillable_fields.py 判断有无可填字段。有字段就提取字段 JSON 逐个赋值没有字段就先转成逐页图片人工确认坐标再写。扫描件走 pdf2image 转图加 pytesseract 的 OCR 路线。H3 一条实用提示reportlab 里千万别用 Unicode 上下标字符内置字体没有这些字形印出来是一排黑方块要用super/sub标签代替。️ PPTX 怎么做出不模板味的幻灯片H3 什么时候用它要从零生成一份 deck或者必须复用公司 .potx 模板、往里塞内容。H3 怎么上手新建用 pptxgenjs 脚本动手前先设好 pres.layout默认画布是 10 英寸宽而不是 13.3 英寸。用模板时先跑 thumbnail.py 生成带编号的幻灯片总览图来挑版式第二参数一定要命名成 deck 自己的前缀。先做结构再填内容add_slide.py 复制幻灯片、改 presentation.xml 调顺序、clean.py 清掉孤儿文件。十六进制颜色不带 # 号也不能写 8 位演讲者备注走 addNotes 而不是文本框。最后 validate.py 加--original对照模板校验模板自带的报错不会算到你头上。H3 一条实用提示颜色给错格式是静默损坏文件的高发点——#FF0000和 8 位带透明度的写法都会让 PowerPoint 直接打不开这个 deck。 Excel 公式零错误怎么保证H3 什么时候用它做财务模型、预算表或任何交付后还要被人改输入、公式要跟着重算的表格。H3 怎么上手用 openpyxl 把公式当字符串写进单元格绝不写 Python 算好的死值。先写 2-3 个公式确认取数符合预期再铺开整张表。跑 recalc.pyLibreOffice 会把公式全部算一遍看到 total_errors 为 0 才算过关退出码为 0 不等于没错误。函数选 Excel 2007 时代的 SUMIFS、INDEX、MATCH、IFERRORXLOOKUP、FILTER 这类会算出来一个零错误但只有左上角有值的假干净文件。按行业惯例上颜色编码蓝字硬编码输入、黑字公式、绿字跨表引用、红字指向外部文件关键假设加黄底。H3 一条实用提示重算全绿只证明公式算得动不算算得对——差一行的区间引用照样给你一个零错误的错误答案。 四个模块怎么串起来用当你要做一份季度汇报时xlsx 出模型pptx 把关键数字做成大字号 callout 页docx 写带修订跟踪的正文报告最后 pdf 把附件拼成一份对外文件。四个模块各自产出的都是标准格式互不依赖。当扫描件里藏着要用的数据时先用 pdf 模块 OCR 出文本再用 xlsx 的 pandas 路线结构化成表最后回到 pptx 做对比图——pdf 负责看得懂xlsx 负责算得动pptx 负责讲得出。当要批量填官方表单时pdf 目录下的 forms 流程是唯一入口先判字段再决定走哪条路别上来就画坐标。 避坑清单OOXML 编辑后不要格式化 document.xml直接原地改重新打包前删掉旧输出文件否则已删的部件会复活。接受修订时被删的段落标记应当并入下一段而 accept_changes.py 和 pandoc 都可能留下空段落交付前去 XML 里核对一遍。带外部链接的 xlsx 用 openpyxl 另存会丢链接重算还会把整列变成 #NAME?先手动把那些单元格的值抄出来。合并单元格只写左上角锚点MergedCell 的 .value 是只读的。跨表引用里带空格的表名要加引号少一个引号整格 #VALUE!。 三步跑起来克隆仓库git clone https://gitcode.com/GitHub_Trending/skills3/skills通读对应模块的 SKILL.md每个文件开头的表格就是任务分派器。拿个小文件试一遍然后跑对应验证脚本比如 recalc.py 和 docx 目录下的 validate.py看到零错误再交付。文档工作里最贵的从来不是写内容而是格式坑——这套技能包把四个格式各自的坑都提前填平了你只需要专注内容本身。【免费下载链接】skillsPublic repository for Agent Skills项目地址: https://gitcode.com/GitHub_Trending/skills3/skills创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考