ARTICLE DETAIL

资讯详情

深耕编程入门与网站建设的一线实战洞察。

清理未使用样式、删除空白行:文档批量瘦身记

清理未使用样式、删除空白行:文档批量瘦身记 讲一次翻车复盘。上个月接手一份八十多页的标书前手是三个人接力改出来的样式表里堆了六十多个样式实际用到的不到十五个正文里夹着上百个空段落模板改了四轮每一轮都留下几个样式尸体。我的任务是把它过一遍 AI 校对再交出去结果一路踩了三个坑。这篇按时间线复盘顺便把现在的标准流程整理出来。坑一把原文档整个丢给 AI我的第一反应是把全文复制到网页版 AI 里校对。八十多页粘过去要么被截断要么格式全丢AI 拿到的段落顺序都是乱的。后来接上察元AI文档助手的 MCP 通道才知道正规的读法用 document_get_text 读全文超过约 80k 阈值时工具会拦下来要么明确 force要么改用 document_chunks 分页分块读而 document_meta 会先给出字数、段数和是否建议分块的提示等于先体检再决定读法。但更重要的是顺序问题脏文档直接读等于让 AI 连同样式尸体和空段落一起消化token 全花在垃圾内容上。现在 Token 成本是实实在在的开销长文档场景下先瘦身、再喂 AI能省下不小一块这比任何提示词技巧都来得直接。坑二不敢动样式表第二个坑是心理障碍。样式表看着就吓人清错了把排版毁了怎么办我一开始只敢看不敢动。后来发现察元的文档批量里专门配了统计已使用样式这一步先把正文实际用到的样式列出来再执行清理未使用样式只动尸体不碰活人。六十多个样式清完剩十几个样式面板从滚三屏变成一屏半后续任何人接手都不容易再点错样式。复盘要点先统计、后清理这个顺序不能反。统计出来的清单本身也是一份交接材料——哪些样式真在用、用在哪些地方附在说明里接手的人不用再猜谜。另外共享模板要慎清——你不用不代表别人不用动共享模板之前先和模板的主人打好招呼。坑三手工删空白行删到眼花上百个空段落我头铁用查找替换加手工删删到凌晨两点中间还删串了两段。其实文档批量里的删除空白行一键就完事。这种教训说出来很蠢但人在赶工的时候就是会先上手再上工具。记一句凡是重复超过十次的操作先停下来找批量入口。现在的标准流程复盘之后我固定了一套顺序供参考。第一步另存副本保住原样第二步统计已使用样式心里有底第三步清理未使用样式第四步删除空白行第五步让 AI 复核结构问题比如这条提示词检查标题/条款序号一、一、1.是否层级混乱批注指出需要校对正文时再加一道保险先预览后写回先跑一遍校对dryRun汇总问题列表不要先改正文我确认后再写成批注校对的 dryRun 只出问题清单不落盘确认之后再转成批注瘦身和校对两步都稳。同门的批量兄弟文档批量这套清理未使用样式、统计已使用样式、删除空白行在加载项里不是独苗。同门还有表格批量——导出或删除全部表格、自动行宽、刷新样式、按文字删行列、序号与样式、表格题注以及图像批量——导出或删除全部图像、统一或清除格式、图像题注。交稿前的大扫除按文档、表格、图像的顺序各过一遍比想到哪修到哪有条理得多。样式面板清爽了表格规整了图片统一了这份文档不管后面是送人审还是喂给 AI都体面得多。适用人群与边界这套瘦身流程适合标书、论文、长报告的交稿前处理尤其是接下来要交给 AI 做校对、摘要、翻译的文档——干净的输入才是又便宜又高质量的输入。边界提醒清理样式和删空白行都改动文档本体务必先备份瘦身解决的是文档卫生内容对不对、逻辑通不通还得靠校对和人工把关工具管不了。一个脏文档在人手里是耐心问题在 AI 手里是 token 问题。先瘦身再干活两边都受益。
返回列表