
Autoresearch实战第一课25轮迭代把测试覆盖率从72%提升到90%【免费下载链接】autoresearchClaude Autoresearch Skill — Autonomous goal-directed iteration for Claude Code. Inspired by Karpathys autoresearch. Modify → Verify → Keep/Discard → Repeat forever.项目地址: https://gitcode.com/gh_mirrors/auto/autoresearchAutoresearch 是一款开源的 Claude Code 自主迭代技能核心玩法是定目标 → 定指标 → 让 AI 循环修改→验证→保留/回滚直到达标。本文是一堂实战第一课用 25 轮自动迭代把一个项目的测试覆盖率从 72% 一路推到 90%全程无需人工盯着。为什么你需要 Autoresearch 这个自动迭代引擎 手动补测试是最枯燥的活写完一批 → 跑一遍 → 发现挂了就回退 → 重来。Autoresearch 把这套流程完全机械化每轮只做一个原子改动改完立即用机械指标验证指标变好就保留变差自动git revert回滚绝不留下坏代码git 就是它的记忆每轮实验都提交为experiment:前缀的 commit下一轮它会自己读历史决定什么有效、什么该避免、什么还没试过这正是 Karpathy autoresearch 的核心思想——约束 机械指标 自主迭代 复利式提升而 Autoresearch 把它推广到了任何可度量的场景详见 COMPARISON.md。一键安装步骤两条命令搞定 在 Claude Code 里推荐用 npx 安装npx skills add uditgoenka/autoresearch安装后重启 Claude Code14 个/autoresearch系列命令即可全部使用。如果你偏好手动安装可以克隆仓库后运行引导式安装脚本git clone https://gitcode.com/gh_mirrors/auto/autoresearch cd autoresearch ./scripts/install.sh --claude --global完整的安装说明见 guide/getting-started.md脚本源码在 scripts/install.sh。实战第一课提升测试覆盖率的完整配置 ✍️第一课选择最经典的目标——提升测试覆盖率。在 Claude Code 里输入/autoresearch Goal: Increase test coverage from 72% to 90% Scope: src/**/*.test.ts, src/**/*.ts Metric: coverage % (higher is better) Verify: npm test -- --coverage | grep All files Iterations: 25只有 5 个字段却是全部关键字段作用一句话技巧Goal用自然语言描述目标带上具体数字72% → 90%ScopeAI 允许修改的文件范围范围越小越安全Metric被追踪的指标 方向必须是能输出的一个数字Verify跑一遍输出该指标的 shell 命令一条命令、干净地提取一个数Iterations迭代轮数默认 25陌生项目先用Iterations: 10试水每轮迭代到底发生了什么 25 轮迭代每一轮都在重复同一个闭环读状态— 读代码库、git 历史、上轮结果日志选改动— 基于历史挑影响最大的一步比如第 1 轮补认证边界测试第 7 轮补支付错误处理做改动— 只做一个改动一句话能解释清楚提交— 先 commit保证随时可干净回滚验证— 跑Verify命令提取覆盖率数字裁决— 指标提升 →keep指标变差 → 自动 revert崩溃 → 修复或跳过记录— 把结果写进 TSV 日志进入下一轮完整协议见 guide/autoresearch.md。读懂结果日志25 轮的账本 所有迭代都会记录成一张 TSV账本25 轮跑完大概长这样iterationcommitmetricdeltastatusdescription0a1b2c3d72.00.0baseline初始状态1b2c3d4e74.12.1keep补认证边界测试2-73.5-0.6discard重构测试工具挂了 2 个用例已回滚7c3d4e5f80.31.2keep补错误处理测试………………25f4e5d6c90.20.5keep补并发场景测试达标收工跑完后执行/autoresearch:evals它会自动分析这张表趋势如何、是否进入平台期、哪一轮贡献最大、建议继续还是收手用法详见 guide/autoresearch-evals.md。防翻车技巧加一道 Guard 护栏 ️提升覆盖率时 AI 可能为了凑数字而改坏现有行为。加一行Guard护栏命令即可Guard: npm test规则很简单Verify 回答指标变好了吗Guard 回答别的东西坏了吗。若指标提升但护栏挂了AI 会立即回滚并重做最多 2 次两次都失败就丢弃这轮、继续下一轮。护栏和测试文件本身永远不被 AI 修改。给新手的 5 个上手建议 先跑 10 轮校准陌生代码库先Iterations: 10看结果顺眼再放大到 25 甚至unlimitedVerify 要紧一个数字、用grep/awk干净提取别给 AI 模糊的判据手动跑一次 Verify开跑前自己跑一遍心里有基线数字跑完看 git log每个实验都有 commit 记录任何一步都可以单独git revert不知道指标定什么先跑/autoresearch:plan它会帮你把模糊目标变成经过 dry-run 验证的完整配置常见问题速答 ❓Q中途想停怎么办ACtrlC即可。因为 AI 是先提交再验证所以你的最后一个成功状态永远安全地留在 git 里。Q25 轮没跑满 90% 怎么办A看 evals 报告——如果是平台期可以扩 Scope 或换策略再开一轮历史日志会自动成为下一轮的经验。Q除了覆盖率还能优化什么A任何有数字的场景包体积、p95 延迟、lint 错误数甚至 SEO 分数。示例大全见 README.md 的 Commands 章节和 guide/examples-by-domain.md。总结Autoresearch 的第一课只有 5 个字段却交付了一套永不放弃、绝不留烂账的自动优化引擎。给它一个目标和一把尺子然后去喝杯咖啡——回来时覆盖率报表已经是 90% 了。☕【免费下载链接】autoresearchClaude Autoresearch Skill — Autonomous goal-directed iteration for Claude Code. Inspired by Karpathys autoresearch. Modify → Verify → Keep/Discard → Repeat forever.项目地址: https://gitcode.com/gh_mirrors/auto/autoresearch创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考