← 返回重点项目
查看 GitHub 项目

Da7-Tech/SureForge

一句话定位

Agent Skill for complex work——五段工作纪律(research before ask / ask before plan / plan before build / verify before deliver / independent review before done);纯文本 SKILL.md + references + assets,跨 Claude Code / Codex / Cursor / Devin / hermes-agent。

它解决的问题

AI Agent 在复杂任务上的失败模式可预测:(1) 在理解需求前就开始构建;(2) 把跳过的问题当作"是";(3) 检查一个 sample 就说完成;(4) 重读自己的工作当作 review;(5) review 轮次用完就交差。SureForge 把这些失败模式整理成"五段工作纪律",作为 SKILL.md 文本让 agent 遵循。它不增加能力,而是降低失败率

为什么值得关注(2026-09-11)

热度来源判断

SureForge 的热度是 "Agent 失败模式可预测 × 文本纪律 Skill 化 × 跨 5 Harness 安装" 的组合。与一般 Skill 仓库"加能力"不同,SureForge 把"质量纪律"打包成 Skill,让 agent 遵守"研究 → 询问 → 计划 → 构建 → 验证 → 独立评审"的工作流。9 forks 中可能有团队 fork → 二次定制为自己的纪律。README 自述"the pattern behind it is simple: the time spent understanding, planning, and checking up front is far less than the time spent redoing work, patching it, and re-checking it by hand afterwards"——这是从团队实战中沉淀的方法论。热度真实但受众限于工程团队——agent 用户基数大,但愿意装"质量纪律"的比例需要观察。

关键技术亮点

  1. 五段工作纪律——research before ask / ask before plan / plan before build / verify before deliver / independent review before done
  2. 纯文本 SKILL.md + references + assets——无运行时、无 hook、无依赖;agent 像读其他 skill 一样读它
  3. 跨 5 Harness 安装——Claude Code / Codex / Cursor / Devin / hermes-agent;通过 Skills CLI npx skills add Da7-Tech/SureForge
  4. skills-lock.json 提醒——README 明示"CLI may write a skills-lock.json... that file can contain local paths, so look at it before committing it"——这是一个非常成熟的工程实践
  5. 失败模式清单——把 agent 失败模式做成可读文档("They start building before the request is understood. They treat a skipped question as a yes...")

架构师速览

决策问题 研究判断 证据边界
系统边界 纯文本 Agent Skill;无运行时、无 hook、无依赖;agent 像读其他 skill 一样读 SKILL.md 仅基于 README 明示的"plain text: no runtime, no hook, no dependency";具体 reference 文件数量与模板细节未在档案中给出
主路径 agent 接收任务 → 加载 SureForge SKILL.md → 遵循五段纪律 → 输出经过研究/询问/计划/构建/验证/独立评审的结果 主路径为 README "the working procedure" 语义;具体 SKILL.md 内容结构、references 章节以仓库代码为准
关键权衡 纪律明确性 vs 文本长度 vs 跨 Harness 同步 vs 用户自定义 vs 失败模式覆盖度 档案明示"五段"结构与跨 5 Harness;用户自定义入口(是否提供修改模板)待核验
最小 PoC 在 Claude Code 中安装 SureForge,给 agent 一个复杂任务(如"为某中型项目添加 OAuth2 登录"),观察 agent 是否按"研究 → 询问 → 计划 → 构建 → 验证"流程推进 PoC 范围由 README "five-stage" 语义推导;具体任务选择、review 轮次配置需自行验证
风险 121KB 仓库 size 偏小、五段纪律可能过于刚性、跨 Harness 同步维护成本 档案明示三项风险

架构启发

SureForge 的核心启发是 "Skill 不只是'加能力',也可以是'立规矩'"。一般 Skill 仓库提供"prompt 模板 / 工具接入 / 知识库"等"加能力"功能;SureForge 反其道,把"质量纪律"打包成 Skill,让 agent 遵守工作流。更深层的启发是:agent 失败的根源不是"能力不够",而是"流程缺失"——把"研究 → 询问 → 计划 → 构建 → 验证 → 独立评审"纪律化,比提升模型本身更直接降低失败率。这种模式可推广到其他质量维度(安全 / 合规 / 性能 / 可观测性)——每个维度都可以做成一个 SureForge-XXX Skill。

架构图(MMD)

证据边界:此图只采用本档案已有可核验描述;"待核验"节点不应视为项目实现事实。

flowchart LR
  Agent[AI Agent] --> Load[加载 SureForge SKILL.md
纯文本] Load --> Stage1[Stage 1: Research before ask
理解需求] Stage1 --> Stage2[Stage 2: Ask before plan
确认模糊问题] Stage2 --> Stage3[Stage 3: Plan before build
明确实施步骤] Stage3 --> Stage4[Stage 4: Verify before deliver
自验证] Stage4 --> Stage5[Stage 5: Independent review
独立评审] Stage5 --> Done[最终交付] Agent -.失败模式.-> Fail[跳过问题 / sample 当完成 / 自读当 review] Fail -.纪律约束.-> Load Load --> H1[Claude Code] Load --> H2[Codex] Load --> H3[Cursor] Load --> H4[Devin] Load --> H5[hermes-agent] H5 -.提醒.-> Lock[skills-lock.json
含本地路径需核验]

定位判断

工具型项目(Agent 质量纪律 Skill)。 SureForge 是"Skill 不只加能力,也可立规矩"的代表。它的价值与"agent 工程质量"需求正相关——企业 / 团队级 agent 部署对质量纪律的需求强于个人用户。值得持续跟踪工具型定位,但价值依赖跨 Harness 安装的可达性。

风险 / 局限 / 泡沫点

与同类项目的关系

是否值得持续跟踪

值得跟踪(Agent 质量纪律 Skill 化)。 SureForge 验证了"Skill 立规矩"的产品形态。建议关注:(1) 五段纪律在实际任务中的效果(用户案例 / case study);(2) 是否被 Anthropic / OpenAI / Cursor 等官方推荐;(3) 是否扩展到其他质量维度(安全 / 合规 / 性能)。对工程团队,本仓库直接提供可用的质量纪律;对 Skill 生态观察者,它是"立规矩"模式的代表样本。

后续观察点


首次记录:2026-09-11

数据来源: GitHub API (2026-09-11) | Stars: 86 | Forks: 9 | License: MIT | 语言: Python | 创建: 2026-09-09