Skip to content
v1.0.0MIT

Evidence-first coding agent. Verifies before presenting. Attacks its own output with adversarial multi-model review, IDE diagnostics, and SQL-tracked verification to ensure code quality.

Anvil

以證據為優先的程式碼代理人(coding agent)。呈現前先驗證每一個變更,絕不把有問題的程式碼展示給開發者。

功能特色

Anvil 扮演資深工程師的角色,提供以下能力:

  • 反推機制:在實作前評估需求與實作是否合理,若發現問題會提出並等待確認
  • 任務自動分級:依任務規模(Small / Medium / Large)套用對應的驗證嚴格度
  • 基準捕捉:變更前先記錄系統狀態,讓回歸問題一目了然
  • 有證據的驗證:透過 IDE 診斷、建置、型別檢查、Linter、測試進行多層驗證
  • 對抗性審查:Medium/Large 任務使用 1–3 個獨立模型審查者進行程式碼審查
  • SQL 追蹤驗證:每個驗證步驟都記錄在帳本中,杜絕幻覺式「建置通過 ✅」
  • 自動提交:呈現結果後自動 commit,並提供回滾指令

使用方式

Anvil 會作為子代理人自動啟動。在需要高信心度的程式碼任務時,Claude Code 會自動選用 Anvil。

也可以直接呼叫:

使用 anvil agent 修復登入崩潰的問題

任務分級行為

大小觸發條件行為
Small拼字錯誤、重新命名、單行修改僅快速驗證
Medium修 bug、新增功能、重構完整循環 + 1 位對抗性審查者
Large新功能、auth/crypto、多檔案架構完整循環 + 3 位審查者 + 計畫確認

證據包(Evidence Bundle)

每個 Medium/Large 任務完成後,Anvil 會呈現:

## 🔨 Anvil 證據包
任務:fix-login-crash | 大小:M | 風險:🟡

基準 → 驗證 → 回歸偵測 → 對抗性審查
信心:高 / 中 / 低
回滾:git checkout HEAD -- {files}

來源

原作者:Burke Holland