AgEnD
Hermes 型能力導入與修正

AgEnD Hermes
功能調整報告

把工具進度、分層記憶與知識反省接進 AgEnD,同時修正「每輪都跳 Reflection」的干擾問題。

已部署 24 / 24 Agent 健康 只做本機版控
2026-08-01 AgEnD 2.1.1 敏感資訊顯示前遮蔽
目前使用體驗:一個 topic、同一則進度訊息持續更新
codex助手 · 執行中
請完整評估並調整 AgEnD 的 Hermes 記憶功能。
📚 讀取 Skill:knowledge-reflection-pipeline
📖 讀取知識:hermes-parity-audit
✏️ 修改檔案:reflection-store.ts
🧪 執行測試:151 passed
正常對話
背景累積
必要時才沉澱
00 / EXECUTIVE SUMMARY

這次不是把 Hermes 整套搬進來

AgEnD 仍然負責管理 Codex、Claude、Kiro;只吸收 Hermes 值得用的體驗,再依 AgEnD 多 Agent 架構重新實作。

3項核心能力:工具進度、執行中補充、分層記憶
10 / 10Memory 每 10 回合、Skill 每 10 次工具操作才檢查
0目前異常 Agent;全 fleet 健康
151本次功能相關測試全部通過
01 / WHAT WENT WRONG

原本最大的問題:反省機制太勤勞

舊版把每個普通回合都送去 Luna 檢查,還把 Reviewer 的結果再送回 topic。即使結論是「不用記」,使用者仍然被打斷。

修正前:每輪都觸發
USER TURN 01詢問目前狀況
REFLECTORno_action:本回合沒有可沉澱內容
USER TURN 02追問由誰判斷
REFLECTORno_action:沒有可稽核的新事實
PROPOSAL待核准:/reflection approve …
修正後:累積再檢查
TURN 01–09正常對話,只在背景更新計數
NO TELEGRAM MESSAGE未達門檻,不啟動 Reviewer
TURN 10Luna 一次檢查這段累積內容
NO_ACTION沒東西要記,就完全安靜
ONLY WHEN USEFUL真的有價值才寫入或派出 Skill 更新
02 / WHAT CHANGED

完成的六項調整

使用者看得到執行狀況,但不會被背景機制洗版;記憶與知識仍保留可追溯、可管理的入口。

工具進度集中顯示

讀 Skill、讀 Wiki、改檔、測試等狀態累積在同一則 Telegram 訊息,避免「處理中」與「更新內容」分成兩則。

三層自動記憶

user 保存跨專案偏好、project 保存團隊規則、agent 保存單一角色經驗;不同 Agent 可用 memory_project 共用專案記憶。

Hermes 式檢查節奏

Memory 累積 10 個使用者回合;Skill 累積 10 次實際工具操作。計數寫入檔案,AgEnD 重啟後不會歸零。

無內容就靜默

Luna 回 no_action 時,不再 report_result 給任何 Agent,也不在 Telegram 顯示無意義訊息。

Memory 自動、Skill 先核准

Memory 自動寫入正確層級;Skill 建立或修改前先顯示 Telegram 按鈕,核准後才交回原 Executor 更新與驗證。

Wiki 安靜待審

Wiki 是 AgEnD 額外能力,不硬套 Hermes。提案先進待審清單,不打斷聊天;需要時再用 /reflection pending 集中查看。

03 / SYSTEM MAP

AgEnD 與 Hermes 的差別

Hermes 自己就是 Agent 引擎;AgEnD 管的是三種外部 CLI,所以不能直接照搬原碼,必須從各後端的 transcript 轉成同一套事件。

外部 AI CLI
Codex讀 JSONL tool_use
Claude Code讀 transcript 工具事件
Kiro解析 Kiro 紀錄格式
AgEnD 正規化
分類Skill/Wiki/測試/改檔
遮蔽token/API key/密碼
顯示編輯同一則 Telegram 訊息
因此:畫面可以做到與 Hermes 相同的使用感,但事件來源不同。Hermes 有原生 tool.started;AgEnD 必須監看 Codex/Claude/Kiro 各自的紀錄。
04 / REFLECTION CADENCE

Reflection 現在怎麼跑

Luna 不是每個對話的負責人。它只在背景門檻到達時,看一小段累積紀錄,判斷是否值得沉澱。

Memory 檢查10 USER TURNS
12345678910

檢查穩定偏好、明確修正、專案規則與可重用經驗。

Skill 檢查10 TOOL CALLS
12345678910

檢查是否形成可重複 SOP,或既有 Skill 是否缺步驟、限制與驗證。


累積窗口
對話摘要+工具證據

GPT-5.6 Luna
Evidence Gatekeeper 只判斷,不直接改資料
no_action → 靜默Memory → 自動寫入Skill → 按鈕核准後派工Wiki → 安靜待審
05 / MEMORY LAYERS

三層記憶放什麼

重點不是把所有聊天都存起來,而是只保存短、穩定、下次真的會用到的規則。

LAYER 01

User Memory

蔡跨專案都成立的偏好,例如用中文白話回答、不要推遠端。

scope: user
LAYER 02

Project Memory

同一專案所有 Agent 都要知道的規則。用相同 memory_project 即可共用。

scope: project
LAYER 03

Agent Memory

只有特定角色需要的操作經驗,不污染其他 Agent 的上下文。

scope: agent
06 / HOW TO USE

實際怎麼用

日常不需要做任何事。正常交辦、正常糾正,AgEnD 會背景累積;只有你想查看或管理時才用指令。

照平常方式對話

交辦任務、補充方向、糾正錯誤,不需要加「請記住」格式。

看同一則進度訊息

Agent 讀了哪些 Skill/Wiki、正在測試或改檔,都會集中更新。

背景達門檻才檢查

10 個回合檢查 Memory;10 次工具操作檢查 Skill。沒有價值就不出聲。

需要時再管理

用 /memory 看目前記憶;用 /reflection pending 看安靜排隊的 Wiki 提案。

fleet.yaml 建議設定
defaults:
  tool_progress: standard
  reflection:
    enabled: true
    reviewer: knowledge-reflector
    memory_interval: 10
    skill_tool_interval: 10
    memory_write_approval: false
    skill_write_approval: true
    notifications: on

# off:完全不通知
# on:只顯示一行結果
# verbose:顯示提案標題
指令用途什麼時候用
/memory查看目前已生效的三層記憶想確認 Agent 現在記得什麼
/memory pending查看尚待確認的推論記憶只有 Agent 自己推論、不是你明講時
/memory forget <ID>刪除不再適用的記憶規則改變或內容過時
/reflection pending集中查看 Wiki/例外提案你想批次整理知識時
/reflection show <ID>查看證據與完整提案決定核准前先看細節
/steer 內容Agent 執行中補充方向不用等任務做完才修正
07 / VERIFICATION

已完成的驗證

不是只改設定文字;門檻持久化、工具計數、靜默處理與 Telegram 按鈕都有程式與測試支撐。

$ agend health
● Fleet running
Instances: 24 healthy
Issues: 0
Stopped: 0

$ targeted tests
151 passed · 0 failed
門檻可持久化cadence.json 保存每個 Agent 的回合與工具計數,重啟不歸零。
三後端事件正規化Codex、Claude、Kiro 的工具紀錄轉成同一套中文進度。
Reflection 不再回報 no_action移除 report_result 回送,避免 topic 出現無意義訊息。
本機 Git 已收斂合併到本機 main;依蔡的規則,沒有 push 到官方遠端。
08 / BOUNDARIES

這輪刻意沒有做的事

避免重複 AgEnD 已有功能,也避免把範圍擴成另一套完整 Agent 平台。

不在本輪範圍
  • 重啟後自動續做未完成任務
  • 完整歷史對話搜尋
  • 新增 /queue:AgEnD 本來就會排隊
  • 新增 /interrupt:沿用既有中斷按鈕與 /cancel