Back to home@hanhan1137

feedback-loop-dsh

Feedback learning loop skill for DSH: log feedback, keep consistent stances, full persistence chain (DSH-adapted from feedback-loop)

Stars
0
Language
Created
Aug 21, 2026
Updated
Aug 21, 2026

Introduction

feedback-loop-dsh 🔁(DSH 适配版 · 反馈学习循环)

feedback-loop(开源版)的 DSH(DeepSeek Harness)适配版:把用户的评价(称赞/批评/共识/改主意)变成 agent 的行为进化——不只是一条日志,而是「立场一致 + 落盘可检索 + 越用越贴合」的完整机制。

OpenClaw 用户请用上游版 hanhan1137/feedback-loop;本仓库 = DSH 社区分发版。

核心能力

  • 🔁 反馈学习循环:正反馈固化、负反馈反思根因、达成共识写死防横跳
  • 🧠 强度分级:随口夸 → 强指令,六档强度走不同处理路径,不小题大做也不漏大事
  • 📦 四步落盘链:feedback-log → conclusions → 长期记忆 → 验证可检索(防止结论只活在会话里、任务一回收就消失)
  • 🔍 触发词消歧:"记住了/有问题"先判是否反馈,宁可不误触
  • 🛡️ 回滚保护:改机制/记忆文件前 git 快照,出错精确回滚

安装(DSH)

# 方式一:克隆到 DSH skills 目录
git clone https://github.com/hanhan1137/feedback-loop-dsh.git ~/.dsh/skills/feedback-loop-dsh

# 方式二:直接下载 SKILL.md(纯 Markdown,零依赖)
mkdir -p ~/.dsh/skills/feedback-loop-dsh
curl -L https://raw.githubusercontent.com/hanhan1137/feedback-loop-dsh/main/SKILL.md -o ~/.dsh/skills/feedback-loop-dsh/SKILL.md

装完重启 dsh 会话即可生效。对 DSH 说「这次做得很好,记住」或「有问题」,即触发反馈循环。

怎么用

  1. 用户对输出/行为给出评价(称赞/批评/共识/改主意)
  2. DSH 按「反馈强度分级表」定级 → 走对应路径
  3. 强指令/强负反馈走四步落盘链(feedback-log → conclusions → 长期记忆 → 验证可检索)
  4. 每次开口前自查 feedback-log「已达成结论」区,立场一致不横跳

与上游的差异

ADAPTATION.md:去掉 OpenClaw 专属路径约定(workspace/、memory/、MEMORY.md、AGENTS.md),全部改为平台中性路径(工作区根目录、记忆目录、长期记忆文件);name: feedback-loop-dsh 匹配目录名(Agent Skills 标准硬规则)。

文件结构

feedback-loop-dsh/
├── SKILL.md                      # 主文档(v1.0.0)
├── README.md                     # 本文件
└── ADAPTATION.md                 # 与上游差异说明

版本 1.0.0 · 基于 feedback-loop 开源版(openclaw-ui-theme-coach 同款发布模式)· 2026-08-21 发布