我是 hugfeature,有测试开发背景,目前关注 AI Engineering Reliability / Agent Reliability。
这里研究 AI 系统从生成、执行、验证到交付过程中的可靠性问题,记录真实项目中的方法、实验、失败案例与可复用工具。
我关注的问题
- 执行受控:Agent Harness 如何管理工具调用、状态、权限与异常。
- 结果可验证:AI Testing / AI Eval 如何连接 Trace、Evidence 与独立验证。
- 失败可回归:如何把真实失败沉淀为 Failure Corpus、Regression 与 Quality Gate。
从哪里开始阅读
从 Agent Harness:从入门到 Reliability 开始建立整体认识,再通过专题与标签追踪具体问题。
开源项目
-
Engram:Agent Continuity · 探索任务中断后的状态恢复与执行连续性。
-
Drift:Agent Runtime Observability · 关注执行过程中的任务偏移与可观测性。
找到我
- GitHub:hugfeature
- 公众号:runtime质量论
- 订阅:RSS / Atom
欢迎通过网站 GitHub Issues反馈文章问题或交流实践。