给 AI 智能体装了个“黑匣子”,3 秒定位谁该背锅

简介: Agent Blame-Finder 是专治多智能体系统“甩锅难题”的开源黑匣子工具。基于IETF草案JEP/JAC,3秒精准定位故障责任方,支持加密签名、因果链追溯与零侵入集成,堪称AI世界的`git blame`。

凌晨三点的噩梦

“喂,生产环境崩了,数据库被删了。你知道是哪个 Agent 干的吗?”

PM Agent 说它给的需求没问题。
Coder Agent 说它完全按代码写的。
Verifier Agent 说它根本没收到输出。

你翻了几千行日志,啥也没找到。

这就是多智能体系统的问责黑洞

所以我给 AI 智能体装了一个 “黑匣子” —— Agent Blame-Finder
它能在 3 秒钟内告诉你:锅在谁那儿。


它能干什么?

一条命令,直接出结果:

$ blame-finder blame incident-abc123

🎯 甩锅结果:Coder-Agent
💡 原因:输入的需求没问题,但输出的代码不符合预期
🔗 责任链:
   ✅ PM-Agent – 成功
   ❌ Coder-Agent – 失败
   ⏳ Verifier-Agent – 未执行

不再扯皮,不再翻日志。每个决策都有加密签名,谁也别想赖账。


原理很简单:给每个 Agent 发一个“行车记录仪”

Agent Blame-Finder 实现了两个 IETF 互联网草案:

  • JEP(Judgment Event Protocol):一个极简的、带加密签名的日志格式
  • JAC(Judgment Accountability Chain):通过 task_based_on 字段,把每个决策链接到它的父任务

每个 Agent 每次决策,都会生成一张 JEP 收据

{
   
  "verb": "J",
  "who": "Coder-Agent",
  "when": 1742345678,
  "what": "sha256:代码的哈希值",
  "task_based_on": "父任务的哈希值",
  "sig": "Ed25519 签名"
}

四个动词(J判断、D委托、T终止、V验证)就能描述任何问责流程。


集成有多简单?一行装饰器

from blame_finder import BlameFinder

finder = BlameFinder(storage="./blackbox_logs")

@finder.trace(agent_name="Coder-Agent")
def write_code(requirement: str) -> str:
    # 你的原有代码不用改
    return "print('hello world')"

# 哪天出问题了:
print(finder.blame(incident_id="task_123"))

装饰器会自动完成哈希、签名、存储、链式关联。
零侵入,真·即插即用。


为什么值得关注?

没有 Blame-Finder 有 Blame-Finder
手动翻几小时日志 blame-finder blame <id> 秒出结果
“大概是 Agent X 的锅” 扯皮 加密证据,无法抵赖
没有审计记录 JEP 收据,不可篡改
因果关系断裂 完整的 task_based_on 决策树

它就是 AI 智能体世界的 git blame

而且它基于 IETF 草案,不是某个公司的封闭产品——它是未来信任基础设施的一部分。


后续计划

  • ✅ Rust 核心引擎(高性能)
  • ✅ Python / TypeScript SDK
  • 🚧 LangChain / CrewAI 官方适配器
  • 🚧 可视化面板(blame-finder dashboard 已经能用)
  • 🚧 一键导出 PDF/HTML 甩锅报告

现在就试试

pip install agent-blame-finder

然后启动可视化面板:

blame-finder dashboard

你会看到一个像 Git 图一样的因果树,每个 Agent 的决策链路一目了然。


开源地址

GitHub: https://github.com/hjs-spec/Agent-Blackbox

MIT 协议,欢迎:

  • 提 bug 和 feature
  • 完善文档
  • 提交代码
  • 集成到各种 Agent 框架
相关文章
|
4月前
|
弹性计算 安全 API
【三种方案】Hermes Agent 云端一键部署指南
Hermes Agent 是 Nous Research 推出的开源自主智能体框架,具备持久化记忆与自我学习闭环:可自主创建、优化技能,并跨会话调用记忆,真正“越用越聪明”。本文提供阿里云三种一键部署方案(计算巢/无影/轻量应用服务器),助力大家快速上手!
1724 2
|
4月前
|
人工智能 JavaScript Ubuntu
低成本搭建AIP自动化写作系统:Hermes保姆级使用教程,长文和逐步实操贴图
我带着怀疑的态度,深度使用了几天,聚焦微信公众号AIP自动化写作场景,写出来的几篇文章,几乎没有什么修改,至少合乎我本人的意愿,而且排版风格,也越来越完善,同样是起码过得了我自己这一关。 这个其实OpenClaw早可以实现了,但是目前我觉得最大的区别是,Hermes会自主总结提炼,并更新你的写作技能。 相信就冲这一点,就值得一试。 这篇帖子主要就Hermes部署使用,作一个非常详细的介绍,几乎一步一贴图。 关于Hermes,无论你赞成哪种声音,我希望都是你自己动手行动过,发自内心的选择!
4856 29
|
5月前
|
存储 人工智能 关系型数据库
OpenClaw怎么可能没痛点?用RDS插件来释放OpenClaw全部潜力
OpenClaw插件是深度介入Agent生命周期的扩展机制,提供24个钩子,支持自动注入知识、持久化记忆等被动式干预。相比Skill/Tool,插件可主动在关键节点(如对话开始/结束)执行逻辑,适用于RAG增强、云化记忆等高级场景。
1348 56
OpenClaw怎么可能没痛点?用RDS插件来释放OpenClaw全部潜力
|
4月前
|
Java 大数据 双11
一张图看懂 Java 能干什么——从淘宝下单到双11抢货,背后都是它
本文专为Java零基础小白打造,用通俗比喻讲清Java本质(“万能翻译官”)、跨平台特性及核心优势;解析其在电商、支付等真实场景的应用;破除“Java已死”误区,结合数据说明其持续强势;并给出清晰入门路径与实用学习建议,助你科学起步。
一张图看懂 Java 能干什么——从淘宝下单到双11抢货,背后都是它
|
4月前
|
开发框架 Java 数据库连接
一张图讲完Java 30年发展史,看完彻底搞懂版本演进
这篇Java版本演进指南,用一天时间理清30年发展脉络:从JDK 1.0“一次编写,到处运行”,到JDK 8函数式革命(Lambda/Stream),再到JDK 17/21 LTS新标配(var/record/虚拟线程)。帮你告别版本困惑,读懂面试考点,选对生产版本。
一张图讲完Java 30年发展史,看完彻底搞懂版本演进
|
4月前
|
人工智能 机器人 API
阿里云服务器玩转OpenClaw教程|免费领6月云服务器+配置+飞书接入+让龙虾成为公众号自动化智能分身指南
很多AI爱好者因为缺少稳定服务器,无法长期运行OpenClaw智能体。本文带来一套**零成本阿里云服务器部署方案**,手把手教你搭建OpenClaw环境,并将其改造成可以24小时运行的**公众号智能分身**,实现热点聚合、内容拆解、选题生成、公众号自动发布等全流程自动化能力。
569 24
|
4月前
|
人工智能 机器人 关系型数据库
阿里云RDSClaw介绍:核心优势、使用场景与免费试用开通步骤
RDSClaw是基于阿里云推出的开源OpenClaw构建的数据库原生AI Agent服务,通过RDS多引擎数据库生态,为企业提供数据持久记忆、专业技能矩阵、全面的可观测指标及安全的管控审计能力。RDSClaw支持自然语言交互,实现数据查询、性能诊断、安全事件响应等全场景智能运维,且支持个人微信、钉钉等五类IM通道一键接入。现提供15天免费试用,到期可享包年6折优惠,助力企业低成本快速落地AI能力。
491 21
|
4月前
|
机器学习/深度学习 人工智能 自然语言处理
大模型应用:医疗视角看脑电图新应用:大模型让脑电波直观的表达.79
本文介绍脑电图(EEG)与大模型融合的前沿应用:无需开刀,仅通过头皮电极采集脑电信号,即可实时解码“想喝水”“想说话”等大脑意图,并转换为自然语言文字。该技术突破传统诊断边界,已在渐冻症沟通、神经康复和脑机交互中落地,兼具无创性、实时性与临床实用性。
325 17
|
4月前
|
人工智能
【钉钉会议 | 日程 Skill】让 Agent 真正帮你「把时间排进钉钉」
钉钉日程助手技能,打通“找人→约时→订室→发邀→跟进”全链路。支持查空闲、抢会议室、一键建会(含视频)、签到链接推送、周期例会自动排期,让AI真正驱动协作闭环。(239字)
625 15
|
4月前
|
数据采集 人工智能 缓存
ModelEngine思想落地指南:用“智能体 + 插件”构建可复用AI应用.76
ModelEngine是一种AI应用开发范式,通过角色化智能体分工、插件化工具集成与双模式(低代码+代码)开发,解决重复造轮子、流程碎片化、技术门槛高等痛点,实现高效、灵活、可复用的AI应用构建。
402 13