adepeju4/attest

  • 类型:github
  • 标识:adepeju4/attest
  • 链接:https://github.com/adepeju4/attest
  • 主题:agent, rag, evaluation, llm-infra
  • 主分类:agent
  • 形态:model
  • 分类:ai
  • Stars:17
  • 周增:+0
  • 语言:Python
  • 许可:MIT
  • 最近提交:2026-08-13
  • 简介:Evidence-grounded evaluation for AI agents — verifies each claim against the agent's real tool outputs (constrained, evidence-grounded model judgment, not holistic LLM-judge guesswork), with confidence intervals.
  • 上次采集:2026-08-14
  • 首次采集:2026-08-14
  • 待LLM分类:否
  • 成熟度:experimental
  • 简介中文:面向 AI agent 的基于证据的评估——将每条断言与 agent 真实工具输出进行核对(受约束、基于证据的模型判断,而非整体式 LLM 评判的猜测),并附带置信区间。
  • 来源文件
  • [GitHub Search]