adepeju4/attest
- 类型:github
- 标识:adepeju4/attest
- 链接:https://github.com/adepeju4/attest
- 主题:agent, rag, evaluation, llm-infra
- 主分类:agent
- 形态:model
- 分类:ai
- Stars:17
- 周增:+0
- 语言:Python
- 许可:MIT
- 最近提交:2026-08-13
- 简介:Evidence-grounded evaluation for AI agents — verifies each claim against the agent's real tool outputs (constrained, evidence-grounded model judgment, not holistic LLM-judge guesswork), with confidence intervals.
- 上次采集:2026-08-14
- 首次采集:2026-08-14
- 待LLM分类:否
- 成熟度:experimental
- 简介中文:面向 AI agent 的基于证据的评估——将每条断言与 agent 真实工具输出进行核对(受约束、基于证据的模型判断,而非整体式 LLM 评判的猜测),并附带置信区间。
- 来源文件:
- [GitHub Search]