seaofokhotskquakerism746/dabench-rlm-eval
- 类型:github
- 标识:seaofokhotskquakerism746/dabench-rlm-eval
- 链接:https://github.com/seaofokhotskquakerism746/dabench-rlm-eval
- 主题:agent, rag, llm-infra, evaluation
- 主分类:evaluation
- 形态:benchmark
- 分类:ai
- Stars:0
- 周增:+0
- 语言:Python
- 最近提交:2026-08-11
- 简介:Benchmark DSPy Recursive Language Models on DABench data analysis tasks with automated scoring for iterative code-based evaluation
- 上次采集:2026-08-11
- 首次采集:2026-08-11
- 待LLM分类:否
- 成熟度:experimental
- 简介中文:在 DABench 数据分析任务上对 DSPy RLM(Recursive Language Models)进行基准测试,使用自动评分实现基于代码的迭代评估
- 来源文件:
- [GitHub Search]