seaofokhotskquakerism746/dabench-rlm-eval

  • 类型:github
  • 标识:seaofokhotskquakerism746/dabench-rlm-eval
  • 链接:https://github.com/seaofokhotskquakerism746/dabench-rlm-eval
  • 主题:agent, rag, llm-infra, evaluation
  • 主分类:evaluation
  • 形态:benchmark
  • 分类:ai
  • Stars:0
  • 周增:+0
  • 语言:Python
  • 最近提交:2026-08-11
  • 简介:Benchmark DSPy Recursive Language Models on DABench data analysis tasks with automated scoring for iterative code-based evaluation
  • 上次采集:2026-08-11
  • 首次采集:2026-08-11
  • 待LLM分类:否
  • 成熟度:experimental
  • 简介中文:在 DABench 数据分析任务上对 DSPy RLM(Recursive Language Models)进行基准测试,使用自动评分实现基于代码的迭代评估
  • 来源文件
  • [GitHub Search]