AnimeshShaw/GenIaC-SecBench

  • 类型:github
  • 标识:AnimeshShaw/GenIaC-SecBench
  • 链接:https://github.com/AnimeshShaw/GenIaC-SecBench
  • 主题:evaluation, risk, llm-infra
  • 主分类:evaluation
  • 形态:benchmark
  • 分类:ai
  • Stars:0
  • 周增:+0
  • 语言:Python
  • 许可:NOASSERTION
  • 最近提交:2026-08-31
  • 简介:Human-anchored security benchmark for LLM-generated Infrastructure-as-Code. 100 scenarios × 12 model configs = 1,196 artifacts scanned by Checkov/Trivy/KICS, compared against 634 human-written templates. Every model: 3.2–3.9× human vulnerability density. arXiv:2608.28021
  • 上次采集:2026-08-31
  • 首次采集:2026-08-31
  • 待LLM分类:否
  • 成熟度:experimental
  • 简介中文:基于人类基准的 LLM 生成 Infrastructure-as-Code 安全基准测试。100 场景 × 12 模型配置 = 1,196 个工件,由 Checkov/Trivy/KICS 扫描,并与 634 个人工编写模板对比。所有模型的漏洞密度均为人工的 3.2–3.9 倍。arXiv:2608.28021
  • 来源文件
  • [GitHub Search]