CAID(Centralized Asynchronous Isolated Delegation)是一个面向长程软件工程任务的多 Agent 协调范式,由卡内基梅隆大学(CMU)研究团队提出,发表在 arXiv 2603.21489。核心思路是:将人类软件工程中的成熟协作基础设施(git worktree、branchandmerge、测试验证)直接映射到…
仓库攻略
141 篇 · 141 个项目 · jay · 工程化
dairai/wikisft 是一个配套仓库,完整复现了 @omarsar0(elvis)发表在 X 上的文章《Automating LLM FineTuning with Fireworks Agent》的数据构建流程。 核心思路来自 Andrej Karpathy 的 LLM Wiki 概念:把个人知识库的"输出风格"通过 SFT 微调蒸馏进模型权重,而…
Zotero 元数据格式化插件(又称 Zotero Linter)——一款面向 Zotero 7 的开源插件,自动化批量修正文献条目的元数据字段。它不是"只警告不修复"的 lint 工具,而是直接原地修正,涵盖标题大小写、期刊缩写、作者姓名格式、DOI 规范化、语言检测、PDF 页数补全、学位论文信息等二十余类规则。 适用人群:需要维护干净学术文献库的研究者…
RTPLLM(RealTime PrefillDecode LLM)是阿里巴巴大模型推理团队开发的高性能 LLM 推理加速引擎,脱胎于 FasterTransformer,在其基础上融合了 TensorRTLLM 的部分 CUDA kernel 实现,并参考了 vLLM 的 PagedAttention 等设计。该项目已在阿里内部广泛落地,支持淘宝问问、淘宝…
Oleafly 是一款本地优先的 AI 辅助科研写作桌面应用,面向撰写学术论文、学位论文、技术报告的作者。它把编辑器、编译器、PDF 预览、Git 版本管理、文献工具和 AI 助手整合到一个应用里,同时让项目文件保持开放——任何时候都可以脱离 Oleafly、用任意编辑器或命令行工具继续工作。 它的定位是「Overleaf 的本地离线版 + Git 原生 +…
RAGSurvey 是一个按体系分类的 RAG 论文Awesome 列表,对应论文 RetrievalAugmented Generation for AIGenerated Content: A Survey(arXiv:2402.19473,2024 年 2 月,北大/北大深圳研究生院团队)。仓库按该论文提出的三层分类法,对 RAG 领域论文进行结构化整…
TrueForge 是 TrueFoundry 于 2026 年 8 月开源的 MIT 许可证 Agent Harness——运行在 LLM 周围的运行时层,把一个语言模型变成可真正跑在生产环境里的 Agent。它不挑模型、不绑云、不锁供应商,可以本地单进程(SQLite)运行,也可以 Docker Compose / Kubernetes 部署高可用集群。…
TeXMe 是一个极简的 JavaScript 工具,用于创建自渲染 Markdown + LaTeX 文档。它的核心思路是:在 .html 文件里写 Markdown 内容,然后在任意浏览器中打开——页面自带一行 <script 标签,就能自动把 Markdown 渲染成 HTML、把 LaTeX 公式渲染成 MathJax,整个过程无需任何构建步骤、服务…
Krasis 是一个混合 LLM 推理运行时,专注于在消费级显存受限的 NVIDIA GPU 上高效运行数百亿参数级别的 MoE(Mixture of Experts)大模型。它的核心设计目标是:让一张或两张普通游戏显卡(如 RTX 5090 32 GB、RTX PRO 6000 96 GB)就能跑得动原本需要 H100/A100 才能加载的千亿参数模型。 …
LaTeX.css 是一个极简 CSS 库(自称"almost classless"),只需在 HTML 页面中引入一行样式链接,就能让任意网站呈现出 LaTeX 文档的排版风格。项目基于 David Zollikofer 的 latexCSS,遵循 MIT 许可证开源。 它不是 JavaScript 框架,不是 React 组件库,不是静态站点生成器——只…
SJTUThesis 是上海交通大学学位论文 LaTeX 模板,由 SJTUG(上海交通大学 Linux 用户组)维护的开源项目。其底层依赖的文档类集 SJTUTeX 已收录至 CTAN,意味着用户无需手动下载宏包,通过标准 TeX 发行版即可使用。 该仓库本身是一个用户级示例模板(即写好的完整论文示例),包含公式、表格、算法、参考文献等常用排版示例;核心文…
binaryhusky/gpt_academic(GPT Academic)是一个为 GPT / GLM 等大语言模型打造的实用化交互界面,特别针对论文阅读、润色、翻译、写作场景深度优化。项目采用模块化插件设计,支持自定义快捷按钮、Python / C++ 项目剖析、ArXiv 论文翻译总结、LaTeX 全文翻译校对等30+ 功能,并行支持 ChatGPT、…
StarlightSearch/EmbedAnything 是一个用 Rust 构建的高性能、多模态 embedding 管道。它支持从文本、图片、音频、PDF、网站等多种来源生成向量嵌入,并与 Milvus、Weaviate、Elastic、SingleStore 等主流向量数据库无缝对接,核心卖点是零 PyTorch 依赖、低内存占用、流式索引,已在 E…
LFM2.52.6B 是 Liquid AI 在 2026 年 8 月初开源的一个 2.6B 参数端侧 Agent 模型,DeepSeekV4Flash0731 是 DeepSeek 同月发布的一个 284B 总参数 / 13B 激活参数 MoE 推理优化模型(20260731 发布)。2026 年 8 月 6 日,atomic.chat 在 4× RTX …
MinerU 是由 OpenDataLab(上海人工智能实验室关联开源组织)开发的高精度文档解析引擎,于 2024 年开源。其核心能力是:将 PDF、DOCX、PPTX、XLSX、图片、网页等复杂文档,转换为 LLM 可直接消费的 Markdown 或 JSON 格式,同时保留阅读顺序、标题层级、表格结构、公式 LaTeX 等语义信息。 MinerU 最早服…
mlabonne/llmcourse 是由法国机器学习工程师 Maxime Labonne 维护的一套免费、开源的大语言模型(LLM)学习路径仓库,GitHub Stars 超过 81,000(2026年8月)。它不是传统意义上的"课程",而是一份精心编排的知识图谱——包含路线图(roadmap)、Colab Notebook 实践代码、配套博客文章,覆盖从…
dshpluginwritingguard 是 DeepSeek Harness(DSH)的论文写作守卫插件,在论文撰写和修改过程中自动检测常见 AI 写作风格、修改残留、防御性表达与机械化句式,同时提供 Scholarship Lock 功能在 AI 润色时保护科研事实(数字、p值、图表编号等核心实体不被悄悄改动)。定位是学术写作 linter——不是"写…
2026 年 7 月 28 日,Model Context Protocol(MCP)正式发布了有史以来最大的一次协议版本更新,版本号 20260728。核心变化:MCP 从有状态的双向协议彻底改为请求/响应式的无状态协议。 附带 HTTP 路由增强、缓存指令、企业级授权加固、长任务扩展,以及一个正式的废弃政策窗口。 根据 MCP 官方博文,MCP 在各 T…
Zotero Actions & Tags(简称 AT)是 Zotero 的插件,赋予用户基于 Zotero 事件或自定义快捷键自动执行操作的能力。核心功能是"触发条件 → 自动动作":当你添加文献、打开条目、创建标注时,自动为条目打标签、复制链接、生成笔记、翻译标题摘要等。完全基于图形界面配置,无需写代码即可使用,也支持用户自定义 JavaScript 脚…
⚠️ 重要说明:原帖候选将本工作仓库写作 SakanaAI/Conductor,经核验该 GitHub 仓库返回 404(不存在或未公开)。本文以 arXiv:2512.04388 论文页面和 Sakana AI 官方博客 为权威来源;代码/模型权重是否公开 Release 需以上述官方渠道为准,本文不替代官方公告。 Sakana AI Conductor …
Claude Code Skill Factory 是一个用自然语言交互构建生产级 Claude Skills、Claude Code Agents、自定义 Slash Commands 和 LLM Prompts 的开源工具包。 简单说:你要写一个 Claude Skill,不用从零憋文档,直接回答几个问题,Factory Agent 帮你生成完整的 SK…
claudekitskills 是 mrgoonie 在 GitHub 上维护的一套 Claude Agent Skills 合集,托管于 ClaudeKit.cc(一个非 Anthropic 官方的 Claude 第三方服务平台)。这并非 Anthropic 官方产品,而是社区将高频使用场景封装为可复用的 Skill 工作流——每个 Skill 约等于一个…
2026 年,AI 社区出现了一个重要认知转向:Agent 的表现瓶颈不在模型本身,而在包裹模型的那层工程结构——Harness(驾驭层)。Harness 由 @omarsar0(Elvis,研究机构 DAIR.AI 联合创始人)提出,核心主张是:Agent 的工具调用行为由 Harness 决定,而非工具数量;Harness 的核心能力是决定何时不调用工具…
ClaudePrism 是一个 本地优先的离线科学写作工作空间,由 Tauri 2(Rust)构建的原生桌面应用,集成 LaTeX 编译(嵌入式 Tectonic)、Python 科学计算环境(uv)、以及 100+ 领域专项 Claude Skills(来自 KDense Scientific Skills 项目)。简单说:它把 OpenAI Prism …
rampstackco/claudeskills 是一个 Claude Skills 技能库,包含 103 个互相组合的模块化技能,覆盖从品牌策略、设计系统、内容生产、SEO、产品管理、前端开发到增长运营的完整网站生命周期。每一个 Skill 都是一个独立文件夹,内含 SKILL.md(指令 + YAML 元数据)以及可选的参考文件(模板、清单、工作示例)。…
AgentENV(简称 AENV)是 Kimi K3 模型背后用于大规模运行 Agent 执行环境的分布式平台,由 kvcacheai 团队开源。它的核心职责是:在大规模集群上同时调度成千上万个轻量级隔离沙盒(基于 Firecracker microVM),按需加载 OCI 镜像,让每个 Agent 任务在独立、可快启、可快停的环境中运行。 类比来说:如果 …
Google Workspace MCP Server(workspacemcp)是目前功能最完整的 Google Workspace MCP 服务器,通过 MCP(Model Context Protocol)协议将 AI 助手连接到 Google 全套生产力工具——覆盖 Gmail、Drive、Calendar、Docs、Sheets、Slides、Fo…
humanizerzhacademic 是一个专为 Claude Code 设计的 Skill(提示词库),核心功能是降低中文学术写作的 AIGC 检测率。它不是让 AI 写得更好,而是让 AI 写的东西读起来更像人写的——不是消除 AI 味,而是注入人类写作的真实感与随机性。 适用于:期刊论文、毕业论文、研究报告、中文学术写作润色。 ⚠️ 实验数据(来源 …
一个 Claude Code 插件市场 + 精选资源索引,收录 Agents(117个)、Commands(175个)、Hooks(28个)、Skills(26个)、Plugins(51个)五大类资源,帮助用户发现和安装 Claude Code 生态中的扩展包。 官方定位: "A plugin marketplace and discovery platfo…
一个 Claude Code Skill(方法论 + 配套脚本集),专注于"忠实复刻任意网站"——从单文件静态页到 WebGL 重前端,不靠 AI 臆测代码,全部走真源码逆向。 核心理念:AI 分析文档里的代码块,默认全是臆造的,必须用真源码逐行核对。作者用一个具体案例说明:一份 AI 分析把"光线球体解析交点 + SVG feDisplacementMap…