AthenaPublic 是一个本地优先的 agentic PKM(个人知识管理)系统,定位是"任何 LLM 的记忆层与治理层"。核心理念是: Own the state. Rent the intelligence. Platforms forget. Athena doesn't. 把记忆搬到本地 Markdown 文件,换模型不丢记忆,记忆会随 ses…
仓库攻略
306 篇 · 305 个项目 · 评测基准
secondbrain 是一个个人 agentic OS(操作系统级框架),核心理念是"把 AI 助手做成你机器的操作系统"。通过本地文件智能 + 工作流自动化 + 多模态消息平台通信,完成从文件处理、代码执行、邮件管理到网页搜索的全套任务。 核心架构分 10 个模块: 1. Attachment Parsing — 解析各类附件(图片/文档/音频等) 2.…
FrontierAgent 是 ApodexAI 开源的一个agent 运行时 + 终端产品 + 评测套件三位一体项目,定位是"长程研究代理和基于文件工作的完整解决方案"。核心由三层组成: 配套 Apodex 商业平台(API Key 接入),也支持自托管 SGLang 模型。 长程 agent 任务长期面临几个痛点: 1. 缺乏结构化并行:传统 ReAct…
LongHorizonHarness 是一个长周期计算机使用(Computer Use)Agent 执行框架。它不训练新模型,而是围绕已有的 Agent(如 Claude Code、OpenCode、DeepSeek Harness)构建一个可靠的"执行验证恢复"循环,让 AI Agent 能在桌面应用和 CLI 环境中连续工作数十小时、可靠地完成复杂工作流…
SmolVM(smolmachines/smolvm)是一个开源的轻量级 microVM 运行时,专门解决 AI Agent 执行 LLM 生成代码时的隔离问题。由 Aniket Maurya 与 Celesto AI 团队开发,Apache 2.0 开源协议,2026 年 4 月 21 日正式发布,GitHub 发布首日即获得 482 个 HN 点。 官方…
这是 Victor Dibia(Microsoft Research 首席研究软件工程师、AutoGen 与 AutoGen Studio 作者)所著《Designing MultiAgent Systems: Principles, Patterns, and Implementation for AI Agents》(2025)的官方配套代码仓库。仓库核…
内容待复核
hitcslj/Awesome-AIGC-3D · 上手攻略
这是一份由香港科技大学(HKUST)团队维护的 AIGC 3D 论文精选列表,当前版本(v2.0,202604)已升级为一份生产导向的 3D 生成综述,通过二维分类法系统整理了从数据基座到场景组装的完整 3D AIGC 论文图谱。 核心定位:不是代码仓库,而是一份持续更新的 living survey,帮你快速定位某个子领域(如"文本生成角色骨骼绑定"或"世…
DARE(Declarative Autonomous Research Engine)是一个 AI 原生科研编排系统,宣称"不是帮你做研究的工具,而是研究者本身"。900+ 纯 Markdown 格式 skill 组成 10 个可自由组合的研究包,按 4 层指挥链架构(Campaign → Strategy → Tactic → SOP)组织,配有 6 个…
DSpark(Decoding Spark)是 Liquid AI 为 LFM2.5 系列模型发布的推测解码(Speculative Decoding)draft 模型系列,覆盖三个尺寸: | Draft 模型 | 目标模型 | Draft 参数量 | |||| | LFM2.51.2BInstructDSpark | LFM2.51.2BInstruct …
主题 slug: xtip20260826promptinducedwasteharnesscost(论文无独立 GitHub 仓库,故按无主仓库命名规范) 论文全称:PromptInduced Waste in Coding Agents: Reasoning, Effort, Harness Design, and EndtoEnd Cost (arXi…
HFlow 是一个开源 SDK,专为机器人和 Physical AI 场景设计的多模态数据流水线工具。它的核心功能是:把原始的多模态 episode 数据(视频、状态、动作、时间戳、元数据)经过质量检查、转换、富化、筛选 curation,最终产出干净、可查询、带 provenance 的训练数据集。 一句话说清:HFlow 让机器人数据团队用普通 Pyth…
coderonion/awesomellmandaigc 是一个 LLM / VLM / VLA / AIGC 领域的精选资源列表(Awesome List),按 Framework(模型/训练/推理/量化/RAG)、Application(IDE/聊天机器人/具身智能/代码助手/知识库等)、Dataset、Learning Resources、Commun…
大语言模型的训练管线近代已从「预训练 + 后训练」两阶段演变为更复杂的多阶段流程。Midtraining 和 Continued Pretraining(CPT) 是夹在通用预训练与后训练(SFT / RL)之间的两个中间训练阶段,都是在已有一个预训练好的基座模型基础上,继续用 nexttoken prediction 目标在大规模文本数据上进行训练——但二…
CAID(Centralized Asynchronous Isolated Delegation)是一个面向长程软件工程任务的多 Agent 协调范式,由卡内基梅隆大学(CMU)研究团队提出,发表在 arXiv 2603.21489。核心思路是:将人类软件工程中的成熟协作基础设施(git worktree、branchandmerge、测试验证)直接映射到…
x64dbgMCPServer 是一个将 x64dbg 调试器通过 MCP(Model Context Protocol) 协议暴露为 HTTP 服务的原生插件。使用 Zig 语言编写,零外部依赖,一个插件文件同时支持 x32 和 x64 架构。连接任何 MCP 兼容的 AI 助手(如 Claude Code),即可通过自然语言控制 x64dbg:设置断点、…
自检:双轨 ✓(机制 + 工程路径)/ ⚠️ 数字核验 3 处(85 crate / ~340K 行 / 368 组测试 / 4.61s 响应均来自仓库自述,未独立复测)/ 私域污染 SUM=0 / CJK 估算 ~1700 / verifiability:核心 URL 已 fetch,LLM 端到端实测数据仅仓库自报。 Apeireth 自称 "AGI o…
AngouriMath 是一个开源、跨平台的符号代数库,使用 C# 开发(同时支持 F# 和实验性 C++),可同时用于生产项目和科研场景。与纯数值计算库不同,AngouriMath 处理的是符号运算——可以理解 x^2 + sin(y) 这样的数学表达式,自动求解方程、求导求积、化简多项式、生成 LaTeX,并编译为高效的原声 Lambda 函数。项目同时…
dairai/wikisft 是一个配套仓库,完整复现了 @omarsar0(elvis)发表在 X 上的文章《Automating LLM FineTuning with Fireworks Agent》的数据构建流程。 核心思路来自 Andrej Karpathy 的 LLM Wiki 概念:把个人知识库的"输出风格"通过 SFT 微调蒸馏进模型权重,而…
xbergio/htmltomarkdown 是一个高性能、CommonMark 兼容的 HTML 到 Markdown 转换引擎。Rust 写核心,对外暴露 16 种语言绑定(Rust、Python、Node.js、WASM、Java、Go、C#、PHP、Ruby、Elixir、R、Dart、Kotlin Android、Swift、Zig、C ABI)。…
wshzd/AwesomeAIGC 是一份中文 AIGC 资料汇总型仓库,以「论文分享 / 访谈 / 模型评测 / 行业动态」为单位收录条目,附带外链(arXiv、知乎、微信公众号、B 站等)。与 f/awesomechatgptprompts、Hannibal046/AwesomeLLM 这类以英文为主的清单相比,它的定位是中文圈 AIGC 早期热度阶段的…
CORAL 是一个面向「自动研究 / 自动进化」场景的多智能体基础设施。它不是某个具体模型,而是把"让多个 coding agent 持续跑实验、共享笔记、互相学习、迭代解法"这件事做成一套可以一键拉起的运行时:把现有代码库喂给它,再配一个打分器(grader),CORAL 就接管剩下的活——隔离工作区、跑评估、维护共享状态、调度多 agent 协作。 原生…
SynaLinks/synalinksskills 是一套面向 AI 编程 Agent 的 SKILL.md 技能包,专门教 Claude Code、Codex、OpenCode、pi 等主流 coding agent 如何写出符合 SynaLinks 框架规范的代码。技能本身是一个标准化的 SKILL.md 文件,基于 Anthropic 主导的 Agen…
MindPipe 是一个统一的 LLM/VLM 模型压缩评估框架,用单一 main.py CLI 驱动 11 种量化方法、7 种剪枝方法、压缩微调联合流程,以及 PPL / lmevalharness 零样本 / VLMEvalKit 多模态三类评估。核心设计理念是:一次配置,全流程可复现。 ⚠️ 注意:本仓库同时支持 NVIDIA GPU 和华为昇腾 NP…
WISP(Workspace for Intelligent Scientific Practice)是一个开源、本地优先的桌面 AI 科研工作台,将文献检索、Python/R 执行、~80 个科学数据库查询、AI 模型调用集成在一个项目中,支持 SSH/WSL/本地 GPU 多种计算后端,数据和凭证保留在本地不传云端。 AI 辅助科研工具普遍存在两个问题:…
LFM2.5 QAD(QuantizationAware Distillation)是 Liquid AI 发布的一种训练时量化蒸馏技术,原理是让一个高精度 teacher 模型直接蒸馏到一个量化后的 student 模型,而非先训练好再事后量化(PTQ,PostTraining Quantization)。 4 个 LFM2.5 尺寸均发布 QAD Q4_…
AwesomeLLMsforVulnerabilityDetection 是一个社区维护的精选论文 / 项目 / Agent Skill 索引,专注于"用大语言模型做软件漏洞检测"这个交叉方向。仓库由 huhusmang 维护,README 主表只展示 2025 年及之后的论文,2024 年及之前的单独归档在 docs/papers_archive.md,分…
Code Mode(@utcp/codemode)是让 AI Agent 通过执行代码而非传统 JSON toolcalling 来调用工具的库。核心思路:给 Agent 一个能写 TypeScript 代码的沙盒执行环境,Agent 在代码里直接调用 MCP/UTCP 工具,一行代码替代传统方案的 15+ 次工具调用轮次。 Apple ML、Cloudfl…
MetaScreener 是一款开源的 AI 驱动系统评价(systematic review)筛选工具。它利用多个开源大语言模型组成并行投票 ensemble,对文献标题和摘要进行批量筛选,决定"纳入"或"排除",并附带置信度评分和不确定性量化。核心设计理念是:不用单一模型做决策,而是让 4+ 个模型同时审阅,通过置信度校准和分层决策路由,用机器替代人工完…
claudedb 为 Claude Code 提供持久化记忆层,解决每次新会话都要重新解释代码库背景的痛点。它在本地记录你与 Claude 的对话历史、代码理解结论和项目决策,新会话时自动注入上下文,Claude 无需再靠"考古式 grep"自行推断。 核心思路:capture(记录)+ recall(回填)+ code graph(代码图),三轨并行运作。…
Artificial Analysis Search Index(搜索 API 指数)是一个专门针对 AI Agent 搜索工具 的评测基准,由 AI 数据分析平台 Artificial Analysis(AA)于 2026 年 8 月 18 日正式发布。它的核心思路非常干净——用同一个 Agent 环境(模型、工具调用上限、评测任务完全相同),只替换底层的…