2026 年 7 月 14 日上传至 arXiv 的一篇97 页大survey(arXiv:2607.13104),由 DAIR.AI 团队(Zhe Ren、Yimeng Chen 等)联合 Jürgen Schmidhuber 等人撰写。配套 GitHub 仓库 selfimprovingagent/awesomeSelfImprovingAgents 提…
仓库攻略
1121 篇 · 1106 个项目
iPolloWork 是 Codex 和 Claude Code 的下一代源码开放替代品,定位是"不只是帮你写代码,而是真正完成工作"。 核心特点: 源码可用(SourceAvailable,非 OSI 认可的开源):允许个人免费使用,3 人及以上使用需书面授权 Claude Code 和 Github Copilot workspace 这类产品,本质上还…
awesomezhuijufree 是一个免费无广告追剧资源导航仓库,由社区人工精选、每天自动检测资源有效性。收录范围涵盖在线影视、影视 APP、网盘搜索、磁力 BT、字幕、TVBox 配置地址、IPTV 直播源、会员拼团等,是一个影视资源的聚合索引。 核心特点: 完全免费,无广告(普通导航站的痛点就是广告满天飞) 人工精选,不是爬虫抓取的垃圾站堆砌 每日自…
《深入理解 AI Agent:设计原理与工程实践》(作者李博杰)是一本系统性阐述 AI Agent 的技术书籍,全书围绕核心公式展开: Agent = LLM + 上下文 + 工具 这个公式是全书的骨架,意思是:一个能用的 Agent,离不开大语言模型(LLM)、对上下文的精细管理、以及可调用的外部工具。三者缺一不可。 十章内容覆盖: | 章节 | 主题 |…
LangChain 于 2026 年 7 月 18 日在 X 宣布将其内部「软件工程 Agent 全链路工具栈」完全开源,CEO Harrison Chase 表示:「我们已经在内部建好了一整套软件工程 Agent 工厂,并把每个组件都开源了。」 这套体系由四个独立但可协同的工具组成: | 组件 | 定位 | 入口 | |||| | Dcode (Deep …
GPT5.6 是 OpenAI 于 2026 年 7 月 9 日正式发布的第五代 GPT 主线模型,采用了与前代完全不同的三级档位 + 多档推理努力度矩阵: 三档(Tier) | 档位 | 定位 | 输入价格 ($/1M tokens) | 输出价格 ($/1M tokens) | ||||| | Sol | 前沿旗舰,对应此前不带后缀的 GPT5 | $5…
Zvec 是阿里巴巴通义实验室开源的进程内(inprocess)向量数据库,定位为"向量数据库领域的 SQLite"——直接以内嵌库的方式运行在你的应用程序中,无需部署独立的数据库服务进程。它基于阿里生产级 Proxima 向量检索引擎,支持稠密向量 + 稀疏向量 + 全文检索(FTS)混合检索,并内置 WAL 持久化、多进程并发读取等企业级特性。 当前版本…
Canvas Editor 是一个基于 HTML <canvas API 构建的富文本编辑器(WYSIWYG),与传统的 contenteditable 方案完全不同。它完全接管渲染管线,在 Canvas 画布上绘制文字、表格、图片、公式等所有内容,从而实现跨浏览器像素级一致的排版输出。 核心技术特点: 渲染引擎基于 Canvas Draw,不依赖浏览器内置…
Sakana Fugu 是 Sakana AI 在 2026 年发布的多智能体编排系统,其核心是一个 7B 参数的 Conductor 模型。该模型不自己解题,而是像"管理者"一样动态决定: 调用哪些专家模型(worker pool 包含 GPT5.5、Gemini 3.1 Pro、Claude Opus 4.8 等) 每个 worker 分配什么任务 wo…
pentestai(CLI 入口 ptai)是一个 AI 驱动的渗透测试框架。核心创新不是"发现更多漏洞",而是每个漏洞都必须被机器 Oracle 重复验证才能进入最终报告。思路借鉴 TruffleHog:TruffleHog 发现泄露密钥后实际登录验证,ptai 发现 Web 漏洞后实际重新触发一遍。一个 finding 停留在"候选"状态,直到 Orac…
FlashAttention4(FA4)是 Tri Dao 团队发布的第四代 IOaware 精确注意力内核,针对 NVIDIA Blackwell 架构(B200/GB200)全面重新设计,同时保留对 Hopper(H100)的支持。FA4 以 CuTeDSL(NVIDIA CUTLASS DSL)编写,在运行时编译为 PTX/CUBIN,核心定位是解决 …
scrollworld 是一个 AI Agent Skill(技能),运行在 Claude Code、Codex 或任何兼容 SKILL.md 的 AI 编程助手内。它能为一任意品牌或行业构建「滚动穿越3D世界」的沉浸式落地页——访客滚动页面时,摄影机从场景外部俯冲进入内部,再无缝飞入下一场景,全称无剪辑,像 Apple's scrollthrough 产品…
这是 Decoding AI 杂志社出品的开源实战课程仓库,教你从零搭建一个"Second Brain AI 助手" —— 让你的 Notion / 网页笔记 / 文档作为个人知识库,配合 agent + RAG + 微调 + LLMOps,做出一个能聊你自己的笔记的生产级 AI 助手。MIT 协议、纯 Jupyter Notebook + Python、最…
ChainForge 是一个给 LLM prompt 做对抗测试的开源可视化编程环境(visual programming environment),学术出身 —— 作者 Ian Arawjo 在 Harvard HCI 组做博后期间发表(CHI 2024 论文 "ChainForge: A Visual Toolkit for Prompt Enginee…
Laminar(仓库路径 lmnrai/lmnr,官方域名 laminar.sh,品牌写作"Laminar"——注意跟流体力学的层流同名)是 为 AI Agent 量身打造的开源可观测性平台,由 YC S24 孵化的团队开发,Apache2.0 协议,主仓 ~3.1k Stars、TypeScript/Rust 混合栈,最近一次 release 验证于 20…
Vorssaint 是一款免费、开源的 macOS 菜单栏(Menu Bar)多合一工具箱。开发者自称「模块化瑞士军刀」——用一个菜单栏图标整合了原本需要安装十几个付费 App 才能获得的功能,全部运行在本地,无账户、无遥测、无订阅。 它不是传统意义上的单一功能 App,而是一个功能平台。每个功能(音量混音、系统监控、窗口管理、剪贴板历史等)都可以独立安装/…
AGiXT(AGI eXecution & Tasks)是一个 动态 AI Agent 自动化平台,定位是「多 AI provider 之上的中央神经系统」。它解决的核心问题是:让一套自然语言指令,能在 OpenAI / Anthropic / Google / Azure / 本地模型之间无缝切换,并自动编排复杂任务、执行扩展动作。 核心卖点: 仓库 3.…
TruLens 是 TruEra 公司(已被 Snowflake 收购)维护的、面向 LLM 实验和 AI Agent 的评估与追踪框架。它做两件事: 1. Instrumentation(埋点):用 OpenTelemetry 拦截你的 LLM / RAG / Agent 调用,把每一次 LLM 生成、检索、工具调用都落成结构化 OTEL span。 2.…
代表攻略
volcengine/OpenViking · 上手攻略
OpenViking 是字节跳动旗下火山引擎(Volcengine)开源的、面向 AI Agent 的「上下文数据库」(Context Database)。它用「文件系统范式(filesystem paradigm)」统一管理 Agent 运行所需的全部上下文:长期记忆(memory)、外部知识与资源(resources)、可调用的技能(skills)。 与…
同类项目 2展开比较
同名 Awesome 仓库已合并展示,原攻略与详情链接均保留。
volcengine/OpenViking
Stars 26,172
代表
volcengine/OpenViking
Stars 26,172
Acontext 是 memodbio 开源的 "Agent Skills 形式的记忆层"——把 agent 运行中学到的经验沉淀成可读、可编辑、可跨 agent 复用的 Markdown skill 文件。它不是又一个向量数据库,而是把"记忆 = skill 文件"做成一等公民:会话消息 → 任务完成事件 → LLM 蒸馏 → Skill Agent 写文…
LoRAX(LoRA eXchange)是 Predibase 开源的 多 LoRA 适配器推理服务器,目标是在一张 GPU 上同时服务成百上千个微调后的 LLM,而吞吐和延迟几乎不打折。它通过"动态加载适配器 + 异构连续批处理 + 适配器交换调度"三大机制,让一份基座模型(如 Mistral7B、Llama3、Qwen)被数千个不同任务的 LoRA 适配…
Agenta 是一个开源的 LLMOps 平台,把 LLM 应用从原型到生产所需的四件事压在一个工作流里:Prompt Playground(交互式调试)、Prompt/Cofig 管理(带版本和分支)、LLM 评估(人评 + 自动评估 + LLMasjudge)、可观测性(Tracing、成本、延迟)。代码以 TypeScript 为主、许可 NOASSE…
Sakana AI 在 ICLR 2026 发表了一篇非常有意思的论文:让一个小模型学会当「指挥家」,而不是自己下场干活。 传统多智能体系统的做法是:人类预先写好流水线(planner → coder → verifier),然后让模型按这个固定流程走。问题在于:不同任务复杂度差异巨大——简单事实问答根本不需要 5 步 pipeline,而复杂编程题可能需要…
Codex Dream Skin 是一个非官方的 Codex 桌面端主题美化工具。它通过本机 CDP(Chromium DevTools Protocol)循环注入方式,在不修改官方 .app / app.asar / WindowsApps 任何文件的前提下,为 Codex 换上自定义图片主题——包括 Banner 图片、低噪点背景、磨砂内容层,同时保留侧…
OpenKnowledge(内部包名 @inkeep/openknowledge)是一个 AI 原生的 Markdown 编辑器,同时也是一个 LLM Wiki 工具。它的定位是"Notion meets VS Code"——既有 Notion 般的 WYSIWYG(所见即所得)编辑体验,又保留 VS Code 式的本地文件夹操作和 Markdown 文件本…
Grok Build 是 xAI(马斯克旗下人工智能公司)发布的终端原生 AI 编程智能体(coding agent),用 Rust 编写,发布于 2026 年 5 月。定位与 GitHub Copilot 的 Claude Code、OpenAI 的 Codex CLI 同类,但打出三模态这张牌:交互式 TUI(满屏鼠标交互)、无头 CLI(脚本/CI 用…
VLMEvalKit(Python 包名 vlmeval)由上海人工智能实验室 OpenCompass 团队开源,是大型视觉语言模型(LVLM / VLM)的事实标准评估工具包。它的口号是 "一命令评测 220+ LVLM、80+ benchmark" —— 用户只写一个 generate_inner(),剩下的数据下载、预处理、推理、metric 全部由框…
lmmseval(Python 包名 lmmseval,前身为 LMMsEval)是 EvolvingLMMsLab 维护的"统一多模态大模型评估工具包"。目标只有一个:让"同一个模型 + 同一个 benchmark + 同一套参数"在两台机器上跑出来数字一致,并且能覆盖文本、图像、视频、音频四大模态的 100+ 任务、30+ 模型后端。 它脱胎于 Eleu…
llmtwincourse 是 Decoding AI Magazine(Paul Iusztin & Alex Vesa 团队)开源的免费工程课,目标是从零搭建一个能"模仿你写作风格"的生产级 LLM Twin —— 一套完整的端到端 LLM + RAG 系统,覆盖数据采集、CDC 同步、实时特征工程、SFT 微调、RAG 推理、Prompt 监控全部 6…
opendilab/awesomeRLHF 是上海人工智能实验室 OpenDILab 维护的 "RLHF 精选资源列表",延续 awesome 系列的策展风格:把强化学习与人类反馈(Reinforcement Learning from Human Feedback)相关论文、代码库、数据集、博客、图书按时间线(2020 及以前 → 2026)梳理成一份可阅…