Miso TTS 是 Miso Labs 开发的一个80 亿参数高表现力文本转对话语音模型(8B parameters),灵感来源于 Sesame 的 CSM(Conversational Speech Model)架构。它使用 RVQ Transformer( Residual Vector Quantization Transformer)架构,结合 L…
仓库攻略
264 篇 · 261 个项目 · 数据与向量库
iflytek/skillhub 是科大讯飞旗下团队开源的企业级私有 Agent Skill 注册与管理系统。它让组织可以在自己的防火墙后面搭建一个私有化的"npm",用来发布、发现、审核、版本化管理 AI Agent 的 Skill 包,并配有完整的 RBAC 权限控制与审计日志。 企业引入 AI Coding Agent 后,团队成员会积累大量 Prom…
google/skills 是 Google 官方维护的 Agent Skills 开源集合(npx skills add google/skills),覆盖 Google Cloud 全产品线(包括 GKE、BigQuery、Gemini API、Cloud SQL、Spanner、Cloud Logging 等),以及 Google Workspace(…
Archify 是一款面向 AI Agent 的架构图生成 Skill(支持 Raven、Cursor、Claude Code、Codex CLI、OpenCode),通过自然语言描述或代码仓库分析,自动输出可交互的 HTML 系统地图,支持五种图类型、多种视觉主题,并可直接导出 PNG / SVG / WebM / 1200×630 分享卡片。 其核心特点…
trycompai/crm 是一个以 AI Agent 为核心的 CRM 系统,核心理念与所有传统 CRM 完全不同:大多数 CRM 是"数据库前面加表单",AI 版不过是在表单旁边加了个聊天框。trycompai/crm 反其道而行——Agent 才是产品,数据库只是它的笔记本。 该系统由两个独立进程组成: Agent 有 18 个内置工具(read_cr…
mcpcontextforge(README 自称 ContextForge)是一个由 IBM 开源的 AI Gateway / Registry / Proxy:它把任意数量的 MCP(Model Context Protocol)服务器、A2A(AgenttoAgent)服务器、REST/gRPC 后端统一汇聚到一个端点后面,对 AI 客户端(Claud…
本攻略核验了 Jerry Liu 原帖中每项工程主张的来源与背景。Loop Engineering 作为 2026 年 AI 工程领域的核心实践,已有多篇高质量一手博客覆盖,以下内容以这些来源为主、原文为辅,冲突处以官方文档为准。 Loop Engineering(循环工程) 是 2026 年 AI Agent 工程领域崛起的一种新实践范式:与其让人一步步 …
QM 是一个多人 AI 编程智能体平台,设计目标是让一个 AI 编程智能体服务于整个公司,而非仅限于个人助手。与传统单人 Copilot 不同,QM 通过「scope(作用域)」机制实现多用户隔离与协作: 核心:TypeScript / Node.js,HTTP 层用 Fastify Slack 插件:Scaffolded with Bolt Web UI:…
smevals(全称 "small evals")是 Prime Radiant 实验室推出的开源 Python CLI 评测框架,主打轻量、可复制、以目录为评测单元的设计理念。MIT 许可证,由 Simon Willison 主导开发,定位是帮助开发者在小模型与高性价比方案中做出选择——而不必总是跑最贵的 frontier 模型。 核心理念来自官方博客原文…
2026 年 7 月 28 日,Model Context Protocol(MCP)发布了自 2024 年 11 月诞生以来最重大的规范更新——20260728,社区普遍称之为 MCP 2.0。官方博客(blog.modelcontextprotocol.io)明确将其定性为: MCP is transforming from a bidirectiona…
LLM Gateway 是一个开源的 LLM API 网关,作为应用层与多个 LLM 提供商之间的中间件,提供统一的 API 接口。开发者只需集成一次网关,后续可自由切换/混用 OpenAI、Anthropic、Google Vertex AI 等多种模型,无需逐一对接每个提供商的 SDK 和认证体系。 同时,它内置了用量追踪、成本分析和性能监控功能,让团队…
vllmmlx 是一个专为 Apple Silicon(M 系列芯片)打造的推理服务器,核心思路是:把 vLLM 在 CUDA 硬件上的核心优化(连续批处理、页级 KV 缓存、前缀缓存)移植到苹果的 MLX 框架上,通过 Metal 驱动统一内存直接跑模型,无需任何格式转换。 它同时暴露 OpenAI /v1/ 和 Anthropic /v1/message…
@openai/codexsecurity 是 OpenAI 官方发布的命令行工具(CLI)和 TypeScript SDK,专注于用大语言模型能力发现、验证并修复代码中的安全漏洞。与传统的规则匹配式 SAST 工具(如 Semgrep、CodeQL)不同,它由 GPT 系列模型驱动,能够理解代码上下文、推理漏洞利用路径,并给出可操作的修复建议。 简单说:C…
TypeDB 是一个用 Rust 写成的下一代数据库,主打"为系统而生,而非为记录而生"。它用一个概念数据模型(conceptual data model)把关系型、文档型、图数据库的优势合并在一起,避免传统 RDBMS 里的对象关系阻抗不匹配(objectrelational mismatch)——也就是 Java/Python 程序员写业务时经常吐槽的"…
Agently(pip install agently)是一个 Python GenAI 应用开发框架,主打"让模型输出稳定可控、让 AI 服务像后端服务一样可观测、可恢复"。它的核心抽象是 AgentExecution:把一次推理涉及的 prompt、策略、Actions、Skill 绑定、process 流、TaskContext 证据、结果视图统一收口…
VectorChord(扩展名 vchord)是 PostgreSQL 上一款面向向量检索的扩展,由原 pgvecto.rs 团队(TensorChord)迭代而来。它把向量索引、Rerank 和量化压缩统一塞进 PG 里,目标是把"亿级向量表"和"普通业务表"放在同一套关系型基础设施上跑,不再引入额外的专用向量库。 它有几条主线卖点: 兼容 pgvecto…
JabRef 是一款开源、跨平台的文献管理工具,诞生于 2003 年,专为需要管理 BibTeX 和 BibLaTeX(.bib)文献库的研究者设计。它并非另一个「通用文献管理器」,而是深度绑定 LaTeX 生态——所有文献库本质上市一个 .bib 纯文本文件,天然适合 Git 版本控制、Dropbox 同步和多作者协作。 它用 Java 编写(MIT 许可…
MCP Router 是一个桌面端(Desktop)的 MCP 服务器统一管理应用,自定位为 "Unified MCP Server Management App / MCP Manager"。Model Context Protocol(MCP)是 Anthropic 推出的"让 LLM 调用外部工具/数据源"的开放协议,过去一年 MCP 服务器数量爆炸—…
Bionic GPT 是一个自托管(onpremise)的 ChatGPT 替代品,定位企业内部的私有生成式 AI 平台。它用 Rust 写了一个高性能 Web Server,把 RAG、文档解析、模型路由、鉴权、审计、可观测性这些通常要自己拼装的"内部 ChatGPT 必备件"打包成一个可直接落到 Kubernetes 上的完整栈。 它不是单一服务,而是按…
代表攻略
LlamaParse Retrieval Harness:面向 Agent 的大规模文档遍历框架 · 干货攻略
LlamaParse Retrieval Harness 是 LlamaIndex(LlamaParse 平台)在 2026 年 6 月 29 日正式上线的一套面向 Agent 的文档遍历工具集,被定位为"2026 版 RAG"。它不再将文档检索视为一次性的语义搜索,而是把整个文档语料库暴露为一组类文件系统工具,让 Agent 能在单次推理循环内自由交替调用…
同类项目 2展开比较
同名 Awesome 仓库已合并展示,原攻略与详情链接均保留。
run-llama/llama_index
Stars 51,547
代表
run-llama/llama_index
Stars 51,547
2026 年 7 月 16 日,Anthropic 发表了论文 "Verbalizable Representations Form a Global Workspace in Language Models"(arXiv:2607.15495),由 Wes Gurnee、Nicholas Sofroniew 核心主导,联合作者达 16 人。作者使用一种新的…
opencodex 是一个轻量级本地代理服务,它的核心职责是把 OpenAI Codex 的 Responses API 请求"翻译"成任意 LLM 提供商能理解的协议,并在请求路径上支持 ChatGPT 账户池化管理。装好之后,你在 Codex CLI/App/SDK 或 Claude Code 里选什么模型,实际上都在走 opencodex 转发到 An…
codereviewgraph(简称 CRG)是一个本地优先的代码智能图谱工具,为 MCP(Model Context Protocol)兼容的 AI 编程助手和 CLI 环境设计。它的核心思路是:先把你的代码库解析成一张结构化的知识图谱(节点 = 函数/类/导入,边 = 调用/继承/测试覆盖),然后在 AI 做代码审查时只喂给它真正相关的文件,而不是把整个…
Retrieval Harness 是 LlamaIndex 在 2026 年提出的一种面向 Agent 的持久化检索架构模式,其参考实现为 runllama/legalkb(法律文档知识库 Demo)。 区别于传统的单次向量搜索 RAG,Harness 将文档知识库包装成一组类文件系统 API 工具(retrieve / findFiles / readF…
CSGHub 是 OpenCSG 团队开源的"LLM 资产管理平台",定位对标 Hugging Face:把模型(LLM/VLM)、数据集、Space 应用、代码片段当作一等资产,统一在一个平台上做上传、下载、版本管理、权限分发、推理部署和数据处理。整套系统由 Go(Gin)+ Rails 旧版迁移中的 Vue3 前端、PostgreSQL 元数据、Apac…
Apache Burr(incubating)是一个 Python 状态机框架,用来构建"会做决策的应用"——chatbot、agent、simulation、人机协作工具。它把应用建模成一张 state machine(状态机/流程图): Burr 的关键设计哲学是 "框架无关":它不规定你必须用哪个 LLM SDK、哪个 vector DB、哪个 age…
Apache Hamilton(incubating)是一个轻量的 Python 库,用"Python 函数即节点"的方式构建数据转换 DAG。它的核心思路是:你写普通的 Python 函数,函数参数的名字 = 它依赖的上游节点名,Hamilton 自动把这些函数拼成 DAG、并按依赖顺序执行。 举例: import pandas as pd def sig…
OpenLIT 是一个开源的 AI Engineering 平台,定位是"一站式把 LLM 应用从实验推到生产"。它把 OpenTelemetry 当作统一底座,向上提供 6 类核心能力: 1. 可观测性 SDK(Python / TypeScript / Go):对 50+ LLM provider、VectorDB、Agent 框架、GPU 做自动埋点(…
Zvec 是阿里巴巴通义实验室开源的进程内(inprocess)向量数据库,定位为"向量数据库领域的 SQLite"——直接以内嵌库的方式运行在你的应用程序中,无需部署独立的数据库服务进程。它基于阿里生产级 Proxima 向量检索引擎,支持稠密向量 + 稀疏向量 + 全文检索(FTS)混合检索,并内置 WAL 持久化、多进程并发读取等企业级特性。 当前版本…
pentestai(CLI 入口 ptai)是一个 AI 驱动的渗透测试框架。核心创新不是"发现更多漏洞",而是每个漏洞都必须被机器 Oracle 重复验证才能进入最终报告。思路借鉴 TruffleHog:TruffleHog 发现泄露密钥后实际登录验证,ptai 发现 Web 漏洞后实际重新触发一遍。一个 finding 停留在"候选"状态,直到 Orac…