LaunchStack 是一个TypeScript AI 原生应用引擎,内置文档摄取、OCR、RAG、知识图谱、LLM 抽象、后台任务等模块,配有一个 Next.js 参考应用演示完整接线方式。 核心定位是:让开发者把 AI 能力嵌入自己的应用时,不必从零组装 LangChain + PostgreSQL + 向量数据库 + 任务队列,而是直接用 Launc…
仓库攻略
15 篇 · 15 个项目 · 数据与向量库 · tom
claudedb 为 Claude Code 提供持久化记忆层,解决每次新会话都要重新解释代码库背景的痛点。它在本地记录你与 Claude 的对话历史、代码理解结论和项目决策,新会话时自动注入上下文,Claude 无需再靠"考古式 grep"自行推断。 核心思路:capture(记录)+ recall(回填)+ code graph(代码图),三轨并行运作。…
Vespa 是 Yahoo(现 Verizon Media)开源的企业级 AI 搜索与推荐平台,定位并非单纯的向量数据库,而是将向量检索、全文搜索、结构化数据查询、分布式模型推理全部整合在单一分布式引擎内。用户无需组合 Elasticsearch + Milvus + 推理服务等多家基础设施,一套 Vespa 就能完成从数据索引到结果排序的全部工作。全球生产…
Vanna 是一个基于检索增强生成(RAG)的 TexttoSQL 开源框架,帮助开发者用自然语言查询 SQL 数据库。v2.0 是完全重写版本(与 v0.x 不兼容),核心定位从「RAG + LLM 生成 SQL」升级为「面向企业的用户感知型数据分析 Agent 平台」——每个组件都知道当前操作用户是谁,并自动做行级别权限过滤。 核心能力: Stars:约…
Pyzotero 是 Zotero API 的 Python 客户端,由 Zotero 社区维护,支持对个人库和团体库进行完整的增删改查操作。它提供 Python 库、CLI 工具和 MCP 服务器三种使用形态,适合需要将 Zotero 文献管理自动化接入 AI 工作流的用户。 uv add pyzotero pip install pyzotero con…
WhoDB 是一个浏览器端数据库工作空间,支持探索数据库表结构、编辑数据、运行查询、理解 schema 关系图。它用 Docker 一行命令启动、自托管免费(Apache 2.0)、也提供桌面 App 和终端 CLI。对 AI 编程场景,它还内置了 Ollama / OpenAI / Anthropic / LM Studio 的自然语言查询能力——用英文提…
xuchonglang/investingforbeginners 是小隐寺投资百科的官方公开索引仓库,面向中文投资者,系统梳理了美股、期权与加密货币的完整知识框架。仓库不提供"买什么"的建议,而是帮助读者理解"自己正在买什么、风险来自哪里、投入资金前应该核对哪些信息"。 核心定位:用成熟且资料丰富的美股市场建立股票/ETF/财报/资产配置的基础框架,同时把…
Zvec 是阿里巴巴通义实验室开源的进程内(inprocess)向量数据库,定位为"向量数据库领域的 SQLite"——直接以内嵌库的方式运行在你的应用程序中,无需部署独立的数据库服务进程。它基于阿里生产级 Proxima 向量检索引擎,支持稠密向量 + 稀疏向量 + 全文检索(FTS)混合检索,并内置 WAL 持久化、多进程并发读取等企业级特性。 当前版本…
ostaxonomy(Marble Skill Taxonomy)是一个开放的小学阶段全科学习知识图谱,由教育科技公司 Marble 于 2025 年中开源发布。它把一个孩子小学期间(大约 5~12 岁)要学的内容拆成了 1,590 个极细粒度的「微主题」(microtopics),再通过 3,221 条有向无环图(DAG)边把它们串联起来——每条边标注了「…
Canner/WrenAI 是 开源 GenBI(Generative BI)引擎,核心能力是让 AI Agent 通过自然语言生成可信的 SQL 查询、可治理的业务仪表盘。它不是简单的 texttoSQL 工具——它通过一层开放 Context Layer(MDL 语义模型),把业务定义、数据血缘、查询记忆等「业务知识」注入 Agent 的推理过程,从根本…
Dolt 是一个带版本控制的 SQL 数据库——把 Git 的协作模型带入了数据世界。你可以 fork、clone、branch、merge、push、pull 数据库表,就像对代码仓库操作一样。数据以 MySQL 兼容的 SQL 表形式存储,版本控制功能通过 SQL 内的系统表和存储过程暴露出来。 官方 slogan:"Git for Data"。 本质上…
astockdata 是一个面向 AI 编程助手(Claude Code / OpenClaw / Codex)设计的 A 股全栈数据 Skill 文件,本质是一份结构化 Markdown 文档,内嵌全部可运行 Python 代码,可直接被 AI 读取并在对话中执行。 它解决的核心问题是:A股数据源极度分散——行情在通达信协议、研报在东财 PDF、资金流在另…
SiYuan(思源笔记)是一款隐私优先、可完全自托管的个人知识管理(PKM)软件,使用 TypeScript + Go 双语言开发,Stars 约 4.5 万,周增约 +14。它以「块(Block)」为最小数据单元,支持块级引用和双向链接(类似 Roam Research / Obsidian),采用 Markdown 所见即所得(WYSIWYG)编辑体验,…
JavaGuide 是 GitHub 上规模最大的 Java 后端面试知识库,涵盖 Java 基础、并发、JVM、数据库(MySQL/Redis/MongoDB)、计算机网络、操作系统、数据结构与算法、系统设计、常用框架(Spring/SpringBoot)等核心主题。除面试内容外,还包含 AI 应用开发指南(AIGuide 子仓库),覆盖 LLM、Agen…
这个仓库有两层含义,需要先区分清楚: 第一层(仓库名): 仓库全名是 Google Cloud Knowledge Catalog(谷歌云知识目录),这是 GCP 的企业级数据目录服务(原名 Dataplex),提供动态知识图谱和元数据管理,为 AI Agent 提供语义上下文。 第二层(核心内容): 这个 GitHub 仓库的真正核心是 Open Know…