Extract Turbo 是 LlamaIndex(LlamaParse / LlamaExtract)平台在 2026 年 9 月发布的全新文档抽取 tier,处于 beta 阶段,主打极致低延迟,目标场景是 extraction 位于用户响应路径上的实时工作流。 LlamaParse 是 LlamaIndex 的核心商业产品,提供 Parse(文档解析…
仓库攻略
1530 篇 · 1501 个项目
§0 自检(Spark W37 #47 硬约束) · ⚠️ 标签密度 ≥10 处 ✔ · 数字 verbatim 来源 ✔(commit 13.09.2026 / 6,806 live / 31,545 in 48h / 775,940 tracked / 4,294 HTTP 等均来自 README+API docs) · 反方按主线独立成段(坑与注意 §…
Marigold V2 是一套将预训练图像生成扩散 Transformer(DiT)低成本改造为单目深度估计器的完整方案——包括模型族和可复现微调协议。2026 年 9 月 8 日由华为苏黎世实验室( Huawei Bayer Lab)、EPFL 和博洛尼亚大学联合开源,已被 ACM Transactions on Graphics 接收(SIGGRAPH …
Pentest Swarm AI 是一个基于真实群智(Swarm)架构的开源渗透测试引擎,由 Go 语言编写,支持 Claude、GLM、Qwen、DeepSeek、Gemini、Ollama 等任意具备 functioncalling 能力的 LLM。与传统多 Agent 工具「单 Planner 按固定顺序调用各阶段」不同,Pentest Swarm A…
Uno(发音「乌诺」)是 IFM(Institute of Foundation Models)团队开源的离散扩散增强型 LLM 推理框架,核心思想是:不让扩散模型取代自回归模型,而是让扩散模型辅助自回归模型并行生成多个 token,从而在保持输出无损的前提下显著提升吞吐。 传统 LLM 推理慢在「串行」——每个 token 必须等前一个 token 生成完…
⚠️ 数据来源:仅 GitHub README 原文 + Remotion / Claude Code / Codex 官网(截至 20260913 抓取)。web_search 命中的 X、Instagram、SkillsLLM 等三方页视为不可信,不引用其 stars / forks 数字。本文不下 npm、不跑 Remotion、不发 TTS 调用。 …
⚠️ 数据来源:GitHub README 与 docs/MCP.md(截至 20260913 抓取)。本文不下载、不安装运行,只整理公开文档可验证的事实;版本号 / 文件名以 Releases 页为最终准绳,写前请再 grep 一次 docs/RELEASE.md。 ⚠️ 标注:≥10 处(见各节) 反方 v2 三段式:每条主线各一段(机制 / 数据 / …
fastembedrs 是 Qdrant/fastembed(Python 版)的 Rust 实现,本地生成向量嵌入(vector embeddings)和重排序(reranking)的纯 Rust 库。无需网络请求、无 Python 依赖、无 Tokio 异步运行时,所有模型在本地通过 ONNX Runtime(via @pykeio/ort)执行。 ⚠️…
flycoinrh 是一个真实果蝇大脑模拟项目,用真实果蝇的神经连接组(connectome)驱动 Robinhood Chain 上的代币发行。165,122 个神经元、10,228,000 个实测突触连接,全部来自真实雄性黑腹果蝇(Drosophila melanogaster)的电子显微镜扫描数据——不是神经网络的"仿生创意",是实测的生物学接线图。 …
DLSS5NeuralScreen 将 NVIDIA DLSS 5 神经渲染技术应用到整个 Windows 桌面,实时提升所有画面质量。游戏、视频、图片、文档——屏幕上的一切都经过和 DLSS 5 游戏相同的神经网络处理后输出,实现全局画面增强。项目基于泄露的 NVIDIA 310.8.0 运行时(sm_75/86/89/120 内核,支持 RTX 2050…
AuK(发音接近 "auk",一种海鸟)是腾讯混元(Tencent Hunyuan)于 2026 年 9 月 9 日 开源的多任务语音生成与编辑统一模型,arXiv 论文编号 2609.08936,MIT 许可证,代码与权重全部公开。 核心定位:一个模型、一套指令格式,覆盖 5 大类 20+ 任务,不再需要为每个子任务部署独立模型。 传统语音系统把 TTS、…
Xberg 是用 Rust 编写的多格式文档智能提取引擎,下一代 Kreuzberg v4。声称支持 107 种文档格式 / 141 种文件扩展名 / 371 种编程语言,提供 15 种语言绑定(Python、Node.js、Rust、Go、Java、C#、Ruby、PHP、Elixir、Dart、Swift、Zig、WASM、Kotlin、C FFI),零…
Miles 是 RadixArk 开源的企业级大模型 RL 后训练框架(v0.1 发布于 2026 年 8 月 18 日),定位与 OpenAI 的训练+推理协同思路类似,但完全开源。Miles 从 THUDM/slime 分叉而来,与 slime 保持共同演进。 核心架构:SGLang 负责高吞吐 rollout 生成 + NVIDIA MegatronL…
ResearchPilotSkills 是一套给 Claude Code(也支持 OpenAI Codex CLI、腾讯 CodeBuddy)用的「科研全流程 skill 包」。它把一篇学术论文的生命周期拆成 A → B → C → D → E → F → G.0–G.8 共 14 个独立阶段,每个阶段一个独立 skill(独立目录、独立 prompt),避…
Memanto 自定位为 "Memory Agent"——一个常驻在 agent 集群旁边的"随从 agent",替你的 Claude Code / Cursor / Codex / Cline / Goose / Copilot 等代理统一管理长期记忆。它不是普通向量库 SDK,而是一个独立进程:观察其它 agent 的对话流 → 抽取 durable 知…
CoEvolving Harnesses and Models: OnPolicy Correction Helps Weaker Models Catch Up Where Imitation Fails 是 Salesforce AI 团队(Zhou Yu、Bin Bi 等)的研究,核心研究问题: 在企业级 Agent 场景下,Harness 演化(优化…
⚠️ 本文为公开 README 与官方 docs 的二次整理,版本与数字以下方 fetch 到的内容为准,后续以仓库 release 为准。 Archestra 是一个面向企业的一体化 AI Agent 平台,把 LLM 代理、网关、Guardrails、MCP 注册表、Agent Runtime 全部塞进同一个控制平面。它的核心目标用户画像是「工程师 + …
内容待复核
punkpeye/awesome-remote-mcp-servers · 上手攻略
Remote MCP Server(远程 MCP 服务器)是一种由第三方运维、仅通过 URL 对外暴露的 Model Context Protocol 端点。与传统的本地 MCP 服务器(需要 npm、PyPI、Docker 或二进制安装,并在本地以 stdio 进程运行)不同,远程 MCP 服务器由服务提供方托管,用户只需在 AI 客户端中配置一个 URL…
Sebastian Raschka(@rasbt)在 2026 年 9 月 6 日发布的视频与博客文章,属于其「从零手写推理模型(Reasoning from Scratch)」系列第 2 期。核心内容是从零用 PyTorch 实现 KV Cache(KeyValue 缓存),让 LLM 在逐 token 自回归生成时跳过重复计算,从而大幅提升推理速度。 这…
2026 年 9 月 8 日,Salesforce AI 研究团队发布了论文 "CoEvolving Harnesses and Models: OnPolicy Correction Helps Weaker Models Catch Up Where Imitation Fails"(arXiv:2609.09134)。论文研究了一个核心问题:当小模型配…
MobileCode 是一个基于 opencode 的开源 AI 编程助手 fork,专注于移动端项目(iOS + Android)的实时预览与构建。它让 AI 编程助手能够直接感知、移动、运行你的 iOS 和 Android 项目,并在编程界面旁边内嵌实时模拟器/模拟器画面——一个 Play 按钮同时驱动 React Native 的 iOS 和 Andr…
realapipricing 是一个开放数据项目,核心目标是回答一个简单但长期被回避的问题:订阅制 AI API 的真实单价到底是多少? 厂商宣传的往往是「月费 × 额度」,但不同厂商的 token 计量方式、额度刷新规则、缓存计费方式差异巨大,直接比较毫无意义。该项目用统一的标准工作负载(97.5% 缓存读取 + 2.15% 普通输入 + 0.35% 输出…
论文 "Beyond Prompts: Measuring and Optimizing LLM ToolAgent Harnesses"(arXiv:2609.05736,EMNLP 2026)来自 Airbnb 团队,核心贡献有两层: 第一层:量化评估协议。 论文指出,对 harness(围绕固定模型的运行时控制层)的优化效果不能只看均值提升,必须在预算…
注:仓库原名 lineharnessoss,20260819 起产品展示名统一为「L Harness」,仓库 URL、createlineharness、@lineharness/ 等保留为兼容标识(详见 BRAND.md)。下文按官方 README 用「L Harness」指代产品本身,仍以仓库原名 lineharnessoss 作为安装与文件路径引用。 …
EdgeEver 是一个开源、面向 AI Agent 时代重做的个人/团队知识库。它致敬 Evernote 经典的三栏布局(笔记本树 + 笔记列表 + 大编辑器),同时用现代化的 Web 技术栈(Bun workspace + Vite/React + TipTap/ProseMirror + Tailwind/shadcn/ui + Dexie + PWA…
wllama 是 ngxson(XuanSon Nguyen)维护的 WebAssembly + WebGPU 绑定库,让 llama.cpp 可以在浏览器内直接运行大语言模型推理,2026 年 9 月 5 日他发布了 首个浏览器内微调(finetuning)PoC,证明在 WebGPU 上训练 LLM 是可行的。@maximelabonne(Liquid …
Open Science Desktop(简称 OSD,原名"Open Science",v0.5.2 为当前最新版)是一个本地优先、模型无关的 AI 科研工作台,面向 macOS、Windows 和 Linux。它用 Tauri 构建桌面外壳,内嵌 OpenCode 运行时,通过 MCP 协议连接科学数据库和 agent 技能,可以完成从文献调研、实验设计…
Webcmd 是一个面向 AI 编程 agent 的自学习浏览器基础设施。它的核心思路很直接:让 agent 在真实浏览器中完成任务,同时把网站的结构知识(sitemap、action space、pitfalls)留在本地,下次同类任务不再重复探测,直接从记忆启动。据 README 描述,理论上可将浏览器 agent 的 token 消耗降低 90%。 它…
okfagentmemory 是一个面向 AI 编码代理(Claude Code、Cursor、Codex、Gemini CLI 等)的 Git 原生持久化记忆层。它把项目里的"长期知识"以符合 Google Open Knowledge Format(OKF)v0.2 规范的 Markdown + YAML frontmatter 文件形式,存在仓库的 k…
Sebastian Raschka(@rasbt)在 X 上分享的 LLM Memory Calculator,是一个基于 his LLM Architecture Gallery 构建的在线交互计算器。 它的核心价值在于:把 LLM 推理时的内存估算拆成两个互不相关的部分——模型权重内存和 KV Cache 增长——让你可以独立调节上下文长度或批量大小,观…