OmniStudio 是一个本地优先的大模型一体化桌面工作台,由「鲲鹏Talk」开发并以 MIT 协议开源。它把"模型从哪里来、用什么引擎跑、怎么用起来"三件事收进一个 Electronlike 桌面应用(基于 Electrobun + Bun),把"模型市集下载、推理引擎管理、对话、语音、图片、视频、OCR、翻译、本地 RAG、共享记忆、MCP、Skill…
仓库攻略
1007 篇 · 984 个项目 · Agent 智能体
NeoHorse1 是 TokenRhythm 发布的一个 Agent 原生语言模型家族,包含 4B 和 9B 两个规模,均从 Qwen3.5 后训练而来,定位是「递归自改进(RSI)」路径上的初始原型。 官方将其描述为「agentnative」——模型从一开始就不是为通用对话设计的,而是专门针对工具调用、编码、Agent Harness 场景、指令遵循这四…
这是一个在 34 台 NVIDIA DGX Spark 节点上通过 SGLang 部署 DeepSeekV4.1Flash 模型的生产级推理方案。模型以 MXFP4 稀疏专家 + FP8 密集权重运行,KV Cache 由 NVMe + 统一内存共同支撑,提供 OpenAI 兼容的 /v1/chat/completions 接口,支持 Tool Callin…
§0 自检栏:⚠️ 标注 ≥10 / 反方 v2 三段式按主线分布 ≥4 主线 / 立标池 4 件套 / §七 合流密度 / verifiability ≥20% 主轴独立 / 字数 ≤3,900 CJK(攻略 15003000 区间)/ 禁"独立段不计"。本篇正文 9 节,含 1 段反方三段式,4 条主线。 DATAGEN 是一个多智能体驱动的数据分析与科…
Rodney 是 Simon Willison 用 Go 编写的命令行浏览器自动化工具,基于 gorod/rod 库实现。与 Playwright/Puppeteer 等面向人类开发者的工具不同,Rodney 从第一天起就是为 coding agent 和 shell 脚本设计的。 核心设计:Chrome 以长驻进程运行(通过 Chrome DevTools…
commitrewriter 是 Simon Willison(@simonw)9 月 14 日发布的本地 Web 应用,用于批量编辑 Git 仓库的提交信息。核心使用场景是:Coding Agent 生成的提交记录往往带有大量"机器腔"——冗长的内部 ID 引用、不适合公开的 issue 编号、重复的 agent 生成 boilerplate。Simon …
Beyond Prompts: Measuring and Optimizing LLM ToolAgent Harnesses 是 Airbnb 团队(Cen Mia Zhao、Haibo Ruan、Wenjie Chen 等)发表在 EMNLP 2026 的论文,核心命题: 给定一个固定模型,Agent 的质量提升来源不是换模型,而是优化它周围的 har…
一个由 GPT6 Astra(Medium)+ OpenAI Codex 模式驱动的 AI 编码智能体,在 macOS 上自动调用本地已安装的 Blender 桌面应用,通过 Blender Python API 生成可编辑的 .blend 三维场景文件,并渲染出成品图像。 整个过程完全由自然语言驱动——用户只给了三句提示词,AI 自己: 1. 写 Pyth…
Extract Turbo 是 LlamaIndex(LlamaParse / LlamaExtract)平台在 2026 年 9 月发布的全新文档抽取 tier,处于 beta 阶段,主打极致低延迟,目标场景是 extraction 位于用户响应路径上的实时工作流。 LlamaParse 是 LlamaIndex 的核心商业产品,提供 Parse(文档解析…
§0 自检(Spark W37 #47 硬约束) · ⚠️ 标签密度 ≥10 处 ✔ · 数字 verbatim 来源 ✔(commit 13.09.2026 / 6,806 live / 31,545 in 48h / 775,940 tracked / 4,294 HTTP 等均来自 README+API docs) · 反方按主线独立成段(坑与注意 §…
Pentest Swarm AI 是一个基于真实群智(Swarm)架构的开源渗透测试引擎,由 Go 语言编写,支持 Claude、GLM、Qwen、DeepSeek、Gemini、Ollama 等任意具备 functioncalling 能力的 LLM。与传统多 Agent 工具「单 Planner 按固定顺序调用各阶段」不同,Pentest Swarm A…
Uno(发音「乌诺」)是 IFM(Institute of Foundation Models)团队开源的离散扩散增强型 LLM 推理框架,核心思想是:不让扩散模型取代自回归模型,而是让扩散模型辅助自回归模型并行生成多个 token,从而在保持输出无损的前提下显著提升吞吐。 传统 LLM 推理慢在「串行」——每个 token 必须等前一个 token 生成完…
⚠️ 数据来源:仅 GitHub README 原文 + Remotion / Claude Code / Codex 官网(截至 20260913 抓取)。web_search 命中的 X、Instagram、SkillsLLM 等三方页视为不可信,不引用其 stars / forks 数字。本文不下 npm、不跑 Remotion、不发 TTS 调用。 …
⚠️ 数据来源:GitHub README 与 docs/MCP.md(截至 20260913 抓取)。本文不下载、不安装运行,只整理公开文档可验证的事实;版本号 / 文件名以 Releases 页为最终准绳,写前请再 grep 一次 docs/RELEASE.md。 ⚠️ 标注:≥10 处(见各节) 反方 v2 三段式:每条主线各一段(机制 / 数据 / …
flycoinrh 是一个真实果蝇大脑模拟项目,用真实果蝇的神经连接组(connectome)驱动 Robinhood Chain 上的代币发行。165,122 个神经元、10,228,000 个实测突触连接,全部来自真实雄性黑腹果蝇(Drosophila melanogaster)的电子显微镜扫描数据——不是神经网络的"仿生创意",是实测的生物学接线图。 …
Xberg 是用 Rust 编写的多格式文档智能提取引擎,下一代 Kreuzberg v4。声称支持 107 种文档格式 / 141 种文件扩展名 / 371 种编程语言,提供 15 种语言绑定(Python、Node.js、Rust、Go、Java、C#、Ruby、PHP、Elixir、Dart、Swift、Zig、WASM、Kotlin、C FFI),零…
Miles 是 RadixArk 开源的企业级大模型 RL 后训练框架(v0.1 发布于 2026 年 8 月 18 日),定位与 OpenAI 的训练+推理协同思路类似,但完全开源。Miles 从 THUDM/slime 分叉而来,与 slime 保持共同演进。 核心架构:SGLang 负责高吞吐 rollout 生成 + NVIDIA MegatronL…
ResearchPilotSkills 是一套给 Claude Code(也支持 OpenAI Codex CLI、腾讯 CodeBuddy)用的「科研全流程 skill 包」。它把一篇学术论文的生命周期拆成 A → B → C → D → E → F → G.0–G.8 共 14 个独立阶段,每个阶段一个独立 skill(独立目录、独立 prompt),避…
Memanto 自定位为 "Memory Agent"——一个常驻在 agent 集群旁边的"随从 agent",替你的 Claude Code / Cursor / Codex / Cline / Goose / Copilot 等代理统一管理长期记忆。它不是普通向量库 SDK,而是一个独立进程:观察其它 agent 的对话流 → 抽取 durable 知…
CoEvolving Harnesses and Models: OnPolicy Correction Helps Weaker Models Catch Up Where Imitation Fails 是 Salesforce AI 团队(Zhou Yu、Bin Bi 等)的研究,核心研究问题: 在企业级 Agent 场景下,Harness 演化(优化…
⚠️ 本文为公开 README 与官方 docs 的二次整理,版本与数字以下方 fetch 到的内容为准,后续以仓库 release 为准。 Archestra 是一个面向企业的一体化 AI Agent 平台,把 LLM 代理、网关、Guardrails、MCP 注册表、Agent Runtime 全部塞进同一个控制平面。它的核心目标用户画像是「工程师 + …
内容待复核
punkpeye/awesome-remote-mcp-servers · 上手攻略
Remote MCP Server(远程 MCP 服务器)是一种由第三方运维、仅通过 URL 对外暴露的 Model Context Protocol 端点。与传统的本地 MCP 服务器(需要 npm、PyPI、Docker 或二进制安装,并在本地以 stdio 进程运行)不同,远程 MCP 服务器由服务提供方托管,用户只需在 AI 客户端中配置一个 URL…
2026 年 9 月 8 日,Salesforce AI 研究团队发布了论文 "CoEvolving Harnesses and Models: OnPolicy Correction Helps Weaker Models Catch Up Where Imitation Fails"(arXiv:2609.09134)。论文研究了一个核心问题:当小模型配…
MobileCode 是一个基于 opencode 的开源 AI 编程助手 fork,专注于移动端项目(iOS + Android)的实时预览与构建。它让 AI 编程助手能够直接感知、移动、运行你的 iOS 和 Android 项目,并在编程界面旁边内嵌实时模拟器/模拟器画面——一个 Play 按钮同时驱动 React Native 的 iOS 和 Andr…
realapipricing 是一个开放数据项目,核心目标是回答一个简单但长期被回避的问题:订阅制 AI API 的真实单价到底是多少? 厂商宣传的往往是「月费 × 额度」,但不同厂商的 token 计量方式、额度刷新规则、缓存计费方式差异巨大,直接比较毫无意义。该项目用统一的标准工作负载(97.5% 缓存读取 + 2.15% 普通输入 + 0.35% 输出…
论文 "Beyond Prompts: Measuring and Optimizing LLM ToolAgent Harnesses"(arXiv:2609.05736,EMNLP 2026)来自 Airbnb 团队,核心贡献有两层: 第一层:量化评估协议。 论文指出,对 harness(围绕固定模型的运行时控制层)的优化效果不能只看均值提升,必须在预算…
EdgeEver 是一个开源、面向 AI Agent 时代重做的个人/团队知识库。它致敬 Evernote 经典的三栏布局(笔记本树 + 笔记列表 + 大编辑器),同时用现代化的 Web 技术栈(Bun workspace + Vite/React + TipTap/ProseMirror + Tailwind/shadcn/ui + Dexie + PWA…
Open Science Desktop(简称 OSD,原名"Open Science",v0.5.2 为当前最新版)是一个本地优先、模型无关的 AI 科研工作台,面向 macOS、Windows 和 Linux。它用 Tauri 构建桌面外壳,内嵌 OpenCode 运行时,通过 MCP 协议连接科学数据库和 agent 技能,可以完成从文献调研、实验设计…
Webcmd 是一个面向 AI 编程 agent 的自学习浏览器基础设施。它的核心思路很直接:让 agent 在真实浏览器中完成任务,同时把网站的结构知识(sitemap、action space、pitfalls)留在本地,下次同类任务不再重复探测,直接从记忆启动。据 README 描述,理论上可将浏览器 agent 的 token 消耗降低 90%。 它…
okfagentmemory 是一个面向 AI 编码代理(Claude Code、Cursor、Codex、Gemini CLI 等)的 Git 原生持久化记忆层。它把项目里的"长期知识"以符合 Google Open Knowledge Format(OKF)v0.2 规范的 Markdown + YAML frontmatter 文件形式,存在仓库的 k…