Guides · organized/guides

仓库攻略

699 篇 · 685 个项目 · Agent 智能体

diegosouzapw/OmniRoute · 上手攻略
OmniRoute 是一个自托管 AI 网关,用单一端点聚合 278+ 提供商(含 90+ 免费层)的 500+ 模型,替开发者省去逐一对接每个 AI 提供商的麻烦。它支持自动 fallback 组合、Token 压缩、多策略路由、MCP 服务器、A2A 代理协议、内存持久化、Guardrails 安全过滤、TLS 指纹伪装等企业级特性,同时提供 Web 界…
Agent 智能体 diegosouzapw/OmniRoute Stars 53,672 Tom 2026-07-23
Deep-Thinking Tokens:用"预测不稳定Token"衡量LLM真实推理努力 · 干货攻略
这篇来自弗吉尼亚大学与 Google 的研究(arXiv:2602.13517,ICML 2026 录用)提出了一个核心问题:模型生成的 token 数量,真的能衡量它的推理努力吗? 答案是否定的。研究者发现,输出 token 数与准确率之间存在平均负相关(r = −0.544)——token 越多,反而可能越差。这被称为"过度思考"(overthinkin…
Jay 2026-07-23
HKUDS/Vibe-Trading · 上手攻略
VibeTrading 是香港大学数据智能实验室(HKUDS)开源的个人量化交易智能体框架,定位为"让任何 AI Agent 都具备完整交易研究能力"的一条命令式工具链。装好后,你的 Agent 可以做市场研究、策略编写、回测、因子分析、Shadow Account 行为诊断、券商账户审计,最终生成可交付的研究报告——覆盖 A 股、港股、美股、加密货币、期货…
Agent 智能体 HKUDS/Vibe-Trading Stars 30,558 Tom 2026-07-23
JimLiu/baoyu-design · 上手攻略
baoyudesign 是一个可移植的 Agent Skill(技能包),它把 Claude 官方网页版 claude.ai/design 的设计引擎完整复刻为本地编辑器内的 AI 工作流。装入 Cursor、Claude Code、Codex 或任何支持 skills 的本地 Agent 后,你用自然语言描述需求,Agent 就会按照 Claude Des…
Agent 智能体 JimLiu/baoyu-design Stars 3,029 Tom 2026-07-23
Claude Code 网页端 GitHub 访问被 Egress 策略拦截 · 干货攻略
Claude Code 网页端(claude.ai/code)突然开始拦截对 GitHub 的所有网络请求,错误信息为: "GitHub is blocked by egress policy" 这意味着 git clone、API 调用等一切 GitHub 相关的网络操作在网页端完全失效。这不是第一次发生——根据 @simonw 的报告,这是第二次出现同类…
Jay 2026-07-22
Inkling · 干货攻略
Inkling 是 Thinking Machines Lab(由前 OpenAI CTO Mira Murati 创办)于 2026 年 7 月 15 日发布的首个从零训练的开源权重混合专家模型。官方定位明确:不是最强通用模型,而是最适合拿来定制(finetuning)的开源基础模型。 核心规格(官方 HuggingFace 模型卡): | 指标 | 数值…
thinkingmachines/Inkling Jay 2026-07-22
stablyai/orca · 上手攻略
Orca 是一个专为并行多 Agent 协作设计的 AI IDE(集成开发环境),让你可以在同一个界面里同时运行多个 AI 编程 Agent(Codex、Claude Code、OpenCode、Cursor 等),每个 Agent 运行在独立的 git worktree 中,结果集中管理、按需对比合并。它本质上是一个"Agent 调度台"——不是替代你的 …
Agent 智能体 stablyai/orca Stars 47,228 Tom 2026-07-22
bethington/ghidra-mcp · 上手攻略
ghidramcp 是一个生产级 MCP(Model Context Protocol)服务器,将 NSA 开源的 Ghidra 反编译引擎以 269 个 MCP 工具的形式暴露给 AI Agent,供其进行 AI 驱动的二进制逆向工程。与大多数 Ghidra MCP 实现只提供几个只读工具不同,这是一个由真实逆向工程师日常使用的完整方案——支持完整的写操作…
Agent 智能体 bethington/ghidra-mcp Stars 3,259 Tom 2026-07-22
raullenchai/Rapid-MLX · 上手攻略
RapidMLX 是目前 Apple Silicon 上速度最快的本地 AI 推理引擎,专为 M 系列芯片优化,基于 Apple MLX 框架重写所有核心 kernel,纯 Metal GPU 加速,无任何 llama.cpp 回退或 Python 桥接层。相比同场景的 Ollama,吞吐量提升约 4.2 倍,首 token 时间(TTFT)可低至 0.08…
LLM 基础设施 raullenchai/Rapid-MLX Stars 3,433 Tom 2026-07-22
ParseBench 文档解析评测基准 · 干货攻略
ParseBench 是 LlamaIndex 在 CVPR 2026 上发布的首个面向 AI Agent 的文档解析评测基准(arXiv:2604.08538,cs.CV)。 它的核心命题是:文档 OCR 不是"把 PDF 转成文字",而是必须保留足够的结构和语义,让 Agent 能可靠地自主决策。一旦表格列对齐错位、小数点丢失、删除线被静默丢弃,Agen…
评测基准 run-llama/ParseBench Jay 2026-07-22
Galaxy-Dawn/claude-scholar · 上手攻略
Claude Scholar 是一个半自动化 AI 学术研究助手,面向计算机科学和 AI 研究者设计,核心功能覆盖文献调研、代码实验、报告撰写、论文写作和项目知识管理。它并非一个独立的 AI 模型或应用,而是一套 Claude Code / Codex / Kimi Code CLI / OpenCode 的技能(Skills)和工作流配置层,通过向这些编码…
Agent 智能体 Galaxy-Dawn/claude-scholar Stars 5,067 Tom 2026-07-22
unicity-aos/aos-ce · 上手攻略
AOS Community Edition(简称 AOSCE)是 Unicity 公司推出的开源 Agent 操作系统,专为希望拥有可审查、可组合 AI Agent 运行环境的开发者设计。它的核心定位是:Agent 的执行环境(类似容器的隔离运行时)+ 配套的工具链,让 Agent 在其中既能安全运行,又能自我扩展能力。 关键概念拆解: MetaHarnes…
Agent 智能体 unicity-aos/aos-ce Stars 8,575 Tom 2026-07-22
LlamaIndex Agentic Retrieval Harness 深度指南 · 干货攻略
Retrieval Harness 是 LlamaIndex 在 2026 年提出的一种面向 Agent 的持久化检索架构模式,其参考实现为 runllama/legalkb(法律文档知识库 Demo)。 区别于传统的单次向量搜索 RAG,Harness 将文档知识库包装成一组类文件系统 API 工具(retrieve / findFiles / readF…
Agent 智能体 run-llama/legal-kb Jay 2026-07-21
hao-ai-lab/FastVideo · 上手攻略
FastVideo 是 MBZUAI Hao Zhang 实验室主导的"统一视频生成推理 + 后训练(蒸馏/微调)框架"。它不是某个视频生成模型本身,而是一套面向 DiT 类视频扩散模型(Wan、Mochi、Hunyuan、CausalWan 等)的训练蒸馏推理一站式底座,目标是让视频生成既能微调,又能跑得快、跑得便宜。 仓库内同时包含 4 个层次的产出: …
工程化 hao-ai-lab/FastVideo Stars 3,936 spark 2026-07-21
OpenCSGs/csghub · 上手攻略
CSGHub 是 OpenCSG 团队开源的"LLM 资产管理平台",定位对标 Hugging Face:把模型(LLM/VLM)、数据集、Space 应用、代码片段当作一等资产,统一在一个平台上做上传、下载、版本管理、权限分发、推理部署和数据处理。整套系统由 Go(Gin)+ Rails 旧版迁移中的 Vue3 前端、PostgreSQL 元数据、Apac…
Agent 智能体 OpenCSGs/csghub Stars 4,181 spark 2026-07-21
LLM 推理「精力等级」机制:训练与推理阶段如何实现 · 干货攻略
Sebastian Raschka(AI 研究者、前威斯康星大学麦迪逊分校教授)在 2026 年 7 月 18 日发表了一篇深度技术博文,系统解释了 LLM 如何在推理时切换低/中/高三种「精力」(effort)推理模式,以及这些能力在训练阶段是如何被注入的。 这不是一篇泛泛的科普文,而是从 RLVR 训练机制、思维链格式的真正作用,到 Qwen3 的「思维…
Jay 2026-07-20
X MCP 构建个人 AI 新闻聚合器 · 干货攻略
利用 X MCP(Model Context Protocol)工具让 AI 代理自动抓取指定高信噪比账号的 X 帖子,生成一份自包含的 HTML Artifact(或存为知识库),构建属于你自己的个性化 AI 资讯日报。 核心思路是:把 X 变成一个结构化的 AI 新闻 API,由代理自动完成「筛选账号 → 抓取内容 → 渲染输出」的全流程,每天早上打开浏…
Jay 2026-07-20
KnockOutEZ/wigolo · 上手攻略
wigolo 是一个本地优先的 AI Agent 网页智能服务器,为 AI 编程 Agent 提供一站式网页能力:搜索、抓取、爬取、提取、缓存、相似页面查找和自主研究。所有数据默认存储在本地 ~/.wigolo/,核心搜索/抓取功能无需任何 API Key,完全免费。 它的定位是替代需要付费的网页搜索 API(如 Google SerpAPI、Bing Se…
Agent 智能体 KnockOutEZ/wigolo Stars 4,476 Tom 2026-07-20
apache/burr · 上手攻略
Apache Burr(incubating)是一个 Python 状态机框架,用来构建"会做决策的应用"——chatbot、agent、simulation、人机协作工具。它把应用建模成一张 state machine(状态机/流程图): Burr 的关键设计哲学是 "框架无关":它不规定你必须用哪个 LLM SDK、哪个 vector DB、哪个 age…
Agent 智能体 apache/burr Stars 2,506 spark 2026-07-20
apache/hamilton · 上手攻略
Apache Hamilton(incubating)是一个轻量的 Python 库,用"Python 函数即节点"的方式构建数据转换 DAG。它的核心思路是:你写普通的 Python 函数,函数参数的名字 = 它依赖的上游节点名,Hamilton 自动把这些函数拼成 DAG、并按依赖顺序执行。 举例: import pandas as pd def sig…
工程化 apache/hamilton Stars 2,561 spark 2026-07-20
openlit/openlit · 上手攻略
OpenLIT 是一个开源的 AI Engineering 平台,定位是"一站式把 LLM 应用从实验推到生产"。它把 OpenTelemetry 当作统一底座,向上提供 6 类核心能力: 1. 可观测性 SDK(Python / TypeScript / Go):对 50+ LLM provider、VectorDB、Agent 框架、GPU 做自动埋点(…
Agent 智能体 openlit/openlit Stars 2,680 spark 2026-07-20
Self-Improvements in Modern Agentic Systems · 干货攻略
2026 年 7 月 14 日上传至 arXiv 的一篇97 页大survey(arXiv:2607.13104),由 DAIR.AI 团队(Zhe Ren、Yimeng Chen 等)联合 Jürgen Schmidhuber 等人撰写。配套 GitHub 仓库 selfimprovingagent/awesomeSelfImprovingAgents 提…
Agent 智能体 selfimproving-agent/awesome-Self-Improving-Agents Jay 2026-07-19
Devin-AXIS/iPolloWork · 上手攻略
iPolloWork 是 Codex 和 Claude Code 的下一代源码开放替代品,定位是"不只是帮你写代码,而是真正完成工作"。 核心特点: 源码可用(SourceAvailable,非 OSI 认可的开源):允许个人免费使用,3 人及以上使用需书面授权 Claude Code 和 Github Copilot workspace 这类产品,本质上还…
Agent 智能体 Devin-AXIS/iPolloWork Stars 1,452 Tom 2026-07-19
bojieli/ai-agent-book · 上手攻略
《深入理解 AI Agent:设计原理与工程实践》(作者李博杰)是一本系统性阐述 AI Agent 的技术书籍,全书围绕核心公式展开: Agent = LLM + 上下文 + 工具 这个公式是全书的骨架,意思是:一个能用的 Agent,离不开大语言模型(LLM)、对上下文的精细管理、以及可调用的外部工具。三者缺一不可。 十章内容覆盖: | 章节 | 主题 |…
Agent 智能体 bojieli/ai-agent-book Stars 42,284 Tom 2026-07-19
LangChain 开源软件工厂:四大组件协作体系 · 干货攻略
LangChain 于 2026 年 7 月 18 日在 X 宣布将其内部「软件工程 Agent 全链路工具栈」完全开源,CEO Harrison Chase 表示:「我们已经在内部建好了一整套软件工程 Agent 工厂,并把每个组件都开源了。」 这套体系由四个独立但可协同的工具组成: | 组件 | 定位 | 入口 | |||| | Dcode (Deep …
Jay 2026-07-19
GPT-5.6 推理层级与档位选型指南 · 干货攻略
GPT5.6 是 OpenAI 于 2026 年 7 月 9 日正式发布的第五代 GPT 主线模型,采用了与前代完全不同的三级档位 + 多档推理努力度矩阵: 三档(Tier) | 档位 | 定位 | 输入价格 ($/1M tokens) | 输出价格 ($/1M tokens) | ||||| | Sol | 前沿旗舰,对应此前不带后缀的 GPT5 | $5…
Jay 2026-07-19
alibaba/zvec · 上手攻略
Zvec 是阿里巴巴通义实验室开源的进程内(inprocess)向量数据库,定位为"向量数据库领域的 SQLite"——直接以内嵌库的方式运行在你的应用程序中,无需部署独立的数据库服务进程。它基于阿里生产级 Proxima 向量检索引擎,支持稠密向量 + 稀疏向量 + 全文检索(FTS)混合检索,并内置 WAL 持久化、多进程并发读取等企业级特性。 当前版本…
数据与向量库 alibaba/zvec Stars 15,199 Tom 2026-07-19
Sakana Fugu:用 RL Conductor 调度多模型军团 · 干货攻略
Sakana Fugu 是 Sakana AI 在 2026 年发布的多智能体编排系统,其核心是一个 7B 参数的 Conductor 模型。该模型不自己解题,而是像"管理者"一样动态决定: 调用哪些专家模型(worker pool 包含 GPT5.5、Gemini 3.1 Pro、Claude Opus 4.8 等) 每个 worker 分配什么任务 wo…
SakanaAI/fugu Jay 2026-07-18
0xSteph/pentest-ai · 上手攻略
pentestai(CLI 入口 ptai)是一个 AI 驱动的渗透测试框架。核心创新不是"发现更多漏洞",而是每个漏洞都必须被机器 Oracle 重复验证才能进入最终报告。思路借鉴 TruffleHog:TruffleHog 发现泄露密钥后实际登录验证,ptai 发现 Web 漏洞后实际重新触发一遍。一个 finding 停留在"候选"状态,直到 Orac…
Agent 智能体 0xSteph/pentest-ai Stars 1,536 Tom 2026-07-18