研究库 实战攻略
Guides · organized/guides

仓库攻略

405 篇 · 395 个项目 · jay · Agent 智能体

Pi SDK + Jev:三段式 Agent Harness 实战指南 · 干货攻略
本篇来自 @omarsar0(elvis)的实操教程,基于 LangChain 官方博客上 Sydney Runkle 的同名文章,用 Pi SDK(TypeScript AI Agent 开发工具包)从零实现一套完整的三段式 Agent Harness,并将 Jev(TypeSafe AI 的决策模型)接入每个决策节点。 Pi SDK(github.com…
Agent 智能体 Jay 2026-09-29
asciimoo/hister · 上手攻略
Hister 是一个本地运行的私人搜索引擎,用于索引和检索你访问过的网页、书签和本地文件。全程数据保存在你自己控制的机器上,不需要任何云端账号或第三方服务。 通过浏览器插件自动收集页面内容,配合 Hister 内置的查询语言或 MCP 接口,可以从 Web UI、终端或 AI 助手侧查询你的个人知识库。 日常上网我们会访问大量页面,但浏览器自带的搜索功能只能…
数据与向量库 asciimoo/hister Stars 5,788 Jay 2026-09-29
yyjeqhc/webcodex · 上手攻略
WebCodex 是一个本地开发环境桥接工具,让云端 AI Agent(如 ChatGPT、Claude)直接使用你本机已有的真实代码仓库、Git 工作区和开发工具链,而不需要把代码上传到任何托管服务或云端沙箱。 核心定位是把「AI 客户端(MCP)」和「你的真实机器」连接起来:AI 负责理解、修改、审查代码,运行测试和命令;代码、编译器、Git 历史都在你…
Agent 智能体 yyjeqhc/webcodex Stars 2,032 Jay 2026-09-29
代表攻略
用 Pi SDK + Jev 构建自定义 Agent Harness · 干货攻略
Pi SDK(earendilworks/pi)是 earendilworks 出品的 TypeScript Agent 开发工具包,包含多个可独立使用的包: | 包名 | 用途 | ||| | @earendilworks/piagentcore | Agent 运行时,含工具调用与会话状态管理 | | @earendilworks/piai | 统一 L…
Agent 智能体 earendil-works/pi Stars 82,886 Jay 2026-09-29
同类项目 2展开比较

同名 Awesome 仓库已合并展示,原攻略与详情链接均保留。

earendil-works/pi Stars 82,886 代表
earendil-works/pi Stars 82,886
ProgramDistill:将网页应用交互转化为可验证 SWE 任务的基准 · 干货攻略
ProgramDistill 是微软研究院(Microsoft Research Montréal)与韩国科学技术院(KAIST)于 2026 年 9 月发布的代码智能基准。它的核心思路不同于传统 SWEbench——不依赖 GitHub Issue 或人工撰写的任务描述,而是让 AI Agent 通过与一个功能完整的参考应用交互,自行推断出缺失的功能,再在…
huggingface.co/datasets/microsoft/ProgramDistill Jay 2026-09-29
Ember-1 · 40% 思考 token 压缩实战攻略 · 干货攻略
Ember1 是 Fireworks Research(Fireworks AI 的研究团队)于 2026 年 9 月 23 日发布的推理专用模型,本质是对 Moonshot AI 的开源推理模型 Kimi K3 做后训练压缩——让它学会用更少的思考 token 到达同等质量的答案。 这不是新架构,也不是新基座模型,而是 K3 的一次 specialized…
Jay 2026-09-28
加密推理链可被跨 API 漏洞窃取 · 干货攻略
一篇 2026 年 8 月 10 日提交的学术论文(arXiv:2608.09867,cs.CR),由来自 MATS Research、ELLIS Institute Tübingen、Max Planck Institute for Intelligent Systems、Snyk 的研究人员撰写。论文发现:Anthropic、OpenAI、Google …
无 Jay 2026-09-26
socai-io/jev-social · 上手攻略
Jev Social 是一个浏览器 grounded 社交媒体研究智能体,将 AI 决策模型(Jev)与真实 Chrome 浏览器操作(socai CLI)配对,对 Instagram、TikTok、LinkedIn 三个平台执行可验证的社交研究任务。Jev 负责每一步「搜索 / 打开某个主页 / 阅读某条评论 / 下载视频 / 结束」的选择决策;socai…
Agent 智能体 socai-io/jev-social Stars 88 Jay 2026-09-26
加密推理链可被跨 API 漏洞窃取 · 干货攻略
2026 年 8 月 10 日,一支来自 ELLIS Institute Tübingen、Max Planck Institute for Intelligent Systems、MATS Research 的研究团队(含 Alexander Panfilov、David Schmotz、Ilia Shumailov 等人)在 arXiv 发布论文 "St…
Jay 2026-09-26
JEPA-Anything:跨不同世界学习的通用世界模型框架 · 干货攻略
JEPAAnything 是一个领域无关(domainagnostic)的通用世界模型学习框架,发表在 arXiv (2609.20800),由 GenVerse 团队开源。它的核心创新叫做 Orthogonal Predictive Factorization(OPF,正交预测因子分解)——把 JEPA(联合嵌入预测架构)的单一目标表征替换为一组互补的、正…
Gen-Verse/JEPA-Anything Jay 2026-09-26
多 Agent 系统集体失控:流行病学建模 · 干货攻略
集体失控(Collective Loss of Control) 是 2026 年 9 月腾讯朱雀实验室(Tencent Zhuque Lab)发表的一篇论文(arXiv:2609.18460)中提出的概念,用于解释多 Agent 系统如何从一次局部偏差演化为集体性故障。论文的核心理论框架将多 Agent 失控建模为流行病传播——三个阶段:意外突变(Muta…
Agent 智能体 Jay 2026-09-24
PDF Agent 精确溯源:Visual Grounding 实战指南 · 干货攻略
Visual Grounding(视觉定位)是 2026 年 PDF Agent 工程中最重要的却被严重低估的能力。它指的是:给定一段文本描述,模型需要找到该描述对应的图像/文档区域——具体到 bounding box(边界框)、页码、词级别或行级别的精确位置。 在 PDF Agent 场景下,Visual Grounding 意味着:Agent 回答"这份…
Agent 智能体 Jay 2026-09-24
htlin222/meta-pipe · 上手攻略
metapipe 是一个基于 Claude Code 的端到端系统综述(Systematic Review)与元分析(MetaAnalysis)自动化 pipeline。你给一个研究主题,Claude Code 自动完成从文献检索、筛选、数据提取、统计分析到生成符合期刊格式的手稿,整个过程模块化、可重现、留有 5 个强制人工决策点。 核心逻辑:用 Claud…
Agent 智能体 htlin222/meta-pipe Stars 130 Jay 2026-09-23
bespokelabsai/nimble · 上手攻略
Nimble 是一个本地运行的决策模型,基于 Qwen3.59B 微调而来,主打「给一段文字 + 一个 schema,立刻返回一个带概率的typed decision」——不做推理过程、不生成文本,直接从 logits 读出各候选答案的概率,返回确定类型的结构化结果。 核心灵感来自 TypeSafe 的商业产品 Jev(System One 决策路径),但 …
评测基准 bespokelabsai/nimble Stars 1,647 Jay 2026-09-23
代表攻略
Skill Entropy:衡量并训练 LLM 跨技能切换能力 · 干货攻略
Skill Entropy 是普林斯顿大学(联合 CMU、UToronto、UIUC、Stanford、Oxford)团队提出的一套跨技能长程推理评测与训练框架,包含三个核心组件: 1. Skill Entropy(技能熵):一种度量技能切换难度的有向成对指标。当参考模型(Claudeopus4.7)分别处理两个技能时表现良好,但在连续执行两者时失败,则该技…
Gen-Verse/Skill-Entropy-RL Jay 2026-09-22
同类项目 2展开比较

同名 Awesome 仓库已合并展示,原攻略与详情链接均保留。

Coding Agent Harness 设计实证研究:176 实验教我们什么 · 干货攻略
这篇论文(arXiv:2609.20804,2026 年 9 月 17 日)是首批对 Coding Harness 进行组件级拆解实证研究的工作之一。 论文作者(RunZe Fan 等,来自 UMass Amherst、Emory、UNC Charlotte 和 Zoom)构建了一个模块化的轻量 Coding Harness,将执行循环固定,仅对三个组件进行…
Agent 智能体 无(纯 arXiv 论文,无开源代码仓库) Jay 2026-09-22
Dicklesworthstone/skillranker · 上手攻略
SkillRanker(命令 sr)是一个独立运行的 Rust CLI 工具,核心作用是在 AI 编码代理(Claude Code、Codex 等)的技能库中,根据当前会话的实时上下文,智能挑选最适合下一步的技能。它由 TypeSafe.ai 的 Jev 模型提供决策引擎,支持 Claude Code Hooks 集成、结构化 JSON 输出、主动弃权(ab…
Agent 智能体 Dicklesworthstone/skillranker Stars 115 Jay 2026-09-21
Procedural Graphs:让 LLM Agent 自进化执行结构 · 干货攻略
Procedural Graphs(过程图)是 Google 团队(Yuxing Lu、Yicheng Chen、Shanchan Wu、Sercan Ö. Arık)2026 年 9 月 8 日发表在 arXiv(2609.09153)的论文提出的 LLM Agent 执行结构框架。 其核心思想类比清晰: 知识图谱(Knowledge Graph)→ 用(…
Agent 智能体 无(论文 arXiv:2609.09153,Google 团队,未见公开代码仓库) Jay 2026-09-21
liyupi/ai-model-world · 上手攻略
AI Model World(大模型世界)是一个把 500+ 大模型可视化成像素小镇的互动网站。每个模型是某家厂商"小屋"里的一个像素角色,网站首页八块领奖台分别标注"今日最聪明""最会编程""最划算""最便宜""记性最好""最新发布""国内最强""开源最强",三秒扫完当天格局。背后数据来自 models.dev、Epoch AI、LiveBench、Hug…
多模态 liyupi/ai-model-world Stars 144 Jay 2026-09-20
GPT-6 Astra 编码 Agent 成本评测:$10/$50 定价与 Coding Agent Index 实测 · 干货攻略
GPT6 Astra 是 OpenAI 于 2026 年 9 月 3 日发布的旗舰模型,定位为「AI 工程师」级 Agent 主力引擎。本攻略聚焦其 API 接入成本 与 编码类 Agent 任务性价比,为有实际落地需求的开发者提供一份可复现的参考。 核心事实(均来自官方来源,详见「核验过程」): | 维度 | 数据 | ||| | API 模型名 | gp…
Agent 智能体 Jay 2026-09-20