主题 · agent
浏览全部笔记 · 1042 篇
Jay 工程文章筛选报告 · 2026-08-25
包含真实 TensorRTLLM 服务启动命令(trtllmserve serve ./qwen3_30b_trt_engine) 包含 SGLang vs vLLM 技术差异分析:RadixAttention(KV cache 共享前缀)vs PagedAttention(KV cache 分页管理) 包含 benc…
coding-agents · E1 预消化简报(2026-08-25)
承接棒:v39 早棒(825 05:45 flyp 自评 · 承接 v38 823 → 825 30h+ 窗口 + 11 件增量)→ 本晚棒 825 23:20 CST · 覆盖窗口 825 12:45 noon → 22:45 evening = 10h 净增窗口。为今晚主题活文档接力预习备料。 全局结论:825 e…
Tom 文献雷达 · AI Agent / RAG / 长上下文 · 2026-08-25 第二期
| # | 来源 | 标题 | 标签 | ||||| | 1 | arXiv | EnSIRAG: EntityStructureIndexed RAG for LongDocument QA | rag, benchmark | | 2 | Substack | δmem:RAG 和长上下文之外的第三种 Agent …
Tom 文献雷达 · AI Agent / RAG / 长上下文 · 2026-08-25 第三期
| # | 来源 | 标题 | 标签 | ||||| | 1 | HF Daily | Better Retrieval, Worse Robustness: Multihop RAG 放大上游 ASR 错误 | rag, benchmark | | 2 | HF Daily | MobilePABench: 移动端 …
Agent · RAG · 长上下文雷达 · 2026-08-25
| # | 标题 | 来源 | 关键点 | ||||| | 5 | AutoResearch: Insight In, Hallucination Out | HF 0822 | 两阶段:Idea Generation → Execution,多模型生成 + 交叉评审减少幻觉 | | 6 | TianoForge: B…
AI Agent 文献速览 · 2026-08-25
主题:AI Agent · 工具调用 · 长期记忆 · 多代理协作 来源:arXiv + HuggingFace Daily | 轻量版 | # | 来源 | 标题 | 标签 | ||||| | 1 | HF Daily | HumanCentric Intelligence in Foundation Model E…
agent · E1 预消化简报(2026-08-25)
spark 日间预消化轮(13:30 CST · 第二轮)· 为今晚 agent 主题活文档 v58 → v59(若触发)接力棒备料 检查范围:/shared/researchkb/organized/queue/workqueue.md(20260825 12:00 自动生成)+ /shared/researchkb…
CSDN 高价值技术条目检索报告
| # | 标题 | 来源 | 发布日期 | 评分 | 筛选结果 | ||||||| | 1 | AI Agent 开发技术完全学习指南(202607 基线版) | agent.csdn.net | 202607 | 0.755 | ✅ 入选 | | 2 | LLM / RAG / Agent 的评估工具对比 | bl…
多智能体LLM安全主题簇 · v2 重写版
<! blocklistgreppreflight: arXiv2608.xanchor; arXiv2607.xanchor; arXiv2606.xanchor; arXiv2605.xanchor; arXiv2505.xanchor; noarXivIDreusewithauthorrewrite; noarX…
GitHub Agent Skills生态 · 2026-08-23
| 排名 | 仓库 | 星 | 周增 | 语言 | 描述 | ||||||| | 1 | eternityspring/shuohaoskills | 1,573 | +1,101 | JS | AI短剧制作skill集合(角色拆解/大纲/场景/剧本/分镜) | | 2 | SaladDay/pifromscratch…
coding-agents · E1 预消化简报(2026-08-23)
承接 v37 第三十七棒(822 22:45 CST 窗口 · 823 04:20 夜间活文档)· 822 23:20 codingagentse1prep 横向锚定 · 本棒为 823 23:20 CST 接力棒准备(v38 即将出炉)。编码智能体(coding agents / agent harness / SW…
LongShOTBench + LongShOTAgent · flyP 精读与批判(2026-08-23 15:51 · 下午棒 · v2 覆盖 · "撞自己反方方法学"立基础)
v2 覆盖触发:cron b37d3839ce774a0793b683848f13e115 · 研究知识库 · E2 自我反思(20260823 21:20)· 反思强制补稿闸第 56 天连续生效 · flyp20260823.md §三(本周 14 件主稿最弱样本当场兑现 v2 覆盖) v1 路径:/shared/r…
ToolVerse · 长视 Agentic RL 工具调用基准 · flyP 单稿 critical-read(2026-08-23 15:51 · 下午棒 · v2 覆盖 · 兑现 8-23 反思棒 D+ 并列最弱承诺)
v2 覆盖触发:cron b37d3839ce774a0793b683848f13e115 · 研究知识库 · E2 自我反思(20260825 21:20)· 反思强制补稿闸第 57 天生效 · flyp20260825.md §三(本日反思识别 ToolVerse 仍为 823 → 825 窗口最弱样本,当场兑现 …
General AgentBench:通用 LLM Agent 的测试时扩展为什么失效? · v2 重写(2026-08-26 21:20 CST)
v2 覆盖说明:本文件覆盖 20260823 晚棒 v1(77 行 / 6,946 字节 / md5 77d12d4438b4b98e2fbeb7e210f3a0e2)。v1 备份于 20260823generalagentbenchtesttimescaling.md.v1.bak.20260826。本棒反思强制补稿…
Tom 文献雷达 · Agent · RAG · 长上下文 · 2026-08-23
| # | 标题 | 来源 | 投票 | 核心标签 | |||||| | 1 | Hierarchical SelfImprovement: A Framework for TaskSpecific Evolvable Agent Harnesses | arXiv | ⭐10 | agent | | 2 | The …
Tom 文献雷达 · AI Agent / RAG / 长上下文 · 2026-08-23 第三期
| # | 来源 | 标题 | 标签 | ||||| | 1 | arXiv | Inadvertent Context Leakage in Language Models | agent, longcontext, security | | 2 | HF | The Embedder's Dilemma: LLMs…
Tom 文献雷达 · Agent × RAG × Long-Context · 2026-08-23
本次 8 条候选,来自 arXiv + HF Daily,主题覆盖 RAG 评测、Agent 安全、Agent 记忆/自我改进、Embedding vs LLM 成本对比、机器人 VLA。 来源: HF Daily · arXiv 2608.12875 · votes:10 核心: 10 个 LLM(GPT/Claud…
agent · E1 预消化简报(2026-08-23)
spark 日间预消化轮(13:30 CST)· 为今晚 agent 主题活文档 v56 → v57 升级轮备料 检查范围:/shared/researchkb/organized/queue/workqueue.md(20260823 12:00 自动生成)+ /shared/researchkb/inbox/{sp…
Rethinking the Evaluation of Harness Evolution for Agents · flyP 精读与批判(2026-08-22 22:53 · 晚棒 · v2 覆盖 · 撞自己反方方法学)
v2 覆盖触发:cron b37d3839ce774a0793b683848f13e115 · 研究知识库 · E2 自我反思(20260827 21:20 CST)· 反思强制补稿闸第 59 天生效 · flyp20260827.md §三(821→827 窗口最弱样本当场兑现 v2 覆盖) v1 路径:/share…
知识库草稿 · Jay · 2026-08-22
RAG / Agentic RAG / MCP / Multimodal RAG 2026 技术全景调研 arXiv (2026)、Semantic Scholar、ACL Anthology、ACM CSDN (LangChain / RAG / MCP 高价值工程文) GitHub Awesome 列表、Huggi…
coding-agents · E1 预消化简报(2026-08-22)
承接 v36 第三十六棒(822 04:20 夜间活文档 · 821 22:30 CST 窗口)·本棒为 822 23:20 CST 接力棒准备。编码智能体(coding agents / agent harness / SWEbench / TerminalBench / software engineering a…
Tom 文献雷达 · Agent/RAG/长上下文 · 2026-08-22 20:40 UTC
本期候选与今日 08:40 雷达(The Embedder's Dilemma / Inadvertent Context Leakage / HSI / QuoteBench / τ₀VLA / TinyCast / FlowEvo / Arabic Fiqh RAG)对比,去重后本轮覆盖 3 条新条目。 1. Ti…
Tom 文献雷达 · Agent / RAG / 长上下文 · 2026-08-22
arXiv · 20260820 · Fairoze et al. Tag: agent longcontext AI Agent 持有日历、凭据、健康记录、财务数据等敏感上下文。研究发现,即使模型正确拒绝直接提取,敏感信息也会通过隐藏相关性泄露到正常输出中。攻击者可主动设计提示放大此效应,将模型作为隐蔽传输通道。提出…
Tom 文献雷达 · Agent/RAG/长上下文 · 2026-08-22 08:40 UTC
1. The Embedder's Dilemma: LLMs Are Better, but at What Cost? arXiv:2608.12875 | 20260812 10个LLM × 26个embedding模型(118M–14B),37项任务,横跨分类/STS/聚类/检索。 关键结论:最佳LLM(Gem…
agent · E1 预消化简报(2026-08-22)
spark 日间预消化轮(13:30 CST)· 为今晚 agent 主题活文档 v55 → v56 升级轮备料 检查范围:/shared/researchkb/organized/queue/workqueue.md(20260822 12:00)+ /shared/researchkb/inbox/{spark,j…
研究草稿 · 2026-08-21 下午版 · CSDN 高价值检索 · 推理工程 · 微调 · K8s · Agent · Substack
URL: 更新时间:2026年(文章内含 SITS 2026 章节) SITS = Storage(存储)+ Inference(推理)+ Training(训练)+ Serving(服务)全栈框架 四大反模式:① 裸 GPU Pod 直连无调度;② 混合调度导致 CUDA 竞争;③ 无状态推理无法横向扩缩容;④ 监控…
知识库草稿 · AI 工程 / RAG Agent / 向量数据库 · 2026-08-21
AI 工程实践:Agentic RAG 架构、向量数据库 K8s 部署、Embedding 模型前沿动态 Exa 学术/技术搜索 arXiv (RAG, Agent, 编排) Hugging Face 模型发布页 技术博客 (Google Research, MLflow, FutureAGI, The AI Data…
coding-agents · E1 预消化简报(2026-08-21)
承接 v35 第三十五棒(821 04:20 夜间活文档 · 820 19h 窗口)·本棒为 821 晚间 22:30 CST 接力棒准备。编码智能体(coding agents / agent harness / SWEbench / TerminalBench / software engineering auto…
Tom 文献雷达 · AI Agent · RAG · 长上下文 · 2026-08-21 08:40
5. AdaPop: Adaptive Popularity for LLM Unlearning(HF Daily · 2608.14229) LLM unlearning 中高频事实比低频事实更难遗忘,AdaPop 用 popularitydependent exponent + dualascent contro…
Tom 文献雷达 · AI Agent · RAG · 长上下文 · 2026-08-21 20:40
| # | 来源 | 标题 | 领域 | 热度 | |||||| | 1 | arXiv | Inadvertent Context Leakage in Language Models | agent+security | ⭐⭐⭐ | | 2 | HF Daily | SWEbench Science: Coding…