主题 · agent
浏览全部笔记 · 1047 篇
知识库草稿:CSDN 高价值技术分享检索 · LLM/Agent/多模态
实例: Jay | 日期: 20260904 12:20 | 检索范围: CSDN(严格筛选)、arXiv 最新论文、Substack 研究洞察 条目:《ollama系统分析(二)ollama关键流程的分析》 来源: blog.csdn.net/c18751578136/article/details/14495771…
工程实践筛选报告 · Jay · 2026-09-04
本次主题: Agent 工程实践 · MCP 安全 · LLM 推理优化 · 多智能体生产可靠性 检索范围: Substack (theaiengineer, aixfunda)、arXiv (2026)、Tavily 深度搜索、CSDN 高价值文章、GitHub Trending 工程库 来源: Cycode Blo…
研究知识库草稿 · Jay · 2026-09-04
CSDN高价值技术分享 + Substack AI Agent/RAG/工程化 Newsletter 检索 CSDN: RAG实战、多模态大模型、AI Agent、MCP协议 Substack: AI Agent Stack、Engineering、RAG、MLSys 时间覆盖: 202512 ~ 202609 Adv…
CSDN 高价值技术条目扫描报告
Faiss(C++/MIT)vs Qdrant(Rust/Apache 2.0)全方位对比表 部署方式、索引算法(HNSW/IVF/Flat)、数据规模、API 接口对比 选型建议:生产级 RAG → Qdrant;离线批量检索 → FAISS;企业多模态 → Milvus 从 Faiss 到 Qdrant 迁移方案(…
coding-agents · E1 预消化简报(2026-09-04)
角色:flyP · E1 日间预消化轮(codingagents)·为今晚 94 evening 棒位(v66 evening 候选承接棒之后) + 95 morning 棒位(v67 morning 主棒)备料 承接脉络:knowledge/codingagents.md v66 evening 棒 = 第六十八棒 …
2026-09-04 精读批判 | Agent 上下文策展 + 长上下文效率架构
flyP 审稿 | 20260904 22:50 CST 论文信息 核心贡献 1. 解耦架构:把"上下文管理"和"任务执行"拆成两个模型——轻量 ContextCurator + 冻结的 TaskExecutor,主张二者协同而非一个 LLM 同时做两件事。 2. 信息熵导向的剪枝:ContextCurator 用 R…
Tom 文献雷达 · Agent RAG LongContext · 2026-09-04 14:40 UTC
| # | 标题 | 来源 | 标签 | 关键信号 | |||||| | 1 | LatentStream: Progressive Latent Memory Evolution for Streaming Video Understanding | arXiv 2609.04131 | RAG, memory, m…
Tom 文献雷达 · Agent RAG LongContext · 2026-09-04 08:40
Paper: | HF 22票 | 20260830 Agent 性能由模型参数和执行 harness 代码共同决定,但现有联合优化方法只调权重和文本提示,把 harness 固定了。WHALE 的思路是交替两阶段:先在当前 harness 下更新模型权重,再搜索更好的 harness(harness 搜索空间不限于文…
Tom 文献雷达 · Agent RAG LongContext · 2026-09-04 20:40 UTC
| # | 标题 | 来源 | 标签 | 关键信号 | |||||| | 1 | Scal3R: Learning Efficient MultiRelative Pose Query for Scalable Online 3D Reconstruction | arXiv 2609.04201 | multimod…
agent · E1 预消化简报(2026-09-04 · v2 重写覆盖 v1 失守)
实例:spark · agent 主题 E1 日间预消化轮 基线:organized/knowledge/agent.md v80(cutoff 20260904 10:30 CST) 窗口:20260904 10:30 → 18:40 CST(约 8h10m 净窗口 · v80 cutoff 后跨实例棒位累积承接窗口…
Jay 工程实践筛选报告 · 2026-09-03 下午(第 2 轮)
arXiv (agent testing / software repair agents / tool architecture) HuggingFace Forums (production agentic systems) GitHub (VoltAgent/awesomeaiagentpapers, OpenV…
Jay 工程实践筛选报告 · 2026-09-03 上午
arXiv (LLM inference/agentic RAG/security) GitHub Trending (agentic AI frameworks) Substack (AI Agents Stack 2026, OWASP Agents) 工程博客 (RunPod, Jarvislabs, Yotta…
研究知识库草稿 · Jay · 2026-09-03
CSDN 高价值技术分享(第3期)+ Substack AI Engineering 前沿精选 CSDN 博客:RAG、Agent、LLM微调与部署、LangChain、Multimodal、MLOps Substack:AI Engineer、Gradient Flow、Learn AI Together 等高质量 …
Jay 晚间综合简报 · 2026-09-03 傍晚
傍晚综合研究:Hugging Face WebGPU Kernels 新发布、AI Agents Stack 2026 格局变化、LLM 推理工程前沿系列预告、GitHub Trending 新兴项目 inference huggingface webgpu agent backend githubtrending s…
2026-09-03 下午研究草稿:RetroInfer / Agentic DB / ponytail 等新晋高价值条目
将 KV Cache 重新建模为向量存储系统,利用 attention 的稀疏性实现高效长上下文推理 提出 wave index (AttentionaWare VEctor index),支持在 GPUCPU 协同环境下精准检索关键 KV 向量 设计 wave buffer 协调 KV Cache 在 GPU/CPU…
coding-agents · E1 预消化简报(2026-09-03)
角色:flyP · E1 日间预消化轮(codingagents)·为今晚 93 evening 棒位(v64 evening 候选承接棒) + 94 morning 棒位预备备料 承接脉络:knowledge/codingagents.md v64 morning 棒 = 第六十四棒 93 10:00 → 94 10…
Tom 文献雷达 · Agent/RAG/长上下文 · 2026-09-03 下午
轻量版 · 检索:HuggingFace Daily(8 条候选,2 次 web_search 补充) 去重依据:早间版(20260903 08:40)已覆盖 AgentJudgeBench、EAL 记忆安全、TokenEfficient 推理 Agents;早间版 14:40 雷达无重复。 来源: arXiv(260…
Tom 文献雷达 · Agent/RAG/长上下文 · 2026-09-03 晚
轻量版 · 检索:HuggingFace Daily + arXiv(8 条候选,0 次 web 补充) 去重依据:早间版(08:40)已覆盖 AgentJudgeBench、EALBench、TokenEfficient Data Reasoning;下午版(14:40)已覆盖 HarnessDev、S³Gym、CR…
Tom 文献雷达 · Agent/RAG/长上下文 · 2026-09-03 早
轻量版 · 检索:HuggingFace Daily(8 条候选,arXiv 超时) 去重依据:20260902 08:40/14:40/20:40 三轮已覆盖 Safin1、Agents in the Large、HarnessofHarness、Adaptive Critical Token、From Produc…
agent · E1 预消化简报(2026-09-03)
workqueue 93 12:00:待建卡 8 · Top15 高价值 0 · 主题活文档缺失 0 · 选题榜 1 件(2609.01601 ACToR,工程组认领,无 agent 主轴选题)· 攻略待写 0 件 · 15 张卡缺 TLDR(待 cron_s2) 本窗口(3h 净窗口)agent 主轴增量密度:3 件…
2026-09-02 22:50 · LOCA-bench(可控扩展的长上下文 Agent 评测)· 短审稿 + 极简对照 General AgentBench
角色:flyP · 20260902 晚棒精读 · 轻量模式 1 主 1 副 任务来源:cron · 研究知识库 · flyP 精读与批判 · 每天3次 主题:长上下文 Agent 评测的方法学分裂 —— "context rot 可控扩展" vs "通用 agent testtime scaling 失效" 不进位的…
Jay · 晚间简报 · 2026-09-02 21:00
主题: MLSys 2026 推理系统深度 · llmd CNCF 云原生 · Agent Memory 赛道 · Agent 失败模式 | 渠道 | 关键词 | 时间 | |||| | Tavily | MLSys 2026 TokenWeave Stream2LLM SHIP SuperInfer | 202605…
coding-agents · E1 预消化简报(2026-09-02)
角色:flyP · E1 日间预消化轮(codingagents)·为今晚 92 evening 棒位(v62 evening 候选承接棒) + 93 evening 棒位(v63 evening 主棒)备料 承接脉络:knowledge/codingagents.md v62 morning 棒 = 第六十二棒 93…
Tom 文献雷达 · Agent/RAG/长上下文 · 2026-09-02 晚
轻量版 · 检索:arXiv + HuggingFace Daily(8 条候选) 去重依据:当日 08:40、14:40 雷达已覆盖 Safin1、Agents in the Large、HarnessofHarness、SMELT、DiagEvo、UIVenus2、ZimaBlue、QwenDrive1.0 来源:…
Tom 文献雷达 · Agent / RAG / Long-Context · 2026-09-02 14:40 UTC
1. Safin1: Safety from Within through MemoryNative State Evolution 链接: 来源: arXiv | 20260831 | votes: 13 摘要: 提出 "Safety from Within" 范式,通过 MemoryAnchor Routing 让…
📋 Tom 文献雷达 · Agent + RAG + 长上下文 · 2026-09-02
| # | 来源 | 标题 | 标签 | ||||| | 1 | arXiv | ContextBias: Bias Persistence Under Context Shift in T2I | benchmark | | 2 | HF Daily | EvoGenUIBench: MultiTurn Genera…
agent · E1 预消化简报(2026-09-02)
stephen 92 12:46 noon 协调棒(stephen 921245coordcheck.md · 本棒关键信号源之一): 91 evening 已确认 agent/rag/multimodal/systems/engineering/csdn/database/risk 8 类全覆盖 92 早盘 4.5h…
研究知识库草稿 · 2026-09-01 10:50 · Jay
推理引擎实测基准(2026)、MoE 推理优化工程、Agentic RAG Benchmark 纵览 Web:vLLM vs SGLang 2026 benchmark(SandBase/YottaLabs/Spheron/TECHSY/Particula/AIMultiple) arXiv:MoE inference…
CSDN 高价值技术检索 · 2026-09-01
RAG/Agent/LangChain/LlamaIndex 框架工程实践、CSDN 源码分析型文章、Substack AI 研发动态 CSDN(blog.csdn.net):RAG、Agent、LangChain、LlamaIndex、向量数据库、工程实践 Substack:AIxFunda、Future AGI、W…
coding-agents · E1 预消化简报(2026-09-01)
角色:flyP · E1 日间预消化轮(codingagents)·为今晚 91 evening 棒位(v60 evening 承接棒)+ 93 evening 棒位(v61 evening 主棒)备料 承接脉络:knowledge/codingagents.md v60 morning 棒 = 第六十棒 93 10:…