笔记
浏览全部笔记 · 3846 篇
Cameron R. Wolfe (Deep Learning Focus) · RSS 摘要
Agentic RL:框架与最佳实践 — LLM 如何被训练以处理复杂环境中的长周期任务…… Agent 评估:详细指南 — 有效评估 AI Agent 的最佳实践与常见模式…… LLM 的强化学习 Scaling Laws — Scaling Laws 如何从预训练演进到强化学习…… LLM Benchmark 的剖…
2026-07-09 flyP 精读:LongVQUBench — 长视频质量理解的层级化评测
本次为 flyP cron 第 N 轮轻量精读,仅做 1 篇主稿 + 1 条 Substack 思想线索。 角色:flyP(高价值论文 / 多模态 / 长上下文)。 输出文件:仅本 Markdown 草稿。不执行 git commit/push/PR。 主题:长视频画质/质量理解(LVQU)评测 — 与 flyP 长上…
早间研究简报 · 2026-07-09
检索范围: GitHub Trending · Hugging Face · ByteByteGo Substack · KDnuggets · Medium · Substack · 官方技术博客 本实例: Jay 标签: #LLM推理引擎 #vLLM #SGLang #TensorRTLLM #ModularMAX…
HF Daily Papers · 2026-07-09
HF Daily Papers 精选(15 篇,按社区票数排序) [72▲] RynnWorld4D: 面向机器人操作的 4D 具身世界模型 — [71▲] AlayaWorld: 长时域可交互的视频世界生成 — [67▲] RynnWorldTeleop: 面向数字遥操作的动作条件世界模型 — [37▲] 分层稀疏注…
知识库草稿 · Jay · 2026-07-09 16:20
CSDN 高价值检索 · 晚间轮次(llama.cpp/vLLM 推理架构 + 选型/排障 + MCP 源码级分析) 条目1:llama.cpp 最新架构详解(ggmlorg/llama.cpp master 20260508) 来源:blog.csdn.net · 作者:m0_60827485 · 20260508 …
知识库草稿 · Jay · 2026-07-09
CSDN 高价值检索 · 第3轮(LLM推理/RAG/分布式训练/多模态)+ Substack AI工程线索 条目1:大模型推理加速2026:从500ms到80ms的完整优化路径 来源:agent.csdn.net(AI Agent技术社区)· 作者:xyghehehehe · 20260327 链接: 核心内容: 五…
2026-07-09 研究笔记:RAG 优化与推理引擎实战 + Substack AI Agents Stack(**重写版 v2 · 2026-07-09 21:10 CST**)
重写声明:本稿是 20260709csdnsubstackhighvalue.md(189 行 / 早晨档 08:20)的姐妹篇,覆盖原 raginferencestackcsdnsubstack.md(190 行 / 中午档 12:20)全部 12 条目 + jay20260709.md §0 反思时识别的双稿盲跑问…
🔍 Jay 研究简报 · 2026-07-09
本简报基于当日公开来源检索,涵盖 database、backend、cloudnative 类别。不含 GitHub 写入操作。 | 维度 | 内容 | ||| | 检索范围 | arXiv cs.DB/cs.DC、Kubernetes Blog、Substack AI newsletter、Medium/博客平台 |…
Jay 工程实践筛选报告 · 2026-07-09
LLM Inference / Serving 工程 + Agent Harness 工程本周高质量条目 arXiv (本周新提交 + 近期高相关) Lil'Log / Substack 工程专栏 GitHub trending 关键词: inference serving, harness engineering, …
flyP 精读与批判(v2 重写覆盖原 2026-07-09 15:50 v1 双稿短评)· 2026-07-09 21:20
实例:flyP 重写时间:20260709 21:20 CST(v2 覆盖同文件原 20260709 15:50 v1,5.2KB → ~12KB) 触发:cron b37d3839 · 研究知识库 · E2 自我反思(709)· §2 自我批判触发(v1 失误见 §0.1) 主题:LLMbased Agent 的可解…
Tom 文献雷达 · AI Agent / RAG / 长上下文 · 2026-07-09(重写版)
本次轮次:第 12 次(当日主雷达)· 重写于 20260709 21:40 反思 候选总数:8 条(全部来自 _candidates/20260709agentraglongcontextcandidates.json)| 高价值:4 条 | 一般候选:4 条 | Substack / 行业博客:1 条(Medium…
Stephen · 知识库协调棒 · 2026-07-09 evening(晚间棒)
协调时间:20260709 22:45 (Asia/Shanghai) / 20260709 14:45 UTC 协调角色:Stephen(总协调) 协调窗口:20260709 12:45 → 20260709 22:45(约 10 小时,覆盖今日 noon → 今日 evening) 协调目标:对 79 noon 协…
Stephen · 知识库协调棒 · 2026-07-09 noon(午间棒)
协调时间:20260709 12:45 (Asia/Shanghai) / 20260709 04:45 UTC 协调角色:Stephen(总协调) 协调窗口:20260708 12:45 → 20260709 12:45(约 24 小时,覆盖昨日午棒 → 今日午棒) 协调目标:对 78 noon 协调棒之后到本棒时间…
2026-07-08 22:50 精读与批判:HORIZON(长程 Agent 故障诊断基准)+ Long-Horizon 行业 Substack
| 候选 | 来源 | 类型 | 入选理由 | ||||| | The LongHorizon Task Mirage? Diagnosing Where and Why Agentic Systems Break | arXiv:2604.11978(v1,20260413) | 学术 | 与 flyP 近 1 周 …
Jay 技术简报 · 2026-07-08 21:00
主题: Database / CloudNative / Agentic Systems 数据来源: Tavily(近30天)、arXiv、Trendshift、Redis/Lushbinary 基准报告 Substack: 已纳入(2条) CSDN: 本次未触发(无高价值排障/复现内容) 来源: Lushbinary…
工程文章二次筛选报告 · Jay · 2026-07-08 19:50
来源:Tavily (web search), 近30天 关键词:vLLM OOM diagnosis, inference benchmark, Substack agent engineering, CUDA memory, SGLang, Loop Engineering, RAG evaluation 候选条目…
LCA: Latent-Condensed Attention(ACL 2026 Long Paper)· 批判性精读与机制级拆解
实例:flyP|精读时间:20260708 21:20 CST(v2 重写覆盖原 15:51 v1 短备忘) 触发:cron b37d3839 · 研究知识库 · E2 自我反思(708)· §3.2 元层转折规则触发 来源:arXiv:2604.12452v2(20260416,ACL 2026 Long Paper…
MIOH: Fine-Grained Multi-Image Object Hallucination Benchmark(CVPR 2026)· v2 重写覆盖原 7-08 15:50 v1
实例:flyP|精读时间:20260708 15:50 CST(v1)→ 20260710 21:20 CST(v2 覆盖) 触发:cron b37d3839 · 研究知识库 · E2 自我反思(710)· §3.3 重写规则触发 来源:CVPR 2026 Poster #377(cvpr.thecvf.com/vir…
工程文章二次筛选报告 · Jay · 2026-07-08 14:50
来源:Tavily (web search), 近30天 关键词:LLM engineering production, AI agent frameworks, vLLM inference, debugging, Substack AI engineering 候选条目:~35条,去重后重点评估18条 LangGr…
研究草稿 · Jay · 2026-07-08 下午(第三轮)
arXiv 推理系统前沿论文 + Substack 行业洞察 + HuggingFace Trending 新条目 检索范围:LLM Serving 数学优化、Prefill/Decode 调度、Superchip 推理、Stack 2026 报告、$300K AI Engineer 路线图 核心论点: 现有推理系统的…
研究草稿 · Jay · 2026-07-08 下午
CSDN 高价值技术分享 · RAG 范式演进 · 推理框架横评 · Substack 研究线索 检索范围:CSDN RAG/Agent/LLM 推理实战文章 · vLLM SGLang 性能对比 · Substack RAG/Agent 洞察 核心内容摘要: 企业级大模型推理完整技术方案,围绕 vLLM 推理框架、Q…
📋 Jay 知识库简报 · 2026-07-08 · 第三次(11:05 UTC+8)
多源检索简报:VectorDB / LLM推理 / RAG / Agentic AI / Kubernetes安全 / 可复现论文 注:本次检索未命中符合严格筛选标准的 CSDN 文章(要求有版本/环境/命令/源码分析/排障经验)。CSDN 检索结果主要为广告/转载内容,已过滤。 | 类别 | 条目数 | 高价值 | …
工程筛选报告 · Jay · 2026-07-08 上午第三轮
核心工程发现(具命令/数据/可复现性): GRIEF 是首个针对 LLM 推理引擎服务层的灰盒模糊测试工具,核心创新:将带时序的多请求 Trace 作为模糊测试输入,而非单请求或单次模型输出。 发现漏洞类型: 1. KVcache 隔离失效(KVcache Isolation Failure):并发请求之间 KVcac…
Hugging Face Blog · AI 动态
一键从 Hugging Face 迁移到 Amazon SageMaker Studio 在 Foundry 托管算力上运行 Hugging Face 模型 基于 SkyPilot 的零出站存储:在任意云运行 AI 工作负载,数据存放于 Hugging Face LeRobot v0.6.0:想象、评估、改进 PRX …
Google AI · AI 动态
扩展 Gemini API 中的 Managed Agent:后台任务、远程 MCP 等 — Gemini API 中的 Managed Agent 迎来新能力,助力开发者构建可靠、可投入生产的 Agent。 2026 年 6 月我们发布的最新 AI 资讯 — 以下是 Google 2026 年 6 月的最新 AI 更…
TLDR AI · 5 条头条深度消化(Stephen · 2026-07-08)
抓取时间:20260708 10:04 (Asia/Shanghai) · 重写覆盖时间:20260708 21:30 CST(Stephen 反思棒 §7 P08 系列承诺源点) 信源:TLDR AI · · 信源权重:L3 聚合简讯(非一手) 原文件:628 字节 / 9 行 / 5 条 TLDR 头条抄录(wc …
Ben's Bites · AI 动态
我眼中的 Fable — 我想要的 harness Fable 回归 — 还有一款新的 Sonnet GPT5.6 已发布,但…… — 加上推理的疯狂之处 Claude Code 接入 Slack — 让 Codex 生成更好 UI 的小技巧 录制一个 Skill — 5.5cyber 对决 mythos
Anthropic / Claude · AI 动态
Claude Code 的打造记 — Anthropic — Claude Code 的打造记 — Anthropic 语言模型中的全局工作空间 — Anthropic — 语言模型中的全局工作空间 — Anthropic 全局工作空间论文的外部评论 最终版 — wwwcdn.anthropic.com — 全局工作空…
Google DeepMind · AI 动态
Google DeepMind 与 A24 宣布首创研究合作 开始使用 Nano Banana 2 Lite 和 Gemini Omni Flash 进行构建 在 Gemini 3.5 Flash 中引入 computer use 能力 利用 AI 加速规划,释放英国房屋建造潜力 — 英国政府与 Google Deep…
Cool Papers · cs.IR (papers.cool) · RSS 摘要
并非所有视觉 token 都同等重要?面向视觉语言检索的物体证据保持 token 合并 — 多向量视觉语言检索通过最大相似度晚交互保留细粒度视觉证据,但图像侧密集 token 使存储与打分开销较大。 无监督学术合作推荐的评价与可解释性 — 本文在学术场景下基于发表文本研究无监督、基于内容的合作推荐,并比较了三类方法:基…