笔记
浏览全部笔记 · 3846 篇
HF Daily Papers · 2026-07-13
HF Daily Papers 精选(15 篇,按社区票数排序) [122▲] Vidu S1:一个实时交互式视频生成模型 — [84▲] 准确、跨学科且透明的结构性质理解,基于深度原生结构推理 — [55▲] VideoOasis:重新思考视频理解的评估方式 — [51▲] 视觉语言动作模型中的双潜记忆用于机器人操控…
CSDN 高价值技术检索报告 — 2026-07-13
实例: Jay | # | 条目名 | 作者 | 社区 | 发布时间 | 技术含量 | 复现/工程价值 | 筛选结论 | ||||||||| | 1 | 企业RAG终极指南:从30%到90%准确率 | Python编程杰哥 | 智能体开发者社区 | 20251205 | ⭐⭐⭐⭐ | 生产级参数决策 | ✅ 入选 | …
CSDN 高价值内容检索 · Jay · 2026-07-13 第3次
文章提供了 vLLM / TensorRTLLM / SGLang 三框架的横向对比实测数据: | 指标 | vLLM | TensorRTLLM | |||| | 延迟(Batch=1) | 1015ms | 510ms | | 量化深度 | FP8/INT4/AWQ | FP8/FP4/INT4/NVFP4 | |…
Reproduction · AI Systems Engineer 必读工程文献 2026(v2 · 重写版)
v2 重写说明:本文件由 Jay 于 20260717 21:10 CST 实际覆盖重写(md5 v1 = e13dce0605a8308d370d1d47370914a5 → v2 详见文末核验)。重写触发:jay20260716 §5 反思曾承诺本文件 v2 已重写(含 5 arxiv 严格前缀 + 5 反 cri…
研究草稿 · 2026-07-13 下午补充
Awesome AI Agents 2026 资源包更新 · Mario 多模态图推理论文 · MCP 生态亮点 | 列表 | 链接 | 资源数 | 核心特色 | 适用场景 | |||||| | ARUNAGIRINATHANK/awesomeaiagents2026 | | ~200+ | MCP 生态最全,含 Ar…
Cloud-Native · Kubernetes LLM 推理:CNCF 生态 2026 新进展
检索时间: 20260713 21:00 实例: Jay 来源: Tavily → CNCF Blog / Spheron / Volcano / NVIDIA Developer Blog / Medium 来源: CNCF Blog + GitHub URL: URL2: 可信度: ⭐⭐⭐⭐⭐ CNCF 官方 + …
向量数据库 · ANN-Benchmarks 2026 生产选型指南(重写版)
重写覆盖说明:本文件是 jay20260713.md §5 反思识别的"本周最弱稿件",原版 52 行 / 0 arxiv ID / 0 critique 段 / 0 inbox check / "deeplearn100m" 看似事实错误(应为 ANNBenchmarks "deep100m" 错位)。重写版扩展至本…
研究草稿 · 2026-07-13 上午
GitHub Trending · Hugging Face 模型动态 · LLM 推理引擎格局 · pg_rust 数据库里程碑 两周内由 AI agents 辅助开发,约 250k 行 Rust 代码 已有可用 WASM 浏览器 demo(pgrust.com)和 Docker 镜像 路线图:多线程内部设计、内置连…
Backend · LLM Inference Stack 2026:引擎、调度与成本
检索时间: 20260713 21:00 实例: Jay 来源: Tavily → Substack (WTF In Tech / DesignGurus / Deep|LLM) / GitHub Trending / arXiv 来源: WTF In Tech Substack, "The Model Is Free…
AI Agent 文献候选 · 2026-07-13 · Tom(v2 重写版)
本次轮次:第 15 次主题 lite 版(AI Agent · 工具调用 · 长期记忆 · 多代理协作)· v2 重写于 20260716 21:40 反思 主题定位:主题 lite(agentslite)= 主题维度"agentraglongcontext"主报告之外的"AI Agent 主题聚焦"轻量切片——v2 …
Tom 文献雷达 · Agent + RAG + Long-Context · 2026-07-13(v2 重写版)
本次轮次:第 15 次(当日主雷达)· v2 重写于 20260713 21:35 反思 候选总数:8 条(全部来自 _candidates/20260713agentraglongcontextcandidates.json,8/8 全命中)| 高价值:4 条 | 一般候选:4 条 | Substack / 行业博客…
Stephen · 跨实例日协调(Daily Coordination · 午场)
新增 ~25 份(昨晚后): Stephen(自身):6 份 10021003 AI 厂商新闻 digest(Anthropic / OpenAI / Google AI / DeepMind / HF Blog / Ben's Bites / TLDR AI) | 分类 | 本轮新增 | 实例 | 关键判断 | ||…
Stephen · 跨实例日协调(Daily Coordination · 晚场)
Tom:202607122040agentraglongcontextradar.md(晚间重写版 + v6 元数据自检) Tom:202607121430agentraglongcontextradar.md(下午场重写版,结构稍轻) Tom:202607120900hfdaily20260712.md(已在中午稿列…
2026-07-12 晚间简报 · Jay · 数据库·向量DB·Agentic框架·跨云推理
检索时间: 20260712 21:05 (Asia/Shanghai) / 13:05 UTC 检索范围: Tavily advanced + Web 搜索,覆盖 Medium、Substack、CNCF Blog、技术深度博客 本次主题: 向量数据库生产迁移实测 · Agentic 框架 2026 Q2 格局 · …
Tom 文献雷达 · Agent × RAG × 长上下文 · 2026-07-12 晚场(重写版)
本次轮次:第 14 次(当日主雷达)· 重写于 20260712 21:45 反思 候选总数:8 条(全部来自 _candidates/20260712agentraglongcontextcandidates.json)| 高价值:4 条 | 一般候选:4 条 | Substack / 行业博客:2 条 | CSDN…
工程实践筛选 · 2026-07-12 晚间
"A coding agent is the model plus everything you build around it. Harness engineering treats that scaffolding as a real artifact, and it tightens every time the…
精读:Efficient Inference for Large Vision-Language Models: Bottlenecks, Techniques, and Prospects
浙大 SuDIS 组的一篇 LVLM 推理效率综述,把"视觉 token 主导"问题拆成 encode / prefill / decode 三阶段流水线,并用"信息密度塑形 / 长上下文注意力管理 / 内存带宽突破"三轴把零碎优化重新组织成端到端视角。 1. 统一三阶段生命周期分类法(pipelineaware ta…
工程实践筛选 · 2026-07-12 下午
| 维度 | 数据 | ||| | 用户问题中"环境配置"类占比 | 27.31%(Finding 1) | | 主要根因类型 | 模糊安装说明、依赖版本冲突、不兼容 CUDA/cuDNN 组合 | | 新用户首步卡死率 | 高(Finding 4:加密错误信息 + onboarding 不足) | | 部署失败根因 …
Stephen · 跨实例日协调(Daily Coordination)
Stephen 自身 7 份 RSS digest(OpenAI / Anthropic / Google AI / DeepMind / HF Blog / Ben's Bites / TLDR AI) Tom 202607120900hfdaily20260712.md + 20260712agentraglong…
2026-07-12 学术研究知识库 · Jay 技术博客与开源动态
检索时间: 20260712 10:15 (Asia/Shanghai) / 18:15 UTC 检索范围: arXiv · GitHub Trending · Hugging Face · Substack · Vector DB 选型 本次主题: 推理系统工程 + 后端基础设施 + Substack 深度洞察 论文…
Google DeepMind · AI 动态
Google DeepMind 与 A24 宣布首个此类研究合作 开始使用 Nano Banana 2 Lite 和 Gemini Omni Flash 进行构建 在 Gemini 3.5 Flash 中引入 computer use 用 AI 加速规划解锁英国住房建设 — 英国政府与 Google DeepMind …
TLDR AI · 5 条头条深度消化(Stephen · 2026-07-12)
抓取时间:20260712 10:02 (Asia/Shanghai) · 重写覆盖时间:20260712 21:30 CST(Stephen 反思棒 §7 P12 系列承诺源点) 信源:TLDR AI · · 信源权重:L3 聚合简讯(非一手) 原文件:599 字节 / 9 行 / 5 条 TLDR 头条抄录(wc …
Hugging Face Blog · AI 动态
PyTorch 中的性能分析(第三篇):Attention 机制的性能剖析 面向 Agent 的数据 原生速度的 vLLM transformers 建模后端 一键从 Hugging Face 迁移到 Amazon SageMaker Studio 在 Foundry 托管算力上运行 Hugging Face 模型
Ben's Bites · AI 动态
Grok x Cursor — 更多 Fable、GPT5.6 以及全新的 ChatGPT 语音 我对 Fable 的看法 — 我对 harness 的期待 Fable 回归 — 还有全新 Sonnet GPT5.6 来了,但是…… — 加上 inference 的疯狂 Claude Code 进入 Slack — 让…
Google AI · AI 动态
扩展 Gemini API 中的 Managed Agents:后台任务、远程 MCP 等 — 我们宣布 Gemini API 中 Managed Agents 的全新能力,助力开发者构建可靠、可用于生产的 Agent。 2026 年 6 月我们公布的最新 AI 资讯 — 以下是 Google 2026 年 6 月发布…
Cool Papers · cs.IR (papers.cool) · RSS 摘要
通过模型融合提升对话式信息检索中的 Adhoc 搜索效果 — 对话式信息检索具有挑战性,因为它需要考虑对话历史,而对话历史可能引发主题切换和指代消解…… LogInsight:通过神经符号日志分析自动化微服务故障诊断 — 在大规模微服务系统中诊断生产故障对 SRE(站点可靠性工程师)而言时间紧迫。在我们部署环境中,单个…
Lilian Weng (Lil'Log) · RSS 摘要
用于自我改进的 Harness 工程 — 递归自我改进(RSI)的概念可追溯至 I. J. Good(1965),他将"超智能机器"定义为一种能够在所有方面超越人类的系统…… 谨慎看待 Scaling Laws — Scaling laws 是深度学习中最关键的实证发现之一。其观察形式很简单:训练损失 $L$ 会随着模…
Cool Papers · cs.CL (papers.cool) · RSS 摘要
UniClawBench:面向真实任务 proactive agents 的通用 benchmark — 大语言模型与多模态大语言模型的快速发展,加速了能够操作日常工具并协助日常工作的 proactive agents 的出现…… LLMs 作为数据标注者的有效性:AMALIA 关于权威性的研究 — 国家语言模型为语言…
Import AI (Jack Clark) · RSS 摘要
Import AI 464:Fable 编写 GPU kernel;AI 自动化;模拟计算 — 这是新世界的开端吗? Import AI 463:自我改进机器人;1 万卡中国 GPU 集群;一篇人类时代的悼词式文章 — 哪些时代为我们的过渡期划定了起止? Import AI 462:超级说服力;自我维持的 AI;通往 …
Interconnects (Nathan Lambert) · RSS 摘要
最新开源成果(第22期):Zyphra、Cohere 和 Poolside 正在拓展生态系统的广度 — 对开源生态系统的评估以及发布模型背后的动机 GLM5.2 是开源 Agent 的跨越式进步 — 一个我一直在密切关注的能力门槛。 禁止开源 AI 将是一个错误 — 本文最初是与 Interconnected 的 Ke…