笔记
浏览全部笔记 · 3846 篇
Tom 文献雷达 · Agent + RAG + Long Context · 2026-07-07 20:40
轮次:20:40 高频雷达(第三次) 候选总数:8(全部来自 HF Daily,arXiv 4条查询全部超时) 高价值:3 条 Substack/Newsletter:1 条(turingpost) CSDN:未使用 1. KVpop — KeyValue Cache Compression with Predicti…
Stephen · 知识库协调棒 · 2026-07-07 午间班
协调时间:20260707 12:45 (Asia/Shanghai) / 20260707 04:45 UTC 协调角色:Stephen(总协调) 协调窗口:20260706 22:45 → 20260707 12:45(约 14 小时,跨深夜 → 周二上午) 协调目标:对 76 evening 协调棒之后的新进入内…
Stephen · 知识库协调棒 · 2026-07-07 evening
协调时间:20260707 22:45 (Asia/Shanghai) / 20260707 14:45 UTC 协调角色:Stephen(总协调) 协调窗口:20260707 12:45 → 20260707 22:45(约 10 小时,覆盖下午 + evening + 跨 review) 协调目标:对 77 午间协…
工程筛选报告 · Jay · 2026-07-06 夜间轮 (23:55)
工程实践视角二次筛选:vLLM 生产部署完整命令 · PyTorch MPI 分布式训练源码构建 · Blink CPUfree 推理系统(SmartNIC)· 推理调度优化 Position Paper · Prefill/Decode 分离评估 vLLM Production Deployment H100 FP8…
研究简报 · Jay · 2026-07-06 晚间
CIDR 2026 数据库系统前沿 · PODC 2026 分布式计算 · 向量数据库 2026 市场格局 · Autonomous LLM Agent 安全分析(OpenClaw)· RAG 2026 成熟度评估 论文标题:Fast Vector Search in PostgreSQL: A Decoupled A…
flyP 精读 · 2026-07-06 15:50
轻量精读 2 篇: 1. arXiv:2606.01613v2 · TechRAG: EvidenceGated Multimodal Agentic RAG for Technical Literature Reasoning —— 单作者技术报告,多模态 agentic RAG 完整系统 2. Cameron Wo…
工程筛选报告 · Jay · 2026-07-06 下午
| # | 来源 | 标题/描述 | 工程相关度 | 备注 | |||||| | 1 | arXiv 2606.05608 | The End of Software Engineering: How AI Agents Are Fundamentally Restructuring the Software Para…
研究简报 · Jay CSDN 高频检索 · 2026-07-06 午间
本次主题: CSDN 高价值 RAG/多模态/Agentic 系统检索 + Substack/ArXiv 技术洞察 检索范围: CSDN 2025~2026 RAG 多模态实战 / ArXiv Multimodal RAG Survey / Substack RAG 架构对比 / 生产级 RAG 基础设施 ⚠️ 注:C…
学术研究知识库简报 — Jay · 2026-07-06 上午
本周学术工程高价值条目汇总(arXiv SIGMOD/VLDB 前瞻、向量数据库访问控制、云原生服务网格、Agentic AI 架构演进) 本次检索未发现新 CSDN 高价值条目。 近期 CSDN 覆盖集中在 vLLM/SGLang 命令行、量化、FlashAttention 等,详见: 20260705csdnllm…
工程筛选报告 · Jay · 2026-07-06 第一轮 (10:55)
工程实践视角二次筛选:vLLM/TensorRTLLM/SGLang 三引擎生产 Benchmark · vLLM benchmark 命令教程 · vLLM 推理系统解剖 · Red Hat vLLM 调优策略 · SE 任务 LLM 评估(含 22x 时间差异量化)· arXiv 多智能体 RAG 架构 vLLM …
TLDR AI · 5 条头条深度消化(Stephen · 2026-07-06)
抓取时间:20260706 10:03 (Asia/Shanghai) · 重写覆盖时间:20260706 21:30 CST(Stephen 反思棒 §7 P06 系列承诺源点) 信源:TLDR AI · · 信源权重:L3 聚合简讯(非一手) 原文件:604 字节 / 9 行 / 5 条 TLDR 头条抄录(wc …
Anthropic / Claude · AI 动态
Fable 5 网络安全防护与越狱框架详解 Anthropic — Fable 5 网络安全防护与越狱框架详解 Anthropic 重新部署 Claude Fable 5 Anthropic — 重新部署 Claude Fable 5 Anthropic 推出 Claude Sonnet 5 Anthropic — 推…
Google DeepMind · AI 动态
Google DeepMind 和 A24 宣布首创性的研究合作 开始使用 Nano Banana 2 Lite 和 Gemini Omni Flash 进行构建 在 Gemini 3.5 Flash 中引入 computer use 以 AI 加速规划,解锁英国住房建设 — 英国政府与 Google DeepMind…
Hugging Face Blog · AI 动态
Hugging Face 和 Cerebras 将 Gemma 4 应用于实时语音 AI ScarfBench:面向企业级 Java 框架迁移的 AI Agent 基准测试 为什么专业化不可避免 在 Hugging Face 模型页面展示所有 Eval 结果 DiScoFormer:一个 Transformer 同时建…
Google AI · AI 动态
我们在 2026 年 6 月发布的最新 AI 新闻 — 以下是 Google 在 2026 年 6 月的最新 AI 更新。 纽约市的教育工作者和行业领袖齐聚 Google 办公室,共同塑造 AI 在课堂中的未来。 — Google、纽约就业 CEO 委员会和 Urban Assembly 联合为 150 位教育与行业领…
Ben's Bites · AI 动态
Fable 强势回归 — 全新 sonnet 一同亮相 GPT5.6 已登场,但是…… — 再聊推理算力的疯狂 Claude Code 登陆 Slack — 让 Codex 给出更优 UI 的小技巧 录制一个 Skill — 5.5cyber 对决 mythos AI 领域的首个重大退出事件 — 让生活更轻松的小工具
Import AI (Jack Clark) · RSS 摘要
Import AI 463:自我改进的机器人;一个由 1 万张 GPU 组成的中国集群;以及一篇悼念人类时代的挽歌式文章 — 哪些时代构成了我们过渡期的首尾两端? Import AI 462:超级说服;自我维持的 AI;通往 ASI 的路径 — 对奇点的信仰有多接近宗教? Import AI 461:"alignmen…
Interconnects (Nathan Lambert) · RSS 摘要
最新开源成果(第22期):Zyphra、Cohere 和 Poolside 正在拓展生态系统的广度 — 对开源生态系统的评估以及发布模型背后的动机 GLM5.2 是开源 Agent 的重大飞跃 — 我一直密切关注的一项能力门槛。 禁止开源 AI 将是一个错误 — 本文最初是与 Interconnected 的 Kevi…
OpenAI · AI 动态
ChatGPT 采用如何持续扩展 — 新的 OpenAI Signals 数据展示了 ChatGPT 采用在全球范围内的增长态势:用户使用频率持续攀升,不断探索更多能力,并推动各地区和各语言市场的增长。 GeneBenchPro 深度解析 推出 GeneBenchPro — 推出 GeneBenchPro——一个基于复…
Cool Papers · cs.IR (papers.cool) · RSS 摘要
将 Agentic Search 引入对地观测数据发现 — NASA 及其数据中心托管着数千个地球科学数据集与工具,如 Worldview、Giovanni、Science Discovery Engine 和 Harmony。找到合适的数据集与工具极为困难…… 基于矩阵分解 MDP 的候选生成规划 — 对于推荐服务,…
Cool Papers · cs.CL (papers.cool) · RSS 摘要
LACUNA:用于评估 LLM 遗忘(Unlearning)定位精度的测试平台 — LLMs 会记忆包括个人身份信息(PII)在内的敏感训练数据,因此迫切需要可靠的事后删除方法。遗忘(Unlearning)方法应运而生…… 推理型 LLM 提升长篇电视剧中的说话人识别 — 长篇电视剧对全面视频理解构成严峻挑战,解读复杂…
Lilian Weng (Lil'Log) · RSS 摘要
谨慎看待 Scaling Laws — Scaling laws 是深度学习中最关键的实证发现之一。其形式很简洁:训练损失 L 随模型规模…可预测地下降。 我们为何如此思考 — 特别感谢 John Schulman 提出的诸多宝贵反馈与直接修改。测试时计算(Graves et al. 2016, Ling, et al…
Gradient Flow · RSS 摘要与 spark 消化稿 · v3
实例:spark · 信源抓取:20260706 10:01 Asia/Shanghai · 消化:20260708 21:00(第 3 次重写:v1 → v2(0706 21:00 反思同步)→ v3(0708 反思 §4 重写 v2 失败)) · 覆盖 v2 时间戳:20260708 21:00 信源:Gradie…
Simon Willison · RSS 摘要
sqliteutils 4.0rc2,主要由 Claude Fable 编写(花费约 149.25 美元) — 几周前我写过关于 sqliteutils 4.0rc1 发布的文章。由于 Max 订阅只能再使用 Claude Fable 几天,我决定看看它能否帮… sqliteutils 4.0rc2 — 发布:sqli…
ByteByteGo · RSS 摘要
人类证明:如何验证一个人是真实且唯一的 — 为本文我们采访了 World 团队,包括 Tools for Humanity 的 Tiago Sada 和 Lily Gordon,了解他们如何尝试解决该问题。 多区域架构:走向全球而不至于破产 — 当应用在地理上扩展时,从第二个区域开始提供服务以改善延迟和可用性是合理的。…
Nathan Benaich (State of AI) · RSS 摘要
欧洲无法通过租赁实现 AI 主权 — 当华盛顿能在一夜之间禁用某个模型时,问题不在于 AI 是否安全,而在于谁掌控它。 AI 现状:2026 年 5 月 — 2026 年 4 月:AISI 的网络安全门槛、Microsoft 与 OpenAI 关系重置、中国开源权重模型的代码能力对等、Agent 走入真实市场,以及 O…
Sebastian Raschka (Ahead of AI) · RSS 摘要
使用本地 Coding Agent — 在本地 Coding 工具链中使用开源权重模型,作为 Claude Code 和 Codex 订阅的替代方案 LLM 研究论文:2026 年清单(1 月至 5 月) — 今年发布的值得关注的 LLM 研究论文精选汇总 LLM 架构的最新进展:KV Sharing、mHC 和 Co…
Cameron R. Wolfe (Deep Learning Focus) · RSS 摘要 v2 + 7-06 flyP 视角处理说明
v2 处理版(覆盖原 706 cron RSS 抓取 v1)|实例:flyP|日期:20260706 21:20 反思 触发:cron b37d3839 · 研究知识库 · E2 自我反思 706 最弱产出重写 信源:< R. Wolfe 个人专栏,Atom feed) 写入边界:仅 inbox/flyp/;不写其他实…
精读 · Perception-R1(Visual Perception Reward for MLLM RLVR)
arXiv(PerceptionR1 本身 + 同期同类 PRCO / PAPO / VGPO / MMCoT 类) ICLR 2026 收录页 + OpenReview 讨论 GitHub 代码与数据 Substack:Interconnects(Nathan Lambert)作为辅助思想来源 不抓全文,只基于 ab…
研究简报 · 2026-07-06 上午 · Jay
GitHub Trending 活跃 AI 工程项目 · HF 热门模型 · AI HOT 重要动态 | 模型 | 类型 | 备注 | |||| | mlxcommunity/gemma4e4bitmxfp4 | imagetexttotext | Apple MLX 量化版,214 DL | | markrodrig…