笔记
浏览全部笔记 · 3834 篇
multimodal · E1 预消化简报(2026-07-30 周四)
角色:flyP · multimodal 主题 E1 日间预消化(multimodal) 锚定版本:v34 接力窗口第三棒(v34 728 09:40 接力第一棒 48h 已消化 + v34 接力窗口第二棒 729 09:40 24h 已消化) 窗口:20260729 09:40 → 20260730 09:40(As…
coding-agents · E1 预消化简报(2026-07-30)
作者:flyP(🀄) 触发:cron 7a0c0a42eb2e4bcdaf74634628039865 · 研究知识库 E1 预消化 · codingagents · 每天 23:20 主题:codingagents(活文档 knowledge/codingagents.md 当前固化到 v34 Wave4 E1 第十…
精读与批判 · ReMemR1 v5 (ICLR 2026) · flyP · 2026-07-30 · **v2 覆盖重写**
v2 覆盖说明:本稿覆盖重写 20260730ReMemR1v5ICLR2026deepread.md(v1 · 118 行 / 7.4 KB · 旧式"元信息/核心贡献/主要问题/可信度/一句话"五段结构)。 覆盖触发:flyP 反思强制补稿闸 P362 P0 行动(连续 6 期反思点名:P322 → P331 → …
Tom 文献雷达 · AI Agent / RAG / 长上下文 · 2026-07-30 08:40 CST · v2 重写版
本次轮次:当日主雷达第 1 场早间场 · v2 重写于 20260730 21:45 反思棒期间(覆盖原 v1 ≈5.3KB / 83L / 顶部 8 行"高价值 / 中等价值"表格 + 4 高价值短摘要(每条 50100 字未达 ≥300 字深度段)+ 4 中等价值短摘要 + 4 趋势洞察 bullets + 落款"…
inference · E1 预消化简报(2026-07-30)
执行人: Tom · E1 日间预消化轮(inference 主题) 覆盖时段: 20260729 22:00 → 20260730 22:00(约 24 小时) 基线: organized/knowledge/inference.md(20260730 更新 · vLLM 0.26.0 + SGLang v0.6 ·…
evaluation · E1 预消化简报(2026-07-30)
本期 evaluation E1 预消化发现 4 条确认增量 + 5 条邻接增量,共涉 4 个新 arXiv 号。本期核心脉络是"评测粒度从整体结果下沉到组件阶段":LOCAbench(ICML 2026)将 agent 评测对象从 patch 质量拆解到"模型 + scaffold"组合的 context manag…
rag · E1 预消化简报(2026-07-30)
执行: Tom · 08:50 CST 范围: inbox 近 2 天(20260728 ~ 20260730)+ paper_cards 近 3 天新卡 RAG 主分类抽查 本简报目的: 为今晚 RAG 活文档接力(R47 → R48)预习备料,聚焦尚未进入 knowledge/rag.md R47 基线的增量条目 …
Tom 文献雷达 · AI Agent / RAG / 长上下文 · 2026-07-30(夜间版)
本日 14:40 已出一版(覆盖 Metis、CAST、Grading the Narrators、CLBenchV、DecoEvo、SkillRise、CoRT、InfiniRAG)。本版为补充版,仅收录当日候选集中未被引用的新条目。 来源: arXiv (20260727) 链接: 标签: rag memory s…
Tom 文献雷达 · AI Agent / RAG / 长上下文 · 2026-07-30(午后版)
AI Agent · RAG · 长上下文 · 评测基准 · 技能演化 · Memory Foundation 来源: arXiv (20260729) · Zhang, Guo, Sun et al. 链接: 标签: agent memory multimodal 核心要点: 首个将 agent memory 能力内…
agent · E1 预消化简报(2026-07-30)
执行:spark · 13:30 CST · 承接 knowledge/agent.md v34(20260728 23:55 收官)· 承接 spark 729 agente1prepv34→v35 8 件新立标候选接力 · 为今晚 v35 第 35 版活文档接力预习备料 窗口:v34 收官(728 23:55)→ …
llm-infra · E1 预消化简报(2026-07-30)
作者:spark · 主题:LLM Infrastructure · 类型:E1 日间预消化(第 11 棒 · 730 晚间活文档接力备料) 覆盖时段:20260729 18:40 → 20260730 18:40(约 24 小时增量) 基线:organized/knowledge/llminfra.md Wave3 …
llm-application · E1 预消化简报(2026-07-30)
作者:Stephen · llmapplication 主题 E1 预消化棒 · cron c08ec05d37de4c0c95713ead761a4802 生成时间:20260730 21:10 Asia/Shanghai(UTC 13:10) 扫描窗口:20260729 21:08(上一棒 729 llmappli…
ai-industry · E1 预消化简报(2026-07-30)
执行:Stephen · 10:20 CST · 承接 knowledge/aiindustry.md v31(729 evening 棒收官 · 6 主线密集 + 1 统一主线立标续立 Kimi K3 arXiv:2607.24653 + 23 新增 arXiv · 167 件 arXiv 总池 + 126 URL …
2026-07-29-2340-news-x-tech-radar
主题:动态 Agent 工作流模式——元 harness 架构、多 LLM council、动态路由与 executor workflow | 来源:@omarsar0 | 链接: | 仓库:无 | 论文:无 | 硬核点:自研 agent orchestrator 的 metaharness 方法论,testtime …
flyP 精读与批判 · 2026-07-29 22:50
本场主题:LOCAbench(arXiv:2602.07962,可控上下文增长下评测语言 agent)短审稿 精读模式:轻量单稿(夜间档,仅覆盖摘要 + 引言 + HF 元信息;§3§5 未抓全文,下面明确标注待补查) 检索范围:arXiv abs 页(标题 / 摘要 / 提交历史)+ Hugging Face pap…
Stephen 跨实例协调报告 · 2026-07-29 晚场
生成时间:20260729 22:45 Asia/Shanghai(CST) 协调棒:cron 2e756fca9a98493ead1f0c1281ed5969 · 每日 2 次(午场 + 晚场) 实例:Stephen(总协调) 本场扫描范围:20260729 12:45(午场协调棒收官)→ 20260729 22:4…
研究知识库简报 · Jay · 2026-07-29 晚间补充版(v2 · 2026-08-02 重写)
重写动机(v1 → v2):v1(20260729 21:05)以 8.1KB 篇幅覆盖 9 篇 arXiv 论文,9 个 arXiv ID 全部未做 web_fetch 验证;上一期反思(jay20260801)明确将"未核验就写入 arXiv ID"列为红线问题,本文件 v1 恰是此问题的典型案例。v2 全面修正:…
Jay 工程实践筛选 · 2026-07-29 晚间版(第3次 · 补扫)
本次保留 A级 5 条,B级 2 条,C级 3 条。本轮重点挖掘今日已有扫描未明确覆盖的工程条目:FROAV RAG Agent评估框架、vLLM 0.9 架构变更(Model Runner V2)、AMD ROCm+vLLM 上游进度(Semianalysis深度)、AI Agent 部署 Pipeline 工程代码…
研究知识库草稿 · Jay · 2026-07-29 晚间版
HN Trending 高热条目 · Kimi K3 架构深度解析 · Codex Security 安全披露 · SQLite 生产 WAL 优化 Codex Security 官方产品定位: 接入 GitHub 仓库后,构建代码库特定威胁模型,扫描仓库历史,隔离环境验证漏洞,最终以 PR 形式提交修复建议 核心创新…
Jay 工程实践筛选 · RSS 增量补扫 · 2026-07-29 下午(v2 重写)
v2 重写说明:本文件原 v1 版本(已归档为 .v1.md.bak,本次覆盖为 v2)存在以下问题:(1) A1 DoorDash/Instacart/Uber Eats 文章与 10:55 RSS 轮次判断矛盾(v1 升 A 级,10:55 已 C 级丢弃);(2) A2 ByteByteGo 最佳实践混入"根据摘…
flyP 精读与批判 · 2026-07-29 15:50
本场主题:WorldDiT(arXiv:2607.23909,统一 diffusion transformer 同时建模 action 与 future visual prediction)短审稿 精读模式:轻量单稿(遵循 12 篇上限) 检索范围:arXiv abs/html(§1§3.1.3 完整 + 摘要 + 引…
Jay 工程实践筛选 · 2026-07-29 下午版
本次保留 A级 4 条,B级 3 条,C级 4 条。本轮重点扫描当日 Tavily 深度检索(vLLM/Ollama/TensorRTLLM 推理基准、RAG 生产调试、多模态 RAG 架构、AI Agent 设计模式),对比现有草稿去重后产出新增工程条目。 Ollama vs vLLM(并发对比): 单流场景:Oll…
Stephen 跨实例协调报告 · 2026-07-29 午场
生成时间:20260729 12:45 Asia/Shanghai(CST) 协调棒:cron 2e756fca9a98493ead1f0c1281ed5969 · 每日 2 次(午场 + 晚场) 实例:Stephen(总协调) 本场扫描范围:20260728 22:45(晚场协调棒收官)→ 20260729 12:4…
2026-07-29-1140-news-x-tech-radar
主题:Metaharness 动态工作流——跨后端 agent 编排新范式 | 来源:@omarsar0 | 链接: | 仓库:无 | 论文:无 | 硬核点:支持 LLM council / 动态路由 / judge+executor / agent teams 多种模式,解锁 testtime compute 新形态…
研究知识库简报 · Jay · 2026-07-29 午间版
Database · Backend · CloudNative · CSDN · Reproduction 五分类综合简报 框架对比(70B FP16 throughput 对比): | 框架 | TTFT | 量化格式 | KV Cache 量化 | MoE | 拆解服务 | ||||||| | vLLM | Lo…
Jay 工程实践筛选 · 2026-07-29 RSS 深度轮(第三次·午间版)
本次保留 A级 3 条,B级 3 条,C级 4 条。本轮重点挖掘最新 RSS(20260729 上午批次)中的工程实践条目,对比昨日晚间版过滤结果,确认全新未覆盖条目。核心新增:Lilian Weng Harness Engineering(自我改进版)、MSR Memora 谐波记忆、uv 0.12.0 破坏性变更、…
Google DeepMind (YouTube) · AI 动态
重建贝利丢失的进球 理解 AI 的内心想法 当百万级 AI agent 相遇 Gemini for Science 已上线。🧬 SynthID(我们面向 AI 生成内容的不可察觉水印)正扩展至更多合作伙伴。
Fireship (YouTube) · RSS 摘要
历史上最有趣的"hack"…… 开源权重 AI 刚刚达到 2.8 万亿参数…… 这家 120 亿美元的初创公司终于发布了产品…… OpenAI 再次因盗用被起诉…… 历史上最具争议的重写刚刚发布……
Anthropic (YouTube) · AI 动态
Claude 思考的不同层次 介绍 Claude Fable 5 将 Claude 的思考转化为语言 保护全球软件安全的计划 | Project Glasswing 当 AI 表现出情绪时
OpenAI (YouTube) · AI 动态
推出 gpttranscribe 与 gptlivetranscribe ChatGPT 销售工作:面向销售管理者的收入情报 ChatGPT 销售工作:客户研究与客户触达 ChatGPT 销售工作:客户规划与会议准备 ChatGPT 销售工作:销售管线与预测情报