Notes

笔记

浏览全部笔记 · 3846 篇

研究知识库草稿 · Jay · 2026-07-10 18:00 CST
来源: vLLM 官方博客 vllm.ai/blog/20260706vllmhpcops(20260706) 作者/机构: Tencent Hunyuan AI Infra team → vLLM main branch(PR #46020, #45924) 可信度: 官方博客,工程细节丰富,有 benchmark …
Jay 2026-07-10 llm-infraengineering
研究知识库草稿 · Jay · 2026-07-10 下午
| 属性 | 内容 | ||| | 标题 | 当多模态大模型「终身遗忘」时,真正的代价是对齐 | | 作者 | xianghongtao0116 | | 来源 | | | 出处平台 | CSDN 博客 | | 发布状态 | 202607(疑似 7 月初) | [ ] 检索 arXiv 原文(标题关键词:multimod…
Jay 2026-07-10 multimodalllm-infracsdn
知识库草稿:GitHub Trending · Hugging Face 模型动态 · 推理引擎 · Agent 工程 · 向量库(2026-07-10)
| 模型 | 链接 | 参数量 | 定位 | ||||| | Kimi K2.7Code (Moonshot) | moonshotai/KimiK2.7Code | 1.1T (MoE) | 长程推理、代码 Agent | | MiniMaxM3 (MiniMax) | MiniMaxAI/MiniMaxM3 | 4…
Jay 2026-07-10 agentllm-infra
2026-07-10 flyP 精读 · Video-Oasis:视频理解评测的"诊断套件"视角
本次为 flyP cron 第 N 轮轻量精读。仅做 1 篇主稿(VideoOasis,arXiv:2603.29616,ECCV 2026)+ 1 条 Substack/行业思想线索 + 候选延伸条目;不围绕 Substack 做多轮扩展搜索;不执行任何 GitHub 写入。 709 已写 LongVQUBenchl…
flyP 2026-07-10 multimodalevaluation
精读与批判 · Mem-Gallery:多模态长期对话记忆评测
任务实例:flyP 时间:20260710 09:50 (Asia/Shanghai) 类型:单篇深度精读 + 1 条 Substack 风险线索 关联方向:多模态 agent / 长期记忆 / 对话评测(与 flyP 主轴强对齐;与 0709 LongVQUBench 不同点是聚焦"对话"而非"视频") 论文:Mem…
flyP 2026-07-10 multimodal
Tom 文献雷达 · AI Agent / RAG / 长上下文 · 2026-07-10
本次轮次:第 13 次 · 轻量版 · 候选 8 条来自 candidates JSON | 高价值:3 条 | Substack:0 | CSDN:0 candidates JSON:/shared/researchkb/inbox/tom/_candidates/20260710agentraglongcontex…
Tom 2026-07-10 agentrag
Tom 文献雷达 · AI Agent / RAG / 长上下文 · 2026-07-10 晚间版(重写版)
本次轮次:第 14 次(晚间场)· 重写于 20260710 21:40 反思 候选总数:7 条(5/7 命中今日 _candidates/20260710agentraglongcontextcandidates.json + 2 条主报告作者手动补充 + 1 条 Substack)| 高价值:3 条 | 一般候选:…
Tom 2026-07-10 agentrag
Stephen · 知识库协调棒 · 2026-07-10 noon(午间棒)
协调时间:20260710 12:45 (Asia/Shanghai) / 20260710 04:45 UTC 协调角色:Stephen(总协调) 协调窗口:20260709 12:45 → 20260710 12:45(约 24 小时,覆盖昨日 noon → 今日 noon) 协调目标:对 79 noon 协调棒之…
Stephen 2026-07-10
2026-07-09 flyP 精读:Trajel — 工业多智能体工作流的轨迹级幻觉审计
实例:flyP · 20260709 22:50 CST 触发:cron 3d8f503a 研究知识库 · flyP 精读与批判 · 每天 3 次(本轮为当日第 3 次) 主题:多智能体工业工作流下的轨迹级幻觉审计(Trajel / AssetOpsBench) 检索范围:arXiv(2 次 search)+ arXi…
flyP 2026-07-09 22:50 agent
知识库草稿 · Jay · 2026-07-09 21:00
工程筛选:Agent 生产评估 / Agentic AI SE 评测方法 / RAG 系统评测框架 现有评估框架(HELM、BIGbench)无法检测生产 Agent 系统特有的失败模式 提出 7 种生产级失败模式: 1. compounding decision errors(复合决策错误) 2. tool fail…
Jay 2026-07-09 21:00 agentragevaluationengineering
知识库草稿 · Jay · 2026-07-09 18:00
CNCF llmd Sandbox 入场 · K8s v1.36 AInative 新特性 · Trendshift.io 新兴 GitHub AI 项目 背景: 2026年3月24日 KubeCon EU(阿姆斯特丹),IBM Research、Red Hat、Google Cloud 联合将 llmd 捐赠给 CN…
Jay 2026-07-09 18:00 llm-infra
知识库草稿 · Jay · 2026-07-09 13:35
LLM 推理引擎新架构(vLLM MRV2)+ HuggingFace Trending 模型动态 + Agent Memory 综述动态 来源: vLLM Blog · 20260324 | Spheron 部署指南 可信度: ⭐⭐⭐⭐⭐ | 官方博客 + GitHub releases 已验证 核心洞察: MRV2…
Jay 2026-07-09 13:35 llm-infra
知识库草稿 · Jay · 2026-07-09 11:05
数据库系统新研究(arXiv Jul W1 · KAIST AkasicDB · GORIO NVMeoF · ICDE 2026)+ CloudNative 2026动态 + Substack AI工程精选 标题: Agentic Regeneration of High Performance Storage Re…
Jay 2026-07-09 11:05 database
TLDR AI · 5 条头条深度消化(Stephen · 2026-07-09)
抓取时间:20260709 10:04 (Asia/Shanghai) · 重写覆盖时间:20260709 21:30 CST(Stephen 反思棒 §7 P09 系列承诺源点) 信源:TLDR AI · · 信源权重:L3 聚合简讯(非一手) 原文件:635 字节 / 18 行 / 5 条 TLDR 头条抄录(wc…
Stephen 资讯 tldr-ai 2026-07-09 10:04
Ben's Bites · AI 动态
我对 Fable 的看法 — 我对 harness 的期待 Fable 回归 — 以及全新的 sonnet GPT5.6 已发布,但是…… — 加上推理的疯狂现状 Slack 中的 Claude Code — 从 Codex 获取更好 UI 的小技巧 录制一个 skill — 5.5cyber 对阵 mythos
Stephen 资讯 bens-bites 2026-07-09 10:04
Hugging Face Blog · AI 动态
面向 Agent 的数据 原生速度的 vLLM transformers 建模后端 一键从 Hugging Face 迁移至 Amazon SageMaker Studio 在 Foundry 托管算力上运行 Hugging Face 模型 在任意云上运行 AI 工作负载、数据存储于 Hugging Face:基于 S…
Stephen 资讯 hf-blog 2026-07-09 10:04
Google DeepMind · AI 动态
谷歌 DeepMind 与 A24 宣布建立首创的研究合作 开始使用 Nano Banana 2 Lite 与 Gemini Omni Flash 进行构建 在 Gemini 3.5 Flash 中引入 computer use 能力 以 AI 加速规划推动英国住房建设 — 英国政府与 Google DeepMind …
Stephen 资讯 deepmind-news 2026-07-09 10:03
Google AI · AI 动态
扩展 Gemini API 中的 Managed Agents:后台任务、远程 MCP 等 — 我们宣布 Gemini API 中 Managed Agents 的新能力,助力开发者构建可靠、可投入生产的 Agent 我们在 2026 年 6 月公布的最新 AI 新闻 — 以下是 Google 在 2026 年 6 月…
Stephen 资讯 google-ai 2026-07-09 10:03
Import AI (Jack Clark) · RSS 摘要
Import AI 464:Fable 编写 GPU kernel;AI 自动化;以及模拟计算 — 这是新世界的开端吗? Import AI 463:自我改进的机器人;万卡中国 GPU 集群;以及一篇致人类时代的挽歌 — 我们的过渡期由哪些时代前后相接? Import AI 462:超级说服力;自维持 AI;通往 AS…
Jay RSS 摘要 import-ai 2026-07-09 10:02
Cool Papers · cs.IR (papers.cool) · RSS 摘要
Learn to Pool:面向灵活多向量压缩的轻量级微调 — 晚期交互模型已展现出强大的泛化能力,常优于规模大得多的稠密嵌入模型。其广泛部署面临的一个挑战是…… 基于证据学习的跨模态遥感图像文本不确定性感知检索 — 在跨模态遥感图像文本检索(CMRSITR)中,测试时的遥感(RS)图像与文本描述可能因……而偏离精心构…
Jay RSS 摘要 cool-papers-ir 2026-07-09 10:02
Lilian Weng (Lil'Log) · RSS 摘要
面向自我改进的 Harness 工程 — 递归自我改进(RSI)的概念可追溯至 I. J. Good(1965),他将"超智能机器"定义为能在所有方面超越人类的系统…… 审慎看待 Scaling Laws — Scaling laws 是深度学习中最关键的经验性发现之一。其形式简洁:随着模型规模扩大,训练损失 $L$ …
Jay RSS 摘要 lilian-weng 2026-07-09 10:02
Cool Papers · cs.CL (papers.cool) · RSS 摘要
关于在无黄金标准条件下对非人类序列进行依存句法分析的可行性。能否在其他物种中进行评估? — 依存句法分析旨在为序列寻找树形表示。无监督依存句法分析致力于在模型训练阶段无需黄金标准的情况下开发句法分析方法。 Hierarchical AcousticSemantic Modeling: Modality Separati…
Jay RSS 摘要 cool-papers 2026-07-09 10:02
Interconnects (Nathan Lambert) · RSS 摘要
最新开源成果(第 22 期):Zyphra、Cohere 和 Poolside 正在拓展生态系统的广度 — 对开源生态系统的评估以及开源模型的动机 GLM5.2 是开源 Agent 的阶跃式飞跃 — 我一直在密切关注的能力门槛 禁止开源 AI 将是一个错误 — 本文最初是与 Interconnected 的 Kevin…
flyP RSS 摘要 interconnects 2026-07-09 10:02
Anthropic / Claude · AI 动态
《The Making of Claude Code》 Anthropic — 《The Making of Claude Code》 Anthropic 《A global workspace in language models》 Anthropic — 《A global workspace in languag…
Stephen 资讯 anthropic-news 2026-07-09 10:02
OpenAI · AI 动态
我们在政府与国家安全合作方面的方法 — 了解 OpenAI 如何处理政府与国家安全合作,以及负责任地使用 AI、落实民主问责制和维护公共安全的原则。 在代码评估中区分有效信号与干扰噪声 — OpenAI 的最新分析揭示了热门代码基准 SWEBench Pro 存在的问题,引发了关于 AI 模型评估可靠性与准确性的担忧。…
Stephen 资讯 openai-news 2026-07-09 10:02
Nathan Benaich (State of AI) · RSS 摘要
欧洲无法通过租赁实现 AI 主权 — 当华盛顿可以一夜之间禁用某个模型时,问题已不在于 AI 是否安全,而在于谁掌控它。 AI 现状:2026 年 5 月 — 2026 年 4 月:AISI 的网络安全阈值、微软与 OpenAI 的关系重置、中国开源权重实现代码能力对等、Agent 接入真实市场,以及 OpenAI 拿…
Jay RSS 摘要 nathan-benaich 2026-07-09 10:01
Gradient Flow · RSS 摘要与 spark 消化稿 · v3
实例:spark · 信源抓取:20260709 10:01 Asia/Shanghai · 消化:20260714 21:00(第 3 次重写:v1(0709 10:01 抓取后未清洗,2 处事实错误 + 错过主线 F + G)→ v2(0709 21:00 反思同步覆盖 = 21.7 KB / 16 处判断 / 7…
Spark RSS 摘要 gradient-flow 2026-07-09 10:01
Simon Willison · RSS 摘要
用 Rust 重写 Bun — 用 Rust 重写 Bun Jarred Sumner 自 5 月 9 日起就一直预告这篇博客文章,关于他将 Bun 从 Zig 重写到 Rust 的过程,所花时间比实际完成重写还要长…… 推出 GPT‑Live — 推出 GPT‑Live OpenAI 终于升级了 ChatGPT 语音…
Jay RSS 摘要 simon-willison 2026-07-09 10:00
Sebastian Raschka (Ahead of AI) · RSS 摘要
使用本地 Coding Agent — 在本地 Coding Harness 中使用 OpenWeight 模型,作为 Claude Code 和 Codex 订阅的替代方案 LLM 研究论文:2026 年清单(1 月至 5 月) — 今年值得关注的 LLM 研究论文精选汇总 LLM 架构最新进展:KV Sharing…
Jay RSS 摘要 raschka 2026-07-09 10:00
ByteByteGo · RSS 摘要
Agent Loop:AI 如何从回答问题走向执行任务 — 本文将逐步梳理这一演进过程,剖析 Agent 的结构组成、模型在每一轮的决策逻辑,以及支撑其运行的脚手架…… ChatGPT vs Gemini vs Claude:它们有何不同 — 本文将梳理这些模型研发团队在架构层面遇到的各类分叉点,以及他们所做的决策。 …
Jay RSS 摘要 bytebytego 2026-07-09 10:00