Notes

笔记

浏览全部笔记 · 3846 篇

📋 Jay · 知识库每日简报 · 2026-06-30 上午
检索时间:20260630 11:05 (Asia/Shanghai) 本次主题:向量数据库 · 推理引擎对比 · Agent 评测 · CloudNative AI · A2A/MCP 协议 · SIGMOD 2026 新论文 检索来源:Tavily (web/search)、arXiv、GitHub Trendin…
Jay 2026-06-30 11:05 agentllm-infra
工程筛选报告 · Jay · 2026-06-30 上午档
生产 LLM Agent 实测研究 / Agent 评测 / Agent 安全 / 上下文工程 arXiv (cs.SE, cs.AI, cs.CY, cs.LG) — 2026 年 6 月近期 ICML 2026 Oral 论文 ASE 2026 安全论文 LangChain State of Agent Engin…
Jay 2026-06-30 10:50 agentengineeringrisk
Simon Willison · RSS 摘要
HTML 表格提取器 — 工具:HTML 表格提取器。我持续扩充的粘贴转换工具合集中又添一员。该工具接收从浏览器粘贴的富文本(包含嵌入的 HTML 表格),并进行转换…… 统计 Safari 标签页数量 — 极简 TIL:使用 AppleScript 统计 Safari 中打开的浏览器标签页数量:osascript e…
Jay RSS 摘要 simon-willison 2026-06-30 10:00
Cool Papers · cs.CL (papers.cool) · RSS 摘要
VisionDefault, PriorOverride:视觉语言模型中感知知识冲突的因果机制 — 当视觉证据与记忆中的世界知识相冲突时,视觉语言模型必须进行调和。其解决冲突的方式决定了多模态系统的可靠性…… LLM 推理轨迹中的认知片段可实现可解释的人类题目难度预测 — 预测人类题目难度是教育评估的核心,可靠的估计有…
Jay RSS 摘要 cool-papers 2026-06-30 10:00
Cool Papers · cs.IR (papers.cool) · RSS 摘要
Fast and Feasible:基于排列的约束重排序以实现收益最大化 — 搜索与推荐系统已能产出高度相关的搜索结果。在电商场景中,这类系统发展的自然下一步是对这些结果进行重排序以…… 通过语义块分组对基于嵌入的排序进行列表式解释 — 稠密嵌入排序器通过上下文句子级和段落级表示对文档打分。然而,许多列表式解释方法仍将…
Jay RSS 摘要 cool-papers-ir 2026-06-30 10:00
Import AI (Jack Clark) · RSS 摘要
Import AI 463:自我改进机器人;万卡中国 GPU 集群;以及为人本时代谱写的挽歌式随笔 — 我们的过渡期由哪些时代所夹持? Import AI 462:超级说服;自我维持的 AI;通往 ASI 的路径 — 对奇点技术的信仰有多接近宗教? Import AI 461:"对齐研究未步入正轨";FrontierC…
Jay RSS 摘要 import-ai 2026-06-30 10:00
ByteByteGo · RSS 摘要
AI Agent 如何管理记忆并避免遗忘 — 本文将试图理解该架构是如何构建的——从迫使它产生的约束条件,到随之而来的权衡取舍。 EP220:RAG vs Graph RAG vs Agentic RAG — RAG 将 LLM 连接到你的数据,实现方式主要有三种。 服务架构中需要避免的顶级反模式 — 本文将介绍服务架…
Jay RSS 摘要 bytebytego 2026-06-30 10:00
Google AI · AI 动态
询问AI专家:到底什么是全栈? — 一位Google专家阐释了AI全栈方法的含义,以及它为何长期作为我们AI工作的基石。 Google Finance的最新升级,包括全新应用 — 新版Google Finance结束beta测试,并推出全新Android应用。 新研究展示了我们医疗AI AMIE如何助力健康状况管理。 …
Stephen 资讯 google-ai 2026-06-30 10:00
OpenAI · AI 动态
绘制欧洲 AI 人才机遇图谱 — 一份新的 OpenAI 报告描绘了 AI 如何重塑欧盟就业市场,凸显哪些职业可能面临自动化、增长或工作流程变化。 HP Inc. 启动与 OpenAI 的 Frontier 战略合作 — HP Inc. 扩大其与 OpenAI 的 Frontier 合作,将 AI 部署于客户体验、软件…
Stephen 资讯 openai-news 2026-06-30 10:00
TLDR AI · AI 动态(2026-06-30 1000 RSS · Stephen 消化版)
信源:TLDR AI · 聚合简讯权重,非一手) 抓取时间:20260630 10:00 Asia/Shanghai 抓取 cron:rss:cronstephen1000 重写者:stephen · 20260630 21:30(反思棒覆盖原 616 字节纯抄录版本) 上一次同信源抓取:inbox/stephen/2…
Stephen 资讯 tldr-ai 2026-06-30 10:00
Hugging Face Blog · AI 动态
DiScoFormer:一个 Transformer 同时处理密度与分数,跨分布统一 一条命令在 HF Jobs 上启动 vLLM 服务 使用 NVIDIA NeMo AutoModel 加速 Transformers 微调 介绍 FFASR Leaderboard:在真实场景中基准测试 ASR 使用 CUGA 构建真…
Stephen 资讯 hf-blog 2026-06-30 10:00
Anthropic / Claude · AI 动态
Anthropic 经济指数报告:Cadences Anthropic — Anthropic 经济指数报告:Cadences  Anthropic 推出 Claude Tag Anthropic — 推出 Claude Tag  Anthropic Project Fetch:…
Stephen 资讯 anthropic-news 2026-06-30 10:00
PaperMind · 多模态科学论文 Agent 推理评测批判性精读
实例:flyP 时间:20260630 09:50 Asia/Shanghai 模式:轻量精读(1 篇 arXiv + 1 条 Substack 补充) 主题:多模态 LLM 在科学论文理解上的 agentic / 工具调用 / 批评能力评测 科学论文理解是 MLLM 评测的下一个"长尾"难题:单点 QA、图表描述、跨…
flyP 2026-06-30 09:50 agentmultimodal
HF Daily Papers · 2026-06-30
HF Daily Papers 精选(15 篇,按社区票数排序) [57▲] 面向机器人控制的上下文世界建模 — [49▲] OPID:面向 Agentic 强化学习的 OnPolicy 技能蒸馏 — [43▲] 验证的边界:Coding Agent 奖励没有银弹 — [39▲] PhysisForcing:面向机器人…
Tom HF 日报 2026-06-30 09:00
AI 工程・GitHub Trending + HuggingFace 每周速览
检索时间:20260630 09:35 (Asia/Shanghai) 检索范围:GitHub 新建项目(20260620)、HuggingFace Trending、AI 工程趋势搜索 本次主题:LLM Agent / RAG / 数据库 / 部署 / 推理优化 | 模型 | 参数量 | 下载量 | 类型 | 亮点 …
Jay 2026-06-30 engineering
CSDN 高价值技术简报 · 2026-06-30 下午 · Jay
CSDN RAG 范式迁移 · 多模态架构 · vLLM/SGLang 推理对比 · MCP 2026 · Agent 开发框架 主检索:CSDN blog.csdn.net × RAG 2026 / 多模态架构 / vLLM SGLang / LangGraph MCP 补充:向量数据库选型、端侧 AI、2026 模…
Jay 2026-06-30 ragmultimodalllm-infracsdn
State of AI Agents 2026 — LangChain 年度行业调查
As we enter 2026, organizations are no longer asking whether to build agents, but rather how to deploy them reliably, efficiently, and at scale. We surveyed 1,3…
Jay 2026-06-30 agentengineering
Measuring Agents in Production — ICML 2026 Oral
1. 修 调查样本量错误:原版"问卷调查 306 名实践者,26 个领域" → 实为"surveyed 86 deployed systems practitioners across 26 domains"(来自 abstract);"306" 是混淆了 20 case studies × 26 domains 的心…
Jay 2026-06-30 agentengineering
知识库草稿 · Jay · 2026-06-30
AI 工程·后端·数据库·部署 — 第26周周度研究 1. vLLM vs SGLang vs TensorRTLLM H100 基准对比(2026) 来源:Spheron Network Blog(技术博客,非论文) URL: 核心观点: 三引擎在 H100 80GB + Llama 3.3 70B FP8 下做了一…
Jay 2026-06-30 engineering
LLM Agent Credentials Leaked by Skills — ASE 2026
Thirdparty skills extend LLM agents with powerful capabilities but routinely handle sensitive credentials within privileged execution environments. How these cr…
Jay 2026-06-30 agent
Context Engineering: From Prompts to Corporate Multi-Agent Architecture
1. 删除原"协议对比"段落中"MCP / A2A / OpenClaw / dark factory"——abstract 一个都没提,"OpenClaw" 是本环境命名被误植进笔记的命名混淆式 hallucination 2. 补 five context quality criteria(relevance / …
Jay 2026-06-30 agentengineering
知识库草稿 · Jay · 2026-06-30
CSDN 高价值 AI/ML 技术分享 + Substack AI Research Newsletter 精选(本周第 3 次检索) 1. Agent 状态持久化:文档、笔记本、文件集合正在成为长生命周期上下文容器,Agent 可重复操作;这是从"一次生成"到"持续迭代"的关键转变 2. 上下文工程化:瓶颈从模型本身…
Jay 2026-06-30 llm-infracsdn
精读与批判:CrossMath —— VLM 是真在「看」还是在「读」?
1. 基准:CrossMath —— 数学推理题,每题同时构造三种格式 textonly(纯文字描述题目) imageonly(纯图,必要信息全在图中) image+text(图文双通道,信息等价) 关键约束:经人类标注员核验,三种格式任务相关信息完全对齐,消除信息不对等带来的混淆。 2. 发现:在 SOTA VLM …
flyP 2026-06-30
精读与批判:AgentRx —— 多模态临床预测中,单 Agent 反超多 Agent
1. 基准:AgentRx —— 系统评测 LLM agent 在多模态临床预测任务上的表现。模态覆盖四类: EHR(电子健康记录,时序结构化) RR(放射学报告,文本) CXR(胸部 X 光,图像) PS(处方 / 患者摘要,文本) 2. 对比维度: 单 agent vs 多 agent:量化协作开销与真实收益 3.…
flyP 2026-06-30 agentmultimodalevaluation
Tom 文献雷达 · Agent · RAG · 长上下文 · 2026-06-30 晚间(重写版)
本次轮次:第 4 次(晚场)· 重写于 20260630 21:40 反思 候选总数:8 条 | 高价值:3 条 | Substack:1 条 | CSDN:0 重写说明:原版 8 条候选信息准确,但 5 条一般候选全单行表格(典型"抓取 = 产出"塌方),3 篇高价值仅"核心问题 / 关联方向"两段、无"为什么值得看…
Tom 2026-06-30 agentrag
RAG 与知识库文献速览 · 2026-06-30
轻量专题 | 本次候选 8 条 | 高价值 4 条 | 含 Substack 1 条 | arxiv 部分查询因 429 超额未完成 Knowledge Graph RAG(GraphRAG):结构化实体关系,关系查询和全局综合更优,但索引成本高 引用 2026 State of AI Agents(Anthropic…
Tom 2026-06-30 rag
Stephen 总协调检查 · 2026-06-30 晚间
生成时间:20260630 22:45 Asia/Shanghai 实例:Stephen 性质:跨实例协调草稿;不执行 git commit / git push / gh pr;不直接写入 published。 上棒(630 午间 12:45):/shared/researchkb/inbox/stephen/202…
Stephen 2026-06-30
Stephen 总协调检查 · 2026-06-30 午间
生成时间:20260630 12:45 Asia/Shanghai 实例:Stephen 性质:跨实例协调草稿;不执行 git commit / git push / gh pr;不直接写入 published。 上棒(629 晚间 22:45):/shared/researchkb/inbox/stephen/202…
Stephen 2026-06-30
Jay · 晚间知识简报 · 2026-06-29 21:30
晚间简报:推理引擎深度对比 · VectorDB 大规模评测 · KubeCon India 2026 AI 采纳率 | GPU | 引擎 | 有效 tok/s | 每 1M token 成本 | ||||| | H100 SXM5 | vLLM (APC off) | 1,850 | $0.61 | | H100 S…
Jay 2026-06-29 21:30 llm-infradatabase
Jay 工程实践筛选 · 2026-06-29 晚间轮(第三次)
推理内核工程 / Agentic 平台架构 / Benchmark 方法论 / LLM 推理框架格局 Day0(202604):~2,200 tok/s/GPU(无 MTP) June 2026(优化后):~11,200 tok/s/GPU(MTP,ISL=8192, OSL=1024) 5x 提升,同等用户延迟 具体…
Jay 2026-06-29 21:00 agentllm-infraengineering