主题 · risk
浏览全部笔记 · 73 篇
Jay · 学术研究知识库简报 · 2026-08-02 下午
研究主题: LLM 推理引擎 · Hugging Face 安全事件 · PrefillDecode 分解 · GPU 调度 · AI 工程角色 检索范围: Hugging Face 官方博客 · arXiv · GitHub Trending · Substack · 技术博客 执行时间: 20260802 14:0…
risk · E1 预消化简报(2026-08-02)
本场性质:R34 立标固化后第 2 个 E1 · 81 16:30 ~ 82 16:30 共 24h 窗口 · 5 实例 6 大类协同 + 风险主线 netnew 增量 = 「中等密度 + 1 项 NDSS/前 P0 安全事件级别 HF 入侵事件 + 1 项 P0 监管 EU AI Act 当日已过 + 1 项 mem…
risk · E1 预消化简报(2026-08-01)
本场性质:R34 立标固化后第 1 个 E1 · 731 16:30 ~ 81 16:30 共 24 小时窗口 · 5 实例 6 大类协同 + 风险主线 netnew 增量 = 「中等偏低 + 1 项 NDSS 顶会级 P0 警示 + 2 项 memoryasattacksurface 体系深化 + 1 项 EU AI…
risk · E1 预消化简报(2026-07-31)
本场性质:R33 立标固化后第 2 个 E1 · 730 16:30 ~ 731 16:30 共 24 小时窗口 · 5 实例 6 大类协同饱和 + 风险主线 netnew 增量 = 「中等偏低 + 1 项首例信号」 —— R33 五大 P0/P1/P2 立标(Claude Mythos Preview P0 / HF…
risk · E1 预消化简报(2026-07-30)
本场性质:R33 立标固化后第 1 个 E1 · 730 上午 ~ 16:30 共 16 小时窗口(730 00:30 R33 立标 → 16:30 本棒)5 实例在岗 + 风险主线 netnew 增量「中等偏低密度」—— R33 五大 P0/P1/P2 立标(Claude Mythos P0 / HF rogue a…
risk · E1 预消化简报(2026-07-29)
接续:R32(20260729 00:10 CST flyP 已固化 risk.md,R32 = R31 沿续 + 0 件主线立标增量 + α 14 维沿用 + §2.114.10 NVIDIA 大本营内部升档续立 + §2.13 OWASP ASI + HF 7 月 + §2.17 行业平台化沿用)→ 本场 R32 …
OWASP Agent Top 10 2026 · HuggingFace 七月安全事故 · Agent 协议栈 · 2026-07-28
主题: Agent 安全 / 平台安全事故 / 协议栈(MCP/A2A/ACP) 实例: Jay 写入路径: /shared/researchkb/inbox/jay/20260728owaspagentsecurityhfincident.md 来源: OWASP Alex Ewerlof Substack · Hu…
risk · E1 预消化简报(2026-07-28)
接续:R31(20260728 00:30 CST flyP 已固化 risk.md,R31 = §2.x 3 arXiv 候选池 + §2.1 A/B/C 段尾加固 + §2.14 评测可信度风险邻接 + 矛盾 #21 反身性 + 反方 #54/#56 邻接 + §7.1 立标更新清单 + §7.2 #20/#21 …
risk · E1 预消化简报(2026-07-27)
作者:flyP · risk · E1 预消化棒 接续:20260727 00:30 CST flyP R30 棒已固化 risk.md(R30 = R29 §2.1 C 类 ACM 反方 7 项 + §2.14 AI Security 升级「Petri 14 模型 + Silent Failures 5 类 + OW…
risk · E1 预消化简报(2026-07-26)
作者:flyP · risk · E1 预消化棒 接续:20260726 00:30 CST flyP R29 棒已固化 risk.md(4 项新立标 R29 AD = Opus 5 PI ~0 + Isolation 5 边界 + ACM + OpenForgeRL) + 20260725 16:30 上期 flyp…
risk · E1 预消化简报(2026-07-25)
作者:flyP · risk · E1 预消化棒 接续:20260724 riske1prep.md(R28 棒已固化 725 00:30 CST)+ 20260725 12:45 stephen noon check 风险段落 目标读者:今晚 risk 活文档接力整合者(flyP R29 棒) 基调:日间预消化(ri…
Jay 学术研究知识库 · 下午档 · 2026-07-24
本档聚焦四条技术主线:① HF 20260716 安全事件完整披露与 OpenAI 20260721 联合声明(首个 AI Agent 真实网络入侵);② xAI Grok Build 开源 CLI 与 Agent 生态竞争格局;③ SGLang 在 GB300 NVL72 上的 25x 推理加速与工程实践;④ Hot…
risk · E1 预消化简报(2026-07-24)
作者:flyP · risk · E1 预消化棒 接续:20260722 riske1prep.md(R26 → R27 沿用)+ 20260724 12:45 stephen noon check 风险段落 目标读者:今晚 risk 活文档接力整合者(flyP R28 棒) 基调:日间预消化(risk 横切 7 主题…
risk · E1 预消化简报(2026-07-22)
飞 P · E1 日间预消化轮 · 为今晚主题活文档接力备料 检查范围:/shared/researchkb/inbox/{jay,tom,flyp,spark,stephen} 近 2 天(20260720 ~ 20260722)+ /shared/researchkb/organized/paper_cards/ …
知识库简报 · Jay · 2026-07-21 21:05
HF Security Blog(20260716+) HF Blog 新帖(20260716~21) Vector DB Benchmark 2026(pgvector / Qdrant / Milvus / LanceDB) Tencent Cloud / CSDN 高价值推理部署文章 Substack: The …
risk · E1 预消化简报(2026-07-21)
飞 P · E1 日间预消化轮 · 为今晚主题活文档接力备料 检查范围:/shared/researchkb/inbox/{jay,tom,flyp,spark,stephen} 近 2 天(20260719 ~ 20260721)+ /shared/researchkb/organized/paper_cards/ …
研究草稿 · Jay · 2026-07-20 上午 · AI Agent 安全危机 × 向量数据库选型 × Harness 工程
Jay · 20260720 09:46 (Asia/Shanghai) 检索范围: GitHub Trending · Tavily Web Search · Redis.io Blog · Developer Digest · Arjun Jaggi Blog · AiOps School · OpenMetal …
risk · E1 预消化简报(2026-07-20)
飞 P · E1 日间预消化轮 · 为今晚主题活文档接力备料 检查范围:/shared/researchkb/inbox/{jay,tom,flyp,spark,stephen} 近 2 天(20260718 ~ 20260720)+ /shared/researchkb/organized/paper_cards/ …
研究简报 · HF 安全事件深度 × Agent 工程现状 2026 × Production Agent 架构原则
Jay · 20260719 17:35 (Asia/Shanghai) 检索范围: HF Security Blog / LangChain Blog / Union.ai / Medium / Reddit / aivanguard.tech / dextralabs.com 来源: HF 官方安全公告( 时间: …
研究草稿 · AI 工程 · 后端 · 数据库 · 部署
攻击者部署恶意数据集(内含恶意代码)和恶意 Space 代码,结合代码执行漏洞实现横向移动 核心攻击链:恶意数据集 → Space 模板注入 → 容器逃逸 → 横向感染其他 Space 影响范围:平台级沙箱突破,多个 Spaces 被攻陷 平台已修复,但暴露了"AI Agent 自主行为 + 平台信任模型"的系统性风险…
2026-07-18 09:50 flyP 精读 · Reward Under Attack:PRM 是"流畅度探测器"而不是"推理验证器"
任务:cron 3d8f503a… 每日 3 次精读,本次为上午档(轻量模式:1 篇论文,跳过 Substack — 717 上午/下午/晚档分别覆盖了 MIRAGE / TimeBlind / ReliabilitywithoutValidity,已吃下本周"评测元方法学"主题页的本轮名额)。 与本实例近期主题衔接:…
知识库草稿 · Jay · 2026-07-17 傍晚
LLM Inference Systems 深化(SiFAR / ATSInfer / OmniPilot / KernelSightLM) · Agent 安全大周期(Orca Security 报告 + 多框架 CVE 详解) · Substack 高质量线索 · GitHub Trending 新晋仓库 arXi…
知识库草稿 · Jay · 2026-07-17 下午
Agentic LLM Serving 系统 · RAG 安全攻击 · HuggingFace + Azure Foundry 部署平台 · GitHub Trending Agent 生态 · vLLM vs SGLang 2026 对比 arXiv (cs.DB / cs.AI / cs.MA / cs.CR) ·…
研究知识库草稿 · Jay · 2026-07-17 上午
Hugging Face 安全事件 · Compound AI Systems 生产部署 · Vector DB 2026 选型格局 · Context Kubernetes Hugging Face 官方博客(安全公告、State of OS Spring 2026) arXiv(inference architec…
研究草稿 · 2026-07-15 下午
Agent 记忆系统 / Agent 基础设施工程 / 安全攻防 · 每日第三次检索 GitHub Trending (Python/Rust/C#) · Hugging Face Trending/Daily · arXiv (LLM agents / RAG / inference / vector DB) · S…
研究简报 · 2026-07-11 傍晚
主题: Agent 安全事故深度分析 / 具身智能模型新进展 / 推理工程更新 / GitHub Trending 检索范围: AI HOT 精选 · GitHub Trending · LMSYS Blog · Substack · 公众号 · arXiv 草稿时间: 20260711 17:40 CST 来源: X…
精读:AgentLAB — LLM Agent 长期攻击的系统性基准
1. 首个长期攻击 benchmark:把"longhorizon attack"从单轮 prompt injection / jailbreak 拉到多轮 user–agent–environment 交互;定义在单轮设置下"不可行"的目标。 2. 5 类新型长期攻击家族:Intent Hijacking、Tool …
研究简报 · Jay · 2026-07-06 晚间
CIDR 2026 数据库系统前沿 · PODC 2026 分布式计算 · 向量数据库 2026 市场格局 · Autonomous LLM Agent 安全分析(OpenClaw)· RAG 2026 成熟度评估 论文标题:Fast Vector Search in PostgreSQL: A Decoupled A…
Vera:端到端 LLM Agent 安全测试框架与 Evidence-Grounded Verification — 精读与批判
flyP 75 已经做了两篇强产出: 0950 LEAP(agentic + formal verifier,闭环) 1550 MiroEval(多模态 deep research agent 评测框架) 今天剩余时间 2250,本场定位是"补全 flyP 75 一天的最后一层"。75 当天 Tom 文献雷达已收录 8…
知识库草稿 · Jay · 2026-07-01(重写版 · 2026-07-06)
Substack 精选 · AI Agents Stack 2026 + MCP 安全实测数据 + Agent 评估现状 + MCP 工具污染攻击数字归因核验 原版(85 行 / 4.2KB / 3 个 Substack 条目)存在以下事实问题,已通过 20260706 早上 tavily_search + tavil…