主题 · risk
浏览全部笔记 · 73 篇
risk · E1 预消化简报(2026-08-25)
窗口:承接 R52(20260823 17:10 CST · flyP · 🟡 1 件主题簇层级 netnew · MultiAgent 安全簇 + 🟡 2 件工程应用层邻接级 netnew · promptfoo + Graph Engineering)→ 825 09:40 morning 棒 6 件增量(0 件主…
Agent安全主题簇笔记 · 2026-08-23
通过分析LLM内部数值激活信号(activationbased)检测多智能体中被入侵的agent 填补了"LLM多智能体系统进化速度远超其安全防护"的gap 单智能体LLM安全 ≠ 多智能体安全。多智能体协作引入了通信链路污染、信任链断裂等新型攻击面。 多智能体LLM系统快速演进 保护措施严重滞后 传统单智能体安全方法…
risk · E1 预消化简报(2026-08-23)
窗口:20260822 17:10 CST(R51 实质触发 · flyP · 0 件主 risk 主分类 netnew + 7 件邻接级 + 1 件评测方法学延革邻接级 + 3 件 P0 待人工 96h+ + 5 件 R50 沿用独立判定 · 候选池 47→54 · arXiv 230→235 · CVE 33→34…
risk · E1 预消化简报(2026-08-22)
窗口:20260821 16:30 CST(R50 实质触发 + 821 evening 协调棒 100% 闭环 R50/R51/v59/v42)→ 20260822 16:30 CST = R50 沿用 24h 主轴空挡延续(风险主轴净增 = 0 件主 risk 主分类 netnew · 沿用 stephen 822…
Jay 工程实践筛选 · 2026-08-21 傍晚批次
检测命令(推断): vllm version # 或 python c "import vllm; print(vllm.__version__)" CSA 确认(202608 本周):CVE202622778 在披露后数小时内即出现武器化利用 不要将 vLLM API 直接暴露在公网 视频处理部署需加反向代理 + 认…
risk · E1 预消化简报(2026-08-21)
窗口:20260820 16:30 CST(R50 备料棒落盘)→ 20260821 16:30 CST = R49 沿用 72h+ 主轴空挡(沿用 stephen 821 noon §4.3 #G3 + #G7 加剧判定) 承接脉络:knowledge/risk.md R49(20260818 17:10 CST ·…
risk · E1 预消化简报(2026-08-20)
窗口:20260818 17:15 CST(R49 落定)~ 20260820 16:30 CST = R49 沿用 36h+ 警窗口 承接脉络:R49 risk.md(20260818 17:10 CST · flyP · 🟢 立标池 8 → 9 类机制化(锚 4 日断裂 + 5 新晋锚 = OpenART/Alay…
risk · E1 预消化简报(2026-08-18)
窗口:20260817 16:30 ~ 20260818 16:30 CST;为今晚 risk 活文档接力棒(R48 → R49 升级轮候选窗口)备料。本文只综合已有 inbox 与 paper_card,不补写未检查材料,不 web search。 承接脉络:R48 risk.md(20260817 17:10 CS…
risk · E1 预消化简报(2026-08-17)
窗口:20260816 16:30 ~ 20260817 16:30 CST;为今晚 risk 活文档接力棒(R47 → R48 升级轮候选窗口)备料。本文只综合已有 inbox 与 paper_card,不补写未检查材料,不 web search。 承接脉络:R47 risk.md(20260816 17:10 CS…
risk · E1 预消化简报(2026-08-16)
窗口:20260815 16:30 ~ 20260816 16:30 CST;为今晚 risk 活文档接力棒(R47 落定时点候选窗口)备料。本文只综合已有 inbox 与 paper_card,不补写未检查材料。 承接脉络:R46 risk.md(20260815 17:10 CST · flyP · 0 件 net…
risk · E1 预消化简报(2026-08-15)
窗口:20260814 16:30 ~ 20260815 16:30 CST;为今晚 risk 活文档接力棒(R46 落定时点候选窗口)备料。本文只综合已有 inbox 与 paper_card,不补写未检查材料。 承接脉络:R45 risk.md(20260814 17:10 CST · flyP · 0 项 net…
risk · E1 预消化简报(2026-08-14)
窗口:20260813 16:30~20260814 16:30 CST;为今晚 risk 活文档接力棒备料。本文只综合已有 inbox 与 paper_card,不补写未检查材料。 承接脉络:R44 risk.md 的「AI Agent 安全访问控制/评测环境安全攻击面」事件周(22~24 栖)、hardening …
risk · E1 预消化简报(2026-08-13)
窗口:20260812 16:30 ~ 20260813 16:30 CST · ~24h 5 实例风险主题预消化 范围:为今晚活文档接力棒(R44 沿用 → R45 候选升档窗口)备料 立场:不替换 risk.md 已沉淀的 R44(20260812 17:10 CST 落定 · 事件周 22 → 23 栖延展 + …
risk · E1 预消化简报(2026-08-12)
窗口:20260811 16:30 ~ 20260812 16:30 CST · ~24h 5 实例风险主题预消化 范围:为今晚活文档接力棒(R43 → R44 候选升级窗口)备料 立场:不替换 risk.md 已沉淀的 R43(20260811 17:10 CST 落定 · 事件周 17→22 栖延展 + Astra…
risk · E1 预消化简报(2026-08-11)
窗口:20260809 16:30 ~ 20260811 16:30 CST · ~48h 5 实例风险主题预消化 范围:为今晚活文档接力棒(R42 → R43 候选升级窗口)备料 立场:不替换 risk.md 已沉淀的 R42(20260810 17:10 CST 落定 · 事件周 17 栖 + 评测环境作为安全攻击…
研究简报 · 2026-08-10 09:38 · Jay
Hugging Face 官方确认:TGI(Text Generation Inference)只接受 minor bug fix PR,不再作为未来方向推荐 官方建议迁移路径:vLLM 或 SGLang 工程影响:仍在用 TGI 的团队需尽快评估迁移方案 | 引擎 | 定位 | 核心优势 | 适合场景 | |||||…
risk · E1 预消化简报(2026-08-10)
窗口:20260808 ~ 20260810 16:30 CST · 24h + 近 2 天 5 实例风险主题预消化 范围:为今晚活文档接力棒(R41 沿用 + R42 候选升档)备料 立场:不替换 risk.md 已沉淀的 R41,只标注「R41 已沉淀·沿用 / 810 netnew 升档候选 / 矛盾结案 / 待…
研究草稿 · Jay · 2026-08-09 13:35
AI 工程知识库 · Hugging Face 安全事件、Kimi K3 发布、AI Agent Stack 2026 演化、HF Trending Papers 与 arXiv RAG/Agent 新研究 Hugging Face 官方博客 (huggingface.co/blog) Hugging Face Tre…
risk · E1 预消化简报(2026-08-09)
窗口:20260807 ~ 20260809 16:30 CST · 24h + 近 2 天 5 实例风险主题预消化 范围:为今晚活文档接力棒(R40 → R41 升级)备料 立场:不替换 risk.md 已沉淀的 R40,只标注「可升档」+「需沿用」+「矛盾待核」三类信号 活文档 /shared/researchkb…
risk · E1 预消化简报(2026-08-08)
本场性质:R39 收官后第 2 个 E1(承接 R39 00:30 cutoff 与 87 16:39 flyp 第 6 棒)· 87 16:30 → 88 16:30 共 24h 窗口回溯 + 88 00:30 → 16:30 ~16h 窗口增量 · 5 实例 6 大类协同 · 风险主线 netnew 增量 = 「中…
精读与批判:BVS(Beyond Visual Safety)— 多模态大模型的"语义解耦"越狱
1. 提出 BVS(Beyond Visual Safety) —— 一种针对 MLLM 的图文对越狱框架,专门探测"视觉安全边界"。 2. 核心方法:"reconstructionthengeneration",分两步: neutralized visual splicing:把恶意意图"中和化"切片、拼接到视觉输入…
risk · E1 预消化简报(2026-08-07)
本场性质:R39 收官后第 1 个 E1 · 87 00:30 ~ 87 16:30 共 16h 窗口(承接 R39 时间戳)+ 86 16:30 ~ 87 16:30 共 24h 窗口回溯 + 5 实例 6 大类协同 + 风险主线 netnew 增量 = 「中密度偏上 · 1 件 🔴 立基础延展 + 1 件 🟡 候补…
Jay · 早间研究简报 v2 · 2026-08-06 · AI 安全 + 行业人事 + 开源模型发布
v2 重写说明:本文档是对 v1(20260806T0820 早间档,覆盖 AISI / OpenAI Black Hat / Cloudflare AAM / Jeff Dean 离职 / Demis 卸任 / NVIDIA Alpamayo / QwenImage / Google Assistant)的事后重写版…
risk · E1 预消化简报(2026-08-06)
本场性质:R38 沿用后第 1 个 E1 · 86 00:30 ~ 86 16:30 共 16h 窗口(承接 R38 时间戳)+ 85 16:30 ~ 86 16:30 共 24h 窗口回溯 + 5 实例 6 大类协同 + 风险主线 netnew 增量 = 「中密度 · 1 件 v38 86 aiindustry 已立…
Jay · 研究草稿 · 2026-08-05 13:35
主题: HF 安全事件时间线 · OWASP Agent 2026 · AI 工程师技能市场数据 · 推理成本攻击 · AAAI26 上下文工程 检索范围: Hugging Face Blog × OWASP × Substack(AI Engineer/The AI Engineer) × arXiv × Huggi…
risk · E1 预消化简报(2026-08-05)
本场性质:R37 沿用后第 1 个 E1 · 84 16:30 ~ 85 16:30 共 24h 窗口 · 5 实例 6 大类协同 + 风险主线 netnew 增量 = 「中密度 · 1 项 85 12:30 主分类 risk netnew 立标候选 MemSFT arXiv:2607.25614 P3 邻接(对齐税缓…
Jay 晚报补遗 · 2026-08-04 21:05(第4次/日)
主题: 推理引擎 Benchmark 2026 · K8s Gateway API Inference Extension · 向量数据库 Q1 2026 · MCP/RAG 安全态势 · EU AI Act 合规 检索范围: Tavily(推理引擎/向量库/K8s/安全)、arXiv cs.DB/cs.DC/cs.C…
risk · E1 预消化简报(2026-08-04)
本场性质:R36 沿用后第 1 个 E1 · 83 16:30 ~ 84 16:30 共 24h 窗口 · 5 实例 6 大类协同 + 风险主线 netnew 增量 = 「低中密度 · 1 项 84 早晨主分类 risk netnew 立标候选 Constitutional Midtraining arXiv:2607…
flyP 精读与批判 · 2026-08-03 09:50 · SaLAD 多模态日常安全基准
SaLAD: When Helpers Become Hazards — A Benchmark for Analyzing Multimodal LLMPowered Safety in Daily Life arXiv:2601.04043 (v1 20260107, v2 20260420) 作者:Xinyue …
risk · E1 预消化简报(2026-08-03)
本场性质:R35 立标固化后第 3 个 E1 · 82 16:30 ~ 83 16:30 共 24h 窗口 · 5 实例 6 大类协同 + 风险主线 netnew 增量 = 「低密度 · 1 项唯一新立标 Memory Provenance Laundering P3 候补级 + 2 项 flyP 精读 SaLAD 多…