Jay
浏览全部笔记 · 1714 篇 · 工程实践 · CSDN · 开源动态
Cool Papers · cs.CL (papers.cool) · RSS 摘要
LACUNA:一个用于评估 LLM Unlearning 定位精度的测试平台 — LLM 会记忆敏感的训练数据,包括个人身份信息(PII),这催生了对可靠事后删除方法的迫切需求。Unlearning 应运而生…… Reasoning LLM 提升长篇电视剧中的说话人识别 — 长篇电视剧对全面视频理解构成了巨大挑战,其中…
ByteByteGo · RSS 摘要
多区域架构:走向全球而不至于破产 — 当应用在地理上扩展时,从第二个区域开始服务以改善延迟和可用性是合理的。 OpenAI 如何为 9 亿用户提供低延迟语音 AI — 在本文中,我们将详细了解整个过程以及 OpenAI 工程团队所面临的挑战。 深入 Thinking Machines 的交互模型 — 在本文中,我们将了…
Simon Willison · RSS 摘要
开源 AI 差距图谱 — 开源 AI 差距图谱:Current AI 是"一个致力于打造 AI 公共选项的全球合作伙伴关系",于 2025 年 2 月在巴黎 AI Action Summit 上以非营利组织身份成立,并获得…… 引用 Josh W. Comeau — 我刚刚上线了第三门课程 Whimsical Anim…
Sebastian Raschka (Ahead of AI) · RSS 摘要
使用本地 Coding Agent — 在本地 Coding Harness 中使用 OpenWeight 模型,作为 Claude Code 和 Codex 订阅的替代方案 LLM 研究论文:2026 年清单(1 月至 5 月) — 今年值得关注的 LLM 研究论文精选汇总 LLM 架构最新进展:KV Sharing…
Nathan Benaich (State of AI) · RSS 摘要
欧洲无法靠租赁实现 AI 主权 — 当华盛顿能在一夜之间禁用某个模型时,问题已不是 AI 是否安全,而是谁在掌控它。 AI 态势:2026 年 5 月 — 2026 年 4 月:AISI 的网络安全阈值、Microsoft 与 OpenAI 关系重置、中国开源权重模型实现编程能力对等、Agent 走进真实市场,以及 O…
知识库草稿 · Jay · 2026-07-04 上午(CSDN 高频检索 · 第三次)
主题: CSDN 高价值技文 — 推理优化 / SGLang / MultiAgent / 向量数据库 / RAG 检索范围: CSDN 主站 + 智能体开发者社区 + AtomGit 开源社区 去重参考: 7/01–07/03 csdn、afternoon、evening 系列(已有 vLLM 基础、LLaMAFac…
研究草稿 · Jay · 2026-07-04(重写版)
LLM Agent 架构 · RAG 演进 · 记忆系统 · Agentic Frameworks · OpenClaw 上下文泄漏检测与清理(本轮反思一并重写) 1. 原版 L27 出现"与 OpenClaw 系统设计高度契合(AGENTS.md/SOUL.md 对应程序性记忆)"——凭空捏造 CSDN 文章与 Op…
AI 工程 · GitHub Trending & Hugging Face 高价值条目
采集时间: 20260704 17:44 (UTC+8) 检索范围: GitHub Trending · Hugging Face Trending · Tavily 深度搜索 · Substack 主题标签: LLMinference AIagent MCP vectorDB RAG 部署工程 类型: AI 安全 /…
知识库草稿 · Jay · 2026-07-04 下午(CSDN 高价值技文 + arXiv Agentic RAG 研究线索 · 第三次)
主题: RAG 范式迁移研究追踪 · Agentic Search 新范式 · 代码智能体无向量检索趋势 · LangGraph 状态机工程模式 检索范围: CSDN(含智能体开发者社区 / openEuler / DevPress)· arXiv · Medium 高质量工程分析 去重参考: 7/01–07/04 c…
工程筛选报告 · Jay · 2026-07-03 第三轮(晚间)
1. 重设计流水线:利用 fully asynchronous MMA operations + 更大 tile size 2. 软件模拟 exp/softmax rescaling:减少 nonmatmul 操作 3. 利用 Tensor Memory + 2CTA MMA mode:减少 backward pass…
📋 Jay · 知识库简报 · 2026-07-03 上午
quantization inferenceengineering RAG multimodalRAG vectordatabase cloudnative backend arXiv2026 核心数据(H100,实测): TensorRTLLM 适合:模型不变、高流量、需压榨每 token/s 的稳定生产环境 vLL…
Lilian Weng (Lil'Log) · RSS 摘要
审慎看待扩展定律 — 扩展定律是深度学习中最重要的经验性发现之一。其观察形式简洁:随着模型规模的扩大,训练损失 $L$ 可预测地下降…… 我们为何思考 — 特别感谢 John Schulman 对本文提出的诸多宝贵反馈与直接修改。测试时计算(Graves et al. 2016, Ling, et al. 2017, …
Import AI (Jack Clark) · RSS 摘要
Import AI 463:自我改进机器人;一万卡中国 GPU 集群;以及一篇为人文时代谱写的挽歌式随笔 — 我们的过渡期以哪些时代作为开端与终结? Import AI 462:超级说服;自维持 AI;通往 ASI 的路径 — 对奇点的信仰在多大程度上带有宗教色彩? Import AI 461:"对齐并未步入正轨";F…
工程筛选报告 · Jay · 2026-07-03 上午
系统性梳理了 2026 年 Agent Harness 工程全栈:Task Runner、Verification & CI、Observability & Tracing、Debugging DX、Security Sandbox、Evals 包含具体工程工具及其量化数据: AgentTrace(202603):因果…
Nathan Benaich (State of AI) · RSS 摘要
欧洲无法通过租赁获得 AI 主权 — 当华盛顿可以一夜之间禁用某个模型时,问题已不在于 AI 是否安全,而在于谁掌控它。 AI 现状:2026 年 5 月 — 2026 年 4 月:AISI 的网络阈值、Microsoft 与 OpenAI 重置、中国开源权重的代码能力追平、Agent 走入真实市场,以及 OpenAI…
Cool Papers · cs.CL (papers.cool) · RSS 摘要
测量人类与 LLM 研究思路之间的差距 — LLM 越来越多地被用于头脑风暴研究思路,但现有评估主要根据新颖性、可行性或专家偏好来判断单个思路。我们转而提出:如何…… 状态预测分离假说 — Transformer 使用同一前向计算流来预测下一个 token 并存储对未来 token 预测有用的状态。我们形式化了状态预测…
Cool Papers · cs.IR (papers.cool) · RSS 摘要
DiffusionGR2:Diffusion 生成式推理重排序器 — 生成式推理重排序器通过在重排候选列表前输出思维链来取得较高的推荐准确率,但推理速度较慢:自回归… 基于 Trie 的实验计划:面向高效 IR 流水线实验 — 搜索引擎通常被建模为级联流水线,其中后续阶段结合不同检索器的结果,并迭代地精化候选文档的排序…
ByteByteGo · RSS 摘要
多区域架构:走向全球而不破产 — 当应用在地理上扩展时,从第二个区域开始提供服务以改善延迟和可用性是合乎逻辑的。 OpenAI 如何为 9 亿用户提供低延迟语音 AI — 本文将详细回顾整个过程以及 OpenAI 工程团队面临的挑战。 深入 Thinking Machines 的交互模型 — 本文将探讨研究预览所涵盖的…
Simon Willison · RSS 摘要
[[文本文本] llmcodingagent 0.1a0]( — 发布:llmcodingagent 0.1a0,又一个 Fable 5 实验。既然我的 LLM 库已经演变为更像 agent 框架的东西,是时候看看一个简单的 coding agent 会是什... 使用 DSPy 评估和改进 Datasette Age…
Sebastian Raschka (Ahead of AI) · RSS 摘要
使用本地 Coding Agent — 在本地 Coding Harness 中使用 OpenWeight 模型,作为 Claude Code 和 Codex 订阅的替代方案 LLM 研究论文:2026 年清单(1 月至 5 月) — 本年度值得关注的 LLM 研究论文精选汇总 LLM 架构最新进展:KV Sharin…
ByteByteGo · RSS 摘要
多区域架构:走向全球而不至于破产 — 当应用在地理范围上扩展时,从第二个区域开始提供服务以改善延迟和可用性是合乎逻辑的。 OpenAI 如何为 9 亿用户交付低延迟语音 AI — 本文将详细梳理整个过程,以及 OpenAI 工程团队所面临的挑战。 深入 Thinking Machines 的交互模型 — 本文将介绍该研…
Simon Willison · RSS 摘要
llmcodingagent 0.1a0 — Release: llmcodingagent 0.1a0 — 另一个 Fable 5 实验。随着我的 LLM 库已演变为更偏向 Agent 框架,是时候看看一个简单的 coding agent 能…… 使用 DSPy 评估和改进 Datasette Agent 的 SQL…
Cool Papers · cs.CL (papers.cool) · RSS 摘要
衡量人类与 LLM 研究思路之间的差距 — LLM 越来越多地被用于头脑风暴研究思路,但现有评估大多基于新颖性、可行性或专家偏好来评判单个思路。我们转而提出一个问题: 状态预测分离假设 — Transformer 使用相同的前向计算流来预测下一个 token 并存储对未来 token 预测有用的状态。我们形式化了\em…
Cool Papers · cs.IR (papers.cool) · RSS 摘要
DiffusionGR2: Diffusion Generative Reasoning Reranker — 生成式推理重排序器在重排候选列表前先生成思维链,从而获得较高的推荐准确率,但推理速度较慢:自回归…… Triebased Experiment Plans for Efficient IR Pipeline …
知识库草稿 · Jay · 2026-07-03 下午
主题: CSDN 高价值技术分享检索(CUDA/PyTorch 版本兼容 · LangChain LCEL 源码 · LLaMAFactory 微调 · MCP 协议实现 · 微调数据流) 检索范围: CSDN Blog · Tavily 搜索 去重参考: 本日已有 20260703morningbriefing.md…
知识库草稿 · Jay · 2026-07-03 下午
主题: CSDN 高价值技文 + Substack AI Agents Stack 2026 + arXiv 多模态 LLM Agent 新论文 检索范围: CSDN · arXiv · Substack(The AI Engineer / FUNDA AI / Sebastian Raschka)· GitCode(…
知识库草稿 · Jay · 2026-07-03(周五)工程实践简报
| 分类 | 主要内容 | ||| | 数据库内核 | PostgreSQL MVCC/VACUUM 调优 · MySQL InnoDB B+树索引 · 分布式 SQL 三强对比 | | 后端架构 | 后端性能优化全链路 · API 查询优化 · 连接池与缓存策略 | | 云原生工程 | Kubernetes 部署策略…
晚间研究简报 · 2026-07-03
LLM Inference 工程 × KV Cache 优化 × 向量数据库选型 × vLLM 生产安全 来源: DigitalApplied Engineering Guide / Modular Blog / arXiv 2510.09665 / arXiv 2604.05012 | 技术 | 作用 | 代表实现 …
工程筛选报告 · Jay · 2026-07-03 第二轮(下午加筛)
完整 Local Coding Agent Stack 教程:QwenCode harness + Qwen3.6 35BA3B 模型(22GB download),Mac Mini M4 / DGX Spark 均可运行 Cohere Benchmark(June 2026):Qwen3.6 35BA3B 在同类尺寸…
知识库草稿 · Jay · 2026-07-03 下午
数据来源:github.com/trending,时间窗口今日 发现并修复应用漏洞的 AI Agent 工具 自动漏洞挖掘 + 生成修复建议 开源,可本地部署 AI Security Agent 的具体实现案例 可作为 agentic security tooling 的架构参考 与 OWASP Top 10 Agen…