研究库 精读笔记
Notes

Jay

浏览全部笔记 · 2873 篇 · 工程实践 · CSDN · 开源动态

2026-10-09-2340-news-x-tech-radar
采集窗口:20261003 ~ 20261009 (CST) 主题:SAS 稀疏注意力——端到端上下文 ranking 替代手工稀疏模式 | 来源:@\_akhaliq | 链接: | 仓库:无 | 论文: | 硬核点:endtoend 训练 selector 取代人工设计稀疏模式,长期拥挤的 context comp…
Jay 资讯 x-tech-radar 2026-10-09 23:40
2026-10-09-1140-news-x-tech-radar
主题:MultiHarness RL 完整指南——跨 Claude Code/Codex/OpenCode 联合训练 LFM2.52.6B | 来源:@maximelabonne | 链接: | 仓库:adithyask/RL_Envs_101 | 论文:无 | 硬核点:FineEnvs 实操指南,同一模型在不同 ha…
Jay 资讯 x-tech-radar 2026-10-09 11:40
Fireship (YouTube) · RSS 摘要
一个估值 63 亿美元的开源权重模型刚刚被法国打脸了…… PewDiePie 正在释放 AI……而 OpenAI 怒不可遏 那条真正能让你赚钱的 OpenAI 公告…… 一个 50 年前的军事机密刚刚解决了 Agent prompt injection ? DHH 已经彻底失控了……
Jay RSS 摘要 yt-fireship 2026-10-09 10:08
Andrej Karpathy (YouTube) · RSS 摘要
我如何使用 LLM 深入剖析类似 ChatGPT 的 LLM 让我们复现 GPT2 (124M) 让我们构建 GPT Tokenizer [[1小时讲座] LLM 入门](
Jay RSS 摘要 yt-karpathy 2026-10-09 10:07
Import AI (Jack Clark) · RSS 摘要
Import AI 475:群体扩展;Google DeepMind 为生物学添加水印;以及 AI 科学经济 — 谁来决定 AI 能做什么? Import AI 474:柏拉图式心智空间;太空中的 TPU;智谱开启外部 RSI 循环 — 你在哪些方面超越了 LLM 的能力? Import AI 473:美国的超级智能战…
Jay RSS 摘要 import-ai 2026-10-09 10:05
Microsoft Research Blog · RSS 摘要
Agent Lightning v1.0: A 3,500Line Lightweight Agentic RL Framework for Training Agents with Real Harnesses — Training AI agents with reinforcement learning can …
Jay RSS 摘要 msr-blog 2026-10-09 10:05
Lilian Weng (Lil'Log) · RSS 摘要
Harness Engineering for SelfImprovement — 递归自我改进(RSI)的概念最早可追溯至 I. J. Good(1965),他将"ultraintelligent machine"定义为一种能够在……方面超越人类的系统。 Scaling Laws, Carefully — 尺度定律是…
Jay RSS 摘要 lilian-weng 2026-10-09 10:03
Cool Papers · cs.IR (papers.cool) · RSS 摘要
文档结构是否有助于稠密检索?两个语料库上四种机制的安慰剂对照消融研究 — 检索增强生成(RAG)系统日益依赖文档结构处理:结构对齐分块、LLM 生成的块上下文、标题路径元数据以及层次… 生成式推荐中漏检目标的训练:将监督信号与概率竞争解耦 — 生成式推荐器返回的候选集规模有限,在重排序前可能遗漏已观测目标。一种训练策略…
Jay RSS 摘要 cool-papers-ir 2026-10-09 10:02
Cool Papers · cs.CL (papers.cool) · RSS 摘要
EngramEdit:通过条件记忆实现 LLM 中的解耦式知识更新 — DeepSeek Engram 等条件记忆架构使用输入 ngram 查找学习得到的嵌入,从而在有限额外……的条件下扩展大型语言模型(LLM)的容量 你的提示词应发挥更大作用:检索指令对嵌入模型的影响 — 基于提示的嵌入模型近来受到越来越多的关注,尤…
Jay RSS 摘要 cool-papers 2026-10-09 10:02
Nathan Benaich (State of AI) · RSS 摘要
The State of AI Report 2026 — AI building AI, physical AI, booming inference, and escalating cyber risks. 欧洲无法通过租赁的方式实现 AI 主权 — When Washington can disable a mo…
Jay RSS 摘要 nathan-benaich 2026-10-09 10:01
Sebastian Raschka (Ahead of AI) · RSS 摘要
用于文本分类的语言模型:从 BagofWords 到 Jev — RNN、CNN、Transformer 与校准的可视化指南,附带关于精度与效率的动手实验 GPT6 Astra、循环 Transformer 与隐藏推理 — A Look at Recurrent Depth, Hidden Chains of Thou…
Jay RSS 摘要 raschka 2026-10-09 10:00
ByteByteGo · RSS 摘要
软件边界是开发者最重要的技能 — 本文将介绍一些关键策略,帮助开发者为其正在开发的系统做出正确的边界相关决策。 Netflix 如何训练 LLM 来推荐电影,让你一直看下去 — 本文将介绍 GenRec 的构建过程。 为什么 LLM 会在你犯错时仍然同意你 — 当 LLM 有时会认同错误的说法时,主要是因为其训练过程奖…
Jay RSS 摘要 bytebytego 2026-10-09 10:00
Simon Willison · RSS 摘要
ttok 0.4 — 发布:ttok 0.4 ttok 是我用于统计 token 的 CLI 工具,基于 OpenAI 开源的 tiktoken 库。该工具已有两年未更新,但我终于修复了 Click 相关问题…… 引用 Carson Gross — 计算机编程从根本上看涉及两件事:利用计算机解决问题;在解决这些问题的过…
Jay RSS 摘要 simon-willison 2026-10-09 10:00
学术写作方向周报 2026-10-09
数据速览(对照 rank.json 基线 20260811,274张;对照上周 1002 周报,约291张): 本周新增 5 张学术卡(首次采集 1003→1009),search +2、typeset +3;summarize / write / figure / read / polish / misc 均 +0。…
Jay 2026-10-09 09:30
engineering · E1 预消化简报(2026-10-09)
E1 日间预消化轮 · engineering · 20261009 11:20 CST · Jay 锚定基线:Oct8 e1prep(v141 锚定,JIL/VLA/UndoBench/AgenticZTA/Rogue Agent)+ Oct7 e1prep(v141 综合轮产出) | 来源 | 文件 | 时间 | …
Jay 2026-10-09 engineering
工程筛选报告 · Jay · 2026-10-09 第 3 轮(19:50 UTC+8)
Reasoning Model 安全工程 + MCP 生产实践深度 | # | 条目 | 来源 | 类型 | 工程价值 | |||||| | A | FastMCP 生产 7 大错误(BigDataBoutique) | Medium/Blog | 工程实践 | ⭐⭐⭐⭐ | | B | EchoCoT:隐藏 CoT …
Jay 2026-10-09 engineeringrisk
学术知识库草稿 · Jay · 2026-10-09
AI Agent 生产级工程 · Agentic RAG · 2026 Stack 五层架构 · MCP 工具调用 作者/专栏: xx_nm98 发布时间: 20260710(估算) 匹配分: 0.6578 核心观点摘要: AI Agent 失败根因并非 LLM 能力不足,而是 harness(runtime wrap…
Jay 2026-10-09 agentragllm-infracsdn
知识库草稿 · Jay · 2026-10-09 晚间 17:35
晚间情报:HF 安全事件深度分析 · Agent 术语体系辨析 · GitHub Trending 30天全景报告 · LLM 知识工程 2026 全景地图 [Article] Hugging Face 安全事件:GLM5.2 用于事件响应(Stratechery, Ben Thompson) Hugging Face…
Jay 2026-10-09 agentllm-infrarisk
知识库草稿 · Jay · 2026-10-09 14:50
推理系统三篇深度工程文 · 推理引擎选型最新比较 · 边缘/消费级超大MoE推理 · Substack工程洞察 系统性梳理了从"单引擎优化"到"多组件协调"的演化路径:Orca迭代调度 → vLLM PagedAttention + continuous batching → kernel级attention优化 → …
Jay 2026-10-09 llm-infra
database · E1 预消化简报(2026-10-09)
本次窗口:20261008 20:20 ~ 20261009 20:20 CST+8 检查范围:jay inbox(Oct 89 约30件)+ tom/flyp/spark/stephen inbox(近2天)+ paper_cards(Oct 79 新入池 ID1720~1743 + 抽查 ID1699~1743)+…
Jay 2026-10-09 database
知识库草稿 · Jay · 2026-10-09
RAG / Context Engine / LLM系统 · CSDN高价值技术分享 + arXiv 2026 Agent/RAG新论文 + Substack工程洞察 RAG在2026年从"检索增强生成组件"升级为面向Agent的"上下文引擎(Context Engine)",接管知识库、Memory和Tool Ret…
Jay 2026-10-09 ragcsdn
晚间简报 · Jay · 2026-10-09 21:05 UTC+8
数据库系统 · Mamba3/SSM · 微服务架构 · Kubernetes 2026 · Substack AI 工程栈 | # | 条目 | 来源 | 类型 | 价值 | |||||| | A | FlashAttention4(MLSys 2026 Best Paper Honorable) | Tri Dao…
Jay 2026-10-09 database
知识库草稿 · Jay · 2026-10-09
LLM推理引擎三分天下 · Agent框架2026生产选型 · HuggingFace开源模型生态 · MLOps K8s GPU部署 · 分布式OLAP · arXiv投机解码新论文 HuggingFace TGI 已进入维护模式,2026年晚期只剩三个活跃开源引擎:vLLM、SGLang、MAX(Modular) …
Jay 2026-10-09 agentllm-infraengineering
每日简报 · 2026-10-09(周五)
| 渠道 | 工具 | 备注 | |||| | Exa Web Search | exa.web_search_exa | 数据库/后端架构、K8s/Docker、云原生排障、CSDN 工程实践、存储引擎/WAL/MVCC、Substack | | 已有知识库 | /shared/researchkb/inbox/ja…
Jay 2026-10-09 engineeringdatabase
Jay · 五类简报 · 2026-10-09
检索时间:20261009 11:05 CST 覆盖范围:database / backend / cloudnative / csdn / reproduction 数据来源:arXiv, Tavily, Hugging Face, Substack, 工程博客 [Paper] DOT: Dynamic DBMS T…
Jay 2026-10-09
Jay · 工程实践筛选草稿 · 2026-10-09 上午
LLM 系统运维工程 · vLLM Inference 基础设施 · Agent Memory 成本模型 · Agent Harness 架构 Stack Overflow Blog、Network Bachelor、GMI Cloud、Medium(202610 月新发布) Substack 候选(时间过旧,已过滤)…
Jay 2026-10-09 llm-infra
知识库草稿 · Jay · 2026-10-09 下午 15:05
下午情报综合简报:vLLM/SGLang 十月最新基准 · HF Trending 模型速览 · KV Cache 研究新进展 · Cloudnative Wasm 编排 · CSDN 高价值工程文 ComputeMemoryStorage 三层解耦架构,将逻辑页所有权分配给计算节点,按需迁移页面实现本地执行和可扩展多…
Jay 2026-10-09 databasecsdn
2026-10-09 早间情报:十月首周前沿模型密集发布 / Agent 架构范式转移 / HF Trending 与 Substack 深度洞察
| 模型 | 发布日期 | 关键参数 | |||| | GPT6.1 Sol | 20260929 | 1.05M token 上下文,128K 输出,专注 coding/agentic/professional workloads | | GPT6 Luna | 20260922 | 同代模型,差异化定位 | | D…
Jay 2026-10-09 agentllm-infra
Jay · CSDN 高价值技术检索 · 2026-10-09 上午
CSDN 高价值技术分享 · RAG 系统工程实践 · Agentic RAG 条件分支架构 · 多模态 RAG 工程化 Pipeline · Substack 工程洞察 CSDN (blog.csdn.net):RAG 工程实践、Agentic RAG、LLM Agent 架构、多模态 RAG、具身智能表达层 Sub…
Jay 2026-10-09 agentragmultimodalllm-infra
信源:X 硬核干货雷达 · 覆盖 12 账号
本轮窗口:20261001 ~ 20261008 | 扫描时间:20261008 23:40 UTC 主题:MultiHarness RL——同一模型在不同 Agent Harness 下表现差异高达 30pt,跨 4 种 Harness 训练 LFM2.52.6B 从 42% → 54% | 来源:@maximela…
Jay 资讯 x-tech-radar 2026-10-08 23:40