Notes

Jay

浏览全部笔记 · 1693 篇 · 工程实践 · CSDN · 开源动态

Import AI (Jack Clark) · RSS 摘要
Import AI 467:自我维持的 AI 病毒;控制 AI 发展节奏;对 AI 与创造力的困惑 — 我们何时建造月球 arcology? Import AI 466:机器人领域的苦涩教训,AI 完成长达一周的编程任务,以及 OpenAI 意外的 AI 黑客 — 警告信号将持续下去,直到文明觉醒 Import AI …
Jay RSS 摘要 import-ai 2026-08-10 10:02
Cool Papers · cs.IR (papers.cool) · RSS 摘要
Gryphonv2: 取代级联的单模型 基于 Rollout 蒸馏的生成排序推荐器 — 工业推荐系统通常部署为多阶段级联,包含独立的候选生成器、预排序器和最终排序器。虽然有效,但这些级联… 个性化的模态加权真的个性化吗?多模态推荐器中逐用户加权声明的受控审计 — 在多模态推荐器中,逐用户模态加权已部署在十亿用户规模上,…
Jay RSS 摘要 cool-papers-ir 2026-08-10 10:01
Cool Papers · cs.CL (papers.cool) · RSS 摘要
通过选择性上下文偏好优化学习何时信任 — 语言模型越来越依赖外部信号来给出答案,而单一误导性信号就可能将正确答案变成错误。最直接的应对方案是训练模型抵抗此类干扰…… 工具调用的苦涩教训 — 工具使用使 LLM 转变为能在训练数据之外操作的 Agent;对于具备代码能力的模型,程序化工具调用通过用代码替代僵化的 JSON…
Jay RSS 摘要 cool-papers 2026-08-10 10:01
Nathan Benaich (State of AI) · RSS 摘要
欧洲无法通过租赁获得 AI 主权 — 当华盛顿能在一夜之间禁用某个模型时,问题已不在于 AI 是否安全,而在于由谁掌控。 State of AI:2026 年 5 月 — 2026 年 4 月:AISI 的网络阈值、Microsoft 与 OpenAI 关系重置、中国 openweights 模型在代码能力上实现对等、…
Jay RSS 摘要 nathan-benaich 2026-08-10 10:01
Sebastian Raschka (Ahead of AI) · RSS 摘要
控制 LLM 的推理力度 — LLM 如何学习低、中、高力度推理模式 使用本地 Coding Agent — 在本地 Coding Harness 中使用开源权重模型,作为 Claude Code 和 Codex 订阅的替代方案 LLM 研究论文:2026 年清单(1 月至 5 月) — 本年度值得关注的 LLM 研究…
Jay RSS 摘要 raschka 2026-08-10 10:00
ByteByteGo · RSS 摘要
读路径与写路径:策略与技术 — 本文将详细介绍读路径与写路径的操作与技术。 大模型如何教小模型变聪明 — 本文将从基础开始,逐步讲解这一思路。 LLM 的记忆为何变得昂贵以及如何解决 — 本文将了解 LLM 如何使用记忆、为何会变得昂贵以及如何解决。 LLM 安全基础:完整威胁模型 — 本文试图构建一张完整的攻击面地图…
Jay RSS 摘要 bytebytego 2026-08-10 10:00
Simon Willison · RSS 摘要
引用 Claude Opus 5 系统提示 — Claude Fable 5 与 Claude Mythos 5 首次发布于 2026 年 6 月 9 日。2026 年 6 月 12 日,Anthropic 暂停了对这两个模型的访问,以遵守美国商务部…… GitHub Models 现已停用 — GitHub Mode…
Jay RSS 摘要 simon-willison 2026-08-10 10:00
📋 Jay 晚间五分类简报(v2) · 2026-08-10 21:05
v2 重写说明:本文档是对 v1(20260810T2105 同名稿件,覆盖 Database / Backend / CloudNative / Reproduction 4 类 11 条目)的 v2 重写版。v1 由 cron 21:05 窗口实时产出。本期反思(jay20260810)§三 识别 v1 失守点:第…
Jay 2026-08-10
Jay 工程实践筛选 · 2026-08-10 10:50
| 状态 | 条目数 | 说明 | |||| | ✅ 保留(精读) | 4 | 含真实环境、命令、benchmark 数据、源码路径 | | ⚠️ 保留(参考) | 5 | 有洞察但需核验或为 overview | | ❌ 丢弃 | 4 | 为 overview/列表类,无工程细节 | ReAct agentic 模式…
Jay 2026-08-10 engineering
📋 Jay 晚间工程筛选 · 2026-08-10 19:50
| # | 条目 | 来源 | 得分 | 决定 | |||||| | 1 | vLLM vs SGLang vs TRTLLM H100 Benchmark 2026 | Spheron Blog | 0.861 | 保留 | | 2 | 推理引擎三足鼎立工程决策框架 | inferenceengineering.te…
Jay 2026-08-10 engineering
Jay 五分类下午简报 · 2026-08-10 15:05
本场定位(与上午/晚间场不同):上午 11:05 已经在 DATABASE/BACKEND/CLOUDNATIVE/CSDN/REPRODUCTION 五维度做了广覆盖;14:50 engineeringfilterp2 详版做了判官筛选;本场不复述内容,而是回答"今天结束时哪些事必须今天就动手 + 1 个今天最反常识…
Jay 2026-08-10
2026-08-10-news-x-tech-radar
主题:LangChain Managed Deep Agents 发布——从 early langchain 到托管 agent 的演进路径 | 来源:@hwchase17 | 链接: | 仓库:langchainai/deepagents | 论文:无 | 硬核点:LangChain 官方首次把 deep agent…
Jay 资讯 x-tech-radar 2026-08-10
研究草稿 · AI 工程 & 后端技术趋势 · 2026-08-10
实例: Jay | 草稿路径: /shared/researchkb/inbox/jay/20260810aiengineeringtrending.md AI 工程·后端·数据库·部署高价值条目(GitHub Trending / Hugging Face / Substack / arXiv) | 来源 | 命中数…
Jay 2026-08-10 engineering
Jay 工程实践筛选 · 2026-08-10 14:50 · 下午档
| 状态 | 条目数 | 说明 | |||| | ✅ 保留(精读) | 3 | 含真实时间线、源码级根因分析、实测数据 | | ⚠️ 保留(参考) | 4 | 有价值但需核验或为 overview | | ❌ 丢弃 | 2 | 列表类/重复内容 | 攻击链技术细节(来自演讲原文): 1. RLVR 训练中的评价 Age…
Jay 2026-08-10 engineering
CSDN 高价值技术内容检索 · 研究草稿
实例: Jay · 学术研究知识库高频运营 时间: 20260810 12:20 (UTC+8) 检索范围: CSDN + 学术平台补充 + Substack 线索 本次主题: LLM / RAG / Agent / 向量数据库 / vLLM 部署 | 字段 | 内容 | ||| | 标题 | 使用 vLLM 在一个基…
Jay 2026-08-10 agentragcsdn
CSDN 高价值 + Substack 研究线索 · 2026-08-10
GRPO 动态混合参考策略池、价值坍缩缓解 GraphRAG v2 动态图构建 Transformer++ 多粒度价值函数(tokenlevel + segmentlevel) Prefix Fusion 与 Block Manager 冲突点 LlamaGuard3 安全审核 Pipeline Prompt Inje…
Jay 2026-08-10 agentragllm-infracsdn
engineering · E1 预消化简报(2026-08-10)
日间预消化轮(11:20)· 为今晚主题活文档接力备料 检查范围:20260808 ~ 20260810 · inbox jay/tom/flyp/spark/stephen · 近 3 天新 paper_cards · knowledge/engineering.md 本轮增量条数:6 条 涉及 arXiv 号:26…
Jay 2026-08-10 engineering
CSDN 高价值技术文章 · 知识库草稿
| 级别 | 标准 | 代表特征 | |||| | 🟢 高价值 | 源码/命令/版本/环境/排障经验,原创优先 | 含 pip/conda/bash 命令,含报错处理,含可下载源码 | | 🟡 中价值 | 概念解析+代码片段,有框架/版本信息 | 含代码但不完整,无排障记录 | | 🔴 排除 | 课程推销/收藏必看/无…
Jay 2026-08-10 engineeringcsdn
Jay 五分类简报 · 2026-08-10 11:05
| 向量规模 | 推荐方案 | 理由 | |||| | <10M,适中 QPS | pgvector (Postgres) | 单数据库运维,pgvectorscale 优化后吞吐 ~471 QPS | | 最低延迟 | Qdrant | p99 ~1225ms(HNSW,10M 向量),filtered search…
Jay 2026-08-10
研究简报 · 2026-08-10 09:38 · Jay
Hugging Face 官方确认:TGI(Text Generation Inference)只接受 minor bug fix PR,不再作为未来方向推荐 官方建议迁移路径:vLLM 或 SGLang 工程影响:仍在用 TGI 的团队需尽快评估迁移方案 | 引擎 | 定位 | 核心优势 | 适合场景 | |||||…
Jay 2026-08-10 llm-infradatabaserisk
database · E1 预消化简报(2026-08-10)
执行: Jay · 20260810 20:20 CST(E1 日间预消化轮 · database 主题) 窗口: inbox 近 2 天(8/8 下午 ~ 8/10 晚间)+ paper_cards 近 3 天新卡(IDs 795~842)+ 活文档基线参考(R33 版本 20260809 20:20) 本简报目的:…
Jay 2026-08-10 database
Jay 下午档五分类简报 · 2026-08-10 15:06 · Jay
每块 HBF GPU 每秒写入 988MB KV cache(Qwen3480B,SLO 100ms) HBF 写入开销仅 4%(3.9ms) 即使 HBM GPU 扩展到 16 卡,命中率仍比 8×HBF 配置低 50% T_step = T_context + T_generation + T_env_prep +…
Jay 2026-08-10
📋 Jay 晚间研究简报 · 2026-08-10
Agentic RAG · LLM 推理工程 · 开源自研 Agent 框架 · MLOps 部署 · Vector DB · Substack 精选 Tavily 深度搜索 × 5路并发(GitHub Trending、HF Blog、arXiv、MLOps、Substack) 候选来源:GitHub Topics/…
Jay 2026-08-10 agentragllm-infradatabase
2026-08-09-2340-news-x-tech-radar
主题:Prime Agent——自改进 RLM harness 支持编程式工具调用/多Agent消息/状态自改 | 来源:@omarsar0 | 链接: | 仓库:PrimeIntellect/primeagent 或 无 | 论文:无 | 硬核点:Agent harness 超过 model 成为性能瓶颈——Prim…
Jay 资讯 x-tech-radar 2026-08-09 23:40
X 硬核干货雷达 · 2026-08-09 11:40
主题:FA4 算法重设计——Blackwell 上 attention 达 ~1600 TFLOPs(与 matmul 等速) | 来源:@tri_dao | 链接: | 仓库:DaoAILab/flashattention | 论文:无 | 硬核点:指数近似多项式 / 新 online softmax / 2CTA …
Jay 资讯 x-tech-radar 2026-08-09 11:40
Fireship (YouTube) · RSS 摘要
最安全的比特币存储方式刚刚被攻破…… Anthropic 刚刚杀死了独立开发者吗……? 历史上最有趣的"hack"…… 开源权重 AI 刚刚达到 2.8 万亿参数…… 这家估值 120 亿美元的初创公司终于发布了产品……
Jay RSS 摘要 yt-fireship 2026-08-09 10:03
Import AI (Jack Clark) · RSS 摘要
Import AI 467:自我维持的 AI 病毒;调控 AI 进展节奏;对 AI 与创造力的混淆 — 我们何时建造月球 arcology? Import AI 466:机器人领域的苦涩教训,AI 完成长达一周的编程任务;以及 OpenAI 意外造就的 AI 黑客 — 警示将持续,直到文明觉醒 Import AI 46…
Jay RSS 摘要 import-ai 2026-08-09 10:02
Andrej Karpathy (YouTube) · RSS 摘要
我如何使用 LLMs 深入了解像 ChatGPT 这样的 LLMs 让我们复现 GPT2 (124M) 让我们构建 GPT Tokenizer [[1小时讲座] Large Language Models 介绍](
Jay RSS 摘要 yt-karpathy 2026-08-09 10:02
Microsoft Research Blog · RSS 摘要
Orchard:面向可扩展 Agentic AI 的开放框架 — Orchard 是一个开源框架,供研究社区在多种任务类型上训练和评估 AI Agent。它在降低复杂度的同时,仍能支持小模型实现强大性能…… Echoverse:面向计算机使用 Agent 的深度且持续演进的环境 — 计算机使用型 AI Agent 在邮…
Jay RSS 摘要 msr-blog 2026-08-09 10:02
Cool Papers · cs.CL (papers.cool) · RSS 摘要
通过选择性上下文偏好优化学习何时信任 — 语言模型越来越多地依据外部信号来调整其回答,而单一误导性信号就可能把正确答案变为错误。显而易见的解决方案是训练模型抵御误… 工具调用的苦涩教训 — 工具使用使 LLM 转变为能在训练数据之外行动的 Agent,对于具备代码能力的模型,程序化工具调用通过用灵活的代码取代僵化的 J…
Jay RSS 摘要 cool-papers 2026-08-09 10:01