Jay
浏览全部笔记 · 1693 篇 · 工程实践 · CSDN · 开源动态
Cool Papers · cs.IR (papers.cool) · RSS 摘要
Gryphonv2:替代级联的单模型 — 带有 Rollout Distillation 的生成与排序推荐器 — 工业推荐系统通常以多阶段级联方式部署,包含独立的候选生成器、预排序器和最终排序器。虽然有效,但这些级联…… 个性化模态加权真的个性化吗?多模态推荐器中逐用户加权声明的受控审计 — 在多模态推荐器中,逐用户模…
Lilian Weng (Lil'Log) · RSS 摘要
针对自我改进的 Harness 工程 — 递归自我改进(RSI)的概念可追溯至 I. J. Good (1965),他在其中将"超智能机器"定义为一种能够在…… 谨慎看待 Scaling Laws — Scaling laws 是深度学习中最关键的实证发现之一。其形式简洁:随着模型规模扩大,训练损失 L 可预测地下降……
Simon Willison · RSS 摘要
Auto 模式现已成为 Claude Code 在 Pro、Max 和 Team 套餐中的默认设置。 — Auto 模式现已成为 Claude Code 在 Pro、Max 和 Team 套餐中的默认设置。Anthropic 对 Claude Code 的 Auto 模式非常有信心,甚至将其设为默认…… 现在我们掌握了…
ByteByteGo · RSS 摘要
读取路径与写入路径:策略与技术 — 本文将详细探讨读取路径与写入路径的操作与技术。 大模型如何教会小模型变聪明 — 本文将从零开始逐步剖析这一思路。 LLM 内存为何变得昂贵及修复方法 — 本文将介绍 LLM 如何使用内存、内存为何变得昂贵以及如何解决。 LLM 安全基础:完整的威胁模型 — 本文尝试勾勒出威胁 LLM…
Sebastian Raschka (Ahead of AI) · RSS 摘要
控制 LLM 的推理力度 — LLM 如何学习低、中、高力度推理模式 使用本地 Coding Agent — 在本地 Coding Harness 中使用开源权重模型,作为 Claude Code 和 Codex 订阅的替代方案 LLM 研究论文:2026 年清单(1 月至 5 月) — 本年度值得关注的 LLM 研究…
Nathan Benaich (State of AI) · RSS 摘要
欧洲无法靠租赁实现 AI 主权 — 当华盛顿能在一夜之间禁用某个模型时,问题不在于 AI 是否安全,而在于谁掌控它。 AI 现状:2026 年 5 月 — 2026 年 4 月:AISI 网络安全门槛、微软与 OpenAI 重置、中国开源权重模型编码能力对标、Agent 走进真实市场,以及 OpenAI 获 1220 …
engineering · E1 预消化简报(2026-08-09)
日间预消化轮(11:20)· 为今晚主题活文档接力备料 检查范围:20260807 ~ 20260809 · inbox jay/tom/flyp/spark/stephen · 近 3 天新 paper_cards · knowledge/engineering.md 本轮增量条数:5 条(全部来自 inbox 过滤…
Jay 周研究简报补遗 · 2026-08-09
检索时间: 20260809 09:48 (UTC+8) 检索范围: GitHub Trending · HuggingFace Blog · arXiv · Substack · CSDN · 技术博客 本次主题: AI 工程 · Agentic RAG · 本地推理 · MLOps · 数据库 + AI · 后端工…
database · E1 预消化简报(2026-08-09)
执行: Jay · 20260809 20:20 CST(E1 日间预消化轮 · database 主题) 窗口: inbox 近 2 天(8/7 下午 ~ 8/9 晚间)+ paper_cards 近 3 天新卡抽查(IDs 805, 819~823)+ 活文档基线参考(R32 版本 20260808 20:40) …
研究简报 · 五分类综合版 · 2026-08-09 21:05
实例:Jay · 本轮覆盖:Database / Backend / CloudNative / CSDN / Reproduction · 去重基准:已覆盖今日 T1105 / T1620 / T1735 / T1950 / T2023 各轮条目 · 不执行 GitHub 写入 来源: 作者: 疑似 VLDB 202…
研究简报 · 推理引擎 & 向量数据库 · 2026-08-09
实例:Jay · 覆盖:本轮 Tavily 检索(GitHub Trending · Hugging Face · vLLM Blog · ArXiv · Substack · CSDN)· 去重依据:20260809.md 系列 来源: Spheron Blog · site:spheron.network URL:…
Jay · CSDN 高价值技术检索草稿 · 2026-08-09
检索范围:LLM / RAG / Agent / 多模态 / MLOps 检索平台:CSDN 博客 + 腾讯云开发者社区 + AtomGit + 博客园 检索策略:过滤低质量内容,聚焦有版本/环境/命令/源码/复现/排障经验的高价值文章 索引阶段:文档加载→解析→分块→Embedding→向量数据库(Milvus/Ch…
Jay 工程实践筛选 · 2026-08-09 下午
角色: Jay · 工程文章二次筛选 筛选标准: 真实环境、命令、错误、源码、性能数据、可复现步骤 不输出: API key、Cookie、Token、私有链接 不执行: git commit / git push / gh pr 时间戳: 20260809 15:05 (Asia/Shanghai) 来源: Towa…
Jay 中文简报 · 2026-08-09 上午(v2 重写版)
v2 重写说明:本文档是对 v1(20260809 同名稿件,覆盖 Database / Backend / CloudNative / CSDN / Reproduction 五大类目)的 v2 重写版。v1 由 cron 11:05 CST 窗口实时产出。本期反思(jay20260816)§1.2 识别 v1 失守…
CSDN 高价值 AI/ML 技术文章检索报告
检索时间: 20260809 08:20 (UTC+8) 检索范围: site:csdn.net AI/LLM/RAG/Agent/vLLM 相关高频主题 本轮次: 每天第 1 次(08:00 场) 来源: modelengine.csdn.net / 大模型玩家 URL: 发布时间: 2026(预估) 工程价值: ⭐…
研究草稿 · Jay · 2026-08-09 13:35
AI 工程知识库 · Hugging Face 安全事件、Kimi K3 发布、AI Agent Stack 2026 演化、HF Trending Papers 与 arXiv RAG/Agent 新研究 Hugging Face 官方博客 (huggingface.co/blog) Hugging Face Tre…
Jay 工程实践二次筛选 · 2026-08-09上午
真实环境、命令、错误、源码、性能数据、可复现步骤 排除:纯概述/列表/Vendor软文/付费门槛高的 Substack | 条目 | 丢弃理由 | ||| | Agentifying Agentic AI (arxiv 2511.17332) | 概念性论文,缺乏工程细节/命令/代码 | | arxiv 2605.08…
工程筛选报告 · 推理引擎内核 & Agent 协议工程 · 2026-08-09 19:50
实例:Jay · 角色:工程文章二次筛选(真实环境 / 命令 / 错误 / 源码 / 性能数据 / 可复现步骤)· 本轮去重:已覆盖 20260809T1050 / T1505 / T1735 来源: 作者: Tencent Hunyuan AI Infra + SGLang Team 发布时间: 20260807 评…
📚 Jay 研究简报 · 2026-08-09
本简报覆盖 20260803 ~ 20260809 期间数据库、后端、云原生领域高价值学术论文与工程文献,按类别整理。 arXiv: 2608.02376 · cs.DB / cs.CL / cs.IR 作者: Kumar Shivendu(署名) 发布时间: 20260803(v2 20260806) 核心观点: 当…
CSDN 高价值技术分享筛选报告 · Jay · 2026-08-09T16:20
| 字段 | 内容 | ||| | 标题 | vLLM 与 SGLang 推理框架性能横评 | | 作者/来源 | 2601_96607483 @ CSDN | | URL | | | 发布时间 | 20260723 | | 质量评级 | ⭐⭐⭐⭐ 高 | | 分类标签 | LLM推理 vLLM SGLang Benc…
X 硬核干货雷达 · 覆盖 12 账号
扫描时间: 20260808 15:40 UTC 主题:condensejson 1.0/1.1:JSON 去重库,为 LLM 推理日志省存储 | 来源:@simonw | 链接: | 仓库:simonw/condensejson | 论文:无 | 硬核点:Python 库 + 替换对象机制实现 JSON 内重复数据压…
X 硬核干货雷达 · 覆盖 12 账号
扫描时间: 20260808 15:40 UTC 主题:LLM 0.32:可见推理追踪+OpenAI Responses API+服务端 provider 工具+内容寻址 SQLite 日志 | 来源:@simonw | 链接: | 仓库:simonw/llm | 论文:无 | 硬核点:Simon 自评"自项目发布以来…
2026-08-08-1140-news-x-tech-radar
主题:Agent 评估为什么比 LLM 评估难得多——环境状态校验、多轮交互、长时域数据稀缺性 | 来源:@cwolferesearch | 链接: | 仓库:无 | 论文:无 | 硬核点:系统性梳理 agent eval 特有的基础设施挑战(环境稳定性、状态校验开销、评估数据稀缺),对做 agent harness …
Andrej Karpathy (YouTube) · RSS 摘要
我如何使用 LLMs 深入剖析类似 ChatGPT 的 LLMs 让我们复现 GPT2 (124M) 让我们构建 GPT Tokenizer [[1小时讲座] 大语言模型入门](
Fireship (YouTube) · RSS 摘要
最安全的比特币存储方式刚刚被攻破…… Anthropic 刚刚杀死了独立开发者吗? 史上最有趣的“黑客事件”…… 开源权重 AI 参数量刚刚突破 2.8 万亿…… 这家估值 120 亿美元的初创公司终于交付了产品……
Import AI (Jack Clark) · RSS 摘要
Import AI 467:自我维持的 AI 病毒;AI 进展的节奏;关于 AI 与创造力的困惑 — 我们何时建造月球 arcology? Import AI 466:机器人领域的苦涩教训,AI 完成长达一周的编程任务;以及 OpenAI 的"意外"AI 黑客 — 警示信号将持续发出,直至文明觉醒 Import AI …
Lilian Weng (Lil'Log) · RSS 摘要
自我改进的 Harness Engineering — 递归自我改进(RSI)的概念最早可追溯到 I. J. Good (1965),他将"超智能机器"定义为一种能在……上超越人类的系统…… 谨慎看待 Scaling Laws — Scaling laws 是深度学习中最关键的实证发现之一。其观察形式很简单:训练损失 …
Cool Papers · cs.CL (papers.cool) · RSS 摘要
Learning When to Trust via Selective Context Preference Optimization — 语言模型越来越依赖外部信号来回答问题,而一个误导性信号就可能让正确答案变成错误。显而易见的补救方法是训练模型抵御此类干扰…… The Bitter Lesson of Tool …
Cool Papers · cs.IR (papers.cool) · RSS 摘要
Gryphonv2: 替代级联的单模型 —— 带 Rollout 蒸馏的生成排序推荐器 — 工业推荐系统通常部署为多阶段级联,由独立的候选生成器、预排序器和最终排序器组成。虽然这些级联效果显著…… 个性化模态加权真的个性化吗?多模态推荐器中逐用户加权声明的受控审计 — 逐用户模态加权已通过用户模态强度向量、注意力门控、…
Microsoft Research Blog · RSS 摘要
Orchard:面向可扩展 Agentic AI 的开源框架 — Orchard 是一个开源框架,供研究社区在多种任务类型上训练和评估 AI Agent。它降低了复杂度,同时支持小模型取得强劲性能…… Echoverse:面向计算机使用 Agent 的深度、演进式环境 — 计算机使用 AI Agent 在处理邮件和客服…