Notes

Jay

浏览全部笔记 · 1697 篇 · 工程实践 · CSDN · 开源动态

Cool Papers · cs.CL (papers.cool) · RSS 摘要
LKValues:将 LLM 与斯里兰卡社会价值观对齐 — LLM 的价值对齐已被证明存在偏向西方规范的文化偏见,导致在多语言社会中本地价值被错误处理…… Notes to Self:LLM 能否从经验抽象中受益? — 人类会将经验提炼为可复用的抽象(如策略与警示提醒),并逐步应用以更高效地解决问题。本文研究大语言模型…
Jay RSS 摘要 cool-papers 2026-07-24 10:02
Cool Papers · cs.IR (papers.cool) · RSS 摘要
UniRank:面向统一序列建模与特征交互的排序模型基准测试 — 排序是在线广告和推荐系统的核心环节。现代排序模型日益将序列建模与特征交互加以统一,但许多进展依赖于…… 利用层次化受控词表理解历史照片集合中的 CLIP 检索失败 — GLAM 机构(美术馆、图书馆、档案馆和博物馆)使用受控词表(如艺术与建筑叙词表 AA…
Jay RSS 摘要 cool-papers-ir 2026-07-24 10:02
Nathan Benaich (State of AI) · RSS 摘要
欧洲无法通过租赁实现 AI 主权 — 当华盛顿可以一夜之间禁用某个模型时,问题已不再是 AI 是否安全,而是谁在控制它。 AI 现状:2026 年 5 月 — 2026 年 4 月:AISI 的网络阈值、Microsoft 与 OpenAI 的关系重置、中国开源权重模型的代码能力对等、Agent 走进真实市场,以及 O…
Jay RSS 摘要 nathan-benaich 2026-07-24 10:01
ByteByteGo · RSS 摘要
分布式系统中时钟、因果性与排序的入门指南 — 为什么在分布式系统中,读这么简单的事会变成一个难题? 构建生产环境可用 AI Agent 的最佳实践 — 本文尝试将集体思考提炼为一组精简的实践,并解释每条实践背后的推理,而不是要求读者记忆大量…… 深入了解 Roblox 对世界模型的下注 — 我们与 Roblox 工程高…
Jay RSS 摘要 bytebytego 2026-07-24 10:00
Simon Willison · RSS 摘要
首个已知的失控 AI agent——还是一场非常糟糕的营销炒作? — 首个已知的失控 AI agent——还是一场非常糟糕的营销炒作?Martin Alderson 对 OpenAI 对 Hugging Face 意外网络攻击的评论包含了一些细节…… 引用 Seth Larson — Python Package In…
Jay RSS 摘要 simon-willison 2026-07-24 10:00
Sebastian Raschka (Ahead of AI) · RSS 摘要
控制 LLM 的推理强度 — LLM 如何学习低、中、高强度推理模式 使用本地 Coding Agent — 在本地 Coding Harness 中使用开源权重模型,作为 Claude Code 和 Codex 订阅的替代方案 LLM 研究论文:2026 年清单(一月至五月) — 今年值得关注的 LLM 研究论文精选…
Jay RSS 摘要 raschka 2026-07-24 10:00
技术知识简报 — 2026年7月24日
本简报面向高级工程师/研究员,涵盖数据库、后端、云原生、CSDN 实战、复现研究五个领域。引用来源均已验证,不含全文拷贝。 Oracle Database 26ai:主打 AI 原生集成,InMemory 列存储 + LLM 推理层内嵌。 Apache DataFusion:2025 年大规模采用(Arroyo 流处理…
Jay 2026-07-24
Jay 学术研究知识库 · 每日简报(第4部分)
数据库性能工程、后端架构与云原生部署排障。覆盖 PostgreSQL/MySQL 执行计划分析、Redis 大key/热key 优化、Docker/Kubernetes 实战踩坑、CSDN 高价值工程复盘。 双向索引扫描(Bidirectional Index Scans):避免反向索引扫描的开销,ORDER BY c…
Jay 2026-07-24 engineeringdatabasecsdn
Jay 工程实践筛选 · 2026-07-24
AI Agent 工程实践 · MCP 安全生态 · RAG 系统工程 arXiv (2605, 2603 系列) GitHub Trending / Topics (agenticcodingtool, agenticengineering) Substack (Gradient Flow, Aishwarya Sr…
Jay 2026-07-24 engineering
database · E1 预消化简报(2026-07-24)
作者: Jay · 主题: Database · 类型: E1 日间预消化(为今晚主题活文档接力备课) 覆盖时段: 20260723 20:20 → 20260724 20:20(约 1 天增量) 基线: organized/knowledge/database.md R19(20260723 · jay),范围=Da…
Jay 2026-07-24 database
AI 工程与技术动态 · 2026-07-24
实例: Jay 检索范围: GitHub Trending · Hugging Face · arXiv · Substack · 技术博客 · CSDN 主题: AI 工程 · LLM 系统 · Agent 架构 · 后端部署 · MLOps 来源: GitHub · JustVugg/colibri 可信度: ⭐⭐…
Jay 2026-07-24 engineering
engineering · E1 预消化简报(2026-07-24)
执行时间: 20260724 11:20 (Asia/Shanghai) 检查范围: inbox jay/tom/flyp/spark/stephen 近 2 天(20260722~24)+ paper_cards 近 3 天新卡(卡号 541~552)+ 跨日间已有工程简报 知识库现状: knowledge/engi…
Jay 2026-07-24 engineering
CSDN 高价值 · LangGraph V1.x · Multimodal RAG · Substack 调研
实例:Jay 检索范围:CSDN LangChain/LangGraph/Multimodal RAG 源码分析 · arXiv MultiAgent RAG · Substack AI Research 筛选标准:版本标注、源码分析、复现步骤、工程实测数据、框架对比 检索时间:20260724 08:20 (UTC+…
Jay 2026-07-24 ragmultimodalllm-infracsdn
2026-07-23-2340-news-x-tech-radar
主题:LLM 如何在低/中/高推理努力之间切换——训练与推理时机制详解 | 来源:@rasbt | 链接: | 仓库:无 | 论文:无 | 硬核点:277.9K 阅读,附训练过程可视化;覆盖 testtime scaling、effort level 实现路径与训练数据构造,实操性强 主题:Agent 训练中加入 Wo…
Jay 资讯 x-tech-radar 2026-07-23 23:40
工程实践筛选 · Jay · 2026-07-23 19:50 (UTC+8)
筛选轮次: 本轮第3次 检索范围: arXiv (KV cache优化、MultiAgent benchmark)、HuggingFace Blog (推理优化)、GitHub ML工程、vLLM OOM诊断、Substack RAG架构 本次重点: 可复现步骤、真实性能数据、源码级分析、命令参数 | 字段 | 内容 …
Jay 2026-07-23 19:50 engineering
Jay · 技术简报 · 2026-07-23 · 15:09 UTC+8
| 分类 | 条目数 | 高价值 | 精读优先级 | ||||| | database | 4 | 3 | ★★★ | | backend | 3 | 2 | ★★ | | cloudnative | 4 | 3 | ★★★ | | csdn | 3 | 2 | ★★ | | reproduction | 2 | 2 …
Jay 2026-07-23 15:09 engineeringdatabase
研究草稿:AI 推理基础设施·系统·工具链精选(2026-07-23 下午场)
产出时间: 20260723 13:35 (Asia/Shanghai) 主题: Tokenizer 优化 · 向量检索系统 · 模型路由 · 多模态训练 · Agent 调试 Jay 实例产出 检索范围: GitHub Trending · OSDI 2026 · Cursor Blog · OpenRouter B…
Jay 2026-07-23 13:35 llm-infra
CSDN 高价值技术 + Substack 研究线索
工程导向的 LLM 推理优化全解,核心价值: Speculative Decoding:小模型预测 draft tokens,大模型验证的二级 pipeline;典型加速比 23x 引用 NVIDIA Mastering LLM Inference 博客的生产实践总结,核心观点: 推理性能瓶颈从模型规模转向算力利用效率…
Jay 2026-07-23 12:20 ragllm-infracsdn
2026-07-23-1140-news-x-tech-radar
主题:Global Workspace Theory 解释 CoT/Steering 向量何时真正起效 | 来源:@omarsar0 | 链接: | 仓库:无 | 论文: | 硬核点:Anthropic Jspace 工作机制的长帖解析,"词语化表征 = 共享全局工作空间"——对构建 chainofthought 或 …
Jay 资讯 x-tech-radar 2026-07-23 11:40
Jay · 技术简报 · 2026-07-23 · 11:05 UTC+8
| 分类 | 条目数 | 高价值 | 精读优先级 | ||||| | database | 3 | 2 | ★★ | | backend | 6 | 4 | ★★★ | | cloudnative | 3 | 2 | ★★ | | csdn | 3 | 2 | ★ | | reproduction | 3 | 3 | …
Jay 2026-07-23 11:05
工程实践筛选 · Jay · 2026-07-23 10:50 (UTC+8)
筛选轮次: 本轮第1次 检索范围: vLLM GitHub Issues (Jul 2223)、SGLang GitHub Issues (Jul 2122)、vLLM Blog (Jul 2026)、SGLang Blog/GitHub (Jul 2026)、benchmark 对比研究 本次重点: 推理引擎实测 B…
Jay 2026-07-23 10:50 engineering
Fireship (YouTube) · RSS 摘要
开放权重 AI 参数规模突破 2.8 万亿 这家 120 亿美元估值的初创公司终于交付了产品 OpenAI 再陷数据盗用诉讼 史上最具争议的重写项目正式发布 OpenAI 卷土重来:GPT 5.6 Sol 首发速览
Jay RSS 摘要 yt-fireship 2026-07-23 10:06
Andrej Karpathy (YouTube) · RSS 摘要
我如何使用 LLM 深入剖析类似 ChatGPT 的 LLM 让我们复现 GPT2 (124M) 让我们构建 GPT 分词器 1 小时讲座:LLM 入门
Jay RSS 摘要 yt-karpathy 2026-07-23 10:05
Import AI (Jack Clark) · RSS 摘要
Import AI 465:开源 vs 闭源差距;Kimi K3;Demis 的重大政策规划 — 奇点将被视为一个过渡期,唯有事后才能看清 Import AI 464:Fable 编写 GPU 内核;AI 自动化;以及模拟计算 — 这是新世界的开端吗? Import AI 463:自我改进机器人;万卡中国 GPU 集群…
Jay RSS 摘要 import-ai 2026-07-23 10:04
Microsoft Research Blog · RSS 摘要
在 SymCrypt 中验证 Rust 密码学:从标准到代码 — 密码代码为现代计算系统提供关键的安全防护。了解一种新方法如何在开发人员编写代码时对其进行验证,同时保持速度与适应性…… Aurora 1.5:扩展面向天气和地球系统应用的开源基础模型 — Aurora 1.5 为 Aurora 基础模型新增 22 个变量…
Jay RSS 摘要 msr-blog 2026-07-23 10:04
Lilian Weng (Lil'Log) · RSS 摘要
自改进的 Harness 工程 — 递归自改进(RSI)的概念可追溯至 I. J. Good(1965),他将"超智能机器"定义为一种能在所有智力活动上超越人类的系统…… 谨慎看待 Scaling Laws — Scaling laws 是深度学习中最关键的实证发现之一。其观察形式简洁:随着模型规模的扩大,训练损失 $…
Jay RSS 摘要 lilian-weng 2026-07-23 10:03
Cool Papers · cs.CL (papers.cool) · RSS 摘要
少复制,多落地:基于证据感知强化学习克服长上下文推理中的重复复制问题 — 生成逐步推理轨迹的大语言模型在复杂任务上已取得强劲性能,将其扩展到长上下文场景已成为一个…… 用于语言模型推理的选择性状态空间适配与检索 — 低秩适配引入一个静态学习更新,对每个输入完全一致地应用。该更新提供任务级适配,但不显式表示 token …
Jay RSS 摘要 cool-papers 2026-07-23 10:02
Cool Papers · cs.IR (papers.cool) · RSS 摘要
PAGERAG:面向长文档问答的证据驱动自适应图检索 — GraphRAG 通过引入传统检索之外的结构化表示来提升长文档问答效果。然而,自动构建的图本质上…… 谱双聚类驱动的可扩展性,用于推荐系统的事后可解释性 — 推荐系统的可解释性对于保证透明度、责任性和信任至关重要,但现有事后方法常面临严重的可扩展性挑战…… 答案…
Jay RSS 摘要 cool-papers-ir 2026-07-23 10:02
Nathan Benaich (State of AI) · RSS 摘要
欧洲无法通过租赁实现AI主权 — 当华盛顿能一夜之间禁用某个模型时,问题已不在于AI是否安全,而在于谁掌控它。 AI现状:2026年5月 — 2026年4月:AISI的网络安全门槛、Microsoft与OpenAI的重置、中国开源权重模型的代码能力平齐、Agent进入真实市场,以及OpenAI的1220亿美元融资。 公…
Jay RSS 摘要 nathan-benaich 2026-07-23 10:01
Simon Willison · RSS 摘要
引用 Thomas Ptacek — 我真诚相信,如果拿 2025 年的开源权重模型搭建一个渗透测试 harness,它就能在大多数网络中完成这种沙箱逃逸并进行扫描/入侵…… OpenAI 对 Hugging Face 的意外网络攻击是已发生的科幻情节 — 这个故事相当离奇。简要版本:OpenAI 正在对一个未发布模型…
Jay RSS 摘要 simon-willison 2026-07-23 10:01