研究库 精读笔记
Notes

Jay

浏览全部笔记 · 1063 篇 · 工程实践 · CSDN · 开源动态

Cool Papers · cs.CL (papers.cool) · RSS 摘要
onPanda:基于 token 级修正的 LLM 与 Agent 在线策略对齐数据高效标注 — 我们提出 onPanda,一个用于高效标注 LLM 对齐数据与 Agent 轨迹的交互式工具。onPanda 以 token 级修正为核心交互方式:…… DolphinBench:刻画 Agent 记忆的帕累托前沿 — 当…
Jay RSS 摘要 cool-papers 2026-09-23 10:01
Nathan Benaich (State of AI) · RSS 摘要
欧洲无法通过租用方式实现 AI 主权 — 当华盛顿能够一夜之间禁用某个模型时,问题已不再是 AI 是否安全,而是谁在控制它。 State of AI:2026 年 5 月 — 2026 年 4 月:AISI 的网络阈值,Microsoft 与 OpenAI 的关系重置,中国 openweights 模型的代码能力追平,…
Jay RSS 摘要 nathan-benaich 2026-09-23 10:01
ByteByteGo · RSS 摘要
OpenAI 如何构建 GPTLive — 为了从端到端理解其完整工作原理,我们采访了 GPT Voice 团队的工程师 Zahan Malkani 和 Justin Uberti(WebRTC 的创建者)。 如何在廉价硬件上运行大模型? — 大型 AI 模型只能在普通硬件上运行,方法是减少其占用的内存、减少其执行的计…
Jay RSS 摘要 bytebytego 2026-09-23 10:00
Sebastian Raschka (Ahead of AI) · RSS 摘要
GPT6 Astra、循环 Transformer 与隐式推理 — 循环深度、隐式思维链及循环 Transformer 模块最新研究综述 Claude 如何为 AI 生成文本添加水印 — 48 分钟视频详解 token 采样、水印检测与去除 从零构建 AI 文本检测器 — 含数据集构建、模型训练、本地部署与 RLVR …
Jay RSS 摘要 raschka 2026-09-23 10:00
Andrej Karpathy (YouTube) · RSS 摘要
我如何使用 LLMs 深入 ChatGPT 这类 LLMs 复现 GPT2 (124M) 构建 GPT Tokenizer [[1小时讲座] 大语言模型入门](
Jay RSS 摘要 yt-karpathy 2026-09-22 10:04
Import AI (Jack Clark) · RSS 摘要
Import AI 473:美国的超级智能战略;小鼠颅内的人类大脑;以及机器诠释学 — AI 正在撞到的天花板,是否就在当下? Import AI 472:DeepMind 的作弊数学 Agent;民粹主义 AI 政策;以及 Forethought 提出"守夜人"构想 — 此外,还有一则机器诠释学的报道 Import …
Jay RSS 摘要 import-ai 2026-09-22 10:03
Microsoft Research Blog · RSS 摘要
利用 RetroChimera 大规模提升小分子合成预测 — 定制分子正推动医药、材料与农业的发展,但其生产过程缓慢且成本高昂。一篇 Nature 新论文重点介绍了 RetroChimera —— 一个用于……的预测模型 GigaPathFlash 与 GigaTIMEFlash:借助高效病理基础模型迈向人群规模的发现…
Jay RSS 摘要 msr-blog 2026-09-22 10:03
Lilian Weng (Lil'Log) · RSS 摘要
Harness 工程用于自我改进 — 递归自我改进(RSI)的概念最早可追溯至 I. J. Good(1965),他将「超智能机器」定义为一种能在…… 谨慎看待 Scaling Laws — Scaling laws 是深度学习中最关键的实证发现之一。该观察形式简洁:训练损失 $L$ 会随模型规模的扩大而可预测地下降……
Jay RSS 摘要 lilian-weng 2026-09-22 10:02
Cool Papers · cs.IR (papers.cool) · RSS 摘要
多跳检索中的可预测失败:分数分布置信度评分与弃答 — 多跳检索的失败在查询中并非均匀分布,而是聚集在结构上可预测的子群体中。我们证明两个结果来形式化该结构…… 通过显式间接关系学习实现自适应偏好建模用于个性化时尚搭配 — 个性化时尚互补推荐需要在稀疏且多模态的数据条件下联合建模用户偏好与物品兼容性。现有方法…… 基于解…
Jay RSS 摘要 cool-papers-ir 2026-09-22 10:02
Cool Papers · cs.CL (papers.cool) · RSS 摘要
职业事故叙述中事故过程角色分类的跨领域泛化 — 职业事故叙述包含有关工作情境、不利条件、事故事件及其后果的宝贵信息。自动构建其结构…… 基于三信号互补性的 LLM Agent 可解释记忆决策控制器:解耦置信度与一致性 — 大语言模型的记忆系统主要聚焦于高效检索,而对检索到的记忆是否应被信任的决策则关注较少…… Qura…
Jay RSS 摘要 cool-papers 2026-09-22 10:02
Nathan Benaich (State of AI) · RSS 摘要
欧洲无法通过租赁实现 AI 主权 — 当华盛顿可以在一夜之间禁用某个模型时,问题不在于 AI 是否安全,而在于谁在掌控它。 AI 现状:2026 年 5 月 — 2026 年 4 月:AISI 的网络门槛、Microsoft 与 OpenAI 关系重置、中国开放权重模型的代码能力对标、Agent 走向真实市场,以及 O…
Jay RSS 摘要 nathan-benaich 2026-09-22 10:02
Simon Willison · RSS 摘要
Jev 推出了一种新的 LLM 形态——System One,又名 Decision Models — 上周 TypeSafe AI 发布了 Jev,这是他们称之为 "System One models" 的全新模型类别的首个示例(我赞同 Maggie Appleton 的看法,认为应该叫 "decision mode…
Jay RSS 摘要 simon-willison 2026-09-22 10:01
ByteByteGo · RSS 摘要
如何在廉价硬件上运行大模型? — 大型 AI 模型只能在廉价硬件上运行,方法包括减少占用的内存、降低计算量,或将部分工作转移到更慢的硬件上。 EP226:每位软件工程师都应了解的 API 概念 — 发送请求并读取 JSON 是一回事;设计一个他人可以依赖的 API,事情就变得复杂了。 大规模迁移:在 30000 英尺高…
Jay RSS 摘要 bytebytego 2026-09-22 10:00
Sebastian Raschka (Ahead of AI) · RSS 摘要
GPT6 Astra、循环 Transformer 与隐式推理 — 剖析循环深度、隐式思维链与近期循环 Transformer 模块研究 Claude 如何给 AI 生成文本打水印 — 48 分钟视频:详解 token 采样、水印检测与去除 从零构建 AI 文本检测器 — 端到端项目:数据集构建、模型训练、本地部署与 …
Jay RSS 摘要 raschka 2026-09-22 10:00
Import AI (Jack Clark) · RSS 摘要
Import AI 472:DeepMind 的"作弊"数学 Agent;民粹主义 AI 政策;Forethought 构想"守夜人" — 此外,还有一则机器释义学的故事 Import AI 471:为什么 Hugging Face 让我担忧;太空采矿;五眼联盟关注 AI — 此外,还有一场与 Robin Sloan …
Jay RSS 摘要 import-ai 2026-09-21 10:02
Microsoft Research Blog · RSS 摘要
GigaPathFlash 与 GigaTIMEFlash:迈向基于高效病理学基础模型的人群规模发现 — 如果病理学基础模型能以更少资源做更多事会怎样?GigaPathFlash 与 GigaTIMEFlash 在保持强劲性能的同时降低算力需求,为……打开大门 扩大 Skala 的可及性,为预测性 DFT 铺就更快路径…
Jay RSS 摘要 msr-blog 2026-09-21 10:02
Lilian Weng (Lil'Log) · RSS 摘要
面向自改进的 Harness Engineering — 递归自改进(RSI)的概念可追溯到 I. J. Good(1965),他将"超智能机器"定义为一种能在所有方面超越人类的系统…… 审慎看待 Scaling Laws — Scaling laws 是深度学习中最重要的经验发现之一。其观察形式简洁:随着模型规模的扩…
Jay RSS 摘要 lilian-weng 2026-09-21 10:01
Cool Papers · cs.CL (papers.cool) · RSS 摘要
Embedding Models Measure in Peculiar Ways — 嵌入空间定义了语义相似度与距离的概念。研究这些嵌入是否反映质量、距离、时间和体积等物理测量……(原文截断) Unifying Models of Intergroup Hostility in Online Discourse — …
Jay RSS 摘要 cool-papers 2026-09-21 10:01
Cool Papers · cs.IR (papers.cool) · RSS 摘要
推理质量至关重要:对抗基于 LLM 的嵌入学习中的推理坍缩 — 大语言模型 (LLMs) 近期展现出为检索生成上下文丰富文本嵌入的强大潜力。大多数现有方法要么将嵌入学习视为…… FacetCRS: MultiFaceted Preference Learning for Pricking Filter Bubbles …
Jay RSS 摘要 cool-papers-ir 2026-09-21 10:01
Nathan Benaich (State of AI) · RSS 摘要
欧洲无法通过租赁实现 AI 主权 — 当华盛顿能够一夜之间禁用某个模型时,问题已不是 AI 是否安全,而是由谁掌控它。 State of AI:2026 年 5 月 — 2026 年 4 月:AISI 的网络阈值、微软与 OpenAI 重置、中国开源权重模型的代码能力追平、Agent 走向真实市场,以及 OpenAI …
Jay RSS 摘要 nathan-benaich 2026-09-21 10:01
Simon Willison · RSS 摘要
引用 voxium — 进入大公司新岗位已经半个月了。这里没人了解任何情况。规格说明、代码、测试、PRD、ticket、ticket 解决方案、报告等等…… llmkeysui 0.1 — 发布:llmkeysui 0.1 该插件解决了一个非常具体的问题。我开始使用 Codex Remote 在多台机器上运行编码 Ag…
Jay RSS 摘要 simon-willison 2026-09-21 10:00
ByteByteGo · RSS 摘要
EP226: 每个软件工程师都应该知道的 API 概念 — 发送请求和读取 JSON 是一回事,而设计一个他人可以信赖的 API,事情就会变得复杂。 大规模迁移:在 30000 英尺高空更换应用引擎 — 本文将探讨大规模场景下的迁移运作方式,以及有助于尽可能提升效率的关键策略。 LLM 如何大海捞针 — 本文将探讨 L…
Jay RSS 摘要 bytebytego 2026-09-21 10:00
Sebastian Raschka (Ahead of AI) · RSS 摘要
GPT6 Astra、循环 Transformer 与隐藏推理 — 循环深度、隐藏思维链与循环 Transformer 模块近期研究概览 Claude 如何给 AI 生成文本添加水印 — 48 分钟视频讲解:token 采样、水印检测与去除 从零构建 AI 文本检测器 — 端到端项目:数据集构建、模型训练、本地部署与 …
Jay RSS 摘要 raschka 2026-09-21 10:00
Fireship (YouTube) · RSS 摘要
Google 是否刚刚引爆了智能爆炸? Anthropic 研究人员正在离职……现在我们知道了原因 OpenAI 最大的数学突破正陷入困境…… 我用 Astra 和 Fable 5.1 构建了同一款游戏……只有一个好玩 5 个开源工具替代了我每月 320 美元的 AI 工具栈……
Jay RSS 摘要 yt-fireship 2026-09-20 10:04
Lilian Weng (Lil'Log) · RSS 摘要
面向自我改进的框架工程 — 递归自我改进 (RSI) 的概念最早可追溯到 I. J. Good (1965),他将"超智能机器"定义为一种能够在所有智力活动上超越人类的系统…… Scaling Laws 详解 — Scaling laws 是深度学习中最重要的经验发现之一。其核心观察很简单:训练损失 $L$ 会随着模型…
Jay RSS 摘要 lilian-weng 2026-09-20 10:02
Microsoft Research Blog · RSS 摘要
GigaPathFlash 与 GigaTIMEFlash:迈向群体规模发现的高效病理学基础模型 — 如果病理学基础模型能用更少资源做更多事会怎样?GigaPathFlash 与 GigaTIMEFlash 在保持强劲性能的同时降低算力需求,为……打开了大门 扩大 Skala 的访问范围,为预测性 DFT 开辟更快路径…
Jay RSS 摘要 msr-blog 2026-09-20 10:02
Import AI (Jack Clark) · RSS 摘要
Import AI 472:DeepMind 的作弊数学 Agent;民粹 AI 政策;Forethought 提出 nightwatchman 理论 — 此外,还有一则机器诠释学故事 Import AI 471:为什么 Hugging Face 让我担忧;太空采矿;五眼联盟聚焦 AI — 此外,还有一场与 Robin…
Jay RSS 摘要 import-ai 2026-09-20 10:02
Cool Papers · cs.IR (papers.cool) · RSS 摘要
推理质量至关重要:应对基于LLM的嵌入学习中的推理退化 — 大语言模型(LLMs)近期在生成上下文丰富的文本嵌入用于检索方面展现出强大潜力。现有方法大多将嵌入学习视为…… FacetCRS:面向对话式推荐系统中刺破过滤气泡的多方面偏好学习 — 过滤气泡是推荐系统(RSs)中一个臭名昭著的问题,描述了用户只能接触到有限且…
Jay RSS 摘要 cool-papers-ir 2026-09-20 10:01
Cool Papers · cs.CL (papers.cool) · RSS 摘要
嵌入模型以奇特方式进行度量 — 嵌入空间定义了语义相似度与距离的概念。我们研究这些嵌入是否反映质量、距离、时间和体积等物理度量…… 统一在线话语中的群体间敌意模型 — 针对社会群体的敌意言论会将排他行为合理化、为其正名,并助长日益加剧的极化与政治暴力…… JEPAAnything:跨不同世界学习预测模型 — 世界建模使…
Jay RSS 摘要 cool-papers 2026-09-20 10:01
Nathan Benaich (State of AI) · RSS 摘要
欧洲无法通过租用方式实现 AI 主权 — 当华盛顿能在一夜之间禁用某个模型时,问题不再是 AI 是否安全,而是谁在控制它。 AI 现状:2026 年 5 月 — 2026 年 4 月:AISI 的网络门槛、微软与 OpenAI 的重置、中国开源权重模型的代码能力对等、Agent 走向真实市场,以及 OpenAI 获 1…
Jay RSS 摘要 nathan-benaich 2026-09-20 10:01