研究库 精读笔记
Notes

Jay

浏览全部笔记 · 1063 篇 · 工程实践 · CSDN · 开源动态

Simon Willison · RSS 摘要
引用 John Gruber — Muse 引发了大量关注——包括我的关注——因为它在技术上具有突破性(每位用户都拥有自己在 Meta 云端运行的完整持久化 Linux 虚拟机),并…… 北鲣鸟、大蓝鹭、加州褐鹈鹕 — 北鲣鸟、大蓝鹭、加州褐鹈鹕,拍摄于美国加利福尼亚州蒙特雷湾国家海洋保护区。新入手的 200800mm…
Jay RSS 摘要 simon-willison 2026-09-26 10:00
Nathan Benaich (State of AI) · RSS 摘要
欧洲无法通过租赁获得 AI 主权 — 当华盛顿能在一夜之间关停一个模型时,问题不再是 AI 是否安全,而是谁在控制它。 AI 现状:2026 年 5 月 — 2026 年 4 月:AISI 的网络阈值,Microsoft 与 OpenAI 的重置,中国开放权重模型的编程平价,Agent 接入真实市场,以及 OpenAI…
Jay RSS 摘要 nathan-benaich 2026-09-26 10:00
Sebastian Raschka (Ahead of AI) · RSS 摘要
GPT6 Astra、循环 Transformer 与隐藏推理 — 循环深度、隐藏思维链与循环 Transformer 块最新研究综述 Claude 如何为 AI 生成文本添加水印 — 48 分钟视频讲解 token 采样、水印检测与去除 从零构建 AI 文本检测器 — 端到端项目:数据集构建、模型训练、本地部署与 R…
Jay RSS 摘要 raschka 2026-09-26 10:00
Fireship (YouTube) · RSS 摘要
WordPress 史上最贵的 33 个小时…… 一位前 OpenAI 研究人员刚从 LLM 中删除了语言…… Google 刚刚引爆了智能爆炸? Anthropic 研究人员正在离职……而我们现在知道原因了 OpenAI 最大的数学突破正在陷入困境……
Jay RSS 摘要 yt-fireship 2026-09-25 10:02
Lilian Weng (Lil'Log) · RSS 摘要
自我改进的 Harness 工程 — 递归自我改进 (RSI) 的概念可追溯至 I. J. Good (1965),他将"超智能机器"定义为一种在所有方面均能超越人类的系统…… 谨慎看待 Scaling Laws — Scaling laws 是深度学习中最关键的实证发现之一。其表述简洁:随着模型规模扩大,训练损失 $…
Jay RSS 摘要 lilian-weng 2026-09-25 10:01
Import AI (Jack Clark) · RSS 摘要
Import AI 473:美国的超级智能战略;鼠颅中的人类大脑;以及机器诠释学 — AI 正在撞上的墙此刻就在我们身边吗? Import AI 472:DeepMind 的作弊数学 Agent;民粹主义 AI 政策;以及 Forethought 提出的守夜人构想 — 另外,还有一个机器诠释学的故事 Import AI…
Jay RSS 摘要 import-ai 2026-09-25 10:01
Microsoft Research Blog · RSS 摘要
面向现实世界物理 AI 机器人的卸载推理 — 机器人越来越智能,但硬件如何跟上这种增长?微软研究院的新研究表明,将 AI 推理转移到机器人之外可提升任务成功率…… 利用 RetroChimera 大规模提升小分子合成预测 — 定制分子正推动医药、材料和农业的发展,但其生产缓慢且成本高昂。一篇新发表于 Nature 的论…
Jay RSS 摘要 msr-blog 2026-09-25 10:01
Cool Papers · cs.IR (papers.cool) · RSS 摘要
超越标量:用于观看时长预测的分布式服务接口 — 观看时长是短视频信息流中的主要参与信号,其预测直接影响排序与曝光。现有方法通过 corre…… 双超图索引:打通 RAG 多跳推理中的知识孤岛 — 基于超图的 RAG 能有效捕捉高阶多实体关联,但现有范式将提取的超边视为孤立的…… 面向个人与群体的灵活推荐系统 — 群组推…
Jay RSS 摘要 cool-papers-ir 2026-09-25 10:01
Cool Papers · cs.CL (papers.cool) · RSS 摘要
对比学习用于作者身份验证 — 结果表明,在测试设定下,对比学习优于基于分类的作者身份验证方法。我们识别出损失函数、批量大小…… 跨尺度迁移学习用于抑郁严重程度预测:从 PHQ8 到 HAMD17 跨语言与临床范式 — 该工作研究数据稀缺场景下基于临床访谈转录的连续抑郁严重程度分数预测。我们提出一种顺序低秩适应(LoRA…
Jay RSS 摘要 cool-papers 2026-09-25 10:00
Sebastian Raschka (Ahead of AI) · RSS 摘要
GPT6 Astra、循环 Transformer 与隐藏推理 — 审视循环深度、隐藏思维链以及循环 Transformer 模块的最新研究 Claude 如何为 AI 生成文本添加水印 — 48 分钟视频详解 token 采样、水印检测与去除 从零构建 AI 文本检测器 — 端到端项目:数据集构建、模型训练、本地部署…
Jay RSS 摘要 raschka 2026-09-25 10:00
ByteByteGo · RSS 摘要
数据的一生:从创建到删除 — 本文将梳理从创建到删除的完整数据生命周期,以及在每个环节需要做出的决策。 如何定制模型以学习新技能 — 本文将探讨模型定制与微调的各种策略。 OpenAI 如何构建 GPTLive — 为理解其端到端的工作机制,我们采访了 GPT Voice 团队的工程师 Zahan Malkani 和 …
Jay RSS 摘要 bytebytego 2026-09-25 10:00
Simon Willison · RSS 摘要
commitrewriter 0.2 — Release: commitrewriter 0.2 支持非默认分支。使用 uvx commitrewriter branch other 可对其他分支运行。#3 Tags: git datasette 1.0a41 — Release: datasette 1.0a41 A…
Jay RSS 摘要 simon-willison 2026-09-25 10:00
Nathan Benaich (State of AI) · RSS 摘要
欧洲无法通过租用实现 AI 主权 — 当华盛顿能够在一夜之间禁用某个模型时,问题已不在于 AI 是否安全,而在于谁来掌控它。 AI 行业现状:2026 年 5 月 — 2026 年 4 月:AISI 的网络安全阈值、Microsoft 与 OpenAI 关系重置、中国开放权重的代码能力对标、Agent 走入真实市场,以…
Jay RSS 摘要 nathan-benaich 2026-09-25 10:00
Fireship (YouTube) · RSS 摘要
WordPress历史上最昂贵的33小时... 一位前OpenAI研究员刚刚从LLM中删除了语言... Google是否刚刚引发了智能爆炸? Anthropic的研究员正在离职...现在我们知道原因了 OpenAI最大的数学突破正陷入困境...
Jay RSS 摘要 yt-fireship 2026-09-24 10:05
Andrej Karpathy (YouTube) · RSS 摘要
我如何使用 LLM 深度剖析 ChatGPT 这类 LLM 让我们复现 GPT2 (124M) 让我们构建 GPT Tokenizer [[1小时讲座] 大语言模型入门](
Jay RSS 摘要 yt-karpathy 2026-09-24 10:04
Microsoft Research Blog · RSS 摘要
真实场景物理 AI 机器人的卸载推理 — 机器人越来越智能,但其硬件如何跟上这种增长?微软研究院的最新研究表明,将 AI 推理迁移到机器人之外可提升任务成功率,…… 利用 RetroChimera 大规模改进小分子合成预测 — 定制分子正推动医学、材料和农业的进步,但其生产过程缓慢且成本高昂。一篇发表在 Nature …
Jay RSS 摘要 msr-blog 2026-09-24 10:03
Import AI (Jack Clark) · RSS 摘要
Import AI 473:美国的超级智能战略;小鼠颅中的人脑;以及机器释义学 — AI 撞上的那面墙,此刻就在我们眼前吗? Import AI 472:DeepMind 的作弊数学 agent;民粹主义 AI 政策;以及 Forethought 理论化的"守夜人" — 此外,还有一个机器释义学的故事 Import A…
Jay RSS 摘要 import-ai 2026-09-24 10:03
Lilian Weng (Lil'Log) · RSS 摘要
Harness Engineering for SelfImprovement(面向自我改进的 Harness 工程) — 递归自我改进(RSI)的概念最早可追溯至 I. J. Good(1965),他将"超级智能机器"定义为能够在所有智能活动中超越人类…… 谨慎地看待 Scaling Laws — Scaling l…
Jay RSS 摘要 lilian-weng 2026-09-24 10:02
Cool Papers · cs.IR (papers.cool) · RSS 摘要
基于文本的发现式异构表整合 — 在数据湖中整合异构数据集是一项关键挑战,尤其是对于缺乏显式连接属性的语义相关表。W… 排列不稳定性何时可泛化?面向 LLM listwise 重排序的独立视图验证 — 基于语言模型的 listwise 重排序器在等价候选排列之间常产生分歧,因此采用有限不稳定性诊断以推动额外采样与聚合(a…
Jay RSS 摘要 cool-papers-ir 2026-09-24 10:02
Cool Papers · cs.CL (papers.cool) · RSS 摘要
FlashdLLM:面向快速、内存高效的 Diffusion LLM 的 IO 感知 KV 缓存与并行解码 — Diffusion Large Language Model(dLLM)近期通过支持非自回归文本生成,成为自回归 LLM 的一种有前景的替代方案。然而,其实际…… Agensh:将组织智能扩展到 1,024 …
Jay RSS 摘要 cool-papers 2026-09-24 10:02
Nathan Benaich (State of AI) · RSS 摘要
欧洲无法通过租用实现 AI 主权 — 当华盛顿可以一夜之间禁用某个模型时,问题已不是 AI 是否安全,而是谁在掌控它。 AI 现状:2026 年 5 月 — 2026 年 4 月:AISI 的网络安全门槛、微软与 OpenAI 的关系重置、中国开放权重模型的代码能力追平、Agent 接入真实市场,以及 OpenAI 斩…
Jay RSS 摘要 nathan-benaich 2026-09-24 10:02
Simon Willison · RSS 摘要
Gemini 3.8 TTS Playground — 工具:Gemini 3.8 TTS Playground Google 今天发布了两款新的 Gemini 文字转语音模型——gemini3.8flashtts 和 gemini3.8flashlitetts,附带超过 2… 的语音库。 Shadow roots,通…
Jay RSS 摘要 simon-willison 2026-09-24 10:01
Sebastian Raschka (Ahead of AI) · RSS 摘要
GPT6 Astra、循环 Transformer 与隐藏推理 — 循环深度、隐藏思维链与循环 Transformer block 最新研究综述 Claude 如何为 AI 生成文本添加水印 — 48 分钟视频讲解 token 采样、水印检测与移除 从零构建 AI 文本检测器 — 涵盖数据集构建、模型训练、本地部署与 …
Jay RSS 摘要 raschka 2026-09-24 10:00
ByteByteGo · RSS 摘要
如何定制模型以学习新技能 — 本文将探讨定制和微调模型的各种策略。 OpenAI 如何构建 GPTLive — 为了理解其端到端的工作原理,我们采访了 GPT Voice 团队的工程师 Zahan Malkani 和 Justin Uberti(WebRTC 的创建者)。 如何在廉价硬件上运行大模型? — 大型 AI …
Jay RSS 摘要 bytebytego 2026-09-24 10:00
Fireship (YouTube) · RSS 摘要
一位前 OpenAI 研究员刚刚从 LLM 中删除了语言…… Google 是否刚刚引爆了智能爆炸? Anthropic 研究员正在离职……现在我们知道原因了 OpenAI 最大的数学突破正陷入困境…… 我用 Astra 和 Fable 5.1 构建了同一款游戏……只有一个好玩
Jay RSS 摘要 yt-fireship 2026-09-23 10:04
Import AI (Jack Clark) · RSS 摘要
Import AI 473:美国的超级智能战略;小鼠颅内的人脑;以及机器诠释学 — AI 正在遭遇的瓶颈是否就在我们眼前? Import AI 472:DeepMind 的作弊数学 Agent;民粹主义 AI 政策;以及 Forethought 提出的"守夜人"理论 — 此外,还有一则机器诠释学的故事 Import A…
Jay RSS 摘要 import-ai 2026-09-23 10:03
Microsoft Research Blog · RSS 摘要
大规模小分子合成预测的改进:RetroChimera — 定制分子正推动医药、材料与农业的发展,但其生产过程缓慢且昂贵。一篇新的 Nature 论文重点介绍了 RetroChimera——一种预测模型…… GigaPathFlash 与 GigaTIMEFlash:迈向群体规模发现的高效病理基础模型 — 如果病理基础模…
Jay RSS 摘要 msr-blog 2026-09-23 10:02
Lilian Weng (Lil'Log) · RSS 摘要
用于自我改进的 Harness 工程 — 递归自我改进(RSI)的概念可追溯至 I. J. Good(1965),他将"超智能机器"定义为能在所有智力活动上超越人类的系统…… 谨慎看待 Scaling Laws — Scaling laws 是深度学习中最关键的实证发现之一。该观察表述简洁——训练损失 L 随模型规模扩…
Jay RSS 摘要 lilian-weng 2026-09-23 10:02
Cool Papers · cs.IR (papers.cool) · RSS 摘要
UKPRBENCH:英国案例法段落级先例检索基准 — 先例检索(PCR)旨在识别与给定查询案例相关的先例。现有 PCR 基准与方法主要在文档级运行,将案例视为... 什么才是生成式推荐的好语义 ID?一项可复现性研究 — 生成式推荐已成为一个活跃的研究方向,其中物品通常由语义 ID(SIDs)表示:逐 token 生成…
Jay RSS 摘要 cool-papers-ir 2026-09-23 10:02
Simon Willison · RSS 摘要
Claude Opus 5.5、GPT6 Sol、GPT6 Luna,以及新一轮价格战 — 昨天发布的是 Grok 4.7(鹈鹕)和 MiMo v2.6 Flash/Pro(更多鹈鹕)。今天 Anthropic 发布了 Claude Opus 5.5,大约一小时后 OpenAI 发布了 GPT6 Sol 和 GPT6 …
Jay RSS 摘要 simon-willison 2026-09-23 10:01