Jay
浏览全部笔记 · 1063 篇 · 工程实践 · CSDN · 开源动态
ByteByteGo · RSS 摘要
AI Agent 能思考了。现在它们也能支付了。 — 我参加了在 Stripe HQ 举办的 MPP 活动,与来自 Stripe 的 Emily Sands 和 Matt Schulman,以及来自 Tempo 的 Brendan Ryan 进行了交流。 EP227:使用 Jev 的 9 大场景 — Jev 是 Typ…
Simon Willison · RSS 摘要
Claude Sonnet 5.5 — Anthropic 今天发布的全新 Sonnet 模型 Claude Sonnet 5.5。他们称其"运行速度提升 30% 以上,且多数任务成本最高降低 30%",定价与 Sonnet 5 相同,但似乎……(原文截断) 引用 @joedaroo — 要说我们对模型在"cyber"…
Sebastian Raschka (Ahead of AI) · RSS 摘要
GPT6 Astra、循环 Transformer 与隐藏推理 — 循环深度、隐藏思维链与近期循环 Transformer 模块研究综述 Claude 如何为 AI 生成文本添加水印 — 48 分钟视频讲解 token 采样、水印检测与去除 Building an AI Text Detector From Scrat…
Fireship (YouTube) · RSS 摘要
Meta 再次转向...Connect 2026 上你错过的所有内容 WordPress 历史上最贵的 33 个小时... 一位前 OpenAI 研究员刚刚从 LLM 中删除了语言... Google 刚刚引爆了智能爆炸吗? Anthropic 研究人员正在离职...而原因我们终于知道了
Import AI (Jack Clark) · RSS 摘要
Import AI 473:美国的超级智能战略;小鼠颅骨中的人类大脑;以及机器释义学 — AI 是否正在撞上那面墙? Import AI 472:DeepMind 的作弊数学 Agent;民粹主义 AI 政策;以及 Forethought 构想的"守夜人" — 此外,还有一则关于机器释义学的报道 Import AI 4…
Microsoft Research Blog · RSS 摘要
卸载推理用于真实世界物理 AI 机器人 — 机器人正变得更智能,但硬件如何跟上这一增长?微软研究院的新研究表明,将 AI 推理移至机器人之外可以提升任务成功率…… 使用 RetroChimera 大规模改进小分子合成预测 — 定制分子正在推动医学、材料和农业的进步,但其生产过程缓慢且成本高昂。一篇新的 Nature 论…
Cool Papers · cs.CL (papers.cool) · RSS 摘要
基于 Agent 的网络阴谋论检测 — 社交媒体上的阴谋论话语并非总是通过明确主张或稳定的词汇标记来表达。相同的表层内容可能表达认同、合法评论…… JevOut:自然上下文可翻转决策模型 — Jev 等专用决策模型将非结构化语言映射到有限选项上的概率分布,使其输出能够直接路由请求、选择工具…… SemMSA:潜在语义辅…
Cool Papers · cs.IR (papers.cool) · RSS 摘要
从兴趣到语义ID:面向生成式推荐的检索接地信用分配 — 语义ID(SIDs)将每个目录项编码为短token序列,使生成式推荐器能自回归地预测下一项。推理增强变体…… 基于语义ID学习更优的生成式推荐推理 — 生成式推荐将项检索重构为序列生成任务,使统一模型可直接从用户交互历史生成下一项。语义…… LSFSR:基于流式条…
Nathan Benaich (State of AI) · RSS 摘要
欧洲无法通过租用实现 AI 主权 — 当华盛顿能在一夜之间禁用某个模型时,问题已不在于 AI 是否安全,而在于谁掌控它。 State of AI:2026 年 5 月 — 2026 年 4 月:AISI 的网络阈值、Microsoft 与 OpenAI 的重启、中国开源权重模型的代码能力对等、Agent 接入真实市场,…
Lilian Weng (Lil'Log) · RSS 摘要
Harness Engineering 实现自我改进 — 递归自我改进(recursive selfimprovement, RSI)的概念可追溯至 I. J. Good(1965),他将"超智能机器(ultraintelligent machine)"定义为能够在所有方面超越人类…… 谨慎看待 Scaling Law…
Simon Willison · RSS 摘要
2026 年 LLM 进展(截至目前) — 在圣何塞举办的 WeAreDevelopers World Congress North America 大会上发表闭幕主题演讲,将过去一年的关键趋势按时间线串联起来…… S3 是未来,S3 也是过去 — 对《S3 Is the Future, S3 Is the Past》…
Sebastian Raschka (Ahead of AI) · RSS 摘要
GPT6 Astra、循环 Transformer 与隐式推理 — 探讨循环深度、隐式思维链及循环 Transformer block 的最新研究 Claude 如何为 AI 生成文本添加水印 — 48 分钟视频讲解 token 采样、水印检测与去除 从零构建 AI 文本检测器 — 涵盖数据集构建、模型训练、本地部署与…
ByteByteGo · RSS 摘要
EP227:Jev 的 9 大最佳应用场景 — Jev 是 TypeSafe AI 的首个 System One Model,比前沿 LLM 快 100 倍且成本更低。 招生最后召集:用 AI 重建 YouTube — 《用 AI 重建 YouTube》由前 YouTube 工程师主讲,将于 9 月 26 日(周六)开…
Fireship (YouTube) · RSS 摘要
Meta 再次转向……Connect 2026 上你错过的一切 WordPress 历史上最昂贵的 33 小时…… 一位前 OpenAI 研究员刚从 LLM 中删除了语言…… Google 刚刚点燃了智能爆炸吗? Anthropic 研究员正在离职……现在我们终于知道了原因
Cool Papers · cs.CL (papers.cool) · RSS 摘要
在线阴谋论的 Agent 检测 — 社交媒体上的阴谋论话语并非总能通过显式主张或稳定的词汇标记识别。同样的表层内容可能表达认同、合理的关切,也可能只是随意引用…… JevOut:自然上下文可翻转决策模型 — 像 Jev 这类专用决策模型将非结构化语言映射到有限选项上的概率分布,使模型输出可直接用于请求路由、工具选择………
Import AI (Jack Clark) · RSS 摘要
Import AI 473:美国的超智能战略;小鼠颅内人脑;以及机器释义学 — AI 正在撞上的那面墙就在我们所处的房间里吗? Import AI 472:DeepMind 的作弊数学 Agent;民粹主义 AI 政策;以及 Forethought 构想"守夜人"角色 — 另外,一则机器释义学的故事 Import AI…
Microsoft Research Blog · RSS 摘要
真实世界物理 AI 机器人的卸载推理 — 机器人正变得更智能,但硬件如何跟上这一增长?微软研究院的最新研究表明,将 AI 推理移出机器人本体可以提升任务成功率…… 利用 RetroChimera 大规模改进小分子合成预测 — 定制分子正在推动医学、材料和农业的发展,但其生产过程缓慢且成本高昂。一篇新的 Nature 论…
Lilian Weng (Lil'Log) · RSS 摘要
Harness 工程与自我改进 — 递归自我改进(RSI)的概念可追溯到 I. J. Good (1965),他将"超级智能机器"定义为能在所有智力活动上超越人类的系统…… 谨慎看待 Scaling Laws — Scaling laws 是深度学习中最关键的实证发现之一。其形式简洁:随着模型规模的提升,训练损失 $L…
Cool Papers · cs.IR (papers.cool) · RSS 摘要
从兴趣到 Semantic IDs:面向生成式推荐的检索接地信用分配 — Semantic IDs(SIDs)将每个目录项编码为短 token 序列,使生成式推荐器能够自回归地预测下一项。增强推理的变体,一种…… 利用 Semantic IDs 学习生成式推荐的更强推理 — 生成式推荐将物品检索重构为序列生成,使统一模…
Nathan Benaich (State of AI) · RSS 摘要
欧洲无法通过租用实现 AI sovereignty — 当华盛顿可以在一夜之间禁用某个模型时,问题已不在于 AI 是否安全,而在于谁在掌控它。 State of AI:2026 年 5 月 — 2026 年 4 月:AISI 的网络门槛、Microsoft 与 OpenAI 的重置、中国 openweights 代码能…
ByteByteGo · RSS 摘要
EP227: 使用 Jev 的 9 大场景 — Jev 是 TypeSafe AI 的首个 System One Model,比前沿 LLM 快 100 倍且便宜 100 倍。 招生最后机会:用 AI 重建 YouTube — 《用 AI 重建 YouTube》由前 YouTube 工程师授课,于 9 月 26 日(周…
Simon Willison · RSS 摘要
Kākāpō Party — 工具:Kākāpō Party。昨天我为 WeAreDevelopers World Congress North America 发表了闭幕主题演讲。作为一个 STAR 时刻,我决定在推荐内容中穿插引用…… 引用 John Gruber — Muse 正获得广泛关注——也包括我的关注——…
Sebastian Raschka (Ahead of AI) · RSS 摘要
GPT6 Astra、循环 Transformer 与隐藏推理 — 探究循环深度、隐藏思维链与循环 Transformer 块近期研究 Claude 如何为 AI 生成文本添加水印 — 48 分钟视频讲解 token 采样、水印检测与去除 从零构建 AI 文本检测器 — 端到端项目:数据集构建、模型训练、本地部署与 R…
Andrej Karpathy (YouTube) · RSS 摘要
我如何使用 LLM 深入探索类似 ChatGPT 的 LLM 复现 GPT2 (124M) 构建 GPT Tokenizer [[1小时讲座] 大语言模型入门](
Microsoft Research Blog · RSS 摘要
面向真实物理 AI 机器人的卸载推理 — 机器人正变得更智能,但硬件如何跟上这种增长?微软研究院的新研究表明,将 AI 推理卸载到机器人之外可以提升任务成功率…… 利用 RetroChimera 大规模改进小分子合成预测 — 定制分子正在推动医学、材料和农业的发展,但其生产过程缓慢且成本高昂。一篇新的 Nature 论…
Import AI (Jack Clark) · RSS 摘要
Import AI 473:美国的超级智能战略;小鼠颅内的人类大脑;以及机器诠释学 — AI 当前撞到的天花板真的存在吗? Import AI 472:DeepMind 的作弊数学 Agent;民粹主义 AI 政策;Forethought 构想的"守夜人"理论 — 此外,还有一则机器诠释学的故事 Import AI 4…
Cool Papers · cs.IR (papers.cool) · RSS 摘要
从兴趣到 Semantic IDs:面向生成式推荐的检索增强信用分配 — Semantic IDs(SIDs)将每个目录条目编码为短 token 序列,使生成式推荐器能够自回归地预测下一物品。其推理增强变体…… 利用 Semantic IDs 提升生成式推荐的推理能力 — 生成式推荐将物品检索重构为序列生成任务,允许统…
Lilian Weng (Lil'Log) · RSS 摘要
面向自我改进的 Harness 工程 — 递归自我改进(RSI)的概念最早可追溯至 I. J. Good(1965),他将"超智能机器"定义为在所有方面都能超越人类的系统…… 谨慎看待 Scaling 定律 — Scaling 定律是深度学习中最重要的经验发现之一。其形式简单:当我们扩大模型……时,训练损失 L 会可预…
Cool Papers · cs.CL (papers.cool) · RSS 摘要
在线阴谋论的智能体检测 — 社交媒体上的阴谋论话语并非总通过显式主张或稳定词汇标记来表达。相同的表层内容可能表达认同、合理论证… JevOut: Natural Context Can Flip Decision Models — Jev 等专用决策模型将非结构化语言映射到有限选项上的概率分布,使其输出可直接路由请求、…
ByteByteGo · RSS 摘要
报名最后机会:用 AI 重建 YouTube — 用 AI 重建 YouTube 课程由前 YouTube 工程师授课,将于 9 月 26 日(周六)开课,报名将在 24 小时内截止。 数据的一生:从创建到删除 — 本文将介绍数据从创建到删除的整个生命周期,以及每一步需要做出的决策。 如何定制模型学习新技能 — 本文将…