笔记
浏览全部笔记 · 1809 篇
Cool Papers · cs.CL (papers.cool) · RSS 摘要
在线阴谋论的智能体检测 — 社交媒体上的阴谋论话语并非总通过显式主张或稳定词汇标记来表达。相同的表层内容可能表达认同、合理论证… JevOut: Natural Context Can Flip Decision Models — Jev 等专用决策模型将非结构化语言映射到有限选项上的概率分布,使其输出可直接路由请求、…
ByteByteGo · RSS 摘要
报名最后机会:用 AI 重建 YouTube — 用 AI 重建 YouTube 课程由前 YouTube 工程师授课,将于 9 月 26 日(周六)开课,报名将在 24 小时内截止。 数据的一生:从创建到删除 — 本文将介绍数据从创建到删除的整个生命周期,以及每一步需要做出的决策。 如何定制模型学习新技能 — 本文将…
Simon Willison · RSS 摘要
引用 John Gruber — Muse 引发了大量关注——包括我的关注——因为它在技术上具有突破性(每位用户都拥有自己在 Meta 云端运行的完整持久化 Linux 虚拟机),并…… 北鲣鸟、大蓝鹭、加州褐鹈鹕 — 北鲣鸟、大蓝鹭、加州褐鹈鹕,拍摄于美国加利福尼亚州蒙特雷湾国家海洋保护区。新入手的 200800mm…
Nathan Benaich (State of AI) · RSS 摘要
欧洲无法通过租赁获得 AI 主权 — 当华盛顿能在一夜之间关停一个模型时,问题不再是 AI 是否安全,而是谁在控制它。 AI 现状:2026 年 5 月 — 2026 年 4 月:AISI 的网络阈值,Microsoft 与 OpenAI 的重置,中国开放权重模型的编程平价,Agent 接入真实市场,以及 OpenAI…
Sebastian Raschka (Ahead of AI) · RSS 摘要
GPT6 Astra、循环 Transformer 与隐藏推理 — 循环深度、隐藏思维链与循环 Transformer 块最新研究综述 Claude 如何为 AI 生成文本添加水印 — 48 分钟视频讲解 token 采样、水印检测与去除 从零构建 AI 文本检测器 — 端到端项目:数据集构建、模型训练、本地部署与 R…
Cameron R. Wolfe (Deep Learning Focus) · RSS 摘要
LLMs 强化学习完全指南 — 追溯强化学习从第一性原理到现代 AI 研究前沿的演进之路 关于 Midtraining 的笔记 — 通过 midtraining 与持续预训练打造更优的专用 LLM Agentic 世界模型 — 教会语言 Agent 对环境建模,从而打造更优的语言 Agent Agentic RL:框架…
Gradient Flow · RSS 摘要
不是每个 AI 任务都需要 LLM — LLM 专为生成文本而构建,但大量 AI 自动化其实根本不需要文本。它只需要一个小决策:这是垃圾邮件吗?这个工单应分给哪个团队?… 过期数据过去只是烦人 — 假设一个采购 Agent 检查库存并判断库存已低于补货阈值,于是再次下单。问题在于一大批货物刚刚到货… 为什么你的数据栈即…
Fireship (YouTube) · RSS 摘要
WordPress 史上最贵的 33 个小时…… 一位前 OpenAI 研究人员刚从 LLM 中删除了语言…… Google 刚刚引爆了智能爆炸? Anthropic 研究人员正在离职……而我们现在知道原因了 OpenAI 最大的数学突破正在陷入困境……
AI Explained (YouTube) · RSS 摘要
Opus 5.5:我们距离自动化 AI 研究还有多远? AI 研究者在呼吁"放缓"AI 之前看到了什么 GPT 6 Astra:表现如此出色,连 OpenAI 都感到担忧 Sam Altman:"AGI 将在 2026 年到来",恰逢模型开始"误训练"自身 AI 正在有些失控
Two Minute Papers (YouTube) · RSS 摘要
Claude Opus 5.5 AI:一次令人惊叹的巨大飞跃 没错,Jev 确实很疯狂,但这里有个问题 DeepSeek 炸裂的新架构 Claude 正在其生成文本中留下隐形指纹 我从未想过这一幕会发生
Lex Fridman (YouTube) · RSS 摘要
精神病学、疯人院、精神疾病、ECT(电休克治疗)、脑叶切除术、弗洛伊德与荣格 | Lex Fridman 播客 #502 DHH:编程、AI、Agentic 工程、Vibe Coding 与 Linux 的未来 | Lex Fridman 播客 #501 Khabib Nurmagomedov:达吉斯坦、MMA、UFC…
3Blue1Brown (YouTube) · RSS 摘要
AI尚未解决的最后一道IMO问题 AI尚未解决的最后一道IMO问题 跳钉谜题 64块方糖谜题 什么是交叉熵?| 压缩即智能 第二部分
Lilian Weng (Lil'Log) · RSS 摘要
自我改进的 Harness 工程 — 递归自我改进 (RSI) 的概念可追溯至 I. J. Good (1965),他将"超智能机器"定义为一种在所有方面均能超越人类的系统…… 谨慎看待 Scaling Laws — Scaling laws 是深度学习中最关键的实证发现之一。其表述简洁:随着模型规模扩大,训练损失 $…
Import AI (Jack Clark) · RSS 摘要
Import AI 473:美国的超级智能战略;鼠颅中的人类大脑;以及机器诠释学 — AI 正在撞上的墙此刻就在我们身边吗? Import AI 472:DeepMind 的作弊数学 Agent;民粹主义 AI 政策;以及 Forethought 提出的守夜人构想 — 另外,还有一个机器诠释学的故事 Import AI…
Microsoft Research Blog · RSS 摘要
面向现实世界物理 AI 机器人的卸载推理 — 机器人越来越智能,但硬件如何跟上这种增长?微软研究院的新研究表明,将 AI 推理转移到机器人之外可提升任务成功率…… 利用 RetroChimera 大规模提升小分子合成预测 — 定制分子正推动医药、材料和农业的发展,但其生产缓慢且成本高昂。一篇新发表于 Nature 的论…
Cool Papers · cs.IR (papers.cool) · RSS 摘要
超越标量:用于观看时长预测的分布式服务接口 — 观看时长是短视频信息流中的主要参与信号,其预测直接影响排序与曝光。现有方法通过 corre…… 双超图索引:打通 RAG 多跳推理中的知识孤岛 — 基于超图的 RAG 能有效捕捉高阶多实体关联,但现有范式将提取的超边视为孤立的…… 面向个人与群体的灵活推荐系统 — 群组推…
Interconnects (Nathan Lambert) · RSS 摘要
与 Epoch AI 的 JS Denain 讨论 RSI、中美差距与能力参差性 — 播客 #19 开源模型当前的力量格局 — 我为国会准备的证词的完整版 为什么我仍未相信真正的 RSI — 一位"AI 温和派"对近期事件与前沿模型发展轨迹的看法 开源 AI 与开源模型阅读清单 — 如何快速了解开源模型及其影响 一次辞…
Chip Huyen · RSS 摘要
构建生成式 AI 应用时的常见陷阱 — 由于我们仍处于基于 foundation model 构建应用的早期阶段,犯错是正常的。这篇短文列举了一些最常见陷阱的示例…… Agents — 智能 Agent 被许多人视为 AI 的终极目标。Stuart Russell 和 Peter Norvig 的经典著作《Artifi…
Cool Papers · cs.CL (papers.cool) · RSS 摘要
对比学习用于作者身份验证 — 结果表明,在测试设定下,对比学习优于基于分类的作者身份验证方法。我们识别出损失函数、批量大小…… 跨尺度迁移学习用于抑郁严重程度预测:从 PHQ8 到 HAMD17 跨语言与临床范式 — 该工作研究数据稀缺场景下基于临床访谈转录的连续抑郁严重程度分数预测。我们提出一种顺序低秩适应(LoRA…
Sebastian Raschka (Ahead of AI) · RSS 摘要
GPT6 Astra、循环 Transformer 与隐藏推理 — 审视循环深度、隐藏思维链以及循环 Transformer 模块的最新研究 Claude 如何为 AI 生成文本添加水印 — 48 分钟视频详解 token 采样、水印检测与去除 从零构建 AI 文本检测器 — 端到端项目:数据集构建、模型训练、本地部署…
ByteByteGo · RSS 摘要
数据的一生:从创建到删除 — 本文将梳理从创建到删除的完整数据生命周期,以及在每个环节需要做出的决策。 如何定制模型以学习新技能 — 本文将探讨模型定制与微调的各种策略。 OpenAI 如何构建 GPTLive — 为理解其端到端的工作机制,我们采访了 GPT Voice 团队的工程师 Zahan Malkani 和 …
Simon Willison · RSS 摘要
commitrewriter 0.2 — Release: commitrewriter 0.2 支持非默认分支。使用 uvx commitrewriter branch other 可对其他分支运行。#3 Tags: git datasette 1.0a41 — Release: datasette 1.0a41 A…
Nathan Benaich (State of AI) · RSS 摘要
欧洲无法通过租用实现 AI 主权 — 当华盛顿能够在一夜之间禁用某个模型时,问题已不在于 AI 是否安全,而在于谁来掌控它。 AI 行业现状:2026 年 5 月 — 2026 年 4 月:AISI 的网络安全阈值、Microsoft 与 OpenAI 关系重置、中国开放权重的代码能力对标、Agent 走入真实市场,以…
Cameron R. Wolfe (Deep Learning Focus) · RSS 摘要
LLM 的强化学习:完整指南 — 从第一性原理出发,追溯 RL 演进至现代 AI 研究前沿... Midtraining 笔记 — 通过 midtraining 与持续预训练构建更优的专用 LLM... Agentic 世界模型 — 通过让语言 Agent 对环境建模,构建更优的语言 Agent... Agentic …
Gradient Flow · RSS 摘要
并非每个 AI 任务都需要 LLM — LLM 专为生成文本而构建,但大量 AI 自动化根本不需要文本,而只需要一个小决策:这是垃圾邮件吗?这张工单该分给哪个团队?… 过期数据过去只是令人烦恼 — 设想一个采购 Agent 检查库存,判断库存低于补货阈值,于是再次下单。问题在于一批大额货物刚刚… 为什么你的数据栈即将变…
Fireship (YouTube) · RSS 摘要
WordPress历史上最昂贵的33小时... 一位前OpenAI研究员刚刚从LLM中删除了语言... Google是否刚刚引发了智能爆炸? Anthropic的研究员正在离职...现在我们知道原因了 OpenAI最大的数学突破正陷入困境...
Lex Fridman (YouTube) · RSS 摘要
精神病学、疯人院、精神疾病、电休克疗法、脑叶白质切除术、弗洛伊德与荣格 | Lex Fridman 播客 #502 DHH:编程、AI、Agentic Engineering、Vibe Coding 与 Linux 的未来 | Lex Fridman 播客 #501 哈比卜·努尔马戈梅多夫:达吉斯坦、MMA、UFC、伊…
3Blue1Brown (YouTube) · RSS 摘要
AI 无法解决的最后一道 IMO 题目 AI 无法解决的最后一道 IMO 题目 跳跃木钉谜题 64 块方糖谜题 但什么是交叉熵?| 压缩即智能 第二部分
Andrej Karpathy (YouTube) · RSS 摘要
我如何使用 LLM 深度剖析 ChatGPT 这类 LLM 让我们复现 GPT2 (124M) 让我们构建 GPT Tokenizer [[1小时讲座] 大语言模型入门](
Two Minute Papers (YouTube) · RSS 摘要
是的,Jev 确实疯狂,但这有个陷阱 DeepSeek 的疯狂新架构 Claude 现在会在文本中留下隐形指纹 我从未想过会看到这个发生 GPT6 Astra 改变一切