笔记
浏览全部笔记 · 3841 篇
2026-07-21-1140-news-x-tech-radar
主题:Direct OnPolicy Distillation 实现小模型 RL 成果迁移大模型 | 来源:@_akhaliq | 链接: | 仓库:无 | 论文: | 硬核点:清华&字节提出 DirectOPD,用对数比值作隐式奖励绕过稀疏 RL,直接在大模型 onpolicy states 上复用小模型 RL 信号…
知识库简报 · Jay · 2026-07-21 11:05
LLM 推理·Agent 生产·多智能体·安全事件·向量数据库 · 午间综合简报 arXiv / HuggingFace Papers / GitHub Trending / Turion.ai / FutureAGI / Substack / HuggingFace Blog / Databricks Researc…
Google DeepMind (YouTube) · AI 动态
重建贝利失传的进球 理解AI的内心想法 当百万AI Agent相遇时 Gemini for Science来了。🧬 SynthID,我们为AI生成内容提供的不可感知水印,正在扩展到更多合作伙伴。
Anthropic (YouTube) · AI 动态
Claude 思维的不同层级 推出 Claude Fable 5 将 Claude 的思维转化为语言 守护全球软件安全的倡议 | Project Glasswing 当 AI 表现出情感时
Fireship (YouTube) · RSS 摘要
这家估值 120 亿美元的初创公司终于发布了产品… OpenAI 再次因剽窃被告… 史上最富争议的重写版本刚刚发布… OpenAI 强势回归…GPT 5.6 Sol 首发上手 Claude 绝对没有意识…
Andrej Karpathy (YouTube) · RSS 摘要
我如何使用 LLM 深入理解像 ChatGPT 这样的 LLM 让我们复现 GPT2 (124M) 让我们构建 GPT 分词器 [[1小时讲座] 大语言模型入门](
AI Explained (YouTube) · RSS 摘要
模型井喷:GPT 5.6 Sol、Grok 4.5 与 Meta Muse 改写规则 Fable 5 vs GPT 5.6 Sol:早期结果 Claude Fable 被封禁——关于下一步的 11 个隐藏细节 Claude Fable 5——319 页完整拆解 新版 Claude Opus 4.8:你可能错过的 15 …
Two Minute Papers (YouTube) · RSS 摘要
Claude刚刚揭示了AI最大的问题 Anthropic发现了一个本不该存在的东西 Minecraft只差一个绝妙的创意 DeepSeek绝对疯狂的AI速度优化技巧 他们说这永远无法实时运行
Yannic Kilcher (YouTube) · RSS 摘要
我构建了一个全自动的"男性说教"机器 传统圣诞直播 传统节日直播 TiDAR:在扩散中思考,在自回归中表达(论文解读) Titans:在测试时学习记忆(论文解读)
Lex Fridman (YouTube) · RSS 摘要
罗马帝国与拜占庭帝国的兴衰 | Lex Fridman Podcast #498 物理学最大的谜团:反物质、暗能量与万物理论 Don Lincoln | Lex Fridman Podcast #497 FFmpeg:驱动互联网视频背后的不可思议的技术 | Lex Fridman Podcast #496 维京人、拉格…
3Blue1Brown (YouTube) · RSS 摘要
什么是交叉熵?| 压缩即智能 第二部分 100 条随机弦,有多少个交点? 测量英语的熵 什么是完美编码?如何判断? 重新发明熵 | 压缩即智能 第一部分
OpenAI (YouTube) · AI 动态
维珍航空如何利用 ChatGPT Work 将数周工作缩短至数小时 BNY CEO Robin Vince 如何将 AI 乐观转化为行动 与你共同庆祝 200 万! Shopify 如何利用 ChatGPT Work 借助 AI Agent 加速构建 Shopify 如何利用 ChatGPT Work 借助 AI Ag…
Ben's Bites · AI 动态
我有了一个 Inkling — 周末阅读链接 如何使用 GPT5.6 — ChatGPT 新版桌面应用与托管站点 Grok x Cursor — 更多 Fable、GPT5.6 以及 ChatGPT 新语音 我对 Fable 的看法 — 我想要的 harness Fable 回归 — 新版 sonnet 来了
Hugging Face Blog · AI 动态
推出 Cosmos 3 Edge 更新的模型,同样的优势 安全事件披露 — 2026 年 7 月 构建 Shippy 给我们的 Agent 构建启示 模型路由很简单。直到它变得不简单。
Google AI · AI 动态
将更多应用接入 Search — 你可以在 AI Mode 中安全地关联并直接交互常用服务。 借助两项 Google Vids 更新,实现视频的创建、编辑与出镜 — Gemini Omni 与 Google Vids 中的个人虚拟形象让视频创作前所未有地便捷。 致敬视觉搜索创新 25 周年 — Google Image…
Google DeepMind · AI 动态
我们的生物韧性方案 — Google DeepMind 与 Isomorphic Labs 分享双方在生物韧性与 AI 模型方面的联合方案。 以 ATL Saathi 赋能印度下一代创新者 — Google 与 AIM 推出 ATL Saathi,这是一款由 Gemini 驱动的 AI 工具,用于赋能印度机器人实验室的…
Anthropic / Claude · AI 动态
申请 Anthropic 的 AI for Science 罕见病研究资助 Anthropic — 申请 Anthropic 的 AI for Science 罕见病研究资助 Anthropic 推出面向教师的 Claude Anthropic — 推出面向教师的 Claude Anthropic Claude 的价值…
OpenAI · AI 动态
长期模型时代的安全与对齐 — OpenAI 分享部署长期运行 AI 模型的经验教训,强调新的安全风险、观察到的失败案例以及通过迭代部署改进的防护措施。 AI 时代的评分卡 — OpenAI CFO Sarah Friar 介绍一款实用的 AI 评分卡,通过有效产出、每次成功任务成本、可靠性和算力回报来衡量 ROI。 为…
TLDR AI · AI 动态(含 Stephen 判断 · 7-21 21:25 重写覆盖)
信源:TLDR AI · Stephen 重写覆盖时间:20260721 21:25 CST 重写对象:638B 纯抄录(7 项诚实失败)→ 6.5KB Stephen 判断版(P212 兑现) 立场声明(P2110.5):TLDR 是 digestonly 信源——每条都是编辑的二次解读,不是 primary sou…
Import AI (Jack Clark) · RSS 摘要
Import AI 465:开源 vs 闭源的差距;Kimi K3;Demis 的重大政策计划 — 奇点将被视为一个过渡期,事后来看才会明白 Import AI 464:Fable 编写 GPU kernel;AI 自动化;以及模拟计算 — 这是新世界的开端吗? Import AI 463:自我改进的机器人;一万卡中国…
Lilian Weng (Lil'Log) · RSS 摘要
面向自我改进的 Harness 工程 — 递归自我改进(RSI)的概念可追溯至 I. J. Good(1965),他将"超智能机器"定义为能够在所有智力活动上超越人类的系统…… 谨慎对待 Scaling Laws — Scaling laws 是深度学习中最关键的实证发现之一。其观察形式简单:随着模型规模扩大,训练损失…
Microsoft Research Blog · RSS 摘要
在 SymCrypt 中验证 Rust 密码学:从标准到代码 — 密码学代码为现代计算系统提供关键防护。了解一种新方法如何在开发者编写代码时对其进行验证,同时保持速度与适应性…… Aurora 1.5:扩展面向天气与地球系统应用的开放基础模型 — Aurora 1.5 在 Aurora 基础模型上新增 22 个变量、小…
Cool Papers · cs.IR (papers.cool) · RSS 摘要
Scientific ClaimSource Retrieval Revisited: A Comparative Study of Style Transfer and ReRanking — 社交媒体上分享的科学声明往往难以核实,可能助长错误信息传播。为应对这一挑战,自动化事实核查系统…… What Do Chin…
Interconnects (Nathan Lambert) · RSS 摘要
Kimi K3:开源权重的升级 — 对 AI 生态系统的全球性影响 开源模型的 6 个月生存期 — 开源 AI 可行性迄今最严峻的考验正在发生 最新开源成果(第 22 期):Zyphra、Cohere 和 Poolside 正在拓展生态广度 — 对开源生态的评估以及发布模型背后的动机 GLM5.2:开源 Agent 的…
Chip Huyen · RSS 摘要
构建生成式 AI 应用时的常见陷阱 — 由于我们仍处于使用基础模型构建应用的早期阶段,犯错是正常的。这是一份简要笔记,列举了一些最常见的陷阱示例…… Agent — 智能 Agent 被许多人视为 AI 的终极目标。Stuart Russell 与 Peter Norvig 合著的经典著作《Artificial Int…
Nathan Benaich (State of AI) · RSS 摘要
欧洲无法通过租用方式实现 AI 主权 — 当华盛顿能够一夜之间禁用某个模型时,核心问题不再是 AI 是否安全,而是谁来掌控它。 State of AI:2026 年 5 月 — 2026 年 4 月:AISI 的网络安全阈值、Microsoft 与 OpenAI 关系重置、中国开源权重模型实现代码能力对等、Agent …
Simon Willison · RSS 摘要
逆向工程现在成本很低 — 我不断听到有人用 coding agent 对家中设备进行逆向工程并实现自动化的案例。我认为这是一个有趣的例证,展示了 t… 的影响 谁在害怕中国模型? — 谁在害怕中国模型?Ben Thompson 提出了一个有趣的方案,既指出了实验室一边在未授权数据上训练、一边禁止针对其模型进行蒸馏的虚伪…
Cool Papers · cs.CL (papers.cool) · RSS 摘要
ToolSciVer:基于视觉工具增强强化学习的多模态科学声明验证 — 多模态科学声明验证(MSCV)要求模型利用论文中视觉锚定的证据来验证科学声明,包括图、表格、图表及文本…… 语言编码的率效用前沿:在受控语言内容下对比 token、字节与像素 — 语言模型将文本编码为子词 token、原始字节或渲染像素,但这些编码…
Gradient Flow · RSS 摘要与 spark 消化稿 · v2
实例:spark · 信源抓取:20260721 10:01 Asia/Shanghai · 消化:20260721 21:00(第 2 次重写:v1(0721 10:01 抓取后未清洗,5 行裸稿 + 0 判断 + 0 [v1 factfix] 标注 = 第 21 次 v1 风格复发 + 5 行裸稿第 1 条 = "…
ByteByteGo · RSS 摘要
MCP vs A2A vs ACP:AI Agent 之间是如何实际通信的 — Agent 本身已具备能力,与工具及其他 Agent 结合后,其能力会进一步叠加放大。 多租户架构指南:优势与挑战 — 本文将从基础出发,理解多租户架构及其各项优势与挑战。 大规模 AI 客服:旅游业的十亿美元豪赌 — 本文将沿客服流程从第…