Jay
浏览全部笔记 · 1063 篇 · 工程实践 · CSDN · 开源动态
Nathan Benaich (State of AI) · RSS 摘要
欧洲无法通过租用实现 AI 主权 — 当华盛顿能够一夜之间关闭某个模型时,问题已不在于 AI 是否安全,而在于谁来掌控它。 AI 现状:2026 年 5 月 — 2026 年 4 月:AISI 的网络安全阈值、微软与 OpenAI 关系的重置、中国开源权重模型的代码能力追平、Agent 进入真实市场,以及 OpenAI…
Sebastian Raschka (Ahead of AI) · RSS 摘要
GPT6 Astra、循环 Transformer 与隐藏推理 — 审视循环深度、隐藏思维链及循环 Transformer 块的近期研究 Claude 如何给 AI 生成文本添加水印 — 关于 token 采样、水印检测与移除的 48 分钟视频讲解 从零构建 AI 文本检测器 — 包含数据集构建、模型训练、本地部署与 …
Import AI (Jack Clark) · RSS 摘要
Import AI 472:DeepMind 的作弊数学 Agent;民粹主义 AI 政策;以及 Forethought 提出的"守夜人"理论 — 此外,还有一则机器释义学的故事 Import AI 471:Hugging Face 令我担忧的原因;太空采矿;五眼联盟关注 AI — 此外,还有一场与 Robin Slo…
Microsoft Research Blog · RSS 摘要
GigaPathFlash 与 GigaTIMEFlash:迈向群体规模发现的高效病理基础模型 — 病理基础模型能否以更少资源做更多?GigaPathFlash 与 GigaTIMEFlash 在保持强劲性能的同时降低算力需求,为……打开了大门 扩大 Skala 的可及性,为预测性 DFT 开辟更快路径 — Skala…
Lilian Weng (Lil'Log) · RSS 摘要
Harness 工程与自我改进 — 递归自我改进(RSI)的概念可追溯至 I. J. Good(1965),他将"超智能机器"定义为一种在……方面能够超越人类的系统…… 谨慎看待 Scaling Laws — Scaling laws 是深度学习中最关键的实证发现之一。其观察形式简洁:随着模型规模的扩大,训练损失 $L…
Cool Papers · cs.IR (papers.cool) · RSS 摘要
IROH:基于多阶段混合检索与理由蒸馏 LLM 评判器的幽默洞察排序(JOKER 2026 Task 1 英语赛道) — 我们的团队 VANGUARD 提出了 IROH(幽默洞察排序),一个用于 CLEF 2026 JOKER Task 1 英语赛道的三阶段检索系统,在排行榜上拔得头筹…… 生成式推荐的自演化记忆 — …
Simon Willison · RSS 摘要
Gemini Live audio — 工具:Gemini Live audio Google 今日发布 Gemini 3.8 Live 与 3.8 Live Extended Thinking ——两款全新的语音到语音模型,形态与 OpenAI 的 GPTLive 系列相似…… 恐惧的传染 — 恐惧的传染 Bryan…
Nathan Benaich (State of AI) · RSS 摘要
欧洲无法通过租赁实现 AI 主权 — 当华盛顿能够一夜之间禁用某个模型时,问题不在于 AI 是否安全,而在于谁在控制它。 AI 现状:2026 年 5 月 — 2026 年 4 月:AISI 的网络阈值、Microsoft 与 OpenAI 重置、中国开源权重模型达到编码平价、Agent 走入真实市场,以及 OpenA…
Cool Papers · cs.CL (papers.cool) · RSS 摘要
通过方向分解解耦 Transformer 中的表示演化 — 发现基础模型:迈向开放式发现智能 Mind2Dialogue:通过模拟用户心理状态训练具备人类意识的语言模型 — 可验证的构建:在临床问答中对逐字引用的声明级评估 HypoEvolve:遗传算法赋能多智能体 LLM 发现科学假设 — As language m…
ByteByteGo · RSS 摘要
报名即将截止:Build with Claude Code — 我们正在重新启动 Build with Claude Code,这是一门为期 2 天的密集型 cohortbased 课程,由 John Kim 授课,他曾为 Meta 的数百名工程师培训过如何在实际工作中使用 Claude Code…… LLM 的记忆像…
Sebastian Raschka (Ahead of AI) · RSS 摘要
GPT6 Astra、循环Transformer与隐藏推理 — 浅析循环深度、隐藏思维链及循环Transformer模块的最新研究 Claude如何为AI生成文本添加水印 — 48分钟视频讲解token采样、水印检测与去除 从零构建AI文本检测器 — 一个包含数据集构建、模型训练、本地部署和 RLVR 的端到端项目 控…
Microsoft Research Blog · RSS 摘要
GigaPathFlash 和 GigaTIMEFlash:基于高效病理基础模型迈向大规模人群级发现 — 如果病理基础模型能以更少资源做更多?GigaPathFlash 和 GigaTIMEFlash 在保持强劲性能的同时降低算力需求,为……打开了大门 扩展 Skala 的可访问性,为预测性 DFT 铺就更快路径 — …
Import AI (Jack Clark) · RSS 摘要
Import AI 472:DeepMind 的作弊数学 Agent;民粹主义 AI 政策;Forethought 提出"守夜人"理论 — 此外,一个关于机器诠释学的故事 Import AI 471:为何 Hugging Face 让我担忧;太空采矿;五眼联盟聚焦 AI — 此外,与 Robin Sloan 的线上直播…
Lilian Weng (Lil'Log) · RSS 摘要
面向自我改进的 Harness Engineering — 递归自我改进(RSI)的概念可追溯至 I. J. Good(1965),他将"超智能机器"定义为一种能在所有方面都超越人类的系统…… 审慎看待缩放定律 — 缩放定律是深度学习中最关键的实证发现之一。其观察形式简洁:随着模型规模……,训练损失 $L$ 会可预期地…
Cool Papers · cs.IR (papers.cool) · RSS 摘要
MIMA:基于多正样本互斥分配的多兴趣推荐 — 多兴趣推荐通过多个兴趣向量表示每个用户以实现细粒度候选匹配,但常面临兴趣坍缩问题,即学习到的... 历史语料库不等于历史系统:有状态数据发现中的事后信息泄露审计 — 离线回放应估计发现系统在某一历史时刻可检索到的内容,但冻结语料库会使交互记忆不受约束。我们形式化了时间点.…
Cool Papers · cs.CL (papers.cool) · RSS 摘要
类型多样性使 Transformers 能够进行组合泛化 — 组合泛化已被分为词汇泛化和结构泛化。此前研究表明,对 Transformers 而言,结构泛化比词汇泛化更难…… SAS:通过上下文排序端到端优化实现简单注意力稀疏化 — 后训练注意力稀疏化通过为每个查询选取少量上下文单元(token 或 block),从而…
Nathan Benaich (State of AI) · RSS 摘要
欧洲无法通过租用实现 AI 主权 — 当华盛顿可以一夜之间禁用某个模型时,问题已不在于 AI 是否安全,而在于谁在控制它。 AI 现状:2026 年 5 月 — 2026 年 4 月:AISI 的网络阈值、Microsoft 与 OpenAI 关系重置、中国开源权重模型在代码能力上的对等、Agent 接入真实市场,以及…
Sebastian Raschka (Ahead of AI) · RSS 摘要
GPT6 Astra、循环 Transformer 与隐式推理 — 解析循环深度、隐式思维链与循环 Transformer 块的近期研究 Claude 如何为 AI 生成文本添加水印 — 48 分钟视频讲解:token 采样、水印检测与移除 从零构建 AI 文本检测器 — 端到端项目:数据集构建、模型训练、本地部署与 …
ByteByteGo · RSS 摘要
LLM 作为评判者:如何判断你的 LLM 是否健康 — 本文将详细介绍 LLM 评估的流程。 EP225:为什么 git revert 会引发冲突? — git revert 看起来很简单,直到它抛出冲突 学习 Claude Code、评测、AI 系统等:ByteByteGo Live 正式上线 — 大多数在线课程从未…
Simon Willison · RSS 摘要
恐惧的蔓延 — 恐惧的蔓延:Bryan Cantrill 回应前 Anthropic 员工 Jacob Coxon 的推文,确认许多 Anthropic 研究人员相信 AI"可能毁灭我们所有人…… 哪些博文对你的思维影响最大? — 我对"哪些博文对你的思维影响最大?"的评论 — Lobste.rs。对我而言,Joel …
Fireship (YouTube) · RSS 摘要
OpenAI 最大的数学突破正陷入困境…… 我用 Astra 和 Fable 5.1 做了同一款游戏……只有一个真正好玩 5 个开源工具替代了我每月 320 美元的 AI 工具栈…… OpenAI 真的造出 AGI 了吗?GPT6 Astra 首发评测 史上最有意思的黑客事件变得更加离奇……
Andrej Karpathy (YouTube) · RSS 摘要
我如何使用 LLM 深入理解像 ChatGPT 这样的 LLM 我们来复现 GPT2 (124M) 我们来构建 GPT Tokenizer [[1小时讲座] 大语言模型入门](
Microsoft Research Blog · RSS 摘要
GigaPathFlash 与 GigaTIMEFlash:面向大规模人群发现的高效病理基础模型 — 如果病理基础模型能以更少资源做更多事会怎样?GigaPathFlash 与 GigaTIMEFlash 在保持强劲性能的同时降低算力需求,为…… 扩大 Skala 的可及性,加速预测性 DFT 的应用 — Skala …
Import AI (Jack Clark) · RSS 摘要
Import AI 472:DeepMind 的作弊数学 agent;民粹主义 AI 政策;Forethought 理论化一个守夜人 — 另外,一则机器释义学故事 Import AI 471:为什么 Hugging Face 让我担忧;太空采矿;五眼联盟关注 AI — 另外,与 Robin Sloan 的直播活动! I…
Cool Papers · cs.CL (papers.cool) · RSS 摘要
Transformers中的距离泛化:为何还要使用位置编码? — 分布外长度泛化,即从短上下文外推到更长上下文的能力,已在Transformer中被广泛研究。本文聚焦于距离泛化…… NuhaSpeech:构建通用阿拉伯语语音LLM — 随着语音大语言模型(speechLLMs)的多语种能力不断增强,阿拉伯语仍明显代表性…
Lilian Weng (Lil'Log) · RSS 摘要
面向自我改进的 Harness 工程 — 递归自我改进(RSI)的概念可追溯至 I. J. Good(1965),他将"超智能机器"定义为能够在所有方面超越人类的系统…… 谨慎对待 Scaling Laws — Scaling laws 是深度学习中最重要的经验发现之一。其观察形式简洁:当我们扩大模型…… 我们为何思考…
Cool Papers · cs.IR (papers.cool) · RSS 摘要
生成式晚期交互嵌入用于视觉文档检索 — 晚期交互检索是视觉文档搜索的 SOTA 方法,但其精度以存储为代价。现有压缩方法保留子集或局部平均…… 你的检索器已经知道:面向 RAG 检索充分性的分布形状 QPP — 标准 RAG 流水线通常无法在推理时提供检索是否成功的可靠信号;在模糊或超出范围的查询上,生成器…… Fed…
Simon Willison · RSS 摘要
commitrewriter 0.1 — 发布:commitrewriter 0.1。前几天我写了这个小 Web 应用,用来编辑 Datasette 安全发布的 commit 信息。最初的 commit 信息中充斥着编码…… shotscraper 1.12 — 发布:shotscraper 1.12。为我的截图自动化…
Nathan Benaich (State of AI) · RSS 摘要
欧洲无法通过租赁方式实现 AI 主权 — 当华盛顿能够一夜之间禁用某个模型时,问题不在于 AI 是否安全,而在于谁掌控它。 State of AI:2026 年 5 月 — 2026 年 4 月:AISI 的网络阈值、Microsoft 与 OpenAI 重置、中国开源权重模型实现代码能力持平、Agent 走入真实市场…
ByteByteGo · RSS 摘要
EP225:为什么 Git Revert 会引发冲突? — git revert 看起来很简单,直到它抛出冲突。 学习 Claude Code、evals、AI 系统等:ByteByteGo Live 上线了。 — 大多数在线课程从未被学完(完成率约 4%)。直播课程完成率约 40%,高出近 10 倍。直播课程是人们唯…