Jay
浏览全部笔记 · 593 篇 · 工程实践 · CSDN · 开源动态
Sebastian Raschka (Ahead of AI) · RSS 摘要
Claude 如何给 AI 生成文本打水印 — 一段 48 分钟的视频讲解,覆盖 token 采样、水印检测与移除 从零构建一个 AI 文本检测器 — 一个端到端项目:包含数据集构建、模型训练、本地部署与 RLVR 控制 LLM 的推理强度 — LLM 如何学习低、中、高强度推理模式 使用本地 Coding Agent…
Cool Papers · cs.CL (papers.cool) · RSS 摘要
ConceptGuard:面向大语言模型上下文敏感遗忘的基准评测 — 大语言模型(LLM)越来越需要选择性地移除有害或敏感知识,即遗忘机制,但现有方法和基准未能有效评估这一点…… GCARL:面向以患者为中心的医学报告解读的、基于检查清单对齐的奖励学习 — 针对医学报告的个性化解读已成为患者日益迫切的需求。满足该需求既…
Nathan Benaich (State of AI) · RSS 摘要
欧洲无法靠租赁实现 AI 主权 — 当华盛顿能在一夜之间禁用某个模型时,问题的关键不在于 AI 是否安全,而在于谁在控制它。 State of AI:2026 年 5 月 — 2026 年 4 月:AISI 的网络阈值、Microsoft 与 OpenAI 的关系重置、中国开源权重模型的编程能力对等、Agent 接触真…
Fireship (YouTube) · RSS 摘要
DeepSeek 重返战场... 硅谷为之胆寒 数学被机器击败的那个夏天... 这家新创公司可以查询你去过的任何地方... Meta 新模型要求对你的个人生活拥有"深度访问"权限... 我在 MIT 待了三天... 机器人的炒作比你想的更离谱
Andrej Karpathy (YouTube) · RSS 摘要
我如何使用 LLMs 深入剖析像 ChatGPT 这样的 LLMs 让我们复现 GPT2 (124M) 让我们构建 GPT Tokenizer [[1小时讲座] 大语言模型入门](
Import AI (Jack Clark) · RSS 摘要
Import AI 469:Science AI;RSI 模拟器;以及 Zuck 的技术悲观主义 — AI 的新前沿是开发有能力的自主研究智能体 Import AI 468:23 个 RSI 构想;PostTrainBench+;以及信任与透明度如何与 AI 竞赛相互影响 — 你将选择哪一片星系? Import AI …
Microsoft Research Blog · RSS 摘要
拓展 Skala 的可及性,为预测性 DFT 铺就更快的路径 — 微软研究院推出的更新版深度学习交换关联泛函 Skala 1.1,在精度与计算化学领域的可及性上均有提升…… MindTopo 揭示 VLM 的空间推理能力 — 一条小径、一道围栏、一个绳结。MindTopo 为测试 AI 对拓扑关系的理解设立新基准,并展…
Lilian Weng (Lil'Log) · RSS 摘要
面向自我改进的 Harness 工程 — 递归自我改进(RSI)的概念最早可追溯至 I. J. Good(1965),他将"超智能机器"定义为在所有智力活动上均能超越人类的系统…… 谨慎看待 Scaling Laws — Scaling laws 是深度学习中最重要的实证发现之一。其形式简洁:随着模型规模……的扩大,训…
Simon Willison · RSS 摘要
llm 0.32.1 — 发布:llm 0.32.1 几天前 LLM 的全新安装突然无法使用,原因是 OpenAI Python 库放弃了对 httpx 的使用,而 LLM 恰好依赖该库…… llmopenrouter 0.7 — 发布:llmopenrouter 0.7 该插件现已兼容 LLM 0.32,与通过 Op…
Nathan Benaich (State of AI) · RSS 摘要
欧洲无法通过租用方式实现 AI 主权 — 当华盛顿可以一夜之间禁用某个模型时,问题已不是 AI 是否安全,而是由谁掌控。 State of AI:2026 年 5 月 — 2026 年 4 月:AISI 的网络门槛、Microsoft 与 OpenAI 重置、中国开源权重模型的代码能力对等、Agent 走进真实市场,以…
Cool Papers · cs.IR (papers.cool) · RSS 摘要
将 BrowseCompPlus 投影到 ClimbMix:迈向更真实的 Agentic 搜索语料库 — BrowseCompPlus 基准通过用固定语料库替换不透明的网络搜索,解耦了 Agentic 搜索的评估,从而可将 Agent 的角色与检索器的角色分离…… 怎样的 Fiqh 检索器才算好?面向阿拉伯语伊斯兰教法…
Cool Papers · cs.CL (papers.cool) · RSS 摘要
ConceptGuard: 大语言模型中上下文敏感遗忘的基准评测 — 大语言模型(LLMs)越来越需要对有害或敏感知识进行选择性移除(即遗忘),然而现有方法和基准未能有效评估这一点…… GCARL: 面向患者导向的医疗报告解读的基于检查清单对齐的奖励学习 — 患者对医疗报告的个性化解读需求日益凸显。满足这一需求既需要基…
Sebastian Raschka (Ahead of AI) · RSS 摘要
从零构建 AI 文本检测器 — 包含数据集构建、模型训练、本地部署和 RLVR 的端到端项目 控制 LLM 的推理力度 — LLM 如何学习低、中、高力度推理模式 使用本地编码 Agent — 在本地编码工具中使用开源权重模型,作为 Claude Code 和 Codex 订阅的替代方案 LLM 研究论文:2026 年…
ByteByteGo · RSS 摘要
Schema Evolution:在不破坏现有运行的前提下修改契约 — 本文将介绍 schema evolution 及其相关策略。 GraphRAG:AI 如何回答隐藏在多份文档中的问题 — GraphRAG 正是为应对第二类问题而设计的,本文将详细介绍它。 全新美国 AI 模型,主打可定制化 — 本文将梳理 Thi…
Fireship (YouTube) · RSS 摘要
DeepSeek 重返舞台……硅谷为之震动 这个夏天,数学领域也沦陷于机器之手…… 这家新创公司可查询你曾到过的任何地方…… Meta 新模型要求获取你个人生活的"深度访问权限"…… 我在 MIT 待了三天……机器人炒作比你想象的更严重
Andrej Karpathy (YouTube) · RSS 摘要
我如何使用 LLM 深入理解像 ChatGPT 这样的 LLM 让我们复现 GPT2(124M) 让我们构建 GPT Tokenizer [[1小时讲座] 大语言模型入门](
Import AI (Jack Clark) · RSS 摘要
Import AI 469:Science AI;RSI 模拟器;以及 Zuck 的技术悲观主义 — AI 的新前沿是开发有能力的自主研究员 Import AI 468:23 个 RSI 创意;PostTrainBench+;以及信任与透明度如何与 AI 竞赛相互影响 — 你会选择哪个星系? Import AI 467…
Cool Papers · cs.IR (papers.cool) · RSS 摘要
rEDMRec: 将大语言模型推理蒸馏为可编辑经验记忆用于推荐 — 大语言模型能够通过对用户历史和候选物品进行显式推理来提升推荐质量,例如提取用户偏好或解释…… ThinktoPersonalize: 统一推理与检索以实现以用户为中心的个性化稠密检索 — 稠密检索通过将查询和物品编码到语义嵌入空间,已成为现代本地生活电…
Microsoft Research Blog · RSS 摘要
扩展 Skala 的访问性,为预测性 DFT 提供了一条更快路径 — Microsoft Research 推出的更新版深度学习交换相关泛函 Skala 1.1,在计算化学领域提供了更高的准确性和更广泛的访问性 MindTopo 揭示 VLM 的空间推理能力 — 一条路径、一道围栏、一个绳结。MindTopo 为测试 …
Lilian Weng (Lil'Log) · RSS 摘要
自我改进的 Harness 工程 — 递归自我改进(RSI)的概念可追溯至 I. J. Good(1965),他将"超智能机器"定义为能够超越人类的系统…… 谨慎对待 Scaling Laws — Scaling laws 是深度学习中最关键的实证发现之一。其观察形式简洁:随着模型规模扩大,训练损失 $L$ 可预测地下…
Nathan Benaich (State of AI) · RSS 摘要
欧洲无法靠租赁获得 AI 主权 — 当华盛顿能一夜禁用某个模型时,问题不再是 AI 是否安全,而是谁掌控它。 AI 现状:2026 年 5 月 — 2026 年 4 月:AISI 网络阈值、微软与 OpenAI 关系重启、中国开源权重模型代码能力追平、Agent 走入真实市场,以及 OpenAI 拿下 1220 亿美元…
Cool Papers · cs.CL (papers.cool) · RSS 摘要
SPADE: SelfPlay in Adaptive Synthetic Executable Environments — Continuous selfimprovement requires an everexpanding pool of selfgenerated, diverse, adaptive go…
Sebastian Raschka (Ahead of AI) · RSS 摘要
从零构建 AI 文本检测器 — 端到端项目:涵盖数据集构建、模型训练、本地部署与 RLVR 控制 LLM 的推理强度 — LLM 如何学习低、中、高强度推理模式 使用本地 Coding Agent — 在本地 Coding Harness 中使用开源权重模型,作为 Claude Code 与 Codex 订阅的替代方案…
Simon Willison · RSS 摘要
ChatGPT 搜索现在大规模使用 site: 操作符 — ChatGPT 搜索现在大规模使用 site: 操作符。Promptwatch 属于新兴的"GEO"(生成式引擎优化)领域,即聊天机器人时代的 SEO 版本…… 基于 Bun 1.4 新版 Bun.WebView 的 shotscraper 风格 JSON A…
ByteByteGo · RSS 摘要
Schema Evolution:在不破坏现有运行的前提下变更契约 — 本文将介绍 schema evolution 及其应对策略。 GraphRAG:AI 如何回答散落多份文档中的问题 — GraphRAG 正是为应对第二类问题而设计,本文将进一步展开介绍。 一款专为定制化而生的美国新 AI 模型 — 本文将剖析 T…
Fireship (YouTube) · RSS 摘要
那个夏天,数学沦陷于机器之手…… 这家初创公司可查询你到过的任何地方…… Meta 新模型要求"深度访问"你的个人生活…… 我在 MIT 待了 3 天……机器人炒作比你想象的更甚 最安全的比特币存储方式刚刚被攻破……
Andrej Karpathy (YouTube) · RSS 摘要
我如何使用 LLMs 深入理解像 ChatGPT 这样的 LLMs 复现 GPT2 (124M) 构建 GPT Tokenizer [[1小时讲座] 大语言模型简介](
Lilian Weng (Lil'Log) · RSS 摘要
Harness 工程实现自我改进 — 递归自我改进(RSI)的概念最早由 I. J. Good(1965)提出,他将"超智能机器"定义为能够在所有方面超越人类的系统…… 谨慎看待 Scaling Laws — Scaling laws 是深度学习领域最重要的实证发现之一。其观察形式简单:随着模型规模扩大,训练损失 L …
Import AI (Jack Clark) · RSS 摘要
Import AI 469:科研AI;RSI模拟器;以及扎克伯格的技术悲观主义 — AI的新前沿是开发有能力的自主研究者 Import AI 468:23个RSI构想;PostTrainBench+;信任与透明如何与AI竞赛相互影响 — 你将选择哪一个星系? Import AI 467:自我维持的AI病毒;AI进步节奏…
Microsoft Research Blog · RSS 摘要
MindTopo 揭示了 VLM 的空间推理能力 — 一条路径、一道围栏、一个绳结。MindTopo 为测试 AI 如何理解拓扑关系设立了新基准,并凸显了增强空间推理能力的新机遇…… 推出 CAREX:迈向临床实用的放射学 VLM,融合辅助监督、奖励对齐学习与工具增强测量 — 放射学 AI 正超越报告生成范畴。CARE…