Jay
浏览全部笔记 · 593 篇 · 工程实践 · CSDN · 开源动态
Import AI (Jack Clark) · RSS 摘要
Import AI 468:23 个 RSI 思路;PostTrainBench+;以及信任与透明度如何与 AI 竞赛相互影响 — 你会选择哪个星系? Import AI 467:自持型 AI 病毒;AI 进展节奏;关于 AI 与创造力的困惑 — 我们何时建造月球生态穹顶城? Import AI 466:机器人领域的 …
Cool Papers · cs.IR (papers.cool) · RSS 摘要
先结构化再查询:实现对非结构化文档的精确分析查询 — 非结构化文档构成了企业和网络数据的大部分。随着大语言模型(LLM)的快速发展,研究人员开始构建数据系统…… 多轮 RAG 何时停止?面向 SearchR1 的结构化停止判断与检索削减 — 多轮检索增强生成(RAG)需要在证据不断累积时判断何时停止搜索。由于已部署策略…
Microsoft Research Blog · RSS 摘要
MindTopo 揭示 VLM 的空间推理能力 — 一条路径、一道围栏、一个绳结。MindTopo 为测试 AI 对拓扑关系的理解设立了新基准,并展现了增强空间推理的新机遇…… CAREX:迈向临床可用的放射科 VLM,融合辅助监督、奖励对齐学习与工具增强测量 — 放射科 AI 正超越报告生成阶段。CAREX 探索融合…
Lilian Weng (Lil'Log) · RSS 摘要
Harness 工程与自我改进 — 递归自我改进(RSI)的概念最早可追溯至 I. J. Good (1965),他将"超级智能机器"定义为在所有方面都能超越人类的系统…… 谨慎看待 Scaling Laws — Scaling laws 是深度学习中最关键的实证发现之一。其观察形式很简单:随着模型规模扩大,训练损失 …
Nathan Benaich (State of AI) · RSS 摘要
欧洲无法靠租用实现 AI 主权 — 当华盛顿能够一夜之间禁用某个模型时,关键问题已不在于 AI 是否安全,而在于由谁掌控。 AI 现状:2026 年 5 月 — 2026 年 4 月:AISI 的网络安全门槛、微软与 OpenAI 关系重置、中国开源权重模型代码能力追平、Agent 走入真实市场,以及 OpenAI 斩…
Cool Papers · cs.CL (papers.cool) · RSS 摘要
LittleLearner:教学受控知识暴露下的语言模型 — 现代语言模型在异构的 web 规模文本语料上训练。因此,研究知识与技能的习得十分困难,因为模型可能对相关内容已有先验接触…… SAEVerbalizer:通过表征语言化生成稀疏自编码器特征的解释 — 稀疏自编码器(SAEs)被提出用于从大语言模型(LLM)表…
Simon Willison · RSS 摘要
Markdown SVG 升级 — 我从五月开始构建 markdownsvgrenderer 工具,但此后我又添加了足够多的功能,值得在此再次介绍。它已演变成我理想的工具,用于 s…… Qwen 3.8 27B 表现优异,但默认情况下会严重过度思考 — 周五的重磅发布是 Qwen 3.8 27B,一款来自阿里巴巴 Qw…
ByteByteGo · RSS 摘要
EP222: 什么是 Google 的 TPU? — TPU(Tensor Processing Unit,张量处理单元)是 Google 自研的 AI 芯片,从零开始设计,专门用于支撑现代模型依赖的海量矩阵乘法计算。GPU 最初是为图形…… API 组合技术详解 — 本文将深入探讨 API 组合问题及其相关模式。 G…
Sebastian Raschka (Ahead of AI) · RSS 摘要
从零构建 AI 文本检测器 — 端到端项目:涵盖数据集构建、模型训练、本地部署与 RLVR 控制 LLM 的推理力度 — LLM 如何学习低、中、高强度推理模式 使用本地 Coding Agent — 在本地 Coding Harness 中使用开源权重模型,作为 Claude Code 与 Codex 订阅的替代方案…
Fireship (YouTube) · RSS 摘要
这家新创公司可以查询你去过的任何地方... Meta 的新模型想要"深度访问"你的个人生活... 我在 MIT 待了 3 天...机器人炒作比你想象的更糟 最安全的 Bitcoin 存储方式刚刚被攻破... Anthropic 刚刚扼杀了独立开发者吗...?
Microsoft Research Blog · RSS 摘要
MindTopo 揭示 VLM 的空间推理能力 — 一条小路、一道围栏、一个绳结。MindTopo 为测试 AI 理解拓扑关系设立了新基准,并凸显了强化空间推理方面的新机会…… 介绍 CAREX:迈向具备辅助监督、奖励对齐学习与工具增强测量的临床实用放射学 VLM — 放射学 AI 正超越报告生成阶段。CAREX 探索…
Import AI (Jack Clark) · RSS 摘要
Import AI 468: 23 个 RSI 想法;PostTrainBench+;信任与透明度如何与 AI 竞赛相互作用 — 你会选择哪个星系? Import AI 467: 自我维持的 AI 病毒;AI 进展节奏;关于 AI 与创造力的困惑 — 我们何时建造月球生态穹顶? Import AI 466: 机器人的 …
Lilian Weng (Lil'Log) · RSS 摘要
Harness 工程与自我改进 — 递归自我改进(RSI)的概念可追溯至 I. J. Good(1965),他将"超智能机器"定义为…… 谨慎看待 Scaling Laws — Scaling laws 是深度学习领域最重要的实证发现之一。其形式简洁:训练损失 L 随模型规模…… 为何而思 — 特别感谢 John Sc…
Cool Papers · cs.CL (papers.cool) · RSS 摘要
LittleLearner: 教学受控知识暴露下的语言模型 — 现代语言模型在异构的网络规模文本语料上进行训练。因此,研究知识与技能的习得十分困难,因为对相关内容的先前暴露…… SAEVerbalizer: 通过表征语言化生成稀疏自编码器特征的解释 — 稀疏自编码器(SAE)被提出用于从大语言模型(LLM)表征中提取大…
Cool Papers · cs.IR (papers.cool) · RSS 摘要
先结构化再查询:支持对非结构化文档的精确分析查询 — 非结构化文档构成了企业与 Web 数据的主体。随着大语言模型(LLM)的快速发展,研究人员已开始构建数据系统…… 多轮 RAG 应在何时停止?SearchR1 中的结构化停止判断与检索缩减 — 多轮检索增强生成(RAG)需要在证据不断累积的过程中决定何时停止检索。由…
Nathan Benaich (State of AI) · RSS 摘要
欧洲无法通过租用实现 AI 主权 — 当华盛顿可以一夜之间禁用某个模型时,问题不再是 AI 是否安全,而是谁在控制它。 AI 现状:2026 年 5 月 — 2026 年 4 月:AISI 的网络门槛、Microsoft 与 OpenAI 的重置、中国开源权重模型的代码能力对等、Agent 走向真实市场,以及 Open…
Simon Willison · RSS 摘要
CORS Chat — 工具:CORS Chat。今天用 GPT5.6Sol xhigh 构建,用于测试运行在 LM Studio 上的 Qwen 3.8 27B,分别部署于 M5 MacBook Pro 和 NVIDIA DGX Spark,提供 Web UI … 北方塘鹅(Northern Gannet) — 北方…
Sebastian Raschka (Ahead of AI) · RSS 摘要
从零构建 AI 文本检测器 — 涵盖数据集构建、模型训练、本地部署和 RLVR 的端到端项目 控制 LLM 的推理力度 — LLM 如何学习低、中、高力度推理模式 使用本地 Coding Agent — 在本地 Coding Harness 中使用开源权重模型,作为 Claude Code 和 Codex 订阅的替代方…
ByteByteGo · RSS 摘要
EP222: 什么是 Google 的 TPU? — TPU(Tensor Processing Unit,张量处理单元)是 Google 自研的 AI 芯片,从零开始为现代模型所依赖的大规模矩阵乘法运算而设计。GPU 最初是为图形处理而构建的…… API 组合技术详解 — 本文将深入探讨 API 组合问题及其相关模式…
Fireship (YouTube) · RSS 摘要
这家新创公司可以查询你去过的任何地方…… Meta 的新模型想要"深度访问"你的个人生活…… 我在 MIT 待了 3 天……机器人炒作比你想象的更离谱 最安全的比特币存储方式刚刚被攻破…… Anthropic 是不是刚刚杀死了独立开发者……?
Andrej Karpathy (YouTube) · RSS 摘要
我是如何使用 LLMs 的 像 ChatGPT 这类 LLM 的深度剖析 让我们复现 GPT2 (124M) 让我们构建 GPT 分词器 [[1小时演讲] 大语言模型入门](
Microsoft Research Blog · RSS 摘要
MindTopo 揭示 VLM 的空间推理能力 — 一条路径、一道围栏、一个结。MindTopo 为测试 AI 理解拓扑关系的能力设立新基准,并指出加强空间推理的新机会…… 介绍 CAREX:迈向临床可用的放射学 VLM,融合辅助监督、奖励对齐学习与工具增强测量 — 放射学 AI 正在超越报告生成阶段。CAREX 探索…
Import AI (Jack Clark) · RSS 摘要
Import AI 468:23个RSI想法;PostTrainBench+;以及信任与透明度如何与AI竞赛相互影响 — 你将选择哪个星系? Import AI 467:自维持的AI病毒;控制AI进步节奏;对AI与创造力的困惑 — 我们何时建造月球生态穹顶城? Import AI 466:机器人领域的"苦涩的教训",A…
Lilian Weng (Lil'Log) · RSS 摘要
面向自我改进的 Harness 工程 — 递归自我改进(RSI)的概念可追溯至 I. J. Good(1965),他将"超智能机器"定义为能够在所有智力活动上超越人类的系统…… 审慎对待 Scaling Laws — Scaling laws 是深度学习中最关键的实证发现之一。其观察形式很简单:随着模型规模……训练损失…
Cool Papers · cs.CL (papers.cool) · RSS 摘要
LittleLearner:教学控制知识暴露下的语言模型 — 现代语言模型在异构的网页规模文本语料库上训练。因此,研究知识与技能的获取较为困难,因为对相关内容的先前暴露…… SAEVerbalizer:通过表征语言化为稀疏自编码器特征生成解释 — 稀疏自编码器(SAE)被提出用于从大语言模型(LLM)表征中提取大量特征…
Cool Papers · cs.IR (papers.cool) · RSS 摘要
先结构化后查询:支持对非结构化文档的精确分析型查询 — 非结构化文档构成了企业和 Web 数据的主体。随着大语言模型(LLMs)的快速发展,研究人员已开始构建数据系统…… 多轮 RAG 应何时停止?SearchR1 中的结构化停止判断与检索缩减 — 多轮检索增强生成(RAG)必须在证据不断累积的过程中决定何时停止搜索。…
Nathan Benaich (State of AI) · RSS 摘要
欧洲无法靠租用实现 AI 主权 — 当华盛顿可以一夜之间禁用某个模型时,问题不在于 AI 是否安全,而在于谁在控制它。 State of AI:2026 年 5 月 — 2026 年 4 月:AISI 的网络阈值、Microsoft 与 OpenAI 的关系重置、中国开源权重模型的代码能力持平、Agent 走向真实市场…
Simon Willison · RSS 摘要
不要分类。直接幻觉生成! — 不要分类。直接幻觉生成!我博客上仍有不少较旧的内容没来得及打标签。我的博客有 1,856 个标签——可能太多,没法一次性喂给 LLM…… sqliteutils 4.2.1 — 发布:sqliteutils 4.2.1,修复 sqliteutils 4.2 中的一个崩溃 bug。我曾引入类…
ByteByteGo · RSS 摘要
API 组合技术详解指南 — 本文将深入探讨 API 组合问题及其相关模式。 GitHub vs Vercel vs Replit:当 AI 代码变得廉价时,开发平台在做什么 — AI 模型已在很大程度上解决了软件开发中的代码编写环节。 Cloudflare 如何让 AI 为内容付费 — 本文将按以下五个步骤介绍 Cl…
Sebastian Raschka (Ahead of AI) · RSS 摘要
控制 LLM 中的推理力度 — LLM 如何学习低、中、高力度推理模式 使用本地 Coding Agent — 在本地 Coding Harness 中使用开源权重模型,作为 Claude Code 和 Codex 订阅的替代方案 LLM 研究论文:2026 年清单(1 月至 5 月) — 今年发布的值得关注的 LLM…