Jay
浏览全部笔记 · 593 篇 · 工程实践 · CSDN · 开源动态
Fireship (YouTube) · RSS 摘要
Meta 的新模型想要对你的个人生活进行"深度访问"…… 我在 MIT 待了三天……机器人炒作比你想象的更甚 最安全的 Bitcoin 存储方式刚刚被攻破…… Anthropic 刚刚扼杀了独立开发者吗……? 历史上最有趣的"hack"……
Andrej Karpathy (YouTube) · RSS 摘要
我如何使用 LLMs 深入理解像 ChatGPT 这样的 LLMs 让我们复现 GPT2 (124M) 让我们构建 GPT Tokenizer [[1小时讲座] Large Language Models 入门](
Import AI (Jack Clark) · RSS 摘要
Import AI 468:23 个 RSI 构想;PostTrainBench+;信任与透明度如何与 AI 竞赛相互交织 — 你会选择哪个星系? Import AI 467:自持型 AI 病毒;AI 发展节奏的调控;对 AI 与创造力的困惑 — 我们何时建造月球生态城? Import AI 466:机器人领域的"苦涩…
Microsoft Research Blog · RSS 摘要
MindTopo 揭示 VLM 的空间推理能力 — 一条路、一道围栏、一个结。MindTopo 为测试 AI 理解拓扑关系建立了新基准,并凸显了强化空间推理的新机遇…… CAREX 介绍:迈向临床实用的放射学 VLM,融合辅助监督、奖励对齐学习与工具增强测量 — 放射学 AI 正超越报告生成。CAREX 探索统一方法,…
Lilian Weng (Lil'Log) · RSS 摘要
Harness 工程与自我改进 — 递归自我改进(RSI)的概念最早可追溯至 I. J. Good(1965),他将"超智能机器"定义为一种能够在所有方面超越人类的系统…… 谨慎看待 Scaling Laws — Scaling laws 是深度学习中最关键的实证发现之一。该观察形式简洁:随着模型规模扩大,训练损失 $…
Cool Papers · cs.IR (papers.cool) · RSS 摘要
让协同信号发挥作用:面向序列推荐的图感知大语言模型 — LLM 已被广泛用作推荐系统的主干网络。然而其以语言为中心的预训练方式难以捕捉协同… 面向生成式文档检索的 token 级信用分配优化 — 生成式检索模型通过自回归生成文档标识(DocID)来完成文档检索。该过程天然构成序贯决策问题,其中… HCGRec:基于 S…
Cool Papers · cs.CL (papers.cool) · RSS 摘要
结构性沉默:当 AI 基础设施辜负低资源语言使用者时 — AI 教育与语言支持工具日益被定位为可扩展方案,用于弥合资源不足社区的可及性差距。然而,相关基础设施…… 用于检测公共采购中指控性语言的级联无监督监督 NLP 流水线 — 公共采购涉及大额财政资源分配,因此需要通过审计、控制与监督机制进行持续监管。然…… 一个冻…
Nathan Benaich (State of AI) · RSS 摘要
欧洲无法通过租赁实现 AI 主权 — 当华盛顿可以一夜之间禁用某个模型时,问题已不在于 AI 是否安全,而在于谁掌控它。 AI 现状:2026 年 5 月 — 2026 年 4 月:AISI 的网络门槛、Microsoft 与 OpenAI 重置、中国开源权重模型的编程能力对等、Agent 落地真实市场,以及 Open…
ByteByteGo · RSS 摘要
API组合技术详解指南 — 本文将深入探讨API组合问题及其相关模式。 GitHub vs Vercel vs Replit:当AI代码成本降低时,开发平台何去何从 — AI模型已在很大程度上解决了软件开发中的代码编写问题。 Cloudflare如何让AI为内容付费 — 本文将从以下五个步骤介绍Cloudflare的解…
Simon Willison · RSS 摘要
sqliteutils 4.2.1 — 发布:sqliteutils 4.2.1 修复 sqliteutils 4.2 中的一个崩溃 bug。引入的代码类似 from typing_extensions import Self,结果 typingextensi… sqliteutils 4.2 — 发布:sqliteu…
Sebastian Raschka (Ahead of AI) · RSS 摘要
在 LLM 中控制推理强度 — LLM 如何学习低、中、高强度的推理模式 使用本地 Coding Agent — 将开源权重模型用于本地 Coding Harness,作为 Claude Code 和 Codex 订阅的替代方案 LLM 研究论文:2026 年清单(1 月至 5 月) — 今年值得关注的 LLM 研究论…
Fireship (YouTube) · RSS 摘要
Meta 的新模型想要"深度访问"你的个人生活…… 我在 MIT 待了 3 天……机器人炒作比你想象的更糟糕 最安全的比特币存储方式刚刚被攻破…… Anthropic 是否刚刚扼杀了独立开发者……? 历史上最有趣的"黑客事件"……
Andrej Karpathy (YouTube) · RSS 摘要
我如何使用 LLMs 深入剖析像 ChatGPT 这样的 LLMs 复现 GPT2 (124M) 构建 GPT Tokenizer [[1小时演讲] Large Language Models 简介](
Import AI (Jack Clark) · RSS 摘要
Import AI 468:23 个 RSI 构想;PostTrainBench+;以及信任与透明度如何与 AI 竞赛相互作用 — 你将选择哪颗星系? Import AI 467:自我维持的 AI 病毒;AI 发展节奏的把握;对 AI 与创造力的困惑 — 我们何时建造月球方舟? Import AI 466:机器人领域的…
Lilian Weng (Lil'Log) · RSS 摘要
自改进的 Harness 工程 — 递归自改进(RSI)概念可追溯至 I. J. Good (1965),他将"超智能机器"定义为一种能在所有方面超越人类的…… 谨慎看待 Scaling Laws — Scaling laws 是深度学习中最关键的实证发现之一。其观察形式简洁:随模型规模扩大,训练损失 $L$ 可预测地…
Microsoft Research Blog · RSS 摘要
MindTopo 揭示 VLM 的空间推理能力 — 一条路径、一道围栏、一个绳结。MindTopo 为测试 AI 如何理解拓扑关系设立了新基准,并凸显了增强空间推理能力的新机遇…… CAREX:面向临床可用的放射学 VLM,融合辅助监督、奖励对齐学习与工具增强测量 — 放射学 AI 正在超越报告生成阶段。CAREX 探…
Cool Papers · cs.IR (papers.cool) · RSS 摘要
我们真的在群组推荐上取得进展了吗?——揭开平局打破的错觉 — 近期群组推荐方法在标准基准上报告了显著提升,但这些增益是否真正反映建模能力的进步仍不明确…… 个性在对话式信息寻求中的作用 — LLM 越来越多地被用于信息寻求场景,用户通过对话查找、对比和评估信息。在此角色下,助手会…… 面向专利匹配的自知识检索增强生成框…
Cool Papers · cs.CL (papers.cool) · RSS 摘要
ConVAWG:一个用于针对妇女和女童暴力领域受控合成对话生成的检索增强框架 — 合成对话生成为研究敏感领域中的对话动态提供了一种途径,因为这些领域的真实数据难以获取、发布或标注。潜在的虐… 从可解释性到控制:TrustNLP Workshop 六年的洞察 — 可信赖自然语言处理 Workshop(TrustNLP)自…
Nathan Benaich (State of AI) · RSS 摘要
欧洲无法通过租赁实现 AI 主权 — 当华盛顿能在一夜之间禁用某个模型时,问题已不在于 AI 是否安全,而在于谁在掌控它。 State of AI:2026 年 5 月 — 2026 年 4 月:AISI 的网络阈值、Microsoft 与 OpenAI 重置、中国开源权重模型的代码能力对等、Agent 走入真实市场,…
ByteByteGo · RSS 摘要
GitHub vs Vercel vs Replit:当 AI 代码变得廉价时,开发平台该如何应对 — AI 模型已经在很大程度上解决了软件开发中编写代码的部分。 Cloudflare 如何让 AI 为内容付费 — 本文将分以下五个步骤介绍 Cloudflare 的解决方案。 如何对抗标题党:Meta、LinkedIn…
Sebastian Raschka (Ahead of AI) · RSS 摘要
控制 LLM 的推理投入程度 — LLM 如何学习低、中、高投入程度的推理模式 使用本地 Coding Agent — 在本地 Coding Harness 中使用开源权重模型,作为 Claude Code 和 Codex 订阅的替代方案 LLM 研究论文:2026 年清单(1 月至 5 月) — 今年值得关注的 LL…
Simon Willison · RSS 摘要
DeepSeek V4 Pro 0813(在 OpenRouter 上) — DeepSeek V4 Pro 0813(在 OpenRouter 上)最新的 DeepSeek Pro 模型现已发布,仅可通过 API 使用。需链接到 OpenRouter,是因为 DeepSeek 没有任何明显的发布公告…… 引用 Flo…
Fireship (YouTube) · RSS 摘要
我在 MIT 待了 3 天……机器人炒作比你想象的更糟 最安全的比特币存储方式刚刚被攻破…… Anthropic 是不是刚刚杀死了 indie hacker…… 史上最有趣的"黑客操作"…… 开源权重 AI 刚刚达到 2.8 万亿参数……
Andrej Karpathy (YouTube) · RSS 摘要
我如何使用 LLM 深入剖析 ChatGPT 这类 LLM 复现 GPT2(124M) 构建 GPT Tokenizer [[1小时讲座] 大语言模型入门](
Import AI (Jack Clark) · RSS 摘要
Import AI 468:23 个 RSI 思路;PostTrainBench+;信任与透明度如何与 AI 竞赛相互影响 — 你将选择哪个星系? Import AI 467:自我维持的 AI 病毒;AI 进展的节奏;关于 AI 与创造力的困惑 — 我们何时建造月球 arcology? Import AI 466:机器…
Cool Papers · cs.CL (papers.cool) · RSS 摘要
从价值观到基准:评估 LLM 在荷兰语政府场景中的应用 — LLM 正日益部署于政府场景,但现有评估框架鲜少同时反映公共行政价值观以及…… 解码级禁忌:LLM 鲁棒性的诊断压力测试 — LLM 评估通常聚焦于标称条件下的性能,营造出一种能力假象——模型在一条狭窄、高度优化的路径上从容行走…… 无验证器测试时缩放中的会聚…
Cool Papers · cs.IR (papers.cool) · RSS 摘要
LLM 重排器中 Listwise CrossEncoder 微调与 Agentic 指令微调的对比研究:医疗流程重排中的系统化分析 — 针对患者查询对医疗流程进行重排是健康保险信息检索中的关键环节,由于患者表述与医疗术语之间存在显著的词汇鸿沟,该任务尤为复杂…… IntHQ:基于双流表征的任务交互式分层查询用于生成式…
Lilian Weng (Lil'Log) · RSS 摘要
面向自我改进的 Harness 工程 — 递归自我改进(RSI)的概念可追溯至 I. J. Good (1965),他将"超级智能机器"定义为一种在所有方面都能超越人类的系统…… 谨慎看待 Scaling Laws — Scaling laws 是深度学习中最重要的经验发现之一:其形式简洁——随着模型规模的扩大,训练损…
Microsoft Research Blog · RSS 摘要
介绍 CAREX:迈向临床实用的放射学 VLM,融合辅助监督、奖励对齐学习与工具增强测量 — 放射学 AI 正超越报告生成的范畴。CAREX 探索一种统一方法,结合灵活的推理、校准的预测以及基于测量的工具,用于…… Orchard:面向可扩展 Agent AI 的开放框架 — Orchard 是一个开源框架,供研究社区…
Nathan Benaich (State of AI) · RSS 摘要
欧洲无法通过租赁实现 AI 主权 — 当华盛顿能够一夜之间禁用某个模型时,问题不在于 AI 是否安全,而在于谁掌控它。 State of AI:2026 年 5 月 — 2026 年 4 月:AISI 网络安全阈值、Microsoft 与 OpenAI 关系重置、中国开源权重模型实现代码能力对等、Agent 走向真实市…