Jay
浏览全部笔记 · 604 篇 · 工程实践 · CSDN · 开源动态
Andrej Karpathy (YouTube) · RSS 摘要
我如何使用 LLM 深入理解 ChatGPT 类 LLM 复现 GPT2 (124M) 构建 GPT Tokenizer [[1小时讲座] 大语言模型入门](
Import AI (Jack Clark) · RSS 摘要
Import AI 467: 自我维持的 AI 病毒;AI 发展节奏把控;对 AI 与创造力的困惑 — 我们何时建造月球 arcology? Import AI 466: 机器人领域的 bitter lesson;AI 完成长达一周的编程任务;以及 OpenAI 意外产出的 AI 黑客 — 警钟将持续敲响,直至文明觉醒…
Microsoft Research Blog · RSS 摘要
Orchard:可扩展 agentic AI 的开源框架 — Orchard 是面向研究社区的开源框架,用于跨任务类型训练和评估 AI Agent。它在降低复杂度的同时,支持小模型实现强性能…… Echoverse:面向 computeruse Agent 的深度演进式环境 — Computeruse AI Agent…
Lilian Weng (Lil'Log) · RSS 摘要
Harness 工程与自我改进 — 递归自我改进(RSI)的概念最早可追溯至 I. J. Good(1965),他将"超智能机器"定义为能在所有智能活动上超越人类的系统…… 谨慎看待 Scaling Laws — Scaling laws 是深度学习中最重要的经验性发现之一。其观察形式很简单:随着模型规模的扩大,训练损…
Cool Papers · cs.CL (papers.cool) · RSS 摘要
TokTier: 面向 Agentic LLM 服务的精确有状态 tokenization — LLM 服务系统会缓存 prompt 的 KV 状态,但大多数前端在每次调用时仍对完整请求文本重新 tokenize。这一开销落在编码 Agent 身上——它们会反复重新提交一段很长的转录内容…… 频率结构化意义空间中语言组…
Cool Papers · cs.IR (papers.cool) · RSS 摘要
QASP:查询自适应的鲁棒向量搜索策略 — 向量搜索的一个核心挑战是在最小化计算开销的同时保持稳定的高召回率。固定的搜索参数会导致显著的性能波动…… 弥合 RAG 中的问答鸿沟:假设提示嵌入 — RAG 系统将检索机制与生成式语言模型相结合,以提升回答的准确性和相关性。然而,弥合…… 语言模型彼此一致,却与读者不一致 …
Simon Willison · RSS 摘要
引用 Steve Yegge 的话 — Gas Town 原本打算做成可复用的,但最终我只用它来构建它自身。Gas Town 在 Opus 4.7 上崩溃瓦解了,一直到 4.6 它都运行得很出色。 不要做"肉代理" — 不要做"肉代理"。Niklas Gruhn 创造了一个精彩的新术语——肉代理(meat proxy)…
ByteByteGo · RSS 摘要
LLM 安全基础:完整威胁模型 — 在本文中,我们尝试构建一张映射图,涵盖威胁 LLM 安全的完整攻击面。 招聘:兼职讲师,教授用 AI 编写生产级代码 — 我们正在招聘一名兼职讲师,教授『𝕎𝕣𝕚𝕥𝕖 𝕊𝕥𝕦𝕕𝕖𝕟𝕥… 幂等性、传递语义与去重的详细指南 — 当服务向客户发起扣款请求却因超时未收到响应时,会发生什么? C…
Nathan Benaich (State of AI) · RSS 摘要
欧洲无法靠租用实现 AI 主权 — 当华盛顿能够一夜之间禁用某个模型时,问题已不再是 AI 是否安全,而是谁在掌控它。 AI 现状:2026 年 5 月 — 2026 年 4 月:AISI 的网络安全阈值、Microsoft 与 OpenAI 的关系重置、中国开源权重模型的编程能力对等、Agent 走入真实市场,以及 …
Sebastian Raschka (Ahead of AI) · RSS 摘要
在 LLM 中控制推理力度 — LLM 如何学习低、中、高力度推理模式 使用本地 Coding Agent — 在本地 Coding Harness 中使用开源权重模型,作为 Claude Code 与 Codex 订阅之外的替代方案 LLM 研究论文:2026 年清单(1 月至 5 月) — 本年度值得关注的 LLM…
Fireship (YouTube) · RSS 摘要
Anthropic 刚刚杀死了独立黑客? 史上最有趣的"hack" 开源权重 AI 参数量突破 2.8 万亿 估值 120 亿美元的初创公司终于发布了产品 OpenAI 因抄袭再次被起诉
Andrej Karpathy (YouTube) · RSS 摘要
我如何使用 LLM 深入探究 ChatGPT 这类 LLM 复现 GPT2 (124M) 构建 GPT Tokenizer [[1 小时演讲] 大语言模型入门](
Microsoft Research Blog · RSS 摘要
Echoverse: 面向 computeruse agents 的深度、持续演进环境 — Computeruse AI agents 在邮件、客服等多步骤工作流场景中表现不佳。Echoverse 在真实环境中训练 agents,而非仅仅提供更多训练… EvoLib: 将经验转化为持续演进的知识 — LLMs 并不会仅…
Import AI (Jack Clark) · RSS 摘要
Import AI 466:机器人的苦涩教训;AI 可完成长达一周的编程任务;以及 OpenAI 意外的 AI 黑客 — 警钟会持续敲响,直到文明觉醒 Import AI 465:开源与闭源的差距;Kimi K3;Demis 的大政策计划 — 奇点回望时将被视为一个过渡期 Import AI 464:Fable 编写 …
Lilian Weng (Lil'Log) · RSS 摘要
面向自我改进的 Harness 工程 — 递归自我改进(RSI)的概念最早可追溯至 I. J. Good(1965),他将"超智能机器"定义为在所有方面都能超越人类的系统…… 审慎看待 Scaling Laws — Scaling laws 是深度学习中最关键的实证发现之一。该观察形式简洁:随着模型规模扩大,训练损失 …
Cool Papers · cs.IR (papers.cool) · RSS 摘要
TCASIR:面向科学灵感检索的目标条件抽象学习 — AI for Science 中的科学假设生成通常包含科学灵感检索(SIR)与假设组合两个阶段。现有 SIR 方法对论文进行排序…… CCFormer:面向腾讯工业推荐的跨字段高效交互与层次化序列压缩 — 工业推荐系统近期研究表明,基于 selfattention …
Cool Papers · cs.CL (papers.cool) · RSS 摘要
AskChem:以声明为中心的化学文献综合框架 — 化学文献综合往往需要将散落在多篇文献中的特定发现汇总,而现有文献检索系统主要返回的是排序后的文档…… 诱导语言模型断言自身的意识可恢复人类的信念与价值观 — 对齐大型语言模型以防止其将意识归于自身,却意外地同时改变了其对其他实体"有心智"的表征以及人类的信念…… 多采…
Nathan Benaich (State of AI) · RSS 摘要
欧洲无法通过租用方式实现 AI 主权 — 当华盛顿能在一夜之间禁用某个模型时,问题已不在于 AI 是否安全,而在于谁掌控它。 AI 现状:2026 年 5 月 — 2026 年 4 月:AISI 的网络安全门槛、微软与 OpenAI 的关系重置、中国开放权重模型的编程能力对等、Agent 走向真实市场,以及 OpenA…
Simon Willison · RSS 摘要
condensejson 1.0 — 发布:condensejson 1.0。我在尝试更勇敢地发布 1.0 版本。这个小库已有一年半历史,我做了一些合理且不破坏现有功能的修复… 关于 AI 发展的公开信 — 关于 AI 发展的公开信。我把过去几周公开信的相关总结写进了仅限赞助者的通讯专栏,但决定也在这里分享… 2026…
Sebastian Raschka (Ahead of AI) · RSS 摘要
控制 LLM 的推理力度 — LLM 如何学习低、中、高强度的推理模式 使用本地编码 Agent — 在本地编码工具链中使用开源权重模型,作为 Claude Code 和 Codex 订阅的替代方案 LLM 研究论文:2026 年清单(1 月至 5 月) — 本年度值得关注的 LLM 研究论文精选汇编 LLM 架构的最…
ByteByteGo · RSS 摘要
招聘:兼职讲师,教授使用 AI 编写生产级代码 — 我们正在为"编写生产级代码与 AI"课程招聘一名兼职讲师(部分文字因编码问题无法正常显示) 幂等性、传递语义与去重的详细指南 — 当服务发送扣款请求却超时且无响应时,会发生什么? ChatGPT 如何优化其 Agent 循环:框架、API 与推理 — 为探究前沿实验室…
Fireship (YouTube) · RSS 摘要
Anthropic 是否刚刚杀死了独立开发者? 史上最有趣的 “hack”…… 开源权重 AI 参数规模突破 2.8 万亿…… 这家估值 120 亿美元的创业公司终于发布了产品…… OpenAI 再因 “窃取” 被起诉……
Andrej Karpathy (YouTube) · RSS 摘要
我如何使用 LLM 深入理解像 ChatGPT 这样的 LLM 让我们复现 GPT2 (124M) 让我们构建 GPT Tokenizer [[1小时讲座] 大语言模型入门](
Import AI (Jack Clark) · RSS 摘要
Import AI 466:机器人领域的"苦涩教训"、AI 完成长达一周的编程任务,以及 OpenAI 的"意外"AI 黑客 — 警钟将持续敲响,直到文明觉醒 Import AI 465:开源 vs 闭源的差距、Kimi K3、Demis 的大政策计划 — 奇点回望不过是一段"间歇期" Import AI 464:Fa…
Microsoft Research Blog · RSS 摘要
Echoverse:面向 computeruse agents 的深度、持续演进环境 — Computeruse AI agents 在邮件、客户支持等多步骤工作流中表现欠佳。Echoverse 在真实环境中训练 agent,而非仅提供更多训练数据…… EvoLib:将经验转化为持续演进的知识 — LLM 并不会仅凭记…
Lilian Weng (Lil'Log) · RSS 摘要
面向自我改进的 Harness 工程 — 递归自我改进(RSI)的概念可追溯至 I. J. Good (1965),他将"超级智能机器"定义为…… 谨慎看待 Scaling Laws — Scaling laws 是深度学习中最重要的经验性发现之一。该观察形式简洁:随着模型规模……,训练损失 L 会可预测地下降。 我们…
Cool Papers · cs.IR (papers.cool) · RSS 摘要
TCASIR: 学习面向科学灵感检索的目标条件抽象 — AI for Science 的科学假设生成通常包含科学灵感检索(SIR)与后续的假设合成。现有 SIR 方法通过对论文排序…… CCFormer: 面向腾讯工业推荐的高效跨场交互与层级序列压缩 — 工业推荐系统的近期研究表明,基于自注意力的序列推荐模型能够通过……
Simon Willison · RSS 摘要
引用 Greg Brockman — 在 openai,很多人将他们的 chatgpt 接入 slack。当同事的 chatgpt 联系他们请求任务帮助时,人们非常反感,即使他们原本完全…… datasetteapps 0.2a0 — 发布:datasetteapps 0.2a0。通过 Datasette Agent …
Nathan Benaich (State of AI) · RSS 摘要
欧洲无法靠租借实现 AI 主权 — 当华盛顿能一夜之间禁用某个模型时,问题不再是 AI 是否安全,而是谁在控制它。 State of AI:2026 年 5 月 — 2026 年 4 月:AISI 的网络门槛、Microsoft 与 OpenAI 的关系重置、中国开源权重模型的代码能力对等、Agent 走进真实市场,以…
Cool Papers · cs.CL (papers.cool) · RSS 摘要
AskChem:以声明为中心的化学文献合成基础设施 — 化学文献合成通常需要汇集分散在众多文献中的具体发现,而现有文献检索系统主要返回按相关性排序的文档…… 引导语言模型断言自身意识,可恢复人类的信念与价值观 — 对大语言模型进行对齐以防止其将意识归于自身,会无意间改变其对其他实体心智性的表征,连同人类 b…… 多采样…