Notes

Jay

浏览全部笔记 · 604 篇 · 工程实践 · CSDN · 开源动态

Cool Papers · cs.CL (papers.cool) · RSS 摘要
通过选择性上下文偏好优化学习何时信任 — 语言模型越来越依赖外部信号来给出答案,而单一误导性信号就可能将正确答案变成错误。最直接的应对方案是训练模型抵抗此类干扰…… 工具调用的苦涩教训 — 工具使用使 LLM 转变为能在训练数据之外操作的 Agent;对于具备代码能力的模型,程序化工具调用通过用代码替代僵化的 JSON…
Jay RSS 摘要 cool-papers 2026-08-10 10:01
Nathan Benaich (State of AI) · RSS 摘要
欧洲无法通过租赁获得 AI 主权 — 当华盛顿能在一夜之间禁用某个模型时,问题已不在于 AI 是否安全,而在于由谁掌控。 State of AI:2026 年 5 月 — 2026 年 4 月:AISI 的网络阈值、Microsoft 与 OpenAI 关系重置、中国 openweights 模型在代码能力上实现对等、…
Jay RSS 摘要 nathan-benaich 2026-08-10 10:01
Sebastian Raschka (Ahead of AI) · RSS 摘要
控制 LLM 的推理力度 — LLM 如何学习低、中、高力度推理模式 使用本地 Coding Agent — 在本地 Coding Harness 中使用开源权重模型,作为 Claude Code 和 Codex 订阅的替代方案 LLM 研究论文:2026 年清单(1 月至 5 月) — 本年度值得关注的 LLM 研究…
Jay RSS 摘要 raschka 2026-08-10 10:00
ByteByteGo · RSS 摘要
读路径与写路径:策略与技术 — 本文将详细介绍读路径与写路径的操作与技术。 大模型如何教小模型变聪明 — 本文将从基础开始,逐步讲解这一思路。 LLM 的记忆为何变得昂贵以及如何解决 — 本文将了解 LLM 如何使用记忆、为何会变得昂贵以及如何解决。 LLM 安全基础:完整威胁模型 — 本文试图构建一张完整的攻击面地图…
Jay RSS 摘要 bytebytego 2026-08-10 10:00
Simon Willison · RSS 摘要
引用 Claude Opus 5 系统提示 — Claude Fable 5 与 Claude Mythos 5 首次发布于 2026 年 6 月 9 日。2026 年 6 月 12 日,Anthropic 暂停了对这两个模型的访问,以遵守美国商务部…… GitHub Models 现已停用 — GitHub Mode…
Jay RSS 摘要 simon-willison 2026-08-10 10:00
Fireship (YouTube) · RSS 摘要
最安全的比特币存储方式刚刚被攻破…… Anthropic 刚刚杀死了独立开发者吗……? 历史上最有趣的"hack"…… 开源权重 AI 刚刚达到 2.8 万亿参数…… 这家估值 120 亿美元的初创公司终于发布了产品……
Jay RSS 摘要 yt-fireship 2026-08-09 10:03
Import AI (Jack Clark) · RSS 摘要
Import AI 467:自我维持的 AI 病毒;调控 AI 进展节奏;对 AI 与创造力的混淆 — 我们何时建造月球 arcology? Import AI 466:机器人领域的苦涩教训,AI 完成长达一周的编程任务;以及 OpenAI 意外造就的 AI 黑客 — 警示将持续,直到文明觉醒 Import AI 46…
Jay RSS 摘要 import-ai 2026-08-09 10:02
Andrej Karpathy (YouTube) · RSS 摘要
我如何使用 LLMs 深入了解像 ChatGPT 这样的 LLMs 让我们复现 GPT2 (124M) 让我们构建 GPT Tokenizer [[1小时讲座] Large Language Models 介绍](
Jay RSS 摘要 yt-karpathy 2026-08-09 10:02
Microsoft Research Blog · RSS 摘要
Orchard:面向可扩展 Agentic AI 的开放框架 — Orchard 是一个开源框架,供研究社区在多种任务类型上训练和评估 AI Agent。它在降低复杂度的同时,仍能支持小模型实现强大性能…… Echoverse:面向计算机使用 Agent 的深度且持续演进的环境 — 计算机使用型 AI Agent 在邮…
Jay RSS 摘要 msr-blog 2026-08-09 10:02
Cool Papers · cs.CL (papers.cool) · RSS 摘要
通过选择性上下文偏好优化学习何时信任 — 语言模型越来越多地依据外部信号来调整其回答,而单一误导性信号就可能把正确答案变为错误。显而易见的解决方案是训练模型抵御误… 工具调用的苦涩教训 — 工具使用使 LLM 转变为能在训练数据之外行动的 Agent,对于具备代码能力的模型,程序化工具调用通过用灵活的代码取代僵化的 J…
Jay RSS 摘要 cool-papers 2026-08-09 10:01
Cool Papers · cs.IR (papers.cool) · RSS 摘要
Gryphonv2:替代级联的单模型 — 带有 Rollout Distillation 的生成与排序推荐器 — 工业推荐系统通常以多阶段级联方式部署,包含独立的候选生成器、预排序器和最终排序器。虽然有效,但这些级联…… 个性化模态加权真的个性化吗?多模态推荐器中逐用户加权声明的受控审计 — 在多模态推荐器中,逐用户模…
Jay RSS 摘要 cool-papers-ir 2026-08-09 10:01
Lilian Weng (Lil'Log) · RSS 摘要
针对自我改进的 Harness 工程 — 递归自我改进(RSI)的概念可追溯至 I. J. Good (1965),他在其中将"超智能机器"定义为一种能够在…… 谨慎看待 Scaling Laws — Scaling laws 是深度学习中最关键的实证发现之一。其形式简洁:随着模型规模扩大,训练损失 L 可预测地下降……
Jay RSS 摘要 lilian-weng 2026-08-09 10:01
Simon Willison · RSS 摘要
Auto 模式现已成为 Claude Code 在 Pro、Max 和 Team 套餐中的默认设置。 — Auto 模式现已成为 Claude Code 在 Pro、Max 和 Team 套餐中的默认设置。Anthropic 对 Claude Code 的 Auto 模式非常有信心,甚至将其设为默认…… 现在我们掌握了…
Jay RSS 摘要 simon-willison 2026-08-09 10:00
ByteByteGo · RSS 摘要
读取路径与写入路径:策略与技术 — 本文将详细探讨读取路径与写入路径的操作与技术。 大模型如何教会小模型变聪明 — 本文将从零开始逐步剖析这一思路。 LLM 内存为何变得昂贵及修复方法 — 本文将介绍 LLM 如何使用内存、内存为何变得昂贵以及如何解决。 LLM 安全基础:完整的威胁模型 — 本文尝试勾勒出威胁 LLM…
Jay RSS 摘要 bytebytego 2026-08-09 10:00
Sebastian Raschka (Ahead of AI) · RSS 摘要
控制 LLM 的推理力度 — LLM 如何学习低、中、高力度推理模式 使用本地 Coding Agent — 在本地 Coding Harness 中使用开源权重模型,作为 Claude Code 和 Codex 订阅的替代方案 LLM 研究论文:2026 年清单(1 月至 5 月) — 本年度值得关注的 LLM 研究…
Jay RSS 摘要 raschka 2026-08-09 10:00
Nathan Benaich (State of AI) · RSS 摘要
欧洲无法靠租赁实现 AI 主权 — 当华盛顿能在一夜之间禁用某个模型时,问题不在于 AI 是否安全,而在于谁掌控它。 AI 现状:2026 年 5 月 — 2026 年 4 月:AISI 网络安全门槛、微软与 OpenAI 重置、中国开源权重模型编码能力对标、Agent 走进真实市场,以及 OpenAI 获 1220 …
Jay RSS 摘要 nathan-benaich 2026-08-09 10:00
Andrej Karpathy (YouTube) · RSS 摘要
我如何使用 LLMs 深入剖析类似 ChatGPT 的 LLMs 让我们复现 GPT2 (124M) 让我们构建 GPT Tokenizer [[1小时讲座] 大语言模型入门](
Jay RSS 摘要 yt-karpathy 2026-08-08 10:03
Fireship (YouTube) · RSS 摘要
最安全的比特币存储方式刚刚被攻破…… Anthropic 刚刚杀死了独立开发者吗? 史上最有趣的“黑客事件”…… 开源权重 AI 参数量刚刚突破 2.8 万亿…… 这家估值 120 亿美元的初创公司终于交付了产品……
Jay RSS 摘要 yt-fireship 2026-08-08 10:03
Import AI (Jack Clark) · RSS 摘要
Import AI 467:自我维持的 AI 病毒;AI 进展的节奏;关于 AI 与创造力的困惑 — 我们何时建造月球 arcology? Import AI 466:机器人领域的苦涩教训,AI 完成长达一周的编程任务;以及 OpenAI 的"意外"AI 黑客 — 警示信号将持续发出,直至文明觉醒 Import AI …
Jay RSS 摘要 import-ai 2026-08-08 10:02
Lilian Weng (Lil'Log) · RSS 摘要
自我改进的 Harness Engineering — 递归自我改进(RSI)的概念最早可追溯到 I. J. Good (1965),他将"超智能机器"定义为一种能在……上超越人类的系统…… 谨慎看待 Scaling Laws — Scaling laws 是深度学习中最关键的实证发现之一。其观察形式很简单:训练损失 …
Jay RSS 摘要 lilian-weng 2026-08-08 10:01
Cool Papers · cs.CL (papers.cool) · RSS 摘要
Learning When to Trust via Selective Context Preference Optimization — 语言模型越来越依赖外部信号来回答问题,而一个误导性信号就可能让正确答案变成错误。显而易见的补救方法是训练模型抵御此类干扰…… The Bitter Lesson of Tool …
Jay RSS 摘要 cool-papers 2026-08-08 10:01
Cool Papers · cs.IR (papers.cool) · RSS 摘要
Gryphonv2: 替代级联的单模型 —— 带 Rollout 蒸馏的生成排序推荐器 — 工业推荐系统通常部署为多阶段级联,由独立的候选生成器、预排序器和最终排序器组成。虽然这些级联效果显著…… 个性化模态加权真的个性化吗?多模态推荐器中逐用户加权声明的受控审计 — 逐用户模态加权已通过用户模态强度向量、注意力门控、…
Jay RSS 摘要 cool-papers-ir 2026-08-08 10:01
Microsoft Research Blog · RSS 摘要
Orchard:面向可扩展 Agentic AI 的开源框架 — Orchard 是一个开源框架,供研究社区在多种任务类型上训练和评估 AI Agent。它降低了复杂度,同时支持小模型取得强劲性能…… Echoverse:面向计算机使用 Agent 的深度、演进式环境 — 计算机使用 AI Agent 在处理邮件和客服…
Jay RSS 摘要 msr-blog 2026-08-08 10:01
Sebastian Raschka (Ahead of AI) · RSS 摘要
控制 LLM 的推理强度 — LLM 如何学习低、中、高强度推理模式 使用本地编码 Agent — 在本地编码框架中使用开源权重模型,作为 Claude Code 和 Codex 订阅的替代方案 LLM 研究论文:2026 年清单(1 月至 5 月) — 今年值得关注 LLM 研究论文的精选汇总 LLM 架构最新进展:…
Jay RSS 摘要 raschka 2026-08-08 10:00
Simon Willison · RSS 摘要
引用 John Gruber 的话 — 我倾向于把自己代入现场演奏的心态,而不是录制录音室专辑——除非我写的作品真的想做成专辑。这种情况并不少见…… 现在我们掌握了 OpenAI 对 Hugging Face 意外攻击的完整时间线 — OpenAI 周三在 Black Hat 安全会议上就"Hugging Face 事…
Jay RSS 摘要 simon-willison 2026-08-08 10:00
ByteByteGo · RSS 摘要
读路径与写路径:策略与技术 — 本文将详细探讨读路径与写路径的操作与技术。 大模型如何教会小模型变聪明 — 本文将从零开始逐步拆解这一思路。 LLM 内存为何昂贵及如何优化 — 本文将介绍 LLM 如何使用内存、为何变得昂贵,以及如何解决。 LLM 安全基础:完整威胁模型 — 本文尝试梳理威胁 LLM 安全的完整攻击面…
Jay RSS 摘要 bytebytego 2026-08-08 10:00
Nathan Benaich (State of AI) · RSS 摘要
欧洲无法通过租赁方式实现 AI 主权 — 当华盛顿能够一夜之间禁用某个模型时,问题已不在于 AI 是否安全,而在于谁掌控它。 State of AI:2026 年 5 月 — 2026 年 4 月:AISI 的网络阈值、Microsoft 与 OpenAI 重置、中国 openweights 模型实现代码能力对等、Ag…
Jay RSS 摘要 nathan-benaich 2026-08-08 10:00
Fireship (YouTube) · RSS 摘要
最安全的比特币存储方式刚刚被攻破…… Anthropic 刚刚扼杀了独立开发者吗……? 史上最有趣的"奇招"…… 开源权重 AI 模型刚刚达到 2.8 万亿参数…… 这家估值 120 亿美元的初创公司终于发布了产品……
Jay RSS 摘要 yt-fireship 2026-08-07 10:05
Import AI (Jack Clark) · RSS 摘要
Import AI 467:自持性 AI 病毒;AI 进展节奏;关于 AI 与创造力的困惑 — 我们何时建造月球 arcology? Import AI 466:机器人的苦涩教训,AI 完成长达一周的编程任务;以及 OpenAI 意外的 AI 黑客 — 警告信号将持续,直至文明觉醒 Import AI 465:开源 v…
Jay RSS 摘要 import-ai 2026-08-07 10:04
Andrej Karpathy (YouTube) · RSS 摘要
我如何使用 LLM 深入理解像 ChatGPT 这样的 LLM 让我们复现 GPT2 (124M) 让我们构建 GPT 分词器 [[1小时演讲] 大语言模型简介](
Jay RSS 摘要 yt-karpathy 2026-08-07 10:04