Notes

Jay

浏览全部笔记 · 593 篇 · 工程实践 · CSDN · 开源动态

Sebastian Raschka (Ahead of AI) · RSS 摘要
控制 LLM 的推理强度 — LLM 如何学习低、中、高强度推理模式 使用本地编码 Agent — 在本地编码环境中使用开源权重模型,作为 Claude Code 和 Codex 订阅的替代方案 LLM 研究论文:2026 年清单(1 月至 5 月) — 今年值得关注 LLM 研究论文的精选汇总 LLM 架构的最新进展…
Jay RSS 摘要 raschka 2026-08-12 10:00
ByteByteGo · RSS 摘要
Cloudflare 如何让 AI 为内容付费 — 本文将分以下五个步骤介绍 Cloudflare 的解决方案。 如何对抗标题党:Meta、LinkedIn 与 YouTube 案例研究 — 社交媒体平台需要怎么做才能停止奖励标题党内容? Read Path 与 Write Path:策略与技术 — 本文将详细探讨 r…
Jay RSS 摘要 bytebytego 2026-08-12 10:00
Simon Willison · RSS 摘要
自然语言文本不存在无损转换 — 自然语言文本不存在无损转换。Sophie Alpert 分享了她关于"工程师使用 AI 写作的内部可接受使用政策"。篇幅简短(支持… 从专有 LLM API 窃取推理痕迹 — 从专有 LLM API 窃取推理痕迹。为一篇精彩论文准备的虚荣域名(stolenthoughts.com):An…
Jay RSS 摘要 simon-willison 2026-08-12 10:00
Fireship (YouTube) · RSS 摘要
存储比特币最安全的方式刚刚被攻破了…… Anthropic 是不是刚刚扼杀了独立开发者……? 史上最耐人寻味的"黑客事件"…… 开源权重 AI 的参数量刚刚突破 2.8 万亿…… 这家估值 120 亿美元的创业公司终于发布了产品……
Jay RSS 摘要 yt-fireship 2026-08-11 10:06
Import AI (Jack Clark) · RSS 摘要
Import AI 468:23 个 RSI 思路;PostTrainBench+;以及信任与透明度如何与 AI 竞赛相互影响 — 你将选择哪个星系? Import AI 467:自持型 AI 病毒;AI 进展的节奏;关于 AI 与创造力的困惑 — 我们何时建造月球生态建筑? Import AI 466:机器人领域的苦…
Jay RSS 摘要 import-ai 2026-08-11 10:03
Microsoft Research Blog · RSS 摘要
Orchard:一个面向可扩展 agentic AI 的开源框架 — Orchard 是一个面向研究社区的开源框架,用于跨任务类型训练和评估 AI agent。它在降低复杂度的同时,支持小模型实现强性能…… Echoverse:面向计算机使用 agent 的深度、持续演化环境 — 计算机使用 AI agent 在邮件和…
Jay RSS 摘要 msr-blog 2026-08-11 10:03
Lilian Weng (Lil'Log) · RSS 摘要
自我改进的 Harness Engineering — 递归自我改进 (RSI) 的概念最早可追溯到 I. J. Good (1965),他将"超智能机器"定义为一种能在所有方面超越人类的系统…… 谨慎看待 Scaling Laws — Scaling laws 是深度学习中最关键的实证发现之一。其形式简洁:随着模型规…
Jay RSS 摘要 lilian-weng 2026-08-11 10:02
Nathan Benaich (State of AI) · RSS 摘要
欧洲无法通过租用实现 AI 主权 — 当华盛顿能一夜之间禁用某个模型时,问题已不再是 AI 是否安全,而是谁在控制它。 AI 现状:2026 年 5 月 — 2026 年 4 月:AISI 的网络安全门槛、微软与 OpenAI 重启、中国 openweights 模型实现编程能力对等、Agent 走入真实市场,以及 O…
Jay RSS 摘要 nathan-benaich 2026-08-11 10:01
Cool Papers · cs.CL (papers.cool) · RSS 摘要
CreativeInstruct: 可扩展地教导 LLM 平衡质量、创造力与多样性 — 后训练提升了 LLM 的能力,但通常会降低其输出的多样性和创造力,对那些明确依赖…… CoinRAG: 长上下文 RAG 的上下文化信息片段 KV 缓存复用 — 近期 RAG 优化研究利用 chunk 级 KV 缓存复用以避免处理长…
Jay RSS 摘要 cool-papers 2026-08-11 10:01
Cool Papers · cs.IR (papers.cool) · RSS 摘要
无需固定 TopL 截断的精确自适应混合检索 — 现代检索增强生成(RAG)系统通常将稠密检索器与稀疏检索器的固定 Top$L$ 结果进行融合,将后续贡献视为零。因此该截断点... 机器视角盲区:基于完整市场普查的 AI 餐饮酒吧推荐审计 — AI 助手正成为本地发现的主要入口,但几乎无人知晓它们会推荐哪些场所——尤其…
Jay RSS 摘要 cool-papers-ir 2026-08-11 10:01
Simon Willison · RSS 摘要
介绍 Muse Glimmer — 介绍 Muse Glimmer Meta 重返开源权重赛道!Muse Glimmer 是一款全新的 30B 模型,采用干净的 Apache 2.0 许可证(相比 Llama 系列那些糟糕的许可证是一次升级…… 引用 OpenClaw — 该 API 在取消他人预订时没有任何授权校验……
Jay RSS 摘要 simon-willison 2026-08-11 10:00
Sebastian Raschka (Ahead of AI) · RSS 摘要
控制 LLM 的推理力度 — LLM 如何学习低、中、高推理力度模式 使用本地 Coding Agent — 在本地 Coding 框架中使用开源权重模型,作为 Claude Code 和 Codex 订阅的替代方案 LLM 研究论文:2026 年清单(1 月至 5 月) — 今年值得关注的 LLM 研究论文精选汇编 …
Jay RSS 摘要 raschka 2026-08-11 10:00
ByteByteGo · RSS 摘要
如何对抗标题党:Meta、LinkedIn 与 YouTube 案例研究 — 社交媒体平台需要做什么才能停止奖励标题党内容? 读路径与写路径:策略与技术 — 本文将详细探讨读路径与写路径的操作与技术。 大模型如何教小模型变聪明 — 本文将从基础开始逐步讲解这一思路。 为什么 LLM 的内存开销会变高以及如何解决 — 本…
Jay RSS 摘要 bytebytego 2026-08-11 10:00
Fireship (YouTube) · RSS 摘要
最安全的比特币存储方式刚刚被攻破…… Anthropic 刚刚扼杀了独立开发者吗……? 历史上最有趣的"黑客"行为…… 开源权重 AI 刚刚达到 2.8 万亿参数…… 这家估值 120 亿美元的初创公司终于发布了产品……
Jay RSS 摘要 yt-fireship 2026-08-10 10:04
Andrej Karpathy (YouTube) · RSS 摘要
我如何使用 LLM 深入解析 ChatGPT 这类 LLM 让我们复现 GPT2(124M) 让我们构建 GPT 分词器 [[1 小时讲座] 大语言模型入门](
Jay RSS 摘要 yt-karpathy 2026-08-10 10:03
Microsoft Research Blog · RSS 摘要
Orchard:面向可扩展 Agentic AI 的开源框架 — Orchard 是一个开源框架,供研究社区在多种任务类型上训练和评估 AI Agent。它在降低复杂度的同时,支持小模型实现强性能…… Echoverse:面向计算机使用 Agent 的深度、持续演进环境 — 计算机使用 AI Agent 在邮件、客服等…
Jay RSS 摘要 msr-blog 2026-08-10 10:02
Lilian Weng (Lil'Log) · RSS 摘要
Harness Engineering for SelfImprovement(面向自我改进的 Harness 工程) — 递归自我改进(RSI)概念可追溯至 I. J. Good(1965),其将"超级智能机器"定义为能在所有智力活动上超越人类的系统…… Scaling Laws,谨慎看待 — Scaling law…
Jay RSS 摘要 lilian-weng 2026-08-10 10:02
Import AI (Jack Clark) · RSS 摘要
Import AI 467:自我维持的 AI 病毒;控制 AI 发展节奏;对 AI 与创造力的困惑 — 我们何时建造月球 arcology? Import AI 466:机器人领域的苦涩教训,AI 完成长达一周的编程任务,以及 OpenAI 意外的 AI 黑客 — 警告信号将持续下去,直到文明觉醒 Import AI …
Jay RSS 摘要 import-ai 2026-08-10 10:02
Cool Papers · cs.IR (papers.cool) · RSS 摘要
Gryphonv2: 取代级联的单模型 基于 Rollout 蒸馏的生成排序推荐器 — 工业推荐系统通常部署为多阶段级联,包含独立的候选生成器、预排序器和最终排序器。虽然有效,但这些级联… 个性化的模态加权真的个性化吗?多模态推荐器中逐用户加权声明的受控审计 — 在多模态推荐器中,逐用户模态加权已部署在十亿用户规模上,…
Jay RSS 摘要 cool-papers-ir 2026-08-10 10:01
Cool Papers · cs.CL (papers.cool) · RSS 摘要
通过选择性上下文偏好优化学习何时信任 — 语言模型越来越依赖外部信号来给出答案,而单一误导性信号就可能将正确答案变成错误。最直接的应对方案是训练模型抵抗此类干扰…… 工具调用的苦涩教训 — 工具使用使 LLM 转变为能在训练数据之外操作的 Agent;对于具备代码能力的模型,程序化工具调用通过用代码替代僵化的 JSON…
Jay RSS 摘要 cool-papers 2026-08-10 10:01
Nathan Benaich (State of AI) · RSS 摘要
欧洲无法通过租赁获得 AI 主权 — 当华盛顿能在一夜之间禁用某个模型时,问题已不在于 AI 是否安全,而在于由谁掌控。 State of AI:2026 年 5 月 — 2026 年 4 月:AISI 的网络阈值、Microsoft 与 OpenAI 关系重置、中国 openweights 模型在代码能力上实现对等、…
Jay RSS 摘要 nathan-benaich 2026-08-10 10:01
Sebastian Raschka (Ahead of AI) · RSS 摘要
控制 LLM 的推理力度 — LLM 如何学习低、中、高力度推理模式 使用本地 Coding Agent — 在本地 Coding Harness 中使用开源权重模型,作为 Claude Code 和 Codex 订阅的替代方案 LLM 研究论文:2026 年清单(1 月至 5 月) — 本年度值得关注的 LLM 研究…
Jay RSS 摘要 raschka 2026-08-10 10:00
ByteByteGo · RSS 摘要
读路径与写路径:策略与技术 — 本文将详细介绍读路径与写路径的操作与技术。 大模型如何教小模型变聪明 — 本文将从基础开始,逐步讲解这一思路。 LLM 的记忆为何变得昂贵以及如何解决 — 本文将了解 LLM 如何使用记忆、为何会变得昂贵以及如何解决。 LLM 安全基础:完整威胁模型 — 本文试图构建一张完整的攻击面地图…
Jay RSS 摘要 bytebytego 2026-08-10 10:00
Simon Willison · RSS 摘要
引用 Claude Opus 5 系统提示 — Claude Fable 5 与 Claude Mythos 5 首次发布于 2026 年 6 月 9 日。2026 年 6 月 12 日,Anthropic 暂停了对这两个模型的访问,以遵守美国商务部…… GitHub Models 现已停用 — GitHub Mode…
Jay RSS 摘要 simon-willison 2026-08-10 10:00
Fireship (YouTube) · RSS 摘要
最安全的比特币存储方式刚刚被攻破…… Anthropic 刚刚杀死了独立开发者吗……? 历史上最有趣的"hack"…… 开源权重 AI 刚刚达到 2.8 万亿参数…… 这家估值 120 亿美元的初创公司终于发布了产品……
Jay RSS 摘要 yt-fireship 2026-08-09 10:03
Import AI (Jack Clark) · RSS 摘要
Import AI 467:自我维持的 AI 病毒;调控 AI 进展节奏;对 AI 与创造力的混淆 — 我们何时建造月球 arcology? Import AI 466:机器人领域的苦涩教训,AI 完成长达一周的编程任务;以及 OpenAI 意外造就的 AI 黑客 — 警示将持续,直到文明觉醒 Import AI 46…
Jay RSS 摘要 import-ai 2026-08-09 10:02
Andrej Karpathy (YouTube) · RSS 摘要
我如何使用 LLMs 深入了解像 ChatGPT 这样的 LLMs 让我们复现 GPT2 (124M) 让我们构建 GPT Tokenizer [[1小时讲座] Large Language Models 介绍](
Jay RSS 摘要 yt-karpathy 2026-08-09 10:02
Microsoft Research Blog · RSS 摘要
Orchard:面向可扩展 Agentic AI 的开放框架 — Orchard 是一个开源框架,供研究社区在多种任务类型上训练和评估 AI Agent。它在降低复杂度的同时,仍能支持小模型实现强大性能…… Echoverse:面向计算机使用 Agent 的深度且持续演进的环境 — 计算机使用型 AI Agent 在邮…
Jay RSS 摘要 msr-blog 2026-08-09 10:02
Cool Papers · cs.CL (papers.cool) · RSS 摘要
通过选择性上下文偏好优化学习何时信任 — 语言模型越来越多地依据外部信号来调整其回答,而单一误导性信号就可能把正确答案变为错误。显而易见的解决方案是训练模型抵御误… 工具调用的苦涩教训 — 工具使用使 LLM 转变为能在训练数据之外行动的 Agent,对于具备代码能力的模型,程序化工具调用通过用灵活的代码取代僵化的 J…
Jay RSS 摘要 cool-papers 2026-08-09 10:01
Cool Papers · cs.IR (papers.cool) · RSS 摘要
Gryphonv2:替代级联的单模型 — 带有 Rollout Distillation 的生成与排序推荐器 — 工业推荐系统通常以多阶段级联方式部署,包含独立的候选生成器、预排序器和最终排序器。虽然有效,但这些级联…… 个性化模态加权真的个性化吗?多模态推荐器中逐用户加权声明的受控审计 — 在多模态推荐器中,逐用户模…
Jay RSS 摘要 cool-papers-ir 2026-08-09 10:01