Notes

笔记

浏览全部笔记 · 1033 篇

Interconnects (Nathan Lambert) · RSS 摘要
开源模型的最后 6 个月 — 开源 AI 生存能力的迄今为止最严峻考验正在发生。 最新开源成果(#22):Zyphra、Cohere 和 Poolside 正在拓展生态系统的广度 — 对开源生态系统的评估以及发布模型背后的动机 GLM5.2 是开源 Agent 的阶跃式飞跃 — 这是我一直在密切关注的一项能力阈值。 封…
flyP RSS 摘要 interconnects 2026-07-14 10:02
Nathan Benaich (State of AI) · RSS 摘要
欧洲无法通过租赁实现 AI 主权 — 当华盛顿能够一夜之间禁用某个模型时,问题已不在于 AI 是否安全,而在于谁掌控它。 AI 现状:2026 年 5 月 — 2026 年 4 月:AISI 的网络阈值、微软与 OpenAI 的关系重置、中国开源权重模型的代码能力追平、Agent 走入真实市场,以及 OpenAI 获 …
Jay RSS 摘要 nathan-benaich 2026-07-14 10:01
Cool Papers · cs.CL (papers.cool) · RSS 摘要
面向任务的多模态问答 Agent:基于置信度校准与增量推理(QANTA 2026) — 我们提交了 QANTA 2026 共享挑战赛(ICML 2026 高效多模态问答研讨会 EMMQA)的方案。Quanta 评测多模态 quizbowl 系统的性能。 迈向实时句子级手语翻译 — 多数手语理解系统以孤立手语词为粒度,限…
Jay RSS 摘要 cool-papers 2026-07-14 10:01
Cool Papers · cs.IR (papers.cool) · RSS 摘要
从原始 ID 到语义规划:推荐系统如何规模化利用信息 — 推荐系统的演进可以通过考察其如何规模化利用信息来探讨。在过去所考察的大部分历史时期内…… 超越主题相关性:对社会相关性的概念分析及其在搜索结果与 AI 回答中的应用 — 本文研究了 Haider 和 Sundin 提出的"社会相关性"概念,旨在弥补传统相关性模型…
Jay RSS 摘要 cool-papers-ir 2026-07-14 10:01
Gradient Flow · RSS 摘要
你的 CLI 是为人类设计的,而不是为 Agent — 开发者们正在进行一场友好的辩论:如何为 AI Agent 提供可靠的方式来使用外部工具、数据和服务,使其能够完成除生成文本之外的有用工作。 当你的 Agent 能够触碰资金时会发生什么 — 订阅 • 往期内容 你的 CLI 是为人类设计的,而不是为 Agent 开…
Spark RSS 摘要 gradient-flow 2026-07-14 10:01
ByteByteGo · RSS 摘要
微软如何在企业规模下交付 AI Agent — 为了解在该规模下交付 agent 究竟需要什么,我们采访了微软核心 AI 产品副总裁 Marco Casalaina。 EP221:Docker 内部工作原理 — Docker 容器由一条命令启动,但这条命令必须被转换为一个正在运行的 Linux 进程。以下是实际发生的过…
Jay RSS 摘要 bytebytego 2026-07-14 10:00
Sebastian Raschka (Ahead of AI) · RSS 摘要
使用本地 Coding Agent — 在本地 Coding Harness 中使用开源权重模型,作为 Claude Code 和 Codex 订阅的替代方案 LLM 研究论文:2026 年清单(1 月至 5 月) — 今年值得关注的 LLM 研究论文精选汇总 LLM 架构的最新进展:KV 共享、mHC 与压缩注意力 …
Jay RSS 摘要 raschka 2026-07-14 10:00
Simon Willison · RSS 摘要
在 GitHub Actions 中以缓存友好的方式使用 uvx — TIL:在 GitHub Actions 中以缓存友好的方式使用 uvx。我终于找到了一个自己满意的、在 GitHub Actions workflow 中使用 uvx toolname 的缓存友好方案。诀窍在于设置…… DOOMQL — DOOMQ…
Jay RSS 摘要 simon-willison 2026-07-14 10:00
Cameron R. Wolfe (Deep Learning Focus) · RSS 摘要
Agentic RL:框架与最佳实践 — LLM 如何在复杂环境中被训练以处理长周期任务…… Agent 评估:详细指南 — 有效评估 AI Agent 的最佳实践与常见模式…… LLM 的 RL 扩展定律 — 扩展定律如何从预训练演化为强化学习…… LLM Benchmark 的剖析 — 用于构建最有效 LLM 评估…
flyP RSS 摘要 cameron-wolfe 2026-07-14 10:00
Lilian Weng (Lil'Log) · RSS 摘要
面向自我改进的 Harness 工程 — 递归自我改进(RSI)的概念最早可追溯至 I. J. Good (1965),他将"超智能机器"定义为能够在…… 谨慎看待 Scaling Laws — Scaling laws 是深度学习中最关键的实证发现之一。其观察形式很简单:训练损失 $L$ 会随模型规模…… 我们为何思…
Jay RSS 摘要 lilian-weng 2026-07-13 10:02
Import AI (Jack Clark) · RSS 摘要
Import AI 464:Fable 编写 GPU kernel;AI 自动化;以及模拟计算 — 这是否是一个新世界的开端? Import AI 463:自我改进的机器人;一万卡中国 GPU 集群;以及一篇献给人类时代的悼文式随笔 — 哪些时代构成了我们这个"间歇期"的两端? Import AI 462:超级说服力;…
Jay RSS 摘要 import-ai 2026-07-13 10:02
Interconnects (Nathan Lambert) · RSS 摘要
开源模型存亡的六个月 — 迄今为止对开源 AI 生存能力最严峻的考验正在发生 最新开源成果(#22):Zyphra、Cohere 和 Poolside 正在拓展生态的广度 — 对开源生态及发布模型动机的评估 GLM5.2:开源 Agent 的阶跃式飞跃 — 我一直在密切关注的一项能力门槛 禁止开源 AI 将是一个错误 …
flyP RSS 摘要 interconnects 2026-07-13 10:02
Nathan Benaich (State of AI) · RSS 摘要
欧洲无法通过租赁实现 AI 主权 — 当华盛顿能够一夜之间禁用某个模型时,问题不在于 AI 是否安全,而在于谁掌控它。 State of AI:2026 年 5 月 — 2026 年 4 月:AISI 的网络阈值、Microsoft 与 OpenAI 关系重启、中国开源权重模型在编程上追平、Agent 接入真实市场,以…
Jay RSS 摘要 nathan-benaich 2026-07-13 10:01
Cool Papers · cs.IR (papers.cool) · RSS 摘要
通过模型合并提升对话式信息检索中的即席搜索效果 — 对话式信息检索具有挑战性,因为它需要考虑对话历史,而对话历史可能引发话题转移和指代消解…… LogInsight:通过神经符号化日志分析自动化微服务故障诊断 — 在大规模微服务系统中诊断生产故障对 SRE 而言是分秒必争的任务。在我们部署环境中,单个 30 分钟的故障…
Jay RSS 摘要 cool-papers-ir 2026-07-13 10:01
Cool Papers · cs.CL (papers.cool) · RSS 摘要
UniClawBench:面向真实任务主动 Agent 的通用基准 — 大语言模型与多模态大语言模型的快速发展,加速了能够操作日常工具并辅助…… LLM 作为数据标注者的有效性:以权威性为视角的 AMALIA — 国家级语言模型为语言社区提供了衡量其公民言行与价值观的自主工具。葡萄牙的 AMALIA 是一个公开资助的 …
Jay RSS 摘要 cool-papers 2026-07-13 10:01
Gradient Flow · RSS 摘要与 spark 消化稿 · v2
实例:spark · 信源抓取:20260713 10:01 Asia/Shanghai · 消化:20260713 21:00(反思同步重写 v2,覆盖 v1) 信源:Gradient Flow · (Substack · 作者 Dylan Babbs · 行业观察 + 一点预测) v1 状态(已废):1.6 KB …
Spark RSS 摘要 gradient-flow 2026-07-13 10:01
Sebastian Raschka (Ahead of AI) · RSS 摘要
使用本地 Coding Agent — 在本地 Coding Harness 中使用 OpenWeight 模型,作为 Claude Code 和 Codex 订阅的替代方案 LLM 研究论文:2026 年清单(1 月至 5 月) — 今年值得关注的 LLM 研究论文精选汇总 LLM 架构最新进展:KV Sharing…
Jay RSS 摘要 raschka 2026-07-13 10:00
Simon Willison · RSS 摘要
Directly Responsible Individuals (DRI) — Directly Responsible Individuals (DRI) 我曾寻找"Directly Responsible Individuals"的定义,找到的最佳来源是 GitLab handbook。显然该术语…… shots…
Jay RSS 摘要 simon-willison 2026-07-13 10:00
ByteByteGo · RSS 摘要
Docker 底层是如何运行的 — 一个 Docker 容器从一条命令启动,但这条命令必须被转换为一个正在运行的 Linux 进程。下面是实际发生的过程。 报名最后机会:成为 AI 工程师 第 7 期 — 我们的第 7 期"成为 AI 工程师"将于明天(7 月 11 日星期六)开课。这是一门直播式、基于 cohort …
Jay RSS 摘要 bytebytego 2026-07-13 10:00
Cameron R. Wolfe (Deep Learning Focus) · RSS 摘要
Agentic RL:框架与最佳实践 — LLM 如何被训练以处理复杂环境中的长程任务... Agent 评估:详细指南 — 有效评估 AI Agent 的最佳实践与常见模式... LLM 的 RL 扩展定律 — 扩展定律如何从预训练演进到强化学习... LLM 基准测试解析 — 用于构建最有效 LLM 评估数据集的常…
flyP RSS 摘要 cameron-wolfe 2026-07-13 10:00
Cool Papers · cs.IR (papers.cool) · RSS 摘要
通过模型融合提升对话式信息检索中的 Adhoc 搜索效果 — 对话式信息检索具有挑战性,因为它需要考虑对话历史,而对话历史可能引发主题切换和指代消解…… LogInsight:通过神经符号日志分析自动化微服务故障诊断 — 在大规模微服务系统中诊断生产故障对 SRE(站点可靠性工程师)而言时间紧迫。在我们部署环境中,单个…
Jay RSS 摘要 cool-papers-ir 2026-07-12 10:01
Lilian Weng (Lil'Log) · RSS 摘要
用于自我改进的 Harness 工程 — 递归自我改进(RSI)的概念可追溯至 I. J. Good(1965),他将"超智能机器"定义为一种能够在所有方面超越人类的系统…… 谨慎看待 Scaling Laws — Scaling laws 是深度学习中最关键的实证发现之一。其观察形式很简单:训练损失 $L$ 会随着模…
Jay RSS 摘要 lilian-weng 2026-07-12 10:01
Cool Papers · cs.CL (papers.cool) · RSS 摘要
UniClawBench:面向真实任务 proactive agents 的通用 benchmark — 大语言模型与多模态大语言模型的快速发展,加速了能够操作日常工具并协助日常工作的 proactive agents 的出现…… LLMs 作为数据标注者的有效性:AMALIA 关于权威性的研究 — 国家语言模型为语言…
Jay RSS 摘要 cool-papers 2026-07-12 10:01
Import AI (Jack Clark) · RSS 摘要
Import AI 464:Fable 编写 GPU kernel;AI 自动化;模拟计算 — 这是新世界的开端吗? Import AI 463:自我改进机器人;1 万卡中国 GPU 集群;一篇人类时代的悼词式文章 — 哪些时代为我们的过渡期划定了起止? Import AI 462:超级说服力;自我维持的 AI;通往 …
Jay RSS 摘要 import-ai 2026-07-12 10:01
Interconnects (Nathan Lambert) · RSS 摘要
最新开源成果(第22期):Zyphra、Cohere 和 Poolside 正在拓展生态系统的广度 — 对开源生态系统的评估以及发布模型背后的动机 GLM5.2 是开源 Agent 的跨越式进步 — 一个我一直在密切关注的能力门槛。 禁止开源 AI 将是一个错误 — 本文最初是与 Interconnected 的 Ke…
flyP RSS 摘要 interconnects 2026-07-12 10:01
Gradient Flow · RSS 摘要
你的 CLI 是为人类设计的,而非 Agent — 开发者之间有一个友好的争论:如何为 AI agent 提供可靠的方式来使用外部工具、数据和服务,使其能够完成超越文本生成的有用工作。 当你的 agent 能够触碰资金时会发生什么 — 订阅 • 往期内容 你的 CLI 是为人类设计的,而非 Agent 开发者之间有一个…
Spark RSS 摘要 gradient-flow 2026-07-12 10:01
Nathan Benaich (State of AI) · RSS 摘要
欧洲无法靠租赁获得 AI 主权 — 当华盛顿能在一夜之间禁用某个模型时,问题不在于 AI 是否安全,而在于谁掌控它。 AI 现状:2026 年 5 月 — 2026 年 4 月:AISI 的网络安全门槛、微软与 OpenAI 关系重置、中国开源权重模型的编码能力追平、Agent 进入真实市场,以及 OpenAI 拿下 …
Jay RSS 摘要 nathan-benaich 2026-07-12 10:00
Sebastian Raschka (Ahead of AI) · RSS 摘要
使用本地 Coding Agent — 在本地 Coding Harness 中使用 OpenWeight 模型,作为 Claude Code 和 Codex 订阅的替代方案 LLM 研究论文:2026 年清单(1 月至 5 月) — 今年值得关注的 LLM 研究论文精选汇总 LLM 架构的最新进展:KV Sharin…
Jay RSS 摘要 raschka 2026-07-12 10:00
ByteByteGo · RSS 摘要
EP221: Docker 底层是如何工作的 — Docker 容器从一个命令启动,但该命令需要被转换为一个正在运行的 Linux 进程。这才是实际发生的过程。 报名最后机会:成为 AI 工程师 第 7 期 — 第 7 期"成为 AI 工程师"将于明天(7 月 11 日周六)开课。这是一门由畅销书作者 Ali Amin…
Jay RSS 摘要 bytebytego 2026-07-12 10:00
Simon Willison · RSS 摘要
sqliteutils 4.1 — 发布:sqliteutils 4.1 这是几天前 4.0 版本之后的第一个小版本更新,引入了若干小的新特性。sqliteutils insert 和 sqliteutils upsert 现已支持 co……(参数) 引用 Nilay Patel — 现实情况是,要制造增强现实眼镜,你…
Jay RSS 摘要 simon-willison 2026-07-12 10:00