Jay
浏览全部笔记 · 615 篇 · 工程实践 · CSDN · 开源动态
Nathan Benaich (State of AI) · RSS 摘要
欧洲无法通过租赁实现AI主权 — 当华盛顿能一夜之间禁用某个模型时,问题已不在于AI是否安全,而在于谁掌控它。 AI现状:2026年5月 — 2026年4月:AISI的网络安全门槛、Microsoft与OpenAI的重置、中国开源权重模型的代码能力平齐、Agent进入真实市场,以及OpenAI的1220亿美元融资。 公…
Simon Willison · RSS 摘要
引用 Thomas Ptacek — 我真诚相信,如果拿 2025 年的开源权重模型搭建一个渗透测试 harness,它就能在大多数网络中完成这种沙箱逃逸并进行扫描/入侵…… OpenAI 对 Hugging Face 的意外网络攻击是已发生的科幻情节 — 这个故事相当离奇。简要版本:OpenAI 正在对一个未发布模型…
ByteByteGo · RSS 摘要
生产环境中可运行的 AI Agent 构建最佳实践 — 本文尝试将众多思路提炼为一组精简实践,并解释每项实践背后的原理,而非要求读者死记硬背大量条目…… Roblox 押注 World Models 的内幕 — 我们与 Roblox 工程高级副总裁 Anupam Singh 坐下来交流,听他介绍 Roblox 用于让多…
Sebastian Raschka (Ahead of AI) · RSS 摘要
控制 LLM 的推理力度 — LLM 如何学习低、中、高力度推理模式 使用本地 Coding Agent — 在本地 Coding Harness 中使用 openweight 模型,作为 Claude Code 和 Codex 订阅的替代方案 LLM 研究论文:2026 年清单(1 月至 5 月) — 今年值得关注的…
Fireship (YouTube) · RSS 摘要
估值 120 亿美元的初创公司终于发布了产品… OpenAI 再次因剽窃被起诉… 史上最受争议的重写版本刚刚发布… OpenAI 强势回归... GPT 5.6 Sol 首发体验 Claude 绝对没有意识…
Andrej Karpathy (YouTube) · RSS 摘要
我如何使用 LLM 深入探究像 ChatGPT 这样的 LLM 让我们复现 GPT2 (124M) 让我们构建 GPT Tokenizer [[1 小时讲座] 大语言模型入门](
Import AI (Jack Clark) · RSS 摘要
Import AI 465:开源vs闭源差距;Kimi K3;Demis 的重大政策计划 — 奇点日后回望,不过是一段过渡期 Import AI 464:Fable 编写 GPU kernel;AI 自动化;以及模拟计算 — 这是新世界的开端吗? Import AI 463:自我改进机器人;万卡中国 GPU 集群;以及…
Microsoft Research Blog · RSS 摘要
验证 SymCrypt 中的 Rust 密码学:从标准到代码 — 密码学代码为现代计算系统提供关键保护。了解一种新方法如何在开发人员编写代码时进行验证,同时保持速度与灵活性…… Aurora 1.5:拓展面向天气与地球系统应用的开源基础模型 — Aurora 1.5 为 Aurora 基础模型新增 22 个变量、逐小时…
Cool Papers · cs.IR (papers.cool) · RSS 摘要
jinarerankerv3.5:一种采用混合注意力与自蒸馏的高效列表式 reranker — 列表式 reranker 是 agentic 检索 pipeline 的判别核心,但生产部署要求其在半结构化数据上同时具备效率、领域鲁棒性与流畅性…… FinSAgent:面向证据驱动 SEC 文件问答的语料对齐多 Agen…
Lilian Weng (Lil'Log) · RSS 摘要
面向自我改进的 Harness 工程 — 递归自我改进(RSI)的概念可追溯至 I. J. Good (1965),他将"超级智能机器"定义为能在所有方面超越人类的系统…… 谨慎看待 Scaling Laws — Scaling laws 是深度学习中最重要的经验发现之一。其观察形式很简单:随着模型规模的扩大,训练损失…
Cool Papers · cs.CL (papers.cool) · RSS 摘要
自动化发现并不存在普遍更优的运行框架 — OpenEvolve、TTTDiscover 等自主发现系统常被用作通用运行框架。然而在实践中,这些是由若干模块组合而成的复合系统…… 关键不在说什么,而在怎么说:评估 LLM 对信念表达的回应 — 用户经常向大语言模型(LLM)表达自己的信念。在某些情境下,LLM 应当将这类…
Nathan Benaich (State of AI) · RSS 摘要
欧洲无法通过租赁获得 AI 主权 — 当华盛顿能够一夜之间禁用某个模型时,问题不再是 AI 是否安全,而是由谁来控制它。 AI 现状:2026 年 5 月 — 2026 年 4 月:AISI 的网络阈值、Microsoft 与 OpenAI 的关系重置、中国开放权重模型的代码能力对等、Agent 走入真实市场,以及 O…
Simon Willison · RSS 摘要
Nativ:在你的 Mac 上本地运行 AI 模型 — Nativ:在你的 Mac 上本地运行 AI 模型。Prince Canuma 是出色的 MLXVLM Python 库的开发者,该库用于在 Mac 上利用 MLX 运行视觉 LLM。非常令人期待…… 与 Claude Code 团队的 Cat 和 Thariq …
ByteByteGo · RSS 摘要
Roblox 对世界模型的押注 — 我们与 Roblox 工程高级副总裁 Anupam Singh 坐下来,听他介绍 Roblox 用来让其多人游戏看起来如同照片一般的世界模型…… MCP vs A2A vs ACP:AI Agent 之间实际如何通信 — Agent 本身已具备能力,与工具及其他 Agent 结合后,…
Sebastian Raschka (Ahead of AI) · RSS 摘要
控制 LLM 的推理努力程度 — LLM 如何学习低、中、高推理努力模式 使用本地 Coding Agent — 在本地 Coding Harness 中使用开源权重模型,作为 Claude Code 和 Codex 订阅的替代方案 LLM 研究论文:2026 年清单(1 月至 5 月) — 今年发布的值得关注的 LL…
Fireship (YouTube) · RSS 摘要
这家估值 120 亿美元的初创公司终于发布了产品… OpenAI 再次因剽窃被告… 史上最富争议的重写版本刚刚发布… OpenAI 强势回归…GPT 5.6 Sol 首发上手 Claude 绝对没有意识…
Andrej Karpathy (YouTube) · RSS 摘要
我如何使用 LLM 深入理解像 ChatGPT 这样的 LLM 让我们复现 GPT2 (124M) 让我们构建 GPT 分词器 [[1小时讲座] 大语言模型入门](
Import AI (Jack Clark) · RSS 摘要
Import AI 465:开源 vs 闭源的差距;Kimi K3;Demis 的重大政策计划 — 奇点将被视为一个过渡期,事后来看才会明白 Import AI 464:Fable 编写 GPU kernel;AI 自动化;以及模拟计算 — 这是新世界的开端吗? Import AI 463:自我改进的机器人;一万卡中国…
Lilian Weng (Lil'Log) · RSS 摘要
面向自我改进的 Harness 工程 — 递归自我改进(RSI)的概念可追溯至 I. J. Good(1965),他将"超智能机器"定义为能够在所有智力活动上超越人类的系统…… 谨慎对待 Scaling Laws — Scaling laws 是深度学习中最关键的实证发现之一。其观察形式简单:随着模型规模扩大,训练损失…
Microsoft Research Blog · RSS 摘要
在 SymCrypt 中验证 Rust 密码学:从标准到代码 — 密码学代码为现代计算系统提供关键防护。了解一种新方法如何在开发者编写代码时对其进行验证,同时保持速度与适应性…… Aurora 1.5:扩展面向天气与地球系统应用的开放基础模型 — Aurora 1.5 在 Aurora 基础模型上新增 22 个变量、小…
Cool Papers · cs.IR (papers.cool) · RSS 摘要
Scientific ClaimSource Retrieval Revisited: A Comparative Study of Style Transfer and ReRanking — 社交媒体上分享的科学声明往往难以核实,可能助长错误信息传播。为应对这一挑战,自动化事实核查系统…… What Do Chin…
Nathan Benaich (State of AI) · RSS 摘要
欧洲无法通过租用方式实现 AI 主权 — 当华盛顿能够一夜之间禁用某个模型时,核心问题不再是 AI 是否安全,而是谁来掌控它。 State of AI:2026 年 5 月 — 2026 年 4 月:AISI 的网络安全阈值、Microsoft 与 OpenAI 关系重置、中国开源权重模型实现代码能力对等、Agent …
Simon Willison · RSS 摘要
逆向工程现在成本很低 — 我不断听到有人用 coding agent 对家中设备进行逆向工程并实现自动化的案例。我认为这是一个有趣的例证,展示了 t… 的影响 谁在害怕中国模型? — 谁在害怕中国模型?Ben Thompson 提出了一个有趣的方案,既指出了实验室一边在未授权数据上训练、一边禁止针对其模型进行蒸馏的虚伪…
Cool Papers · cs.CL (papers.cool) · RSS 摘要
ToolSciVer:基于视觉工具增强强化学习的多模态科学声明验证 — 多模态科学声明验证(MSCV)要求模型利用论文中视觉锚定的证据来验证科学声明,包括图、表格、图表及文本…… 语言编码的率效用前沿:在受控语言内容下对比 token、字节与像素 — 语言模型将文本编码为子词 token、原始字节或渲染像素,但这些编码…
ByteByteGo · RSS 摘要
MCP vs A2A vs ACP:AI Agent 之间是如何实际通信的 — Agent 本身已具备能力,与工具及其他 Agent 结合后,其能力会进一步叠加放大。 多租户架构指南:优势与挑战 — 本文将从基础出发,理解多租户架构及其各项优势与挑战。 大规模 AI 客服:旅游业的十亿美元豪赌 — 本文将沿客服流程从第…
Sebastian Raschka (Ahead of AI) · RSS 摘要
控制 LLM 中的推理强度 — LLM 如何学习低、中、高强度推理模式 使用本地 Coding Agent — 在本地 Coding Harness 中使用开源权重模型,作为 Claude Code 和 Codex 订阅之外的替代方案 LLM 研究论文:2026 年清单(1 月至 5 月) — 今年值得关注的 LLM …
Fireship (YouTube) · RSS 摘要
OpenAI 再陷剽窃诉讼…… 史上最具争议的重写已发布…… OpenAI 强势回归——GPT 5.6 Sol 首发速览 Claude 绝对没有意识…… 互联网的离奇历史……
Andrej Karpathy (YouTube) · RSS 摘要
我如何使用 LLM 深度剖析像 ChatGPT 这样的 LLM 让我们复现 GPT2 (124M) 让我们构建 GPT Tokenizer [[1小时讲座] 大语言模型入门](
Import AI (Jack Clark) · RSS 摘要
Import AI 464:Fable 编写 GPU kernels;AI 自动化;模拟计算 — 这是新世界的开端吗? Import AI 463:自我改进的机器人;一万卡中国 GPU 集群;为人类时代谱写的挽歌式随笔 — 哪些时代为我们的过渡期划定起止? Import AI 462:超级说服;自我维持的 AI;通往 …
Microsoft Research Blog · RSS 摘要
在 SymCrypt 中验证 Rust 密码学:从标准到代码 — 密码学代码为现代计算系统提供关键保护。了解一种新方法如何在开发人员编写代码时验证代码,同时保持速度与适应性…… Aurora 1.5:扩展面向天气与地球系统应用的开源基础模型 — Aurora 1.5 为 Aurora 基础模型新增 22 个变量、小时级…