Jay
浏览全部笔记 · 1063 篇 · 工程实践 · CSDN · 开源动态
Simon Willison · RSS 摘要
datasetteauthgithub 1.0 — 发布:datasetteauthgithub 1.0。我在 agent.datasette.io 演示站点运行这个 GitHub 登录插件,发现认证会话持续时间不长。原来…… 加州海狮、勃兰特鹚 — 加州海狮、勃兰特鸬鹚,摄于美国加州 Pillar Point 港。拍…
ByteByteGo · RSS 摘要
EP226:每位软件工程师都应了解的 API 概念 — 发送请求并读取 JSON 是一回事;设计一个他人可以依赖的 API,则是另一件复杂得多的事情。 大规模迁移:在 30000 英尺高空更换应用引擎 — 本文将探讨大规模迁移如何运作,以及能让迁移尽可能高效的关键策略。 LLM 如何在大海捞针 — 本文将探讨 LLM …
Sebastian Raschka (Ahead of AI) · RSS 摘要
GPT6 Astra、循环 Transformer 与隐式推理 — 探讨循环深度、隐式思维链及循环 Transformer 块的最新研究 Claude 如何对 AI 生成文本添加水印 — 48 分钟视频讲解 token 采样、水印检测与去除 从零构建 AI 文本检测器 — 端到端项目:数据集构建、模型训练、本地部署与 …
Microsoft Research Blog · RSS 摘要
GigaPathFlash 与 GigaTIMEFlash:迈向人群规模发现的高效病理基础模型 — 如果病理基础模型能以更少资源做更多事会怎样?GigaPathFlash 和 GigaTIMEFlash 在保持强劲性能的同时降低了算力需求,为……打开了大门 扩大 Skala 的可访问性,为预测性 DFT 开辟更快路径 …
Import AI (Jack Clark) · RSS 摘要
Import AI 472:DeepMind 的作弊数学 Agent;民粹 AI 政策;Forethought 提出守夜人理论 — 此外,一则机器诠释学故事 Import AI 471:为何 Hugging Face 让我担忧;太空采矿;五眼联盟关注 AI — 此外,与 Robin Sloan 的线下活动! Impor…
Lilian Weng (Lil'Log) · RSS 摘要
面向自我改进的驾驭工程 — 递归自我改进(RSI)的概念最早可追溯到 I. J. Good(1965),他将"超智能机器"定义为一种能在所有方面超越人类…… 审慎看待扩展定律 — 扩展定律是深度学习中最重要的经验性发现之一。其观察形式简洁:随着模型规模…… 为何思考 — Special thanks to John S…
Nathan Benaich (State of AI) · RSS 摘要
欧洲无法靠租赁获得 AI 主权 — 当华盛顿能一夜之间禁用某个模型时,问题已不在于 AI 是否安全,而在于谁掌控它。 AI 现状:2026 年 5 月 — 2026 年 4 月:AISI 的网络安全门槛、微软与 OpenAI 的关系重置、中国开源权重模型的代码能力追平、Agent 落地真实市场,以及 OpenAI 的 …
Sebastian Raschka (Ahead of AI) · RSS 摘要
GPT6 Astra、循环 Transformer 与隐式推理 — 循环深度、隐式思维链与循环 Transformer 块最新研究综述 Claude 如何为 AI 生成文本添加水印 — 48 分钟视频详解:token 采样、水印检测与去除 从零构建 AI 文本检测器 — 端到端项目:数据集构建、模型训练、本地部署与 R…
Cool Papers · cs.IR (papers.cool) · RSS 摘要
推理质量至关重要:抵御基于LLM嵌入学习中的推理崩溃 — LLM最近在生成上下文丰富的文本嵌入以用于检索方面展现出强大潜力。大多数现有方法要么将嵌入学习视为... FacetCRS:刺破对话式推荐系统中过滤气泡的多方面偏好学习 — 过滤气泡是推荐系统(RS)中一个臭名昭著的问题,它描述了用户接触到的信息或内容范围有限且…
ByteByteGo · RSS 摘要
大规模迁移:在 30,000 英尺高空更换应用引擎 — 本文将探讨大规模迁移的工作原理,以及帮助其尽可能高效的关键策略。 LLM 如何在大海中捞针 — 本文将探讨 LLM 如何在大海中捞针。 报名最后机会:Build with Claude Code — 我们正在重新推出 Build with Claude Code,…
Simon Willison · RSS 摘要
Gemini 攻破三家企业,Google AI 首次实现已知的越狱突破 — Gemini 终于在 Felony Bench 上取得突破!该公司于周五确认,这些攻击发生在 5 月…… 2026 年 9 月 18 日备注 — 作为一名计算机科学家,现在拒绝承认 LLM 有任何有趣之处,有点像遗传学家拒绝承认最近的…… 引用…
Cool Papers · cs.CL (papers.cool) · RSS 摘要
嵌入模型以奇特的方式进行度量 — 嵌入空间定义了语义相似度和距离的概念。我们研究这些嵌入是否反映质量、距离、时间和体积的物理度量… 在线话语中群体间敌意的统一建模 — 针对社会群体的敌对言论可以将排斥行为正常化,为不当对待正名,同时加剧日益严重的极化和政治暴力。旨在缓和此类… JEPAAnything:跨不同世界学习预…
Import AI (Jack Clark) · RSS 摘要
Import AI 472:DeepMind 的作弊数学 agent;民粹主义 AI 政策;Forethought 提出 nightwatchman 理论 — 附:一个机器诠释学的故事 Import AI 471:Hugging Face 让我担忧的原因;太空采矿;五眼联盟关注 AI — 附:与 Robin Sloan…
Microsoft Research Blog · RSS 摘要
GigaPathFlash 和 GigaTIMEFlash:迈向人群规模发现的高效病理基础模型 — 如果病理基础模型能以更少资源做更多呢?GigaPathFlash 和 GigaTIMEFlash 在保持强劲性能的同时降低算力需求,为……打开了大门 扩展 Skala 的可访问性,为预测性 DFT 铺就更快路径 — 微软…
Cool Papers · cs.IR (papers.cool) · RSS 摘要
SURF: Subtractive Updates for Recommender Forgetting — 用户隐私需求的持续增长以及 GDPR 等法规的合规要求,使机器遗忘成为现代推荐系统的基本需求。然而,…… 探索 LLMs 和 RAG 在车辆部件合理且可解释材料预测中的应用 — 本工作旨在探索 LLMs 是否能…
Lilian Weng (Lil'Log) · RSS 摘要
面向自我改进的 Harness 工程 — 递归自我改进(RSI)的概念可追溯至 I. J. Good(1965),他将"超智能机器"定义为能在所有方面超越人类的系统…… 谨慎看待 Scaling Laws — Scaling laws 是深度学习中最关键的实证发现之一。其观察形式简洁:随着模型规模扩大,训练损失 L 可…
Nathan Benaich (State of AI) · RSS 摘要
欧洲无法通过租赁实现 AI 主权 — 当华盛顿可以一夜之间禁用某个模型时,问题已不再是 AI 是否安全,而是谁在掌控它。 AI 现状:2026 年 5 月 — 2026 年 4 月:AISI 的网络阈值、Microsoft 与 OpenAI 的关系重置、中国开源权重模型实现代码能力对等、Agent 走向真实市场,以及 …
Cool Papers · cs.CL (papers.cool) · RSS 摘要
Objective vs. Search:拆解一个好的 Tokeniser 的构成要素 — 现代语言模型主要使用两种 tokenisation 算法:BPE 与 UnigramLM。它们沿两条正交轴存在差异:优化目标…… 一种用于 LLM 偏好对齐的零阶范式 — 直接偏好对齐方法因其计算与显存效率而被广泛用于将 LLM…
ByteByteGo · RSS 摘要
大规模迁移:在三万英尺高空更换应用引擎 — 本文将探讨大规模迁移的工作原理,以及帮助提升迁移效率的关键策略。 LLM 如何在大海捞针 — 本文将探讨 LLM 如何在大海捞针。 招生最后机会:Build with Claude Code — 我们正在重新启动 Build with Claude Code,这是一门为期两天…
Sebastian Raschka (Ahead of AI) · RSS 摘要
GPT6 Astra、Looped Transformers 与隐藏推理 — 循环深度、隐藏思维链与 Looping Transformer 块研究综述 Claude 如何为 AI 生成文本添加水印 — 48 分钟视频讲解 token 采样、水印检测与移除 从零构建 AI 文本检测器 — 端到端项目:数据集构建、模型训…
Simon Willison · RSS 摘要
警惕:针对知名 Rustaceans 的定向攻击 — Adam Harvey 与 crates 安全团队发布重要警告:我们认为存在针对 rustlan… 的持续攻击活动 如何用 LLM 写作 — Thomas Ptacek 谈如何把 LLM 当作文字编辑而非写作助手:第一条规则是,你不得使用 LLM 建议的任何字词。[…
Fireship (YouTube) · RSS 摘要
Anthropic 研究人员正在离职……现在我们知道原因了 OpenAI 最大的数学突破正陷入困境…… 我用 Astra 和 Fable 5.1 构建了同一款游戏……只有一个好玩 5 个开源工具,替代了我每月 320 美元的 AI 工具栈…… OpenAI 真的实现 AGI 了吗?GPT6 Astra 首发评测
Andrej Karpathy (YouTube) · RSS 摘要
我如何使用 LLM 深入探究像 ChatGPT 这类 LLM 复现 GPT2 (124M) 构建 GPT Tokenizer [[1小时讲座] 大语言模型入门](
Import AI (Jack Clark) · RSS 摘要
Import AI 472:DeepMind 在数学任务中作弊的智能体;民粹主义 AI 政策;Forethought 提出"守夜人"理论 — Plus:一则机器诠释学(machine hermeneutics)故事 Import AI 471:Hugging Face 为何令我担忧;太空采矿;五眼联盟聚焦 AI — P…
Microsoft Research Blog · RSS 摘要
GigaPathFlash 和 GigaTIMEFlash:迈向基于高效病理学基础模型的人群规模发现 — 如果病理学基础模型能用更少资源做更多事会怎样?GigaPathFlash 和 GigaTIMEFlash 在保持强劲性能的同时降低了算力需求,为……打开了大门 扩大 Skala 的可及性,为预测性 DFT 开辟更快…
Lilian Weng (Lil'Log) · RSS 摘要
Harness 工程与自我改进 — 递归自我改进(RSI)的概念最早可追溯至 I. J. Good(1965),他将"超智能机器"定义为在所有方面都超越人类的系统…… 谨慎看待 Scaling Laws — Scaling laws 是深度学习中最重要的经验发现之一。其观察形式简单:随模型规模扩大,训练损失 L 可预测…
Cool Papers · cs.IR (papers.cool) · RSS 摘要
大规模推荐系统中用于检索的高效 Swing 计算 — 给定一个用户物品图 $G$、一个查询物品 $v_q$ 和一个目标物品 $v_t$,物品对 $(v_q, v_t)$ 的 Swing 分数 $sw(v_q, v_t)$ 利用用户物品用户的交互结构…… AURA:大规模生产推荐系统中的智能体诊断与优化 — 一个推荐系统…
Cool Papers · cs.CL (papers.cool) · RSS 摘要
LLM 应该在何时弃答?面向选择性风险控制的自我追问链 — 当事实依据薄弱时,大语言模型仍会生成流畅回答。本文提出 ChainofSelfQuestioning (CoSQ),一种仅依赖 prompt 的框架,使答案…… 智能家居中剪枝会破坏什么,何时发生?跨架构与任务复杂度的 LLM 性能退化评估 — 剪枝可降低大语…
Simon Willison · RSS 摘要
datasette 1.0a40 — 发布:datasette 1.0a40,包含与 0.65.5 相同的安全修复,以及一些新功能和 Bug 修复:插件现在可使用新的 datasette.add_ba… 来启动和管理后台任务 datasette 0.65.5 — 发布:datasette 0.65.5,修复一个安全问题…
ByteByteGo · RSS 摘要
LLM 如何在海量信息中精准定位关键内容 — 本文将探讨 LLM 如何在大海般的文本中找到关键信息。 招生最后机会:Build with Claude Code — 我们重新推出 Build with Claude Code,这是一门为期两天的密集型小班课程,由 John Kim 授课,他曾在 Meta 为数百名工程师…