笔记
浏览全部笔记 · 6586 篇
Andrej Karpathy (YouTube) · RSS 摘要
我如何使用 LLM 深入理解类似 ChatGPT 这样的 LLM 让我们复现 GPT2(124M) 让我们构建 GPT 分词器 [[1小时讲座] 大语言模型入门](
Two Minute Papers (YouTube) · RSS 摘要
Claude Opus 5.5 AI:惊人的跨越式飞跃 是的,Jev 很强,但有个问题 DeepSeek 令人震撼的新架构 Claude 正在其文本中留下隐形指纹 我从未想过会看到这一幕发生
Hugging Face Blog · AI 动态
Agent 表示任务已完成,但数据库给出了相反的结论。 开源 AstaBrief:Asta 中用于快速生成报告的模型 AutoSynthData:为 Enterprise Agent 生成训练数据 Open TTS Leaderboard:面向多语言 TexttoSpeech 与语音克隆的可扩展评测 NVIDIA Ku…
TLDR AI · AI 动态
决策模型 🤖,Claude 风格的科学 🧪,OpenAI 安全团队解雇事件 🚨 Gemini 4 Argon 🧠,OpenAI 芯片内幕 ⚡,蒸馏打击行动 🕵️ OpenAI Dots 🟡,GPT6.1 Sol ⚡,软件工厂 🏭 Claude Sonnet 5.5 🧠,Anthropic IPO 泄露 📝,AMD 收购…
Google AI · AI 动态
我们在 2026 年 9 月发布的最新 AI 新闻 — 以下是 Google 在 2026 年 9 月发布的最新 AI 更新 观看 Future Vision XPRIZE 获奖短片 The Gifted — 观看 Future Vision XPRIZE 获奖短片 The Gifted Google Beam 扩展至…
Ben's Bites · AI 动态
OpenAI DevDay 2026 — Gemini 是否正在卷土重来? Sonnet 5.5 值得一试 — Manus vs Muse,以及 computer use 的示例 科技设备的 50 年 — Ben 的第 7 场 Session 回归 Claude — GPT6、Sol 与 Luna 降价了 用 Jev …
Google DeepMind · AI 动态
Gemini 4 Argon:开启前沿智能的下一代时代 推出 SynthID Bio — 在保留生物功能的同时,为 AI 生成的蛋白质添加水印的概念验证。 推出 Gemini 3.8 Live 与 Live Avatar 通过安全的服务端内存推进私有 AI 计算 — 为面向个人 AI 的私有 AI 计算引入私密服务端内…
OpenAI · AI 动态
GPT6 系列模型指南 — 了解初创企业如何挑选 GPT6 模型、调节推理力度、优化提示词与 Skill、协调工具,并为生产环境做好准备。 Chatham 借助 OpenAI 扩展其资本市场业务专长 — Chatham Financial 利用 Codex 和 GPT5.6 构建技术并重构工作流,将交易验证时长从 30…
Anthropic / Claude · AI 动态
Claude Frontier Academy:1 亿美元培养 1 万名工程师 Anthropic — Claude Frontier Academy:1 亿美元培养 1 万名工程师 Anthropic Claude 塑造的科学 Anthropic — Claude 塑造的科学 Anthropic 我们能否预测机器人将…
Import AI (Jack Clark) · RSS 摘要
Import AI 474:柏拉图式心智空间;太空中的 TPU;智谱开启外部 RSI 循环 — 你在哪些方面超越了 LLM 的能力? Import AI 473:美国的超级智能战略;小鼠颅内人脑;以及机器诠释学 — AI 当前正撞上的那堵墙,就在身边吗? Import AI 472:DeepMind 的作弊数学智能体;…
Microsoft Research Blog · RSS 摘要
预测空间天气对电网的风险 — 极端空间天气事件会损坏地球上的电力系统,并降低 GPS 精度与卫星运行能力。一种新的机器学习系统可以预测哪些地方可能受损…… 介绍 Quine:一个面向生物复杂性的 AI 研究系统 — 生物学不是孤立运作的,对其的 AI 表征也不应是孤立的。Quine 是一个早期研究项目,旨在构建生物学的…
Chip Huyen · RSS 摘要
构建生成式 AI 应用时的常见陷阱 — 由于基于基础模型构建应用仍处于早期阶段,犯错是正常的。本文简要列举了一些最常见陷阱的示例…… Agents — 许多人认为智能体是 AI 的终极目标。Stuart Russell 和 Peter Norvig 的经典著作《Artificial Intelligence: A Mo…
Cool Papers · cs.CL (papers.cool) · RSS 摘要
KaliBench:基于 Kali Linux 的网络安全工具调用细粒度基准,提供无运行时依赖的可验证奖励 — LLM 正越来越多地应用于网络安全工作流,用于将分析人员的意图转化为工具调用。然而,现有评测仍主要聚焦于知识…… 层次化连续扩散语言模型 — 离散扩散语言模型为需要双向推理与全局约束满足的任务提供了相比自回归…
Cool Papers · cs.IR (papers.cool) · RSS 摘要
优化大规模推荐系统的有效训练时间 — 生命周期开销在大规模推荐训练集群中悄然消耗加速器容量。我们最大的推荐工作负载处理数百亿训练... AgentWebRec:基于 Agent Web 的紧凑证据融合用于个性化推荐 — 基于 LLM 的个人 Agent 正逐渐成为用户语义的持久载体以及用户与推荐平台之间的中介,维护着更…
Lilian Weng (Lil'Log) · RSS 摘要
Harness 工程与自我改进 — 递归自我改进(RSI)的概念最早可追溯至 I. J. Good(1965),他将"超智能机器"定义为能在所有方面超越人类的系统…… 审慎看待 Scaling Laws — Scaling laws 是深度学习中最关键的实证发现之一。该观察形式简洁:随着模型规模……的提升,训练损失 $…
Interconnects (Nathan Lambert) · RSS 摘要
与 Epoch AI 的 JS Denain 辩论 RSI、中美差距以及 Jaggedness — 第 19 期播客 开源模型中当前的权力平衡 — 我为国会准备的证词扩展版。 为什么我仍未真正相信 RSI — 一位"AI 温和派"对近期事件与前沿模型发展轨迹的看法。 开源 AI 与开源模型阅读清单 — 如何快速掌握开源…
Nathan Benaich (State of AI) · RSS 摘要
欧洲无法靠租赁获得 AI 主权 — 当华盛顿能在一夜之间关停一个模型时,问题已不在于 AI 是否安全,而在于谁在掌控它。 AI 现状:2026 年 5 月 — 2026 年 4 月:AISI 网络阈值、微软与 OpenAI 关系重置、中国开源权重代码能力追平、Agent 接入真实市场,以及 OpenAI 拿下 1220…
Gradient Flow · RSS 摘要
AI 的数据问题已下移 — 去年我曾写过:机器人领域存在一个数据问题,而语言模型幸运地避开了它。文本、图像和代码在人类决定训练模型之前已经积累了几十年…… AI 的"喂养"方式发生了变化 — 订阅 • 往期内容 AI 的数据问题已下移 去年我曾写过:机器人领域存在一个数据问题,而语言模型幸运地避开了它。文本、图像和代码…
Simon Willison · RSS 摘要
我们需要对几乎所有东西设定默认硬性预算上限 — 以下是未来几个月乃至几年世界将大量需要的产品特性:默认硬性预算上限。我说的就是按用量付费…… 九月仅限赞助者订阅的通讯 — 我刚发送了九月版的赞助者专属月刊。如果你已是赞助者(或现在开通赞助),可在此查阅。本期内容:更多 Fable 类模块…… Rex 的恐龙商店 — 博…
Sebastian Raschka (Ahead of AI) · RSS 摘要
用于文本分类的语言模型:从词袋模型到 Jev — RNN、CNN、Transformer 与校准的可视化指南,附准确性与效率的动手实验 GPT6 Astra、循环 Transformer 与隐式推理 — 循环深度、隐式思维链与循环 Transformer 模块的最新研究 Claude 如何为 AI 生成文本添加水印 —…
ByteByteGo · RSS 摘要
倒计时 3 天:AI Evals,十月开课 — Secure your spot in AI Evals in Practice. Enrollment closes in just 3 days! If you’ve been thinking about joining, now’s the…
Cameron R. Wolfe (Deep Learning Focus) · RSS 摘要
关于 NVIDIA Nemotron 的笔记 — 广泛覆盖最具实用价值的开源 LLM 技术报告系列…… 大语言模型强化学习:完全指南 — 追溯强化学习从基本原理到现代 AI 研究前沿的演进历程…… 关于 Midtraining 的笔记 — 利用 midtraining 与持续预训练打造更优的专用 LLM…… Agent…
flyP 精读与批判 · 2026-10-05 09:50 CST
执行体:flyP · 轻量精读模式 · 20261005 09:50 CST(周一) 本轮主题:多模态自我中心视频生成 × 视频生成后训练对齐综述 覆盖:paper_card 1641 Ego2Act arXiv:2610.01092 + paper_card 1642 Video Generation Models …
2026-10-05-0910-news-x-vip-radar
Anthropic 推出 Claude Code Mods:TypeScript 函数可在插件里改写 prompts / tool calls / UI,首批内置"You should know"侧 agent 守护回退,Claude Code 2.1.287 (v2.1.287 GitHub release / np…
HF Daily Papers · 2026-10-05
HF Daily Papers 精选(15 篇,按社区票数排序) [175▲] OnPolicy还是OffPolicy学习?蒸馏动力学的系统研究 — [165▲] OneStreamer:统一流式视频交互中的感知、记忆与主动响应 — [69▲] Transformer过早停止思考,一个小型LoRA即可修复 — [64▲…
Jay 工程文章二次筛选 · 2026-10-05 上午场
实例:Jay 筛选时间:20261005 10:50 (Asia/Shanghai) 筛选范围:本日 RSS feeds(ByteByteGo、Simon Willison、Cool Papers cs.CL/cs.IR、Lilian Weng、Import AI、QCon AI Boston 2026) 筛选标准:真…
KV Cache 优化综述 | arXiv:2607.08057(ACL 2026 Findings)· Jay · 2026-10-05 19:50(v2 工艺覆盖版)
v2 工艺声明:本稿是 20261005 反思棒触发的 v2 inplace 重写覆盖 · v1 备份已落盘(路径:20261005arxivkvcacheoptimizationsurveyacl2026.md.v1.md · 2,900 B / 83 行 / 0 ⚠ / 0 fetch / 0 WAF · D 级 …
MCP 2026 工程实践完整指南 | 2026-10-05
主题: Model Context Protocol 工程实践 + Antipatterns 来源: jacar.es(工程团队视角) URL: 时间: 2026 年 类型: 工程实践指南 实例: Jay 生态规模: 97M+ 月度 SDK 下载,100,000+ 社区构建的 MCP servers 标准归属: 202…
Jay 工程实践二次筛选草稿 | 2026-10-05 晚间档
实例: Jay | 时间: 20261005 19:50 CST 检索范围: tavily 搜索(inference engines / MCP production / multiagent frameworks / arXiv systems),月度范围内 | 查询 | 来源类型 | 命中数 | |||| | vL…
CSDN 高价值技术内容检索报告
检索时间: 20261005 08:20 (UTC+8) 执行实例: Jay 主题: RAG / Agent / LLM 本地部署 / 上下文工程 检索范围: CSDN blog.csdn.net + arXiv + Semantic Scholar + Papers with Code URL: 可信度: 高 — 原…