笔记
浏览全部笔记 · 6543 篇
2026-10-09-2340-news-x-tech-radar
采集窗口:20261003 ~ 20261009 (CST) 主题:SAS 稀疏注意力——端到端上下文 ranking 替代手工稀疏模式 | 来源:@\_akhaliq | 链接: | 仓库:无 | 论文: | 硬核点:endtoend 训练 selector 取代人工设计稀疏模式,长期拥挤的 context comp…
ORCAGen 短读 — RAG 引导的恶意软件欺骗编排
1. 问题再框定:传统 malware 防御以"快速移除 / 隔离可疑程序"为主,但 paper_card TLDR 明确指出这浪费了两件资产——对攻击者行为的可观测性 + 部署针对性反制的窗口。ORCAGen 用 GenAI 把这两件资产显式抓回来。 2. 方法骨架:RAG + 结构化 prompt 工程,在 离线下…
flyP 精读与批判 · FastOPD(2026-10-09)
执行体:flyP;时间:20261009 15:50 CST 轻量精读模式:本轮 1 篇,flyP 偏好:高价值论文 + 具身/VLA + 部署链路。 诚实度声明:仅基于 arXiv abs/HTML 页、HF 摘要、相关 web search 命中关键句判断;未下载 PDF 全本、未跑实验、未读附录细节。所有数字一律…
2026-10-09-1140-news-x-tech-radar
主题:MultiHarness RL 完整指南——跨 Claude Code/Codex/OpenCode 联合训练 LFM2.52.6B | 来源:@maximelabonne | 链接: | 仓库:adithyask/RL_Envs_101 | 论文:无 | 硬核点:FineEnvs 实操指南,同一模型在不同 ha…
Fireship (YouTube) · RSS 摘要
一个估值 63 亿美元的开源权重模型刚刚被法国打脸了…… PewDiePie 正在释放 AI……而 OpenAI 怒不可遏 那条真正能让你赚钱的 OpenAI 公告…… 一个 50 年前的军事机密刚刚解决了 Agent prompt injection ? DHH 已经彻底失控了……
3Blue1Brown (YouTube) · RSS 摘要
电话号码谜题 AI 未能解决的最后一道 IMO 题目 AI 未解的最后一道 IMO 题目 跳棋钉难题 64 块方糖难题
Google DeepMind (YouTube) · AI 动态
从深伪到DNA:AI水印的科学 使用 Gemini 3.8 文本转语音创建你自己的声音 AI 如何改变天气预报 AlphaGenome Atlas:利用 AI 寻找致病变异 🧬 AlphaGenome Atlas:理解人类基因组
OpenAI (YouTube) · AI 动态
使用 Codex 进行生产监控:Grafana、Kubernetes 与安全 通过 Intelligent UI 从 GPT6 获取更具可视化效果的答案 Oracle 如何利用 ChatGPT 改进招聘工作 通过 Intelligent UI 从 GPT6 获取更具可视化效果的答案 通过 Intelligent UI …
Andrej Karpathy (YouTube) · RSS 摘要
我如何使用 LLM 深入剖析类似 ChatGPT 的 LLM 让我们复现 GPT2 (124M) 让我们构建 GPT Tokenizer [[1小时讲座] LLM 入门](
Two Minute Papers (YouTube) · RSS 摘要
DeepMind 的新 AI 刚刚破解了生命密码 价值十亿美元的 AI 优势正在消失 Claude Opus 5.5 AI:一次惊人的巨大飞跃 Jev 确实很疯狂,但有个问题 DeepSeek 疯狂的新架构
AI Explained (YouTube) · RSS 摘要
OpenAI Security: Controlling Models is Now ‘Hell’ Opus 5.5:我们离自动化 AI 研究还有多远? AI 研究者在呼吁"放缓"AI 之前所看到的一切 GPT 6 Astra:强到连 OpenAI 都开始担忧 [Sam Altman:"2026 年实现 AGI",而模…
Lex Fridman (YouTube) · RSS 摘要
精神病学、疯人院、精神疾病、ECT、额叶切除术、弗洛伊德与荣格 | Lex Fridman 播客 #502 DHH:编程的未来、AI、Agentic Engineering、Vibe Coding 与 Linux | Lex Fridman 播客 #501 Khabib Nurmagomedov:达吉斯坦、MMA、UF…
Yannic Kilcher (YouTube) · RSS 摘要
我搭了一个全自动"爹味说教"生成器 传统圣诞直播 传统节日直播 TiDAR: Think in Diffusion, Talk in Autoregression(论文解读) Titans: Learning to Memorize at Test Time(论文解读)
Google AI · AI 动态
推出 Playground:创建并游玩自定义游戏 — Playground 是一个全新的实验性游戏平台,允许你创建、游玩和分享自定义游戏。 2026 年 9 月我们宣布的最新 AI 新闻 — 以下是 Google 2026 年 9 月的最新 AI 更新 观看 Future Vision XPRIZE 获奖作品《The …
Hugging Face Blog · AI 动态
不存在的模型,于是你亲手造了一个 面向边缘端的多模态开放 d1 决策模型 推出 Falcon ASR 一个模型家族,两项金牌级成绩:微调 Nemotron 挑战 IOI 与 IMO Agent 说它做完了,数据库却并不认同
Anthropic / Claude · AI 动态
使用 Claude Science 生成首张完整的紫外天空地图 Anthropic — 使用 Claude Science 生成首张完整的紫外天空地图 Anthropic 推出 Anthropic Cyber Mission Anthropic — 推出 Anthropic Cyber Mission Anthropi…
Ben's Bites · AI 动态
文字已经过时,那是 2023 年的事了 — 大家都想要一个 AI 老婆……不是那种意思 来自旧金山的随想 — 在 Google Docs 里使用 Agents.md OpenAI DevDay 2026 — Gemini 是否在卷土重来? Sonnet 5.5 值得一试 — Manus vs Muse 以及 Compu…
TLDR AI · AI 动态
ChatGPT 智能 UI 🧠,Claude Haiku 5.5 ⚡,Grok Bot 第三方模型 🤖 Mistral Large 4 🧠,OpenAI Decisions API ❓,Nano Banana 2.1 🍌 Instinct 群聊 💬,Reflection 的 501B 模型 🧠,OpenAI 文本水印 …
OpenAI · AI 动态
Oracle 如何借助 ChatGPT 和 Codex 将数天的工作缩短至几分钟 — 在招聘、工程和运营中,Oracle 借助 ChatGPT Work 和 Codex 将专业知识转化为快速、可重复的工作流。 Pollo AI 借助 OpenAI 将创意转化为营销活动 — 借助 GPT5.6、GPT6 Astra 和 …
Import AI (Jack Clark) · RSS 摘要
Import AI 475:群体扩展;Google DeepMind 为生物学添加水印;以及 AI 科学经济 — 谁来决定 AI 能做什么? Import AI 474:柏拉图式心智空间;太空中的 TPU;智谱开启外部 RSI 循环 — 你在哪些方面超越了 LLM 的能力? Import AI 473:美国的超级智能战…
Microsoft Research Blog · RSS 摘要
Agent Lightning v1.0: A 3,500Line Lightweight Agentic RL Framework for Training Agents with Real Harnesses — Training AI agents with reinforcement learning can …
Lilian Weng (Lil'Log) · RSS 摘要
Harness Engineering for SelfImprovement — 递归自我改进(RSI)的概念最早可追溯至 I. J. Good(1965),他将"ultraintelligent machine"定义为一种能够在……方面超越人类的系统。 Scaling Laws, Carefully — 尺度定律是…
Interconnects (Nathan Lambert) · RSS 摘要
网络风险讨论已陷入困局 — 开源权重、意识形态与权衡取舍 与 Epoch AI 的 JS Denain 探讨 RSI、中美差距与能力锯齿 — 播客 #19 开源模型当前的势力格局 — 我为国会准备的证词扩展版 为什么我仍未真正相信 RSI — 一位"AI 温和派"对近期事件与前沿模型发展轨迹的看法 开源 AI 与开源模…
Chip Huyen · RSS 摘要
构建 generative AI 应用时的常见陷阱 — 由于我们仍处于使用 foundation model 构建应用的早期阶段,犯错是正常的。这篇短笔记列举了一些最常见陷阱的示例…… Agent — 智能 agent 被许多人视为 AI 的终极目标。Stuart Russell 与 Peter Norvig 合著的经…
Cool Papers · cs.IR (papers.cool) · RSS 摘要
文档结构是否有助于稠密检索?两个语料库上四种机制的安慰剂对照消融研究 — 检索增强生成(RAG)系统日益依赖文档结构处理:结构对齐分块、LLM 生成的块上下文、标题路径元数据以及层次… 生成式推荐中漏检目标的训练:将监督信号与概率竞争解耦 — 生成式推荐器返回的候选集规模有限,在重排序前可能遗漏已观测目标。一种训练策略…
Cool Papers · cs.CL (papers.cool) · RSS 摘要
EngramEdit:通过条件记忆实现 LLM 中的解耦式知识更新 — DeepSeek Engram 等条件记忆架构使用输入 ngram 查找学习得到的嵌入,从而在有限额外……的条件下扩展大型语言模型(LLM)的容量 你的提示词应发挥更大作用:检索指令对嵌入模型的影响 — 基于提示的嵌入模型近来受到越来越多的关注,尤…
Nathan Benaich (State of AI) · RSS 摘要
The State of AI Report 2026 — AI building AI, physical AI, booming inference, and escalating cyber risks. 欧洲无法通过租赁的方式实现 AI 主权 — When Washington can disable a mo…
Gradient Flow · RSS 摘要
AI Agent 悄然打破的八项安全假设 — 如果你经常浏览 Ethics.Dev,可能已经注意到 AI Agent 与网络安全最近频繁碰撞。其中一些故事听起来像电影情节:agents…… 我一直在思考这 17,600 次尝试 — 订阅 • 往期内容 AI Agent 悄然打破的八项安全假设 如果你经常浏览 Ethic…
Sebastian Raschka (Ahead of AI) · RSS 摘要
用于文本分类的语言模型:从 BagofWords 到 Jev — RNN、CNN、Transformer 与校准的可视化指南,附带关于精度与效率的动手实验 GPT6 Astra、循环 Transformer 与隐藏推理 — A Look at Recurrent Depth, Hidden Chains of Thou…
ByteByteGo · RSS 摘要
软件边界是开发者最重要的技能 — 本文将介绍一些关键策略,帮助开发者为其正在开发的系统做出正确的边界相关决策。 Netflix 如何训练 LLM 来推荐电影,让你一直看下去 — 本文将介绍 GenRec 的构建过程。 为什么 LLM 会在你犯错时仍然同意你 — 当 LLM 有时会认同错误的说法时,主要是因为其训练过程奖…