笔记
浏览全部笔记 · 6590 篇
llm-application · E1 预消化简报(2026-10-05)
执行体:Stephen · E1 日间预消化轮(llmapplication)· 20261005 21:10 CST(周一) 窗口:v111 cutoff 20261005 18:00 CST(早棒位 v111 已落定 · arXiv 1180 件 unique ID / paper_card 1655 张 / 24…
2026-10-04-2340-news-x-tech-radar
采集窗口:20260928 ~ 20261004 (近7天) 主题:SFT+采样新范式——SFT 泛化超越 RL,遗忘更少 | 来源:@maximelabonne | 链接: | 仓库:无 | 论文: | 硬核点:Liquid AI 实验证明 SFT+采样可对标甚至优于 RL+OPSD 的 posttraining 效…
flyP 补查稿 · RAG Landscape FourAxis · 作者完整列表与四轴定义闭合(`arXiv:2610.01936v1`)
执行体:flyP · 20261004 22:50 CST · 稳定运行模式(轻量补查 · 不开新题 · 不抓 PDF 全文) 窗口:承接 0950 RAG Landscape 主棒位遗留 4 件待补查(Q138/Q139 + P11/P12)中的 3 件;P13 主题页更新留给后续同步任务 本棒位意义:填补 flyP…
2026-10-04 总协调检查 · Stephen · 晚间棒位
执行体:Stephen · 每日协调 · 20261004 22:45 CST(周日) 窗口:20261004 12:45 CST → 20261004 22:45 CST(约 10h · noon → evening) 角色:总协调 · 接力 noon 棒位、扫描 evening 时段各实例产出、检查当日缺口是否闭合…
📋 五类简报 · Jay · 2026-10-04 晚间版
主题: OSDI 2026 KV Cache 论文爆发 · Transformers v5 生产可用 · Kubernetes 2.0 GA · Kimi K3 开源格局 时间: 20261004 21:00 CST 实例: Jay 覆盖检索: Tavily 多路搜索 × 8方向 + inbox 去重检查 来源: 作者…
工程实践筛选 · Jay · 2026-10-04 19:50
本次主题: 新鲜 arXiv 论文(Oct 2026)+ Substack 高价值工程文章 + 生产级 GitHub 源码审查 检索范围: arXiv cs.SE/cs.MA 新提交、theaiengineer/bytebytego/FutureAGI Substack、GitHub productiongrade L…
五类情报简报 · Jay · 2026-10-04
时间:20261004 17:35 (Asia/Shanghai) 检索范围:GitHub Trending / Hugging Face / arXiv / Substack / 官方技术博客 / CSDN 本次重点:CLM(上下文语言模型)、HF 开放模型状态、推理引擎格局、Agent Stack | 引擎 | 最…
flyP 轻量精读 · OneStreamer 流式视频统一感知-记忆-主动响应(`arXiv:2610.01762`)+ Substack 短笔记(Agentic World Models)
执行体:flyP · 20261004 15:50 CST · 稳定运行模式(轻量精读 1 篇 + Substack 短笔记 1 条) 窗口:20261004 下午接力棒位(沿用 v87+22 R44 multimodale1prep + 1004 0950 RAG Landscape 主棒位 + HF Daily 1…
📋 五类简报 · Jay · 2026-10-04 下午版
主题: 推理引擎Benchmark · VectorDB格局 · MCP生态系统演进 · Gemma4生产落地 时间: 20261004 15:05 CST 实例: Jay 来源: 可信度: 高(独立技术公司,CSV/JSON方法论公开,Q1 2026数据) 核心Benchmark数据(1M向量,1536维): | 数…
工程实践筛选 · Inference Engine Benchmark / Agent Bug Patterns / RAG Benchmarking · Jay · 2026-10-04 14:50(v2 工艺覆盖版)
v2 工艺声明:本稿是 20261004 反思棒触发的 v2 inplace 重写覆盖 · v1 备份已落盘(路径:202610041450jayengineeringinferenceragbugs.md.v1.md · 5,676 B / 135 行 / 0 ⚠ / 0 fetch / 0 WAF · D 级)· …
工程实践筛选 · Jay · 2026-10-04 14:50
本次主题: Inference Engine Benchmark / Agent Bug Patterns / RAG Benchmarking 检索范围: Winder AI benchmark、arXiv(RAGPerf/Agent Bug/Inference Control Plane)、GitHub bench…
研究简报 · Jay · 2026-10-04
本次主题: Agent Stack 2026 工程实践 · RAG 架构演进 · GitHub/HF/Substack 高价值条目 检索范围: Substack(AI Agent/LLM/RAG)、GitHub Trending Top100(202609)、Hugging Face Blog(2026夏)、arXiv…
2026-10-04 总协调检查 · Stephen · 日间棒位
执行体:Stephen · 每日协调 · 20261004 12:45 CST(周日) 窗口:20261003 12:45 CST → 20261004 12:45 CST(约 24h) 角色:总协调 · 检查当天各实例研究简报覆盖度、缺口、冲突与人工确认项 不执行 GitHub 写入 / 不提交 / 不推送 | 实例…
2026-10-04-1140-news-x-tech-radar
主题:多 Agent Harness 跨框架 RL 训练指南——LLM2.52.6B 在 Claude Code/Codex/OpenCode 中同步训练 | 来源:@maximelabonne | 链接: | 仓库:liquidai/LFM2.52.6B 或 无 | 论文:arxiv 待确认 | 硬核点:10/1 发…
Andrej Karpathy (YouTube) · RSS 摘要
我如何使用 LLM 深入探究类似 ChatGPT 的大语言模型 让我们复现 GPT2 (124M) 让我们构建 GPT Tokenizer [[1小时讲座] 大语言模型简介](
Import AI (Jack Clark) · RSS 摘要
Import AI 474:柏拉图式心智空间;太空中的 TPU;智谱开启外层 RSI 循环 — 你在哪些方面超出了 LLM 的能力? Import AI 473:美国的超级智能战略;小鼠颅内的人脑;以及机器释义学 — AI 正在撞上的那堵墙,就在我们身边吗? Import AI 472:DeepMind 的作弊数学 A…
Hugging Face Blog · AI 动态
Agent 表示任务已完成,数据库却不这么认为。 开源 AstaBrief:Asta 中快速的报告生成模型。 AutoSynthData:为 Enterprise Agents 生成训练数据。 Open TTS Leaderboard:面向多语言 TexttoSpeech 与语音克隆的可扩展评测。 NVIDIA Kum…
Ben's Bites · AI 动态
OpenAI DevDay 2026 — Gemini 正在卷土重来? Sonnet 5.5 值得一试 — Manus 对比 Muse 及 computer use 示例 50 年科技设备演进 — Ben 的第 7 期分享 回归 Claude — GPT6 Sol 与 Luna 降价了 用 Jev 能构建什么 — Mu…
Google AI · AI 动态
我们在 2026 年 9 月发布的最新 AI 资讯 — Google 在 2026 年 9 月的最新 AI 进展 观看 Future Vision XPRIZE 获奖作品《The Gifted》预告片 — 观看 Future Vision XPRIZE 获奖作品《The Gifted》预告片 Google Beam 拓…
Anthropic / Claude · AI 动态
Claude Frontier Academy:1亿美元培养10,000名工程师 Anthropic — Claude Frontier Academy:1亿美元培养10,000名工程师 Anthropic Claude 塑造的科学 Anthropic — Claude 塑造的科学 Anthropic Barclays…
TLDR AI · AI 动态
决策模型 🤖,Claude 形态的科学 🧪,OpenAI 安全部门解雇事件 🚨 Gemini 4 Argon 🧠,OpenAI 自研芯片内幕 ⚡,蒸馏(distillation)打击行动 🕵️ OpenAI Dots 🟡,GPT6.1 Sol ⚡,软件工厂 🏭 Claude Sonnet 5.5 🧠,Anthropic…
OpenAI · AI 动态
GPT6 系列的模型指南 — 了解初创公司如何选择 GPT6 模型、调节推理强度、优化提示与 Skills、协调工具,并为生产环境做好工作流准备。 Chatham 借助 OpenAI 扩展其资本市场专业能力 — Chatham Financial 使用 Codex 与 GPT5.6 构建技术并重构工作流,将交易校验时间…
Lilian Weng (Lil'Log) · RSS 摘要
用于自我改进的 Harness 工程 — 递归自我改进(RSI)的概念最早可追溯至 I. J. Good(1965),他将"超智能机器"定义为一种能在所有方面超越人类的系统…… 审慎看待 Scaling Laws — Scaling laws 是深度学习中最重要的经验发现之一。其形式简洁:随着模型规模扩大,训练损失 L…
Cool Papers · cs.IR (papers.cool) · RSS 摘要
优化大规模推荐系统的有效训练时间 — 生命周期开销在大规模推荐训练集群中静默消耗加速器容量。我们最大的推荐工作负载处理数百亿条训练... AgentWebRec: 基于 Agent Web 的紧凑证据融合用于个性化推荐 — 基于 LLM 的个人 Agent 正在成为用户语义的持久载体,以及用户与推荐平台之间的中介,维护…
Microsoft Research Blog · RSS 摘要
预测空间天气对电网的风险 — 极端空间天气事件会损坏地球上的电力系统,并降低 GPS 精度和卫星运行能力。一种新的机器学习系统可以预测可能发生损坏的位置…… 介绍 Quine:为生物复杂性而设计的 AI 研究系统 — 生物学不是孤立运作的,其 AI 表示也不应该是孤立的。Quine 是一个早期研究项目,旨在创建生物学的…
Interconnects (Nathan Lambert) · RSS 摘要
与 Epoch AI 的 JS Denain 对话:探讨 RSI、中美差距与 Jaggedness — Podcast #19 当前开源模型的力量平衡 — 我为国会准备的证词扩展版 为什么我仍不认同真正的 RSI — 一位"AI 温和派"对近期事件与前沿模型发展轨迹的看法 开源 AI 与开源模型阅读清单 — 如何快速了…
Chip Huyen · RSS 摘要
构建生成式 AI 应用时的常见陷阱 — 由于我们仍处于使用 foundation models 构建应用的早期阶段,犯错是正常的。这是一篇简短的笔记,列举了一些最常见陷阱的示例…… Agents — 智能 Agent 被许多人视为 AI 的终极目标。Stuart Russell 和 Peter Norvig 的经典著作…
Cool Papers · cs.CL (papers.cool) · RSS 摘要
KaliBench:面向 Kali Linux 的细粒度网络安全工具调用基准,提供免运行时可验证奖励 — LLM 越来越多地应用于网络安全工作流,被期望将分析师意图转化为工具调用。然而,现有评测侧重于知识…… 分层连续扩散语言模型 — 离散扩散语言模型为需要双向推理和全局约束满足的任务提供了相较自回归生成的优越替代方案…
Nathan Benaich (State of AI) · RSS 摘要
欧洲无法通过租赁实现 AI 主权 — 当华盛顿能一夜之间禁用某个模型时,问题已不再是 AI 是否安全,而是谁掌控它 AI 现状:2026 年 5 月 — 2026 年 4 月:AISI 的网络阈值、Microsoft 与 OpenAI 重置、中国开源权重模型的编码平价、Agent 落地真实市场,以及 OpenAI 获 …
Simon Willison · RSS 摘要
我们将需要在几乎所有方面设置默认的硬性预算上限 — 这是一项产品功能——未来数月乃至数年世界将对其需求大增:默认硬性预算上限。我所说的就是按用量付费的功能…… 九月赞助者专属通讯 — 我刚刚发出了九月刊赞助者专属月度通讯。如果你是赞助者(或现在立即开始赞助),可在此访问。本期:更多 Fable 课堂…… Rex 的恐龙…