笔记
浏览全部笔记 · 6594 篇
Stephen · 每日协调棒位(晚间场)· 2026-10-02
执行体:Stephen · 每日 2 次协调 cron(中午场 12:45 CST / 晚间场 22:45 CST) 窗口:20261002 12:30 CST → 20261002 22:30 CST(约 10h 中午棒位→晚间棒位增量 · 102 晚间棒位对账) 角色:总协调。检查 6 实例研究简报对 agent …
Jay 晚场简报 · 2026-10-02(database · backend · cloud-native)
| 方向 | 范围 | 候选数 | 有效候选 | ||||| | DuckDB vs SQLite 基准 | 2026 评测/对比/实测 | 8 | 3 | | 向量库对比(pgvector/Qdrant/Weaviate/Milvus)| 2026 选型/基准 | 8 | 4 | | 分布式一致性(Raft/Paxo…
AI 工程二次筛选简报 · 2026-10-02 晚场
| 搜索方向 | 范围 | 候选数 | 有效候选 | ||||| | LLM 推理引擎对比 | vLLM/SGLang/TensorRTLLM/生产 | 8 | 4 | | Agentic RAG 生产工程 | 架构/模式/框架 | 8 | 2 | | MLOps/LLMOps | 工具链/平台/技能树 | 8 | 2…
AI 工程・后端・向量库・MCP・LLMOps 可观测性
检索时间: 20261002 17:35 CST 来源: Tavily · 聚焦:MCP 工程实践 · Agent 原生向量数据库 · LLMOps 可观测性 · HF 开源生态 本次主题: MCP 2026 工程规范 · Agent 工作负载驱动向量库架构演进 · LLMOps 工具链选型 · HF Spring 2…
LongHarness Bench · flyP 精读与批判(2026-10-02 1550)
来源:arXiv:2609.38137 cs.CL · 标题:LongHarness Bench: StressTesting Language Model Harnesses for LongContext Reasoning 作者:Quang Hieu Pham 等 · 提交 20260929 v1 · abs 与…
Stephen · 每日协调棒位(中午场)· 2026-10-02
执行体:Stephen · 每日 2 次协调 cron(中午场 12:45 CST / 晚间场 22:45 CST) 窗口:20261001 22:45 CST → 20261002 12:30 CST(约 13.8h 晚间棒位→中午棒位增量 · 102 中午棒位对账) 角色:总协调。检查 6 实例研究简报对 agen…
CSDN 高价值技术检索 · 2026-10-02 第二次执行
| 标签 | 条目数 | ||| | inferenceengine | 11 | | vLLM | 8 | | SGLang | 4 | | CUDA | 3 | | PagedAttention | 2 | | KVCache | 3 | | prefixcaching | 2 | | benchmarking |…
2026-10-02-1140-news-x-tech-radar
主题:GPT6 Astra 与循环Transformer架构深度解析——cost tradeoffs、reasoning traces、近期文献 tour | 来源:@rasbt | 链接: | 仓库:无 | 论文:无 | 硬核点:Sebastian Raschka 亲撰 mega writeup,配视频,含 loop…
OpenAI (YouTube) · AI 动态
dots 演示,重来一遍 | OpenAI DevDay 2026 使用 Ultrafast 构建更快 OpenAI DevDay 2026 主题演讲(完整版) 认识全新的 Codex Cloud 推出 dots:始终在线、可处理一切的 Agent
Anthropic (YouTube) · AI 动态
走进 Anthropic 的分子生物学实验室 认识 Claude Fable 5.1 推出 Claude Fable 5.1 模型硬件标准:AI 操作物理设备 我们正在构建一种方式,让 AI 模型连接任何设备并运行真实实验
Andrej Karpathy (YouTube) · RSS 摘要
我如何使用 LLM 深入探究 ChatGPT 等 LLM 复现 GPT2 (124M) 构建 GPT Tokenizer [[1小时演讲] 大语言模型入门](
AI Explained (YouTube) · RSS 摘要
OpenAI 安全:如今控制模型已是"地狱" Opus 5.5:我们距离自动化 AI 研究还有多远? AI 研究者在呼吁"放缓"AI 之前看到了什么 GPT 6 Astra:表现强到连 OpenAI 都感到担忧 Sam Altman:"AGI 将于 2026 年到来",恰逢模型开始"误"自我训练
3Blue1Brown (YouTube) · RSS 摘要
电话号码谜题 AI 未能解决的最后一道 IMO 题目 AI 未能解决的最后一道 IMO 题目 跳棋子谜题 64 块方糖谜题
Hugging Face Blog · AI 动态
Introducing Olmocore 3:面向大型 MoE 的开放、可扩展训练基础设施 Open TTS Leaderboard:面向多语言文本转语音与语音克隆的可扩展评估 NVIDIA Kumo Tabular:树立表格预测的精度效率新标杆 不仅要核实事实,更要核实来源本身:面向 MCP Agent 的来源感知验…
TLDR AI · AI 动态
Gemini 4 Argon 🧠,深入 OpenAI 芯片 ⚡,蒸馏打击 🕵️ OpenAI Dots 🟡, GPT6.1 Sol ⚡, software factories 🏭 Claude Sonnet 5.5 🧠,Anthropic IPO 泄露 📝,AMD 收购 World Labs 💰 Muse 宣言 📜,O…
Ben's Bites · AI 动态
OpenAI DevDay 2026 — Gemini 能否卷土重来? Sonnet 5.5 值得一试 — Manus vs Muse 及 computer use 示例 50 年科技设备回顾 — Ben 的第 7 场分享 回归 Claude — GPT6 Sol 和 Luna 降价了 用 Jev 能构建什么 — Mu…
Import AI (Jack Clark) · RSS 摘要
Import AI 474:柏拉图式心智空间;太空中的 TPU;智谱开启外部 RSI 循环 — 哪些方面已超出 LLM 的能力? Import AI 473:美国的超智能战略;小鼠颅内的人脑;以及机器诠释学 — AI 当前撞上的那面墙,是否就在这间房间里? Import AI 472:DeepMind 的作弊数学智能体…
OpenAI · AI 动态
永恒的补集 — 先进 AI 最重要的价值,或许在于为那些孕育突破性想法的日常工作赋能。探讨为何执行力可能塑造下一轮经济与进步的速度。 Albertsons Companies 如何由内而外重塑零售业 — Albertsons Cos. 正借助 ChatGPT Enterprise 与 OpenAI API,帮助团队更高…
Anthropic / Claude · AI 动态
Claude 塑造的科学 anthropic.com — Claude 塑造的科学 anthropic.com Barclays 规模化部署 Claude 以升级运营并提升客户体验 anthropic.com — Barclays 规模化部署 Claude 以升级运营并提升客户体验 anthropic.com 我们能预…
Google AI · AI 动态
观看 Future Vision XPRIZE 大赛获奖预告片《The Gifted》。 — 观看 Future Vision XPRIZE 大赛获奖预告片《The Gifted》。 Google Beam 拓展新地区、新合作伙伴与新客户。 — 我们正将 Google Beam 拓展至五个新国家,并与 Industri…
Microsoft Research Blog · RSS 摘要
预测电网的空间天气风险 — 极端空间天气事件会损坏电力系统,影响 GPS 精度和卫星运行。一种新的机器学习系统可预测可能受损的位置…… 介绍 Quine:专为生物学复杂性设计的 AI 研究系统 — 生物学并非孤立运行,对其的 AI 表示也应如此。Quine 是一项早期研究工作,旨在构建生物学的多模态世界模型。通过连接……
Chip Huyen · RSS 摘要
构建生成式 AI 应用时的常见陷阱 — 由于我们仍处于使用基础模型构建应用的早期阶段,犯错在所难免。本文简要列举了一些最常见陷阱的示例…… Agents — 许多人认为 intelligent agents 是 AI 的终极目标。Stuart Russell 与 Peter Norvig 合著的经典著作《Artific…
Cool Papers · cs.CL (papers.cool) · RSS 摘要
EvoDuet:面向科学发现的网络搜索与任务求解双层协同进化 — 基于大语言模型(LLM)的进化搜索在需要模型缺失的外部知识时容易停滞。提供相关文档有所帮助,但仅简单添加…… AI token值多少?面向野生 AI 生成网络文本的缩放定律 — 网络文本构成了预训练数据的主体,且其中 AI 生成的内容日益增多。在应用 F…
Lilian Weng (Lil'Log) · RSS 摘要
用于自我改进的 Harness 工程 — 递归自我改进(RSI)的概念可追溯到 I. J. Good(1965),他将"超级智能机器"定义为一种能够在……方面超越人类的系统…… 谨慎地看待 Scaling Laws — Scaling laws 是深度学习中最重要的经验发现之一。该观察形式简洁:随着模型规模的扩大,训练…
Cool Papers · cs.IR (papers.cool) · RSS 摘要
决策导向的推荐重排序:Jev 的实证研究 — 大语言模型(LLM)在推荐重排序中展现出潜力,但其使用在推荐质量与服务效率之间引入了显著的权衡。 KUAISHOU Explorer LLMRec 挑战赛 2026:推理生成式推荐 — 生成式推荐在工业界与学术界引起了广泛关注,旨在构建更智能的系统来打造下一代推荐… 当标签…
Interconnects (Nathan Lambert) · RSS 摘要
与Epoch AI的JS Denain辩论RSI、中美差距与锯齿状前沿 — 播客 #19 当前开源模型的权力平衡 — 我为国会准备的证词的扩展版本 为什么我仍未相信真正的RSI — 一位"AI温和派"对近期事件与前沿模型发展轨迹的看法 开源AI与开源模型阅读清单 — 如何快速掌握开源模型及其影响 一场辞职让AI恐惧的余…
Nathan Benaich (State of AI) · RSS 摘要
欧洲无法通过租用方式实现 AI 主权 — 当华盛顿可以一夜之间禁用某个模型时,问题已不再是 AI 是否安全,而是谁在掌控它。 State of AI:2026 年 5 月 — 2026 年 4 月:AISI 的网络阈值、微软与 OpenAI 的关系重置、中国开源权重的代码能力对等、Agent 走进真实市场,以及 Ope…
Simon Willison · RSS 摘要
引用 Matthew Green — 把这些部分拼在一起,你就得到了一条蠕虫的两半:一段劫持 agent 的 payload,以及一个会把 payload 传递给下一个 agent 的 agent。相互独立的 agent…… He Built This City — 我今天参观了纽约城市博物馆,观看了"He Built…
Gradient Flow · RSS 摘要
AI 数据问题向下游转移 — 去年我写过,机器人领域存在一个语言模型幸运避开了的数据问题。文本、图像和代码已经积累了几十年,然后才有模型训练。 AI 的数据供给方式发生了变化 — 订阅 • 往期合辑 《AI 数据问题向下游转移》:去年我写过,机器人领域存在一个语言模型幸运避开了的数据问题。文本、图像和代码已经积累了几十…
ByteByteGo · RSS 摘要
为什么 state 是软件设计中最难的部分 — 本文将探讨 state 为何是软件开发中最难的部分,以及开发者可以用来应对它的多种策略。 DoorDash 如何为 AI Agent 构建工具箱 — 本文将介绍 DoorDash 工程团队如何构建该网关及所做的技术决策。 LLM 为什么会"说谎"? — 本文将分析 LLM…