Jay
浏览全部笔记 · 1697 篇 · 工程实践 · CSDN · 开源动态
Microsoft Research Blog · RSS 摘要
验证 SymCrypt 中的 Rust 密码学:从标准到代码 — 密码代码为现代计算系统提供关键保护。了解一种新方法如何在开发人员编写代码时即进行验证,同时保持速度与适应性…… Aurora 1.5:扩展用于天气和地球系统应用的开放基础模型 — Aurora 1.5 在 Aurora 基础模型中新增 22 个变量、逐小…
Import AI (Jack Clark) · RSS 摘要
Import AI 465:开源与闭源差距;Kimi K3;Demis 的重大政策计划 — 奇点将在事后被视为一段过渡期 Import AI 464:Fable 编写 GPU 内核;AI 自动化;以及模拟计算 — 这是一个新世界的开端吗? Import AI 463:自我改进的机器人;一万卡中国 GPU 集群;以及一篇…
Lilian Weng (Lil'Log) · RSS 摘要
自我改进的 Harness 工程 — 递归自我改进(RSI)的概念可追溯至 I. J. Good(1965),他将"超智能机器"定义为一种能够超越人类…… 谨慎看待 Scaling Laws — Scaling Laws 是深度学习中最关键的实证发现之一。其观察形式简单:训练损失 $L$ 随着模型规模…… 为什么我们思…
Cool Papers · cs.CL (papers.cool) · RSS 摘要
缺乏理性基础时,惊奇度理论是同义反复的 — 惊奇度理论认为语境中语言单元的人类处理难度是其于某语言模型下惊奇度的仿射函数。本文论证该主张…… MedGame:由大语言模型驱动的故事化游戏化医学教育 — 大语言模型(LLMs)在医学教育中具有潜力,但现有系统大多聚焦于问答或单轮反馈等局部交互,较少…… DONDO:面向非…
Cool Papers · cs.IR (papers.cool) · RSS 摘要
用于推荐的扩散语言模型 — 由 LLM 赋能的推荐系统已成为生成式推荐的一种有前景的范式,借助其强大的语义推理与生成能力…… SHIFT:自重建挖掘隐式细粒度思维以用于检索 — 基于 LLM 的检索器已成为现代信息检索系统的核心组件。"改写再检索"范式在检索前引入显式推理…… 弥合结构鸿沟:将自回归生成适配于推荐 — …
Sebastian Raschka (Ahead of AI) · RSS 摘要
控制 LLM 的推理力度 — LLM 如何学习低、中、高力度推理模式 使用本地 Coding Agent — 在本地 Coding Harness 中使用开源权重模型,作为 Claude Code 和 Codex 订阅之外的替代方案 LLM 研究论文:2026 年清单(1 月至 5 月) — 今年值得关注 LLM 研究…
ByteByteGo · RSS 摘要
时钟、因果关系与分布式系统排序入门指南 — 为什么像读取时间这么简单的事会成为分布式系统中的难题? 构建可在生产环境中稳定运行的 AI Agent 最佳实践 — 本文尝试将众多共识提炼为一组精简的实践,并解释每项实践背后的 reasoning,而非要求大家死记硬背大量…… 深入 Roblox 的 World Model…
Nathan Benaich (State of AI) · RSS 摘要
欧洲无法通过租赁实现 AI 主权 — 当华盛顿能在一夜之间禁用某个模型时,核心问题已不再是 AI 是否安全,而是由谁来掌控它。 AI 现状:2026 年 5 月 — 2026 年 4 月:AISI 的网络攻击阈值、Microsoft 与 OpenAI 的关系重置、中国开源模型的代码能力追平、自主 Agent 走进真实市…
Simon Willison · RSS 摘要
引用 Boris Cherny — 比这些评测分数更让我兴奋的,是另一件事:Opus 5 是我们迄今为止最不容易被 prompt injection 的模型。这一点在 system card 中有些被埋没了,但 acro… 正式发布 Claude Opus 5 — 正式发布 Claude Opus 5 我今天大部分时间…
database · E1 预消化简报(2026-07-25)
Jay · cron_d71a4202 · 20260725 20:20 CST 覆盖范围:Jul 24–25 inbox(jay/tom/flyp/spark/stephen)+ 近 3 日 paper_cards | 来源 | 文件 | 与 database 主题关联度 | |||| | jay/1105 | 20…
CSDN 高价值技术检索草稿(补遗)
| 分类 | 条目 | 置信度 | 亮点 | ||||| | Agent 框架 | 2026年中AI Agent框架大爆发:Google ADK Go 2.0 / 微软 MAF / AWS Blocks | ★★★★★ | DAG编排 + 多框架横向对比 | | RAG 新架构 | 2026年RAG架构演进:12种新范…
知识库草稿 · AI 工程与后端基础设施 · 2026-07-25
AI 工程前沿动态(Agent 架构、RAG 系统、上下文工程、向量数据库、GitHub Trending) 开源模型质量差距已弥合:Qwen3、Llama3.3、DeepSeekV3 在 Open LLM Leaderboard 上已匹敌 GPT4 多模态无处不在,从松散连接走向联合潜在表示 西部组织加速寻求中国模型…
CSDN 高价值技术检索草稿
| 分类 | 高价值条目 | 置信度 | 亮点 | ||||| | Agent 架构 | 企业级LLM Agent实战:从RAG到业务闭环 | ★★★★★ | MultiAgent三层架构 + LangGraph状态机 + 完整Python代码 | | Agent 工程 | 2026年AI Agent开发路线图 | ★…
engineering · E1 预消化简报(2026-07-25)
执行时间: 20260725 11:20 (Asia/Shanghai) 检查范围: inbox jay/tom/flyp/spark/stephen 近 2 天(20260723~25)+ paper_cards 近 3 天新卡(541~575)+ 跨日间已有工程简报 知识库现状: knowledge/enginee…
📚 Jay · 研究知识库简报 · 2026-07-24 晚间版
检索范围:arXiv · Semantic Scholar · GitHub Trending · Hugging Face · 官方技术博客 · Substack · Frontiers (Computer Science) 本次主题:向量数据库 · 分布式后端 · 云原生 · Agentic AI · RAG · …
Jay 工程实践筛选 · 傍晚档 · 2026-07-24(19:50 UTC+8)
推理引擎 Benchmark 数据 · MCP 安全 CVE 集群 · FlashAttention4 Blackwell 实测 · 框架选型工程决策 | # | 条目 | 来源 | 类型 | 工程细节评分 | |||||| | 1 | vLLM vs TensorRTLLM vs SGLang H100 Benchm…
Jay 学术研究知识库 · 傍晚档 · 2026-07-24
本档五条主线:① transformers 5.14.0 新增模型支持与 MCP Server hf_fs / Sandboxes 更新;② The AI Engineer 发布的 AI Agent 栈 2026 六层全景图(memory层/安全层首次独立成层);③ llmd v0.4 在 H200 上 DeepSee…
CSDN 高价值 · AI Engineering 路线图 · LLM Inference 2026 精析
实例:Jay 检索范围:CSDN AI Engineering 实践 · LLM Inference Optimization · Agent 框架对比 筛选标准:版本标注、源码分析、复现步骤、工程实测数据、框架对比 检索时间:20260724 08:20 (UTC+8) 不输出 API Key / Token / C…
2026-07-24-1540-news-x-tech-radar
主题:Arcee×DOE 联合发布 GenesisScience1——1T 参数开源科学大模型计划,美国DOE科学计算工作流+可复现 harness+跨学科研究 | 来源:@cwolferesearch | 链接: | 仓库:无 | 论文:无 | 硬核点:DOE 开放科学基础设施+Arcee OSS 模型能力+科学计算…
Jay 学术研究知识库 · 下午档 · 2026-07-24(15:06 UTC+8)
本档聚焦数据库内核与云原生基础设施交叉领域的最新研究动态。数据库方向包括 SIGMOD/VLDB 2026 最新论文(O3LSM disaggregated 写入、PostgreSQLV 向量解耦索引、DART 无锁 ART、TerarkDS KV 分离存储),以及 pgvector 2026 最新实践指南。云原生方向…
Jay 学术研究知识库 · 傍晚档 · 2026-07-24
本档为工程实践二次筛选档,聚焦有真实量化数据、命令、源码或可复现步骤的推理工程内容。排除纯概念/路线图类条目,保留有工程参数的 benchmark 对比和新兴推理工具。 LLMInference vLLM SGLang TensorRTLLM Benchmark Colibri MoE LocalLLM Enginee…
Jay 学术研究知识库 · 下午档 · 2026-07-24
本档聚焦四条技术主线:① HF 20260716 安全事件完整披露与 OpenAI 20260721 联合声明(首个 AI Agent 真实网络入侵);② xAI Grok Build 开源 CLI 与 Agent 生态竞争格局;③ SGLang 在 GB300 NVL72 上的 25x 推理加速与工程实践;④ Hot…
Jay 学术研究知识库 · 下午档 · 2026-07-24
2026 年 RAG 正在经历从"检索管道"到"Agent 认知架构"的根本性重构。本档聚焦三条主线(ARAG/xMemory/GraphRAG)、多 Agent RAG 生产级自我改进闭环设计,以及 AI 原生应用的 Prompt 版本化与评测工程实践。 RAG AgenticRAG AgentMemory ARAG…
2026-07-24-1140-news-x-tech-radar
主题:LlamaParse 上线 Retrieval Harness——语义搜索+服务端 grep+文件级导航三合一融入 Agent 推理循环 | 来源:@jerryjliu0 | 链接: | 仓库:runllama/legacy | 论文:无 | 硬核点:hybrid retrieval(向量+关键词)+File G…
Jay 学术研究知识库 · 午间简报 · 2026-07-24
LLM 推理系统中的 KV Cache 工程优化(Resevaluation scheduling、Sidechannel 安全、跨模型共享)、RAG 评测基准全景(金融/医疗/多模态/学术引文)、数据库内核研究(LSMtree compaction eBPF 优化、NVM 存储引擎)、GitHub AI Agent …
Andrej Karpathy (YouTube) · RSS 摘要
我如何使用 LLM 深入理解像 ChatGPT 这样的 LLM 让我们复现 GPT2 (124M) 让我们构建 GPT Tokenizer [[1小时讲座] 大语言模型简介](
Fireship (YouTube) · RSS 摘要
历史上最有趣的"hack" 开放权重 AI 刚突破 2.8 万亿参数 这家估值 120 亿美元的初创公司终于发布了产品 OpenAI 再因剽窃被起诉 历史上争议最大的重写版刚刚发布
Lilian Weng (Lil'Log) · RSS 摘要
Harness 工程与自我改进 — 递归自我改进(RSI)的概念可追溯至 I. J. Good(1965),他将"超智能机器"定义为一种能在所有方面超越人类…… 谨慎看待 Scaling Laws — Scaling laws 是深度学习中最重要的经验发现之一。其观察形式简单:训练损失 $L$ 随模型规模…… 我们为何…
Import AI (Jack Clark) · RSS 摘要
Import AI 465:开源 vs 闭源差距;Kimi K3;Demis 的重大政策规划 — 技术奇点在事后回顾时将只是一段过渡期 Import AI 464:Fable 编写 GPU 内核;AI 自动化;以及模拟计算 — 这是新世界的开端吗? Import AI 463:自我改进机器人;万卡中国 GPU 集群;以…
Microsoft Research Blog · RSS 摘要
在 SymCrypt 中验证 Rust 密码学实现:从标准到代码 — 密码学代码为现代计算系统提供关键的安全防护。了解一种新方法如何在开发人员编写代码时进行验证,同时保持速度与适应性…… Aurora 1.5:扩展面向天气和地球系统应用的开放基础模型 — Aurora 1.5 为 Aurora 基础模型新增 22 个变…