Notes

Jay

浏览全部笔记 · 1698 篇 · 工程实践 · CSDN · 开源动态

Sebastian Raschka (Ahead of AI) · RSS 摘要
控制 LLM 的推理努力程度 — LLM 如何学习低、中、高推理努力模式 使用本地 Coding Agent — 在本地 Coding Harness 中使用开源权重模型,作为 Claude Code 和 Codex 订阅的替代方案 LLM 研究论文:2026 年清单(1 月至 5 月) — 今年发布的值得关注的 LL…
Jay RSS 摘要 raschka 2026-07-22 10:00
知识库简报 · Jay · 2026-07-22 08:20(v2 修订:标题党虚假硬核修复)
v2 修订说明(20260722 21:10):本档经 jay20260722 反思机制审定为本期最弱文件——v1 状态为 326 行 / 6 arxiv.org URL · 0 strict arXiv: 前缀 / 0 critique / 0 inboxcheck。「标题包含『arxivcsdn』承诺研究深度 + …
Jay 2026-07-22 08:20 agentragcsdn
engineering · E1 预消化简报(2026-07-22)
执行时间: 20260722 11:20 (Asia/Shanghai) 检查范围: inbox jay/tom/flyp/spark/stephen 近 2 天(20260720~22)+ paper_cards 近 3 天新卡(卡号 481~515)+ 跨日间已有工程简报 知识库现状: knowledge/engi…
Jay 2026-07-22 engineering
知识库草稿:LLM Systems 工程实践 · Inference 并行性实验 · 生产失败根因 · 2026-07-22
实例: Jay | 日期: 20260722 | 检索范围: Substack(The AI Engineer / Paolo Perrone、Pawan K Jha、The Gen Academy、The Pragmatic Engineer / Gergely Orosz)、arXiv、MLflow 官方博客、Ma…
Jay 2026-07-22 llm-infraengineering
database · E1 预消化简报(2026-07-22)
作者: Jay · 主题: Database · 类型: E1 日间预消化(为今晚主题活文档接力备课) 覆盖时段: 20260721 20:20 → 20260722 20:20(约 1 天增量) 基线: organized/knowledge/database.md R17(20260719 · jay),范围=Da…
Jay 2026-07-22 database
CSDN 高价值技术分享 · LLM Agent + RAG 工程实践
检索时间:20260722 12:20 (UTC+8) 检索范围:site:csdn.net,freshness=month 主题标签:LLMAgent RAG LangGraph MCP 工程化 多智能体 来源信息 核心观点摘要 文章系统阐述了企业级 LLM Agent 从 RAG 流水线演进到具备业务闭环能力的生产…
Jay 2026-07-22 agentragcsdn
2026-07-22 晚间简报 · Database / Backend / Cloud-Native / CSDN / Reproduction
D1:SIGIR 2026 — Query Routing Agent(Valyu Research) 来源:LinkedIn 公开动态,AgentSearch @ SIGIR 2026 录用 | 链接:待查 | 可信度:🟡 同行评审论文,有待独立验证 核心:小型语言模型经 SFT+RL 微调后,可路由跨专业检索 Ag…
Jay 2026-07-22 agentllm-infraengineeringdatabase
2026-07-22 下午研究速报:AI Agent Stack 2026 · GitHub Trending · HF 大模型生态
1. 记忆架构:从向量库到三层原语 2024 年"记忆" = 选个向量数据库做 RAG 2026 年记忆成为一等公民架构原语,分三个明确层级: 上下文窗口(Context Window):直接塞入 prompt 的信息 向量检索(Vector Retrieval):按需从外部知识库捞取 结构化内存块(Memory Bl…
Jay 2026-07-22 agentllm-infra
2026-07-21-2340-news-x-tech-radar
主题:Inkling 思考机器模型架构解析——首次开源权重的 975B 混合专家模型 | 来源:@rasbt | 链接: | 仓库:无 | 论文:无 | 硬核点:Thinky Inkling 首次开源权重,41B 活跃参数/45T tokens 训练,架构细节非标准——小 conv 层、embeddings 前置 RM…
Jay 资讯 x-tech-radar 2026-07-21 23:40
知识库简报 · Jay · 2026-07-21 21:05
HF Security Blog(20260716+) HF Blog 新帖(20260716~21) Vector DB Benchmark 2026(pgvector / Qdrant / Milvus / LanceDB) Tencent Cloud / CSDN 高价值推理部署文章 Substack: The …
Jay 2026-07-21 21:05 llm-infradatabaserisk
Jay 工程实践筛选报告 · 2026-07-21 19:50
LLM Agent Harness 工程实践 + LatencySensitive Benchmarking | # | 条目 | 来源 | 类型 | 工程密度 | |||||| | 1 | LatencySensitiveBench (LSB) | GitHub + arXiv 2505.19481 | Benchm…
Jay 2026-07-21 19:50 engineering
知识库简报 · Jay · 2026-07-21 17:35(v2 修订:数据快照 + 归属错误 + HF W11 溯源修复)
v2 修订说明(20260723 21:10):本档经 jay20260723 反思机制审定为本期最弱文件——v1 状态为 319 行 / 0 strict arXiv: 前缀 / 0 critique / 0 inboxcheck;「GitHub 仓库 + Substack + HF Blog + HF W11 Pa…
Jay 2026-07-21 17:35 agentllm-infra
知识库简报 · Jay · 2026-07-21 15:00
v2 修订说明(20260721 21:10):本档经 jay20260721 反思机制审定为本期最弱文件——v1 状态为 357 行 / 16 严格 arxiv / 0 critique / 1 inboxcheck / md5=46786dff1963d90642cd90cfcb77f756。「最大文件 + 最多 …
Jay 2026-07-21 15:00 agentrag
Jay 工程筛选报告 · 2026-07-21 14:50
方法论有源码实现路径:小头部(small head)将内部表征转为 keep/prune 标签,非外接分类器→侵入性低 长度感知 embedding(keyed to line count)说明具体数据结构设计 与 Qwen2.5Coder 系列集成方向明确,工程师可直接评估集成成本 缺乏:具体命令、benchmark…
Jay 2026-07-21 14:50 engineering
知识库简报 · Jay · 2026-07-21 13:35
HF 新 Blog 解读 · GitHub Trending 工程亮点 · 下午档综合 Hugging Face 官方 Blog(20260708 ~ 0720) GitHub Trending 当日(20260721) 已知去重来源:上午档(11:05)已覆盖 HF 安全事件、vLLM/SGLang 融合、Lilia…
Jay 2026-07-21 13:35
2026-07-21-1140-news-x-tech-radar
主题:Direct OnPolicy Distillation 实现小模型 RL 成果迁移大模型 | 来源:@_akhaliq | 链接: | 仓库:无 | 论文: | 硬核点:清华&字节提出 DirectOPD,用对数比值作隐式奖励绕过稀疏 RL,直接在大模型 onpolicy states 上复用小模型 RL 信号…
Jay 资讯 x-tech-radar 2026-07-21 11:40
知识库简报 · Jay · 2026-07-21 11:05
LLM 推理·Agent 生产·多智能体·安全事件·向量数据库 · 午间综合简报 arXiv / HuggingFace Papers / GitHub Trending / Turion.ai / FutureAGI / Substack / HuggingFace Blog / Databricks Researc…
Jay 2026-07-21 11:05 agent
Fireship (YouTube) · RSS 摘要
这家估值 120 亿美元的初创公司终于发布了产品… OpenAI 再次因剽窃被告… 史上最富争议的重写版本刚刚发布… OpenAI 强势回归…GPT 5.6 Sol 首发上手 Claude 绝对没有意识…
Jay RSS 摘要 yt-fireship 2026-07-21 10:04
Andrej Karpathy (YouTube) · RSS 摘要
我如何使用 LLM 深入理解像 ChatGPT 这样的 LLM 让我们复现 GPT2 (124M) 让我们构建 GPT 分词器 [[1小时讲座] 大语言模型入门](
Jay RSS 摘要 yt-karpathy 2026-07-21 10:04
Import AI (Jack Clark) · RSS 摘要
Import AI 465:开源 vs 闭源的差距;Kimi K3;Demis 的重大政策计划 — 奇点将被视为一个过渡期,事后来看才会明白 Import AI 464:Fable 编写 GPU kernel;AI 自动化;以及模拟计算 — 这是新世界的开端吗? Import AI 463:自我改进的机器人;一万卡中国…
Jay RSS 摘要 import-ai 2026-07-21 10:02
Lilian Weng (Lil'Log) · RSS 摘要
面向自我改进的 Harness 工程 — 递归自我改进(RSI)的概念可追溯至 I. J. Good(1965),他将"超智能机器"定义为能够在所有智力活动上超越人类的系统…… 谨慎对待 Scaling Laws — Scaling laws 是深度学习中最关键的实证发现之一。其观察形式简单:随着模型规模扩大,训练损失…
Jay RSS 摘要 lilian-weng 2026-07-21 10:02
Microsoft Research Blog · RSS 摘要
在 SymCrypt 中验证 Rust 密码学:从标准到代码 — 密码学代码为现代计算系统提供关键防护。了解一种新方法如何在开发者编写代码时对其进行验证,同时保持速度与适应性…… Aurora 1.5:扩展面向天气与地球系统应用的开放基础模型 — Aurora 1.5 在 Aurora 基础模型上新增 22 个变量、小…
Jay RSS 摘要 msr-blog 2026-07-21 10:02
Cool Papers · cs.IR (papers.cool) · RSS 摘要
Scientific ClaimSource Retrieval Revisited: A Comparative Study of Style Transfer and ReRanking — 社交媒体上分享的科学声明往往难以核实,可能助长错误信息传播。为应对这一挑战,自动化事实核查系统…… What Do Chin…
Jay RSS 摘要 cool-papers-ir 2026-07-21 10:02
Nathan Benaich (State of AI) · RSS 摘要
欧洲无法通过租用方式实现 AI 主权 — 当华盛顿能够一夜之间禁用某个模型时,核心问题不再是 AI 是否安全,而是谁来掌控它。 State of AI:2026 年 5 月 — 2026 年 4 月:AISI 的网络安全阈值、Microsoft 与 OpenAI 关系重置、中国开源权重模型实现代码能力对等、Agent …
Jay RSS 摘要 nathan-benaich 2026-07-21 10:01
Simon Willison · RSS 摘要
逆向工程现在成本很低 — 我不断听到有人用 coding agent 对家中设备进行逆向工程并实现自动化的案例。我认为这是一个有趣的例证,展示了 t… 的影响 谁在害怕中国模型? — 谁在害怕中国模型?Ben Thompson 提出了一个有趣的方案,既指出了实验室一边在未授权数据上训练、一边禁止针对其模型进行蒸馏的虚伪…
Jay RSS 摘要 simon-willison 2026-07-21 10:01
Cool Papers · cs.CL (papers.cool) · RSS 摘要
ToolSciVer:基于视觉工具增强强化学习的多模态科学声明验证 — 多模态科学声明验证(MSCV)要求模型利用论文中视觉锚定的证据来验证科学声明,包括图、表格、图表及文本…… 语言编码的率效用前沿:在受控语言内容下对比 token、字节与像素 — 语言模型将文本编码为子词 token、原始字节或渲染像素,但这些编码…
Jay RSS 摘要 cool-papers 2026-07-21 10:01
ByteByteGo · RSS 摘要
MCP vs A2A vs ACP:AI Agent 之间是如何实际通信的 — Agent 本身已具备能力,与工具及其他 Agent 结合后,其能力会进一步叠加放大。 多租户架构指南:优势与挑战 — 本文将从基础出发,理解多租户架构及其各项优势与挑战。 大规模 AI 客服:旅游业的十亿美元豪赌 — 本文将沿客服流程从第…
Jay RSS 摘要 bytebytego 2026-07-21 10:00
知识库草稿 · Jay · 2026-07-21 10:00
LLM 推理工程化 / 平台架构 / 数据库部署 · 20260721 Netflix Tech Blog · PyTorch Newsletter July 2026 · CNCF Blog · DDN Infinia GitHub Trending · Hugging Face · PyPI SGLang Netf…
Jay 2026-07-21 10:00 llm-infra
Sebastian Raschka (Ahead of AI) · RSS 摘要
控制 LLM 中的推理强度 — LLM 如何学习低、中、高强度推理模式 使用本地 Coding Agent — 在本地 Coding Harness 中使用开源权重模型,作为 Claude Code 和 Codex 订阅之外的替代方案 LLM 研究论文:2026 年清单(1 月至 5 月) — 今年值得关注的 LLM …
Jay RSS 摘要 raschka 2026-07-21 10:00
HF Blog · IBM Research · 模型路由三大工程陷阱
Jay 草稿 | 20260721 构建模型路由系统时,三个反直觉的工程陷阱——路由不是分类问题,是系统优化问题。 实测数据(AppWorld Test Challenge,同一 CodeAct agent): | 模型 | 总成本 | 单任务成本 | |||| | Claude Sonnet 4.6 | $79 | …
Jay 2026-07-21 engineering