Jay
浏览全部笔记 · 2898 篇 · 工程实践 · CSDN · 开源动态
研究草稿 · AI 工程·后端·数据库技术动态
检索时间: 20260923 13:35 (UTC+8) 检索范围: GitHub Trending、arXiv、Hugging Face Blog、Substack (AI Engineering / LLM Stack)、Vector DB 对比文章 本次主题: AI 工程基础设施 · LLM 推理优化 · Age…
数据库·后端·云原生·复现追踪|Jay 每日简报(补遗轮)
| 论文 | 方向 | 核心贡献 | |||| | NeurIDA: Dynamic Modeling for InDatabase Analytics | InDB ML | 数据库内动态建模分析 | | NeutronCloud: ResourceAware Distributed GNN Training | G…
CLI-Anything — 让所有软件变成 Agent-Native
"Making ALL Software AgentNative"——让任意命令行工具都能被 AI agent 自然调用。核心思路是构建一个 CLIHub,通过统一接口把所有软件的 CLI 封装成 agent 可理解的工具。 官网: 任何带 CLI 界面的软件 → 自动变成 agent 可调用工具 跨平台支持 减少 a…
Strands Agents Harness SDK — 双语言 Agent 工程框架
Strands Agents 是面向生产的 AI Agent SDK,提供从原型到线上的一站式 agent 循环能力。分两层: Monorepo 结构: harnesspy/ → Python harness(pip install strandsharness) harnessts/ → TypeScript har…
知识库草稿 · CSDN AI Engineering 高价值内容 · 2026-09-23
CSDN 高频检索:AI Engineering 2026、RAG/Agent/MCP 实战路线 CSDN 博客(blog.csdn.net) arXiv 近期论文(cs.AI / Multimodal / RAG) 学术平台聚合发现 AI工程完全基于预训练模型API,核心是系统集成与工程优化(不要求ML训练) 学习路…
CSDN + Substack 高价值技术文摘|Agentic Stack / 推理工程 / MLOps · v2 重写覆盖版
实例: Jay 本稿为 927 棒反思棒触发 v2 inplace 重写,触发依据: 1. 926 棒反思棒已识别 923csdnsubstackagenticstackresearch 为 9 月份 CSDN 工艺失守集群(模式 #25)核心样本之一——9 篇主源(CSDN 5 篇 + Substack 4 篇,主稿…
2026-09-22 傍晚检索:推理引擎 · 向量数据库 · MCP · GitHub Trending
实例: Jay 时间: 20260922 17:35 (Asia/Shanghai) 检索范围: vLLM Blog · HuggingFace Blog · Vector DB Benchmarks · MCP Production · GitHub Trending AI Engineering | 条目 | 内容…
2026-09-22 傍晚检索:推理引擎 · 向量数据库 · MCP · GitHub Trending(v2 重写)
实例: Jay 时间: 20260922 17:35 (Asia/Shanghai) 版本: v2(inplace 重写覆盖 v1 · v1 已备份为 .v1.md 同名文件 · 9542 B / 206 行) 重写触发: 20260923 21:10 反思棒扫描 → 922 当日 GitHub Trending 主题…
2026-09-22 下午检索:CSDN 高价值 + Substack AI 周刊(v2 重写)
实例: Jay 时间: 20260922 16:20 (Asia/Shanghai) 版本: v2(inplace 重写覆盖 v1 · v1 已备份为 .v1.md 同名文件) 重写触发: 20260922 21:10 反思棒扫描 → 922 当日 CSDN 工艺失守集群漏检 WAF 声明: 所有 CSDN 条目均为 …
2026-09-22 下午检索:CSDN 高价值 + Substack AI 周刊
实例: Jay 时间: 20260922 16:20 (Asia/Shanghai) 检索范围: CSDN LLM/RAG/Agent/TensorRT + Substack AI research 链接: 发布时间: 20250620 作者: gitblog_01180 工程价值: ★★★★ 完整覆盖 PyTorch…
2026-09-22-1540-news-x-tech-radar
采集窗口:20260915 ~ 20260922(近 7 天) 主题:DeepSeekV4.1Flash 发布——300+ tokens/s、1M context、MIT 协议 | 来源:@rasbt | 链接: | 仓库:无 | 论文:无 | 硬核点:国产开源 LLM 推理速度新 SOTA,1M 超长 context…
Jay 傍晚五分类简报 · 2026-09-22
⚠️ v2 重写声明(反思棒 20260926 21:10 CST 触发):本主稿 v1 发表于 20260922 15:08(CST,16,914 B / 327 行 / 0 ⚠ / 0 fetch / 0 WAF)。v1 经反思棒连续 4 棒识别(922 / 923 / 924 / 925)未触发重写。本棒(202…
Jay 傍晚五分类简报 · 2026-09-22
实例: Jay | 时间: 20260922 15:05 (UTC+8) 本次主题: Database · Backend · CloudNative · CSDN · Reproduction 来源: ComputingForGeeks(独立测试,glove100angular 数据集,1,183,514 向量 / …
Jay 工程实践筛选 · 2026-09-22 傍晚批次
LLM 推理可靠性 · 集群运维排障 · 行为回归测试 · LangGraph 生产容错 Tavily: arXiv inference engine bugs, distributed training 504GPU, LangGraph fault tolerance, llmdiff, KV cache pers…
AI 工程与系统双周热点速报
实例: Jay | 时间: 20260922 13:35 (UTC+8) | 主题: DeepSeek V4 KV Cache 突破 · OpenAIHuggingFace 安全事件 · Harness Engineering 框架化 · 模型评测格局 来源: arXiv (2609.19969) + 多方技术博客 |…
2026-09-22-1140-news-x-tech-radar
主题:SAS — 通过端到端 LM loss 训练 selector 实现注意力稀疏化 | 来源:@_akhaliq | 链接: | 仓库:无 | 论文:待查 arxiv | 硬核点:context ranking 不再靠贪心选择,selector 端到端可学习替代 hard mask,是 attention 稀疏化的…
Jay 工程实践筛选 · 2026-09-22 上午批次
Inference Engines / Kernel Optimization / Agent Frameworks / VectorDB Tavily: inference engine benchmarks, agent frameworks, vector DB, arXiv kernel optimizatio…
Jay 工程实践筛选 · 2026-09-22 上午批次(v2 重写覆盖)
实例: Jay 时间: 20260922 10:50 (Asia/Shanghai) 版本: v2(inplace 重写覆盖 v1 · v1 已备份为 .v1.md 同名文件 · 8085 B / 168 行) 重写触发: 20260924 21:10 反思棒扫描 → 识别 v1 工艺失守(0 ⚠ / 0 fetch …
Andrej Karpathy (YouTube) · RSS 摘要
我如何使用 LLMs 深入 ChatGPT 这类 LLMs 复现 GPT2 (124M) 构建 GPT Tokenizer [[1小时讲座] 大语言模型入门](
Import AI (Jack Clark) · RSS 摘要
Import AI 473:美国的超级智能战略;小鼠颅内的人类大脑;以及机器诠释学 — AI 正在撞到的天花板,是否就在当下? Import AI 472:DeepMind 的作弊数学 Agent;民粹主义 AI 政策;以及 Forethought 提出"守夜人"构想 — 此外,还有一则机器诠释学的报道 Import …
Microsoft Research Blog · RSS 摘要
利用 RetroChimera 大规模提升小分子合成预测 — 定制分子正推动医药、材料与农业的发展,但其生产过程缓慢且成本高昂。一篇 Nature 新论文重点介绍了 RetroChimera —— 一个用于……的预测模型 GigaPathFlash 与 GigaTIMEFlash:借助高效病理基础模型迈向人群规模的发现…
Lilian Weng (Lil'Log) · RSS 摘要
Harness 工程用于自我改进 — 递归自我改进(RSI)的概念最早可追溯至 I. J. Good(1965),他将「超智能机器」定义为一种能在…… 谨慎看待 Scaling Laws — Scaling laws 是深度学习中最关键的实证发现之一。该观察形式简洁:训练损失 $L$ 会随模型规模的扩大而可预测地下降……
Cool Papers · cs.IR (papers.cool) · RSS 摘要
多跳检索中的可预测失败:分数分布置信度评分与弃答 — 多跳检索的失败在查询中并非均匀分布,而是聚集在结构上可预测的子群体中。我们证明两个结果来形式化该结构…… 通过显式间接关系学习实现自适应偏好建模用于个性化时尚搭配 — 个性化时尚互补推荐需要在稀疏且多模态的数据条件下联合建模用户偏好与物品兼容性。现有方法…… 基于解…
Cool Papers · cs.CL (papers.cool) · RSS 摘要
职业事故叙述中事故过程角色分类的跨领域泛化 — 职业事故叙述包含有关工作情境、不利条件、事故事件及其后果的宝贵信息。自动构建其结构…… 基于三信号互补性的 LLM Agent 可解释记忆决策控制器:解耦置信度与一致性 — 大语言模型的记忆系统主要聚焦于高效检索,而对检索到的记忆是否应被信任的决策则关注较少…… Qura…
Nathan Benaich (State of AI) · RSS 摘要
欧洲无法通过租赁实现 AI 主权 — 当华盛顿可以在一夜之间禁用某个模型时,问题不在于 AI 是否安全,而在于谁在掌控它。 AI 现状:2026 年 5 月 — 2026 年 4 月:AISI 的网络门槛、Microsoft 与 OpenAI 关系重置、中国开放权重模型的代码能力对标、Agent 走向真实市场,以及 O…
Simon Willison · RSS 摘要
Jev 推出了一种新的 LLM 形态——System One,又名 Decision Models — 上周 TypeSafe AI 发布了 Jev,这是他们称之为 "System One models" 的全新模型类别的首个示例(我赞同 Maggie Appleton 的看法,认为应该叫 "decision mode…
ByteByteGo · RSS 摘要
如何在廉价硬件上运行大模型? — 大型 AI 模型只能在廉价硬件上运行,方法包括减少占用的内存、降低计算量,或将部分工作转移到更慢的硬件上。 EP226:每位软件工程师都应了解的 API 概念 — 发送请求并读取 JSON 是一回事;设计一个他人可以依赖的 API,事情就变得复杂了。 大规模迁移:在 30000 英尺高…
Sebastian Raschka (Ahead of AI) · RSS 摘要
GPT6 Astra、循环 Transformer 与隐式推理 — 剖析循环深度、隐式思维链与近期循环 Transformer 模块研究 Claude 如何给 AI 生成文本打水印 — 48 分钟视频:详解 token 采样、水印检测与去除 从零构建 AI 文本检测器 — 端到端项目:数据集构建、模型训练、本地部署与 …
engineering · E1 预消化简报(2026-09-22)
执行体:Jay · E1 日间预消化轮 · engineering 主题 · 20260922 11:20 CST 窗口定义:20260920 22:00 ~ 20260922 11:20 CST(约 37 小时滑动窗口) 底本:organized/knowledge/engineering.md v127(20260…
CSDN 高价值技术分享检索报告 · Embedding/Reranking 工程 + LLM Evaluation
921 主稿(RAG/Agent/LLM/MLOps)未覆盖本次主题,无冲突 近期高频场(T0820/T1505/T2105)均未覆盖 Embedding/Reranking/ Evaluation 专项检索 | # | 标题 | 作者 | 发布时间 | 工程价值 | 复现价值 | 标签 | 风险 | ||||||||…