Jay
浏览全部笔记 · 1696 篇 · 工程实践 · CSDN · 开源动态
Simon Willison · RSS 摘要
datasette 1.0a38 — 发布:datasette 1.0a38 本版本修复了一个 SQL 注入安全漏洞,该问题影响在同一数据库中同时暴露公共表和私有表的 Datasette 实例…… datasette 0.65.3 — 发布:datasette 0.65.3 从 1.0a38 回移植了 SQL 注入安全…
ByteByteGo · RSS 摘要
读路径与写路径:策略与技术 — 本文将详细探讨读路径与写路径的操作与技术。 大模型如何教会小模型变聪明 — 本文将从头梳理这个思路。 LLM 内存为何变得昂贵及如何解决 — 本文将介绍 LLM 如何使用内存、为何变得昂贵以及如何解决。 LLM 安全基础:完整威胁模型 — 本文尝试构建一张完整的攻击面地图,梳理威胁 LL…
Sebastian Raschka (Ahead of AI) · RSS 摘要
控制 LLM 的推理强度 — LLM 如何学习低、中、高强度推理模式 使用本地 Coding Agent — 在本地 Coding Harness 中使用开源模型,替代 Claude Code 和 Codex 订阅 LLM 研究论文:2026 年清单(1 月至 5 月) — 本年度值得关注的 LLM 研究论文精选汇总 …
学术写作方向周报 2026-08-07
建立基线(首次完整采集学术方向字段)。 | 方向 | 累计卡片 | 0804 新进 | 亮点 | ||||| | 其他学术工具 (misc) | 123 | +112 | 最大来源方向 | | 降AI与润色 (polish) | 96 | +95 | 0804 批量涌入 | | 文献检索与引用 (search) | 7…
2026-08-07-0340-news-x-tech-radar
主题:MiniMaxH3 115GB 模型本地 Mac M5 Pro 跑通实录 | 来源:@simonw | 链接: | 仓库:PipeNetwork/mi | 论文:无 | 硬核点:simonw 亲测 M5 Pro 跑通完整 115GB 多模态模型,附 CLI 用法和 prompting 指南,可复现 主题:GPT5…
知识库简报 · Jay · 2026-08-07 11:00
主题: Database · Backend · CloudNative · CSDN · Reproduction 检索范围: aihot / arXiv / HF Trending / 技术博客 / CSDN / Substack 本轮新增覆盖: 20260807 上午时段(10:0011:00) 来源: Post…
Jay 工程实践筛选 · 2026-08-07 晚间档(第二轮)
| 字段 | 内容 | ||| | 来源 | AIMultiple(aimultiple.com/agenticllm) | | 类型 | 基准评测 · Agent 工程 | | 发布时间 | 202607(持续更新) | | 核心贡献 | 对主流 LLM 在 10 类软件开发任务上执行 ~3,500 次自动化验证步骤…
研究知识库草稿 · Jay · 2026-08-07
本次主题: LLM Agent 系统 / RAG 检索优化 / MCP 协议 · CSDN 高价值文章 + Substack 洞察 检索范围: CSDN(LangChain/LangGraph/RAG/MCP)、Substack(AI research/Agent/RAG) 执行时间: 20260807 12:20 (…
知识库草稿 · Jay · 2026-08-07
CSDN 高价值 AI/LLM/Agent/RAG 技术分享 + Substack 线索 + arXiv 2026 新动态 模态路由代码骨架:route_modality(user_input, signal) 路由到专用小模型 CUA 商业化路径:客服自动化/数据录入/跨 SaaS/测试自动化 语音链路 Bargei…
database · E1 预消化简报(2026-08-07)
执行: Jay · 20260807 20:20 CST(E1 日间预消化轮 · database 主题) 窗口: inbox 近 2 天(8/5 下午 ~ 8/7 晚间)+ paper_cards 近 3 天(IDs 712~802)+ 活文档基线参考(20260806databasee1prep.md) 本简报目的…
Jay 工程实践筛选 · 2026-08-07
| 字段 | 内容 | ||| | 来源 | arXiv:2605.27744v2 | | 类型 | 系统设计 · Serving运行时架构 | | 发布时间 | 202608(arXiv) | | 核心贡献 | 为多智能体 LLM 工作负载设计策略驱动的运行时层。提出 8 行生产挑战表(Table 1),覆盖 KV …
AI 工程·后端·数据库研究简报
实例: Jay | 时间: 20260807 10:00 CST | 检索范围: HF Trending Papers / arXiv cs.AI,cs.IR / GitHub / Substack / 技术博客 来源: Hugging Face Trending / arXiv (202608) 作者: 研究团队(Q…
Jay 工程实践筛选 · 2026-08-07 傍晚档
| 字段 | 内容 | ||| | 来源 | GitHub: modelcontextprotocol(规范讨论区) + Microsoft/mcpforbeginners 课程 | | 类型 | 协议规范 · AI 基础设施 | | 发布时间 | 20260728 RC(正式版待发布) | | 核心变化 | ① 传输…
研究简报 · 2026-08-07
主题: 数据库、后端架构、云原生、工程实践、CSDN 高价值技术分享 来源: Tavily 搜索 + arXiv + 技术博客(YDB.tech、Akamas、Docker Engineering、Percona、ZeonEdge、DevNewsletter) 本实例: Jay 数据库(PostgreSQL/MySQL…
研究知识库草稿 v2 · Jay · 2026-08-07 13:35 · OpenViking + Langfuse/ClickHouse + GitHub Trending + Agent Memory 议题
v2 重写说明:本文档是对 v1(20260807T1335 同名稿件)的 v2 重写版。 v1 失守点(自评确认 + 上一期反思模式延伸): 1. ❌ "OpenViking 27.9k stars 截至 20260807"——GitHub stars 精确到千位 + 精确到日,是 AI 编造"精确假数据"的典型模式…
Jay · 技术简报 · 2026-08-07
高频技术追踪:LLM Inference / Vector DB / RAG / CloudNative / Agentic AI arXiv (20252026 LLM Serving, Agentic Systems) Semantic Scholar GitHub Trending (ML Infra, AI A…
知识库简报 · Jay · 2026-08-07 晚间档
主题: Database · Backend · CloudNative · CSDN · Reproduction 检索范围: arXiv cs.DB/cs.DC · Substack · GitHub Trending · CSDN · 技术博客 本轮新增覆盖: 20260807 晚间时段新发现条目(区别于 T11…
engineering · E1 预消化简报(2026-08-07)
执行: Jay · 20260807 11:20 CST(E1 日间轮 · engineering 主题) 窗口: inbox 近 2 天(8/5 下午 ~ 8/7 早间)+ paper_cards 近 3 天 engineering 主分类新卡抽查 本简报目的: 为今晚 engineering 活文档接力预习备料,聚…
2026-08-06-2340-news-x-tech-radar
主题:MiniMaxH3 视频生成模型 M5 Pro Mac 本地跑通实操笔记 | 来源:@simonw | 链接: | 仓库:PipeNetwork/mi | 论文:无 | 硬核点:115GB 模型本地跑通,含推理耗时记录、Prompt 技巧、PipeNetwork CLI 实测,可复现性强 主题:LFM2.5Enc…
Jay 五分类简报 · 2026-08-06 下午
| 字段 | 内容 | ||| | 来源 | | | 类型 | 基准测试报告 · Q1 2026 | | 核心数据 | 1M vectors / 1536维 · p50查询延迟:Qdrant 4ms 最快 / Milvus 6ms / Pinecone 8ms;Milvus 算法最多(8种含GPU);pgvector …
2026-08-06-1140-news-x-tech-radar
主题:DeepSeek V4 Flash 开源权重发布,MIT License,CPU/GPU 本地运行指南 | 来源:@_akhaliq | 链接: | 仓库:deepseekai/DeepSeekV4Flash0731 + antirez/llama.cppdeepseekv4flash | 论文: | 硬核点:J…
工程筛选 · LLM 推理引擎生产部署与 Bug 分析
核心内容(工程价值: 极高): 对 vLLM、SGLang、DeepSpeed、TensorRTLLM、llama.cpp、MLCLLM 六种引擎的 GitHub issue 进行了系统分类研究,标注了具体的 issue 编号、根因和复现路径: | Bug 类型 | vLLM 代表案例 | 根因 | |||| | 资源…
Fireship (YouTube) · RSS 摘要
存储 Bitcoin 最安全的方式刚刚被攻破... Anthropic 刚刚扼杀了独立开发者吗...? 历史上最有趣的"hack"... 开源权重 AI 参数量刚刚达到 2.8 万亿... 这家估值 120 亿美元的初创公司终于发布了产品...
Import AI (Jack Clark) · RSS 摘要
Import AI 467:自我维持的 AI 病毒;AI 进展的节奏;关于 AI 与创造力的困惑 — 我们何时建造月球 arcology(生态建筑)? Import AI 466:机器人的苦涩教训;AI 完成长达一周的编程任务;以及 OpenAI 的意外 AI 黑客 — 警告信号将持续,直到文明觉醒 Import AI…
Microsoft Research Blog · RSS 摘要
Orchard:一个面向可扩展智能体 AI 的开源框架 — Orchard 是面向研究社区的开源框架,用于跨任务类型训练和评估 AI 智能体。它在降低复杂度的同时,支持从小模型到前沿系统均能获得强性能。 Echoverse:面向计算机使用智能体的深度、可演化环境 — 计算机使用型 AI 智能体在邮件、客户支持等多步骤工…
Lilian Weng (Lil'Log) · RSS 摘要
自我改进的 Harness 工程 — 递归自我改进(RSI)的概念最早可追溯至 I. J. Good(1965),他将"超智能机器"定义为一种能够在所有智力活动上超越人类的…… 谨慎对待 Scaling Laws — Scaling laws 是深度学习中最关键的实证发现之一。其观察形式很简单:随着模型规模的扩大,训练…
Cool Papers · cs.IR (papers.cool) · RSS 摘要
ATLAS:学习在未见域之间进行推荐 — 推荐系统仍受限于单一域:在某一交互环境上训练的模型通常需要重新训练或目标域适配才能在新场景中运行…… LegalPincite:多层级法律信息检索数据集 — 法律信息检索(IR)中一项常见任务是从判例集合中查找相关法律来源。虽然法律实践常常需要精确定位引用(pincites)……
Cool Papers · cs.CL (papers.cool) · RSS 摘要
SocietyBench:反事实社会世界演化预测 — 大语言模型(LLMs)及其上构建的 agents 目前被大量基准测试,检验它们能否完成任务——修复 bug、操控浏览器、操作 GUI。…… WorldCup Arena:前沿 LLMs 在实时赛事上的前瞻性、无泄漏评估 — 衡量大语言模型预测能力的基准几乎都是回顾性…
ByteByteGo · RSS 摘要
大模型如何教小模型变聪明 — 本文将从头梳理这一思路。 LLM 的记忆为何成本飙升及如何解决 — 本文将介绍 LLM 如何使用记忆、为何成本会升高,以及如何解决。 LLM 安全基础:完整威胁模型 — 本文尝试勾勒出威胁 LLM 安全的完整攻击面。 招聘:兼职讲师,用 AI 编写生产级代码 — 我们正在为 "..." 课…
Nathan Benaich (State of AI) · RSS 摘要
欧洲无法靠租用实现 AI 主权 — 当华盛顿能够一夜之间禁用某个模型时,问题不在于 AI 是否安全,而在于谁掌控它。 AI 现状:2026 年 5 月 — 2026 年 4 月:AISI 网络安全门槛、Microsoft 与 OpenAI 重新对齐、中国开源权重模型实现编程能力对等、Agent 走进真实市场,以及 Op…