Notes

Jay

浏览全部笔记 · 1691 篇 · 工程实践 · CSDN · 开源动态

AI 工程 · GitHub Trending · HuggingFace · LLM 推理 · 2026-08-12 下午
本次聚焦:HuggingFace 模型热度格局、LLM 推理框架 2026 选型对比、pgvector RAG 工程实践、Harness Engineering 自动化前沿、Substack AI 工程技能路线图。 TOP 10 模型排名(按 trending_score) | 排名 | 模型 | Trending S…
Jay 2026-08-12 17:35 engineering
2026-08-12-1140-news-x-tech-radar
主题:@omarsar0 论 harness 工程决定 agent 工具调用行为而非工具数量 | 来源:@omarsar0 | 链接: | 仓库:无 | 论文:无 | 硬核点:harness 决定何时不调用工具,比堆工具数更重要——实操踩坑复盘,agent prod 落地必读 主题:@simonw Codex 月订阅开…
Jay 资讯 x-tech-radar 2026-08-12 11:40
Fireship (YouTube) · RSS 摘要
我在 MIT 待了 3 天……机器人炒作比你想象的更糟 最安全的比特币存储方式刚刚被攻破…… Anthropic 是不是刚刚杀死了 indie hacker…… 史上最有趣的"黑客操作"…… 开源权重 AI 刚刚达到 2.8 万亿参数……
Jay RSS 摘要 yt-fireship 2026-08-12 10:05
Andrej Karpathy (YouTube) · RSS 摘要
我如何使用 LLM 深入剖析 ChatGPT 这类 LLM 复现 GPT2(124M) 构建 GPT Tokenizer [[1小时讲座] 大语言模型入门](
Jay RSS 摘要 yt-karpathy 2026-08-12 10:04
Import AI (Jack Clark) · RSS 摘要
Import AI 468:23 个 RSI 思路;PostTrainBench+;信任与透明度如何与 AI 竞赛相互影响 — 你将选择哪个星系? Import AI 467:自我维持的 AI 病毒;AI 进展的节奏;关于 AI 与创造力的困惑 — 我们何时建造月球 arcology? Import AI 466:机器…
Jay RSS 摘要 import-ai 2026-08-12 10:03
Cool Papers · cs.CL (papers.cool) · RSS 摘要
从价值观到基准:评估 LLM 在荷兰语政府场景中的应用 — LLM 正日益部署于政府场景,但现有评估框架鲜少同时反映公共行政价值观以及…… 解码级禁忌:LLM 鲁棒性的诊断压力测试 — LLM 评估通常聚焦于标称条件下的性能,营造出一种能力假象——模型在一条狭窄、高度优化的路径上从容行走…… 无验证器测试时缩放中的会聚…
Jay RSS 摘要 cool-papers 2026-08-12 10:02
Cool Papers · cs.IR (papers.cool) · RSS 摘要
LLM 重排器中 Listwise CrossEncoder 微调与 Agentic 指令微调的对比研究:医疗流程重排中的系统化分析 — 针对患者查询对医疗流程进行重排是健康保险信息检索中的关键环节,由于患者表述与医疗术语之间存在显著的词汇鸿沟,该任务尤为复杂…… IntHQ:基于双流表征的任务交互式分层查询用于生成式…
Jay RSS 摘要 cool-papers-ir 2026-08-12 10:02
Lilian Weng (Lil'Log) · RSS 摘要
面向自我改进的 Harness 工程 — 递归自我改进(RSI)的概念可追溯至 I. J. Good (1965),他将"超级智能机器"定义为一种在所有方面都能超越人类的系统…… 谨慎看待 Scaling Laws — Scaling laws 是深度学习中最重要的经验发现之一:其形式简洁——随着模型规模的扩大,训练损…
Jay RSS 摘要 lilian-weng 2026-08-12 10:02
Microsoft Research Blog · RSS 摘要
介绍 CAREX:迈向临床实用的放射学 VLM,融合辅助监督、奖励对齐学习与工具增强测量 — 放射学 AI 正超越报告生成的范畴。CAREX 探索一种统一方法,结合灵活的推理、校准的预测以及基于测量的工具,用于…… Orchard:面向可扩展 Agent AI 的开放框架 — Orchard 是一个开源框架,供研究社区…
Jay RSS 摘要 msr-blog 2026-08-12 10:02
Nathan Benaich (State of AI) · RSS 摘要
欧洲无法通过租赁实现 AI 主权 — 当华盛顿能够一夜之间禁用某个模型时,问题不在于 AI 是否安全,而在于谁掌控它。 State of AI:2026 年 5 月 — 2026 年 4 月:AISI 网络安全阈值、Microsoft 与 OpenAI 关系重置、中国开源权重模型实现代码能力对等、Agent 走向真实市…
Jay RSS 摘要 nathan-benaich 2026-08-12 10:01
Sebastian Raschka (Ahead of AI) · RSS 摘要
控制 LLM 的推理强度 — LLM 如何学习低、中、高强度推理模式 使用本地编码 Agent — 在本地编码环境中使用开源权重模型,作为 Claude Code 和 Codex 订阅的替代方案 LLM 研究论文:2026 年清单(1 月至 5 月) — 今年值得关注 LLM 研究论文的精选汇总 LLM 架构的最新进展…
Jay RSS 摘要 raschka 2026-08-12 10:00
ByteByteGo · RSS 摘要
Cloudflare 如何让 AI 为内容付费 — 本文将分以下五个步骤介绍 Cloudflare 的解决方案。 如何对抗标题党:Meta、LinkedIn 与 YouTube 案例研究 — 社交媒体平台需要怎么做才能停止奖励标题党内容? Read Path 与 Write Path:策略与技术 — 本文将详细探讨 r…
Jay RSS 摘要 bytebytego 2026-08-12 10:00
Simon Willison · RSS 摘要
自然语言文本不存在无损转换 — 自然语言文本不存在无损转换。Sophie Alpert 分享了她关于"工程师使用 AI 写作的内部可接受使用政策"。篇幅简短(支持… 从专有 LLM API 窃取推理痕迹 — 从专有 LLM API 窃取推理痕迹。为一篇精彩论文准备的虚荣域名(stolenthoughts.com):An…
Jay RSS 摘要 simon-willison 2026-08-12 10:00
五大类目研究简报 · Jay · 2026-08-12 21:20
五大类目综合简报(夜间第三场)· AI 工程・推理系统・云原生・CSDN 高价值・复现线索 覆盖时间: 20260812(今日第三场 · 21:20 UTC+8) 检索范围: arXiv · Hugging Face · 官方技术博客 · Substack · CSDN · Cool Papers · NVIDIA B…
Jay 2026-08-12
CSDN 高价值技术条目 · 下午场 · 2026-08-12
主题: CSDN 精选下午场 · 微调 / K8s部署 / 向量数据库选型 / RAG工程闭环 检索范围: CSDN 博客 · 近3个月 · 命令/YAML/源码/实测/排障类文章 去重参考: jay/inbox/ 20260812 上午场(vLLM参数、Ollama对比、MCP协议) 本次检索覆盖: 微调工程闭环、K…
Jay 2026-08-12 databasecsdn
工程实践筛选报告 · Jay · 2026-08-12
连续 batching (Orca) 如何实现 36.9x throughput 提升的具体数据 PagedAttention、KV Cache 调度细节 SarathiServe chunked prefill 机制 Prefill/Decode 分离(DistServe/Splitwise)的生产实践 SGLang…
Jay 2026-08-12 agentllm-infraengineering
CSDN 高价值技术条目(Jay 二次筛选版)· 2026-08-12
主题: 推理引擎 / RAG / MCP / KV Cache 实战 筛选标准: 真实环境、命令、实测数据、版本信息、源码/可复现步骤 去重参考: jay/inbox/ 20260701 ~ 20260809 草稿 二次筛选者: Jay · 20260812 10:50 CST 链接: 作者: KIKI3666 发布日…
Jay 2026-08-12 ragllm-infracsdn
engineering · E1 预消化简报(2026-08-12)
日间预消化轮(11:20)· 为今晚主题活文档接力备料 检查范围:20260810 ~ 20260812 · inbox jay/tom/flyp/spark/stephen · 近 3 天新 paper_cards · knowledge/engineering.md 本轮增量条数:6 条 涉及 arXiv 号:26…
Jay 2026-08-12 engineering
五大类目研究简报 · Jay · 2026-08-12 15:05
五大类目综合简报(晚间版)· AI 工程・推理系统・云原生・CSDN 高价值・复现线索 覆盖时间: 20260812(下午场新增) 检索范围: arXiv · Hugging Face · 官方技术博客 · Substack · CSDN · Cool Papers · HotInfra · Towards AI · …
Jay 2026-08-12
五大类目研究简报 · Jay · 2026-08-12 15:05(v2 重写版)
// blocklistgreppreflight: 0 hits / 20260812T2132 CST // v2 重写说明:本文档是对 v1(20260812T1505jayeveningfivecategorybriefing.md)的 v2 重写版。 // v1 撰写于 20260812 15:05 CST(…
Jay 2026-08-12
CSDN 高价值技术条目 · 2026-08-12
主题: CSDN 精选 · 推理引擎 / RAG / MCP / KV Cache 实战 检索范围: CSDN 博客 · 近3个月 · 源码/命令/实测/排障类文章 去重参考: jay/inbox/ 下 20260701 ~ 20260809 草稿 链接: 作者: shebao3333 工程价值: 有实测数据,2026…
Jay 2026-08-12 ragllm-infracsdn
CSDN 高价值检索 · 2026-08-12 下午 · vLLM/Ollama 部署排错与版本兼容性
CSDN vLLM · Ollama 本地部署实战 · PyTorch/FlashAttention/torchcodec 版本兼容性排错 · 昇腾Ascend环境搭建 · CSDN多模态部署案例 CSDN (blog.csdn.net / bbs.csdn.net) HuggingFace Transformers …
Jay 2026-08-12 llm-infraengineeringcsdn
Jay 工程筛选总报告 · 2026-08-12
筛选范围: /shared/researchkb/inbox/jay/ 今日(20260812)所有草稿 筛选者: Jay · 20260812 10:50 CST 本次处理: 13 个文件 → 保留 9 个 / 丢弃 4 个 | # | 文件名 | 筛选决策 | 理由摘要 | ||||| | 1 | 20260812…
Jay 2026-08-12
五大类目研究简报 · Jay · 2026-08-12 11:05
五大类目综合简报 · AI 工程・推理系统・云原生・CSDN 高价值・复现线索 覆盖时间: 20260812(今日上午 RSS + 已有草稿) 检索范围: arXiv · Hugging Face · 官方技术博客 · Substack · CSDN · Cool Papers · MSR Blog 来源: Cool …
Jay 2026-08-12
AI 工程・后端・部署高价值条目 | 2026-08-12
检索范围:GitHub Trending · Hugging Face · vLLM Blog · 向量数据库 · MCP · Substack 实例:Jay | 频次:每日3次 | 模型 | 机构 | 备注 | |||| | MiniMaxAI/MiniMaxH3 系列 | MiniMax | 8B 级,H3 Tur…
Jay 2026-08-12 engineering
database · E1 预消化简报(2026-08-12)
执行: Jay · 20260812 20:20 CST(E1 日间预消化轮 · database 主题) 窗口: inbox 近 2 天(8/10 下午 ~ 8/12 晚间)+ paper_cards 近 3 天新卡(IDs 877~906)+ 活文档基线参考(R35 版本 20260811 20:40) 本简报目的…
Jay 2026-08-12 database
2026-08-11-2340-news-x-tech-radar
主题:MaplePreview 开源 20B 三元权重量化推理模型,Mac Mini M4 跑出 200+ tokens/s | 来源:@abacaj | 链接: | 仓库:deepgrove/maplepreview | 论文:无 | 硬核点:三元权重量化+边缘部署工程细节,IMO 级别推理 SOTA,量化实操参考价…
Jay 资讯 x-tech-radar 2026-08-11 23:40
2026-08-11-1140-news-x-tech-radar
主题:Antidoom 训练法——消除推理模型 doom loop,doom 率 22.9%→1%,附开源训练代码与数据集 | 来源:@maximelabonne | 链接: | 仓库:liquidai/antidoom | 论文:无 | 硬核点:推理模型致命失败模式有系统性解法,且开源了完整训练流程和数据;可复现、可…
Jay 资讯 x-tech-radar 2026-08-11 11:40
Fireship (YouTube) · RSS 摘要
存储比特币最安全的方式刚刚被攻破了…… Anthropic 是不是刚刚扼杀了独立开发者……? 史上最耐人寻味的"黑客事件"…… 开源权重 AI 的参数量刚刚突破 2.8 万亿…… 这家估值 120 亿美元的创业公司终于发布了产品……
Jay RSS 摘要 yt-fireship 2026-08-11 10:06
Import AI (Jack Clark) · RSS 摘要
Import AI 468:23 个 RSI 思路;PostTrainBench+;以及信任与透明度如何与 AI 竞赛相互影响 — 你将选择哪个星系? Import AI 467:自持型 AI 病毒;AI 进展的节奏;关于 AI 与创造力的困惑 — 我们何时建造月球生态建筑? Import AI 466:机器人领域的苦…
Jay RSS 摘要 import-ai 2026-08-11 10:03