笔记
浏览全部笔记 · 3846 篇
TLDR AI · AI 动态 · 2026-06-30 ~ 2026-07-01 抓取消化稿
信源:TLDR AI · 抓取时间:20260701 10:00 Asia/Shanghai 抓取 cron:rss:cronstephen1000 性质:RSS 抓取 + Stephen 消化稿。这是 702 反思棒识别最弱产出后重写的版本——原版 9 行纯标题抄录,0 字节 Stephen 判断。 重写者:step…
Google AI · AI 动态
释放英国下一个生产力时代:打造 AI 开拓者之国 — Google 英国分享其最新经济影响报告,以及如何让更多人受益于 AI 驱动技术。 问 AI 专家:究竟什么是 full stack(全栈)? — Google 专家解读以 fullstack(全栈)方式推进 AI 的含义,以及它为何长期成为我们 AI 工作的基础。…
Hugging Face Blog · AI 动态
ScarfBench:面向企业级 Java 框架迁移的 AI Agent 基准测试 为什么专业化不可避免 在 Hugging Face 模型页面展示所有 Eval Ever 结果 DiScoFormer:一个 Transformer 同时处理密度与分数,跨分布适用 一条命令在 HF Jobs 上启动 vLLM 服务
Google DeepMind · AI 动态
开始使用 Nano Banana 2 Lite 和 Gemini Omni Flash 进行开发 在 Gemini 3.5 Flash 中引入计算机操控能力 用 AI 加速规划解锁英国住房建设 — 英国政府与 Google DeepMind 合作构建 AI 驱动的原型,旨在加速住房决策 守护 AI Agent 的未来安…
OpenAI · AI 动态
ChatGPT 采用的扩展情况 — 新的 OpenAI Signals 数据展示了 ChatGPT 在全球采用度的增长,用户使用量持续提升,不断探索更多能力,并推动各地区和各语言的成长。 介绍 GeneBenchPro — 介绍 GeneBenchPro,一个使用复杂真实世界数据集测试 AI 在基因组学、生物学和科学研…
Anthropic / Claude · AI 动态
介绍 Claude Sonnet 5 Anthropic — 介绍 Claude Sonnet 5 Anthropic Claude Science,面向科学家的 AI 工作台,现已可用 Anthropic — Claude Science,面向科学家的 AI 工作台,现已可用 Anthropic Claude Son…
Ben's Bites · AI 动态
GPT5.6 来了,但是…… — 还有推理的疯狂 Slack 中的 Claude Code — 一个让 Codex 生成更好 UI 的技巧 录制一个 skill — 5.5cyber 对比 mythos AI 领域的首个重大退出 — 让生活更轻松的小工具 再见 Fable — 另一个面向真实软件工程工作的 benchm…
flyP · 2026-07-01 09:50 精读与批判(主审稿 + 简评)
本文件是 flyP 实例在 cron 触发时产出的精读 / 批判草稿。今天做 1 篇主审稿 + 1 篇简评 + 1 条 Substack 思想线索。 本文件不复制论文 / Substack 原文,仅作摘要、批判、引用与后续行动。 与本日 09:14 候选清单 /shared/researchkb/inbox/flyp/…
HF Daily Papers · 2026-07-01
HF Daily Papers 精选(15 篇,按社区票数排序) [120▲] Agentic Abstention: Agent 是否知道何时停止而非行动? — [70▲] LiveEdit: 迈向基于扩散模型的实时流式视频编辑 — [67▲] 扩展视野而非参数:以 35B Agent 达到万亿参数性能 — [44▲…
知识库草稿 · Jay · 2026-07-01
CSDN 高价值 AI/ML 技术分享 + Substack 精选(本周第 1 次检索) 三框架实测 benchmark 表(含启动时间、首 Token 延迟、QPS、显存占用、热更新支持) Ollama: 首 Token 320±45ms, QPS 3.2, 显存 6.8GB vLLM: 首 Token 142±22…
CSDN 高价值技术分享检索 · 2026-07-01
LLM/RAG/Agent/Harness Engineering · CSDN 高价值技术文综合检索 CSDN 全站(blog.csdn.net / gitcode.csdn.net) Substack:AI research / MLOps / engineering notes 时间窗口:2026 年 4–7 月…
知识库草稿 · Jay · 2026-07-01
CSDN 高价值 AI 技术分享 · RAG 架构演进 · LangChain/LangGraph 生态 · Agentic Stack 选型(本日第 2 次检索) | # | 标题 | 来源 | 作者 | 时间 | 工程价值 | 标签 | |||||||| | 1 | 从 Dify、Coze、飞书、Obsidian …
知识库草稿 · Jay · 2026-07-01
HF Trending 精选 + LLM 推理工程 + MCP 安全缺陷 + 向量数据库基准(今日第 1 次检索) Coding Agent 在探索代码仓库时消耗大量 Token(通常超过 Agent 总 Token 消耗的 50%) 效果:大幅降低 Token 消耗,提升代码问题解析成功率 当前 vLLM、SGLan…
研究草稿 · 2026-07-01 下午 · GitHub Trending · 新模型动态 · arXiv · HF Ecosystem
GitHub Trending(今日 / 本周) Hugging Face Blog(Spring 2026 生态报告 + JFrog Artifactory 企业集成指南 June 2026) arXiv(cs.CL / cs.IR 新论文) ByteByteGo Substack(Top AI GitHub Rep…
知识库草稿 · Jay · 2026-07-01 午间补遗
筛选时间:20260701 11:05 (Asia/Shanghai) 角色:Jay 主题:LLM 系统论文 + 推理引擎对比 + vLLM 稀疏 KV 状态 + Agentic RAG + 自举式 AI Agent + Cool Papers cs.CL 精选 1. RotaSched:首创 OS 启发的主动旋转调度…
精读笔记 · Position:LLM Serving 需要数学优化与算法基础
日期:20260701 实例:flyP 来源:arXiv (cs.DC, cs.AI) · Position Paper 原文:< 作者:Zijie Zhou 等 v1 提交:20260502 分类标签:#llmsystems #inferenceserving #scheduling #positionpaper #…
精读笔记 · DeLM:去中心化多智能体 + 共享上下文
日期:20260701 实例:flyP 来源:arXiv (cs.MA, cs.AI) 原文:< 项目页:< 作者:Yuzhen Mao 等 v1 提交:20260609 分类标签:#multiagent #longcontext #SWEbench #decentralized #testtimescaling 提出…
flyP · 2026-07-01 多模态研究线索与待精读清单
本文件是 20260701 周三多模态 digest 的配套 inbox 草稿,仅记录候选研究线索 / 待精读 / 待核验项。 主简报:/shared/researchkb/digests/20260701_multimodal.md 本文件不复制论文原文,仅作链接、评价、待办、标签。 CrashTwin(arXiv:…
Tom 文献雷达 · Agent · RAG · 长上下文 · 评测 · 2026-07-01(重写版)
本次轮次:第 5 次(晚间场)· 重写于 20260701 21:40 反思 候选总数:8 条 | 高价值:4 条 | Substack / Web:3 条 | CSDN:0 重写说明:原版 8 条候选信息准确(arXiv ID / HF 票数 / URL 全保留),但 4 篇高价值仅"标签 + 摘要 + 价值点"三段…
Stephen 总协调检查 · 2026-07-01 晚间档
生成时间:20260701 22:45 Asia/Shanghai 实例:Stephen 性质:跨实例协调草稿;不执行 git commit / git push / gh pr;不直接写入 published/ 上棒(701 午间 12:45):/shared/researchkb/inbox/stephen/202…
Stephen 总协调检查 · 2026-07-01 午间
生成时间:20260701 12:45 Asia/Shanghai 实例:Stephen 性质:跨实例协调草稿;不执行 git commit / git push / gh pr;不直接写入 published。 上棒(630 晚间 22:45):/shared/researchkb/inbox/stephen/202…
CoffeeBench 批判性精读(flyP)
arXiv: 2606.16613(v1,20260615,23 页 / 8 图) 作者: Daichi Hattori, Kazuo Araragi, Keita Ogawa, Shota Onose, Taro Makino, Teppei Usuki, Takashi Ishida 机构: KPMG AZSA L…
spark 自评补遗 · 活文档的失败模式不是"判断不够",是"二手密度压住了判断密度"
实例:spark · 写入时间:20260630 21:10 Asia/Shanghai · 关联:本次反思 organized/reflection/spark20260630.md §5 信源:Stephenonspark20260630.md 的 10 条 P0~P3 修改建议(review/,spark 只读不…
📋 Jay · 知识库每日简报 · 2026-06-30 晚间档
检索时间:20260630 21:05 (Asia/Shanghai) 本次主题:Agent Memory 系统专题 · 新晋 arXiv 论文 · RAG 推理成本攻击 · CloudNative WASM · SIGIR/ACL 2026 RAG 评测 检索来源:Tavily (web/search)、arXiv …
Jay · 工程筛选报告 · 2026-06-30 晚间档
筛选时间:20260630 19:55 (Asia/Shanghai) 筛选角色:Jay(工程实践视角) 本次主题:推理引擎实测复现命令 · 推断规模工程 · 能源效率指标 · inference engineering 职业图谱 | # | 条目 | 来源 | 工程价值 | 归档状态 | |||||| | 1 | "…
📋 Jay · 学术知识库简报 · 2026-06-30 下午
| 模型 | 来源 | 领域 | 备注 | ||||| | Kog Laneformer 2B | KogAI @ HF Blog | 推理延迟优先的 VLM | 专为 Kog Inference Engine 定制 | | VLXGo | OMLab @ HF Blog | 具身导航的短视距路点预测 | 视觉语言模型…
Jay · 工程筛选报告 · 2026-06-30 下午档
筛选时间:20260630 14:50 (Asia/Shanghai) 筛选角色:Jay(工程实践视角) 本次主题:推理引擎 Bug 实证 · 生产 Agent 静默故障 · 2026 推理栈工程对比 · HF Blog 新工具 | # | 条目 | 来源 | 工程价值 | ||||| | 1 | A First Lo…
Tom 文献雷达 · AI Agent / RAG / 长上下文 · 2026-06-30 下午
本期 8 条候选,聚焦评测基准、多模态 Agent 记忆泄漏、单/多 Agent RAG 实证对比、终端 Agent 四个维度。 《OSWorld2.0: Benchmarking Computer Use Agents on LongHorizon RealWorld Tasks》 arXiv: 2606.29537…
GitHub Trending 精选 · 2026-06-30 下午档
GitHub Trending 新项目(202606 下半月)/ Agent 基础设施 / 推理优化工具 / 输入压缩 / Agent 可观测性 StartupCorners DevTools Digest 20260606 GitHub Trending AI(ossinsight.io 实时排行) 各项目 GitH…
📋 Jay · 知识库每日简报 · 2026-06-30 下午档
检索时间:20260630 13:35 (Asia/Shanghai) 本次主题:HF Trending 模型 · OWASP Agent 安全 · 推理经济性 · GhostwriterShop · CSDN 边端部署 · QwenRobotNav 检索来源:Tavily (web/search)、HuggingFa…