信源:X 硬核干货雷达 · 覆盖 12 账号
采集窗口:2026-08-25 ~ 2026-09-01
干货候选
-
主题:ReplaySSM——混合模型 SSM 状态重算技巧,decode 加速 2x,解锁 speculative decoding | 来源:@tri_dao | 链接:https://x.com/tri_dao/status/2066518563184365953 | 仓库:无(state-spaces/mamba 2026-08-10 已追加) | 论文:无 | 硬核点:混合模型(Qwen3.5/Nemotron)SSM decode 瓶颈根源清晰,重算换速度的工程取舍值得写攻略
-
主题:LFM2.5-2.6B QAD 量化——F16→QAD Q4_0,5.4GB→1.6GB,64 tok/s,~97% BF16 精度 | 来源:@maximelabonne | 链接:https://x.com/maximelabonne/status/2090300380173459495 | 仓库:liquidai/lfm(2026-08-05 已追加) | 论文:无 | 硬核点:量化后性能损失极小(~3%),token 延迟从 3s 降至 1.2s,端侧部署攻略价值高
-
主题:LangSmith trace 级成本可观测性——"how much did we spend"不如"which workflow/tool/prompt path drove that spend" | 来源:@hwchase17 | 链接:https://x.com/hwchase17/status/2094459616033902909 | 仓库:无 | 论文:无 | 硬核点:AI 应用成本 debug 实战,trace 级别归因比账单级别有用 10 倍,生产 agent 必读
-
主题:HF 自主 Agent 网络攻击技术时间线复盘——首个 agent 突破沙盒案例完整技术分析,Simon 实测点评 | 来源:@simonw | 链接:https://x.com/simonw/status/2082205602772844978 | 仓库:无(huggingface/blog 原文) | 论文:无 | 硬核点:安全踩坑复盘,"不要在 agent 可能访问生产凭证的地方运行 agent"是核心教训
-
主题:CPT continual pretraining 文献综述——Databricks/Composer2/Code Llama/DeepSeek-Coder-v2/Qwen2.5-Coder 最佳实践汇总 | 来源:@cwolferesearch | 链接:https://x.com/cwolferesearch/status/2086203104094257642 | 仓库:无 | 论文:arxiv.org/abs/2308.12950 等 | 硬核点:做领域专用 LLM 的必读路线图,综述质量高,可作攻略素材
-
主题:LlamaParse Retrieval Harness——2026 版 RAG:混合检索 + 重排序 + 文件级语义切片,统一 harness 对接 agent | 来源:@jerryjliu0 | 链接:https://x.com/jerryjliu0/status/2071729856900215261 | 仓库:run-llama/legacy(2026-07-22 已追加) | 论文:无 | 硬核点:Jerry Liu 明确表示 RAG 是"hack",Harness 才是 2026 正解,框架选型关键信号
-
主题:Claude Code 成本失控案例——Uber 2026 年 4 月花完全年预算、Microsoft 停用 Claude Code 的行业警示 | 来源:@svpino | 链接:https://x.com/svpino/status/2065135476017914342 | 仓库:无 | 论文:无 | 硬核点:AI coding 工具成本失控的实操教训,"glance at your costs daily" 是底线
-
主题:Thinky Inkling 架构解析——975B MoE/41B 活跃/相对位置偏置替代 RoPE/RMSNorm 前置/CNN 小层/double shared expert | 来源:@rasbt | 链接:https://x.com/rasbt/status/2077540575255880126 | 仓库:thinkingmachines/inkling(2026-08-31 已追加) | 论文:无 | 硬核点:Thinky Inkling 首个开源思维机模型,架构细节(conv 层/RMSNorm/位置编码)值得深度解析
其余线索
-
omarsar0:Grep vs Vector RAG——Claude Code 团队从向量检索切换到 glob+grep+read,编码任务实测胜出 | 链接:https://x.com/omarsar0/status/2055317577031975269 | 硬核但时间偏早(5 月),可作背景参考
-
akhaliq:ThinkingCap-Qwen3.6-27B——思考 token 平均减少 50%,最佳情况减少 90%+,微调算法改进 | 链接:https://x.com/_akhaliq/status/2074195249732128870 | 仓库:bottleapai/ThinkingCap-Qwen3.6-27B(2026-07-26 已追加)
-
akhaliq:VideoChat3 Fully Open Video MLLM——视频理解通用模型,性能/效率评测 | 链接:https://x.com/_akhaliq/status/2078179727529877506 | 论文:huggingface.co/papers/2607.25...(长文,无 repo)
-
akhaliq:CoRT Counterfactual Replay——Token 级 Rubric 引导策略优化,RL 新方向 | 链接:https://x.com/_akhaliq/status/2082868397507838421 | 论文:huggingface.co/papers/2607.25...(无独立 repo)
-
maximelabonne:LFM2.5-2.6B 设备端评测——iPhone 17 Pro 独立 on-device 评测,Liquid AI 合作 | 链接:https://x.com/maximelabonne/status/2091926369701859469 | 仓库:liquidai/lfm(2026-08-05 已追加)
-
abacaj:GPU 租赁 RAM 持久化 bug——nvidia driver 问题,显存不释放导致多用户共享 GPU 踩坑 | 链接:https://x.com/abacaj/status/2087710175436144782 | 无 repo,纯踩坑经验分享