信源:X 硬核干货雷达 · 覆盖 12 账号
干货候选
- 主题:LFM2.5-2.6B QAD 量化实战——5.4GB→1.6GB / 21→64 tok/s / tool-call 延迟 3.0s→1.2s | 来源:@maximelabonne | 链接:https://x.com/maximelabonne/status/2092122012726608345 | 仓库:无 | 论文:无 | 硬核点:量化实战三组数字直接可比(体积/吞吐/延迟),Mac 本地跑通且保持 97% BF16 精度,有工程参考价值
- 主题:ExtractBench 严格评分标准——字段须 value 与 citation 同时正确,word-level box IoU≥0.5 | 来源:@jerryjliu0 | 链接:https://x.com/jerryjliu0/status/2089710424388202565 | 仓库:run-llama/ExtractBench | 论文:无 | 硬核点:大多数文档提取 API 不提供来源定位,ExtractBench 的 word-level IoU 0.5 划界方式是当前最严苛的 grounding 评测标准,攻略可详解实现方法
其余线索
- @abacaj Aug 18:Fable 训练 LFM 2.6B 时 chat template 错误覆盖约 1/3 数据,导致模型每轮都变差;人工检查数据后才发现问题——数据检查是模型训练必备步骤(踩坑复盘,值得留意)
- @cwolferesearch Aug 8-28 窗口内无硬核技术帖(仅 Jul 4/25 有 RLHF 综述转发),跳过
- @tri_dao Aug 窗口内无新帖;FlashAttention-4(Mar 5 FA4 论文附 Dao-AILab/flash-attention)已于 2026-08-28 追加 watchlist
- @swyx Aug 19-20 的 OpenClaw 驱动 Mac Mini 销量为观点/营销帖,不够格
- @rasbt Aug 12 仅书籍真伪辨别公告,无技术内容
- @simonw Aug 13 Gemini 3.7 Flash pricing 评论为观点帖;Aug 6 pelican benchmark 为娱乐向,均不收录
本轮备注
近 7 天(8/21~28)12 个 tech 账号整体活跃度偏低:maximelabonne 的 QAD 量化数字与 jerryjliu0 的 ExtractBench 划界标准是本轮仅有两篇有实质硬核内容的帖子。其余账号或为产品公告、观点输出,或在目标窗口内静默。