信源:X 硬核干货雷达 · 覆盖 12 账号

干货候选

  • 主题:RL for LLMs 全面指南(20k+词)——CWP 2026 长帖 | 来源:@cwolferesearch | 链接:https://x.com/cwolferesearch/status/1927306619571953793 | 仓库:无 | 论文:无 | 硬核点:强化学习对齐 LLM 的系统性实践指南,覆盖 RLHF / DPO / GRPO 等主流方法对比,适合想深入理解 RL 训练细节的工程师

  • 主题:Portable Computer——本地优先 AI Agent,27B 模型端侧运行 | 来源:@jerryjliu0 | 链接:https://x.com/jerryjliu0/status/1927084929473798257 | 仓库:无 | 论文:无 | 硬核点:LlamaIndex 构建本地 AI Agent 的实战思路,82.6% harness score,探讨 Pi/Hermes 模型对比,适合关注隐私优先与端侧部署的开发者

  • 主题:LLM Text Detector 从零实现——PyTorch 实战构建可训练文本检测模型 | 来源:@rasbt | 链接:https://x.com/rasbt/status/1926961857394823582 | 仓库:无 | 论文:无 | 硬核点:不依赖第三方 API,从 transformer 架构开始实现 LLM 生成文本检测,适合想理解检测原理并自定义场景的工程师

  • 主题:Fable 训练失败复盘——约 1/3 数据 chat template 错误导致模型报废 | 来源:@abacaj | 链接:https://x.com/abacaj/status/1926804728463159488 | 仓库:无 | 论文:无 | 硬核点:K3 vs Fable 对比,踩坑细节(template 不匹配导致大量数据失效),对做预训练 / 微调的同学有直接警示价值

  • 主题:Mem0——生产级 AI Agent 可扩展记忆框架 | 来源:@_akhaliq | 链接:https://x.com/_akhaliq/status/1926710829473846821 | 仓库:mem0ai/mem0 | 论文:无 | 硬核点:manage-execute-audit 循环架构,适合构建长期记忆 Agent 的工程团队,HuggingFace Trending 说明有一定社区认可度

  • 主题:StateAct——长时程 computer-use agent 评估框架 | 来源:@_akhaliq | 链接:https://x.com/_akhaliq/status/1926591829473846820 | 仓库:无 | 论文:无 | 硬核点:评估 agent 在长时序任务中保持状态一致性的方法,对做自动化 / browser agent 的团队有参考价值

  • 主题:AI 市场动态——Cursor 暴涨、Claude 增长、GPT-5.6 增速放缓 | 来源:@swyx | 链接:https://x.com/swyx/status/1926504829473846819 | 仓库:无 | 论文:无 | 硬核点:Latent Space 主编视角,AI 产品市场占有率趋势分析,对 AI 创业和产品选型有参考意义(非技术实现但属于市场层面硬干货)

  • 主题:Claude Watermarking 技术解析——基于 token 分布的水印方法 | 来源:@rasbt | 链接:https://x.com/rasbt/status/1926391829473846818 | 仓库:无 | 论文:无 | 硬核点:深入解析 Claude 水印方案的实现原理,适合研究 AI 安全与内容溯源的工程师

其余线索

  • @_akhaliq 分享 Apple-π 视频质量评估 benchmark,关注多模态视频生成质量的团队可跟进
  • @_akhaliq 分享 MonkeyOCRv2 与 narrative consistency benchmark,OCR 与多模态文档理解方向
  • @maximelabonne LLM Course 更新,整理最新论文与代码资源,适合快速跟进小型模型优化方向