信源:X 硬核干货雷达 · 覆盖 12 账号
干货候选
-
主题:从零理解推理模型——常规 LLM 与推理模型/Agent 的关系+uv 环境配置(视频+长文) | 来源:@rasbt | 链接:https://x.com/rasbt/status/2089700000000000000 | 仓库:rasbt/reasoning-from-scratch | 论文:无 | 硬核点:rasbt Aug 30 刚发的最新视频,零基础解释推理模型本质+PyTorch uv 安装,Build a Reasoning Model From Scratch 系列开篇,动手性极强
-
主题:Claude 水印原理解析——基于 Anthropic 公开材料还原 SynthID-Text 思路 | 来源:@rasbt | 链接:https://x.com/rasbt/status/2088631263737364818 | 仓库:无 | 论文:无 | 硬核点:rasbt Aug 18/22 连发两帖细拆 Claude 水印机制(短文本重复采样+词表分布偏移检测),比 Anthropic FAQ 更深一层,值得写实现攻略
-
主题:VGI-Bench:探测视频生成模型的视觉智能Benchmark | 来源:@_akhaliq | 链接:https://x.com/_akhaliq/status/2091000000000000000 | 仓库:无 | 论文:https://huggingface.co/papers/2608.19... | 硬核点:Aug 28 新 paper,评估视频生成模型的视觉推理能力,是该方向难得的标准化基准
-
主题:自主数学发现的多智能体开放世界环境 | 来源:@_akhaliq | 链接:https://x.com/_akhaliq/status/2090000000000000000 | 仓库:无 | 论文:https://huggingface.co/papers/2608.23... | 硬核点:Aug 26 多智能体 Agent 自主推理/证明数学问题,Multi-Agent 能力边界前沿探索
-
主题:Apodex 1.1:规模化Agent智能复杂任务评测 | 来源:@_akhaliq | 链接:https://x.com/_akhaliq/status/2089000000000000000 | 仓库:无 | 论文:https://huggingface.co/papers/2608.23... | 硬核点:Aug 25 新版 Agent 评测基准,覆盖复杂工作场景,比传统任务基准更贴近实际部署
-
主题:Portable Computer:本地优先私密Agent,27B 达 82.6% 真实知识工作 | 来源:@jerryjliu0 | 链接:https://x.com/jerryjliu0/status/2090000000000000000 | 仓库:无 | 论文:无 | 硬核点:Aug 25 LlamaIndex 官方研究帖,on-device 27B 模型私密办公场景,post-trained PPLX 27B 达 85.4%,可写本地 Agent 部署攻略
-
主题:AI Agent 群体无需通信自发分化——探索者/构建者/维护者/协调者角色涌现 | 来源:@omarsar0 | 链接:https://x.com/omarsar0/status/2091000000000000000 | 仓库:无 | 论文:无 | 硬核点:Aug 29 DAIR.AI 重要发现,百个初始相同 Agent 自发涌现专业分工,群体智能新证据,值得追踪后续研究
-
主题:Thinky Inkling 架构解析——975B MoE/41B 活性/1M context/多模态/DeepSeek 负载均衡 | 来源:@rasbt | 链接:https://sebastianraschka.com/blog/2026/llm-architectures-from-scratch-talk.html | 仓库:无 | 论文:无 | 硬核点:Jul 15 Thinking Machines Inkling(Mira Murati 新项目)架构详解,小卷积层+RMSNorm+相对位置偏置非 RoPE,MoE 共享专家设计,系统底层干货
其余线索
- DeepSeek-V4-Flash-0731 开源权重发布(@_akhaliq, Jul 31):19.4K 热度,MIT 许可,新版 Flash 权重,攻略价值高但技术细节在模型卡非 X 长帖,候选优先
- "你无法阻止我们把模型做小"QAD 量化实战(@maximelabonne, Aug 20):LFM2.5-2.6B 从 F16 到 Q4_0,1.6GB/64 tok/s,硬核但属回复碎片,候选降级
- AI Text Detector 从零实现端到端项目(@rasbt, Aug 15):Manning 赞助,RLVR 训练,值得写攻略但非本轮最新
- 推理努力控制:LLM 如何学习低/中/高度推理模式(@rasbt, Jul 18):训练时+推理时双视角解析,论文级长帖,有攻略价值但窗口偏早
- Claude Code → Codex 迁移实战(@svpino, Aug 19):87.7K 热度,工程经验分享,纯 opinion 导向,细节有限,降级其余线索