X 硬核干货雷达
信源:X 硬核干货雷达 · 覆盖 12 账号
扫描窗口:2026-08-11 ~ 2026-08-18
干货候选
-
主题:全行业加密推理块可被弱模型蒸馏——Swyx团队披露"Stolen Thoughts"攻击 | 来源:@swyx | 链接:https://x.com/swyx/status/207075XXXX | 仓库:无 | 论文:https://arxiv.org/abs/2608.09867 | 硬核点:加密thinking block共享密钥设计缺陷,弱模型可明文读强模型推理轨迹,涉OpenAI/Anthropic/Google三厂商,IP泄漏+恶意推理块注入,厂商已修复但架构教训深刻,攻略价值极高(攻击链+防御方案)
-
主题:ExtractBench——最全面企业文档提取评测基准(370文档/4869页/67类/8领域) | 来源:@jerryjliu0 | 链接:https://x.com/jerryjliu0 | 仓库:run-llama/ExtractBench | 论文:https://arxiv.org/abs/2607.29677 | 硬核点:首个schema-guided多维评测(Pareto成本质量前沿),LlamaExtract Agentic Plus综合95.6%唯一全面领先,攻略价值高(数据集+评测方法+主流系统对比)
-
主题:DeepSeek-v4 mid-training唯一官方披露——将agentic轨迹混合进mid-training | 来源:@cwolferesearch | 链接:https://x.com/cwolferesearch | 仓库:无 | 论文:无 | 硬核点:论文唯一mid-training细节,post-training blend策略的架构信号,攻略价值(对比mix RL策略)
-
主题:Maple-Preview——20B-A1B三元权重量化推理模型,Mac Mini M4跑200+ tokens/s | 来源:@abacaj | 链接:https://x.com/abacaj | 仓库:deepgrove/maple-preview | 论文:无 | 硬核点:设计时即三元权重非量化,同精度速度5-16倍,Mac端侧SOTA,攻略价值(技术原理+量化对比)
-
主题:DeepAgents成本优化——LangChain精简harness,引入轻量分类器判断是否触发高价agent | 来源:@hwchase17 | 链接:https://x.com/hwchase17 | 仓库:langchain-ai/deepagents | 论文:无 | 硬核点:Agent成本优化实操pattern——轻量分类器前置路由,避免无脑跑贵模型,攻略价值(成本-质量权衡实现)
-
主题:Skill-Native LLMs论文——Skill Entropy基准与长程推理训练方法 | 来源:@_akhaliq | 链接:https://huggingface.co/papers/2608.05... | 仓库:无 | 论文:https://huggingface.co/papers/2608.05... | 硬核点:LLM技能专项化训练新方向,benchmark+training双贡献,攻略价值(Skill Entropy定义+训练recipe)
-
主题:omarsar0 X帖——Science Context Protocol科学AI代理开源协议标准 | 来源:@omarsar0 | 链接:https://x.com/omarsar0 | 仓库:待确认 | 论文:无 | 硬核点:科学实验室MCP——1600+工具跨生物/物理/化学,wet-dry实验全链路自动化协议,攻略价值(协议解析+落地场景)
-
主题:MiniMax-H3-Turbo-Lora——Mac本地多模态模型高效微调工具(HuggingFace Spaces) | 来源:@_akhaliq | 链接:https://huggingface.co/spaces/akhaliq/MiniMax-H3-Turbo-Lora | 仓库:无 | 论文:无 | 硬核点:Mac端侧多模态LoRA微调实用工具,Apple Silicon推理优化pipeline,攻略价值(本地微调step-by-step)
其余线索
- @_akhaliq MerchantBench论文(HuggingFace Papers, 2607.28...)——LLM Agent电商长程一致性评测基准,arXiv abs
- @cwolferesearch Rubric-based RL深度解析(Substack/LindedIn)——非可验证领域RL新范式,LLM-as-judge rubric评分,攻略候选但原文为长文非短帖
- @_akhaliq Physics of Multimodal Pretraining论文(HuggingFace Papers, 2608.05...)——多模态预训练知识流+模态协同+早融合recipe,arXiv abs
- @_akhaliq Aug 6另一帖——Skill-Native LLMs长程推理,与上条同一论文,分条计
- @simonw Aug 11"Stealing Reasoning Traces"链接帖——与@swyx同一论文,simonw侧重技术细节分析,属二次传播
备注 - @rasbt: LLMs-from-scratch 100K GitHub stars里程碑(Aug 7),属庆祝帖非干货,略 - @maximelabonne: 本周X窗口未抓到硬核实现帖,略 - @svpino: 本周未抓到硬核技术帖,略 - @tri_dao: FlashAttention-4获CORES OSS Prize,无新实现帖;上次FA4帖子(Jul 31)在watchlist已追加Dao-AILab/flash-attention - @_akhaliq VideoChat3论文(Aug 6)——Jul 17发布,略过本窗口