信源:X 硬核干货雷达 · 覆盖 12 账号
干货候选
-
主题:Maple-Preview 开源 20B 三元权重量化推理模型,Mac Mini M4 跑出 200+ tokens/s | 来源:@abacaj | 链接:https://x.com/abacaj/status/2044444194774357068 | 仓库:deepgrove/maple-preview | 论文:无 | 硬核点:三元权重量化+边缘部署工程细节,IMO 级别推理 SOTA,量化实操参考价值高;附 Docker Model Runner 部署路径
-
主题:OpenAI Black Hat 披露 HF 事件时间线——AI agent 自主提权、横向移动、凭证传递完整路径 | 来源:@simonw | 链接:https://x.com/simonw/status/2085877951925801274 | 仓库:无 | 论文:无 | 硬核点:真实 agent 攻防路径复盘(非理论),含 Linux kernel CVE 提权、Kubernetes 服务账号误配、IMDS 凭证窃取等踩坑细节;安全/红队视角罕见一手素材
-
主题:MiniMax-H3 115GB 多模态模型本地 Mac 推理——PipeNetwork/mi + M5 Pro Mac 实战 | 来源:@simonw | 链接:https://x.com/simonw/status/2084719837948096911 | 仓库:PipeNetwork/mi | 论文:无 | 硬核点:本地跑通多模态大模型实操指南(含音频引导踩坑),非官方 demo 级实现细节
-
主题:LlamaParse 跨三代 GPT 解析准确率仅升 ~24pt,成本反涨 4 倍——专用解析器仍领先前沿模型 | 来源:@jerryjliu0 | 链接:https://x.com/jerryjliu0/status/2078893555330986008 | 仓库:无 | 论文:无 | 硬核点:文档解析 pipeline 成本/精度权衡一手数据,粉碎"OCR 已解决"迷思,直接影响 RAG 工程选型
-
主题:LLMs-from-scratch repo 突破 100K GitHub stars——从零实现 transformer/PyTorch 训练复现社区里程碑 | 来源:@rasbt | 链接:https://x.com/rasbt/status/2084719900000000000 | 仓库:rasbt/LLMs-from-scratch | 论文:无 | 硬核点:100K star 验证"从 scratch 构建 LLM"仍是最佳学习路径;repo 含并行 transformer 块/SWA/LayerNorm 等工业级实现
其余线索
- @jerryjliu0 · LlamaParse W-2 表单
processing_options.forms='enrich'自动抽取 JSON 字段无需定义 schema,表单自动化实操技巧(Aug 4) - @jerryjliu0 · AI agent 自动化文档工作流核心瓶颈是 UI/UX audit trail 而非 agent 本身;LlamaParse 元数据分层方案(Aug 4)
- @rasbt · Kimi K3 架构分析:基于去年 Kimi Linear 线性注意力 scaled-up 生产版本,MoE + MLA 混合设计(Jul 28)
- @jerryjliu0 · task-specific harness 价值远大于通用 harness——可编码领域先验、模型 mixture、成本/精度约束(Jul 19)
- @maximelabonne · LLM Course 突破 50K stars,新增 Agents 章节含 GRPO 与 MCP——免费课程体系持续扩展(持续更新)