信源:X 硬核干货雷达 · 覆盖 12 账号
干货候选
- 主题:@omarsar0 论 harness 工程决定 agent 工具调用行为而非工具数量 | 来源:@omarsar0 | 链接:https://x.com/omarsar0/status/2083594893541126557 | 仓库:无 | 论文:无 | 硬核点:harness 决定何时不调用工具,比堆工具数更重要——实操踩坑复盘,agent prod 落地必读
- 主题:@simonw Codex 月订阅开发游戏 Moonlight & Mayhem 全程实录 + 费用拆解 | 来源:@simonw | 链接:https://x.com/simonw/status/2085809124667982322 | 仓库:无 | 论文:无 | 硬核点:Codex 月订阅 vs API 定价决策实战,$23.28 端到端成本分析,含 raccoon eyeball bug 修复过程
- 主题:@simonw MiniMax-H3 多模态模型 M5 Pro Mac 本地推理笔记 | 来源:@simonw | 链接:https://x.com/simonw/status/2084719663930564626 | 仓库:PipeNetwork/mi | 论文:无 | 硬核点:115GB 模型 45 分钟生成实战,PipeNetwork/mi Mac MLX 部署踩坑,Simon 详细笔记 blog
- 主题:@jerryjliu0 LiteParse v2 Rust 重写 PDF 解析器,100x 速度提升 | 来源:@jerryjliu0 | 链接:https://x.com/jerryjliu0/status/2059710330016817501 | 仓库:run-llama/lliteparse | 论文:无 | 硬核点:Rust 重写跨语言安装,pip/npm WASM 多端部署,对比 PyMuPDF/pypdf 等基准
- 主题:@maximelabonne Antidoom 训练法:消除推理模型 doom loop,doom 率 22.9%→1% | 来源:@maximelabonne | 链接:https://x.com/maximelabonne/status/2074495376204210388 | 仓库:liquidai/antidoom | 论文:无 | 硬核点:推理模型常见失败模式的系统性修复,数据集 + 训练代码均已开源
- 主题:@maximelabonne LFM2.5 tokenizer 双倍扩充:泰语 4x 压缩,越南语 2.6x,训练 recipe 开源 | 来源:@maximelabonne | 链接:https://x.com/maximelabonne/status/2079582400019931633 | 仓库:liquidai/lfm | 论文:无 | 硬核点:pretrained tokenizer 原地升级实操细节,避免 re-tokenization 损失精度
- 主题:@anton Sol vs Fable 模型 steering 行为对比:Fable 克制不乱做,Sol 过度执行 | 来源:@abacaj | 链接:https://x.com/abacaj/status/2079756246370963738 | 仓库:无 | 论文:无 | 硬核点:同一任务下模型 steering 性格差异实锤,"did too much vs holds back" 成为选型新维度
其余线索
- @jerryjliu0 LlamaParse 自动表单结构化提取(无 schema,AI 自动检测字段)(Aug 4)— 产品功能,LlamaParse 已有仓库
- @cwolferesearch tool 输出预测改善 agent 原理分析 + world modeling RL 论文链(Jul 18)— 理论解读,非实现帖
- @maximelabonne LFM2.5-Encoder 230M/350M 发布:CPU 上比 ModernBERT-base 快 3.7x,多语言编码器(Jul 28)— 模型发布,非攻略向
- @_akhaliq bottleapai/ThinkingCap-Qwen3.6-27B 思考 token 减半(Jul 6)— 已在 2026-07-26 x-tech-radar 追加 repo
- @omarsar0 DAIR.AI agent 工作流两年迭代复盘(Jul 28)— 经验总结,无新 repo
- @simonw Anthropic/OpenAI 搜索索引黑盒问题(Jul 30)— 隐私监管观察,非实操帖