信源:X 硬核干货雷达 · 覆盖 12 账号

干货候选

  • 主题:Inkling 思考机器模型架构解析——首次开源权重的 975B 混合专家模型 | 来源:@rasbt | 链接:https://x.com/rasbt/status/2077540575255880126 | 仓库:无 | 论文:无 | 硬核点:Thinky Inkling 首次开源权重,41B 活跃参数/45T tokens 训练,架构细节非标准——小 conv 层、embeddings 前置 RMSNorm、用相对位置偏置替代 RoPE;Hugging Face 模型卡可查细节

  • 主题:Grok 4.5 进入 Pareto 前沿——LLM 能力/成本权衡图更新 | 来源:@rasbt | 链接:https://x.com/rasbt/status/2075982283509571666 | 仓库:无 | 论文:无 | 硬核点:应社区要求将 Grok 4.5 和 Meta Muse Spark 1.1 纳入能力/成本 Pareto 前沿图,可作 2026 年中模型选型参考基准

  • 主题:Cerebras 内部知识库构建——agentic retrieval 生产踩坑复盘 | 来源:@jerryjliu0 | 链接:https://x.com/jerryjliu0/status/2078537490932384136 | 仓库:无 | 论文:无 | 硬核点:Cerebras 工程博客原文复盘:Slack 线程拼接为连续 chunk、代码库独立分块/更新策略、混合搜索验证有效(含具体参数调优细节)、数据源级自然 guardrails;生产级检索系统构建方法论

  • 主题:ParseBench——首个文档解析系统性评测基准,CVPR 2026 | 来源:@jerryjliu0 | 链接:https://x.com/jerryjliu0/status/2062535626491412621 | 仓库:run-llama/ParseBench | 论文:无 | 硬核点:文档 OCR 是 AGI-complete 问题(Agent 无法操作读不对的文档),LlamaIndex 发布 2k 页真实企业文档评测集,含表格/图表/视觉定位/语义格式/内容忠实度五个维度

  • 主题:GPT-5.6 Sol→Luna post-training 全套 prompt 公开 | 来源:@abacaj | 链接:https://x.com/abacaj/status/2075403004115554644 | 仓库:无 | 论文:无 | 硬核点:Anton 公开用 GPT-5.6 Sol post-train 5.6 Luna 的完整 prompt 链,展示 GPT-5.6 作为顶级研究员自主完成模型间知识迁移的能力;非单纯提示技巧,是模型级别工作流案例

  • 主题:Weak-to-Strong Generalization via Direct On-Policy Distillation | 来源:@_akhaliq | 链接:https://x.com/_akhaliq/status/2077170804693803266 | 仓库:无 | 论文:无 | 硬核点:AK 分享弱到强泛化新工作,在线策略蒸馏直接在大模型上复用 RL 信号,绕过离线数据蒸馏的分布偏移问题

其余线索

  • @swyx:AIE NYC 2026 演讲者征集(Call for Speakers),Context Engineering / Personal Agent / Harness Engineering 三个 track 定义 2026 技术栈路线图
  • @_akhaliq:ECCV 2026 录用论文 Think in Strokes: Process-Driven Image Generation(Hugging Face 论文页),视觉生成新范式,CVPR/ECCV 双料研究
  • @maximelabonne:IFStruct benchmark——结构化输出合规性评测博客发布(cleanlab/structured-output-benchmark 已在 watchlist),LLM JSON/YAML 输出的系统性评测
  • @omarsar0:Sakana AI Conductor(ICLR 2026)——7B Conductor 模型用 RL 调度其他 LLM 达到 SOTA,递归拓扑形成动态 test-time scaling;仓库 SakanaAI/fugu 已在 watchlist
  • @rasbt:Anthropic Opus 5 vs Fable 5 命名体系讨论——Haiku < Sonnet < Opus < Fable < Mythos 的相对关系尚待官方澄清,纯观点无技术增量
  • @simonw:Anthropic 模型命名体系观察帖(Haiku < Sonnet < Opus < Fable < Mythos),属于纯讨论无硬核实现/评测内容