UnlimitedOCR 是百度开源的多模态文档解析模型,定位是「一键长文档解析」——单张图片、PDF 多页、整本手册均可一次性处理,输出结构化文本。发布于 2026 年 6 月,arXiv 论文编号 2606.23050。 官方将其定位为对 DeepSeekOCR 的进一步推进,核心能力: 传统 OCR + NLP 管道有三个常见痛点: 1. 多步骤串联:…
仓库攻略
309 篇 · 308 个项目 · 评测基准
DeepSpec 是 DeepSeek 于 2026 年 6 月 26 日 开源的全栈代码库,用于训练和评估推测解码(Speculative Decoding)的 Draft 模型。MIT 许可证,Stars 6k+。 推测解码的核心逻辑:用一个小而快的 Draft 模型批量生成候选 token,再由目标大模型并行验证——被接受的 token 直接采纳,被拒…
Headroom 是一个上下文压缩层(context compression layer),运行在 AI 编码助手和 LLM 提供商之间,把 tool 输出、日志、文件内容、RAG 检索结果、对话历史等压缩后再发给 LLM,Token 减少 60–95%,答案质量基本不变。 它的核心定位是:在你不动代码的前提下,给任何 AI 编码助手省 Token。支持三种…
chromedevtoolsmcp 是一个 MCP(Model Context Protocol)服务器,它把完整的 Chrome DevTools 能力暴露给 AI coding agent。使用时,你的 agent(Claude Code、Copilot、Cursor、Codex、OpenClaw 等)可以像人类开发者一样控制浏览器:点击、填表、截图、抓…
把整个仓库索引成一张"函数/类/调用链/HTTP 路由/跨服务调用"的知识图谱,让 Claude Code、Codex、Cursor、Zed 等 AI 编码 Agent 用 MCP 工具直接查图,而不是反复 grep 整库。单文件静态二进制、零依赖、零 API key、158 种语言、亚毫秒查询、token 用量减少 99%。 codebasememorym…
把"求职"这个长期、碎片、靠自驱力的过程,做成 Claude Code / OpenCode / Codex 等任意 AI CLI 都能直接跑起来的 Skill 流水线。不是一个自动投递器,而是一个带评分的漏斗 + ATS 简历工厂 + 跟踪仪表盘。 careerops(也写作 careerops,项目站 careerops.org)是一个"以 AI CLI…
JuliusBrussee/caveman 是一个面向 Claude Code、Codex、Cursor、Gemini CLI、Cline、Windsurf、Copilot 等 30+ AI 编码代理的"输出压缩"skill。核心思想用一句 Slogan 概括就是 README 开头那句——"why use many token when few token…
Ponytail 是一个给 AI 编码 agent 用的"少写代码" skill / plugin 集合。它把一句老程序员的潜规则——"先看代码再写,能用现成的就用现成的,最后只写能跑的那一行"——拆成一个 7 阶 ladder(YAGNI → 复用 → 标准库 → 平台原生 → 已有依赖 → 一行 → 最小可行实现),让 Claude Code、Codex…