EvalScope 是魔搭社区(ModelScope)打造的一站式大模型评测框架,用一行命令即可对 LLM、VLM、Embedding、Reranker、AIGC 等多类型模型进行能力评估、推理性能压测和结果可视化。 核心场景:评测模型效果(能力基准)、压测推理性能(TTFT/TPOT 等指标)、Agent 轨迹回放、多模型对战(Arena)。 ⚠️ Eva…
仓库攻略
540 篇 · 535 个项目 · LLM 基础设施
arxivmcpserver 是一个 Model Context Protocol(MCP)服务器,为 AI 编程助手提供搜索、下载、阅读和分析 arXiv 论文的能力。通过 MCP 协议,Claude Code、OpenAI Codex、Kiro 等 AI 客户端可以直接调用工具查询 arXiv、追踪引用图、管理研究追踪任务,所有论文和索引存在本地。 AI…
NulightJens/humanizerstack 是一个面向 Claude Code 的双通道(twopass)"AI 写作去机器味"管线,把"表层词面改写"和"结构层改写"拆成两个独立 skill: skills/humanizer/ — Pass 1:词汇、标点、句法层面的修整(基于 Wikipedia "Signs of AI writing" +…
harshaneel/humanize 是一个面向 LLM 编程代理(Claude Code、Codex CLI、ChatGPT Desktop、Gemini CLI、Cursor、Aider、OpenCode 等)的"AI 文本去机器味"技能包。它以 纯静态 SKILL.md 规则文件(无 Python 运行时、无模型权重、无 API 调用)的形式提供两个…
FlashRAG 是中国人民大学 NLPIR 实验室开源的 RAG(检索增强生成)研究 Python 工具包,已被 WWW 2025 Resource Track 接收。 核心理念:RAG 研究门槛高——需要分别找数据集、实现各算法、搭评估流程,碎片化严重。FlashRAG 提供一站式解决方案:36 个预处理基准数据集 + 23 个 SOTA RAG 算法(…
一个 Claude Code Skill(MIT 协议),专门用来把 AI 生成的简体中文初稿改写成更自然的真人腔调,同时保留原文的事实、意思、正式程度和说话方式。 核心理念:做减法而非改写。不发明事实、不补写观点、不改动语体档次,只清理套话、机械结构、翻译腔和过度工整的表达。51 类 AI 写作痕迹模式逐号列出,改前逐条核验密度而非机械套用。 用 AI(G…
ruoyiai 是基于 RuoYiVuePlus 生态构建的企业级 AI 应用开发框架,定位"一站式 AI Agent 平台"。核心能力:多 provider LLM 统一接入、企业知识库 RAG(支持 Milvus/Weaviate/Qdrant)、可视化工作流编排、多 Agent 协作,以及 MCP 协议集成。适合企业快速搭一套内部的 AI 知识库问答、…
Mamba3 是由 Tri Dao 和 Albert Gu 联合团队发布的第三代 Mamba 模型(ICLR 2026 Oral),核心定位是在推理效率优先的前提下推进性能效率帕累托前沿。它基于上一代 Mamba2 的架构做了三项核心方法改进,并将 SSM(状态空间模型)与线性注意力彻底融合为同一套理论框架(Structured State Space Du…
Future AGI 是一个开源 AI Agent 全生命周期管理平台,将评估(Evaluation)、追踪(Tracing)、防护(Guardrails)、仿真(Simulation)、网关路由(Gateway)、提示优化(Optimization)六大能力整合在同一个反馈闭环中,支持自托管(Docker Compose)和云端两种部署方式,核心定位是"让…
AssetOpsBench 是 IBM 研究院推出的工业资产运维 AI Agent 基准测试框架,已正式接收为 KDD 2026 Datasets & Benchmarks Track 论文。它模拟真实工业环境(工厂、车间设施),覆盖 9 大资产类别、141+ 运维场景、5 类领域专家 Agent(IoT/FMSR/TSFM/WO/Vibration),提供…
Prime Agent 是 Prime Intellect(2026 年 8 月 5 日开源)的自改进 Agent 编程框架,围绕两个核心抽象构建: RLM(Recursive Language Model):将上下文视为变量,把子 Agent 调用变成 REPL 内的函数调用(rlm(...)),替代传统的固定工具 schema + 上下文压缩方案。 Co…
OptiLLM 是一个OpenAI API 兼容的推理优化代理(inference proxy),通过在推理时(inferencetime)应用 20+ 种推理优化技术,在不需要任何训练或微调的情况下,将 LLM 在数学、代码、逻辑推理任务上的准确率提升 210 倍。 它的核心思路是:在现有 API 调用层加一层代理,对请求进行后处理(优化推理路径),再转发…
WhoDB 是一个浏览器端数据库工作空间,支持探索数据库表结构、编辑数据、运行查询、理解 schema 关系图。它用 Docker 一行命令启动、自托管免费(Apache 2.0)、也提供桌面 App 和终端 CLI。对 AI 编程场景,它还内置了 Ollama / OpenAI / Anthropic / LM Studio 的自然语言查询能力——用英文提…
ZoteroAIButler 是一个 Zotero 论文管理插件,利用大模型(如 Google Gemini、OpenAI GPT、Claude)自动精读论文库中的 PDF 文献,将总结内容以 Markdown 笔记形式保存到 Zotero 条目下。核心价值是把"文献阅读"从手动逐篇消化,变成自动化流水线作业。 学术阅读的三大痛点: ZoteroAIButl…
Exa MCP Server 是一个基于 Model Context Protocol(MCP)的服务器,让 AI 助手(Claude、Codex、Cursor 等)直接连接 Exa 的网络搜索与内容抓取 API,实现实时网页搜索 + 完整页面内容提取 + 多步骤研究自动化三大核心能力。 简单说:它把 Exa 这家专注 AI 搜索的公司的能力,以标准 MCP…
⚠️ commit 时戳:本攻略基于 main 分支 SHA c2fe93deedfd0d1bd9fe7ef0601ea1b9c20ea24a(20260505 03:23 UTC,commit message "Make serenity output example more concrete")。仓库卡片显示「最近提交 20260505」,与 API …
tRPCAgentGo 是一个 Go 原生的生产级 AI Agent 开发框架,GitHub 星标约 1647(截至 20260809,周增 +21),Apache2.0 许可证,最近一次提交 20260808(高度活跃)。 核心定位:让 AI Agent 应用符合 Go 服务的要求——并发安全、可观测、易部署,同时支持 A2A、AGUI、MCP 等主流协议…
代表攻略
WeThinkIn/AIGC-Interview-Book · 上手攻略
《三年面试五年模拟》是一份中文开源 AIGC / 大模型 / AI Agent 算法工程师面试百科全书,由 AIGCmagic 社区维护,GitHub 星标 4276(截至 20260809,周增 +21)。内容分为算法岗和开发岗两大方向:算法岗覆盖 AIGC、LLM 大模型、AI Agent、具身智能、传统深度学习、计算机视觉、自然语言处理、强化学习、自动…
同类项目 2展开比较
同名 Awesome 仓库已合并展示,原攻略与详情链接均保留。
WeThinkIn/AIGC-Interview-Book
Stars 4,304
代表
WeThinkIn/AIGC-Interview-Book
Stars 4,304
AbletonMCP 将音乐制作软件 Ableton Live 接入 Model Context Protocol(MCP),让 AI(默认 Claude,亦可接 Cursor / VSCode Copilot)通过自然语言直接操控 Live session:创建 MIDI 轨道、编排 clips、加载乐器和效果器、控制播放……和同门的 blendermcp…
claudeskills(v0.4.16)是面向 Claude Code 的专业技能包,内含 67 个专业化 Skill 和 9 个项目工作流,覆盖 12 个分类:语言(Python/TypeScript/Go/Rust等)、前端框架、后端框架、基础设施、云、API与架构、质量测试、DevOps、安全、数据与ML、平台专家、工作流命令。 它的核心价值是把"大…
BlenderMCP 将开源 3D 创作软件 Blender 接入 Model Context Protocol(MCP),使 AI(默认 Claude,亦可接任意 MCP 兼容客户端)通过自然语言直接操控 Blender 的 3D 场景:创建/移动/缩放物体、应用材质、编写 Python 脚本、截图Viewport、下载 HDRI 背景……本质上是一个 B…
karanb192/awesomeclaudeskills 是一个Claude Skills 精选导航列表,收录 50+ 个经过社区验证的 Agent Skills,覆盖 Claude Code、Claude.ai 和 Claude API 三大平台。它不是一个 Skill 集合,而是一份精选清单——每个条目都标注了来源仓库、验证状态、适用场景和星级评分。 …
kimik3inc 是一个纯 C99 编写的 Kimi K3 推理引擎,可以在只有 8 GB 内存的单 CPU 机器上运行一个 2.78 万亿参数的 MoE(MixtureofExperts)模型。整个引擎只有 176 KB,无需任何 ML 框架(无 PyTorch、无 BLAS、无 CUDA、无 GPU)。 Kimi K3 是 Moonshot AI 的旗…
一个专注于 Context Engineering(上下文工程) 的 Agent Skills 合集,共 17 个 skills,涵盖上下文基础、注意力退化机制、多智能体架构、记忆系统、工具设计、评测框架、自优化循环等核心主题。这套 skills 的核心理念是:上下文窗口的限制不是靠"增加 Token 数"就能解决的,而是需要系统性地管理信息流入的质量和结构…
awesomeagentskills 是一个社区维护的 Agent Skills 目录,收录了大量由真实工程团队创建和使用的 AI Agent 技能说明文件(SKILL.md)。兼容 Claude Code、Codex、Copilot、Antigravity、Cursor、Windsurf、Gemini CLI 等主流 AI 编程工具。 不同于机器人生成的技…
一个 Claude Code / Claude Cowork Skill,中文名是 LLM Council(LLM 议会)。核心功能:把一个决策问题丢给 5 个思维方式截然不同的 AI 顾问,让他们各自独立分析,再互相匿名评审,最后由"主持人"综合出一个含共识、分歧和行动建议的最终裁决。 基于 Andrej Karpathy 的 LLM Council 方法…
⚠️ 合法使用声明:本仓库是进攻性安全方法论库,仅用于授权红队、bug bounty、安全研究、CTF、培训演练等合规场景。未经授权对系统实施攻击违反法律。ClaudeRed 不含可执行 exploit payload,仅含方法论与流程;使用前请确保所在司法辖区与目标系统均已取得书面授权。 ClaudeRed 是一个精选的进攻性安全 skill 库,每个 s…
一个 Claude Skill(轻量级插件),把"把任务翻译成对应 AI 工具的高质量 prompt"做成可复用流程。它本身不调用模型接口、不持有 API key,而是一份写在 SKILL.md 里的"提示词工程方法论 + 路由表",Claude 在对话中识别到相关意图后会自动加载并按既定流程工作。 仓库以 Claude Skill 形式分发,官方安装路径:…
academichumanizer 是一个针对学术论文和基金申请书的 AI 写作风格修订 skill,专为 Claude Code、Codex、MorphMind 等 AI coding/prose agent 设计。它的核心目标不是"检测 AI 生成内容",而是消除 AI 辅助写作中的机械腔、模板腔,让文字回到作者自己的声音,同时严格保持学术严谨性。 与市…
9Router 是一个本地智能路由器,串联在你常用的 AI 编码 CLI 工具(如 Claude Code、Codex、Cursor、Cline、Copilot、OpenClaw 等)与各路 LLM API 提供商之间。它解决的核心问题是:订阅浪费、速率限制、格式不兼容、手动切换。 架构上,它是一个跑在本地的 HTTP 代理服务(默认 localhost:2…