研究库 开源仓库
Repositories · organized/repo_cards

仓库/Skill 库

24 个 · LLM 基础设施 · 工具 · 快速增长

排序 Stars 周增
Wei-Shaw/sub2api
Go · 2026-08-11 LLM 基础设施 工具 生产可用 Stars 36568 周增 +287

Sub2API 是一款开源中继平台,将 Claude、OpenAI、Gemini 与 Antigravity 订阅统一为单一端点,支持账号共享与费用分摊,兼容原生工具调用。Sub2API 一站式开源中转服务,让 Claude、Openai 、Gemini、Grok订阅统一接入,支持拼车共享,更高效分摊成本,原生工具无缝使用。

JustVugg/colibri
C · 2026-08-10 LLM 基础设施 工具 生产可用 Stars 23805 周增 +1169

在现有硬件上运行前沿 MoE 模型——纯 C 实现、零依赖、专家权重从磁盘流式加载。轻量引擎,海量模型。🐦Run frontier MoE models on hardware you already own — pure C, zero deps, experts streamed from disk. Tiny engine, immense model. 🐦

lidge-jun/opencodex
TypeScript · 2026-08-11 LLM 基础设施 工具 研究原型 Stars 9000 周增 +658

OpenAI Codex 与 Claude Code 的通用 provider 代理 —— 可在 Codex CLI、App、SDK 及 Claude Code 中使用任意 LLM(Claude、Gemini、Grok、DeepSeek、Ollama…)。Universal provider proxy for OpenAI Codex & Claude Code — use any LLM (Claude, Gemini, Grok, DeepSeek, Ollama…) with Codex CLI, App, SDK, and Claude Code

llm-infra
yjh051108/dsh-routing-suite
JavaScript · 2026-09-02 LLM 基础设施 工具 生产可用 Stars 7031 周增 +2149

dsh-routing-suite——注入器 + 路由标准套件:先安装运行时注入器,再安装任务感知的推理模式路由预设(已实测 P1-P23)。dsh-routing-suite — injector + router-standard kit: install the runtime injector first, then the task-aware reasoning-mode router preset (measured P1-P23).

agent
TheoLeeCJ/SemIf
Python · 2026-09-19 LLM 基础设施 工具 实验 Stars 1648 周增 +0

在家用 3090 上由开源模型生成语义化 if。独立项目,与 Jev 或 TypeSafe 无关。Semantic ifs from open models, on a 3090 at home. Independent; not affiliated with Jev or TypeSafe.

TheoLeeCJ/openjev
Python · 2026-09-18 LLM 基础设施 工具 实验 Stars 964 周增 +0

我们能在家里用 3090 跑类似 Jev 的东西吗?Can we run something like Jev on a 3090 at home?

zouyuxuan122/dsh-our-free-model
JavaScript · 2026-10-01 LLM 基础设施 工具 实验 Stars 532 周增 +508

在 dsh 里装上这个插件即可,无需登录、注册或填 API Key,就能使用包括 Muse Spark 1.3、MiMo V2.6 在内的前沿模型——完全免费,不限量。 All you do is install this plugin in dsh: no login, no sign-up, no API key — the frontier models are just there, Muse Spark 1.3 and MiMo V2.6 among them. Completely free, with no usage cap.

agentllm-infra
ArasTey/lunel
Python · 2026-09-13 LLM 基础设施 工具 研究原型 Stars 532 周增 +0
ollaya-dev/ollaya
Rust · 2026-09-27 LLM 基础设施 工具 实验 Stars 475 周增 +0

本地运行开源决策模型:在兼容 TypeSafe 的 API 后面拉取并服务 Laya、decider、NLI 和 GLiClass。基于 Ollama 的决策模型。Run open decision models locally: pull and serve Laya, decider, NLI and GLiClass behind a TypeSafe-compatible API. Ollama for decision models.

llm-infra
gvzdv/claudish-to-english
Shell · 2026-08-11 LLM 基础设施 工具 实验 Stars 341 周增 +0
linguo2625469/workbuddy2api-panel
Go · 2026-09-16 LLM 基础设施 工具 实验 Stars 317 周增 +637

把腾讯WorkBuddy账号变成 OpenAI 兼容 API 的多账号网关,同时自动完成任务中心全部任务,附 Web 管理面板(账号池可视化 / 积分任务 / 配置热更新)。基于 Sliverkiss/workbuddy2api 的增强分支

MiaAI-Lab/Qwen3.8-Flash-Next-Single-DGX-Spark
Python · 2026-09-09 LLM 基础设施 工具 实验 Stars 291 周增 +274

Qwen3.8-Flash-Next 部署于单台 DGX Spark(TP=1)Qwen3.8-Flash-Next on ONE DGX Spark (TP=1)

pingmike2/freebuff2api-wokers
JavaScript · 2026-08-11 LLM 基础设施 工具 实验 Stars 236 周增 +0
carloslfu/slotstream
Swift · 2026-09-02 LLM 基础设施 工具 实验 Stars 232 周增 +560

在 Mac 上以远低于 104 GB 的内存运行 Qwen3.8-Flash-Next(125B MoE,4-bit 下约 104 GB),通过 SSD 流式加载专家。MLX + Swift,兼容 Ollama 的 API。Run Qwen3.8-Flash-Next (125B MoE, 104 GB at 4-bit) on Macs with a fraction of that RAM by streaming experts from SSD. MLX + Swift, Ollama-compatible API.

llm-infra
0xNatoshi/jev-codex-router
JavaScript · 2026-09-22 LLM 基础设施 工具 实验 Stars 184 周增 +0

Codex 的每轮模型与推理路由,由 Jev(TypeSafe System One)驱动:为每一轮选择模型、思考深度和速度模式。Per-turn model & reasoning routing for Codex, driven by Jev (TypeSafe System One): picks the model, thinking depth and speed mode for every turn.

llm-infra
MiaAI-Lab/Qwen3.8-Flash-Next-Single-DGX-Spark-TensorFold
Shell · 2026-10-01 LLM 基础设施 工具 研究原型 Stars 129 周增 +0

在单台 DGX Spark 上运行 Qwen3.8 Flash Next(TensorFold)Qwen3.8 Flash Next on one DGX Spark (TensorFold)

ithtelab/workbuddy-manager
Python · 2026-09-16 LLM 基础设施 工具 生产可用 Stars 123 周增 +308

腾讯 CodeBuddy 账号池管理控制台 + OpenAI 兼容反代网关。扫码纳管账号、自动签到、多密钥分发、IP 管控、调用日志与用量统计。UI 对标 linux-do/cdk。

MiaAI-Lab/DeepSeek-v4.1-Flash-DGX-Sparks
Python · 2026-09-15 LLM 基础设施 工具 实验 Stars 118 周增 +122

DeepSeek-V4.1-Flash 部署于 3–4 块 NVIDIA DGX Spark。DeepSeek-V4.1-Flash on 3-4x NVIDIA DGX Sparks

maiphucgiang/codebuddy2api
Python · 2026-09-16 LLM 基础设施 工具 实验 Stars 114 周增 +0

将你的 CodeBuddy 订阅作为本地 OpenAI API 使用。Use your CodeBuddy subscription as local OpenAI APIs.

446599/ccodex-rotate
Go · 2026-09-22 LLM 基础设施 工具 实验 Stars 93 周增 +0

本地 Codex 反向代理:轮换代理节点池、惰性健康故障转移、每模型 292 turn-state 采集/注入。支持 macOS + Windows。Local Codex reverse proxy: rotating proxy-node pool, lazy health failover, and per-model 292 turn-state collection/injection. macOS + Windows.

trefeon/freebuff-proxy
Go · 2026-08-16 LLM 基础设施 工具 实验 Stars 85 周增 +112

FreeBuff 编码模型的 OpenAI 兼容网关。Token 池、会话生命周期、TLS stealth、嵌入式管理后台。无广告、无 CLI,只有 /v1/chat/completions。OpenAI-compatible gateway for FreeBuff coding models. Token pool, session lifecycle, TLS stealth, embedded admin dashboard. No ads, no CLI, just /v1/chat/completions.

agentllm-infra
maximpri/mlxtop
Rust · 2026-09-16 LLM 基础设施 工具 实验 Stars 82 周增 +7
0xSero/local-ai-registry
Python · 2026-09-01 LLM 基础设施 工具 实验 Stars 81 周增 +0

本地 AI 注册中心——硬件、模型、recipes、模型实例与价格。Local AI registry — hardware, models, recipes, model instances, and prices

Soulmate-Halo/heterogeneous-gpu-pd-lab
Python · 2026-09-07 LLM 基础设施 工具 实验 Stars 66 周增 +0

AI Max+ 395 加速:在 RTX 3060 上实测的异构 GPU PD 与异步融合层 pipeline 实验。AI Max+ 395 acceleration: measured heterogeneous GPU PD and asynchronous fused-layer pipeline experiments with RTX 3060.

engineering