Guides · organized/guides

仓库攻略

391 篇 · 386 个项目 · jay

用 Codex Desktop + GPT-5.6 Sol Ultra 单次生成完整 3D 游戏的完整复盘 · 干货攻略
2026 年 8 月 7 日,知名 AI 工程博主 Simon Willison(@simonw)用 Codex Desktop 跑了 GPT5.6 Sol Ultra,一次提示词,52 分钟,零人工干预,直接生成一个完整可玩的 3D 浣熊偷盗游戏「Moonlight & Mayhem」。 游戏特点: 博物馆场景,三只浣熊组队潜入 需要解救同伴、叠罗汉偷取「…
simonw/raccoon-heist-codex Jay 2026-08-14
chi111i/BypassAIGC · 上手攻略
BypassAIGC 是一个专业论文润色与 AIGC 降重系统(CC BYNCSA 4.0 非商业许可证),核心功能是双阶段处理:先用大模型对论文进行语言润色,再用第二阶段模型对润色后文本进行"原创性增强"——即降低 GPTZero 等 AIGC 检测器的识别率,同时保持语义基本不变。 支持 Gemini(推荐 2.5 Pro)、OpenAI 兼容接口、Re…
安全与风险 chi111i/BypassAIGC Stars 2,034 Jay 2026-08-14
windingwind/zotero-actions-tags · 上手攻略
Zotero Actions & Tags(简称 AT)是 Zotero 的插件,赋予用户基于 Zotero 事件或自定义快捷键自动执行操作的能力。核心功能是"触发条件 → 自动动作":当你添加文献、打开条目、创建标注时,自动为条目打标签、复制链接、生成笔记、翻译标题摘要等。完全基于图形界面配置,无需写代码即可使用,也支持用户自定义 JavaScript 脚…
工程化 windingwind/zotero-actions-tags Stars 2,775 Jay 2026-08-14
Aperivue/medsci-skills · 上手攻略
MedSci Skills 是面向临床研究与医学人工智能的开源 Agent Skills 合集(MIT 许可证),由韩国首尔峨山医疗中心放射科医生兼研究员 Yoojin Nam, MD 构建,在真实出版物上测试通过。截至 v5.0 版本共包含 59 项技能,覆盖从文献检索、统计图表、报告指南合规审查到 AI 模型工程的全链路。 它并非通用 AI 科学家平台,…
Agent 智能体 Aperivue/medsci-skills Stars 269 Jay 2026-08-14
MOPD:前沿开源模型的默认后训练配方 · 干货攻略
MOPD(MultiDomain OnPolicy Distillation,多域同策略蒸馏) 是一种将多个领域专家模型的能力整合到单一模型中的后训练范式。它由小米 MiMo 团队提出(论文 arXiv:2606.30406),核心做法是:先在各自领域独立训练 RL specialist teacher(数学、代码、Agent 等),再通过同策略蒸馏将所有 …
Jay 2026-08-14
Sakana AI Conductor:让一个 7B 模型学会"当主管" · 干货攻略
⚠️ 重要说明:原帖候选将本工作仓库写作 SakanaAI/Conductor,经核验该 GitHub 仓库返回 404(不存在或未公开)。本文以 arXiv:2512.04388 论文页面和 Sakana AI 官方博客 为权威来源;代码/模型权重是否公开 Release 需以上述官方渠道为准,本文不替代官方公告。 Sakana AI Conductor …
Jay 2026-08-13
vercel-labs/zero-native · 上手攻略
Native SDK(项目原名 ZeroNative)是 Vercel Labs 出品的原生桌面应用开发工具链,用 Zig 做运行时引擎、TypeScript 或 Zig 写业务逻辑、.native 声明式标记写界面,编译后输出不含任何浏览器 runtime 的单个本地二进制。核心理念:开发者喜欢 Web 技术的表达力,但 Electron 的重量(Chro…
vercel-labs/zero-native(现更名为 [vercel-labs/native](https://github.com/vercel-labs/native)) Jay 2026-08-13
Lynricsy/OneSSH · 上手攻略
OneSSH 是一个面向 AI Agent 的集中式 SSH 网关,用 Go 写的单个二进制(默认端口 8866),提供 MCP(Model Context Protocol)接口让 AI Agent 以工具调用方式操作远程主机。核心思路是:私钥/密码从不离开网关,Agent 只拿临时令牌 + MCP 工具,权限在网关侧集中管理,所有操作留下结构化审计日志。…
Agent 智能体 Lynricsy/OneSSH Stars 56 Jay 2026-08-13
khoj-ai/openpaper · 上手攻略
Open Paper 是一个研究文献管理工作台,定位为"读论文的 IDE"。核心功能是把 PDF 上传、AI 生成摘要、highlight 标注、AI 问答、跨文献综合、Zotero 同步全部收敛到一个 Web 应用里,AI 回答强制附带可点击溯源的精确引用(citationgrounded),并配套专门的 ResearchQA 基准 来量化回答质量。 读论…
RAG 检索增强 khoj-ai/openpaper Stars 412 Jay 2026-08-13
Meta Muse Glimmer 30B 本地 Agent 攻略 · 干货攻略
Meta Muse Glimmer 是 Meta 超级智能实验室(Meta Superintelligence Lab)于 2026 年 8 月 开源发布的 ~29.6B 参数多模态推理模型,权重基于 Apache 2.0 许可证,完全开放商用。它是 Meta 自 Llama 时代之后首次重新发布开源权重,被 @rasbt 形容为「Llama 时代以来 Me…
Agent 智能体 Jay 2026-08-13
alirezarezvani/claude-code-skill-factory · 上手攻略
Claude Code Skill Factory 是一个用自然语言交互构建生产级 Claude Skills、Claude Code Agents、自定义 Slash Commands 和 LLM Prompts 的开源工具包。 简单说:你要写一个 Claude Skill,不用从零憋文档,直接回答几个问题,Factory Agent 帮你生成完整的 SK…
Agent 智能体 alirezarezvani/claude-code-skill-factory Stars 847 Jay 2026-08-13
dgreenheck/webgpu-claude-skill · 上手攻略
webgpuclaudeskill 是一个 Claude Code Agent Skill,让 Claude 能够帮助开发者编写基于 WebGPU + Three.js 的 3D 图形程序,重点覆盖 TSL(Three.js Shading Language) 着色器编程、GPU 计算着色器和后处理效果。 核心定位:把 Claude 变成一个懂 WebGPU…
Agent 智能体 dgreenheck/webgpu-claude-skill Stars 1,137 Jay 2026-08-13
stacklok/toolhive · 上手攻略
ToolHive 是 Stacklok 开源的企业级 MCP(Model Context Protocol)服务器运行与管理平台,定位类似 MCP 界的"Kubernetes"——用容器隔离每一个 MCP 服务器,用声明式 API 集中管控注册表、网关、运行时和安全策略。 核心卖点三条: 1. 安全隔离:每个 MCP 服务器跑在独立容器里,凭证不泄露到本地,…
Agent 智能体 stacklok/toolhive Stars 2,000 Jay 2026-08-13
utkuozdemir/nvidia_gpu_exporter · 上手攻略
nvidia_gpu_exporter 是一个用 Go 编写的 Prometheus GPU 指标导出器,底层调用 nvidiasmi(NVIDIA 系统管理接口)采集显卡实时状态——包括 GPU 利用率、显存占用、温度、功率、风扇转速、时钟频率等——并以 Prometheus 标准格式(/metrics 端点)暴露出来,可直接对接 Grafana 渲染监控…
LLM 基础设施 utkuozdemir/nvidia_gpu_exporter Stars 1,527 Jay 2026-08-12
mrgoonie/claudekit-skills · 上手攻略
claudekitskills 是 mrgoonie 在 GitHub 上维护的一套 Claude Agent Skills 合集,托管于 ClaudeKit.cc(一个非 Anthropic 官方的 Claude 第三方服务平台)。这并非 Anthropic 官方产品,而是社区将高频使用场景封装为可复用的 Skill 工作流——每个 Skill 约等于一个…
Agent 智能体 mrgoonie/claudekit-skills Stars 2,199 Jay 2026-08-12
lexmount/moli · 上手攻略
Moli 是一个用 Rust 从零构建的浏览器引擎,专为 AI Agent 场景设计。它不依赖 Chromium,却又完整实现了 V8 JavaScript 引擎、原生 DOM、CSS 渲染、网络请求(Fetch/XHR/WebSocket)、Cookie、localStorage/IndexedDB/OPFS 等 Web 运行时。与传统浏览器自动化工具最大…
Agent 智能体 lexmount/moli Stars 399 Jay 2026-08-12
Harness 工程决定 Agent 工具调用行为,而非工具数量 · 干货攻略
2026 年,AI 社区出现了一个重要认知转向:Agent 的表现瓶颈不在模型本身,而在包裹模型的那层工程结构——Harness(驾驭层)。Harness 由 @omarsar0(Elvis,研究机构 DAIR.AI 联合创始人)提出,核心主张是:Agent 的工具调用行为由 Harness 决定,而非工具数量;Harness 的核心能力是决定何时不调用工具…
Agent 智能体 Jay 2026-08-12
Maple-Preview:三元权重量化推理模型,Mac Mini M4 跑出 218 tok/s · 干货攻略
MaplePreview 是 DeepGrove(@deepgrove_ai)于 2026 年 8 月初开源的一个 20BA1B 三元权重组合专家(ternaryweight MoE)推理模型。所谓"三元权重",即权重值仅使用 {1, 0, +1} 三个离散值,而非常见的 INT4/INT8 量化——这意味着权重本身已经是极端低精度状态,但仍从零开始以三元格…
deepgrove/maple-preview Jay 2026-08-12
Skill-Native LLMs:技能切换熵如何让大模型真正掌握长程推理 · 干货攻略
长程推理(longhorizon reasoning)要求模型在一个回答链内反复切换不同技能:比如先做数学推导,再用结果来规划日程。现有评测基准往往只考单个技能,无法衡量模型在技能之间灵活切换的能力。 SkillNative LLMs 是普林斯顿、CMU、MIT 等机构在 2026 年 8 月发表的论文(arXiv:2608.05139),从评测和训练两个方…
Gen-Verse/Skill-Entropy-RL Jay 2026-08-11
delibae/claude-prism · 上手攻略
ClaudePrism 是一个 本地优先的离线科学写作工作空间,由 Tauri 2(Rust)构建的原生桌面应用,集成 LaTeX 编译(嵌入式 Tectonic)、Python 科学计算环境(uv)、以及 100+ 领域专项 Claude Skills(来自 KDense Scientific Skills 项目)。简单说:它把 OpenAI Prism …
Agent 智能体 delibae/claude-prism Stars 1,732 Jay 2026-08-11
rampstackco/claude-skills · 上手攻略
rampstackco/claudeskills 是一个 Claude Skills 技能库,包含 103 个互相组合的模块化技能,覆盖从品牌策略、设计系统、内容生产、SEO、产品管理、前端开发到增长运营的完整网站生命周期。每一个 Skill 都是一个独立文件夹,内含 SKILL.md(指令 + YAML 元数据)以及可选的参考文件(模板、清单、工作示例)。…
Agent 智能体 rampstackco/claude-skills Stars 530 Jay 2026-08-11
kvcache-ai/AgentENV · 上手攻略
AgentENV(简称 AENV)是 Kimi K3 模型背后用于大规模运行 Agent 执行环境的分布式平台,由 kvcacheai 团队开源。它的核心职责是:在大规模集群上同时调度成千上万个轻量级隔离沙盒(基于 Firecracker microVM),按需加载 OCI 镜像,让每个 Agent 任务在独立、可快启、可快停的环境中运行。 类比来说:如果 …
LLM 基础设施 kvcache-ai/AgentENV Stars 3,140 Jay 2026-08-11
SpyRL:用「谁是卧底」游戏为开放域任务生成自验证 RL 奖励 · 干货攻略
SpyRL 是 RLSVR(Reinforcement Learning with SelfVerifiable Rewards)的具体实现,由 Duke 大学、Adobe、NUS、Penn State 等机构联合提出,已被 COLM 2026 接收。 核心思想一句话:把开放域任务变成一个「谁是卧底」游戏,让游戏的投票结果自动成为可验证的 RL 奖励信号——…
wangqinsi1/RLSVR(代码在 `SpyRL` 分支) Jay 2026-08-11
taylorwilsdon/google_workspace_mcp · 上手攻略
Google Workspace MCP Server(workspacemcp)是目前功能最完整的 Google Workspace MCP 服务器,通过 MCP(Model Context Protocol)协议将 AI 助手连接到 Google 全套生产力工具——覆盖 Gmail、Drive、Calendar、Docs、Sheets、Slides、Fo…
Agent 智能体 taylorwilsdon/google_workspace_mcp Stars 2,940 Jay 2026-08-11
modelscope/evalscope · 上手攻略
EvalScope 是魔搭社区(ModelScope)打造的一站式大模型评测框架,用一行命令即可对 LLM、VLM、Embedding、Reranker、AIGC 等多类型模型进行能力评估、推理性能压测和结果可视化。 核心场景:评测模型效果(能力基准)、压测推理性能(TTFT/TPOT 等指标)、Agent 轨迹回放、多模型对战(Arena)。 ⚠️ Eva…
评测基准 modelscope/evalscope Stars 3,218 Jay 2026-08-11
redbaronyyyyy-eng/humanizer-zh-academic · 上手攻略
humanizerzhacademic 是一个专为 Claude Code 设计的 Skill(提示词库),核心功能是降低中文学术写作的 AIGC 检测率。它不是让 AI 写得更好,而是让 AI 写的东西读起来更像人写的——不是消除 AI 味,而是注入人类写作的真实感与随机性。 适用于:期刊论文、毕业论文、研究报告、中文学术写作润色。 ⚠️ 实验数据(来源 …
安全与风险 redbaronyyyyy-eng/humanizer-zh-academic Stars 246 Jay 2026-08-11
LifelongLazyLearner/qu-ai-wei · 上手攻略
一个 Claude Code Skill(MIT 协议),专门用来把 AI 生成的简体中文初稿改写成更自然的真人腔调,同时保留原文的事实、意思、正式程度和说话方式。 核心理念:做减法而非改写。不发明事实、不补写观点、不改动语体档次,只清理套话、机械结构、翻译腔和过度工整的表达。51 类 AI 写作痕迹模式逐号列出,改前逐条核验密度而非机械套用。 用 AI(G…
安全与风险 LifelongLazyLearner/qu-ai-wei Stars 392 Jay 2026-08-10