noaislop 是一个专注于「AI 味」检测和清除的开源工具,更准确地说是一套编辑规则和工作流。它的核心目标不是判断「这段文字是不是 AI 写的」,而是检测并清除文字中 20+ 种常见的 AI 写作模式(smell patterns),同时保留作者本人的声音、节奏和个性。 GitHub Stars 超过 2700,X(Twitter)帖子达到 611K 浏…
仓库攻略
122 篇 · 122 个项目 · tom · 评测基准
img2threejs 是一个代码优先的图像→3D 重建工具。你给它一张参考图,它生成一段 TypeScript 代码,在浏览器里跑出一个 THREE.Group 工厂函数——所有几何体都由原始几何体(BoxGeometry、CylinderGeometry 等)、程序化着色器和生成式几何拼出来,没有 mesh 文件,没有 GLB 下载,产物天然是"代码"而…
21stdev/magicmcp 是 21st.dev 平台的 MCP(Model Context Protocol)服务器,专门为 AI 编程助手(Cursor、Windsurf、Claude Code、Cline、VS Code 等)提供 UI 组件生成能力。官方自称"like v0, but in your Cursor / Claude Code /…
jCodeMunch 是一个基于 treesitter AST 解析的 MCP 服务器,专门解决 AI Agent 在代码库探索时「读整个文件找一句话」的 token 浪费问题。它对仓库做一次索引,之后每次检索只返回精确的函数、类、方法、常量符号——实测平均减少 95%+ 的 token 消耗(官方 live benchmark 20260723:15 项任…
VibeTrading 是香港大学数据智能实验室(HKUDS)开源的个人量化交易智能体框架,定位为"让任何 AI Agent 都具备完整交易研究能力"的一条命令式工具链。装好后,你的 Agent 可以做市场研究、策略编写、回测、因子分析、Shadow Account 行为诊断、券商账户审计,最终生成可交付的研究报告——覆盖 A 股、港股、美股、加密货币、期货…
AOS Community Edition(简称 AOSCE)是 Unicity 公司推出的开源 Agent 操作系统,专为希望拥有可审查、可组合 AI Agent 运行环境的开发者设计。它的核心定位是:Agent 的执行环境(类似容器的隔离运行时)+ 配套的工具链,让 Agent 在其中既能安全运行,又能自我扩展能力。 关键概念拆解: MetaHarnes…
codereviewgraph(简称 CRG)是一个本地优先的代码智能图谱工具,为 MCP(Model Context Protocol)兼容的 AI 编程助手和 CLI 环境设计。它的核心思路是:先把你的代码库解析成一张结构化的知识图谱(节点 = 函数/类/导入,边 = 调用/继承/测试覆盖),然后在 AI 做代码审查时只喂给它真正相关的文件,而不是把整个…
Zvec 是阿里巴巴通义实验室开源的进程内(inprocess)向量数据库,定位为"向量数据库领域的 SQLite"——直接以内嵌库的方式运行在你的应用程序中,无需部署独立的数据库服务进程。它基于阿里生产级 Proxima 向量检索引擎,支持稠密向量 + 稀疏向量 + 全文检索(FTS)混合检索,并内置 WAL 持久化、多进程并发读取等企业级特性。 当前版本…
awesomepretrainedchinesenlpmodels 是一个由个人开发者(lonePatient)维护的 GitHub 精选列表,收录高质量中文预训练模型、大语言模型、多模态模型及其相关资源。截至 2026 年 7 月 Stars 5574,是中文 NLP 领域最全面的开源模型索引之一。 仓库按模型类型和任务类型双重维度分类,涵盖从 2020 …
AwesomeLLMOps 是由 tensorchord 团队维护的 GitHub 精选列表(Awesome List),收录了 LLMOps(Large Language Model Operations)领域的优质工具、项目和资源。截至 2026 年 7 月已累计 5879 Stars,周增 +7,是目前最活跃的 LLMOps 专题列表之一。 LLMOp…
Chronos 是亚马逊科学团队开源的时间序列预测预训练模型家族,通过将时间序列 token 化后借助语言模型架构(类 T5)进行训练,实现零样本预测。整个家族经历三代演进: Chronos2(最新,2025年10月发布):120M 参数 encoderonly 模型;支持单变量、多变量、以及带外生变量的协变量感知预测;上下文扩展至 8192 步、预测长度达…
ymcui/ChineseLLaMAAlpaca 是最早一批将 Meta LLaMA 模型中文化并开源的重量级项目。它的核心工作是两件事: 1. 中文词表扩充——原版 LLaMA 词表偏英文,中文编码效率极低(一个汉字 = 多个 subword),该项目将中文词表扩充至约 5 万 token,显著提升中文处理效率 2. 指令精调(Alpaca)——在扩充词表…
MOSS(MultiOmni Scale System)是复旦大学开源的工具增强型对话语言模型,具有 160 亿参数(16B),支持中英双语、多轮对话,以及插件调用能力(搜索、文生图、计算器、解方程)。 该项目开源内容包括: 本质上,这是一个可以调用工具的中文 ChatGPT 风格模型,可以在本地私有部署,参数规模比 GPT4 小但远大于早期开源 7B 模型…
Evidently 是一个开源的 ML 和 LLM 可观测性(Observability)框架,用 Python 编写,用于评估、测试和监控 AI 系统——从传统机器学习模型到生成式 LLM 应用均可覆盖。 核心能力: 离线评测(Reports):一次性评估模型或数据质量,输出交互式 HTML 报告或 JSON。 测试套件(Test Suites):在 CI…
内容待复核
BradyFU/Awesome-Multimodal-Large-Language-Models · 上手攻略
这是一份由南京大学 MIG 实验室(NJUMiG)维护的多模态大语言模型(Multimodal Large Language Models,MLLM)前沿论文合集,截至 2026 年 7 月已收录 17.9k+ Stars,是 MLLM 领域最全面、最活跃的社区驱动的学术索引之一。 它不是代码库,而是一个持续更新的知识库,系统整理了 MLLM 各个子方向的论…
Metaflow 是 Netflix 于 2019 年开源的人类中心化 ML/AI 系统框架,用 Python 编写,目标是让数据科学家和工程师能够从笔记本快速原型开发无缝过渡到可靠的生产部署。它覆盖了 AI/ML 项目全生命周期:实验跟踪、数据管理、模型版本控制、水平/垂直扩展,以及一键部署到生产编排器。 Netflix 内部有超过 3000 个 AI/M…
Giskard 是一个开源 Python 库,专为测试和评估 AI Agent 系统而设计,由法国团队 GiskardAI 维护。它经历了从 v2 到 v3 的重大重写:v3 采用模块化架构,将功能拆分为 giskardchecks(轻量测试)、giskardscan(红队漏洞扫描)和规划中的 giskardrag(RAG 评估)三个独立包,去掉了 v2 中…
ncnn 是腾讯开源的高性能神经网络推理框架,专门针对移动端、嵌入式设备和桌面端场景优化。它的核心特点是无第三方运行时依赖(pure C++ 实现)、支持 CPU 和 Vulkan GPU 双后端,可将 PyTorch / ONNX 模型直接部署到手机、PC、浏览器或边缘设备上。 腾讯内部已大规模落地:QQ、Qzone、微信、天天 P 图等产品均在用。 最新…
elizaOS/eliza 是一个开源、本地优先的 AI Agent 操作系统。它由两部分组成: Eliza(应用层):面向桌面、移动端、Web 的 AI 助手,支持聊天、语音、消息账户集成、个人大脑、非托管钱包、浏览器自动化和本地模型。 elizaOS(运行时/OS 层):同一个运行时可以接管整台设备,从 USB 启动 Linux 桌面,或在 Androi…
rustunofficial/awesomerust 是 Rust 生态中最老牌、最全面的资源聚合列表,由社区维护,GitHub 星标数超过 5.8 万。它不是一个代码库,而是一张 Rust 世界的地图——收录了 Rust 语言相关的应用程序、库、开发工具、学习资源,覆盖从入门到生产级项目的全链路。 该列表按照「应用程序 → 开发工具 → 库 → 资源 → …
OpenLLMetry(发音「openLLmetry」)是基于 OpenTelemetry 的开源 LLM 应用可观测性工具,由 Y Combinator 支持的 Traceloop 公司开发和维护(Apache 2.0 许可)。 它的核心思路:用 OpenTelemetry 标准采集 LLM 应用的全链路追踪数据,无需更换你现有的可观测性基础设施(Data…
BISHENG(毕昇)是一款开源 LLM 应用开发平台,主攻企业级场景,由国内公司 DataElement 开发维护。"毕昇"取自活字印刷术发明人,寓意"让智能应用像知识传播一样普惠"。平台融合了 Workflow 编排、RAG、Agent、模型管理、数据集管理、评估、SFT 微调、文档解析、观测等企业 AI 所需的全套能力,已被多家行业头部组织和世界 50…
内容待复核
WangRongsheng/awesome-LLM-resources · 上手攻略
awesomeLLMresources 是由 WangRongsheng(王荣胜)维护的大语言模型(LLM)优质资源汇总仓库,目前 8.6K+ Stars。它自称"全世界最好的LLM资料总结",涵盖从数据处理、微调、Agent 开发、推理优化、RAG、模型评测到多模态(小语言模型、视觉语言模型)等全链路内容,并持续更新。 这不是一个代码工具库,而是一个持续更…
cheatoncontent 是一个内容创作实验系统,用 AI 把每一次发帖变成一次"可量化、可复盘、可进化"的校准实验。它不是帮你写内容的 AI,而是帮你建立创作者判断力的工具。 作者自称用它从零做到 100 万粉丝,用法核心是:写之前先打分 → 发布后 3 天复盘 → 用数据迭代评分公式。 大多数创作者困在一个低效循环里: 发布 → 看数据 → 什么也没…
NirDiamant/agentstowardsproduction 是一个端到端、代码优先的 GenAI Agent 生产化教程仓库,由 AI 教育博主 Nir Diamant 维护(LinkedIn 粉丝众多,RAG Techniques Newsletter 作者)。目前收录 28 个生产级教程,覆盖从原型到企业级部署的完整链路。 每个教程都是独立文件…
Helicone 是一个开源的 LLM 可观测性(Observability)与 AI 网关(AI Gateway)平台,定位是帮助 AI 工程师一站式完成模型调用监控、成本分析、流量路由、Prompt 版本管理和微调数据准备。它诞生于 Y Combinator W23 批次,GitHub Stars 已超过 5,900(数据截至 202607),是 LLM…
LitGPT 是 Lightning AI 出品的开源 LLM 训练与推理框架,定位是「一站式解决从零预训练、微调到上线部署的全部流程」。核心设计理念是无抽象层、全部从零实现、代码可直接调试,不依赖 Transformers 库内部的复杂封装。它支持 20+ 主流大模型(MegaSauna 3、Qwen2.5、Phi4、Llama 3/3.1/3.2/3.3…
HandsOn Large Language Models(O'Reilly,2024)是 Jay Alammar(《The Illustrated GPT2》作者)和 Maarten Grootendorst(Hugging Face 社区明星博主)合著的技术书籍,其官方配套代码仓库。仓库以 Jupyter Notebook 形式覆盖了从语言模型基础、To…
Haystack 是由 deepset(一家专注于 NLP 和 LLM 的德国公司)维护的开源 AI 编排框架,用于构建生产就绪的 LLM 应用。它的核心理念是"透明编排"——对检索(Retrieval)、路由(Routing)、记忆(Memory)和生成(Generation)每一步都有显式控制,开发者清楚知道数据在管道中如何流转。 简单说:Haystac…
AI Engineering Hub 是一个收录了 93+ 个生产就绪 AI 项目的开源教程库,涵盖 LLM、RAG、AI Agent 的完整实战项目,每个项目都附带可运行的代码和详细说明。 它不是一个大模型或框架本身,而是一个学习路径 + 项目索引:从最基础的 OCR 识别、聊天机器人,到高级的 Agent 编排、模型微调、生产部署,全部都有按难度分类的实…