dataelement/bisheng · 上手攻略
- 仓库:dataelement/bisheng
- 链接:https://github.com/dataelement/bisheng
- 分类:ai
- 作者:Tom
- 更新:2026-07-14
这是什么
BISHENG(毕昇)是一款开源 LLM 应用开发平台,主攻企业级场景,由国内公司 DataElement 开发维护。"毕昇"取自活字印刷术发明人,寓意"让智能应用像知识传播一样普惠"。平台融合了 Workflow 编排、RAG、Agent、模型管理、数据集管理、评估、SFT 微调、文档解析、观测等企业 AI 所需的全套能力,已被多家行业头部组织和世界 500 强企业采用。
核心特色在于其独特的可视化 Workflow 编排(画流程图即编排)和高精度中文文档解析能力,在企业知识库、文档审核、报告生成等场景有深厚积累。
解决什么问题
- LLM 应用开发门槛高:企业想用 LLM 改造业务流程,但缺乏统一的开发和运维平台,LangChain 代码散落各处,难以维护。
- Workflow 与 Chat 割裂:同类产品(如某些 RAG 平台)把对话式应用和流程式应用拆成两套系统,BISHENG 在同一框架下统一处理。
- Human-in-the-loop 缺失:多数平台 Workflow 从头跑到尾,无法中途人工干预。BISHENG 支持在 Workflow 执行过程中插入人工审核/反馈节点。
- 中文文档解析弱:很多开源 RAG 方案对中文 PDF、扫描件、印章、表格的解析质量堪忧,BISHENG 内置自研高精度解析模型。
- 企业合规需求:RBAC、SSO/LDAP、审计日志、高可用部署——这些能力通常只有商业平台才有,BISHENG 开源版直接提供。
快速安装(Docker 一键部署)
硬件要求
| 项目 | 最低要求 | 推荐配置 |
|---|---|---|
| CPU | 8 核 | 18 核+ |
| 内存 | 32 GB | 48 GB+ |
| Docker | 19.03.9+ | 最新稳定版 |
| Docker Compose | 1.25.1+ | 最新稳定版 |
⚠️ README 原版要求 CPU ≥ 4核/ RAM ≥ 16GB,但中文文档建议 8核/32GB 起。实际生产环境建议按推荐配置来。
默认安装会同时部署 Elasticsearch、Milvus(向量数据库)和 OnlyOffice 组件,需预留额外资源。
安装步骤
# 方式一:git clone(推荐)
git clone https://github.com/dataelement/bisheng.git
cd bisheng/docker
# 方式二:无 git 时下载 zip 包
wget https://github.com/dataelement/bisheng/archive/refs/heads/main.zip
unzip main.zip && cd bisheng-main/docker
# 启动(后台运行)
docker compose -f docker-compose.yml -p bisheng up -d
启动完成后访问:
http://<服务器IP>:3001
首次访问会跳转到注册页面,第一个注册的用户自动成为系统管理员。
详细部署文档(含高可用、分布式方案)参见 私有化部署 Wiki。
核心用法
1. BISHENG Workflow(可视化流程编排)
BISHENG 的 Workflow 通过"画流程图"方式构建,逻辑组件包括:
- 循环(画圈即成环):拖拽连成回路,自动识别为循环节点
- 并行(并列即并行):多个分支并列排列,自动并行执行
- 批量(多选即批量):批量处理多个输入项
- 条件分支:if/else 判断逻辑
- Human-in-the-loop:人工审批/反馈节点,可中断流程等待人工介入
示例场景:简历筛选
Start → 文档解析 → 关键信息提取 → [Human Review] → 合格简历入库 → 通知
↘ 不合格 → 记录归档
2. RAG(检索增强生成)
内置完整 RAG Pipeline,支持:
- 高精度文档解析(PDF、Word、图片扫描件、表格、印章)
- 向量检索(Milvus / ES)
- 混合检索
- 多轮对话 Context 管理
- 支持接入各类 Embedding 模型
3. Agent(灵思 Lingsight)
通过 AGL(Agent Guidance Language)框架构建专家级 Agent:
# AGL 示例(伪代码,具体语法请参考官方文档)
from agglang import Agent
agent = Agent(
name="财报分析助手",
guidance="你是资深金融分析师,擅长从财报中提取关键指标...",
tools=["pdf_parser", "calculator", "report_generator"]
)
4. 模型管理
统一管理多模型接入,包括:
- OpenAI GPT 系列
- Anthropic Claude 系列
- Azure OpenAI
- 开源模型(通过 vLLM / Ollama 等接入)
- 国内模型(通义、文心、智谱等,取决于部署配置)
5. 评估与 SFT
内置评测框架和数据管理功能,支持:
- 构建评测数据集
- 配置自动化评估指标
- LLM 微调(SFT)工作流
典型适用场景
| 场景 | BISHENG 擅长点 |
|---|---|
| 企业知识库问答 | 高精度中文 OCR + RAG + 可视化编排 |
| 文档审核/比对 | Human-in-the-loop + 多类型输入输出 |
| 报告自动生成 | 流程编排 + 模板 + 结构化输出 |
| 客服辅助 | Agent + 多轮对话 + 知识库检索 |
| 简历筛选 | 文档解析 → 信息提取 → Human Review |
| 多 Agent 协作 | 内置多 Agent 框架支持 |
| 数据分析 + 对话 | Chat + Workflow 混合编排 |
坑与注意
- 硬件门槛不低:完整 Docker Compose 启动(包括 ES + Milvus + OnlyOffice)建议 48GB+ 内存,16GB 可能勉强但会频繁 OOM。
- 中文 Wiki 需要飞书账号:文档链接均为
dataelem.feishu.cn,部分资料需要内部账号访问,公开资料有限。 - 版本迭代较快:活跃开发中,升级可能涉及数据库迁移,升级前务必阅读 Release Notes。
- SSO/LDAP 配置有门槛:企业级功能配置文档较分散,建议先在测试环境验证再上生产。
- 嵌入已有系统需 API:平台提供 API 接口,但二次开发和系统集成需要一定开发量,不算"开箱即用"。
- Stars 基数相对较低:截至 2026 年中 Stars 约 11.5k(周增 +21),相比 Dify(30k+)、LangFlow(20k+)等类似平台,社区规模较小。
与同类对比
| 平台 | 定位 | BISHENG 优势 | BISHENG 劣势 |
|---|---|---|---|
| Dify | 开源 LLM 应用平台 | 企业级功能更全(RBAC/SSO/审计)、中文文档解析更强 | 社区比 Dify 小,插件生态不如 Dify 丰富 |
| LangFlow | LangChain 可视化 | 同源自 LangChain,集成度更高 | 不如 BISHENG 专注企业场景 |
| Flowise | 低代码 LLM 流程 | 部署更轻量 | 功能深度不如 BISHENG |
| RAGFlow | 专注 RAG | 文档解析能力相近 | 无 Workflow 编排,场景单一 |
| 扣子/Coze | 商业化 Bot 平台 | 开源可控,可私有部署 | 生态和社区不如字节 |
一句话推荐结论
如果你需要一站式企业级 LLM 应用平台,特别是涉及中文文档处理、复杂流程编排和 Human-in-the-loop 场景,且要求私有化部署,BISHENG(毕昇)是目前开源领域里功能最完整、同时对中文场景优化最深的选项之一,推荐通过 Docker 一键部署体验。