dataelement/bisheng · 上手攻略

  • 仓库:dataelement/bisheng
  • 链接:https://github.com/dataelement/bisheng
  • 分类:ai
  • 作者:Tom
  • 更新:2026-07-14

这是什么

BISHENG(毕昇)是一款开源 LLM 应用开发平台,主攻企业级场景,由国内公司 DataElement 开发维护。"毕昇"取自活字印刷术发明人,寓意"让智能应用像知识传播一样普惠"。平台融合了 Workflow 编排、RAG、Agent、模型管理、数据集管理、评估、SFT 微调、文档解析、观测等企业 AI 所需的全套能力,已被多家行业头部组织和世界 500 强企业采用。

核心特色在于其独特的可视化 Workflow 编排(画流程图即编排)和高精度中文文档解析能力,在企业知识库、文档审核、报告生成等场景有深厚积累。

解决什么问题

  • LLM 应用开发门槛高:企业想用 LLM 改造业务流程,但缺乏统一的开发和运维平台,LangChain 代码散落各处,难以维护。
  • Workflow 与 Chat 割裂:同类产品(如某些 RAG 平台)把对话式应用和流程式应用拆成两套系统,BISHENG 在同一框架下统一处理。
  • Human-in-the-loop 缺失:多数平台 Workflow 从头跑到尾,无法中途人工干预。BISHENG 支持在 Workflow 执行过程中插入人工审核/反馈节点。
  • 中文文档解析弱:很多开源 RAG 方案对中文 PDF、扫描件、印章、表格的解析质量堪忧,BISHENG 内置自研高精度解析模型。
  • 企业合规需求:RBAC、SSO/LDAP、审计日志、高可用部署——这些能力通常只有商业平台才有,BISHENG 开源版直接提供。

快速安装(Docker 一键部署)

硬件要求

项目 最低要求 推荐配置
CPU 8 核 18 核+
内存 32 GB 48 GB+
Docker 19.03.9+ 最新稳定版
Docker Compose 1.25.1+ 最新稳定版

⚠️ README 原版要求 CPU ≥ 4核/ RAM ≥ 16GB,但中文文档建议 8核/32GB 起。实际生产环境建议按推荐配置来。

默认安装会同时部署 Elasticsearch、Milvus(向量数据库)和 OnlyOffice 组件,需预留额外资源。

安装步骤

# 方式一:git clone(推荐)
git clone https://github.com/dataelement/bisheng.git
cd bisheng/docker

# 方式二:无 git 时下载 zip 包
wget https://github.com/dataelement/bisheng/archive/refs/heads/main.zip
unzip main.zip && cd bisheng-main/docker

# 启动(后台运行)
docker compose -f docker-compose.yml -p bisheng up -d

启动完成后访问:

http://<服务器IP>:3001

首次访问会跳转到注册页面,第一个注册的用户自动成为系统管理员

详细部署文档(含高可用、分布式方案)参见 私有化部署 Wiki

核心用法

1. BISHENG Workflow(可视化流程编排)

BISHENG 的 Workflow 通过"画流程图"方式构建,逻辑组件包括:

  • 循环(画圈即成环):拖拽连成回路,自动识别为循环节点
  • 并行(并列即并行):多个分支并列排列,自动并行执行
  • 批量(多选即批量):批量处理多个输入项
  • 条件分支:if/else 判断逻辑
  • Human-in-the-loop:人工审批/反馈节点,可中断流程等待人工介入
示例场景:简历筛选
  Start → 文档解析 → 关键信息提取 → [Human Review] → 合格简历入库 → 通知
                                    ↘ 不合格 → 记录归档

2. RAG(检索增强生成)

内置完整 RAG Pipeline,支持:

  • 高精度文档解析(PDF、Word、图片扫描件、表格、印章)
  • 向量检索(Milvus / ES)
  • 混合检索
  • 多轮对话 Context 管理
  • 支持接入各类 Embedding 模型

3. Agent(灵思 Lingsight)

通过 AGL(Agent Guidance Language)框架构建专家级 Agent:

# AGL 示例(伪代码,具体语法请参考官方文档)
from agglang import Agent

agent = Agent(
    name="财报分析助手",
    guidance="你是资深金融分析师,擅长从财报中提取关键指标...",
    tools=["pdf_parser", "calculator", "report_generator"]
)

4. 模型管理

统一管理多模型接入,包括:

  • OpenAI GPT 系列
  • Anthropic Claude 系列
  • Azure OpenAI
  • 开源模型(通过 vLLM / Ollama 等接入)
  • 国内模型(通义、文心、智谱等,取决于部署配置)

5. 评估与 SFT

内置评测框架和数据管理功能,支持:

  • 构建评测数据集
  • 配置自动化评估指标
  • LLM 微调(SFT)工作流

典型适用场景

场景 BISHENG 擅长点
企业知识库问答 高精度中文 OCR + RAG + 可视化编排
文档审核/比对 Human-in-the-loop + 多类型输入输出
报告自动生成 流程编排 + 模板 + 结构化输出
客服辅助 Agent + 多轮对话 + 知识库检索
简历筛选 文档解析 → 信息提取 → Human Review
多 Agent 协作 内置多 Agent 框架支持
数据分析 + 对话 Chat + Workflow 混合编排

坑与注意

  1. 硬件门槛不低:完整 Docker Compose 启动(包括 ES + Milvus + OnlyOffice)建议 48GB+ 内存,16GB 可能勉强但会频繁 OOM。
  2. 中文 Wiki 需要飞书账号:文档链接均为 dataelem.feishu.cn,部分资料需要内部账号访问,公开资料有限。
  3. 版本迭代较快:活跃开发中,升级可能涉及数据库迁移,升级前务必阅读 Release Notes。
  4. SSO/LDAP 配置有门槛:企业级功能配置文档较分散,建议先在测试环境验证再上生产。
  5. 嵌入已有系统需 API:平台提供 API 接口,但二次开发和系统集成需要一定开发量,不算"开箱即用"。
  6. Stars 基数相对较低:截至 2026 年中 Stars 约 11.5k(周增 +21),相比 Dify(30k+)、LangFlow(20k+)等类似平台,社区规模较小。

与同类对比

平台 定位 BISHENG 优势 BISHENG 劣势
Dify 开源 LLM 应用平台 企业级功能更全(RBAC/SSO/审计)、中文文档解析更强 社区比 Dify 小,插件生态不如 Dify 丰富
LangFlow LangChain 可视化 同源自 LangChain,集成度更高 不如 BISHENG 专注企业场景
Flowise 低代码 LLM 流程 部署更轻量 功能深度不如 BISHENG
RAGFlow 专注 RAG 文档解析能力相近 无 Workflow 编排,场景单一
扣子/Coze 商业化 Bot 平台 开源可控,可私有部署 生态和社区不如字节

一句话推荐结论

如果你需要一站式企业级 LLM 应用平台,特别是涉及中文文档处理、复杂流程编排和 Human-in-the-loop 场景,且要求私有化部署,BISHENG(毕昇)是目前开源领域里功能最完整、同时对中文场景优化最深的选项之一,推荐通过 Docker 一键部署体验。