跳到正文
IAI智能工厂中枢

Deployment

部署形态

IAI 有三种交付形态:个人版聚焦本机资料与官方 AI(规划中);企业服务器版在内网运行,岗位电脑用企业客户端连接服务器。

个人版与服务器版

个人版 规划中服务器版
用途本机知识库与按需官方 AI(规划中)企业正式私有部署
获取客户端免费,签名包即将通过官方域名提供私有化交付,企业镜像包受控
运行环境本机资料与检索;官方 AI 通过独立云网关Linux 服务器:PostgreSQL、Redis / Celery、MinIO、模型
用户个人账号、多设备共享积分;内测不开放自助注册多用户、多组织与资源树授权
数据知识库、本体、检索与 Wiki 编排留在本机企业自己的业务与知识数据
官方 AI账号与积分,确认必要上下文和预算后调用企业配置自己的模型服务
外部系统首期不承担工厂系统接入与值守MES / SCADA / ERP / MCP 与消息通道
费用价格以正式发布为准;云端到期不锁定本机资料按实际合同与授权

企业客户端只包含界面,连接企业的 IAI 服务器使用,随服务器版一起交付,不单独公开下载。

服务器版的组成

全部组件以容器方式运行在企业内网的一台或多台 Linux 服务器上。除 Web 工作台外,数据库、缓存和对象存储都只在容器内网通信,不在宿主机暴露端口。

  • Web 工作台

    浏览器访问,对内网开放一个端口;/api 由它转发到中枢服务

  • 中枢服务

    对话与执行账本、技能、知识库、本体、智能体、审批、审计

  • PostgreSQL 16 + pgvector

    业务数据、知识切片与向量索引

  • Redis · Celery

    异步任务、定时计划与事件处理

  • MinIO

    文件与附件存储

  • 模型服务

    本机 vLLM / Ollama,或企业已有的 OpenAI 兼容服务

硬件参考

实际需求随模型大小、并发量和知识库规模变化,以下为起步参考。

GPU(使用本机模型时)
24 GB 显存单卡(RTX 4090 级)可运行 30B 级 MoE 模型的 4 bit 量化版本
内存 / 磁盘
32 GB 以上内存;200 GB 以上可用磁盘(模型镜像与权重约占 20–30 GB)
系统与软件
Ubuntu 22.04 / 24.04,Docker 与 Compose;GPU 另需 NVIDIA 驱动与 Container Toolkit
不用本机模型时
服务器不需要 GPU,接入企业已有的模型服务即可

服务器版怎么交付

原则是:不含产品代码的可以公开,含代码的按客户受控交付。每个版本都附带 SHA256 校验和,拿到文件后可以自行核对。

私有化交付

部署套件

docker-compose 编排文件、安装脚本、.env 示例和部署文档。先看清部署方式和硬件要求,再做决定。

按客户交付

镜像包

中枢服务、Web 工作台和数据库镜像。包含产品代码,通过离线介质或按客户签发的限时链接交付,附校验和。

不分发

模型

模型权重体积大且受第三方许可约束,不随产品分发;提供导入说明,无外网工厂可离线拷入。

本机知识库与官方 AI,按自己的节奏使用

个人版仍在规划与开发中:资料在本机,官方 AI 使用账号与积分。企业系统接入通过私有化交付。