跳到正文
IAI

Deployment

部署形态

IAI 有三种交付形态:先用试用版在自己的电脑上评估;正式使用时部署服务器版,数据留在企业内网;岗位电脑用企业客户端连接服务器。

试用版与服务器版

试用版 即将发布服务器版
用途任何人下载后自助评估;售前现场离线演示企业正式私有部署
获取官网公开下载部署套件公开;镜像包按客户交付
运行环境Windows 本机,后端 + SQLite,只监听 127.0.0.1Linux 服务器:PostgreSQL、Redis / Celery、MinIO、本机模型
用户1 个主账号 + 2 个预置岗位账号,不能新增多用户、多组织、团队与资源树授权
数据演示数据 + 你导入的文档,不设容量上限企业自己的真实数据
外部系统只有内置模拟平台真实 MES / SCADA / ERP / MCP 与消息通道
自动化手动试算事件驱动、定时与无人值守运行
行业扩展不含医药、研发等扩展包
有效期构建后 120 天,到期只读、可导出按授权

企业客户端只包含界面,连接企业的 IAI 服务器使用,随服务器版一起交付,不单独公开下载。

服务器版的组成

全部组件以容器方式运行在企业内网的一台或多台 Linux 服务器上。除 Web 工作台外,数据库、缓存和对象存储都只在容器内网通信,不在宿主机暴露端口。

  • Web 工作台

    浏览器访问,对内网开放一个端口;/api 由它转发到中枢服务

  • 中枢服务

    对话与执行账本、技能、知识库、本体、智能体、审批、审计

  • PostgreSQL 16 + pgvector

    业务数据、知识切片与向量索引

  • Redis · Celery

    异步任务、定时计划与事件处理

  • MinIO

    文件与附件存储

  • 模型服务

    本机 vLLM / Ollama,或企业已有的 OpenAI 兼容服务

硬件参考

实际需求随模型大小、并发量和知识库规模变化,以下为起步参考。

GPU(使用本机模型时)
24 GB 显存单卡(RTX 4090 级)可运行 30B 级 MoE 模型的 4 bit 量化版本
内存 / 磁盘
32 GB 以上内存;200 GB 以上可用磁盘(模型镜像与权重约占 20–30 GB)
系统与软件
Ubuntu 22.04 / 24.04,Docker 与 Compose;GPU 另需 NVIDIA 驱动与 Container Toolkit
不用本机模型时
服务器不需要 GPU,接入企业已有的模型服务即可

服务器版怎么交付

原则是:不含产品代码的可以公开,含代码的按客户受控交付。每个版本都附带 SHA256 校验和,拿到文件后可以自行核对。

公开

部署套件

docker-compose 编排文件、安装脚本、.env 示例和部署文档。先看清部署方式和硬件要求,再做决定。

按客户交付

镜像包

中枢服务、Web 工作台和数据库镜像。包含产品代码,通过离线介质或按客户签发的限时链接交付,附校验和。

不分发

模型

模型权重体积大且受第三方许可约束,不随产品分发;提供导入说明,无外网工厂可离线拷入。

先装一个试用版,看看它在你的场景里能做什么

试用版在本机运行,自带演示数据,也可以导入你自己的文档。需要接入真实系统时,再谈私有部署。