NexusClaw
NexusClaw企业应用与数字员工平台
← 能力总览

Deployment / Data & Model Boundary

部署形态不是配置清单,是数据、模型与责任边界的选择

NexusClaw 支持托管 SaaS、混合部署和私有化形态。三者运行同一套治理链,但业务数据放在哪里、模型在哪里推理、谁负责基础设施并不相同。

先确定边界,再讨论规格。页面中的资源口径只属于标明的拓扑,不把构建内存、模型显存或另一种部署形态的数字混在一起。

真实架构 · NexusClaw 系统蓝图NexusClaw System Evidence
NexusClaw 系统架构与三种部署形态蓝图
同一核心运行链支持托管 SaaS、混合部署与单机全栈;拓扑选择改变数据、模型和运维责任边界。

01 / Topology Choice

三种形态解决的是不同边界,不是三个价格档位

治理、审计和 Agent 运行逻辑保持一致;变化的是基础设施归属、数据驻留位置和模型推理位置。

01

托管 SaaS

平台托管应用层,使用云端模型

可交付

适合希望快速上线、采用托管数据库与缓存、并接受云模型 API 的团队。应用服务无须 GPU。

企业用户
NexusClaw
Cloud
RDS · Redis · OSS
Cloud Model API
  • HTTPS 统一入口
  • 托管 RDS / Redis / OSS
  • 本地模型明确关闭
02

混合部署

云端业务系统 + 客户 AI PC

可交付

云端保留企业应用与治理控制面,本地模型推理放在客户 AI PC;通过客户侧主动建立的隧道连接。

Cloud
Control Plane
主动隧道
Customer AI PC
Local Model · GPU
  • 模型权重留在 AI PC
  • 云端不加载本地模型
  • 推理链路独立验收
03

私有化 / 单机全栈

应用、数据与可选本地模型进入客户环境

可交付

适合要求自有网络与基础设施边界的场景。实际规格随数据规模、并发和所选本地模型计算。

Customer environment

Web · API
Postgres · Redis
Object Storage
Optional Local Model
  • 客户环境内运行
  • 可接自有数据库与存储
  • 模型规格决定额外资源

02 / Data & Model Boundary

混合部署把业务控制面留在云端,把模型重量留在客户侧

云端节点运行 Web、API、移动端、数据服务与隧道服务;AI PC 承担本地模型和 GPU。隧道由客户侧主动发起,不要求把 AI PC 直接暴露到公网。

云端业务与治理控制面

Web · Mobile
Backend API
PostgreSQL
Redis · Files
Audit · Trace
FRP Server

LOCAL_MOE_ENABLED = false

⇄受控隧道

客户 AI PC 模型平面

Local Model Endpoint
Model Weights · GPU
Health · Timeout · Logs

客户侧主动连接 · 无需公网暴露 AI PC

业务数据

按项目约定驻留在云端数据库或客户环境;模型上下文继续受权限与审计控制。

模型权重

本地模型文件与 GPU 留在客户 AI PC,不复制到云端应用节点。

推理故障

健康检查与超时必须被监控;是否允许切换其他 Provider 由明确路由策略决定,不静默承诺。

03 / Release & Operations

“容器已启动”不是上线完成,切换需要一条可回放的证据链

生产发布从精确提交与不可变镜像开始,依次执行数据库迁移、同版本服务切换、严格健康检查与权限烟测。失败时按行为、代码和数据三层选择回滚方式。

01

锁定版本

记录提交 SHA、镜像摘要与配置版本。

02

执行迁移

迁移与应用版本绑定,并保留执行结果。

03

同版切换

Backend、Web 与 Mobile 使用同一版本。

04

验证健康

严格健康、权限烟测和关键记录烟测全部通过。

05

保留回滚

功能开关、旧镜像与数据库恢复路径各自明确。

真实界面 · Deployment ManagementNexusClaw System Evidence
NexusClaw Deployment Management 部署管理产品界面
产品内的部署管理入口用于在环境间提升元数据与配置;基础设施发布仍需遵循版本、迁移、健康与回滚流程。
release-evidence.log
commita1b2c3d · exact source
imagesbackend · web · mobile / same version
migrationcompleted · evidence retained
healthstrict / passed
permissionssmoke / passed
rollbackflag · image · PITR / ready

04 / Sizing & Responsibility

容量数字必须先写清楚它属于哪一种拓扑

以下是受控试用与已验证形态的起点,不是脱离并发、数据量与模型的统一承诺。正式项目会在选定拓扑后做容量验证。

托管 SaaS · 受控试用

4 vCPU / 8 GiB 应用 ECS

数据库、缓存、对象存储托管;云端推理;≤20 名受邀用户、3–5 个并发 AI 任务的起点。

托管 SaaS · 建议配置

8 vCPU / 16 GiB 应用 ECS

为生产前试运行提供更充足余量,仍采用托管数据服务和云模型。

混合 · 云端节点

总计约 3–4 GiB

其中 Backend 约 1.5–2 GiB;云端不加载本地模型,AI PC 承担模型内存与 GPU。

私有化 / 单机全栈

按模型与并发测算

应用、数据库与本地模型可能同机,不能复用混合云端节点的资源数字。

项目启动时必须写进边界表

01域名、证书与入口
02数据库、缓存与备份
03对象存储与密钥
04模型 Provider 与费用
05隧道与网络连通
06监控、升级与回滚责任

客户验收不只看页面能打开

边界验证

逐项确认业务数据、日志、模型权重与密钥的实际位置。

故障验证

断开模型端点或缓存,确认健康状态、告警和恢复路径。

升级验证

用指定版本完成迁移、切换、烟测与旧版本回退。

审计验证

从一次 Agent 结果返回执行、工具、审批与责任人证据。

当前能力边界

部署形态不等于合规认证,也不会替客户自动制定数据驻留制度。硬件、云资源、模型许可证、网络条件与备份责任需在项目范围中明确;私有化资源以所选模型、数据量和并发验收为准。

把你的数据边界、模型选择和目标并发带进部署评估

我们会先锁定拓扑,再共同画出数据与模型边界,给出对应容量口径、上线证据和回滚验收清单。