托管 SaaS
平台托管应用层,使用云端模型
适合希望快速上线、采用托管数据库与缓存、并接受云模型 API 的团队。应用服务无须 GPU。
Cloud
- HTTPS 统一入口
- 托管 RDS / Redis / OSS
- 本地模型明确关闭
Deployment / Data & Model Boundary
NexusClaw 支持托管 SaaS、混合部署和私有化形态。三者运行同一套治理链,但业务数据放在哪里、模型在哪里推理、谁负责基础设施并不相同。
先确定边界,再讨论规格。页面中的资源口径只属于标明的拓扑,不把构建内存、模型显存或另一种部署形态的数字混在一起。

01 / Topology Choice
治理、审计和 Agent 运行逻辑保持一致;变化的是基础设施归属、数据驻留位置和模型推理位置。
平台托管应用层,使用云端模型
适合希望快速上线、采用托管数据库与缓存、并接受云模型 API 的团队。应用服务无须 GPU。
云端业务系统 + 客户 AI PC
云端保留企业应用与治理控制面,本地模型推理放在客户 AI PC;通过客户侧主动建立的隧道连接。
应用、数据与可选本地模型进入客户环境
适合要求自有网络与基础设施边界的场景。实际规格随数据规模、并发和所选本地模型计算。
Customer environment
02 / Data & Model Boundary
云端节点运行 Web、API、移动端、数据服务与隧道服务;AI PC 承担本地模型和 GPU。隧道由客户侧主动发起,不要求把 AI PC 直接暴露到公网。
云端业务与治理控制面
LOCAL_MOE_ENABLED = false
客户 AI PC 模型平面
客户侧主动连接 · 无需公网暴露 AI PC
按项目约定驻留在云端数据库或客户环境;模型上下文继续受权限与审计控制。
本地模型文件与 GPU 留在客户 AI PC,不复制到云端应用节点。
健康检查与超时必须被监控;是否允许切换其他 Provider 由明确路由策略决定,不静默承诺。
03 / Release & Operations
生产发布从精确提交与不可变镜像开始,依次执行数据库迁移、同版本服务切换、严格健康检查与权限烟测。失败时按行为、代码和数据三层选择回滚方式。
记录提交 SHA、镜像摘要与配置版本。
迁移与应用版本绑定,并保留执行结果。
Backend、Web 与 Mobile 使用同一版本。
严格健康、权限烟测和关键记录烟测全部通过。
功能开关、旧镜像与数据库恢复路径各自明确。

04 / Sizing & Responsibility
以下是受控试用与已验证形态的起点,不是脱离并发、数据量与模型的统一承诺。正式项目会在选定拓扑后做容量验证。
4 vCPU / 8 GiB 应用 ECS
数据库、缓存、对象存储托管;云端推理;≤20 名受邀用户、3–5 个并发 AI 任务的起点。
8 vCPU / 16 GiB 应用 ECS
为生产前试运行提供更充足余量,仍采用托管数据服务和云模型。
总计约 3–4 GiB
其中 Backend 约 1.5–2 GiB;云端不加载本地模型,AI PC 承担模型内存与 GPU。
按模型与并发测算
应用、数据库与本地模型可能同机,不能复用混合云端节点的资源数字。
逐项确认业务数据、日志、模型权重与密钥的实际位置。
断开模型端点或缓存,确认健康状态、告警和恢复路径。
用指定版本完成迁移、切换、烟测与旧版本回退。
从一次 Agent 结果返回执行、工具、审批与责任人证据。
部署形态不等于合规认证,也不会替客户自动制定数据驻留制度。硬件、云资源、模型许可证、网络条件与备份责任需在项目范围中明确;私有化资源以所选模型、数据量和并发验收为准。