
数字员工的云端运行环境部署在 AWS 上,按区域选择离你最近的机房。
模型跑在你账号里的 Amazon EC2 GPU 机器或 Amazon SageMaker 上;账单由 AWS 直接开给你,我们负责部署与运维。
Kimi、GLM、DeepSeek、Qwen 等开放模型可以直接在 Amazon Bedrock 上调用:按 token 计费,数据不出 AWS。
机器放哪里、账单开给谁,是三种方式的唯一区别;模型怎么派给岗位、上面的流程,完全一样。
机器在你的账号里,账单直接开给你;我们负责部署与运维。
机器费:按 AWS 公开价,你直接付给 AWS我们在 AWS 上为你单独开一台机器,不与任何客户共用。
机器费:AWS 公开价 × 1.25(含备份与监控)硬件你自购,放在你的机房;网络可以完全断开对外。
机器费:硬件自购三种方式都一样:部署费 ¥30万(一次性,组织决策系统的建设费已含第一次)+ 托管运维 ¥1万 / 台 / 月。
价格是 AWS 公开的按需价(Linux)。新加坡区没有这几种 GPU 机型,参考东京与美国东部;签一年或三年节省计划还能再省约 37% 或 57%。
| 机型 | GPU · 显存 | 可承载的模型 | 东京 · 美元 / 小时 | 东京 · 每月约 | 美国东部 · 美元 / 小时 |
|---|---|---|---|---|---|
| 入门 | 1 × NVIDIA L40S · 48 GB g6e.xlarge | 约 30B 参数以内 | $2.699 | ¥1.32万 | $1.861 |
| 标准 | 4 × NVIDIA L40S · 192 GB g6e.12xlarge | 约 150B 参数以内 | $15.217 | ¥7.45万 | $10.493 |
| 大型 | 8 × NVIDIA H200 · 1,128 GB p5en.48xlarge | 约 900B 参数以内 | $79.12 | ¥38.72万 | $63.296 |
| 旗舰 | 8 × NVIDIA B300 · 2,100 GB p6-b300.48xlarge | 约 1.7T 参数以内 | 东京暂无 | — | $142.416 |
可承载的规模按 FP8 权重、留出约两成显存给上下文缓存估算;TB 级旗舰模型用量化或多台机器承载。月费按 730 小时计。
哪些岗位的模型要留在自己家里,由合规和客户合同决定;算账只回答「值不值」。
何时更划算:一类岗位每月的模型账单,超过一台专属机器的月费加托管费。以东京标准机型为例,约 ¥8.4万 / 月,相当于 Claude Sonnet 5.5 按厂商价约 35.6万 次典型任务。
下面是各家当前的开放权重旗舰与许可。自定许可对大规模对外服务有额外条件,部署前请法务读一遍原文。