
配额跟着席位走;一名员工用不完的,同事可以接着用——全公司是一个池。
| 席位 | 订阅 | 计算秒 / 月 | 存储 | 标准模型任务 / 月 | 高级模型任务 / 月 |
|---|---|---|---|---|---|
| 完整席位 · 智能体系统 | ¥200 / 人 / 月 | 2万 | 10 GB | 1,112 | 84 |
| 完整席位 · 价值链系统 | ¥300 / 人 / 月 | 3万 | 20 GB | 1,668 | 126 |
| 完整席位 · 组织决策系统 | ¥400 / 人 / 月 | 4万 | 30 GB | 2,224 | 168 |
| 轻量席位 · 一线员工 | ¥50 / 人 / 月 | 5,000 | 2 GB | 278 | 21 |
「任务」指一次典型的智能体任务:读 10 万 token 的上下文(97% 命中缓存),写 1,000 token。标准模型按 DeepSeek V4.1 Flash 计,高级模型按 Claude Sonnet 5.5 计。
每个席位的配额相加,就是全公司每月可用的量。谁用、用在哪个部门、哪个应用,控制台里分开看。
300 个完整席位 + 700 个轻量席位:每月 1,250万 计算秒、7.4 TB 存储。
忙月多用、闲月少用都算在全年里;全年没超,就没有超额费用。
用到 80% 和 100% 各提醒一次管理员,不会突然停。
可以给部门或应用设预算;设了硬上限,到顶即停。
每一次调用都记到发起它的部门、岗位或应用上;归不到单个应用的,记到发起人。
用量记在 UTC 日期上;跨天的作业记在结束那天。
超出全年配额的部分,按下方单价逐月结算。
单位的定义照抄 Palantir:计算秒不是时间,是平台完成的一份工作量;按分配的资源计,不按利用率。
应用、工作流、语义层的同步与查询,都按计算秒计。一个 vCPU 配 7.5 GiB 内存跑 1 秒,是 1 计算秒;内存要得多,按内存折算。
compute_seconds = max(vCPU, GiB ÷ 7.5) × seconds每个模型按厂商公开价折算成计算秒:每 1 万 token 折合多少计算秒,下表逐一列出。命中缓存的输入按厂商的缓存价折算。
compute_seconds = tokens ÷ 10,000 × rate(model)文件库、语义层对象与应用数据,每小时采样一次、按月平均:1 GB 放一整个月是 1 GB·月。
GB·month = Σ hourly GB ÷ hours in month数字员工对话与执行任务的运行环境含在席位里,不单独计量;你只为模型、应用计算与存储计量。
厂商价取自各家官方价目页;折算率 = 厂商价 ÷ 1 计算秒的价格(¥0.001)。选模型按岗位来:大多数岗位用标准模型,少数岗位用高级模型。
| 模型 | 厂商价 · 美元 / 百万 token | 折合计算秒 · 每 1 万 token | 一次任务 | 2万 计算秒可做 | ||||
|---|---|---|---|---|---|---|---|---|
| 输入 | 缓存命中 | 输出 | 输入 | 缓存命中 | 输出 | |||
| GPT-6 Astra旗舰 | $10 | $1 | $50 | 670.5 | 67.05 | 3,352.3 | 1,187 | 16 次 |
| GPT-6.1 Sol均衡 | $2 | $0.10 | $10 | 134.1 | 6.7 | 670.5 | 172 | 116 次 |
| GPT-6 Luna轻快 | $0.10 | $0.01 | $0.50 | 6.7 | 0.67 | 33.5 | 12 | 1,685 次 |
| Claude Fable 5.1旗舰 | $10 | $0.25 | $50 | 670.5 | 16.76 | 3,352.3 | 699 | 28 次 |
| Claude Opus 5.5旗舰 | $4 | $0.20 | $20 | 268.2 | 13.41 | 1,340.9 | 345 | 58 次 |
| Claude Sonnet 5.5均衡 | $2 | $0.20 | $10 | 134.1 | 13.41 | 670.5 | 237 | 84 次 |
| Claude Haiku 4.5轻快 | $1 | $0.10 | $5 | 67 | 6.7 | 335.2 | 119 | 168 次 |
| DeepSeek V4 Pro均衡 | $1.32 | $0.044 | $3.96 | 88.5 | 2.95 | 265.5 | 82 | 244 次 |
| DeepSeek V4.1 Flash标准 | $0.30 | $0.006 | $1.20 | 20.1 | 0.4 | 80.5 | 18 | 1,112 次 |
| GLM-5.3均衡 | $1.40 | $0.26 | $4.40 | 93.9 | 17.43 | 295 | 227 | 88 次 |
| GLM-5.3 Flash轻快 | $0.15 | $0.03 | $0.50 | 10.1 | 2.01 | 33.5 | 26 | 772 次 |
| Kimi K3旗舰 | $3 | $0.30 | $15 | 201.1 | 20.11 | 1,005.7 | 356 | 56 次 |
| Kimi K2.6均衡 | $0.95 | $0.16 | $4 | 63.7 | 10.73 | 268.2 | 150 | 133 次 |
DeepSeek 按北京时间工作时段的峰时价计,其余时段半价、按调用时刻计。每行价格读自厂商官方价目页,读取日期见表尾;厂商调价后,折算率随下一次更新同步。
价格来源
只有全年用量超过全年配额,才按这里结算。
模型 token 按上表折算后同样按这个价结算——所以 token 等于按厂商价付。
按小时采样、按月平均;删掉的数据当月起不再计。
在一年里滚动使用:配额按月发放、按年结算,年底清零,不跨年。
不同模型的一个 token 价格能差上百倍,直接按 token 收,配额就没法比较。折成计算秒之后,模型、应用计算用的是同一个池子,一张账单看完。
在控制台里按部门、岗位、应用与模型查看用量与成本;月度账单按同样的口径列出。