本地输入成本
官方 API ¥1.00/百万 · 人民币同口径
以副本拓扑与 SLA Goodput 推导可持续输出产能,无需先拍月度 token 或并发; 支持 V1 完整经济成本与 V2 边际能耗成本两套独立口径。
官方 API ¥1.00/百万 · 人民币同口径
官方 API ¥2.00/百万 · 人民币同口径
官方 API ¥0.02/百万 · 缓存命中输入
同业务量官方 API 月费 ¥8,791
数据来源:通用经验估算,置信度 低。经验估算含负载修正但仍不能替代相同模型、硬件和SLA下的实测。
1 台 · 8 × B200 180GB SXM
1 台 · 8 × B200 180GB SXM
1 台 · 8 × H200 141GB SXM
V1 与 V2 共用 Goodput 和副本拓扑,只改变成本分子。V2 只计耗电量乘综合电价,不计硬件和其他运营费用。证据优先级:公司实测数据 > 厂商/模型官方基准 > 可信第三方基准 > 公式估算。
权重显存 ≈ 总参数量 × 精度字节数 × 1.15每副本服务器数 = max(显存最低台数,厂商最低加速卡建议)副本数 = ⌊业务服务器数 ÷ 每副本服务器数⌋跨机效率只作用于一个模型副本;多个副本按调度效率扩展。剩余不足一个完整副本的服务器不计正常产能。权重显存校验仍不替代 KV Cache 容量规划。
集群 Goodput(request/s) = 单副本 Goodput × 副本数 × 调度效率月有效输出 = Goodput × 年秒数 ÷ 12 × 可用率 × 利用率 × OSL实测SLA Goodput直接使用,不重复乘0.68。原始实测只乘一次SLA折算;经验估算同时绑定ISL、OSL并标为低置信度。
平均IT功率 = 生产待机功率 + 备用待机功率 + 满载增量功率 × 可用率 × 利用率年度边际能耗 = 平均IT功率 × PUE × 8,760h × 综合电价每百万输出边际能耗 = 年度边际能耗 ÷(年度输出Token ÷ 1,000,000)不计硬件、EAC、基本/需量费、维护、场地、网络和人工。备用服务器仍按待机功率计入能耗。
EAC资产 =(初始投入 − 残值现值)× 资本回收系数年度TCO = EAC + 固定OPEX + 完整电费 + 变量OPEX每百万有效输出成本 = 年度TCO ÷(年度有效输出 ÷ 1,000,000)GPU服务器、网络和冷却设施按不同寿命年化;经济TCO不再重复加入会计折旧和全额资金成本。核心输出自动展示液冷与风冷中较低的完整单位成本。
本地输出单价 = 所选年度成本 ÷ 加权年度 Token本地输入单价 = 本地输出单价 × 输入成本权重本地缓存单价 = 本地输入单价 × 缓存成本系数默认输入权重为输出的 25%,缓存命中为普通输入的 10%。这是把本地总成本拆到推理阶段的可调归因,不会虚构独立计费账单,也不会改变 Goodput。
阶梯价 = 按单次请求平均输入长度匹配官网价格区间月API费 = 未缓存输入量 × 输入价 + 缓存输入量 × 缓存价 + 输出量 × 输出价美元官网价 × USD/CNY = 人民币官网价输入、输出、缓存价格分开显示,不生成合并 Token 单价。缓存命中率按输入 Token 计;官网未单列缓存价时,月费按普通输入价计算。
默认负载为2048输入/512输出;改变长度会改变经验估算,实测模式必须重新录入对应负载的Benchmark。
严格比较优先使用厂商同模型官方价格;没有官方价格时明确缺失,不用其他闭源模型顶替。
1.05 与 1.0273 是公司提供的产品测算假设,当前不标记为全年实测值;客户可覆盖。
只进入 V1;V2 完全忽略硬件价格。整机价格仍是市场/渠道含税参考,不是厂商正式报价。
按公开代理购电价与输配电信息派生 24×7 综合参考。V2 只使用元/kWh综合电价,不另计基本/需量费。
仅收录可商业部署的开放权重模型,但部分社区许可证有使用条件;本页不是法律意见。