Together AI · 官方

开放、便捷、可预测:Provisioned Throughput 介绍

Open, convenient and predictable: Introducing Provisioned Throughput

二〇二六年七月八日 · 英文原文

Provisioned Throughput 为 MiniMax M3 和 GLM-5.2 等开放模型提供预留推理容量,采用基于 token 的定价,提供 99% 正常运行时间 SLA,成本比专有 API 降低高达 90%,无需管理 GPU 基础设施。

Provisioned Throughput 为您提供前沿开放模型(如 MiniMax M3 和 GLM-5.2)的预留推理容量。采用基于 token 的定价,提供 99% 正常运行时间 SLA,成本比专有 API 降低高达 90%。无需计算 GPU 小时,也无需管理基础设施。

译自 Together AI · 官方 · 录于 二〇二六年七月八日