1. 定义
这些定义是本文档的核心。将「停机时间」和「网关错误率」结合阅读——它们决定是否应给予抵扣。
对于预付费账户,指当月从您的可用余额中实际扣除的 API 用量费用,不包括未使用的充值余额、税费、退款和先前的抵扣。对于后付费企业账户,指根据适用协议计算的当月费用,在应用抵扣之前。
根据第 2 节计算的网关未处于停机状态的日历月百分比。总分钟数是指该日历月的每一分钟。
至少连续 5 分钟网关错误率超过 10%。以整分钟计量。不包括第 4 节下的任何情况。
一分钟间隔内失败的符合条件请求 / 符合条件请求总数,在整个网关范围内计算。不按模型单独计算。
(a) 携带 HTTP 状态码 500、502、503 或 504 且源自 RouteAPI 基础设施的响应,或 (b) 在 30 秒内无响应——连接被拒绝或重置、TLS 握手失败、DNS 失败,或任何产生无 HTTP 状态码的传输层级故障。不属于网关错误:由请求或授权引起的响应(400、401、403、422)、速率限制(429),或源自上游的错误(即使 RouteAPI 以相同状态码返回给您)。
格式正确的生产端点请求,具有有效的 API 密钥,未因客户原因被拒绝。
通过您使用的相同公共入口发出的 RouteAPI 合成探测,间隔不超过 1 分钟,每个请求受 30 秒响应超时限制。在 routeapi.ai/status 发布。
2. 服务承诺
RouteAPI 将尽商业上的合理努力,确保服务在每个日历月内的月度正常运行时间百分比至少达到 99.9%。
(Total Minutes − Downtime Minutes) / Total Minutes × 100此承诺适用于整个网关,而不是任何单个模型。如果网关支持的至少一个模型能够接受并成功处理请求,则认为服务在任何给定时间都是可用的。
理由。 AI 网关的价值主张是冗余和灵活性:当一个模型由于上游速率限制、区域性中断或提供商维护而不可用时,您可以无中断地路由到替代方案。RouteAPI 为大多数模型提供多个上游渠道,这大大降低了所有模型的所有路径同时失败的可能性。在网关级别进行测量反映了这一设计,并与您的实际体验相匹配——获得响应的能力。
透明度。 我们在公共状态页面上发布每个单独模型的实时可用性,包括正常运行时间、错误率和事件历史。使用它来监控您所依赖的内容。但服务抵扣仅根据网关级别的可用性计算,而不是根据任何单个模型的可用性计算。
作为参考,99.9% 对应于 30 天/月最多约 43.2 分钟的停机时间,31 天/月最多约 44.6 分钟。
3. 服务抵扣
如果在某个日历月内未达到服务承诺,您有资格获得服务抵扣,该抵扣按您当月符合条件用量费用的百分比计算。
| 月度正常运行时间百分比 | 服务抵扣 |
|---|---|
| 低于 99.9% 但 ≥ 99.0% | 10% |
| 低于 99.0% 但 ≥ 95.0% | 25% |
| 低于 95.0% | 50% |
- < 99.9% · ≥ 99.0%10%
- < 99.0% · ≥ 95.0%25%
- < 95.0%50%
在批准后 [30] 天内作为抵扣应用于您的账户余额,可用于未来使用服务。我们不会将其抵消未来的发票——预付费账户没有发票可抵消。
服务抵扣是您因未达到服务承诺而获得的唯一和排他性补救措施。
不得超过受影响月份符合条件用量费用的 50%。
不与同一时期的任何其他抵扣累积。
4. 例外
服务承诺不适用于以下原因导致的不可用性,停机时间也不包括以下情况。第 4.2 项值得仔细阅读——这是唯一由我们承担举证责任的例外情况。
计划维护
至少提前 [48 小时] 通过状态页面和电子邮件向您指定的联系人宣布,且每个日历月累计不超过 [4 小时]。生产节点每次维护一个,因此常规维护不会中断流量。
上游模型提供商故障
举证责任:RouteAPI您选择的第三方模型提供商的不可用性、速率限制、错误或输出降级——但仅限于该提供商的公开可用状态页面或事件报告确认的范围内。RouteAPI 承担证明此类确认的责任。
客户归因原因
无效请求(4xx)、超出配额或速率限制、账户被暂停或未充值、滥用或违反服务条款的使用。
不可抗力
超出 RouteAPI 合理控制范围的事件:自然灾害、战争、恐怖主义、劳资纠纷、政府行为、我们网络之外的互联网骨干网或 DNS 故障,以及无法合理缓解的拒绝服务攻击。
测试版、预览版或已弃用功能
模型列表中标记为「预览」、「实验性」或「已弃用」的任何模型。
您的网络、软件或设备
不受 RouteAPI 控制的第三方服务。
5. 抵扣申请程序
抵扣不会自动应用。请在发生停机的日历月结束后三十 (30) 天内提交申请。
在 30 天内向我们发送电子邮件
在发生停机的日历月结束后三十 (30) 天内发送至 support@routeapi.ai。
包括证据
您的账户标识符;每次声称的停机事件的日期和时间;以及带时间戳的请求 ID,或记录错误的服务器日志。
我们审查并回复
我们根据我们的测量源和我们自己的请求日志检查您的请求,并在 [15] 个工作日内回复。如果我们确认未达到服务承诺,抵扣将按第 3(a) 节应用到您的账户余额。
6. 状态页面和测量
本 SLA 中的每个数字都来自同一来源:RouteAPI 的合成探测,公开发布。如果我们的测量与您的不一致,我们会说明并展示我们的数据。
提供状态页面是为了透明度。如果存在差异,RouteAPI 的内部测量记录为准。
7. 本 SLA 的变更
RouteAPI 可能会提前至少 [30] 天通知修改本 SLA。修改不会在任何企业客户的企业协议当前期限内降低服务承诺。
常见问题
企业审核者最常问的问题,给出清晰直接的回答。
网关的意义在于您不依赖单个模型。我们的承诺是您始终可以获得响应——如果您请求的模型不可用,您可以路由到另一个模型。状态页面上发布了每个模型的可用性,以便您可以监控您所依赖的内容,但抵扣计算遵循第 2 节中的网关级别定义。这也是 AWS 测量 API Gateway 可用性的方式:按区域而非单个后端。
我们是聚合层,而不是底层计算的所有者:您支付的费用中很大一部分流向上游提供商。10% / 25% / 50% 的抵扣已经达到了业务在继续运营的同时所能承受的极限。我们宁愿承诺一个我们能支付的数字,也不愿发布一个我们必须争论的数字。抵扣也是应用于您的余额而非退款,因此它们仍然可用于您未来的使用。
不适用。此 SLA 适用于具有已签署的企业协议或引用它的订单表的客户。自助服务和预付费账户、免费层、试用和测试功能不包括在内。所有账户的可用性都在状态页面上以相同的测量方法发布——区别在于合同补救措施,而不是测量方法。
您不必证明——我们来证明。第 4.2 节仅在该提供商自己的公共状态页面或事件报告确认时才排除上游提供商故障,并且 RouteAPI 承担证明该确认的责任。我们自己的聚合、路由或供应层内的任何故障都算作停机时间,句号。
就其本身而言,不算。停机时间要求整个网关的网关错误率至少连续五分钟超过 10%——这意味着网关整体无法返回响应。单个模型不可用在状态页面上可见,您可以绕过它,但根据本 SLA,它不是停机时间。
