‹ 返回事件历史

H100的GPU容量达到极限,导致某些型号的排队时间过长

原文Hitting GPU Capacity for H100s creating large queue times for some models
已恢复轻微故障Replicate
2026年7月22日星期三 19:51 ~ 2026年7月23日星期四 11:05(15 小时 14 分钟)
受影响组件
Official Models
Inference and Training / H100 Hardware
更新记录
已恢复2026年7月23日星期四 22:19

此问题已解决。

原文This issue is resolved

监控中2026年7月23日星期四 11:05

此问题现已解决。

原文This issue is now resolved

监控中2026年7月23日星期四 01:11

GPU使用率已回落至容量以下。我们正在持续监控。

原文GPU usage is back below capacity. We're continuing to monitor.

已定位2026年7月22日星期三 19:51

我们目前H100的供应过剩,导致部分在H100上运行的模型排队时间较长。

原文We are over provisioned on H100s currently which is causing long queue times for some models running on H100s

事件内容来自 Replicate 官方状态页:查看官方原文。中文由 AI 翻译,仅供快速理解,以官方英文原文为准。

关于这些数据

事件从哪来?

全部来自各厂商官方状态页的公开接口,由本站每 5 分钟同步一次,保留最近 90 天。事件标题、时间、影响级别与更新记录均为官方原文,本站不做改写;点详情页底部的链接可回到厂商原始记录核对。

为什么有的服务查不到历史?

本页只收录对外提供官方状态页的服务。没有公开状态页的厂商(多数国产大模型属于此类)无法取得可信数据,本站不做自建拨测去猜,因此也不会出现在状态总览里。

持续时长怎么算?

按官方标注的开始时间到恢复时间计算;尚未恢复的事件按「至今」计算并标为进行中。跨天的事件在状态条上会覆盖它经过的每一天。