[fr-par-1] - 无法在实例上执行操作
某些操作无法应用于 fr-par-1 上的实例,导致资源卡在临时状态。
- 处理进展
- 2 条公开更新
修复:此事件已解决。
Scaleway
某些操作无法应用于 fr-par-1 上的实例,导致资源卡在临时状态。
修复:此事件已解决。
在15h55,公共交换机s45-d14.dc3已重启;所有连接至该交换机的服务器的公共网络连接受到影响,持续10分钟。
服务出现一些不稳定和宕机情况,我们的团队正在调查以解决该问题
安装可能会导致错误,并且切换到救援模式可能在NL-AMS-2区域中特别失败。 我们目前正在调查此问题。
修复:此事件已解决。
我们的服务 TEM 自 10:20 CEST 起中断 已于 10:52 CEST 恢复
修复:此事件已解决。
11:45 UTC 至 12:00 UTC 期间多个产品不可用 annotation audit trail cockpit containers datalab datawarehouse instance v1 k8s kafka kms mongo registry secrets
修复:此事件已解决。
在使用模型 gemma-4-26b-a4b-it 进行多轮 tool_call 请求的情况下,用户可能会在响应中遇到无限循环。
修复:此事件已解决。
由于未知原因,103 房间 E6 机架的一半已宕机(PAR1- DC2)
修复:此事件已解决。
2026年7月28日 - 09:02 CEST:我们的监控系统检测到影响FR-PAR-1中多个PRO2 hypervisor的连接问题。多个服务器似乎不可达。
原因:2026年7月28日 — 09:02 CEST: 我们的监控系统检测到影响 FR-PAR-1 中多个 PRO2 虚拟机管理程序的连接问题。多台服务器似乎无法访问。 2026年7月28日 — 09:14 CEST: Scaleway Instances 团队开始调查该问题。 2026年7月28日 — 09:14 CEST: 初步调查结果显示,受影响的服务器仍可正常运行,但网络流量受到中断。 July 28, 2026 — 09:16 CEST:内部事件已开启,网络团队加入调查。 July 28, 2026 — 09:32 CEST:两台叶交换机中的一台出现上行链路问题。不过,仍有部分流量通过受影响的交换机转发。 July 2…
修复:2026年7月28日 — 09:02 CEST: 我们的监控系统检测到影响 FR-PAR-1 中多个 PRO2 虚拟机管理程序的连接问题。多台服务器似乎无法访问。 2026年7月28日 — 09:14 CEST: Scaleway Instances 团队开始调查该问题。 2026年7月28日 — 09:14 CEST: 初步调查结果显示,受影响的服务器仍可正常运行,但网络流量受到中断。 July 28, 2026 — 09:16 CEST:内部事件已开启,网络团队加入调查。 July 28, 2026 — 09:32 CEST:两台叶交换机中的一台出现上行链路问题。不过,仍有部分流量通过受影响的交换机转发。 July 2…
由于网络设备故障,OPCORE 数据中心以下机架中的 Dedibox 服务器受到影响: - s202A-B7
原因:由于网络设备故障,OPCORE 数据中心以下机架中的 Dedibox 服务器受到影响: - s202A-B7
修复:故障交换机已被更换。现在所有服务器应该都能访问了。
我们目前正在调查 imap.bookmyname.com 和 smtp.bookmyname.com 上的 SSL 证书问题。 此问题可能会导致部分用户无法通过这些端点发送或接收电子邮件。
修复:此事件已解决。
大约从 UTC 时间下午 1 点开始,it-mil 区域到 Scaleway API 的一些内部连接开始失败。结果: - 推送到 rg.it-mil.scw.eu 失败,错误码为 HTTP 500 - Serverless Containers 部署失败(资源卡在创建中) - 等等(列表并非详尽无遗)
[14:45] 在升级基础设施期间,部分集群无法访问
在 fr-par 的计算实例事件期间(参见此状态:https://status.scaleway.com/incidents/bsp2y5fysy9w),一些作业在执行过程中被中断或完全未被执行。它们最终处于 Interrupted 状态,原因代码为 technical_error。 此现象间歇性发生,且仅发生在部分作业运行中,时间仅介于 21/07/2026 22:00:00 CEST 至 22/07/2026 01:49:00 CEST 以及 22/07/2026 03:44:00 CEST 至 22/07/2026 05:30:00 之间。 受影响的作业运行数量约占我们每日平均作业运行的十分之一。此为信息性状态,我方无需采取纠正措施。 请检查您是否需要重新运行作业。对于给您带来的不便,我们深表歉意。
在 Compute 实例故障(https://status.scaleway.com/incidents/bsp2y5fysy9w)之后,fr-par 区域的部分 Serverless Containers 和命名空间在夜间一直卡在临时状态(更新中/删除中)。 并非所有资源都受到影响,仅我们基础架构某个部分的一小部分资源受影响(约 1/10)。 在这部分,受影响的资源要么: - 在 2026-07-21 21:07 UTC 至 2026-07-21 22:05 UTC 之间更新 - 或者在 2026-07-21 21:33 UTC 至 2026-07-22 03:18 UTC 之间删除 我们已经修复了状态,资源不再卡住了。 但是,如果状态处于错误状态并出现以下错误消息之一,受影响用户将需要再次更新或删除其…
修复:事件现已解决。如果您的容器或命名空间出现以下任一错误消息,请阅读上一条消息中的说明。 再次为给您带来的不便深表歉意。
Kubernetes 集群的产品 API 已宕机
修复:此事件已解决。
在 UTC 时间 20h15 块存储集群上的一个节点崩溃后,一些虚拟机卡住。 值班团队正在调查。
原因:**事件概述** 7月21日,一次块存储集群事件在 20:14 至 03:45 UTC 之间影响了 FR-PAR-1 上的 Instance 产品。该事件导致区域性服务降级 \(FR-PAR\),造成以下影响: * 在 21:30 至 01:30 UTC 之间,Kapsule 操作在区域层面不可用。 * FR-PAR-1 上的 Instances 无法运行。 * 所有依赖 Instance 和 Kapsule 的托管产品均遭遇中断。 #### **根本原因分析** **5 个为什么** * **为什么 Instance 及其依赖产品不可用?** 因为磁盘 I/O 无法进行。 * **为什么磁盘 I/O 无法进行?…
修复:**事件概述** 7月21日,一次块存储集群事件在 20:14 至 03:45 UTC 之间影响了 FR-PAR-1 上的 Instance 产品。该事件导致区域性服务降级 \(FR-PAR\),造成以下影响: * 在 21:30 至 01:30 UTC 之间,Kapsule 操作在区域层面不可用。 * FR-PAR-1 上的 Instances 无法运行。 * 所有依赖 Instance 和 Kapsule 的托管产品均遭遇中断。 #### **根本原因分析** **5 个为什么** * **为什么 Instance 及其依赖产品不可用?** 因为磁盘 I/O 无法进行。 * **为什么磁盘 I/O 无法进行?…
由于域名映射不一致,部分免费域名当前可能显示默认托管页面或解析异常。 我们的团队正在调查并努力恢复正常配置。
原因:由于域名映射不一致,部分免费域名当前可能显示默认托管页面或解析异常。 我们的团队正在调查并努力恢复正常配置。
修复:该事件自19:15 UTC起已解决。
自 UTC 时间约 12:30 起,it-mil 区域内到 Scaleway API 的几条内部连接出现故障。因此: - 推送到 rg.it-mil.scw.eu 失败,并返回 "HTTP 500" 错误。 - Serverless Containers 部署失败(资源卡在创建中) (列表并非详尽无遗) 我们的团队正在积极修复,我们对此事件造成的不便深表歉意。
原因:自 UTC 时间约 12:30 起,it-mil 区域内到 Scaleway API 的几条内部连接出现故障。因此: - 推送到 rg.it-mil.scw.eu 失败,并返回 "HTTP 500" 错误。 - Serverless Containers 部署失败(资源卡在创建中) (列表并非详尽无遗) 我们的团队正在积极修复,我们对此事件造成的不便深表歉意。
修复:该事故已解决,自 16:30 UTC 起情况已恢复稳定。 it-mil 区域的镜像仓库推送和容器部署已恢复正常。 感谢您在此期间的耐心等待。
针对其中一个 Block Storage 的强制性维护操作耗时超出计划。 部分客户端在 sbs_5k 和 sbs_15K 卷上的写入操作期间可能会遇到延迟。 我们正在监控此操作,并正在努力调整该操作以限制影响。
修复:此事件已解决。
网络问题导致产品 API 中断了几分钟。我们的团队已立即解决了该问题。
修复:此事件已解决。
创建新资源池时,资源池创建抛出错误 500。 我们的团队正在调查。
修复:该问题已由我们的产品团队解决。现在应该可以毫无问题地创建池。
11:13 CEST 至 11:48 CEST 在此 30 分钟窗口内,用户可能遇到了较高的错误率或超时。 我们的工程团队已定位并解决了该问题。
修复:此事件已解决。
DC5 机房 1 号房间 A59 机架中的一台 Dedibox 交换机与上游路由器的连接不稳定。 我们需要更换 SFP 模块。这将导致连接到该交换机的服务器出现短暂的连接中断。
修复:此事件已解决。
客户在数据库冷启动时可能会遇到速度下降,冷启动可能耗时长达 30 秒。
修复:此事件已解决。
通过 API 或控制台进行的安装/重新安装和重启工作流不适用于 Apple Silicon。 当前正在使用的 mac 仍然可运行且可访问。
修复:此事件已解决。
由于 NotReady 节点,我们在 it-mil-1 上丢失了约 1 小时的所有数据摄取 开始于 13h20 -> 结束于 14h20
原因:由于 NotReady 节点,我们在 it-mil-1 上丢失了约 1 小时的所有数据摄取 开始于 13h20 -> 结束于 14h20
我们正在调查一个影响部分关联了多个组织的账户登录的问题。仅关联单个组织的账户不受影响。
修复:此事件已解决。
客户可能会遇到 Scaleway 产品在 10:30-12:00 CEST 时间段内日志缺失的情况。
修复:此事件已解决。
客户在 Container Registry 区域端点上列出标签时,可能会遇到标签缺失的情况。按标签或摘要拉取镜像不受影响。Container Registry API 不受影响,会返回正确的标签列表。
修复:此事件已解决。
客户可能会遇到 DC3 中 4 号机房 4-6 号机架 1 号公共交换机上服务器的公共连接部分中断。
修复:此事件已解决。
在 fr-par 区域,客户在摄取或查询 Cockpit 中的 trace 数据时可能会遇到性能下降。
修复:此事件已解决。
客户在 fr-par 的 Managed Inference 上可能会遇到更长的部署创建时间。
修复:此事件已解决。
从07:30 CET开始,用户在访问nl-ams区域的无服务器容器时可能遇到连接问题或请求失败。 此问题正在由我们的团队调查。
修复:更新:连接已于上午 9:30 左右部分恢复。我们正在监控情况。
由于内部组件不稳定,客户在使用 mistral-medium-3.5-128b 模型时可能会遇到无响应的情况。
原因:由于内部组件不稳定,客户在使用 mistral-medium-3.5-128b 模型时可能会遇到无响应的情况。
修复:此事件已解决。
安全系统更新维护。维护期间预计将有 10 分钟的停机时间。 日期/时间:7 月 9 日 16 时至 17 时
修复:此事件已解决。
由于内部依赖问题,客户在 fr-par 区域创建 Spark 集群时可能会遇到失败。
原因:由于内部依赖问题,客户在 fr-par 区域创建 Spark 集群时可能会遇到失败。
修复:此事件已解决。
由于 DC2 中的公共交换机 s301-b5-2 重启,客户可能会在几分钟内经历公共连接的部分中断。
原因:由于 DC2 中的公共交换机 s301-b5-2 重启,客户可能会在几分钟内经历公共连接的部分中断。
客户可能因锁定状态而无法连接到其位于 Paris 的 Dedibox VPS。
原因:客户可能因锁定状态而无法连接到其位于 Paris 的 Dedibox VPS。
修复:此事件已解决。
客户在 it-mil-1 上使用 Object Storage 时可能会遇到连接问题。
修复:此事件已解决。
今天,在上午 9:12 至上午 10:15(巴黎时间)之间,由于 DNS 解析问题影响了一个内部组件,客户在带有对象存储后端的 Edge Services 管道上遇到了大量 HTTP 503 错误。 该事件现已解决,我们的团队正在继续监控情况。
原因:今天,在上午 9:12 至上午 10:15(巴黎时间)之间,由于 DNS 解析问题影响了一个内部组件,客户在带有对象存储后端的 Edge Services 管道上遇到了大量 HTTP 503 错误。 该事件现已解决,我们的团队正在继续监控情况。
修复:今天,在上午 9:12 至上午 10:15(巴黎时间)之间,由于 DNS 解析问题影响了一个内部组件,客户在带有对象存储后端的 Edge Services 管道上遇到了大量 HTTP 503 错误。 该事件现已解决,我们的团队正在继续监控情况。
在 fr-par 区域,由于 MSGQ 服务可用 IP 地址不足,客户可能无法创建新的部署。
原因:在 fr-par 区域,由于 MSGQ 服务可用 IP 地址不足,客户可能无法创建新的部署。
修复:此事件已解决。
[约17小时] 由于内部组件上的 DNS 解析问题,客户可能会在带有 Object Storage 后端的 Edge Services 管道上遇到大量 503 错误。
原因:[约17小时] 由于内部组件上的 DNS 解析问题,客户可能会在带有 Object Storage 后端的 Edge Services 管道上遇到大量 503 错误。
由于内部依赖项上出现与证书相关的错误,客户在创建 SEDB 部署时可能会遇到失败。
原因:由于内部依赖项上出现与证书相关的错误,客户在创建 SEDB 部署时可能会遇到失败。
修复:此事件已解决。
由于路由问题,使用 it-mil-1 中 Object Storage 的客户可能会遇到服务不可用的情况。
原因:由于路由问题,使用 it-mil-1 中 Object Storage 的客户可能会遇到服务不可用的情况。
修复:此事件已解决。
通过快照恢复的实例可以生成新的快照,但无法还原这些快照。 我们目前正在调查此问题。
修复:新恢复的实例不会受此问题影响。 受影响的客户将被单独联系,获取有关其快照纠正性维护的更新。
由于内部组件不稳定,客户在使用 qwen3.6-35b-a3b 模型时可能会遇到暂时的 5xx 错误。
原因:由于内部组件不稳定,客户在使用 qwen3.6-35b-a3b 模型时可能会遇到暂时的 5xx 错误。
修复:此事件已解决。
客户在 fr-par 的 Container Registry 拉取/推送镜像时可能会遇到速度变慢和错误。部分拉取/推送可能需要长达 30 分钟,或完全失败。这也可能导致 Serverless Containers 和 Functions 部署延迟或失败。
修复:此事件已解决。
客户在使用 gemma4-26b-a4b-it 模型时,可能会因内部组件的不稳定而遇到间歇性 5xx 错误。 问题已被识别,我们正在修复。在短暂延迟后重试请求即可成功。
原因:客户在使用 gemma4-26b-a4b-it 模型时,可能会因内部组件的不稳定而遇到间歇性 5xx 错误。 问题已被识别,我们正在修复。在短暂延迟后重试请求即可成功。
修复:此事件已解决。
在fr-par区域的Generative APIs服务中使用mistral-medium-3.5-128b模型时,客户可能会遇到不稳定的情况。
修复:此事件已解决。