
Un rašireni prekid rada Cloudflare mreže Ovaj utorak izazvao je globalne poremećaje, ostavljajući milijune korisnika s problemima u pristupu popularnim uslugama kao što su X y ChatGPTIzmeđu ostalog. Incident, koji se dogodio u podne (po španjolskom poluotočnom vremenu), istaknuo je koliko je međusobno povezana infrastruktura koja podržava internet.
Američka tvrtka, ključna u CDN i kibersigurnost, potvrdio je da istražuje val 500 grešaka i kvarove u kontrolnoj ploči i API-ju dok se radilo na postupnom oporavku. U Španjolskoj i ostatku Europe izvješća su se umnožila, utječući na sve, od društvenih mreža do digitalne zabave i, u manjoj mjeri, financijskih usluga.
Kronologija incidencije
Prva upozorenja su zabilježena oko 12:30 (poluotočno vrijeme)s vrhuncem problema oko 13:00 sati. Cloudflare je potvrdio situaciju neposredno prije 1:00 sati ujutro, oko 12:48i počeli provoditi mjere ublažavanja; za 13:15 Mnoge usluge su se počele oporavljati, iako su u nekim okruženjima i dalje postojali preostali kvarovi.
Prema izvorima unutar same tvrtke, otkriveno je neuobičajen porast prometa prema jednoj od svojih usluga prema 11:20To je izazvalo visoke stope pogrešaka u više komponenti njihove mreže. Iako je velik dio prometa nastavio teći, degradacija je uzrokovala primjetni prekidi u široko korištenim primjenama.
Pogođene usluge s velikim utjecajem
Doseg je bio širok i dotaknuo se benchmark platformi u nekoliko kategorija, s posebnim osvrtom na X (bivši Twitter) y ChatGPTIncidenti su također prijavljeni u alatima za stvaranje i pohranu, online igrama i nekim korporativnim web stranicama s velikim prometom, što je formiralo Domino efekt izvanredan.
- Društvene mreže i komunikacija: X, Izmjeri me i portal za praćenje Downdetector Prikazivali su greške ili sporo vrijeme učitavanja.
- Umjetna inteligencija i produktivnost: ChatGPT, Canva, Dropbox a neke poslovne usluge imale su povremene prekide.
- Financije i usluge: problemi su prijavljeni u Coinbase i korporativne web stranice kao što su Moody'saKorisnici su spomenuli specifične poteškoće u subjektima kao što su CaixaBank.
- Slobodno vrijeme i videoigre: Liga of Legends i zabavne aplikacije poput Grindr Trpili su prekide.
- Promet i telekomunikacije: incidenti u NJ Transit i privremeni prekidi ili degradacija operatora kao što su Movistar.
Osim utjecaja na kupce, Interne usluge Cloudflarea Bili su pogođeni tijekom incidenta. Kao dio napora za ublažavanje posljedica, tvrtka je navela konkretne akcije kao što su privremena deaktivacija WARP-a u Londonu stabilizaciju mreže i naknadnu reaktivaciju nakon što se razine pogrešaka normaliziraju.
Što je pošlo po zlu i što se zna
U svojim početnim komunikacijama, tvrtka je epizodu kategorizirala kao Unutarnje pogoršanje usluge i uvjeren da se provode promjene kako bi se ubrzao oporavak. Za sada, Nema dokaza o vanjskom napaduOperativna hipoteza ukazuje na problem unutar vlastite infrastrukture, koja je još uvijek u fazi analize.
Tijekom vrhunca incidenta, korisnici su se susreli raširenih 500 pogrešaka i neuspjesi u učitavanju sadržaja, uz incidente u Upravljačka ploča i Cloudflare APITvrtka je naznačila da će objavljivati ažuriranja na svojoj stranici sa statusom (cloudflarestatus.com) i detaljnu analizu na njegovom blogu (blog.cloudflare.com).
Utjecaj u Španjolskoj i Europi
Većina upozorenja u Španjolskoj bila je koncentrirana u rano poslijepodne, što se poklopilo s radnim vremenom i vršnom upotrebom digitalnih računala. Pogođeni pojedinačni korisnici i tvrtke, s posebnom vidljivošću na društvenim mrežama, platformama umjetne inteligencije i bankarske i telekomunikacijske usluge koji je bilježio povremene incidente.
Za europske organizacije koje ovise o Cloudflare kao CDN i sigurnosni slojUtjecaj je rezultirao skokovima latencije, djelomičnim prekidima i pogreškama u usmjeravanju, a IT timovi su provodili mjere za nepredviđene situacije dok je Oporavak je napredovao na globalnoj mreži tvrtke.
Resetiranje i sljedeći koraci
Cloudflare je objavio da je razine pogrešaka su se smanjivale Nakon provedenih promjena, s oporavkom koji se proširio cijelom mrežom, neposredni prioritet bio je kako bi se osigurala stabilnost prometa a zatim dovršiti analizu uzroka kako bi se spriječilo slično ponavljanje.
Incident ponovno otvara raspravu o ovisnost o velikim dobavljačima infrastrukture. To se događa nakon nedavnih epizoda u Kvarovi AWS-a y Plavetniloi naglašava da lokalizirani kvar može širenje učinaka velikih razmjera kada milijuni usluga ovise o istim kritičnim slojevima.
Pad je ostavio jasnu sliku: jedna oslabljena veza To bi moglo imati posljedice na više sektora istovremeno. S obzirom na to da je većina platformi već operativna, pozornost je sada usmjerena na tehničko izvješće koje detaljno opisuje... Što je pošlo po zlu, kako je problem ublažen? i koje će se promjene uspostaviti kako bi se ojačala otpornost digitalnog ekosustava.
