Cloudflare отново срина половината интернет по време на поредно мащабно прекъсване

  • Нов глобален срив в Cloudflare остави хиляди уебсайтове и услуги недостъпни по целия свят, с особено въздействие върху Испания и Европа.
  • Прекъсването засегна основни платформи като LinkedIn, Canva, Fortnite, Zoom, испански банки и множество онлайн магазини.
  • Проблемът е възникнал от грешки, свързани с контролния панел, API и услуги като Cloudflare Workers, съвпадащи с планирана поддръжка.
  • Многократните прекъсвания само за няколко седмици подчертават огромната зависимост на интернет от няколко доставчици на облачни услуги и CDN.

Глобален прекъсване на Cloudflare

Ако през последните няколко часа сте се сблъсквали празни страници, грешки 500 или уебсайтове, които не се зареждатНе е по вина на телефона ви, рутера ви или интернет доставчика ви. Това, което отново се е повредило, е един от ключовите компоненти на интернет инфраструктурата: Cloudflare претърпя пореден глобален срив което остави половината свят без достъп до множество услуги.

Този инцидент се случва само седмици след поредното масивно прекъсване на електрозахранването Това е свързано и с Cloudflare, който породи сериозни опасения относно надеждността на основните доставчици на облачни услуги и CDN. За пореден път значителна част от дигиталния живот в Испания и Европа беше спряна за доста дълго време, оставяйки потребителите безсилни да се намесят.

Какво се случи с последния прекъсване на Cloudflare?

Проблеми с мрежата на Cloudflare

около 9:45-10:00 ч. (Испанско полуостровно време)Хиляди потребители започнаха да съобщават, че много познати уебсайтове не успяват да се заредят или връщат грешки „500 Internal Server Error“ и напълно празни страници. Платформи за мониторинг като Downdetector Те започнаха да се пълнят с предупреждения, до степен, че самият уебсайт на Downdetector... Също така имаше проблеми с достъпа понякога.

На официалната страница за състоянието на компанията, Cloudflare потвърди, че Разследвах грешки в таблото за управление и свързаните с него API.Компанията обясни, че заявките към тези услуги може да са неуспешни или да показват грешки, което на практика е довело до хиляди уебсайтове, които не отговориха или които са били само частично заредени.

Почти едновременно компанията беше планирала поддръжка в няколко центъра за даннивключително тези в Чикаго (ORD), Детройт (DTW) и Богота. Въпреки че първоначално не беше ясно дали съществува пряка връзка, Cloudflare по-късно потвърди, че в допълнение към таблото за управление, Услуги като Cloudflare Workers бяха засегнати, които изпълняват код директно във вашата мрежа и са от съществено значение за всички видове динамични процеси в съвременните уебсайтове.

Този бъг в Workers обяснява защо на много страници Началната страница щеше да се зареди, но критични функции като пазарски колички, вход и формуляри щеше да връщат грешки.За потребителя, усещането беше, че интернетът е спрял без видима причина, въпреки че домашната връзка работеше нормално.

Според докладите, Първите проблеми започнаха малко преди 10:00 часаКъм 10:12 ч. компанията вече беше съобщила, че е имало внедрено решение и наблюдаваше резултатите. В Испания много уебсайтове започнаха да се връщат към нормалното си функциониране през цялата сутрин, докато в други страни възстановяването беше малко по-бавно.

Какво точно е Cloudflare и защо може да „изключи“ половината интернет?

Как работи Cloudflare в интернет

За да се разбере защо инцидент в тази компания може да избиеш половината интернет от игратаСтрува си да си припомним какво е Cloudflare и каква роля играе. Това не е просто услуга за уеб хостинг, а... CDN (мрежа за доставяне на съдържание) и доставчик на услуги за сигурност който се намира между сървърите на компанията и крайните потребители.

На практика Cloudflare работи така: огромна магистрала и щит В същото време. От една страна, той съхранява копия на уебсайтове на сървъри, разпределени по целия свят, така че страниците да се зареждат по-бързо и да могат да се справят с пиковете на трафика без сривове. От друга страна, той действа като „гейткипър“, филтрирайки DDoS атаки, злонамерен трафик и ботове, защитавайки сертификатите, действайки като защитна стена на приложенията и управлявайки част от маршрутизацията.

Този модел има едно очевидно следствие: централизира голямо количество трафикКогато всичко работи добре, това позволява на уебсайтове от всякакъв размер да функционират бързо и сигурно. Но когато Cloudflare претърпи прекъсване, все едно... главната магистрала беше прекъсната който свързва потребителите с хиляди услуги: сайтовете все още съществуват на своите оригинални сървъри, но пътят до тях е блокиран.

Следователно, изправени пред този спад, много потребители видяха, че Техният WiFi работеше; можеха да отварят други уебсайтове, които не зависеха от Cloudflare.Те обаче не можеха да имат достъп до определени платформи, да влизат в профила си или да извършват покупки. Рестартирането на рутера, превключването на самолетен режим или дори нулирането на мрежовите настройки на мобилното им устройство – всичко това работеше. Беше абсолютно безполезнозащото проблемът беше извън техните устройства.

Ситуацията напомня на това, което вече се е случило 18 ноемврикогато друг инцидент с Cloudflare отне популярни услуги като X (преди Twitter), ChatGPT, Canva или IkeaПо този повод компанията в крайна сметка обясни, че промяна в разрешенията на вътрешна база данни е довела до генерирането на хиляди допълнителни редове в критичен файл от системата за управление на ботове, докато... Файлът се удвои по размер и надхвърли лимита, който софтуерът можеше да обработи., предизвиквайки колапса.

Засегнати услуги: от испански банки до видеоигри и платформи с изкуствен интелект

Услугите не работят поради прекъсване на Cloudflare

Списъкът с услуги, засегнати от това ново прекъсване, е дълъг и в много случаи... много познат на испанските и европейските потребителиВ професионалната сфера и сферата на социалните медии бяха съобщени проблеми в LinkedInкоито понякога не се зареждаха, показваха празни страници или предотвратяваха влизането, както и в инструменти за съвместна работа и дизайн, като например Canvaкоето беше директно недостъпно за мнозина.

В областта на дигиталните развлечения те бяха засегнати онлайн видеоигри и развлекателни платформи като Fortnite, Valorant, League of Legends или магазина на Epic Gamesкато потребителите съобщават, че не могат да се свържат с мачове, да актуализират играта или дори да стартират приложения. Имаше и проблеми с услуги като Crunchyroll и други платформи за съдържание.

Електронната търговия в Испания и други европейски страни усети силно удара. Онлайн магазини с висок трафик като MediaMarkt, PCComponentes, Decathlon или Vinted Те са имали смущения, от начални страници, които не се зареждат, до пазарски кошници, които връщат грешки. За много от тези компании дори няколко минути престой са били достатъчни. Това води до загуба на продажби и поток от оплаквания. в социалните мрежи.

Една от най-чувствителните области беше финансовият сектор. Според доклади, събрани от платформи за мониторинг, банки като CaixaBank и Bankinter Те претърпяха проблеми с достъпа до своите уебсайтове и цифрови услуги, които Това попречи на извършването на нормални операции за известно време.Въпреки че в повечето случаи проблемите са били временни, самата невъзможност за достъп до онлайн банката поражда голямо чувство на несигурност сред клиентите.

на инструменти за изкуствен интелект Те бяха и сред най-засегнатите. Потребителите на ChatGPT, Клод, Озадачение или Близнаци Те съобщаваха за прекъсвания, изключително бавни реакции или пълна невъзможност за достъп до платформите. През по-голямата част от инцидента, Най-популярните изкуствени интелекти буквално останаха без думи. за много потребители, особено в Европа и други страни, където Cloudflare концентрира част от трафика.

Въздействие в Испания и Европа: какво се наблюдава оттук

От гледна точка на европейските потребители, спадът се възприема като ново сутрешно интернет „затъмнение“Докато на източното крайбрежие на Съединените щати инцидентът съвпадна с ранните сутрешни часове, в Испания той застигна сутринта на работния петък, време, когато много компании работят с пълна сила.

В нашата страна оплакванията се натрупаха в социалните медии, когато уебсайтове, толкова често срещани като Decathlon, MediaMarkt, Vinted или различни онлайн образователни платформи Те спряха да отговарят. Това беше утежнено от прекъсвания в банките и услугите за видео разговори, като например ZoomТова допълнително усложняваше ежедневието за онези, които разчитаха на тези инструменти за работа.

Освен това, няколко испански медии използват Cloudflare, за да ускорят и защитят своите уебсайтове. Те преживяха периодични паданияНякои новинарски портали се зареждаха бавно, връщаха грешки или показваха непълно съдържание, което възпрепятстваше достъпа до информация точно когато имаше най-голям интерес да се знае какво се случва.

Интересното е, че докато голяма част от Европейския съюз ясно забеляза инцидента, Данните за състоянието на Cloudflare показват, че в някои страни услугите му все още са „работещи“Това очевидно противоречие се обяснява с факта, че не всички региони, маршрути и услуги са били засегнати еднакво: имаше райони със стабилно обслужване и други, където определени продукти (като например работници или части от API) многократно се повреждаха.

Съществени проблеми бяха съобщени и в други части на света, като доклади от Индия, Турция, Бразилия, Португалия или Виетнамкъдето потребителите видяха как приложения като ChatGPT, Zoom или различни референтни уебсайтове те станаха недостъпни или функционираха периодично.

Какво казаха от Cloudflare за произхода на проблема?

Както често се случва при подобни инциденти, Първоначалните съобщения на Cloudflare бяха много кратки.Компанията просто призна, че проучва проблеми с таблото за управление и API-тата, както и голям брой празни страници при използване на определени свързани функции. Работници КВ, неговата система за съхранение на ключови стойности в мрежата.

С напредването на сутринта технически представители на компанията, включително нейният главен технически директор, се обърнаха към тях, за да изяснят няколко въпроса. Едно от най-често повтаряните съобщения беше, че Това не беше външна атакаа по-скоро вътрешен проблем, свързан с деактивиране на определени записи за смекчаване на скорошна уязвимост в React. Тази модификация би довела до нежелани последици за достъпността на част от мрежата.

В последващи съобщения Cloudflare обясни, че е внедрих решение и пренасочих трафика от центрове за данни, които са подложени на поддръжка, което би могло да доведе до временно увеличение на латентността за някои потребители. Успоредно с това беше започната нова поддръжка на други места, като например центъра за данни в Богота, за да се стабилизира напълно ситуацията.

Във всеки случай, и отвъд тези технически подробности, Все още не са предоставени подробни подробности относно основната причина за повредата, нещо, което компанията обикновено запазва за по-късни публикации в техническия си блог. Тази липса на незабавна информация допринася за генериране на несигурност сред компаниите, които критично зависят от нейните услуги, особено когато Инцидентите се повтарят за толкова кратък период от време.

Многократните падания са се събудили загриженост в бизнес и технологичната средаТова е особено вярно за организации, които разчитат в голяма степен на платформи, хоствани или защитени от Cloudflare. Много от тях вече внимателно преглеждат своите планове за действие при извънредни ситуации и нивото си на зависимост от един-единствен критичен доставчик.

„Дежавю“ след седмици на срив в облачните технологии

Днешният спад допринася за Последна поредица от инциденти при големи доставчици на облачни услугиПреди повтарящите се проблеми на Cloudflare, вече е имало сериозно прекъсване на услугите. AWS (Уеб услуги на Amazon)което в Испания нокаутира платежни системи като Bizum и други платформи стрийминг като Netflix или Spotify и дори свързани устройства като интелигентни високоговорители или легла за домашна автоматизация.

Няколко седмици по-късно, Azure, облакът на MicrosoftСъщо така имаше прекъсвания, които засегнаха различни бизнес услуги и онлайн приложения. И в този контекст, няколко CDN доставчици, като например Cloudflare или Fastly преди години, бяха замесени в прекъсвания със значителни медийни и икономически последици.

Общото между всички тези случаи е, че По-голямата част от глобалния трафик е концентриран в няколко гигантаКакто обясняват повече от един експерт в сектора, вече не става въпрос за „висока“ зависимост, а за тотална зависимостДори компании със собствени центрове за данни разчитат на тези доставчици, за да се мащабират, да се защитят и да доставят съдържание на милиони потребители с гаранции.

Проблемът е, че когато един от тези гиганти се спъне, Това носи със себе си стотици или хиляди малки и средни услуги които разчитат на тяхната инфраструктура. Това, което може да е пречка за голяма мултинационална компания, може да означава нещо сериозно за бизнес за електронна търговия, медия или регионална банка. цяла сутрин на блокирани операции.

Самите засегнати компании са наясно, че е практически невъзможно самостоятелно да възпроизведат нивата на капацитет и резервиране на тези доставчици. Истинският „лимит“, както специалистите често казват с нотка на ирония, Това е кредитната карта на клиентазащото от този момент нататък всичко се възлага на външни изпълнители в облака.

Крехкостта на силно концентрирана инфраструктура

Последните събития отново разпалиха неудобен дебат: До каква степен е здравословно голяма част от интернет да е в ръцете на няколко компании?От банки и магазини до социални мрежи, образователни платформи, обществени услуги или транспортни системи, те вече зависят пряко или косвено от облака и големите мрежи за разпространение на съдържание.

Когато една от тези критични връзки претърпи повреда, Домино ефект Това е незабавно: системите за продажба в магазините се провалят, онлайн процесите са парализирани, някои здравни услуги се забавят, инструментите за съвместна работа спират да работят и т.н. За една нощ идеята, че „интернетът е винаги наличен“, е разклатена.

Експертите по инфраструктура и киберсигурност посочват, че въпреки съществуването на механизми за съкращаване и планове за действие при извънредни ситуации, няма безпогрешна системаПлатформи като Cloudflare имат множество разпределени центрове за данни и автоматизирани системи, които пренасочват трафика, когато нещо се обърка, но когато проблемът засяга критични компоненти, дори това съкращение не е достатъчно.

Освен това, при този тип инцидент, човешкият фактор остава силно присъстващВъпреки че не винаги е пряка човешка грешка, много повреди произтичат от промени в конфигурацията, актуализации или корекции, които, съчетани с изключително сложни системи, причиняват верижни реакции, които са трудни за предвиждане.

Случаи като прекъсването на Meta през 2021 г., когато неправилна конфигурация остави Facebook, WhatsApp и Instagram офлайн с часове, или инцидентът с Fastly, който свали популярни уебсайтове като Amazon, Twitch и Reddit, са напомняне за това. Една-единствена слаба точка е достатъчна, за да предизвика глобален проблем.

Как преживявате подобен срив от мобилния си телефон и компютъра?

За обикновения потребител всичко това се превръща в нещо много просто: Изведнъж почти нищо не работиТелефонът остава включен, Wi-Fi или връзката за данни е активна, но редица приложения замръзват, показват грешки 500 или се забиват на екрана за зареждане. В много случаи изкушението е да се започне... рестартирайте устройства, изчистете кеша или променете паролите, когато в действителност нищо от това няма смисъл.

В ситуация, подобна на тази, преживяна с Cloudflare, Смартфонът се превръща почти в луксозно преспапие За всичко, което зависи от облака: инструменти с изкуствен интелект, банкови приложения, платформи за пазаруване, социални мрежи, онлайн игри, управление на проекти, дигитални услуги… всичко е спряно, докато доставчикът не възстанови нормалното функциониране.

Експертите многократно подчертават, че когато се случи падане от този тип, Няма реално място за маневриране от страна на потребителяДеинсталирането на приложения, повтарящите се влизания или променянето на настройки няма да ускорят възстановяването на услугата и понякога само добавят още повече неудовлетвореност или дори могат да причинят допълнителни проблеми.

Най-разумната препоръка в тези случаи обикновено е изчакайте спокойно проблемът да бъде решенПроверка на официалните страници за състоянието на доставчиците от време на време (когато са достъпни) или на съобщенията от самите засегнати платформи. Ако прекъсването продължи, може би е подходящ момент да Вдигнете поглед от екрана и отделете известно време за офлайн дейности.

При днешния срив, добрата новина е, че Cloudflare успя Възстановете повечето услуги за по-малко от часВъпреки това, някои потребители продължиха да забелязват странно поведение и остатъчни грешки на определени уебсайтове известно време, докато мрежата се стабилизира напълно.

Това, което се случи с този нов прекъсване на Cloudflare, показва за пореден път, че доколко ежедневието ни зависи от невидима инфраструктура Управлявана от няколко глобални играчи, промяна в конфигурацията, злополучен проблем с поддръжката или повреда в специфична част от мрежата са достатъчни, за да оставят милиони хора без достъп до основни инструменти като онлайн банкиране, дигитално пазаруване, бизнес срещи или развлекателни платформи. Докато тези системи продължават да концентрират голяма част от глобалния трафик, инциденти като днешния ще продължат да ни напомнят, че интернет, колкото и стабилен да изглежда, има повече от една уязвима област.


Добавяне като предпочитан източник