Back to blog

Segui e iscriviti

Lo stadio invisibile

Scopri come l’IA, il routing edge e i team di esperti gestiscono enormi picchi di traffico durante la Coppa del Mondo, garantendo un’esperienza di visualizzazione fluida ad alte prestazioni.

Hossein Lotfi
Hossein LotfiVicepresidente senior dell'Ingegneria, Fastly
Justin Odom
Justin OdomVicepresidente, Fleet Operations e Production Engineering

All'interno dell'infrastruttura edge, delle persone e dell'IA dietro la Coppa del Mondo

Quando circa 1,8 miliardi di persone si sintonizzano su una singola partita, come è accaduto per l'ultima partita della Coppa del Mondo, l'intero Internet si rimodella attorno a loro.

Il traffico sulla nostra rete ha registrato un picco durante la finale. La cosa più sorprendente è stata il modo in cui il traffico fra categorie non correlate si è invertito in tempo reale.

Il traffico gaming è sceso del 18–20% al di sotto della baseline, quando milioni di persone hanno posato i loro joypad. Nel frattempo, è aumentato il traffico social di circa il 25%, generando marcati micro-picchi perfettamente sincronizzati secondo per secondo con ogni momento cruciale, dal cartellino rosso di Enzo Fernández al gol di Ferran Torres. Poi, nel giro di 45 minuti dal fischio finale, la baseline della rete globale è tornata subito alla normalità.

Nota: i dati sono stati indicizzati a fini di visualizzazione. Il traffico per categoria viene visualizzato in relazione alla scala.

Osservando la telemetria, la curva verde mostra come il traffico di streaming della Coppa del Mondo aumenti prima del calcio d'inizio e mantenga un livello costantemente elevato per tutta la partita. Nello stesso identico momento, il traffico gaming (giallo) cala costantemente in proporzione diretta. Ma il segnale più volatile è il traffico social (blu), che registra forti picchi nei momenti più importanti della partita.

Dai picchi di una singola partita alla scalabilità a livello di torneo

In 39 giorni e 104 partite, l'andamento del torneo è cambiato radicalmente: da un flusso costante, distribuito su plateau giornalieri di 12 ore, si è passati a picchi globali sempre più concentrati, fino al massimo assoluto toccato in occasione della finale.

Prestazioni ininterrotte, a zero blackout, nel momento più importante: non è stato un colpo di fortuna, ma il risultato di un preciso lavoro di ingegnerizzazione. Ha richiesto una pianificazione predittiva della capacità, un routing edge autonomo con sicurezza inline e l’impegno ingegneristico umano dedicato sui bridge live.

Telemetria predittiva e pianificazione della capacità

La preparazione per un evento di questa portata inizia mesi prima dell'avvio. Quando i clienti di streaming, media e piattaforme registrano picchi di traffico simultanei, diventa fondamentale l'allocazione della capacità. Per costruire una roadmap dell'infrastruttura globale, i nostri team collaborano direttamente con i clienti con mesi di anticipo per pianificare le proiezioni della larghezza di banda e i requisiti dell'infrastruttura regionale.

Utilizziamo modelli di machine learning per aiutarci a prendere decisioni sulla pianificazione della capacità. Acquisendo e sintetizzando enormi flussi di dati di rete in tempo reale e storici, i nostri strumenti di modellazione basati sull’IA offrono ai team ingegneristici una visibilità più rapida e precisa sulla domanda di traffico regionale, mantenendo al contempo gli operatori esperti saldamente al controllo delle decisioni architetturali.

Durante la fase a gironi, ad esempio, i nostri modelli di telemetria hanno segnalato un'impennata inaspettata degli spettatori. Gli strumenti hanno previsto istantaneamente le modifiche necessarie alla topologia regionale, consentendo ai nostri team di infrastruttura di accelerare le implementazioni localizzate. Siamo passati dai primi avvisi di telemetria alla distribuzione del traffico in tempo reale in pochi giorni.

Routing edge e sicurezza autonomi

Mentre i modelli predittivi gestiscono la pianificazione della capacità, la distribuzione del live streaming richiede un’esecuzione inferiore al secondo nel livello edge.

Durante il torneo, la nostra rete sottostante ha preso milioni di decisioni di routing autonome e istantanee al secondo. Sistemi come Autopilot e Precision Path hanno valutato costantemente lo stato dei provider di transito e le prestazioni dell’infrastruttura principale, eseguendo automaticamente il rerouting in frazioni di millisecondo per aggirare i colli di bottiglia upstream.

Contemporaneamente, gli eventi sportivi dal vivo attirano elevati volumi di attività dannose, tra cui pirateria automatizzata dei flussi, credential stuffing, tentativi di acquisizione dell'account e attacchi DDoS volumetrici. Spinte dalla diffusione degli strumenti di IA, queste minacce stanno diventando più veloci e sofisticate. Poiché prestazioni e sicurezza sono inseparabili a questa scalabilità, Fastly funge da prima linea di difesa, portando un'ampia esperienza nel contrasto a frodi e pirateria direttamente all'edge.

A metà del torneo, i nostri team hanno distribuito mitigazioni antipirateria direttamente sui percorsi di distribuzione live. Alimentata dal nostro Adaptive Threat Engine e da strumenti come ContentGuard, la nostra piattaforma ha filtrato attivamente i flussi di distribuzione non autorizzati inline ai bordi della rete senza introdurre latenza per gli spettatori legittimi o sovraccaricare i server di origine dei clienti.

Persone dedicate sui bridge live

Non importa quanto siano avanzati il routing automatizzato o gli strumenti, un’infrastruttura critica richiede competenze in prima linea.

Uno dei valori fondamentali di Fastly è fungere da estensione diretta dei team e delle tecnologie dei nostri clienti. Nel corso di tutte le 104 partite, i nostri team ingegneristici hanno mantenuto canali live dedicati e condivisi con i responsabili tecnici dei clienti. Ciò è stato supportato da mesi di preparazione anticipata, dallo sviluppo di runbook congiunti, dalla creazione di dashboard di osservabilità condivise e dall’esecuzione di simulazioni parallele di scenari di fallimento. I team di Fastly e del cliente hanno operato sulla base di una telemetria identica e in tempo reale, monitorando metriche di integrità condivise durante le partite per individuare e risolvere potenziali colli di bottiglia prima che avessero un impatto sugli utenti finali.

Gestire il torneo non è stato un singolo evento, ma l’esecuzione di centinaia di micro-eventi, supportata da team esperti dotati di strumenti potenti.

Costruire la resilienza per il peak traffic

La Coppa del Mondo si tiene solo ogni quattro anni, ma gestire i picchi di traffico in tempo reale, le minacce alla sicurezza e il routing in frazioni di secondo non serve solo per le grandi partite. È ciò che l’infrastruttura moderna deve fare ogni giorno.

Quando la tecnologia è costruita per gestire questo tipo di scala globale senza perdere pacchetti o causare interruzioni per i clienti, tali modelli di resilienza diventano lo standard di base per l'intera piattaforma. L'obiettivo finale è mantenere l'infrastruttura invisibile, in modo che l'esperienza sia tutto ciò che gli spettatori ricordano.

Stai pianificando un prossimo evento soggetto a peak traffic? Contatta il team Fastly per saperne di più sul modo in cui possiamo aiutarti.

Pronto per iniziare?

Contattaci oggi