Piattaforma edge cloud di Fastly

Back to blog

Follow and Subscribe

Come proteggere il tuo server MCP con Fastly

Ameet Bharwani

Staff Sales Engineer, Fastly

David King

Responsabile del marketing di prodotto di gruppo, sicurezza

Poiché le organizzazioni adottano rapidamente agenti di IA e flussi di lavoro agentici, i server Model Context Protocol (MCP) stanno diventando un livello di integrazione fondamentale tra i modelli di IA e i sistemi Enterprise. Sebbene accelerino lo sviluppo e semplifichino l’integrazione degli strumenti, introducono anche una nuova classe di sfide per la sicurezza. A differenza del traffico API tradizionale, che in genere è deterministico e con un ambito limitato, il traffico MCP consente il rilevamento dinamico degli strumenti, interazioni guidate dal linguaggio naturale e l’orchestrazione attraverso confini di attendibilità. Queste caratteristiche espandono la superficie di attacco e richiedono controlli di sicurezza che vadano oltre la Protezione API convenzionale.

Quando un importante editore globale si è rivolto a Fastly chiedendo aiuto per proteggere l’infrastruttura principale del proprio server MCP che collega i suoi agenti di IA a dati e strumenti finanziari in tempo reale, il nostro team è entrato subito in azione per costruire un prototipo la cui architettura può essere seguita da qualsiasi organizzazione per proteggere la propria. Di seguito sono illustrati il processo e i risultati ottenuti, fornendo un riferimento pratico per le organizzazioni che lavorano per proteggere i propri ambienti MCP.

Prototipo di protezione MCP di Fastly

Per proteggere il proprio server MCP, il prototipo di Fastly doveva soddisfare tre requisiti chiave: 

  • Rileva e mitiga i vettori di attacco specifici dell’IA – gli attacchi Open Web Application Security Project e quelli specifici dell’IA che prendono di mira il server MCP devono essere mitigati

  • Garantisci prestazioni su scala di produzione – È obbligatoria una latenza inferiore a 100 ms e la soluzione deve gestire almeno 100 Mbps di throughput

  • Consenti complessità di autenticazione – Deve essere consentita una combinazione di modelli di autenticazione basati su IP, token e mTLS senza falsi positivi

Per soddisfare questi requisiti, il prototipo ha combinato la flessibilità e la personalizzazione di più funzionalità Fastly esistenti. Anche se non entreremo nei dettagli della loro implementazione specifica (ma saremo lieti di aiutare privatamente la tua organizzazione a replicare i risultati di sicurezza), ognuna di queste soluzioni ha fornito al cliente un ulteriore livello di protezione per il suo server MCP. 

Ecco come il prototipo le ha abbinate per soddisfare i requisiti del cliente: 

  • La rete globale di Fastly offre molto più di una capacità globale di 578 Tbps e vantaggi in termini di prestazioni, consentendo ai clienti di implementare logica di traffico personalizzata mentre entra nella rete. Questa flessibilità di configurazione ha consentito di implementare le regole come previsto quando il traffico MCP ha raggiunto la nostra rete, bloccando automaticamente tipi di contenuto imprevisti come xml e limitando i metodi HTTP.

  • La gestione dei bot di Fastly offre visibilità sul traffico automatizzato diretto al server MCP, consentendo di creare regole per bloccare client di automazione indesiderati, bot con fingerprint dannose e, in generale, traffico di bot dannoso.

  • Fastly Next-Gen WAF offre la possibilità di mitigare gli attacchi OWASP e gli attacchi specifici per LLM, come l’iniezione di prompt codificata e le frasi di jailbreak. Il prototipo sfrutta le sue capacità di limitazione della velocità per incorporare policy contro IP o chiavi API che hanno superato le norme previste.

  • Fastly Media Shield fornisce un point of presence Fastly designato come punto di ancoraggio per tutto il traffico del server MCP prima che raggiunga infine l’origine. Ciò consente al prototipo di ridurre il carico sull’origine accelerando al contempo le connessioni, riducendo il tempo necessario per costosi handshake con più round trip.

Risultati principali

Con queste quattro soluzioni implementate e ottimizzate per proteggere il server MCP del cliente, il team ha condotto una prova di 10 settimane per vedere come si confrontava con i requisiti del cliente e ha scoperto che li superava di gran lunga.

Requisito

Metrica desiderata

Risultato

Latenza (media)

< 100ms

Meno di 50 ms

Velocità effettiva di caricamento

100 Mbps

Raggiunto

Dimensione massima del payload

200MB+

500 MB+ senza timeout

Flessibilità di autenticazione

Accettazione del modello basata su IP, token e mTLS

Raggiunto

Fastly per l’infrastruttura IA

La piattaforma di Fastly è in una posizione unica nel percorso della richiesta per proteggere e accelerare l’infrastruttura degli agenti IA, perché è stata progettata appositamente per l’edge, dove prestazioni e sicurezza devono coesistere.

  • Prestazioni senza compromessi:  L’ispezione aggiunge una latenza trascurabile; la scalabilità e la resilienza globali di Fastly mantengono performanti gli agenti di IA 

  • Sicurezza programmabile: Le regole di rete e di Next-Gen WAF possono essere ottimizzate per i nuovi modelli di traffico MCP e agentico

  • Visibilità in tempo reale: I team di sicurezza vedono tutto, quasi in tempo reale, senza dover attendere esportazioni batch dei log

  • Mitigazione delle minacce nativa per l’IA: È possibile creare facilmente policy per l’iniezione di prompt, l’abuso degli strumenti e l’enumerazione guidata da bot e abbinarle alle protezioni predefinite contro gli attacchi in stile OWASP

Poiché l’adozione dell’IA e delle tecnologie associate continua a crescere, il prototipo di protezione del server MCP di Fastly è solo un esempio di come Fastly possa aiutare la tua azienda ad adottare con sicurezza le tecnologie emergenti senza aumentare il rischio. Contattaci se vuoi saperne di più sul prototipo o su come possiamo aiutare la tua azienda nell’era dell’IA.

Pronto per iniziare?

Contattaci oggi