Gouvernez. Contrôlez. Protégez.
Fastly pour l'IA
Une seule plateforme pour créer, sécuriser et livrer vos applications, votre IA et vos données, en ligne, en quelques millisecondes, sur le réseau qui transporte déjà votre trafic.
Les plus grandes entreprises au monde nous font confiance
Nous déployons les meilleures expériences IA
De la distribution au déploiement, en passant par l’observabilité et la sécurité, Fastly offre la vitesse, le contrôle et l’échelle dont vous avez besoin pour créer des expériences d’IA sur lesquelles vos utilisateurs, et votre budget, peuvent compter.
One platform for your AI needs
AI is part of everything you do - in what you power, what you build, and within your own digital footprint. Fastly gives you command over all three with speed, visibility and control - on one platform.
Govern
Full visibility into every AI call and crawl
AI Runtime Control routes every model call through virtual keys with budget caps, rate limits, and automatic failover - on your terms.

Control
Capture every single AI call your business makes
AI Firewall delivers deterministic inline detection - at the edge - shielding your apps and APIs from attacks targeting AI use-cases

Protect
Block unwanted AI crawlers without stopping the ones you trust
Not all AI traffic is bad. Fastly Bot Management provides deep visibility that enables organizations to welcome the automation they want, and rate limit, block or monetize the traffic they don't




Pourquoi les équipes IA se basent sur Fastly
Alors que le trafic d'IA croît 6,5 fois plus vite que le trafic humain, une plateforme permettant de contrôler l'IA n'est plus facultative. Un panneau de contrôle unique pour les opérations, les informations et la sécurité liées à l'IA.
Visibilité unifiée de l'IA
Des journaux de prompts et de réponses consultables, l'attribution des jetons et des informations sur le trafic en temps réel = aucun angle mort.
Réduction des coûts d’IA
Les clés virtuelles avec des plafonds budgétaires, des limitations du débit et une attribution par session réduisent les dépenses non comptabilisées chez les fournisseurs.
Protection du contenu
Contrôlez la façon dont les bots d’indexation d’IA accèdent à votre contenu selon vos propres conditions : bloquez, limitez, trompez ou autorisez.
Sécurité de l'IA intégrée
Le pare-feu IA bloque les injections de prompts en périphérie en temps réel. Détection déterministe, sans GPU.
Application des contrats d'API
L'application du schéma limite le trafic agentique au contrat que vous avez déjà publié. Enregistrez-le ou bloquez-le, service par service.
Simplicité d’intégration
Acheminez des centaines de modèles publics et auto-hébergés via un seul point de terminaison. Utilisez vos propres clés, sans modifier votre pipeline.
Fastly for AI
Purpose-built products to help you accelerate, protect, and operate AI on the same edge cloud platform.
Intelligent control plane providing AI traffic visibility, governance, and control
Protect AI-enabled applications from LLM-based threats
Detect and control the AI crawlers scraping your content, without consent or credit.
Validate incoming API requests against schemas you define; log or block requests that don't conform
Manage your Fastly infrastructure, security settings, and performance monitoring through natural language interactions.
An open source collection of AI agent skills that teach your coding agent how to work with Fastly.
Pourquoi vos charges de travail d’IA ont-elles besoin d’une couche de mise en cache ?
Les charges de travail d'IA peuvent être considérablement plus lentes que le traitement d'éléments qui ne sont pas des LLM. Vos utilisateurs voient la différence entre quelques dizaines de millisecondes et plusieurs secondes et, dans le cas de plusieurs milliers de requêtes, vos serveurs la voient aussi. La mise en cache sémantique cartographie les requêtes en concepts sous forme de vecteurs, mettant en cache les réponses quelle que soit la façon dont la question est posée. Il s'agit d'une bonne pratique recommandée par les principaux fournisseurs de LLM. AI Accelerator simplifie cette tâche.

Résultats réels sur Fastly


« Que vous soyez une petite boutique ou une très grande entreprise, il y a quelque chose dans la plateforme Fastly que vos équipes de service et d’application peuvent exploiter pour générer de la valeur pour le client. »
Jefferson Frazer
Directeur de l’infrastructure cloud
68 %
Réduction des coûts de stockage
115 PB
Contenu livré en 90 jours


« Les solutions de sécurité de Fastly nous protègent efficacement contre les attaques malveillantes et préservent notre origine d’un trafic excessif, sans nuire à l’expérience client. »
Yanyan Ni
Ingénieur principal, ingénierie de la fiabilité des sites
90 %
Réduction du trafic de bots
250+
Sites protégés


« Fastly Bot Management a considérablement réduit notre trafic indésirable. La facilité d’utilisation dans l’élaboration des règles, la visualisation rapide des signaux, l’analyse comportementale et l’atténuation des comportements ont justifié l’investissement. »
Randy Naraine
Architecte en cybersécurité
30 à 50 %
Réduction du trafic de bots
3 jours
35 sites migrés


« En tant que responsable de l’ingénierie, je me soucie profondément de l’interaction entre l’expérience des développeurs et l’expérience de sécurité. Instaurer un climat de confiance avec les développeurs est plus facile avec Fastly. »
Matt Brandman
Responsable principal en ingénierie, sécurité de la plateforme
Cas d’utilisation mis en avant



Ressources présentées



Questions fréquemment posées
Qu’est-ce que l’AI Accelerator de Fastly et comment améliore-t-il les performances de l’IA ?
AI Accelerator est une solution de mise en cache sémantique facile à mettre en œuvre pour les API de LLM utilisées dans les applications d’IA générative. Le traitement des requêtes d’IA s’effectue en périphérie, grâce à une mise en cache sémantique intelligente et une distribution optimisée, permettant aux organisations de fournir des réponses d’IA plus rapides. Moins de requêtes vers l’API LLM permettent également de réduire le coût des jetons.
Qu’est-ce que la mise en cache sémantique et comment optimise-t-elle les coûts des LLM ?
La mise en cache sémantique identifie et réutilise des réponses d’IA similaires ou équivalentes, plutôt que de mettre en cache uniquement les correspondances exactes. Elle décompose une requête en concepts significatifs afin de correspondre aux futures requêtes qui sont sémantiquement similaires. Appliquée en périphérie, elle réduit les appels d’inférence redondants, diminue les coûts de jetons et livre des réponses plus rapides.
How does AI Runtime Control help maintain AI application reliability across providers?
AI Runtime Control lets teams configure an ordered set of model targets behind a virtual key. If the primary target continues to return errors after a retry, AI Runtime Control automatically routes the request to a configured fallback, helping keep customer-facing AI applications available without requiring failover logic in each application.
Comment Fastly AI s’intègre-t-il à ma pile d’IA existante ?
Fastly est une couche de distribution et d’optimisation haute performance qui se positionne en amont de votre infrastructure d’IA et de vos fournisseurs de LLM existants. Comme il agit comme un proxy améliorant les performances plutôt que comme un remplacement de modèle, les équipes accélèrent les charges de travail d’IA sans changer de frameworks, de pipelines ou de choix de modèles.
Fastly AI convient-il aux charges de travail d’entreprise et de production ?
Oui. Fastly AI est conçue pour les applications à l’échelle des entreprises qui exigent fiabilité, sécurité et performances prévisibles, avec les contrôles, l’observabilité et la scalabilité nécessaires pour exécuter l’IA en production tout en livrant des expériences plus rapides aux utilisateurs finaux dans le monde entier.
How does AI Runtime Control help prevent runaway AI agents and unexpected usage?
AI Runtime Control applies independent requests-per-minute and tokens-per-minute limits to individual virtual keys. These controls can contain excessive consumption caused by autonomous agent loops, software errors, attacks, or sudden traffic spikes before they exhaust provider quotas or generate uncontrolled costs.
Govern. Control. Protect.
Une seule plateforme pour créer, sécuriser et diffuser vos applications, l'IA et vos données.





