Gouvernez. Contrôlez. Protégez.

Fastly pour l'IA

Une seule plateforme pour créer, sécuriser et livrer vos applications, votre IA et vos données, en ligne, en quelques millisecondes, sur le réseau qui transporte déjà votre trafic.

Les plus grandes entreprises au monde nous font confiance

  • TED
  • Sotheby's
  • SpaceX
  • Cannon
  • The New York Times
  • Buzzfeed
  • Carvana
  • Shutterstock
  • Duolingo
  • rightmove

Nous déployons les meilleures expériences IA

De la distribution au déploiement, en passant par l’observabilité et la sécurité, Fastly offre la vitesse, le contrôle et l’échelle dont vous avez besoin pour créer des expériences d’IA sur lesquelles vos utilisateurs, et votre budget, peuvent compter.

  • Déploiements d'applications protégés 1

  • Requêtes quotidiennes traitées sur l’ensemble du réseau 2

  • Capacité globale du réseau périphérique 3

  • Temps de purge régional moyen 4

One platform for your AI needs

AI is part of everything you do - in what you power, what you build, and within your own digital footprint. Fastly gives you command over all three with speed, visibility and control -  on one platform.

Govern
Full visibility into every AI call and crawl

AI Runtime Control routes every model call through virtual keys with budget caps, rate limits, and automatic failover - on your terms.

En savoir plus
Control
Capture every single AI call your business makes

AI Firewall delivers deterministic inline detection - at the edge - shielding your apps and APIs from attacks targeting AI use-cases

En savoir plus
Protect
Block unwanted AI crawlers without stopping the ones you trust

Not all AI traffic is bad. Fastly Bot Management provides deep visibility that enables organizations to welcome the automation they want, and rate limit, block or monetize the traffic they don't

En savoir plus

Pourquoi les équipes IA se basent sur Fastly

Alors que le trafic d'IA croît 6,5 fois plus vite que le trafic humain, une plateforme permettant de contrôler l'IA n'est plus facultative. Un panneau de contrôle unique pour les opérations, les informations et la sécurité liées à l'IA.

Visibilité unifiée de l'IA

Des journaux de prompts et de réponses consultables, l'attribution des jetons et des informations sur le trafic en temps réel = aucun angle mort.

Réduction des coûts d’IA

Les clés virtuelles avec des plafonds budgétaires, des limitations du débit et une attribution par session réduisent les dépenses non comptabilisées chez les fournisseurs.

Protection du contenu

Contrôlez la façon dont les bots d’indexation d’IA accèdent à votre contenu selon vos propres conditions : bloquez, limitez, trompez ou autorisez.

Sécurité de l'IA intégrée

Le pare-feu IA bloque les injections de prompts en périphérie en temps réel. Détection déterministe, sans GPU.

Application des contrats d'API

L'application du schéma limite le trafic agentique au contrat que vous avez déjà publié. Enregistrez-le ou bloquez-le, service par service.

Simplicité d’intégration

Acheminez des centaines de modèles publics et auto-hébergés via un seul point de terminaison. Utilisez vos propres clés, sans modifier votre pipeline.

Fastly for AI

Purpose-built products to help you accelerate, protect, and operate AI on the same edge cloud platform.

AI Runtime Control

Intelligent control plane providing AI traffic visibility, governance, and control

AI Firewall

Protect AI-enabled applications from LLM-based threats

AI Bot Management

Detect and control the AI crawlers scraping your content, without consent or credit.

API Enforcement

Validate incoming API requests against schemas you define; log or block requests that don't conform

Fastly MCP Server

Manage your Fastly infrastructure, security settings, and performance monitoring through natural language interactions.

Fastly Agent Toolkit

An open source collection of AI agent skills that teach your coding agent how to work with Fastly.

Pourquoi vos charges de travail d’IA ont-elles besoin d’une couche de mise en cache ?

Les charges de travail d'IA peuvent être considérablement plus lentes que le traitement d'éléments qui ne sont pas des LLM. Vos utilisateurs voient la différence entre quelques dizaines de millisecondes et plusieurs secondes et, dans le cas de plusieurs milliers de requêtes, vos serveurs la voient aussi. La mise en cache sémantique cartographie les requêtes en concepts sous forme de vecteurs, mettant en cache les réponses quelle que soit la façon dont la question est posée. Il s'agit d'une bonne pratique recommandée par les principaux fournisseurs de LLM. AI Accelerator simplifie cette tâche.

Résultats réels sur Fastly

Shutterstock

« Que vous soyez une petite boutique ou une très grande entreprise, il y a quelque chose dans la plateforme Fastly que vos équipes de service et d’application peuvent exploiter pour générer de la valeur pour le client. »

Jefferson Frazer

Directeur de l’infrastructure cloud

68 %

Réduction des coûts de stockage

115 PB

Contenu livré en 90 jours

Lire le témoignage client
USA Today Co.

« Les solutions de sécurité de Fastly nous protègent efficacement contre les attaques malveillantes et préservent notre origine d’un trafic excessif, sans nuire à l’expérience client. »

Yanyan Ni

Ingénieur principal, ingénierie de la fiabilité des sites

90 %

Réduction du trafic de bots

250+

Sites protégés

Lire le témoignage client
JetBlue

« Fastly Bot Management a considérablement réduit notre trafic indésirable. La facilité d’utilisation dans l’élaboration des règles, la visualisation rapide des signaux, l’analyse comportementale et l’atténuation des comportements ont justifié l’investissement. »

Randy Naraine

Architecte en cybersécurité

30 à 50 %

Réduction du trafic de bots

3 jours

35 sites migrés

Lire le témoignage client
Duolingo

« En tant que responsable de l’ingénierie, je me soucie profondément de l’interaction entre l’expérience des développeurs et l’expérience de sécurité. Instaurer un climat de confiance avec les développeurs est plus facile avec Fastly. »

Matt Brandman

Responsable principal en ingénierie, sécurité de la plateforme

Lire le témoignage client

Cas d’utilisation mis en avant

Servez les chatbots et assistants virtuels plus rapidement en mettant en cache des réponses sémantiquement similaires en périphérie.
Accélérez la recherche et les bases de connaissances alimentées par l’IA tout en réduisant les appels d’inférence redondants.
Exécutez des agents à faible latence et la personnalisation en temps réel sur Fastly Compute et le Key Value Store.

Ressources présentées

Scale your AI securely. Fastly for AI gives enterprise leaders complete visibility into model usage, real-time cost controls, and edge-based threat protection
Govern your AI traffic and control your spend with an intelligent control plane for the agentic web.
Protect AI-enabled applications from LLM-based threats

Questions fréquemment posées

Qu’est-ce que l’AI Accelerator de Fastly et comment améliore-t-il les performances de l’IA ?

AI Accelerator est une solution de mise en cache sémantique facile à mettre en œuvre pour les API de LLM utilisées dans les applications d’IA générative. Le traitement des requêtes d’IA s’effectue en périphérie, grâce à une mise en cache sémantique intelligente et une distribution optimisée, permettant aux organisations de fournir des réponses d’IA plus rapides. Moins de requêtes vers l’API LLM permettent également de réduire le coût des jetons.

Qu’est-ce que la mise en cache sémantique et comment optimise-t-elle les coûts des LLM ?

La mise en cache sémantique identifie et réutilise des réponses d’IA similaires ou équivalentes, plutôt que de mettre en cache uniquement les correspondances exactes. Elle décompose une requête en concepts significatifs afin de correspondre aux futures requêtes qui sont sémantiquement similaires. Appliquée en périphérie, elle réduit les appels d’inférence redondants, diminue les coûts de jetons et livre des réponses plus rapides.

How does AI Runtime Control help maintain AI application reliability across providers?

AI Runtime Control lets teams configure an ordered set of model targets behind a virtual key. If the primary target continues to return errors after a retry, AI Runtime Control automatically routes the request to a configured fallback, helping keep customer-facing AI applications available without requiring failover logic in each application.

Comment Fastly AI s’intègre-t-il à ma pile d’IA existante ?

Fastly est une couche de distribution et d’optimisation haute performance qui se positionne en amont de votre infrastructure d’IA et de vos fournisseurs de LLM existants. Comme il agit comme un proxy améliorant les performances plutôt que comme un remplacement de modèle, les équipes accélèrent les charges de travail d’IA sans changer de frameworks, de pipelines ou de choix de modèles.

Fastly AI convient-il aux charges de travail d’entreprise et de production ?

Oui. Fastly AI est conçue pour les applications à l’échelle des entreprises qui exigent fiabilité, sécurité et performances prévisibles, avec les contrôles, l’observabilité et la scalabilité nécessaires pour exécuter l’IA en production tout en livrant des expériences plus rapides aux utilisateurs finaux dans le monde entier.

How does AI Runtime Control help prevent runaway AI agents and unexpected usage?

AI Runtime Control applies independent requests-per-minute and tokens-per-minute limits to individual virtual keys. These controls can contain excessive consumption caused by autonomous agent loops, software errors, attacks, or sudden traffic spikes before they exhaust provider quotas or generate uncontrolled costs.

Govern. Control. Protect.

Une seule plateforme pour créer, sécuriser et diffuser vos applications, l'IA et vos données.