Visibilidad. Control. Gobernanza. Para cada llamada de IA.
Fastly AI Runtime Control (ARC)
Deja de adivinar el riesgo y el gasto de tu IA. ARC es un plano de control unificado que se ubica entre tus aplicaciones y modelos de IA, brindándote visibilidad, gobernanza y control centralizados sobre todo tu tráfico de IA. Rastrea el gasto en tiempo real, aplica límites de presupuesto y de velocidad, automatiza la conmutación por error de múltiples proveedores y benefíciate del rendimiento de baja latencia en el edge.
Toma el control de todo el tráfico de IA y agentes
Controla el uso interno de la IA y gobierna tus aplicaciones habilitadas para IA. AI Runtime Control de Fastly te permite gestionar con seguridad la complejidad de múltiples proveedores con visibilidad en tiempo real, controles de acceso y costos, además de conmutación por error automatizada para garantizar un tiempo de actividad continuo.
Audita el 100 % de tu actividad de IA
Responde a los requisitos legales, de cumplimiento y de seguridad. Verifica cómo se manejan los datos del cliente y rastrea exactamente quién solicitó qué.
Obtén una medición unificada de múltiples proveedores
ARC consolida el tráfico de IA en un único panel de control con un seguimiento detallado y en tiempo real del recuento de tokens de entrada y salida, los volúmenes de solicitudes y los costos calculados asignados a claves virtuales y sesiones de cliente específicas.
Aísla rápidamente los focos de alto gasto
Usa tableros y tablas de clasificación en tiempo real para identificar exactamente qué aplicaciones, equipos o desarrolladores consumen más tokens y dólares.
Convierte las interrupciones del proveedor en un evento irrelevante
Mantén tus funciones de IA orientadas al cliente sin problemas ante límites de velocidad o interrupciones del proveedor ascendente. Si un modelo principal falla, ARC reintenta de forma transparente y conmuta por error a tus modelos de respaldo en el edge, lo que garantiza una experiencia del usuario continua.
Aplica límites de presupuesto mensual
Pasa de un gasto reactivo a medidas de protección financiera proactivas al aplicar límites de presupuesto mensual en dólares exigibles directamente a claves virtuales individuales.
Evita que los agentes descontrolados agoten tu presupuesto o cuota de IA
La limitación de velocidad por clave virtual protege las cuotas de tu proveedor ascendente para que no se agoten por bucles descontrolados de agentes autónomos o picos de tráfico externos.
Protege contra amenazas basadas en LLM con AI Firewall
AI Firewall es un módulo de seguridad dentro de ARC que protege tus aplicaciones impulsadas por IA de ataques de inyección de prompts con un impacto de latencia casi nulo. Aprovecha el motor de detección SmartParse de Fastly y barreras de protección personalizadas para detectar ataques como la inyección de prompts y otros ataques específicos de LLM. Despliega con solo accionar un interruptor.
Un solo plano de control para todo tu tráfico de IA
Bloquea el acceso, limita el gasto y detén los ataques antes de que comiencen. AI Runtime Control de Fastly te ofrece un solo lugar para gestionar el acceso, el gasto y el riesgo en todos los modelos y proveedores, para que puedas ejecutar IA en producción con visibilidad y control en tiempo real.
Preguntas frecuentes
¿Qué es AI Runtime Control de Fastly?
ARC es un plano de control que gobierna el tráfico de IA en toda tu organización al rastrear el gasto en tiempo real, aplicar controles de acceso y habilitar la conmutación por error automática entre modelos de IA. Ofrece a los equipos una vista única del uso de tokens, los costos y las solicitudes en todos los proveedores de IA que utilizan.
¿Cómo puedo controlar o reducir el gasto en IA en toda mi organización?
ARC rastrea los conteos de tokens de entrada/salida, los volúmenes de solicitudes y los costos calculados en tiempo real, asignados a claves virtuales y sesiones de cliente. Los tableros y tablas de clasificación en tiempo real muestran exactamente qué aplicaciones, equipos o desarrolladores generan el mayor gasto, para que puedas detectar y solucionar puntos críticos rápidamente.
¿Qué sucede si mi proveedor de IA (como OpenAI o Anthropic) sufre una interrupción?
ARC mantiene las funciones y cargas de trabajo de IA al reintentar automáticamente las solicitudes y conmutar por error de forma transparente a modelos de respaldo en el edge cuando un proveedor principal deja de funcionar.
¿Cómo evito que un agente fuera de control agote mi presupuesto o cuota?
ARC aplica la limitación de velocidad por clave virtual, lo que limita cuánto puede consumir cualquier aplicación, agente o usuario individual. Esto protege tu presupuesto y las cuotas del proveedor ascendente para que no se agoten por bucles de agentes autónomos descontrolados o picos de tráfico inesperados.
¿Qué es AI Firewall de Fastly?
AI Firewall protege las aplicaciones de IA de ataques dirigidos específicamente a los modelos, como los intentos de inyección de prompts, en los que una entrada en lenguaje natural intenta desencadenar acciones no intencionadas. AI Firewall de Fastly está diseñado específicamente para estas amenazas de IA, a diferencia de un firewall de aplicaciones web tradicional.
¿Cómo detecta y bloquea AI Firewall de Fastly los ataques de inyección de prompts?
Utiliza un proceso de tres pasos: primero, el motor de detección SmartParse de Fastly inspecciona las solicitudes en busca de amenazas específicas de LLM, se inyectan barreras de protección para sanear las respuestas y se validan las salidas para respuestas de rechazo y protección contra fugas.
¿Cuál es la diferencia entre AI Runtime Control y AI Firewall? ¿Necesito ambos?
ARC es el plano de control que gestiona el tráfico, el costo y la fiabilidad de la IA entre proveedores. AI Firewall es una capa de seguridad que se despliega dentro de ARC y agrega detección de amenazas y barreras de protección. La mayoría de las organizaciones utilizan AI Firewall como parte de su despliegue de ARC, tanto para la gobernanza como para la protección.
¿Buscas algo más?







