Visibilidad. Control. Gobernanza. Para cada llamada de IA.

Control del tiempo de ejecución de IA de Fastly (ARC)

Deja de adivinar cuáles son los riesgos y gastos de la IA. ARC es un plano de control unificado que se sitúa entre tus aplicaciones y los modelos de IA, y te proporciona visibilidad, gobernanza y control centralizados sobre todo el tráfico de IA. Haz un seguimiento del gasto en tiempo real, aplica límites de presupuesto y de volumen, automatiza el sistema de recuperación de fallos entre varios proveedores y aprovecha el rendimiento de edge con baja latencia.

Ventajas

Toma el control de todo el tráfico de IA y agentes

Controla el uso interno de la IA y gestiona tus aplicaciones habilitadas para IA. AI Runtime Control de Fastly te permite gestionar de forma segura la complejidad de múltiples proveedores gracias a la visibilidad en tiempo real, controles de costes y accesos, además de un sistema de recuperación de fallos automatizado para garantizar un tiempo de actividad continuo.

Audita el 100 % de tu actividad de IA

Cumple los requisitos legales, de cumplimiento y de seguridad. Verifica cómo se gestionan los datos de los clientes y rastrea exactamente quién solicitó qué.

Obtén una medición unificada de múltiples proveedores

ARC consolida el tráfico de IA en un único panel con un seguimiento detallado y en tiempo real del recuento de tokens de entrada y salida, el volumen de peticiones y los costes calculados asignados a claves virtuales y sesiones de clientes específicas.

Aísla rápidamente los puntos críticos de alto gasto

Utiliza paneles y clasificaciones en tiempo real para identificar con exactitud qué aplicaciones, equipos o desarrolladores consumen más tokens y dólares.

Haz que las interrupciones de los proveedores pasen desapercibidas

Mantén las funciones de IA orientadas al cliente funcionando sin problemas ante límites de volumen o interrupciones de proveedores ascendentes. Si un modelo principal deja de funcionar, ARC vuelve a intentarlo de forma transparente y conmuta a los modelos de respaldo en el edge, lo que garantiza una experiencia de usuario continua.

Aplicar límites de presupuesto mensual

Pasa de un gasto reactivo a mecanismos de protección financiera proactivos aplicando límites vinculantes de presupuesto mensual en dólares directamente a claves virtuales individuales.

Evita que los agentes descontrolados agoten tu presupuesto o cuota de IA

La limitación de frecuencia por clave virtual protege las cuotas de tu proveedor ascendente para que no se agoten por bucles descontrolados de agentes autónomos o picos de tráfico externos.

Protégete frente a las amenazas basadas en LLM con el cortafuegos de IA

AI Firewall es un módulo de seguridad dentro de ARC que protege tus aplicaciones impulsadas por IA contra ataques por inyección de comandos con un impacto casi nulo en la latencia. Utiliza el motor de detección SmartParse de Fastly y barreras de protección personalizadas para detectar ataques como la inyección de comandos y otros ataques específicos de LLM. Despliégalo con un solo gesto.

Explora el control en tiempo de ejecución de la IA

Un único plano de control para todo tu tráfico de IA

Bloquea el acceso, limita el gasto y detén los ataques antes de que comiencen. AI Runtime Control de Fastly te ofrece un único lugar para gestionar el acceso, el gasto y el riesgo en todos los modelos y proveedores, para que puedas ejecutar la IA en producción con visibilidad y control en tiempo real.

Acceso seguro con claves virtuales gestionadas

ARC sustituye las claves de API en bruto del proveedor por claves virtuales seguras y rotativas, y también permite conectarse a proveedores mediante el paso directo de SSO federado para un control centralizado de identidades y accesos.

Límites de gasto y alertas por clave

Establece un presupuesto mensual en dólares para cada clave virtual y elige entre bloquearla por completo o seguir distribuyendo contenido cuando se agote. Recibe alertas de umbral del 80 % y del 100 % a través de Notification Service de Fastly.

Cortafuegos de IA

AI Firewall ofrece un nivel de seguridad opcional que utiliza el motor de detección propio SmartParse de Fastly para proteger las aplicaciones basadas en IA de ataques por inyección de comandos con un impacto casi nulo en la latencia.

Sistema de recuperación de fallos y reintentos multiproveedor

Las claves virtuales enrutan a una lista ordenada de destinos alternativos. ARC reintenta automáticamente una petición fallida y luego conmuta por error al siguiente destino si los errores persisten, de forma transparente para la aplicación o el servicio que realiza la petición.

Limitación de frecuencia por clave virtual

Los límites independientes de peticiones por minuto y de tokens por minuto por clave protegen la cuota del proveedor y ayudan a proteger los productos y las funciones de IA orientados al cliente frente a vectores de ataque.

Creación detallada de registros y paneles

ARC captura registros completos de peticiones y respuestas, incluidos prompts y compleciones, para depuración y análisis. Visualiza el gasto acumulado en el mes, el volumen de peticiones y el recuento de tokens para detectar al instante un uso descontrolado y anomalías.

Preguntas frecuentes

¿Qué es el AI Runtime Control de Fastly?

ARC es un plano de control que gestiona el tráfico de IA en toda tu organización, ya que realiza un seguimiento del gasto en tiempo real, aplica controles de acceso y habilita un sistema de recuperación de fallos automático entre modelos de IA. Ofrece a los equipos una vista única del uso de tokens, los costes y las peticiones en todos los proveedores de IA que utilizan.

¿Cómo puedo controlar o reducir el gasto en IA en toda mi organización?

ARC monitoriza el recuento de tokens de entrada/salida, el volumen de peticiones y los costes calculados en tiempo real, asignados a claves virtuales y sesiones de cliente. Los paneles y clasificaciones en tiempo real muestran con exactitud qué aplicaciones, equipos o desarrolladores generan el mayor gasto, para que puedas detectar y corregir puntos críticos rápidamente.

¿Qué ocurre si mi proveedor de IA (como OpenAI o Anthropic) sufre una caída?

ARC mantiene en funcionamiento las funciones y cargas de trabajo de IA al reintentar automáticamente las peticiones y conmutar de forma transparente a modelos de respaldo en el edge cuando un proveedor principal se cae.

¿Cómo evito que un agente descontrolado agote mi presupuesto o cuota?

ARC aplica la limitación de frecuencia por clave virtual, lo que limita cuánto puede consumir cualquier aplicación, agente o usuario individual. Esto protege tu presupuesto y las cuotas del proveedor ascendente para que no se agoten debido a bucles descontrolados de agentes autónomos o picos de tráfico imprevistos.

¿Qué es el cortafuegos de IA de Fastly?

El cortafuegos de IA protege las aplicaciones de IA frente a ataques dirigidos específicamente a los modelos, como los intentos de inyección de comandos en los que una entrada en lenguaje natural intenta activar acciones no deseadas. A diferencia de un cortafuegos de aplicaciones web tradicional, el cortafuegos de IA de Fastly se ha creado específicamente para estas amenazas exclusivas de la IA.

¿Cómo detecta y bloquea el cortafuegos de IA de Fastly los ataques por inyección de prompts?

Utiliza un proceso de tres pasos: primero, el motor de detección SmartParse de Fastly inspecciona las peticiones en busca de amenazas específicas de LLM, se inyectan barreras de seguridad para sanear las respuestas y se validan las salidas para detectar respuestas de rechazo y proteger contra fugas.

¿Cuál es la diferencia entre el control en tiempo de ejecución de IA y el cortafuegos de IA? ¿Necesito ambos?

ARC es el plano de control que gestiona el tráfico, el coste y la fiabilidad de la IA entre diferentes proveedores. AI Firewall es un nivel de seguridad que se despliega dentro de ARC y que añade detección de amenazas y barreras de protección por encima. La mayoría de las organizaciones ejecutan AI Firewall como parte de su despliegue de ARC, tanto para la gobernanza como para la protección.

¿Quieres más?

Fastly se une a la Agentic AI Foundation
Fastly se ha unido a la Agentic AI Foundation (AAIF) para garantizar que los protocolos que gobiernan las interacciones agénticas se diseñen para la escala y la velocidad de los entornos de producción del mundo real
MCP en el edge
Los bucles de agentes realizan decenas de llamadas a herramientas por tarea. Descubre cómo el MCP sin estado en el edge convierte cada una en un salto de menos de un milisegundo.
Creación de un servidor MCP realmente seguro con Fastly Compute
MCP puede ser un campo de minas para la seguridad si no lo creas bien. Este artículo ofrece una guía paso a paso para desplegar un servidor MCP seguro y escalable en Fastly.

¿Listo para empezar?

Ponte en contacto o crea una cuenta