Transparenz. Kontrolle. Governance. Für jeden KI-Abruf.

Fastly AI Runtime Control (ARC)

Beenden Sie das Rätselraten über Ihre KI-Risiken und -Ausgaben. ARC ist eine einheitliche Steuerungsebene, die zwischen Ihren Anwendungen und KI-Modellen angesiedelt ist und Ihnen zentralisierte Transparenz, Governance und Kontrolle über Ihren gesamten KI-Datenverkehr bietet. Tracken Sie Ausgaben in Echtzeit, setzen Sie Budget- und Rate-Limits durch, automatisieren Sie das Multi-Provider-Failover und profitieren Sie von Edge-Performance mit niedriger Latenz.

Vorteile

Übernehmen Sie die Kontrolle über den gesamten KI- und Agenten-Traffic

Kontrollieren Sie die interne KI-Usage und steuern Sie Ihre KI-fähigen Apps. Mit Fastlys AI Runtime Control können Sie die Multi-Provider-Komplexität mit Echtzeittransparenz, Kosten- und Zugriffskontrollen sowie automatisiertem Failover sicher verwalten, um eine kontinuierliche Verfügbarkeit zu gewährleisten.

Überprüfen Sie 100 % Ihrer KI-Aktivitäten

Erfüllen Sie rechtliche, Compliance- und Sicherheitsanforderungen. Überprüfen Sie, wie Kundendaten verarbeitet werden, und verfolgen Sie genau nach, wer was angefordert hat.

Erhalten Sie eine einheitliche Multi-Provider-Verbrauchsmessung

ARC konsolidiert KI-Traffic in einer zentralen Ansicht mit granularer Echtzeit-Nachverfolgung von Input- und Output-Token-Zahlen, Anfragevolumen und berechneten Kosten, zugeordnet zu virtuellen Schlüsseln und spezifischen Client-Sitzungen.

Kostenintensive Hotspots schnell isolieren

Nutzen Sie Echtzeit-Dashboards und Leaderboards, um genau zu identifizieren, welche Apps, Teams oder Entwickler die meisten Token und Dollar verbrauchen.

Ausfälle von Anbietern zur Nebensache machen

Sorgen Sie dafür, dass Ihre kundenorientierten KI-Funktionen auch bei Ratenbeschränkungen oder Ausfällen von Vorlieferanten reibungslos funktionieren. Wenn ein primäres Modell ausfällt, führt ARC transparent Wiederholungsversuche durch und leitet per Failover zu Ihren Backup-Modellen auf der Edge weiter, um eine kontinuierliche User Experience zu gewährleisten.

Monatliche Budgetlimits erzwingen

Gehen Sie von reaktiven Ausgaben zu proaktiven finanziellen Leitplanken über, indem Sie durchsetzbare monatliche Dollar-Budgetlimits direkt auf einzelne virtuelle Schlüssel anwenden.

Verhindern Sie, dass außer Kontrolle geratene Agenten Ihr KI-Budget oder -Kontingent sprengen

Rate Limiting pro virtuellem Schlüssel schützt Ihre Upstream-Provider-Kontingente davor, durch außer Kontrolle geratene Schleifen autonomer Agenten oder externe Traffic-Spitzen aufgebraucht zu werden.

Schutz vor LLM-basierten Bedrohungen mit AI Firewall

AI Firewall ist ein Sicherheitsmodul innerhalb von ARC, das Ihre KI-gestützten Apps vor Prompt-Injection-Angriffen mit nahezu keinen Auswirkungen auf die Latenz schützt. Sie nutzt die SmartParse-Erkennungs-Engine von Fastly und Custom Guardrails, um Angriffe wie Prompt-Injection und andere LLM-spezifische Angriffe zu erkennen. Stellen Sie auf Knopfdruck bereit.

AI Runtime Control erkunden

Eine Kontrollebene für Ihren gesamten KI-Traffic

Sichern Sie Zugriffe ab, deckeln Sie Ausgaben und stoppen Sie Angriffe, bevor sie beginnen. Mit AI Runtime Control von Fastly erhalten Sie einen zentralen Ort, um Zugriffe, Ausgaben und Risiken über alle Modelle und Anbieter hinweg zu verwalten, sodass Sie KI mit Echtzeittransparenz und Kontrolle in der Produktivumgebung einsetzen können.

Sicherer Zugriff mit verwalteten virtuellen Schlüsseln

ARC ersetzt rohe Provider-API-Schlüssel durch sichere, rotierbare virtuelle Schlüssel und unterstützt zudem die Verbindung zu Anbietern über föderiertes SSO-Pass-Through für eine zentrale Identitäts- und Zugriffskontrolle.

Ausgabenlimits und Benachrichtigungen pro Schlüssel

Legen Sie ein monatliches Dollar-Budget pro virtuellem Schlüssel fest und entscheiden Sie selbst, ob nach dessen Erschöpfung Zugriffe vollständig blockiert oder weiterhin verarbeitet werden sollen. Erhalten Sie Schwellenwert-Benachrichtigungen bei 80 % und 100 % über den Notification Service von Fastly.

AI Firewall

AI Firewall bietet einen optionalen Sicherheits-Layer unter Verwendung der proprietären SmartParse Erkennungs-Engine von Fastly, um KI-gestützte Apps mit nahezu keinen Auswirkungen auf die Latenz vor Prompt-Injection-Angriffen zu schützen.

Multi-Provider-Failover und Wiederholungsversuche

Virtuelle Schlüssel leiten zu einer geordneten Liste von Ersatz-Zielen weiter. ARC versucht eine fehlgeschlagene Anfrage automatisch erneut und wechselt dann zum nächsten Ziel, wenn die Fehler weiterhin bestehen, transparent für die App oder den Service, die bzw. der die Anfrage stellt.

Rate Limiting pro virtuellem Schlüssel

Unabhängige Obergrenzen für Anfragen pro Minute und Token pro Minute pro Schlüssel schützen das Anbieter-Kontingent und tragen dazu bei, Ihre kundenorientierten KI-Produkte und -Funktionen vor Angriffsvektoren zu schützen.

Detailliertes Logging und Dashboards

ARC erfasst vollständige Anfrage- und Antwort-Logs, einschließlich Prompts und Completions, für Debugging und Analyse. Visualisieren Sie die bisherigen Monatsausgaben, Anfragevolumen und Token-Zahlen, um ausufernde Nutzung und Anomalien sofort zu erkennen.

Häufig gestellte Fragen

Was ist die AI Runtime Control von Fastly?

ARC ist eine Steuerungsebene, die den KI-Datenverkehr in Ihrem gesamten Unternehmen regelt, die Kosten in Echtzeit erfasst, Zugriffskontrollen durchsetzt und ein automatisches Failover zwischen KI-Modellen ermöglicht. Sie bietet Teams eine zentrale Ansicht von Token-Usage, Kosten und Anfragen über jeden von ihnen genutzten KI-Anbieter hinweg.

Wie kann ich KI-Ausgaben in meiner gesamten Organisation kontrollieren oder reduzieren?

ARC trackt die Anzahl der Input-/Output-Tokens, das Anfragevolumen und die berechneten Kosten in Echtzeit, zugeordnet zu virtuellen Schlüsseln und Client-Sitzungen. Dashboards und Bestenlisten in Echtzeit zeigen genau, welche Apps, Teams oder Entwickler die höchsten Ausgaben verursachen, sodass Sie Hotspots schnell erkennen und beheben können.

Was passiert, wenn mein KI-Anbieter (wie OpenAI oder Anthropic) einen Ausfall hat?

ARC hält KI-Funktionen und -Workloads am Laufen, indem es Anfragen automatisch wiederholt und auf der Edge transparent ein Failover auf Backup-Modelle durchführt, wenn ein primärer Anbieter ausfällt.

Wie verhindere ich, dass ein außer Kontrolle geratener Agent mein Budget oder mein Kontingent sprengt?

ARC wendet Rate Limiting pro virtuellem Schlüssel an, wodurch begrenzt wird, wie viel eine einzelne App, ein Agent oder ein Nutzer verbrauchen kann. Dadurch wird verhindert, dass Ihr Budget und die Kontingente Ihrer Vorlieferanten durch außer Kontrolle geratene Schleifen autonomer Agenten oder unerwartete Traffic-Spitzen aufgebraucht werden.

Was ist die AI Firewall von Fastly?

AI Firewall schützt KI-Anwendungen vor Angriffen, die gezielt auf Modelle abzielen, wie etwa Prompt-Injection-Versuche, bei denen eine Eingabe in natürlicher Sprache unbeabsichtigte Aktionen auszulösen versucht. AI Firewall von Fastly wurde im Gegensatz zu einer herkömmlichen Webanwendungs-Firewall speziell für diese KI-spezifischen Bedrohungen entwickelt.

Wie erkennt und blockiert die AI Firewall von Fastly Prompt-Injection-Angriffe?

Sie verwendet einen dreistufigen Prozess: Anfragen werden zuerst von Fastlys SmartParse Erkennungs-Engine auf LLM-spezifische Bedrohungen überprüft, Guardrails werden eingefügt, um Antworten zu bereinigen, und Ausgaben werden auf Ablehnungsantworten und Schutz vor Datenlecks validiert.

Was ist der Unterschied zwischen AI Runtime Control und AI Firewall? Brauche ich beides?

ARC ist die Kontrollebene, die KI-Traffic, Kosten und Zuverlässigkeit über verschiedene Anbieter hinweg verwaltet. AI Firewall ist ein Sicherheits-Layer, der innerhalb von ARC bereitgestellt wird und zusätzliche Bedrohungserkennung und Guardrails bietet. Die meisten Unternehmen nutzen AI Firewall als Teil ihres ARC-Deployments sowohl für Governance als auch für Schutz.

Möchten Sie mehr erfahren?

Fastly tritt der Agentic AI Foundation bei
Fastly ist der Agentic AI Foundation (AAIF) beigetreten, um sicherzustellen, dass die Protokolle zur Steuerung agentischer Interaktionen für die Größe und Geschwindigkeit realer Produktionsumgebungen entwickelt werden
MCP auf der Edge
Agenten-Schleifen führen pro Aufgabe Dutzende von Tool-Aufrufen durch. Erfahren Sie, wie das zustandslose MCP am Netzwerkrand jeden einzelnen zu einem Hop im Sub-Millisekundenbereich macht.
Aufbau eines wirklich sicheren MCP-Servers mit Fastly Compute
MCP kann ein Sicherheitsminenfeld sein, wenn Sie es falsch entwickeln. Dieser Artikel bietet eine Schritt-für-Schritt-Anleitung für das Bereitstellen eines sicheren, skalierbaren MCP-Servers auf Fastly.

Sind Sie bereit, loszulegen?

Setzen Sie sich mit uns in Verbindung oder erstellen Sie einen Account.