可視性、コントロール、ガバナンスを、すべての AI コールに。
Fastly AI ランタイムコントロール (ARC)
AI のリスクやコストを、推測だけで判断するのはやめましょう。ARC は、アプリケーションと AI モデルの間に配置される統合コントロールプレーンで、すべての AI トラフィックの一元的な可視化、ガバナンス、コントロールを可能にします。リアルタイムの支出を追跡し、予算やレート制限を適用し、マルチプロバイダーのフェイルオーバーを自動化して、低レイテンシのエッジパフォーマンスによるメリットを享受できます。
すべての AI とエージェントトラフィックを一元管理
社内での AI 使用状況をコントロールし、AI を活用したアプリケーションを管理します。Fastly の AI Runtime Control により、リアルタイムの可視性、コストとアクセスのコントロール、自動フェイルオーバーを活用して、複数のプロバイダーにまたがる複雑な環境を安全に管理し、サービスの継続的な稼働を実現します。
AI アクティビティを100%監査
法的要件、コンプライアンス要件、セキュリティ要件を満たします。顧客データがどのように処理されているかを確認し、どのユーザーが何をリクエストしたのかを正確に追跡します。
複数プロバイダーの利用状況を一元的に計測
ARC は AI トラフィックを単一の画面に統合し、仮想キーや特定のクライアントセッションにマッピングされた入力および出力トークン数、リクエスト量、算出されたコストをリアルタイムかつ詳細に追跡します。
高支出のホットスポットをすばやく特定
リアルタイムのダッシュボードやリーダーボードを使用して、どのアプリケーション、チーム、開発者が最も多くのトークンやドルを消費しているかを正確に特定します。
プロバイダーの障害に左右されない環境
レート制限やアップストリームプロバイダーの障害が発生しても、顧客向け AI 機能をスムーズに稼働させ続けることができます。プライマリモデルがダウンした場合でも、ARC はエッジ側で自動的に再試行し、バックアップモデルへフェイルオーバーすることで、途切れることのないユーザー体験を実現します。
月次予算の上限を適用する
個々の仮想キーに月間利用額の上限を直接設定し、確実に適用することで、事後的なコスト管理から、問題を未然に防ぐ財務上のセーフガードへと移行できます。
AI エージェントの暴走による予算・クォータの枯渇を防止
仮想キーごとのレート制限により、暴走した自律型エージェントのループや外部からのトラフィックスパイクによってアップストリームプロバイダーのクォータが枯渇するのを防ぎます。
Protect against LLM-based threats with AI Firewall
AI Firewall is a security module within ARC that protects your AI-powered applications from prompt injection attacks with near-zero latency impact. It leverages Fastly’s SmartParse detection engine and custom guardrails to detect attacks like prompt injection and other LLM specific attacks. Deploy with a flip of a switch.
すべての AI トラフィックに単一のコントロールプレーンで対応
アクセスを制御し、コストを抑え、攻撃を未然に防ぎます。Fastly の AI Runtime Control を使用すると、すべてのモデルやプロバイダーにわたってアクセス、支出、リスクを一元管理できるため、リアルタイムの可視性とコントロールを確保しながら本番環境で AI を実行できます。
よくある質問
Fastly の AI ランタイムコントロールとはどのようなものですか?
ARC は、組織全体の AI トラフィックを管理するコントロールプレーンであり、リアルタイムの支出追跡、アクセスコントロールの適用、AI モデル間の自動フェイルオーバーを実現します。これにより、チームは利用中のすべての AI プロバイダーについて、トークン使用量、コスト、リクエスト状況を一元的に把握できます。
組織全体の AI 関連コストを管理・削減するにはどうすればよいですか?
ARC は、仮想キーやクライアントセッションにマッピングされた、入出力トークン数、リクエスト量、計算されたコストをリアルタイムで追跡します。リアルタイムのダッシュボードとリーダーボードにより、どのアプリ、チーム、開発者が最も支出を押し上げているかを正確に把握できるため、ホットスポットを迅速に特定して修正できます。
AI プロバイダー (OpenAI や Anthropic など) で障害が発生した場合はどうなりますか?
ARC は、プライマリプロバイダーがダウンした際に、リクエストを自動的に再試行し、エッジでバックアップモデルへ透過的にフェイルオーバーすることで、AI 機能とワークロードの稼働を維持します。
暴走した AI エージェントによる予算やクォータの使い切りを防ぐには?
ARC は仮想キーごとにレート制限を適用し、単一のアプリケーション、エージェント、またはユーザーが消費できる量に上限を設定します。これにより、暴走した自律型エージェントのループや予期しないトラフィックスパイクによって予算やアップストリームプロバイダーのクォータが枯渇するのを防ぎます。
Fastly の AI ファイアウォールとはどのようなものですか?
AI ファイアウォールは、自然言語入力によって意図しないアクションを引き起こそうとするプロンプトインジェクションの試行など、モデルを特に標的とする攻撃から AI アプリケーションを保護します。Fastly の AI ファイアウォールは、従来の Web アプリケーションファイアウォールとは異なり、こうした AI 特有の脅威専用に構築されています。
Fastly の AI ファイアウォールはプロンプトインジェクション攻撃をどのように検出してブロックしますか?
これには3つのステップからなるプロセスが使用されます。まず、Fastly の SmartParse 検出エンジンによって、LLM 特有の脅威がないか検査されます。次に、レスポンスをサニタイズするためにガードレールが挿入され、拒否レスポンスや情報漏えい防止のために出力が検証されます。
AI ランタイムコントロールと AI ファイアウォールには、どのような違いがありますか?両方を導入する必要がありますか?
ARC は、プロバイダー全体にわたる AI トラフィック、コスト、信頼性を管理するコントロールプレーンです。AI ファイアウォールは、ARC 内にデプロイされ、脅威検出やガードレール機能を提供するセキュリティレイヤーです。ほとんどの組織は、ガバナンスと保護の両方を目的として、ARC デプロイの一部として AI ファイアウォールを運用しています。
参考リソース







