可視性、コントロール、ガバナンスを、すべての AI コールに。

Fastly AI ランタイムコントロール (ARC)

AI のリスクやコストを、推測だけで判断するのはやめましょう。ARC は、アプリケーションと AI モデルの間に配置される統合コントロールプレーンで、すべての AI トラフィックの一元的な可視化、ガバナンス、コントロールを可能にします。リアルタイムの支出を追跡し、予算やレート制限を適用し、マルチプロバイダーのフェイルオーバーを自動化して、低レイテンシのエッジパフォーマンスによるメリットを享受できます。

メリット

すべての AI とエージェントトラフィックを一元管理

社内での AI 使用状況をコントロールし、AI を活用したアプリケーションを管理します。Fastly の AI Runtime Control により、リアルタイムの可視性、コストとアクセスのコントロール、自動フェイルオーバーを活用して、複数のプロバイダーにまたがる複雑な環境を安全に管理し、サービスの継続的な稼働を実現します。

AI アクティビティを100%監査

法的要件、コンプライアンス要件、セキュリティ要件を満たします。顧客データがどのように処理されているかを確認し、どのユーザーが何をリクエストしたのかを正確に追跡します。

複数プロバイダーの利用状況を一元的に計測

ARC は AI トラフィックを単一の画面に統合し、仮想キーや特定のクライアントセッションにマッピングされた入力および出力トークン数、リクエスト量、算出されたコストをリアルタイムかつ詳細に追跡します。

高支出のホットスポットをすばやく特定

リアルタイムのダッシュボードやリーダーボードを使用して、どのアプリケーション、チーム、開発者が最も多くのトークンやドルを消費しているかを正確に特定します。

プロバイダーの障害に左右されない環境

レート制限やアップストリームプロバイダーの障害が発生しても、顧客向け AI 機能をスムーズに稼働させ続けることができます。プライマリモデルがダウンした場合でも、ARC はエッジ側で自動的に再試行し、バックアップモデルへフェイルオーバーすることで、途切れることのないユーザー体験を実現します。

月次予算の上限を適用する

個々の仮想キーに月間利用額の上限を直接設定し、確実に適用することで、事後的なコスト管理から、問題を未然に防ぐ財務上のセーフガードへと移行できます。

AI エージェントの暴走による予算・クォータの枯渇を防止

仮想キーごとのレート制限により、暴走した自律型エージェントのループや外部からのトラフィックスパイクによってアップストリームプロバイダーのクォータが枯渇するのを防ぎます。

Protect against LLM-based threats with AI Firewall

AI Firewall is a security module within ARC that protects your AI-powered applications from prompt injection attacks with near-zero latency impact. It leverages Fastly’s SmartParse detection engine and custom guardrails to detect attacks like prompt injection and other LLM specific attacks. Deploy with a flip of a switch.

AI ランタイムコントロールについて詳しく見る

すべての AI トラフィックに単一のコントロールプレーンで対応

アクセスを制御し、コストを抑え、攻撃を未然に防ぎます。Fastly の AI Runtime Control を使用すると、すべてのモデルやプロバイダーにわたってアクセス、支出、リスクを一元管理できるため、リアルタイムの可視性とコントロールを確保しながら本番環境で AI を実行できます。

マネージド仮想キーによるセキュアなアクセス

ARC は、生のプロバイダー API キーを安全でローテーション可能な仮想キーに置き換え、ID とアクセスコントロールを一元化するためのフェデレーション SSO パススルー経由によるプロバイダーへの接続もサポートしています。

キーごとの支出上限とアラート

仮想キーごとに月間のドル予算を設定し、使い切った際の対応として完全ブロックまたは配信継続を選択できます。Fastly の通知サービスを通じて、80%および100%のしきい値アラートを受信できます。

AI ファイアウォール

AI ファイアウォールは、Fastly 独自の SmartParse 検出エンジンを活用したオプションのセキュリティレイヤーで、レイテンシへの影響をほぼゼロに抑えながら、AI 搭載アプリケーションをプロンプトインジェクション攻撃から保護します。

マルチプロバイダーのフェイルオーバーと再試行

仮想キーは、優先順位が設定されたフォールバック先のリストにルーティングされます。ARC は失敗したリクエストを自動的に再試行し、エラーが解消されない場合は次のターゲットへフェイルオーバーします。これはリクエストを行うアプリケーションやサービスに対して透過的に行われます。

仮想キーごとのレート制限

キーごとに1分あたりのリクエスト数とトークン数の上限を個別に設定することで、プロバイダーのクォータを保護するとともに、顧客向けの AI プロダクトや機能をさまざまな攻撃から守ることができます。

詳細なログ記録とダッシュボード

ARC は、デバッグと分析のために、プロンプトと補完を含む完全なリクエストおよびレスポンスのログを取得します。月初から現在までの支出、リクエスト量、トークン数を可視化し、急増した利用量や異常を即座に特定できます。

よくある質問

Fastly の AI ランタイムコントロールとはどのようなものですか?

ARC は、組織全体の AI トラフィックを管理するコントロールプレーンであり、リアルタイムの支出追跡、アクセスコントロールの適用、AI モデル間の自動フェイルオーバーを実現します。これにより、チームは利用中のすべての AI プロバイダーについて、トークン使用量、コスト、リクエスト状況を一元的に把握できます。

組織全体の AI 関連コストを管理・削減するにはどうすればよいですか?

ARC は、仮想キーやクライアントセッションにマッピングされた、入出力トークン数、リクエスト量、計算されたコストをリアルタイムで追跡します。リアルタイムのダッシュボードとリーダーボードにより、どのアプリ、チーム、開発者が最も支出を押し上げているかを正確に把握できるため、ホットスポットを迅速に特定して修正できます。

AI プロバイダー (OpenAI や Anthropic など) で障害が発生した場合はどうなりますか?

ARC は、プライマリプロバイダーがダウンした際に、リクエストを自動的に再試行し、エッジでバックアップモデルへ透過的にフェイルオーバーすることで、AI 機能とワークロードの稼働を維持します。

暴走した AI エージェントによる予算やクォータの使い切りを防ぐには?

ARC は仮想キーごとにレート制限を適用し、単一のアプリケーション、エージェント、またはユーザーが消費できる量に上限を設定します。これにより、暴走した自律型エージェントのループや予期しないトラフィックスパイクによって予算やアップストリームプロバイダーのクォータが枯渇するのを防ぎます。

Fastly の AI ファイアウォールとはどのようなものですか?

AI ファイアウォールは、自然言語入力によって意図しないアクションを引き起こそうとするプロンプトインジェクションの試行など、モデルを特に標的とする攻撃から AI アプリケーションを保護します。Fastly の AI ファイアウォールは、従来の Web アプリケーションファイアウォールとは異なり、こうした AI 特有の脅威専用に構築されています。

Fastly の AI ファイアウォールはプロンプトインジェクション攻撃をどのように検出してブロックしますか?

これには3つのステップからなるプロセスが使用されます。まず、Fastly の SmartParse 検出エンジンによって、LLM 特有の脅威がないか検査されます。次に、レスポンスをサニタイズするためにガードレールが挿入され、拒否レスポンスや情報漏えい防止のために出力が検証されます。

AI ランタイムコントロールと AI ファイアウォールには、どのような違いがありますか?両方を導入する必要がありますか?

ARC は、プロバイダー全体にわたる AI トラフィック、コスト、信頼性を管理するコントロールプレーンです。AI ファイアウォールは、ARC 内にデプロイされ、脅威検出やガードレール機能を提供するセキュリティレイヤーです。ほとんどの組織は、ガバナンスと保護の両方を目的として、ARC デプロイの一部として AI ファイアウォールを運用しています。

参考リソース

Fastly が Agentic AI Foundation に参加
Fastly は、AI エージェントによるインタラクションを管理するプロトコルが実際の本番環境のスケーラビリティとスピードに対応できるようにするため、Agentic AI Foundation (AAIF) に参加しました。
エッジでの MCP
エージェントループはタスクごとに数十回ものツールコールを実行します。エッジでのステートレス MCP により、その1つひとつを1ミリ秒未満のホップに変える方法をご紹介します。
Fastly Compute で真にセキュアな MCP サーバーを構築
MCP は、適切に構築されていない場合、重大なセキュリティリスクを招く可能性があります。この記事では、Fastly で安全かつスケーラブルな MCP サーバーをデプロイするための手順をステップごとに解説します。

Fastly を試してみませんか?

お問い合わせ・アカウントの作成はこちら