Last updated:
AIリソースの使用(例:API呼び出し、計算時間)に対する制御と制限は、ガバナンスポリシーを遵守し、費用の高騰や乱用を防ぐために設定されています。
ユーザー、チーム、またはアプリケーションごとに、リソース消費に対するスロットリング、レート制限、ならびに日次または月次の上限を実装します。クォータは、サービス拒否(DoS)、制御不能な支出、モデル抽出攻撃から保護します。ガバナンスは、SLAおよび予算に整合したクォータポリシーを定義し、利用状況ダッシュボードを監視し、しきい値到達時にユーザーへ自動通知またはアクセスをブロックすることで、公平な利用とコスト予測可能性を確保します。
Real world example:
ある研究機関では、プロジェクトごとに月間100 GPU時間のクォータを設定しています。プロジェクトの使用量が80時間を超えると、自動通知がチームリーダーにメール送信されます。100時間に達すると、クォータ増枠の承認が完了するまで、以降のトレーニングジョブはキューに入れられます。これにより、予期しないクラウド費用の発生やリソース競合を防止します。




