コンピューティングパワーリース — 弾性コンピューティングサービス

AIトレーニング、推論、ハイパフォーマンスコンピューティングのシナリオ向けに、AscendおよびNVIDIA GPUに基づく弾性コンピューティングパワーのリースサービスを提供

機能概要

AIトレーニング、推論、ハイパフォーマンスコンピューティングのシナリオ向けに、AscendおよびNVIDIA GPUに基づく弾性コンピューティングパワーのリースサービスを提供します。お客様は自前でデータセンターを構築する必要はありません。GPUコンピューティングパワーをオンデマンドで(単一カード、複数カード、クラスタ単位で)レンタルでき、秒単位/カード時間単位/月単位の課金に対応し、7×24のO&M体制でサポートします。'すぐにレンタルしてすぐに利用でき、使った分だけ支払う'を実現します。

お客様の課題

  • 中小規模のお客様はマシン一式を購入できない:1万カードクラスタには数億人民元の投資が必要で、中小規模のAI企業や研究機関は自力で構築できず、弾力的で小規模なコンピューティングパワーのリースが求められています。
  • リース後のO&M負担が重い:コンピューティングパワーをリースした後も、ドライバー適応、障害対応、性能チューニングには専門チームが必要ですが、お客様にはそれがありません。
  • 柔軟性に欠けるリース課金:従来の月額リースモデルでは、閑散期にコンピューティングパワーが遊休状態でも全額支払いが必要で、時間帯別課金や使った分だけ支払うなどきめ細かな課金オプションがありません。
  • 地域をまたぐスケジューリングが困難:お客様のビジネスは複数の拠点に分散しており、異なるノード間でのタスクスケジューリングが必要ですが、統一されたエントリーポイントとリソースビューが不足しています。

ソリューションの特長

  • 柔軟なマルチスペックリース:128、256、512ユニットから1万カードクラスタまでの複数スペックをサポートし、規模の異なる大企業、中堅企業、研究機関のニーズに応えます。短期、長期、オンデマンド拡張のオプションも用意しています。
  • 時間分割とダイナミックプライシング:実際の運用データに基づき、時間帯別(オフピーク/ピーク)、Token消費量別、カード時間別などの複数の課金モデルを提供し、お客様は実際の利用分だけ支払います。
  • フルスタックO&Mホスティング:7×24のコンピューティングパワー監視、ドライバーアップグレード、障害の自己復旧、性能チューニングを提供するため、お客様が自前のO&Mチームを構築する必要はありません。
  • 地域横断の統一スケジューリング:コンピューティングパワースケジューリングプラットフォームにより、お客様は全国の複数のインテリジェントコンピューティングノード間でタスクをワンクリック配分でき、最適なリソースプールが自動的に選択されます。
  • セキュリティ分離とコンプライアンス:物理マシン分離とコンテナレベルのマルチテナント分離をサポートし、トレーニングデータの域外持ち出し防止やモデルのセキュリティ暗号化などの高度な要件を満たします。

アーキテクチャ図

アーキテクチャ図