AI企業向け弾性コンピューティングレンタル

弾性コンピューティングレンタル

ソリューション

  • 柔軟なレンタルモデル:顧客は最低限のリソースを保証する月額基本計算契約を締結しつつ、動的スケーリングにも対応。トレーニングジョブ開始時には、プラットフォームがリソースプールから必要な数のGPUを自動割り当てし、トレーニング終了後に解放します。課金は実際に使用したGPU時間分のみです。
  • 専用計算プール:中軟国際(ChinaSoft International)は西安AI計算センター内に、物理的に分離されたAscend計算ゾーンを顧客向けに提供します。データ保存、モデルトレーニング、推論サービスはすべて専用環境内で稼働し、データセキュリティとコンプライアンス要件を満たします。
  • フルスタックマネージド運用:中軟国際が7×24時間の計算モニタリング、ドライバーアップグレード、自動障害復旧、性能チューニングを提供するため、顧客のアルゴリズムエンジニアは基盤インフラを管理することなく、APIやJupyter Notebookから直接計算リソースを呼び出せます。
  • 統合モデルデプロイメント:トレーニング完了後、モデルは自動的にパッケージ化され、同じ専用ゾーンの推論サービスクラスタにデプロイされ、トレーニングから推論へのシームレスな引き継ぎを実現します。

導入効果

  • 同等規模のハードウェア自社購入(3年償却)や月額専用レンタルと比較し、弾性レンタルモデルでは実際のトレーニング時間分のみを支払うため、月間計算コストがRMB 480,000からRMB 170,000に削減されました。
  • 中軟国際は事前設定済みのディープラーニングフレームワークイメージ(PyTorch、TensorFlow、MindSpore)と分散トレーニング最適化を提供し、モデルのイテレーションサイクルを1週間から4日間に短縮しました。
  • 顧客はIT運用スタッフを雇用する必要がなく、計算プラットフォームは初期設定不要ですぐに利用でき、平均復旧時間(MTTR)は30分未満です。
  • 月間アクティブAPI呼び出しは20万回から150万回に増加し、推論サービスの可用性は99.95%以上を維持、計算不足によるサービス中断は一度も発生しませんでした。
  • 全履歴モデルの再検証を48時間以内に要求する緊急規制コンプライアンス検査の際、顧客はワンクリックで200基GPUクラスタに拡張し、予定より6時間早くタスクを完了しました。

お客様の声

中軟国際の弾性コンピューティングレンタルにより、GPUドライバーやネットワーク調整に悩むことなく、モデルアルゴリズムに全力を注げます。この柔軟な計算サービスがなければ、18か月で4回のメジャーバージョンイテレーションを完了することはできませんでした。
アーキテクチャ図