メインコンテンツへスキップ
営業に問い合わせる

AIプラットフォーム

コンテナジョブをお持ち込みください。最適なティアでお預かりします。

AIプラットフォームは、サーバーの管理ではなく、お客様のコンテナジョブをそのまま投入できる、すぐに使える実行環境です。各ジョブは、中断可能な作業向けの大幅割引フレキシブルティアか、本番向けのプロダクションティアのどちらかをお選びいただき、運用はすべてKubernetesのオーケストレーションが担います。

コンテナ
お持ち込み、パッケージ化は1回
2つのティア
フレキシブルと本番
Kubernetes
スケジューリングとスケーリングを自動化

ティアの仕組み

同じジョブを実行する2つの方法

コストと確実性のどちらを優先するかを、ジョブごとにお客様が決められます。あとはプラットフォームにお任せください。

フレキシブルティア

中断可能、大幅割引

一時停止と再開が可能なジョブ(バッチ処理、実験、事前学習など)は、空き容量を利用して大幅な割引で実行できます。容量があるときにスケジュールされ、ないときは安全に中断・再開されます。

  • 大幅割引のコンピュート
  • 容量に応じて一時停止・再開
  • バッチ・研究・事前学習に最適

プロダクションティア

最上位パフォーマンス、優先実行を保証

必ず期限内に完了させたいジョブ(本番推論や顧客向けワークロードなど)には、プロダクションティアが容量を確保し、スケジューリングを優先します。安定したパフォーマンスをお約束します。

  • 容量確保と優先スケジューリング
  • 安定した最上位パフォーマンス
  • 本番推論・ライブワークロードに最適

仕組み

コンテナから実行まで、3つのステップ

サーバーの調達もクラスターの管理も不要です。チームはこれまでと同じように、コンテナでソフトウェアを作り続けるだけです。

01

ジョブをパッケージ化

ワークロードを標準のコンテナイメージとして構築します。エンジニアが日頃使っているのと同じ形式です。

02

ジョブを投入

プラットフォームにジョブを送信し、ティアを選択します。キャパシティ計画もインフラの申請も不要です。

03

スケジュールとスケーリングはお任せ

KubernetesベースのオーケストレーションがGPU容量にジョブをスケジュールし、必要に応じて自動スケーリング、障害時には自動復旧します。

料金モデル

ティアごとの従量課金。実行した分だけ、実行したティアに応じて

利用量はメータリングされ、選択したティアに応じて課金されます。コスト重視の実験ジョブはフレキシブルティアで、確実性が必要な本番ジョブはプロダクションティアで。ファイナンスダッシュボードでリアルタイムに確認できます。

ティアごとのメータリング

各ジョブは実行されたティアに応じて課金されます。

実行した分だけ支払い

使っていない間の課金はありません。ジョブが実際に使用したコンピュート分だけお支払いいただきます。

利用状況を可視化

利用量と支出をリアルタイムで確認でき、予算上限の設定や請求書のダウンロードも可能です。

ユースケース

AIを世に出すチームのために設計

実験から本番まで、作り直しなしでスケールできるひとつのプラットフォームです。

バッチ学習・ファインチューニング

長時間のジョブをフレキシブルティアで実行。空き容量に合わせてスケジュールされ、大幅な割引が適用されます。

本番推論

顧客向けワークロードをプロダクションティアで実行。優先スケジューリングと安定したパフォーマンスを実現します。

実験とML向けCI

素早い試行錯誤と自動化されたモデル評価。インフラ管理なしでジョブを立ち上げたり終了したりできます。

プラットフォームで最初のジョブを実行しましょう

ワークロード、実行するコンテナイメージ、パフォーマンス要件をお聞かせください。シニアメンバーが1営業日以内にご返信いたします。