GPU Instance
1. GPU インスタンスの料金を確認するにはどうすればよいですか?
GPU インスタンスとその構成(コンテナディスク、ボリュームディスク、ネットワークボリュームなど)の料金は、料金ページで確認できます。2. GPU インスタンスの課金はいつ開始されますか?
インスタンスのステータスが「Pulling」に変わると課金が開始されます。3. コンテナディスク、ボリュームディスク、ネットワークボリュームについて。
-
コンテナディスク
- 動的拡張はサポートしておらず、インスタンス作成時にのみ容量を指定できます。
- マウントディレクトリ:
/(カスタマイズ不可) - イメージを保存すると、データも保存されます。
- 60GB の無料枠をサポートしており、超過分には料金が発生します。詳細は 課金説明 を参照してください。
-
ボリュームディスク
- 動的拡張をサポートしています。
- デフォルトのマウントディレクトリ:
/workspace(カスタマイズ可能) - イメージを保存しても、データは保存されません。
- 読み書き速度はコンテナディスクと同じです。
- ボリュームディスク容量には追加料金が必要です。詳細は 課金説明 を参照してください。
-
ネットワークボリューム
- 動的拡張をサポートしています。
- デフォルトのマウントディレクトリ:
/network(カスタマイズ可能) - ネットワークボリュームはインスタンスとは独立したライフサイクルを持ちます。インスタンスが削除されても、ネットワークボリュームのデータは引き続き存在します。
- 全体的な読み書き速度は、コンテナディスクまたはボリュームディスクより遅くなります(具体的な使用状況によります)。
- ネットワークボリューム容量には追加料金が必要です。詳細は 課金説明 を参照してください。
4. インスタンス停止後に再起動できないのはなぜですか?
これは 従量課金インスタンスにのみ適用されます。月額サブスクリプションインスタンスではリソースが事前に予約されているため、この問題は発生しません。
5. インスタンスのステータス異常にはどのように対処すればよいですか?
まず、インスタンスの「System Logs」と「Instance Logs」から問題のトラブルシューティングを試してください。問題を解決できない場合は、お問い合わせください。
6. 指定した CUDA バージョンのインスタンス仕様がありません。
CUDA バージョンには下位互換性があります。たとえば、サービスが CUDA バージョン 12.1 に依存している場合、CUDA バージョンが 12.1 以上のインスタンス仕様を選択できます。7. プラットフォームでサポートされる最大の CUDA バージョンは何ですか?
Explore の右下にある「Filter」モジュールで、利用可能な CUDA バージョンを確認できます。
8. 「Save Image」の失敗を診断するにはどうすればよいですか?
まず、「Save Image」 タスクのログから問題のトラブルシューティングを試してください。イメージをプライベートリポジトリアドレスに保存している場合は、Container Registry Auth Configuration が正しいかどうかを確認してください。問題を解決できない場合は、お問い合わせください。
9. 専用 IP はサポートされていますか?
はい。現在、この機能は一般公開されていません。このような要件がある場合は、お問い合わせください。10. インスタンスの GPU 使用率を確認するにはどうすればよいですか?
Docker コンテナの PID 分離により、nvidia-smi コマンドを使用してプロセスを表示することはできません。py3nvml ライブラリをインストールし、shell コマンドを使用して GPU 使用率を確認できます。
11. 1 つのインスタンスに複数のネットワークボリュームをマウントできますか?
はい。コンソールと API のどちらも、1 つのインスタンスに複数のネットワークボリュームをマウントすることをサポートしています。Serverless GPUs
1. Serverless GPU と GPU Instance の違いは何ですか?
Serverless GPU は、インフラストラクチャを管理せずにモデル推論エンドポイントをデプロイするために設計されています。エンドポイントを定義すると、プラットフォームがスケーリング、スケジューリング、リソース割り当てを自動的に処理します。GPU Instance は、ランタイムを直接管理できる永続的で対話型の VM スタイル環境を提供します。本番環境の推論ワークロードには Serverless GPU を、開発、トレーニング、または永続ストレージや対話型アクセスが必要なワークフローには GPU Instance を選択してください。2. Serverless GPU はどのように課金されますか?
Serverless GPU は実際の実行時間に基づいて課金されます。つまり、エンドポイントがリクエストを処理している間のみ料金が発生します。アイドル期間中の料金は発生しません。料金は消費された GPU 時間の秒単位で計算されます。詳細な料金については、Serverless GPU 料金ページ を参照してください。3. Serverless GPU エンドポイントがタイムアウトエラーを返す場合はどうすればよいですか?
タイムアウトエラーは通常、次のような場合に発生します。- コールドスタート時間がリクエストのタイムアウトしきい値を超える場合(例: コンテナイメージが大きく、pull に時間がかかる)。
- モデル推論時間が設定されたリクエストタイムアウトを超える場合。
- イメージプリウォーム 機能を使用して、コールドスタートのレイテンシを短縮します。
- ワークロードでより長い処理時間が必要な場合は、エンドポイントのリクエストタイムアウト設定を増やします。
- 問題が解決しない場合は、エンドポイント ID とエラーの詳細を添えて お問い合わせください。
Payments
1. チャージ失敗を回避するにはどうすればよいですか?
チャージ失敗は、一般的に主に次の 2 つの理由で発生します。-
カード発行会社による拒否。 次の理由で発生する場合があります。詳細については確認するか、カード発行会社にお問い合わせください。
- 対応する支払いチャネルが有効化されていない。
- クレジットカードの有効期限が切れている、または凍結されている。
- クレジットカード残高が不足している。
- カード番号が正しくない。
- セキュリティコードが正しくない。
-
支払いチャネルによるリスク管理措置。 確認し、必要な調整を行ってください。
- デバイス ID が多数のカードに関連付けられている。
- このメールアドレスで拒否されたカード数が非常に多い。
- このデバイス ID で、このカードが Stripe ネットワーク上で初めて検出されてからの時間が非常に短い。
- このメールアドレスに関連付けられた承認率が非常に低い。
- メールアドレス上の名前がカード上の名前と一致しない。