Instância de GPU
1. Como verificar o preço das instâncias de GPU?
Você pode verificar o preço das instâncias de GPU e suas configurações (disco do contêiner, disco de volume, volume de rede etc.) na Página de preços.2. Quando começa a cobrança da instância de GPU?
A cobrança começa quando o status da instância muda para o status “Pulling”.3. Introdução ao disco do contêiner, disco de volume e volume de rede.
-
Disco do contêiner
- Não oferece suporte à expansão dinâmica; a capacidade só pode ser especificada ao criar uma instância;
- Diretório de montagem:
/(não pode ser personalizado); - Os dados serão salvos ao salvar a imagem;
- Oferece suporte a uma cota gratuita de 60GB; cobranças serão aplicadas à parte excedente. Para detalhes, consulte: Instruções de cobrança
-
Disco de volume
- Oferece suporte à expansão dinâmica;
- Diretório de montagem padrão:
/workspace(personalizável); - Os dados não serão salvos ao salvar a imagem;
- A velocidade de leitura e gravação é a mesma do disco do contêiner;
- A capacidade do Disco de volume requer cobranças adicionais. Para detalhes, consulte: Instruções de cobrança.
-
Volume de rede
- Oferece suporte à expansão dinâmica;
- Diretório de montagem padrão:
/network(personalizável); - O volume de rede tem um ciclo de vida independente, não relacionado à instância; mesmo que a instância seja excluída, os dados do volume de rede ainda existirão;
- A velocidade geral de leitura e gravação é mais lenta que a do disco do contêiner ou do disco de volume (dependendo do uso específico);
- A capacidade do volume de rede requer cobranças adicionais. Para detalhes, consulte: Instruções de cobrança
4. Por que a instância não pode ser reiniciada após ser interrompida?
Isso se aplica somente a instâncias de pagamento conforme o uso. Instâncias de assinatura mensal têm recursos pré-reservados e não encontrarão esse problema.
5. Como lidar com um status anormal da instância?
Primeiro, tente solucionar o problema por meio dos “Logs do sistema” e “Logs da instância” da instância. Se o problema não puder ser resolvido, você pode entrar em contato conosco.
6. Não há especificações de instância com uma versão CUDA especificada.
As versões CUDA são compatíveis com versões anteriores. Por exemplo, se o seu serviço depende da versão CUDA 12.1, você pode escolher uma especificação de instância com uma versão CUDA maior ou igual a 12.1.7. Qual é a versão CUDA máxima compatível com a plataforma?
Você pode verificar as versões CUDA permitidas no módulo “Filtro” no canto inferior direito da página Explorar.
8. Como diagnosticar a falha em “Salvar imagem”?
Primeiro, tente solucionar o problema por meio dos logs da tarefa “Salvar imagem”. Se você estiver salvando a imagem em um endereço de repositório privado, verifique se sua Configuração de autenticação do Container Registry está correta. Se o problema não puder ser resolvido, você pode entrar em contato conosco.
9. Há suporte para IP dedicado?
Sim. Atualmente, esse recurso não está aberto ao público. Se você tiver esse tipo de requisito, entre em contato conosco.10. Como verificar o uso de GPU da instância?
Devido ao isolamento de PID dos contêineres Docker, o comandonvidia-smi não pode ser usado para visualizar o processo. Você pode instalar a biblioteca py3nvml e usar o comando shell para verificar o uso de GPU:
11. Uma única instância pode montar vários volumes de rede?
Sim. Tanto o console quanto a API oferecem suporte à montagem de vários volumes de rede em uma única instância.GPUs Serverless
1. Qual é a diferença entre Serverless GPU e Instância de GPU?
Serverless GPU foi projetado para implantar endpoints de inferência de modelos sem gerenciar infraestrutura. Você define um endpoint, e a plataforma lida automaticamente com escalonamento, agendamento e alocação de recursos. A Instância de GPU oferece a você um ambiente persistente e interativo no estilo VM, no qual você gerencia o runtime diretamente. Escolha Serverless GPU para cargas de trabalho de inferência em produção; escolha Instância de GPU para desenvolvimento, treinamento ou fluxos de trabalho que exigem armazenamento persistente e acesso interativo.2. Como o Serverless GPU é cobrado?
O Serverless GPU é cobrado com base no tempo real de execução — você só é cobrado quando seu endpoint está processando solicitações ativamente. Não há cobranças durante períodos ociosos. O preço é calculado por segundo de tempo de GPU consumido. Para taxas detalhadas, consulte a página de preços do Serverless GPU.3. O que devo fazer se meu endpoint Serverless GPU retornar um erro de timeout?
Erros de timeout geralmente ocorrem quando:- O tempo de cold start excede o limite de timeout da solicitação (por exemplo, a imagem do contêiner é grande e leva tempo para ser baixada).
- O tempo de inferência do modelo excede o timeout configurado da solicitação.
- Use o recurso de pré-aquecimento de imagem para reduzir a latência de cold start.
- Aumente a configuração de timeout da solicitação para o seu endpoint se sua carga de trabalho exigir tempos de processamento mais longos.
- Se o problema persistir, entre em contato conosco com o ID do seu endpoint e os detalhes do erro.
Pagamentos
1. Como posso evitar falhas de recarga?
Falhas de recarga geralmente são causadas por dois motivos principais:-
Recusa do emissor do cartão. Isso pode ocorrer pelos seguintes motivos. Verifique ou entre em contato com o emissor do seu cartão para obter detalhes:
- O canal de pagamento correspondente não está ativado.
- O cartão de crédito expirou ou foi bloqueado.
- O saldo do cartão de crédito é insuficiente.
- O número do cartão está incorreto.
- O código de segurança está incorreto.
-
Medidas de controle de risco do canal de pagamento. Verifique e faça os ajustes necessários:
- O ID do dispositivo está associado a um número elevado de cartões.
- O número de cartões recusados usando este endereço de email é muito alto.
- O tempo desde que este cartão foi visto pela primeira vez na rede Stripe com este ID de dispositivo é muito curto.
- A taxa de autorização associada a este endereço de email é muito baixa.
- O nome no endereço de email não corresponde ao nome no cartão.