Atendendo clientes em toda a Ásia e globalmente. Austrália e Cingapura são opções de implantação a serem discutidas; a localização real, a disponibilidade e a data de entrega são confirmadas no seu orçamento. Uma página traduzida não implica estoque local de GPU.
Seleção de GPU
NVIDIA H100
Memória por GPU
80 GB · PCIe / SXM
Referência pública / GPU-hora · AUD
A$ 3.12 – A$ 5.94
Um ponto de partida para treinamento e inferência quando o modelo se ajusta à configuração de memória selecionada. PCIe e SXM diferem em largura de banda de memória e conectividade multi-GPU; especifique a variante exata.
Considere, para inferência com uso intensivo de memória, caches KV maiores e modelos que superem um dispositivo de 80 GB. Compare a configuração completa da instância, em vez de apenas a memória.
Considere cargas de trabalho maiores de treinamento e inferência usando software compatível com Blackwell. Confirme a precisão numérica, contagem de GPU, topologia NVLink e versões da estrutura.
Discuta a capacidade multi-GPU dedicada para grandes modelos, robótica e simulação. B300 e GB300 são configurações de sistema diferentes; a cotação deve identificar qual é fornecido.
Reservas GB300: meta de disponibilidade em 6 semanas a partir da confirmação do pedido e da capacidade. O prazo de entrega final é indicado no pedido confirmado.
Registre interesse em Rubin. Esta é uma investigação sobre capacidade futura, não uma instância imediatamente adquirível. Preço e disponibilidade requerem confirmação.
Estime a contagem de GPU × taxa horária × horas faturáveis. Em seguida, adicione armazenamento persistente, snapshots, transferência de dados, IPs públicos e quaisquer serviços gerenciados. Pergunte se os recursos continuam sendo cobrados quando a GPU é interrompida.
Exemplo resolvido, não uma oferta: 8 GPUs a A$5 por hora de GPU por 100 horas = A$4.000 por tempo de GPU, antes de outros serviços e impostos. Os compromissos reservados podem usar termos de cobrança diferentes.
Antes de fazer o pedido, confirme o prazo mínimo de aluguel, granularidade de faturamento, termos de cancelamento, limites de armazenamento e transferência incluídos, taxas excedentes e se os preços incluem GST ou outros impostos aplicáveis.
Estas são referências datadas do mercado público convertidas para AUD, e não uma oferta da Arvica ou prova de stock. Eles podem abranger diferentes variantes de instância. Sua cotação confirma a configuração completa, impostos aplicáveis e unidades de faturamento.
Uma primeira estimativa para os pesos do modelo é a contagem de parâmetros × bytes por parâmetro. Para 70 bilhões de parâmetros, apenas os pesos FP16/BF16 requerem cerca de 140 GB (decimal); Os pesos de 4 bits começam em torno de 35 GB antes dos metadados de quantização. Cache KV, ativações e sobrecarga de tempo de execução requerem memória adicional.
Apenas pesos · GB (decimal)
Parâmetros do modelo (milhares de milhões)
FP16 / BF16
INT8
4 bits
8
16
8
4
32
64
32
16
70
140
70
35
405
810
405
202.5
Esses cálculos não são benchmarks de desempenho. Comprimento do contexto, tamanho do lote, simultaneidade, precisão e método de treinamento alteram as necessidades de memória. O treinamento também precisa de gradientes e estado do otimizador. Compartilhe essas configurações para que a configuração possa ser verificada.
Forneça-nos os detalhes que alteram a recomendação
Inclua nome e tamanho do modelo, treinamento ou inferência, precisão, comprimento do contexto, simultaneidade esperada, tamanho do conjunto de dados, armazenamento, requisitos de rede e imagem do software. Se você precisar de um país específico para residência de dados, indique-o explicitamente.
O pedido deve nomear o local de computação, o local de armazenamento, o local de backup e o acesso de suporte permitido. Atender clientes em um país é diferente de hospedar naquele país. Solicite esses detalhes antes de transferir dados.
O pedido deve nomear o local de computação, o local de armazenamento, o local de backup e o acesso de suporte permitido. Atender clientes em um país é diferente de hospedar naquele país. Solicite esses detalhes antes de transferir dados.
Como obtenho suporte e quando receberei um orçamento?
Contate support@arvica.ai ou envie o formulário abaixo. A Arvica analisa a configuração, a capacidade e os termos comerciais antes de fazer uma cotação. Solicite uma resposta esperada e data de entrega; nenhuma resposta de cotação fixa ou tempo de ativação é prometido nesta página.
Qual GPU é mais rápida para meu modelo?
Uma comparação útil usa o mesmo modelo, precisão, tamanho do lote, comprimento do contexto, versão do software e contagem de GPU. Solicite medições verificadas nessas condições. Este guia não reivindica desempenho não medido nem publica resultados inventados de clientes.
Posso usar um pedido de compra ou capacidade reservada?
Inclua sua entidade legal, referência do pedido de compra, prazo solicitado e requisitos de cobrança. Arvica confirma o contrato, depósito, faturamento e condições de pagamento no orçamento. O envio deste formulário não cobra seu cartão nem provisiona um recurso.
Os clientes na China continental podem usar o serviço?
Verifique o acesso à página, envio de formulário, SSH e caminhos de download de modelo da rede real do cliente antes de fazer o pedido. A disponibilidade no exterior não prova a conectividade no continente. Confirme os requisitos de transferência e acesso de dados para a carga de trabalho pretendida.
Envie suas necessidades
Informe-nos a carga de trabalho e as restrições de implantação. A Arvica preparará opções de configuração e preços adequados. Você pode escrever sua exigência no idioma usado nesta página.