Melayani pelanggan di seluruh Asia dan global. Australia dan Singapura sedang mendiskusikan opsi penempatan; lokasi sebenarnya, ketersediaan dan tanggal pengiriman dikonfirmasi dalam penawaran Anda. Halaman yang diterjemahkan tidak berarti stok GPU lokal.
Pemilihan GPU
NVIDIA H100
Memori per GPU
80 GB · PCIe / SXM
Referensi publik / jam GPU · AUD
A$ 3.12 – A$ 5.94
Titik awal untuk pelatihan dan inferensi ketika model sesuai dengan konfigurasi memori yang dipilih. PCIe dan SXM berbeda dalam bandwidth memori dan konektivitas multi-GPU; tentukan varian yang tepat.
Pertimbangkan untuk inferensi intensif memori, cache KV yang lebih besar, dan model yang melebihi perangkat 80 GB. Bandingkan konfigurasi instans lengkap, bukan memori saja.
Pertimbangkan beban kerja pelatihan dan inferensi yang lebih besar menggunakan perangkat lunak yang kompatibel dengan Blackwell. Konfirmasikan presisi numerik, jumlah GPU, topologi NVLink, dan versi kerangka kerja.
Diskusikan kapasitas multi-GPU khusus untuk model besar, robotika, dan simulasi. B300 dan GB300 adalah konfigurasi sistem yang berbeda; kutipan harus mengidentifikasi mana yang diberikan.
Reservasi GB300: target kesiapan dalam 6 minggu sejak pemesanan dan konfirmasi kapasitas. Waktu pengiriman akhir dinyatakan dalam pesanan yang dikonfirmasi.
Daftarkan minat pada Rubin. Ini adalah pertanyaan tentang kapasitas masa depan, bukan instans yang dapat dibeli secara langsung. Harga dan ketersediaan memerlukan konfirmasi.
Perkirakan jumlah GPU × tarif per jam × jam yang dapat ditagih. Kemudian tambahkan penyimpanan persisten, snapshot, transfer data, IP publik, dan layanan terkelola apa pun. Tanyakan apakah sumber daya tetap ditagih saat GPU dihentikan.
Contoh yang berhasil, bukan penawaran: 8 GPU seharga A$5 per jam GPU selama 100 jam = A$4.000 untuk waktu GPU, sebelum layanan dan pajak lainnya. Komitmen yang dicadangkan mungkin menggunakan persyaratan penagihan yang berbeda.
Sebelum memesan, konfirmasikan jangka waktu sewa minimum, rincian penagihan, ketentuan pembatalan, termasuk tunjangan penyimpanan dan transfer, tarif kelebihan penggunaan, dan apakah harga sudah termasuk GST atau pajak lain yang berlaku.
Ini adalah referensi pasar publik bertanggal yang dikonversi ke AUD, bukan penawaran Arvica atau bukti saham. Mereka mungkin mencakup varian instans yang berbeda. Penawaran Anda mengonfirmasi konfigurasi lengkap, pajak yang berlaku, dan unit penagihan.
Berapa banyak memori GPU yang dibutuhkan suatu model?
Perkiraan pertama untuk bobot model adalah jumlah parameter × byte per parameter. Untuk 70 miliar parameter, bobot FP16/BF16 saja memerlukan sekitar 140 GB (desimal); Bobot 4-bit dimulai sekitar 35 GB sebelum metadata kuantisasi. Cache KV, aktivasi, dan overhead runtime memerlukan memori tambahan.
Bobot saja · GB (desimal)
Parameter model (miliar)
FP16 / BF16
INT8
4 bit
8
16
8
4
32
64
32
16
70
140
70
35
405
810
405
202.5
Perhitungan ini bukanlah tolok ukur kinerja. Panjang konteks, ukuran batch, konkurensi, presisi, dan metode pelatihan mengubah kebutuhan memori. Pelatihan juga memerlukan gradien dan status pengoptimal. Bagikan pengaturan tersebut agar konfigurasi dapat diperiksa.
Sertakan nama dan ukuran model, pelatihan atau inferensi, presisi, panjang konteks, konkurensi yang diharapkan, ukuran kumpulan data, penyimpanan, persyaratan jaringan, dan gambar perangkat lunak. Jika Anda memerlukan negara tertentu untuk residensi data, nyatakan secara eksplisit.
Perintah tersebut harus menyebutkan lokasi komputasi, lokasi penyimpanan, lokasi pencadangan, dan akses dukungan yang diizinkan. Melayani pelanggan di suatu negara berbeda dengan hosting di negara tersebut. Minta detail ini sebelum mentransfer data.
Perintah tersebut harus menyebutkan lokasi komputasi, lokasi penyimpanan, lokasi pencadangan, dan akses dukungan yang diizinkan. Melayani pelanggan di suatu negara berbeda dengan hosting di negara tersebut. Minta detail ini sebelum mentransfer data.
Bagaimana cara mendapatkan dukungan dan kapan saya akan menerima penawaran?
Hubungi support@arvica.ai atau kirimkan formulir di bawah ini. Arvica meninjau konfigurasi, kapasitas dan persyaratan komersial sebelum mengutip. Mintalah tanggapan yang diharapkan dan tanggal pengiriman; tidak ada penyelesaian penawaran harga tetap atau waktu aktivasi yang dijanjikan di halaman ini.
GPU mana yang tercepat untuk model saya?
Perbandingan yang berguna menggunakan model, presisi, ukuran batch, panjang konteks, versi perangkat lunak, dan jumlah GPU yang sama. Mintalah pengukuran yang terverifikasi dalam kondisi tersebut. Panduan ini tidak mengklaim kinerja yang tidak terukur atau mempublikasikan hasil penemuan pelanggan.
Bisakah saya menggunakan pesanan pembelian atau kapasitas yang dipesan?
Sertakan badan hukum Anda, referensi pesanan pembelian, persyaratan yang diminta, dan persyaratan penagihan. Arvica mengonfirmasi kontrak, deposit, faktur, dan syarat pembayaran dalam penawaran. Mengirimkan formulir ini tidak membebankan biaya pada kartu Anda atau menyediakan sumber daya.
Bisakah pelanggan di Tiongkok daratan menggunakan layanan ini?
Periksa akses halaman, pengiriman formulir, SSH dan jalur pengunduhan model dari jaringan pelanggan sebenarnya sebelum memesan. Ketersediaan di luar negeri tidak membuktikan konektivitas daratan. Konfirmasikan transfer data dan persyaratan akses untuk beban kerja yang diinginkan.
Kirim kebutuhan Anda
Beri tahu kami batasan beban kerja dan penerapannya. Arvica akan menyiapkan opsi konfigurasi dan harga yang sesuai. Anda dapat menulis kebutuhan Anda dalam bahasa yang digunakan di halaman ini.