Melayan pelanggan di seluruh Asia dan global. Australia dan Singapura adalah pilihan penempatan untuk dibincangkan; lokasi sebenar, ketersediaan dan tarikh penghantaran disahkan dalam sebut harga anda. Halaman yang diterjemahkan tidak membayangkan stok GPU tempatan.
Pemilihan GPU
NVIDIA H100
Memori setiap GPU
80 GB · PCIe / SXM
Rujukan awam / jam GPU · AUD
A$ 3.12 – A$ 5.94
Titik permulaan untuk latihan dan inferens apabila model sesuai dengan konfigurasi memori yang dipilih. PCIe dan SXM berbeza dalam lebar jalur memori dan sambungan berbilang GPU; nyatakan varian yang tepat.
Pertimbangkan untuk inferens intensif memori, cache KV yang lebih besar dan model yang melebihi peranti 80 GB. Bandingkan konfigurasi contoh penuh, bukannya ingatan sahaja.
Pertimbangkan untuk latihan yang lebih besar dan beban kerja inferens menggunakan perisian yang serasi dengan Blackwell. Sahkan ketepatan berangka, kiraan GPU, topologi NVLink dan versi rangka kerja.
Bincangkan kapasiti berbilang GPU khusus untuk model besar, robotik dan simulasi. B300 dan GB300 adalah konfigurasi sistem yang berbeza; sebut harga mesti mengenal pasti yang dibekalkan.
Tempahan GB300: sasaran kesediaan dalam masa 6 minggu dari pesanan dan pengesahan kapasiti. Masa penghantaran akhir dinyatakan dalam pesanan yang disahkan.
Daftar minat dalam Rubin. Ini adalah pertanyaan tentang kapasiti masa hadapan, bukan contoh yang boleh dibeli dengan serta-merta. Harga dan ketersediaan memerlukan pengesahan.
Anggarkan kiraan GPU × kadar setiap jam × jam boleh dibilkan. Kemudian tambahkan storan berterusan, syot kilat, pemindahan data, IP awam dan sebarang perkhidmatan terurus. Tanya sama ada sumber mengekalkan pengebilan apabila GPU dihentikan.
Contoh berkesan, bukan tawaran: 8 GPU pada A$5 setiap GPU-jam selama 100 jam = A$4,000 untuk masa GPU, sebelum perkhidmatan dan cukai lain. Komitmen terpelihara mungkin menggunakan istilah pengebilan yang berbeza.
Sebelum membuat pesanan, sahkan tempoh sewa minimum, butiran pengebilan, syarat pembatalan, termasuk elaun penyimpanan dan pemindahan, kadar lebihan dan sama ada harga termasuk GST atau cukai lain yang berkenaan.
Ini adalah rujukan pasaran awam bertarikh yang ditukar kepada AUD, bukan tawaran Arvica atau bukti stok. Mereka mungkin meliputi varian contoh yang berbeza. Petikan anda mengesahkan konfigurasi lengkap, cukai yang dikenakan dan unit pengebilan.
Berapa banyak memori GPU yang diperlukan oleh model?
Anggaran pertama untuk berat model ialah kiraan parameter × bait setiap parameter. Untuk 70 bilion parameter, berat FP16/BF16 sahaja memerlukan kira-kira 140 GB (perpuluhan); Berat 4-bit bermula sekitar 35 GB sebelum metadata kuantisasi. Cache KV, pengaktifan dan overhed masa jalan memerlukan memori tambahan.
Berat model sahaja · GB (perpuluhan)
Parameter model (bilion)
FP16 / BF16
INT8
4 bit
8
16
8
4
32
64
32
16
70
140
70
35
405
810
405
202.5
Pengiraan ini bukan penanda aras prestasi. Panjang konteks, saiz kelompok, konkurensi, ketepatan dan kaedah latihan mengubah keperluan memori. Latihan juga memerlukan kecerunan dan keadaan pengoptimuman. Kongsi tetapan tersebut supaya konfigurasi boleh disemak.
Sertakan nama dan saiz model, latihan atau inferens, ketepatan, panjang konteks, jangkaan keselarasan, saiz set data, storan, keperluan rangkaian dan imej perisian. Jika anda memerlukan negara tertentu untuk pemastautin data, nyatakan dengan jelas.
Pesanan harus menamakan lokasi pengiraan, lokasi storan, lokasi sandaran dan akses sokongan yang dibenarkan. Melayan pelanggan di sesebuah negara adalah berbeza daripada pengehosan di negara tersebut. Minta butiran ini sebelum memindahkan data.
Pesanan harus menamakan lokasi pengiraan, lokasi storan, lokasi sandaran dan akses sokongan yang dibenarkan. Melayan pelanggan di sesebuah negara adalah berbeza daripada pengehosan di negara tersebut. Minta butiran ini sebelum memindahkan data.
Bagaimanakah saya mendapat sokongan dan bila saya akan menerima sebut harga?
Hubungi support@arvica.ai atau serahkan borang di bawah. Arvica menyemak konfigurasi, kapasiti dan terma komersial sebelum memetik. Minta maklum balas yang dijangkakan dan tarikh penghantaran; tiada pemulihan sebut harga tetap atau masa pengaktifan dijanjikan di halaman ini.
GPU manakah yang paling pantas untuk model saya?
Perbandingan yang berguna menggunakan model, ketepatan, saiz kelompok, panjang konteks, versi perisian dan kiraan GPU yang sama. Minta ukuran yang disahkan di bawah syarat tersebut. Panduan ini tidak menuntut prestasi yang tidak diukur atau menerbitkan hasil rekaan pelanggan.
Bolehkah saya menggunakan pesanan pembelian atau kapasiti terpelihara?
Sertakan entiti undang-undang anda, rujukan pesanan pembelian, syarat yang diminta dan keperluan pengebilan. Arvica mengesahkan kontrak, deposit, invois dan syarat pembayaran dalam sebut harga. Menghantar borang ini tidak mengenakan caj pada kad anda atau menyediakan sumber.
Bolehkah pelanggan di tanah besar China menggunakan perkhidmatan tersebut?
Semak akses halaman, penyerahan borang, SSH dan laluan muat turun model daripada rangkaian pelanggan sebenar sebelum membuat pesanan. Ketersediaan di luar negara tidak membuktikan ketersambungan tanah besar. Sahkan pemindahan data dan keperluan akses untuk beban kerja yang dimaksudkan.
Hantar keperluan anda
Beritahu kami beban kerja dan kekangan penggunaan. Arvica akan menyediakan pilihan konfigurasi dan harga yang sesuai. Anda boleh menulis keperluan anda dalam bahasa yang digunakan pada halaman ini.