Naglilingkod sa mga customer sa buong Asya at sa buong mundo. Ang Australia at Singapore ay mga opsyon sa pag-deploy upang talakayin; ang aktwal na lokasyon, availability at petsa ng paghahatid ay nakumpirma sa iyong quote. Ang isang isinaling pahina ay hindi nagpapahiwatig ng lokal na stock ng GPU.
Pagpili ng GPU
NVIDIA H100
Memory bawat GPU
80 GB · PCIe / SXM
Pampublikong sanggunian / GPU-hour · AUD
A$ 3.12 – A$ 5.94
Isang panimulang punto para sa pagsasanay at hinuha kapag ang modelo ay umaangkop sa napiling pagsasaayos ng memorya. Ang PCIe at SXM ay naiiba sa memory bandwidth at multi-GPU connectivity; tukuyin ang eksaktong variant.
Isaalang-alang ang memory-intensive inference, mas malalaking KV cache at mga modelong lumalampas sa 80 GB na device. Ihambing ang buong configuration ng instance, sa halip na memory lang.
Isaalang-alang ang mas malaking pagsasanay at paghihinuha na mga workload gamit ang software na tugma sa Blackwell. Kumpirmahin ang numerical precision, GPU count, NVLink topology at mga bersyon ng framework.
Talakayin ang nakatuong multi-GPU na kapasidad para sa malalaking modelo, robotics at simulation. Ang B300 at GB300 ay magkaibang mga configuration ng system; dapat tukuyin ng quote kung alin ang ibinibigay.
Mga pagpapareserba ng GB300: target na kahandaan sa loob ng 6 na linggo mula sa pag-order at pagkumpirma ng kapasidad. Ang huling oras ng paghahatid ay nakasaad sa nakumpirmang order.
Magrehistro ng interes sa Rubin. Ito ay isang pagtatanong tungkol sa kapasidad sa hinaharap, hindi isang agad na mabibiling pagkakataon. Ang pagpepresyo at availability ay nangangailangan ng kumpirmasyon.
Tantyahin ang bilang ng GPU × oras-oras na rate × masisingil na oras. Pagkatapos ay magdagdag ng patuloy na storage, mga snapshot, paglilipat ng data, mga pampublikong IP at anumang pinamamahalaang serbisyo. Itanong kung patuloy na nagsisingil ang mga mapagkukunan kapag huminto ang GPU.
Mahusay na halimbawa, hindi isang alok: 8 GPU sa A$5 bawat GPU-hour sa loob ng 100 oras = A$4,000 para sa oras ng GPU, bago ang iba pang serbisyo at buwis. Ang mga nakalaan na pangako ay maaaring gumamit ng iba't ibang mga tuntunin sa pagsingil.
Bago mag-order, kumpirmahin ang pinakamababang termino ng pagrenta, granularity ng pagsingil, mga tuntunin sa pagkansela, kasama ang mga allowance sa pag-iimbak at paglipat, mga rate ng labis, at kung kasama sa mga presyo ang GST o iba pang naaangkop na mga buwis.
Ang mga ito ay may petsang mga sanggunian sa pampublikong merkado na na-convert sa AUD, hindi isang alok ng Arvica o patunay ng stock. Maaaring saklawin ng mga ito ang iba't ibang variant ng instance. Kinukumpirma ng iyong quote ang kumpletong configuration, mga naaangkop na buwis at mga unit ng pagsingil.
Gaano karaming memorya ng GPU ang kailangan ng isang modelo?
Ang unang pagtatantya para sa mga timbang ng modelo ay ang bilang ng parameter × byte bawat parameter. Para sa 70 bilyong parameter, ang FP16/BF16 na timbang lamang ay nangangailangan ng humigit-kumulang 140 GB (decimal); Ang mga 4-bit na timbang ay nagsisimula sa paligid ng 35 GB bago ang quantization metadata. Ang KV cache, activation at runtime overhead ay nangangailangan ng karagdagang memory.
Mga weight lamang · GB (decimal)
Mga parameter ng modelo (bilyon)
FP16 / BF16
INT8
4-bit
8
16
8
4
32
64
32
16
70
140
70
35
405
810
405
202.5
Ang mga kalkulasyong ito ay hindi mga benchmark ng pagganap. Ang haba ng konteksto, laki ng batch, pagkakatugma, katumpakan at paraan ng pagsasanay ay nagbabago sa mga pangangailangan ng memorya. Kailangan din ng pagsasanay ang mga gradient at estado ng optimizer. Ibahagi ang mga setting na iyon para masuri ang configuration.
Ibigay sa amin ang mga detalyeng nagbabago sa rekomendasyon
Isama ang pangalan at laki ng modelo, pagsasanay o hinuha, katumpakan, haba ng konteksto, inaasahang pagkakatugma, laki ng dataset, storage, mga kinakailangan sa network at ang imahe ng software. Kung kailangan mo ng partikular na bansa para sa data residency, tahasan itong sabihin.
Dapat pangalanan ng order ang lokasyon ng pagkalkula, lokasyon ng imbakan, lokasyon ng backup at pinahihintulutang access sa suporta. Ang paglilingkod sa mga customer sa isang bansa ay iba sa pagho-host sa bansang iyon. Hilingin ang mga detalyeng ito bago maglipat ng data.
Dapat pangalanan ng order ang lokasyon ng pagkalkula, lokasyon ng imbakan, lokasyon ng backup at pinahihintulutang access sa suporta. Ang paglilingkod sa mga customer sa isang bansa ay iba sa pagho-host sa bansang iyon. Hilingin ang mga detalyeng ito bago maglipat ng data.
Paano ako makakakuha ng suporta at kailan ako makakatanggap ng isang quote?
Makipag-ugnayan sa support@arvica.ai o isumite ang form sa ibaba. Sinusuri ni Arvica ang pagsasaayos, kapasidad at mga terminong pangkomersyo bago mag-quote. Humingi ng inaasahang tugon at petsa ng paghahatid; walang nakapirming quote turnaround o activation time ang ipinangako sa page na ito.
Aling GPU ang pinakamabilis para sa aking modelo?
Ang isang kapaki-pakinabang na paghahambing ay gumagamit ng parehong modelo, katumpakan, laki ng batch, haba ng konteksto, bersyon ng software at bilang ng GPU. Humingi ng mga na-verify na sukat sa ilalim ng mga kundisyong iyon. Ang gabay na ito ay hindi nag-aangkin ng hindi nasusukat na pagganap o nag-publish ng mga naimbentong resulta ng customer.
Maaari ba akong gumamit ng purchase order o nakareserbang kapasidad?
Isama ang iyong legal na entity, sanggunian ng purchase order, hiniling na termino at mga kinakailangan sa pagsingil. Kinukumpirma ni Arvica ang kontrata, deposito, pag-invoice at mga tuntunin sa pagbabayad sa quote. Ang pagsusumite ng form na ito ay hindi naniningil sa iyong card o nagbibigay ng mapagkukunan.
Maaari bang gamitin ng mga customer sa mainland China ang serbisyo?
Suriin ang pag-access sa pahina, pagsusumite ng form, SSH at mga path ng pag-download ng modelo mula sa aktwal na network ng customer bago mag-order. Ang pagkakaroon sa ibang bansa ay hindi nagpapatunay ng pagkakakonekta sa mainland. Kumpirmahin ang paglilipat ng data at mga kinakailangan sa pag-access para sa nilalayong workload.
Ipadala ang iyong mga kinakailangan
Sabihin sa amin ang workload at mga hadlang sa deployment. Maghahanda si Arvica ng angkop na mga opsyon sa pagsasaayos at pagpepresyo. Maaari mong isulat ang iyong pangangailangan sa wikang ginamit sa pahinang ito.