GPU-ressurser for AI og maskinlæring

Kjør inferens, modelltrening, videokoding og andre GPU-akselererte arbeidslaster i Safesprings skyinfrastruktur.

GPU-instanser i Safespring Compute

Safespring Compute tilbyr GPU-flavors for inferens, modelltrening, videokoding og kjøring av store språkmodeller.

GPU-ressursene leveres som flavors, det vil si forhåndsdefinerte ressursprofiler. Hver GPU-flavor har en fast kombinasjon av GPU, vCPU og RAM. Flavors i l2-serien har i tillegg lokal disk. Aktuelle konfigurasjoner og priser finnes i prislisten.

A2 passer for inferens, lettere trening og videokoding. A2-flavors er tilgjengelige i STO2 og aktiveres for prosjektet via support. H100 NVL tilbys i STO1 på forespørsel og er optimalisert for inferens med store språkmodeller. Kortet har 94 GB HBM3-minne, PCIe 5.0 x16 og passiv kjøling.

NVIDIA A2

STO2

GPU-minne

16 GB GDDR6

Arkitektur
Ampere
Konfigurasjoner
4 (b2 og l2)
Pris fra
3,86 kr/time
Effektgrense
60 W
Status
Aktiveres via support
Bruksområder
Inferens, lettere trening, videokoding

NVIDIA H100 NVL

STO1

GPU-minne

94 GB HBM3

Arkitektur
Hopper
Konfigurasjoner
1 (b2)
Pris fra
32,91 kr/time
Effektgrense
Opptil 400 W
Status
Tilgjengelig på forespørsel
Bruksområder
Inferens med store språkmodeller

Velg mellom lokal og sentral lagring

l2-flavors har lokal NVMe-lagring på compute-noden. Rotdisken følger instansens livssyklus og slettes sammen med instansen. Safespring kan ikke gjenopprette dataene hvis den lokale disken svikter. Bruk derfor l2 for tilstandsløse eller kortvarige arbeidslaster, eller sørg for at dataene sikkerhetskopieres.

b2-flavors har ingen lokal disk og starter fra et vedvarende volum i den sentrale blokklagringen. Volumet består uavhengig av instansen og kan være av typen fast eller large.

GPU-noder for Kubernetes

GPU-støtte i Safespring Kubernetes Engine er tilgjengelig i STO2 for workernoder med A2-flavors der navnet slutter på gA2. Den dokumenterte SKE-støtten omfatter ikke H100 NVL. Det administrerte kontrollplanet og Compute-instansene som brukes som workernoder, faktureres separat.

Dokumentasjon og eksempler om GPU og maskinlæring

Les teknisk dokumentasjon om GPU-instanser, en praktisk veiledning for å kjøre en lokal språkmodell og et eksempel på maskinlæring i Safesprings infrastruktur.

Konfigurasjoner og priser

I prislisten for GPU-instanser finner du aktuelle konfigurasjoner med vCPU, RAM, lokal disk, GPU-modell samt pris per time og per 30 dager.

Hvis du er usikker på hvilken flavor eller lagringsløsning som passer arbeidslasten din, kan du kontakte Safespring for å gå gjennom kravene.