AI-SERVER
ai-server.no
Leie- og leasingavtale

Lei AI-GB10 — Stor modell, lite budsjett · Leasingavtale

Samme server, ingen investering: fast månedspris med inkludert bruk, og betaling kun for det dere faktisk bruker utover det — slik dere kjenner det fra skyleverandørene, men med maskinen hos dere og dataene bak deres egen brannmur.

2 590,- / måned eks. mva
MODELL AI-GB10 · LEIE

Stor modell, lite budsjett

Eksempelprodukt · 1–5 brukere · utprøving og utvikling
128GB GPU-MINNE
Levering: 1–2 uker etter bekreftet bestilling

Hvorfor er denne så billig? Kapasitet fremfor fart.

AI-GB10 er eksempelproduktet vårt for å spare penger mot tregere ytelse: 128 GB delt minne gir plass til modeller som ellers krever server til 175 000+, men minnebåndbredden (~273 GB/s) er 3–7× lavere enn GPU-serverne våre — og det er båndbredden som avgjør hvor mange tokens per sekund modellen skriver. Godt kjøp for utprøving, utvikling og få brukere; velg en av GPU-serverne våre når mange skal ha raske svar.

MaskinNVIDIA DGX Spark (Founders Edition)
BrikkeNVIDIA GB10 Grace Blackwell Superchip, ~1 PFLOP FP4
CPU20-kjerners Arm v9.2 (10× Cortex-X925 + 10× Cortex-A725)
Minne128 GB LPDDR5x delt mellom CPU og GPU — ~273 GB/s
Lagring4 TB NVMe SSD
Nett10 GbE + ConnectX-7: to maskiner kan kobles til 256 GB
StørrelseMini-PC, 240 W — står på en kontorpult

Fordeler mot de andre serverne

  • 128 GB modellminne til under en tredjedel av prisen for nærmeste GPU-server med tilsvarende kapasitet (fra 177 900 kr i konfiguratoren vår)
  • Kjører og finjusterer store modeller som ikke får plass i de mindre serverne
  • Liten, stillegående og strømgjerrig (240 W) — ingen serverrom nødvendig
  • To stk. kan kobles sammen til 256 GB for DeepSeek-klassen kvantisert

Ulemper mot de andre serverne

  • Minnebåndbredden (~273 GB/s) er 3–7× lavere enn GPU-serverne våre — tette modeller svarer merkbart tregere (70B: ~5–7 tok/s mot 20+ på de store)
  • Egner seg for få samtidige brukere — ikke som chat-server for et helt team
  • Arm-basert (NVIDIA DGX OS/Ubuntu) — det meste av KI-verktøy virker, men enkelte x86-avhengigheter gjør ikke
  • Kan ikke oppgraderes — minne og GPU er fastloddet

Kjører typisk: Får plass til gpt-oss-120b, Llama 3.3 70B og 235B-klassen kvantisert — modeller som ellers krever server til 175 000+. Men med ~273 GB/s minnebåndbredde går tette 70B-modeller i 5–7 tokens/sek, mot 20+ på GPU-serverne våre. MoE-modeller som gpt-oss-120b går klart raskere.

Slik beregnes leien

Forbruket rapporteres løpende i månedsrapporten, og vi varsler før dere passerer inkludert bruk. Leieavtalen løper måned for måned etter en oppstartsperiode på 12 måneder. Ønsker dere å kjøpe før produktverdien er innbetalt, trekkes opptjent leie fra kjøpesummen.