Ønsker du råd på AI-server? Ta kontakt — oppgi budsjett og modeller, så foreslår vi riktig maskin med én gang.
Riktig valg handler om to tall. Mengden GPU-minne avgjør hvilke modeller som får plass: en 70B-modell i 4-bit trenger rundt 40 GB, DeepSeek R1 i full størrelse over 400 GB. Minnebåndbredden avgjør farten: for hvert token modellen skriver, leses hele modellen fra minnet — 40 GB modell på et kort med 1,8 TB/s gir rundt 40 tokens i sekundet, mens samme modell på en rimelig maskin med delt minne (typisk 270 GB/s) kryper ned mot 5–7. Det er derfor prisen som oftest avgjør hvor raskt modellen kan kjøre, ikke om den kan kjøre. Tommelfingerregelen vår: kjøp først nok minne til modellen dere faktisk vil bruke, og legg deretter resten av budsjettet i båndbredde — en mindre modell som svarer øyeblikkelig slår ofte en større som hakker. Antall samtidige brukere, kontekstlengde og om dere skal finjustere trekker alle i retning mer minne; chat og sanntidsbruk trekker i retning mer båndbredde. Usikker? Vi hjelper dere med hele valget, ikke bare maskinen: hvilken modell som faktisk passer formålet — chat, koding, dokumentanalyse, RAG mot egne data — hvordan modellen tas i bruk i forretningen, fra pilot og integrasjon mot egne systemer til opplæring, sikkerhet og drift, og alle andre valg på veien. Still spørsmålet, så ser vi på det sammen med dere.
Et konkret eksempel på regnestykket over: NVIDIA DGX Spark (Founders Edition) har 128 GB delt minne og får plass til modeller som ellers krever server til 175 000+ — men med ~273 GB/s båndbredde leverer den bare en brøkdel av farten. Du sparer penger, modellen svarer tregere. For utprøving, utvikling og få brukere er det ofte et godt bytte.
Passer ingen av pakkene helt? Oppgi budsjett og hvilke modeller dere vil kjøre, så foreslår vi riktig maskin med én gang — ferdig priset.
AI-server leverer ferdig konfigurerte servere for lokal kjøring av store språkmodeller — bygget, testet og supportert i Norge.
Skybaserte KI-tjenester fakturerer per token og krever at dataene dine sendes ut av virksomheten. En lokal server snur regnestykket: én investering, full kontroll, ubegrenset bruk.
API-tjenester koster per token, hver dag, for alltid. En egen server er en engangsinvestering — jo mer dere bruker den, jo billigere blir hver forespørsel.
Kundedata, kontrakter, kildekode og interne dokumenter behandles bak deres egen brannmur — ingen tredjepart ser trafikken eller trener på dataene.
Ingen dataoverføring til utenlandske skyleverandører betyr enklere personvernvurderinger, ingen tredjelandsproblematikk og full sporbarhet for revisjon og tilsyn.
Åpne modeller som Llama, Mistral, Qwen og gpt-oss byttes fritt. Ingen prisøkninger over natten og ingen endrede bruksvilkår.
Svarene kommer fra maskinrommet, ikke fra et datasenter i utlandet. Modellene virker under nettbrudd, i lukkede nettverk og i miljøer med strenge sikkerhetskrav.
Ingen kvoter, køer eller «rate limits» i travle perioder. Kapasiteten er deres alene, og kostnaden er kjent på forhånd — uansett hvor mye teamet bruker den.
Hver server leveres ferdig montert og innkjørt, med operativsystem, GPU-drivere og modellkjøring (Ollama / vLLM) installert. Anbefalte modeller ligger klare ved oppstart.
| GPU | 1× NVIDIA GeForce RTX 5080, 16 GB GDDR7 (960 GB/s) |
| CPU | AMD Ryzen 9 9900X, 12 kjerner |
| Minne | 64 GB DDR5-5600 |
| Lagring | 2 TB NVMe SSD (7000 MB/s) |
| Nett | 10 GbE innebygd |
| Kabinett | Stillegående tower, 1200 W 80+ Platinum |
Modeller opptil ~20 mrd. parametre: gpt-oss-20b, Gemma 3 12B, Qwen3 14B — og 27B/32B-klassen kvantisert. Rask nok til chat, RAG og kodeassistent for et lite team.
| GPU | 1× NVIDIA GeForce RTX 5090, 32 GB GDDR7 (1,8 TB/s) |
| GPU-plass 2 | Klargjort: hovedkort og strøm dimensjonert for én 5090 til |
| CPU | AMD Ryzen 9 9950X, 16 kjerner |
| Minne | 64 GB DDR5-5600 |
| Lagring | 2× 2 TB NVMe (speilet) |
| Nett | 10 GbE innebygd |
| Kabinett | Full tower, 1600 W 80+ Titanium |
Gemma 3 27B og Qwen3 32B i høy fart med lang kontekst, gpt-oss-20b for mange samtidige brukere, 70B-klassen kvantisert. Oppgrader til GPU nr. 2 senere og doble til 64 GB VRAM.
| GPU | 2× NVIDIA RTX PRO 6000 Blackwell, 2× 96 GB GDDR7 ECC |
| CPU | AMD Ryzen 9 9950X, 16 kjerner |
| Minne | 128 GB DDR5 |
| Lagring | 2× 4 TB NVMe (speilet) |
| Nett | 10 GbE innebygd, 25 GbE som tilvalg |
| Kabinett | Super tower, 1600 W 80+ Titanium |
Llama 3.3 70B i full presisjon med lang kontekst, gpt-oss-120b, Qwen3-235B kvantisert. ECC-minne på GPU-ene og titalls samtidige brukere — hele organisasjonens KI-plattform.
Alle priser er veiledende og eks. mva. Konfigurasjonene tilpasses kostnadsfritt — vi dimensjonerer GPU-minne, lagring og nettverk etter deres modellvalg og antall brukere. Komponentpriser svinger; endelig tilbud gis ved bestilling.
Maskinvare kan alle selge. Forskjellen ligger i hva som skjer etterpå — når serveren skal inn i deres nettverk, når en disk må byttes, eller når dere vil oppgradere til neste modellgenerasjon.
Ring eller skriv til folk som kjenner akkurat deres server — ingen utenlandske callsentre, ingen saksnummer-limbo. Vi svarer samme dag.
Vi leverer, installerer og integrerer serveren i deres nettverk, og kommer fysisk når maskinvare må byttes. Reservedeler på lager i Norge.
Kjøpet følger norsk lov, garantien håndteres her, og fakturaen kommer i norske kroner — uten valutarisiko, toll-overraskelser eller importpapirer.
Vi lærer opp deres IT-ansvarlige i drift, modellvalg og oppdateringer, slik at dere eier både maskinen og kunnskapen om den.
Vi hjelper dere å velge riktig størrelse ut fra reelle behov. Trenger dere bare den minste serveren, selger vi dere ikke den største.
Modellene blir bedre hvert kvartal. Som lokal partner oppgraderer vi GPU-er og minne når behovet vokser — med innbytteverdi på eksisterende utstyr.
Fortell oss hvor mange brukere dere er og hva modellene skal brukes til, så anbefaler vi riktig konfigurasjon — uforpliktende.