Språkmodeller på svenska GPU:er
En del data är för känslig för att lämna Sverige. För de arbetslasterna kör vi de bästa öppna modellerna i vårt eget datacenter. API:et är OpenAI-kompatibelt, så er befintliga kod fungerar direkt när ni pekar om den mot vår adress. Er data lämnar aldrig Sverige och används aldrig för träning.
tokens varje månad
Vårt eget team och lösningarna vi driftar åt kunder förbrukar hundratals miljarder tokens varje månad, så vi vet vad som krävs för att köra språkmodeller i skarp drift.
Det här får ni
API-inferens
OpenAI-kompatibelt API mot de bästa öppna modellerna.
Er data förblir er
Ingenting lagras längre än nödvändigt. Ingenting används för träning.
GDPR och AI Act
All behandling sker i Sverige. Vi hjälper er dokumentera efterlevnad.
Dedikerad kapacitet
Egna NVIDIA RTX PRO 6000 med garanterad genomströmning och valfri modell.
Från pilot till produktion
Våra AI-konsulter tar er från pilot till produktion, med agentflöden och skräddarsydd sökning som gör att modellerna svarar träffsäkert utifrån just er data.
Datalager för agenter
Era agenter får behörighetsstyrd tillgång till er data via vår plattform LimiLake: strukturerad data, filer och SQL i samma miljö.
Priser per modell
Ni betalar per token. Tabellen nedan är hela prislistan. Alla priser exkl. moms.
| Modell | Input | Output |
|---|---|---|
| GLM 5.2 | 17 kr | 52 kr |
| Kimi K2.6 | 9 kr | 42 kr |
| Qwen 3.5 397B | 8 kr | 43 kr |
| GPT-OSS 120B | 3 kr | 9 kr |
| Qwen 3.6 35B | 2 kr | 8 kr |
| Mistral Small 3.2 24B | 4 kr | 4 kr |
| Gemma 4 27B | 3 kr | 6 kr |
| E5 Large (embeddings) | 0,4 kr |
Priser i kr per miljon tokens.
Exempelpriser. Modellutbudet uppdateras löpande.
Dedikerad kapacitet
GPU-kapacitet på NVIDIA RTX PRO 6000 med 96 GB VRAM. Hyr en hel GPU eller en MIG-instans. Alla priser exkl. moms.
från 3 995 kr/mån
- Isolerad del av en RTX PRO 6000
- Garanterad VRAM och beräkningskraft
- Privat endpoint
- Räcker för mindre modeller och test
från 12 995 kr/mån
- NVIDIA RTX PRO 6000, 96 GB VRAM
- Valfri modell, även finjusterad
- Delbar i upp till fyra MIG-instanser
- Övervakning ingår
Offert
- Flera GPU:er och modeller
- GPU-noder i ert Kubernetes-kluster
- Anpassat SLA
- Personuppgiftsbiträdesavtal
Exempelpriser. Kontakta oss för en genomgång av ert användningsfall.
Vanliga frågor
Gör ert första API-anrop samma dag
Boka en demo så visar vi API:et och diskuterar hur språkmodeller kan skapa värde i er verksamhet.