Språkmodeller på svenska GPU:er

En del data är för känslig för att lämna Sverige. För de arbetslasterna kör vi de bästa öppna modellerna i vårt eget datacenter. API:et är OpenAI-kompatibelt, så er befintliga kod fungerar direkt när ni pekar om den mot vår adress. Er data lämnar aldrig Sverige och används aldrig för träning.

0+ mdr

tokens varje månad

Vårt eget team och lösningarna vi driftar åt kunder förbrukar hundratals miljarder tokens varje månad, så vi vet vad som krävs för att köra språkmodeller i skarp drift.

Samma API, full kontroll
Plattformen exponerar ett OpenAI-kompatibelt API. Befintliga verktyg, bibliotek och applikationer fungerar direkt. Bakom API:et kör vi öppna modeller vi själva utvärderat, på egna GPU:er och med samma driftsäkerhet som resten av Liminity Cloud.

Det här får ni

API-inferens

OpenAI-kompatibelt API mot de bästa öppna modellerna.

POST /v1/chat/completions
"model": "gpt-oss-120b"
200 OK

Er data förblir er

Ingenting lagras längre än nödvändigt. Ingenting används för träning.

GDPR och AI Act

All behandling sker i Sverige. Vi hjälper er dokumentera efterlevnad.

GDPR
AI Act

Dedikerad kapacitet

Egna NVIDIA RTX PRO 6000 med garanterad genomströmning och valfri modell.

MIG ×4 · 96 GB

Från pilot till produktion

Våra AI-konsulter tar er från pilot till produktion, med agentflöden och skräddarsydd sökning som gör att modellerna svarar träffsäkert utifrån just er data.

index: 2.4M chunks
recall@10: 0.94

Datalager för agenter

Era agenter får behörighetsstyrd tillgång till er data via vår plattform LimiLake: strukturerad data, filer och SQL i samma miljö.

SELECT sum(total)
FROM lake.invoices
1 204 rows
AI utan juridisk huvudvärk
Vi är inte emot de globala AI-tjänsterna, vi använder dem själva varje dag. Men för känsliga personuppgifter krävs juridisk utredning, och ibland blir svaret nej. De arbetslasterna kör ni hos oss i Sverige med tydliga personuppgiftsbiträdesavtal, och resten kör ni kvar i era befintliga moln. Vi hjälper er gärna att få helheten på plats.
Egen hårdvara, färdigkonfigurerad
Vill ni ha en egen fysisk server, med eller utan GPU, levererar vi den färdigkonfigurerad. Kör den i vårt datacenter eller i era egna lokaler.

Priser per modell

Ni betalar per token. Tabellen nedan är hela prislistan. Alla priser exkl. moms.

ModellInputOutput
GLM 5.217 kr52 kr
Kimi K2.69 kr42 kr
Qwen 3.5 397B8 kr43 kr
GPT-OSS 120B3 kr9 kr
Qwen 3.6 35B2 kr8 kr
Mistral Small 3.2 24B4 kr4 kr
Gemma 4 27B3 kr6 kr
E5 Large (embeddings)0,4 kr

Priser i kr per miljon tokens.

Exempelpriser. Modellutbudet uppdateras löpande.

Dedikerad kapacitet

GPU-kapacitet på NVIDIA RTX PRO 6000 med 96 GB VRAM. Hyr en hel GPU eller en MIG-instans. Alla priser exkl. moms.

MIG-instans

från 3 995 kr/mån

  • Isolerad del av en RTX PRO 6000
  • Garanterad VRAM och beräkningskraft
  • Privat endpoint
  • Räcker för mindre modeller och test
Populärast
Dedikerad GPU

från 12 995 kr/mån

  • NVIDIA RTX PRO 6000, 96 GB VRAM
  • Valfri modell, även finjusterad
  • Delbar i upp till fyra MIG-instanser
  • Övervakning ingår
Enterprise

Offert

  • Flera GPU:er och modeller
  • GPU-noder i ert Kubernetes-kluster
  • Anpassat SLA
  • Personuppgiftsbiträdesavtal

Exempelpriser. Kontakta oss för en genomgång av ert användningsfall.

Vanliga frågor

Gör ert första API-anrop samma dag

Boka en demo så visar vi API:et och diskuterar hur språkmodeller kan skapa värde i er verksamhet.

Vill du vara med i resan att bli Sveriges största konsultföretag?

ANSÖK IDAG


© Liminity. All rights reserved.