Obsidian Peaks
Hyr

Därför tar Obsidian dig högre än Berget

Berget AI säljer ett per-token-API; vi hyr ut GPU:n till dig. Per token passar liten eller ojämn volym; en egen GPU passar jämn volym, isolering, egen stack och finjustering. Tabellen, brytpunkten och frågorna nedan visar var gränsen går.

Sida vid sida

Sex skillnader.

Berget AI säljer ett per-token-API; vi hyr ut GPU:n till dig.

Per-token-API eller din egen GPU
Per-token-API eller din egen GPUPer-token-APIDin egen GPU
Vad du köperTokensGPU:n
Vem mer kör på hårdvaranEn delad poolIngen, så länge du hyr
ModellerDeras utbudVilken som helst
ÅtkomstBara APIRoot + API på din maskin
PrisPer token, kräver förbetald planPer minut, publicerat
Passar bäst förLiten eller ojämn volymJämn volym, isolering, egen stack, finjustering

Vad som passar när

Välj efter volym och kontroll.

Ett per-token-API vinner när

  • Volymen är liten eller ojämn: du betalar per token och driver ingenting.
  • En modell i deras utbud är precis vad du behöver.
  • Du vill slippa drift: inget att hålla igång, inget att konfigurera.

Din egen GPU vinner när

  • Volymen är jämn: över brytpunkten kostar tokens mer än maskinen.
  • Du vill kunna köra vilken modell som helst: Hugging Face eller vår spegel, finjusterad eller inte.
  • Isolering spelar roll: ingen annan på hårdvaran så länge du hyr.
  • Du kör en egen stack: dina vLLM-inställningar, embeddings och tal på samma maskin.
  • Du vill ha root-åtkomst och ett fast månadspris att budgetera med.

Brytpunkt

Var gränsen går.

En dedikerad 5090 för 8 000 kr/mån kostar ungefär lika mycket som 1,5 miljarder output-tokens till listpris hos ett typiskt svenskt per-token-API. Under det är tokens billigare. Över det, eller när du behöver isolering, egen stack eller finjustering, vinner GPU:n.

8 000 kr i månaden, räknat i tokens

8 000 kr i månaden, räknat i tokens
ModellDeras pris, €/mn tokens (in · ut)Output-tokens per månad för 8 000 krPer dagRyms på en 5090?
Kimi-K33,00 € · 15,00 €48 mn1,6 mnnej
Qwen3.8-27B-FP80,40 € · 3,00 €242 mn8,1 mnknappt
GLM-5.3-Flash0,25 € · 0,50 €1,5 md48 mn
Gemma-4-31B0,25 € · 0,50 €1,5 md48 mnja, 4-bit
Mistral-Small-3.2-24B0,30 € · 0,30 €2,4 md81 mnja

Under de här volymerna är ett per-token-API billigare, sett bara till priset; över dem, eller när du behöver isolering, egen stack eller finjustering, vinner GPU:n.

Listpriset vi räknat med: 0,50 € per miljon output-tokens, det publicerade priset för en öppen 31B-modell hos ett svenskt per-token-API den 23 sep 2026; 8 000 kr/mån omräknat med cirka 11 kr per euro. Exkl. moms. Deras priser: modellistan på api.berget.ai, 23 sep 2026; output-tokens; 11 kr per euro.

Frågor

Frågor och svar.

Vad är skillnaden mellan ett per-token-API och att hyra en GPU?
Med ett per-token-API köper du output-tokens från en delad pool av hårdvara som kör leverantörens utbud av modeller. Hos oss hyr du själva GPU:n: ingen annan kör på den så länge du hyr, du kör vilken modell du vill, och du har root-åtkomst och ett API på din egen maskin.
När är ett per-token-API det bättre valet?
Vid liten eller ojämn volym, när en modell i deras utbud räcker och du inte behöver isolering: du betalar bara för de tokens du använder och driver inget själv.
När är det bättre att hyra GPU:n?
Vid jämn volym, en modell som inte finns i API:ets utbud, finjustering, egen stack, eller när isolering spelar roll: en maskin, en kund, så länge du hyr.
Var går brytpunkten?
En dedikerad 5090 för 8 000 kr/mån kostar ungefär lika mycket som 1,5 miljarder output-tokens till listpris hos ett typiskt svenskt per-token-API (0,50 € per miljon output-tokens den 23 sep 2026). Under det är tokens billigare; över det är GPU:n det.
Kan jag få ett OpenAI-kompatibelt API från en hyrd GPU?
Ja. Den dedikerade inferensmaskinen serverar modellen du väljer via ett OpenAI-kompatibelt API (vLLM) bakom din egen nyckel, så allt som pratar OpenAI:s API kan peka på din maskin.
Hur betalar jag, och kan jag sluta när jag vill?
Per timme: ett förbetalt saldo som debiteras per minut, med priset låst 7 dagar i taget; sluta när du vill, och oanvänt saldo återbetalas på begäran. Dedikerat: ett månadspris under ett signerat avtal, månadsvis eller med årsavtal.
Ligger min data i Sverige?
Ja. Hårdvaran är vår och den står i Sverige; avtal, faktura och support kommer från Obsidian Peaks Technologies AB enligt svensk lag; vi flyttar inte din data ut ur EU/EES.

Hyr GPU:n.

Per timme i dag, per månad när du är redo.