Därför tar Obsidian dig högre än Berget
Berget AI säljer ett per-token-API; vi hyr ut GPU:n till dig. Per token passar liten eller ojämn volym; en egen GPU passar jämn volym, isolering, egen stack och finjustering. Tabellen, brytpunkten och frågorna nedan visar var gränsen går.
Sida vid sida
Sex skillnader.
Berget AI säljer ett per-token-API; vi hyr ut GPU:n till dig.
| Per-token-API eller din egen GPU | Per-token-API | Din egen GPU |
|---|---|---|
| Vad du köper | Tokens | GPU:n |
| Vem mer kör på hårdvaran | En delad pool | Ingen, så länge du hyr |
| Modeller | Deras utbud | Vilken som helst |
| Åtkomst | Bara API | Root + API på din maskin |
| Pris | Per token, kräver förbetald plan | Per minut, publicerat |
| Passar bäst för | Liten eller ojämn volym | Jämn volym, isolering, egen stack, finjustering |
Vad som passar när
Välj efter volym och kontroll.
Ett per-token-API vinner när
- Volymen är liten eller ojämn: du betalar per token och driver ingenting.
- En modell i deras utbud är precis vad du behöver.
- Du vill slippa drift: inget att hålla igång, inget att konfigurera.
Din egen GPU vinner när
- Volymen är jämn: över brytpunkten kostar tokens mer än maskinen.
- Du vill kunna köra vilken modell som helst: Hugging Face eller vår spegel, finjusterad eller inte.
- Isolering spelar roll: ingen annan på hårdvaran så länge du hyr.
- Du kör en egen stack: dina vLLM-inställningar, embeddings och tal på samma maskin.
- Du vill ha root-åtkomst och ett fast månadspris att budgetera med.
Brytpunkt
Var gränsen går.
En dedikerad 5090 för 8 000 kr/mån kostar ungefär lika mycket som 1,5 miljarder output-tokens till listpris hos ett typiskt svenskt per-token-API. Under det är tokens billigare. Över det, eller när du behöver isolering, egen stack eller finjustering, vinner GPU:n.
8 000 kr i månaden, räknat i tokens
| Modell | Deras pris, €/mn tokens (in · ut) | Output-tokens per månad för 8 000 kr | Per dag | Ryms på en 5090? |
|---|---|---|---|---|
| Kimi-K3 | 3,00 € · 15,00 € | 48 mn | 1,6 mn | nej |
| Qwen3.8-27B-FP8 | 0,40 € · 3,00 € | 242 mn | 8,1 mn | knappt |
| GLM-5.3-Flash | 0,25 € · 0,50 € | 1,5 md | 48 mn | — |
| Gemma-4-31B | 0,25 € · 0,50 € | 1,5 md | 48 mn | ja, 4-bit |
| Mistral-Small-3.2-24B | 0,30 € · 0,30 € | 2,4 md | 81 mn | ja |
Under de här volymerna är ett per-token-API billigare, sett bara till priset; över dem, eller när du behöver isolering, egen stack eller finjustering, vinner GPU:n.
Listpriset vi räknat med: 0,50 € per miljon output-tokens, det publicerade priset för en öppen 31B-modell hos ett svenskt per-token-API den 23 sep 2026; 8 000 kr/mån omräknat med cirka 11 kr per euro. Exkl. moms. Deras priser: modellistan på api.berget.ai, 23 sep 2026; output-tokens; 11 kr per euro.
Frågor
Frågor och svar.
- Vad är skillnaden mellan ett per-token-API och att hyra en GPU?
- Med ett per-token-API köper du output-tokens från en delad pool av hårdvara som kör leverantörens utbud av modeller. Hos oss hyr du själva GPU:n: ingen annan kör på den så länge du hyr, du kör vilken modell du vill, och du har root-åtkomst och ett API på din egen maskin.
- När är ett per-token-API det bättre valet?
- Vid liten eller ojämn volym, när en modell i deras utbud räcker och du inte behöver isolering: du betalar bara för de tokens du använder och driver inget själv.
- När är det bättre att hyra GPU:n?
- Vid jämn volym, en modell som inte finns i API:ets utbud, finjustering, egen stack, eller när isolering spelar roll: en maskin, en kund, så länge du hyr.
- Var går brytpunkten?
- En dedikerad 5090 för 8 000 kr/mån kostar ungefär lika mycket som 1,5 miljarder output-tokens till listpris hos ett typiskt svenskt per-token-API (0,50 € per miljon output-tokens den 23 sep 2026). Under det är tokens billigare; över det är GPU:n det.
- Kan jag få ett OpenAI-kompatibelt API från en hyrd GPU?
- Ja. Den dedikerade inferensmaskinen serverar modellen du väljer via ett OpenAI-kompatibelt API (vLLM) bakom din egen nyckel, så allt som pratar OpenAI:s API kan peka på din maskin.
- Hur betalar jag, och kan jag sluta när jag vill?
- Per timme: ett förbetalt saldo som debiteras per minut, med priset låst 7 dagar i taget; sluta när du vill, och oanvänt saldo återbetalas på begäran. Dedikerat: ett månadspris under ett signerat avtal, månadsvis eller med årsavtal.
- Ligger min data i Sverige?
- Ja. Hårdvaran är vår och den står i Sverige; avtal, faktura och support kommer från Obsidian Peaks Technologies AB enligt svensk lag; vi flyttar inte din data ut ur EU/EES.
