Prestanda för delad användning
Med 6,3 tokens per sekund och användare jämfört med referensnivån 0,7 blir genomströmningen 9× i exemplet. Över 32 chattar motsvarar det 201,6 jämfört med 22,4 tokens per sekund.
Lokal och självhostad AI för säker chatt, agenter och kunskap med modellstyrning, DLP och revisionsunderlag för företag.
Byggd för teamen som ansvarar för förtroendet
En arbetsyta för medarbetarna. En kontrollpanel för IT. Granskningsunderlag för säkerhet och regelefterlevnad. Allt i er infrastruktur.
Driftsätt i er privata miljö. Välj modeller och konfigurera plattformen efter era arbetsflöden.
Koppla in identitetsleverantör, dokumentbibliotek och interna system. Bestäm vem som får använda varje modell och verktyg.
Hantera policyer, granska aktivitet, verifiera nätverksisolering och samla underlag i samma administrationskonsol.
Interaktiv programvaruförhandsvisning · exempeldata · utforska alla 30 moduler
En samlad driftbild av er AI-miljö.
Anrop
1,284
GPU-noder
3
Klara tjänster
12/12
GPU-nodernas hälsa
Baserad på administrationskonsolen i Kaldryn Platform. Funktioner beror på licensnivå, roll, hårdvara och konfiguration.
Lokal drift är startpunkten. Kaldryn tillför verktygen för identitet, styrning och drift som gör privat AI granskningsbar.
Dataskydd blir ett arbetsflöde.
Begränsa exponeringen med lokal bearbetning, avgränsad dokumentåtkomst och konfigurerbar DLP. Granska och genomför begäran om radering med en spårbar historik.
Gör ansvarsfull AI till en del av driften.
Gör AI-användningen tydlig med information i produkten, modellstyrning och insyn i driften. Samla policyer, loggaktivitet och granskningsbart underlag.
Samla SAML SSO, rollbaserad åtkomst, MFA och passkeys med kontroller av nätverksisolering, ett register över utgående trafik och granskningsbart säkerhetsunderlag.
Kaldryn tillhandahåller tekniska kontroller och dokumentation som stödjer regelefterlevnad, inte automatisk efterlevnad eller certifiering. Era skyldigheter beror på användningsfall, modell, konfiguration och organisatoriska åtgärder.
Diskutera era säkerhetskravMolnabonnemang och tokenavgifter växer när fler använder AI. Med Kaldryn har lokal inferens ingen nota för tokens eller krediter. Jämför era molnkostnader med hela kostnaden för att driva er egen AI.
Kostnadsjämförelse · SEK
Inkludera abonnemang och genomsnittlig förbrukning av tokens eller krediter.
Total Kaldryn-kostnad / månad
Fast kostnad på 75 000 kr per månad, med obegränsat antal användare att ansluta.
Möjlig årlig besparing
Ingen avgift per token eller kredit för lokal inferens.
Jämförelsen använder en fast Kaldryn-budget på 75 000 kr/månad. Anpassa antal användare och molnkostnad efter er organisation. Molnets startvärden är exempel. Modellkvalitet och kapacitet varierar; bekräfta konfiguration och omfattning i er offert.
Moln = personer × månadskostnad × 12. Kaldryn = total månadskostnad × 12.
Se potentialen i delad inferens med ett försiktigt räkneexempel på 9× för 32 samtidiga chattar på GB10-hårdvara.
genomströmningen per användare i detta exempel
Kontinuerlig batchning · delad GPU
Referensnivå för detta räkneexempel
Med 6,3 tokens per sekund och användare jämfört med referensnivån 0,7 blir genomströmningen 9× i exemplet. Över 32 chattar motsvarar det 201,6 jämfört med 22,4 tokens per sekund.
Chatt, dokumentsökning med RAG, agenter och finjustering av modeller samlas i en plattform.
Hantera SSO, rollbaserad åtkomst, DLP och granskningsloggar tillsammans med GPU-hälsa, signerade uppdateringar och backuper i en konsol.
Räkneexempel, inte ett nytt uppmätt benchmark: 0,7 × 9 = 6,3 tokens/s per användare. Referenslast: GB10, Qwen2.5-7B, 8k kontext, svar på 150 tokens, varm motor, 32 samtidiga chattar. Faktisk genomströmning beror på modell, hårdvara och konfiguration.
Berätta om ert företag, era användare och hur ni använder AI i dag. Vi hjälper er jämföra kostnader och hitta rätt lösning.
Företagsnamn och jobbmejl krävs.