For gründere ligger gevinsten i lavere kostnad per godkjent oppgave. Da må også feil, ventetid og drift inn i regnestykket.
Åpne språkmodeller kan gjøre hver forespørsel billigere og likevel gi bedriften mer å betale. Når en KI-tjeneste må prøve på nytt, hente flere opplysninger og sende svaret til en ansatt for kontroll, vokser regningen. For en norsk oppstartsbedrift bør modellvalget derfor begynne med et enkelt spørsmål: Hva koster en oppgave som faktisk blir løst?
Ollama-sjef Jeffrey Morgan peker på lavere kostnader, kodeagenter og bedre modellegenskaper som drivere for økt bruk av åpne modeller, slik Y Combinator presenterer vurderingen hans. For gründere gir dette grunn til å undersøke flere alternativer. Men en lav pris på modellbruk forteller bare en del av historien.
Lavere pris kan gi høyere forbruk
Y Combinator oppgir i beskrivelsen av samtalen med Morgan at tokenbruken i Ollama Cloud har økt til 150 ganger nivået ved starten av 2026. Tokener er små tekstdeler som modellen behandler, og brukes ofte til å måle og prise forbruk. Tallet gjelder denne tjenesten; det viser verken hele markedets utvikling eller kundenes lønnsomhet.
Likevel synliggjør det et spørsmål enhver gründer bør stille: Hva skjer med budsjettet hvis bruken øker kraftig? En KI-agent, altså programvare som bruker en modell til å utføre flere arbeidstrinn, kan gjøre mange modellkall før én kundeoppgave er ferdig. Billigere kall kan gjøre flere slike oppgaver økonomisk mulige, samtidig som samlet forbruk stiger.
Derfor bør samtalen om hva som driver KI-kostnadene følges helt frem til tjenesten kunden bruker. Regn både på dagens volum og på hva som skjer dersom kundene faktisk blir så begeistret som dere håper.
Sett en pris på en godkjent oppgave
Tenk deg en norsk programvarebedrift som vil automatisere svar på spørsmål om fakturaer. Et svar er først brukbart når det viser til riktig faktura, forklarer beløpet korrekt og håndterer manglende opplysninger. Et raskt, høflig svar med feil fakturanummer gir ekstra arbeid for både kunden og kundebehandleren.
Prøv derfor modellene på de samme oppgavene, med de samme opplysningene og tydelige krav til godkjenning. Ta med enkle spørsmål, uklare henvendelser og saker som må overlates til et menneske. Slik blir sammenligningen en prøve på arbeidet bedriften trenger utført.
Legg sammen modellbruk, drift og menneskelig oppfølging, og del på antall oppgaver som består kvalitetskravene. Hold kostnaden ved selve utprøvingen synlig ved siden av. Den relevante prisen inkluderer tiden noen bruker på å rydde opp.
En gjennomtenkt arbeidsflyt for modellvalg gjør det lettere å oppdage hvor pengene forsvinner. Kanskje trenger dere en bedre modell. Kanskje er problemet at fakturaopplysningene som sendes inn, er ufullstendige.
Egen drift må passe laget dere har
Åpenhet og driftsform er to forskjellige valg. Når en modell har tilgjengelige modellvekter, de innlærte verdiene som styrer beregningene, kan det være mulig å kjøre den selv. Bruksbetingelsene varierer mellom modeller, og tilgjengelige vekter betyr ikke automatisk at alt ved modellen er åpent eller fritt å bruke.
Egen drift krever at noen tar ansvar for kapasitet, oppdateringer og feil. For et lite utviklerlag må dette veies mot tiden som kunne gått til produktet. En modell som passer på tilgjengelig maskinvare, kan være interessant; en løsning som stadig krever oppmerksomhet fra den eneste erfarne utvikleren, får en annen kostnad.
Åpne modeller kan også tilbys gjennom kjøpte skytjenester. Da blir leverandørens pris, tilgjengelighet og håndtering av data en del av vurderingen. Sammenlign konkrete alternativer: hvem gjør driftsjobben, hva betaler dere for, og hvor mye arbeid krever det å bytte løsning?
Norske kundesaker avslører praktiske svakheter
For en tjeneste rettet mot norske kunder bør utprøvingen inneholde språket kundene faktisk bruker. Hvis dere mottar henvendelser på både bokmål og nynorsk, må begge være representert. Ta også med forkortelser, ufullstendige setninger og faguttrykk fra bransjen deres.
Se etter mer enn pen formulering. Forstår modellen forskjellen mellom et spørsmål om betalingsfrist og en innsigelse mot beløpet? Ber den om avklaring når opplysningene spriker? Slike egenskaper påvirker hvor mye kontroll ansatte må gjøre før et svar kan sendes.
Her kan gründerens bransjekunnskap bli et konkret fortrinn. Den som kjenner kundearbeidet, vet hvilke feil som skaper merarbeid, og hvilke oppgaver som tåler automatisering. Bruk denne kunnskapen til å lage vurderingskriterier før dere sammenligner resultater.
Avtal også hva som skal skje når modellen ikke strekker til. En sak som sendes videre med en presis forklaring på hva som mangler, kan være nyttig. Gjentatte forsøk uten bedre informasjonsgrunnlag kan derimot bruke både tid og penger.
Lærdommen: Gjør modellvalget etterprøvbart
Åpne språkmodeller gir gründere flere muligheter til å undersøke hva som passer virksomheten. Begynn med en avgrenset oppgave der dere kjenner dagens tidsbruk og kan vurdere resultatet. Velg noe dere vil merke verdien av å få gjort bedre.
Før dere utvider bruken, bør dere kunne svare på tre spørsmål: Hvor ofte blir oppgaven godkjent? Hva koster et godkjent resultat, inkludert oppfølging? Hvem har ansvar når løsningen feiler? Svarene gjør det lettere å vurdere om en rimeligere modell faktisk forbedrer økonomien.
Behold oppgavene og vurderingskriteriene, slik at dere kan prøve nye modeller uten å begynne helt på nytt. Friheten til å bytte modell blir verdifull når bedriften faktisk klarer å bruke den. Da kan neste modellvalg bygge på erfaring fra egne kunder og egne kostnader.
Den relevante prisen inkluderer tiden noen bruker på å rydde opp.
Friheten til å bytte modell blir verdifull når bedriften faktisk klarer å bruke den.

Kilder
- Y Combinator: Åpne modeller endrer økonomien i kunstig intelligens — Samtale med Ollama-gründer og daglig leder Jeffrey Morgan, publisert 4. september 2026. Faktahenvisningene bygger på kanalens oppgitte beskrivelse; full transkripsjon var ikke vedlagt. Relevante kapittelstarter er kostnader ved 02:13, tokenbruk ved 03:31 og lokale modeller sammenlignet med skytjenester ved 20:41. Opplysningen om 150 ganger høyere tokenbruk gjelder Ollama Cloud og er hentet fra kanalbeskrivelsen.
Innohub TV
Se dette innholdet også på Innohub TV
Vi har plukket ut klipp fra Innohub TV som fortsetter samme tema.
