KI
Hva endrer seg når programvaren handler på egen hånd
Når programvaren handler på egen hånd, flytter risikoen seg fra utdata til handling. En modell som tar feil gir deg et dårlig svar. Et agentisk system som tar feil har allerede sendt e-posten.

Det som endrer seg når programvaren handler på egen hånd, er hvor feilen lander. En språkmodell som tar feil, gir deg et dårlig svar du kan overse. Et agentisk system som tar feil, har allerede sendt e-posten, kreditert fakturaen eller lukket saken. Risikoen flytter seg fra utdata til handling, og driften må bygges om etter det.
Hva skiller et agentisk system fra en språkmodell?
Et agentisk system får to ting en språkmodell ikke har: tilgang til verktøy, og lov til å bestemme rekkefølgen selv. Modellen slutter å være en funksjon noen kaller, og blir en prosess som kjører til den mener oppgaven er løst.
Løkken har fire steg, og de gjentas til systemet stopper.
- Steg 1
Leser situasjonen. Systemet henter tilstanden det trenger: saken, dokumentet, arkivet, kontoen.
- Steg 2
Velger en handling. Systemet bestemmer selv hvilket verktøy som skal kalles, og med hvilke argumenter. Det er her rekkefølgen oppstår i stedet for å være programmert på forhånd.
- Steg 3
Utfører handlingen. Verktøyet kalles. Er handlingen skrivende, har den nå skjedd i et system utenfor agenten.
- Steg 4
Leser resultatet og bestemmer neste steg. Systemet vurderer utfallet og går tilbake til steg 1, eller stopper.
Hvor stopper løkken?
Løkken stopper på tre måter: målet er nådd, forsøkene er brukt opp, eller et menneske griper inn. Den tredje stoppbetingelsen er den du designer. De to første designer seg selv.
Et agentisk system uten en definert tredje stoppbetingelse kjører til det går tomt for forsøk. Det er ingen sikkerhetsmekanisme. Det er et tidsavbrudd.
Hva endrer seg i risikobildet?
Risikoen endrer karakter, ikke bare størrelse. Fire ting flytter seg samtidig.
| Med en språkmodell | Med et agentisk system |
|---|---|
| Feilen er et dårlig svar du leser | Feilen er en handling som allerede er utført |
| Du oppdager feilen når du leser svaret | Du oppdager feilen når konsekvensen dukker opp et annet sted |
| Systemet krasjer eller svarer rart | Systemet gjør noe plausibelt som er feil, og gjør det med selvtillit |
| Oppetid og responstid fanger driftsproblemer | Oppetid og responstid fanger ingenting av dette |
Den siste raden er den som overrasker flest. Et agentisk system i produksjon har som regel utmerkede driftstall mens det gjør feil. Systemet svarer raskt, det er oppe, og det tar gale beslutninger i tide.
Hvorfor er skillet mellom lesing og skriving den billigste kontrollen?
Skillet mellom lesende og skrivende operasjoner er den billigste kontrollen fordi det kan settes én gang og gjelder alt systemet gjør etterpå. La agenten lese fritt. Krev godkjenning for alt som sender, betaler, sletter eller endrer data utenfor systemet.
Kontrollen er billig fordi den ikke krever at du forutser feilen. Du trenger ikke vite hvilken gal handling agenten kommer til å foreslå. Du trenger bare vite hvilke handlinger som er ugjenkallelige, og den listen er kort og kjent på forhånd.
Hva vi gjorde i vår egen publiseringsagent
Publiseringsagenten på apps.no leser hele artikkelarkivet, velger emne, skriver teksten på to språk, lager forsidebildet og legger alt i CMS-et. Agenten kan ikke publisere. Hver eneste skriving lander som utkast, og et menneske trykker publiser.
Grensen er verdt å forsvare fordi den har blitt testet. Den 21. september 2026 produserte publiseringsagenten to komplette artikkelutkast. Begge hadde alle obligatoriske felter fylt ut, forsidebilde påhektet, fem FAQ-spørsmål og interne lenker som resolverte i begge språk. Skjemavalideringen i CMS-et stoppet én ting den dagen: et FAQ-element der svarfeltet manglet fordi nøkkelen var stavet feil.
Begge utkastene ble forkastet av et menneske. Det ene fordi belegget var andrehånds, det andre fordi tallene tilhørte et annet selskap enn bloggen tilhører. Ingen av de to grunnene har et felt i et skjema.
Hvilke kontroller må på plass før volumet går opp?
Fire kontroller må være avklart før et agentisk system får kjøre i volum. Ingen av dem er vanskelige å bygge. Alle fire er dyre å ettermontere.
Rettigheter. Hver agent er en egen identitet med avgrensede rettigheter, kortlevde nøkler og en tilbakekallingsvei som virker på minutter. En agent som arver en tjenestekonto med vide rettigheter er en vanlig måte en nyttig pilot blir en uakseptabel produksjonsrisiko på.
Logg. Hvert verktøykall logges med argumentene det ble kalt med, og med nok kontekst til å rekonstruere en beslutning i ettertid. Loggen er både feilsøkingen og dokumentasjonen en offentlig innkjøper kommer til å be om.
Reverserbarhet. Hver handling agenten gjør selvstendig skal kunne rulles tilbake. Er handlingen ikke reverserbar, skal den godkjennes av et menneske.
Eskalering. Terskelen for å hente et menneske er skrevet ned og testet, og mennesket får med seg det som allerede er sagt.
Hvor mye av dette som lønner seg, og hvor det ryker, er gjennomgått med tall i Hvordan kan agentisk KI forbedre virksomheten min?. Hvorfor loggen også er dokumentasjonen myndighetene vil be om, står i Agentisk KI i et land uten KI-lov. Hva som skjer med grensesnittet når agenten snakker med kunden direkte, står i Alle lanserte taleagenter. Ingen designet dem..
Skriv ned de ugjenkallelige handlingene først
Skal dere sette et agentisk system i drift i år, begynn med listen over handlinger som ikke kan angres. Send listen til hello@apps.no. Vi svarer med hvilke av dem vi ville satt bak en godkjenning, og hvilke vi ville latt agenten gjøre selv.
Om denne artikkelen. Skrevet av Espen Hareide, medgrunnlegger og partner i Apps. Ankerartikkel for pilaren En ny virkelighet med agentisk KI. Tallene om publiseringsagenten er hentet fra Apps AS' egen agentkonfigurasjon og fra kjøringene 21. september 2026, lest 22. september 2026. Artikkelen bygger ikke på kundeprosjekter, og ingen kundetall er brukt.
FAQ
- Hvor mye selvstendighet bør en agent ha i starten?
- Mindre enn den tåler teknisk. Start med at agenten foreslår og et menneske bestemmer, og registrer hvor ofte de to er enige. Når enigheten er stabil over noen uker, la agenten handle selvstendig på den minst risikable delen først. Rekkefølgen er viktigere enn tempoet, fordi den første selvstendige handlingen er den dere har minst erfaring med.
- Hva gjør vi hvis en handling ikke kan reverseres i det hele tatt?
- Da skal den godkjennes av et menneske, uten unntak. Penger som forlater huset, kontrakter som binder, data som slettes og endelige beskjeder til kunder hører i denne kategorien. Alternativet er å bygge en mellomtilstand: agenten forbereder handlingen fullt ut og legger den i kø, og godkjenningen utløser den. Da er ventetiden kort og angremuligheten reell.
- Hvor lenge må vi ha et menneske i godkjenningsløypa?
- På de ugjenkallelige stegene: alltid. På resten: til dere har tall som viser at agenten og mennesket er enige. Det er verdt å si at utkast-og-godkjenn er en helt reell sluttilstand og ikke et kompromiss på veien mot full autonomi. Ved moderate volumer er menneskelig gjennomgang rimeligere enn folk tror.
- Hvordan oppdager vi at agenten gjør noe plausibelt som er feil?
- Ikke gjennom driftsovervåking, som vil vise grønt. Dere trenger et mål på utfall og ikke på gjennomføring: andel saker som blir gjenåpnet, andel resultater som rettes senere, eller stikkprøver der et menneske vurderer et tilfeldig utvalg av det agenten gjorde. Uten en av de tre oppdager dere feilen når kunden ringer.
- Er skillet mellom lesing og skriving nok alene?
- Nei, men det er det billigste første steget. Skillet håndterer ikke en agent som leser data den ikke burde sett, og det håndterer ikke fiendtlige inndata som får agenten til å foreslå noe galt. Rettighetsavgrensning og logging må på plass i tillegg. Poenget med å begynne med lese-skrive-skillet er at det kan settes på én dag og gjelder alt etterpå.


