Skip to content

Automatisk tilbakemelding

Å styre krever tilbakemelding

Kontrollteori handler om å styre systemer, rett og slett å få ting til å gå i riktig retning. Å kjøre bil er en lukket sløyfe: du ser veien og justerer rattet hele tiden, også når vind og svinger prøver å dra deg ut av feltet. En åpen sløyfe er styring uten tilbakemelding. Det er å kjøre med lukkede øyne. Det er vanskelig.

Agenter fungerer på samme måte. En agent som ser resultatet av handlingene sine, kan korrigere kursen underveis. En agent uten tilbakemelding kjører i blinde, og resultatet blir deretter.

Grunnen er at usikkerhet akkumuleres. Hver prediksjon bygger på den forrige, og med litt usikkerhet i hvert steg vokser avviket for hver runde. Uten korrigering underveis kan resultatet divergere langt fra det du så for deg, selv om hvert enkelt steg så fornuftig ut.

To paneler. Åpen sløyfe: en stiplet rød bane starter mot målet, men en voksende usikkerhetskjegle gjør at den ender med en X langt unna blinken — usikkerheten vokser for hver runde. Lukket sløyfe: en grønn bane med korrigeringspunktene test, kompilator og skjermbilde treffer blinken — hver korrigering trekker mot målet.

Faste rammer gir ærlige svar

Agenten trenger ærlige svar som viser om retningen er riktig. Føringene som gis i prompts er anbefalinger og ikke krav, agenten kan velge å gjøre noe annet. Testene agenten skriver selv er skrevet for å fungere og bli grønne, ikke for å verifisere rett oppførsel. Agenten trenger eksterne, harde begrensninger som ikke lyver, faste rammer som gir ærlige svar: kompilatorer lyver ikke. Kode som kjøres er ærlig, den kræsjer når den er feil. Skjermbilder viser om nettsiden på skjermen ser riktig ut eller om den ikke vises rett.

De automatiske kildene gir hyppig tilbakemelding og styring, i hver eneste runde. Dine tilbakemeldinger er sjeldne og kostbare, de kommer typisk først når agenten er ferdig. Lag faste rammer og la dem styre underveis, og spar på din vurdering. Dine vurderinger er dyrebare og trege.

Automatisk tilbakemelding

Prøv å lage løsninger som er slik at agenten selv kan teste helheten. Agenter skriver gjerne egne tester, men de har begrenset verdi fordi de sjelden dekker hele flyten i løsningen. Legg heller opp til ende-til-ende-tester: la agenten skrive kode, ta skjermbilder selv og se resultatet med egne "øyne".

Gi agenten verktøy som gjør det mulig å interagere programmatisk med et testmiljø: kjøre løsningen, klikke seg gjennom flyten og lese ut det som skjer. Da lukker du sløyfen, og agenten retter feil du ellers måtte funnet selv. Det sparer deg tid og krefter.

Bruk gjerne /screenshot

I Claude Code kan skills som /screenshot la agenten ta skjermbilder av løsningen den bygger og vurdere resultatet selv. Jobber du med frontend, er dette den enkleste måten å lukke sløyfen på.


Hva er en lukket sløyfe?

Hvorfor bør de faste rammene, ikke du, gi agenten tilbakemelding underveis?

Hvorfor bør du legge opp til ende-til-ende-testing for agenten?