Skip to content

Ralph loops

Språkmodellen som optimeringsverktøy

Ralph loops er konseptet å bruke språkmodellen som en søkeheuristikk: la den prøve en løsning, måle den, og prøve igjen. Modellen har en intelligens vi kan utnytte, og den trenger «bare» muligheten til å eksperimentere. Får modellen testet løsningen sin, kan den også forbedre den, runde etter runde, uten deg i midten.

Dette er heuristisk optimering med modellen som motor. Du definerer hva en god løsning er, loopen leter etter den.

Hva loopen trenger

Tre ting må være på plass. Først et veldefinert suksesskriterie, det optimeringsfolk kaller en objektivfunksjon: en hard og ærlig måling av hvor god løsningen er, som «alle testene passerer» eller «responstiden er under 100 ms». Uten den kan ikke modellen vite om den forbedrer noe.

Deretter muligheten til å eksperimentere: loopen må trygt kunne endre, kjøre og måle løsningen om og om igjen. Og til slutt en oversikt over hva som er prøvd før, for eksempel en logg eller notatfil i repoet. Uten historikk prøver modellen det samme igjen og igjen, med historikk søker den videre i nytt terreng.

En robot står i sentrum av en løkke og jobber: prøver en ny løsning («legg til indeks»), måler resultatet («responstid: 95 ms») og logger forsøket («forsøk 8: 95 ms») før neste runde. En grønn pil merket «suksesskriteriet nådd» går fra målingen til en målskive med skiltet «Mål: under 100 ms», satt opp av deg. Du setter målet én gang, agenten prøver å nå målet ditt.

Høyere giring

I praksis kan en Ralph loop være så enkel som en bash-løkke som starter agenten på nytt til suksesskriteriet er nådd. I Claude Code finnes det mer elegante mekanismer for det samme: GOALS lar deg definere målet loopen jobber mot, og stop-hooks kan nekte agenten å gi seg før kriteriet faktisk er oppfylt. Begge deler møter du igjen i Claude Code-seksjonen, på GOALS- og hooks-sidene.

Ralph loops er enda et steg i å få mer ut av modellen enn du putter inn. Du skriver suksesskriteriet én gang, og modellen legger inn forsøkene. Det gir høyere giring: innsatsen din veksles inn i stadig flere forsøk, uten at du sitter på.


Hva er en Ralph loop?

Hvorfor trenger loopen en oversikt over hva som er prøvd før?

Hva kjennetegner et godt suksesskriterie for en Ralph loop?