SEO Eval Builder
SEO Eval Builder tester promptene dine systematisk: du definerer testtilfeller med krav (må inneholde X, maks lengde Y, gyldig JSON), kjører prompten mot alle testene, og får pass/fail per test pluss en kvalitetsscore per kriterium fra en AI-dommer.
Evalueringen er reell: kravene sjekkes deterministisk mot faktisk AI-output, og scoringen gjøres av en egen dommermodell mot rubrikken din. «Foreslå tester»-knappen er gratis og gir deg et utgangspunkt.
Hvem passer verktøyet for
Deg som bygger eller vedlikeholder prompter — for egne verktøy, GPT-er eller arbeidsflyter — og vil måle endringer i stedet for å synse.
Forutsetninger
- Innlogget konto
- 10 kreditter per eval-kjøring, uansett antall tester
- En prompt å teste, en rubrikk (forhåndsvalg finnes) og minst ett testtilfelle
Slik bruker du verktøyet
- Lim inn prompten og velg/juster rubrikken — kriterievektene må summere til 1.0.
- Legg til testtilfeller, eller bruk «Foreslå tester» (gratis) som utgangspunkt.
- Kjør evalen og les pass/fail per test og score per kriterium.
- Juster prompten og kjør igjen — sammenlign scorene manuelt.
Slik leser du resultatet
- Pass/fail per test er de harde kravene; kriteriescoren 0–10 er dommerens kvalitetsvurdering.
- Output-utdraget per test viser hva modellen faktisk svarte — les det når en test overrasker.
Vanlige feil
- «0 av N passert» med feilmeldinger på alle tester: selve AI-kallene feilet (ikke prompten din) — trekket refunderes ikke automatisk i dag; prøv igjen og kontakt support hvis det gjentar seg.
- Vektene summerer ikke til 1.0: juster til nøyaktig 1.0 før kjøring.
Begrensninger
- Ingen lagring, historikk eller eksport — noter score og oppsett selv før du lukker; sammenligning mellom kjøringer er manuell.
- Regresjonsvarsling finnes ikke i dag, selv om UI-et har plass til det.
Relaterte verktøy
- Code Review, for kodedelen av promptene
- Content Quality Grader, for innholdskvalitet
- Brutal Nordic Editor, for tekstene evalen godkjenner
Sist oppdatert 2026-08-06