Kalibrera AI bedömning
AI bedömning är bara så tillförlitlig som kalibreringen bakom den. Bedoma är kalibrerat mot 466 riktiga elevtexter med riktiga lärarbedömningar från nationella prov, Skolverkets bedömda exempel och texter som lärare delat med samtycke. Ingen AI genererad text används någonsin.
Processen bakom vår träffsäkerhet
Steg 1: insamling av texter från NP och Skolverkets betygsporträtt. Steg 2: träffanalys per ämne, per kurs, per nivå. Steg 3: kalibrering av analysmotorn när systematiska fel upptäcks. Steg 4: konsistenstest för att säkerställa stabila och reproducerbara resultat.
Ämnen där träffsäkerheten är högst
Högst träffsäkerhet ser vi i svenska och SO-ämnena, där bedömningsunderlaget är störst. Engelska ligger stabilt men med större spridning, eftersom språklig helhetsbedömning har fler gränsfall. Aktuella siffror per ämne, med antal texter bakom varje mätning, publiceras löpande på transparens-sidan.
Ämnen där AI:n är osäker
Mellanbetygen D och B är systematiskt svårast att träffa exakt, både för AI och för människor, eftersom de per definition ligger mellan två nivåer. Det är ett känt gränsfall och vi är öppna med det. Lärare som arbetar mycket med gränsfall bör se Bedoma som ett stöd, inte en avgörare. Vissa ämnen är fortfarande under kalibrering och är märkta BETA i verktyget.
Bidra själv
Via bidra sidan kan du ladda upp en anonymiserad elevtext med ditt betyg och få bonusanalyser. Dina bidrag går in i nästa kalibreringsomgång. Bara riktiga elevtexter används, aldrig AI genererade.
Relaterat: Bidra med text, Om Bedoma, Insights, Forskning om AI bedömning.