Vidensbank · DISC & personprofiler
Testretfærdighed, måleinvarians og adverse impact
Kort fortalt
Testretfærdighed er et bredt krav om, at måling og brug er saglig, tilgængelig og fri for irrelevant skævhed. Måleinvarians undersøger, om konstrukter og scores fungerer sammenligneligt på tværs af grupper. Adverse impact er en udfaldsforskel og er ikke i sig selv det samme som målebias.
Hvad er testretfærdighed?
Fairness omfatter design, adgang, administration, scorefortolkning, beslutningsregler og konsekvenser. En test kan måle samme konstrukt på tværs af grupper og stadig indgå i en uretfærdig proces.
Testretfærdighed bliver mest præcist, når begrebet kobles til konstrukt, instrument, population, administration, score og beslutningsformål. Det gør det muligt at skelne mellem en faglig definition, en praktisk model og en løs hverdagsetiket. Skellet er vigtigt, fordi de tre former ikke kan bære de samme konklusioner eller beslutninger.
Vigtige afgrænsninger
- Målebias er systematisk construct-irrelevant forskel i scores.
- Måleinvarians er statistisk sammenlignelighed på flere niveauer.
- Adverse impact beskriver forskelle i udvælgelsesrater og kræver videre undersøgelse.
Afgrænsningerne omkring testretfærdighed er ikke kun sproglige. De bestemmer, hvilke data der er relevante, hvilke fejl man risikerer, og om en anbefaling kan forsvares. Start derfor med at skrive, hvad begrebet omfatter og ikke omfatter i den konkrete brug.
Hvad viser forskningen?
Faglige standarder gør fairness til en grunddimension ved siden af validitet og reliabilitet.
Metodereviews viser, at gruppesammenligninger kræver passende invarians og gennemtænkt gruppekategorisering.
Fairness kan ikke afgøres af én statistisk test alene.
Kilderne om testretfærdighed viser et samlet mønster, men de er ikke et løfte om et bestemt resultat hos en bestemt person eller arbejdsplads. Studier varierer i population, design, måling og kontekst. Korrelationer kan støtte en faglig hypotese, men fastslår ikke alene årsag og virkning.
Sådan kan testretfærdighed bruges ansvarligt
- Definér jobrelevant konstrukt og mulige barrierer.
- Test målefunktion og tilgængelighed i relevante grupper.
- Monitorér udfald og undersøg alternative forklaringer.
- Justér proces, indhold eller kombination af metoder, når risikoen ikke kan forsvares.
Skriv først hvilket konstrukt og hvilken beslutning testretfærdighed skal understøtte. Kontrollér instrument, normer, usikkerhed og dokumentation, og beslut på forhånd hvordan resultatet kombineres med andre data og forklares for den berørte person.
Begrænsninger og typiske fejl
- Kald ikke enhver gruppeskel diskrimination eller enhver valid test fair.
- Brug ikke små undergrupper til sikre konklusioner.
- Skjul ikke adverse impact bag en samlet validitet.
Ved brug af testretfærdighed er den vigtigste kildekritiske regel proportionalitet. Jo større konsekvens en fortolkning får for mennesker, desto stærkere og mere lokal dokumentation kræves. En model kan være god til refleksion uden at være egnet til udvælgelse, diagnose eller juridiske konklusioner.
Måling og opfølgning
Ved måling af testretfærdighed: Dokumentér scoredefinition, måleusikkerhed, normgruppe og den præcise beslutning. Undersøg reliabilitet, validitet og fairness for den konkrete brug. Små forskelle omkring en tærskel bør behandles som usikre og suppleres med andre relevante data.
For testretfærdighed skal det på forhånd beskrives, hvad der tæller som forbedring, hvilken periode der er relevant, og hvem der kan korrigere fortolkningen. Hvis målet ændres efter resultaterne er set, bliver evalueringen let en efterrationalisering. Brug hellere få tydelige indikatorer end et stort dashboard uden beslutningsværdi.
Kort FAQ
Hvad betyder en score på testretfærdighed?
En score har kun mening i forhold til en defineret skala, administration, norm eller reference og et bestemt formål. Den indeholder måleusikkerhed og må ikke fortolkes som en fuldstændig eller uforanderlig beskrivelse af personen.
Kan resultatet bruges alene?
Nej ved beslutninger med konsekvenser. Brug kun testretfærdighed til et formål, dokumentationen understøtter, og kombiner resultatet med andre jobrelevante eller fagligt relevante data.
Hvilken dokumentation bør man bede om?
Bed om manual, konstruktsdefinition, reliabilitet, validitet, normgrundlag, fairness-analyser, versionsnummer og kompetencekrav. Markedsføring eller en generel henvisning til forskning er ikke det samme som lokal dokumentation.
Fra score til forsvarlig fortolkning
En fortolkning af testretfærdighed skal forbinde konstrukt, instrument, administration, referencegrundlag og beslutningsformål. Skriv også hvilken usikkerhed og hvilke alternative forklaringer der findes. Flere decimaler eller farvekategorier gør ikke målingen mere præcis.
Kontrollér dokumentationen for den aktuelle version og population. En generel forskningsartikel om et konstrukt validerer ikke automatisk et bestemt kommercielt instrument eller dets anvendelse i en konkret beslutning.
Implementering trin for trin
Trin 1: Definér jobrelevant konstrukt og mulige barrierer
Dokumentér trinnet: Definér jobrelevant konstrukt og mulige barrierer. Angiv instrumentversion, datagrundlag, fagligt ansvarlig, fortolkningsregel og grænser for anvendelsen. Den berørte person skal kunne stille spørgsmål og korrigere faktuelle fejl.
Trin 2: Test målefunktion og tilgængelighed i relevante grupper
Dokumentér trinnet: Test målefunktion og tilgængelighed i relevante grupper. Angiv instrumentversion, datagrundlag, fagligt ansvarlig, fortolkningsregel og grænser for anvendelsen. Den berørte person skal kunne stille spørgsmål og korrigere faktuelle fejl.
Trin 3: Monitorér udfald og undersøg alternative forklaringer
Dokumentér trinnet: Monitorér udfald og undersøg alternative forklaringer. Angiv instrumentversion, datagrundlag, fagligt ansvarlig, fortolkningsregel og grænser for anvendelsen. Den berørte person skal kunne stille spørgsmål og korrigere faktuelle fejl.
Trin 4: Justér proces, indhold eller kombination af metoder, når risikoen ikke kan forsvares
Dokumentér trinnet: Justér proces, indhold eller kombination af metoder, når risikoen ikke kan forsvares. Angiv instrumentversion, datagrundlag, fagligt ansvarlig, fortolkningsregel og grænser for anvendelsen. Den berørte person skal kunne stille spørgsmål og korrigere faktuelle fejl.
Kvalitetssikring før brug
Kontrollér at definition, kilder, anbefalinger og den konkrete anvendelse af testretfærdighed passer sammen. En kilde om gennemsnitlige sammenhænge kan ikke alene begrunde en individuel beslutning, og en teori om en mekanisme dokumenterer ikke automatisk effekten af et bestemt produkt.
Ved arbejde med testretfærdighed skal mindst ét perspektiv kunne udfordre den foretrukne forklaring, og berørte personer skal kunne korrigere faktuelle fejl. Ved høj konsekvens skal kontrol og dokumentation være tilsvarende stærkere.
Dokumentation og beslutningsspor
For testretfærdighed noteres formål, datakilder, ansvarlig, beslutningsregel, begrænsninger og dato for genbesøg. Beskriv også hvad der ikke blev målt, og hvilke personer eller situationer datagrundlaget dækker dårligt.
Ved gentagen brug af testretfærdighed skal versioner og ændringer kunne spores. Nye spørgsmål, systemer, normer eller målgrupper kan ændre fortolkningen, så en tidligere godkendelse må ikke behandles som permanent tilladelse til enhver anvendelse.
Spørgsmål til faglig gennemgang
- Hvilken præcis definition af testretfærdighed bruger vi?
- Hvilken beslutning eller adfærd skal begrebet forbedre?
- Hvilken kilde er stærkest, og hvad kan den ikke dokumentere?
- Hvilke alternative forklaringer er realistiske?
- Hvem bærer risikoen ved en forkert fortolkning?
- Hvornår og på hvilket grundlag stopper eller ændrer vi praksis?
Kilder og kildekritik
Kildelisten for testretfærdighed prioriterer faglige standarder, meta-analyser, systematiske reviews og originale modeller. Noterne angiver centrale begrænsninger. Det er vigtigt, fordi en troværdig udgiver eller peer review ikke i sig selv gør enhver praktisk påstand sand.
Relaterede begreber og hjælp i praksis
Læs også Sensitivitet og specificitet i test og screening, Psykometri: Hvordan vurderer man kvaliteten af en test?, Personlighedstest og personprofiler: forskelle og ansvarlig brug.
Lykkeco bruger profiler og test som struktureret beslutnings- eller dialogstøtte inden for det formål, dokumentationen kan bære. Resultater fortolkes med usikkerhed, kontekst og mulighed for spørgsmål, aldrig som hele sandheden om et menneske. Her bliver testretfærdighed altid afgrænset til det formål og den evidens, som den konkrete anvendelse kan bære.
Relaterede begreber
Forløb der arbejder med det
Kilder og videre læsning
- AERA, APA & NCME, Standards for Educational and Psychological Testing, 2014. Tværfaglig fagstandard for validitet, reliabilitet, fairness, scoring og testbrug. Den er normativ vejledning, ikke et effektstudie af en bestemt test.
- Roger E. Millsap & Jenn Yun-Tein, Assessing Factorial Invariance in Ordered-Categorical Measures, 2004. Peer-reviewet metodeartikel. Forklarer statistiske krav, men fairness omfatter også formål, adgang, administration og konsekvenser.
- Society for Industrial and Organizational Psychology, Principles for the Validation and Use of Personnel Selection Procedures, 2018. Faglige principper for jobanalyse, validering, fairness og dokumentation i udvælgelse. Principperne er vejledning og skal anvendes i den konkrete kontekst.



