Spring til indhold
NYT WEBSITE LANCERET i DAGVi er i fuld gang med finpudsning og fejlretning :-)
Lykke og Co.
70 22 71 12

Vidensbank · DISC & personprofiler

Validitet: Hvad må en testscore bruges til?

Kort fortalt

Validitet er graden, hvori evidens og teori understøtter den ønskede fortolkning og brug af testscore. Spørgsmålet er derfor ikke kun, om en test er valid, men valid til hvad, for hvem, i hvilken sammenhæng og med hvilke konsekvenser.

Hvad er validitet?

Moderne validitetsteori samler flere evidenskilder i ét argument. Indhold, responsprocesser, intern struktur, relationer til andre variable og konsekvenser kan være relevante afhængigt af den påståede fortolkning.

Validitet bliver mest præcist, når begrebet kobles til konstrukt, instrument, population, administration, score og beslutningsformål. Det gør det muligt at skelne mellem en faglig definition, en praktisk model og en løs hverdagsetiket. Skellet er vigtigt, fordi de tre former ikke kan bære de samme konklusioner eller beslutninger.

Vigtige afgrænsninger

  • Indholdsrelevans undersøger om opgaverne repræsenterer konstruktet og jobbet.
  • Kriterierelation undersøger sammenhæng med et relevant udfald.
  • Konstruktvaliditet er den samlede teoretiske fortolkning, ikke én statistisk test.

Afgrænsningerne omkring validitet er ikke kun sproglige. De bestemmer, hvilke data der er relevante, hvilke fejl man risikerer, og om en anbefaling kan forsvares. Start derfor med at skrive, hvad begrebet omfatter og ikke omfatter i den konkrete brug.

Hvad viser forskningen?

Faglige standarder placerer ansvaret for validitetsargumentet hos både udvikler og bruger.

Meta-analytiske validiteter kan informere, men lokal brug kan afvige i job, population og kriterium.

Høj reliabilitet er nødvendig for mange fortolkninger, men gør ikke en irrelevant score valid.

Kilderne om validitet viser et samlet mønster, men de er ikke et løfte om et bestemt resultat hos en bestemt person eller arbejdsplads. Studier varierer i population, design, måling og kontekst. Korrelationer kan støtte en faglig hypotese, men fastslår ikke alene årsag og virkning.

Sådan kan validitet bruges ansvarligt

  1. Skriv den præcise scorefortolkning og beslutning.
  2. Saml evidens for indhold, struktur og relevante relationer.
  3. Undersøg alternative forklaringer og fairness.
  4. Monitorér konsekvenser, fejl og ændringer i populationen.

Skriv først hvilket konstrukt og hvilken beslutning validitet skal understøtte. Kontrollér instrument, normer, usikkerhed og dokumentation, og beslut på forhånd hvordan resultatet kombineres med andre data og forklares for den berørte person.

Begrænsninger og typiske fejl

  • Kald ikke en test valid uden anvendelseskontekst.
  • Brug ikke korrelation som bevis for årsag.
  • Ekstrapolér ikke ud over det scoreinterval og den gruppe, der er undersøgt.

Ved brug af validitet er den vigtigste kildekritiske regel proportionalitet. Jo større konsekvens en fortolkning får for mennesker, desto stærkere og mere lokal dokumentation kræves. En model kan være god til refleksion uden at være egnet til udvælgelse, diagnose eller juridiske konklusioner.

Måling og opfølgning

Ved måling af validitet: Dokumentér scoredefinition, måleusikkerhed, normgruppe og den præcise beslutning. Undersøg reliabilitet, validitet og fairness for den konkrete brug. Små forskelle omkring en tærskel bør behandles som usikre og suppleres med andre relevante data.

For validitet skal det på forhånd beskrives, hvad der tæller som forbedring, hvilken periode der er relevant, og hvem der kan korrigere fortolkningen. Hvis målet ændres efter resultaterne er set, bliver evalueringen let en efterrationalisering. Brug hellere få tydelige indikatorer end et stort dashboard uden beslutningsværdi.

Kort FAQ

Hvad betyder en score på validitet?

En score har kun mening i forhold til en defineret skala, administration, norm eller reference og et bestemt formål. Den indeholder måleusikkerhed og må ikke fortolkes som en fuldstændig eller uforanderlig beskrivelse af personen.

Kan resultatet bruges alene?

Nej ved beslutninger med konsekvenser. Brug kun validitet til et formål, dokumentationen understøtter, og kombiner resultatet med andre jobrelevante eller fagligt relevante data.

Hvilken dokumentation bør man bede om?

Bed om manual, konstruktsdefinition, reliabilitet, validitet, normgrundlag, fairness-analyser, versionsnummer og kompetencekrav. Markedsføring eller en generel henvisning til forskning er ikke det samme som lokal dokumentation.

Fra score til forsvarlig fortolkning

En fortolkning af validitet skal forbinde konstrukt, instrument, administration, referencegrundlag og beslutningsformål. Skriv også hvilken usikkerhed og hvilke alternative forklaringer der findes. Flere decimaler eller farvekategorier gør ikke målingen mere præcis.

Kontrollér dokumentationen for den aktuelle version og population. En generel forskningsartikel om et konstrukt validerer ikke automatisk et bestemt kommercielt instrument eller dets anvendelse i en konkret beslutning.

Implementering trin for trin

Trin 1: Skriv den præcise scorefortolkning og beslutning

Dokumentér trinnet: Skriv den præcise scorefortolkning og beslutning. Angiv instrumentversion, datagrundlag, fagligt ansvarlig, fortolkningsregel og grænser for anvendelsen. Den berørte person skal kunne stille spørgsmål og korrigere faktuelle fejl.

Trin 2: Saml evidens for indhold, struktur og relevante relationer

Dokumentér trinnet: Saml evidens for indhold, struktur og relevante relationer. Angiv instrumentversion, datagrundlag, fagligt ansvarlig, fortolkningsregel og grænser for anvendelsen. Den berørte person skal kunne stille spørgsmål og korrigere faktuelle fejl.

Trin 3: Undersøg alternative forklaringer og fairness

Dokumentér trinnet: Undersøg alternative forklaringer og fairness. Angiv instrumentversion, datagrundlag, fagligt ansvarlig, fortolkningsregel og grænser for anvendelsen. Den berørte person skal kunne stille spørgsmål og korrigere faktuelle fejl.

Trin 4: Monitorér konsekvenser, fejl og ændringer i populationen

Dokumentér trinnet: Monitorér konsekvenser, fejl og ændringer i populationen. Angiv instrumentversion, datagrundlag, fagligt ansvarlig, fortolkningsregel og grænser for anvendelsen. Den berørte person skal kunne stille spørgsmål og korrigere faktuelle fejl.

Kvalitetssikring før brug

Kontrollér at definition, kilder, anbefalinger og den konkrete anvendelse af validitet passer sammen. En kilde om gennemsnitlige sammenhænge kan ikke alene begrunde en individuel beslutning, og en teori om en mekanisme dokumenterer ikke automatisk effekten af et bestemt produkt.

Ved arbejde med validitet skal mindst ét perspektiv kunne udfordre den foretrukne forklaring, og berørte personer skal kunne korrigere faktuelle fejl. Ved høj konsekvens skal kontrol og dokumentation være tilsvarende stærkere.

Dokumentation og beslutningsspor

For validitet noteres formål, datakilder, ansvarlig, beslutningsregel, begrænsninger og dato for genbesøg. Beskriv også hvad der ikke blev målt, og hvilke personer eller situationer datagrundlaget dækker dårligt.

Ved gentagen brug af validitet skal versioner og ændringer kunne spores. Nye spørgsmål, systemer, normer eller målgrupper kan ændre fortolkningen, så en tidligere godkendelse må ikke behandles som permanent tilladelse til enhver anvendelse.

Spørgsmål til faglig gennemgang

  • Hvilken præcis definition af validitet bruger vi?
  • Hvilken beslutning eller adfærd skal begrebet forbedre?
  • Hvilken kilde er stærkest, og hvad kan den ikke dokumentere?
  • Hvilke alternative forklaringer er realistiske?
  • Hvem bærer risikoen ved en forkert fortolkning?
  • Hvornår og på hvilket grundlag stopper eller ændrer vi praksis?

Eksempel fra praksis

En organisation vil bruge validitet i en beslutning. Den definerer konstrukt og formål, kontrollerer dokumentationen for den konkrete version og skriver på forhånd, hvordan resultatet kombineres med andre data.

Nære eller modstridende resultater behandles som usikre. Personen får en forståelig forklaring, og organisationen registrerer både afgørelse, begrænsninger og mulighed for korrektion uden at gøre scoren til en identitet.

Fordeling af roller og ansvar

Testudbyderen skal levere dokumentation for instrument og version. En kompetent testbruger ejer korrekt administration og fortolkning, mens beslutningsejeren afgør formål, proportionalitet og hvordan validitet indgår med andre data.

Den testede person skal have forståelig information, relevant feedback og mulighed for at korrigere faktuelle fejl. Ved klinisk, juridisk eller anden reguleret brug kræves den relevante kvalifikation og konkrete faglige vurdering.

Kildernes styrker og svagheder

Standards for Educational and Psychological Testing

Tværfaglig fagstandard for validitet, reliabilitet, fairness, scoring og testbrug. Den er normativ vejledning, ikke et effektstudie af en bestemt test. I vurderingen af validitet bruges kilden derfor til det afgrænsede spørgsmål, den faktisk undersøger, og ikke som generelt bevis for alle produkter, personer eller arbejdspladser med samme begreb.

Principles for the Validation and Use of Personnel Selection Procedures

Faglige principper for jobanalyse, validering, fairness og dokumentation i udvælgelse. Principperne er vejledning og skal anvendes i den konkrete kontekst. I vurderingen af validitet bruges kilden derfor til det afgrænsede spørgsmål, den faktisk undersøger, og ikke som generelt bevis for alle produkter, personer eller arbejdspladser med samme begreb.

Revisiting Meta-Analytic Estimates of Validity in Personnel Selection

Peer-reviewet revurdering af klassiske validitetsestimater. Viser, at flere ældre korrektioner overvurderede niveauet, selv om rangordningen ofte var stabil. I vurderingen af validitet bruges kilden derfor til det afgrænsede spørgsmål, den faktisk undersøger, og ikke som generelt bevis for alle produkter, personer eller arbejdspladser med samme begreb.

Kilder og kildekritik

Kildelisten for validitet prioriterer faglige standarder, meta-analyser, systematiske reviews og originale modeller. Noterne angiver centrale begrænsninger. Det er vigtigt, fordi en troværdig udgiver eller peer review ikke i sig selv gør enhver praktisk påstand sand.

Relaterede begreber og hjælp i praksis

Læs også Reliabilitet og måleusikkerhed, Standardisering og normgrupper i psykologiske test, Råscore, percentil og standardscores forklaret.

Lykkeco bruger profiler og test som struktureret beslutnings- eller dialogstøtte inden for det formål, dokumentationen kan bære. Resultater fortolkes med usikkerhed, kontekst og mulighed for spørgsmål, aldrig som hele sandheden om et menneske. Her bliver validitet altid afgrænset til det formål og den evidens, som den konkrete anvendelse kan bære.

Relaterede begreber

Forløb der arbejder med det

Kilder og videre læsning

Vi bider ikke

Skal vi hjælpe jer på vej?

I behøver ikke vide præcis hvad I skal bruge. Vi hjælper jer med at finde det rigtige - og siger til, hvis noget andet passer bedre.