Welke indelingen, onderscheidingen en begrippen zijn er omtrent testtheorie? - Chapter 3

De testindeling die in het volgende hoofdstuk gemaakt is, beoogt twee doelen te bereiken:

  1. De lezer een systematisch overzicht geven van beschikbare tests en testmethodieken.

  2. Veelgebruikte begrippen op een samenhangende wijze introduceren en behandelen.

Tests kunnen op twee verschillende manieren ingedeeld worden. De indeling naar testgedrag is de belangrijkste indeling. De tweede indeling is op basis van de verschillende manieren van testinstructie en -afname. Er is ook nog een derde indeling mogelijk; indelen op basis van het soort testvragen waar de test uit bestaat. Hier wordt in hoofdstuk 4 verder op ingegaan.

Hoe kunnen tests ingedeeld worden op basis van testgedrag?

Bijna alle overzichten gaan uit van de indeling van tests naar testgedrag. Er zijn echter ook andere indelingen mogelijk, zo stelt Visser een indeling voor op basis van het gebruiksdoel of de meetpretentie. Een groot bezwaar tegen dit voorstel is dat in verschillende gebruikssituaties er geheel verschillende meetpretenties (doelen) aan de orde zijn. En bovendien is dit niet de meest gangbare en internationale indeling. Indeling op basis van gedrag heeft echter ook nadelen; het aangeven in welke categorie een psychologische eigenschap thuishoort is niet altijd ondubbelzinnig.

Bij het uitgaan van testgedrag wordt er onderscheid gemaakt tussen tests voor prestatieniveau en tests voor gedragswijze. Bij de eerste gaat het om de maximale prestatie van de onderzochte persoon, het is duidelijk wat goed en wat fout is. Bij de laatste is niet van tevoren bekend wat goed en wat fout is, de maximale prestatie wordt niet verkregen door de prestatie op de test; het is belangrijk hoe iemand iets doet en op welke wijze de prestatie of reactie plaatsvindt.

Welk onderscheid is er te maken bij tests voor prestatieniveau?

 

Enkelvoudige algemene niveautestsVeelvoudige algemene niveautestsSpeciale niveautestsVorderingtests 
Individuele niveautestsTestbatterijen voor intteligentiefactorenTests voor speciale intelligentiefactoren'Achievement tests'
Individuele ontwikkelingtests voor volwassenenTestbatterijen voor geschikthedenTestbatterijen voor speciale geschiktheden'Proficiency' tests
Algemene collectieve intelligentietests Tests voor speciale niet-intelligentiefactoren 

Bij de tests voor prestatieniveau zijn vier tests te onderscheiden, namelijk:

  1. Enkelvoudige algemene niveautests.
  2. Veelvoudige algemene niveautests.
  3. Speciale niveautests.
  4. Vorderingstests.

1. Enkelvoudige algemene niveautests

Enkelvoudige algemene niveautests zijn de grootste en belangrijkste tests. Bij deze tests gaat het om een niveaubepaling van de intelligentie; het gaat dus niet om de verschillende intelligentiegebieden. Er zijn drie enkelvoudige algemene niveautests. De eerste twee zijn individuele tests en de derde is een groepstest:

  1. Individuele intelligentietests voor volwassenen: Het intelligentieniveau wordt vastgesteld nadat intelligentie min of meer als volgroeid mag worden beschouwd (vanaf 15 à 17 jaar). Voorbeelden zijn de WAIS, GIT en Terman-Merrill. Deze tests hebben intelligentienormen voor alle leeftijd, inclusief de ouderdom.

  2. Individuele ontwikkelingstests voor kinderen: Het doel van deze tests is het meten van de intelligentie tijdens de ontwikkeling. De intelligentiescore van het kind wordt vergeleken met de testprestaties van leeftijdsgenoten. Soms wordt het vergeleken met de chronologische leeftijd om te bepalen hoe snel of hoe langzaam de intelligentie-ontwikkeling heeft plaatsgevonden. Voorbeelden zijn de WISC-R en Rakit.

  3. Algemene collectieve intelligentietests: Deze tests gebeuren vaak schriftelijk en groepsgewijs. Ze zijn breed en gevarieerd samengesteld. Er zijn collectieve intelligentietests voor volwassenen en voor kinderen, en collectieve non-verbale intelligentietests. Deze laatste hebben meestal niet een maximale brede samenstelling, omdat er geen verbaal materiaal gebruikt wordt. Ze zijn nuttig bij het testen van niet-geletterden en bij populaties met een verschillende culturele en taalkundige achtergrond.

2. Veelvoudige algemene niveautests

Bij veelvoudige algemene niveautests is differentiatie wel belangrijk. Een verschil met bovenstaande tests is dat deze tests afzonderlijk gezien voldoende betrouwbaar zijn en onderling voldoende afhankelijk zijn. Er zijn twee categorieën van veelvoudige algemene niveautests:

  1. Testbatterijen voor intelligentiefactoren: De verschillende items in een test worden samengevoegd tot enkele factoren. De meest bekende factoren zijn die van Thurnstone (Verbal, Number, Spatial, Word fluency, Memory, Reasoning). De PMA, een testbatterij samengesteld door Thurstone, probeert deze factoren 'zuiver' te meten. Een voorbeeld in Nederland is de testserie voor 'hoger niveau' van Drenth. Een alternatief voor de factoren van Thurnstone is het factoranalytische systeem van Guilford. Hij leidde uit de praktijk een aantal factoren af en noemde het de 'structure of intellect theory'.

  2. Testbatterijen voor geschiktheid oftewel 'multiple aptitude' tests: Het gaat om het meten van vermogens waarmee iemand zich voor een maatschappelijke taak of schoolopleidingseisen kan bekwamen (geschiktheden). Eigenlijk gaat het om leergeschiktheid. Leerfactoren kunnen soms hetzelfde, maar ook iets heel anders zijn dan intelligentiefactoren, zoals bijvoorbeeld motorische vaardigheden. Voorbeelden van dergelijke tests zijn de leerpotentiaaltests, DAT (Differential Aptitude Testbattery) en GATB (General Aptitude Test Battery).

3. Speciale niveautests

Speciale niveautests richten zich op een bepaald segment van begaafdheid, bijvoorbeeld een intelligentie-aspect, geschiktheid of een vaardigheid. Ze vallen vaak niet onder intelligentie maar ze zijn wel belangrijk. Er zijn drie categorieën van speciale niveautests:

  1. Tests voor speciale intelligentiefactoren: Dit kunnen bijvoorbeeld tests zijn die zich alleen richten op ruimtelijk inzicht, woordkennis etc. Op basis van de theorie van Guilford komen we tot drie gebieden. De eerste is die van het divergent denken (creativiteit). De onderzochte moet oplossingen bedenken voor een probleem waarvoor er vele oplossingen mogelijk zijn. De antwoorden worden aan de hand van drie criteria beoordeeld; hoeveelheid oplossingen, aantal verschillende principes en originaliteit. Het tweede gebied is die van de behavorial-dimensie (sociale intelligentie). Uit onderzoek blijkt dat het moeilijk te onderscheiden is van andere intelligentiefactoren. Het laatste gebied is kritisch denken. Ook dit is moeilijk te onderscheiden. Eigenlijk is de vraag of iets wel of niet onder intelligentie valt afhankelijk van de definitie die je aanhoudt.

  2. Tests voor speciale geschiktheden oftewel 'special aptitude tests': Er zijn twee soorten, de eerste soort zijn tests voor leergeschiktheden die zich richten op leercondities bijvoorbeeld geheugentests, tempotests en concentratietests. Bijvoorbeeld de Bourdon-Wiersma test, Grünbaumtest en het onderdeel ‘snelheid en nauwkeurigheid uit de DAT. Ook tests die gericht zijn op specifieke leergeschiktheden vallen hieronder. De tweede soort zijn tests voor werkgeschiktheid die zich richten op typische vaardigheden die nodig zijn voor maatschappelijke functies, bijvoorbeeld geschiktheid als piloot of chauffeur.

  3. Tests voor speciale niet-intelligentiefactoren: Deze tests richten zich op vaardigheden of capaciteiten die belangrijk zijn voor een maatschappelijke functie of klinische diagnostiek. Er zijn drie soorten, namelijk (1) motoriektests (tests voor reactiesnelheden, lichaamsbeheersing en coördinatie; het gaat hierbij om de beeldvorming van de motoriek), (2) artistieke tests (men probeert een esthetisch oordeel te geven) en (3) sensorische tests (waarbij het gaat om gehoorscherpte, diepte zien, etc., het gaat hierbij om de beeldvorming van sensorische vaardigheden).

4. Vorderingstests

De cruciale vraag bij een vorderingstest is of iemand het doel van een opleiding heeft bereikt. Let wel: vorderingstests zijn niet hetzelfde als kennistests, want het doel van een opleiding is vaak niet alleen het verkrijgen van kennis. Er zijn twee soorten vorderingstests:

  1. Achievement test: dit is een kennistest die meer specifiek gericht is op schoolvorderingen. Bijvoorbeeld de CITO-toets.
  2. Proficiency test: dit is een vaardigheidstest die meer algemeen gericht is op vaardigheden buiten de cognitieve sfeer en kennis.

In Nederland lijken proefwerk en schriftelijk examen het meest op de kennistest. Er is een vloeiende overgang tussen de kennistest en de vaardigheidstest. Strikt genomen zijn ‘begrijpend lezen’, ‘begrijpend luisteren’ en ‘rekenvaardigheid’ ook vaardigheidstests.

Welk onderscheid is er te maken bij tests voor gedragswijze?

 

ObservatiesSomato-fysiologische methodenZelfbeoordelingenKwalitatieve prestatietests
Individuele observatietestsMorfologisch onderzoekInteressetests

Niveautests voor gedragswijze:

  • Experimentele tests
  • Motoriektests
  • Intelligentietests
  • Karkatertests
  • Cognitieve/ perceptuele stijlen
GroepsobservatiesFysiologisch onderzoekWaarde-attitudestests 
  Biologische vrangelijst

Projectietests:

  • Perceptie-tests
  • Intrepretatie-tests
  • Expressie-tests
  • Constructie-tests
  • Associatie-tests
  • Keuze-tests
  Persoonlijkheids-vragen 

Het prestatievermogen bepalen is makkelijker dan het bepalen van gedragswijze. Er zijn drie problemen bij het bepalen van gedragswijze:

  1. Minder generaliseerbaarheid: Metingen van prestatieniveau zijn eenvoudig generaliseerbaar naar het praktische functioneren, maar gedrag in een testsituatie is niet altijd hetzelfde als gedrag in het dagelijks leven.

  2. Geen objectief criterium: Er is geen objectief criterium waarmee testprestaties kunnen worden vergeleken, dus er is sprake van weinig objectiviteit en betrouwbaarheid bij het vergelijken van testprestaties.

  3. Minder stabiliteit van persoonlijkheidstrekken: Persoonlijkheidstrekken zijn vaak minder stabiel en kunnen per situatie verschillen en hebben een minder gelijkmatige invloed op gedrag.

Maar onderzoek naar persoonlijkheid is praktisch en psychologisch wel van belang en er zijn veel testen om de persoonlijkheid te meten. Er zijn vier verschillende test voor gedragswijze, die zullen hieronder worden besproken, namelijk (1) observatietests, (2) somato-fysiologische tests, (3) zelfbeoordelingen en (4) kwalitatieve prestatietests.

1. Observatietests

In vergelijking met andere tests voor gedragswijze is een observatietest een indirecte test omdat het om observaties en interpretaties van de psycholoog gaat. Er zijn twee soorten observatietests:

  1. Individuele observatietests: Een persoon wordt geobserveerd. Er wordt gelet op werkgedrag, houding, mimiek, uiterlijk gedrag en sociaal contact. De observator kan neutraal of geheel betrokken zijn. Meestal weet de onderzochte dat hij/zij geobserveerd wordt. Bij het gebruik van een one-way screen hoeft dat niet het geval te zijn.

  2. Groepsobservatietests: Een groep mensen dat gezamenlijk aan een opdracht bezig is, wordt geobserveerd. Dit soort tests komen voor in zogenaamde ‘assessment centers’ voor de selectie van managers. Een andere vorm is een vorm waarbij deelnemers elkaar beoordelen en de psycholoog de beoordelingen verder verwerkt. Dit noemt men ‘peer rating’ of ‘buddy rating’. Een voorbeeld is een sociogram: ieder groepslid moet aangeven wie sympathiek is, wie leider is etc. Op basis van deze keuzes wordt een patroon van relaties in de interacties zichtbaar.

2. Somato-fysiologische methoden

Men gaat er vanuit dat er een verband is tussen fysieke/fysiologische aspecten en gedragskenmerken. Door middel van metingen van lichamelijke kenmerken of processen probeert men uitspraken te doen over de psychologische kwaliteiten van de onderzochte. Er zijn twee soorten methoden.

  1. Morfologisch onderzoek: Met behulp van somatische kenmerken (hele lichaam, hoofd of gezicht) probeert men iets te zeggen over persoonlijkheidskenmerken. De validiteit is erg laag.

  2. Fysiologisch onderzoek: Voorbeelden van fysiologisch onderzoek zijn: biochemische indices, elektro-encefalogram (EEG), elektrocardiogram, bloeddruk en bloedvolume, oogbewegingen, oogposities en pupildiameter, elektrodermale verschijnselen. Deze fysiologische maten blijken een verband te hebben met psychologische variabelen die belangrijk zijn voor het persoonlijkheidsonderzoek. Sommige verbanden zijn empirisch vastgesteld, maar onverklaard. Soms zijn er theoretische verklaringen gegeven. Ontwikkelingen hierin worden steeds belangrijker voor gedragsdiagnostiek.

3. Zelfbeoordelingen

Zelfbeoordelingen worden meestal afgenomen in de vorm van vragenlijsten. Ze zijn lang gewantrouwd omdat ze niet echt objectief zouden zijn. Een andere vorm is via empirisch onderzoek, er wordt dan gekeken of er een bepaald patroon is in de wijze van beantwoorden. Op basis daarvan kan men een psychologische interpretatie geven aan elke vraag. Deze methode levert meer valide conclusies op. Uit theoretische onderzoeken uit praktijkervaring blijkt de zelfbeoordeling toch een waardevolle methode te zijn. Er zijn vier soorten zelfbeoordelingen:

  1. Interessetests: Deze tests hebben betrekking op interesses en kunnen gebruikt worden bij het bepalen van school- of beroepskeuzes.

  2. Waarde- en attitudetests: Deze tests onderzoeken waarden en attitudes (houdingen). Bijvoorbeeld de California-F-Scale geeft aan in hoeverre iemand dogmatisch, conservatief en bevooroordeeld staat tegenover de politiek, cultuur en sociale factoren. Of de Schaal voor Interpersoonlijke Waarden, die meet zes waarden, namelijk sociale steun, erkenning, altruïsme, conformiteit, onafhankelijkheid en leiderschap.

  3. Biografische vragenlijsten: ​​Dit zijn systematische schriftelijke anamneses, oftewel vragenlijsten over biografische gegevens. De te voorspellen criteria zijn vaak specifiek, en het aantal biografische gegevens is groot en complex. Daarom wordt hiervoor meestal een specifieke vragenlijst gemaakt.

  4. Persoonlijkheidsvragenlijsten: Het gaat hier om persoonlijkheidstrekken, zoals neuroticisme, extraversie enzovoort. De proefpersoon krijgt eenvoudige vragen die met deze persoonlijkheidstrekken samenhangen. Uitgaande van persoonlijkheidsvragenlijsten zijn er drie soorten constructies:

    • Zuiver empirisch samengestelde vragenlijsten op basis van hun relatie met een relevant geacht criterium. Bijvoorbeeld de PMT meet één trek; de MMPI meet een aantal trekken;

    • Via factoranalyse of clusteranalyse. De items worden samengesteld uit een groot aantal persoonlijkheidstests. Bijvoorbeeld 16PF en GZTS;

    • Vanuit een theorie over persoonlijkheid of temperament. Bijvoorbeeld de Amsterdamse Biografische Vragenlijst, de NEO-PI-R of de NEO-FFI.

Er zijn ook zelfbeoordelingsmethoden die anders werken dan met vragenlijsten. Enkele voorbeelden zijn:

  1. De Osgoodschalen of de methode van de semantische differentiaal: De proefpersoon moet een aantal objecten, gebeurtenissen of een serie eigenschappen beoordelen op een aantal bipolaire dimensies, zoals mooi/lelijk, sterk/zwak of glad/ruw. Door factoranalyse kwamen de onderzoekers tot drie significante dimensies waarop de antwoorden van de proefpersonen gescoord kunnen worden. Deze zijn: evaluatie (goed/slecht), activiteit (actief/passief) en potentie (sterk/zwak). Deze dimensies bleken niet sterk cultuurgebonden te zijn. Door de beoordelingen van de respondenten over te brengen op deze 3 dimensies, krijgt men een indruk van hun beleving van bepaalde verschijnselen (zoals huwelijk, liefde, rechtvaardigheid, hun beroep of zichzelf).

  2. De Role Construct Repertoire van Kelly (de Rep-test): De proefpersonen beoordelen zichzelf, hun leraar, vader of andere relevante personen op een checklist met adjectiva over persoonlijkheidsontwikkeling. Op deze manier ontstaan constructen over de persoonlijkheid.

  3. Q-technique of Q-sort: Iemand wordt gevraagd een serie uitspraken te sorteren op basis van de gelijkenis met bijvoorbeeld zichzelf (‘self-sort’), het ideaal (‘ideal-sort’) of de gemiddelde mens (‘average-sort’). Niet alleen de absolute scores, maar ook de afwijkingsscores worden geïnterpreteerd, want die blijken diagnostische betekenis te hebben. Bijvoorbeeld de discrepantie tussen het ideale zelfbeeld en het waargenomen zelfbeeld.

4. Kwalitatieve prestatietests

Bij kwalitatieve prestatietests wordt het resultaat (prestatie) van de onderzochte anders beoordeeld of geïnterpreteerd; namelijk als een indicatie voor een persoonlijkheidstrek of een klinisch syndroom. De onderzochte weet niet wat de bedoeling is van de test. Er zijn twee soorten kwalitatieve prestatietests:

1. Niveautests voor gedragswijze

De prestatie wordt beoordeeld aan de hand van een duidelijke norm voor wat goed of fout is. Men gaat er vanuit dat de score samenhangt met een persoonlijkheidstrek of met een klinisch diagnostische categorie. Bovendien gaat het in eerste instantie niet om een capaciteit of vaardigheid. Er zijn vijf categorieën niveautests voor gedragswijze (gebaseerd op de aard van de opdracht):

  1. Experimentele tests: Onderzoeksresultaten uit het laboratorium blijken bruikbaar te zijn voor persoonlijkheidsdiagnostiek.

  2. Motoriektests: Motorische verschijnselen vertonen samenhang met persoonlijkheidsaspecten, zoals bijvoorbeeld coördinatieproeven.

  3. Intelligentietests: De totaalscore wordt gebruikt voor klinische- of persoonlijkheidsdiagnostiek. Bijvoorbeeld de intelligentietests voor de diagnostiek van disfuncties in de hersenen en hersenbeschadigingen, zoals de Bender Gestalt Test.

  4. Karaktertests: Proberen het karakter, de zedelijke aspecten of de wilskracht te meten. Bijvoorbeeld de volhardingstests. De tests zijn vaak onbetrouwbaar en afhankelijk van de specifieke tijd in de geschiedenis en het ‘zedelijk klimaat’.

  5. Cognitieve of perceptuele stijlen: Een cognitieve stijl is de manier waarop iemand informatie organiseert en bij een perceptuele stijl gaat het om waarnemingsgegevens, die subjectief worden opgenomen en verwerkt. Voorbeelden zijn: RFT (Rod and Frame Test), EFT (Embedded Figures Test) en BAT (Body Adjustment Test).

2. Projectietests

Vaak ambigue opdrachten waarop een persoon vrij mag reageren. In zijn reactie laat de persoon iets zien van zijn motieven. De psycholoog gebruikt coderings- en interpretatiecategorieën gebaseerd op kwalitatieve kenmerken van de reacties op de testopgaven. Er zijn zes categorieën projectietests of projectieve methoden.

  1. Perceptietests: De onderzochte reageert op ongestructureerde (inkt)vlekken, elke zingeving en duiding wordt door de psycholoog geïnterpreteerd. Bijvoorbeeld de Rorschachtest of Holtzman Inkblot Test.

  2. Interpretatietests: Men moet vanuit persoonlijke interpretatie de afgebeelde situatie interpreteren of met elkaar in verband brengen. Bijvoorbeeld de Thematic Apperception Test (TAT) of de Vier-Platen-Test.

  3. Expressietests:Bijvoorbeeld de boomtest of de grafologie.

  4. Constructietests: Ook wel speeltests, bijvoorbeeld de Scenotest.

  5. Associatietests: Bijvoorbeeld de zinaanvullingstest of de frustratietest.

  6. Keuzetests: Bijvoorbeeld de Szonditest.

Wat zijn voorbeelden van tests en voldoen ze aan de zes kenmerken van tests?

RAKIT – algemene intelligentie (revisie Amsterdamse KinderIntelligentieTest)

De test bestaat uit 12 deeltests die samen de algemene intelligentie meten van kinderen van 4-11 jaar. De test heeft een lange en een korte versie (voor een gedifferentieerd beeld of een globale indruk), en sluit aan bij Thurstone (zeven intelligentiefactoren) en Guilford (drie dimensies). Wordt door COTAN beoordeeld als een goede test.

De test voldoet aan de zes kenmerken van een test (zie H2) waardoor deze onderscheiden wordt van het voorwetenschappelijk oordeel:

  1. Efficiëntie: door het groot aantal gevarieerde taken kan in relatief korte tijd een vrij volledig beeld gekregen worden van het complexe intelligentiebegrip. Observatie ‘in vivo’ zou veel meer tijd kosten.

  2. Standaardisatie: de test wordt individueel voorgelegd en duurt 2-2,5 uur. Heeft zeer gedetailleerde richtlijnen voor de proefleider, de handleiding bevat veel aanwijzingen over de procedure en gedetailleerde instructies per deeltest. Er wordt nadrukkelijk genoemd dat zich niet houden aan de aanwijzingen de testprestaties nadelig kan beïnvloeden.

  3. Normering: genormeerd op basis van zeven leeftijdsgroepen (4,5-11 jaar) van duizenden proefpersonen. Groepen zijn samengesteld op basis van regio, urbanisatiegraad, schoolgrootte, leeftijd en sekse. De ruwe testscores zijn omgezet naar een goed te interpreteren schaal. En er is een samenvattende score van de algemene intelligentie beschikbaar.

  4. Objectiviteit: over het algemeen objectief, maar soms ook een subjectieve beoordeling. De uiteindelijke testscore wordt verkregen met een goed omschreven (maar complexe) scoringsprocedure. Er kan niet worden uitgesloten dat verschillende beoordelaars tot verschillende scores komen.

  5. Betrouwbaarheid: de betrouwbaarheid is gegeven voor drie leeftijdsgroepen – wat voor de ene leeftijd betrouwbaar is, hoeft namelijk niet voor de andere leeftijd betrouwbaar te zijn. De deeltests zijn in alle leeftijdsgroepen redelijk tot voldoende betrouwbaar, de totaalscore is zelfs zeer betrouwbaar.

  6. Validiteit: de samenhang van de deeltests met externe variabelen is onderzocht om de betekenis vast te stellen. Vastgesteld kan worden dat de RAKIT een aantal relevante criteria (CITO-scores, vervolgonderwijs) behoorlijk goed kan voorspellen.

Test voor transitief redeneren – specifieke test (computertest Bouwmeester)

Transitief redeneren is op basis van voorgaande kennis (premissen) een antwoord op een probleem af te leiden. Het kunnen afleiden van transitieve relaties is belangrijk voor het onderwijs en dagelijks leven bij het nemen van rationele beslissingen (bijvoorbeeld bepalen in welke winkel een bepaald product het goedkoopst is). De test bestaat uit 16 taken (via de computer); per taak krijgt men eerst de premissen te zien, waarbij het kind bijvoorbeeld moet aangeven welke stok het langst is. Daarna wordt gevraagd naar de relatie tussen twee stokken die nog niet als premissenpaar zijn gegeven, maar die wel af te leiden is uit de premissen.

Voldoet de test voor transitief redeneren aan de zes kenmerken van een test?

  1. Efficiëntie: diverse relevante aspecten van transitief redeneren komen in korte tijd aan bod.

  2. Standaardisatie: het kan afgenomen worden door een getrainde proefleider aan individuele kinderen; de kinderen krijgen uitleg en proeftaken. De proefleider reageert op vragen op een vooraf goed doordachte manier – zonder het oplossingsproces te sturen. Testtijd is ongeveer een half uur (varieert per leeftijd).

  3. Normering: het wordt alleen in wetenschappelijk onderzoek gebruikt. Er zijn geen normen voor individuele diagnostiek beschikbaar.

  4. Objectiviteit: de reacties worden via de computer geregistreerd, de uitleg is gestandaardiseerd. De objectiviteit was voldoende hoog.

  5. Betrouwbaarheid: betrouwbaarheid van de somscore op de items was ook voldoende hoog.

  6. Validiteit: volgens Piaget zijn er twee vaardigheden voor transitief redeneren, maar volgens Bouwmeester is er maar één (hooguit daarnaast nog verbale vaardigheid voor de verbale taken). De onderzoeken van Bouwmeester geven nauwkeurig weer wat de test meet.

NEO – meting van de Big-Five persoonlijkheidsstructuur

Deze test meet vijf dominante persoonlijkheidskenmerken:

  1. Neuroticisme: emotionele labiliteit versus emotionele stabiliteit: angst speelt een dominante rol.

  2. Extraversie: extraversie versus introversie: naar binnen of naar buiten gerichte energie, aandacht en oriëntatie.

  3. Openheid: openstaan voor ervaringen versus conventionaliteit en geslotenheid: intellectuele nieuwsgierigheid, voorkeur voor variatie en esthetiek.

  4. Altruïsme: altruïsme versus egoïsme: georiënteerd op de belangen van anderen, hulpvaardig, gericht op samenwerken.

  5. Consciëntieusheid: de mate van goed georganiseerd zijn, volhardend, ambitieus, betrouwbaar en gewetensvol handelen.

De test wordt gebruikt bij patiënten, voor arbeidsselectie en bij de beoordeling van de geschiktheid voor trainingen en opleidingen. Het wordt ook veel gebruikt in wetenschappelijk onderzoek. De test heeft een korte en een lange versie en maakt onderscheid op zes facetten per eigenschap. De lange versie heeft 240 items en geeft een genuanceerd beeld van de 30 facetten. Als voorbeeld de zes facetten van Neuroticisme:

  1. Angst: de mate waarin men bang, zorgelijk, nerveus, gespannen en schrikachtig is.

  2. Ergernis: de mate waarin men frustratie, boosheid en haat ervaart.

  3. Depressie: de mate waarin men schuld, verdriet, hopeloosheid en eenzaamheid ervaart.

  4. Schaamte: de mate waarin men verlegen is en gevoelig is voor spot en beoordeling van anderen.

  5. Impulsiviteit: de mate waarin men zijn verlangens en gevoelens slecht beheerst.

  6. Kwetsbaarheid: de mate waarin men spanning en stress slecht beheerst.

De items zijn uitspraken in de ‘ik-vorm’ die gaan over een facet van de eigenschap. De respondent geeft per item aan in hoeverre hij het met de uitspraak eens is (helemaal oneens / oneens / neutraal / eens / helemaal eens), en krijgt een score van 1 tot 5 punten; hoger betekent dat positie op de schaal voor die eigenschap hoger is.

Voldoet de NEO aan de zes kenmerken van een test?
  1. Efficiëntie: door zich een voorstelling te maken van een groot aantal verschillende situaties, kan in korte tijd een indruk verkregen worden van de vijf persoonlijkheidstrekken.

  2. Standaardisatie: de tests kunnen individueel en groepsgewijs worden afgenomen. NEO-FFI duurt 10-15 minuten, NEO-PI-R duurt 40-50 minuten.

  3. Normering: per trek wordt de deeltestscore berekend door de itemscores bij elkaar op te tellen. Er wordt aangenomen dat de scores in de populatie op een normaalverdeling liggen; men krijgt dan een nieuwe score op een schaal van 1-9, die correspondeert met gelijke delen onder de normaalverdeling: stanines. Deze normen zijn vastgesteld voor diverse deelpopulaties met behulp van steekproeven met duizenden proefpersonen.

  4. Objectiviteit: de scoring is objectief doordat per item is vastgesteld hoeveel punten men krijgt bij elk antwoord. Zo komt elke psycholoog tot hetzelfde antwoord.

  5. Betrouwbaarheid: de betrouwbaarheid van de verkorte versie varieert per bevolkingsgroep en per eigenschap van 0.57 tot 0.88. De COTAN beoordeelt het als voldoende.

  6. Validiteit: van elke eigenschap is de samenhang onderzocht met variabelen die psychisch, sociaal en lichamelijk welbevinden representeren. De COTON vindt dat de betekenis van de testscores in voldoende mate is aangetoond, maar dat er onvoldoende onderzoek is geweest naar de voorspellende waarde.

Hoe kunnen tests ingedeeld worden naar instructie en afname?

Er zijn twee onderscheidingen in afneming en instructie mogelijk, namelijk individuele test versus groepstest en snelheidstest versus niveautest.

Wat is het verschil tussen individuele tests en groepstests?

Individuele tests

Bij een individuele test is er sprake van een individuele testsituatie en individuele instructie. Er is een individuele relatie tussen de testleider en de onderzochte, de vragen worden stuk voor stuk geformuleerd of aangeboden en reacties/prestaties worden persoonlijk vastgelegd. Is vooral in Europa populair. Voordelen aan deze test zijn (1) de mogelijkheid om de onderzochte te stimuleren, (2) controle op de situatie en op de inhoud en (3) de mogelijkheid tot observatie van de onderzochte. Nadelen zijn de geringe efficiëntie en dat de informatie niet op een systematische wijze verkregen wordt.

Groepstests

Bij een groepstest geeft de testleider instructies aan een groep. Een voordeel is efficiëntie en de besparing van geld en tijd. Nadelen zijn problemen met de orde houden en het risico op afkijken; zaken die invloed kunnen hebben op de testprestatie. Hoe groot een groep mag zijn, hangt af van de aard van de test, het doel van het onderzoek en de leeftijd van de onderzochten. Bij patiënten, jonge kinderen en in ontwikkelingslanden is groepsgewijs testen moeilijker en bij kinderen jonger dan 5 jaar helemaal onmogelijk.

Zowel individuele test als groepstest kunnen schriftelijk en via de computer worden afgenomen. Individuele tests kunnen daarnaast ook mondeling worden afgenomen of middels een verrichtingstest.

Wat is het verschil tussen een snelheidstest en een niveautest?

Een snelheidstest wordt ook wel speedtest genoemd. Een niveautest noemt men ook wel powertest. Uitgaande van een vaste periode kijkt men bij een snelheidstest hoe snel iemand een bepaalde opdracht af heeft.

Snelheidstest

  • Veel opgaven, dus het is nooit binnen de toegestane tijd af.
  • De opgaven zijn ongeveer even moeilijk.
  • De opgaven zijn vaak bijzonder gemakkelijk.
  • Bij de beoordeling worden fouten vaak niet meegerekend.

Niveautest

  • Opgaven zijn niet even moeilijk.
  • Opgaven lopen van makkelijk naar moeilijk.
  • Iedereen kan de makkelijkste oefeningen maken en vrijwel niemand de moeilijkste.
  • Geen tijdslimiet (hoewel in de praktijk vaak wel, maar dan ruim genomen).
  • Beoordeling op basis van de correcte oplossingen.

Een interessante vraag is of tests, onder de verschillende voorwaarden van snelheid of niveau, toch dezelfde eigenschap kunnen meten. Het lijkt dat snelheidstests samenhangen met kwantiteit en niveautests met kwaliteit. Er is een positieve correlatie gevonden tussen de prestaties onder beperkte en onbeperkte tijd.

Meili kwam met twee hypothesen met betrekking tot de verhouding tussen snelheid en niveau:

  1. De snelheid waarmee gemakkelijk opgaven worden opgelost geeft geen aanwijzing voor het vermogen moeilijk opgaven op te lossen.

  2. De snelheid waarmee moeilijke opgaven worden beantwoord is wel een aanwijzing voor het vermogen als zodanig om deze problemen op te lossen, maar weer niet voor de snelheid waarmee eenvoudiger taken worden verricht.

Er is een gedeeltelijke bevestiging van beide hypothesen gevonden: de snelheid bij makkelijke opgaven stond los van de intelligentie en de snelheid van werken bij moeilijke opdrachten.

Model van Van der Ven: de precisiescore is de proportie goede antwoorden en de snelheidsscores is het aantal geprobeerde items. De correlatie tussen precisie en snelheid kan door deze twee scores worden verklaard – onder de aannamen dat precisie en snelheid onafhankelijk van elkaar zijn. Maar dit model werd bekritiseerd door Van den Wollenberg. Als alternatief voor de precisiescore stelde hij de persoonsscore uit het Rasch-model voor. Hij vond ook dat precisie en snelheid niet helemaal onafhankelijk zijn en dat er meer eigenschappen ten grondslag liggen aan de testprestatie dan deze twee alleen.

Bij het testen van woordenschat, kennisniveau en sensorische of artistieke vaardigheden is het snelheidselement niet belangrijk. Als het wel belangrijk is, moet de mate van de snelheid empirisch worden bepaald, afhankelijk van wat men wil weten of voorspellen. De optimale praktische uitvoering van een tijdslimiet (wel of niet, en hoe lang dan) hangt samen met de betrouwbaarheid en betekenis van de test.

Welk onderscheid kan er gemaakt worden op basis van testvragen?

De belangrijkste begrippen in verband met de onderscheidingen op basis van testvragen zijn: cultuurvrije en niet-cultuurvrije tests en directe en indirecte tests.

Wat is het verschil tussen cultuurvrije en niet-cultuurvrije tests?

Het gaat hier meer om een continuüm dan om een tegenstelling. Een zuivere cultuurvrije test bestaat niet en men moet er ook niet naar streven. De mens wordt altijd beïnvloed door zijn omgeving. Ook non-verbale tests zijn niet helemaal cultuurvrij. Non-verbale tests blijken vaak laag te correleren met allerlei relevante criteria. Misschien komt dit omdat de taal eruit gehaald is, die mogelijk een wezenlijke bijdrage levert aan het begrip intelligentie.

Het is beter om het complexe begrip ‘cultuur’ te vervangen voor een begrip dat beter omschreven kan worden, zoals het begrip ‘skill’. Om mee te kunnen doen aan een test heeft men bepaalde vaardigheden, 'skills', nodig, zoals het kunnen horen van instructies: vaardigheden die men met de test juist niet wil meten. Sommige skills zijn fysiologisch bepaald (kunnen horen of zien), anderen worden beïnvloed door cultuur of omgevingsinvloeden (kunnen lezen, schrijven etc.).

De invloed van skill-verschillen kan op drie manieren worden gereduceerd:

  1. Door het verkleinen van de skill-verschillen zelf, door bijvoorbeeld de instructie uit te breiden.

  2. Door interpretaties en testscores te beperken tot slechts dat deel van de populatie dat de vereiste skills bezit.

  3. Door het ontwikkelen van ‘skill reduced tests’, bijvoorbeeld de Design Construction Test van Ord, de SON (voor doven). Het doel is de groep te vergroten waarbinnen uit de testscores conclusies over de te meten capaciteit kunnen worden getrokken.

Wat is het verschil tussen directe en indirecte tests?

Een belangrijke vraag is of het doel van de test bekend is bij de onderzochte. Vrijwel alle projectiemethoden en de meeste zelfbeoordelingen en persoonlijkheidsvragenlijsten vallen onder indirecte tests; de onderzochte weet het doel van de test niet. Bij directe tests weet en begrijpt de onderzochte het doel van de test. Zoals bij bijna alle prestatietests en vorderingstests, biografische informatielijsten en opinie- en attitudetest.

Vragenlijsten kunnen ook in een indirecte vorm gegoten zijn. De meeste zelfbeoordelingen en persoonlijkheids-vragenlijsten zijn in zekere zin indirect: onderzochte weet niet hoe de vragen zullen leiden tot een interpretatie over de persoonlijkheid, interesse of attitude.

Wat is het verschil tussen vrije-antwoordtests en keuze-antwoordtests?

Vrije-antwoordentest en keuze-antwoordentests worden ook wel open versus gesloten vragen of ongecodeerde versus geprecodeerde vragen, genoemd. Het gaat hier om het verschil in uitvoering van de test. Hoofdstuk 4 gaat hier dieper op in.

Image

Access: 
Public

Image

Join: WorldSupporter!

Join with a free account for more service, or become a member for full access to exclusives and extra support of WorldSupporter >>

Check: concept of JoHo WorldSupporter

Concept of JoHo WorldSupporter

JoHo WorldSupporter mission and vision:

  • JoHo wants to enable people and organizations to develop and work better together, and thereby contribute to a tolerant and sustainable world. Through physical and online platforms, it supports personal development and promote international cooperation is encouraged.

JoHo concept:

  • As a JoHo donor, member or insured, you provide support to the JoHo objectives. JoHo then supports you with tools, coaching and benefits in the areas of personal development and international activities.
  • JoHo's core services include: study support, competence development, coaching and insurance mediation when departure abroad.

Join JoHo WorldSupporter!

for a modest and sustainable investment in yourself, and a valued contribution to what JoHo stands for

Check: how to help

Image

 

 

Contributions: posts

Help others with additions, improvements and tips, ask a question or check de posts (service for WorldSupporters only)

Image

Image

Share: this page!
Follow: Psychology Supporter (author)
Add: this page to your favorites and profile
Statistics
2667
Submenu & Search

Search only via club, country, goal, study, topic or sector