{"id":"W4297999228","doi":"10.1037/spq0000518","title":"Using many-facet rasch measurement and generalizability theory to explore rater effects for direct behavior rating–multi-item scales.","year":2022,"lang":"en","type":"article","venue":"School Psychology","topic":"Behavioral and Psychological Studies","field":"Psychology","cited_by":6,"is_retracted":false,"has_abstract":true,"ca_institutions":"Education and Early Childhood Development","funders":"","keywords":"Generalizability theory; Rasch model; Psychology; PsycINFO; Facet (psychology); Rating scale; Item response theory; Inter-rater reliability; Clinical psychology; Psychometrics; Social psychology; Developmental psychology; MEDLINE; Big Five personality traits; Personality","routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.1017781,0.000985594,0.0008743648,0.003325289,0.001011935,0.002527975,0.0009370744,0.0006363965,0.00228609],"category_scores_gemma":[0.2414919,0.0005792224,0.001987426,0.004175888,0.00179982,0.002604747,0.003197716,0.002034305,0.0007919269],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.001163215,"about_ca_system_score_gemma":0.001521222,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.003132251,"about_ca_topic_score_gemma":0.006258397,"domain_scores_codex":[0.8732362,0.09729425,0.00667794,0.007271834,0.01506992,0.0004498235],"domain_scores_gemma":[0.7027371,0.2093225,0.02530323,0.03475886,0.02708897,0.000789289],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"observational","study_design_gemma":"observational","study_design_scores_codex":[0.00047958,0.0005232046,0.5645717,0.001318895,0.003768257,0.0001474135,0.01541969,0.004098761,0.004580088,0.01650511,0.005705061,0.3828822],"study_design_scores_gemma":[0.0002497287,0.002606552,0.8707395,0.0008878133,0.0009276148,0.0005366432,0.006299605,0.05315252,0.006122579,0.03782029,0.0203871,0.0002699603],"study_design_candidate":"observational","study_design_consensus":"observational","genre_codex":"methods","genre_gemma":"empirical","genre_scores_codex":[0.2244741,0.001294932,0.7308653,0.000890924,0.0003702571,0.008631397,0.001685043,0.0008941482,0.03089392],"genre_scores_gemma":[0.76202,0.0003784231,0.2265195,0.0003628516,0.0001124132,0.007862959,0.001069683,0.0001649726,0.001509179],"genre_candidate":"empirical","genre_consensus":null,"teacher_disagreement_score":0.1017781,"threshold_uncertainty_score":0.5382605,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.4983916110037136,"score_gpt":0.4479995435687562,"score_spread":0.05039206743495739,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}