{"id":"W4401022221","doi":"10.1016/j.jneb.2024.05.138","title":"Exploring Response Shift Bias, Reliability and Validity by Using Retrospective Pretests-Posttests in EFNEP Evaluations","year":2024,"lang":"en","type":"article","venue":"Journal of Nutrition Education and Behavior","topic":"Evaluation and Performance Assessment","field":"Decision Sciences","cited_by":0,"is_retracted":false,"has_abstract":false,"ca_institutions":"","funders":"","keywords":"Reliability (semiconductor); Psychology; Validity; Clinical psychology; Psychometrics","routes":{"ca_aff":false,"ca_fund":false,"ca_venue":true,"about_ca":false,"invisible_to_affiliation_only":true},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.07773706,0.0006982876,0.0007735216,0.001365257,0.0009231587,0.001407145,0.0009820631,0.00105252,0.001468105],"category_scores_gemma":[0.1757035,0.0007524126,0.001166977,0.0009875703,0.0009633325,0.002348721,0.001466368,0.001225267,0.0007159799],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.001003201,"about_ca_system_score_gemma":0.001740497,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.001735006,"about_ca_topic_score_gemma":0.003810977,"domain_scores_codex":[0.9520693,0.02768403,0.00619013,0.00289891,0.009965669,0.001191829],"domain_scores_gemma":[0.6991593,0.2134623,0.02095737,0.01765529,0.04712417,0.001641634],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"observational","study_design_gemma":"observational","study_design_scores_codex":[0.003930151,0.003985378,0.8307012,0.0003412682,0.0004085992,0.0001176335,0.008302113,0.001202278,0.00487888,0.0004502214,0.0007624196,0.1449197],"study_design_scores_gemma":[0.0002552453,0.01205161,0.9517825,0.0001909708,0.0003258327,0.0002517472,0.003044089,0.007407107,0.02129893,0.0007174875,0.002578836,0.00009574649],"study_design_candidate":"observational","study_design_consensus":"observational","genre_codex":"empirical","genre_gemma":"methods","genre_scores_codex":[0.9846706,0.0001516322,0.01092023,0.000092836,0.00005857829,0.0008194885,0.0001788386,0.00008702782,0.003020863],"genre_scores_gemma":[0.9858682,0.00008919308,0.01102567,0.000100734,0.00003037722,0.001148222,0.0002760137,0.0000334889,0.00142829],"genre_candidate":"methods","genre_consensus":null,"teacher_disagreement_score":0.07773706,"threshold_uncertainty_score":0.4111177,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.4265571124088472,"score_gpt":0.5292730830177823,"score_spread":0.1027159706089351,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}