{"id":"W4400488323","doi":"10.1080/00223891.2024.2375213","title":"Broader Issues in Test Translation and Validation: A Commentary Inspired by Macina et al. (2023)","year":2024,"lang":"en","type":"letter","venue":"Journal of Personality Assessment","topic":"Natural Language Processing Techniques","field":"Computer Science","cited_by":1,"is_retracted":false,"has_abstract":true,"ca_institutions":"Université Laval; Université de Sherbrooke; Collège Laflèche; Université du Québec à Trois-Rivières","funders":"","keywords":"Psychology; Test (biology); Validation test; Test validity; Psychometrics; Clinical psychology; Ecology","routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.07562803,0.001751279,0.00279807,0.002702904,0.008585514,0.007976403,0.009443317,0.06955086,0.003444775],"category_scores_gemma":[0.3438461,0.001684894,0.003188728,0.002883578,0.01920065,0.01197299,0.005104776,0.08560493,0.005101684],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.01699361,"about_ca_system_score_gemma":0.02854822,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.03684233,"about_ca_topic_score_gemma":0.03319942,"domain_scores_codex":[0.9117637,0.03990319,0.01509948,0.006826247,0.02364047,0.002766932],"domain_scores_gemma":[0.6294129,0.2621311,0.009570272,0.006072856,0.08264939,0.01016357],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"not_applicable","study_design_gemma":"not_applicable","study_design_scores_codex":[0.000034341,0.00001881472,0.0001474478,0.0001960426,0.00001026703,0.0002393038,0.0005534904,0.00002712887,0.00007176239,0.001988928,0.9880307,0.008681834],"study_design_scores_gemma":[0.0001244738,0.00007286629,0.0009932357,0.002981696,0.00004778364,0.001077212,0.001525123,0.0004146729,0.0002844922,0.01369968,0.9786456,0.0001331395],"study_design_candidate":"not_applicable","study_design_consensus":"not_applicable","genre_codex":"commentary","genre_gemma":"commentary","genre_scores_codex":[0.00005560895,0.00154763,0.0001004686,0.9713147,0.02669557,0.00001039751,0.00002608428,0.00001709471,0.0002323027],"genre_scores_gemma":[0.0007612429,0.001022832,0.0003100575,0.9706289,0.02650057,0.0000597278,0.00001664552,0.00003117771,0.0006688692],"genre_candidate":"commentary","genre_consensus":"commentary","teacher_disagreement_score":0.07562803,"threshold_uncertainty_score":0.399964,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.02943416655327385,"score_gpt":0.3528010667475053,"score_spread":0.3233669001942314,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}