{"id":"W4385303643","doi":"10.1037/cbs0000380.supp","title":"Supplemental Material for L’évaluation de la validité de la performance en neuropsychologie clinique : sondage sur les pratiques et les croyances des neuropsychologues québécois","year":2023,"lang":"fr","type":"article","venue":"Canadian Journal of Behavioural Science/Revue canadienne des sciences du comportement","topic":"Educational and Psychological Assessments","field":"Psychology","cited_by":0,"is_retracted":false,"has_abstract":false,"ca_institutions":"","funders":"","keywords":"Psychology; Humanities; Philosophy","routes":{"ca_aff":false,"ca_fund":false,"ca_venue":true,"about_ca":true,"invisible_to_affiliation_only":true},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"codex-gemma-dda1882f352a","candidate_categories":["metaepi_narrow","sts","insufficient_payload"],"consensus_categories":["sts"],"category_scores_codex":[0.02125078,0.000422717,0.0004654975,0.0008845198,0.002334501,0.0008247148,0.001748853,0.000299781,0.001404085],"category_scores_gemma":[0.000868068,0.000387827,0.0002324495,0.001435415,0.009932114,0.000955986,0.00007030947,0.0006694104,0.000009557828],"about_ca_system_candidate":true,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.001549424,"about_ca_system_score_gemma":0.005943192,"about_ca_topic_candidate":true,"about_ca_topic_consensus":true,"about_ca_topic_score_codex":0.1571373,"about_ca_topic_score_gemma":0.2861482,"domain_scores_codex":[0.9934713,0.002394302,0.00116284,0.0007752586,0.0003486232,0.001847696],"domain_scores_gemma":[0.9955939,0.00124657,0.000805272,0.0002740942,0.0006410034,0.00143913],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"observational","study_design_gemma":"observational","study_design_scores_codex":[0.00005803821,0.0003425343,0.9215503,0.00008419487,0.00003961192,0.0004788355,0.02369943,0.0004884844,0.003096003,0.00771701,0.004906452,0.03753916],"study_design_scores_gemma":[0.0007793135,0.002483846,0.9599409,0.000291526,0.00009215533,0.001601354,0.01044124,0.0003279689,0.000256926,0.00538916,0.01798238,0.0004132039],"study_design_candidate":"observational","study_design_consensus":"observational","genre_codex":"empirical","genre_gemma":"empirical","genre_scores_codex":[0.9852837,0.0004398613,0.0002089589,0.006814688,0.004727201,0.0005341534,0.0005648914,0.00003434607,0.00139219],"genre_scores_gemma":[0.9912243,0.0006667796,0.006179059,0.0005906474,0.0005565852,0.00008648981,0.00006462133,0.00003278956,0.0005986836],"genre_candidate":"empirical","genre_consensus":"empirical","teacher_disagreement_score":0.1290109,"threshold_uncertainty_score":0.9998574,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.2204455856525332,"score_gpt":0.4110811146308107,"score_spread":0.1906355289782775,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}