{"id":"W7104268304","doi":"10.71781/5966","title":"Modélisation, élaboration et évaluation de rapports à visée diagnostique des données du PIRLS 2011","year":2018,"lang":"fr","type":"dissertation","venue":"Papyrus : Institutional Repository (Université de Montréal)","topic":"Educational and Psychological Assessments","field":"Psychology","cited_by":0,"is_retracted":false,"has_abstract":true,"ca_institutions":"","funders":"","keywords":"Test (biology); Validation test; Plank","routes":{"ca_aff":false,"ca_fund":false,"ca_venue":false,"about_ca":true,"invisible_to_affiliation_only":true},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"codex-gemma-dda1882f352a","candidate_categories":["metaepi_narrow","sts","insufficient_payload"],"consensus_categories":["insufficient_payload"],"category_scores_codex":[0.001546556,0.0007043891,0.0005278409,0.0004218443,0.006635093,0.0001511655,0.0005383269,0.00110014,0.001843002],"category_scores_gemma":[0.0003075474,0.0007892171,0.0003514049,0.0004968389,0.0006787686,0.0008414258,0.00009837591,0.0006427555,0.000805933],"about_ca_system_candidate":true,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.004794054,"about_ca_system_score_gemma":0.003869351,"about_ca_topic_candidate":true,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.03461511,"about_ca_topic_score_gemma":0.01045505,"domain_scores_codex":[0.9949303,0.001521173,0.0008519173,0.001139594,0.0008449059,0.0007120668],"domain_scores_gemma":[0.9961436,0.0005610137,0.0009533385,0.0005524802,0.001288717,0.0005008553],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"observational","study_design_gemma":"observational","study_design_scores_codex":[0.002347493,0.00393107,0.4843687,0.0004418192,0.001288269,0.001066421,0.3341815,0.00502211,0.01106706,0.1141494,0.02909178,0.01304436],"study_design_scores_gemma":[0.001543396,0.0004184751,0.9129623,0.0004266684,0.0005113806,0.0005825633,0.03293763,0.001166914,0.002297828,0.01239647,0.03387992,0.0008764891],"study_design_candidate":"observational","study_design_consensus":"observational","genre_codex":"empirical","genre_gemma":"empirical","genre_scores_codex":[0.9345997,0.008182532,0.005783669,0.002442382,0.004345171,0.0008777319,0.0001834384,0.0001556197,0.04342974],"genre_scores_gemma":[0.9375201,0.002760533,0.005317651,0.001060606,0.001185207,0.000278735,0.004446935,0.00006863022,0.04736156],"genre_candidate":"empirical","genre_consensus":"empirical","teacher_disagreement_score":0.4285935,"threshold_uncertainty_score":0.999972,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.02915164022654552,"score_gpt":0.2678041800750513,"score_spread":0.2386525398485058,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}