{"id":"W2915704712","doi":"10.7202/1055898ar","title":"Et si la validation était plus qu’une suite de procédures techniques ?","year":2019,"lang":"fr","type":"article","venue":"Mesure et évaluation en éducation","topic":"Evaluation and Performance Assessment","field":"Decision Sciences","cited_by":19,"is_retracted":false,"has_abstract":true,"ca_institutions":"Université de Montréal","funders":"","keywords":"Humanities; Physics; Philosophy","routes":{"ca_aff":true,"ca_fund":false,"ca_venue":true,"about_ca":false,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"codex-gemma-dda1882f352a","candidate_categories":["metaresearch","metaepi_narrow","insufficient_payload"],"consensus_categories":["insufficient_payload"],"category_scores_codex":[0.07734883,0.0003957579,0.0004452551,0.0006129059,0.00023588,0.0008651363,0.0005763157,0.000487617,0.006937015],"category_scores_gemma":[0.004047998,0.0003788327,0.0001858939,0.001452168,0.0001055919,0.002675761,0.0001034723,0.000571658,0.003055668],"about_ca_system_candidate":true,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.001215417,"about_ca_system_score_gemma":0.007337548,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.0004735678,"about_ca_topic_score_gemma":0.0005299695,"domain_scores_codex":[0.9817408,0.01247558,0.001307005,0.0008782304,0.003098426,0.0004999323],"domain_scores_gemma":[0.9932676,0.003207139,0.0009016924,0.0008595291,0.001611043,0.000153008],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"design_other","study_design_gemma":"observational","study_design_scores_codex":[0.0002043326,0.001067913,0.1046394,0.0004501874,0.0001597512,0.000002699265,0.2960694,0.02950254,0.01465528,0.09118009,0.06008396,0.4019845],"study_design_scores_gemma":[0.001573286,0.0004528949,0.5551477,0.0005238912,0.0002059463,0.00006197049,0.00681887,0.0813714,0.01158231,0.03634993,0.305038,0.0008737794],"study_design_candidate":"observational","study_design_consensus":null,"genre_codex":"empirical","genre_gemma":"empirical","genre_scores_codex":[0.7215356,0.0008805179,0.06152723,0.1313952,0.004299672,0.003289993,0.00005188525,0.0003041367,0.07671584],"genre_scores_gemma":[0.9444329,0.0008310858,0.01019562,0.002217715,0.000336834,0.0002953924,0.0004952215,0.00005374464,0.04114151],"genre_candidate":"empirical","genre_consensus":"empirical","teacher_disagreement_score":0.4505083,"threshold_uncertainty_score":0.9998664,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.1443381996319608,"score_gpt":0.5195502806199485,"score_spread":0.3752120809879876,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}