{"id":"W2004471759","doi":"10.7202/1024862ar","title":"Analyse des différentes facettes influant sur la fidélité de l’épreuve d’expression écrite d’un test de français langue étrangère","year":2014,"lang":"fr","type":"article","venue":"Mesure et évaluation en éducation","topic":"Psychometric Methodologies and Testing","field":"Decision Sciences","cited_by":4,"is_retracted":false,"has_abstract":true,"ca_institutions":"","funders":"","keywords":"Humanities; Art","routes":{"ca_aff":false,"ca_fund":false,"ca_venue":true,"about_ca":false,"invisible_to_affiliation_only":true},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.03789562,0.0006177459,0.0004211586,0.001804818,0.0008133503,0.003200243,0.0005884686,0.0006119541,0.003536867],"category_scores_gemma":[0.1327142,0.0003507442,0.0007331053,0.001805398,0.00189961,0.001291903,0.001539336,0.0009055376,0.0006678391],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.00235791,"about_ca_system_score_gemma":0.002050568,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.02124463,"about_ca_topic_score_gemma":0.0229418,"domain_scores_codex":[0.9676302,0.01878097,0.001897653,0.001904653,0.008516119,0.001270419],"domain_scores_gemma":[0.7076271,0.223831,0.01786786,0.009778989,0.03855815,0.0023369],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"observational","study_design_gemma":"observational","study_design_scores_codex":[0.0009307342,0.0002314857,0.8451258,0.0002747823,0.0004668135,0.0001674102,0.02049216,0.001348326,0.009816227,0.001493455,0.0007810211,0.1188718],"study_design_scores_gemma":[0.00001340002,0.0003506355,0.9864745,0.00008302985,0.00006564958,0.0001021087,0.0038088,0.002153934,0.004379245,0.0003277381,0.00219189,0.00004901636],"study_design_candidate":"observational","study_design_consensus":"observational","genre_codex":"empirical","genre_gemma":"empirical","genre_scores_codex":[0.9872736,0.000193745,0.004448662,0.0001936471,0.00001425893,0.00007230834,0.000151962,0.00003063729,0.007621251],"genre_scores_gemma":[0.996085,0.0000573137,0.001931116,0.0000304766,0.000005730913,0.00007974898,0.0001101199,0.00001661294,0.001683919],"genre_candidate":"empirical","genre_consensus":"empirical","teacher_disagreement_score":0.03789562,"threshold_uncertainty_score":0.2004136,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.2584652406471245,"score_gpt":0.4527758650486191,"score_spread":0.1943106244014947,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}