{"id":"W2288663988","doi":"10.7202/1036761ar","title":"Analyse d’un outil d’évaluation en mathématiques : entre une logique de compétences et une logique de contenu","year":2016,"lang":"fr","type":"article","venue":"Mesure et évaluation en éducation","topic":"Mathematics Education and Teaching Techniques","field":"Social Sciences","cited_by":6,"is_retracted":false,"has_abstract":true,"ca_institutions":"","funders":"","keywords":"Humanities; Philosophy; Mathematics; Political science","routes":{"ca_aff":false,"ca_fund":false,"ca_venue":true,"about_ca":false,"invisible_to_affiliation_only":true},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"codex-gemma-dda1882f352a","candidate_categories":["metaresearch","metaepi_narrow","insufficient_payload"],"consensus_categories":[],"category_scores_codex":[0.05439766,0.000453202,0.0005296958,0.0003681516,0.0004809254,0.0002711687,0.0005955728,0.0007103813,0.001815183],"category_scores_gemma":[0.008208677,0.0003930587,0.0002299307,0.0009483336,0.0003603821,0.0008979624,0.00006650112,0.0005483307,0.00022329],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.00202731,"about_ca_system_score_gemma":0.004629668,"about_ca_topic_candidate":true,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.007894823,"about_ca_topic_score_gemma":0.01112781,"domain_scores_codex":[0.971136,0.02547286,0.001084061,0.0006387912,0.001052609,0.0006156979],"domain_scores_gemma":[0.9932209,0.004033285,0.001030039,0.000583725,0.0008950494,0.0002369633],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"qualitative","study_design_gemma":"theoretical_or_conceptual","study_design_scores_codex":[0.00001921258,0.0007210529,0.01167262,0.00009771452,0.0001240588,0.000001682845,0.5482881,0.0001191913,0.002069273,0.3495105,0.01217188,0.07520473],"study_design_scores_gemma":[0.0006939805,0.0002118455,0.1148725,0.0008572624,0.0003966706,0.00002307103,0.02619803,0.005623935,0.004099296,0.8373336,0.008954768,0.0007349575],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"genre_codex":"methods","genre_gemma":"empirical","genre_scores_codex":[0.2011003,0.0003453772,0.5827684,0.2010638,0.0009758286,0.001058622,0.00002518473,0.0004078248,0.01225467],"genre_scores_gemma":[0.8821344,0.00144601,0.1069655,0.001582777,0.0004188669,0.0002801471,0.0001454335,0.00005010514,0.006976755],"genre_candidate":"empirical","genre_consensus":null,"teacher_disagreement_score":0.6810341,"threshold_uncertainty_score":0.9998521,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.06825583269513844,"score_gpt":0.4022329591372169,"score_spread":0.3339771264420784,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}