{"id":"W4366447032","doi":"10.3138/cjpe.0022.009","title":"La comparabilité des échantillons dans les enquêtes de l’international association for the evaluation of educational achievement","year":2008,"lang":"en","type":"article","venue":"Canadian Journal of Program Evaluation","topic":"Evaluation and Performance Assessment","field":"Decision Sciences","cited_by":0,"is_retracted":false,"has_abstract":true,"ca_institutions":"Université de Montréal","funders":"","keywords":"Association (psychology); Perspective (graphical); Educational research; Student achievement; Psychology; Pedagogy; Mathematics education; Sociology; Academic achievement; Political science; Mathematics","routes":{"ca_aff":true,"ca_fund":false,"ca_venue":true,"about_ca":false,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"codex-gemma-dda1882f352a","candidate_categories":["metaresearch","insufficient_payload"],"consensus_categories":["metaresearch"],"category_scores_codex":[0.03810959,0.0001109805,0.0001887156,0.0004004631,0.0005316025,0.0001504796,0.0005458454,0.000088683,0.001350332],"category_scores_gemma":[0.01322246,0.00007917223,0.0001953795,0.0004261983,0.0002155907,0.0004167692,0.00001167339,0.0001530936,0.000008525287],"about_ca_system_candidate":true,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.001812084,"about_ca_system_score_gemma":0.008648986,"about_ca_topic_candidate":true,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.0007391383,"about_ca_topic_score_gemma":0.01880929,"domain_scores_codex":[0.9939507,0.001145555,0.0009798344,0.0001681464,0.003524326,0.0002314274],"domain_scores_gemma":[0.986644,0.002625189,0.001220398,0.0002112819,0.009122533,0.0001765468],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"observational","study_design_gemma":"observational","study_design_scores_codex":[0.00003279272,0.000179202,0.6268654,0.000006941511,0.000144922,2.157248e-7,0.006927567,0.02900222,0.0002094722,0.00158445,0.002620738,0.3324261],"study_design_scores_gemma":[0.00112006,0.0001638457,0.7661241,0.00003074355,0.0002204086,0.00003034867,0.002301929,0.1951769,0.0002919179,0.01398594,0.02047138,0.00008240715],"study_design_candidate":"observational","study_design_consensus":"observational","genre_codex":"empirical","genre_gemma":"empirical","genre_scores_codex":[0.9827458,0.000656489,0.004031295,0.006821897,0.0007808119,0.001627295,0.00003777118,0.000003936582,0.003294741],"genre_scores_gemma":[0.9951145,0.0000475633,0.003939962,0.00005147524,0.0002352777,0.0003163211,0.00003305555,0.00000831917,0.0002534932],"genre_candidate":"empirical","genre_consensus":"empirical","teacher_disagreement_score":0.3323437,"threshold_uncertainty_score":0.9995626,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.4409650328077531,"score_gpt":0.5430028838125461,"score_spread":0.102037851004793,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}