{"id":"W2063772878","doi":"10.1007/s11409-011-9074-8","title":"Statistical estimates of learners’ judgments about knowledge in calibration of achievement","year":2011,"lang":"en","type":"article","venue":"Metacognition and Learning","topic":"Innovative Teaching and Learning Methods","field":"Psychology","cited_by":24,"is_retracted":false,"has_abstract":false,"ca_institutions":"McGill University; Simon Fraser University","funders":"","keywords":"Calibration; Measure (data warehouse); Psychology; Statistic; Correctness; Metacognition; Mathematics education; Sample (material); Statistics; Computer science; Mathematics; Cognition; Data mining","routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.01939371,0.0005246296,0.0004049051,0.001722801,0.000360843,0.001475011,0.0007530797,0.0009540693,0.002533379],"category_scores_gemma":[0.2044576,0.0003765885,0.0008789003,0.001111418,0.001177522,0.00194301,0.001438424,0.001285887,0.0005381354],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.000527621,"about_ca_system_score_gemma":0.0005493755,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.001161903,"about_ca_topic_score_gemma":0.0009952855,"domain_scores_codex":[0.992452,0.004530191,0.0004890925,0.001117561,0.001227286,0.0001838547],"domain_scores_gemma":[0.6388537,0.3219833,0.01092653,0.01852928,0.008636133,0.001071074],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"observational","study_design_gemma":"observational","study_design_scores_codex":[0.006422461,0.001119003,0.5031552,0.0005286956,0.001926356,0.0002428559,0.00503626,0.08038595,0.02813402,0.03003417,0.002629245,0.3403857],"study_design_scores_gemma":[0.0001907692,0.001701617,0.7022455,0.00009737306,0.0004217557,0.0006362256,0.001428844,0.2045378,0.03929643,0.04681696,0.002410147,0.0002166259],"study_design_candidate":"observational","study_design_consensus":"observational","genre_codex":"empirical","genre_gemma":"empirical","genre_scores_codex":[0.878354,0.0002296936,0.1162915,0.000126568,0.00004207031,0.000092462,0.0003749729,0.000337412,0.004151361],"genre_scores_gemma":[0.9890327,0.00004285054,0.01003848,0.00003071691,0.00001114108,0.00007039371,0.0002674963,0.00003586482,0.0004703777],"genre_candidate":"empirical","genre_consensus":"empirical","teacher_disagreement_score":0.01939371,"threshold_uncertainty_score":0.102565,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.1019453062351795,"score_gpt":0.3849430238929029,"score_spread":0.2829977176577234,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}