{"id":"W2583066599","doi":"10.7759/cureus.992","title":"Resident Development via Progress Testing and Test-Marking: An Innovation and Program Evaluation&#x0D;","year":2017,"lang":"en","type":"article","venue":"Cureus","topic":"Innovations in Medical Education","field":"Medicine","cited_by":3,"is_retracted":false,"has_abstract":true,"ca_institutions":"McMaster University; University of Toronto; University of British Columbia","funders":"","keywords":"Test (biology); Medicine; Medical education; Process (computing); Computer science","routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.2169427,0.001055893,0.001016401,0.002907599,0.001819617,0.00402222,0.003124134,0.001551935,0.004200111],"category_scores_gemma":[0.131839,0.0006136605,0.00161726,0.002304375,0.002730229,0.002843136,0.006982716,0.00193825,0.001395727],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.00740073,"about_ca_system_score_gemma":0.02170797,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.003618686,"about_ca_topic_score_gemma":0.004651906,"domain_scores_codex":[0.7618169,0.1824305,0.01009285,0.003558114,0.03892713,0.003174495],"domain_scores_gemma":[0.8385295,0.06655307,0.01996976,0.01205983,0.05579463,0.007093123],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"design_other","study_design_gemma":"observational","study_design_scores_codex":[0.001925825,0.006231748,0.02639804,0.002720807,0.000272461,0.00007299056,0.003875927,0.0007000898,0.0008572536,0.003312528,0.01468097,0.9389513],"study_design_scores_gemma":[0.01441789,0.1342622,0.3896015,0.02949347,0.004020527,0.00129103,0.01579922,0.02065284,0.03592097,0.01113866,0.3425962,0.0008055022],"study_design_candidate":"observational","study_design_consensus":null,"genre_codex":"empirical","genre_gemma":"empirical","genre_scores_codex":[0.473643,0.0120598,0.1714269,0.03427406,0.002841097,0.2157697,0.00314805,0.004478425,0.08235899],"genre_scores_gemma":[0.4696539,0.005559013,0.4035777,0.004585416,0.0007556328,0.1045082,0.001491798,0.0004471357,0.009421152],"genre_candidate":"empirical","genre_consensus":"empirical","teacher_disagreement_score":0.2169427,"threshold_uncertainty_score":0.9656491,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.1134387850649354,"score_gpt":0.4414087608621575,"score_spread":0.327969975797222,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}