{"id":"W2000477303","doi":"10.1097/acm.0b013e3181637925","title":"The Reported Validity and Reliability of Methods for Evaluating Continuing Medical Education: A Systematic Review","year":2008,"lang":"en","type":"review","venue":"Academic Medicine","topic":"Innovations in Medical Education","field":"Medicine","cited_by":69,"is_retracted":false,"has_abstract":true,"ca_institutions":"","funders":"Johns Hopkins University","keywords":"Reliability (semiconductor); Medical education; MEDLINE; Validity; Continuing medical education; Psychology; Continuing education; Medicine; Clinical psychology; Psychometrics; Political science","routes":{"ca_aff":false,"ca_fund":false,"ca_venue":false,"about_ca":true,"invisible_to_affiliation_only":true},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":["metaresearch"],"consensus_categories":["metaresearch"],"category_scores_codex":[0.382411,0.003182072,0.01521058,0.02531991,0.002222913,0.01062803,0.004053868,0.004720389,0.001775555],"category_scores_gemma":[0.7150169,0.003053665,0.01490623,0.02229302,0.005880835,0.008065089,0.003770112,0.00298218,0.0003769177],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.01153593,"about_ca_system_score_gemma":0.02555569,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.005158982,"about_ca_topic_score_gemma":0.009992477,"domain_scores_codex":[0.4322689,0.283886,0.190445,0.01365584,0.07815268,0.001591507],"domain_scores_gemma":[0.1797277,0.636865,0.1139635,0.01344296,0.05484822,0.001152719],"domain_codex":null,"domain_gemma":"methods","domain_candidate":"methods","domain_consensus":null,"study_design_codex":"systematic_review","study_design_gemma":"systematic_review","study_design_scores_codex":[0.001357866,0.00009310587,0.02297533,0.7991173,0.06439746,0.0001310716,0.001620991,0.0004891312,0.0003203445,0.001198455,0.001757327,0.1065417],"study_design_scores_gemma":[0.001805103,0.001189303,0.02397112,0.8214226,0.1343816,0.0005951431,0.001243077,0.001262645,0.001223398,0.002519691,0.01009929,0.0002870958],"study_design_candidate":"systematic_review","study_design_consensus":"systematic_review","genre_codex":"review","genre_gemma":"review","genre_scores_codex":[0.008997147,0.9727584,0.008177287,0.001273195,0.0009242563,0.00595619,0.0007935091,0.00005412949,0.001065994],"genre_scores_gemma":[0.2847544,0.6224561,0.05850105,0.002324454,0.001118623,0.02891234,0.001536133,0.00008165791,0.000315222],"genre_candidate":"review","genre_consensus":"review","teacher_disagreement_score":0.617589,"threshold_uncertainty_score":0.7615972,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.2238340500536985,"score_gpt":0.5939144964063777,"score_spread":0.3700804463526792,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}