{"id":"W4387670261","doi":"10.21203/rs.3.rs-3369555/v1","title":"Program Evaluation Activities in Competence by Design: A Survey of Specialty/Subspecialty Program Directors","year":2023,"lang":"en","type":"preprint","venue":"Research Square","topic":"Evaluation and Performance Assessment","field":"Decision Sciences","cited_by":0,"is_retracted":false,"has_abstract":true,"ca_institutions":"University of Ottawa","funders":"","keywords":"Competence (human resources); Medical education; Specialty; Subspecialty; Descriptive statistics; Program evaluation; Program Design Language; Evaluation methods; Survey research; Curriculum; Descriptive research; Psychology; Medicine; Family medicine; Computer science; Political science; Applied psychology; Pedagogy; Engineering; Sociology","routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":true,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.02508371,0.0002143767,0.0003633818,0.002510417,0.00206268,0.00231471,0.0007792342,0.0007499126,0.00250446],"category_scores_gemma":[0.04714295,0.0005440779,0.0003403534,0.002537103,0.001519427,0.00137847,0.002175022,0.001117186,0.0003994878],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.008076769,"about_ca_system_score_gemma":0.01081278,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.04466046,"about_ca_topic_score_gemma":0.0488879,"domain_scores_codex":[0.9735508,0.01432502,0.00217657,0.001038412,0.006100002,0.002809232],"domain_scores_gemma":[0.9212621,0.02667344,0.02369501,0.001549077,0.01459109,0.01222924],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"observational","study_design_gemma":"observational","study_design_scores_codex":[0.0001264559,0.0005139427,0.946174,0.0002008756,0.00002566468,0.00009881868,0.02424836,0.0001174186,0.0004724147,0.0001985062,0.003027086,0.02479646],"study_design_scores_gemma":[0.00002604308,0.0003440569,0.9515235,0.000146156,0.00001254316,0.0001447565,0.0398494,0.0004685224,0.0003386714,0.00007593906,0.007045572,0.00002484034],"study_design_candidate":"observational","study_design_consensus":"observational","genre_codex":"empirical","genre_gemma":"empirical","genre_scores_codex":[0.996436,0.0003140642,0.0002886097,0.0009269225,0.000009030556,0.0001404467,0.0001523742,0.0000120347,0.001720553],"genre_scores_gemma":[0.99797,0.0002663162,0.0005585683,0.0004221298,0.00001301245,0.0001238901,0.0001041123,0.000005313952,0.0005366702],"genre_candidate":"empirical","genre_consensus":"empirical","teacher_disagreement_score":0.04466046,"threshold_uncertainty_score":0.1326569,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.6823018805970905,"score_gpt":0.6383738635957723,"score_spread":0.04392801700131821,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}