{"id":"W4296461057","doi":"10.21203/rs.3.rs-1936442/v1","title":"The CG Equation: A Probabilistic Approach to Predict Doctoral Success Likelihood","year":2022,"lang":"en","type":"preprint","venue":"Research Square","topic":"Doctoral Education Challenges and Solutions","field":"Health Professions","cited_by":0,"is_retracted":false,"has_abstract":true,"ca_institutions":"University of Toronto","funders":"","keywords":"Probabilistic logic; Structural equation modeling; Econometrics; Maximum likelihood; Computer science; Psychology; Data science; Mathematics; Statistics; Artificial intelligence; Machine learning","routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"codex-gemma-dda1882f352a","candidate_categories":["metaepi_narrow","sts","research_integrity","insufficient_payload"],"consensus_categories":[],"category_scores_codex":[0.00851032,0.0003543952,0.0004526035,0.0004364142,0.007770998,0.0002604236,0.001934771,0.0004804272,0.002279017],"category_scores_gemma":[0.003429662,0.0002660193,0.0002236571,0.001197296,0.0002608625,0.0001078398,0.004892134,0.006971214,0.0004847],"about_ca_system_candidate":true,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.002303566,"about_ca_system_score_gemma":0.006339857,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.002349252,"about_ca_topic_score_gemma":0.0008987522,"domain_scores_codex":[0.9883606,0.005181171,0.0009546467,0.001093764,0.002539482,0.001870306],"domain_scores_gemma":[0.9923908,0.003071092,0.0002530536,0.001986272,0.001538854,0.0007599366],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"not_applicable","study_design_gemma":"not_applicable","study_design_scores_codex":[0.0005011036,0.002697937,0.02405547,0.01043281,0.000340985,0.00001202035,0.05882289,0.009228123,0.000004998838,0.2580215,0.6268427,0.009039446],"study_design_scores_gemma":[0.0006107339,0.000424111,0.04032467,0.0008917112,0.000041232,0.000001125934,0.05014893,0.006593056,3.535412e-7,0.03017108,0.8701935,0.0005994875],"study_design_candidate":"not_applicable","study_design_consensus":"not_applicable","genre_codex":"other","genre_gemma":"empirical","genre_scores_codex":[0.2049295,0.01582589,0.004652307,0.1711301,0.0250434,0.06923285,0.004168984,0.001884765,0.5031323],"genre_scores_gemma":[0.9290546,0.000909423,0.0007610108,0.0003220763,0.003679309,0.03996811,0.001255965,0.0001376208,0.0239119],"genre_candidate":"empirical","genre_consensus":null,"teacher_disagreement_score":0.7241251,"threshold_uncertainty_score":0.9999792,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.4672915756541625,"score_gpt":0.5913379028010632,"score_spread":0.1240463271469007,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}