{"id":"W7117461739","doi":"10.1093/bjs/znaf270.145","title":"75 Internal Validity for Large Collaborative Clinical Datasets: Assessment of the CONGRESS Database","year":2025,"lang":"en","type":"article","venue":"British journal of surgery","topic":"Gastric Cancer Management and Outcomes","field":"Medicine","cited_by":0,"is_retracted":false,"has_abstract":true,"ca_institutions":"St. Thomas Hospital","funders":"","keywords":"Categorical variable; Reliability (semiconductor); Internal validity; Confidence interval; Data quality; Sample (material); External validity; Data validation; Sample size determination","routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.565155,0.0009535799,0.002771617,0.005843669,0.002637305,0.008104564,0.005347667,0.002487599,0.002215815],"category_scores_gemma":[0.6999126,0.001345296,0.004458591,0.008926393,0.005896819,0.003721931,0.0110273,0.002100514,0.0007580601],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.004219729,"about_ca_system_score_gemma":0.008294332,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.00294356,"about_ca_topic_score_gemma":0.002623799,"domain_scores_codex":[0.31839,0.5065088,0.07967937,0.01975421,0.07304689,0.002620763],"domain_scores_gemma":[0.1214748,0.6345544,0.06312902,0.1173189,0.06143257,0.002090278],"domain_codex":"methods","domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"observational","study_design_gemma":"observational","study_design_scores_codex":[0.004493131,0.0004870335,0.8445855,0.004729614,0.007706971,0.0003250174,0.01311195,0.006550813,0.001356477,0.007631324,0.009679816,0.09934233],"study_design_scores_gemma":[0.001782413,0.002528809,0.8761423,0.005153446,0.002809466,0.001407946,0.005752383,0.04452926,0.006183183,0.009068971,0.04419449,0.0004473505],"study_design_candidate":"observational","study_design_consensus":"observational","genre_codex":"empirical","genre_gemma":"empirical","genre_scores_codex":[0.7955684,0.004911067,0.1446033,0.004128499,0.0009007596,0.02100228,0.01200925,0.001111431,0.015765],"genre_scores_gemma":[0.9098125,0.0003617508,0.06340192,0.0008771665,0.0001681685,0.01705659,0.007660657,0.0002269009,0.0004343329],"genre_candidate":"empirical","genre_consensus":"empirical","teacher_disagreement_score":0.565155,"threshold_uncertainty_score":0.5362414,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.07967527198048793,"score_gpt":0.4127579461189693,"score_spread":0.3330826741384814,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}