{"id":"W2538818169","doi":"10.1155/2016/6982739","title":"Pilot Validation Study: Canadian Global Rating Scale for Colonoscopy Services","year":2016,"lang":"en","type":"article","venue":"Canadian Journal of Gastroenterology and Hepatology","topic":"Colorectal Cancer Screening and Detection","field":"Medicine","cited_by":11,"is_retracted":false,"has_abstract":true,"ca_institutions":"McGill University Health Centre","funders":"","keywords":"Medicine; Concordance; Colonoscopy; Cohen's kappa; Inter-rater reliability; Scale (ratio); Kappa; Reliability (semiconductor); Endoscopy; Rating scale; Internal medicine; Statistics; Machine learning; Computer science","routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":true,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"codex-gemma-dda1882f352a","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0002785977,0.000099347,0.0003144341,0.0002261966,0.0001763734,0.00001378528,0.00007030708,0.00006971106,0.00003930779],"category_scores_gemma":[0.00005951767,0.00007714628,0.00004818314,0.00006067694,0.0001080967,0.00007697962,0.000006171291,0.0001037627,0.000001888915],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.0002948828,"about_ca_system_score_gemma":0.0008471019,"about_ca_topic_candidate":true,"about_ca_topic_consensus":true,"about_ca_topic_score_codex":0.1635347,"about_ca_topic_score_gemma":0.9822642,"domain_scores_codex":[0.9990678,0.00009149834,0.0002771806,0.0001491955,0.00004877027,0.0003655162],"domain_scores_gemma":[0.9988411,0.00004394167,0.0001503066,0.0000792436,0.0002072647,0.0006781304],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"observational","study_design_gemma":"observational","study_design_scores_codex":[0.007241967,0.00001708281,0.9906131,0.00001727127,0.0000620703,0.00007859131,0.0001134247,6.967051e-7,0.00008885041,0.0000154758,0.0002923186,0.001459147],"study_design_scores_gemma":[0.007505378,0.09225894,0.8911521,0.0001267313,0.0002878679,0.00501013,0.000554044,0.00009045351,0.0002318925,0.0003133426,0.002360882,0.0001081825],"study_design_candidate":"observational","study_design_consensus":"observational","genre_codex":"empirical","genre_gemma":"empirical","genre_scores_codex":[0.9932911,0.0001039066,0.0009964722,0.004627708,0.0006174575,0.0002383621,0.00003723403,0.000005670233,0.00008210361],"genre_scores_gemma":[0.9984116,0.000009814502,0.0003790333,0.001020864,0.0001366725,0.00001144349,0.000003243834,0.000007232517,0.00002007914],"genre_candidate":"empirical","genre_consensus":"empirical","teacher_disagreement_score":0.8187294,"threshold_uncertainty_score":0.8420354,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.01673595889388162,"score_gpt":0.2698541055482305,"score_spread":0.2531181466543489,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}