{"id":"W4415005299","doi":"10.1055/a-2703-0209","title":"Large language model for interpreting the Paris classification of colorectal polyps","year":2025,"lang":"en","type":"article","venue":"Endoscopy International Open","topic":"Colorectal Cancer Screening and Detection","field":"Medicine","cited_by":3,"is_retracted":false,"has_abstract":true,"ca_institutions":"Centre Hospitalier de l’Université de Montréal","funders":"Fonds Wetenschappelijk Onderzoek; Norges Forskningsråd; European Commission","keywords":"Colonoscopy; MEDLINE; Colorectal Polyp; Text mining","routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.004597002,0.001722782,0.000875014,0.002214782,0.000429854,0.002505299,0.001557454,0.001636243,0.004091925],"category_scores_gemma":[0.01622803,0.0003959227,0.001604562,0.0008045412,0.0005033113,0.001396992,0.001290501,0.001397459,0.003133718],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.001662403,"about_ca_system_score_gemma":0.001383834,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.01464817,"about_ca_topic_score_gemma":0.01136146,"domain_scores_codex":[0.9977542,0.001067502,0.0001739093,0.0005780765,0.0002371208,0.0001892547],"domain_scores_gemma":[0.9939318,0.004301016,0.0004560302,0.0003645462,0.0007727275,0.0001738698],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","study_design_scores_codex":[0.004152748,0.0006705626,0.08468593,0.0008139263,0.00115116,0.001469572,0.0007901709,0.2837167,0.009674929,0.005311809,0.04105139,0.5665111],"study_design_scores_gemma":[0.00006111074,0.0001489492,0.004781089,0.00008247209,0.00009761744,0.0001839123,0.0001139315,0.9872426,0.001594161,0.003732278,0.001918814,0.00004303132],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"genre_codex":"methods","genre_gemma":"empirical","genre_scores_codex":[0.4504504,0.005270161,0.4907421,0.003614946,0.0009357646,0.0008933668,0.01744254,0.01860179,0.01204887],"genre_scores_gemma":[0.9093007,0.0004160416,0.07456154,0.0006260579,0.0003047267,0.0004279504,0.01084458,0.0002982972,0.003220178],"genre_candidate":"empirical","genre_consensus":null,"teacher_disagreement_score":0.01464817,"threshold_uncertainty_score":0.02912581,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.02339308782639944,"score_gpt":0.3728170015419663,"score_spread":0.3494239137155669,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}