{"id":"W6989532544","doi":"","title":"Bias and uncertainty in comparative diagnostic accuracy research","year":2022,"lang":"en","type":"dissertation","venue":"Pure Amsterdam UMC","topic":"Meta-analysis and systematic reviews","field":"Decision Sciences","cited_by":0,"is_retracted":false,"has_abstract":true,"ca_institutions":"","funders":"Universiteit van Amsterdam; Amsterdam University Medical Centers; Department of Health and Social Care; National Institute for Health and Care Research; Birmingham Biomedical Research Centre; European Commission; University Hospitals Birmingham NHS Foundation Trust; McMaster University","keywords":"Diagnostic accuracy; Test (biology); Systematic review; Diagnostic test; Risk assessment; Accuracy and precision","routes":{"ca_aff":false,"ca_fund":true,"ca_venue":false,"about_ca":false,"invisible_to_affiliation_only":true},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"codex-gemma-dda1882f352a","candidate_categories":["metaresearch","metaepi_narrow","scholarly_communication","insufficient_payload"],"consensus_categories":["metaresearch","insufficient_payload"],"category_scores_codex":[0.1185768,0.0004987854,0.004630431,0.001581366,0.00040797,0.00158253,0.002447221,0.0002166703,0.02266647],"category_scores_gemma":[0.1682393,0.0002788011,0.0008901721,0.003343366,0.0001002136,0.0002683109,0.0003296075,0.001256171,0.001975735],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.0001421939,"about_ca_system_score_gemma":0.0002554608,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.00023306,"about_ca_topic_score_gemma":0.005725613,"domain_scores_codex":[0.9503359,0.02931757,0.008071595,0.001953673,0.009764507,0.0005567421],"domain_scores_gemma":[0.8994868,0.0907864,0.004359175,0.003499768,0.001635477,0.000232371],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"not_applicable","study_design_gemma":"not_applicable","study_design_scores_codex":[0.0002329532,0.0005208341,0.07455683,0.00120491,0.0007875303,0.0002712767,0.07310092,0.001095768,0.00005788774,0.007564104,0.7123628,0.1282442],"study_design_scores_gemma":[0.0006643365,0.0002389439,0.1407997,0.0004857363,0.0003582485,0.00002001644,0.07741687,0.004028601,0.00001653649,0.02989836,0.7451862,0.0008865094],"study_design_candidate":"not_applicable","study_design_consensus":"not_applicable","genre_codex":"empirical","genre_gemma":"empirical","genre_scores_codex":[0.9268758,0.01093144,0.00001781898,0.0007065322,0.0008866495,0.002883342,0.00009974946,0.000007795946,0.05759092],"genre_scores_gemma":[0.9248092,0.0003836401,0.0001052075,0.00011999,0.0001201292,0.0007562226,0.0006005311,0.00002764134,0.07307741],"genre_candidate":"empirical","genre_consensus":"empirical","teacher_disagreement_score":0.1273577,"threshold_uncertainty_score":0.9999664,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.8306448108381463,"score_gpt":0.6170178763432315,"score_spread":0.2136269344949149,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}