{"id":"W4416461622","doi":"10.21956/amrcopenres.14044.r26708","title":"Referee report. For: Validation of the 4AT tool for delirium assessment in specialist palliative care settings: protocol of a prospective diagnostic test accuracy study [version 1; peer review: 2 approved]","year":2021,"lang":"en","type":"article","venue":"Faculty of 1000 Research Ltd","topic":"Intensive Care Unit Cognitive Disorders","field":"Medicine","cited_by":0,"is_retracted":false,"has_abstract":false,"ca_institutions":"Ottawa Hospital","funders":"","keywords":"Delirium; Protocol (science); Diagnostic accuracy; Test (biology); Palliative care; Diagnostic test","routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"codex-gemma-dda1882f352a","candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.003041778,0.000197054,0.0006539188,0.0001722474,0.0001215,0.00001688985,0.0002449589,0.00009814955,0.00005386215],"category_scores_gemma":[0.4863373,0.0001456708,0.0002621927,0.0007683469,0.0002432629,0.0001039032,0.0002514125,0.0004928394,0.000001348549],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.0006267678,"about_ca_system_score_gemma":0.001556852,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.0001889022,"about_ca_topic_score_gemma":0.0002922053,"domain_scores_codex":[0.9956157,0.0004741542,0.0009240613,0.0005200923,0.002123345,0.0003427012],"domain_scores_gemma":[0.7886449,0.006091847,0.0007535727,0.0007382827,0.2037029,0.00006843385],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"observational","study_design_gemma":"observational","study_design_scores_codex":[0.002199633,0.004789251,0.5889879,0.02802907,0.0004318688,0.0001190437,0.01135866,0.000009894674,0.02805408,0.0001995308,0.3330666,0.002754366],"study_design_scores_gemma":[0.01335367,0.005885456,0.4800467,0.01660615,0.0004397365,0.00001210912,0.1637502,0.00005227233,0.2412543,0.0003421178,0.07787526,0.000381998],"study_design_candidate":"observational","study_design_consensus":"observational","genre_codex":"protocol","genre_gemma":"empirical","genre_scores_codex":[0.1728652,0.0003268235,0.0007202381,0.09787677,0.0001718242,0.7154653,0.006308528,0.00003603673,0.006229246],"genre_scores_gemma":[0.7801412,0.00008228052,0.003059404,0.001146281,0.0001813228,0.2020538,0.005648681,0.00009910724,0.007587921],"genre_candidate":"empirical","genre_consensus":null,"teacher_disagreement_score":0.607276,"threshold_uncertainty_score":0.5940281,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.06780415750716921,"score_gpt":0.4563561921397535,"score_spread":0.3885520346325843,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}