{"id":"W2893131674","doi":"10.1111/ijcp.13265","title":"Evaluating cognitive screening instruments with the “likelihood to be diagnosed or misdiagnosed” measure","year":2018,"lang":"en","type":"article","venue":"International Journal of Clinical Practice","topic":"Dementia and Cognitive Impairment Research","field":"Medicine","cited_by":34,"is_retracted":false,"has_abstract":true,"ca_institutions":"","funders":"","keywords":"Medicine; Dementia; Metric (unit); Montreal Cognitive Assessment; Cognitive impairment; False positive paradox; Cognition; Cognitive test; Diagnostic accuracy; Psychiatry; Radiology; Pathology; Statistics","routes":{"ca_aff":false,"ca_fund":false,"ca_venue":false,"about_ca":true,"invisible_to_affiliation_only":true},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"codex-gemma-dda1882f352a","candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.007192234,0.0001482728,0.0003363094,0.0001546502,0.0001306789,0.0001478269,0.0004033534,0.00007213691,0.0008008591],"category_scores_gemma":[0.06368674,0.00007931449,0.0001750523,0.0002524878,0.000228515,0.0006076201,0.0001425666,0.0008553231,0.00009138577],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.00005513733,"about_ca_system_score_gemma":0.0008283374,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.00003184453,"about_ca_topic_score_gemma":0.00004038906,"domain_scores_codex":[0.9948712,0.0007179255,0.0009669869,0.0002424031,0.002931871,0.0002696253],"domain_scores_gemma":[0.9802671,0.009098518,0.0009763113,0.0001479338,0.00911537,0.0003947706],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"design_other","study_design_gemma":"observational","study_design_scores_codex":[0.05182448,0.001853351,0.1149523,0.000008791226,0.003170913,0.002147013,0.0008022148,0.00000199109,0.0002306344,0.00002441632,0.00625237,0.8187315],"study_design_scores_gemma":[0.02702901,0.03347105,0.80116,0.002067795,0.00185578,0.003352463,0.009504474,0.0003090661,0.00205764,0.00007444765,0.1188161,0.0003021285],"study_design_candidate":"observational","study_design_consensus":null,"genre_codex":"empirical","genre_gemma":"empirical","genre_scores_codex":[0.9079828,0.00004192805,0.006625765,0.07614417,0.0006556591,0.0005138059,0.000008562968,0.00001041483,0.008016895],"genre_scores_gemma":[0.9567945,0.00006258104,0.01189833,0.02848707,0.002326824,0.00001717877,0.000004469858,0.00002058102,0.0003884478],"genre_candidate":"empirical","genre_consensus":"empirical","teacher_disagreement_score":0.8184294,"threshold_uncertainty_score":0.9442002,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.2121497314587083,"score_gpt":0.5577892436603522,"score_spread":0.3456395122016439,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}