{"id":"W2978087496","doi":"10.2217/nmt-2019-0017","title":"What is Test Accuracy? Comparing Unitary Accuracy Metrics for Cognitive Screening Instruments","year":2019,"lang":"en","type":"article","venue":"Neurodegenerative Disease Management","topic":"Dementia and Cognitive Impairment Research","field":"Medicine","cited_by":17,"is_retracted":false,"has_abstract":true,"ca_institutions":"","funders":"","keywords":"Receiver operating characteristic; Metric (unit); Dementia; Test (biology); Cognition; Cognitive impairment; Raw score; Statistics; Measure (data warehouse); Psychology; Computer science; Medicine; Mathematics; Data mining; Raw data; Psychiatry; Engineering","routes":{"ca_aff":false,"ca_fund":false,"ca_venue":false,"about_ca":true,"invisible_to_affiliation_only":true},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.1465184,0.001201464,0.001930602,0.008784629,0.001010737,0.005789497,0.002149956,0.002799578,0.0009176562],"category_scores_gemma":[0.5056682,0.0005115158,0.002671213,0.005874863,0.003941092,0.006496629,0.002976711,0.001749995,0.0004048265],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.002304007,"about_ca_system_score_gemma":0.001710171,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.00252973,"about_ca_topic_score_gemma":0.002955363,"domain_scores_codex":[0.8517581,0.09034809,0.0170224,0.00774748,0.03066658,0.002457388],"domain_scores_gemma":[0.3718499,0.5306541,0.040356,0.02609361,0.02914604,0.001900408],"domain_codex":null,"domain_gemma":"methods","domain_candidate":"methods","domain_consensus":null,"study_design_codex":"observational","study_design_gemma":"theoretical_or_conceptual","study_design_scores_codex":[0.001649559,0.0001330428,0.8140257,0.0009899957,0.003092689,0.0001268141,0.002459089,0.004625597,0.0006044258,0.006773821,0.002390931,0.1631283],"study_design_scores_gemma":[0.0001999063,0.005049352,0.8913215,0.001808129,0.002106705,0.001427507,0.00280574,0.04936275,0.006343612,0.03118513,0.008071008,0.0003186406],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"genre_codex":"empirical","genre_gemma":"methods","genre_scores_codex":[0.8211846,0.02539966,0.1304727,0.004735287,0.001086971,0.0006127108,0.001819104,0.001013505,0.01367545],"genre_scores_gemma":[0.9857087,0.0006084815,0.01236331,0.0002923838,0.0001732535,0.0002061791,0.0003746601,0.00008532045,0.0001877532],"genre_candidate":"methods","genre_consensus":null,"teacher_disagreement_score":0.8534816,"threshold_uncertainty_score":0.7748726,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.04453971085852782,"score_gpt":0.3395502077307218,"score_spread":0.295010496872194,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}