{"id":"W3196529262","doi":"10.1055/s-0041-1735184","title":"Systematic Review of Approaches to Preserve Machine Learning Performance in the Presence of Temporal Dataset Shift in Clinical Medicine","year":2021,"lang":"en","type":"review","venue":"Applied Clinical Informatics","topic":"Artificial Intelligence in Healthcare and Education","field":"Medicine","cited_by":82,"is_retracted":false,"has_abstract":true,"ca_institutions":"Institute for Clinical Evaluative Sciences; SickKids Foundation; Hospital for Sick Children","funders":"","keywords":"Machine learning; Benchmark (surveying); Computer science; Artificial intelligence; Calibration; Feature (linguistics); Paradigm shift; Baseline (sea); Data mining; Statistics; Mathematics","routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.04553655,0.001812157,0.006729562,0.0101622,0.0009248917,0.004268717,0.003333987,0.002881347,0.003725728],"category_scores_gemma":[0.2269623,0.001354125,0.0101776,0.008718754,0.001473228,0.003888396,0.002369274,0.00204929,0.0005307275],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.005652006,"about_ca_system_score_gemma":0.01996439,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.006165862,"about_ca_topic_score_gemma":0.01634384,"domain_scores_codex":[0.9564017,0.01980372,0.01521894,0.001934254,0.006163102,0.000478326],"domain_scores_gemma":[0.7328436,0.2225588,0.0241326,0.004775471,0.0150012,0.0006882816],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"systematic_review","study_design_gemma":"systematic_review","study_design_scores_codex":[0.0003345418,0.00002937687,0.001010679,0.8923554,0.01289844,0.0001132419,0.0003302976,0.0003704453,0.0001846772,0.0006875666,0.002048255,0.08963712],"study_design_scores_gemma":[0.0002793293,0.0003735449,0.002938637,0.9197156,0.0498988,0.000319615,0.000290957,0.0002557317,0.0005101776,0.001065021,0.02429046,0.00006212166],"study_design_candidate":"systematic_review","study_design_consensus":"systematic_review","genre_codex":"review","genre_gemma":"review","genre_scores_codex":[0.001169019,0.9955171,0.001173522,0.0005797583,0.0002725047,0.0004806246,0.0003239705,0.00002304414,0.0004605395],"genre_scores_gemma":[0.03129952,0.9587587,0.005693815,0.001439714,0.0003182552,0.001744186,0.0005021238,0.00004093461,0.0002026976],"genre_candidate":"review","genre_consensus":"review","teacher_disagreement_score":0.04553655,"threshold_uncertainty_score":0.2408231,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.6097023893970032,"score_gpt":0.5421238976580322,"score_spread":0.06757849173897101,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}