{"id":"W4410127530","doi":"10.2196/58097","title":"Concordance between survey and electronic health record data in the COVID-19 Citizen Science study: a retrospective cohort analysis (Preprint)","year":2024,"lang":"en","type":"article","venue":"JMIR Formative Research","topic":"Machine Learning in Healthcare","field":"Computer Science","cited_by":0,"is_retracted":false,"has_abstract":true,"ca_institutions":"","funders":"","keywords":"Preprint; Concordance; Coronavirus disease 2019 (COVID-19); Health records; 2019-20 coronavirus outbreak; Severe acute respiratory syndrome coronavirus 2 (SARS-CoV-2); Electronic health record; Survey data collection; Cohort; Medicine; Virology; Health care; Political science; Statistics; Computer science; World Wide Web; Infectious disease (medical specialty); Outbreak; Pathology; Mathematics; Internal medicine","routes":{"ca_aff":false,"ca_fund":false,"ca_venue":true,"about_ca":false,"invisible_to_affiliation_only":true},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0254947,0.0003001953,0.0006205462,0.00242571,0.0007244587,0.001965838,0.0008296457,0.0005999583,0.0008401994],"category_scores_gemma":[0.04083516,0.0006178066,0.0009590673,0.003206666,0.0007990928,0.0008511778,0.002128432,0.0006603071,0.000253554],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.0007292145,"about_ca_system_score_gemma":0.001137909,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.009132151,"about_ca_topic_score_gemma":0.008520978,"domain_scores_codex":[0.9741626,0.01180447,0.003946914,0.003958656,0.004790631,0.001336677],"domain_scores_gemma":[0.9588618,0.01338939,0.01434923,0.007490996,0.005156515,0.0007521322],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"observational","study_design_gemma":"observational","study_design_scores_codex":[0.00005272007,0.0000135653,0.9989383,0.0000145864,0.00007319023,0.00001659333,0.0002385977,0.00001729506,0.00005118666,0.0000208131,0.00005937338,0.0005036919],"study_design_scores_gemma":[0.000008602191,0.0001058647,0.9979456,0.00004054575,0.00007062092,0.0001587287,0.0007052397,0.0004194439,0.0001432944,0.00003316641,0.0003611347,0.000007790853],"study_design_candidate":"observational","study_design_consensus":"observational","genre_codex":"empirical","genre_gemma":"empirical","genre_scores_codex":[0.997497,0.000231886,0.0007281047,0.00004101284,0.000013727,0.00006878663,0.0009829457,0.000006807421,0.0004296929],"genre_scores_gemma":[0.998391,0.00006316631,0.0004426833,0.00003365938,0.000008876388,0.00007226952,0.0008944829,0.00000498313,0.00008875207],"genre_candidate":"empirical","genre_consensus":"empirical","teacher_disagreement_score":0.0254947,"threshold_uncertainty_score":0.1348304,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.1379656253288164,"score_gpt":0.5090514009935752,"score_spread":0.3710857756647588,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}