{"id":"W6939837085","doi":"10.6084/m9.figshare.16909645","title":"Additional file 7 of Assessing the suitability of general practice electronic health records for clinical prediction model development: a data quality assessment","year":2021,"lang":"en","type":"article","venue":"Figshare","topic":"Data Quality and Management","field":"Decision Sciences","cited_by":0,"is_retracted":false,"has_abstract":true,"ca_institutions":"University of Calgary","funders":"","keywords":"Data quality; Record linkage; Quality (philosophy); Health records; General practice; Health data; Quality assessment; Data collection","routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":["metaresearch","insufficient_payload"],"consensus_categories":[],"category_scores_codex":[0.01297727,0.0009730814,0.001063631,0.004310036,0.001126382,0.002247501,0.002209068,0.001364775,0.8468087],"category_scores_gemma":[0.1879137,0.0006517429,0.001335489,0.005841753,0.0003852513,0.002391897,0.001805626,0.001076936,0.09595143],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.002135354,"about_ca_system_score_gemma":0.00411636,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.008502331,"about_ca_topic_score_gemma":0.01165903,"domain_scores_codex":[0.9929946,0.002227692,0.002056859,0.0006643145,0.001694828,0.0003615883],"domain_scores_gemma":[0.7191227,0.2336304,0.01115609,0.009040029,0.02546316,0.00158765],"domain_codex":null,"domain_gemma":"methods","domain_candidate":"methods","domain_consensus":null,"study_design_codex":"not_applicable","study_design_gemma":"observational","study_design_scores_codex":[0.0006988187,0.0001647368,0.003568458,0.003611667,0.0001085519,0.00005749932,0.0001382785,0.0005004361,0.00007485799,0.001005861,0.9740456,0.01602528],"study_design_scores_gemma":[0.01773592,0.0009153445,0.08570341,0.01234995,0.0008057574,0.0006833022,0.001546624,0.008109708,0.00228783,0.01912357,0.8503596,0.0003790186],"study_design_candidate":"observational","study_design_consensus":null,"genre_codex":"dataset","genre_gemma":"empirical","genre_scores_codex":[0.0005729655,0.00001432209,0.000810591,0.0002868723,0.00003268644,0.0007634286,0.9950133,0.0004519561,0.002053861],"genre_scores_gemma":[0.02588567,0.0001716534,0.01936434,0.001116069,0.0002401008,0.01810026,0.9168882,0.001749408,0.01648431],"genre_candidate":"empirical","genre_consensus":null,"teacher_disagreement_score":0.9870228,"threshold_uncertainty_score":0.2185088,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.6550559088450293,"score_gpt":0.5950021434766101,"score_spread":0.06005376536841922,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}