{"id":"W4367048213","doi":"10.1007/s10654-023-00997-3","title":"Evaluating the harmonisation potential of diverse cohort datasets","year":2023,"lang":"en","type":"article","venue":"European Journal of Epidemiology","topic":"Health, Environment, Cognitive Aging","field":"Environmental Science","cited_by":12,"is_retracted":false,"has_abstract":true,"ca_institutions":"","funders":"Medical Research Foundation; Medical Research Council; UK Research and Innovation; Wellcome Trust; McGill University","keywords":"Comparability; Rigour; Data mining; Computer science; Granularity; Data science; Mathematics","routes":{"ca_aff":false,"ca_fund":true,"ca_venue":false,"about_ca":false,"invisible_to_affiliation_only":true},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":["metaresearch"],"consensus_categories":["metaresearch"],"category_scores_codex":[0.2935735,0.001132265,0.001557509,0.004792503,0.001710107,0.004616366,0.00307939,0.001806493,0.002243468],"category_scores_gemma":[0.3848576,0.0008319352,0.005629176,0.007132145,0.002880987,0.003006309,0.00838693,0.002173194,0.0005741931],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.00163239,"about_ca_system_score_gemma":0.003369026,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.003797402,"about_ca_topic_score_gemma":0.003054827,"domain_scores_codex":[0.7933884,0.1665522,0.01162597,0.01510177,0.01179209,0.001539668],"domain_scores_gemma":[0.6889262,0.2016749,0.009682076,0.08466367,0.01372571,0.001327497],"domain_codex":null,"domain_gemma":"methods","domain_candidate":"methods","domain_consensus":null,"study_design_codex":"observational","study_design_gemma":"simulation_or_modeling","study_design_scores_codex":[0.01019117,0.001272081,0.4503082,0.003458475,0.02744325,0.0008435745,0.00604055,0.2034192,0.004404023,0.03275173,0.02085951,0.2390083],"study_design_scores_gemma":[0.006305147,0.007128078,0.4206843,0.002279762,0.01234682,0.002505744,0.008039394,0.2085855,0.01727102,0.1640508,0.1498204,0.0009829251],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"genre_codex":"empirical","genre_gemma":"empirical","genre_scores_codex":[0.6860841,0.004282118,0.2520218,0.003941262,0.0008509047,0.007902523,0.03198699,0.00187003,0.01106027],"genre_scores_gemma":[0.7927389,0.0007475815,0.1656135,0.001066273,0.0001393781,0.004966826,0.03300355,0.0006616065,0.001062431],"genre_candidate":"empirical","genre_consensus":"empirical","teacher_disagreement_score":0.7064265,"threshold_uncertainty_score":0.8711497,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.1693394519202947,"score_gpt":0.3948474087422008,"score_spread":0.2255079568219061,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}