{"id":"W2084416125","doi":"10.1177/0962280208096046","title":"Efficient sampling approaches to address confounding in database studies","year":2008,"lang":"en","type":"review","venue":"Statistical Methods in Medical Research","topic":"Primary Care and Health Outcomes","field":"Health Professions","cited_by":9,"is_retracted":false,"has_abstract":true,"ca_institutions":"McGill University Health Centre; McGill University","funders":"","keywords":"Confounding; Pharmacoepidemiology; Medical prescription; Computer science; Sampling (signal processing); Medicine; Data mining; Statistics; Mathematics; Pharmacology","routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":["metaresearch"],"consensus_categories":["metaresearch"],"category_scores_codex":[0.228262,0.002479835,0.006213847,0.007923554,0.001314731,0.003469395,0.006193389,0.002911584,0.003516096],"category_scores_gemma":[0.331685,0.002204249,0.005157812,0.01341889,0.002894848,0.003778803,0.005770715,0.00384133,0.0007823115],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.00258641,"about_ca_system_score_gemma":0.006661617,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.00301514,"about_ca_topic_score_gemma":0.002874788,"domain_scores_codex":[0.6255941,0.3321937,0.01628386,0.006227178,0.0189884,0.000712744],"domain_scores_gemma":[0.6011153,0.3579413,0.01179159,0.01909485,0.009504372,0.0005526419],"domain_codex":null,"domain_gemma":"methods","domain_candidate":"methods","domain_consensus":null,"study_design_codex":"design_other","study_design_gemma":"theoretical_or_conceptual","study_design_scores_codex":[0.0005926862,0.0002050438,0.008915926,0.02562252,0.009188883,0.0002749709,0.002271404,0.01372697,0.0006869057,0.1356184,0.007346459,0.7955498],"study_design_scores_gemma":[0.002461503,0.001298197,0.01440351,0.01748634,0.007377048,0.001192167,0.001247317,0.07170826,0.002890544,0.7618898,0.1177263,0.0003190389],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"genre_codex":"methods","genre_gemma":"review","genre_scores_codex":[0.002043215,0.05130215,0.937793,0.001421241,0.000414895,0.004740589,0.0006883657,0.0001796212,0.001416971],"genre_scores_gemma":[0.03504097,0.04717983,0.8950283,0.001036112,0.0006008611,0.01919423,0.001132926,0.00008416386,0.0007026959],"genre_candidate":"review","genre_consensus":null,"teacher_disagreement_score":0.7717379,"threshold_uncertainty_score":0.9516903,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.9154363551370552,"score_gpt":0.7780213316583924,"score_spread":0.1374150234786629,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}