{"id":"W2414367516","doi":"10.1136/bmjopen-2015-010403","title":"Empirical evaluation of the Q-Genie tool: a protocol for assessment of effectiveness","year":2016,"lang":"en","type":"article","venue":"BMJ Open","topic":"Genetic Associations and Epidemiology","field":"Biochemistry, Genetics and Molecular Biology","cited_by":47,"is_retracted":false,"has_abstract":true,"ca_institutions":"McMaster University; University of Toronto","funders":"Canadian Diabetes Association; Heart and Stroke Foundation of Canada","keywords":"Medicine; Protocol (science); Alternative medicine; Pathology","routes":{"ca_aff":true,"ca_fund":true,"ca_venue":false,"about_ca":false,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"codex-gemma-dda1882f352a","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.003627975,0.00005397781,0.0001454375,0.000008371488,0.00003139876,0.000003415369,0.0002473214,0.00007724375,0.00001940701],"category_scores_gemma":[0.0008326537,0.00002826687,0.00007921726,0.00003703162,0.00004030489,0.000001902161,0.0002128981,0.00001343991,4.30734e-7],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.0000237558,"about_ca_system_score_gemma":0.0004213429,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.0000101425,"about_ca_topic_score_gemma":0.00001754519,"domain_scores_codex":[0.9988319,0.0005645358,0.0002363724,0.0001469193,0.0001326341,0.00008766541],"domain_scores_gemma":[0.9990344,0.0001046659,0.0002351241,0.000312841,0.0003008467,0.0000120895],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"observational","study_design_gemma":"observational","study_design_scores_codex":[0.0003234804,0.0001695898,0.6421436,0.0001161642,0.0001194805,2.021478e-8,0.00001655626,0.000139935,0.339781,0.0002952518,0.003636191,0.01325871],"study_design_scores_gemma":[0.002882873,0.000363191,0.9262584,0.00007581787,0.00003299262,8.318825e-7,0.000008910866,0.0002661805,0.06355073,0.001887218,0.004604321,0.00006855897],"study_design_candidate":"observational","study_design_consensus":"observational","genre_codex":"empirical","genre_gemma":"empirical","genre_scores_codex":[0.6437585,0.000002532527,0.008015417,0.0006217982,0.00006842949,0.3456699,0.00004387313,0.000001411689,0.001818069],"genre_scores_gemma":[0.6667173,2.064149e-7,0.001792098,0.00004139269,0.00002821856,0.3313011,0.000006328714,0.000005060194,0.0001082771],"genre_candidate":"empirical","genre_consensus":"empirical","teacher_disagreement_score":0.2841148,"threshold_uncertainty_score":0.1257391,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.2222707968560043,"score_gpt":0.5500169730032044,"score_spread":0.3277461761472001,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}