{"id":"W3111257782","doi":"10.23889/ijpds.v5i5.1542","title":"Evaluating PPRL Vs Clear Text Linkage with Real-World Data","year":2020,"lang":"en","type":"article","venue":"International Journal for Population Data Science","topic":"Data Quality and Management","field":"Decision Sciences","cited_by":1,"is_retracted":false,"has_abstract":true,"ca_institutions":"University of British Columbia","funders":"","keywords":"Linkage (software); Identifier; Genetic linkage; Computer science; Record linkage; Population; Hash function; Genetics; Biology; Gene; Medicine","routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":true,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"codex-gemma-dda1882f352a","candidate_categories":["metaresearch","scholarly_communication","open_science"],"consensus_categories":[],"category_scores_codex":[0.01525459,0.0001426015,0.0002170554,0.0004723427,0.0006401798,0.0030113,0.01431987,0.00001973289,0.0002687066],"category_scores_gemma":[0.01301397,0.0001031098,0.00003849278,0.001428715,0.0002833298,0.00974243,0.003914248,0.0002282096,0.0001728467],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.00009872331,"about_ca_system_score_gemma":0.0002803452,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.000365003,"about_ca_topic_score_gemma":0.000928521,"domain_scores_codex":[0.992229,0.0001579571,0.000979,0.001128243,0.005202195,0.0003035603],"domain_scores_gemma":[0.9950277,0.0006903172,0.0009484146,0.001895138,0.001140104,0.0002982885],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","study_design_scores_codex":[0.002104076,0.0001923581,0.03925466,0.00001722185,0.0001463914,0.00005321265,0.000814227,0.00986361,0.0005750745,0.05210825,0.1476422,0.7472287],"study_design_scores_gemma":[0.001113008,0.0004443066,0.06025486,0.00006856714,0.00004290152,0.0000354976,0.0007010433,0.5116493,0.00005675689,0.006842519,0.4184654,0.0003259073],"study_design_candidate":"design_other","study_design_consensus":null,"genre_codex":"methods","genre_gemma":"empirical","genre_scores_codex":[0.2205309,0.00005849348,0.6174175,0.1341755,0.009065728,0.001586196,0.01068963,0.000227366,0.006248679],"genre_scores_gemma":[0.8904727,0.00004891018,0.1011866,0.003647173,0.001349901,0.000004667953,0.002407989,0.00001908165,0.0008630148],"genre_candidate":"empirical","genre_consensus":null,"teacher_disagreement_score":0.7469028,"threshold_uncertainty_score":0.9980237,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.6781494335367946,"score_gpt":0.5956232882520471,"score_spread":0.08252614528474744,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}