{"id":"W2461005711","doi":"10.1145/2911451.2911456","title":"An Architecture for Privacy-Preserving and Replicable High-Recall Retrieval Experiments","year":2016,"lang":"en","type":"article","venue":"","topic":"Data Quality and Management","field":"Decision Sciences","cited_by":3,"is_retracted":false,"has_abstract":true,"ca_institutions":"University of Waterloo","funders":"","keywords":"Computer science; Recall; Architecture; Precision and recall; Information retrieval; Order (exchange); Information privacy; Computer security","routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"codex-gemma-dda1882f352a","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.002636173,0.0001081949,0.0001858654,0.0001033218,0.0001400549,0.0002972818,0.001161801,0.00005084893,0.0008620038],"category_scores_gemma":[0.002656274,0.00005607607,0.00004076747,0.0001641374,0.00006762958,0.0005916313,0.0007634123,0.00003489514,0.0000663388],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.00001637943,"about_ca_system_score_gemma":0.00001407216,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.00008350032,"about_ca_topic_score_gemma":0.00003711215,"domain_scores_codex":[0.9979517,0.0001271029,0.0003675575,0.0006696611,0.0006279057,0.0002560571],"domain_scores_gemma":[0.9973002,0.0008382893,0.00009974558,0.001511338,0.00009395333,0.0001564913],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"not_applicable","study_design_gemma":"not_applicable","study_design_scores_codex":[0.0008495652,0.0002835694,0.001202295,0.00002858052,0.00006077362,0.000004829407,0.001192516,0.00001208586,0.1230107,0.09917888,0.3912713,0.3829049],"study_design_scores_gemma":[0.001272505,0.0003209063,0.003295359,0.00002136266,0.000009065504,0.000001881041,0.0004881921,0.0002752116,0.03483774,0.3146526,0.6445895,0.0002357297],"study_design_candidate":"not_applicable","study_design_consensus":"not_applicable","genre_codex":"methods","genre_gemma":"empirical","genre_scores_codex":[0.4832374,0.00005458421,0.4882216,0.02124076,0.0003245308,0.0008001126,0.0001377251,0.0001373034,0.005845986],"genre_scores_gemma":[0.9296693,0.00001441529,0.04487253,0.001614394,0.0001294392,0.00003038378,0.00001342358,0.00001518951,0.02364094],"genre_candidate":"empirical","genre_consensus":null,"teacher_disagreement_score":0.4464319,"threshold_uncertainty_score":0.9438337,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.157610163111091,"score_gpt":0.429325468273088,"score_spread":0.271715305161997,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}