{"id":"W1996246161","doi":"10.1145/1277741.1277895","title":"Improving retrieval accuracy by weighting document types with clickthrough data","year":2007,"lang":"en","type":"article","venue":"","topic":"Information Retrieval and Search Behavior","field":"Computer Science","cited_by":5,"is_retracted":false,"has_abstract":true,"ca_institutions":"University of Waterloo","funders":"","keywords":"Weighting; Computer science; Task (project management); Relevance (law); Information retrieval; Document retrieval; Function (biology); Term (time); Vector space model; Relevance feedback; tf–idf; Artificial intelligence; Data mining; Image retrieval","routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.005731043,0.002103711,0.002403964,0.01136249,0.0007407665,0.002788063,0.001210875,0.001904368,0.001430896],"category_scores_gemma":[0.03468019,0.0006515684,0.001153093,0.006703825,0.0004031056,0.004433576,0.00106375,0.001191841,0.0031257],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.0007447142,"about_ca_system_score_gemma":0.001163825,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.01136377,"about_ca_topic_score_gemma":0.01397962,"domain_scores_codex":[0.9957371,0.001428129,0.0005271116,0.0005709026,0.001462995,0.00027371],"domain_scores_gemma":[0.9774524,0.01103409,0.001813334,0.003715982,0.005639083,0.0003452009],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","study_design_scores_codex":[0.00139308,0.0005389354,0.0287078,0.0007560224,0.0004389255,0.0001263051,0.0002436323,0.01838274,0.03534203,0.0007913241,0.02117602,0.8921032],"study_design_scores_gemma":[0.0004732974,0.001087734,0.04673035,0.0002416193,0.001321222,0.001329671,0.0003602741,0.8427849,0.07562306,0.0115585,0.0180413,0.0004480873],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"genre_codex":"methods","genre_gemma":"empirical","genre_scores_codex":[0.3708815,0.01524048,0.5757802,0.001113263,0.0008466401,0.0007743413,0.005959096,0.02142195,0.007982572],"genre_scores_gemma":[0.6543415,0.00275306,0.321407,0.0003832159,0.0007610038,0.0003312622,0.009994982,0.001051134,0.008976827],"genre_candidate":"empirical","genre_consensus":null,"teacher_disagreement_score":0.01136377,"threshold_uncertainty_score":0.03030902,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.02680500078858922,"score_gpt":0.3022873821396024,"score_spread":0.2754823813510132,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}