{"id":"W2132314908","doi":"10.1145/1390334.1390446","title":"Novelty and diversity in information retrieval evaluation","year":2008,"lang":"en","type":"article","venue":"","topic":"Information Retrieval and Search Behavior","field":"Computer Science","cited_by":951,"is_retracted":false,"has_abstract":true,"ca_institutions":"University of Waterloo","funders":"","keywords":"Novelty; Computer science; Redundancy (engineering); Ranking (information retrieval); Information retrieval; Ambiguity; Learning to rank; Information gain; Data mining; Artificial intelligence; Machine learning","routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.06834721,0.002364682,0.00333351,0.009538271,0.001767174,0.006254688,0.002078248,0.003686226,0.001183263],"category_scores_gemma":[0.1770916,0.0008234837,0.001593938,0.005154718,0.005884214,0.01164137,0.006614281,0.003743243,0.000356199],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.004350632,"about_ca_system_score_gemma":0.002010297,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.001130315,"about_ca_topic_score_gemma":0.001412207,"domain_scores_codex":[0.8959367,0.06570719,0.005090998,0.006158061,0.02553216,0.001574851],"domain_scores_gemma":[0.7930283,0.1662651,0.01121405,0.01091479,0.01550054,0.00307716],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"design_other","study_design_gemma":"theoretical_or_conceptual","study_design_scores_codex":[0.001929104,0.0005354147,0.03829167,0.001414913,0.001324444,0.0003026591,0.001076931,0.1476975,0.007681496,0.2743159,0.005170656,0.5202593],"study_design_scores_gemma":[0.0003771018,0.00281531,0.01890167,0.0004810068,0.0004459539,0.0008437143,0.0002497858,0.4565943,0.008950614,0.5018911,0.008015301,0.0004342504],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"genre_codex":"methods","genre_gemma":"empirical","genre_scores_codex":[0.07982308,0.01073372,0.890636,0.002024294,0.0002501182,0.0006751702,0.0002813963,0.0008016846,0.01477457],"genre_scores_gemma":[0.7264948,0.001249706,0.2678781,0.0005311417,0.0006432043,0.0009073077,0.0003063684,0.0002584513,0.001730907],"genre_candidate":"empirical","genre_consensus":null,"teacher_disagreement_score":0.06834721,"threshold_uncertainty_score":0.3614589,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.0679627973098831,"score_gpt":0.2735590934351592,"score_spread":0.2055962961252761,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}