{"id":"W4393704820","doi":"10.5281/zenodo.3372763","title":"Cross-Domain Modeling of Sentence-Level Evidence for Document Retrieval","year":2019,"lang":"en","type":"dataset","venue":"Zenodo (CERN European Organization for Nuclear Research)","topic":"Topic Modeling","field":"Computer Science","cited_by":0,"is_retracted":false,"has_abstract":true,"ca_institutions":"University of Waterloo","funders":"","keywords":"Information retrieval; Sentence; Computer science; Domain (mathematical analysis); Natural language processing; Artificial intelligence; Mathematics","routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.003694568,0.003022254,0.001521506,0.002299888,0.0009265221,0.001858871,0.003156278,0.00234905,0.02238569],"category_scores_gemma":[0.01171147,0.0008013227,0.002813567,0.002113356,0.0006155138,0.001984776,0.001774417,0.003662656,0.03713972],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.001649558,"about_ca_system_score_gemma":0.001633881,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.01197629,"about_ca_topic_score_gemma":0.0192619,"domain_scores_codex":[0.9982573,0.0006266718,0.0001408633,0.000525608,0.0003073262,0.0001420537],"domain_scores_gemma":[0.9956877,0.001898204,0.0001816905,0.001294683,0.000720705,0.0002169987],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"not_applicable","study_design_gemma":"not_applicable","study_design_scores_codex":[0.001091824,0.0005738674,0.004186189,0.001561777,0.0003953763,0.0001990015,0.0000617225,0.01671954,0.002324644,0.001299431,0.9122641,0.05932239],"study_design_scores_gemma":[0.002488829,0.001676886,0.03478817,0.0009761628,0.001166908,0.001877877,0.0004323743,0.4361792,0.02763163,0.02492268,0.4674665,0.0003927595],"study_design_candidate":"not_applicable","study_design_consensus":"not_applicable","genre_codex":"dataset","genre_gemma":"dataset","genre_scores_codex":[0.03279457,0.002978574,0.02741555,0.001497702,0.001151931,0.0006548772,0.9059013,0.01994808,0.007657338],"genre_scores_gemma":[0.02255678,0.0003444018,0.01154472,0.0001945954,0.00008966616,0.0003682397,0.9603424,0.000402687,0.004156603],"genre_candidate":"dataset","genre_consensus":"dataset","teacher_disagreement_score":0.02238569,"threshold_uncertainty_score":0.07488757,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.1617745458923477,"score_gpt":0.3356699897381784,"score_spread":0.1738954438458307,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}