{"id":"W4205795307","doi":"10.1109/bigdata52589.2021.9671523","title":"BIRD-QA: A BERT-based Information Retrieval Approach to Domain Specific Question Answering","year":2021,"lang":"en","type":"article","venue":"2021 IEEE International Conference on Big Data (Big Data)","topic":"Topic Modeling","field":"Computer Science","cited_by":18,"is_retracted":false,"has_abstract":true,"ca_institutions":"Queen's University","funders":"","keywords":"Computer science; Question answering; Information retrieval; Context (archaeology); Knowledge base; Preprocessor; Domain (mathematical analysis); Matching (statistics); Task (project management); F1 score; Language model; Artificial intelligence","routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.002704379,0.001346816,0.0009498996,0.004221884,0.0006961199,0.001422291,0.003460765,0.001738474,0.004937554],"category_scores_gemma":[0.006847292,0.0006704314,0.001724646,0.002222123,0.0007071688,0.003746266,0.001809986,0.001945061,0.003401426],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.001575263,"about_ca_system_score_gemma":0.001244099,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.02348695,"about_ca_topic_score_gemma":0.02494562,"domain_scores_codex":[0.9984232,0.0005689887,0.0001311052,0.0004479959,0.0003396864,0.00008892828],"domain_scores_gemma":[0.9973355,0.001391131,0.0001194948,0.000400604,0.0006305572,0.0001225997],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","study_design_scores_codex":[0.0006184633,0.0007852894,0.006166344,0.001163487,0.0003635543,0.0004267147,0.001279059,0.1466352,0.0143349,0.02895808,0.064579,0.7346898],"study_design_scores_gemma":[0.00003696868,0.0002359244,0.00158097,0.00006594667,0.00007138414,0.0002363105,0.0001633295,0.9410226,0.004371028,0.019872,0.03228832,0.00005511738],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"genre_codex":"methods","genre_gemma":"methods","genre_scores_codex":[0.01113521,0.001501293,0.9594685,0.0007624832,0.000119459,0.0007640602,0.002735483,0.0191568,0.004356721],"genre_scores_gemma":[0.2161968,0.0009338277,0.7613947,0.0009664494,0.0001496496,0.0007109818,0.01130735,0.0004467721,0.007893301],"genre_candidate":"methods","genre_consensus":"methods","teacher_disagreement_score":0.02348695,"threshold_uncertainty_score":0.04670048,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.2826899529421072,"score_gpt":0.3327089787810121,"score_spread":0.05001902583890488,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}