{"id":"W6947982486","doi":"10.48448/eq63-z219","title":"FACTIFY-5WQA: 5W Aspect-based Fact Verification through Question Answering","year":2022,"lang":"en","type":"other","venue":"Open MIND","topic":"Remote Sensing in Agriculture","field":"Environmental Science","cited_by":0,"is_retracted":false,"has_abstract":true,"ca_institutions":"Artificial Intelligence in Medicine (Canada)","funders":"","keywords":"Verisimilitude; Question answering; Baseline (sea); Focus (optics); Categorization; Semantics (computer science)","routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.00384386,0.00174756,0.000808312,0.006069252,0.001058153,0.002927668,0.002296184,0.002112448,0.01672546],"category_scores_gemma":[0.0245672,0.0006666257,0.002137634,0.00225204,0.0009427574,0.006385963,0.004397599,0.002502358,0.009266082],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.001593087,"about_ca_system_score_gemma":0.002409694,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.01142492,"about_ca_topic_score_gemma":0.01722555,"domain_scores_codex":[0.9958383,0.001181609,0.0005966942,0.001131726,0.001049899,0.0002018497],"domain_scores_gemma":[0.9885633,0.005442617,0.001172797,0.002550532,0.001946558,0.000324198],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","study_design_scores_codex":[0.0009766928,0.0004797665,0.02461742,0.005472431,0.000371874,0.001887062,0.006201701,0.009241067,0.03843137,0.04610023,0.384443,0.4817773],"study_design_scores_gemma":[0.0003804067,0.0003179738,0.02561301,0.0007834552,0.0001994967,0.002036866,0.002644961,0.1965388,0.04790196,0.07070035,0.6526164,0.0002661873],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"genre_codex":"methods","genre_gemma":"methods","genre_scores_codex":[0.04911716,0.002501121,0.521859,0.003362944,0.0004619713,0.002704617,0.189054,0.2121762,0.01876299],"genre_scores_gemma":[0.1213839,0.000661815,0.5812829,0.001077169,0.0001346981,0.001087637,0.2847977,0.003499553,0.006074758],"genre_candidate":"methods","genre_consensus":"methods","teacher_disagreement_score":0.01672546,"threshold_uncertainty_score":0.05595219,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.0260152647740432,"score_gpt":0.2857068566867526,"score_spread":0.2596915919127094,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}