{"id":"W4401042732","doi":"10.18653/v1/2024.starsem-1.11","title":"Paraphrase Identification via Textual Inference","year":2024,"lang":"en","type":"article","venue":"","topic":"Natural Language Processing Techniques","field":"Computer Science","cited_by":3,"is_retracted":false,"has_abstract":true,"ca_institutions":"University of Alberta","funders":"Natural Sciences and Engineering Research Council of Canada; Alberta Machine Intelligence Institute","keywords":"Paraphrase; Computer science; Inference; Artificial intelligence; Identification (biology); Natural language processing","routes":{"ca_aff":true,"ca_fund":true,"ca_venue":false,"about_ca":false,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.002472763,0.001754939,0.001166768,0.00368082,0.001033265,0.002847407,0.00430568,0.002188881,0.00795415],"category_scores_gemma":[0.02202977,0.0004946827,0.001157799,0.002786414,0.0009139547,0.006483172,0.003254866,0.003063871,0.006618067],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.001074983,"about_ca_system_score_gemma":0.002099577,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.003236951,"about_ca_topic_score_gemma":0.007706338,"domain_scores_codex":[0.996427,0.0009283083,0.0003646714,0.001122039,0.0009810404,0.0001769882],"domain_scores_gemma":[0.9925512,0.003346305,0.0006236907,0.001715719,0.001542444,0.0002206546],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"design_other","study_design_gemma":"not_applicable","study_design_scores_codex":[0.0004636292,0.000777296,0.00469119,0.002764183,0.0002984354,0.000943133,0.0007606118,0.02853903,0.04865456,0.01822053,0.07007128,0.8238161],"study_design_scores_gemma":[0.0001198711,0.0003104111,0.004603876,0.0002666279,0.0002013992,0.001436862,0.0007158173,0.8142916,0.07297487,0.060569,0.0443789,0.0001307493],"study_design_candidate":"not_applicable","study_design_consensus":null,"genre_codex":"methods","genre_gemma":"methods","genre_scores_codex":[0.07923973,0.004507602,0.8406598,0.002131476,0.0005034754,0.001205924,0.01360481,0.03501402,0.02313312],"genre_scores_gemma":[0.3964671,0.001203365,0.5522487,0.0009741058,0.0003403407,0.0004541837,0.03668426,0.001114402,0.01051356],"genre_candidate":"methods","genre_consensus":"methods","teacher_disagreement_score":0.00795415,"threshold_uncertainty_score":0.0266093,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.01348102768761926,"score_gpt":0.3071119475079168,"score_spread":0.2936309198202975,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}