{"id":"W2977455214","doi":"10.4000/books.aaccademia.4437","title":"Evalita 2018: Overview on the 6th Evaluation Campaign of Natural Language Processing and Speech Tools for Italian","year":2018,"lang":"en","type":"book-chapter","venue":"Accademia University Press eBooks","topic":"Text Readability and Simplification","field":"Computer Science","cited_by":30,"is_retracted":false,"has_abstract":true,"ca_institutions":"","funders":"National Research Council Canada; Università degli Studi di Napoli Federico II","keywords":"Natural (archaeology); Computer science; Natural language processing; Linguistics; Psychology; Speech recognition; History; Archaeology; Philosophy","routes":{"ca_aff":false,"ca_fund":true,"ca_venue":false,"about_ca":false,"invisible_to_affiliation_only":true},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.02149384,0.002413198,0.001473848,0.0101864,0.001678465,0.007196955,0.003467099,0.002398904,0.03174476],"category_scores_gemma":[0.0227198,0.0006817969,0.001135117,0.006496632,0.001492424,0.005120162,0.004956654,0.002790338,0.03154483],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.004265052,"about_ca_system_score_gemma":0.00488711,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.006825965,"about_ca_topic_score_gemma":0.01181936,"domain_scores_codex":[0.9785218,0.007673026,0.0008683647,0.001260398,0.01063493,0.001041558],"domain_scores_gemma":[0.978536,0.005798667,0.0007872577,0.002437046,0.01079908,0.001641969],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"not_applicable","study_design_gemma":"not_applicable","study_design_scores_codex":[0.0003344169,0.0002999528,0.001158253,0.002111465,0.0000687949,0.0000998719,0.0008599764,0.0008489513,0.003717466,0.00731035,0.7880879,0.1951025],"study_design_scores_gemma":[0.00007730705,0.0002195732,0.002945805,0.0009060993,0.00006351292,0.0001228029,0.0002621959,0.0009256763,0.004425122,0.002427063,0.9875803,0.00004450998],"study_design_candidate":"not_applicable","study_design_consensus":"not_applicable","genre_codex":"other","genre_gemma":"review","genre_scores_codex":[0.03604032,0.07882865,0.0654076,0.02277058,0.009360827,0.005872948,0.0954203,0.02779341,0.6585054],"genre_scores_gemma":[0.1016664,0.02427608,0.1022464,0.007075809,0.004429298,0.01167958,0.4198935,0.02191305,0.3068199],"genre_candidate":"review","genre_consensus":null,"teacher_disagreement_score":0.03174476,"threshold_uncertainty_score":0.1136717,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.1062257194990996,"score_gpt":0.3005297298892182,"score_spread":0.1943040103901186,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}