{"id":"W6983105518","doi":"","title":"Lemmatising Treebanks. Corpus Annotation with Knowledge Bases","year":2018,"lang":"en","type":"article","venue":"RIUR (Universidad de La Rioja)","topic":"Preterm Birth and Chorioamnionitis","field":"Medicine","cited_by":0,"is_retracted":false,"has_abstract":true,"ca_institutions":"","funders":"","keywords":"Treebank; Annotation; Lemma (botany); Parsing; Set (abstract data type); Corpus linguistics; Text corpus","routes":{"ca_aff":false,"ca_fund":false,"ca_venue":false,"about_ca":true,"invisible_to_affiliation_only":true},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.009050237,0.0009921007,0.0009378631,0.01097149,0.002594355,0.005399412,0.001836313,0.001112687,0.01684751],"category_scores_gemma":[0.03981585,0.001234606,0.0008547634,0.01684107,0.002378285,0.006571138,0.004791389,0.002677843,0.009953409],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.001981561,"about_ca_system_score_gemma":0.004399419,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.005265096,"about_ca_topic_score_gemma":0.005581203,"domain_scores_codex":[0.9921457,0.003593226,0.001325482,0.001489134,0.001283552,0.0001629553],"domain_scores_gemma":[0.9658901,0.02313917,0.002312549,0.004857654,0.003515871,0.0002846076],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","study_design_scores_codex":[0.0004301247,0.0001983217,0.004114558,0.005706334,0.0001866138,0.001182109,0.02267827,0.00566533,0.02668634,0.1948048,0.09997948,0.6383678],"study_design_scores_gemma":[0.00009583512,0.0000650436,0.008124499,0.001845199,0.000145694,0.001114611,0.005730389,0.02435096,0.02464566,0.1309267,0.8027465,0.0002089269],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"genre_codex":"methods","genre_gemma":"methods","genre_scores_codex":[0.01422403,0.002187541,0.8943594,0.001219385,0.0004773297,0.001786399,0.04123989,0.0138339,0.0306722],"genre_scores_gemma":[0.0599741,0.001436877,0.8512889,0.0003269329,0.0001936747,0.002271178,0.0731646,0.004377233,0.006966408],"genre_candidate":"methods","genre_consensus":"methods","teacher_disagreement_score":0.01684751,"threshold_uncertainty_score":0.0563606,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.00904552662072357,"score_gpt":0.2657146131267278,"score_spread":0.2566690865060042,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}