{"id":"W2005994535","doi":"10.3406/medi.2002.1536","title":"La lemmatisation et l'encodage grammatical permettent-ils de reconnaître l'auteur d'un texte ?","year":2002,"lang":"en","type":"article","venue":"Médiévales","topic":"Natural Language Processing Techniques","field":"Computer Science","cited_by":7,"is_retracted":false,"has_abstract":true,"ca_institutions":"Canadian Linguistic Association","funders":"","keywords":"Lemmatisation; Linguistics; Authorship attribution; Computer science; Artificial intelligence; Point (geometry); Corpus linguistics; Natural language processing; Humanities; Philosophy; Mathematics","routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.003325639,0.0004625969,0.0005123343,0.001782171,0.001064115,0.005851711,0.0006020175,0.001038592,0.006126456],"category_scores_gemma":[0.01659952,0.0003770061,0.0004977289,0.002766689,0.005775795,0.009599002,0.001024466,0.001405348,0.002819234],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.001156516,"about_ca_system_score_gemma":0.001138858,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.001577225,"about_ca_topic_score_gemma":0.002228223,"domain_scores_codex":[0.9971073,0.00165325,0.000218281,0.0005458624,0.0003246094,0.0001507707],"domain_scores_gemma":[0.9914703,0.004699314,0.001079352,0.001695204,0.00093853,0.0001173041],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"simulation_or_modeling","study_design_scores_codex":[0.0004313104,0.00008752947,0.02303964,0.0006450908,0.00009772853,0.0006432622,0.0139033,0.00142087,0.03308871,0.5042259,0.00483073,0.4175859],"study_design_scores_gemma":[0.00009083248,0.000259582,0.04919654,0.0007910882,0.0001669845,0.003727975,0.02124553,0.02484829,0.05620927,0.4851279,0.3581173,0.0002187737],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"genre_codex":"methods","genre_gemma":"empirical","genre_scores_codex":[0.3448451,0.008320478,0.5474259,0.01696476,0.001328271,0.0001594429,0.001089854,0.001775192,0.07809113],"genre_scores_gemma":[0.8144999,0.002431544,0.1713397,0.0005036527,0.0003747689,0.0001056073,0.0004642387,0.0007322697,0.009548275],"genre_candidate":"empirical","genre_consensus":null,"teacher_disagreement_score":0.006126456,"threshold_uncertainty_score":0.02049506,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.02342428150521207,"score_gpt":0.2706678659825323,"score_spread":0.2472435844773203,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}