{"id":"W2254582040","doi":"10.1515/jhsl-2015-0002","title":"Searching for standard French: The construction and mining of the <i>Recueil historique des grammaires du français</i>","year":2015,"lang":"en","type":"article","venue":"Journal of Historical Sociolinguistics","topic":"Linguistic Variation and Morphology","field":"Social Sciences","cited_by":74,"is_retracted":false,"has_abstract":true,"ca_institutions":"University of Manitoba; University of Ottawa","funders":"","keywords":"Linguistics; Rule-based machine translation; Grammar; Originality; Structuring; Selection (genetic algorithm); French; Humanities; Philosophy; History; Computer science; Sociology; Artificial intelligence; Political science; Anthropology; Law","routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":true,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.002241555,0.0002563873,0.0002445331,0.006705924,0.00144167,0.002882396,0.000721691,0.0004092205,0.00299361],"category_scores_gemma":[0.008676684,0.0002123651,0.0002190054,0.006105303,0.001976477,0.001284328,0.001182443,0.0005914859,0.0004856495],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.004054796,"about_ca_system_score_gemma":0.003363033,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.2137908,"about_ca_topic_score_gemma":0.358271,"domain_scores_codex":[0.9989781,0.0003923096,0.00005763506,0.0002774574,0.0002085111,0.00008599246],"domain_scores_gemma":[0.9932706,0.003207954,0.0008710328,0.0008404747,0.001614642,0.0001954112],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"design_other","study_design_gemma":"observational","study_design_scores_codex":[0.0002540888,0.00008100923,0.3161329,0.001227784,0.0001435766,0.001457867,0.09794274,0.002962005,0.02031864,0.05820206,0.02874019,0.4725372],"study_design_scores_gemma":[0.00002332635,0.0000604095,0.5525364,0.0004358665,0.00005847311,0.0008862072,0.04527092,0.01232496,0.008590844,0.01135931,0.3683332,0.0001200535],"study_design_candidate":"observational","study_design_consensus":null,"genre_codex":"empirical","genre_gemma":"empirical","genre_scores_codex":[0.9319429,0.002607813,0.02544116,0.001718612,0.0000556936,0.0001862564,0.0136047,0.0005123193,0.02393063],"genre_scores_gemma":[0.9546047,0.0006023949,0.02798639,0.0001185256,0.00003263633,0.0001182522,0.01218243,0.0001925998,0.004162033],"genre_candidate":"empirical","genre_consensus":"empirical","teacher_disagreement_score":0.2137908,"threshold_uncertainty_score":0.4250928,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.04972725782999952,"score_gpt":0.3027244303230727,"score_spread":0.2529971724930732,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}