{"id":"W2294508362","doi":"10.7202/1035932ar","title":"Proposition de protocole pour l’analyse des données textuelles : pour une démarche expérimentale en lexicométrie","year":2016,"lang":"fr","type":"article","venue":"Nouvelles perspectives en sciences sociales","topic":"Natural Language Processing Techniques","field":"Computer Science","cited_by":28,"is_retracted":false,"has_abstract":true,"ca_institutions":"","funders":"","keywords":"Humanities; Art","routes":{"ca_aff":false,"ca_fund":false,"ca_venue":true,"about_ca":false,"invisible_to_affiliation_only":true},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.05860746,0.002576061,0.002508324,0.00330734,0.002170164,0.01081669,0.003618445,0.004116027,0.0160259],"category_scores_gemma":[0.1726314,0.001953377,0.002479139,0.002926061,0.003203907,0.01056642,0.004620331,0.005822504,0.007699464],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.002067941,"about_ca_system_score_gemma":0.01157454,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.00521201,"about_ca_topic_score_gemma":0.003043488,"domain_scores_codex":[0.8804387,0.07172291,0.01157677,0.009623176,0.02524404,0.001394409],"domain_scores_gemma":[0.7642943,0.1519445,0.0047839,0.04321173,0.03408952,0.001676077],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"design_other","study_design_gemma":"theoretical_or_conceptual","study_design_scores_codex":[0.006927497,0.002476006,0.007471653,0.009768466,0.001693636,0.0005058882,0.007433129,0.0142238,0.1266287,0.06685539,0.02019881,0.7358171],"study_design_scores_gemma":[0.003204597,0.004615084,0.01105258,0.002867583,0.001395558,0.001202494,0.008545445,0.1858234,0.413432,0.1102321,0.2564266,0.001202741],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"genre_codex":"methods","genre_gemma":"methods","genre_scores_codex":[0.01957962,0.0007691401,0.9619509,0.001780168,0.0004131378,0.003576358,0.002380004,0.006110815,0.003439804],"genre_scores_gemma":[0.06990907,0.0004954967,0.915878,0.0006158311,0.0001267279,0.005765634,0.002698105,0.001301335,0.003209778],"genre_candidate":"methods","genre_consensus":"methods","teacher_disagreement_score":0.05860746,"threshold_uncertainty_score":0.3099496,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.07846731784657346,"score_gpt":0.3714836107079668,"score_spread":0.2930162928613934,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}