{"id":"W2900690780","doi":"10.13053/rcs-124-1-9","title":"Creación y clasificación de un corpus criminológico en español usando características lingüísticas superficiales","year":2016,"lang":"es","type":"article","venue":"Research in Computing Science","topic":"Spanish Linguistics and Language Studies","field":"Arts and Humanities","cited_by":1,"is_retracted":false,"has_abstract":true,"ca_institutions":"Polytechnique Montréal","funders":"","keywords":"Humanities; Art","routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"codex-gemma-dda1882f352a","candidate_categories":["metaresearch","metaepi_narrow","sts","scholarly_communication"],"consensus_categories":["sts"],"category_scores_codex":[0.00886583,0.0003833266,0.0005374774,0.001060119,0.002634621,0.002210776,0.001565865,0.0001433759,0.000266301],"category_scores_gemma":[0.01267099,0.0002786746,0.000114074,0.0006475679,0.006805628,0.0002128104,0.001178542,0.000892226,0.0002064684],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.0006442562,"about_ca_system_score_gemma":0.001179778,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.001813452,"about_ca_topic_score_gemma":0.0002342223,"domain_scores_codex":[0.9933584,0.0006457217,0.0007217277,0.001143409,0.001757767,0.002372988],"domain_scores_gemma":[0.991304,0.006054719,0.0001459527,0.0006865205,0.001389648,0.0004191402],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"observational","study_design_scores_codex":[0.00008984525,0.0004236632,0.03286687,0.0002052446,0.00004277461,0.0006414664,0.03120816,0.0000265443,0.01030318,0.8409917,0.0001170804,0.08308344],"study_design_scores_gemma":[0.009237842,0.006180687,0.4257349,0.02107064,0.0003807753,0.0004251151,0.08605804,0.08296636,0.037684,0.04911234,0.2744465,0.006702795],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"genre_codex":"empirical","genre_gemma":"empirical","genre_scores_codex":[0.97558,0.001444752,0.0003653694,0.001176785,0.001159957,0.0004318857,0.00006997965,0.00009620583,0.01967508],"genre_scores_gemma":[0.9953507,0.0005583909,0.0007915151,0.00008089728,0.002765014,0.00001142269,0.00000171237,0.00004372341,0.0003966163],"genre_candidate":"empirical","genre_consensus":"empirical","teacher_disagreement_score":0.7918794,"threshold_uncertainty_score":0.9999666,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.1252213479101175,"score_gpt":0.4106063798652217,"score_spread":0.2853850319551043,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}