{"id":"W7125831461","doi":"10.21428/594757db.4d4509de","title":"Experimental Analysis of Large Language Models in Crime Classification and Prediction","year":2024,"lang":"en","type":"article","venue":"","topic":"Crime Patterns and Interventions","field":"Social Sciences","cited_by":1,"is_retracted":false,"has_abstract":true,"ca_institutions":"Ontario Tech University","funders":"","keywords":"Crime analysis; Law enforcement; Transformative learning; Adaptability; Focus (optics); Domain (mathematical analysis); Generative grammar; Enforcement","routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.01120221,0.001429724,0.000733482,0.001045458,0.0008260349,0.001156269,0.001305143,0.001261699,0.002086181],"category_scores_gemma":[0.04264034,0.0004580072,0.0009323023,0.001100366,0.001085234,0.002469621,0.001161996,0.002919995,0.0009642265],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.001620354,"about_ca_system_score_gemma":0.001067068,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.02247592,"about_ca_topic_score_gemma":0.02234776,"domain_scores_codex":[0.9940586,0.004095692,0.0003185188,0.0007888621,0.0004688999,0.0002693838],"domain_scores_gemma":[0.9344073,0.05670061,0.001667798,0.004255221,0.002361641,0.0006072926],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","study_design_scores_codex":[0.004495626,0.005492053,0.07035637,0.0008722886,0.001025687,0.0004619194,0.001481715,0.6360732,0.005431435,0.006978239,0.0299617,0.2373698],"study_design_scores_gemma":[0.0001304815,0.0005392689,0.009416405,0.00004033258,0.00009539908,0.00006831135,0.0003642091,0.981463,0.003075728,0.002941758,0.001819581,0.00004561684],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","genre_codex":"empirical","genre_gemma":"empirical","genre_scores_codex":[0.9633765,0.001495948,0.02298816,0.002177284,0.0003870359,0.000220061,0.003199874,0.001342818,0.004812396],"genre_scores_gemma":[0.9767981,0.0003170988,0.01692439,0.0002346689,0.0001120489,0.0001667006,0.003966895,0.00009115904,0.001388947],"genre_candidate":"empirical","genre_consensus":"empirical","teacher_disagreement_score":0.02247592,"threshold_uncertainty_score":0.05924368,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.06609552712876222,"score_gpt":0.4163797179679329,"score_spread":0.3502841908391707,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}