{"id":"W4410728601","doi":"10.1007/s41060-025-00799-8","title":"A data-driven approach for predicting crime occurrence using machine learning models","year":2025,"lang":"en","type":"article","venue":"International Journal of Data Science and Analytics","topic":"Crime Patterns and Interventions","field":"Social Sciences","cited_by":1,"is_retracted":false,"has_abstract":false,"ca_institutions":"Université de Sherbrooke","funders":"","keywords":"Computer science; Machine learning; Artificial intelligence","routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.002544755,0.001118464,0.001389539,0.003103718,0.0006047581,0.001916663,0.002539251,0.001619062,0.001533368],"category_scores_gemma":[0.01093679,0.0008514337,0.001656817,0.002742535,0.0004546461,0.001519074,0.001227717,0.002524354,0.0006431919],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.00120729,"about_ca_system_score_gemma":0.002212083,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.01241207,"about_ca_topic_score_gemma":0.01706304,"domain_scores_codex":[0.9986524,0.000482608,0.000115864,0.0003446918,0.0003046555,0.00009989313],"domain_scores_gemma":[0.9928495,0.005372273,0.0003799809,0.0003650079,0.0008495534,0.0001837253],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","study_design_scores_codex":[0.0002363129,0.0007612074,0.01924739,0.0001492371,0.0003241448,0.0002327425,0.00009663772,0.8712152,0.001083221,0.009391296,0.003364502,0.09389815],"study_design_scores_gemma":[0.000004398322,0.00001410098,0.0003902502,0.000004678588,0.000007807859,0.00001286049,0.000008098597,0.9960341,0.0001577382,0.003180948,0.0001797785,0.000005342131],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","genre_codex":"methods","genre_gemma":"empirical","genre_scores_codex":[0.07851771,0.0004318207,0.9132622,0.00129362,0.0001687974,0.0003074591,0.003433559,0.001516638,0.001068107],"genre_scores_gemma":[0.6893348,0.0003530927,0.3005444,0.000300568,0.0002071789,0.0006507189,0.006325371,0.0001023163,0.00218166],"genre_candidate":"empirical","genre_consensus":null,"teacher_disagreement_score":0.01241207,"threshold_uncertainty_score":0.02467966,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.3388764596217803,"score_gpt":0.4783996502889309,"score_spread":0.1395231906671506,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}