{"id":"W2228056711","doi":"","title":"Financial Fraud Detection and Data Mining of Imbalanced Databases using State Space Machine Learning","year":2016,"lang":"en","type":"dissertation","venue":"UWSpace (University of Waterloo)","topic":"Imbalanced Data Classification Techniques","field":"Computer Science","cited_by":0,"is_retracted":false,"has_abstract":true,"ca_institutions":"","funders":"","keywords":"Finance; Computer science; State (computer science); Database; Space (punctuation); Data mining; Data science; Artificial intelligence; Machine learning; Business","routes":{"ca_aff":false,"ca_fund":false,"ca_venue":false,"about_ca":true,"invisible_to_affiliation_only":true},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"codex-gemma-dda1882f352a","candidate_categories":["metaepi_narrow"],"consensus_categories":[],"category_scores_codex":[0.0003295488,0.000230233,0.0004129074,0.0003759151,0.0002383273,0.00003108717,0.001234186,0.0001412926,0.0000129566],"category_scores_gemma":[0.0001245883,0.0002503128,0.00004552704,0.000289369,0.0001218081,0.001344871,0.0006532296,0.0002292528,0.000002835032],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.00005779823,"about_ca_system_score_gemma":0.000138572,"about_ca_topic_candidate":true,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.01100778,"about_ca_topic_score_gemma":0.01100651,"domain_scores_codex":[0.9984426,0.0001102508,0.0002025673,0.0006972169,0.0003067025,0.0002406055],"domain_scores_gemma":[0.9977789,0.00008383174,0.0007769174,0.001108898,0.0001947811,0.00005666273],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"bench_or_experimental","study_design_gemma":"bench_or_experimental","study_design_scores_codex":[0.0004666002,0.0001265076,0.004665722,0.001148033,0.0001577079,0.00004986022,0.04238168,0.00004028202,0.7625695,0.0009240512,0.0005465812,0.1869235],"study_design_scores_gemma":[0.00430072,0.0008886107,0.05210461,0.004562479,0.0005100648,0.00004993357,0.02741368,0.2344568,0.6643219,0.001102749,0.007161509,0.00312691],"study_design_candidate":"bench_or_experimental","study_design_consensus":"bench_or_experimental","genre_codex":"empirical","genre_gemma":"empirical","genre_scores_codex":[0.8346917,0.0001847181,0.1637664,0.0001254013,0.0002146254,0.0002299893,0.0005747399,0.0001662067,0.0000461936],"genre_scores_gemma":[0.5359864,0.001713659,0.4078358,0.00001611924,0.0000779854,0.00000117611,0.003402731,0.00007259554,0.05089352],"genre_candidate":"empirical","genre_consensus":"empirical","teacher_disagreement_score":0.2987053,"threshold_uncertainty_score":0.9999949,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.02657397377353905,"score_gpt":0.2487400393814043,"score_spread":0.2221660656078653,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}