{"id":"W4295135780","doi":"10.1007/978-3-031-15471-3_32","title":"Assessment of Creditworthiness Models Privacy-Preserving Training with Synthetic Data","year":2022,"lang":"en","type":"book-chapter","venue":"Lecture notes in computer science","topic":"Imbalanced Data Classification Techniques","field":"Computer Science","cited_by":6,"is_retracted":false,"has_abstract":false,"ca_institutions":"Western University","funders":"","keywords":"Computer science; Synthetic data; Scarcity; Quality (philosophy); Training set; Work (physics); Data quality; Credit risk; Data mining; Artificial intelligence; Finance; Business; Metric (unit)","routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.009336703,0.0008174299,0.0009025541,0.0006379161,0.0004679673,0.001215434,0.001679119,0.001680255,0.001227776],"category_scores_gemma":[0.0278647,0.0002858162,0.000527162,0.0008433873,0.001194134,0.002376233,0.001398273,0.001481863,0.0002238616],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.001580115,"about_ca_system_score_gemma":0.001453895,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.003773228,"about_ca_topic_score_gemma":0.002387676,"domain_scores_codex":[0.9982131,0.0009326386,0.00009394313,0.0002704189,0.0003519219,0.0001380979],"domain_scores_gemma":[0.967921,0.02516462,0.0009485366,0.004118178,0.001448954,0.000398597],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","study_design_scores_codex":[0.0009901773,0.000112144,0.004541627,0.0001080848,0.00008479637,0.00006129202,0.0000612697,0.9169157,0.001410612,0.004391801,0.002102734,0.06921976],"study_design_scores_gemma":[0.00001151705,0.00007592009,0.0005092897,0.000008955777,0.00001017013,0.00002544116,0.00001174035,0.9953695,0.001360981,0.002434473,0.0001780871,0.000003839681],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","genre_codex":"empirical","genre_gemma":"empirical","genre_scores_codex":[0.5324397,0.003106426,0.4550227,0.002252121,0.000178723,0.0001357273,0.001338547,0.00171844,0.003807595],"genre_scores_gemma":[0.9612892,0.0003246842,0.0357981,0.0001165901,0.00005362408,0.00003067312,0.001076417,0.00006960138,0.001241129],"genre_candidate":"empirical","genre_consensus":"empirical","teacher_disagreement_score":0.009336703,"threshold_uncertainty_score":0.04937774,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.07513686561004515,"score_gpt":0.3056106964338318,"score_spread":0.2304738308237866,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}