{"id":"W4406143531","doi":"10.36227/techrxiv.173143474.47669751/v3","title":"Exploring the Preprocessing of a Time-Series Healthcare Administrative Dataset on Deep Learning to Improve Prediction","year":2025,"lang":"en","type":"preprint","venue":"","topic":"Impact of AI and Big Data on Business and Society","field":"Decision Sciences","cited_by":0,"is_retracted":false,"has_abstract":true,"ca_institutions":"Hotchkiss Brain Institute; University of Calgary","funders":"","keywords":"Preprocessor; Deep learning; Computer science; Artificial intelligence; Time series; Series (stratigraphy); Health care; Machine learning; Data mining; Political science","routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.003524517,0.001166078,0.0004698746,0.001176642,0.0003712125,0.001355509,0.001065375,0.0007161787,0.001884599],"category_scores_gemma":[0.01406186,0.0002835139,0.0008764911,0.001491656,0.0003798559,0.001780906,0.0008341784,0.002436933,0.000901597],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.000923119,"about_ca_system_score_gemma":0.001667504,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.009743132,"about_ca_topic_score_gemma":0.0131123,"domain_scores_codex":[0.9989393,0.0004499032,0.0001005253,0.0002022837,0.000208015,0.00009989505],"domain_scores_gemma":[0.9948018,0.003179597,0.0003211317,0.0008057674,0.0007879418,0.0001037991],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","study_design_scores_codex":[0.0005045268,0.0009499624,0.03563003,0.0003276117,0.0003129878,0.0003102076,0.0002298696,0.4357442,0.01354176,0.009196399,0.01809815,0.4851543],"study_design_scores_gemma":[0.00001816126,0.0001153148,0.005094952,0.00003059612,0.00001803934,0.00002938808,0.00006294972,0.9801915,0.006799786,0.005199589,0.002420343,0.00001939592],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"genre_codex":"methods","genre_gemma":"empirical","genre_scores_codex":[0.2916136,0.000835492,0.6877154,0.003432397,0.0005412826,0.0004080534,0.005071465,0.007196212,0.00318609],"genre_scores_gemma":[0.740512,0.000482522,0.2468311,0.0004403974,0.0001280695,0.0004259608,0.009246297,0.0001615832,0.001771997],"genre_candidate":"empirical","genre_consensus":null,"teacher_disagreement_score":0.009743132,"threshold_uncertainty_score":0.01937282,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.3130282241788229,"score_gpt":0.4328642949644528,"score_spread":0.1198360707856299,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}