{"id":"W4317717687","doi":"10.1002/cpe.7635","title":"Performance comparison of Dask and Apache Spark on HPC systems for neuroimaging","year":2023,"lang":"en","type":"article","venue":"Concurrency and Computation Practice and Experience","topic":"Advanced Neural Network Applications","field":"Computer Science","cited_by":4,"is_retracted":false,"has_abstract":true,"ca_institutions":"Concordia University","funders":"Natural Sciences and Engineering Research Council of Canada; Canada Research Chairs; Canada Foundation for Innovation","keywords":"Computer science; SPARK (programming language); Big data; Python (programming language); File system; Neuroimaging; Pipeline (software); Database; Operating system; Programming language","routes":{"ca_aff":true,"ca_fund":true,"ca_venue":false,"about_ca":false,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.00674628,0.001352864,0.001258624,0.001708725,0.001298145,0.002444841,0.003059281,0.0006701771,0.002653294],"category_scores_gemma":[0.01206133,0.0006912036,0.001031112,0.003052697,0.001465894,0.002476487,0.002632618,0.001461222,0.001775157],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.002028633,"about_ca_system_score_gemma":0.004000247,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.0119335,"about_ca_topic_score_gemma":0.006723215,"domain_scores_codex":[0.994068,0.00105393,0.000621165,0.001156437,0.002235377,0.0008649935],"domain_scores_gemma":[0.9911017,0.002310512,0.0003449993,0.001594798,0.003334065,0.001313949],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","study_design_scores_codex":[0.02457838,0.002069801,0.06451244,0.004238949,0.00201261,0.001342327,0.003299544,0.3957003,0.06213447,0.030684,0.1775133,0.231914],"study_design_scores_gemma":[0.001290019,0.001251496,0.04082135,0.0001451358,0.0002314522,0.0004319248,0.001524338,0.8550457,0.05862294,0.00970985,0.03055955,0.0003662114],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","genre_codex":"empirical","genre_gemma":"empirical","genre_scores_codex":[0.8857585,0.001597662,0.02541483,0.001359522,0.0007901834,0.0002739273,0.004210786,0.0524812,0.02811353],"genre_scores_gemma":[0.9419044,0.0005764324,0.04043469,0.0002566326,0.00009544368,0.0002185578,0.01044099,0.003370408,0.002702458],"genre_candidate":"empirical","genre_consensus":"empirical","teacher_disagreement_score":0.0119335,"threshold_uncertainty_score":0.03567815,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.07232339667677312,"score_gpt":0.3845238603157263,"score_spread":0.3122004636389532,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}