{"id":"W4405130376","doi":"10.2139/ssrn.5037738","title":"Unleashing the benefits of SparkContext for Big Data","year":2024,"lang":"en","type":"article","venue":"SSRN Electronic Journal","topic":"Data Mining Algorithms and Applications","field":"Computer Science","cited_by":0,"is_retracted":false,"has_abstract":false,"ca_institutions":"Artificial Intelligence in Medicine (Canada)","funders":"","keywords":"Big data; Data science; Computer science; Business; Data mining","routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.02245054,0.001876489,0.002636325,0.002077756,0.003648097,0.009939365,0.008543951,0.003661389,0.009323978],"category_scores_gemma":[0.09778231,0.002137134,0.002574432,0.004956934,0.006242197,0.03134687,0.01793629,0.01116775,0.008960784],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.001610517,"about_ca_system_score_gemma":0.009657296,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.0048816,"about_ca_topic_score_gemma":0.00814121,"domain_scores_codex":[0.9690048,0.007665107,0.001874047,0.003326619,0.01515652,0.002972922],"domain_scores_gemma":[0.8856347,0.03883471,0.001918803,0.05488757,0.01097284,0.007751378],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"not_applicable","study_design_gemma":"not_applicable","study_design_scores_codex":[0.004873927,0.0004867189,0.01033758,0.001735141,0.0004355011,0.0006478414,0.001779364,0.003793943,0.01128111,0.1921121,0.496415,0.2761018],"study_design_scores_gemma":[0.0007079415,0.0005340555,0.003082895,0.0007176123,0.0003422438,0.001132379,0.001256922,0.05077744,0.01444529,0.4837834,0.4428734,0.0003463755],"study_design_candidate":"not_applicable","study_design_consensus":"not_applicable","genre_codex":"methods","genre_gemma":"methods","genre_scores_codex":[0.1087037,0.03305116,0.4320092,0.1552062,0.0251174,0.000903162,0.007490011,0.1519844,0.08553466],"genre_scores_gemma":[0.5055748,0.0112601,0.3677785,0.04500954,0.0106505,0.0006950296,0.01304518,0.02453741,0.02144897],"genre_candidate":"methods","genre_consensus":"methods","teacher_disagreement_score":0.02245054,"threshold_uncertainty_score":0.1187313,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.06117778190044694,"score_gpt":0.2919267630927175,"score_spread":0.2307489811922706,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}