{"id":"W4220779482","doi":"10.1145/3490395","title":"Identifying the Big Shots—A Quantile-Matching Way in the Big Data Context","year":2022,"lang":"en","type":"article","venue":"ACM Transactions on Management Information Systems","topic":"Big Data and Business Intelligence","field":"Business, Management and Accounting","cited_by":2,"is_retracted":false,"has_abstract":true,"ca_institutions":"York University","funders":"","keywords":"Quantile; Operationalization; Multivariate statistics; Statistic; Matching (statistics); Econometrics; Context (archaeology); Sample size determination; Statistics; Big data; Computer science; Sample (material); Multivariate analysis; Quantile regression; Variable (mathematics); Mathematics; Data mining; Geography","routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.04173157,0.001068807,0.002426088,0.00534892,0.001866446,0.004191367,0.003914519,0.002803881,0.004551695],"category_scores_gemma":[0.1787894,0.0008287182,0.001834879,0.006792283,0.004413993,0.009151172,0.005352364,0.004014548,0.0004804948],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.001289407,"about_ca_system_score_gemma":0.002252208,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.002389349,"about_ca_topic_score_gemma":0.001700304,"domain_scores_codex":[0.9721519,0.01891231,0.001008735,0.004182484,0.003172262,0.0005724067],"domain_scores_gemma":[0.880894,0.08937769,0.007146406,0.016445,0.00455866,0.001578306],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","study_design_scores_codex":[0.0009286035,0.0005443736,0.07713273,0.001117068,0.001274971,0.000906941,0.00464076,0.04200801,0.002773471,0.3392776,0.007932063,0.5214633],"study_design_scores_gemma":[0.0001236146,0.0002972411,0.01999295,0.0002221073,0.000288458,0.0003286682,0.001321122,0.1637656,0.002483393,0.8010809,0.009969027,0.0001267918],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"genre_codex":"methods","genre_gemma":"empirical","genre_scores_codex":[0.0294375,0.0006840917,0.9651331,0.001621541,0.0001418805,0.0002312411,0.0003834465,0.0004688596,0.001898257],"genre_scores_gemma":[0.5716926,0.0004493824,0.4242535,0.0009976486,0.0003088565,0.0005852958,0.0005565268,0.0002193769,0.0009367314],"genre_candidate":"empirical","genre_consensus":null,"teacher_disagreement_score":0.04173157,"threshold_uncertainty_score":0.2207003,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.1927878425864501,"score_gpt":0.3058364880874943,"score_spread":0.1130486455010442,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}