{"id":"W2065753274","doi":"10.1089/big.2013.1509","title":"Benchmarking Big Data Systems and the BigData Top100 List","year":2013,"lang":"en","type":"article","venue":"Big Data","topic":"Cloud Computing and Resource Management","field":"Computer Science","cited_by":50,"is_retracted":false,"has_abstract":true,"ca_institutions":"University of Toronto","funders":"","keywords":"Big data; Benchmarking; Computer science; Data science; Benchmark (surveying); Comparability; Database transaction; Data mining; Database; Business; Marketing","routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.02802376,0.0009918512,0.0008360206,0.0066068,0.003409651,0.014133,0.003084529,0.001711781,0.002878473],"category_scores_gemma":[0.06164806,0.0004572044,0.0005847254,0.01257639,0.001965057,0.01226645,0.005660655,0.002699658,0.001582568],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.004684763,"about_ca_system_score_gemma":0.007272879,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.006392342,"about_ca_topic_score_gemma":0.006331948,"domain_scores_codex":[0.9641218,0.01184934,0.002153687,0.001703516,0.01833552,0.001836133],"domain_scores_gemma":[0.9525999,0.00998894,0.003476969,0.008582671,0.02119645,0.00415508],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"observational","study_design_scores_codex":[0.0008538999,0.0007722127,0.05952652,0.00150975,0.0002221952,0.0004353996,0.00171493,0.0395272,0.006507413,0.4264613,0.2013995,0.2610698],"study_design_scores_gemma":[0.0001582729,0.001317697,0.07949113,0.00178926,0.0001338774,0.0006437094,0.006422592,0.1621623,0.03046917,0.2112139,0.5058129,0.0003851621],"study_design_candidate":"observational","study_design_consensus":null,"genre_codex":"methods","genre_gemma":"empirical","genre_scores_codex":[0.3079366,0.007668018,0.3445121,0.04517667,0.003876029,0.001690951,0.01660087,0.01651878,0.2560199],"genre_scores_gemma":[0.6963376,0.00237743,0.2436899,0.003582741,0.0006729098,0.001062024,0.04042792,0.002886116,0.008963428],"genre_candidate":"empirical","genre_consensus":null,"teacher_disagreement_score":0.02802376,"threshold_uncertainty_score":0.1482056,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.1267692910704791,"score_gpt":0.2606979585164022,"score_spread":0.1339286674459231,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}