{"meta":{"query_hash":"7ed3139828b5","filters":{"venue":"2021 IEEE International Conference on Big Data (Big Data)"},"cohort_total":31,"direct_labels_cover":0,"predictions_cover":31,"exported":31,"export_cap":100000,"truncated":false,"label_status":"direct model label, unvalidated","prediction_status":"machine_predicted_unvalidated (Codex and Gemma teacher distillation)","score_status":"score_only:v0-immature-baseline","snapshot":{"source":"OpenAlex, pinned release, all 482 partitions","release":"2026-06-24","frame_built":"2026-07-12"},"permalink":"https://metacan.xera.ac/q/7ed3139828b5","api":"https://metacan.xera.ac/api/v1/cohort?venue=2021+IEEE+International+Conference+on+Big+Data+%28Big+Data%29"},"results":[{"id":"W3042396236","doi":"10.1109/bigdata52589.2021.9671967","title":"Can we Estimate Truck Accident Risk from Telemetric Data using Machine Learning?","year":2021,"lang":"en","type":"article","venue":"2021 IEEE International Conference on Big Data (Big Data)","topic":"Time Series Analysis and Forecasting","field":"Computer Science","cited_by":5,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Concordia University","funders":"","keywords":"Truck; Computer science; Convolutional neural network; Estimation; Task (project management); Machine learning; Random forest; Time series; Artificial neural network; Artificial intelligence; Data mining; Engineering","score_opus":0.3188860319983249,"score_gpt":0.3563519263735447,"score_spread":0.0374658943752198,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W3042396236","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.6819091,0.004005091,0.29059097,0.009268647,0.00054105115,0.00015979148,0.007628378,0.00094944664,0.004947514],"genre_scores_gemma":[0.9559431,0.0010017647,0.03847215,0.0003546181,0.00024436245,0.00007515815,0.0033129498,0.000036359357,0.00055968633],"study_design_codex":"observational","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9983902,0.00067992695,0.0001753481,0.00030381314,0.00032818844,0.00012266923],"domain_scores_gemma":[0.98946697,0.005178207,0.0025482932,0.0012976722,0.0012962812,0.00021254204],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.004038319,0.0013889987,0.0009717016,0.0033700974,0.0002742674,0.0015153533,0.0014837718,0.0022128683,0.0011178332],"category_scores_gemma":[0.024770994,0.00042750957,0.0009638729,0.003046482,0.00067995465,0.003897138,0.0007447657,0.0015136885,0.0007970842],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00034861758,0.00053842994,0.5220759,0.00027312452,0.00071815867,0.0001644111,0.00014682599,0.313414,0.0014856459,0.0046932567,0.004238957,0.15190266],"study_design_scores_gemma":[0.000033597637,0.0002457862,0.12560064,0.00019712841,0.00011726246,0.00023307817,0.00043297707,0.8423271,0.0030222205,0.023617607,0.0040673674,0.00010519612],"about_ca_topic_score_codex":0.007842862,"about_ca_topic_score_gemma":0.005588645,"teacher_disagreement_score":0.007842862,"about_ca_system_score_codex":0.0007372069,"about_ca_system_score_gemma":0.0006875294,"threshold_uncertainty_score":0.02135694},"labels":[],"label_agreement":null},{"id":"W3213179908","doi":"10.1109/bigdata52589.2021.9671411","title":"Detecting Fake Points of Interest from Location Data","year":2021,"lang":"en","type":"preprint","venue":"2021 IEEE International Conference on Big Data (Big Data)","topic":"Anomaly Detection Techniques and Applications","field":"Computer Science","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Toronto Metropolitan University","funders":"","keywords":"Computer science; Point of interest; Data mining; Ground truth; Reliability (semiconductor); Global Positioning System; Artificial intelligence; Perceptron; Machine learning; Artificial neural network","score_opus":0.5344346287500138,"score_gpt":0.3894898064020511,"score_spread":0.1449448223479627,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W3213179908","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.6130143,0.0020758235,0.3722289,0.0013853554,0.0003776138,0.00014722832,0.0026904494,0.0035477693,0.0045325733],"genre_scores_gemma":[0.9487462,0.00044701088,0.046697423,0.00006878152,0.00009848936,0.000036563466,0.0022427347,0.00004015068,0.0016226163],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9981933,0.0003970059,0.00011778325,0.0004274982,0.00064872165,0.00021557497],"domain_scores_gemma":[0.9943956,0.0019570875,0.0012510902,0.0014334931,0.00081370835,0.0001490157],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0012189657,0.00085856515,0.00095585984,0.0026041053,0.0005514409,0.001109929,0.0011991531,0.0015418665,0.00081619265],"category_scores_gemma":[0.009329661,0.00029486377,0.00054903026,0.002009642,0.00061412505,0.0021356875,0.0012688193,0.0012619494,0.0010266786],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0011548134,0.0004577001,0.12884668,0.00063652755,0.00027952617,0.0015566694,0.00059536955,0.10111016,0.021002727,0.0076982984,0.014520103,0.7221414],"study_design_scores_gemma":[0.000022474562,0.00015896907,0.033172186,0.000068975976,0.000053117823,0.0011090217,0.00038081472,0.93030554,0.021938285,0.0064360527,0.0063109905,0.000043530654],"about_ca_topic_score_codex":0.0026464753,"about_ca_topic_score_gemma":0.002882036,"teacher_disagreement_score":0.0026464753,"about_ca_system_score_codex":0.0008543444,"about_ca_system_score_gemma":0.00047429334,"threshold_uncertainty_score":0.0064465404},"labels":[],"label_agreement":null},{"id":"W3217443545","doi":"10.1109/bigdata52589.2021.9672045","title":"MURAL: An Unsupervised Random Forest-Based Embedding for Electronic Health Record Data","year":2021,"lang":"en","type":"preprint","venue":"2021 IEEE International Conference on Big Data (Big Data)","topic":"Machine Learning in Healthcare","field":"Computer Science","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Université de Montréal","funders":"National Institutes of Health; Institut de Valorisation des Données; Natural Sciences and Engineering Research Council of Canada; Canadian Institute for Advanced Research","keywords":"Categorical variable; Random forest; Embedding; Computer science; Artificial intelligence; Random variable; Dimensionality reduction; Decision tree; Missing data; Data mining; Mathematics; Machine learning; Statistics","score_opus":0.40296661493703373,"score_gpt":0.4393100574242843,"score_spread":0.03634344248725058,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W3217443545","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.016813217,0.0005288594,0.9774696,0.00035359117,0.00009747112,0.00011567225,0.0013349159,0.0028671985,0.00041954947],"genre_scores_gemma":[0.26366028,0.00059052027,0.7226177,0.0004002479,0.00024556392,0.0004280406,0.008886335,0.0005050154,0.0026663619],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9984061,0.0007747713,0.00007500455,0.0003166984,0.0003099314,0.000117572774],"domain_scores_gemma":[0.99657804,0.002122458,0.00028502173,0.0004365461,0.0004426319,0.0001352509],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.002815732,0.0011355755,0.0009784381,0.0019315575,0.00048664302,0.0007532035,0.0014587285,0.0012016207,0.0017001648],"category_scores_gemma":[0.008948884,0.00043136664,0.0013834,0.0014028177,0.0005488652,0.0017054327,0.001413254,0.0018979135,0.0012859551],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0006102002,0.00030163504,0.007377666,0.00036770315,0.00028350775,0.00025465098,0.0003475079,0.33248112,0.004997938,0.01285575,0.024495356,0.615627],"study_design_scores_gemma":[0.00002314071,0.000049896968,0.00043816824,0.000020275827,0.000011626696,0.0000728736,0.000024327675,0.98649997,0.000699333,0.0102625545,0.0018823891,0.000015390153],"about_ca_topic_score_codex":0.0047197263,"about_ca_topic_score_gemma":0.008581569,"teacher_disagreement_score":0.0047197263,"about_ca_system_score_codex":0.0006355461,"about_ca_system_score_gemma":0.00094745064,"threshold_uncertainty_score":0.014891207},"labels":[],"label_agreement":null},{"id":"W4205239629","doi":"10.1109/bigdata52589.2021.9671747","title":"A Scalable Multi-factor Fault Analysis Framework for Information Systems","year":2021,"lang":"en","type":"article","venue":"2021 IEEE International Conference on Big Data (Big Data)","topic":"Data Mining Algorithms and Applications","field":"Computer Science","cited_by":1,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Exfo Electro-Optical Engineering (Canada); Concordia University","funders":"","keywords":"Computer science; Data mining; Scalability; Association rule learning; Set (abstract data type); SPARK (programming language); Fault (geology); Database","score_opus":0.3177522349045409,"score_gpt":0.3802030307136332,"score_spread":0.0624507958090923,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4205239629","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0020671678,0.00014230522,0.9933693,0.000102169906,0.00002393257,0.00007369009,0.00030009396,0.003538398,0.0003830358],"genre_scores_gemma":[0.13549139,0.00022808963,0.8615377,0.00007545731,0.00008004592,0.00023593537,0.0011559919,0.0002885906,0.0009067346],"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.99846894,0.0002853246,0.00013263586,0.0002760191,0.0006970665,0.00014013308],"domain_scores_gemma":[0.99804354,0.00074221205,0.00020866974,0.00035799466,0.0005519372,0.0000955829],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.002117059,0.0016434385,0.0013822787,0.0022246747,0.0006546564,0.0016501162,0.0018111124,0.00078276935,0.0025270237],"category_scores_gemma":[0.005717058,0.00054199714,0.0023564189,0.001674252,0.00052850106,0.0021141074,0.0013579761,0.0015111559,0.00086482614],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00020638338,0.00015151215,0.00526179,0.00037796327,0.00037580315,0.00042742796,0.0001975978,0.6939367,0.0051378845,0.046713024,0.011132228,0.23608172],"study_design_scores_gemma":[0.0000107732685,0.00002001287,0.00022451057,0.0000095077485,0.000018496066,0.00004358712,0.000014458566,0.98042333,0.0006137924,0.01665936,0.0019533853,0.000008831183],"about_ca_topic_score_codex":0.010318472,"about_ca_topic_score_gemma":0.011652681,"teacher_disagreement_score":0.010318472,"about_ca_system_score_codex":0.0009845945,"about_ca_system_score_gemma":0.0021254143,"threshold_uncertainty_score":0.020516813},"labels":[],"label_agreement":null},{"id":"W4205279354","doi":"10.1109/bigdata52589.2021.9671538","title":"A Secure and Reusable Software Architecture for Supporting Online Data Harmonization","year":2021,"lang":"en","type":"article","venue":"2021 IEEE International Conference on Big Data (Big Data)","topic":"Health, Environment, Cognitive Aging","field":"Environmental Science","cited_by":4,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Health Sciences North","funders":"National Institute of Environmental Health Sciences; National Institutes of Health","keywords":"Computer science; Data science; Harmonization; Data transformation; Data quality; Analytics; Software; Data modeling; Web application; Data access; Database; Data warehouse; World Wide Web; Engineering","score_opus":0.28125011028971364,"score_gpt":0.3732638183597521,"score_spread":0.09201370807003845,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4205279354","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.005515667,0.00013445203,0.9006563,0.0006360502,0.00011733222,0.0006896902,0.0011003915,0.08862097,0.0025291366],"genre_scores_gemma":[0.13997136,0.0006288402,0.8121296,0.0017737785,0.00022261657,0.002437211,0.013983418,0.02113018,0.007722959],"study_design_codex":"design_other","study_design_gemma":"not_applicable","domain_scores_codex":[0.98781675,0.0021872343,0.0021280558,0.0026222004,0.0043727937,0.0008728781],"domain_scores_gemma":[0.9689443,0.0066366126,0.0019160804,0.016043758,0.0047697374,0.0016895302],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.01913573,0.0018082141,0.0016216894,0.005041631,0.0021417968,0.007697752,0.0050725183,0.0019683994,0.0056302813],"category_scores_gemma":[0.036636602,0.0022422704,0.003102365,0.004209749,0.002937466,0.010366767,0.015064914,0.004482991,0.0051794746],"study_design_candidate":"not_applicable","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0019015712,0.0012063731,0.030836582,0.0011540779,0.0012853366,0.002889397,0.0057748766,0.03276368,0.03806927,0.12227621,0.122255236,0.63958746],"study_design_scores_gemma":[0.0006385634,0.0006276354,0.013217039,0.00069276214,0.0004970908,0.0020648828,0.0011790463,0.3251098,0.06296495,0.22329234,0.36897194,0.0007439347],"about_ca_topic_score_codex":0.0072789956,"about_ca_topic_score_gemma":0.0035985678,"teacher_disagreement_score":0.01913573,"about_ca_system_score_codex":0.0019506884,"about_ca_system_score_gemma":0.0064443033,"threshold_uncertainty_score":0.10120064},"labels":[],"label_agreement":null},{"id":"W4205541117","doi":"10.1109/bigdata52589.2021.9671349","title":"Intersection Representation of Big Data Networks and Triangle Counting","year":2021,"lang":"en","type":"article","venue":"2021 IEEE International Conference on Big Data (Big Data)","topic":"Complex Network Analysis Techniques","field":"Physics and Astronomy","cited_by":3,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Lethbridge","funders":"","keywords":"Computer science; Intersection (aeronautics); Enumeration; Scalability; Data structure; Representation (politics); Theoretical computer science; Cluster analysis; Set (abstract data type); Enhanced Data Rates for GSM Evolution; Big data; Algorithm; Data mining; Mathematics; Combinatorics; Artificial intelligence","score_opus":0.3391835867248633,"score_gpt":0.38336133464529065,"score_spread":0.044177747920427335,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4205541117","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.015536997,0.000352675,0.97717893,0.00033486172,0.000089597364,0.0000572272,0.0006940087,0.0018992497,0.003856437],"genre_scores_gemma":[0.3623739,0.00072081666,0.6258054,0.00022532976,0.00018529393,0.0003730438,0.0052878517,0.0006235287,0.0044049546],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9980653,0.00048169817,0.0001269973,0.00031749735,0.0008388124,0.00016977367],"domain_scores_gemma":[0.9962398,0.0013888021,0.00043436012,0.00090099534,0.00085126713,0.0001848361],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.00096892304,0.0007896034,0.0011182283,0.0030643751,0.00091720297,0.0033817755,0.002297763,0.00088625494,0.0053659603],"category_scores_gemma":[0.011972362,0.00046063116,0.00074737385,0.0055736657,0.0009927767,0.0056545488,0.0027512554,0.0019590063,0.001755596],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00038747358,0.00010517141,0.0033725325,0.0002854129,0.00007176001,0.00023909307,0.00055293815,0.3169352,0.0046871277,0.35143256,0.018993959,0.30293682],"study_design_scores_gemma":[0.000012066205,0.000028241819,0.0002165139,0.000020456753,0.000007660485,0.00009183649,0.00010415681,0.8949028,0.0026359817,0.09430679,0.0076604784,0.000013003166],"about_ca_topic_score_codex":0.0037645623,"about_ca_topic_score_gemma":0.0034893868,"teacher_disagreement_score":0.0053659603,"about_ca_system_score_codex":0.0012742693,"about_ca_system_score_gemma":0.0011287326,"threshold_uncertainty_score":0.017950952},"labels":[],"label_agreement":null},{"id":"W4205572831","doi":"10.1109/bigdata52589.2021.9671347","title":"Forecasting Air Pollution using a Modified Compositional Learning Approach","year":2021,"lang":"en","type":"article","venue":"2021 IEEE International Conference on Big Data (Big Data)","topic":"Air Quality Monitoring and Forecasting","field":"Environmental Science","cited_by":5,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Carleton University","funders":"","keywords":"Random forest; Air quality index; Hyperparameter; Artificial intelligence; Set (abstract data type); Linear regression; Machine learning; Computer science; Air pollution; Mean squared error; Regression; Statistics; Mathematics; Meteorology; Chemistry; Geography","score_opus":0.4993754370384956,"score_gpt":0.36128902507719085,"score_spread":0.13808641196130472,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4205572831","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.13785893,0.00097050157,0.8558063,0.0004465676,0.00015147025,0.00017725427,0.00048361602,0.0010645683,0.0030409181],"genre_scores_gemma":[0.84338737,0.00038223417,0.15188636,0.0002534058,0.00017632516,0.00019526652,0.00093217765,0.000080319696,0.0027066502],"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.99923337,0.00024948534,0.00005891895,0.00022747723,0.00014540143,0.00008532007],"domain_scores_gemma":[0.99826896,0.0009776399,0.00015481496,0.00011526275,0.00041561978,0.00006760346],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0021040966,0.0010874247,0.0014719127,0.0016527262,0.0004999666,0.0010594906,0.0021176552,0.0013771397,0.0019780253],"category_scores_gemma":[0.0042997063,0.00064045005,0.0015815301,0.0012974049,0.00051184034,0.0011855186,0.0010399652,0.0010577777,0.00044096386],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00009521159,0.00008516841,0.0021233114,0.00004566603,0.00012847627,0.000047589838,0.000018458648,0.95656025,0.00084883673,0.0011760488,0.00031365413,0.038557217],"study_design_scores_gemma":[0.0000032791509,0.0000067441197,0.00007443594,0.0000011285225,0.000004766879,0.0000014343649,9.523399e-7,0.99949455,0.000061006103,0.0003161674,0.00003408443,0.0000014700262],"about_ca_topic_score_codex":0.025297381,"about_ca_topic_score_gemma":0.017627107,"teacher_disagreement_score":0.025297381,"about_ca_system_score_codex":0.0008030958,"about_ca_system_score_gemma":0.0014403817,"threshold_uncertainty_score":0.05030024},"labels":[],"label_agreement":null},{"id":"W4205598825","doi":"10.1109/bigdata52589.2021.9671579","title":"An Alert Notification Subsystem for AI Based Clinical Decision Support: A Protoype in NICU","year":2021,"lang":"en","type":"article","venue":"2021 IEEE International Conference on Big Data (Big Data)","topic":"Machine Learning in Healthcare","field":"Computer Science","cited_by":3,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"McMaster University; McMaster Children's Hospital; Ontario Tech University","funders":"HORIZON EUROPE Health","keywords":"Workflow; Analytics; Computer science; Premise; Context (archaeology); Schedule; Service (business); Big data; Decision support system; Clinical decision support system; Health care; Medical emergency; Data science; Medicine; Data mining; Database","score_opus":0.47616395722529403,"score_gpt":0.4845012723773186,"score_spread":0.008337315152024571,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4205598825","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.5171586,0.0014323265,0.39720988,0.006525755,0.00075499393,0.0017498194,0.0023038306,0.050159,0.02270579],"genre_scores_gemma":[0.89457715,0.0002721963,0.09739789,0.0007092601,0.00010340781,0.00018382049,0.00072473555,0.00022263992,0.0058088815],"study_design_codex":"design_other","study_design_gemma":"bench_or_experimental","domain_scores_codex":[0.9991609,0.00023504418,0.00009365814,0.00021334625,0.0001960247,0.0001011111],"domain_scores_gemma":[0.9979863,0.0006806414,0.00013789043,0.00039924885,0.0005114435,0.00028447283],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0012291594,0.0005847522,0.00049940625,0.00077298813,0.00085513276,0.0015369838,0.0015444536,0.001089918,0.0027139038],"category_scores_gemma":[0.0034681845,0.0003146125,0.00027471595,0.00055752636,0.00040786172,0.0011996598,0.0010300968,0.00073787244,0.0011888371],"study_design_candidate":"bench_or_experimental","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0043794787,0.0021396538,0.12352609,0.0011165696,0.00044841712,0.008642556,0.0042360704,0.06037998,0.16967238,0.0121526215,0.049722712,0.5635835],"study_design_scores_gemma":[0.00017537623,0.000906053,0.029394107,0.00020893762,0.00023666663,0.0022490663,0.0012213549,0.7864457,0.1137077,0.0040865876,0.061189327,0.00017908099],"about_ca_topic_score_codex":0.011177167,"about_ca_topic_score_gemma":0.009223491,"teacher_disagreement_score":0.011177167,"about_ca_system_score_codex":0.0010539874,"about_ca_system_score_gemma":0.0015491977,"threshold_uncertainty_score":0.022224247},"labels":[],"label_agreement":null},{"id":"W4205602011","doi":"10.1109/bigdata52589.2021.9671413","title":"A Lifecycle for Engineering IoT Neural Network-based Systems","year":2021,"lang":"en","type":"article","venue":"2021 IEEE International Conference on Big Data (Big Data)","topic":"IoT and Edge/Fog Computing","field":"Computer Science","cited_by":1,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Waterloo","funders":"","keywords":"Computer science; Adaptability; Distributed computing; Artificial neural network; System lifecycle; Dynamism; System of systems; Systems engineering; Software engineering; Artificial intelligence; Software; Systems design; Application lifecycle management; Engineering","score_opus":0.32131442955517625,"score_gpt":0.33528371962612324,"score_spread":0.013969290070946994,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4205602011","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.010824722,0.00026310925,0.9704076,0.002599817,0.00008552062,0.0005968691,0.00017901658,0.0013289277,0.013714486],"genre_scores_gemma":[0.05718489,0.0005729184,0.9335118,0.00022287804,0.000044782515,0.00068829884,0.00055030274,0.0003650143,0.0068591363],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.99524397,0.0011187996,0.0005514295,0.00038597814,0.0023385733,0.00036125613],"domain_scores_gemma":[0.99320555,0.001656379,0.0005140575,0.002214248,0.001963673,0.00044611224],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0066203047,0.0010846788,0.0005906626,0.0016522983,0.0015927464,0.0045120087,0.002404249,0.002097667,0.0032117744],"category_scores_gemma":[0.011703065,0.0011623063,0.0016423747,0.001002755,0.001997512,0.0064197388,0.004703298,0.004041742,0.0016335159],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00008378803,0.0005768385,0.003552235,0.0006118035,0.00005405306,0.0010362685,0.0029424964,0.04386069,0.017382408,0.7015885,0.008424767,0.21988624],"study_design_scores_gemma":[0.00008577549,0.0004010955,0.0014161605,0.0009265074,0.00006826343,0.0013039447,0.0016208412,0.30977085,0.021973824,0.3542636,0.30802393,0.00014520973],"about_ca_topic_score_codex":0.0036807866,"about_ca_topic_score_gemma":0.003031293,"teacher_disagreement_score":0.0066203047,"about_ca_system_score_codex":0.0026752634,"about_ca_system_score_gemma":0.0072556543,"threshold_uncertainty_score":0.035011947},"labels":[],"label_agreement":null},{"id":"W4205611454","doi":"10.1109/bigdata52589.2021.9671692","title":"Towards Multi-class Sentiment Analysis With Limited Labeled Data","year":2021,"lang":"en","type":"article","venue":"2021 IEEE International Conference on Big Data (Big Data)","topic":"Sentiment Analysis and Opinion Mining","field":"Computer Science","cited_by":5,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Carleton University","funders":"","keywords":"Sentiment analysis; Computer science; Artificial intelligence; Machine learning; Class (philosophy); Transformer; Enhanced Data Rates for GSM Evolution; Labeled data; Baseline (sea); Data mining; Engineering","score_opus":0.3978350710327186,"score_gpt":0.377999222092047,"score_spread":0.019835848940671585,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4205611454","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.05175516,0.00036063534,0.93610644,0.0007119487,0.00022506104,0.00030204165,0.0014078434,0.0045312364,0.004599721],"genre_scores_gemma":[0.39148632,0.00032844755,0.5940831,0.00053797883,0.0003477007,0.00043739515,0.00818417,0.00045378247,0.004141133],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9978163,0.00075837236,0.00014957639,0.0005617136,0.00055402576,0.00016002945],"domain_scores_gemma":[0.9951015,0.0016966711,0.00057233166,0.0007952702,0.0016457337,0.00018852325],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0034850817,0.0015991781,0.0011489574,0.002621638,0.00096590596,0.001906172,0.0013344632,0.001227936,0.0018070155],"category_scores_gemma":[0.0075496095,0.00050670304,0.0012563935,0.0017045633,0.0006504745,0.003434193,0.0015837053,0.0023860831,0.0027909572],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0010151693,0.0008970593,0.012594121,0.00037205964,0.00025992657,0.00035008314,0.000715267,0.024780912,0.059169456,0.008404841,0.040491324,0.8509497],"study_design_scores_gemma":[0.00006710494,0.0001540857,0.0028310365,0.00003576375,0.000054930053,0.0001417794,0.00046470787,0.94988334,0.018785845,0.018891422,0.008658432,0.00003147429],"about_ca_topic_score_codex":0.0019821613,"about_ca_topic_score_gemma":0.0043754284,"teacher_disagreement_score":0.0034850817,"about_ca_system_score_codex":0.0007989739,"about_ca_system_score_gemma":0.001198226,"threshold_uncertainty_score":0.018431127},"labels":[],"label_agreement":null},{"id":"W4205675155","doi":"10.1109/bigdata52589.2021.9672023","title":"MetaHate: A Meta-Model for Hate Speech Detection","year":2021,"lang":"en","type":"article","venue":"2021 IEEE International Conference on Big Data (Big Data)","topic":"Hate Speech and Cyberbullying Detection","field":"Computer Science","cited_by":4,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Carleton University","funders":"","keywords":"Benchmark (surveying); Computer science; Baseline (sea); Task (project management); Language model; F1 score; Artificial intelligence; Macro; Voice activity detection; Machine learning; Sentiment analysis; Natural language processing; Speech recognition; Speech processing","score_opus":0.44815077082744353,"score_gpt":0.36512516252513644,"score_spread":0.0830256083023071,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4205675155","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.06496102,0.0057606753,0.8800891,0.0022163014,0.00088550703,0.00039458086,0.011205034,0.0278318,0.006655937],"genre_scores_gemma":[0.6087816,0.0019304801,0.33643776,0.001982168,0.0007384315,0.0009848763,0.024425903,0.002481354,0.022237498],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9991259,0.0002519705,0.0000507207,0.0003458292,0.00013624091,0.0000893068],"domain_scores_gemma":[0.997282,0.0016918983,0.00011745676,0.00034272624,0.00044928532,0.000116639545],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0021029585,0.0026258868,0.0015825154,0.0028159423,0.0008196298,0.0019140216,0.0028240976,0.0019345704,0.0040429397],"category_scores_gemma":[0.0051653096,0.0010454576,0.002685844,0.0012553391,0.0005717812,0.0038422772,0.0017123513,0.0031534785,0.004198514],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0013679411,0.0009881494,0.022168253,0.00093018747,0.0023215192,0.0006863209,0.00057577924,0.3436225,0.018263206,0.0054730643,0.04830279,0.55530035],"study_design_scores_gemma":[0.000027823095,0.000114750306,0.0012189401,0.000051473322,0.00017298809,0.0001285455,0.0000589582,0.9819217,0.0044722375,0.0070477948,0.004729848,0.00005490113],"about_ca_topic_score_codex":0.009127414,"about_ca_topic_score_gemma":0.021356776,"teacher_disagreement_score":0.009127414,"about_ca_system_score_codex":0.00119997,"about_ca_system_score_gemma":0.0015052961,"threshold_uncertainty_score":0.018148541},"labels":[],"label_agreement":null},{"id":"W4205688737","doi":"10.1109/bigdata52589.2021.9671412","title":"Stock Price Prediction Leveraging Reddit: The Role of Trust Filter and Sliding Window","year":2021,"lang":"en","type":"article","venue":"2021 IEEE International Conference on Big Data (Big Data)","topic":"Stock Market Forecasting Methods","field":"Decision Sciences","cited_by":9,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Queen's University","funders":"Natural Sciences and Engineering Research Council of Canada","keywords":"Stock (firearms); Sliding window protocol; Computer science; Window (computing); World Wide Web; Engineering","score_opus":0.5254588191551868,"score_gpt":0.42489582860880876,"score_spread":0.10056299054637802,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4205688737","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.7465498,0.0021838194,0.23688647,0.0018932106,0.00053358206,0.00024234618,0.0015337983,0.002378487,0.0077984347],"genre_scores_gemma":[0.96678334,0.00020775983,0.030958086,0.00008286813,0.00014825471,0.000034718032,0.00065491855,0.000023248867,0.0011068964],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.99939775,0.00012442959,0.000051685445,0.00013777633,0.00018998378,0.000098263365],"domain_scores_gemma":[0.9962406,0.0018290328,0.00052743504,0.0004116433,0.0007563022,0.00023499169],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.002244795,0.00062746875,0.0006331134,0.0014309945,0.00039960034,0.0013806775,0.00066412956,0.000625646,0.0011556189],"category_scores_gemma":[0.009355395,0.0002264767,0.00037594233,0.0008587128,0.00022282539,0.0020568362,0.0008031337,0.00092496304,0.0006394382],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0018717861,0.0013270363,0.16638923,0.00022763434,0.00032156252,0.0006043425,0.0009037364,0.06472446,0.021745928,0.004658407,0.013048365,0.7241775],"study_design_scores_gemma":[0.000029025665,0.00020492547,0.016571585,0.000031165688,0.000057413738,0.00009608163,0.00016708756,0.9731747,0.0051607704,0.002179422,0.002294229,0.00003355454],"about_ca_topic_score_codex":0.008447676,"about_ca_topic_score_gemma":0.012045956,"teacher_disagreement_score":0.008447676,"about_ca_system_score_codex":0.00044606588,"about_ca_system_score_gemma":0.0007063615,"threshold_uncertainty_score":0.016797006},"labels":[],"label_agreement":null},{"id":"W4205723429","doi":"10.1109/bigdata52589.2021.9671458","title":"Addressing Stability in Classifier Explanations","year":2021,"lang":"en","type":"article","venue":"2021 IEEE International Conference on Big Data (Big Data)","topic":"Explainable Artificial Intelligence (XAI)","field":"Computer Science","cited_by":1,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Waterloo","funders":"","keywords":"Shapley value; Computer science; Classifier (UML); Artificial neural network; Artificial intelligence; Machine learning; Stability (learning theory); Monte Carlo method; Algorithm; Mathematics; Mathematical economics; Game theory; Statistics","score_opus":0.7275100894644405,"score_gpt":0.4292445498229833,"score_spread":0.2982655396414572,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4205723429","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.060271617,0.00052371004,0.9299297,0.0034187464,0.00007659173,0.000118047064,0.00020150156,0.00034068455,0.005119426],"genre_scores_gemma":[0.85273385,0.00027009027,0.14287591,0.000797084,0.00023254653,0.00032163254,0.00035684486,0.00018191391,0.0022300975],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.98388785,0.009227735,0.0007136927,0.0030391472,0.0024396502,0.000691992],"domain_scores_gemma":[0.82450217,0.14708842,0.0077709095,0.012199408,0.006981507,0.0014575938],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.022893623,0.0011231231,0.0022835743,0.0020835595,0.0024400859,0.005136691,0.0031323123,0.003839431,0.005691739],"category_scores_gemma":[0.17151052,0.0010488034,0.0014625953,0.0014656102,0.004542477,0.010663608,0.0063205785,0.0072592716,0.00049860263],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00025160256,0.00011728356,0.006785399,0.00024490335,0.00019444193,0.00023469522,0.0014574949,0.13025774,0.0011426063,0.7934442,0.0025787281,0.06329098],"study_design_scores_gemma":[0.000020499429,0.000031649317,0.00032941267,0.00003586006,0.000016840788,0.000040812603,0.00007802698,0.2509091,0.0005052386,0.74707794,0.0009372707,0.000017335384],"about_ca_topic_score_codex":0.0017168501,"about_ca_topic_score_gemma":0.0014412826,"teacher_disagreement_score":0.022893623,"about_ca_system_score_codex":0.0038267078,"about_ca_system_score_gemma":0.0023786363,"threshold_uncertainty_score":0.1210745},"labels":[],"label_agreement":null},{"id":"W4205795307","doi":"10.1109/bigdata52589.2021.9671523","title":"BIRD-QA: A BERT-based Information Retrieval Approach to Domain Specific Question Answering","year":2021,"lang":"en","type":"article","venue":"2021 IEEE International Conference on Big Data (Big Data)","topic":"Topic Modeling","field":"Computer Science","cited_by":18,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Queen's University","funders":"","keywords":"Computer science; Question answering; Information retrieval; Context (archaeology); Knowledge base; Preprocessor; Domain (mathematical analysis); Matching (statistics); Task (project management); F1 score; Language model; Artificial intelligence","score_opus":0.28268995294210725,"score_gpt":0.33270897878101213,"score_spread":0.050019025838904885,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4205795307","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.011135208,0.0015012933,0.9594685,0.0007624832,0.00011945901,0.00076406024,0.0027354835,0.019156797,0.0043567214],"genre_scores_gemma":[0.21619684,0.0009338277,0.76139474,0.00096644944,0.00014964957,0.00071098184,0.011307348,0.00044677214,0.007893301],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9984232,0.00056898873,0.00013110525,0.00044799587,0.00033968643,0.00008892828],"domain_scores_gemma":[0.9973355,0.0013911307,0.00011949479,0.00040060398,0.0006305572,0.00012259973],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0027043791,0.0013468163,0.0009498996,0.004221884,0.00069611985,0.0014222906,0.003460765,0.0017384737,0.0049375542],"category_scores_gemma":[0.006847292,0.00067043136,0.0017246463,0.002222123,0.0007071688,0.0037462655,0.0018099862,0.0019450606,0.003401426],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0006184633,0.0007852894,0.006166344,0.001163487,0.00036355434,0.00042671472,0.0012790586,0.14663525,0.014334899,0.028958084,0.064578995,0.7346898],"study_design_scores_gemma":[0.00003696868,0.00023592437,0.0015809701,0.00006594667,0.000071384144,0.00023631055,0.00016332952,0.94102263,0.0043710284,0.019872002,0.032288317,0.000055117376],"about_ca_topic_score_codex":0.023486946,"about_ca_topic_score_gemma":0.024945617,"teacher_disagreement_score":0.023486946,"about_ca_system_score_codex":0.0015752631,"about_ca_system_score_gemma":0.0012440995,"threshold_uncertainty_score":0.046700478},"labels":[],"label_agreement":null},{"id":"W4205844254","doi":"10.1109/bigdata52589.2021.9671394","title":"GraphQL Patient Case Presentation using the Problem Oriented Medical Record Schema","year":2021,"lang":"en","type":"article","venue":"2021 IEEE International Conference on Big Data (Big Data)","topic":"Electronic Health Records Systems","field":"Health Professions","cited_by":6,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Lakehead University","funders":"","keywords":"Schema (genetic algorithms); SOAP; Computer science; Interface (matter); Presentation (obstetrics); Harmonization; World Wide Web; Medical record; User interface; Medicine; Multimedia; Information retrieval; Programming language; Surgery","score_opus":0.5511457221122521,"score_gpt":0.5109968928077908,"score_spread":0.040148829304461287,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4205844254","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.009827253,0.00041977363,0.7038503,0.006314928,0.0006706952,0.0016806228,0.08425804,0.15427634,0.038701963],"genre_scores_gemma":[0.19338177,0.0012481987,0.5623244,0.0053138603,0.00034385902,0.0016934528,0.19343324,0.0147215305,0.027539695],"study_design_codex":"not_applicable","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9973667,0.0006980626,0.00047526075,0.000583091,0.00074532966,0.00013150657],"domain_scores_gemma":[0.9961662,0.0014011712,0.00026345236,0.0011027411,0.00089045265,0.00017598986],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0036265254,0.0009002953,0.0005264836,0.0021046044,0.00060843944,0.004534993,0.0021870825,0.0014302267,0.028161667],"category_scores_gemma":[0.011053349,0.0005471063,0.001177394,0.002091957,0.0006078323,0.0043479726,0.0033517056,0.001813161,0.008744215],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0011895132,0.00047995753,0.010482826,0.0018028764,0.0002503116,0.0023835185,0.0024987063,0.020639576,0.014105126,0.21193588,0.46538967,0.26884207],"study_design_scores_gemma":[0.00040820957,0.00018235468,0.0027649305,0.00033584746,0.00007518638,0.0016716062,0.00077782804,0.09665344,0.021136636,0.10187306,0.7739351,0.00018585025],"about_ca_topic_score_codex":0.008422251,"about_ca_topic_score_gemma":0.0061218347,"teacher_disagreement_score":0.028161667,"about_ca_system_score_codex":0.001909337,"about_ca_system_score_gemma":0.001962399,"threshold_uncertainty_score":0.09421021},"labels":[],"label_agreement":null},{"id":"W4205900257","doi":"10.1109/bigdata52589.2021.9671317","title":"Computational Analysis to Capture Cluster Lifetime Dynamics","year":2021,"lang":"en","type":"article","venue":"2021 IEEE International Conference on Big Data (Big Data)","topic":"Human Mobility and Location-Based Analysis","field":"Social Sciences","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Waterloo","funders":"","keywords":"Computer science; Cluster analysis; Cluster (spacecraft); Data mining; Limiting; Spatial analysis; Mobile device; Machine learning; Geography; Remote sensing; Engineering","score_opus":0.2013913438451896,"score_gpt":0.3859404138132156,"score_spread":0.18454906996802597,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4205900257","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.03342124,0.00114728,0.95492375,0.0013604052,0.00017628136,0.00016865702,0.0012021477,0.0007340015,0.0068662856],"genre_scores_gemma":[0.6537147,0.0014249336,0.33485988,0.00038812487,0.00026864198,0.0006871393,0.0027474933,0.0002832099,0.005625865],"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.99904495,0.00031651204,0.000057034977,0.00023682065,0.00023359666,0.0001111352],"domain_scores_gemma":[0.9935323,0.0039767083,0.00060115,0.000679308,0.001032908,0.00017760744],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.002333398,0.0008023947,0.00080130587,0.0025911643,0.001004137,0.0020648,0.0017034708,0.00094880344,0.0033265327],"category_scores_gemma":[0.0155684985,0.00043560006,0.0010030007,0.003044953,0.00075802434,0.002503743,0.0016448888,0.0014276787,0.0006542242],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00007322102,0.0000801427,0.008681362,0.00020596849,0.00015226292,0.00013755637,0.00039607112,0.8071153,0.001014833,0.11105526,0.010713791,0.060374234],"study_design_scores_gemma":[0.000002349828,0.000006048862,0.00054020097,0.000010601524,0.000007829287,0.000017957822,0.0000649476,0.97908634,0.00011856833,0.017989986,0.0021495654,0.0000056707677],"about_ca_topic_score_codex":0.01766316,"about_ca_topic_score_gemma":0.016799292,"teacher_disagreement_score":0.01766316,"about_ca_system_score_codex":0.0021463393,"about_ca_system_score_gemma":0.0024138133,"threshold_uncertainty_score":0.035120666},"labels":[],"label_agreement":null},{"id":"W4205916580","doi":"10.1109/bigdata52589.2021.9671738","title":"Predicting family physicians based on their practice using machine learning","year":2021,"lang":"en","type":"article","venue":"2021 IEEE International Conference on Big Data (Big Data)","topic":"Artificial Intelligence in Healthcare","field":"Health Professions","cited_by":2,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":true,"ca_institutions":"NOSM University; Lakehead University","funders":"","keywords":"Machine learning; Rurality; Artificial intelligence; Computer science; Health care; Binary classification; Field (mathematics); Class (philosophy); Medicine; Rural area; Support vector machine; Mathematics","score_opus":0.6762616049797713,"score_gpt":0.5199363785259139,"score_spread":0.15632522645385738,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4205916580","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.9802316,0.0006313676,0.01454895,0.00078662275,0.000031660835,0.00007535316,0.0013713432,0.00016903444,0.00215418],"genre_scores_gemma":[0.99176824,0.00022822185,0.0065064603,0.000049643077,0.00002818028,0.000029684992,0.0010176956,0.0000038522667,0.00036805033],"study_design_codex":"observational","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9990729,0.00031316912,0.000101621205,0.0001665503,0.0002360649,0.00010975891],"domain_scores_gemma":[0.9940724,0.0039179716,0.0010037539,0.0001385262,0.0006340768,0.0002332943],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0012828514,0.00037009575,0.00042739793,0.0030705477,0.00030645222,0.0006948589,0.00039677997,0.00075426983,0.0012362236],"category_scores_gemma":[0.00918502,0.00017044952,0.00048128556,0.002033933,0.0001995209,0.0007011142,0.0002988167,0.0004842212,0.0004990358],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00008840846,0.00021620831,0.94186026,0.00003623701,0.00005890986,0.00013572306,0.00010961179,0.023658823,0.00020815327,0.00018772003,0.0010445275,0.032395422],"study_design_scores_gemma":[0.000028113716,0.0002460155,0.4215892,0.000054458193,0.000054026976,0.00032346378,0.00048235003,0.5741881,0.0007274528,0.0011772851,0.0010987415,0.000030760693],"about_ca_topic_score_codex":0.015527144,"about_ca_topic_score_gemma":0.016533185,"teacher_disagreement_score":0.015527144,"about_ca_system_score_codex":0.0006950145,"about_ca_system_score_gemma":0.00083404966,"threshold_uncertainty_score":0.030873477},"labels":[],"label_agreement":null},{"id":"W4205945425","doi":"10.1109/bigdata52589.2021.9671818","title":"Context-Aware Data Analytics Variability in IoT Neural Network-Based Systems","year":2021,"lang":"en","type":"article","venue":"2021 IEEE International Conference on Big Data (Big Data)","topic":"Software System Performance and Reliability","field":"Computer Science","cited_by":5,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Waterloo","funders":"","keywords":"Computer science; Analytics; Data analysis; Context (archaeology); Data science; Software analytics; Artificial neural network; Software; Data mining; Machine learning; Software system; Component-based software engineering","score_opus":0.3355768752768476,"score_gpt":0.3522646931300971,"score_spread":0.01668781785324952,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4205945425","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.28646362,0.0005472649,0.70742005,0.0006247935,0.00005113624,0.00006630901,0.00023421827,0.0004497724,0.0041429186],"genre_scores_gemma":[0.98320276,0.000108570304,0.01614725,0.00003957629,0.000011710361,0.00003207909,0.00006146895,0.000017916022,0.00037852896],"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9991536,0.00019749664,0.00006743108,0.00021273457,0.0002819189,0.00008680572],"domain_scores_gemma":[0.99781126,0.0010907901,0.00045221156,0.00023756517,0.0003418295,0.00006636308],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0012208836,0.00038398043,0.00041145785,0.00037955336,0.0003115094,0.00092481717,0.00077271747,0.0004625339,0.00048891484],"category_scores_gemma":[0.005938665,0.00024882058,0.00033997884,0.00045228458,0.0006772675,0.0015391975,0.00096470705,0.0009289742,0.00006155602],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.000102276535,0.0000660097,0.0105135515,0.00006793401,0.00006430232,0.00022601198,0.00025167214,0.9402321,0.0054770852,0.014600352,0.00033611804,0.028062565],"study_design_scores_gemma":[0.000001336637,0.00001327438,0.0012108405,0.000004290553,0.0000051072325,0.000023029244,0.000017065802,0.9918147,0.00051247067,0.006207649,0.00018511571,0.0000051403767],"about_ca_topic_score_codex":0.0042925915,"about_ca_topic_score_gemma":0.0044672433,"teacher_disagreement_score":0.0042925915,"about_ca_system_score_codex":0.0010922982,"about_ca_system_score_gemma":0.00051557005,"threshold_uncertainty_score":0.008535206},"labels":[],"label_agreement":null},{"id":"W4206068237","doi":"10.1109/bigdata52589.2021.9671680","title":"Wildfire Occurrence Prediction Using Time Series Classification: A Comparative Study","year":2021,"lang":"en","type":"article","venue":"2021 IEEE International Conference on Big Data (Big Data)","topic":"Fire effects on ecosystems","field":"Environmental Science","cited_by":4,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":true,"ca_institutions":"University of Regina","funders":"","keywords":"Computer science; Artificial intelligence; Training (meteorology); Residual neural network; Machine learning; Training set; Multivariate statistics; Class (philosophy); Hidden Markov model; Time series; Pattern recognition (psychology); Deep learning; Meteorology; Geography","score_opus":0.36471504525854015,"score_gpt":0.3663925604939697,"score_spread":0.0016775152354295275,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4206068237","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.9654598,0.005356202,0.017707132,0.00075837015,0.00032141438,0.0001163674,0.0025880614,0.0012258077,0.006466774],"genre_scores_gemma":[0.98392856,0.00094446715,0.010291591,0.00008314478,0.00012023514,0.000030103796,0.003833945,0.000045764158,0.0007221636],"study_design_codex":"observational","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.99680746,0.0011011129,0.00037757095,0.0006614227,0.0008518793,0.00020061269],"domain_scores_gemma":[0.9848549,0.010481379,0.0009791901,0.001062305,0.0022098399,0.00041238457],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.00809321,0.0017811898,0.0012318763,0.0050679557,0.00051067054,0.0017225351,0.0010638544,0.0014525856,0.000875456],"category_scores_gemma":[0.012887917,0.00025817816,0.0011496235,0.0031894618,0.00045799822,0.0034495757,0.00075170735,0.00090039044,0.00039264394],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0040175715,0.0018868375,0.3427545,0.00077375455,0.0024396055,0.00035530646,0.00035576214,0.3081263,0.0031581908,0.0012459585,0.008304598,0.32658166],"study_design_scores_gemma":[0.00008530218,0.00088292937,0.074960634,0.00009078785,0.00030735784,0.00017295723,0.00042999568,0.9169062,0.0032512087,0.0010420723,0.0018053503,0.0000651366],"about_ca_topic_score_codex":0.024101771,"about_ca_topic_score_gemma":0.021462709,"teacher_disagreement_score":0.024101771,"about_ca_system_score_codex":0.0012208498,"about_ca_system_score_gemma":0.0008213589,"threshold_uncertainty_score":0.04792297},"labels":[],"label_agreement":null},{"id":"W4206124320","doi":"10.1109/bigdata52589.2021.9671894","title":"Towards Automated Variability-Aware Machine-Learning-Based Modeling Analysis","year":2021,"lang":"en","type":"article","venue":"2021 IEEE International Conference on Big Data (Big Data)","topic":"Scientific Computing and Data Management","field":"Decision Sciences","cited_by":1,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Waterloo","funders":"","keywords":"Computer science; Automation; Variety (cybernetics); Data science; Process (computing); Software engineering; Feature (linguistics); Data modeling; Machine learning; Data mining; Artificial intelligence; Engineering","score_opus":0.5463838428580676,"score_gpt":0.4465904440958107,"score_spread":0.0997933987622569,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4206124320","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0023623956,0.00006359869,0.9947984,0.00019980132,0.0000076101073,0.00003394056,0.00010001672,0.0021538625,0.0002803789],"genre_scores_gemma":[0.10438277,0.00018028573,0.8930463,0.00018639166,0.000044674474,0.00014393192,0.00095772784,0.00072447443,0.00033353773],"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.98578393,0.0054733963,0.0010524838,0.0015864955,0.005583341,0.00052044564],"domain_scores_gemma":[0.9603447,0.020745123,0.0029136685,0.010603557,0.004892696,0.000500162],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0126267085,0.0017745915,0.0021390712,0.0036453807,0.0011197185,0.006144169,0.0041536335,0.0015773725,0.0012054938],"category_scores_gemma":[0.036032412,0.001404138,0.003784244,0.0027930322,0.0020240664,0.005493204,0.0056925397,0.0051165926,0.0009619013],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00013155081,0.0003749538,0.0079238815,0.00038909476,0.00036702887,0.00052583107,0.00094209576,0.651414,0.0101377275,0.0764772,0.005183101,0.24613358],"study_design_scores_gemma":[0.000006661675,0.0000106050775,0.00023657779,0.000029228519,0.00001539668,0.00003772692,0.000040462615,0.9500799,0.0025314144,0.044726945,0.0022685525,0.000016376307],"about_ca_topic_score_codex":0.0050593433,"about_ca_topic_score_gemma":0.007407763,"teacher_disagreement_score":0.0126267085,"about_ca_system_score_codex":0.0023065424,"about_ca_system_score_gemma":0.005139682,"threshold_uncertainty_score":0.06677723},"labels":[],"label_agreement":null},{"id":"W4206145914","doi":"10.1109/bigdata52589.2021.9671521","title":"The Analysis of Time Series Forecasting on Resource Provision of Cloud-based Game Servers","year":2021,"lang":"en","type":"article","venue":"2021 IEEE International Conference on Big Data (Big Data)","topic":"Cloud Computing and Resource Management","field":"Computer Science","cited_by":3,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Ubisoft (Canada); Concordia University","funders":"","keywords":"Provisioning; Autoregressive integrated moving average; Server; Computer science; Cloud computing; Workload; Resource (disambiguation); Resource allocation; Time series; Virtual machine; Service (business); Real-time computing; Distributed computing; Machine learning; Computer network; Operating system","score_opus":0.2109719349532415,"score_gpt":0.314779056933657,"score_spread":0.10380712198041547,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4206145914","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.9653666,0.00025153364,0.031742368,0.00048764574,0.000049812512,0.000020429039,0.00052195525,0.00023639767,0.0013232452],"genre_scores_gemma":[0.99714595,0.000081250735,0.0021202564,0.0000217229,0.000009698567,0.0000072762464,0.00037546246,0.0000110326355,0.00022728818],"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.99951255,0.00011389931,0.000033387958,0.000119237564,0.0001291509,0.000091780785],"domain_scores_gemma":[0.99739146,0.0016186117,0.00038542206,0.00017437381,0.00032921147,0.00010084555],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0016970476,0.00077026634,0.000495561,0.0008255934,0.0002920094,0.0007283078,0.0005780989,0.000785885,0.0006119273],"category_scores_gemma":[0.0068007126,0.00027325258,0.00059611653,0.0010289394,0.00031557947,0.0010107586,0.00028107443,0.000901579,0.00013964047],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00008365769,0.0000559613,0.030759996,0.00003860455,0.00007813132,0.00014814227,0.00007259355,0.9543519,0.0017788162,0.0012435246,0.0007015021,0.010687235],"study_design_scores_gemma":[8.6932425e-7,0.00001487457,0.0066966633,0.0000029352566,0.000005210432,0.0000127887415,0.00002140039,0.99264634,0.00026080536,0.00024122762,0.00009257228,0.0000043607297],"about_ca_topic_score_codex":0.03155502,"about_ca_topic_score_gemma":0.013879323,"teacher_disagreement_score":0.03155502,"about_ca_system_score_codex":0.00091803615,"about_ca_system_score_gemma":0.00044362107,"threshold_uncertainty_score":0.06274271},"labels":[],"label_agreement":null},{"id":"W4206156526","doi":"10.1109/bigdata52589.2021.9671934","title":"Making Case for Using RAFT in Healthcare Through Hyperledger Fabric","year":2021,"lang":"en","type":"article","venue":"2021 IEEE International Conference on Big Data (Big Data)","topic":"Blockchain Technology Applications and Security","field":"Computer Science","cited_by":23,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"McGill University","funders":"","keywords":"Scalability; Computer science; Transparency (behavior); Traceability; Health care; Stylized fact; Consensus algorithm; Blockchain; Raft; Computer security; Risk analysis (engineering); Data science; Business; Software engineering; Database","score_opus":0.5139239833398503,"score_gpt":0.4285759765949415,"score_spread":0.08534800674490883,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4206156526","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.09548246,0.0037181135,0.58050704,0.09940654,0.0012666149,0.00036245544,0.00031370626,0.0013491258,0.21759394],"genre_scores_gemma":[0.8749238,0.002334877,0.0922842,0.004016066,0.0003222625,0.00024638342,0.0001612906,0.00019885547,0.025512166],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9969453,0.0015262354,0.00011845239,0.00043950047,0.0005630256,0.00040743282],"domain_scores_gemma":[0.9951095,0.0019097956,0.00039982348,0.001439692,0.0005444713,0.00059672],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.004847403,0.00044217336,0.0003764385,0.0008453349,0.0024782408,0.0058714724,0.001230234,0.0039494284,0.010020162],"category_scores_gemma":[0.009522567,0.00034619306,0.00062447716,0.00088159356,0.0057461257,0.01143072,0.005584028,0.0023886259,0.0031734474],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00021581545,0.00007595389,0.0023046224,0.00017898573,0.000028627912,0.0011901787,0.0015425077,0.011609812,0.0019884214,0.9066337,0.010314923,0.06391644],"study_design_scores_gemma":[0.00007711494,0.00015430986,0.00068708934,0.00031039145,0.000027879209,0.0008110257,0.0014197746,0.04118807,0.0036903955,0.7696472,0.18191344,0.000073254865],"about_ca_topic_score_codex":0.0015715401,"about_ca_topic_score_gemma":0.0015111681,"teacher_disagreement_score":0.010020162,"about_ca_system_score_codex":0.0018602011,"about_ca_system_score_gemma":0.0021706116,"threshold_uncertainty_score":0.033520818},"labels":[],"label_agreement":null},{"id":"W4206236431","doi":"10.1109/bigdata52589.2021.9671335","title":"Explainable image analysis for decision support in medical healthcare","year":2021,"lang":"en","type":"article","venue":"2021 IEEE International Conference on Big Data (Big Data)","topic":"COVID-19 diagnosis using AI","field":"Medicine","cited_by":25,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"National Research Council Canada","funders":"","keywords":"Medical imaging; Artificial intelligence; Visualization; Computer science; Deep learning; Cluster analysis; Health care; Decision support system; Contextual image classification; Machine learning; Dimensionality reduction; Image (mathematics); Pattern recognition (psychology)","score_opus":0.37513189999524427,"score_gpt":0.46334477375338345,"score_spread":0.08821287375813919,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4206236431","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.010874371,0.0026979859,0.97639185,0.0047068074,0.00014258276,0.00009953947,0.0007697271,0.0019069633,0.0024101036],"genre_scores_gemma":[0.5736051,0.0034681782,0.41649142,0.0009851145,0.00055816415,0.00017835286,0.001560902,0.00026012005,0.0028926097],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.99929893,0.0002596635,0.000052856372,0.0001602168,0.00018498598,0.000043258267],"domain_scores_gemma":[0.99712974,0.002059036,0.00026496028,0.00022852575,0.00023067882,0.00008704371],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0015008928,0.00097282004,0.0007098493,0.002093398,0.00035432653,0.0019105094,0.000916646,0.0014314853,0.005853073],"category_scores_gemma":[0.0065650987,0.0003508889,0.0010085545,0.0010398543,0.0010625554,0.0016271897,0.0011933522,0.0017263053,0.00095554255],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0005209258,0.00021911462,0.006855029,0.000860209,0.00033834451,0.00073892745,0.00045936345,0.3063029,0.011345373,0.096624956,0.023883998,0.55185086],"study_design_scores_gemma":[0.00002178431,0.000039515497,0.0011020749,0.00007280055,0.000039668565,0.00012801007,0.00007472688,0.8517289,0.0033395905,0.13613817,0.0072858515,0.000028860872],"about_ca_topic_score_codex":0.0027257174,"about_ca_topic_score_gemma":0.002081749,"teacher_disagreement_score":0.005853073,"about_ca_system_score_codex":0.0011343954,"about_ca_system_score_gemma":0.00095977343,"threshold_uncertainty_score":0.019580543},"labels":[],"label_agreement":null},{"id":"W4206287169","doi":"10.1109/bigdata52589.2021.9671670","title":"An Approach to Support Human-in-the-Loop Big Data Software Development Projects","year":2021,"lang":"en","type":"article","venue":"2021 IEEE International Conference on Big Data (Big Data)","topic":"Human-Automation Interaction and Safety","field":"Psychology","cited_by":2,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Waterloo","funders":"","keywords":"Computer science; Human-in-the-loop; Task (project management); Software development; Big data; Software; Software engineering; Set (abstract data type); Software development process; Data science; Artificial intelligence; Systems engineering; Engineering; Data mining; Programming language","score_opus":0.5793099540989958,"score_gpt":0.46297134849388727,"score_spread":0.1163386056051085,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4206287169","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.019741543,0.000116619805,0.9488488,0.0046251393,0.00011635784,0.0017981074,0.00007290924,0.0033807226,0.02129977],"genre_scores_gemma":[0.104917035,0.00007914535,0.88833416,0.00046562954,0.000032811582,0.0012220495,0.00011414182,0.00024849802,0.004586496],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.968369,0.019985156,0.0014011556,0.0033553191,0.005578754,0.0013105372],"domain_scores_gemma":[0.9525331,0.017387759,0.004547008,0.011048338,0.0065862406,0.007897401],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.026889037,0.0010249458,0.00040013532,0.00265591,0.0037690361,0.0074268044,0.004574309,0.0033912496,0.0051401136],"category_scores_gemma":[0.04607205,0.0011601322,0.0008375615,0.0014559459,0.0044680024,0.008500397,0.0127360225,0.0036047949,0.002765625],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0005492228,0.004048675,0.018626692,0.0011176846,0.00013470263,0.0018518055,0.06537418,0.022732312,0.023530524,0.21747735,0.028415127,0.61614174],"study_design_scores_gemma":[0.0006154192,0.0023682732,0.00680264,0.00077431253,0.00012690117,0.0017513855,0.018354546,0.13654888,0.019054636,0.2455053,0.5677819,0.0003157734],"about_ca_topic_score_codex":0.0026311458,"about_ca_topic_score_gemma":0.0046004467,"teacher_disagreement_score":0.026889037,"about_ca_system_score_codex":0.0030459533,"about_ca_system_score_gemma":0.01413718,"threshold_uncertainty_score":0.14220452},"labels":[],"label_agreement":null},{"id":"W4206345476","doi":"10.1109/bigdata52589.2021.9671778","title":"An Implementation of Fake News Prevention by Blockchain and Entropy-based Incentive Mechanism","year":2021,"lang":"en","type":"article","venue":"2021 IEEE International Conference on Big Data (Big Data)","topic":"Blockchain Technology Applications and Security","field":"Computer Science","cited_by":3,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Waterloo","funders":"","keywords":"Computer science; Computer security; Incentive; Internet privacy; Fake news; Crash; Deception; Social media; Mechanism (biology); Cheating; World Wide Web","score_opus":0.13453146047937378,"score_gpt":0.35857680738544667,"score_spread":0.2240453469060729,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4206345476","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.17649007,0.00031450248,0.79950833,0.001644197,0.00029802602,0.0010260099,0.00017498288,0.0056340694,0.014909799],"genre_scores_gemma":[0.9364121,0.00008216256,0.05821552,0.00011386262,0.000043912103,0.00024537605,0.00006491973,0.000044740627,0.004777539],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9973809,0.0009588584,0.00019552046,0.00035473536,0.00075667346,0.00035332103],"domain_scores_gemma":[0.99464214,0.0015580206,0.0005656052,0.0016956616,0.0010304431,0.00050805847],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0033950068,0.00048517826,0.0007316421,0.0010697009,0.0014772213,0.0013957808,0.0018125604,0.0016337578,0.0064452128],"category_scores_gemma":[0.007318457,0.0003566973,0.00042553598,0.00062339485,0.0013893243,0.003179298,0.0025486604,0.0011817586,0.0009798309],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.003068324,0.0022045155,0.015678255,0.00082151376,0.00027600222,0.0020803157,0.0023203501,0.15989578,0.091601565,0.28931758,0.010752346,0.42198354],"study_design_scores_gemma":[0.00042050867,0.00067697134,0.0013146757,0.000057503337,0.00007050309,0.00042005035,0.00015440141,0.9186433,0.028369887,0.03817928,0.01157939,0.00011353685],"about_ca_topic_score_codex":0.0017335429,"about_ca_topic_score_gemma":0.0012388104,"teacher_disagreement_score":0.0064452128,"about_ca_system_score_codex":0.0008877711,"about_ca_system_score_gemma":0.0020316618,"threshold_uncertainty_score":0.021561325},"labels":[],"label_agreement":null},{"id":"W4206380024","doi":"10.1109/bigdata52589.2021.9672059","title":"Towards Real-Time Public Health: A Novel Mobile Health Monitoring System","year":2021,"lang":"en","type":"article","venue":"2021 IEEE International Conference on Big Data (Big Data)","topic":"Digital Mental Health Interventions","field":"Psychology","cited_by":8,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Waterloo","funders":"","keywords":"Computer science; Public health; Data collection; Mobile device; Analytics; Public health surveillance; Leverage (statistics); Data science; Internet privacy; Computer security; Medicine; World Wide Web; Artificial intelligence; Nursing","score_opus":0.566682803193613,"score_gpt":0.47685150943476023,"score_spread":0.08983129375885274,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4206380024","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.2403606,0.0023832135,0.5771981,0.0071608145,0.0015059767,0.0032395555,0.008427256,0.118033625,0.0416909],"genre_scores_gemma":[0.7486033,0.00095907494,0.21990341,0.0039262213,0.0007088771,0.0015892964,0.005734126,0.00056889624,0.01800683],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9992878,0.00012719833,0.00007264296,0.00024131167,0.00019272834,0.000078343175],"domain_scores_gemma":[0.9990476,0.00023529358,0.0001200359,0.00013612243,0.0002864543,0.00017449021],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.00096759194,0.0007622481,0.00074537704,0.0015325696,0.0005454685,0.0016472772,0.0012827305,0.0013553861,0.005918897],"category_scores_gemma":[0.0020559926,0.00031930007,0.0003208236,0.00073601777,0.00025245835,0.0017246258,0.0017359713,0.0007661822,0.0031309891],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0024102672,0.0018890963,0.049539465,0.0009160224,0.0003014356,0.002093173,0.002272498,0.0028929042,0.07655188,0.0076851775,0.085343756,0.7681043],"study_design_scores_gemma":[0.0012496739,0.0044423165,0.0826503,0.0005703843,0.00088999904,0.0050656656,0.002089612,0.38042954,0.09331137,0.017387614,0.41136,0.00055343146],"about_ca_topic_score_codex":0.0013963671,"about_ca_topic_score_gemma":0.0013777969,"teacher_disagreement_score":0.005918897,"about_ca_system_score_codex":0.00044593305,"about_ca_system_score_gemma":0.00063955673,"threshold_uncertainty_score":0.019800663},"labels":[],"label_agreement":null},{"id":"W4206545034","doi":"10.1109/bigdata52589.2021.9671392","title":"Drivable Area Detection Using Deep Learning Models for Autonomous Driving","year":2021,"lang":"en","type":"article","venue":"2021 IEEE International Conference on Big Data (Big Data)","topic":"Autonomous Vehicle Technology and Safety","field":"Engineering","cited_by":17,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Queen's University","funders":"","keywords":"Computer science; Pyramid (geometry); Artificial intelligence; Segmentation; Backbone network; Computer vision; Pixel; Deep learning; Feature (linguistics); Pooling; Architecture; Image segmentation; Advanced driver assistance systems; Object detection; Pattern recognition (psychology); Geography","score_opus":0.2613181683505157,"score_gpt":0.31131480188750965,"score_spread":0.04999663353699396,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4206545034","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.29851148,0.0042940085,0.66921616,0.0013626135,0.0004909398,0.00013978047,0.0037031535,0.012270741,0.010011119],"genre_scores_gemma":[0.9246124,0.0005945845,0.06211697,0.00033095156,0.00008168596,0.00008030566,0.004356072,0.00016150223,0.007665538],"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.999841,0.000014314867,0.000006291281,0.000066562854,0.000032832813,0.000039035986],"domain_scores_gemma":[0.9998412,0.00003831786,0.000017612329,0.000020025522,0.00006834703,0.000014459128],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.00023030219,0.0011666546,0.0006065487,0.00061172846,0.0002895399,0.0006006294,0.0013664529,0.0007674229,0.0013906374],"category_scores_gemma":[0.0005547083,0.0004418361,0.0008040396,0.0005566043,0.00028978678,0.00083124737,0.0005620878,0.0012690006,0.0008342771],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00023536921,0.00030163635,0.0041560787,0.0000844214,0.00015151022,0.00012698305,0.00005867408,0.7070275,0.008471627,0.001584031,0.009491632,0.26831058],"study_design_scores_gemma":[0.000002917474,0.00001454213,0.0002771809,0.0000034407074,0.0000074019513,0.00000839938,0.0000051266193,0.99759835,0.00088757754,0.00076877524,0.00042261335,0.0000036353802],"about_ca_topic_score_codex":0.023431174,"about_ca_topic_score_gemma":0.033231463,"teacher_disagreement_score":0.023431174,"about_ca_system_score_codex":0.000891016,"about_ca_system_score_gemma":0.0008491311,"threshold_uncertainty_score":0.046589613},"labels":[],"label_agreement":null},{"id":"W4206588201","doi":"10.1109/bigdata52589.2021.9671467","title":"Deep Neural Network to Tradeoff between Accuracy and Diversity in a News Recommender System","year":2021,"lang":"en","type":"article","venue":"2021 IEEE International Conference on Big Data (Big Data)","topic":"Recommender Systems and Techniques","field":"Computer Science","cited_by":23,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Toronto Metropolitan University","funders":"Science and Engineering Research Council","keywords":"Computer science; Recommender system; Representation (politics); Term (time); Reading (process); Artificial intelligence; Information retrieval; Taxonomy (biology); Process (computing); Diversity (politics); Domain (mathematical analysis); Linguistics; Political science","score_opus":0.42904204535092827,"score_gpt":0.3636116226915197,"score_spread":0.06543042265940857,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4206588201","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.5724329,0.0037130737,0.41048214,0.0024314788,0.00021216342,0.00009472609,0.00052649475,0.0021508217,0.007956277],"genre_scores_gemma":[0.96497935,0.00023964001,0.03129783,0.00031721388,0.00005957948,0.00003606139,0.0003171304,0.00003767951,0.0027154824],"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.99908924,0.00023112223,0.000067227185,0.00027526316,0.00017364022,0.00016353953],"domain_scores_gemma":[0.9967867,0.0020014395,0.00016071823,0.0002036633,0.0007238921,0.00012357128],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.002411613,0.0009221986,0.0011838339,0.0006299948,0.0005990021,0.0010253853,0.0014790553,0.0019874705,0.0013340648],"category_scores_gemma":[0.008845704,0.00048917957,0.00041756587,0.00065917283,0.0004874239,0.0028188466,0.0011382049,0.0021543077,0.00043409909],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0006686633,0.00036821247,0.007533468,0.00015513778,0.0001805645,0.00018444585,0.00017889895,0.7728886,0.0065456866,0.0032551659,0.0034024788,0.2046387],"study_design_scores_gemma":[0.000011925954,0.000043963915,0.0003138053,0.000005332381,0.000013916138,0.000016459417,0.000009324161,0.9974184,0.0008731816,0.0011635524,0.00012541366,0.0000048217894],"about_ca_topic_score_codex":0.012974941,"about_ca_topic_score_gemma":0.014325546,"teacher_disagreement_score":0.012974941,"about_ca_system_score_codex":0.0015512124,"about_ca_system_score_gemma":0.00092316,"threshold_uncertainty_score":0.025798857},"labels":[],"label_agreement":null},{"id":"W4206630568","doi":"10.1109/bigdata52589.2021.9671816","title":"MixNN: Combating Noisy Labels in Deep Learning by Mixing with Nearest Neighbors","year":2021,"lang":"en","type":"article","venue":"2021 IEEE International Conference on Big Data (Big Data)","topic":"Machine Learning and Data Classification","field":"Computer Science","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"McMaster University","funders":"","keywords":"Overfitting; Computer science; Artificial intelligence; Pattern recognition (psychology); Machine learning; Noise (video); Deep learning; Transfer of learning; Ground truth; Representation (politics); Artificial neural network; Image (mathematics)","score_opus":0.19693395144726453,"score_gpt":0.33696667031590244,"score_spread":0.1400327188686379,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4206630568","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.044055283,0.000721738,0.95129937,0.00027929188,0.00010742646,0.00008048678,0.00013380485,0.002295762,0.0010268791],"genre_scores_gemma":[0.56571996,0.00044408097,0.4265761,0.0006986124,0.00016493205,0.00025715373,0.0011560221,0.00046573227,0.004517316],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9976413,0.00070182746,0.00012929682,0.0006826449,0.00065981667,0.00018514803],"domain_scores_gemma":[0.997024,0.0010888324,0.0004069054,0.00069435185,0.0006202839,0.00016555002],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0038750998,0.0018665201,0.0019109469,0.0013427294,0.0009911617,0.0015664062,0.003220503,0.0022399365,0.0012978986],"category_scores_gemma":[0.009891439,0.00081874296,0.00089553074,0.0014297229,0.0015803175,0.0039388426,0.003615826,0.002773775,0.0006915867],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00075618026,0.0004596545,0.006615926,0.00029621116,0.0003148986,0.00017889554,0.00046136818,0.42501256,0.012644668,0.01266636,0.0070104655,0.5335828],"study_design_scores_gemma":[0.00001332681,0.000059397054,0.00022449737,0.00001454075,0.000018337214,0.000031482363,0.000023554589,0.9898005,0.0034404502,0.0055576307,0.0008011865,0.000015084356],"about_ca_topic_score_codex":0.005091872,"about_ca_topic_score_gemma":0.0076063154,"teacher_disagreement_score":0.005091872,"about_ca_system_score_codex":0.0013539714,"about_ca_system_score_gemma":0.0010920173,"threshold_uncertainty_score":0.020493746},"labels":[],"label_agreement":null},{"id":"W4206688589","doi":"10.1109/bigdata52589.2021.9671707","title":"NFTs: Tulip Mania or Digital Renaissance?","year":2021,"lang":"en","type":"article","venue":"2021 IEEE International Conference on Big Data (Big Data)","topic":"Blockchain Technology Applications and Security","field":"Computer Science","cited_by":28,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of British Columbia","funders":"","keywords":"Context (archaeology); The Renaissance; Computer science; Business; Internet privacy; History; Art history; Archaeology","score_opus":0.27542687162242996,"score_gpt":0.3443330272353151,"score_spread":0.06890615561288516,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4206688589","genre_codex":"other","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.035789397,0.0068354504,0.01049196,0.06223007,0.0041568372,0.000051359955,0.00059719017,0.0012153413,0.87863237],"genre_scores_gemma":[0.5881203,0.008566615,0.0077135097,0.014056845,0.0013238202,0.00012065912,0.00055207673,0.0010365179,0.37850967],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"not_applicable","domain_scores_codex":[0.99865806,0.00034766732,0.000050257353,0.00020320828,0.00044787014,0.00029289073],"domain_scores_gemma":[0.99842936,0.00038988405,0.00018303095,0.00049962365,0.00029660077,0.00020143276],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0020832801,0.00031793528,0.00021467108,0.001430504,0.004116119,0.009708664,0.00090692425,0.002152819,0.031795733],"category_scores_gemma":[0.008551015,0.0001822677,0.00028817393,0.001976078,0.00733056,0.015109099,0.003774603,0.0029358885,0.0053708334],"study_design_candidate":"not_applicable","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.000046730554,0.000008692006,0.00089372613,0.00006816389,0.000005278654,0.00031522493,0.004142217,0.00007370695,0.0002603303,0.8830601,0.048712984,0.06241284],"study_design_scores_gemma":[0.0000023386242,0.0000115510975,0.00055366725,0.00021039123,0.0000035385328,0.00022887725,0.0027086756,0.00010502185,0.00040194325,0.039940815,0.95581466,0.000018597006],"about_ca_topic_score_codex":0.012116733,"about_ca_topic_score_gemma":0.015535822,"teacher_disagreement_score":0.031795733,"about_ca_system_score_codex":0.0036771968,"about_ca_system_score_gemma":0.002218754,"threshold_uncertainty_score":0.10636735},"labels":[],"label_agreement":null},{"id":"W4206704243","doi":"10.1109/bigdata52589.2021.9671361","title":"IoT-Based COVID-19 Health Monitoring System: Context, Early Warning and Self-Adaptation","year":2021,"lang":"en","type":"article","venue":"2021 IEEE International Conference on Big Data (Big Data)","topic":"COVID-19 diagnosis using AI","field":"Medicine","cited_by":8,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Waterloo","funders":"","keywords":"Computer science; Wearable computer; Internet of Things; Redundancy (engineering); Context (archaeology); Remote patient monitoring; Adaptation (eye); Continuous monitoring; Coronavirus disease 2019 (COVID-19); Real-time computing; Warning system; Wireless; Embedded system; Risk analysis (engineering); Medicine; Telecommunications; Engineering","score_opus":0.42407723467783853,"score_gpt":0.4238719489904132,"score_spread":0.00020528568742533837,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4206704243","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.24810581,0.0033362191,0.69857275,0.0023141778,0.001140028,0.0015421731,0.0021077802,0.023500532,0.019380577],"genre_scores_gemma":[0.8733518,0.00079214957,0.118864454,0.0010443986,0.00032569893,0.00038101166,0.0015509115,0.00012964221,0.003560043],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.99961394,0.000055857086,0.000056023964,0.00011685777,0.00011469407,0.000042717264],"domain_scores_gemma":[0.9994722,0.000113477734,0.00007771864,0.00007409588,0.00017326818,0.00008931296],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.00054872996,0.0005263933,0.0006901228,0.00066540163,0.0003171509,0.000744655,0.000784706,0.00060427433,0.0013098352],"category_scores_gemma":[0.0013901389,0.00019418499,0.00024597967,0.00037229044,0.00015977368,0.0007731208,0.0009717886,0.0005440955,0.0005988945],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0032176927,0.0016494354,0.05588109,0.0012390779,0.00037235775,0.0028154862,0.0010603762,0.022806779,0.18262523,0.007709853,0.032538928,0.68808365],"study_design_scores_gemma":[0.00050612504,0.0016906937,0.062027834,0.00032195772,0.0004736816,0.0038027174,0.000486631,0.7523905,0.099814646,0.0070100203,0.07118301,0.00029219338],"about_ca_topic_score_codex":0.00098424,"about_ca_topic_score_gemma":0.0012143037,"teacher_disagreement_score":0.0013098352,"about_ca_system_score_codex":0.0003075363,"about_ca_system_score_gemma":0.00046185454,"threshold_uncertainty_score":0.0043818355},"labels":[],"label_agreement":null}]}