{"meta":{"query_hash":"a80b6dd78038","filters":{"venue":"International Journal of Data Warehousing and Mining"},"cohort_total":24,"direct_labels_cover":0,"predictions_cover":24,"exported":24,"export_cap":100000,"truncated":false,"label_status":"direct model label, unvalidated","prediction_status":"machine_predicted_unvalidated (Codex and Gemma teacher distillation)","score_status":"score_only:v0-immature-baseline","snapshot":{"source":"OpenAlex, pinned release, all 482 partitions","release":"2026-06-24","frame_built":"2026-07-12"},"permalink":"https://metacan.xera.ac/q/a80b6dd78038","api":"https://metacan.xera.ac/api/v1/cohort?venue=International+Journal+of+Data+Warehousing+and+Mining"},"results":[{"id":"W1966404343","doi":"10.4018/jdwm.2012100103","title":"Efficient and Effective Aggregate Keyword Search on Relational Databases","year":2012,"lang":"en","type":"article","venue":"International Journal of Data Warehousing and Mining","topic":"Data Management and Algorithms","field":"Computer Science","cited_by":3,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Simon Fraser University; Coquitlam College","funders":"Natural Sciences and Engineering Research Council of Canada","keywords":"Computer science; Aggregate (composite); Ranking (information retrieval); Keyword search; Relational database; Information retrieval; Keyword density; Database; Data mining","score_opus":0.08742456037480173,"score_gpt":0.3419586676621541,"score_spread":0.2545341072873524,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W1966404343","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.10703275,0.0038535357,0.875906,0.00037797133,0.000049930455,0.00026266137,0.0014652646,0.006005408,0.0050464566],"genre_scores_gemma":[0.44296896,0.0020976658,0.54986715,0.0001516284,0.0001054058,0.00015810208,0.0020192168,0.00027337292,0.002358442],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.994187,0.0015360916,0.0007908103,0.00055369013,0.0024600765,0.0004723164],"domain_scores_gemma":[0.99243414,0.003424372,0.00059292454,0.001904334,0.0014175447,0.00022662834],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0023575176,0.0007905403,0.0023357593,0.0035198021,0.0008455189,0.003401106,0.0015020903,0.0009522798,0.0015011879],"category_scores_gemma":[0.01090043,0.0005239225,0.00088868814,0.0073063946,0.00055990275,0.0069503644,0.0022488195,0.0005708922,0.0013434516],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0011705186,0.0003653518,0.005327688,0.001119127,0.00030430438,0.0005932949,0.0008493076,0.12219805,0.06369399,0.046306536,0.018364483,0.7397074],"study_design_scores_gemma":[0.00013011473,0.00040385756,0.0025739279,0.000060754082,0.0002194038,0.00095415383,0.00079224206,0.8793516,0.049768604,0.051010616,0.014637496,0.00009726351],"about_ca_topic_score_codex":0.0048674126,"about_ca_topic_score_gemma":0.0051170858,"teacher_disagreement_score":0.0048674126,"about_ca_system_score_codex":0.0008739654,"about_ca_system_score_gemma":0.0017213853,"threshold_uncertainty_score":0.012467861},"labels":[],"label_agreement":null},{"id":"W1974637590","doi":"10.4018/jdwm.2013040101","title":"Elasticity in Cloud Databases and Their Query Processing","year":2013,"lang":"en","type":"article","venue":"International Journal of Data Warehousing and Mining","topic":"Cloud Computing and Resource Management","field":"Computer Science","cited_by":5,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Concordia University","funders":"","keywords":"Computer science; Provisioning; Cloud computing; Query optimization; Elasticity (physics); Range query (database); Database; Materialized view; Node (physics); Sargable; Key (lock); Online aggregation; Task (project management); Context (archaeology); Web query classification; View; Web search query; Distributed computing; Information retrieval; Computer network; Search engine; Operating system","score_opus":0.04858488775959593,"score_gpt":0.2912323829923285,"score_spread":0.24264749523273257,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W1974637590","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.047229946,0.012998905,0.9161997,0.0053499145,0.0002898013,0.0001816012,0.00036050088,0.0007092552,0.01668038],"genre_scores_gemma":[0.6477967,0.008505321,0.3342887,0.00084324833,0.00054792356,0.00019830573,0.0004708449,0.00025791686,0.0070910268],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.9963458,0.0010436391,0.00026428254,0.00048680272,0.0015662845,0.00029325028],"domain_scores_gemma":[0.99731016,0.0015232598,0.0002006618,0.000644371,0.00023563173,0.00008587892],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0022616682,0.0005234887,0.00082546397,0.00093468424,0.0010420484,0.004532963,0.0016910689,0.0012851274,0.00211487],"category_scores_gemma":[0.005762046,0.00062724185,0.0008955282,0.0037716902,0.0015155525,0.0054316837,0.0016951077,0.0018919592,0.0005473535],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00043165375,0.00018317331,0.0034685975,0.00043506024,0.00010399682,0.00048814525,0.00060551823,0.19038989,0.008716964,0.5502285,0.010945374,0.23400314],"study_design_scores_gemma":[0.000031562347,0.00007969872,0.001181859,0.000066390014,0.000037873877,0.0005822931,0.00048267184,0.64123577,0.005418758,0.3240053,0.026834741,0.000043037882],"about_ca_topic_score_codex":0.0034479338,"about_ca_topic_score_gemma":0.0022869012,"teacher_disagreement_score":0.004532963,"about_ca_system_score_codex":0.0014381026,"about_ca_system_score_gemma":0.0010274672,"threshold_uncertainty_score":0.011960983},"labels":[],"label_agreement":null},{"id":"W1980161931","doi":"10.4018/jdwm.2008010103","title":"Dynamic View Selection for OLAP","year":2008,"lang":"en","type":"article","venue":"International Journal of Data Warehousing and Mining","topic":"Advanced Database Systems and Queries","field":"Computer Science","cited_by":5,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Dalhousie University","funders":"","keywords":"Materialized view; Online analytical processing; Computer science; Data warehouse; Aggregate (composite); Selection (genetic algorithm); Task (project management); Set (abstract data type); Information retrieval; Order (exchange); Data mining; Database; View; Machine learning","score_opus":0.06588151749652649,"score_gpt":0.3408887644985445,"score_spread":0.275007247002018,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W1980161931","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.017603071,0.0021621557,0.9746303,0.0003548902,0.00010552826,0.0001608273,0.00033944726,0.0025562479,0.0020874152],"genre_scores_gemma":[0.3728464,0.0015348651,0.6208139,0.00031608992,0.00027469336,0.00031294976,0.0015342864,0.00055045786,0.0018163802],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9964971,0.0012093423,0.00020984576,0.00061374594,0.0012144299,0.00025547593],"domain_scores_gemma":[0.9929894,0.0035527449,0.0004466083,0.0017563243,0.0008297048,0.0004252328],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.002851802,0.0009862328,0.0013233154,0.0012259831,0.0010706246,0.0023734504,0.0023361272,0.0008436125,0.0024076046],"category_scores_gemma":[0.008921787,0.00066607265,0.00097085757,0.002275297,0.00083511136,0.0033625641,0.0025897413,0.002040235,0.0008734288],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0012440501,0.0004345915,0.0056979638,0.00040007243,0.00024501295,0.0006448752,0.0006093242,0.20661318,0.028351393,0.060259536,0.024292324,0.6712076],"study_design_scores_gemma":[0.000084373394,0.00018420901,0.000910592,0.00004372928,0.000067230234,0.00045032395,0.0002131816,0.89554673,0.007907673,0.0766967,0.01782746,0.00006768184],"about_ca_topic_score_codex":0.0022704925,"about_ca_topic_score_gemma":0.0023612035,"teacher_disagreement_score":0.002851802,"about_ca_system_score_codex":0.00068468536,"about_ca_system_score_gemma":0.00095016405,"threshold_uncertainty_score":0.015081942},"labels":[],"label_agreement":null},{"id":"W1998319238","doi":"10.4018/jdwm.2005100103","title":"Preference-Based Frequent Pattern Mining","year":2005,"lang":"en","type":"article","venue":"International Journal of Data Warehousing and Mining","topic":"Data Mining Algorithms and Applications","field":"Computer Science","cited_by":9,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Simon Fraser University","funders":"","keywords":"Computer science; Preference; Data mining; Sequential Pattern Mining; Constraint (computer-aided design); K-optimal pattern discovery; Machine learning; Artificial intelligence; Data stream mining; Mathematics","score_opus":0.11674474253513491,"score_gpt":0.3223307267655304,"score_spread":0.20558598423039548,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W1998319238","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.019642623,0.0004672334,0.9756438,0.0004345075,0.000057162477,0.0003085086,0.0008735943,0.00040208493,0.00217048],"genre_scores_gemma":[0.32661432,0.00077154615,0.66779375,0.00028135948,0.0001158234,0.00042047843,0.0021719635,0.00007252253,0.0017583192],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9911951,0.0028518548,0.00097249774,0.0012471777,0.003295554,0.00043779597],"domain_scores_gemma":[0.98398846,0.008134706,0.0014018416,0.0024123997,0.0037011637,0.00036133666],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0057295673,0.0009413519,0.0015911403,0.0036553335,0.0010894954,0.0022316608,0.0021744394,0.0010458257,0.0024968963],"category_scores_gemma":[0.03222919,0.000482232,0.0015075813,0.00633175,0.0007197895,0.004739789,0.0013822977,0.0014179122,0.0011721172],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00072907127,0.000438562,0.025208479,0.0013258287,0.0006025583,0.0012913579,0.00072133297,0.09507408,0.0071842656,0.13290288,0.013549258,0.72097236],"study_design_scores_gemma":[0.0001198025,0.00031357826,0.0034843804,0.00015937153,0.00019964368,0.002519821,0.0005462238,0.7011309,0.009271667,0.26389417,0.018236741,0.00012375369],"about_ca_topic_score_codex":0.0014936499,"about_ca_topic_score_gemma":0.001850491,"teacher_disagreement_score":0.0057295673,"about_ca_system_score_codex":0.00074498245,"about_ca_system_score_gemma":0.0015324842,"threshold_uncertainty_score":0.030301213},"labels":[],"label_agreement":null},{"id":"W1998415522","doi":"10.4018/ijdwm.2015010102","title":"Parallel Real-Time OLAP on Multi-Core Processors","year":2015,"lang":"en","type":"article","venue":"International Journal of Data Warehousing and Mining","topic":"Advanced Database Systems and Queries","field":"Computer Science","cited_by":7,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Carleton University","funders":"","keywords":"Online analytical processing; Computer science; Data warehouse; Data cube; Benchmark (surveying); Database; Xeon Phi; Decision support system; Data mining; Parallel computing","score_opus":0.1509179829619319,"score_gpt":0.365363937577586,"score_spread":0.2144459546156541,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W1998415522","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.24890155,0.0019986078,0.6961772,0.00070058374,0.0005171573,0.0009849616,0.0008947384,0.033571474,0.016253728],"genre_scores_gemma":[0.5474951,0.00050447613,0.44272637,0.00031755297,0.00009078665,0.00062955415,0.0015784722,0.00083648035,0.0058212527],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9973355,0.00045890594,0.0002546275,0.0006351964,0.00091519015,0.00040046722],"domain_scores_gemma":[0.9971942,0.0006625103,0.00020699557,0.00071859994,0.0009952649,0.00022248464],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0015937666,0.0017658694,0.0010610431,0.0009539651,0.0010517391,0.002147226,0.0027986427,0.00055339094,0.004445226],"category_scores_gemma":[0.0035867624,0.0007543004,0.0007339564,0.0017219352,0.0007757273,0.0021954023,0.0015905602,0.001420671,0.0014872546],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.005167157,0.0011075162,0.0074336627,0.0011662476,0.0005957607,0.0013132278,0.0009803212,0.3656594,0.10539413,0.014188039,0.046450887,0.45054373],"study_design_scores_gemma":[0.0003035973,0.00047589332,0.001108623,0.000032329586,0.000079815676,0.00019806088,0.00017500829,0.9418256,0.03960007,0.005385316,0.0107489,0.00006679561],"about_ca_topic_score_codex":0.0064040064,"about_ca_topic_score_gemma":0.0056600613,"teacher_disagreement_score":0.0064040064,"about_ca_system_score_codex":0.001136629,"about_ca_system_score_gemma":0.0026240193,"threshold_uncertainty_score":0.014870763},"labels":[],"label_agreement":null},{"id":"W2004582297","doi":"10.4018/jdwm.2008100104","title":"Effectiveness of Fuzzy Classifier Rules in Capturing Correlations between Genes","year":2008,"lang":"en","type":"article","venue":"International Journal of Data Warehousing and Mining","topic":"Data Mining Algorithms and Applications","field":"Computer Science","cited_by":10,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Calgary","funders":"","keywords":"Classifier (UML); Computer science; Gene selection; Artificial intelligence; Fuzzy logic; Correlation; Fuzzy rule; Machine learning; Gene; Data mining; Pattern recognition (psychology); Fuzzy set; Mathematics; Genetics; Biology","score_opus":0.08223178487745361,"score_gpt":0.32237026324166423,"score_spread":0.24013847836421062,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2004582297","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.20312995,0.0010584486,0.7882176,0.00043396468,0.000139495,0.00026109334,0.0004909482,0.001070109,0.005198459],"genre_scores_gemma":[0.63615775,0.00042469092,0.3616031,0.00018780812,0.00008762305,0.00014632945,0.00062750827,0.00007578581,0.0006893467],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9910088,0.002700069,0.0009626529,0.0013495646,0.0037060857,0.00027276154],"domain_scores_gemma":[0.9211777,0.062941484,0.0031248967,0.004812191,0.007547213,0.00039644373],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.013103691,0.0010145148,0.0017917439,0.0035557447,0.0008123709,0.003338244,0.0012958137,0.0015386262,0.0008017409],"category_scores_gemma":[0.060839437,0.00047217542,0.0010978371,0.0017850456,0.0009696771,0.0042198757,0.00061814697,0.0013343799,0.00048283132],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0011007972,0.00050760806,0.056915183,0.0004083472,0.0006065706,0.00081022724,0.0008933361,0.39953616,0.017637556,0.019351719,0.0020109878,0.50022143],"study_design_scores_gemma":[0.00004751833,0.00018403013,0.0069970367,0.00006693251,0.00015513155,0.00027708407,0.0001355878,0.9581244,0.012143737,0.020332795,0.0014524623,0.00008322962],"about_ca_topic_score_codex":0.0050377958,"about_ca_topic_score_gemma":0.0033130192,"teacher_disagreement_score":0.013103691,"about_ca_system_score_codex":0.0008812438,"about_ca_system_score_gemma":0.0015823955,"threshold_uncertainty_score":0.06929976},"labels":[],"label_agreement":null},{"id":"W2008393584","doi":"10.4018/jdwm.2008100102","title":"Computing Join Aggregates Over Private Tables","year":2008,"lang":"en","type":"article","venue":"International Journal of Data Warehousing and Mining","topic":"Privacy-Preserving Technologies in Data","field":"Computer Science","cited_by":2,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Simon Fraser University","funders":"","keywords":"Join (topology); Computer science; Protocol (science); Private information retrieval; Matching (statistics); Inference; Computer security; Secret sharing; Theoretical computer science; Cryptography; Mathematics","score_opus":0.076248266712977,"score_gpt":0.3195461971826842,"score_spread":0.24329793046970716,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2008393584","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.09136068,0.00021464846,0.9036915,0.0005025084,0.000052095747,0.00017401238,0.0003157771,0.0017845721,0.0019043133],"genre_scores_gemma":[0.7325798,0.00025976045,0.26181334,0.0001465557,0.000108498854,0.00023791399,0.0009196524,0.0002575768,0.0036769733],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.99200857,0.0014825669,0.0008637648,0.001357374,0.0034833266,0.00080438814],"domain_scores_gemma":[0.9838297,0.004846087,0.0014182345,0.008197137,0.0010460068,0.0006627592],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.00789904,0.0007674127,0.0019216037,0.0009890632,0.0018655466,0.0058598886,0.00201351,0.0016017695,0.0018929176],"category_scores_gemma":[0.016145106,0.000906986,0.0017835328,0.0018602569,0.002267415,0.013478809,0.008049337,0.0023779743,0.0006167396],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0024339776,0.00037800547,0.009590995,0.0004202519,0.00037474168,0.00067930826,0.0034630701,0.22858667,0.04833683,0.5098264,0.005157177,0.19075258],"study_design_scores_gemma":[0.00019532531,0.00029800626,0.0008508886,0.000034592565,0.00017367839,0.000270615,0.00062626717,0.60106033,0.05913251,0.32467696,0.012598484,0.00008237942],"about_ca_topic_score_codex":0.0013402713,"about_ca_topic_score_gemma":0.0008886119,"teacher_disagreement_score":0.00789904,"about_ca_system_score_codex":0.0014046102,"about_ca_system_score_gemma":0.002052748,"threshold_uncertainty_score":0.04177463},"labels":[],"label_agreement":null},{"id":"W2037018161","doi":"10.4018/jdwm.2006010101","title":"Improved Data Partitioning for Building Large ROLAP Data Cubes in Parallel","year":2006,"lang":"en","type":"article","venue":"International Journal of Data Warehousing and Mining","topic":"Advanced Database Systems and Queries","field":"Computer Science","cited_by":9,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Concordia University; Carleton University; Dalhousie University","funders":"","keywords":"Computer science; Parallel computing; Speedup; Scalability; Data cube; Data warehouse; Cube (algebra); Representation (politics); Multiprocessing; Materialized view; Online analytical processing; Data structure; External Data Representation; Parallel algorithm; Data mining; Database; Operating system","score_opus":0.07509153115286228,"score_gpt":0.3572573266976316,"score_spread":0.28216579554476934,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2037018161","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.013018137,0.000097551885,0.9841702,0.00007113008,0.000022855058,0.00007307163,0.000092216105,0.001276825,0.0011780214],"genre_scores_gemma":[0.06618385,0.00009087182,0.93156594,0.00004014394,0.000018224173,0.0002018255,0.00064541737,0.00026751333,0.0009862242],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9991855,0.00016644571,0.00005308582,0.00012811746,0.00038378447,0.0000830346],"domain_scores_gemma":[0.9992137,0.00024246074,0.00004534511,0.0002625569,0.00020911852,0.00002669935],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0005219598,0.0006420029,0.0006471712,0.0007262207,0.00069347885,0.0007445428,0.0014505044,0.00037069956,0.0018232437],"category_scores_gemma":[0.0017031148,0.00042904547,0.00083277904,0.0013784708,0.0005216955,0.00141836,0.0015882289,0.0009279091,0.0008961922],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00048137683,0.00025528503,0.0016936775,0.000369519,0.00013186153,0.00041149298,0.0006680161,0.26406026,0.08053403,0.026234435,0.013650949,0.6115091],"study_design_scores_gemma":[0.0001314466,0.00011793836,0.0005297424,0.000013976208,0.000041656698,0.00027290164,0.00015050793,0.91526544,0.048612397,0.016172519,0.018649269,0.000042259384],"about_ca_topic_score_codex":0.0032896914,"about_ca_topic_score_gemma":0.0043121036,"teacher_disagreement_score":0.0032896914,"about_ca_system_score_codex":0.0004391073,"about_ca_system_score_gemma":0.00080420583,"threshold_uncertainty_score":0.0065410733},"labels":[],"label_agreement":null},{"id":"W2040900238","doi":"10.4018/jdwm.2013040105","title":"An Envisioned Approach for Modeling and Supporting User-Centric Query Activities on Data Warehouses","year":2013,"lang":"en","type":"article","venue":"International Journal of Data Warehousing and Mining","topic":"Advanced Database Systems and Queries","field":"Computer Science","cited_by":4,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Université du Québec en Outaouais","funders":"","keywords":"Computer science; Data warehouse; Online analytical processing; Metadata; Ontology; Information retrieval; Exploit; Knowledge extraction; Query optimization; Data mining; Data science; Database; World Wide Web","score_opus":0.09383134873528128,"score_gpt":0.3502786813204296,"score_spread":0.25644733258514835,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2040900238","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0023962269,0.0001814265,0.99288756,0.00090139813,0.000045911675,0.00015483254,0.00010787521,0.0009935311,0.0023312762],"genre_scores_gemma":[0.06582862,0.00047166712,0.9303591,0.00031897434,0.00008430107,0.00032149372,0.0003590356,0.00013232729,0.0021244676],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9948067,0.0017966189,0.0006697347,0.0009477164,0.0013624307,0.00041677678],"domain_scores_gemma":[0.9961618,0.0008643914,0.00022583528,0.0014792874,0.0008765207,0.00039218002],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.009373072,0.0010584454,0.0010356092,0.0017686615,0.0014108724,0.010941811,0.0069570425,0.004270458,0.0024283817],"category_scores_gemma":[0.0067930515,0.0015207271,0.0026420876,0.0026869273,0.0030418395,0.01199247,0.0041209557,0.003159067,0.0013816126],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00016065793,0.00029521505,0.001955799,0.00035493117,0.00015016567,0.0004706816,0.002735237,0.0695895,0.006601247,0.8610332,0.006085456,0.0505679],"study_design_scores_gemma":[0.00006722405,0.00018676766,0.00031768068,0.00020384052,0.00013633924,0.00034321737,0.0007206319,0.5640098,0.005820057,0.32672504,0.101361185,0.00010824127],"about_ca_topic_score_codex":0.005320027,"about_ca_topic_score_gemma":0.004906735,"teacher_disagreement_score":0.010941811,"about_ca_system_score_codex":0.002014504,"about_ca_system_score_gemma":0.0033266353,"threshold_uncertainty_score":0.049570143},"labels":[],"label_agreement":null},{"id":"W2044194343","doi":"10.4018/jdwm.2012100101","title":"Towards Comparative Mining of Web Document Objects with NFA","year":2012,"lang":"en","type":"article","venue":"International Journal of Data Warehousing and Mining","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":6,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Windsor","funders":"","keywords":"Computer science; Web mining; Data Web; Web page; Web modeling; Information retrieval; Web standards; World Wide Web; Web intelligence; Static web page; Web navigation; Database","score_opus":0.07416393370134935,"score_gpt":0.3429523755542617,"score_spread":0.2687884418529124,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2044194343","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.051842723,0.0004870047,0.9435182,0.00008934259,0.000012631935,0.00014310412,0.0005537666,0.002001055,0.0013522485],"genre_scores_gemma":[0.21263532,0.00024188597,0.7837634,0.000042433956,0.000014716395,0.00026519148,0.0020850324,0.00013449752,0.0008174551],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9982967,0.00034743035,0.0002189699,0.000534926,0.0005102107,0.0000918649],"domain_scores_gemma":[0.99587506,0.002483474,0.00035528676,0.00052376144,0.00068612455,0.00007633213],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0021199652,0.00065939873,0.0010339293,0.0075914613,0.0009912963,0.0020760738,0.0013265124,0.0011917981,0.0010545568],"category_scores_gemma":[0.009742036,0.0005840982,0.002355622,0.0044718706,0.0012033478,0.0029293855,0.0012106196,0.0007356054,0.00052534894],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00043816812,0.0003543235,0.034366425,0.00087680685,0.0002914202,0.0011300779,0.001590031,0.101367086,0.042583343,0.04182286,0.0016484975,0.77353084],"study_design_scores_gemma":[0.000020485575,0.00015881733,0.008322048,0.00013079615,0.00012127008,0.0008504272,0.0003891366,0.9055477,0.018148214,0.05670725,0.009559535,0.000044321736],"about_ca_topic_score_codex":0.006823195,"about_ca_topic_score_gemma":0.006116615,"teacher_disagreement_score":0.0075914613,"about_ca_system_score_codex":0.0012732684,"about_ca_system_score_gemma":0.0013586056,"threshold_uncertainty_score":0.013566911},"labels":[],"label_agreement":null},{"id":"W2060490725","doi":"10.4018/jdwm.2008070101","title":"RCUBE","year":2008,"lang":"en","type":"article","venue":"International Journal of Data Warehousing and Mining","topic":"Advanced Database Systems and Queries","field":"Computer Science","cited_by":8,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Dalhousie University; Concordia University; Carleton University","funders":"Natural Sciences and Engineering Research Council of Canada","keywords":"Online analytical processing; Computer science; Scalability; Search engine indexing; Materialized view; Scheme (mathematics); Multidimensional data; Volume (thermodynamics); Database index; Index (typography); Distributed computing; Data mining; Database; Information retrieval; Data warehouse; View; Database design; World Wide Web","score_opus":0.09224246699132363,"score_gpt":0.32406961971131504,"score_spread":0.2318271527199914,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2060490725","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.014906794,0.0042193197,0.6339746,0.0023659868,0.0028855316,0.0010678377,0.01549952,0.08417237,0.2409081],"genre_scores_gemma":[0.12013897,0.005067561,0.6110688,0.0022252966,0.0010973483,0.0016037513,0.05571482,0.016868588,0.18621495],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.99712026,0.0003200158,0.00024729798,0.0005127203,0.0014872178,0.000312583],"domain_scores_gemma":[0.9956073,0.0005254775,0.00016757242,0.0022249005,0.0012161836,0.00025853107],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0010130275,0.0009886472,0.0013153728,0.0022119726,0.0019263295,0.004708216,0.00424791,0.0014300566,0.059196968],"category_scores_gemma":[0.005784268,0.00052341237,0.0009624464,0.004585113,0.0007222232,0.0053468407,0.005807356,0.001898882,0.05229347],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00042845664,0.00014548747,0.0013283428,0.0008228854,0.00006443438,0.00038465657,0.0003219821,0.0070836404,0.008889474,0.082714066,0.32497278,0.57284385],"study_design_scores_gemma":[0.00005495992,0.00010695081,0.00054861547,0.000097867196,0.000022655038,0.0008348045,0.00015817402,0.033438213,0.010287071,0.02523286,0.9291553,0.00006248627],"about_ca_topic_score_codex":0.004512007,"about_ca_topic_score_gemma":0.0050189183,"teacher_disagreement_score":0.059196968,"about_ca_system_score_codex":0.0013897339,"about_ca_system_score_gemma":0.0025324759,"threshold_uncertainty_score":0},"labels":[],"label_agreement":null},{"id":"W2067774887","doi":"10.4018/jdwm.2010070103","title":"Classification of Peer-to-Peer Traffic Using A Two-Stage Window-Based Classifier With Fast Decision Tree and IP Layer Attributes","year":2010,"lang":"en","type":"article","venue":"International Journal of Data Warehousing and Mining","topic":"Network Security and Intrusion Detection","field":"Computer Science","cited_by":5,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Ottawa","funders":"","keywords":"Computer science; Traffic classification; Classifier (UML); Router; Decision tree; Data mining; The Internet; Peer-to-peer; Internet traffic; Artificial intelligence; Machine learning; Computer network; Network packet","score_opus":0.07563901748133242,"score_gpt":0.3311798451447369,"score_spread":0.25554082766340447,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2067774887","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.11975003,0.00020626346,0.8768381,0.00016895917,0.00012028821,0.0002904141,0.00027017447,0.0017407474,0.0006150586],"genre_scores_gemma":[0.39001676,0.00018682725,0.6065718,0.00007120247,0.000101528465,0.00028032402,0.00090351125,0.00006897778,0.0017991315],"study_design_codex":"design_other","study_design_gemma":"bench_or_experimental","domain_scores_codex":[0.99876153,0.0001749931,0.00016585719,0.00029261093,0.0004769661,0.00012801378],"domain_scores_gemma":[0.9965495,0.001709227,0.000209862,0.00029015998,0.0011040642,0.00013710187],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.002578525,0.0010182593,0.0017181482,0.0026913802,0.000670307,0.0015021624,0.0019362137,0.0014218681,0.0008081387],"category_scores_gemma":[0.004464409,0.0004898919,0.0013004136,0.0015487905,0.0003536634,0.0026643684,0.0005554868,0.0013309283,0.0006489717],"study_design_candidate":"bench_or_experimental","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0011956915,0.0011205467,0.02122053,0.00017809612,0.00025242748,0.00033044734,0.00018556986,0.1456108,0.03395218,0.0026873727,0.0026400504,0.7906263],"study_design_scores_gemma":[0.000014749764,0.00014913564,0.0010893503,0.000006035807,0.000025802201,0.000056831224,0.000016574118,0.99127066,0.0062840837,0.00064954784,0.0004226386,0.000014505824],"about_ca_topic_score_codex":0.0043628523,"about_ca_topic_score_gemma":0.003277095,"teacher_disagreement_score":0.0043628523,"about_ca_system_score_codex":0.0008255281,"about_ca_system_score_gemma":0.0010445049,"threshold_uncertainty_score":0.013636708},"labels":[],"label_agreement":null},{"id":"W2072801150","doi":"10.4018/jdwm.2013070101","title":"Efficient Top-k Keyword Search Over Multidimensional Databases","year":2013,"lang":"en","type":"article","venue":"International Journal of Data Warehousing and Mining","topic":"Advanced Database Systems and Queries","field":"Computer Science","cited_by":1,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"York University","funders":"","keywords":"Computer science; Keyword search; Online analytical processing; Perspective (graphical); Database; Search algorithm; Search engine; Search engine indexing; Information retrieval; Data mining; Algorithm; Artificial intelligence; Data warehouse","score_opus":0.061530596177754776,"score_gpt":0.33968236031463683,"score_spread":0.27815176413688203,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2072801150","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.09653792,0.0052697985,0.8894861,0.00030584843,0.000086199514,0.00022443243,0.0010591398,0.0043730913,0.002657384],"genre_scores_gemma":[0.31879362,0.00153779,0.6753004,0.000097723416,0.000056276793,0.00009472139,0.001715573,0.00021527043,0.002188623],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9984376,0.00027285726,0.00024732642,0.0003215265,0.000539139,0.00018155717],"domain_scores_gemma":[0.99737394,0.0011905622,0.00027128728,0.00045839525,0.00055879477,0.0001470172],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0007093286,0.0009855396,0.0023283793,0.0027001037,0.0011230203,0.0017870348,0.0019190364,0.0013946216,0.0020245798],"category_scores_gemma":[0.004170898,0.00059178367,0.0010714526,0.0067504225,0.00043190195,0.004207465,0.0020140575,0.0006074101,0.0015351753],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0009959495,0.00037258028,0.0045006676,0.0015961762,0.00034703105,0.000904004,0.0005888494,0.110216476,0.069150515,0.008340673,0.010708257,0.79227895],"study_design_scores_gemma":[0.00012132797,0.0003289997,0.0012975339,0.00004507565,0.00015943745,0.0018829524,0.00056571024,0.9332895,0.032681268,0.022339607,0.007222642,0.000065871456],"about_ca_topic_score_codex":0.0037791186,"about_ca_topic_score_gemma":0.0058948733,"teacher_disagreement_score":0.0037791186,"about_ca_system_score_codex":0.00058487145,"about_ca_system_score_gemma":0.0016469494,"threshold_uncertainty_score":0.0075142384},"labels":[],"label_agreement":null},{"id":"W2091140227","doi":"10.4018/jdwm.2010070102","title":"Exploring Disease Association from the NHANES Data","year":2010,"lang":"en","type":"article","venue":"International Journal of Data Warehousing and Mining","topic":"Data Mining Algorithms and Applications","field":"Computer Science","cited_by":10,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Simon Fraser University","funders":"","keywords":"Computer science; Automatic summarization; Disease; Association rule learning; Data mining; Association (psychology); Data science; Artificial intelligence; Medicine; Pathology; Psychology","score_opus":0.21387985509449203,"score_gpt":0.33851251238262725,"score_spread":0.12463265728813522,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2091140227","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.77439255,0.0031258252,0.10325328,0.0033294943,0.00009506314,0.00051637454,0.10549586,0.0010374376,0.008754094],"genre_scores_gemma":[0.8005784,0.0023525243,0.10457839,0.00043631333,0.00013570869,0.0004921577,0.08987291,0.000053485353,0.001500164],"study_design_codex":"observational","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9987532,0.00041777804,0.0001581177,0.00022122578,0.00037926887,0.0000703118],"domain_scores_gemma":[0.99460727,0.003831688,0.0006669826,0.00033725012,0.00040306294,0.0001538921],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0015580129,0.00034579987,0.00038445953,0.004525099,0.0003960814,0.00054319366,0.00032682036,0.00037297513,0.0019259957],"category_scores_gemma":[0.0077025536,0.0001343653,0.00091078866,0.005140696,0.00017682707,0.0005061887,0.00085353845,0.00062191096,0.00044361938],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00070335396,0.00039011007,0.77219206,0.0008650387,0.00092087453,0.0020716053,0.0008577901,0.012602004,0.007932324,0.0043057045,0.009530779,0.18762843],"study_design_scores_gemma":[0.00014758957,0.0005608925,0.8426622,0.00020878058,0.0010459961,0.0029511412,0.0021468657,0.061737113,0.008290506,0.026644489,0.05350668,0.00009773027],"about_ca_topic_score_codex":0.010068462,"about_ca_topic_score_gemma":0.022867855,"teacher_disagreement_score":0.010068462,"about_ca_system_score_codex":0.00032899049,"about_ca_system_score_gemma":0.0009563964,"threshold_uncertainty_score":0.02001977},"labels":[],"label_agreement":null},{"id":"W2100729317","doi":"10.4018/jdwm.2006070102","title":"A TOPSIS Data Mining Demonstration and Application to Credit Scoring","year":2006,"lang":"en","type":"article","venue":"International Journal of Data Warehousing and Mining","topic":"Rough Sets and Fuzzy Logic","field":"Computer Science","cited_by":44,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Toronto","funders":"","keywords":"TOPSIS; Ideal solution; Computer science; Data mining; Similarity (geometry); Classifier (UML); Machine learning; Artificial intelligence; Operations research; Mathematics","score_opus":0.05886790145175001,"score_gpt":0.31690642003769104,"score_spread":0.258038518585941,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2100729317","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.01659257,0.00066722813,0.94875455,0.0035159567,0.00026068868,0.00073907,0.00076471386,0.0009913816,0.027713766],"genre_scores_gemma":[0.14059085,0.0007006968,0.85390526,0.00013030211,0.000060483297,0.00044066514,0.00033333266,0.00005827104,0.003780136],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.99450535,0.002502916,0.00033566053,0.00029657077,0.0022499731,0.000109656066],"domain_scores_gemma":[0.99325293,0.0034694336,0.00041624092,0.00046997247,0.0021600688,0.00023142144],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0069680507,0.0012822517,0.0010625058,0.005011566,0.0020463276,0.004034487,0.0012172753,0.0010229567,0.01047904],"category_scores_gemma":[0.019395912,0.00036129422,0.0012252878,0.0077457675,0.0012400203,0.0023797962,0.001935986,0.0020542059,0.0017357037],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00023819365,0.00039592173,0.0066153645,0.0009828821,0.00031615037,0.0013108982,0.0023295158,0.0762049,0.002971471,0.34332746,0.02454814,0.540759],"study_design_scores_gemma":[0.00013080746,0.00031625986,0.0034980013,0.00042738346,0.00009737375,0.00071139715,0.0019249945,0.58512557,0.0030779052,0.34835652,0.056190316,0.00014352695],"about_ca_topic_score_codex":0.0077068633,"about_ca_topic_score_gemma":0.008035202,"teacher_disagreement_score":0.01047904,"about_ca_system_score_codex":0.001905772,"about_ca_system_score_gemma":0.0032657008,"threshold_uncertainty_score":0.03685099},"labels":[],"label_agreement":null},{"id":"W2128322880","doi":"10.4018/jdwm.2005040101","title":"The Use of Smart Tokens in Cleaning Integrated Warehouse Data","year":2005,"lang":"en","type":"article","venue":"International Journal of Data Warehousing and Mining","topic":"Data Quality and Management","field":"Decision Sciences","cited_by":24,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Windsor","funders":"","keywords":"Computer science; Data warehouse; Security token; Database; Alphanumeric; Matching (statistics); Data mining; Unique identifier; Identifier; Computer security","score_opus":0.5821457750325668,"score_gpt":0.47436071499941795,"score_spread":0.10778506003314886,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2128322880","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.049629368,0.0005188232,0.9429004,0.00017353459,0.00014092863,0.00021901353,0.0005592613,0.005003414,0.0008552823],"genre_scores_gemma":[0.1514124,0.00025979278,0.84476656,0.00009751943,0.000025911591,0.00013930314,0.0013733696,0.00044043572,0.0014846975],"study_design_codex":"design_other","study_design_gemma":"bench_or_experimental","domain_scores_codex":[0.9938956,0.0006992731,0.0010980136,0.0013727697,0.0026029982,0.00033131582],"domain_scores_gemma":[0.989056,0.0024477358,0.0023617097,0.0038794235,0.0018958458,0.00035928196],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0025751842,0.0007611071,0.0015786842,0.0034479515,0.0013652282,0.0031188636,0.0037442108,0.0010740433,0.0012429417],"category_scores_gemma":[0.012057822,0.0008173598,0.0014143506,0.006191608,0.0014550207,0.006390649,0.0034949507,0.0013657003,0.0019109097],"study_design_candidate":"bench_or_experimental","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0018581644,0.00036409884,0.023472372,0.0008374796,0.0002505691,0.0009476087,0.002139027,0.028544856,0.07004926,0.03152947,0.0075022066,0.83250487],"study_design_scores_gemma":[0.00020407472,0.0013513474,0.011674156,0.00025481914,0.00042275063,0.004150433,0.0021796387,0.35194102,0.4796521,0.047291234,0.10031604,0.0005623276],"about_ca_topic_score_codex":0.0035320392,"about_ca_topic_score_gemma":0.0026551157,"teacher_disagreement_score":0.0037442108,"about_ca_system_score_codex":0.0011148677,"about_ca_system_score_gemma":0.0026616568,"threshold_uncertainty_score":0.013619065},"labels":[],"label_agreement":null},{"id":"W2171228059","doi":"10.4018/jdwm.2010090801","title":"Investigating the Properties of a Social Bookmarking and Tagging Network","year":2010,"lang":"en","type":"article","venue":"International Journal of Data Warehousing and Mining","topic":"Complex Network Analysis Techniques","field":"Physics and Astronomy","cited_by":11,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Dalhousie University","funders":"","keywords":"Computer science; Bookmarking; Similarity (geometry); Social network (sociolinguistics); Set (abstract data type); World Wide Web; Friendship; Meaning (existential); Popularity; Information retrieval; Social media; Artificial intelligence","score_opus":0.0489664359810364,"score_gpt":0.30693320963499304,"score_spread":0.25796677365395665,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2171228059","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.77089214,0.00083261897,0.21577385,0.0024358218,0.000040881914,0.00016407769,0.0010524206,0.00021768293,0.008590495],"genre_scores_gemma":[0.9649115,0.0006568189,0.031425286,0.0001520167,0.000079330566,0.00013262052,0.0007404602,0.000050259467,0.001851601],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"observational","domain_scores_codex":[0.9983689,0.0007696494,0.000068220295,0.0004227327,0.00023408687,0.00013647671],"domain_scores_gemma":[0.9454081,0.040699854,0.0073665534,0.0031778594,0.0020776484,0.0012700906],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0024293559,0.0004683339,0.0005177413,0.0027962178,0.0013879606,0.0022601967,0.001115027,0.001788421,0.002039179],"category_scores_gemma":[0.027704597,0.0006718731,0.00059594784,0.0026598333,0.0022133938,0.0079100225,0.0011967443,0.0012175739,0.0002930276],"study_design_candidate":"observational","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0005801728,0.0006690708,0.14143582,0.00076067145,0.00049547356,0.001682473,0.004484828,0.28836405,0.020042572,0.4655463,0.0060958066,0.06984278],"study_design_scores_gemma":[0.000037354795,0.00012071382,0.018183516,0.00006525562,0.00007294642,0.0006493873,0.0010690435,0.7982313,0.002643096,0.17486688,0.004018768,0.00004172506],"about_ca_topic_score_codex":0.0037037744,"about_ca_topic_score_gemma":0.0031451585,"teacher_disagreement_score":0.0037037744,"about_ca_system_score_codex":0.0016748363,"about_ca_system_score_gemma":0.0005802485,"threshold_uncertainty_score":0.012847781},"labels":[],"label_agreement":null},{"id":"W2563061479","doi":"10.4018/ijdwm.2017010103","title":"Multidimensional Business Benchmarking Analysis on Data Warehouses","year":2016,"lang":"en","type":"article","venue":"International Journal of Data Warehousing and Mining","topic":"Advanced Database Systems and Queries","field":"Computer Science","cited_by":1,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Simon Fraser University","funders":"","keywords":"Benchmarking; Computer science; Data warehouse; Benchmark (surveying); Business intelligence; Aggregate (composite); Data science; Online analytical processing; Scalability; Context (archaeology); Analytics; Data mining; Set (abstract data type); Data cube; Business analytics; Database; Business model; Business analysis","score_opus":0.07877539273770963,"score_gpt":0.3369665008377868,"score_spread":0.25819110810007717,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2563061479","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.18950121,0.0014641678,0.7927939,0.0013462465,0.00011892451,0.00029622065,0.0029558926,0.0042427485,0.0072806724],"genre_scores_gemma":[0.7060626,0.00062936667,0.28718823,0.00018645961,0.00007014289,0.0002444963,0.0042979945,0.00020971756,0.0011110449],"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9903724,0.0038766635,0.0010121873,0.00085923384,0.003293048,0.00058638933],"domain_scores_gemma":[0.98683447,0.0055390764,0.0013182099,0.0026601884,0.003193167,0.00045489497],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0063793585,0.0011461142,0.0015809444,0.0072269933,0.001283545,0.0057437615,0.0016171526,0.0009431065,0.0016566489],"category_scores_gemma":[0.026753856,0.00060865516,0.0014657519,0.01271202,0.00092455506,0.0062984196,0.0029835806,0.0012139919,0.0005106635],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0004513291,0.0005223983,0.030466205,0.0006274617,0.0003760735,0.00081881165,0.0010486683,0.4264714,0.0065292786,0.21223573,0.014185863,0.30626684],"study_design_scores_gemma":[0.000013000462,0.00006998915,0.002777654,0.000062189,0.000026593758,0.00010565216,0.0005291358,0.90337557,0.0030621698,0.08623685,0.0037138455,0.000027378992],"about_ca_topic_score_codex":0.004634885,"about_ca_topic_score_gemma":0.0035079862,"teacher_disagreement_score":0.0072269933,"about_ca_system_score_codex":0.0016417728,"about_ca_system_score_gemma":0.0011962724,"threshold_uncertainty_score":0.03373766},"labels":[],"label_agreement":null},{"id":"W2892991540","doi":"10.4018/ijdwm.2018100103","title":"An Encryption Methodology for Enabling the Use of Data Warehouses on the Cloud","year":2018,"lang":"en","type":"article","venue":"International Journal of Data Warehousing and Mining","topic":"Cryptography and Data Security","field":"Computer Science","cited_by":2,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Dalhousie University","funders":"","keywords":"Encryption; Computer science; Client-side encryption; Filesystem-level encryption; Cloud computing; Homomorphic encryption; On-the-fly encryption; 40-bit encryption; 56-bit encryption; Database; Computer security; Operating system","score_opus":0.5255598604403172,"score_gpt":0.4357902813132018,"score_spread":0.08976957912711542,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2892991540","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.04328583,0.0004971096,0.951938,0.00033394832,0.000031122996,0.0002671854,0.00007175113,0.00019216783,0.0033829377],"genre_scores_gemma":[0.47895104,0.0008192734,0.5177531,0.00012579965,0.000019007475,0.00011121872,0.00015308961,0.000027421922,0.0020400125],"study_design_codex":"design_other","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.9989563,0.00033262704,0.00011548091,0.00009458612,0.00040773014,0.000093219474],"domain_scores_gemma":[0.9989195,0.0002595961,0.00015887992,0.00034686385,0.0002806103,0.000034698744],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0014351548,0.00023984275,0.00020668421,0.00049289694,0.00044104643,0.0010512862,0.0005533543,0.0004026378,0.00086172955],"category_scores_gemma":[0.0019065193,0.0001785348,0.0004935339,0.0005670408,0.0004386076,0.0019309351,0.0007928322,0.0005829303,0.0002760668],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00034567638,0.00036305323,0.0034876368,0.0005394347,0.00012397341,0.000574044,0.0005383824,0.07201441,0.1725608,0.3250318,0.003352317,0.4210685],"study_design_scores_gemma":[0.00009903038,0.00091484166,0.0028662784,0.00017623408,0.00014424742,0.0030162393,0.00069000403,0.53754675,0.3198666,0.077426076,0.05715468,0.00009904663],"about_ca_topic_score_codex":0.00046801634,"about_ca_topic_score_gemma":0.0004672804,"teacher_disagreement_score":0.0014351548,"about_ca_system_score_codex":0.0005825834,"about_ca_system_score_gemma":0.0011197883,"threshold_uncertainty_score":0.0075899363},"labels":[],"label_agreement":null},{"id":"W2989849422","doi":"10.4018/ijdwm.2020010101","title":"Mining Integrated Sequential Patterns From Multiple Databases","year":2019,"lang":"en","type":"article","venue":"International Journal of Data Warehousing and Mining","topic":"Data Mining Algorithms and Applications","field":"Computer Science","cited_by":3,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Guelph; Royal Bank of Canada; University of Windsor","funders":"","keywords":"Computer science; Tuple; Sequence (biology); Database transaction; Sequence database; Data mining; GSP Algorithm; Table (database); Database; Position (finance); Association rule learning; Apriori algorithm; Mathematics","score_opus":0.0751542230104232,"score_gpt":0.3248460621996281,"score_spread":0.2496918391892049,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2989849422","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.23510258,0.0035154857,0.7413842,0.00095468946,0.00024032414,0.0008826099,0.008559629,0.0044900477,0.004870418],"genre_scores_gemma":[0.44771713,0.001513199,0.53320825,0.00023685262,0.00017308051,0.00046794265,0.014351915,0.0001702589,0.0021613382],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9954182,0.00048712493,0.00072930416,0.0011008489,0.0020000236,0.00026444872],"domain_scores_gemma":[0.99385405,0.0022094995,0.00093007344,0.0009779844,0.0017262999,0.0003021171],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0019084412,0.0011870504,0.0016290133,0.00831327,0.00083546515,0.0027888785,0.0017822812,0.00095565134,0.0018568806],"category_scores_gemma":[0.010871523,0.0007931681,0.0014933455,0.010527139,0.00042389263,0.0043017115,0.0019501101,0.0010090364,0.0010378684],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0011291958,0.0005995979,0.06750132,0.0013709422,0.0009980274,0.005160055,0.00064648857,0.03373677,0.019638104,0.009590455,0.007489883,0.8521392],"study_design_scores_gemma":[0.00017195477,0.000942892,0.026175823,0.0003799822,0.0009257763,0.007393497,0.0018790421,0.81278396,0.03985806,0.07219917,0.037151463,0.00013851217],"about_ca_topic_score_codex":0.0017862304,"about_ca_topic_score_gemma":0.0025984107,"teacher_disagreement_score":0.00831327,"about_ca_system_score_codex":0.0005680938,"about_ca_system_score_gemma":0.0013975452,"threshold_uncertainty_score":0.010092914},"labels":[],"label_agreement":null},{"id":"W3032597430","doi":"10.4018/ijdwm.2020070106","title":"Conceptual Model and Design of Semantic Trajectory Data Warehouse","year":2020,"lang":"en","type":"article","venue":"International Journal of Data Warehousing and Mining","topic":"Data Management and Algorithms","field":"Computer Science","cited_by":7,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Calgary","funders":"","keywords":"Computer science; Data warehouse; Trajectory; Data mining; Geospatial analysis; Context (archaeology); Ontology; Inference; Object (grammar); Semantic data model; Information retrieval; Data modeling; Data science; Database; Artificial intelligence","score_opus":0.22540462770170883,"score_gpt":0.32539442731228885,"score_spread":0.09998979961058002,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W3032597430","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.004026837,0.00017362018,0.9886395,0.0008751649,0.000055563938,0.00023088537,0.0005890183,0.00055392546,0.00485545],"genre_scores_gemma":[0.09182772,0.0010003134,0.8978035,0.0003622988,0.00006354399,0.00075261167,0.0034282813,0.00020189713,0.0045598214],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.9968166,0.0007334676,0.0005865835,0.0006079442,0.0009927611,0.00026278495],"domain_scores_gemma":[0.99827385,0.00029018705,0.00020127391,0.00042138717,0.0006150241,0.00019834212],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0041376385,0.00072098884,0.000751893,0.0029657942,0.0016474004,0.008265514,0.0037402571,0.0020417084,0.0021101085],"category_scores_gemma":[0.0039305952,0.00089295243,0.0022959034,0.004759428,0.0021501102,0.009164949,0.004027123,0.0021734505,0.0011693215],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.000054338463,0.000089678826,0.0010626564,0.00029930737,0.00006569709,0.0007158054,0.0016900524,0.035131816,0.0027485853,0.92655975,0.004092056,0.02749016],"study_design_scores_gemma":[0.0000597835,0.000105984094,0.00055332656,0.00035247448,0.00013257061,0.0011588593,0.0021340842,0.34117103,0.006265269,0.43295777,0.21501149,0.00009738167],"about_ca_topic_score_codex":0.009800623,"about_ca_topic_score_gemma":0.007444267,"teacher_disagreement_score":0.009800623,"about_ca_system_score_codex":0.0027187816,"about_ca_system_score_gemma":0.005455113,"threshold_uncertainty_score":0.021882176},"labels":[],"label_agreement":null},{"id":"W3127102899","doi":"10.4018/ijdwm.2021010103","title":"Scalable Biclustering Algorithm Considers the Presence or Absence of Properties","year":2021,"lang":"en","type":"article","venue":"International Journal of Data Warehousing and Mining","topic":"Gene expression and cancer classification","field":"Biochemistry, Genetics and Molecular Biology","cited_by":3,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Statistics Canada","funders":"","keywords":"Biclustering; Computer science; Scalability; Context (archaeology); Set (abstract data type); Exploit; Data mining; Matrix (chemical analysis); Binary number; Homogeneous; Column (typography); Algorithm; Theoretical computer science; Cluster analysis; Artificial intelligence; Database; Mathematics","score_opus":0.0837448108144359,"score_gpt":0.3264471138996301,"score_spread":0.2427023030851942,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W3127102899","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.022410803,0.00022593435,0.97450745,0.00014135212,0.000034063778,0.00012347625,0.00020575029,0.0014126244,0.0009386208],"genre_scores_gemma":[0.21353555,0.0002596978,0.78311914,0.00016666451,0.000046523346,0.00034644836,0.0012330282,0.0002118246,0.0010811252],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9985286,0.00032747447,0.00015309636,0.0004828851,0.00038759838,0.00012042231],"domain_scores_gemma":[0.9968604,0.0015225286,0.00024591997,0.0005083025,0.000784484,0.00007850224],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0014707973,0.0011202627,0.001758818,0.0019915777,0.0009942737,0.0010590315,0.0013676442,0.0009566862,0.0020785152],"category_scores_gemma":[0.0060268114,0.0005636281,0.0011198812,0.0023064492,0.0008357729,0.0014211986,0.0015679671,0.0010649617,0.0010791683],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0006466922,0.00025554118,0.012664731,0.0005879676,0.00042411694,0.0005220632,0.0005622807,0.2966097,0.041775197,0.015945718,0.009269721,0.62073636],"study_design_scores_gemma":[0.000049007824,0.00011329214,0.0012906636,0.00004172072,0.000057340505,0.00038737207,0.00017777809,0.9705866,0.0074930475,0.017147357,0.002620942,0.000034831184],"about_ca_topic_score_codex":0.0022510288,"about_ca_topic_score_gemma":0.0026340843,"teacher_disagreement_score":0.0022510288,"about_ca_system_score_codex":0.0003673983,"about_ca_system_score_gemma":0.0013947955,"threshold_uncertainty_score":0.0077784657},"labels":[],"label_agreement":null},{"id":"W4294982430","doi":"10.4018/ijdwm.309957","title":"A Stock Trading Expert System Established by the CNN-GA-Based Collaborative System","year":2022,"lang":"en","type":"article","venue":"International Journal of Data Warehousing and Mining","topic":"Stock Market Forecasting Methods","field":"Decision Sciences","cited_by":2,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Brandon University","funders":"Natural Science Foundation of Shandong Province","keywords":"Computer science; Futures contract; Stock (firearms); Convolutional neural network; Stock exchange; Stock market; Artificial intelligence; Data mining; Finance; Business","score_opus":0.17586435733785302,"score_gpt":0.4223358107247798,"score_spread":0.2464714533869268,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4294982430","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.110444546,0.0006894984,0.8417566,0.00043403608,0.00036245867,0.0007948894,0.0014624158,0.021381922,0.022673542],"genre_scores_gemma":[0.6827581,0.0003172091,0.29486293,0.00038571024,0.000072729265,0.0004662948,0.001978636,0.00020063564,0.018957807],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9992495,0.000056725057,0.00007245628,0.00031194443,0.00020841106,0.0001009423],"domain_scores_gemma":[0.99954057,0.000074293705,0.000039930037,0.000068259265,0.00023945232,0.00003754337],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0007908861,0.00090150733,0.00075427553,0.0012314838,0.0006211705,0.0009895802,0.0013878088,0.001216257,0.0058816266],"category_scores_gemma":[0.0016856864,0.0003623031,0.0006906573,0.00073565484,0.00026132233,0.0011657269,0.00067841087,0.00067192654,0.0015079913],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.000538703,0.000524003,0.008880103,0.0002568749,0.00030178844,0.0007695711,0.00015538547,0.18320914,0.029305074,0.005051611,0.015764793,0.755243],"study_design_scores_gemma":[0.000039886774,0.00006745548,0.0017510226,0.000014890249,0.00005504275,0.00012210755,0.000020401627,0.9822245,0.010282252,0.0010552503,0.004341194,0.00002593683],"about_ca_topic_score_codex":0.02338402,"about_ca_topic_score_gemma":0.021946283,"teacher_disagreement_score":0.02338402,"about_ca_system_score_codex":0.0012045893,"about_ca_system_score_gemma":0.0015168166,"threshold_uncertainty_score":0.046495855},"labels":[],"label_agreement":null},{"id":"W4319991217","doi":"10.4018/ijdwm.316150","title":"Top-K Pseudo Labeling for Semi-Supervised Image Classification","year":2022,"lang":"en","type":"article","venue":"International Journal of Data Warehousing and Mining","topic":"Machine Learning and Data Classification","field":"Computer Science","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"","funders":"Canadian Institute for Advanced Research","keywords":"Computer science; Artificial intelligence; Artificial neural network; Machine learning; Key (lock); Semi-supervised learning; Supervised learning; Set (abstract data type); Pattern recognition (psychology); Labeled data; Training set; Convergence (economics); Data mining","score_opus":0.07460392936922271,"score_gpt":0.34534800968852597,"score_spread":0.27074408031930325,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4319991217","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.006161376,0.00020331502,0.99052423,0.00010122175,0.000049182865,0.00008597988,0.0000857398,0.001808724,0.0009802757],"genre_scores_gemma":[0.28762236,0.00025320385,0.7068141,0.00038341447,0.00013160317,0.00048023302,0.0011633199,0.0005503447,0.0026012799],"study_design_codex":"design_other","study_design_gemma":"bench_or_experimental","domain_scores_codex":[0.99557143,0.0016159825,0.00028194793,0.0010914678,0.0011897964,0.0002493222],"domain_scores_gemma":[0.9939873,0.0017003104,0.0005779076,0.0018144404,0.0017596585,0.0001603878],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.002455962,0.0011029142,0.0013367115,0.0016042709,0.0015283709,0.001627731,0.0027605037,0.0018954914,0.002383179],"category_scores_gemma":[0.0072151516,0.00059851044,0.0011430053,0.0015010672,0.0017452419,0.0030209178,0.0013862475,0.0020661643,0.0017934247],"study_design_candidate":"bench_or_experimental","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0005924343,0.00033203664,0.0027728747,0.00053519814,0.00016321897,0.0002583414,0.0006384652,0.14376166,0.034712277,0.030071134,0.015593,0.7705693],"study_design_scores_gemma":[0.000020018077,0.00009422765,0.0004397944,0.000029115996,0.00002496694,0.00017424207,0.000054711898,0.96121347,0.0151014635,0.018675063,0.004133437,0.00003956849],"about_ca_topic_score_codex":0.0021019783,"about_ca_topic_score_gemma":0.0026962634,"teacher_disagreement_score":0.0027605037,"about_ca_system_score_codex":0.0013697501,"about_ca_system_score_gemma":0.0015144777,"threshold_uncertainty_score":0.012988567},"labels":[],"label_agreement":null}]}