{"meta":{"query_hash":"4d1828cd258b","filters":{"venue":"Wiley Interdisciplinary Reviews Data Mining and Knowledge Discovery"},"cohort_total":18,"direct_labels_cover":0,"predictions_cover":18,"exported":18,"export_cap":100000,"truncated":false,"label_status":"direct model label, unvalidated","prediction_status":"machine_predicted_unvalidated (Codex and Gemma teacher distillation)","score_status":"score_only:v0-immature-baseline","snapshot":{"source":"OpenAlex, pinned release, all 482 partitions","release":"2026-06-24","frame_built":"2026-07-12"},"permalink":"https://metacan.xera.ac/q/4d1828cd258b","api":"https://metacan.xera.ac/api/v1/cohort?venue=Wiley+Interdisciplinary+Reviews+Data+Mining+and+Knowledge+Discovery"},"results":[{"id":"W1574923366","doi":"10.1002/widm.1112","title":"Self‐organizing maps for latent semantic analysis of free‐form text in support of public policy analysis","year":2013,"lang":"en","type":"article","venue":"Wiley Interdisciplinary Reviews Data Mining and Knowledge Discovery","topic":"Complex Network Analysis Techniques","field":"Physics and Astronomy","cited_by":6,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Victoria","funders":"Mitacs; University of Victoria","keywords":"Computer science; Cluster analysis; Information retrieval; Unstructured data; Latent semantic analysis; Context (archaeology); Topic model; Document clustering; Natural language processing; Artificial intelligence; Big data; Data mining","score_opus":0.05294647992264497,"score_gpt":0.3458112725074737,"score_spread":0.2928647925848287,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W1574923366","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0077968887,0.0002103015,0.98975337,0.00025945422,0.0000335144,0.00007662829,0.0003172146,0.00081632216,0.000736207],"genre_scores_gemma":[0.25455588,0.00046449137,0.739115,0.00014643367,0.00018359892,0.0007006256,0.002145608,0.0003424056,0.0023458463],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.99791986,0.0009841796,0.00013045198,0.0003624287,0.00047621477,0.00012679814],"domain_scores_gemma":[0.9911465,0.006623557,0.00057036424,0.00064578914,0.0008753123,0.00013851104],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0029195857,0.00086801196,0.00092180376,0.0047229575,0.001189353,0.0025529384,0.0016850934,0.0012088335,0.0024903824],"category_scores_gemma":[0.016132433,0.00052595144,0.0014613763,0.0036636512,0.0013072254,0.0028407031,0.0023471809,0.0019689118,0.0015004328],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0003227226,0.00022906491,0.005114338,0.00045443783,0.0002785299,0.00034878516,0.0015487385,0.35714954,0.004159722,0.13196927,0.013914298,0.48451054],"study_design_scores_gemma":[0.000009952957,0.00001321477,0.00058556476,0.000019296078,0.000012231633,0.000033387027,0.00016537638,0.8994825,0.0010297756,0.09638742,0.0022440078,0.000017252429],"about_ca_topic_score_codex":0.004308277,"about_ca_topic_score_gemma":0.00451024,"teacher_disagreement_score":0.0047229575,"about_ca_system_score_codex":0.0014010906,"about_ca_system_score_gemma":0.0016167846,"threshold_uncertainty_score":0.015440404},"labels":[],"label_agreement":null},{"id":"W1903799253","doi":"10.1002/widm.1094","title":"Bayesian treed response surface models","year":2013,"lang":"en","type":"article","venue":"Wiley Interdisciplinary Reviews Data Mining and Knowledge Discovery","topic":"Statistical Methods and Bayesian Inference","field":"Mathematics","cited_by":13,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Acadia University","funders":"","keywords":"Computer science; Machine learning; Bayesian probability; Artificial intelligence; Model selection; Bayesian linear regression; Tree (set theory); Inference; Gaussian process; Bayesian inference; Data mining; Mathematics; Gaussian","score_opus":0.16156548228287826,"score_gpt":0.4164045060676965,"score_spread":0.25483902378481826,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W1903799253","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.006359495,0.0014536913,0.982969,0.00093614485,0.00010398847,0.00007087347,0.0012488521,0.0004472145,0.0064107585],"genre_scores_gemma":[0.50743,0.0077119893,0.4391696,0.0013570874,0.00054918,0.0014446472,0.0044153496,0.0005840433,0.03733817],"study_design_codex":"simulation_or_modeling","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.9972204,0.0013817272,0.000113422866,0.00048766405,0.00062383234,0.00017293025],"domain_scores_gemma":[0.99522567,0.003394727,0.0004057684,0.00025568265,0.00059890386,0.00011920584],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.004411372,0.0010606373,0.0021374961,0.0014666268,0.00044723804,0.0024019354,0.0030667242,0.0028192098,0.009895732],"category_scores_gemma":[0.0161201,0.0008434252,0.0016215421,0.0022662329,0.0010017686,0.0021860383,0.001405913,0.0020819937,0.0030782276],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00008333032,0.000046884164,0.0016733223,0.00026474704,0.00015605522,0.000094070754,0.00014532995,0.5349441,0.0005862385,0.40345362,0.008120726,0.050431557],"study_design_scores_gemma":[0.0000188992,0.000015936714,0.00031128636,0.00003555292,0.000024477891,0.00003491158,0.000014050506,0.8518364,0.00007658805,0.14246926,0.005141771,0.000020835942],"about_ca_topic_score_codex":0.0059319045,"about_ca_topic_score_gemma":0.004536224,"teacher_disagreement_score":0.009895732,"about_ca_system_score_codex":0.001197307,"about_ca_system_score_gemma":0.0012111628,"threshold_uncertainty_score":0.03310454},"labels":[],"label_agreement":null},{"id":"W1963913493","doi":"10.1002/widm.22","title":"Ensembles of case‐based reasoning classifiers in high‐dimensional biological domains","year":2011,"lang":"en","type":"article","venue":"Wiley Interdisciplinary Reviews Data Mining and Knowledge Discovery","topic":"AI-based Problem Solving and Planning","field":"Computer Science","cited_by":1,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Discovery Centre; Ontario Institute for Cancer Research","funders":"","keywords":"Classifier (UML); Computer science; Artificial intelligence; Disjoint sets; Case-based reasoning; Random subspace method; Cluster analysis; Machine learning; Cascading classifiers; Ensemble learning; Feature selection; Data mining; Pattern recognition (psychology); Mathematics","score_opus":0.1307819076493614,"score_gpt":0.33222079092292583,"score_spread":0.20143888327356443,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W1963913493","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.08676454,0.0011249082,0.90664804,0.00075160596,0.00007407505,0.00022556512,0.00032770008,0.0008832562,0.0032003399],"genre_scores_gemma":[0.5797074,0.0005122118,0.41730937,0.0002191988,0.00009545141,0.0002757133,0.0009061655,0.00005025084,0.0009242557],"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9961779,0.0015328368,0.000367865,0.0006443143,0.0010678283,0.0002091906],"domain_scores_gemma":[0.982419,0.012437891,0.0010824881,0.0017686584,0.0018624774,0.00042941587],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.008395516,0.0007739135,0.0014208549,0.0042348476,0.0008543211,0.0022032002,0.0020381527,0.0012003862,0.0018849344],"category_scores_gemma":[0.021508759,0.00045837407,0.0013050042,0.0034703494,0.00087068387,0.0027998697,0.0023597155,0.0014734897,0.0004407812],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00019341473,0.00033591426,0.016406957,0.0002127483,0.00042372601,0.0003748241,0.00048756337,0.5304404,0.0020268387,0.017177716,0.003582752,0.42833716],"study_design_scores_gemma":[0.000015464633,0.00003229642,0.0013353305,0.000032990618,0.00005706507,0.00007029962,0.00006457304,0.9721262,0.0009510477,0.02386036,0.0014386169,0.000015661199],"about_ca_topic_score_codex":0.004370361,"about_ca_topic_score_gemma":0.004685128,"teacher_disagreement_score":0.008395516,"about_ca_system_score_codex":0.0013282025,"about_ca_system_score_gemma":0.001117329,"threshold_uncertainty_score":0.044400275},"labels":[],"label_agreement":null},{"id":"W1980062933","doi":"10.1002/widm.1047","title":"Machine learning methods for predicting tumor response in lung cancer","year":2012,"lang":"en","type":"article","venue":"Wiley Interdisciplinary Reviews Data Mining and Knowledge Discovery","topic":"Lung Cancer Treatments and Mutations","field":"Medicine","cited_by":21,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"McGill University","funders":"","keywords":"Radiation therapy; Lung cancer; Medicine; Cancer; Personalization; Treatment of lung cancer; Radiation treatment planning; Intensive care medicine; Oncology; Bioinformatics; Internal medicine; Computer science; Biology","score_opus":0.07363155616305792,"score_gpt":0.4794801865354944,"score_spread":0.40584863037243646,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W1980062933","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.09847089,0.008735287,0.882654,0.0033298796,0.00026978418,0.0003326437,0.0015073867,0.0012025374,0.0034975153],"genre_scores_gemma":[0.81537735,0.002175735,0.1771834,0.00044486785,0.00037487,0.0004826819,0.0018297929,0.00006741039,0.002063831],"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9985713,0.0007072975,0.00014978937,0.00023079278,0.00026184018,0.00007901019],"domain_scores_gemma":[0.98996454,0.008491483,0.00068083685,0.0002336962,0.0005227779,0.00010663119],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0038692881,0.0006761898,0.0009827357,0.0027686567,0.0003162855,0.0011416554,0.0010207021,0.0012717515,0.0011911688],"category_scores_gemma":[0.014103313,0.0002501648,0.00080247043,0.0017081698,0.0005014232,0.00069216924,0.000628347,0.0014885879,0.0005801561],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00016986308,0.00022828861,0.031140748,0.00023775597,0.0002073078,0.00014609189,0.00005043103,0.7214701,0.00083400647,0.0053792302,0.0031494051,0.23698679],"study_design_scores_gemma":[0.0000069521057,0.0000252166,0.0010910637,0.000018906794,0.000009131036,0.000028203032,0.00000937067,0.99261063,0.00023140151,0.0055820155,0.000381553,0.0000055800933],"about_ca_topic_score_codex":0.0036351006,"about_ca_topic_score_gemma":0.0019343237,"teacher_disagreement_score":0.0038692881,"about_ca_system_score_codex":0.00087464973,"about_ca_system_score_gemma":0.0009574814,"threshold_uncertainty_score":0.02046305},"labels":[],"label_agreement":null},{"id":"W1987111416","doi":"10.1002/widm.30","title":"Density‐based clustering","year":2011,"lang":"en","type":"article","venue":"Wiley Interdisciplinary Reviews Data Mining and Knowledge Discovery","topic":"Advanced Clustering Algorithms Research","field":"Computer Science","cited_by":810,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Alberta","funders":"","keywords":"Cluster analysis; Outlier; Data set; Computer science; Data mining; Cluster (spacecraft); Set (abstract data type); Single-linkage clustering; DBSCAN; Pattern recognition (psychology); Correlation clustering; CURE data clustering algorithm; Artificial intelligence","score_opus":0.15651942522856147,"score_gpt":0.37289851207918545,"score_spread":0.216379086850624,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W1987111416","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0060664024,0.002601064,0.97213453,0.000663111,0.00022460337,0.00034320817,0.0015029783,0.0016075409,0.014856623],"genre_scores_gemma":[0.30667707,0.0058786785,0.65727484,0.00065458927,0.00049744034,0.00077690487,0.009142983,0.0010073734,0.018090159],"study_design_codex":"design_other","study_design_gemma":"not_applicable","domain_scores_codex":[0.99501246,0.0011331846,0.0002726587,0.0011418659,0.0021684736,0.00027127058],"domain_scores_gemma":[0.9942855,0.0018765172,0.00047513025,0.0012324377,0.0019745734,0.00015582213],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0034005304,0.0014905431,0.0020547162,0.008395691,0.0020712565,0.004955584,0.0031010837,0.0023518149,0.008533414],"category_scores_gemma":[0.017203083,0.0009357687,0.0018201969,0.009168972,0.0017023634,0.0035161148,0.0035317,0.0018224838,0.0066979406],"study_design_candidate":"not_applicable","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00023933119,0.00012533936,0.007886333,0.0011763432,0.0005308698,0.00031956765,0.00094165123,0.26438347,0.0048684445,0.28152376,0.061402865,0.37660202],"study_design_scores_gemma":[0.000039690352,0.00006405476,0.0037962047,0.00029913202,0.0001236625,0.00066472864,0.00038614453,0.6702391,0.0060344557,0.22271296,0.095447265,0.00019260378],"about_ca_topic_score_codex":0.008082308,"about_ca_topic_score_gemma":0.0049816337,"teacher_disagreement_score":0.008533414,"about_ca_system_score_codex":0.0027955754,"about_ca_system_score_gemma":0.0026942843,"threshold_uncertainty_score":0.028547108},"labels":[],"label_agreement":null},{"id":"W1994891592","doi":"10.1002/widm.31","title":"Mining uncertain data","year":2011,"lang":"en","type":"article","venue":"Wiley Interdisciplinary Reviews Data Mining and Knowledge Discovery","topic":"Data Mining Algorithms and Applications","field":"Computer Science","cited_by":59,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Manitoba","funders":"","keywords":"Association rule learning; Key (lock); Affinity analysis; Computer science; Uncertain data; Data mining; Associative property; Probabilistic logic; Database transaction; K-optimal pattern discovery; Task (project management); Process (computing); Knowledge extraction; Data science; Artificial intelligence; Database; Engineering; Mathematics","score_opus":0.2056452550767086,"score_gpt":0.37378523516306994,"score_spread":0.16813998008636133,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W1994891592","genre_codex":"methods","genre_gemma":"review","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"review","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.033491127,0.005203449,0.9452413,0.0053331433,0.00037889488,0.00028344296,0.0027442474,0.0004718639,0.0068524973],"genre_scores_gemma":[0.46142554,0.0063874973,0.517343,0.0014097461,0.0011626625,0.0006141305,0.008703843,0.00013785051,0.0028157681],"study_design_codex":"design_other","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.9872169,0.0033751607,0.0015692512,0.002289065,0.0050877645,0.0004618657],"domain_scores_gemma":[0.9706661,0.019318221,0.0027242738,0.0040086317,0.002855115,0.0004277183],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.007411716,0.0010689542,0.0022493857,0.0047208867,0.0015737946,0.0061303736,0.003655455,0.002234155,0.0029698296],"category_scores_gemma":[0.049195297,0.00097513164,0.0020105164,0.00725071,0.0022057153,0.00996181,0.0055826483,0.0024400975,0.0010845761],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00045024877,0.00021504181,0.025995774,0.0024807367,0.001015943,0.004182295,0.0015904295,0.22137447,0.0026357966,0.2967042,0.01889362,0.42446136],"study_design_scores_gemma":[0.000043194745,0.00008939214,0.0019380514,0.00045797002,0.00014757218,0.0012574709,0.0006828505,0.47329903,0.0025219023,0.48571372,0.03377276,0.000076095756],"about_ca_topic_score_codex":0.0013670269,"about_ca_topic_score_gemma":0.0012582655,"teacher_disagreement_score":0.007411716,"about_ca_system_score_codex":0.00095319655,"about_ca_system_score_gemma":0.0013105945,"threshold_uncertainty_score":0.039197385},"labels":[],"label_agreement":null},{"id":"W2026082078","doi":"10.1002/widm.17","title":"Introducing WIREs Data Mining and Knowledge Discovery","year":2011,"lang":"en","type":"article","venue":"Wiley Interdisciplinary Reviews Data Mining and Knowledge Discovery","topic":"Bioinformatics and Genomic Networks","field":"Biochemistry, Genetics and Molecular Biology","cited_by":8,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Alberta","funders":"","keywords":"Knowledge extraction; Cluster analysis; Data science; Computer science; Data mining; Data stream mining; Artificial intelligence","score_opus":0.07684688907758393,"score_gpt":0.32811955453709646,"score_spread":0.25127266545951255,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2026082078","genre_codex":"methods","genre_gemma":"editorial","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"editorial","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0014986992,0.0014386016,0.9780011,0.005878421,0.00081769563,0.000080800004,0.0005120924,0.0011834687,0.010589234],"genre_scores_gemma":[0.063039936,0.0055684247,0.9019418,0.0030370548,0.0012510247,0.00053222175,0.0016663427,0.00072037894,0.022242803],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"not_applicable","domain_scores_codex":[0.9957646,0.0010971375,0.00049193815,0.0008445581,0.0016250138,0.00017667683],"domain_scores_gemma":[0.98922473,0.0062720827,0.0005519057,0.0022600028,0.0013654925,0.0003258499],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0053562727,0.0008949119,0.000981005,0.004822283,0.001131379,0.006608853,0.0023367328,0.0015724495,0.0096228495],"category_scores_gemma":[0.018154504,0.00086996367,0.0016139692,0.0064191124,0.003444727,0.011456786,0.006290936,0.0038550943,0.0039296993],"study_design_candidate":"not_applicable","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.000023520905,0.000026662872,0.00046779113,0.00018831724,0.000048339007,0.0000960111,0.000114908056,0.0038425436,0.00036563212,0.8946285,0.009775016,0.090422735],"study_design_scores_gemma":[0.000009452133,0.000009798985,0.0001026657,0.0001125274,0.000029050214,0.00011286357,0.000065974724,0.03031309,0.0009259302,0.859305,0.1089987,0.000014834766],"about_ca_topic_score_codex":0.0012911754,"about_ca_topic_score_gemma":0.00097578083,"teacher_disagreement_score":0.0096228495,"about_ca_system_score_codex":0.0012399117,"about_ca_system_score_gemma":0.0022985449,"threshold_uncertainty_score":0.032191634},"labels":[],"label_agreement":null},{"id":"W2069255081","doi":"10.1002/widm.40","title":"Fuzzy association rule mining framework and its application to effective fuzzy associative classification","year":2011,"lang":"en","type":"article","venue":"Wiley Interdisciplinary Reviews Data Mining and Knowledge Discovery","topic":"Data Mining Algorithms and Applications","field":"Computer Science","cited_by":24,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Calgary; Western University","funders":"","keywords":"Association rule learning; Data mining; Fuzzy classification; Artificial intelligence; Fuzzy set operations; Fuzzy logic; Computer science; Neuro-fuzzy; Defuzzification; Machine learning; Fuzzy rule; Fuzzy set; Classifier (UML); Fuzzy number; Fuzzy clustering; Pattern recognition (psychology); Fuzzy control system","score_opus":0.06305845491350742,"score_gpt":0.3417930014364239,"score_spread":0.27873454652291646,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2069255081","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.00776189,0.00050219643,0.98987234,0.00018413014,0.000036136174,0.00007199076,0.000036277233,0.00013094231,0.0014041053],"genre_scores_gemma":[0.22393078,0.0005188477,0.77381456,0.00009996346,0.000102726706,0.00020329357,0.00014496101,0.000025280555,0.0011596158],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9966456,0.0011488666,0.00028863433,0.00049190054,0.0012842031,0.00014077032],"domain_scores_gemma":[0.9973477,0.0013028343,0.00022757343,0.00017404852,0.0008675726,0.000080278485],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.004993999,0.0006029322,0.0011087486,0.0031820978,0.0010270479,0.001650505,0.0016151344,0.0009727199,0.0016694806],"category_scores_gemma":[0.0081509845,0.0002921155,0.0011942409,0.0026810393,0.0011465352,0.001696626,0.0011238283,0.001072831,0.00043466347],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00013409306,0.0002909097,0.0031379259,0.0003057903,0.00021077147,0.0006918834,0.0006837372,0.26260164,0.0052158805,0.32253385,0.0034952855,0.40069827],"study_design_scores_gemma":[0.000009295232,0.000032134296,0.00026713655,0.00002443257,0.00002318417,0.00010439461,0.000032242624,0.95720637,0.0011329923,0.038270917,0.002882792,0.000014083369],"about_ca_topic_score_codex":0.004776614,"about_ca_topic_score_gemma":0.0026739964,"teacher_disagreement_score":0.004993999,"about_ca_system_score_codex":0.0009465434,"about_ca_system_score_gemma":0.0015102884,"threshold_uncertainty_score":0.026411116},"labels":[],"label_agreement":null},{"id":"W2130674512","doi":"10.1002/widm.1131","title":"Biomedical informatics and panomics for evidence‐based radiation therapy","year":2014,"lang":"en","type":"article","venue":"Wiley Interdisciplinary Reviews Data Mining and Knowledge Discovery","topic":"Radiomics and Machine Learning in Medical Imaging","field":"Medicine","cited_by":18,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"McGill University","funders":"Canadian Institutes of Health Research","keywords":"Informatics; Translational bioinformatics; Radiation therapy; Health informatics; Computer science; Medical physics; Data science; Personalized medicine; Precision medicine; Interface (matter); Bioinformatics; Translational research informatics; Radiation oncology; Systems biology; Health informatics tools; Medicine; Genomics; Engineering informatics; Pathology; Biology; Genome; Internal medicine","score_opus":0.08553935413831011,"score_gpt":0.39373271732820714,"score_spread":0.30819336318989704,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2130674512","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0036328482,0.30371273,0.50962365,0.14172983,0.0031258042,0.0004183598,0.0017554092,0.0013415363,0.03465979],"genre_scores_gemma":[0.06828666,0.34386238,0.55566245,0.017955543,0.006737553,0.0008273524,0.0021027261,0.0003689479,0.00419632],"study_design_codex":"design_other","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.9940578,0.0029519952,0.0005437644,0.0005955394,0.0017288956,0.00012195952],"domain_scores_gemma":[0.97243553,0.021766506,0.0013269306,0.0022256656,0.00177189,0.00047349188],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.012653798,0.00086454686,0.0012126381,0.0054489104,0.0006435016,0.00674095,0.0019019844,0.0028427327,0.005138141],"category_scores_gemma":[0.025855293,0.00053870835,0.001193762,0.00840656,0.004406961,0.009034151,0.0039791865,0.0060285567,0.0020417531],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.000052785006,0.000079115154,0.0024704845,0.0034247248,0.00016269783,0.0001526415,0.00027510367,0.0038607654,0.0008463419,0.4708263,0.039844755,0.47800434],"study_design_scores_gemma":[0.000015850024,0.000048907816,0.0019370137,0.0032606875,0.00006127684,0.00034587708,0.00032627466,0.011271091,0.00078954216,0.665331,0.31656888,0.00004352449],"about_ca_topic_score_codex":0.0011580653,"about_ca_topic_score_gemma":0.000985426,"teacher_disagreement_score":0.012653798,"about_ca_system_score_codex":0.002761889,"about_ca_system_score_gemma":0.0043188566,"threshold_uncertainty_score":0.06692046},"labels":[],"label_agreement":null},{"id":"W2131550814","doi":"10.1002/widm.1068","title":"Reverse engineering of gene regulatory networks from biological data","year":2012,"lang":"en","type":"article","venue":"Wiley Interdisciplinary Reviews Data Mining and Knowledge Discovery","topic":"Gene Regulatory Network Analysis","field":"Biochemistry, Genetics and Molecular Biology","cited_by":14,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Saskatchewan","funders":"","keywords":"Biological network; Gene regulatory network; Biological data; Reverse engineering; Computer science; Inference; Network topology; Data mining; Data science; Machine learning; Artificial intelligence; Computational biology; Biology; Bioinformatics; Gene","score_opus":0.06458627543732233,"score_gpt":0.3164829617760331,"score_spread":0.25189668633871076,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2131550814","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.025900863,0.00031981862,0.9714039,0.0003552261,0.000032683995,0.000092943206,0.00040755412,0.00067548366,0.00081158284],"genre_scores_gemma":[0.24503785,0.00086462346,0.75051737,0.00016983929,0.000056170204,0.00016534944,0.0022488285,0.000091028836,0.00084893446],"study_design_codex":"design_other","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.9980458,0.00081355474,0.00012154737,0.0003611427,0.00059626956,0.00006153016],"domain_scores_gemma":[0.9891306,0.007849708,0.00078106753,0.001482859,0.00068656635,0.00006916078],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0030837508,0.0004823913,0.00053090183,0.0023702357,0.0003313026,0.0012247826,0.0010215772,0.00051985536,0.0010193352],"category_scores_gemma":[0.017982537,0.0002990527,0.0012024627,0.0017130157,0.0008753513,0.0011335803,0.0013466342,0.0013491092,0.00046404207],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0002051023,0.00019803054,0.014101622,0.00089543534,0.00030143143,0.00083011633,0.00037293156,0.32862353,0.02526834,0.10372253,0.002652795,0.52282816],"study_design_scores_gemma":[0.000015796631,0.000031283118,0.0010816441,0.00006432563,0.000043020154,0.00026289004,0.00008560999,0.8821526,0.01808341,0.093023404,0.0051398487,0.000016129174],"about_ca_topic_score_codex":0.0012294978,"about_ca_topic_score_gemma":0.0014331609,"teacher_disagreement_score":0.0030837508,"about_ca_system_score_codex":0.0005465035,"about_ca_system_score_gemma":0.0010233476,"threshold_uncertainty_score":0.016308606},"labels":[],"label_agreement":null},{"id":"W3045868447","doi":"10.1002/widm.1383","title":"Predicting disease‐associated genes: Computational methods, databases, and evaluations","year":2020,"lang":"en","type":"article","venue":"Wiley Interdisciplinary Reviews Data Mining and Knowledge Discovery","topic":"Bioinformatics and Genomic Networks","field":"Biochemistry, Genetics and Molecular Biology","cited_by":6,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Saskatchewan; Princess Margaret Cancer Centre; University Health Network","funders":"Natural Sciences and Engineering Research Council of Canada; China Scholarship Council","keywords":"Identification (biology); Computer science; Computational model; Focus (optics); Machine learning; Data science; Set (abstract data type); Point (geometry); Biological data; Modelling biological systems; Artificial intelligence; Bioinformatics; Systems biology; Biology","score_opus":0.09762632397675337,"score_gpt":0.40110903499238115,"score_spread":0.3034827110156278,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W3045868447","genre_codex":"methods","genre_gemma":"review","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"review","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.21036935,0.09829155,0.6346725,0.008089847,0.0012214634,0.0014865613,0.021783268,0.006466387,0.017618949],"genre_scores_gemma":[0.5820759,0.026745634,0.37024358,0.0009870613,0.00037618287,0.0016040215,0.016082035,0.00025437097,0.0016311678],"study_design_codex":"design_other","study_design_gemma":"systematic_review","domain_scores_codex":[0.9960259,0.0017409598,0.0003938599,0.0005001657,0.0012404781,0.000098640456],"domain_scores_gemma":[0.98074716,0.016205383,0.00046996903,0.0007399015,0.001613761,0.00022374882],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.009956671,0.0010982659,0.0017132481,0.00463331,0.0004767026,0.0028775325,0.0019839874,0.001189332,0.0026408439],"category_scores_gemma":[0.028162409,0.0003245129,0.0009871728,0.00677867,0.00060265185,0.002015416,0.0011106705,0.0011757106,0.0007218015],"study_design_candidate":"systematic_review","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0008930206,0.0007139686,0.03321322,0.0030188265,0.0012112455,0.00023212173,0.00008977409,0.33835164,0.00093472196,0.0215638,0.026312748,0.57346493],"study_design_scores_gemma":[0.00015623598,0.00014811875,0.0030560903,0.00031526122,0.0002330386,0.00013275252,0.00007037804,0.96561027,0.0013166072,0.022987274,0.0059378645,0.00003603173],"about_ca_topic_score_codex":0.008161902,"about_ca_topic_score_gemma":0.0045151305,"teacher_disagreement_score":0.009956671,"about_ca_system_score_codex":0.0013946487,"about_ca_system_score_gemma":0.0021911405,"threshold_uncertainty_score":0.05265653},"labels":[],"label_agreement":null},{"id":"W3082381194","doi":"10.1002/widm.1388","title":"Smart city and resilient city: Differences and connections","year":2020,"lang":"en","type":"article","venue":"Wiley Interdisciplinary Reviews Data Mining and Knowledge Discovery","topic":"Smart Cities and Technologies","field":"Engineering","cited_by":62,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of British Columbia","funders":"National Key Research and Development Program of China; China Scholarship Council","keywords":"Smart city; Computer science; Hazard; Focus (optics); Urban planning; Architectural engineering; Data science; Sociology; Regional science; Civil engineering; Computer security; Internet of Things; Engineering","score_opus":0.09336277250994358,"score_gpt":0.3048798354911904,"score_spread":0.21151706298124684,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W3082381194","genre_codex":"review","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.24740274,0.5209466,0.022175806,0.0465969,0.0014183738,0.00018203414,0.0012512546,0.00011163291,0.15991464],"genre_scores_gemma":[0.88268155,0.10909866,0.0037067502,0.0014939152,0.0003786108,0.000071406226,0.0003116154,0.00002124136,0.0022361751],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.996555,0.0014210504,0.00037611302,0.00045577047,0.0010077861,0.00018437936],"domain_scores_gemma":[0.9883392,0.00842993,0.001210732,0.0003381733,0.0014206527,0.0002613126],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0029896807,0.00026545924,0.0004756056,0.00880732,0.00081696844,0.005548588,0.00048337746,0.00071619893,0.00441311],"category_scores_gemma":[0.009894251,0.00016547044,0.00058041885,0.015121969,0.0042725815,0.0059247017,0.0027174049,0.0011685458,0.0002571741],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00010290496,0.000050423314,0.06100114,0.0112798745,0.0005786362,0.00066045945,0.021743849,0.0013505701,0.0006842849,0.45536652,0.008055318,0.439126],"study_design_scores_gemma":[0.00001769594,0.0001214682,0.17616037,0.016771378,0.0007679685,0.0018401975,0.08277558,0.0023248012,0.0012256487,0.3623749,0.35545033,0.00016961772],"about_ca_topic_score_codex":0.003186981,"about_ca_topic_score_gemma":0.0038352553,"teacher_disagreement_score":0.00880732,"about_ca_system_score_codex":0.0022263986,"about_ca_system_score_gemma":0.0021058435,"threshold_uncertainty_score":0.016153693},"labels":[],"label_agreement":null},{"id":"W3137237563","doi":"10.1002/widm.1436","title":"Blockchain networks: Data structures of Bitcoin, Monero, Zcash, Ethereum, Ripple, and Iota","year":2021,"lang":"en","type":"preprint","venue":"Wiley Interdisciplinary Reviews Data Mining and Knowledge Discovery","topic":"Topological and Geometric Data Analysis","field":"Computer Science","cited_by":5,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Manitoba","funders":"National Science Foundation of Sri Lanka","keywords":"Blockchain; Cryptocurrency; Computer science; Asset (computer security); Popularity; Big data; Data science; Computer security; Data mining","score_opus":0.09912994489545705,"score_gpt":0.35639318000931836,"score_spread":0.2572632351138613,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W3137237563","genre_codex":"methods","genre_gemma":"review","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"review","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.03574146,0.006083803,0.8715752,0.0076541067,0.00068047753,0.0009020487,0.011373315,0.0034215257,0.06256815],"genre_scores_gemma":[0.49333233,0.009468522,0.4344153,0.0017095631,0.00070528727,0.0026007248,0.016951716,0.001026508,0.039790004],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"not_applicable","domain_scores_codex":[0.9975389,0.0007453176,0.00028086163,0.00050890923,0.00072421035,0.00020175142],"domain_scores_gemma":[0.99270236,0.00275108,0.0011553486,0.0020680428,0.00087981555,0.00044327744],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.002397797,0.000813767,0.0009989867,0.004443416,0.003074379,0.008428796,0.0019035155,0.0017122525,0.011924985],"category_scores_gemma":[0.014796108,0.00084034225,0.0009935838,0.007408002,0.0040858476,0.019003808,0.0035970358,0.003061089,0.0028713974],"study_design_candidate":"not_applicable","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.000070906994,0.000028404385,0.0009102594,0.00014505832,0.000018428418,0.00016703788,0.00045327074,0.0071953963,0.00041157496,0.95243615,0.008001956,0.030161588],"study_design_scores_gemma":[0.000019470897,0.000022734193,0.00033312372,0.00017984478,0.000017370457,0.00024523702,0.00019927668,0.034911234,0.0010650335,0.87044436,0.092524335,0.000038018115],"about_ca_topic_score_codex":0.005704311,"about_ca_topic_score_gemma":0.005650478,"teacher_disagreement_score":0.011924985,"about_ca_system_score_codex":0.0024201549,"about_ca_system_score_gemma":0.0027954413,"threshold_uncertainty_score":0.03989303},"labels":[],"label_agreement":null},{"id":"W4234482552","doi":"10.1002/widm.16","title":"Rough clustering","year":2011,"lang":"en","type":"article","venue":"Wiley Interdisciplinary Reviews Data Mining and Knowledge Discovery","topic":"Rough Sets and Fuzzy Logic","field":"Computer Science","cited_by":51,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Saint Mary's University","funders":"","keywords":"Cluster analysis; Rough set; Computer science; Fuzzy clustering; Data mining; Similarity (geometry); Artificial intelligence; Self-organizing map; Set (abstract data type); Pattern recognition (psychology); Image (mathematics)","score_opus":0.15803284078610344,"score_gpt":0.3397054162188211,"score_spread":0.18167257543271767,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4234482552","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.003869543,0.0030023884,0.95098764,0.0008551104,0.0004556856,0.0006035947,0.001589863,0.0014329545,0.037203196],"genre_scores_gemma":[0.15227726,0.004981334,0.8068827,0.0006350449,0.000546474,0.0010946629,0.007618689,0.00058051787,0.02538338],"study_design_codex":"design_other","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.9927666,0.001845651,0.0006339521,0.0013902009,0.003015583,0.00034791185],"domain_scores_gemma":[0.9954502,0.0012194089,0.00038696598,0.0011472172,0.0016888252,0.000107313615],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0045499997,0.0019274161,0.0030731468,0.0072057033,0.0017715177,0.007815208,0.003453179,0.0023622182,0.015409553],"category_scores_gemma":[0.014028912,0.0007834507,0.0029791428,0.007810429,0.001457857,0.003692702,0.0033607923,0.0016689833,0.011339561],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00017449942,0.000071828916,0.0020993368,0.0015587064,0.0005484601,0.0003093874,0.0005268421,0.14612468,0.0023206456,0.2743931,0.070334926,0.5015376],"study_design_scores_gemma":[0.000085292995,0.00011395844,0.0018979096,0.0006224003,0.0002226373,0.000620449,0.00061460026,0.3714744,0.0042178603,0.3701199,0.24984142,0.00016916964],"about_ca_topic_score_codex":0.0037634503,"about_ca_topic_score_gemma":0.0024833882,"teacher_disagreement_score":0.015409553,"about_ca_system_score_codex":0.002504504,"about_ca_system_score_gemma":0.0027746626,"threshold_uncertainty_score":0.05155009},"labels":[],"label_agreement":null},{"id":"W4285781363","doi":"10.1002/widm.1343","title":"Density‐based clustering","year":2019,"lang":"en","type":"article","venue":"Wiley Interdisciplinary Reviews Data Mining and Knowledge Discovery","topic":"Advanced Clustering Algorithms Research","field":"Computer Science","cited_by":116,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Alberta","funders":"","keywords":"Computer science; Cluster analysis; Artificial intelligence","score_opus":0.06673601290054507,"score_gpt":0.3667671650858934,"score_spread":0.30003115218534837,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4285781363","genre_codex":"methods","genre_gemma":"review","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"review","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0040998016,0.0026688452,0.98237497,0.00070114725,0.00016996235,0.00019555364,0.0010053081,0.0009771847,0.0078072967],"genre_scores_gemma":[0.20043573,0.007931127,0.7709983,0.00074840675,0.0005505387,0.0006167406,0.0065507623,0.0009230143,0.011245314],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.99492633,0.0012834019,0.0003007831,0.0012619956,0.0019757403,0.0002517191],"domain_scores_gemma":[0.99357325,0.0022821906,0.00053903507,0.0012189341,0.0022264374,0.00016009365],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0038384811,0.0012923804,0.0022087302,0.0072391215,0.0019355798,0.0052343654,0.0032644598,0.002048587,0.005479062],"category_scores_gemma":[0.016204963,0.00097157236,0.0018768721,0.008456771,0.0020686453,0.004136845,0.0035055035,0.0022255648,0.0045903563],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00014081207,0.000099331286,0.007816515,0.0012927133,0.0005144815,0.00024788562,0.0010633135,0.19869708,0.004724952,0.3514377,0.05352438,0.38044095],"study_design_scores_gemma":[0.000026631833,0.000044436092,0.004098123,0.00037599553,0.00010593246,0.00045592512,0.00046996865,0.58124644,0.004608578,0.31401497,0.094393164,0.00015974484],"about_ca_topic_score_codex":0.008484232,"about_ca_topic_score_gemma":0.0060327016,"teacher_disagreement_score":0.008484232,"about_ca_system_score_codex":0.0031001726,"about_ca_system_score_gemma":0.0029888065,"threshold_uncertainty_score":0.022493422},"labels":[],"label_agreement":null},{"id":"W4388731451","doi":"10.1002/widm.1523","title":"The use of gene expression datasets in feature selection research: 20 years of inherent bias?","year":2023,"lang":"en","type":"article","venue":"Wiley Interdisciplinary Reviews Data Mining and Knowledge Discovery","topic":"Gene expression and cancer classification","field":"Biochemistry, Genetics and Molecular Biology","cited_by":6,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Dalhousie University","funders":"Global Affairs Canada; Fundação de Amparo à Pesquisa do Estado do Rio Grande do Sul; Conselho Nacional de Desenvolvimento Científico e Tecnológico; Coordenação de Aperfeiçoamento de Pessoal de Nível Superior","keywords":"Feature selection; Preprocessor; Computer science; Selection (genetic algorithm); Feature (linguistics); Machine learning; Data mining; DNA microarray; Data pre-processing; Artificial intelligence; Biological data; Data science; Bioinformatics; Gene; Gene expression; Biology; Genetics","score_opus":0.28383519852189343,"score_gpt":0.42745225951905635,"score_spread":0.14361706099716293,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4388731451","genre_codex":"review","genre_gemma":"empirical","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.05007363,0.48090866,0.3949169,0.055115048,0.005388099,0.0002779419,0.0021968877,0.00088179274,0.010241044],"genre_scores_gemma":[0.58344173,0.18941149,0.18528304,0.023175836,0.010099168,0.0013342965,0.0034812253,0.0007568593,0.0030162884],"study_design_codex":"design_other","study_design_gemma":"observational","domain_scores_codex":[0.93750477,0.039603595,0.005695235,0.0053848377,0.0113506885,0.00046081538],"domain_scores_gemma":[0.7410305,0.21555607,0.009212708,0.01416514,0.01948095,0.000554604],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.08791871,0.0007651712,0.0022114653,0.004587166,0.00064643245,0.005796011,0.0022982464,0.0014382477,0.0014880912],"category_scores_gemma":[0.15774393,0.0005574349,0.0013760364,0.010191915,0.0032331957,0.0050536334,0.0022073803,0.0034354792,0.0007311601],"study_design_candidate":"observational","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00035002283,0.000094777344,0.02551744,0.0065072645,0.0021144499,0.00021756721,0.0008527301,0.0052185217,0.002054708,0.0434922,0.025297204,0.8882832],"study_design_scores_gemma":[0.00035694762,0.0009097595,0.06152196,0.016480543,0.0022090361,0.00189454,0.0013821104,0.07083129,0.021237032,0.40930295,0.4132797,0.0005941312],"about_ca_topic_score_codex":0.0013145655,"about_ca_topic_score_gemma":0.0010585432,"teacher_disagreement_score":0.9120813,"about_ca_system_score_codex":0.0021656312,"about_ca_system_score_gemma":0.0018055686,"threshold_uncertainty_score":0.46496415},"labels":[],"label_agreement":null},{"id":"W4396913259","doi":"10.1002/widm.1546","title":"Decoding cognitive health using machine learning: A comprehensive evaluation for diagnosis of significant memory concern","year":2024,"lang":"en","type":"preprint","venue":"Wiley Interdisciplinary Reviews Data Mining and Knowledge Discovery","topic":"Dementia and Cognitive Impairment Research","field":"Medicine","cited_by":15,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Manitoba; Health Sciences Centre","funders":"Science and Engineering Research Board; Canadian Institutes of Health Research; National Institutes of Health; Genentech; IXICO; H. Lundbeck A/S; Servier; Ministry of Electronics and Information technology; Eisai; Department of Science and Technology, Ministry of Science and Technology, India; Pfizer; Novartis Pharmaceuticals Corporation; Council of Scientific and Industrial Research, India; University of Southern California; Biogen; Eli Lilly and Company; Bristol-Myers Squibb; BioClinica; U.S. Department of Defense; Alzheimer's Disease Neuroimaging Initiative; Meso Scale Diagnostics; Alzheimer's Association","keywords":"Support vector machine; Artificial intelligence; Machine learning; Computer science; Neuroimaging; Feature selection; Population; Psychology; Medicine; Psychiatry","score_opus":0.29457584341650345,"score_gpt":0.49571017216395513,"score_spread":0.20113432874745168,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4396913259","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.4783305,0.40505818,0.09527157,0.0055761286,0.00095797185,0.0005061862,0.005640718,0.0012967726,0.0073619857],"genre_scores_gemma":[0.9408675,0.035377104,0.01923432,0.0006948101,0.00048284975,0.00020688414,0.0024642993,0.00003587175,0.0006363747],"study_design_codex":"design_other","study_design_gemma":"observational","domain_scores_codex":[0.9987565,0.0004807124,0.000171694,0.00023863258,0.00030590285,0.00004656721],"domain_scores_gemma":[0.9943153,0.0036458708,0.0003904466,0.00018526678,0.0013320955,0.0001309895],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.003867085,0.0011987792,0.0013023335,0.0022225596,0.00025371066,0.0013282014,0.0009241003,0.0008551409,0.00079292135],"category_scores_gemma":[0.011627276,0.00018906136,0.0012042538,0.0009489183,0.0002593973,0.0008399112,0.0004865899,0.0008811488,0.00025716133],"study_design_candidate":"observational","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0010440651,0.0002676648,0.16620949,0.003475777,0.0028552979,0.00019433233,0.00015257539,0.01729412,0.0012813428,0.0010067695,0.007871879,0.79834664],"study_design_scores_gemma":[0.0003296557,0.00416706,0.23995565,0.0076046716,0.011772387,0.0020382036,0.0007346387,0.6860559,0.0110635925,0.011440333,0.0245097,0.0003282066],"about_ca_topic_score_codex":0.0026352159,"about_ca_topic_score_gemma":0.0031864948,"teacher_disagreement_score":0.003867085,"about_ca_system_score_codex":0.00050776143,"about_ca_system_score_gemma":0.0006364456,"threshold_uncertainty_score":0.020451367},"labels":[],"label_agreement":null},{"id":"W4402576412","doi":"10.1002/widm.1554","title":"From <scp>3D</scp> point‐cloud data to explainable geometric deep learning: State‐of‐the‐art and future challenges","year":2024,"lang":"en","type":"article","venue":"Wiley Interdisciplinary Reviews Data Mining and Knowledge Discovery","topic":"Remote Sensing and LiDAR Applications","field":"Environmental Science","cited_by":17,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Alberta","funders":"Austrian Science Fund; Amt der NÖ Landesregierung","keywords":"Point cloud; Computer science; Cloud computing; State (computer science); Deep learning; Point (geometry); Data science; Artificial intelligence; Algorithm; Geometry","score_opus":0.046510086094736613,"score_gpt":0.3084817585943116,"score_spread":0.261971672499575,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4402576412","genre_codex":"methods","genre_gemma":"review","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"review","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.029309306,0.03149126,0.89669657,0.027107548,0.00053793954,0.00006635335,0.0027823949,0.0026371477,0.0093715275],"genre_scores_gemma":[0.51474744,0.0523471,0.40987235,0.0050543724,0.0019225461,0.00021669937,0.0074037677,0.0007504383,0.0076852795],"study_design_codex":"design_other","study_design_gemma":"not_applicable","domain_scores_codex":[0.9993617,0.00020913132,0.000021341568,0.00014479032,0.00022752574,0.000035479454],"domain_scores_gemma":[0.9956077,0.0028092253,0.00017208543,0.00075381267,0.00053304574,0.00012412628],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0020034858,0.0007216914,0.00077484554,0.00095929846,0.00024310486,0.002432082,0.0024676155,0.0017720492,0.0036067322],"category_scores_gemma":[0.006393147,0.0004216798,0.00073817174,0.0017964303,0.0023228277,0.0044437787,0.002378926,0.0027798621,0.0014152188],"study_design_candidate":"not_applicable","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0000854763,0.00008625669,0.0034633807,0.0009939317,0.00022818561,0.00012314106,0.00017440759,0.28134722,0.0020208156,0.14809513,0.040023085,0.52335906],"study_design_scores_gemma":[0.000007382631,0.00002341318,0.0009035465,0.00017251117,0.0000154771,0.000049696955,0.000072144016,0.71980333,0.0012336225,0.24660587,0.03108556,0.000027397828],"about_ca_topic_score_codex":0.006783745,"about_ca_topic_score_gemma":0.004688219,"teacher_disagreement_score":0.006783745,"about_ca_system_score_codex":0.0012628356,"about_ca_system_score_gemma":0.0010104063,"threshold_uncertainty_score":0.013488531},"labels":[],"label_agreement":null}]}