{"meta":{"query_hash":"371cb4d87b7b","filters":{"topic":"Web Data Mining and Analysis"},"cohort_total":630,"direct_labels_cover":3,"predictions_cover":630,"exported":630,"export_cap":100000,"truncated":false,"label_status":"direct model label, unvalidated","prediction_status":"machine_predicted_unvalidated (Codex and Gemma teacher distillation)","score_status":"score_only:v0-immature-baseline","snapshot":{"source":"OpenAlex, pinned release, all 482 partitions","release":"2026-06-24","frame_built":"2026-07-12"},"permalink":"https://metacan.xera.ac/q/371cb4d87b7b","api":"https://metacan.xera.ac/api/v1/cohort?topic=Web+Data+Mining+and+Analysis"},"results":[{"id":"W108479605","doi":"","title":"A New Similarity Measure to Understand Visitor Behavior in a Web Site","year":2004,"lang":"en","type":"article","venue":"IEICE Transactions on Information and Systems","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":32,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Hatch (Canada)","funders":"","keywords":"Visitor pattern; Computer science; World Wide Web; Cluster analysis; Similarity (geometry); Web page; Similarity measure; The Internet; Web site; Information retrieval; Measure (data warehouse); Web analytics; Site map; Order (exchange); Web mining; Web navigation; Web modeling; Static web page; Data mining; Web intelligence; Artificial intelligence","score_opus":0.020539530157939336,"score_gpt":0.24516196564746087,"score_spread":0.22462243548952154,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W108479605","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.22639869,0.002161468,0.75982165,0.0003363445,0.00016587436,0.00054574345,0.0022163854,0.0013602196,0.0069936384],"genre_scores_gemma":[0.75123274,0.00045869208,0.24314491,0.000116544754,0.00017173646,0.00041596845,0.0024750186,0.00014726231,0.0018370654],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.99721944,0.00050294696,0.00044166658,0.00051131734,0.0011344055,0.00019023742],"domain_scores_gemma":[0.9948318,0.002261561,0.00079807587,0.0006587204,0.0011302322,0.00031959938],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0017800913,0.0007964119,0.0014784884,0.011137306,0.00080214936,0.0018326655,0.0013832848,0.0016170955,0.0016767364],"category_scores_gemma":[0.010952901,0.00022158703,0.0011388275,0.008219316,0.00093323644,0.0045717238,0.0012227544,0.0011527505,0.0008176277],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0008840754,0.0017597406,0.17097709,0.0011649048,0.001368504,0.0005543911,0.0026930976,0.058870282,0.039815374,0.06152724,0.0141413165,0.646244],"study_design_scores_gemma":[0.00006942982,0.0012484188,0.14573866,0.00018915057,0.00039010518,0.00290682,0.0018169013,0.7534676,0.011604322,0.06120458,0.021059707,0.00030431474],"about_ca_topic_score_codex":0.0032563815,"about_ca_topic_score_gemma":0.00246294,"teacher_disagreement_score":0.011137306,"about_ca_system_score_codex":0.0012933625,"about_ca_system_score_gemma":0.000785426,"threshold_uncertainty_score":0.009414136},"labels":[],"label_agreement":null},{"id":"W114734663","doi":"10.1609/icwsm.v3i1.13964","title":"Adaptive Weblog Post Filtering Based on User Browsing History","year":2009,"lang":"en","type":"article","venue":"Proceedings of the International AAAI Conference on Web and Social Media","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Alberta","funders":"","keywords":"Popularity; World Wide Web; Computer science; Order (exchange); Revenue; Population; Multimedia; Business; Political science; Sociology","score_opus":0.03527437937829823,"score_gpt":0.23108416588004102,"score_spread":0.1958097865017428,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W114734663","genre_codex":"empirical","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.66399527,0.0020656737,0.30676755,0.00065470656,0.0004246745,0.0009393379,0.0015332926,0.016695758,0.006923701],"genre_scores_gemma":[0.88230246,0.00058350526,0.108385205,0.0001579015,0.0003433062,0.00017403487,0.0017054288,0.00023106324,0.006117098],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9987464,0.0001795045,0.0001281039,0.0002642544,0.00054348627,0.00013826035],"domain_scores_gemma":[0.99352044,0.0023214214,0.0006247309,0.00079782086,0.0023152097,0.0004203122],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0016913667,0.00092232734,0.0013486795,0.003288178,0.00074261613,0.0014047722,0.0008515275,0.0007093212,0.001362204],"category_scores_gemma":[0.006323389,0.00039734604,0.0004932496,0.0017629636,0.0003382136,0.0015262325,0.000352799,0.0007303628,0.0011605871],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0015209395,0.0016322475,0.07976281,0.0003918945,0.0002003319,0.00035684748,0.00049663684,0.007023691,0.07022751,0.0007838599,0.007890547,0.82971275],"study_design_scores_gemma":[0.00018212738,0.001962446,0.21798219,0.00011356444,0.0005633518,0.0019413712,0.00057939545,0.6479619,0.1094849,0.0024411893,0.016536612,0.000250999],"about_ca_topic_score_codex":0.006449642,"about_ca_topic_score_gemma":0.0121906465,"teacher_disagreement_score":0.006449642,"about_ca_system_score_codex":0.00050126266,"about_ca_system_score_gemma":0.0009779386,"threshold_uncertainty_score":0.012824178},"labels":[],"label_agreement":null},{"id":"W1221199048","doi":"10.1016/j.procs.2015.08.200","title":"Similarities of Frequent Following Patterns and Social Entities","year":2015,"lang":"en","type":"article","venue":"Procedia Computer Science","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":9,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Manitoba","funders":"Japan Society for the Promotion of Science; Natural Sciences and Engineering Research Council of Canada","keywords":"Computer science; Data science; Artificial intelligence; Computer security","score_opus":0.03095346345671893,"score_gpt":0.25249450785672184,"score_spread":0.2215410444000029,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W1221199048","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.47126004,0.0016966808,0.51141626,0.00047794843,0.00014714542,0.0005168244,0.004179614,0.000663522,0.00964195],"genre_scores_gemma":[0.86079186,0.00049444527,0.13257284,0.00007014718,0.00011871564,0.00033352303,0.0038212414,0.00004878361,0.0017483507],"study_design_codex":"design_other","study_design_gemma":"observational","domain_scores_codex":[0.9952296,0.00084533123,0.00079810456,0.0011673289,0.0017174159,0.00024217505],"domain_scores_gemma":[0.98325837,0.008422076,0.0032330516,0.0020394062,0.0026320142,0.0004150069],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0016884956,0.00040778783,0.0007109714,0.006341427,0.0006941778,0.0015780305,0.0011207542,0.0009402699,0.0021772336],"category_scores_gemma":[0.021673096,0.00029081333,0.0009822124,0.0066391192,0.00078933366,0.003790114,0.0013687029,0.0005998274,0.00048263435],"study_design_candidate":"observational","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0012173053,0.0005806268,0.20260693,0.0018606458,0.00081337016,0.0035069278,0.003487241,0.041535556,0.024728201,0.15229298,0.0071697393,0.5602004],"study_design_scores_gemma":[0.00010656699,0.00076871354,0.14481986,0.00027732033,0.0004304033,0.012402075,0.0030459685,0.47139877,0.015727622,0.31403723,0.03673055,0.00025497886],"about_ca_topic_score_codex":0.0012992227,"about_ca_topic_score_gemma":0.001533201,"teacher_disagreement_score":0.006341427,"about_ca_system_score_codex":0.0005586868,"about_ca_system_score_gemma":0.00050141773,"threshold_uncertainty_score":0.008929729},"labels":[],"label_agreement":null},{"id":"W122957206","doi":"10.5555/1556176.1556241","title":"A new framework for analyzing political news","year":2009,"lang":"en","type":"article","venue":"International Conference on Digital Government Research","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Université Laval","funders":"","keywords":"Politics; Computer science; Ontology; Order (exchange); Information retrieval; Data science; Political science; Business","score_opus":0.1370495776574001,"score_gpt":0.4195985893732581,"score_spread":0.282549011715858,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W122957206","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0030511834,0.00029177498,0.9887001,0.00050227327,0.00012164023,0.00014423937,0.00040151863,0.00041051427,0.0063767214],"genre_scores_gemma":[0.057283424,0.00051655946,0.93509156,0.00020234373,0.00038072834,0.00041928593,0.0012309698,0.0002060257,0.0046691233],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"not_applicable","domain_scores_codex":[0.99695516,0.0008740738,0.00031061645,0.0009235397,0.0007714711,0.00016509919],"domain_scores_gemma":[0.99685305,0.0014113337,0.00033466597,0.0006961415,0.00055257126,0.00015229965],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0034622008,0.0010777042,0.0010618556,0.008218395,0.0018643572,0.007713499,0.001959423,0.0013193897,0.005497238],"category_scores_gemma":[0.00754522,0.0005767555,0.0024089417,0.0073455865,0.0028671136,0.010029565,0.0018823175,0.0021624544,0.0015740546],"study_design_candidate":"not_applicable","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.000042855838,0.00010879397,0.0023914026,0.00026334633,0.00010171338,0.00016287673,0.0012362014,0.008937132,0.002543674,0.8544389,0.005678888,0.12409425],"study_design_scores_gemma":[0.000047737536,0.000087800596,0.002112885,0.00012826476,0.00012357048,0.0003425094,0.0010692916,0.15702322,0.0027972257,0.6857641,0.15043017,0.000073352305],"about_ca_topic_score_codex":0.0056905486,"about_ca_topic_score_gemma":0.0037289914,"teacher_disagreement_score":0.008218395,"about_ca_system_score_codex":0.0014531479,"about_ca_system_score_gemma":0.0019145765,"threshold_uncertainty_score":0.01839012},"labels":[],"label_agreement":null},{"id":"W130931946","doi":"10.1007/978-1-4615-1507-4_16","title":"Recent Advances in Tabu Search","year":2002,"lang":"en","type":"book-chapter","venue":"Operations research, computer science. Interface series","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":37,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Université de Montréal; Université du Québec à Montréal","funders":"","keywords":"Tabu search; Guided Local Search; Focus (optics); Computer science; Field (mathematics); Hill climbing; Artificial intelligence; Mathematics; Physics","score_opus":0.07058871474709118,"score_gpt":0.3526118933868006,"score_spread":0.28202317863970944,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W130931946","genre_codex":"review","genre_gemma":"review","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"review","genre_consensus":"review","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.005121503,0.69474185,0.23533455,0.003798986,0.0031600422,0.00015411945,0.0011368995,0.0036124005,0.05293973],"genre_scores_gemma":[0.07139518,0.37167656,0.5030908,0.003308069,0.007447483,0.00042941415,0.0050098337,0.0019593174,0.03568339],"study_design_codex":"design_other","study_design_gemma":"not_applicable","domain_scores_codex":[0.99633515,0.0013392443,0.00023210992,0.0005480865,0.0013263641,0.0002190473],"domain_scores_gemma":[0.992074,0.0050505637,0.00036714802,0.0009661713,0.0013510571,0.00019103565],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0037214167,0.001289254,0.002906293,0.005080382,0.0009764889,0.0041782125,0.0037033625,0.0015882719,0.027135892],"category_scores_gemma":[0.016102474,0.00086083997,0.0011839726,0.021223012,0.0015842151,0.006448261,0.0018447267,0.0023253805,0.012131046],"study_design_candidate":"not_applicable","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00019429803,0.00010558956,0.00055309676,0.0020345054,0.000073745316,0.000024375839,0.00007083278,0.0075693475,0.0003943316,0.042881455,0.045311835,0.90078664],"study_design_scores_gemma":[0.00018337849,0.0003134083,0.0017249807,0.0016533004,0.00029139296,0.0009909137,0.00023455551,0.13066347,0.002777042,0.21879438,0.64223284,0.00014033445],"about_ca_topic_score_codex":0.0050224224,"about_ca_topic_score_gemma":0.0046713175,"teacher_disagreement_score":0.027135892,"about_ca_system_score_codex":0.0020288755,"about_ca_system_score_gemma":0.0030515941,"threshold_uncertainty_score":0.09077853},"labels":[],"label_agreement":null},{"id":"W134020375","doi":"","title":"Downloading Deep Web Data from Real Web Services","year":2011,"lang":"en","type":"article","venue":"Scholarship at UWindsor (University of Windsor)","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Windsor","funders":"","keywords":"Upload; World Wide Web; Computer science; Web service; Deep Web; The Internet; Internet privacy","score_opus":0.05521523942210807,"score_gpt":0.22980307759504853,"score_spread":0.17458783817294046,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W134020375","genre_codex":"empirical","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.87651134,0.0005127789,0.053469267,0.0007096542,0.00014961163,0.00049507414,0.037285935,0.024060354,0.006805943],"genre_scores_gemma":[0.7982231,0.0004967591,0.09674557,0.00017621777,0.0000487133,0.00020355306,0.0983664,0.0014852836,0.004254332],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9984213,0.00020227526,0.00013627835,0.00022395661,0.00087334804,0.00014285828],"domain_scores_gemma":[0.9933195,0.002173291,0.00030445878,0.00228978,0.0015473168,0.00036568113],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0011827772,0.00077889016,0.00076690025,0.0027566522,0.00065814465,0.0012485767,0.0008408658,0.0006306887,0.0017037053],"category_scores_gemma":[0.008185382,0.00038751587,0.0006263028,0.0050476165,0.00041376986,0.002205686,0.0012771362,0.0010636324,0.0017016004],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0026972066,0.0019366797,0.12482707,0.0021361886,0.0005867957,0.00244586,0.0023110928,0.046631306,0.06858566,0.0068604904,0.081896976,0.6590847],"study_design_scores_gemma":[0.00022236136,0.0007904232,0.15078242,0.00016444974,0.00019073341,0.0014629987,0.0026300885,0.6458385,0.106357545,0.017016193,0.0743362,0.00020799103],"about_ca_topic_score_codex":0.011333132,"about_ca_topic_score_gemma":0.018745987,"teacher_disagreement_score":0.011333132,"about_ca_system_score_codex":0.00067353447,"about_ca_system_score_gemma":0.00092710974,"threshold_uncertainty_score":0.02253437},"labels":[],"label_agreement":null},{"id":"W137699535","doi":"10.1016/j.infsof.2009.04.015","title":"Guest Editorial for the Special Issue on Source Code Analysis andManipulation, SCAM 2008","year":2009,"lang":"en","type":"editorial","venue":"Information and Software Technology","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":0,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Queen's University","funders":"","keywords":"Computer science; Information retrieval; Explicit semantic analysis; Search engine indexing; Semantic search; Leverage (statistics); Ranking (information retrieval); Semantic computing; Knowledge base; Set (abstract data type); Component (thermodynamics); Semantic compression; Semantic grid; Semantic technology; Semantic data model; World Wide Web; Artificial intelligence; Search engine; Semantic Web","score_opus":0.006236592068031181,"score_gpt":0.24539800936155215,"score_spread":0.23916141729352097,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W137699535","genre_codex":"editorial","genre_gemma":"editorial","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"editorial","genre_consensus":"editorial","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.000059310885,0.0034468055,0.00035006859,0.01944375,0.97487587,0.000019647547,0.0000811017,0.00012041988,0.0016029701],"genre_scores_gemma":[0.0005364287,0.002789935,0.00027208484,0.010217234,0.970293,0.00002132231,0.000084687366,0.00010204953,0.015683295],"study_design_codex":"not_applicable","study_design_gemma":"not_applicable","domain_scores_codex":[0.99621284,0.0003867288,0.0004544224,0.00056168606,0.0021216923,0.00026262505],"domain_scores_gemma":[0.97917604,0.0055075916,0.0015152653,0.00058771536,0.010870652,0.0023428146],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.005558332,0.002905562,0.0030328468,0.004176806,0.0022549068,0.0060141534,0.0023198163,0.008103973,0.022395574],"category_scores_gemma":[0.019407792,0.0010507175,0.0019370497,0.001539679,0.0016323491,0.002973876,0.0011962177,0.01069343,0.013620887],"study_design_candidate":"not_applicable","study_design_consensus":"not_applicable","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.000027746037,0.000008990346,0.00002160268,0.00008190726,0.000010362885,0.00007616017,0.0000037988027,0.000014927065,0.00008735145,0.00009677145,0.9949287,0.0046416707],"study_design_scores_gemma":[0.000081675644,0.00005521557,0.0006062968,0.00023996628,0.00006730081,0.0003647033,0.000022315871,0.0002729999,0.00030021716,0.0007811667,0.99719006,0.00001801552],"about_ca_topic_score_codex":0.0014762994,"about_ca_topic_score_gemma":0.005556566,"teacher_disagreement_score":0.022395574,"about_ca_system_score_codex":0.0017984768,"about_ca_system_score_gemma":0.0023461718,"threshold_uncertainty_score":0.074920654},"labels":[],"label_agreement":null},{"id":"W1482288948","doi":"10.3233/wia-2012-0232","title":"Selecting queries from sample to crawl deep web data sources","year":2012,"lang":"en","type":"article","venue":"Web Intelligence and Agent Systems An International Journal","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":13,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Windsor","funders":"Natural Sciences and Engineering Research Council of Canada; Nanjing University","keywords":"Deep Web; Sample (material); Computer science; Information retrieval; World Wide Web; The Internet","score_opus":0.07823562605587984,"score_gpt":0.3229699100774922,"score_spread":0.24473428402161235,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W1482288948","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.24917775,0.0022868987,0.7261054,0.0015539257,0.00010682953,0.0012883308,0.0047352617,0.012627491,0.0021180825],"genre_scores_gemma":[0.36249408,0.00067439233,0.6216057,0.0003777106,0.00010826704,0.00064941146,0.0111837275,0.0010804023,0.0018263585],"study_design_codex":"design_other","study_design_gemma":"not_applicable","domain_scores_codex":[0.99480706,0.001502623,0.0005924546,0.0009991257,0.0017312889,0.00036743341],"domain_scores_gemma":[0.98483896,0.008552605,0.0010007218,0.0026346014,0.0022746257,0.0006984542],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0037681297,0.0016747015,0.0031082737,0.0041211005,0.0012390646,0.0032819845,0.0018380939,0.0017973712,0.0009647117],"category_scores_gemma":[0.023360206,0.00095129997,0.0010701326,0.0037535608,0.0008561804,0.0052518765,0.0026018634,0.0018736932,0.0015752615],"study_design_candidate":"not_applicable","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.001596892,0.0016205519,0.05682814,0.0017463756,0.00039751225,0.0011632903,0.0031760654,0.04045624,0.114597276,0.012203561,0.035793003,0.730421],"study_design_scores_gemma":[0.00021625085,0.00066647184,0.013582249,0.00014993077,0.00020572472,0.0014015106,0.0023389105,0.8783535,0.052606672,0.02515686,0.025192931,0.00012886146],"about_ca_topic_score_codex":0.0039820485,"about_ca_topic_score_gemma":0.006642211,"teacher_disagreement_score":0.0041211005,"about_ca_system_score_codex":0.00078288314,"about_ca_system_score_gemma":0.0016888051,"threshold_uncertainty_score":0.019928038},"labels":[],"label_agreement":null},{"id":"W1482515287","doi":"10.1007/978-3-642-17187-1_51","title":"Modeling Variable Dependencies between Characters in Chinese Information Retrieval","year":2010,"lang":"en","type":"book-chapter","venue":"Lecture notes in computer science","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":1,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Université de Montréal","funders":"","keywords":"Computer science; Variable (mathematics); Information retrieval; Artificial intelligence; Data mining; Mathematics","score_opus":0.013165052766024829,"score_gpt":0.23203952137144762,"score_spread":0.21887446860542278,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W1482515287","genre_codex":"empirical","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.83779365,0.001089445,0.1551646,0.0005403697,0.00006836078,0.00010394469,0.0008218473,0.00049601734,0.0039219474],"genre_scores_gemma":[0.9794658,0.00031871654,0.015055427,0.00005084299,0.000048466998,0.000066165834,0.0007371917,0.000092339644,0.0041651153],"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9992279,0.0002713081,0.00003644968,0.0002130964,0.000100942045,0.00015034198],"domain_scores_gemma":[0.9930623,0.0059098317,0.00032918694,0.00025752027,0.00029814703,0.00014290304],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.001880218,0.0006485865,0.0007811401,0.0020121434,0.0007777702,0.0012147889,0.0013445998,0.0008192019,0.002299049],"category_scores_gemma":[0.008202976,0.0005559187,0.0008207071,0.0023479974,0.00078891363,0.002926942,0.0008273563,0.0012502641,0.00045540728],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0014074796,0.00045437852,0.050214555,0.00031949056,0.00023880386,0.0008336051,0.0011368828,0.7793986,0.0056498894,0.04873267,0.0041530114,0.10746059],"study_design_scores_gemma":[0.000011711235,0.000024914467,0.0028158838,0.000006165022,0.00005042445,0.000027124779,0.00002847645,0.9906404,0.00048466233,0.0056392467,0.00026122056,0.000009755194],"about_ca_topic_score_codex":0.03783584,"about_ca_topic_score_gemma":0.023560803,"teacher_disagreement_score":0.03783584,"about_ca_system_score_codex":0.0015034283,"about_ca_system_score_gemma":0.0013819634,"threshold_uncertainty_score":0.075231194},"labels":[],"label_agreement":null},{"id":"W1485672862","doi":"","title":"BlogScope: a system for online analysis of high volume text streams","year":2007,"lang":"en","type":"article","venue":"","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":79,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Toronto","funders":"","keywords":"Blogosphere; Computer science; Ranking (information retrieval); Relevance (law); Information retrieval; Volume (thermodynamics); Set (abstract data type); Data stream mining; World Wide Web; Data mining; Data science; The Internet","score_opus":0.013479098991408147,"score_gpt":0.25992056768312166,"score_spread":0.24644146869171352,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W1485672862","genre_codex":"software","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.028290762,0.0011109734,0.29111516,0.0007195151,0.0005145404,0.0012989606,0.06040754,0.6021429,0.014399617],"genre_scores_gemma":[0.20783496,0.0015154354,0.5889969,0.0011762077,0.00063749077,0.002208338,0.14837542,0.019762516,0.029492768],"study_design_codex":"not_applicable","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.99923337,0.00008480559,0.00007314717,0.00019932367,0.00035411335,0.000055266217],"domain_scores_gemma":[0.99776256,0.00082922727,0.00021830389,0.00049341406,0.00045338477,0.00024308983],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.001029062,0.0010323166,0.000941913,0.0032026612,0.00082352385,0.0018912381,0.0014133273,0.0008506305,0.01695322],"category_scores_gemma":[0.0042779427,0.0005573308,0.00044070103,0.0028077425,0.00037892262,0.0034720183,0.002038142,0.00095409557,0.009514514],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0017831475,0.00038228533,0.01159127,0.0011532288,0.0002472754,0.0008064393,0.000763068,0.0027910175,0.037236426,0.0048163305,0.5687476,0.36968198],"study_design_scores_gemma":[0.0008618396,0.00045251445,0.02522549,0.00022437309,0.00025084993,0.0019885807,0.0005338281,0.29122764,0.06734021,0.017022664,0.59437144,0.00050055404],"about_ca_topic_score_codex":0.0035497996,"about_ca_topic_score_gemma":0.004672009,"teacher_disagreement_score":0.01695322,"about_ca_system_score_codex":0.00046453907,"about_ca_system_score_gemma":0.0010388013,"threshold_uncertainty_score":0.056714177},"labels":[],"label_agreement":null},{"id":"W1490501152","doi":"10.1007/978-3-642-03348-3_32","title":"Crawling Deep Web Using a New Set Covering Algorithm","year":2009,"lang":"en","type":"book-chapter","venue":"Lecture notes in computer science","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":23,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Windsor","funders":"","keywords":"Crawling; Computer science; Set (abstract data type); Algorithm; Set cover problem; Greedy algorithm; Web crawler; Domain (mathematical analysis); Data mining; Artificial intelligence; World Wide Web; Mathematics","score_opus":0.025397222463813478,"score_gpt":0.26016370992732113,"score_spread":0.23476648746350764,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W1490501152","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.02815794,0.0005461796,0.96415275,0.00018440287,0.00019346701,0.00016693526,0.00044440205,0.004352668,0.0018012818],"genre_scores_gemma":[0.10761345,0.00023598896,0.88532346,0.00013372088,0.00017144463,0.0002615066,0.0017123251,0.0005185639,0.0040295445],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.99724543,0.00047472937,0.00025430697,0.0005508966,0.0012711845,0.0002034454],"domain_scores_gemma":[0.9951533,0.0020738794,0.0002438501,0.0015478716,0.00077421893,0.00020679426],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0013409609,0.0011843188,0.002894194,0.006474771,0.0016228365,0.002251062,0.0025896858,0.0022447438,0.0036373655],"category_scores_gemma":[0.006709521,0.0010452555,0.0022581299,0.005241362,0.00073994795,0.0035609724,0.0029410727,0.0014209293,0.0013647836],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0002545464,0.00047985683,0.0047023934,0.00028288693,0.00040375986,0.00030290568,0.00022698716,0.07680118,0.01689374,0.013431147,0.015485833,0.8707348],"study_design_scores_gemma":[0.000032460888,0.00009199203,0.0008000909,0.000017419758,0.00009552101,0.0003106585,0.000030959745,0.9746514,0.0047313985,0.014551908,0.0046618893,0.000024261912],"about_ca_topic_score_codex":0.0043255277,"about_ca_topic_score_gemma":0.008517152,"teacher_disagreement_score":0.006474771,"about_ca_system_score_codex":0.0008944329,"about_ca_system_score_gemma":0.0016366917,"threshold_uncertainty_score":0.012168229},"labels":[],"label_agreement":null},{"id":"W1493789029","doi":"10.1023/a:1012408428703","title":"A Conceptual Model and Rule-Based Query Language for HTML","year":2001,"lang":"en","type":"article","venue":"World Wide Web","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":18,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Carleton University","funders":"Natural Sciences and Engineering Research Council of Canada","keywords":"Computer science; Query language; Information retrieval; Simple (philosophy); Semantics (computer science); Conceptual graph; Programming language; Knowledge representation and reasoning; Artificial intelligence","score_opus":0.020280491436409195,"score_gpt":0.2545614389812293,"score_spread":0.2342809475448201,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W1493789029","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0012246397,0.00009038783,0.98153085,0.00040919153,0.00005583459,0.00028265966,0.00293137,0.012172105,0.0013029145],"genre_scores_gemma":[0.027396567,0.0003263354,0.954988,0.00060170994,0.00007189169,0.0007689161,0.009792742,0.0024615312,0.0035923093],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.9952354,0.0007233367,0.0012443175,0.0007094013,0.0018235411,0.00026403458],"domain_scores_gemma":[0.99339986,0.0028374868,0.0004949611,0.001142079,0.0018290672,0.00029656757],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0053308145,0.0015603312,0.0017987997,0.0041005835,0.0013438457,0.0080743255,0.004904598,0.0030683035,0.009151756],"category_scores_gemma":[0.012922644,0.0018329847,0.0037678669,0.003497494,0.0021494739,0.009969639,0.0031663356,0.004096004,0.007599868],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00048602902,0.0005030271,0.0025796467,0.0017111648,0.00024659076,0.0017479424,0.003124643,0.031259403,0.018212328,0.61742985,0.09209204,0.23060735],"study_design_scores_gemma":[0.00021185595,0.00021574085,0.00073788187,0.000655276,0.00045871583,0.0015848262,0.0007365102,0.3793547,0.029976914,0.28909007,0.29664597,0.0003315997],"about_ca_topic_score_codex":0.009212495,"about_ca_topic_score_gemma":0.008749303,"teacher_disagreement_score":0.009212495,"about_ca_system_score_codex":0.0018117221,"about_ca_system_score_gemma":0.0033137815,"threshold_uncertainty_score":0.030615687},"labels":[],"label_agreement":null},{"id":"W1494273468","doi":"10.1007/978-3-540-24840-8_5","title":"Term-Based Clustering and Summarization of Web Page Collections","year":2004,"lang":"en","type":"book-chapter","venue":"Lecture notes in computer science","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":20,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Dalhousie University","funders":"","keywords":"Automatic summarization; Computer science; Cluster analysis; Information retrieval; Web page; World Wide Web; Web intelligence; Task (project management); Web modeling; Artificial intelligence","score_opus":0.013844641570018714,"score_gpt":0.2280352087547077,"score_spread":0.21419056718468898,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W1494273468","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.16744098,0.0074729803,0.8023871,0.00044884387,0.00038337646,0.0005657463,0.007392457,0.009327629,0.0045808842],"genre_scores_gemma":[0.26886111,0.0025473107,0.68405,0.000088832494,0.0005112191,0.0003397551,0.031307954,0.0009695583,0.01132428],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.99890363,0.0001586692,0.00013118274,0.00025259546,0.00042458475,0.00012928262],"domain_scores_gemma":[0.99755543,0.0006629623,0.00021308816,0.00037353332,0.0010681053,0.00012689708],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0010095186,0.00074340455,0.001548607,0.0099788355,0.0011110456,0.0020543858,0.0018686568,0.0008529449,0.002599862],"category_scores_gemma":[0.0044165477,0.00045198697,0.0013365631,0.009254218,0.00038939278,0.0016616976,0.00086466916,0.0008126217,0.002780601],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0005100537,0.00024215755,0.0046239197,0.0005371593,0.00026806493,0.00016310863,0.0004377119,0.013686725,0.04556272,0.0016465198,0.015887542,0.9164343],"study_design_scores_gemma":[0.00013285338,0.00078512414,0.06141137,0.00020577777,0.001440115,0.0016643038,0.0012688407,0.7871545,0.079716146,0.024741415,0.04118778,0.00029180944],"about_ca_topic_score_codex":0.008637242,"about_ca_topic_score_gemma":0.01746238,"teacher_disagreement_score":0.0099788355,"about_ca_system_score_codex":0.0007424315,"about_ca_system_score_gemma":0.0012531655,"threshold_uncertainty_score":0.017173946},"labels":[],"label_agreement":null},{"id":"W1500705686","doi":"10.1007/978-3-540-24840-8_10","title":"The Reconstruction of the Interleaved Sessions from a Server Log","year":2004,"lang":"en","type":"book-chapter","venue":"Lecture notes in computer science","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":4,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of New Brunswick","funders":"","keywords":"Computer science; Session (web analytics); Web server; Web mining; Web log analysis software; Markov chain; Data mining; Web service; World Wide Web; The Internet; Machine learning; Static web page","score_opus":0.015170789224130945,"score_gpt":0.2295073547762586,"score_spread":0.21433656555212766,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W1500705686","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.07650988,0.00023530457,0.9174475,0.0002287719,0.000055425244,0.000056388766,0.0009091065,0.0036342666,0.0009234088],"genre_scores_gemma":[0.57512194,0.0004559987,0.41595265,0.000046005134,0.00009764128,0.00008586371,0.0027936955,0.00055807375,0.004888172],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9993443,0.00014475439,0.00003421931,0.00012773422,0.00025422615,0.00009473644],"domain_scores_gemma":[0.99678874,0.0014947816,0.00016930979,0.0009354104,0.00043783095,0.00017387318],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0007537654,0.0006250395,0.0006012279,0.0014647718,0.0003322566,0.0014679051,0.0013101496,0.0011371808,0.0022491063],"category_scores_gemma":[0.0065308507,0.000610263,0.0006535455,0.0016794925,0.0005341155,0.0019738514,0.0008887754,0.0016429301,0.0019698883],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0019648946,0.0004868996,0.023028795,0.00036900758,0.00015551134,0.0008005602,0.0011417393,0.14047241,0.052140553,0.020606622,0.008129025,0.75070405],"study_design_scores_gemma":[0.000014688353,0.00005232803,0.003785394,0.000016321148,0.000022763723,0.00020924387,0.00011922948,0.96993744,0.010989037,0.01287097,0.001960702,0.000021842732],"about_ca_topic_score_codex":0.0039487327,"about_ca_topic_score_gemma":0.0044398396,"teacher_disagreement_score":0.0039487327,"about_ca_system_score_codex":0.00030247527,"about_ca_system_score_gemma":0.000993866,"threshold_uncertainty_score":0.007851481},"labels":[],"label_agreement":null},{"id":"W1503428979","doi":"10.1007/3-540-48080-3_9","title":"Characterizing the Citation Graph as a Self-Organizing Networked Information Space","year":2002,"lang":"en","type":"book-chapter","venue":"Lecture notes in computer science","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":7,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Dalhousie University","funders":"","keywords":"Computer science; Citation; Graph; The Internet; Digital library; Information retrieval; Information space; Space (punctuation); Theoretical computer science; World Wide Web; Data science","score_opus":0.01271505120369952,"score_gpt":0.21073858859869204,"score_spread":0.1980235373949925,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W1503428979","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.42497948,0.0035011887,0.5427291,0.0023824663,0.00017214597,0.00014604963,0.0021205286,0.0009540286,0.023015054],"genre_scores_gemma":[0.9027438,0.0023335468,0.08698797,0.00016590525,0.0003746896,0.00015869927,0.0016702511,0.00018279208,0.0053822915],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.99911505,0.00026339214,0.00006365617,0.00020279974,0.0002913993,0.00006370912],"domain_scores_gemma":[0.9907308,0.006013405,0.0010484064,0.00085897034,0.000947037,0.00040135309],"candidate_categories":["bibliometrics"],"consensus_categories":[],"category_scores_codex":[0.00088450057,0.0003147703,0.00067632966,0.00816528,0.0012350413,0.0040111067,0.0011134667,0.001524099,0.0025573326],"category_scores_gemma":[0.013076291,0.00039611387,0.00061177195,0.009022317,0.0016584401,0.0068142987,0.0012593026,0.0007723101,0.0004971469],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00010632614,0.00016077352,0.016552918,0.00044227543,0.00014898162,0.00038810764,0.001113453,0.081391335,0.0060815923,0.77899164,0.008808286,0.10581439],"study_design_scores_gemma":[0.000012697527,0.000028617214,0.0038811148,0.000046014757,0.000060283015,0.00030695775,0.00031723775,0.20404586,0.0012574277,0.7818296,0.008183171,0.000031007665],"about_ca_topic_score_codex":0.0015511799,"about_ca_topic_score_gemma":0.0018446827,"teacher_disagreement_score":0.9918347,"about_ca_system_score_codex":0.00068287406,"about_ca_system_score_gemma":0.00055,"threshold_uncertainty_score":0.008555174},"labels":[],"label_agreement":null},{"id":"W1509214810","doi":"10.1007/978-3-642-04417-5_12","title":"Time-Sensitive Language Modelling for Online Term Recurrence Prediction","year":2009,"lang":"en","type":"book-chapter","venue":"Lecture notes in computer science","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":9,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Université de Montréal","funders":"","keywords":"Term (time); Computer science; Point (geometry); Language model; Machine learning; Artificial intelligence; Data mining; Information retrieval","score_opus":0.02000752572108192,"score_gpt":0.2541830932252973,"score_spread":0.2341755675042154,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W1509214810","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.024384065,0.00086948415,0.97158563,0.0004222754,0.000101996804,0.00004506926,0.00045255193,0.001359886,0.0007791791],"genre_scores_gemma":[0.7797697,0.0014667164,0.20140816,0.00036145726,0.00038328965,0.00035787292,0.002198573,0.00046068334,0.013593569],"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.99890137,0.0004741686,0.00007951056,0.0002151965,0.00019138641,0.00013832521],"domain_scores_gemma":[0.9918611,0.0067482986,0.00037716996,0.0004542268,0.0004359028,0.00012321891],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.003243892,0.0008873643,0.001638009,0.0011341706,0.00057632657,0.0013643119,0.0022174898,0.0013947901,0.0032334693],"category_scores_gemma":[0.010328704,0.0006651569,0.0014165525,0.0014657695,0.00053795666,0.0021051632,0.001261049,0.0028015955,0.0019209471],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00036379302,0.00020894402,0.0016911841,0.00016731056,0.00015523996,0.00018105167,0.0001718412,0.81196517,0.0039659855,0.03158219,0.0040786117,0.14546876],"study_design_scores_gemma":[0.0000026184418,0.0000068417266,0.000061482475,0.000003499114,0.0000073558886,0.000009568266,0.0000026913922,0.9947201,0.00021171468,0.0048480094,0.00012187574,0.000004249984],"about_ca_topic_score_codex":0.0074961493,"about_ca_topic_score_gemma":0.008731807,"teacher_disagreement_score":0.0074961493,"about_ca_system_score_codex":0.00079896016,"about_ca_system_score_gemma":0.0010203292,"threshold_uncertainty_score":0.017155528},"labels":[],"label_agreement":null},{"id":"W1515339153","doi":"10.1007/978-3-540-69858-6_11","title":"Exploiting Multiple Features with MEMMs for Focused Web Crawling","year":2008,"lang":"en","type":"book-chapter","venue":"Lecture notes in computer science","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":4,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Dalhousie University","funders":"","keywords":"Crawling; Web crawler; Computer science; Focused crawler; Information retrieval; Web page; World Wide Web; Task (project management); Key (lock); Context (archaeology); Link analysis; Static web page; Web development","score_opus":0.02566325501353451,"score_gpt":0.23651966483021006,"score_spread":0.21085640981667556,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W1515339153","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.2593351,0.002256556,0.7082617,0.00045222024,0.00036361182,0.00028595037,0.002206767,0.022826634,0.004011355],"genre_scores_gemma":[0.6221258,0.00022876172,0.37170744,0.00017358438,0.0002297019,0.00023346017,0.0020721026,0.000620738,0.0026083675],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.999022,0.00024150345,0.00010398511,0.00021793814,0.00033415537,0.00008038159],"domain_scores_gemma":[0.9961636,0.0020019012,0.0003807495,0.00076096726,0.0005790702,0.00011380927],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0010612048,0.0008761186,0.0012685409,0.0048616556,0.0006432695,0.0010320034,0.0012291142,0.0011943551,0.0013659117],"category_scores_gemma":[0.0065166526,0.00049184513,0.000769216,0.0028801688,0.0003258745,0.0021896346,0.0010453122,0.000636712,0.00081575103],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00065938686,0.00045967964,0.020039823,0.00040875142,0.00036416925,0.00041471742,0.00024433198,0.020097524,0.03517593,0.002211322,0.016150083,0.9037743],"study_design_scores_gemma":[0.0000550652,0.00029100614,0.0072221532,0.000032753214,0.00018407218,0.0006254078,0.00013229098,0.95273817,0.022971291,0.009033531,0.006672212,0.000042011423],"about_ca_topic_score_codex":0.0014231021,"about_ca_topic_score_gemma":0.004574127,"teacher_disagreement_score":0.0048616556,"about_ca_system_score_codex":0.0003083563,"about_ca_system_score_gemma":0.00043887732,"threshold_uncertainty_score":0.005612254},"labels":[],"label_agreement":null},{"id":"W1522356839","doi":"10.1007/978-3-642-21605-3_37","title":"New Techniques for Merging Text Versions","year":2011,"lang":"en","type":"book-chapter","venue":"Lecture notes in computer science","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":2,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"York University","funders":"","keywords":"Computer science; Window (computing); Overlay; Software versioning; Information retrieval; Track (disk drive); Data mining; World Wide Web; Software; Programming language; Operating system","score_opus":0.024754156250914826,"score_gpt":0.25591865337717473,"score_spread":0.23116449712625992,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W1522356839","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.005948208,0.00089302455,0.9720367,0.00029699842,0.00070987415,0.00026816785,0.0011357905,0.014924652,0.0037865024],"genre_scores_gemma":[0.024813581,0.00056531315,0.95650685,0.00012370267,0.0003868093,0.00018239996,0.0036443118,0.0040991856,0.009677928],"study_design_codex":"design_other","study_design_gemma":"not_applicable","domain_scores_codex":[0.9935953,0.00061781774,0.0010025685,0.0016082571,0.0029254032,0.0002507335],"domain_scores_gemma":[0.9812633,0.00617299,0.0010760409,0.0061034933,0.005023087,0.00036109446],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0042062625,0.0021938381,0.0017499486,0.009759247,0.0022454902,0.00501461,0.004357911,0.0019184987,0.026809817],"category_scores_gemma":[0.024043983,0.0018578803,0.0032485162,0.011056085,0.0014856438,0.011767802,0.005495492,0.002912638,0.012955993],"study_design_candidate":"not_applicable","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00033259907,0.00010141435,0.0008467917,0.00044408438,0.00014301634,0.00032563068,0.00060236023,0.002270977,0.017961662,0.017134218,0.021386871,0.9384504],"study_design_scores_gemma":[0.0003085884,0.00048570323,0.004094201,0.00045518638,0.0014659549,0.004137393,0.0016186866,0.27661392,0.18385737,0.19364142,0.33292547,0.00039613867],"about_ca_topic_score_codex":0.0016106725,"about_ca_topic_score_gemma":0.0029597636,"teacher_disagreement_score":0.026809817,"about_ca_system_score_codex":0.00068595796,"about_ca_system_score_gemma":0.0014397983,"threshold_uncertainty_score":0.089687765},"labels":[],"label_agreement":null},{"id":"W1526839813","doi":"10.4271/2007-01-1107","title":"A Navigation Assistance Agent: Mobile LBS Web Service","year":2007,"lang":"en","type":"article","venue":"SAE technical papers on CD-ROM/SAE technical paper series","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":1,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Université de Sherbrooke","funders":"","keywords":"Computer science; Web service; Service (business); Location-based service; World Wide Web; Computer network; Business","score_opus":0.013003526188752803,"score_gpt":0.26065144315657635,"score_spread":0.24764791696782354,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W1526839813","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.029786788,0.0006988096,0.45716006,0.0020372411,0.000617878,0.0012974407,0.0051016524,0.30702075,0.1962794],"genre_scores_gemma":[0.3868093,0.0011109285,0.2677817,0.0024462126,0.00045740925,0.0008931918,0.013054949,0.0051317206,0.3223146],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9997861,0.000025462283,0.000018119457,0.00002949744,0.000104415856,0.00003650359],"domain_scores_gemma":[0.9997582,0.000031884567,0.000019443507,0.000034919827,0.00008298638,0.00007267944],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.00026399887,0.00052776205,0.0005345876,0.0008394447,0.00048546854,0.0010337096,0.0009410532,0.0012863654,0.03176036],"category_scores_gemma":[0.0008106816,0.00024286602,0.0003065203,0.0006591854,0.0002089281,0.001068291,0.0007963603,0.0005974404,0.022207724],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00096206507,0.00070414983,0.0041069565,0.0005180586,0.00007515739,0.0017464512,0.00050432794,0.0039447825,0.05392858,0.027019417,0.42336196,0.48312813],"study_design_scores_gemma":[0.00023167337,0.0002445939,0.0027455164,0.00009946688,0.00007413473,0.0012409923,0.00013609884,0.11321227,0.027918179,0.004260057,0.8497443,0.000092639435],"about_ca_topic_score_codex":0.005283258,"about_ca_topic_score_gemma":0.0049948497,"teacher_disagreement_score":0.03176036,"about_ca_system_score_codex":0.00037964343,"about_ca_system_score_gemma":0.0006301582,"threshold_uncertainty_score":0.106249034},"labels":[],"label_agreement":null},{"id":"W1528282505","doi":"10.1007/978-3-642-14556-8_33","title":"University of Waterloo at INEX 2009: Ad Hoc, Book, Entity Ranking, and Link-the-Wiki Tracks","year":2010,"lang":"en","type":"book-chapter","venue":"Lecture notes in computer science","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":7,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Waterloo","funders":"","keywords":"Information retrieval; Computer science; PageRank; Redundancy (engineering); Ranking (information retrieval); Post hoc; Baseline (sea); World Wide Web; Track (disk drive); Question answering","score_opus":0.009514738419151883,"score_gpt":0.20047286875322434,"score_spread":0.19095813033407247,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W1528282505","genre_codex":"other","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0092499405,0.053696234,0.17821535,0.029160725,0.013961452,0.00044946815,0.1376621,0.052561402,0.5250433],"genre_scores_gemma":[0.012391281,0.02145863,0.1078823,0.0013613788,0.0021199519,0.00018521195,0.10202883,0.008567696,0.7440047],"study_design_codex":"not_applicable","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.99784327,0.00017667879,0.00010027062,0.00033481538,0.0013791361,0.00016585142],"domain_scores_gemma":[0.99655104,0.0004842909,0.00009715042,0.00044677514,0.0017561464,0.00066447625],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.00337612,0.0013052511,0.0014098986,0.00517459,0.0020853211,0.006207872,0.0019832123,0.0012326386,0.09923771],"category_scores_gemma":[0.0063554016,0.0012867012,0.0005708805,0.013646178,0.0006439062,0.009719293,0.0018174155,0.001983437,0.069398195],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.000021366468,0.000034294026,0.00022106303,0.00007600709,0.0000050345843,0.000014248373,0.000045573495,0.00033932104,0.00017759763,0.0036738159,0.8298606,0.165531],"study_design_scores_gemma":[0.000010642269,0.00001776216,0.00093844644,0.00008916162,0.000007331595,0.00007109459,0.00005876415,0.0021420503,0.0010530322,0.004012878,0.991572,0.000026800397],"about_ca_topic_score_codex":0.100121625,"about_ca_topic_score_gemma":0.18143435,"teacher_disagreement_score":0.100121625,"about_ca_system_score_codex":0.004035731,"about_ca_system_score_gemma":0.009156634,"threshold_uncertainty_score":0.3319832},"labels":[],"label_agreement":null},{"id":"W1529503031","doi":"10.1007/11531371_38","title":"An Experiment on the Matching and Reuse of XML Schemas","year":2005,"lang":"en","type":"book-chapter","venue":"Lecture notes in computer science","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":21,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Université de Sherbrooke; University of Windsor","funders":"","keywords":"XML Schema Editor; Computer science; XML validation; Document Structure Description; Efficient XML Interchange; RELAX NG; Streaming XML; XML Schema (W3C); Information retrieval; XML database; XML Encryption; XML; Schema matching; Database; World Wide Web; Data integration","score_opus":0.021328582114346406,"score_gpt":0.2634941184819652,"score_spread":0.24216553636761878,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W1529503031","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.98715556,0.000413169,0.0063675977,0.00042054447,0.00012460594,0.0002989332,0.0011312047,0.0010393428,0.0030490125],"genre_scores_gemma":[0.9537772,0.00029806854,0.034931295,0.00039679435,0.000073491196,0.0003465101,0.0043046037,0.00036521722,0.0055068457],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9886231,0.0063595814,0.0015181525,0.0016247615,0.0014609443,0.00041350475],"domain_scores_gemma":[0.7181526,0.2503161,0.0036397108,0.019144835,0.0062921327,0.0024545977],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.011270903,0.0008848664,0.0010576219,0.0011479902,0.00090825383,0.0016011974,0.0026274344,0.0034129994,0.008838553],"category_scores_gemma":[0.083216555,0.0009148995,0.0009930156,0.0016658963,0.001633009,0.005692424,0.0018024637,0.0020940406,0.0018242726],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.13359708,0.07484092,0.08536565,0.008229364,0.0024098016,0.002277091,0.008511607,0.041663215,0.19197437,0.010824416,0.021162326,0.4191442],"study_design_scores_gemma":[0.024258582,0.09663666,0.09666778,0.0007181472,0.0039610323,0.0050190557,0.007907492,0.43238223,0.26830015,0.023638396,0.03981433,0.00069613644],"about_ca_topic_score_codex":0.005112997,"about_ca_topic_score_gemma":0.003090065,"teacher_disagreement_score":0.011270903,"about_ca_system_score_codex":0.00067421363,"about_ca_system_score_gemma":0.0013242611,"threshold_uncertainty_score":0.05960691},"labels":[],"label_agreement":null},{"id":"W1533716782","doi":"10.1007/978-3-540-28637-0_20","title":"Web Page Transformation When Switching Devices","year":2004,"lang":"en","type":"book-chapter","venue":"Lecture notes in computer science","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":32,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Dalhousie University","funders":"","keywords":"Computer science; Transformation (genetics); World Wide Web","score_opus":0.01583395283593206,"score_gpt":0.23486221410478436,"score_spread":0.2190282612688523,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W1533716782","genre_codex":"empirical","genre_gemma":"other","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"other","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.4161316,0.000709243,0.38885388,0.0011083825,0.0016387941,0.0006019096,0.0018239848,0.06708189,0.12205027],"genre_scores_gemma":[0.88368756,0.00029866458,0.06884689,0.00027677996,0.000111420755,0.00010665425,0.0019447095,0.004391633,0.040335562],"study_design_codex":"design_other","study_design_gemma":"not_applicable","domain_scores_codex":[0.9987663,0.00012861595,0.00007860711,0.00022498205,0.0005445966,0.00025698243],"domain_scores_gemma":[0.99574935,0.0013932849,0.00015643387,0.0019631134,0.0005488801,0.00018884325],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0006211714,0.00052399666,0.0005586455,0.0010255451,0.00061069126,0.0025190003,0.001108905,0.0010274339,0.02077595],"category_scores_gemma":[0.0064215064,0.00048640303,0.0005963956,0.0009777001,0.00060424616,0.003780731,0.0013245752,0.0010755274,0.004974987],"study_design_candidate":"not_applicable","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0027190081,0.0009640906,0.01027002,0.00049676595,0.00009007986,0.004103505,0.0012422613,0.0147831105,0.11264611,0.038967136,0.05682541,0.75689244],"study_design_scores_gemma":[0.00019506877,0.00053016545,0.013829744,0.00022361845,0.0002442358,0.003943853,0.0022586517,0.33361956,0.41050127,0.1063935,0.12811837,0.00014200815],"about_ca_topic_score_codex":0.0011191794,"about_ca_topic_score_gemma":0.0013666429,"teacher_disagreement_score":0.02077595,"about_ca_system_score_codex":0.00030287754,"about_ca_system_score_gemma":0.00045745895,"threshold_uncertainty_score":0.06950247},"labels":[],"label_agreement":null},{"id":"W1535195418","doi":"","title":"Designing an Integrated Bookmark / History System for Web Browsing","year":2000,"lang":"en","type":"article","venue":"","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":13,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Calgary","funders":"","keywords":"Thumbnail; World Wide Web; Computer science; The Internet; Web page; Web browser; Filter (signal processing)","score_opus":0.028972746057839813,"score_gpt":0.226619682865625,"score_spread":0.1976469368077852,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W1535195418","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.045554038,0.00031590703,0.8262743,0.00026253954,0.000092128495,0.0018762471,0.0006396022,0.120243594,0.0047417697],"genre_scores_gemma":[0.07500813,0.00016314787,0.9151689,0.00017248833,0.00004951072,0.000431616,0.0013027635,0.0023368616,0.005366681],"study_design_codex":"design_other","study_design_gemma":"bench_or_experimental","domain_scores_codex":[0.99843794,0.0002386336,0.00019548499,0.00047502606,0.0005539444,0.00009902125],"domain_scores_gemma":[0.9945405,0.0018506566,0.00034438,0.0015583867,0.0011782834,0.0005278678],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0033889443,0.0006825826,0.0011690074,0.002358662,0.0009973703,0.00323013,0.0025416403,0.0012305686,0.006716192],"category_scores_gemma":[0.007752213,0.0010697963,0.00070072117,0.0020258548,0.0007114782,0.00623156,0.0018907664,0.0013756827,0.003069961],"study_design_candidate":"bench_or_experimental","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0010630598,0.0010767432,0.019911218,0.00079549605,0.00022839189,0.00075724267,0.0023678723,0.009175552,0.08039966,0.0069384356,0.026102858,0.85118353],"study_design_scores_gemma":[0.00085638673,0.0020014623,0.025637133,0.00035867104,0.0008919964,0.0024949352,0.0012716805,0.50593877,0.24928294,0.015323034,0.19517148,0.00077159563],"about_ca_topic_score_codex":0.0037468104,"about_ca_topic_score_gemma":0.0062753833,"teacher_disagreement_score":0.006716192,"about_ca_system_score_codex":0.0007034564,"about_ca_system_score_gemma":0.001723006,"threshold_uncertainty_score":0.022467911},"labels":[],"label_agreement":null},{"id":"W1540779876","doi":"10.1007/978-3-540-30480-7_16","title":"Wrapping HTML Tables into XML","year":2004,"lang":"en","type":"book-chapter","venue":"Lecture notes in computer science","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":6,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Carleton University","funders":"","keywords":"Computer science; XML; Programming language; Information retrieval; World Wide Web","score_opus":0.01515788186687181,"score_gpt":0.2384742168423802,"score_spread":0.2233163349755084,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W1540779876","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0063769934,0.00037596354,0.90734863,0.00036131623,0.0003844523,0.00018302811,0.0023613924,0.06876149,0.013846711],"genre_scores_gemma":[0.0867254,0.0019680986,0.78301215,0.0010551943,0.00019812273,0.00041815176,0.026198188,0.03142183,0.06900286],"study_design_codex":"design_other","study_design_gemma":"not_applicable","domain_scores_codex":[0.99907744,0.00016068648,0.00013612781,0.00016587548,0.0003856669,0.00007416868],"domain_scores_gemma":[0.99748766,0.0009070135,0.000087415756,0.001102722,0.0003443825,0.00007081412],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0014700316,0.001198597,0.0007717432,0.0021755365,0.0005999663,0.0033912945,0.0016801336,0.0010765453,0.01582085],"category_scores_gemma":[0.0054839174,0.0016871128,0.0015209841,0.003175812,0.00057316304,0.004373256,0.0029903003,0.0015847703,0.013556569],"study_design_candidate":"not_applicable","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00022718671,0.0002561044,0.001619855,0.00087058346,0.00015492758,0.001260786,0.0014585077,0.008098916,0.026965138,0.05608794,0.13034926,0.7726508],"study_design_scores_gemma":[0.00010407431,0.00010404097,0.0015797886,0.000701164,0.0002653075,0.0015782813,0.0004527243,0.08640899,0.14580795,0.10495303,0.65788263,0.00016199898],"about_ca_topic_score_codex":0.0014461654,"about_ca_topic_score_gemma":0.0014175484,"teacher_disagreement_score":0.01582085,"about_ca_system_score_codex":0.00048252422,"about_ca_system_score_gemma":0.00053763884,"threshold_uncertainty_score":0.052926064},"labels":[],"label_agreement":null},{"id":"W1543092769","doi":"","title":"Effect of different network analysis strategies on search engine re-ranking","year":2004,"lang":"en","type":"article","venue":"Conference of the Centre for Advanced Studies on Collaborative Research","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":3,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Toronto; Toronto Metropolitan University","funders":"","keywords":"Search engine; Information retrieval; Computer science; Ranking (information retrieval); Citation; Relevance (law); Set (abstract data type); Learning to rank; Web search query; Metasearch engine; Data mining; World Wide Web","score_opus":0.06323160916407666,"score_gpt":0.398864937114471,"score_spread":0.33563332795039436,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W1543092769","genre_codex":"empirical","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.95257664,0.0033599883,0.033802677,0.00080090726,0.00020842743,0.00073374086,0.00044149597,0.00213458,0.0059416406],"genre_scores_gemma":[0.96246266,0.0007038609,0.03463194,0.00012213143,0.0000837776,0.0002478877,0.00043647733,0.00021615253,0.0010950929],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9883824,0.0071737017,0.000977479,0.0008881428,0.0019742625,0.00060406694],"domain_scores_gemma":[0.848695,0.13244276,0.005172361,0.005446217,0.0070619895,0.0011816733],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.01225089,0.0019107069,0.0016442147,0.006453891,0.0012640944,0.0036132173,0.0016239547,0.0016867114,0.0014376438],"category_scores_gemma":[0.10426725,0.0005316984,0.0009410908,0.004143067,0.0007689122,0.0063729635,0.0011373704,0.0013536233,0.0006024555],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.014405246,0.0053014793,0.071054295,0.0020662218,0.0020984742,0.0007407413,0.002121589,0.21138525,0.038599484,0.008291236,0.0061622607,0.6377737],"study_design_scores_gemma":[0.0012975427,0.0077559697,0.0439841,0.0003099906,0.002299115,0.0010267473,0.0031645712,0.87315565,0.04365967,0.015366731,0.007553055,0.00042682924],"about_ca_topic_score_codex":0.0057884343,"about_ca_topic_score_gemma":0.007831101,"teacher_disagreement_score":0.01225089,"about_ca_system_score_codex":0.001499163,"about_ca_system_score_gemma":0.0016165214,"threshold_uncertainty_score":0.06478965},"labels":[],"label_agreement":null},{"id":"W1544683773","doi":"10.1007/978-3-540-89796-5_38","title":"Automatic Web Page Classification Using Various Features","year":2008,"lang":"en","type":"book-chapter","venue":"Lecture notes in computer science","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":9,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Toronto Metropolitan University","funders":"","keywords":"Computer science; Web page; Information retrieval; Artificial intelligence; World Wide Web","score_opus":0.031645864750477905,"score_gpt":0.25931603903771194,"score_spread":0.22767017428723405,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W1544683773","genre_codex":"empirical","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.6344538,0.003238847,0.3173377,0.0003404045,0.00042177696,0.00045878874,0.008209729,0.019491637,0.016047422],"genre_scores_gemma":[0.79044515,0.0006994108,0.18337637,0.00010043013,0.0002571865,0.00016998292,0.011242592,0.0004276774,0.013281227],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9996099,0.00003291635,0.00002936995,0.00010174722,0.00016376119,0.00006243263],"domain_scores_gemma":[0.99920803,0.00027917683,0.00007371977,0.00009887465,0.0002732825,0.000066978035],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.00036060103,0.00059948844,0.0009421724,0.005122173,0.0004635429,0.001095621,0.00051726383,0.00060401816,0.0033103013],"category_scores_gemma":[0.001092879,0.0001654209,0.0007284595,0.003219378,0.00015963115,0.0013996982,0.000502414,0.000453111,0.0028411315],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00042941084,0.00042909788,0.020061344,0.00022394718,0.00007608375,0.0001904242,0.00005173105,0.0016850645,0.05942879,0.00058525515,0.010876441,0.90596235],"study_design_scores_gemma":[0.00010114834,0.00079209264,0.16771385,0.00014284541,0.00056680886,0.0021345913,0.00035141275,0.65977997,0.13827239,0.007241705,0.022780083,0.00012312846],"about_ca_topic_score_codex":0.0014838757,"about_ca_topic_score_gemma":0.002788092,"teacher_disagreement_score":0.005122173,"about_ca_system_score_codex":0.00023219593,"about_ca_system_score_gemma":0.0003395037,"threshold_uncertainty_score":0.011074007},"labels":[],"label_agreement":null},{"id":"W1544996779","doi":"10.1007/978-3-540-78808-9_12","title":"A Phrase Recommendation Algorithm Based on Query Stream Mining in Web Search Engines","year":2008,"lang":"en","type":"book-chapter","venue":"Lecture notes in computer science","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":0,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of New Brunswick","funders":"","keywords":"Computer science; Phrase; Recommender system; Phrase search; Information retrieval; Set (abstract data type); Web search query; Artificial intelligence; Search engine; Web query classification; Data mining","score_opus":0.02337569642548815,"score_gpt":0.2581162057507853,"score_spread":0.23474050932529716,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W1544996779","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.06024697,0.0021851035,0.92872757,0.00045215595,0.00023412844,0.00043063343,0.0009281134,0.004845957,0.0019494272],"genre_scores_gemma":[0.17781772,0.0008952902,0.8130326,0.00023167678,0.00034678963,0.00033038523,0.002240251,0.00020456598,0.0049007707],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.99904734,0.00016423066,0.00010888473,0.00018918632,0.00040486036,0.00008557837],"domain_scores_gemma":[0.9984199,0.0006509173,0.00007426591,0.00015596113,0.0006350068,0.00006402732],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0012527431,0.00071549014,0.0023041845,0.002956109,0.0007997813,0.0012575131,0.0019403573,0.001261276,0.0028982826],"category_scores_gemma":[0.0036169032,0.00050847366,0.00096289674,0.0039690454,0.00034218267,0.0019851632,0.000657005,0.0009723262,0.0019881064],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00075535855,0.00047902734,0.0043134405,0.00021737546,0.00019467394,0.0001446956,0.000102838676,0.019178178,0.021990249,0.003642266,0.0127070835,0.9362749],"study_design_scores_gemma":[0.00015881062,0.00022813401,0.0020859533,0.000016936763,0.00017650901,0.0002479727,0.00005033386,0.9799355,0.0099404855,0.0038608138,0.0032586541,0.00003987128],"about_ca_topic_score_codex":0.01110262,"about_ca_topic_score_gemma":0.011531764,"teacher_disagreement_score":0.01110262,"about_ca_system_score_codex":0.00056800933,"about_ca_system_score_gemma":0.0015281608,"threshold_uncertainty_score":0.02207601},"labels":[],"label_agreement":null},{"id":"W1546518574","doi":"10.1007/3-540-45486-1_34","title":"Task-Structure Based Mediation: The Travel-Planning Assistant Example","year":2000,"lang":"en","type":"book-chapter","venue":"Lecture notes in computer science","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":7,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Alberta","funders":"","keywords":"Computer science; Task (project management); Architecture; Mediation; Set (abstract data type); Domain (mathematical analysis); Variety (cybernetics); Human–computer interaction; World Wide Web; Web service; Artificial intelligence","score_opus":0.020851723888740452,"score_gpt":0.23869542401750257,"score_spread":0.2178437001287621,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W1546518574","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.15414993,0.0007533275,0.63260406,0.006198748,0.00028731808,0.0004962291,0.0009340355,0.0030302098,0.20154607],"genre_scores_gemma":[0.801481,0.00040442136,0.15965526,0.0002875158,0.000064403685,0.00025407493,0.00036988844,0.00019386564,0.03728955],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9988318,0.0005629437,0.000046401725,0.00014231476,0.00018593944,0.0002305597],"domain_scores_gemma":[0.99688727,0.0019689344,0.00008870421,0.00053423655,0.00023416137,0.0002867599],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0014851148,0.0005811897,0.00085780997,0.000578464,0.0023765902,0.00237453,0.0024640698,0.0035910476,0.020203099],"category_scores_gemma":[0.007283773,0.0004841817,0.0011740084,0.0014035753,0.0014255327,0.004439601,0.0028103162,0.0019428104,0.0024415918],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0017734744,0.0013996261,0.0043613818,0.0005591813,0.00017771016,0.0059284866,0.0057675284,0.07422593,0.010099591,0.738959,0.024071062,0.13267703],"study_design_scores_gemma":[0.0006742971,0.00042437646,0.0015269971,0.00008702355,0.00022266812,0.0017090974,0.0035193572,0.37897772,0.0099011855,0.53592247,0.06690502,0.00012975637],"about_ca_topic_score_codex":0.009693844,"about_ca_topic_score_gemma":0.007162205,"teacher_disagreement_score":0.020203099,"about_ca_system_score_codex":0.00066577905,"about_ca_system_score_gemma":0.0018802027,"threshold_uncertainty_score":0.067586064},"labels":[],"label_agreement":null},{"id":"W1554198265","doi":"10.1007/978-3-540-31849-1_33","title":"Making DTD a Truly Powerful Schema Language","year":2005,"lang":"en","type":"book-chapter","venue":"Lecture notes in computer science","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":0,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Carleton University","funders":"","keywords":"Computer science; Schema (genetic algorithms); Programming language; Natural language processing; Information retrieval; Artificial intelligence","score_opus":0.02090417509429613,"score_gpt":0.2752320241306938,"score_spread":0.25432784903639766,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W1554198265","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0013414886,0.00030923384,0.9838457,0.00093707145,0.00046122906,0.0000563564,0.0011609638,0.0074312347,0.004456668],"genre_scores_gemma":[0.03200141,0.0011454644,0.94090134,0.0012267225,0.0002810306,0.00021640013,0.004481382,0.00542465,0.014321568],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.9968809,0.00056216464,0.0005120144,0.0007069829,0.0012026947,0.00013510943],"domain_scores_gemma":[0.99522084,0.0014100841,0.00015296863,0.002444969,0.00060356193,0.00016765585],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.004102395,0.0007866545,0.0008290013,0.0014291336,0.0007514686,0.0044545103,0.002690066,0.0011555959,0.010072646],"category_scores_gemma":[0.008219545,0.0015284227,0.0018167901,0.0021467756,0.0017071433,0.011404391,0.004831847,0.004620838,0.006150811],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00011576128,0.00005535203,0.0006844825,0.00056522636,0.000093068804,0.0002067872,0.0006019877,0.0029282605,0.012449036,0.5970417,0.06442804,0.32083035],"study_design_scores_gemma":[0.000047878086,0.000030220988,0.00010617831,0.0001350106,0.000107201784,0.0005319201,0.00009402474,0.017908676,0.02207925,0.32323962,0.6356733,0.00004680013],"about_ca_topic_score_codex":0.0009153643,"about_ca_topic_score_gemma":0.0012044545,"teacher_disagreement_score":0.010072646,"about_ca_system_score_codex":0.0009820206,"about_ca_system_score_gemma":0.0017192675,"threshold_uncertainty_score":0.033696353},"labels":[],"label_agreement":null},{"id":"W1554796723","doi":"10.1007/3-540-46105-1_24","title":"Finding Similar Queries to Satisfy Searches Based on Query Traces","year":2002,"lang":"en","type":"book-chapter","venue":"Lecture notes in computer science","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":45,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Alberta","funders":"","keywords":"Computer science; Information retrieval; Web query classification; Search engine; Web search query; Similarity (geometry); Query expansion; Task (project management); Spatial query; Disappointment; Query language; Sargable; Query optimization; Variety (cybernetics); Search-oriented architecture; Ranking (information retrieval); Data mining; Artificial intelligence","score_opus":0.039374169030028223,"score_gpt":0.2637484585050917,"score_spread":0.2243742894750635,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W1554796723","genre_codex":"empirical","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.74615854,0.0016264502,0.23623364,0.0018094821,0.00014080608,0.0007322758,0.0032941634,0.0066175577,0.0033871022],"genre_scores_gemma":[0.8563855,0.0005289022,0.13304687,0.0002888143,0.00014244186,0.00018777364,0.006816828,0.00068142964,0.0019214054],"study_design_codex":"design_other","study_design_gemma":"not_applicable","domain_scores_codex":[0.9932921,0.0009499323,0.00086412474,0.0009868486,0.003230663,0.00067631446],"domain_scores_gemma":[0.97004145,0.018941974,0.0015897754,0.0038278014,0.0042205746,0.0013784812],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0033540397,0.0011752655,0.002311336,0.006860778,0.0015285675,0.0038264312,0.0022744301,0.0022825545,0.0023471352],"category_scores_gemma":[0.03661977,0.0008740599,0.0016766445,0.005087417,0.0011898152,0.007966313,0.002271103,0.0021005545,0.0009987768],"study_design_candidate":"not_applicable","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.006763405,0.0029599671,0.198836,0.0023886203,0.0015284749,0.002629296,0.0047747265,0.068086796,0.15861471,0.0358534,0.021499997,0.49606472],"study_design_scores_gemma":[0.00021833795,0.000930008,0.016170213,0.000118618766,0.00064667594,0.002161176,0.0023303223,0.8823588,0.04429063,0.042357627,0.008287021,0.0001306135],"about_ca_topic_score_codex":0.0054953117,"about_ca_topic_score_gemma":0.008153332,"teacher_disagreement_score":0.006860778,"about_ca_system_score_codex":0.0011172385,"about_ca_system_score_gemma":0.0030165724,"threshold_uncertainty_score":0.017738104},"labels":[],"label_agreement":null},{"id":"W1555770568","doi":"10.7202/1029496ar","title":"Problèmes de repérage des ressources bibliographiques en langue chinoise : une perspective occidentale","year":2015,"lang":"fr","type":"article","venue":"Documentation et bibliothèques","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":true,"route_about_ca":false,"ca_institutions":"","funders":"","keywords":"Humanities; Political science; Rage (emotion); Philosophy; Psychology","score_opus":0.04202179728818354,"score_gpt":0.35252880033938955,"score_spread":0.310507003051206,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W1555770568","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.7529066,0.027254857,0.05994958,0.014890783,0.00021578527,0.0003560087,0.0061087636,0.0009099632,0.13740763],"genre_scores_gemma":[0.92934805,0.011809735,0.03720015,0.0002612829,0.00007712269,0.00014379188,0.0024695094,0.00014246201,0.018547783],"study_design_codex":"design_other","study_design_gemma":"not_applicable","domain_scores_codex":[0.9973226,0.0008211425,0.00016305025,0.00044148377,0.000986759,0.0002649769],"domain_scores_gemma":[0.9911021,0.0040509324,0.00082377985,0.000685747,0.0030548198,0.00028262666],"candidate_categories":["scholarly_communication"],"consensus_categories":[],"category_scores_codex":[0.004487023,0.0006475862,0.0007577434,0.010438484,0.0034639998,0.0076088104,0.0010645062,0.0008899447,0.004388914],"category_scores_gemma":[0.01341203,0.00030513998,0.00070328347,0.022191403,0.0024492445,0.00344615,0.002097545,0.00082002545,0.0005191982],"study_design_candidate":"not_applicable","study_design_consensus":null,"about_ca_topic_candidate":true,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.000221435,0.00010227481,0.28337175,0.0035271167,0.00050079904,0.002307464,0.0789186,0.010637682,0.008038309,0.09601449,0.009856246,0.5065038],"study_design_scores_gemma":[0.000034109184,0.00013326512,0.47022316,0.0030939141,0.0007253205,0.0015083236,0.16405982,0.01712996,0.009537893,0.032740526,0.3005641,0.00024966485],"about_ca_topic_score_codex":0.56491506,"about_ca_topic_score_gemma":0.6584299,"teacher_disagreement_score":0.99239117,"about_ca_system_score_codex":0.010516793,"about_ca_system_score_gemma":0.013974464,"threshold_uncertainty_score":0.87529445},"labels":[],"label_agreement":null},{"id":"W1556161798","doi":"","title":"Generating custom notification histories by tracking visual differences between web page visits","year":2006,"lang":"en","type":"article","venue":"Graphics Interface","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":10,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Calgary","funders":"","keywords":"Bitmap; Computer science; Timestamp; Web page; World Wide Web; Representation (politics); Clipping (morphology); Information retrieval; Computer graphics (images)","score_opus":0.023948552214001537,"score_gpt":0.26833109219246387,"score_spread":0.24438253997846232,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W1556161798","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.10276544,0.00031759116,0.82189703,0.00022181864,0.00024437497,0.000759257,0.0017807717,0.0649157,0.0070980885],"genre_scores_gemma":[0.42397162,0.00030835494,0.5570275,0.00016461987,0.00020662443,0.00056294433,0.003943523,0.003940788,0.009874017],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.99835795,0.0003517988,0.0001380597,0.00050095964,0.00057094963,0.000080263686],"domain_scores_gemma":[0.9892412,0.00428321,0.0011092819,0.0030779403,0.0014732825,0.00081506645],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.002646586,0.001119454,0.0008569546,0.0025285075,0.0005284381,0.0019084694,0.0014689331,0.0008144869,0.004580073],"category_scores_gemma":[0.015109327,0.0007106907,0.00054282305,0.001229667,0.00034046214,0.0022703325,0.0017932662,0.0007641452,0.0017142026],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0017356944,0.0006298786,0.023806605,0.00048253452,0.00012177368,0.0007478818,0.0035196631,0.00872521,0.03787574,0.0036645788,0.016808959,0.9018816],"study_design_scores_gemma":[0.00047318928,0.0012110198,0.054447036,0.00026818112,0.0005012252,0.0021328188,0.0017855014,0.54443717,0.20957215,0.015409426,0.16911504,0.00064731453],"about_ca_topic_score_codex":0.002941084,"about_ca_topic_score_gemma":0.0043675294,"teacher_disagreement_score":0.004580073,"about_ca_system_score_codex":0.0004964882,"about_ca_system_score_gemma":0.00081385655,"threshold_uncertainty_score":0.01532191},"labels":[],"label_agreement":null},{"id":"W1557531196","doi":"","title":"Information discovery within organizations using the Athens system","year":2004,"lang":"en","type":"article","venue":"Conference of the Centre for Advanced Studies on Collaborative Research","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":6,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Queen's University","funders":"","keywords":"Computer science; Information retrieval; Web query classification; Query expansion; Web search query; Set (abstract data type); Scope (computer science); Query language; IBM; Task (project management); Cluster analysis; World Wide Web; Information system; Search engine; Artificial intelligence","score_opus":0.08217917438116418,"score_gpt":0.3723316813248209,"score_spread":0.29015250694365674,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W1557531196","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.50649583,0.0023129906,0.2528501,0.0036181,0.00025799213,0.0012159116,0.019047067,0.13514376,0.07905829],"genre_scores_gemma":[0.62960374,0.00093639543,0.32266515,0.00045055235,0.00015501775,0.0004558594,0.0292681,0.0010905765,0.015374608],"study_design_codex":"design_other","study_design_gemma":"not_applicable","domain_scores_codex":[0.9964569,0.00081694446,0.0004942988,0.0008805125,0.0012086409,0.00014261201],"domain_scores_gemma":[0.9935248,0.0028297822,0.0006630566,0.0019987777,0.0006084712,0.00037527495],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0030511415,0.00031358478,0.0006503562,0.006028734,0.0014308337,0.003453919,0.000925295,0.00094729185,0.00340533],"category_scores_gemma":[0.011686168,0.00047972298,0.00055316655,0.005273604,0.0007219597,0.0046474757,0.0032445581,0.0006526632,0.0016781922],"study_design_candidate":"not_applicable","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0027868568,0.0007181533,0.07876287,0.00095988985,0.00051910477,0.001998965,0.0063021244,0.023038752,0.030814854,0.06624252,0.08563793,0.70221794],"study_design_scores_gemma":[0.00034158185,0.00023085819,0.031081326,0.00020895539,0.00024720907,0.0011572064,0.0022044813,0.34247506,0.043029543,0.043520663,0.5352548,0.00024839875],"about_ca_topic_score_codex":0.015006069,"about_ca_topic_score_gemma":0.014792,"teacher_disagreement_score":0.015006069,"about_ca_system_score_codex":0.001793092,"about_ca_system_score_gemma":0.0021247973,"threshold_uncertainty_score":0.02983743},"labels":[],"label_agreement":null},{"id":"W1563293148","doi":"10.1007/978-1-4471-0105-5_15","title":"How People Recognise Previously Seen Web Pages from Titles, URLs and Thumbnails","year":2002,"lang":"en","type":"book-chapter","venue":"","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":73,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Calgary","funders":"","keywords":"Thumbnail; Computer science; World Wide Web; Information retrieval; Web page; String (physics); Image (mathematics); Artificial intelligence; Mathematics","score_opus":0.027096102520495984,"score_gpt":0.19783877709056283,"score_spread":0.17074267457006684,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W1563293148","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.6436484,0.008374853,0.25880316,0.0045827543,0.001550685,0.00033242963,0.002845665,0.009006662,0.070855424],"genre_scores_gemma":[0.7523569,0.0047859573,0.16044664,0.0023591511,0.0003217299,0.00019822529,0.0038560012,0.0011164132,0.07455901],"study_design_codex":"design_other","study_design_gemma":"observational","domain_scores_codex":[0.9995455,0.0000693118,0.000022990922,0.0001821284,0.00013652747,0.00004342181],"domain_scores_gemma":[0.99830097,0.0009897638,0.00008498169,0.00015161767,0.0003664762,0.00010630099],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.00078577263,0.0006231501,0.00051315,0.0011222033,0.000381995,0.003151535,0.0008107361,0.0020663312,0.005759657],"category_scores_gemma":[0.0058400026,0.00040579712,0.0006173692,0.00084156875,0.0004919241,0.0072144694,0.0009929725,0.00094759284,0.0077736992],"study_design_candidate":"observational","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0006356913,0.0002101797,0.02818078,0.0005785284,0.00020392369,0.0005015028,0.0062293145,0.001264202,0.061939552,0.0021231207,0.045072976,0.85306025],"study_design_scores_gemma":[0.00020928704,0.0012729573,0.20865577,0.0008960008,0.0013118049,0.012624893,0.036407985,0.2643929,0.168773,0.092317805,0.21242985,0.00070782873],"about_ca_topic_score_codex":0.0039294865,"about_ca_topic_score_gemma":0.0037751948,"teacher_disagreement_score":0.005759657,"about_ca_system_score_codex":0.00022113051,"about_ca_system_score_gemma":0.00022290676,"threshold_uncertainty_score":0.019267976},"labels":[],"label_agreement":null},{"id":"W1566915699","doi":"10.1007/978-3-540-73078-1_54","title":"Multiple Evidence Combination in Web Site Search Based on Users’ Access Histories","year":2007,"lang":"en","type":"book-chapter","venue":"Lecture notes in computer science","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":0,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"IBM (Canada); Toronto Metropolitan University","funders":"","keywords":"Computer science; Web site; Information retrieval; Search engine; World Wide Web; Baseline (sea); Web server; Data mining; The Internet","score_opus":0.06809082929141408,"score_gpt":0.3126195281885981,"score_spread":0.24452869889718404,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W1566915699","genre_codex":"empirical","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.5571485,0.016964268,0.41430026,0.0018556628,0.00029178642,0.00053539296,0.002232512,0.0014635307,0.005208123],"genre_scores_gemma":[0.9035941,0.0011269666,0.09145001,0.00011477553,0.0002568462,0.00015278069,0.0013810161,0.00006162034,0.0018620228],"study_design_codex":"design_other","study_design_gemma":"not_applicable","domain_scores_codex":[0.98958033,0.0038698595,0.0012707193,0.0010608165,0.0036474366,0.00057086605],"domain_scores_gemma":[0.91091037,0.08102784,0.002021165,0.002108688,0.003034403,0.00089756004],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.010117514,0.001245727,0.00400758,0.016131222,0.0013620963,0.0043342174,0.0032388775,0.004718398,0.0025036049],"category_scores_gemma":[0.045516644,0.0015578542,0.0025874462,0.010948057,0.001222447,0.0081770085,0.0023273006,0.002571729,0.0008247171],"study_design_candidate":"not_applicable","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0068802168,0.0018279853,0.14373368,0.0019394987,0.0029321928,0.0024548501,0.00085529,0.11719844,0.008617589,0.0071038157,0.005514776,0.7009417],"study_design_scores_gemma":[0.00016225674,0.0003762965,0.017550053,0.00018494463,0.0013486694,0.0012537829,0.00032223584,0.9580959,0.005070043,0.01415076,0.0013701392,0.00011485575],"about_ca_topic_score_codex":0.0050131753,"about_ca_topic_score_gemma":0.008970338,"teacher_disagreement_score":0.016131222,"about_ca_system_score_codex":0.0010544393,"about_ca_system_score_gemma":0.0017335668,"threshold_uncertainty_score":0.05350715},"labels":[],"label_agreement":null},{"id":"W1570003767","doi":"","title":"Predicting Future User Actions by Observing Unmodified Applications","year":2000,"lang":"en","type":"article","venue":"","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":42,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of British Columbia","funders":"","keywords":"Computer science; User interface; User modeling; Human–computer interaction; State space; Software; User interface design; State (computer science); Space (punctuation); Machine learning; Artificial intelligence; Distributed computing; Data mining; User experience design; Algorithm; Programming language","score_opus":0.01742366038573868,"score_gpt":0.2458363644001544,"score_spread":0.22841270401441574,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W1570003767","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.6601502,0.00029402226,0.3312081,0.00034036668,0.000027179767,0.00017530688,0.00069366663,0.004679373,0.002431852],"genre_scores_gemma":[0.92929024,0.00018528187,0.06883154,0.00004659596,0.000014665272,0.00006973535,0.0006866812,0.00007805075,0.000797282],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.99936,0.00019801558,0.000044848613,0.00016473672,0.0001895,0.00004291148],"domain_scores_gemma":[0.995394,0.0027477124,0.0005372946,0.00066445296,0.0005311413,0.00012541075],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0008818423,0.0008232936,0.0005575173,0.00087293296,0.00028403278,0.000989634,0.00069396675,0.00083765126,0.0008680372],"category_scores_gemma":[0.007970376,0.00053327996,0.00042386295,0.00059313944,0.00041179883,0.0018016117,0.000624157,0.0010421735,0.00061366166],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0008580034,0.00086096564,0.19000673,0.00023456418,0.00022342327,0.0002845737,0.0008636729,0.38502368,0.025712814,0.0023888382,0.0039311284,0.38961163],"study_design_scores_gemma":[0.0000084022095,0.00010035668,0.013964847,0.000007212868,0.000027318292,0.000047445712,0.000053979067,0.97928786,0.0040333355,0.0018600458,0.0005893988,0.000019857638],"about_ca_topic_score_codex":0.008221854,"about_ca_topic_score_gemma":0.015975365,"teacher_disagreement_score":0.008221854,"about_ca_system_score_codex":0.00047999056,"about_ca_system_score_gemma":0.00063305,"threshold_uncertainty_score":0.016348004},"labels":[],"label_agreement":null},{"id":"W1572418368","doi":"10.1007/978-3-540-68825-9_6","title":"A Frequency Mining-Based Algorithm for Re-ranking Web Search Engine Retrievals","year":2008,"lang":"en","type":"book-chapter","venue":"Lecture notes in computer science","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":7,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of New Brunswick","funders":"","keywords":"Computer science; Rank (graph theory); Ranking (information retrieval); Search engine; Information retrieval; Learning to rank; Web page; Data mining; Domain (mathematical analysis); Matrix (chemical analysis); Algorithm; Web search engine; Web search query; World Wide Web; Mathematics","score_opus":0.029718555459894772,"score_gpt":0.26621425775055235,"score_spread":0.23649570229065758,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W1572418368","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.032809064,0.0015288113,0.9569057,0.00027829257,0.00033347597,0.00038914336,0.0006744094,0.0048469203,0.0022341553],"genre_scores_gemma":[0.11855945,0.00042170117,0.87335455,0.00015108586,0.00031939882,0.00027977634,0.0014844935,0.00023805346,0.0051915064],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.99637645,0.0005158933,0.0003792297,0.00051333854,0.0019750842,0.0002399773],"domain_scores_gemma":[0.9940891,0.0023694674,0.0003679903,0.00075295655,0.0022465982,0.00017393741],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0030043584,0.0011976006,0.002607253,0.009788599,0.0014019522,0.0023125273,0.0031010895,0.0018516302,0.004214421],"category_scores_gemma":[0.011337232,0.00063044345,0.0012907924,0.007722753,0.00057262357,0.0028558848,0.0013119833,0.0014306356,0.0030872517],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0003118562,0.00033915957,0.0034433142,0.00012513108,0.00015121928,0.000057465433,0.00007178036,0.01456372,0.010686674,0.0024304867,0.009052509,0.95876676],"study_design_scores_gemma":[0.00018264646,0.000437458,0.004546467,0.000044136206,0.00022062928,0.00081804954,0.00011118085,0.9558686,0.017114421,0.011126848,0.009426187,0.00010347069],"about_ca_topic_score_codex":0.0063614873,"about_ca_topic_score_gemma":0.0114718955,"teacher_disagreement_score":0.009788599,"about_ca_system_score_codex":0.0009965673,"about_ca_system_score_gemma":0.0021291988,"threshold_uncertainty_score":0.01588875},"labels":[],"label_agreement":null},{"id":"W1573292081","doi":"10.1007/3-540-45490-x_37","title":"A Theory and Approach to Improving Relevance Ranking in Web Retrieval","year":2001,"lang":"en","type":"book-chapter","venue":"Lecture notes in computer science","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":2,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Regina","funders":"","keywords":"Computer science; Information retrieval; Web page; Relevance (law); Ranking (information retrieval); Web search engine; World Wide Web; Search engine; Web search query","score_opus":0.013714645609097818,"score_gpt":0.23169170124991165,"score_spread":0.21797705564081382,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W1573292081","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0025244665,0.0022174993,0.99189466,0.00065536716,0.00019287293,0.0000987352,0.000093787254,0.0006715345,0.0016509738],"genre_scores_gemma":[0.08021548,0.0024951005,0.90854245,0.00067378255,0.001429063,0.00034448828,0.00034111887,0.00026221733,0.0056962096],"study_design_codex":"design_other","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.98686856,0.0052352594,0.00072736933,0.001472364,0.0051690703,0.0005273952],"domain_scores_gemma":[0.98079556,0.011847514,0.00072359125,0.002925955,0.0034312694,0.00027609794],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.010936647,0.0016370884,0.0039075394,0.0075061317,0.002150585,0.0043171714,0.005808554,0.0036118065,0.0061267084],"category_scores_gemma":[0.035248186,0.001334444,0.0025464308,0.008750809,0.0036401006,0.009865131,0.0032496466,0.0040528807,0.003119949],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00024288047,0.00047194646,0.0014035566,0.00097139034,0.00034519154,0.00011075291,0.00044188838,0.06955767,0.0063879513,0.24413195,0.028252572,0.6476823],"study_design_scores_gemma":[0.000106142455,0.0003505453,0.0007608413,0.0001035013,0.00032165178,0.00039671428,0.00012121075,0.6071695,0.0056366534,0.36862668,0.016297683,0.000108883505],"about_ca_topic_score_codex":0.0054264134,"about_ca_topic_score_gemma":0.005951298,"teacher_disagreement_score":0.010936647,"about_ca_system_score_codex":0.0022948573,"about_ca_system_score_gemma":0.0030581132,"threshold_uncertainty_score":0.057839215},"labels":[],"label_agreement":null},{"id":"W15738104","doi":"10.1145/2488388.2488459","title":"Imagen","year":2013,"lang":"es","type":"article","venue":"","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":41,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of British Columbia","funders":"","keywords":"Computer science; JavaScript; HTML5; Session (web analytics); Web browser; Rich Internet application; World Wide Web; Client-side scripting; Snapshot (computer storage); Operating system; Web application; Multimedia; Web page; Web API; The Internet; Web navigation","score_opus":0.010831532065370075,"score_gpt":0.2287507717079443,"score_spread":0.21791923964257423,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W15738104","genre_codex":"other","genre_gemma":"other","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"other","genre_consensus":"other","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0016126339,0.002082309,0.009456213,0.0022571036,0.002730081,0.00021462285,0.007915871,0.00771252,0.9660186],"genre_scores_gemma":[0.010979744,0.0019267128,0.0066301287,0.0015609909,0.0006893358,0.00011770067,0.009151052,0.002022479,0.96692187],"study_design_codex":"not_applicable","study_design_gemma":"not_applicable","domain_scores_codex":[0.9995241,0.000044395416,0.000028333674,0.000114892966,0.00023961147,0.0000486732],"domain_scores_gemma":[0.9992544,0.000109600165,0.000042214273,0.00016869661,0.0002813213,0.00014370035],"candidate_categories":["insufficient_payload"],"consensus_categories":[],"category_scores_codex":[0.00039540062,0.0010004386,0.0006569204,0.0020706148,0.00083371793,0.004332697,0.0014746962,0.0021037513,0.82206446],"category_scores_gemma":[0.0017874782,0.0003927613,0.0006097904,0.001517338,0.0005296097,0.0022059546,0.0019207642,0.0012577215,0.6563246],"study_design_candidate":"not_applicable","study_design_consensus":"not_applicable","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00022132439,0.00006713797,0.0005681433,0.00036817865,0.000015151412,0.00043633612,0.00008675002,0.00026255412,0.0039097667,0.007495695,0.63019675,0.35637218],"study_design_scores_gemma":[0.000018375673,0.0000144313335,0.00045259754,0.00007577635,0.0000047348744,0.0004441543,0.000039158575,0.00046113093,0.0007825224,0.001100386,0.99659926,0.0000074046225],"about_ca_topic_score_codex":0.0029449684,"about_ca_topic_score_gemma":0.0032522904,"teacher_disagreement_score":0.17793554,"about_ca_system_score_codex":0.0009707698,"about_ca_system_score_gemma":0.00076972484,"threshold_uncertainty_score":0},"labels":[],"label_agreement":null},{"id":"W1580924750","doi":"10.1609/aaai.v24i1.7502","title":"News Recommendation in Forum-Based Social Media","year":2010,"lang":"en","type":"article","venue":"Proceedings of the AAAI Conference on Artificial Intelligence","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":17,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Memorial University of Newfoundland","funders":"National Natural Science Foundation of China","keywords":"Computer science; World Wide Web; Moderation; Social media; Recommender system; Generalization; Information retrieval; Internet privacy","score_opus":0.07718165713992965,"score_gpt":0.3018259944924312,"score_spread":0.22464433735250156,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W1580924750","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.34525052,0.0026041917,0.6310601,0.0014075147,0.00045514642,0.00081399817,0.0005238589,0.005805697,0.012078909],"genre_scores_gemma":[0.83534336,0.00058954075,0.15595272,0.00013605213,0.00037880449,0.00022395699,0.0005167166,0.00010345139,0.0067554293],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.99754614,0.0012606435,0.000116223666,0.00030698575,0.000574007,0.00019600002],"domain_scores_gemma":[0.99117345,0.0047947015,0.0006072654,0.0010192215,0.0018174534,0.00058790436],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.005265141,0.00059784856,0.0009004913,0.002133228,0.0015724861,0.0023603512,0.0014305033,0.0016567522,0.0021168655],"category_scores_gemma":[0.011766215,0.0005464491,0.00092641177,0.0014013649,0.0005599334,0.0033321057,0.0011491467,0.0009860994,0.0012234645],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0028391532,0.0033749107,0.042294424,0.0009408934,0.0005571112,0.0018551283,0.0032714435,0.104070686,0.034086607,0.041120343,0.020904478,0.7446848],"study_design_scores_gemma":[0.0002580914,0.0004977138,0.0053974725,0.0000499262,0.0001735373,0.0002875483,0.0005229455,0.95687836,0.008111044,0.016486451,0.011242929,0.00009403574],"about_ca_topic_score_codex":0.008091269,"about_ca_topic_score_gemma":0.008448914,"teacher_disagreement_score":0.008091269,"about_ca_system_score_codex":0.000841511,"about_ca_system_score_gemma":0.0007114063,"threshold_uncertainty_score":0.027845085},"labels":[],"label_agreement":null},{"id":"W1582856601","doi":"10.1007/3-540-44839-x_49","title":"Neural Based Approach to Keyword Extraction from Documents","year":2003,"lang":"en","type":"book-chapter","venue":"Lecture notes in computer science","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":17,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Ottawa","funders":"","keywords":"Keyword extraction; Computer science; Information retrieval; Extraction (chemistry); Natural language processing; Keyword search; Artificial intelligence; Chromatography; Chemistry","score_opus":0.02153317523767367,"score_gpt":0.25587242617168504,"score_spread":0.23433925093401137,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W1582856601","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0432989,0.0045565907,0.9338999,0.0004433976,0.00031303463,0.0003382935,0.0021148012,0.007737278,0.007297842],"genre_scores_gemma":[0.21496964,0.002918022,0.7466512,0.00028885234,0.00025847234,0.00031685538,0.0047628838,0.00026075795,0.029573297],"study_design_codex":"design_other","study_design_gemma":"not_applicable","domain_scores_codex":[0.9994342,0.00008667051,0.00008584206,0.000121675825,0.00021188144,0.000059702154],"domain_scores_gemma":[0.9988965,0.00041416407,0.00006136241,0.00009510741,0.0005047609,0.000028125443],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.00055599696,0.00062613125,0.0007997391,0.0023742963,0.0005555506,0.0011735808,0.0011740056,0.00089168904,0.0035570562],"category_scores_gemma":[0.0018723041,0.00035724454,0.0006931165,0.0029221727,0.00032293765,0.0014254242,0.0006966949,0.00071197056,0.002709523],"study_design_candidate":"not_applicable","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00036637366,0.00017627417,0.0008534014,0.00045446944,0.00009627337,0.0001945807,0.00011337925,0.013929198,0.05267707,0.0030700588,0.007608178,0.92046064],"study_design_scores_gemma":[0.000084322266,0.00028613015,0.003454647,0.000097147305,0.00032359592,0.00086166756,0.00023672232,0.8605529,0.09453886,0.0155343395,0.023938105,0.000091580034],"about_ca_topic_score_codex":0.008194011,"about_ca_topic_score_gemma":0.014645993,"teacher_disagreement_score":0.008194011,"about_ca_system_score_codex":0.0007014631,"about_ca_system_score_gemma":0.0010966825,"threshold_uncertainty_score":0.016292632},"labels":[],"label_agreement":null},{"id":"W1583242700","doi":"10.1007/11827405_55","title":"Cleaning Web Pages for Effective Web Content Mining","year":2006,"lang":"en","type":"book-chapter","venue":"Lecture notes in computer science","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":17,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Windsor","funders":"","keywords":"Web page; Computer science; Information retrieval; World Wide Web; Static web page; Web mining; Block (permutation group theory); Categorization; Web content; Web navigation; Artificial intelligence; Mathematics","score_opus":0.026986326645245234,"score_gpt":0.24499266289061916,"score_spread":0.21800633624537394,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W1583242700","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.06692807,0.002955519,0.8995692,0.00089857745,0.0003916332,0.0008805329,0.005184369,0.019418675,0.0037734504],"genre_scores_gemma":[0.16771983,0.0015021251,0.8063968,0.00033277713,0.00033039594,0.00047317985,0.014416713,0.0016499,0.0071782554],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9971148,0.00052920886,0.00022640688,0.00046747038,0.0014121541,0.00025001419],"domain_scores_gemma":[0.99512756,0.0018154366,0.00028473992,0.0011486537,0.0014843051,0.0001393919],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0014393815,0.0013950771,0.0020960483,0.009524599,0.001661125,0.0027820559,0.0017995259,0.0017995044,0.0039369944],"category_scores_gemma":[0.010589147,0.0009448144,0.0016994317,0.00625577,0.0006825191,0.003704962,0.0016820224,0.0017797153,0.0059640193],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00022132066,0.00050290435,0.009100696,0.00069179235,0.00019269573,0.00032730759,0.00032408262,0.005603604,0.052916616,0.003366489,0.041435424,0.885317],"study_design_scores_gemma":[0.00011170345,0.00037514174,0.020404227,0.0003853069,0.00084720284,0.0025166771,0.0015712809,0.5818275,0.23868094,0.058660235,0.09445935,0.00016035212],"about_ca_topic_score_codex":0.003173473,"about_ca_topic_score_gemma":0.0049421526,"teacher_disagreement_score":0.009524599,"about_ca_system_score_codex":0.0005431152,"about_ca_system_score_gemma":0.0015867935,"threshold_uncertainty_score":0.0131706},"labels":[],"label_agreement":null},{"id":"W1590926312","doi":"10.1007/3-540-45813-1_67","title":"PagePrompter: An Intelligent Web Agent Created Using Data Mining Techniques","year":2002,"lang":"en","type":"book-chapter","venue":"Lecture notes in computer science","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":21,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Regina","funders":"","keywords":"Computer science; Web mining; World Wide Web; Web modeling; Intelligent agent; Web page; Web development; Data Web; Web intelligence; Web design; Web navigation; Artificial intelligence","score_opus":0.08952862322531616,"score_gpt":0.3028358999741696,"score_spread":0.21330727674885344,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W1590926312","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.027220001,0.0007014347,0.75308645,0.0004925542,0.00035642978,0.00063792884,0.003687091,0.1868628,0.02695536],"genre_scores_gemma":[0.12045279,0.0009954427,0.75008416,0.0005539723,0.00015827526,0.0005296592,0.0092130285,0.013467512,0.10454518],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.99969494,0.00004131606,0.00002655691,0.000065018256,0.00015222431,0.000020040512],"domain_scores_gemma":[0.9993326,0.0002537252,0.00005505055,0.0001504745,0.00012193783,0.00008609748],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.00087001873,0.000671866,0.0008294173,0.0010552121,0.0004972239,0.001451149,0.001286252,0.00093413313,0.013074845],"category_scores_gemma":[0.0024290518,0.0005743237,0.000556464,0.00080370094,0.00027761274,0.0026061744,0.0009823467,0.0010360536,0.0071783937],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0012309352,0.00062805926,0.003625375,0.00090013485,0.0001972787,0.0009388458,0.00081249117,0.005568629,0.04321657,0.0157189,0.17092143,0.75624126],"study_design_scores_gemma":[0.0003145272,0.00045987352,0.005042452,0.0002255454,0.00042260534,0.00295417,0.00018927407,0.20858714,0.13583767,0.019731391,0.62602806,0.00020718282],"about_ca_topic_score_codex":0.0007420279,"about_ca_topic_score_gemma":0.0015021133,"teacher_disagreement_score":0.013074845,"about_ca_system_score_codex":0.00024328365,"about_ca_system_score_gemma":0.00045876508,"threshold_uncertainty_score":0.043739736},"labels":[],"label_agreement":null},{"id":"W1592142909","doi":"10.18438/b80014","title":"Study of Search Engine Transaction Logs Shows Little Change in How Users use Search Engines","year":2006,"lang":"en","type":"article","venue":"Evidence Based Library and Information Practice","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":true,"route_about_ca":false,"ca_institutions":"","funders":"","keywords":"Search engine; Information retrieval; Transaction log; Computer science; Database transaction; Query expansion; World Wide Web; Search analytics; Metasearch engine; Web search query; Database","score_opus":0.0471057312752498,"score_gpt":0.2787684893232249,"score_spread":0.2316627580479751,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W1592142909","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.86327356,0.07741206,0.0046257186,0.0036599413,0.0001957017,0.00020380288,0.015716746,0.00039181477,0.034520596],"genre_scores_gemma":[0.96866614,0.0157351,0.0018672514,0.0013333018,0.00012789562,0.0001401784,0.007288079,0.00013922594,0.00470281],"study_design_codex":"observational","study_design_gemma":"observational","domain_scores_codex":[0.99479705,0.0012119546,0.00074977044,0.00080068375,0.0022576528,0.00018297393],"domain_scores_gemma":[0.9162309,0.055979606,0.0107472995,0.0030914429,0.013365782,0.0005849787],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0047299494,0.0003846401,0.000653264,0.0064486954,0.0004772823,0.0027057813,0.0007087215,0.0006756339,0.0028557952],"category_scores_gemma":[0.041655917,0.00036857734,0.0006845581,0.010918743,0.00052488846,0.0044399872,0.0007891998,0.00068870914,0.0019704734],"study_design_candidate":"observational","study_design_consensus":"observational","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00085325673,0.00033076655,0.5379371,0.008159633,0.00093494775,0.00033138666,0.009512532,0.0004374154,0.004955292,0.0015834576,0.017145058,0.4178191],"study_design_scores_gemma":[0.000030407322,0.0006566851,0.9281457,0.0011768792,0.00054487353,0.00079718634,0.006947423,0.00054110656,0.003739849,0.0008442423,0.05647647,0.0000992113],"about_ca_topic_score_codex":0.0067388844,"about_ca_topic_score_gemma":0.011919962,"teacher_disagreement_score":0.0067388844,"about_ca_system_score_codex":0.0008699093,"about_ca_system_score_gemma":0.0010554715,"threshold_uncertainty_score":0.025014699},"labels":[],"label_agreement":null},{"id":"W1594382369","doi":"10.28945/509","title":"HTML Tags as Extraction Cues for Web Page Description Construction","year":2003,"lang":"en","type":"article","venue":"Informing Science The International Journal of an Emerging Transdiscipline","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":23,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Western University","funders":"Natural Sciences and Engineering Research Council of Canada","keywords":"Computer science; Information retrieval; World Wide Web; Web page; HTML element","score_opus":0.025878263754117305,"score_gpt":0.3316387600285208,"score_spread":0.3057604962744035,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W1594382369","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.10837341,0.004998185,0.79277986,0.001946713,0.0013723378,0.0011915166,0.021704849,0.041664537,0.025968596],"genre_scores_gemma":[0.36018538,0.0024831223,0.58193976,0.00045619806,0.00040199756,0.0006420308,0.037511982,0.0035903826,0.0127891395],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9986494,0.00037401213,0.00017412382,0.000257947,0.0003747582,0.00016969784],"domain_scores_gemma":[0.99084973,0.005463512,0.000691069,0.0007802284,0.0018751421,0.0003403198],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0014667601,0.0012657094,0.00055470056,0.008730033,0.00081825943,0.0039196145,0.00094639783,0.001652428,0.008063059],"category_scores_gemma":[0.014083198,0.0006249213,0.0007465709,0.0053055547,0.000733092,0.0058380812,0.0023381962,0.0016376488,0.008248661],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0010935325,0.00035595422,0.009916624,0.0018990545,0.00009285183,0.0010731659,0.002533331,0.0033449873,0.060343813,0.019842718,0.055541143,0.8439628],"study_design_scores_gemma":[0.00027446434,0.0005977851,0.032999784,0.0019419962,0.00069109787,0.0030076702,0.0065814573,0.3246654,0.17580341,0.10312325,0.34985134,0.00046243498],"about_ca_topic_score_codex":0.0048462786,"about_ca_topic_score_gemma":0.008069942,"teacher_disagreement_score":0.008730033,"about_ca_system_score_codex":0.00080811244,"about_ca_system_score_gemma":0.0013107044,"threshold_uncertainty_score":0.026973605},"labels":[],"label_agreement":null},{"id":"W1604837868","doi":"10.48550/arxiv.1301.3859","title":"Building a Stochastic Dynamic Model of Application Use","year":2013,"lang":"en","type":"article","venue":"arXiv (Cornell University)","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":13,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of British Columbia","funders":"","keywords":"Computer science; Adaptation (eye); Interface (matter); State space; User interface; State (computer science); Space (punctuation); Stochastic modelling; User modeling; Distributed computing; Human–computer interaction; Algorithm; Programming language","score_opus":0.04866406720913448,"score_gpt":0.17588909736861774,"score_spread":0.12722503015948328,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W1604837868","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.19893868,0.00019734375,0.79255265,0.00081919733,0.00002715181,0.00017502772,0.0021770329,0.0011876111,0.0039252946],"genre_scores_gemma":[0.8948446,0.00026205948,0.09796679,0.00012353306,0.000045310207,0.0005179061,0.002638977,0.00016168992,0.003439135],"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9987061,0.0002965274,0.00007981201,0.00039909963,0.00036183413,0.00015667664],"domain_scores_gemma":[0.9952537,0.003490671,0.00041260492,0.0003077495,0.00040690787,0.00012835395],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0014479285,0.0008363413,0.0009515886,0.0015810942,0.00050016755,0.0016723115,0.0015755405,0.0014978361,0.002461721],"category_scores_gemma":[0.008995259,0.0010463464,0.0011708841,0.0013835304,0.0010177715,0.0025305625,0.0011602477,0.0018706403,0.0006446974],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00003744625,0.00003722873,0.0028629028,0.000024202058,0.000022803632,0.000055479264,0.000106200314,0.9820296,0.00070966745,0.008018959,0.00039128182,0.005704163],"study_design_scores_gemma":[0.000002709504,0.0000040782684,0.00028054725,0.0000021182796,0.0000034182551,0.000006171518,0.000004957228,0.9967816,0.00010170898,0.0026786362,0.00012999006,0.0000041149533],"about_ca_topic_score_codex":0.03426108,"about_ca_topic_score_gemma":0.0297953,"teacher_disagreement_score":0.03426108,"about_ca_system_score_codex":0.002007388,"about_ca_system_score_gemma":0.0018072744,"threshold_uncertainty_score":0.06812334},"labels":[],"label_agreement":null},{"id":"W1605449937","doi":"10.20381/ruor-14830","title":"Intelligent search techniques for large software systems.","year":2002,"lang":"en","type":"article","venue":"","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":7,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Ottawa","funders":"","keywords":"Computer science; Software; Software system; Data mining; Search-based software engineering; Information retrieval; Software engineering; Machine learning; Software construction; Artificial intelligence; Programming language","score_opus":0.052821306538472904,"score_gpt":0.29066244957508625,"score_spread":0.23784114303661336,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W1605449937","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0077093598,0.011649232,0.96416426,0.0016961861,0.00015499923,0.0004910313,0.00047799526,0.0034227667,0.010234143],"genre_scores_gemma":[0.06967849,0.0059144227,0.91726726,0.00033095074,0.00021949474,0.00060174207,0.0011266574,0.00032661264,0.0045343232],"study_design_codex":"design_other","study_design_gemma":"not_applicable","domain_scores_codex":[0.9968785,0.00133882,0.00027470043,0.00028575765,0.0011310981,0.00009103988],"domain_scores_gemma":[0.99405354,0.0042863893,0.0003872884,0.00074287853,0.00044435725,0.000085569925],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0032248944,0.0010987499,0.0013364695,0.0040918863,0.00095915905,0.0022487103,0.0018326123,0.0014257759,0.009204224],"category_scores_gemma":[0.019803977,0.00065858697,0.0013003839,0.004777289,0.0011350326,0.0060713957,0.0021716603,0.0014788088,0.003985725],"study_design_candidate":"not_applicable","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00017962116,0.00018143059,0.0018466181,0.002691522,0.00026653337,0.0003716471,0.0010021398,0.04329014,0.0068713254,0.18392265,0.046527382,0.71284896],"study_design_scores_gemma":[0.00019558669,0.0002812091,0.0014517029,0.0004547503,0.00016445,0.0015059462,0.00068290095,0.42320946,0.00533779,0.4422965,0.12433646,0.00008330306],"about_ca_topic_score_codex":0.002007759,"about_ca_topic_score_gemma":0.0037439386,"teacher_disagreement_score":0.009204224,"about_ca_system_score_codex":0.0009474056,"about_ca_system_score_gemma":0.0011221782,"threshold_uncertainty_score":0.030791223},"labels":[],"label_agreement":null},{"id":"W1608529622","doi":"10.1109/icw.2005.74","title":"SMDP: A Simple Multimedia Service Description Protocol on the Internet","year":2005,"lang":"en","type":"article","venue":"","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Carleton University","funders":"","keywords":"Upload; Computer science; Multimedia; The Internet; Protocol (science); Service (business); Simple (philosophy); World Wide Web; Service provider","score_opus":0.04185137654921452,"score_gpt":0.27753295779555726,"score_spread":0.23568158124634275,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W1608529622","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.010892754,0.0022922591,0.93976456,0.0019464247,0.00080451404,0.0025534034,0.0027591947,0.011588473,0.027398493],"genre_scores_gemma":[0.44373313,0.0069878055,0.48900735,0.0030117873,0.00071737205,0.008076481,0.011300095,0.0010385644,0.03612738],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"not_applicable","domain_scores_codex":[0.9970504,0.0008152352,0.00046046186,0.00021876578,0.0011260492,0.00032900224],"domain_scores_gemma":[0.99740124,0.0007519518,0.00027812112,0.000551989,0.000809399,0.00020734836],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0030124565,0.0008471931,0.0009735726,0.0017383578,0.0013956047,0.0034631735,0.0021659103,0.0021254313,0.0049914974],"category_scores_gemma":[0.006569622,0.0006146368,0.0007503991,0.002425844,0.0013111364,0.003969333,0.003143269,0.002786169,0.0030918913],"study_design_candidate":"not_applicable","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0014480945,0.00041955363,0.0013783029,0.0020022113,0.00016498273,0.0022390794,0.0010701027,0.02328391,0.044836797,0.43808922,0.124624245,0.36044338],"study_design_scores_gemma":[0.00042451776,0.0006231342,0.00093305286,0.00034226116,0.0001776454,0.0017157908,0.00037295624,0.22841498,0.038078688,0.09997497,0.62864095,0.00030101452],"about_ca_topic_score_codex":0.0059055127,"about_ca_topic_score_gemma":0.0041813543,"teacher_disagreement_score":0.0059055127,"about_ca_system_score_codex":0.001998772,"about_ca_system_score_gemma":0.0027867695,"threshold_uncertainty_score":0.016698241},"labels":[],"label_agreement":null},{"id":"W162289556","doi":"","title":"Mining Multiple Web Sources Using Non-Deterministic Finite State Automata","year":2012,"lang":"en","type":"article","venue":"Scholarship at UWindsor (University of Windsor)","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Windsor","funders":"","keywords":"Computer science; Information extraction; Web page; Metadata; Information retrieval; Deterministic finite automaton; Automaton; Data extraction; Finite-state machine; Object (grammar); Data mining; Theoretical computer science; Algorithm; World Wide Web; Artificial intelligence","score_opus":0.03266818413818435,"score_gpt":0.23377849408343113,"score_spread":0.20111030994524678,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W162289556","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.092212066,0.00017550435,0.90018725,0.00024904622,0.00002420188,0.0003379061,0.0011898578,0.004142338,0.0014819017],"genre_scores_gemma":[0.52192354,0.00021118023,0.47272706,0.00009360879,0.000017934823,0.0005664099,0.0026374152,0.00017593116,0.0016469954],"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.99816656,0.0003453733,0.00025572462,0.0006245948,0.0005057156,0.00010199931],"domain_scores_gemma":[0.9916728,0.0063432376,0.0006259956,0.000599306,0.0006614433,0.0000972939],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0013262685,0.0010800537,0.0009291632,0.0033102147,0.0012071748,0.0020677133,0.0016650677,0.0010099924,0.001322397],"category_scores_gemma":[0.007762762,0.0008818221,0.0023717745,0.0018716261,0.00077411195,0.0022825033,0.0014867166,0.00077409315,0.0005069765],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00040429118,0.00043016713,0.04103917,0.00068729045,0.0005641476,0.0025093378,0.001115241,0.67572683,0.016437398,0.017368611,0.0018384394,0.24187902],"study_design_scores_gemma":[0.00001825482,0.00003303589,0.0012004662,0.000028860919,0.00007112557,0.0001414192,0.00010849989,0.97983366,0.0063161557,0.011187004,0.0010405028,0.000020998488],"about_ca_topic_score_codex":0.011257705,"about_ca_topic_score_gemma":0.018396337,"teacher_disagreement_score":0.011257705,"about_ca_system_score_codex":0.0012384068,"about_ca_system_score_gemma":0.0018515369,"threshold_uncertainty_score":0.022384346},"labels":[],"label_agreement":null},{"id":"W16242065","doi":"10.1016/s1499-4046(06)60164-4","title":"Automated profile mapping","year":2006,"lang":"en","type":"article","venue":"Journal of Nutrition Education and Behavior","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":true,"route_about_ca":false,"ca_institutions":"","funders":"","keywords":"Computer science; Interoperability; Personalization; Set (abstract data type); Information retrieval; Data exchange; Information system; User profile; Data mining; Database; World Wide Web; Engineering; Programming language","score_opus":0.015500018043194065,"score_gpt":0.28392257717523406,"score_spread":0.26842255913204,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W16242065","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.013633611,0.00025428695,0.9406816,0.00036635238,0.00013159274,0.000908147,0.0038895474,0.033396926,0.00673802],"genre_scores_gemma":[0.108147666,0.00043880055,0.8663295,0.00020823067,0.00005210262,0.0008271138,0.01324943,0.0021380396,0.00860907],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9940513,0.0016234203,0.00061074813,0.0012910637,0.00207988,0.00034354324],"domain_scores_gemma":[0.98633724,0.003737615,0.0009830414,0.0048183207,0.0037508106,0.0003729299],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0043603447,0.0015432297,0.0014254786,0.0064443033,0.0018367287,0.004285784,0.002408787,0.0012295183,0.0095529],"category_scores_gemma":[0.022945754,0.0008522572,0.0013619361,0.0037908328,0.00045705837,0.0039702384,0.0047554276,0.0013980409,0.0067411223],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00036979606,0.00034452582,0.0069697527,0.0005686371,0.00013155848,0.00035669445,0.0013184473,0.006322264,0.0148375835,0.015371083,0.04700837,0.9064012],"study_design_scores_gemma":[0.00019299886,0.00024860227,0.017829364,0.0006525699,0.00020828308,0.0021102596,0.0037312345,0.426307,0.11656852,0.099196225,0.33257306,0.00038188384],"about_ca_topic_score_codex":0.0051555373,"about_ca_topic_score_gemma":0.0046856124,"teacher_disagreement_score":0.0095529,"about_ca_system_score_codex":0.0010377853,"about_ca_system_score_gemma":0.00310361,"threshold_uncertainty_score":0.031957626},"labels":[],"label_agreement":null},{"id":"W16404305","doi":"10.1097/01.prs.0000196262.13766.5c","title":"Proceedings of the 20th ACM conference on Hypertext and hypermedia","year":2009,"lang":"en","type":"article","venue":"ACM Conference on Hypertext","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":58,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":true,"ca_institutions":"","funders":"","keywords":"Hypertext; Computer science; World Wide Web; Hypermedia; Presentation (obstetrics); Social media; Markup language; HTML; Multimedia; Web page; XML","score_opus":0.05153949935545338,"score_gpt":0.2611461444505319,"score_spread":0.20960664509507854,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W16404305","genre_codex":"other","genre_gemma":"other","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"other","genre_consensus":"other","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.007962445,0.12529725,0.12646085,0.05096852,0.1381084,0.0015644385,0.008396474,0.00819168,0.53304994],"genre_scores_gemma":[0.021183267,0.060992725,0.033619285,0.010603569,0.017575322,0.00081201165,0.018449305,0.0025496131,0.83421487],"study_design_codex":"not_applicable","study_design_gemma":"not_applicable","domain_scores_codex":[0.9952602,0.0016259325,0.00040471368,0.00081842794,0.0015526214,0.0003381914],"domain_scores_gemma":[0.9922862,0.0025696896,0.0003227051,0.0013173395,0.0020376625,0.0014663603],"candidate_categories":["insufficient_payload"],"consensus_categories":[],"category_scores_codex":[0.0039800107,0.0015037598,0.0022949227,0.0023860105,0.001856375,0.012076371,0.0025784406,0.0034110572,0.20534162],"category_scores_gemma":[0.011727512,0.00067144836,0.001260825,0.002939827,0.002582848,0.011535314,0.0051785926,0.0056755426,0.11177987],"study_design_candidate":"not_applicable","study_design_consensus":"not_applicable","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00014130455,0.000120864664,0.0006602886,0.0005575408,0.00007705232,0.0002457924,0.00054018665,0.00022816287,0.002056435,0.014180616,0.81697804,0.16421373],"study_design_scores_gemma":[0.0000113437145,0.000022913096,0.0003177692,0.00018616859,0.000017105252,0.0001312289,0.000111179696,0.000371823,0.00021501422,0.0034525315,0.9951479,0.000015057259],"about_ca_topic_score_codex":0.003616783,"about_ca_topic_score_gemma":0.0039488357,"teacher_disagreement_score":0.79465836,"about_ca_system_score_codex":0.0017280608,"about_ca_system_score_gemma":0.00379744,"threshold_uncertainty_score":0.68693614},"labels":[],"label_agreement":null},{"id":"W1672685495","doi":"10.1109/pacrim.2005.1517321","title":"A proposal of information retrieval method based on TPO meatdata","year":2005,"lang":"en","type":"article","venue":"","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":1,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":true,"ca_institutions":"","funders":"","keywords":"Computer science; Information retrieval","score_opus":0.01375425044492069,"score_gpt":0.27575296055435383,"score_spread":0.26199871010943315,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W1672685495","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0075177834,0.0011317546,0.985091,0.0003863328,0.00036017114,0.00021933096,0.0004462558,0.002481696,0.002365704],"genre_scores_gemma":[0.092836596,0.0014255409,0.8920626,0.00037596616,0.0006174073,0.00052310654,0.0029057246,0.00028661737,0.008966413],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.99789786,0.0003233176,0.00019746997,0.00058748596,0.0008255791,0.00016828277],"domain_scores_gemma":[0.9987656,0.00022075053,0.00005261252,0.00024106668,0.0006582639,0.00006169092],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0014000896,0.00091461453,0.0014392458,0.0060474416,0.0015785497,0.003304567,0.0022923062,0.0013909889,0.0048463386],"category_scores_gemma":[0.003603228,0.00051225815,0.0015443042,0.0062820115,0.00066103024,0.0050165327,0.0018427119,0.0010323923,0.0030744139],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00036391997,0.00026186288,0.002622793,0.00038119758,0.00016034539,0.0002515752,0.00024403766,0.0040607294,0.028910724,0.024228916,0.021266717,0.9172472],"study_design_scores_gemma":[0.0003255096,0.0003974416,0.0060782246,0.00010491368,0.0005550399,0.0021818073,0.0006748666,0.7671859,0.07038228,0.06330269,0.08847387,0.00033743572],"about_ca_topic_score_codex":0.00483562,"about_ca_topic_score_gemma":0.0028493432,"teacher_disagreement_score":0.0060474416,"about_ca_system_score_codex":0.00060879876,"about_ca_system_score_gemma":0.0016833271,"threshold_uncertainty_score":0.016212583},"labels":[],"label_agreement":null},{"id":"W1675886408","doi":"10.1007/978-3-642-39200-9_7","title":"Hidden-Web Induced by Client-Side Scripting: An Empirical Study","year":2013,"lang":"en","type":"book-chapter","venue":"Lecture notes in computer science","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":13,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of British Columbia","funders":"","keywords":"JavaScript; Document Object Model; Computer science; World Wide Web; Client-side; Scripting language; Web page; Interactivity; Web content; Server-side; Dynamic web page; Static web page; Web application; Web development; Operating system","score_opus":0.04070059916444162,"score_gpt":0.29631607346695177,"score_spread":0.25561547430251014,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W1675886408","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.99545765,0.00008462393,0.0018416211,0.000050047583,0.000009095898,0.00008167212,0.00018018049,0.00017746811,0.0021176431],"genre_scores_gemma":[0.99765813,0.00004430662,0.0009152793,0.00004040863,0.000012231903,0.000031345433,0.00041061794,0.00009191154,0.00079558394],"study_design_codex":"observational","study_design_gemma":"observational","domain_scores_codex":[0.99621284,0.0012813644,0.0002810763,0.000567771,0.001321491,0.0003354275],"domain_scores_gemma":[0.87465346,0.08825964,0.012340984,0.014700683,0.006247698,0.0037975803],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0035006397,0.00042776865,0.00052240107,0.000817805,0.00086543,0.0021086931,0.0012975094,0.0010834762,0.0049111536],"category_scores_gemma":[0.06373369,0.0004372454,0.00042785102,0.001082918,0.0010371365,0.0034696104,0.0013180445,0.0025022512,0.0016414985],"study_design_candidate":"observational","study_design_consensus":"observational","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0047344686,0.017038386,0.8195364,0.00073160685,0.00023009573,0.0027807662,0.007443015,0.0061443564,0.01767559,0.0050604944,0.005241489,0.11338337],"study_design_scores_gemma":[0.0002081501,0.002660246,0.79151934,0.00027590265,0.00050018635,0.0044687707,0.008691181,0.15248284,0.02541411,0.009035486,0.0045755133,0.00016834884],"about_ca_topic_score_codex":0.0028424652,"about_ca_topic_score_gemma":0.0020392344,"teacher_disagreement_score":0.0049111536,"about_ca_system_score_codex":0.00072492834,"about_ca_system_score_gemma":0.00084197015,"threshold_uncertainty_score":0.018513381},"labels":[],"label_agreement":null},{"id":"W17042212","doi":"","title":"Capturing the Long Tail of Sensor Web","year":2010,"lang":"en","type":"article","venue":"","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":8,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Calgary","funders":"","keywords":"Sensor web; Interoperability; Wireless sensor network; Global Positioning System; Scale (ratio); Computer science; Data logger; Global network; Telecommunications; Ranging; Remote sensing; Real-time computing; Data science; Geography; World Wide Web; Key distribution in wireless sensor networks; Computer network; Cartography; Wireless network","score_opus":0.011278700961409696,"score_gpt":0.22188615647593116,"score_spread":0.21060745551452145,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W17042212","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.4403892,0.008459583,0.4590467,0.0022334391,0.0014470898,0.00039259563,0.02648916,0.02577667,0.035765704],"genre_scores_gemma":[0.8984236,0.0017250865,0.07830989,0.0004091434,0.00018971291,0.00011083009,0.010158403,0.00054814114,0.010125247],"study_design_codex":"design_other","study_design_gemma":"not_applicable","domain_scores_codex":[0.99960595,0.000038510017,0.000032101907,0.00007081347,0.00020412056,0.00004853071],"domain_scores_gemma":[0.99909914,0.00022926905,0.00009972617,0.00019975072,0.00028799044,0.000084245126],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.00022345662,0.0006212519,0.0005127305,0.0024202045,0.00034352916,0.0014031382,0.0005084746,0.0008464391,0.0028365636],"category_scores_gemma":[0.0019955195,0.00025905104,0.00030457438,0.002090577,0.00021051662,0.002222969,0.0012355178,0.0005792376,0.0027203707],"study_design_candidate":"not_applicable","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0006395667,0.0002481318,0.064278,0.00077001663,0.00017873202,0.0044271443,0.0008345739,0.017265916,0.07672278,0.007812253,0.0633182,0.7635048],"study_design_scores_gemma":[0.000023621558,0.00023663149,0.09310384,0.00031972118,0.00012132967,0.0065597803,0.0019308004,0.6883041,0.065606,0.03691847,0.106726065,0.00014963765],"about_ca_topic_score_codex":0.0019988338,"about_ca_topic_score_gemma":0.004639729,"teacher_disagreement_score":0.0028365636,"about_ca_system_score_codex":0.00024227118,"about_ca_system_score_gemma":0.00020964249,"threshold_uncertainty_score":0.009489238},"labels":[],"label_agreement":null},{"id":"W173185721","doi":"10.1145/2567948.2576947","title":"Reachable subwebs for traversal-based query execution","year":2014,"lang":"en","type":"article","venue":"","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":5,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Waterloo","funders":"","keywords":"Tree traversal; Computer science; Graph traversal; Benchmark (surveying); Relevance (law); PageRank; Information retrieval; Search engine; Graph; Web search query; Data mining; Theoretical computer science; Algorithm","score_opus":0.010686936658638579,"score_gpt":0.21940822393275375,"score_spread":0.20872128727411518,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W173185721","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.14741392,0.0008061982,0.8349303,0.00039397,0.000037777012,0.0004652347,0.001796203,0.008076843,0.0060795723],"genre_scores_gemma":[0.6267171,0.00041188722,0.3647245,0.00011968708,0.00004389805,0.00033455362,0.0043533305,0.001265108,0.0020299086],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9968368,0.0008773095,0.00032066068,0.0005406382,0.0010842246,0.00034037768],"domain_scores_gemma":[0.98495483,0.007907035,0.0014544218,0.003812341,0.0013511231,0.0005202257],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0019709733,0.0007568464,0.0008715766,0.0040553203,0.0011726276,0.002517502,0.001215308,0.0009769468,0.0031863688],"category_scores_gemma":[0.019477474,0.0006551232,0.0010139651,0.0036536355,0.0016181266,0.0046747793,0.0023150567,0.0012236743,0.0012313648],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0014769252,0.0005907379,0.055819474,0.0011376862,0.00034291204,0.0016519787,0.0020353657,0.25443098,0.05588824,0.27974236,0.013474313,0.3334091],"study_design_scores_gemma":[0.000028324488,0.00011561224,0.003896382,0.000048316764,0.00006209121,0.000539135,0.00028334226,0.82621044,0.010219893,0.14973208,0.008824848,0.000039458766],"about_ca_topic_score_codex":0.0041301064,"about_ca_topic_score_gemma":0.006271219,"teacher_disagreement_score":0.0041301064,"about_ca_system_score_codex":0.001118493,"about_ca_system_score_gemma":0.0014253883,"threshold_uncertainty_score":0.010659456},"labels":[],"label_agreement":null},{"id":"W173217944","doi":"","title":"Second Symposium on the Personal Web","year":2011,"lang":"en","type":"article","venue":"","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"IBM (Canada); University of Toronto","funders":"","keywords":"Computer science; World Wide Web; Web development; Web modeling; Personal information manager; Web standards; Web engineering; Mashup; Web service; Web 2.0; Personal computer; Context (archaeology); Personal information management; Web application security; Information system; Engineering","score_opus":0.03504324742649889,"score_gpt":0.2091666873080292,"score_spread":0.1741234398815303,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W173217944","genre_codex":"editorial","genre_gemma":"other","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"other","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0048518972,0.066638835,0.01620573,0.18790588,0.38443398,0.00027019827,0.0009121528,0.0011602242,0.33762118],"genre_scores_gemma":[0.02839406,0.023194993,0.0048511974,0.026861083,0.07195937,0.0003086589,0.0009933816,0.0012060313,0.8422312],"study_design_codex":"not_applicable","study_design_gemma":"not_applicable","domain_scores_codex":[0.9962276,0.00076630275,0.00015172179,0.000696008,0.0014518888,0.00070642465],"domain_scores_gemma":[0.99485284,0.00083111203,0.00015182167,0.0004883647,0.0017010982,0.0019747787],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.005255734,0.0013072797,0.00072279363,0.0021319278,0.0042944797,0.0120114125,0.0016723019,0.0066380277,0.070838965],"category_scores_gemma":[0.0060830577,0.00062891823,0.0013290726,0.0013494085,0.0019871113,0.008804456,0.008027463,0.011644337,0.02620534],"study_design_candidate":"not_applicable","study_design_consensus":"not_applicable","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.000036235826,0.00006215352,0.00011014586,0.00012637947,0.0000074931263,0.00012990266,0.0005830604,0.00007583416,0.0006492997,0.02885775,0.9377157,0.03164606],"study_design_scores_gemma":[0.0000017577895,0.00001406019,0.00007986429,0.000093709255,0.0000023134326,0.000059732363,0.0001412064,0.00003370996,0.00012283432,0.0011046453,0.99834096,0.0000052544156],"about_ca_topic_score_codex":0.0025694696,"about_ca_topic_score_gemma":0.0045047174,"teacher_disagreement_score":0.070838965,"about_ca_system_score_codex":0.0036143316,"about_ca_system_score_gemma":0.004475154,"threshold_uncertainty_score":0.2369799},"labels":[],"label_agreement":null},{"id":"W1752910098","doi":"10.1007/3-540-45415-2_8","title":"i-Cube: A Tool-Set for the Dynamic Extraction and Integration of Web Data Content","year":2001,"lang":"en","type":"book-chapter","venue":"Lecture notes in computer science","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":2,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Waterloo","funders":"","keywords":"Computer science; XML; Scripting language; Information retrieval; Dynamic web page; HTML element; World Wide Web; Web service; XML validation; Tree (set theory); Set (abstract data type); Document Structure Description; Document Object Model; Web page; The Internet; Well-formed document; Document type definition; Database; Programming language","score_opus":0.06870515490833315,"score_gpt":0.30172189553848433,"score_spread":0.23301674063015118,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W1752910098","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0039551733,0.0006323741,0.8248969,0.00034551288,0.00011919363,0.00037659757,0.016349413,0.14926551,0.004059384],"genre_scores_gemma":[0.027886894,0.0014075362,0.9066789,0.00029877896,0.00009230478,0.00084707426,0.040710423,0.017620169,0.004457878],"study_design_codex":"design_other","study_design_gemma":"bench_or_experimental","domain_scores_codex":[0.998055,0.0001998034,0.0003074404,0.00031880965,0.0010205145,0.000098474455],"domain_scores_gemma":[0.9955922,0.002198032,0.0002979611,0.001057519,0.0006276279,0.00022665651],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0023831532,0.002905063,0.002220071,0.008585737,0.0011612556,0.0053844447,0.002991725,0.0011513261,0.010439844],"category_scores_gemma":[0.009524118,0.0016035723,0.0028510345,0.0096995,0.00096137135,0.0057533197,0.0052376688,0.0022638955,0.007831165],"study_design_candidate":"bench_or_experimental","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00040105815,0.00022315115,0.0050473474,0.0022052687,0.00043273153,0.0010309723,0.0013475281,0.0093343705,0.015914379,0.021499764,0.15254751,0.79001594],"study_design_scores_gemma":[0.00032940618,0.0002566611,0.005967507,0.0010281656,0.00077126495,0.0028575086,0.0013738971,0.29374704,0.13024865,0.12331046,0.43956995,0.0005395027],"about_ca_topic_score_codex":0.00526647,"about_ca_topic_score_gemma":0.0059084045,"teacher_disagreement_score":0.010439844,"about_ca_system_score_codex":0.0008709793,"about_ca_system_score_gemma":0.0023356348,"threshold_uncertainty_score":0.034924746},"labels":[],"label_agreement":null},{"id":"W1754114003","doi":"","title":"LibGuides: Canadian Federal Election 2015: Resources","year":2015,"lang":"en","type":"libguides","venue":"","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":0,"is_retracted":false,"has_abstract":false,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":true,"ca_institutions":"","funders":"","keywords":"Federal election; Political science; Public administration; Law; Politics","score_opus":0.022867691285446183,"score_gpt":0.2603875842976448,"score_spread":0.2375198930121986,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W1754114003","genre_codex":"dataset","genre_gemma":"other","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"other","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0016392529,0.004862327,0.001594205,0.0051425314,0.0014508662,0.0002483115,0.5855842,0.009068222,0.39041013],"genre_scores_gemma":[0.014053325,0.0059518893,0.005667156,0.0011651759,0.00044559353,0.00029864395,0.4528802,0.0048271166,0.51471084],"study_design_codex":"not_applicable","study_design_gemma":"not_applicable","domain_scores_codex":[0.99793965,0.00014996312,0.00009156689,0.00012323612,0.0012942149,0.00040132573],"domain_scores_gemma":[0.99440587,0.00037309475,0.00014676194,0.0003427624,0.0040161246,0.00071538443],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0021081213,0.0015523798,0.0010269622,0.010705559,0.0053232173,0.0074814665,0.0024914665,0.0013416384,0.23235707],"category_scores_gemma":[0.009330437,0.00074201345,0.00075886596,0.01971556,0.0008878692,0.0026288095,0.0030787736,0.0015556857,0.09173375],"study_design_candidate":"not_applicable","study_design_consensus":"not_applicable","about_ca_topic_candidate":true,"about_ca_topic_consensus":true,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.000013141969,0.0000066373073,0.00020478602,0.000059279777,0.0000027961046,0.000008025369,0.000025874604,0.000084781655,0.000013802315,0.0012658882,0.98444736,0.013867674],"study_design_scores_gemma":[0.000008819116,0.0000016759021,0.0018444007,0.00013486455,0.0000048144816,0.00000746529,0.0001053219,0.00020913407,0.000108915214,0.00094913144,0.99660987,0.00001538065],"about_ca_topic_score_codex":0.9376302,"about_ca_topic_score_gemma":0.9603756,"teacher_disagreement_score":0.23235707,"about_ca_system_score_codex":0.018781923,"about_ca_system_score_gemma":0.061765146,"threshold_uncertainty_score":0.7773118},"labels":[],"label_agreement":null},{"id":"W1755220452","doi":"10.1007/3-540-44886-1_21","title":"Post-supervised Template Induction for Dynamic Web Sources","year":2003,"lang":"en","type":"book-chapter","venue":"Lecture notes in computer science","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":0,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Dalhousie University","funders":"","keywords":"Computer science; Row; Exploit; Data mining; Dynamic programming; Machine learning; Information extraction; Artificial intelligence; Supervised learning; Dynamic web page; Unsupervised learning; Pattern recognition (psychology); Web page; Information retrieval; Database; Algorithm; World Wide Web; Artificial neural network","score_opus":0.016692376007182975,"score_gpt":0.24295445410656108,"score_spread":0.2262620780993781,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W1755220452","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.010100861,0.00035272466,0.9718811,0.00021104013,0.00007923044,0.00014209104,0.0016019,0.014061951,0.0015690719],"genre_scores_gemma":[0.16723523,0.00052052696,0.7983577,0.0001694138,0.00021858136,0.00032430945,0.01834847,0.003077768,0.011748052],"study_design_codex":"design_other","study_design_gemma":"bench_or_experimental","domain_scores_codex":[0.9976024,0.000502591,0.0002064824,0.0006960691,0.0007864512,0.00020607753],"domain_scores_gemma":[0.99100983,0.0048501855,0.0004381368,0.0022005453,0.0012894663,0.00021181557],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0026995237,0.001182807,0.001279472,0.004068785,0.0012502004,0.0019797687,0.0044627055,0.0017440352,0.007129025],"category_scores_gemma":[0.009724994,0.001072807,0.0018540501,0.003686695,0.0008671523,0.0052485894,0.0026622897,0.0024720964,0.006620565],"study_design_candidate":"bench_or_experimental","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0003627201,0.00031346024,0.0033357218,0.00035712114,0.00013783421,0.00054719317,0.00020956603,0.030193804,0.014592368,0.013246839,0.03117335,0.9055301],"study_design_scores_gemma":[0.00004721978,0.00006820392,0.0010026813,0.00005520678,0.000101764745,0.00044629787,0.000100352554,0.9038155,0.034283604,0.04676522,0.0132761,0.000037768652],"about_ca_topic_score_codex":0.0031808184,"about_ca_topic_score_gemma":0.008164774,"teacher_disagreement_score":0.007129025,"about_ca_system_score_codex":0.0009256279,"about_ca_system_score_gemma":0.0021620307,"threshold_uncertainty_score":0.02384895},"labels":[],"label_agreement":null},{"id":"W1757294307","doi":"","title":"A unified interface for visual and interactive web search","year":2007,"lang":"en","type":"article","venue":"","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":2,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Regina","funders":"","keywords":"Computer science; Search engine; Information retrieval; World Wide Web; Semantic search; Interface (matter); Search analytics; Web search query; Visual search; User interface; Web search engine; Web navigation; Human–computer interaction; Web page; Artificial intelligence","score_opus":0.024209937782751104,"score_gpt":0.3470820021514493,"score_spread":0.3228720643686982,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W1757294307","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0019555667,0.0009698079,0.86128736,0.00046521178,0.00029135772,0.0010988184,0.0018174312,0.11092126,0.02119323],"genre_scores_gemma":[0.035031512,0.0012707367,0.89352316,0.0015436448,0.0004232722,0.0037489217,0.0056504314,0.015281006,0.043527216],"study_design_codex":"design_other","study_design_gemma":"bench_or_experimental","domain_scores_codex":[0.99794954,0.0005166804,0.0002484143,0.00022952692,0.000848944,0.00020689057],"domain_scores_gemma":[0.9967726,0.001276179,0.00010358775,0.00051526283,0.00084125256,0.00049105124],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0026440169,0.0020015952,0.0016980626,0.0032403464,0.00097133877,0.0042739776,0.003057286,0.0029200758,0.05955589],"category_scores_gemma":[0.009056646,0.0011341193,0.0013749871,0.001709923,0.0010833425,0.006874164,0.0063775033,0.002269689,0.030784175],"study_design_candidate":"bench_or_experimental","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0012658727,0.00042137993,0.00093135796,0.0013817628,0.00011362928,0.00092616497,0.0020901267,0.0026183107,0.030596117,0.06379754,0.30927685,0.586581],"study_design_scores_gemma":[0.00042144864,0.00038445203,0.0010768772,0.0005100409,0.00012026002,0.0019881707,0.00041698234,0.05094578,0.011753455,0.055345785,0.87667274,0.00036399413],"about_ca_topic_score_codex":0.0019693063,"about_ca_topic_score_gemma":0.0022292803,"teacher_disagreement_score":0.05955589,"about_ca_system_score_codex":0.00064409245,"about_ca_system_score_gemma":0.0010544595,"threshold_uncertainty_score":0.1992343},"labels":[],"label_agreement":null},{"id":"W1767221188","doi":"","title":"Experiments with ClueWeb09: Relevance Feedback and Web Tracks","year":2009,"lang":"en","type":"article","venue":"","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":10,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Waterloo","funders":"","keywords":"Relevance (law); Relevance feedback; Suspect; Computer science; Information retrieval; Work (physics); Data collection; World Wide Web; Statistics; Artificial intelligence; Psychology; Mathematics; Engineering","score_opus":0.011345639123159086,"score_gpt":0.24181985438529557,"score_spread":0.2304742152621365,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W1767221188","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.8792982,0.010538965,0.026693325,0.0018184275,0.002405945,0.0049657086,0.025885504,0.031587932,0.016805958],"genre_scores_gemma":[0.74670386,0.0014290634,0.14216447,0.0016835807,0.0008456241,0.0028141083,0.08065949,0.0030588133,0.020640997],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9839445,0.0072172126,0.0018480398,0.0022140953,0.0039216317,0.0008545082],"domain_scores_gemma":[0.9474074,0.034765787,0.0013779983,0.0057652034,0.0083917985,0.0022917879],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.014811937,0.002449375,0.0026436285,0.0028657548,0.002780359,0.0022166523,0.0033769882,0.003399254,0.004819493],"category_scores_gemma":[0.047886122,0.0008848242,0.001430194,0.0045468626,0.0013737143,0.0038782416,0.0023013558,0.0027763322,0.003010492],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.018984148,0.019835673,0.023646645,0.008689381,0.0017901206,0.002522068,0.0026172379,0.07088183,0.08916429,0.0017405001,0.2688521,0.4912761],"study_design_scores_gemma":[0.01106554,0.022011984,0.07999143,0.00060466287,0.0013334281,0.004735937,0.0033305497,0.50407255,0.20985821,0.0046299295,0.15688479,0.0014809531],"about_ca_topic_score_codex":0.032774854,"about_ca_topic_score_gemma":0.037466932,"teacher_disagreement_score":0.032774854,"about_ca_system_score_codex":0.0020772675,"about_ca_system_score_gemma":0.0024252338,"threshold_uncertainty_score":0.078333914},"labels":[],"label_agreement":null},{"id":"W1772992909","doi":"10.1007/11424918_19","title":"Integrating Web Content Clustering into Web Log Association Rule Mining","year":2005,"lang":"en","type":"book-chapter","venue":"Lecture notes in computer science","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":26,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Dalhousie University","funders":"","keywords":"Computer science; Web mining; Web log analysis software; Cluster analysis; Association rule learning; Web page; Data Web; Web analytics; Data mining; Web server; Information retrieval; Web navigation; Web modeling; World Wide Web; The Internet; Static web page; Web intelligence; Machine learning","score_opus":0.023915445733343622,"score_gpt":0.2468860429053318,"score_spread":0.2229705971719882,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W1772992909","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.027325932,0.0003642549,0.9596194,0.00014256021,0.000064960004,0.00018890447,0.00032029278,0.010222623,0.0017509881],"genre_scores_gemma":[0.123041,0.00022142263,0.8721302,0.00009540404,0.00008400048,0.00012458683,0.0011316126,0.00036073313,0.0028111816],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9987582,0.00031987546,0.000106676875,0.00026723713,0.00046965902,0.000078304496],"domain_scores_gemma":[0.9957783,0.0022808288,0.00018862123,0.0006416783,0.0009951084,0.000115459865],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0018758775,0.0006995668,0.0013044078,0.0042171315,0.0007129054,0.0018254877,0.0017155617,0.0009048259,0.0020509104],"category_scores_gemma":[0.0066886996,0.0006305186,0.0009150613,0.0046380074,0.0002678613,0.0017390158,0.0010473197,0.0008294169,0.0023118209],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00017551811,0.0004963965,0.008972436,0.00015861519,0.00021146142,0.00014100345,0.00014556792,0.0247972,0.011867908,0.0016208849,0.0049391575,0.94647384],"study_design_scores_gemma":[0.000029136665,0.00009442612,0.0049111093,0.000037454523,0.0001795802,0.00029826412,0.00016029553,0.9540391,0.02449895,0.009613524,0.006099857,0.000038234102],"about_ca_topic_score_codex":0.007449881,"about_ca_topic_score_gemma":0.013994984,"teacher_disagreement_score":0.007449881,"about_ca_system_score_codex":0.00048978894,"about_ca_system_score_gemma":0.0009030926,"threshold_uncertainty_score":0.0148130655},"labels":[],"label_agreement":null},{"id":"W1787426797","doi":"","title":"With News Search Engines.","year":2005,"lang":"en","type":"article","venue":"Teacher librarian","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":0,"is_retracted":false,"has_abstract":false,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":true,"route_about_ca":false,"ca_institutions":"","funders":"","keywords":"World Wide Web; Computer science; Information retrieval","score_opus":0.020148338044579533,"score_gpt":0.22515807568272994,"score_spread":0.20500973763815042,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W1787426797","genre_codex":"other","genre_gemma":"other","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"other","genre_consensus":"other","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.010522044,0.023062881,0.13715264,0.0122637255,0.0036756399,0.0009388581,0.13414907,0.21245909,0.465776],"genre_scores_gemma":[0.06942996,0.013907921,0.23332149,0.0065450077,0.0025909874,0.0008141183,0.2443225,0.015279834,0.41378823],"study_design_codex":"not_applicable","study_design_gemma":"not_applicable","domain_scores_codex":[0.9961665,0.0008506385,0.000341908,0.0007795047,0.001542146,0.00031930688],"domain_scores_gemma":[0.9938235,0.0016294288,0.00037452995,0.002522443,0.0011011946,0.00054889685],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.003595944,0.0020912476,0.0014469594,0.009069069,0.0013491142,0.0109974975,0.0025255962,0.0026742965,0.10073776],"category_scores_gemma":[0.017188868,0.0015370161,0.0010487185,0.009524721,0.000534062,0.019121608,0.0051162797,0.0018626002,0.16098525],"study_design_candidate":"not_applicable","study_design_consensus":"not_applicable","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00031293137,0.00020218284,0.0023999815,0.00082719716,0.00016486693,0.0001835304,0.00022217579,0.0003721976,0.0020467802,0.009159632,0.70683765,0.27727088],"study_design_scores_gemma":[0.000074090654,0.000059436104,0.0015879493,0.00027881927,0.00011355698,0.00044822413,0.00029860638,0.004064391,0.0050329654,0.018537592,0.9694536,0.000050800347],"about_ca_topic_score_codex":0.0023624124,"about_ca_topic_score_gemma":0.0064696046,"teacher_disagreement_score":0.10073776,"about_ca_system_score_codex":0.0005668911,"about_ca_system_score_gemma":0.0012368419,"threshold_uncertainty_score":0.33700132},"labels":[],"label_agreement":null},{"id":"W1800643017","doi":"10.1007/3-540-45151-x_22","title":"A Non-Euclidean Model for Web Retrieval","year":2000,"lang":"en","type":"book-chapter","venue":"Lecture notes in computer science","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":1,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Regina","funders":"","keywords":"Computer science; Information retrieval; World Wide Web","score_opus":0.021612683039276735,"score_gpt":0.25353840819541384,"score_spread":0.2319257251561371,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W1800643017","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.018646004,0.0016986576,0.9701085,0.0012287885,0.0001249694,0.00005884083,0.0005356811,0.00046336395,0.007135239],"genre_scores_gemma":[0.6560221,0.0039878716,0.26494977,0.00079525844,0.0007658896,0.00047336397,0.0021977755,0.0006009943,0.07020701],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9978125,0.000982302,0.0001335065,0.00044100216,0.00041330844,0.0002173422],"domain_scores_gemma":[0.99618214,0.002141696,0.0003287474,0.0006491637,0.00053603505,0.00016223505],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0025209745,0.0009624308,0.0018142194,0.0016716708,0.0008801906,0.0033012158,0.0055746306,0.0029962626,0.0068914783],"category_scores_gemma":[0.0100714285,0.0008827729,0.0014975423,0.0027421124,0.0018938853,0.0074777273,0.0022325113,0.0025685227,0.0038105838],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00019291481,0.000112109214,0.000921703,0.00022799666,0.00010410259,0.00016793002,0.00019590792,0.27141833,0.0014190455,0.66909146,0.007405895,0.048742548],"study_design_scores_gemma":[0.000016910117,0.000030278052,0.00019778332,0.0000110854,0.000019385085,0.00008121115,0.000020948286,0.806236,0.0001597573,0.19120722,0.0019984306,0.000020916785],"about_ca_topic_score_codex":0.0076609435,"about_ca_topic_score_gemma":0.005791523,"teacher_disagreement_score":0.0076609435,"about_ca_system_score_codex":0.0020676218,"about_ca_system_score_gemma":0.0009355396,"threshold_uncertainty_score":0.023054302},"labels":[],"label_agreement":null},{"id":"W1812261627","doi":"10.1007/978-3-642-17449-0_23","title":"Electronic Commerce On-Site Search Services: A State of the Art Review","year":2010,"lang":"en","type":"book-chapter","venue":"Lecture notes in business information processing","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":0,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Dalhousie University","funders":"","keywords":"Key (lock); Product (mathematics); Function (biology); World Wide Web; Computer science; State (computer science); Web site; Data science; The Internet; Computer security; Algorithm; Mathematics","score_opus":0.010041752827458098,"score_gpt":0.23775319490996064,"score_spread":0.22771144208250255,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W1812261627","genre_codex":"review","genre_gemma":"review","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"review","genre_consensus":"review","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.00090895675,0.9948264,0.00022821757,0.0006702061,0.00015718616,0.000010685877,0.000046536737,0.000010686498,0.0031412363],"genre_scores_gemma":[0.0048814747,0.99308634,0.0004549848,0.00032885192,0.00037794138,0.0000065223494,0.000105850464,0.000006171439,0.00075186923],"study_design_codex":"design_other","study_design_gemma":"not_applicable","domain_scores_codex":[0.9987889,0.00022644532,0.00012488301,0.00013629942,0.00061672437,0.00010673754],"domain_scores_gemma":[0.9870841,0.008890371,0.0008614825,0.00017458253,0.0026608766,0.00032858926],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.003339423,0.0006114015,0.0016471518,0.007988078,0.00038184554,0.0039874064,0.001363791,0.0013287714,0.0061923736],"category_scores_gemma":[0.006062344,0.00049510936,0.0006664733,0.016007343,0.0009834671,0.0048516677,0.00082076504,0.0010647359,0.002023444],"study_design_candidate":"not_applicable","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0001150769,0.000118877346,0.0010826177,0.011290687,0.00010131279,0.00005821911,0.00010750864,0.00021122406,0.0005250049,0.0033095214,0.029031383,0.9540485],"study_design_scores_gemma":[0.000037897848,0.0003617297,0.008620601,0.018348629,0.0008040991,0.00084663613,0.00049724936,0.0010769289,0.0015157586,0.002412426,0.9654207,0.000057307272],"about_ca_topic_score_codex":0.0035264418,"about_ca_topic_score_gemma":0.007198114,"teacher_disagreement_score":0.007988078,"about_ca_system_score_codex":0.0013268585,"about_ca_system_score_gemma":0.0034585507,"threshold_uncertainty_score":0.020715594},"labels":[],"label_agreement":null},{"id":"W1813837568","doi":"10.1109/icst.2015.7102635","title":"Testing Web Applications Through Layout Constraints","year":2015,"lang":"en","type":"article","venue":"","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":14,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Université du Québec à Chicoutimi","funders":"","keywords":"Computer science; Web page; Window (computing); World Wide Web; Set (abstract data type); Web browser; Web application; On the fly; Client-side scripting; Web testing; Information retrieval; Static web page; Web modeling; Web navigation; Programming language; The Internet; Operating system; Web intelligence","score_opus":0.09756168937176984,"score_gpt":0.29811273679354294,"score_spread":0.2005510474217731,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W1813837568","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.46504718,0.0010907408,0.5028829,0.00093167083,0.00014367295,0.00043701986,0.0013064098,0.022128401,0.006032062],"genre_scores_gemma":[0.81029105,0.00038820662,0.18387972,0.00046257506,0.000048716473,0.00034852634,0.0012981727,0.0019236583,0.0013594099],"study_design_codex":"design_other","study_design_gemma":"bench_or_experimental","domain_scores_codex":[0.9773755,0.009285247,0.0017590717,0.0030488705,0.0073174913,0.0012138359],"domain_scores_gemma":[0.8699032,0.09879197,0.010788581,0.013341701,0.006306616,0.0008678824],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.008077312,0.0014548142,0.00074479723,0.0019370744,0.00063056394,0.00239957,0.0027953854,0.0014266573,0.0022652294],"category_scores_gemma":[0.083481334,0.0012874876,0.0011110954,0.0014563313,0.0020454621,0.006181933,0.002312162,0.00188372,0.00057076244],"study_design_candidate":"bench_or_experimental","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0012973587,0.0015330346,0.12767883,0.0028094528,0.00061658246,0.0038673345,0.0034431424,0.18326591,0.14292355,0.061694216,0.011772844,0.45909777],"study_design_scores_gemma":[0.00026143828,0.0014638585,0.021896666,0.00068008684,0.00033448194,0.0028042577,0.0012735137,0.7063835,0.1844829,0.05710463,0.023068044,0.0002464949],"about_ca_topic_score_codex":0.00289285,"about_ca_topic_score_gemma":0.003902517,"teacher_disagreement_score":0.008077312,"about_ca_system_score_codex":0.0009472665,"about_ca_system_score_gemma":0.001972164,"threshold_uncertainty_score":0.042717397},"labels":[],"label_agreement":null},{"id":"W1816957470","doi":"10.48550/arxiv.0908.2588","title":"Wild Card Queries for Searching Resources on the Web","year":2009,"lang":"en","type":"preprint","venue":"ArXiv.org","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":2,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Alberta","funders":"","keywords":"Computer science; Web query classification; Information retrieval; Web search query; Unary operation; Ranking (information retrieval); Query expansion; Tuple; Set (abstract data type); Sargable; Query optimization; Task (project management); Query language; WordNet; RDF query language; Search engine; Programming language; Mathematics","score_opus":0.07159459653999371,"score_gpt":0.2893932437194094,"score_spread":0.21779864717941566,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W1816957470","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.016211368,0.0012486989,0.96659577,0.0008737091,0.0000634158,0.00066795317,0.0017505864,0.009897513,0.0026910608],"genre_scores_gemma":[0.105197765,0.00051967765,0.887137,0.00035360546,0.0000840139,0.000353653,0.004060483,0.00058438594,0.0017093748],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9878143,0.0042101583,0.0015450288,0.0012463316,0.0046589603,0.0005252301],"domain_scores_gemma":[0.9806337,0.009474218,0.0013291152,0.006294453,0.0017428489,0.000525685],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.009341569,0.0015353338,0.0024113723,0.007979176,0.0019270162,0.0045208056,0.0046665333,0.0026551837,0.004361933],"category_scores_gemma":[0.028686902,0.00085168204,0.0012757514,0.011088865,0.0024646935,0.014684884,0.004003992,0.0025763004,0.0016308135],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0011189912,0.0008611302,0.008082822,0.001777424,0.00028392294,0.00084086414,0.0016582074,0.057860434,0.01979157,0.2175125,0.050816946,0.6393951],"study_design_scores_gemma":[0.00018003154,0.00032530897,0.0018102968,0.0001491451,0.00013942321,0.0012960281,0.00061310036,0.731871,0.018284533,0.20026651,0.04485761,0.0002071204],"about_ca_topic_score_codex":0.0069320174,"about_ca_topic_score_gemma":0.010503845,"teacher_disagreement_score":0.009341569,"about_ca_system_score_codex":0.0018003569,"about_ca_system_score_gemma":0.0016788442,"threshold_uncertainty_score":0.04940355},"labels":[],"label_agreement":null},{"id":"W1828830618","doi":"","title":"World wide web site summarization","year":2004,"lang":"en","type":"article","venue":"","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":92,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Dalhousie University","funders":"","keywords":"Automatic summarization; Computer science; World Wide Web; Web site; Directory; Web navigation; Information retrieval; Task (project management); Web page; Web mapping; Data Web; Web modeling; Web standards; The Internet","score_opus":0.009892234255779498,"score_gpt":0.21681205060088518,"score_spread":0.20691981634510567,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W1828830618","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.107919045,0.008690565,0.7651791,0.0016246418,0.00071839936,0.0025310966,0.04610176,0.033679295,0.033556078],"genre_scores_gemma":[0.37091187,0.003760863,0.4841532,0.0002554787,0.00045893656,0.00087856286,0.11953875,0.0013655522,0.018676886],"study_design_codex":"design_other","study_design_gemma":"not_applicable","domain_scores_codex":[0.9981949,0.00053523935,0.00021503262,0.00031596352,0.0006477744,0.00009107303],"domain_scores_gemma":[0.9949929,0.0010323013,0.00061910175,0.0010694589,0.00213959,0.00014648575],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.001484092,0.00092072977,0.0007526575,0.0065643117,0.00057993946,0.0026239532,0.0008324292,0.0005764301,0.0040872446],"category_scores_gemma":[0.009127116,0.00022054685,0.00049839716,0.0056757554,0.00021253526,0.0021774047,0.0009419884,0.00067884877,0.0028960635],"study_design_candidate":"not_applicable","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0002127532,0.0001412495,0.0047733835,0.0009980671,0.00013935754,0.00017949495,0.00044422338,0.008117912,0.016255222,0.0051631853,0.070259996,0.89331514],"study_design_scores_gemma":[0.00013731707,0.0007706753,0.05122141,0.0004863083,0.0007860517,0.0015619383,0.0028656956,0.23251168,0.10777436,0.043146323,0.5584384,0.0002998125],"about_ca_topic_score_codex":0.002076552,"about_ca_topic_score_gemma":0.003130312,"teacher_disagreement_score":0.0065643117,"about_ca_system_score_codex":0.0005265724,"about_ca_system_score_gemma":0.0007545868,"threshold_uncertainty_score":0.013673186},"labels":[],"label_agreement":null},{"id":"W183117328","doi":"10.1007/978-3-642-32584-7_7","title":"Automatic Transformation of Multi-dimensional Web Tables into Data Cubes","year":2012,"lang":"en","type":"book-chapter","venue":"Lecture notes in computer science","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":4,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Simon Fraser University","funders":"","keywords":"Online analytical processing; Computer science; Table (database); Metadata; Transformation (genetics); Data transformation; Data warehouse; Information retrieval; Data mining; Data cube; Database; Process (computing); Visualization; Programming language; World Wide Web","score_opus":0.033874131845582724,"score_gpt":0.27114551111559665,"score_spread":0.23727137927001393,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W183117328","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.021940518,0.00047466706,0.9318812,0.00028026197,0.00016456153,0.00024891904,0.0037428217,0.0389968,0.0022703246],"genre_scores_gemma":[0.114916384,0.00048957224,0.8694412,0.0001274319,0.000038033486,0.00025571138,0.009961933,0.002034179,0.0027355724],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.99905556,0.000094963216,0.00010875725,0.00018600006,0.00048612102,0.000068540096],"domain_scores_gemma":[0.9980696,0.00067928544,0.00014110487,0.00050028693,0.00053364044,0.000076178185],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.00066698354,0.0009344964,0.0008192858,0.0022678098,0.00048524322,0.0025030489,0.0012747652,0.00056641496,0.006602592],"category_scores_gemma":[0.0041361675,0.00063522573,0.0014778536,0.0033762741,0.00047642027,0.0022372685,0.0023293344,0.0010312716,0.0033179985],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0004493126,0.0001929614,0.004045815,0.0006792805,0.00014340864,0.00052560406,0.0006493359,0.013894434,0.04663044,0.013313975,0.0383282,0.8811473],"study_design_scores_gemma":[0.0001547301,0.00023097325,0.00660382,0.00022726311,0.00017636067,0.0011942963,0.0011503145,0.6713986,0.1667183,0.05553742,0.09648305,0.00012486945],"about_ca_topic_score_codex":0.002489242,"about_ca_topic_score_gemma":0.0042704153,"teacher_disagreement_score":0.006602592,"about_ca_system_score_codex":0.0005515808,"about_ca_system_score_gemma":0.0010134928,"threshold_uncertainty_score":0.022087872},"labels":[],"label_agreement":null},{"id":"W1841070547","doi":"10.1007/11892755_86","title":"Document Mining Based on Semantic Understanding of Text","year":2006,"lang":"en","type":"book-chapter","venue":"Lecture notes in computer science","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":5,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Waterloo","funders":"","keywords":"Computer science; Semantic similarity; Representation (politics); Information retrieval; Measure (data warehouse); Semantic computing; Similarity (geometry); Natural language processing; Similarity measure; Matching (statistics); Cluster analysis; Explicit semantic analysis; Semantic matching; Data mining; Artificial intelligence; Semantic technology; Semantic Web; Image (mathematics)","score_opus":0.025920840777231703,"score_gpt":0.24630791501138222,"score_spread":0.22038707423415052,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W1841070547","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.028821034,0.0019925374,0.958085,0.00041097222,0.00018001511,0.00023726218,0.0017348535,0.005125575,0.00341277],"genre_scores_gemma":[0.11687323,0.001400552,0.8707542,0.00013341155,0.00021161552,0.00020168746,0.006436192,0.0003729258,0.0036161884],"study_design_codex":"design_other","study_design_gemma":"not_applicable","domain_scores_codex":[0.99886596,0.00017642742,0.00017144544,0.00030887825,0.00040243275,0.00007485976],"domain_scores_gemma":[0.99737954,0.001505071,0.00015141994,0.00026854535,0.00062967034,0.00006569154],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0010867118,0.0008210334,0.0012675915,0.006289562,0.0007657015,0.0023454286,0.0013947218,0.0008771402,0.0028636751],"category_scores_gemma":[0.0045680604,0.00040411204,0.001367951,0.005029664,0.00063266634,0.004395349,0.0010769228,0.0011242556,0.0021247095],"study_design_candidate":"not_applicable","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00034477614,0.00023085451,0.0021966374,0.0006184471,0.00013456432,0.00024642085,0.0004133514,0.0055523934,0.03559736,0.014891136,0.010506359,0.92926776],"study_design_scores_gemma":[0.00014035356,0.00036944964,0.004972304,0.00028714706,0.0005791167,0.0021452121,0.0007332677,0.7113154,0.10349065,0.12233484,0.053491674,0.00014055985],"about_ca_topic_score_codex":0.00153441,"about_ca_topic_score_gemma":0.0021378228,"teacher_disagreement_score":0.006289562,"about_ca_system_score_codex":0.000495221,"about_ca_system_score_gemma":0.001054263,"threshold_uncertainty_score":0.0095799565},"labels":[],"label_agreement":null},{"id":"W1844769929","doi":"10.22230/cjc.2000v25n4a1179","title":"Metadata, Knowledge Management, and Communications","year":2000,"lang":"en","type":"article","venue":"Canadian Journal of Communication","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":2,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":true,"route_about_ca":false,"ca_institutions":"University of Calgary","funders":"","keywords":"Metadata; Computer science; The Internet; Personalization; Standardization; World Wide Web; Relevance (law); Software; Data science; Knowledge management; Field (mathematics); Process (computing)","score_opus":0.026382138062724013,"score_gpt":0.2601880229671061,"score_spread":0.23380588490438206,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W1844769929","genre_codex":"other","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0155145945,0.100743696,0.041683655,0.10023283,0.0018510316,0.00018459905,0.000573826,0.0003301566,0.7388856],"genre_scores_gemma":[0.63931614,0.14884163,0.048147492,0.008979324,0.004615953,0.0003060002,0.0010360278,0.0001420102,0.14861535],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"not_applicable","domain_scores_codex":[0.99715817,0.00094318803,0.00019030522,0.0002852162,0.0011331125,0.00029008588],"domain_scores_gemma":[0.9961991,0.0018361647,0.00047872344,0.000489742,0.00057565223,0.00042071336],"candidate_categories":["scholarly_communication"],"consensus_categories":[],"category_scores_codex":[0.0029702403,0.00034763187,0.00043163582,0.0053484384,0.0043815086,0.017354794,0.0010690795,0.002361573,0.01001905],"category_scores_gemma":[0.0060081985,0.00023623153,0.00022047851,0.011634173,0.012237948,0.01277242,0.003743165,0.001422945,0.0014657709],"study_design_candidate":"not_applicable","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.000010682966,0.000015791684,0.00068624277,0.00015356185,0.000009294782,0.000097985256,0.00223338,0.00035115177,0.0000994559,0.8970145,0.017621009,0.08170685],"study_design_scores_gemma":[0.0000062413696,0.00001437254,0.0010481535,0.0004146876,0.000011634853,0.00016376267,0.0039846567,0.0004992886,0.0001919568,0.5520846,0.44155544,0.000025187985],"about_ca_topic_score_codex":0.0409039,"about_ca_topic_score_gemma":0.03331894,"teacher_disagreement_score":0.9826452,"about_ca_system_score_codex":0.006584776,"about_ca_system_score_gemma":0.010145824,"threshold_uncertainty_score":0.08133161},"labels":[],"label_agreement":null},{"id":"W1854561485","doi":"10.1007/978-3-642-33290-6_51","title":"Diva: A Web-Based High-Resolution Digital Document Viewer","year":2012,"lang":"en","type":"book-chapter","venue":"Lecture notes in computer science","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":3,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"McGill University; Centre for Interdisciplinary Research in Music Media and Technology","funders":"","keywords":"Diva; Computer science; World Wide Web; Web application; Computer graphics (images); Information retrieval; Art","score_opus":0.012813946223871723,"score_gpt":0.2289692785660168,"score_spread":0.21615533234214507,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W1854561485","genre_codex":"software","genre_gemma":"software","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"software","genre_consensus":"software","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.006812623,0.002349213,0.39267886,0.0007760984,0.0008532418,0.0005431959,0.050807644,0.4263115,0.11886773],"genre_scores_gemma":[0.06897358,0.004094145,0.38991797,0.001567456,0.0006247611,0.0012434591,0.109842986,0.13818373,0.2855519],"study_design_codex":"not_applicable","study_design_gemma":"not_applicable","domain_scores_codex":[0.99966884,0.000036265657,0.000027232583,0.000054916978,0.00017544144,0.000037277096],"domain_scores_gemma":[0.998628,0.0005074605,0.000055702305,0.00025729847,0.0003945772,0.00015693728],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.00084837986,0.0011890178,0.00087930996,0.0026797443,0.000546037,0.0031978164,0.0021754059,0.0012985447,0.1598009],"category_scores_gemma":[0.002391953,0.00076892064,0.00080829696,0.0019684827,0.0002957092,0.0030861173,0.0019572452,0.0015495429,0.06460921],"study_design_candidate":"not_applicable","study_design_consensus":"not_applicable","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00048027674,0.00011331618,0.00057073723,0.0010315032,0.00007307533,0.00041610652,0.00037429575,0.0010506719,0.027132042,0.008124807,0.64427173,0.3163615],"study_design_scores_gemma":[0.00014159318,0.00005562808,0.0016019923,0.00021199315,0.00005748434,0.0012047236,0.0002367563,0.01741096,0.032607842,0.011088268,0.935269,0.00011362433],"about_ca_topic_score_codex":0.0010902586,"about_ca_topic_score_gemma":0.0019557506,"teacher_disagreement_score":0.1598009,"about_ca_system_score_codex":0.0004305971,"about_ca_system_score_gemma":0.00057491683,"threshold_uncertainty_score":0.53458726},"labels":[],"label_agreement":null},{"id":"W1860914937","doi":"10.1007/11610113_36","title":"The Adaptability of English Based Web Search Algorithms to Chinese Search Engines","year":2005,"lang":"en","type":"book-chapter","venue":"Lecture notes in computer science","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":2,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Victoria","funders":"","keywords":"Computer science; Search engine; Scope (computer science); Adaptability; Information retrieval; Semantic search; Search algorithm; Search analytics; Web search engine; Beam search; Web crawler; Exploratory search; Web search query; World Wide Web; Algorithm; Programming language","score_opus":0.0183141131814815,"score_gpt":0.2678530435157057,"score_spread":0.24953893033422422,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W1860914937","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.87446666,0.001487568,0.08316284,0.0014452502,0.000212078,0.0002566237,0.00080396037,0.002430982,0.03573405],"genre_scores_gemma":[0.97189957,0.0004942052,0.020012377,0.00039176588,0.000098459066,0.00008475473,0.0007527936,0.00068440253,0.005581676],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9969313,0.0013899849,0.0002642339,0.00050296687,0.000671489,0.00024000861],"domain_scores_gemma":[0.9798166,0.013335768,0.0005138402,0.0026002396,0.003350673,0.00038288775],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.005585111,0.00058724737,0.0005477264,0.002123236,0.0010272181,0.002397878,0.0010666216,0.0005950063,0.0038942937],"category_scores_gemma":[0.04589335,0.00040333119,0.00067135144,0.0031231912,0.0008859239,0.004879977,0.0010046073,0.0009506589,0.001494391],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.003293392,0.0008357155,0.11272078,0.0007405741,0.00058792613,0.0010194813,0.007569357,0.08567819,0.054489493,0.040165957,0.019662587,0.6732365],"study_design_scores_gemma":[0.00026340634,0.0009190542,0.0784594,0.00011163372,0.0007120673,0.0010759823,0.0040329103,0.80155957,0.05706017,0.036748342,0.018893884,0.00016361935],"about_ca_topic_score_codex":0.021120049,"about_ca_topic_score_gemma":0.017520003,"teacher_disagreement_score":0.021120049,"about_ca_system_score_codex":0.0015376974,"about_ca_system_score_gemma":0.0014182443,"threshold_uncertainty_score":0.041994214},"labels":[],"label_agreement":null},{"id":"W1869545673","doi":"10.1109/nafips.2001.944685","title":"Mapping the Internet","year":2002,"lang":"en","type":"article","venue":"","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":8,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Simon Fraser University","funders":"","keywords":"traceroute; Computer science; The Internet; Completeness (order theory); Internet topology; Network mapping; Data mining; Network topology; Task (project management); Theoretical computer science; Data science; Computer network; World Wide Web; Mathematics","score_opus":0.05416792139957191,"score_gpt":0.21870161355576362,"score_spread":0.1645336921561917,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W1869545673","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.08156328,0.0023001933,0.869925,0.0012818391,0.00023995103,0.00039268384,0.0035378442,0.0038051312,0.036954105],"genre_scores_gemma":[0.5257582,0.004493768,0.45652074,0.00023036399,0.000118508426,0.00029703166,0.003568979,0.0004455887,0.008566893],"study_design_codex":"design_other","study_design_gemma":"not_applicable","domain_scores_codex":[0.998831,0.00038339227,0.000052145846,0.00024213016,0.00043349926,0.00005783965],"domain_scores_gemma":[0.99759346,0.0009122481,0.00014061961,0.0010001134,0.00028435054,0.00006924639],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0010795698,0.0006255941,0.00050957256,0.0026463205,0.00091175456,0.0029708305,0.000832616,0.00079640927,0.004018503],"category_scores_gemma":[0.008722246,0.00046050645,0.00049433834,0.003978654,0.0006041891,0.004548933,0.001965259,0.0008390633,0.0017444736],"study_design_candidate":"not_applicable","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00013615635,0.00011093275,0.009178319,0.00047492157,0.00014260398,0.0003753884,0.00088865485,0.10344408,0.009116629,0.082194045,0.014299178,0.7796391],"study_design_scores_gemma":[0.000031332056,0.00021970022,0.010532279,0.0002768056,0.0001497289,0.0015339047,0.001754118,0.34650278,0.023140676,0.40905342,0.20667623,0.00012910042],"about_ca_topic_score_codex":0.0016273337,"about_ca_topic_score_gemma":0.0013122264,"teacher_disagreement_score":0.004018503,"about_ca_system_score_codex":0.00043549377,"about_ca_system_score_gemma":0.00086246233,"threshold_uncertainty_score":0.013443291},"labels":[],"label_agreement":null},{"id":"W1870211331","doi":"10.1007/11944935_13","title":"Text Mining Through Semi Automatic Semantic Annotation","year":2006,"lang":"en","type":"book-chapter","venue":"Lecture notes in computer science","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":36,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Toronto; Queen's University","funders":"","keywords":"Annotation; Computer science; Semantic annotation; Information retrieval; Natural language processing; Artificial intelligence","score_opus":0.01645471353785901,"score_gpt":0.24815726148980818,"score_spread":0.23170254795194917,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W1870211331","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.013771438,0.00055778684,0.9656375,0.00037614795,0.00020900377,0.00023590695,0.0026229615,0.011248778,0.0053405175],"genre_scores_gemma":[0.11651532,0.0007786226,0.8576313,0.00020481941,0.00017674176,0.0005209094,0.014161094,0.0011843942,0.008826699],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.99817,0.00046850854,0.00022641984,0.00040067546,0.00065365166,0.00008068245],"domain_scores_gemma":[0.9954136,0.0023262461,0.00025217762,0.0007580759,0.0011790592,0.000070936156],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.001615149,0.0010228261,0.0009638499,0.0049575386,0.0011068865,0.0023323714,0.0012685366,0.0007698136,0.00435577],"category_scores_gemma":[0.005742403,0.00061113085,0.0012739495,0.0045548202,0.0009666023,0.0039069327,0.0022248577,0.0012513435,0.005918967],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.000341306,0.00018352491,0.0014009797,0.0008061239,0.000115624476,0.00034751912,0.0006189868,0.0047601876,0.05173935,0.025451073,0.025371563,0.88886374],"study_design_scores_gemma":[0.00008279605,0.00023672324,0.0031855796,0.00042215656,0.00039353935,0.0015209119,0.0010132506,0.47683233,0.17971013,0.19418004,0.1422713,0.00015122067],"about_ca_topic_score_codex":0.0013182579,"about_ca_topic_score_gemma":0.0021250057,"teacher_disagreement_score":0.0049575386,"about_ca_system_score_codex":0.00044684214,"about_ca_system_score_gemma":0.00129645,"threshold_uncertainty_score":0.014571488},"labels":[],"label_agreement":null},{"id":"W1886218757","doi":"10.1109/icdm.2002.1183904","title":"Phrase-based document similarity based on an index graph model","year":2003,"lang":"en","type":"article","venue":"","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":73,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Waterloo","funders":"","keywords":"Computer science; Document clustering; Cluster analysis; Phrase; Vector space model; Information retrieval; Graph; Similarity (geometry); Matching (statistics); Set (abstract data type); Artificial intelligence; Data mining; Mathematics","score_opus":0.02070779077958386,"score_gpt":0.2583232720134422,"score_spread":0.23761548123385834,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W1886218757","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.031812802,0.00038929225,0.96414053,0.00015154609,0.000053359974,0.00014622326,0.00045993624,0.000923099,0.0019231989],"genre_scores_gemma":[0.43879274,0.0007965512,0.5551353,0.00016084126,0.00019305368,0.00041466614,0.0018038284,0.00026658946,0.0024363846],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9979874,0.0005126411,0.00014464707,0.00036444172,0.0009225618,0.0000682548],"domain_scores_gemma":[0.9969439,0.0012347403,0.0003234595,0.0006264049,0.0007758754,0.00009559886],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0011260391,0.00054546224,0.0012298807,0.004967847,0.0005954102,0.0015404351,0.0017108978,0.0010384767,0.001696005],"category_scores_gemma":[0.008384758,0.00025482997,0.0010706332,0.0067659207,0.00088782783,0.0045896615,0.00118135,0.0008153256,0.0008462379],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0006243394,0.00042347127,0.0074248733,0.0007343898,0.00049788255,0.0004106421,0.00071608037,0.22847983,0.042872954,0.17707609,0.012238888,0.5285006],"study_design_scores_gemma":[0.00003639422,0.00016919455,0.0016835228,0.000021918393,0.00010111753,0.0004200691,0.00006840036,0.9312703,0.0057528093,0.056329865,0.004080491,0.00006589514],"about_ca_topic_score_codex":0.0027523509,"about_ca_topic_score_gemma":0.0031681845,"teacher_disagreement_score":0.004967847,"about_ca_system_score_codex":0.00092754274,"about_ca_system_score_gemma":0.0008512974,"threshold_uncertainty_score":0.0067297816},"labels":[],"label_agreement":null},{"id":"W1924960892","doi":"10.3127/ajis.v7i2.270","title":"Issues of Page Representation and Organisation in Web Browser's Revisitation Tools","year":2000,"lang":"en","type":"article","venue":"AJIS. Australasian journal of information systems/AJIS. Australian journal of information systems/Australian journal of information systems","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":55,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Calgary","funders":"Natural Sciences and Engineering Research Council of Canada; Microsoft Research","keywords":"Representation (politics); World Wide Web; Computer science; Political science","score_opus":0.024981889816105177,"score_gpt":0.27600088978352083,"score_spread":0.25101899996741567,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W1924960892","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.072961494,0.0031332828,0.8789099,0.00684031,0.0004378142,0.00046077845,0.0004661166,0.019791001,0.016999304],"genre_scores_gemma":[0.41443577,0.0020831265,0.562997,0.0011063701,0.00029472858,0.00072159944,0.00051445665,0.007870028,0.009976917],"study_design_codex":"design_other","study_design_gemma":"not_applicable","domain_scores_codex":[0.9745814,0.015874933,0.0029497482,0.0014492262,0.0043119695,0.000832633],"domain_scores_gemma":[0.8114177,0.13032465,0.0074614543,0.03173397,0.017001053,0.0020612397],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.032248456,0.0009222685,0.0016930599,0.0034467115,0.0021429637,0.017607408,0.00347772,0.0031072828,0.003718888],"category_scores_gemma":[0.18431835,0.002000941,0.0009194898,0.004107096,0.0041909595,0.017638702,0.0044003967,0.0032701013,0.0022449445],"study_design_candidate":"not_applicable","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.001566552,0.0004801834,0.012285007,0.0019164293,0.00016998395,0.000945356,0.04727258,0.018196942,0.023869269,0.25006908,0.031832915,0.6113958],"study_design_scores_gemma":[0.0005324363,0.0015063524,0.021233061,0.0041090883,0.00039651274,0.0047977706,0.021390872,0.12267265,0.0475733,0.30300266,0.47135115,0.0014341607],"about_ca_topic_score_codex":0.0028595466,"about_ca_topic_score_gemma":0.0024089771,"teacher_disagreement_score":0.032248456,"about_ca_system_score_codex":0.0017489402,"about_ca_system_score_gemma":0.0018252817,"threshold_uncertainty_score":0.17054814},"labels":[],"label_agreement":null},{"id":"W1927326449","doi":"10.1109/hicss.1998.649223","title":"Using metadata to query passive data sources","year":2002,"lang":"en","type":"article","venue":"","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":6,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Queen's University","funders":"","keywords":"Computer science; Metadata; Information retrieval; World Wide Web; The Internet; Metadata repository; Popularity; Data element; Data extraction; Data management; Database","score_opus":0.23513886665376893,"score_gpt":0.3190759787592714,"score_spread":0.08393711210550248,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W1927326449","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.051789768,0.0012341473,0.9272438,0.0032257566,0.00015535756,0.0010030317,0.0018685001,0.004703095,0.008776497],"genre_scores_gemma":[0.2962257,0.001140062,0.68835115,0.00080765825,0.00018048605,0.000943713,0.005924734,0.0007925529,0.0056338883],"study_design_codex":"design_other","study_design_gemma":"not_applicable","domain_scores_codex":[0.98848766,0.0040088776,0.0015679883,0.0013247378,0.004261743,0.00034907812],"domain_scores_gemma":[0.94342417,0.027504481,0.0044629183,0.015650878,0.0079321815,0.0010254091],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.018671345,0.0008297596,0.0011963618,0.010054162,0.0023442875,0.009000021,0.003301313,0.002121519,0.0016390722],"category_scores_gemma":[0.058192052,0.0009520815,0.0012284004,0.009780223,0.0023060148,0.016250888,0.006875209,0.0018414486,0.0010003361],"study_design_candidate":"not_applicable","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0012007466,0.0006686611,0.04483775,0.0025969257,0.0005084875,0.003690696,0.022071384,0.013642241,0.053120594,0.27990544,0.021202566,0.5565546],"study_design_scores_gemma":[0.00044391476,0.0006384714,0.010590037,0.0011965432,0.0005198593,0.0043741134,0.010760197,0.22046378,0.11575445,0.30340648,0.33129263,0.0005594141],"about_ca_topic_score_codex":0.0042706896,"about_ca_topic_score_gemma":0.005733453,"teacher_disagreement_score":0.018671345,"about_ca_system_score_codex":0.0018125233,"about_ca_system_score_gemma":0.0029000263,"threshold_uncertainty_score":0.09874469},"labels":[],"label_agreement":null},{"id":"W1965372953","doi":"10.1145/2766462.2767751","title":"Evaluating Streams of Evolving News Events","year":2015,"lang":"en","type":"article","venue":"","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":5,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Waterloo","funders":"Networks of Centres of Excellence of Canada; Natural Sciences and Engineering Research Council of Canada","keywords":"Computer science; Automatic summarization; TRACE (psycholinguistics); Event (particle physics); Context (archaeology); Track (disk drive); Reading (process); Information retrieval; Measure (data warehouse); Data mining","score_opus":0.12521478451774037,"score_gpt":0.3651689624897769,"score_spread":0.23995417797203655,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W1965372953","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.95737284,0.0011636943,0.035203,0.0004140426,0.00015533617,0.0003022056,0.0019453358,0.0013420559,0.0021014316],"genre_scores_gemma":[0.9792924,0.00025121478,0.015484874,0.000068738125,0.00009804191,0.00008257886,0.003989039,0.000054800406,0.0006782728],"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9959812,0.0015150377,0.00039178113,0.0008037129,0.0010865211,0.0002217301],"domain_scores_gemma":[0.9507364,0.03961063,0.0030249697,0.0021026034,0.0031520787,0.0013732654],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.009457123,0.0010168304,0.0013531529,0.0028462193,0.00055554137,0.0023287605,0.001180137,0.0014783969,0.0009832137],"category_scores_gemma":[0.039754685,0.00041234033,0.00070545095,0.002099901,0.00047503354,0.0029566123,0.0008387639,0.0011103225,0.00046226638],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.005722996,0.0021170706,0.17185903,0.0008064586,0.0010263815,0.00045878964,0.0008988453,0.55381733,0.010537024,0.002598873,0.00790097,0.24225627],"study_design_scores_gemma":[0.00006549609,0.0007538658,0.015438856,0.000016556769,0.0000839275,0.00007822218,0.00017444052,0.97832495,0.003143625,0.0012191122,0.000672998,0.000028018196],"about_ca_topic_score_codex":0.009481928,"about_ca_topic_score_gemma":0.0068331324,"teacher_disagreement_score":0.009481928,"about_ca_system_score_codex":0.001469443,"about_ca_system_score_gemma":0.0006430819,"threshold_uncertainty_score":0.050014675},"labels":[],"label_agreement":null},{"id":"W1966037453","doi":"10.1109/bigdata.congress.2013.59","title":"RSenter: Tool for Topics and Terms Extraction from Unstructured Data Debris","year":2013,"lang":"en","type":"article","venue":"","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":11,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Saskatchewan","funders":"","keywords":"Computer science; Unstructured data; Information retrieval; NoSQL; Cluster analysis; Schema (genetic algorithms); Data mining; World Wide Web; Data science; Database; Big data","score_opus":0.028029691592742424,"score_gpt":0.27178550984970257,"score_spread":0.24375581825696013,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W1966037453","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.010748631,0.001075926,0.58401054,0.0004727862,0.00016036587,0.0010261092,0.05397985,0.34150726,0.0070185093],"genre_scores_gemma":[0.036387246,0.0005237467,0.8851015,0.00019019787,0.000073812196,0.0011871903,0.06402439,0.007739165,0.004772688],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9988288,0.00021213047,0.00021116364,0.00030162703,0.00035596217,0.00009024439],"domain_scores_gemma":[0.9966017,0.0021918367,0.00030492953,0.00038501658,0.00037522582,0.0001412089],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0018426444,0.0021932714,0.0013220557,0.010528728,0.0010547276,0.0025056144,0.0018453801,0.0012577862,0.020588256],"category_scores_gemma":[0.009426022,0.000992423,0.0019765913,0.0072403452,0.00053709,0.003475396,0.002342193,0.0012709746,0.0138302],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00073736865,0.00028437123,0.0048090457,0.0033967742,0.00035866632,0.0012543076,0.0020721098,0.0046524666,0.021823956,0.015128691,0.2934342,0.65204793],"study_design_scores_gemma":[0.0006286549,0.0003747449,0.009800384,0.0007033178,0.00026576535,0.003938389,0.0020415948,0.23566474,0.07199781,0.0517994,0.6223851,0.00040010337],"about_ca_topic_score_codex":0.0029599455,"about_ca_topic_score_gemma":0.0059558717,"teacher_disagreement_score":0.020588256,"about_ca_system_score_codex":0.0006726903,"about_ca_system_score_gemma":0.0021581992,"threshold_uncertainty_score":0.06887454},"labels":[],"label_agreement":null},{"id":"W1967641500","doi":"10.1007/s101150200002","title":"Correlation-Based Web Document Clustering for Adaptive Web Interface Design","year":2002,"lang":"en","type":"article","venue":"Knowledge and Information Systems","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":16,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Simon Fraser University","funders":"","keywords":"Computer science; Web page; Cluster analysis; Web modeling; Data Web; Web mining; Information retrieval; Web navigation; Data mining; World Wide Web; Static web page; Web design; Machine learning","score_opus":0.03196732839296157,"score_gpt":0.24740335138207364,"score_spread":0.21543602298911207,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W1967641500","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.03510398,0.00018535659,0.959173,0.00007716326,0.00002930349,0.0001665244,0.00016710252,0.0041724867,0.00092518993],"genre_scores_gemma":[0.3690826,0.00013955847,0.6275714,0.000057945286,0.000033773536,0.0002467407,0.0006263243,0.00040137375,0.0018403493],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9983304,0.0004341303,0.00012923642,0.00035134924,0.0006477023,0.000107197775],"domain_scores_gemma":[0.9943229,0.002099641,0.0004827613,0.0008518746,0.0020633389,0.00017957459],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0015296384,0.00056980876,0.0009052391,0.0036388298,0.0010242278,0.0014537845,0.0013205411,0.0007561197,0.0027538182],"category_scores_gemma":[0.008805963,0.00046098078,0.00066917605,0.003256671,0.00045964253,0.0015746362,0.0009398226,0.0007335302,0.0011761597],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0006445758,0.0005532188,0.010634258,0.00027651724,0.00014260315,0.00013739512,0.00034981483,0.05479311,0.03724574,0.0069786417,0.0075631593,0.8806809],"study_design_scores_gemma":[0.00003964241,0.00009929387,0.003815333,0.000015524103,0.000058695845,0.00016999213,0.00008323353,0.96643996,0.023744151,0.0031812608,0.0023204621,0.000032547414],"about_ca_topic_score_codex":0.00613893,"about_ca_topic_score_gemma":0.011230748,"teacher_disagreement_score":0.00613893,"about_ca_system_score_codex":0.0010678652,"about_ca_system_score_gemma":0.0015632177,"threshold_uncertainty_score":0.012206376},"labels":[],"label_agreement":null},{"id":"W1970107047","doi":"10.1109/icmlc.2010.5580499","title":"Incremental clustering algorithm based on phrase-semantic similarity histogram","year":2010,"lang":"en","type":"article","venue":"","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":11,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Waterloo","funders":"","keywords":"Cluster analysis; Computer science; Fuzzy clustering; Correlation clustering; CURE data clustering algorithm; Canopy clustering algorithm; Document clustering; Data stream clustering; Data mining; Artificial intelligence; Clustering high-dimensional data; Brown clustering; Single-linkage clustering; Pattern recognition (psychology); Information retrieval","score_opus":0.013383855809061493,"score_gpt":0.24352670910997895,"score_spread":0.23014285330091747,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W1970107047","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.016478876,0.00028731022,0.9791307,0.000107343614,0.00010649424,0.00020078347,0.00021464392,0.0018308177,0.0016430018],"genre_scores_gemma":[0.16656794,0.00038761966,0.82674736,0.000119669465,0.00014817086,0.00036181413,0.0015562887,0.0002505163,0.0038606247],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9991171,0.000088854984,0.000057090085,0.00023087158,0.00042787116,0.00007831202],"domain_scores_gemma":[0.99900985,0.0002063112,0.00007420717,0.0001194958,0.000538514,0.000051566927],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0006024535,0.000601951,0.0012618017,0.0037147277,0.0011992805,0.0010418603,0.0026425326,0.0008642965,0.0027860259],"category_scores_gemma":[0.002425805,0.00033302247,0.0009871912,0.0039128847,0.00055088644,0.0019337089,0.0010448861,0.000856926,0.0013888426],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00023623373,0.00020079952,0.0021901755,0.00017703824,0.00016426129,0.00017287729,0.00028063188,0.06422837,0.014788693,0.014577506,0.011861666,0.8911217],"study_design_scores_gemma":[0.0000859577,0.00015158152,0.0022796148,0.000013845483,0.00010222488,0.00047516252,0.00014644435,0.9552265,0.012407799,0.020051964,0.008967233,0.00009168335],"about_ca_topic_score_codex":0.007879733,"about_ca_topic_score_gemma":0.006751334,"teacher_disagreement_score":0.007879733,"about_ca_system_score_codex":0.0009030461,"about_ca_system_score_gemma":0.0016800945,"threshold_uncertainty_score":0.015667737},"labels":[],"label_agreement":null},{"id":"W1970642732","doi":"10.3166/isi.19.4.61-86","title":"Crawl intelligent et adaptatif d’applications web pour l’archivage du web","year":2014,"lang":"fr","type":"article","venue":"Ingénierie des systèmes d information","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":true,"route_about_ca":false,"ca_institutions":"","funders":"","keywords":"Computer science; World Wide Web","score_opus":0.023655153752137545,"score_gpt":0.2477247503217598,"score_spread":0.22406959656962228,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W1970642732","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.39551762,0.0029923222,0.50684357,0.0015149565,0.00039425513,0.0008839671,0.0029620305,0.07453727,0.014353992],"genre_scores_gemma":[0.56236255,0.001402256,0.3998949,0.0004196222,0.0001873044,0.00042868598,0.0066132066,0.0037994091,0.024892095],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9977616,0.00044372806,0.00017925227,0.0004244287,0.0010395504,0.0001514479],"domain_scores_gemma":[0.99583614,0.0012551451,0.00021532673,0.0012476611,0.0012864413,0.00015925772],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0017132498,0.0012143233,0.0009804262,0.0057793283,0.0010104823,0.0029936086,0.00087304355,0.0016899124,0.0023763087],"category_scores_gemma":[0.0070043295,0.0009010556,0.0013309092,0.0017628319,0.0005365632,0.0024132219,0.0010615739,0.0011116682,0.0023462612],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00061304553,0.0010159602,0.0400711,0.00077272457,0.00044442955,0.0012416878,0.0014182413,0.026688611,0.1319962,0.003562194,0.025836293,0.7663396],"study_design_scores_gemma":[0.00014186058,0.00041290023,0.052438118,0.00019335827,0.00045880498,0.001982203,0.00066610414,0.71343833,0.15727107,0.0046963305,0.06813947,0.00016144474],"about_ca_topic_score_codex":0.009259659,"about_ca_topic_score_gemma":0.014186931,"teacher_disagreement_score":0.009259659,"about_ca_system_score_codex":0.0008094234,"about_ca_system_score_gemma":0.0012116855,"threshold_uncertainty_score":0.018411577},"labels":[],"label_agreement":null},{"id":"W197096134","doi":"10.15173/mjc.v1i0.224","title":"New Cultural Structures: South Asian Matrimonial Websites","year":2004,"lang":"en","type":"article","venue":"The McMaster Journal of Communication","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":5,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":true,"route_about_ca":false,"ca_institutions":"McMaster University","funders":"","keywords":"Geography; History; Political science","score_opus":0.02027888599285094,"score_gpt":0.26150361941684686,"score_spread":0.24122473342399592,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W197096134","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.81067604,0.00145785,0.00029794598,0.0063662915,0.00013585176,0.000046827754,0.00020170111,0.00003840879,0.18077904],"genre_scores_gemma":[0.9702398,0.0011662884,0.0002663988,0.0005916609,0.000036171285,0.000020257692,0.00012309059,0.000026821013,0.027529554],"study_design_codex":"qualitative","study_design_gemma":"observational","domain_scores_codex":[0.9995751,0.0001301201,0.000029036626,0.00004851149,0.000100999365,0.000116127005],"domain_scores_gemma":[0.9986737,0.00027584934,0.0003066892,0.00009488891,0.00016644978,0.00048249448],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.00093127205,0.00021105706,0.00011010774,0.0012183227,0.0045348355,0.0072371033,0.00041324462,0.00046683048,0.013734723],"category_scores_gemma":[0.001350825,0.00020241969,0.00014272606,0.0035470594,0.0022978703,0.0035558175,0.0025834807,0.0012531457,0.001909416],"study_design_candidate":"observational","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00012517435,0.00019944287,0.09107305,0.00047262706,0.000016444357,0.005623051,0.70200926,0.00007491029,0.0017863645,0.064939104,0.026120061,0.10756053],"study_design_scores_gemma":[0.000010555512,0.000055864162,0.13126755,0.0003240226,0.00002017503,0.0014820845,0.6172383,0.00029548365,0.0006294082,0.001966264,0.24668209,0.000028211103],"about_ca_topic_score_codex":0.02188997,"about_ca_topic_score_gemma":0.043309912,"teacher_disagreement_score":0.02188997,"about_ca_system_score_codex":0.0029698971,"about_ca_system_score_gemma":0.0025931762,"threshold_uncertainty_score":0.045947254},"labels":[],"label_agreement":null},{"id":"W1972495172","doi":"10.1145/2723372.2723725","title":"TEGRA","year":2015,"lang":"en","type":"article","venue":"","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":33,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Waterloo","funders":"","keywords":"Computer science; Information retrieval; Row; Table (database); Relational database; Schema (genetic algorithms); World Wide Web; Data mining; Database","score_opus":0.05405638443133703,"score_gpt":0.2543020114080482,"score_spread":0.20024562697671117,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W1972495172","genre_codex":"other","genre_gemma":"other","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"other","genre_consensus":"other","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0076672896,0.012749432,0.024000123,0.008833779,0.0065828725,0.00038031803,0.010711926,0.008037601,0.9210367],"genre_scores_gemma":[0.057473112,0.008074243,0.017033398,0.0037596407,0.0016806779,0.00031897496,0.012126099,0.0024106489,0.8971232],"study_design_codex":"design_other","study_design_gemma":"not_applicable","domain_scores_codex":[0.99779546,0.0003572581,0.00016499098,0.0005780408,0.00082765624,0.0002766396],"domain_scores_gemma":[0.9977963,0.00028141728,0.00018851203,0.0005795885,0.00073032384,0.00042390867],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0017151574,0.0012216427,0.00088451535,0.0028316923,0.0019176854,0.0068461346,0.0020163946,0.0026358827,0.40850294],"category_scores_gemma":[0.004577252,0.00061764906,0.0008104233,0.002159743,0.0009918772,0.0031233646,0.0041872337,0.002219223,0.35048723],"study_design_candidate":"not_applicable","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00059383217,0.00017421618,0.0026729228,0.00095416856,0.00006733648,0.000960056,0.00067530345,0.00082484004,0.0056114993,0.066742666,0.37761462,0.5431085],"study_design_scores_gemma":[0.000018371262,0.00003272097,0.0005480079,0.00012313825,0.00001336794,0.00046153183,0.00010448366,0.00032961712,0.0012879206,0.0037915313,0.99327576,0.000013617748],"about_ca_topic_score_codex":0.0029797095,"about_ca_topic_score_gemma":0.0025466222,"teacher_disagreement_score":0.40850294,"about_ca_system_score_codex":0.0018809036,"about_ca_system_score_gemma":0.002702109,"threshold_uncertainty_score":0},"labels":[],"label_agreement":null},{"id":"W1972743934","doi":"10.1109/coginf.2011.6016120","title":"Extraction of geospatial information on the Web for GIS applications","year":2011,"lang":"en","type":"article","venue":"","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":17,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Calgary","funders":"","keywords":"Geospatial analysis; Geospatial PDF; Computer science; Web Coverage Service; World Wide Web; Distributed GIS; Web mapping; Geographic information system; Geospatial metadata; Information retrieval; Web page; Data Web; GIS applications; Geography; AM/FM/GIS; Meta Data Services; Remote sensing; Metadata","score_opus":0.03601138114245606,"score_gpt":0.24857063181841796,"score_spread":0.2125592506759619,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W1972743934","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.061791204,0.0044868565,0.8707087,0.0012186343,0.00026239688,0.00092679943,0.025656,0.016288238,0.018661132],"genre_scores_gemma":[0.116612665,0.0034775112,0.84382063,0.00012821918,0.000096934644,0.00026938412,0.030381225,0.0007541816,0.004459283],"study_design_codex":"design_other","study_design_gemma":"not_applicable","domain_scores_codex":[0.99927324,0.000104219376,0.00008119525,0.00010444215,0.00038269904,0.000054147407],"domain_scores_gemma":[0.99864537,0.00042471164,0.00016265792,0.00027827927,0.00043908256,0.00004998235],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0004973846,0.00091264327,0.000907433,0.010001269,0.000847823,0.0024132768,0.000760355,0.00087541103,0.0033533785],"category_scores_gemma":[0.0036903801,0.0005748396,0.000956226,0.014000066,0.0004228488,0.0025479393,0.0012417737,0.0009091816,0.0049554054],"study_design_candidate":"not_applicable","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00017867469,0.00023407656,0.011198502,0.0019168047,0.00015901282,0.002117427,0.0010726668,0.0067516,0.04558276,0.011471334,0.035595536,0.8837216],"study_design_scores_gemma":[0.00007954961,0.00019223825,0.052368652,0.0010883138,0.0004602299,0.0069068857,0.0055887573,0.23175618,0.181859,0.0696297,0.4497984,0.00027212346],"about_ca_topic_score_codex":0.0027491094,"about_ca_topic_score_gemma":0.005565677,"teacher_disagreement_score":0.010001269,"about_ca_system_score_codex":0.00044368813,"about_ca_system_score_gemma":0.0012466605,"threshold_uncertainty_score":0.01121819},"labels":[],"label_agreement":null},{"id":"W1975046113","doi":"10.1145/1520340.1520652","title":"Building support for multi-session tasks","year":2009,"lang":"en","type":"article","venue":"","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":9,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Dalhousie University","funders":"","keywords":"Session (web analytics); Computer science; Web application; Web browser; Task (project management); Human–computer interaction; World Wide Web; Multimedia; The Internet; Systems engineering; Engineering","score_opus":0.0497520218839738,"score_gpt":0.33901838770816556,"score_spread":0.28926636582419174,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W1975046113","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.20617926,0.00037496578,0.7079821,0.0005605977,0.000120575205,0.001836743,0.0003432239,0.076372586,0.0062299683],"genre_scores_gemma":[0.43325156,0.00018619627,0.55559623,0.00029609236,0.000083691055,0.0011502946,0.0008439107,0.0025785284,0.0060134623],"study_design_codex":"design_other","study_design_gemma":"not_applicable","domain_scores_codex":[0.99632275,0.0009998715,0.0004237839,0.0008616329,0.00086551235,0.0005265532],"domain_scores_gemma":[0.9476639,0.030782003,0.002204331,0.011374606,0.0046973284,0.0032778692],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.007538917,0.0019694779,0.001017914,0.0014545864,0.00085164106,0.0027591703,0.0050085397,0.0025248828,0.0061142296],"category_scores_gemma":[0.039926134,0.0017938174,0.0012301697,0.0006126037,0.0006894837,0.007206338,0.0048409947,0.002959667,0.0038611586],"study_design_candidate":"not_applicable","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.003585906,0.0047293603,0.034401767,0.0024139606,0.00036083997,0.0032892758,0.022971438,0.0094440235,0.108395524,0.0057941326,0.02082039,0.78379333],"study_design_scores_gemma":[0.0018263585,0.0060623204,0.050899327,0.0018397262,0.0008950262,0.006567123,0.007939984,0.46632677,0.19038428,0.036103006,0.22982597,0.0013300447],"about_ca_topic_score_codex":0.0018438165,"about_ca_topic_score_gemma":0.0023139336,"teacher_disagreement_score":0.007538917,"about_ca_system_score_codex":0.0004618081,"about_ca_system_score_gemma":0.0016461916,"threshold_uncertainty_score":0.039870083},"labels":[],"label_agreement":null},{"id":"W1976974399","doi":"10.1145/1188966.1188996","title":"Improving web site search using web server logs","year":2006,"lang":"en","type":"article","venue":"","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":7,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Toronto Metropolitan University","funders":"Natural Sciences and Engineering Research Council of Canada; Connaught Fund; University of Toronto; National University of Singapore","keywords":"Computer science; Information retrieval; Web page; Web server; Web search engine; Static web page; Web modeling; Web crawler; World Wide Web; Data Web; Ranking (information retrieval); Web mining; Search engine; Web search query; Data mining; Web navigation; The Internet","score_opus":0.02198109100242396,"score_gpt":0.24952108379682875,"score_spread":0.2275399927944048,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W1976974399","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.52115995,0.0015452717,0.45570436,0.00038667294,0.000062572646,0.0002868816,0.0006026431,0.016655244,0.0035965003],"genre_scores_gemma":[0.8646345,0.00048524057,0.13081482,0.000061215935,0.00008858031,0.00008514341,0.0014473709,0.00023323364,0.0021499249],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.99847215,0.0004873262,0.00012036063,0.00017363629,0.00063445285,0.00011217239],"domain_scores_gemma":[0.99544096,0.0022963504,0.0004454543,0.0006995686,0.0009897951,0.00012779469],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.002272723,0.00094495574,0.0016040029,0.0047251815,0.0004023761,0.0014717417,0.0010656964,0.00079632696,0.00077514275],"category_scores_gemma":[0.014403068,0.00037199847,0.0006061601,0.003224566,0.00026608488,0.004375825,0.00070557336,0.0005851285,0.0010111434],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00090458087,0.0009403147,0.038403936,0.00032134773,0.0001812868,0.00013150675,0.0001958466,0.06987123,0.022947505,0.0012583522,0.0048670177,0.859977],"study_design_scores_gemma":[0.00007300281,0.00030535203,0.009539477,0.00001891826,0.00011360594,0.00023228563,0.00011863977,0.96675783,0.019359961,0.0017138339,0.0017255895,0.000041499152],"about_ca_topic_score_codex":0.008883237,"about_ca_topic_score_gemma":0.008913928,"teacher_disagreement_score":0.008883237,"about_ca_system_score_codex":0.00060401903,"about_ca_system_score_gemma":0.0010661671,"threshold_uncertainty_score":0.017663062},"labels":[],"label_agreement":null},{"id":"W1977275825","doi":"10.1145/379437.379453","title":"Measuring the reputation of web sites","year":2001,"lang":"en","type":"article","venue":"","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":10,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Toronto","funders":"University of Toronto; Badan Riset dan Inovasi Nasional","keywords":"Reputation; Ranking (information retrieval); Search engine indexing; Computer science; Trustworthiness; Selection (genetic algorithm); Information retrieval; Link analysis; World Wide Web; Data science; Internet privacy; Artificial intelligence; Political science","score_opus":0.04635411903323384,"score_gpt":0.24561736867345355,"score_spread":0.19926324964021971,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W1977275825","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.98495746,0.00029418097,0.0074213776,0.000179143,0.00002358187,0.0001253177,0.00019834694,0.00017115868,0.0066294237],"genre_scores_gemma":[0.99566275,0.000058974347,0.0035353275,0.000012335022,0.000019842106,0.000024603936,0.0001535444,0.0000122929205,0.00052032125],"study_design_codex":"observational","study_design_gemma":"observational","domain_scores_codex":[0.98903745,0.0049398933,0.000932714,0.0007808477,0.0038393873,0.00046976242],"domain_scores_gemma":[0.9083289,0.0410284,0.015427346,0.006707907,0.023999417,0.004508007],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.014504487,0.00035642894,0.0005878066,0.0031459406,0.0010246437,0.0020648835,0.00063661067,0.00057591393,0.0017949451],"category_scores_gemma":[0.05696624,0.00018260063,0.00033129693,0.0016627414,0.00057538936,0.002752081,0.0010680528,0.0006701752,0.0008253759],"study_design_candidate":"observational","study_design_consensus":"observational","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0009012879,0.0008271164,0.8368608,0.00037036487,0.00025938472,0.00030241694,0.003690285,0.0019477439,0.01387872,0.0014577879,0.0017996319,0.13770449],"study_design_scores_gemma":[0.000084580905,0.003554697,0.94842386,0.000063198706,0.00020892131,0.0007845881,0.0034178896,0.024729056,0.013230105,0.0017129546,0.0036220285,0.00016817232],"about_ca_topic_score_codex":0.0016870118,"about_ca_topic_score_gemma":0.0023932026,"teacher_disagreement_score":0.014504487,"about_ca_system_score_codex":0.00071354304,"about_ca_system_score_gemma":0.0006243159,"threshold_uncertainty_score":0.07670802},"labels":[],"label_agreement":null},{"id":"W1977556313","doi":"10.1145/506443.506448","title":"Hunter gatherer","year":2002,"lang":"en","type":"article","venue":"","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":2,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Toronto","funders":"","keywords":"Copying; Computer science; World Wide Web; Task (project management); Focus (optics); Web page; Engineering","score_opus":0.023781315915570277,"score_gpt":0.19902349484431608,"score_spread":0.1752421789287458,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W1977556313","genre_codex":"other","genre_gemma":"other","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"other","genre_consensus":"other","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.015349601,0.0049990867,0.213027,0.010526527,0.0043952777,0.0024960453,0.03157017,0.06598667,0.6516496],"genre_scores_gemma":[0.046800658,0.00384036,0.15579702,0.0041263057,0.0009823729,0.0017756188,0.025860287,0.012813438,0.7480039],"study_design_codex":"not_applicable","study_design_gemma":"not_applicable","domain_scores_codex":[0.99767417,0.00040294434,0.00016842534,0.00073288457,0.00077896024,0.00024262618],"domain_scores_gemma":[0.9921383,0.002576307,0.00037922693,0.0012952044,0.0023426744,0.0012683228],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.003363833,0.001532698,0.0013089211,0.007649989,0.002741673,0.003722202,0.001790351,0.0016364495,0.29753122],"category_scores_gemma":[0.013315685,0.0013868285,0.0007642862,0.0048244833,0.0013256448,0.004516138,0.005432691,0.0018076178,0.17969573],"study_design_candidate":"not_applicable","study_design_consensus":"not_applicable","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0003639878,0.000077335724,0.0022286566,0.0005566837,0.000031339598,0.0003295827,0.002387527,0.00023459588,0.0019031338,0.008872756,0.694448,0.28856647],"study_design_scores_gemma":[0.00003251104,0.000041025873,0.0017702855,0.00014865765,0.00001795872,0.00033010248,0.00064690463,0.00065820804,0.0008809451,0.005467686,0.98996115,0.000044489396],"about_ca_topic_score_codex":0.004624144,"about_ca_topic_score_gemma":0.010309011,"teacher_disagreement_score":0.29753122,"about_ca_system_score_codex":0.0009989723,"about_ca_system_score_gemma":0.0029912812,"threshold_uncertainty_score":0.99534106},"labels":[],"label_agreement":null},{"id":"W1981155543","doi":"10.1002/meet.1450390145","title":"GeoSearcher: Geospatial ranking of search engine results","year":2002,"lang":"en","type":"article","venue":"Proceedings of the American Society for Information Science and Technology","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Dalhousie University","funders":"","keywords":"Geospatial analysis; Computer science; Information retrieval; Exploit; Ranking (information retrieval); Search engine; World Wide Web; Web search engine; Rank (graph theory); Matching (statistics); Data mining; Web search query; Geography","score_opus":0.01826634226760524,"score_gpt":0.2528697570100849,"score_spread":0.23460341474247967,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W1981155543","genre_codex":"software","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.26713184,0.003769893,0.30112863,0.001351179,0.00047489456,0.0015647202,0.040368896,0.35228863,0.03192141],"genre_scores_gemma":[0.6159013,0.00075193483,0.33257344,0.00021051719,0.00024803143,0.0004131636,0.033349764,0.0035671233,0.012984753],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9970578,0.0006357797,0.00028606594,0.00038751683,0.0014106398,0.00022218369],"domain_scores_gemma":[0.99398947,0.0021311876,0.0007634751,0.0009417271,0.0017129538,0.000461291],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0026043481,0.00095050904,0.0013746349,0.010344571,0.00065890275,0.0030974476,0.001187945,0.0006781291,0.010619826],"category_scores_gemma":[0.009617724,0.00038999552,0.00039951215,0.006182865,0.00034948325,0.0024069955,0.0011615028,0.00039454328,0.006606991],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.003412556,0.00062599994,0.039369572,0.0013367247,0.00043219066,0.00047703975,0.000665763,0.012489119,0.03859205,0.00937913,0.18388276,0.7093371],"study_design_scores_gemma":[0.0010956811,0.0014832116,0.05934925,0.00018196247,0.00032023367,0.0011966424,0.0010054286,0.7327088,0.09563532,0.012147689,0.09446575,0.00041006936],"about_ca_topic_score_codex":0.00777278,"about_ca_topic_score_gemma":0.013227546,"teacher_disagreement_score":0.010619826,"about_ca_system_score_codex":0.0007887363,"about_ca_system_score_gemma":0.0010515477,"threshold_uncertainty_score":0.035526812},"labels":[],"label_agreement":null},{"id":"W1981802602","doi":"10.1109/wi.2004.70","title":"Focused Crawling by Learning HMM from User's Topic-specific Browsing","year":2004,"lang":"en","type":"article","venue":"","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":9,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Dalhousie University","funders":"","keywords":"Crawling; Computer science; Hidden Markov model; Web page; Focused crawler; Information retrieval; Web crawler; World Wide Web; Session (web analytics); Task (project management); Graph; Static web page; Artificial intelligence; Web navigation","score_opus":0.012976536588739752,"score_gpt":0.20957093693935858,"score_spread":0.19659440035061881,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W1981802602","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.18892866,0.000576185,0.7994661,0.0001355407,0.00003535315,0.00020457173,0.0011789132,0.008665121,0.0008095786],"genre_scores_gemma":[0.60616356,0.0004569361,0.38518807,0.000118209435,0.00006077402,0.00032443038,0.005350731,0.00024104722,0.002096219],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9992613,0.0002547523,0.000051945502,0.00024282103,0.00013623144,0.000052867086],"domain_scores_gemma":[0.99679923,0.0017880317,0.00021281376,0.0005870112,0.00049650186,0.000116359486],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0012230538,0.0009729415,0.0011915086,0.0021481744,0.00037410273,0.00071595766,0.0010896474,0.0012355931,0.0005931443],"category_scores_gemma":[0.0049219034,0.0007661493,0.0008854956,0.0015115724,0.0003875962,0.0019058515,0.0005606544,0.0010119409,0.00092229404],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0007704725,0.0010821733,0.060042903,0.00045264163,0.0006984618,0.0005180451,0.0007624475,0.2407495,0.029835649,0.0023900003,0.011109743,0.6515881],"study_design_scores_gemma":[0.000017228966,0.00010989642,0.005710112,0.000011792048,0.00007206888,0.0001524917,0.000032865675,0.9864271,0.0051188455,0.0016747786,0.0006456372,0.000027096154],"about_ca_topic_score_codex":0.010315722,"about_ca_topic_score_gemma":0.019725582,"teacher_disagreement_score":0.010315722,"about_ca_system_score_codex":0.0005534292,"about_ca_system_score_gemma":0.00082347484,"threshold_uncertainty_score":0.02051133},"labels":[],"label_agreement":null},{"id":"W1982652679","doi":"10.1145/1871437.1871645","title":"Query model refinement using word graphs","year":2010,"lang":"en","type":"article","venue":"","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":3,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Université de Montréal","funders":"","keywords":"Computer science; Relevance feedback; Term (time); Relevance (law); ENCODE; Graph; Random walk; Context (archaeology); Word (group theory); Information retrieval; Query expansion; Artificial intelligence; Theoretical computer science; Data mining; Mathematics; Image retrieval; Statistics","score_opus":0.030578107499941425,"score_gpt":0.26666472536787894,"score_spread":0.23608661786793753,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W1982652679","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.008798499,0.000490943,0.98654187,0.00016706124,0.00003532694,0.00019510531,0.00029635525,0.0029311427,0.0005436147],"genre_scores_gemma":[0.2251986,0.0008073419,0.76713324,0.0003623331,0.00010867977,0.00046695184,0.0026872426,0.00067912426,0.0025564872],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.99355006,0.0025998892,0.00041323737,0.0010098222,0.0021956773,0.00023132516],"domain_scores_gemma":[0.99365014,0.0030854242,0.00035920241,0.0010968749,0.0017103681,0.00009808109],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.002961919,0.0019501231,0.0016717671,0.004443833,0.00087373727,0.0014062243,0.0020419522,0.0012141458,0.0017871064],"category_scores_gemma":[0.01425827,0.0006962672,0.0022951663,0.0030211692,0.00082966156,0.0042250743,0.0018550387,0.0015457739,0.0011762987],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0007774827,0.0003338022,0.0024398037,0.0008457249,0.00037320078,0.0005485526,0.00074078335,0.21100068,0.07299297,0.024443643,0.01474177,0.6707616],"study_design_scores_gemma":[0.00007488891,0.00015625927,0.00042284015,0.000026212325,0.000116881645,0.00022292144,0.00010800099,0.948237,0.018063027,0.025362983,0.0071396995,0.000069304064],"about_ca_topic_score_codex":0.0124305505,"about_ca_topic_score_gemma":0.012635271,"teacher_disagreement_score":0.0124305505,"about_ca_system_score_codex":0.0012189274,"about_ca_system_score_gemma":0.0018482502,"threshold_uncertainty_score":0.024716377},"labels":[],"label_agreement":null},{"id":"W1984342665","doi":"10.1145/2009916.2010168","title":"Enhancing web search by mining search and browse logs","year":2011,"lang":"en","type":"article","venue":"","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":1,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Simon Fraser University","funders":"","keywords":"Computer science; Automatic summarization; Information retrieval; Search engine; Web search query; Web search engine; Web crawler; Byte; World Wide Web; Data mining; Data science","score_opus":0.04401880406645026,"score_gpt":0.25990522001881144,"score_spread":0.2158864159523612,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W1984342665","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.24994002,0.01895143,0.66231114,0.0032410948,0.00025128294,0.0012919729,0.019634565,0.029679727,0.0146987075],"genre_scores_gemma":[0.44847393,0.007870141,0.4960173,0.0006701503,0.00037010203,0.000597395,0.03816911,0.0010241714,0.0068077217],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.99853444,0.00044479826,0.00015586482,0.00024562734,0.0005067847,0.00011255445],"domain_scores_gemma":[0.9927787,0.0046813497,0.0005172775,0.000878638,0.0010131359,0.0001308033],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0023831564,0.0015624192,0.0014775306,0.009998479,0.0006128746,0.003427652,0.0014116344,0.0010965399,0.0012784244],"category_scores_gemma":[0.016288819,0.0006718561,0.0015693876,0.007436104,0.00045373142,0.0063750413,0.0013455187,0.0016061218,0.002220112],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00047511462,0.001006918,0.047901846,0.0022483403,0.00039039215,0.00035124636,0.0010657455,0.029225588,0.01529982,0.0067617954,0.037422527,0.8578507],"study_design_scores_gemma":[0.00007998338,0.00039675366,0.024315683,0.00035772027,0.00029711353,0.0008703084,0.0012312629,0.8848738,0.015040169,0.039279003,0.03313121,0.00012697176],"about_ca_topic_score_codex":0.007868253,"about_ca_topic_score_gemma":0.013042623,"teacher_disagreement_score":0.009998479,"about_ca_system_score_codex":0.0006590987,"about_ca_system_score_gemma":0.0014385456,"threshold_uncertainty_score":0.015644908},"labels":[],"label_agreement":null},{"id":"W1984348519","doi":"10.1109/suite.2012.6225474","title":"Similarity search plug-in: Clone detection meets internet-scale code search","year":2012,"lang":"en","type":"article","venue":"","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":14,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Concordia University","funders":"","keywords":"Computer science; The Internet; Nearest neighbor search; Scalability; Eclipse; Similarity (geometry); clone (Java method); Information retrieval; Source code; Plug-in; Code (set theory); Search engine; Open source; World Wide Web; Data mining; Database; Artificial intelligence; Software; Programming language; Set (abstract data type)","score_opus":0.042836929191181365,"score_gpt":0.29383514972419966,"score_spread":0.2509982205330183,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W1984348519","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.058093492,0.00042391472,0.5673962,0.0005523525,0.00023916842,0.00045974343,0.0018823512,0.36348644,0.007466387],"genre_scores_gemma":[0.5128679,0.00046153436,0.43685362,0.0007625793,0.00020173332,0.0005230134,0.007578344,0.025587907,0.015163324],"study_design_codex":"design_other","study_design_gemma":"bench_or_experimental","domain_scores_codex":[0.99797696,0.0002339702,0.00019234046,0.0003785381,0.0010130408,0.00020513627],"domain_scores_gemma":[0.9941812,0.002457621,0.00038038124,0.0018528518,0.0008010444,0.0003268105],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0023289789,0.0010878169,0.0012054737,0.0020656362,0.000478739,0.0021704002,0.0021473814,0.0013313999,0.0067212894],"category_scores_gemma":[0.013471913,0.0009774514,0.0007497822,0.0014629025,0.0005996027,0.0058978642,0.0034633859,0.0012172016,0.003870084],"study_design_candidate":"bench_or_experimental","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.003112031,0.0011511358,0.033196617,0.001037219,0.00024107519,0.002227836,0.00081510993,0.0074678557,0.06981609,0.02134169,0.11776584,0.74182755],"study_design_scores_gemma":[0.00069761515,0.0007406936,0.019268623,0.000231384,0.00019957391,0.0034270363,0.0003907393,0.571946,0.23740803,0.021834422,0.14357854,0.00027725354],"about_ca_topic_score_codex":0.002125323,"about_ca_topic_score_gemma":0.0029468436,"teacher_disagreement_score":0.0067212894,"about_ca_system_score_codex":0.00063989934,"about_ca_system_score_gemma":0.0010263054,"threshold_uncertainty_score":0.022484958},"labels":[],"label_agreement":null},{"id":"W1986378259","doi":"10.1016/j.procs.2013.06.025","title":"Ad-centric Model Discovery for Prediciting Ads's Click-through Rate","year":2013,"lang":"en","type":"article","venue":"Procedia Computer Science","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":6,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Dalhousie University","funders":"","keywords":"Computer science; Click-through rate; Revenue; World Wide Web; The Internet; Search engine; Organic search; Service (business); Online advertising; Web search engine; Web search query","score_opus":0.02150087887796619,"score_gpt":0.25213489473268397,"score_spread":0.23063401585471777,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W1986378259","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.40153825,0.0030089756,0.57541484,0.0023275658,0.00022103617,0.00040206008,0.0074333088,0.0062002186,0.0034537795],"genre_scores_gemma":[0.9310801,0.00034460097,0.062300205,0.0001846313,0.00013419498,0.0001815762,0.0038919973,0.00005882286,0.0018238075],"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.99867815,0.00048146793,0.000107595086,0.00036348822,0.00021673618,0.00015245021],"domain_scores_gemma":[0.9920969,0.005716791,0.0006614889,0.0006013249,0.00070317695,0.00022024737],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0041092113,0.0018450217,0.0017962193,0.005079803,0.00064153253,0.0013852813,0.0015758288,0.0016892191,0.0018021882],"category_scores_gemma":[0.009443085,0.00075507205,0.0021655818,0.0032939874,0.00036998815,0.0013428017,0.000828233,0.0020393915,0.00091234595],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00080329174,0.001650231,0.10367463,0.00024698133,0.0008568824,0.00029412724,0.0001283258,0.68984133,0.001806109,0.005055387,0.0095043825,0.18613836],"study_design_scores_gemma":[0.000008079233,0.000025758673,0.0011392161,0.000004131643,0.000021396825,0.000023536308,0.000006687273,0.997592,0.00016001346,0.0008717259,0.0001418973,0.000005585348],"about_ca_topic_score_codex":0.016641505,"about_ca_topic_score_gemma":0.018003916,"teacher_disagreement_score":0.016641505,"about_ca_system_score_codex":0.0013804527,"about_ca_system_score_gemma":0.0016889217,"threshold_uncertainty_score":0.03308928},"labels":[],"label_agreement":null},{"id":"W1987416436","doi":"10.1145/2808194.2809478","title":"Building a Self-Contained Search Engine in the Browser","year":2015,"lang":"en","type":"article","venue":"","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":9,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Waterloo","funders":"National Science Foundation","keywords":"JavaScript; Computer science; Rendering (computer graphics); Search engine; Web browser; Key (lock); World Wide Web; Spamdexing; Index (typography); Information retrieval; Database; Web search engine; The Internet; Operating system; Computer graphics (images); Web search query","score_opus":0.03653162617092156,"score_gpt":0.28076583962817153,"score_spread":0.24423421345724997,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W1987416436","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.049047958,0.00018806862,0.8822826,0.00017695842,0.000065296656,0.00041452926,0.0003309894,0.0623862,0.0051074107],"genre_scores_gemma":[0.23793115,0.00021891756,0.74070984,0.0004217447,0.000034085984,0.00029457736,0.0017754177,0.0049536014,0.013660579],"study_design_codex":"bench_or_experimental","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.99920887,0.00011220207,0.00008988338,0.00021675916,0.0002988727,0.00007342969],"domain_scores_gemma":[0.99810505,0.0005547865,0.000071030954,0.00049510144,0.0005748639,0.00019919964],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0014277908,0.00055894215,0.0007234036,0.00047007954,0.00036890147,0.0017023967,0.0019740232,0.00095681107,0.0030923956],"category_scores_gemma":[0.003631103,0.0008221544,0.00069859007,0.00041435048,0.0005674227,0.003797456,0.0012988237,0.0010744634,0.0040116324],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0017301653,0.0014270481,0.012008291,0.0009319364,0.00042907256,0.0013507684,0.0022412091,0.017243935,0.5444049,0.029285017,0.03233569,0.35661197],"study_design_scores_gemma":[0.0004549262,0.00090156303,0.0053131483,0.00014483074,0.00035364434,0.0020227486,0.00034683698,0.48512742,0.38432574,0.013221746,0.1074647,0.00032273374],"about_ca_topic_score_codex":0.002418539,"about_ca_topic_score_gemma":0.0026870407,"teacher_disagreement_score":0.0030923956,"about_ca_system_score_codex":0.00038172145,"about_ca_system_score_gemma":0.0011360797,"threshold_uncertainty_score":0.010345161},"labels":[],"label_agreement":null},{"id":"W1989495780","doi":"10.1007/s10515-014-0146-2","title":"Semantic tagging and linking of software engineering social content","year":2014,"lang":"en","type":"article","venue":"Automated Software Engineering","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":23,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Athabasca University; Toronto Metropolitan University","funders":"","keywords":"Computer science; World Wide Web; Scalability; Process (computing); Software; Software development; Data science; Database","score_opus":0.011517489404960227,"score_gpt":0.20281677799411887,"score_spread":0.19129928858915865,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W1989495780","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.44817492,0.0013219382,0.4890163,0.0012993786,0.0004566501,0.00068541436,0.013676308,0.0034551348,0.041913997],"genre_scores_gemma":[0.72166073,0.00094745174,0.24660875,0.00020717065,0.00022333722,0.00038386782,0.020105543,0.0005707986,0.009292425],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9975157,0.0008350144,0.00021698969,0.00047304775,0.0008183059,0.00014086421],"domain_scores_gemma":[0.99145496,0.004373542,0.00092919375,0.0014607204,0.0015419825,0.00023952614],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.001736035,0.00040676384,0.00033274826,0.016033405,0.0015289241,0.0027346876,0.0006474887,0.0010164987,0.0021993585],"category_scores_gemma":[0.011589478,0.00030416407,0.00066749036,0.010184351,0.00076895655,0.0036207084,0.0022783277,0.00085455365,0.0015084062],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00058628066,0.0010951848,0.074233964,0.0014866798,0.00026338434,0.0013138234,0.008725108,0.009447663,0.05743053,0.14531264,0.025920246,0.6741846],"study_design_scores_gemma":[0.000065581,0.0003063513,0.11008417,0.0010804109,0.000585046,0.0024611047,0.0069248183,0.28116688,0.08582308,0.27049834,0.2407647,0.0002395167],"about_ca_topic_score_codex":0.0025073672,"about_ca_topic_score_gemma":0.0047123116,"teacher_disagreement_score":0.016033405,"about_ca_system_score_codex":0.0009503831,"about_ca_system_score_gemma":0.0015405201,"threshold_uncertainty_score":0.009181142},"labels":[],"label_agreement":null},{"id":"W1991726843","doi":"10.1300/j123v43n02_03","title":"An Open Source Solution to Managing Electronic Journal Links with Database-Generated Web Pages","year":2003,"lang":"en","type":"article","venue":"The Serials Librarian","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":2,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Ottawa","funders":"","keywords":"World Wide Web; Computer science; Open source; Database; Web page; Information retrieval; Operating system; Software","score_opus":0.02532925884413571,"score_gpt":0.24731040544293265,"score_spread":0.22198114659879695,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W1991726843","genre_codex":"methods","genre_gemma":"software","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"software","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.017237365,0.0007729503,0.49494898,0.00093467254,0.0008687647,0.0015531186,0.007526226,0.45149693,0.024660941],"genre_scores_gemma":[0.09911692,0.0011462473,0.7223297,0.0008317896,0.0010084346,0.0014088255,0.03691086,0.03771179,0.09953543],"study_design_codex":"design_other","study_design_gemma":"not_applicable","domain_scores_codex":[0.996191,0.0003612075,0.0004706949,0.00053009036,0.0022303266,0.00021654516],"domain_scores_gemma":[0.9856016,0.0026123987,0.00119451,0.005090096,0.004193668,0.001307705],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0040249913,0.0013970302,0.0011735997,0.007633528,0.0020211807,0.006910488,0.0035154365,0.0017452777,0.02363926],"category_scores_gemma":[0.017977193,0.0017211706,0.0010408841,0.008332866,0.0006711301,0.006142495,0.0052807904,0.001983892,0.018670576],"study_design_candidate":"not_applicable","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0010299555,0.0008072761,0.0040084925,0.0005766814,0.00020849508,0.0005633938,0.0006031366,0.0011478314,0.01820211,0.007056831,0.1982714,0.7675244],"study_design_scores_gemma":[0.0009947998,0.0006592266,0.009568895,0.00038575922,0.0006837518,0.0023075093,0.0006528049,0.112848185,0.10847674,0.030309144,0.73259604,0.0005170932],"about_ca_topic_score_codex":0.0016896463,"about_ca_topic_score_gemma":0.002750926,"teacher_disagreement_score":0.02363926,"about_ca_system_score_codex":0.0007668209,"about_ca_system_score_gemma":0.0019652029,"threshold_uncertainty_score":0.07908124},"labels":[],"label_agreement":null},{"id":"W1992804945","doi":"10.1109/icde.2014.6816719","title":"An efficient sampling method for characterizing points of interests on maps","year":2014,"lang":"en","type":"article","venue":"","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":15,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"McGill University","funders":"","keywords":"Popularity; Computer science; Point of interest; Estimator; Limit (mathematics); Data mining; Sampling (signal processing); Sample (material); Information retrieval; Data science; World Wide Web; Artificial intelligence; Mathematics; Statistics","score_opus":0.04394580274114445,"score_gpt":0.3422622210899989,"score_spread":0.2983164183488544,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W1992804945","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.009798023,0.00016079769,0.9885415,0.00006396219,0.000026591742,0.00010086962,0.00031295983,0.00049773196,0.00049754477],"genre_scores_gemma":[0.26021457,0.0003894898,0.7326993,0.000101434576,0.00021125987,0.00077094644,0.0031601477,0.00013812992,0.0023148651],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.998063,0.0005748902,0.00011883188,0.00036867085,0.0007276267,0.0001468397],"domain_scores_gemma":[0.9974004,0.0014285055,0.00016996147,0.0003760188,0.0005315206,0.000093658484],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0014264169,0.00082601246,0.0011414797,0.003034403,0.00074234477,0.0011286067,0.0018797241,0.0008043952,0.0015670895],"category_scores_gemma":[0.008176328,0.00046521216,0.0011184631,0.0042853686,0.0005334431,0.0015755699,0.0017047069,0.0010856475,0.0011452825],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0006032182,0.00036447681,0.015625311,0.00040028914,0.00023809091,0.00044078045,0.0007999662,0.19481231,0.018215045,0.0354303,0.012368096,0.72070205],"study_design_scores_gemma":[0.000042756204,0.00005739047,0.0017724937,0.000013568877,0.000026646092,0.00021035047,0.00011802551,0.9771513,0.0038789178,0.012555919,0.004143483,0.000029172994],"about_ca_topic_score_codex":0.005894482,"about_ca_topic_score_gemma":0.0069691134,"teacher_disagreement_score":0.005894482,"about_ca_system_score_codex":0.0005382482,"about_ca_system_score_gemma":0.0008484809,"threshold_uncertainty_score":0.011720359},"labels":[],"label_agreement":null},{"id":"W1993288800","doi":"10.1145/1379092.1379143","title":"Iclone","year":2008,"lang":"en","type":"article","venue":"","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":3,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Toronto","funders":"","keywords":"World Wide Web; Session (web analytics); Computer science; Web 2.0; Web navigation; Web browser; Social web; The Internet; Social media; Multimedia","score_opus":0.025131157460460254,"score_gpt":0.2101475260132977,"score_spread":0.18501636855283743,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W1993288800","genre_codex":"other","genre_gemma":"other","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"other","genre_consensus":"other","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.003509625,0.0037495082,0.020097008,0.0025193084,0.0023903854,0.00038780808,0.014224723,0.054714892,0.89840674],"genre_scores_gemma":[0.01375415,0.0017226974,0.013676971,0.0015162043,0.0005151961,0.00026821083,0.017545244,0.010853716,0.9401476],"study_design_codex":"not_applicable","study_design_gemma":"not_applicable","domain_scores_codex":[0.9989446,0.00009280423,0.00004268105,0.00027919508,0.0005044781,0.00013633158],"domain_scores_gemma":[0.997785,0.00030169048,0.00010540366,0.0005239483,0.0006261393,0.0006578808],"candidate_categories":["insufficient_payload"],"consensus_categories":[],"category_scores_codex":[0.00091896154,0.0015573477,0.00084492133,0.0023521003,0.0014199716,0.0050947065,0.0021572844,0.0020375417,0.48298895],"category_scores_gemma":[0.0032650197,0.000606401,0.0006526983,0.0023582648,0.0007298051,0.0053406465,0.0041864817,0.0017696645,0.32801908],"study_design_candidate":"not_applicable","study_design_consensus":"not_applicable","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00030190768,0.000060339218,0.0006578517,0.000361653,0.000014218284,0.00025131804,0.00024008028,0.00012683646,0.0027376576,0.009138127,0.8501377,0.13597235],"study_design_scores_gemma":[0.0000158093,0.000029098619,0.00040459,0.000050226867,0.0000054515726,0.00022903034,0.000041301584,0.00024483723,0.00062226504,0.00068814744,0.99765354,0.00001573911],"about_ca_topic_score_codex":0.003396969,"about_ca_topic_score_gemma":0.00943387,"teacher_disagreement_score":0.51701105,"about_ca_system_score_codex":0.0009688206,"about_ca_system_score_gemma":0.0012064696,"threshold_uncertainty_score":0},"labels":[],"label_agreement":null},{"id":"W1994305054","doi":"10.1145/2132176.2132233","title":"Automated dictionary discovery for the online marketplace","year":2012,"lang":"en","type":"article","venue":"Proceedings of the 2012 iConference","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Toronto","funders":"Natural Sciences and Engineering Research Council of Canada","keywords":"Product (mathematics); Computer science; World Wide Web; Window (computing); Business; Goods and services; Advertising; Internet privacy","score_opus":0.024538915236805025,"score_gpt":0.25893433500535845,"score_spread":0.23439541976855344,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W1994305054","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.12625058,0.007037546,0.7046177,0.005696907,0.00084711896,0.0019887686,0.051040404,0.08187203,0.020648923],"genre_scores_gemma":[0.20079471,0.001607302,0.75593483,0.0003899882,0.00019040878,0.0003979792,0.032243185,0.00071041775,0.007731129],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9982949,0.00034146674,0.00018161695,0.0003637764,0.0006874439,0.00013073832],"domain_scores_gemma":[0.9966994,0.001083317,0.0004207312,0.0007612963,0.0007719606,0.0002632891],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0011614121,0.0008367132,0.0010890155,0.012199269,0.001683009,0.0034342958,0.0017418873,0.0019931612,0.008848505],"category_scores_gemma":[0.008230694,0.000502804,0.0010486866,0.0070486274,0.0006161571,0.0055265543,0.0027723955,0.0012356279,0.00774701],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00037946855,0.0005815234,0.01166838,0.0006476016,0.00013874599,0.001079372,0.00033269724,0.0054381695,0.010355358,0.01495282,0.091464534,0.8629614],"study_design_scores_gemma":[0.00024836496,0.00036001118,0.010775942,0.0003170075,0.00014569439,0.0028061522,0.0016358092,0.7136178,0.020966107,0.07755555,0.17140819,0.0001633579],"about_ca_topic_score_codex":0.0068341494,"about_ca_topic_score_gemma":0.015137757,"teacher_disagreement_score":0.012199269,"about_ca_system_score_codex":0.0011908534,"about_ca_system_score_gemma":0.0026035048,"threshold_uncertainty_score":0.029601216},"labels":[],"label_agreement":null},{"id":"W1994604287","doi":"10.1145/1244002.1244186","title":"Log-based indexing to improve web site search","year":2007,"lang":"en","type":"article","venue":"","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":11,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Toronto Metropolitan University","funders":"","keywords":"Search engine indexing; Computer science; Information retrieval; Search engine; Index (typography); Web site; World Wide Web; Web server; Web search engine; Web log analysis software; Web page; Static web page; Web search query; Data mining; The Internet","score_opus":0.018301604330843928,"score_gpt":0.27956850929281996,"score_spread":0.261266904961976,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W1994604287","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.16974548,0.0077609704,0.7688375,0.0010972103,0.00044678696,0.0007247456,0.0045249504,0.032162774,0.014699505],"genre_scores_gemma":[0.57699656,0.001881575,0.40812144,0.00028506602,0.00060952245,0.00037725785,0.006849187,0.00054741185,0.0043319496],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.99800235,0.0005011237,0.00019409166,0.00018902628,0.0009990558,0.00011448372],"domain_scores_gemma":[0.98894686,0.0055197403,0.0009885072,0.0018084445,0.0024968304,0.00023968381],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0024097804,0.0007495754,0.0016729771,0.008055607,0.0005901668,0.0017593371,0.0012885648,0.0007361829,0.0033606677],"category_scores_gemma":[0.018515823,0.0003410862,0.00050910434,0.007668636,0.00038693516,0.0043941033,0.0011517692,0.0010171268,0.0027541968],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0006956822,0.0011921946,0.02481109,0.0005006039,0.00014144805,0.00020541236,0.00024920003,0.015572054,0.021447461,0.005697235,0.01910331,0.9103844],"study_design_scores_gemma":[0.0002708819,0.0009340142,0.026979659,0.00016026448,0.0003669554,0.0013326118,0.00030118876,0.86797744,0.048415035,0.02539316,0.027691927,0.00017683092],"about_ca_topic_score_codex":0.003744102,"about_ca_topic_score_gemma":0.006181385,"teacher_disagreement_score":0.008055607,"about_ca_system_score_codex":0.0005843658,"about_ca_system_score_gemma":0.001472367,"threshold_uncertainty_score":0.0127443075},"labels":[],"label_agreement":null},{"id":"W1995934506","doi":"10.1016/j.eswa.2008.05.011","title":"Information extraction from syllabi for academic e-Advising","year":2008,"lang":"en","type":"article","venue":"Expert Systems with Applications","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":21,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of New Brunswick","funders":"Natural Sciences and Engineering Research Council of Canada","keywords":"Computer science; Syllabus; Information extraction; Extraction (chemistry); Academic advising; Information retrieval; Mathematics education; Higher education; Psychology; Chromatography; Chemistry; Political science","score_opus":0.024377009563993756,"score_gpt":0.2810708853278222,"score_spread":0.25669387576382846,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W1995934506","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.34860775,0.008320469,0.26788294,0.0040445793,0.0016074898,0.0046124826,0.2683142,0.023902206,0.07270791],"genre_scores_gemma":[0.42791435,0.0025762455,0.3702288,0.00034519803,0.00055025425,0.0021864676,0.1795245,0.00057869306,0.01609543],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.998664,0.00028101326,0.0002351759,0.00022497663,0.00040032782,0.00019447482],"domain_scores_gemma":[0.993454,0.002838053,0.00048763666,0.0004128667,0.0022570165,0.00055044907],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.00095373346,0.001078469,0.00080053543,0.01569161,0.0011699727,0.0020420894,0.0010265914,0.0011191788,0.01463886],"category_scores_gemma":[0.0093316445,0.0004035244,0.0009586909,0.012045163,0.00024057887,0.0015583468,0.0012700557,0.0010894383,0.009758851],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00058989326,0.0006138042,0.026799362,0.0017333251,0.00007766278,0.00040848248,0.00043848125,0.0019555963,0.021673009,0.0029960796,0.07896143,0.86375284],"study_design_scores_gemma":[0.0003108093,0.0009361041,0.19694299,0.0018204972,0.0010121486,0.0013485389,0.00437001,0.16757357,0.14321977,0.01756831,0.4645271,0.00037011737],"about_ca_topic_score_codex":0.01818447,"about_ca_topic_score_gemma":0.024928655,"teacher_disagreement_score":0.01818447,"about_ca_system_score_codex":0.0014115322,"about_ca_system_score_gemma":0.004800928,"threshold_uncertainty_score":0.04897189},"labels":[],"label_agreement":null},{"id":"W2004193186","doi":"10.1145/584931.584940","title":"A framework for web table mining","year":2002,"lang":"en","type":"article","venue":"","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":37,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Simon Fraser University","funders":"","keywords":"Computer science; Table (database); Web page; Information retrieval; World Wide Web; Web mining; Table of contents; Information extraction; Process (computing); Data mining","score_opus":0.047218706857434414,"score_gpt":0.2677927006460024,"score_spread":0.220573993788568,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2004193186","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.00035300557,0.0003522526,0.99533737,0.0003607813,0.00004295688,0.00025049443,0.0006239568,0.0016376917,0.0010414469],"genre_scores_gemma":[0.006604623,0.00035822534,0.9901085,0.00012887512,0.00006463225,0.0003205226,0.0015143738,0.00014425705,0.00075600354],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.9912164,0.002539047,0.0011444675,0.0014296408,0.0033418841,0.00032856062],"domain_scores_gemma":[0.9902029,0.004705448,0.0007015966,0.0024368663,0.0015704315,0.0003826529],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.008295611,0.0018657419,0.0018931329,0.009678522,0.0024240008,0.008419906,0.0061322944,0.0025928877,0.005897294],"category_scores_gemma":[0.021354763,0.0016896309,0.0052618505,0.010018894,0.0034224424,0.009660353,0.0047745607,0.0039006802,0.0046984707],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.000089906214,0.00024883074,0.0026478092,0.0010425539,0.0002775374,0.000910937,0.001074759,0.03867513,0.002343336,0.59232014,0.03732972,0.32303938],"study_design_scores_gemma":[0.000047083824,0.000058127567,0.0006027419,0.0003705869,0.000076396456,0.0009875651,0.00033159895,0.2066089,0.0020913915,0.6479988,0.14074054,0.000086414606],"about_ca_topic_score_codex":0.0072014616,"about_ca_topic_score_gemma":0.008264365,"teacher_disagreement_score":0.009678522,"about_ca_system_score_codex":0.0018539038,"about_ca_system_score_gemma":0.003942176,"threshold_uncertainty_score":0.04387188},"labels":[],"label_agreement":null},{"id":"W2005116792","doi":"10.1145/1723028.1723062","title":"The smart internet","year":2009,"lang":"en","type":"article","venue":"","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":18,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Queen's University; University of Toronto; IBM (Canada)","funders":"","keywords":"World Wide Web; Computer science; Web service; Web modeling; Ajax; Web development; Web API; Web navigation; Web standards; Web page; Web server; Mashup; The Internet; Server; Data Web","score_opus":0.010714689683579396,"score_gpt":0.227250651916864,"score_spread":0.2165359622332846,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2005116792","genre_codex":"other","genre_gemma":"commentary","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"commentary","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.005867651,0.02454611,0.03639116,0.04924156,0.005699032,0.00011570277,0.0006864259,0.0014492042,0.87600315],"genre_scores_gemma":[0.22656542,0.071481846,0.06127608,0.049909182,0.009949815,0.00063748815,0.002271647,0.001001136,0.57690746],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"not_applicable","domain_scores_codex":[0.9988317,0.00028954647,0.000050279083,0.0002490347,0.00043005793,0.00014935665],"domain_scores_gemma":[0.99888116,0.00021599379,0.00007644106,0.0003634456,0.00018311376,0.00027977917],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0010525951,0.000535451,0.00035634282,0.0012514413,0.0018755025,0.0076494925,0.0008312247,0.0031861344,0.024140738],"category_scores_gemma":[0.002672256,0.00028051785,0.00031339226,0.0013318355,0.0036307836,0.012415579,0.0052171946,0.0032444363,0.009478489],"study_design_candidate":"not_applicable","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00001278563,0.000014554615,0.00022015213,0.00008501076,0.0000052143137,0.00009895553,0.00032690397,0.00015351355,0.00040410197,0.81464857,0.104426555,0.07960367],"study_design_scores_gemma":[0.000003114873,0.000009127895,0.00016828162,0.00011471672,0.0000027920744,0.0001762823,0.0001290164,0.00024195004,0.0001598055,0.099227384,0.8997595,0.000008041546],"about_ca_topic_score_codex":0.0010665446,"about_ca_topic_score_gemma":0.0012192699,"teacher_disagreement_score":0.024140738,"about_ca_system_score_codex":0.0016210868,"about_ca_system_score_gemma":0.0018543095,"threshold_uncertainty_score":0.08075881},"labels":[],"label_agreement":null},{"id":"W2005564459","doi":"10.1109/hsi.2008.4581436","title":"Natural search pointers &amp;#x2014; A query formulation method for structured information search","year":2008,"lang":"en","type":"article","venue":"","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Dalhousie University","funders":"Dalhousie University","keywords":"Computer science; Interface (matter); Search engine; Information retrieval; Extension (predicate logic); Key (lock); Iterative deepening depth-first search; Web search query; Search-oriented architecture; Search algorithm; Search analytics; Beam search; Incremental heuristic search; Programming language","score_opus":0.0395710133177763,"score_gpt":0.32597932375425215,"score_spread":0.28640831043647585,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2005564459","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0006626206,0.00006191985,0.9935208,0.00012180986,0.000028615685,0.00018088862,0.00025095127,0.0030018124,0.002170597],"genre_scores_gemma":[0.013473935,0.00014573494,0.9787748,0.00012220374,0.000024879128,0.0005082883,0.0006589641,0.0007014409,0.005589805],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.99658906,0.0013818649,0.00042021307,0.0003793638,0.0011390519,0.000090374786],"domain_scores_gemma":[0.9950675,0.0030692643,0.00018105499,0.0007269124,0.00079703185,0.00015826544],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0041614557,0.0012188804,0.0008329215,0.0025324358,0.0008460109,0.0026898778,0.0019225999,0.0015218019,0.02598101],"category_scores_gemma":[0.0138779525,0.0008218157,0.0014843569,0.0025171116,0.0019674394,0.0071183476,0.0030605276,0.0022912398,0.0067422427],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0004144893,0.00016352208,0.0005249233,0.001098633,0.00005688921,0.00027790322,0.0024735574,0.0057045785,0.014186926,0.379177,0.040342897,0.5555787],"study_design_scores_gemma":[0.00037365375,0.00049328647,0.0004483729,0.0004856853,0.0000859311,0.0014283302,0.00088978134,0.34479135,0.027185846,0.261626,0.36195484,0.0002370119],"about_ca_topic_score_codex":0.0022031069,"about_ca_topic_score_gemma":0.0030374986,"teacher_disagreement_score":0.02598101,"about_ca_system_score_codex":0.0009430764,"about_ca_system_score_gemma":0.001676501,"threshold_uncertainty_score":0.086915135},"labels":[],"label_agreement":null},{"id":"W2006536984","doi":"10.1145/1183614.1183737","title":"Constructing better document and query models with markov chains","year":2006,"lang":"en","type":"article","venue":"","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":6,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Université de Montréal","funders":"","keywords":"Computer science; Markov chain; Information retrieval; Query optimization; Theoretical computer science; Artificial intelligence; Machine learning","score_opus":0.006209587728475849,"score_gpt":0.18830460584534084,"score_spread":0.182095018116865,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2006536984","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.04348761,0.0004466368,0.952536,0.0003465103,0.000037113132,0.00014392535,0.00031639804,0.002016303,0.00066955545],"genre_scores_gemma":[0.38839057,0.0008350834,0.60171276,0.00052798307,0.0002831523,0.0005388111,0.0031223558,0.0005008819,0.004088428],"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9974734,0.0011495643,0.0001655599,0.0005589629,0.0004570462,0.00019538184],"domain_scores_gemma":[0.9890577,0.008525165,0.00044690163,0.0011347542,0.00062255847,0.00021291537],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.004014495,0.0011156093,0.001886356,0.0017323731,0.00065839087,0.0017585402,0.001672044,0.0022876118,0.002156088],"category_scores_gemma":[0.014434211,0.0010598828,0.0019653076,0.00231433,0.00076407567,0.0056099994,0.0014910835,0.0030449457,0.0011312901],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0012495109,0.0005779683,0.004608484,0.0002896603,0.0002843215,0.00031582854,0.0006440251,0.6845839,0.016881788,0.025988234,0.0065152133,0.25806105],"study_design_scores_gemma":[0.000035063855,0.000033560555,0.00013522079,0.000005337182,0.00001633109,0.000027367825,0.000014581745,0.9933373,0.0011053795,0.0047520776,0.0005241194,0.000013695212],"about_ca_topic_score_codex":0.012340098,"about_ca_topic_score_gemma":0.012537113,"teacher_disagreement_score":0.012340098,"about_ca_system_score_codex":0.0015036187,"about_ca_system_score_gemma":0.0022000922,"threshold_uncertainty_score":0.02453655},"labels":[],"label_agreement":null},{"id":"W2009759761","doi":"10.1016/j.ins.2012.07.022","title":"Effectiveness of template detection on noise reduction and websites summarization","year":2012,"lang":"en","type":"article","venue":"Information Sciences","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":27,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Calgary","funders":"","keywords":"Computer science; Automatic summarization; Web page; Information retrieval; The Internet; Noise (video); Preprocessor; Template; Data mining; World Wide Web; Artificial intelligence","score_opus":0.016001201890909898,"score_gpt":0.2569754104418357,"score_spread":0.2409742085509258,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2009759761","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.3062531,0.0040425155,0.6655293,0.00082698493,0.00072020147,0.00042386574,0.0020215681,0.013480508,0.0067018378],"genre_scores_gemma":[0.6311443,0.0012156193,0.35533026,0.00021908125,0.00037897733,0.00015984853,0.0053845025,0.0006846861,0.0054827384],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.995265,0.0012492213,0.00040262606,0.0010012668,0.0016981649,0.00038364803],"domain_scores_gemma":[0.9894729,0.0056414143,0.00067525165,0.001465453,0.002332633,0.0004122241],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0028864269,0.0013818055,0.0022071819,0.00449686,0.00089968514,0.0030747047,0.0013285378,0.001603899,0.0028300958],"category_scores_gemma":[0.018931547,0.00036392352,0.0016416814,0.0028401536,0.00044962243,0.0025011445,0.0009562287,0.00075872283,0.0029876542],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0015863064,0.0004589563,0.0067492547,0.00046206077,0.00019044545,0.00018339796,0.00017031531,0.014138899,0.051364392,0.0012422252,0.0064834473,0.9169704],"study_design_scores_gemma":[0.00013650801,0.00091416657,0.017824091,0.000058635098,0.0006510583,0.00078249944,0.00048104007,0.8211321,0.14684528,0.003926788,0.007148025,0.00009974917],"about_ca_topic_score_codex":0.0037480139,"about_ca_topic_score_gemma":0.0030815909,"teacher_disagreement_score":0.00449686,"about_ca_system_score_codex":0.0005175191,"about_ca_system_score_gemma":0.0021384382,"threshold_uncertainty_score":0.015265107},"labels":[],"label_agreement":null},{"id":"W2010463775","doi":"10.1145/860435.860449","title":"Query type classification for web document retrieval","year":2003,"lang":"en","type":"article","venue":"","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":251,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Kootenay Association for Science & Technology","funders":"","keywords":"Computer science; Information retrieval; Relevance (law); Task (project management); Web query classification; Query expansion; Relevance feedback; Scheme (mathematics); Web search query; Search engine; Artificial intelligence; Image retrieval","score_opus":0.03861046735755231,"score_gpt":0.28792178949113484,"score_spread":0.24931132213358254,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2010463775","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.072166204,0.0057246382,0.9058373,0.00081253215,0.0003165707,0.00100486,0.0022862975,0.008345926,0.003505606],"genre_scores_gemma":[0.32728013,0.0016802758,0.65958726,0.00032514756,0.0004972585,0.0009417003,0.0052504437,0.00039690355,0.004040933],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.99576676,0.001647126,0.00052851136,0.00047708195,0.0013244299,0.00025620745],"domain_scores_gemma":[0.99442106,0.0024373073,0.00035529048,0.0011313647,0.0014942589,0.00016070389],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.004512313,0.0007191086,0.0016727749,0.0062541314,0.0010300438,0.0016477666,0.0011920303,0.0011520584,0.0021584919],"category_scores_gemma":[0.014093683,0.0003203835,0.0011076281,0.0043726503,0.0005353484,0.0027267234,0.0007230038,0.00093815976,0.0022004126],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0008675567,0.00025372638,0.007848485,0.0005376589,0.00011740969,0.00020411085,0.0002256773,0.010609071,0.025736261,0.008920014,0.018846257,0.9258336],"study_design_scores_gemma":[0.00025402659,0.0006360821,0.014791151,0.00014237755,0.00033044568,0.0016680129,0.0004106216,0.8606097,0.04242958,0.04434629,0.03416542,0.00021631224],"about_ca_topic_score_codex":0.005153408,"about_ca_topic_score_gemma":0.00404668,"teacher_disagreement_score":0.0062541314,"about_ca_system_score_codex":0.0012336852,"about_ca_system_score_gemma":0.0013257614,"threshold_uncertainty_score":0.023863673},"labels":[],"label_agreement":null},{"id":"W2010733320","doi":"10.1145/2445196.2445443","title":"On the countably many misconceptions about #hashtables (abstract only)","year":2013,"lang":"en","type":"article","venue":"","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":4,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Toronto","funders":"","keywords":"Correctness; Computer science; Hash function; Set (abstract data type); Code (set theory); The Internet; Mathematics education; Programming language; World Wide Web; Psychology","score_opus":0.01899016982224659,"score_gpt":0.23673083037503595,"score_spread":0.21774066055278934,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2010733320","genre_codex":"empirical","genre_gemma":"other","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"other","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.8878761,0.0015388846,0.06540889,0.015021917,0.000982142,0.00016421179,0.0010576957,0.0023578932,0.025592325],"genre_scores_gemma":[0.9683413,0.0007167659,0.013774136,0.0029037616,0.00023537276,0.00008316854,0.00062025356,0.00043334052,0.012891807],"study_design_codex":"design_other","study_design_gemma":"not_applicable","domain_scores_codex":[0.99243987,0.0032430443,0.0004772168,0.000563627,0.003101046,0.00017515956],"domain_scores_gemma":[0.7504678,0.20455004,0.011307359,0.011122499,0.02066413,0.0018882009],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.009204611,0.00039052902,0.00019151071,0.0016015436,0.0010470868,0.001721772,0.00066324335,0.00096361345,0.010687322],"category_scores_gemma":[0.11511616,0.00020709018,0.0002693985,0.0010436643,0.0014896947,0.0029264535,0.0013043823,0.0018675375,0.0027540957],"study_design_candidate":"not_applicable","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0013733241,0.00080465013,0.13688691,0.0009156414,0.00011025511,0.0017769192,0.051285435,0.0024210182,0.027697008,0.014342544,0.06421438,0.6981719],"study_design_scores_gemma":[0.0001572159,0.0025974265,0.24895142,0.0033096713,0.0004658859,0.01103545,0.061221115,0.04106116,0.15486854,0.047614574,0.42799345,0.0007240727],"about_ca_topic_score_codex":0.0014667328,"about_ca_topic_score_gemma":0.0019932466,"teacher_disagreement_score":0.010687322,"about_ca_system_score_codex":0.0010853631,"about_ca_system_score_gemma":0.00076882355,"threshold_uncertainty_score":0.048679233},"labels":[],"label_agreement":null},{"id":"W2011364352","doi":"10.1145/1370256.1370278","title":"An enhanced web robot for the CINDI system","year":2008,"lang":"en","type":"article","venue":"","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":6,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Concordia University","funders":"Natural Sciences and Engineering Research Council of Canada; Concordia University","keywords":"Web crawler; Computer science; Digging; Software; Field (mathematics); Robot; Web application; World Wide Web; Artificial intelligence; Geography","score_opus":0.026203370480576946,"score_gpt":0.2520494850366246,"score_spread":0.22584611455604767,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2011364352","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.059859518,0.000950364,0.749035,0.00074453495,0.0009912417,0.0031776137,0.00274783,0.13865776,0.043836083],"genre_scores_gemma":[0.26483074,0.00042166488,0.6559625,0.0011309498,0.00013753188,0.0020256278,0.0043522073,0.0025762736,0.068562515],"study_design_codex":"design_other","study_design_gemma":"bench_or_experimental","domain_scores_codex":[0.9990171,0.00007560042,0.00006721002,0.00022367049,0.00051548524,0.00010101897],"domain_scores_gemma":[0.99879503,0.0002534074,0.00007575624,0.0002786713,0.0004455916,0.00015158684],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0006169733,0.0010826725,0.00079521636,0.00091199006,0.00050510716,0.0008929779,0.0025817316,0.00087941013,0.02066954],"category_scores_gemma":[0.0015901589,0.0006217966,0.00042040943,0.00051127834,0.00032043815,0.0012113521,0.001415415,0.0009357112,0.0056831664],"study_design_candidate":"bench_or_experimental","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.002293045,0.00082896964,0.006308818,0.0017737079,0.00013077236,0.0017305311,0.0005428211,0.010700057,0.33748358,0.0076833135,0.08859408,0.54193026],"study_design_scores_gemma":[0.00048022417,0.0018987515,0.015766766,0.00021322566,0.00024221734,0.004470423,0.00018685625,0.27105063,0.23147151,0.0015496463,0.47226563,0.0004040979],"about_ca_topic_score_codex":0.0033154243,"about_ca_topic_score_gemma":0.0030583674,"teacher_disagreement_score":0.02066954,"about_ca_system_score_codex":0.0006813403,"about_ca_system_score_gemma":0.0011734751,"threshold_uncertainty_score":0.069146514},"labels":[],"label_agreement":null},{"id":"W2011539648","doi":"10.1145/2109205.2109208","title":"Crawling Ajax-Based Web Applications through Dynamic Analysis of User Interface State Changes","year":2012,"lang":"en","type":"article","venue":"ACM Transactions on the Web","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":298,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of British Columbia","funders":"","keywords":"Ajax; Computer science; JavaScript; Dynamic web page; World Wide Web; Crawling; Web application; Web page; Interactivity; Web modeling; Web-based simulation; Mashup; User interface; Web crawler; Web API; Programming language","score_opus":0.026773311154707602,"score_gpt":0.28688668861354966,"score_spread":0.26011337745884205,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2011539648","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.312548,0.0004903547,0.6609089,0.00021172468,0.000029980301,0.0003834539,0.00040669844,0.022907263,0.0021136135],"genre_scores_gemma":[0.5519527,0.00031916503,0.44428763,0.00006480751,0.000024347402,0.00021179239,0.0013170005,0.00057549216,0.0012470739],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.99816954,0.00041073086,0.00014521409,0.00043529487,0.0007555289,0.000083778585],"domain_scores_gemma":[0.993494,0.0032038076,0.0009461509,0.0012191506,0.00097131234,0.00016567178],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.001402716,0.00088420144,0.0006297424,0.003148579,0.00089470047,0.0018725466,0.0009280408,0.00066019164,0.00041943594],"category_scores_gemma":[0.00974799,0.00057279627,0.00051236217,0.00160819,0.000730879,0.0022148706,0.0012779331,0.0009653281,0.00033764995],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00052675395,0.00093960296,0.07817148,0.00065656635,0.0002815205,0.000823028,0.0026653,0.05564681,0.14203855,0.0092743365,0.003711622,0.70526445],"study_design_scores_gemma":[0.000044192362,0.00023054621,0.028488137,0.00005501628,0.0001194101,0.0007762473,0.00036014552,0.86878604,0.083209835,0.010187713,0.007661154,0.000081630285],"about_ca_topic_score_codex":0.003250972,"about_ca_topic_score_gemma":0.006082758,"teacher_disagreement_score":0.003250972,"about_ca_system_score_codex":0.00051512255,"about_ca_system_score_gemma":0.001119463,"threshold_uncertainty_score":0.007418394},"labels":[],"label_agreement":null},{"id":"W2013314064","doi":"10.1108/02640471011052016","title":"Interoperability models in digital libraries: an overview","year":2010,"lang":"en","type":"article","venue":"The Electronic Library","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":23,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Alberta","funders":"","keywords":"Interoperability; Digital library; Metadata; Computer science; World Wide Web; Cross-domain interoperability; Field (mathematics); Semantic interoperability; Originality; Value (mathematics); Software engineering; Data science","score_opus":0.022690414636996465,"score_gpt":0.23778644670055277,"score_spread":0.2150960320635563,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2013314064","genre_codex":"methods","genre_gemma":"review","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"review","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.028148422,0.16972673,0.5882067,0.026126286,0.00071711617,0.00056770234,0.0006126933,0.001254505,0.18463975],"genre_scores_gemma":[0.5088987,0.1824372,0.2871821,0.003549217,0.0014948049,0.0014169093,0.0013144559,0.00042049307,0.013286198],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"not_applicable","domain_scores_codex":[0.99110013,0.0037491666,0.0013203946,0.00071573275,0.0027059026,0.00040860637],"domain_scores_gemma":[0.99138016,0.00583565,0.00074998144,0.00089803286,0.0008796342,0.00025658048],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0074084396,0.0010054935,0.0011424272,0.014429043,0.002262371,0.013633674,0.0028587433,0.0035932458,0.0043872246],"category_scores_gemma":[0.00891146,0.00073870376,0.0021152503,0.01696254,0.0057027834,0.027251197,0.0046960446,0.0033262607,0.0013138502],"study_design_candidate":"not_applicable","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.000022190641,0.000106557236,0.0011803993,0.001024643,0.00004305761,0.00018783813,0.0014948773,0.0029085006,0.00019387543,0.9208105,0.0029318673,0.06909562],"study_design_scores_gemma":[0.000016207741,0.00008670544,0.0015931361,0.0027242377,0.00009959988,0.00096503884,0.0040519354,0.021984437,0.000999599,0.7421221,0.22526105,0.00009594351],"about_ca_topic_score_codex":0.0037440346,"about_ca_topic_score_gemma":0.0017188764,"teacher_disagreement_score":0.014429043,"about_ca_system_score_codex":0.006704702,"about_ca_system_score_gemma":0.00398981,"threshold_uncertainty_score":0.04864627},"labels":[],"label_agreement":null},{"id":"W2025445363","doi":"10.7202/014331ar","title":"Linguistique et reconnaissance automatique des noms propres","year":2006,"lang":"fr","type":"article","venue":"Meta Journal des traducteurs","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":6,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":true,"route_about_ca":false,"ca_institutions":"","funders":"","keywords":"Humanities; Political science; Philosophy; Art","score_opus":0.05956899917549953,"score_gpt":0.30532956619393664,"score_spread":0.24576056701843713,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2025445363","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.10879421,0.0027769418,0.8619606,0.0012145074,0.00039486162,0.0003074964,0.0014347571,0.010556665,0.012560021],"genre_scores_gemma":[0.26457274,0.0019025959,0.71633536,0.00024623203,0.00021284533,0.00024776315,0.0028993073,0.001173136,0.012410021],"study_design_codex":"design_other","study_design_gemma":"bench_or_experimental","domain_scores_codex":[0.9951468,0.0013316857,0.00048790098,0.00096981385,0.0018751682,0.00018854027],"domain_scores_gemma":[0.9829133,0.009676658,0.0012467722,0.0017322781,0.004264328,0.00016664738],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0043025184,0.0010723124,0.0012944734,0.0048707537,0.0018263828,0.005207263,0.0013077336,0.0014901125,0.0041094706],"category_scores_gemma":[0.027189475,0.0006717354,0.0011195808,0.0030213315,0.0012071817,0.004906616,0.0013195549,0.0018161122,0.004600713],"study_design_candidate":"bench_or_experimental","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00034441988,0.00010372266,0.016800167,0.0011124888,0.00015600164,0.00063757744,0.00581233,0.009132971,0.046781868,0.012474217,0.008887973,0.8977563],"study_design_scores_gemma":[0.00010232909,0.0004092959,0.04141227,0.0009896104,0.0005937782,0.005687054,0.009501774,0.28240073,0.25251162,0.038227938,0.36769617,0.0004674852],"about_ca_topic_score_codex":0.009222911,"about_ca_topic_score_gemma":0.010833824,"teacher_disagreement_score":0.009222911,"about_ca_system_score_codex":0.0009365238,"about_ca_system_score_gemma":0.0019583893,"threshold_uncertainty_score":0.022754133},"labels":[],"label_agreement":null},{"id":"W2025470942","doi":"10.1016/j.asoc.2015.02.029","title":"Automated classification and localization of daily deal content from the Web","year":2015,"lang":"en","type":"article","venue":"Applied Soft Computing","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":8,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Toronto Metropolitan University","funders":"","keywords":"Computer science; News aggregator; Discriminative model; Web page; Set (abstract data type); Information retrieval; Web content; Machine learning; World Wide Web; Artificial intelligence","score_opus":0.061166581469034156,"score_gpt":0.2576346301896803,"score_spread":0.19646804872064616,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2025470942","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.9335356,0.0014483534,0.042867433,0.0004070467,0.0000942961,0.00015779265,0.010793752,0.0044589923,0.0062368014],"genre_scores_gemma":[0.9435714,0.0005969545,0.033689603,0.000055145098,0.0001598421,0.00008223611,0.0155036,0.0001900762,0.006151206],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9996507,0.00004371725,0.000025332072,0.00008549257,0.00013675856,0.000057893252],"domain_scores_gemma":[0.9986216,0.00042522617,0.0002567289,0.00016506208,0.00041381957,0.0001175181],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.00027572538,0.0003754327,0.00043531816,0.009697383,0.00039142373,0.0014292349,0.00046152336,0.0007533948,0.0021127206],"category_scores_gemma":[0.0018062623,0.00019161648,0.0003725878,0.004538731,0.00022177557,0.0012369868,0.00067298365,0.0004733974,0.002743289],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0009440174,0.00079065235,0.24764436,0.00050468446,0.00015885539,0.0009593197,0.00071373046,0.008855276,0.055777717,0.0022784637,0.029818797,0.6515541],"study_design_scores_gemma":[0.000035730303,0.00016240768,0.3663776,0.00008507472,0.00013109509,0.0010866938,0.0013441354,0.57745785,0.029848747,0.0048429435,0.018565623,0.00006204666],"about_ca_topic_score_codex":0.0046778712,"about_ca_topic_score_gemma":0.0076168044,"teacher_disagreement_score":0.009697383,"about_ca_system_score_codex":0.00034577036,"about_ca_system_score_gemma":0.00048904883,"threshold_uncertainty_score":0.009301245},"labels":[],"label_agreement":null},{"id":"W2025685302","doi":"10.1109/icsmc.2012.6377673","title":"Optimized audit evidence gathering method based on data matching using length-filtering","year":2012,"lang":"en","type":"article","venue":"","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":1,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Toronto","funders":"","keywords":"Audit; Matching (statistics); Data collection; Computer science; Information technology audit; Process (computing); Audit plan; Audit evidence; Internal audit; Accounting; Business; Joint audit; Statistics; Mathematics","score_opus":0.20639941042802074,"score_gpt":0.3837406504335228,"score_spread":0.17734124000550205,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2025685302","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.017612116,0.00017569998,0.979955,0.00011054291,0.000039028044,0.0003446294,0.00027281157,0.0009845385,0.0005057038],"genre_scores_gemma":[0.087385975,0.00016947593,0.90989816,0.000059747443,0.00004819646,0.00038473294,0.0008367888,0.00007374962,0.001143125],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9920007,0.0016249734,0.0013040558,0.0014448568,0.003304022,0.0003213999],"domain_scores_gemma":[0.99028146,0.003082526,0.0011407165,0.001579574,0.0036617601,0.00025387827],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.004593613,0.0007777365,0.0015650823,0.0054743034,0.001193692,0.0016574402,0.0017372635,0.0010417005,0.0022177515],"category_scores_gemma":[0.015117759,0.0005030816,0.0015912668,0.0041299574,0.00048738997,0.0025530304,0.0016942638,0.0009232189,0.00076628296],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0005875544,0.00044727864,0.009327588,0.0003973333,0.00020570018,0.00017476955,0.00032285738,0.021260453,0.033932813,0.0055776075,0.0033412215,0.9244248],"study_design_scores_gemma":[0.0003052964,0.00079108524,0.015690023,0.00011230584,0.00047795413,0.001229358,0.0004486751,0.8211122,0.12218329,0.018107941,0.01928497,0.00025687335],"about_ca_topic_score_codex":0.003667289,"about_ca_topic_score_gemma":0.003263653,"teacher_disagreement_score":0.0054743034,"about_ca_system_score_codex":0.0009412496,"about_ca_system_score_gemma":0.003106293,"threshold_uncertainty_score":0.024293602},"labels":[],"label_agreement":null},{"id":"W2027919936","doi":"10.1002/1097-4571(2000)9999:9999<::aid-asi1055>3.3.co;2-p","title":"The role of user profiles for news filtering","year":2001,"lang":"en","type":"article","venue":"Journal of the American Society for Information Science and Technology","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":14,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Dalhousie University","funders":"","keywords":"Newspaper; Filter (signal processing); Computer science; Preference; User profile; Subject (documents); Task (project management); Information retrieval; World Wide Web; Advertising; Mathematics; Engineering","score_opus":0.009267190326634119,"score_gpt":0.2582203156164686,"score_spread":0.24895312528983446,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2027919936","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.77588946,0.0015243005,0.19516708,0.0015966223,0.00012981586,0.0008164807,0.0004582648,0.0015830155,0.02283489],"genre_scores_gemma":[0.9800411,0.00016276875,0.018455107,0.00007914414,0.000037472175,0.000069819085,0.00012596749,0.00006164175,0.00096693553],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9822134,0.012784931,0.00072902703,0.0010899033,0.0026094778,0.0005733107],"domain_scores_gemma":[0.88916606,0.085144155,0.0055065067,0.009908064,0.0077806897,0.0024945159],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.016222388,0.0010327401,0.001027808,0.0020978376,0.0016432522,0.0052192565,0.0008309338,0.0013939443,0.0023203306],"category_scores_gemma":[0.0827757,0.0006499187,0.0006415344,0.0015661288,0.0008751658,0.007584107,0.0014452271,0.0012624749,0.0009801058],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.005758265,0.0014863072,0.34901562,0.00083721033,0.0005851117,0.00042499555,0.010681579,0.014338459,0.013676412,0.020851895,0.0045268703,0.5778174],"study_design_scores_gemma":[0.0006268517,0.004466259,0.40723088,0.0005857378,0.001564296,0.0024184568,0.009682821,0.44488767,0.026710695,0.064986825,0.035935134,0.0009043208],"about_ca_topic_score_codex":0.0035469364,"about_ca_topic_score_gemma":0.00309255,"teacher_disagreement_score":0.016222388,"about_ca_system_score_codex":0.0007890854,"about_ca_system_score_gemma":0.0010149074,"threshold_uncertainty_score":0.0857932},"labels":[],"label_agreement":null},{"id":"W2028903960","doi":"10.1109/wi-iat.2010.267","title":"An Efficient Method for Tagging a Query with Category Labels Using Wikipedia towards Enhancing Search Engine Results","year":2010,"lang":"en","type":"article","venue":"","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":6,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Waterloo","funders":"","keywords":"Computer science; Web query classification; Information retrieval; Web search query; Search engine; Query expansion; Set (abstract data type); Sargable; Matching (statistics); Noise (video); Query optimization; Data mining; Artificial intelligence; Mathematics","score_opus":0.02616368340438582,"score_gpt":0.32828418994121794,"score_spread":0.30212050653683215,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2028903960","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.015972737,0.00025118206,0.97827166,0.00014786229,0.000050056457,0.00017771569,0.0003853343,0.0033511934,0.0013923183],"genre_scores_gemma":[0.09663831,0.00014279415,0.89967996,0.00008120832,0.00004707747,0.00025357894,0.0008306918,0.00031350338,0.0020128824],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.99750745,0.0006517682,0.00018248426,0.0004819315,0.0010278528,0.00014845404],"domain_scores_gemma":[0.9949822,0.0016334931,0.00035868422,0.0009667172,0.0019089776,0.00015004221],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0019084376,0.00080290914,0.00078266195,0.004345162,0.00095302856,0.0014642989,0.001145551,0.0009530944,0.0013865947],"category_scores_gemma":[0.009256173,0.00047915085,0.00062222127,0.00287033,0.00084815914,0.0025552157,0.0018166051,0.0009041792,0.0017101273],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00045209425,0.00031854643,0.005604773,0.0004670544,0.00010855059,0.00022915425,0.0008993009,0.0122365635,0.09383305,0.018437821,0.011400364,0.8560127],"study_design_scores_gemma":[0.00013918937,0.0004126232,0.0069417534,0.00013233813,0.00024364256,0.0015720122,0.00074253476,0.72537184,0.16776948,0.04451666,0.05173222,0.00042571354],"about_ca_topic_score_codex":0.0045253914,"about_ca_topic_score_gemma":0.007200466,"teacher_disagreement_score":0.0045253914,"about_ca_system_score_codex":0.00072078995,"about_ca_system_score_gemma":0.0016315823,"threshold_uncertainty_score":0.010092914},"labels":[],"label_agreement":null},{"id":"W2029219570","doi":"10.1145/2644866.2644868","title":"An ensemble approach for text document clustering using Wikipedia concepts","year":2014,"lang":"en","type":"article","venue":"","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":18,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Dalhousie University","funders":"Natural Sciences and Engineering Research Council of Canada; Universidade Federal de Minas Gerais","keywords":"Document clustering; Computer science; Cluster analysis; Term (time); Information retrieval; Representation (politics); tf–idf; Text corpus; Artificial intelligence; Feature (linguistics); Natural language processing; Document retrieval","score_opus":0.031555558603974125,"score_gpt":0.3061687329010991,"score_spread":0.27461317429712495,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2029219570","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.021680117,0.00062602037,0.97461873,0.000107266336,0.000093398274,0.00012576589,0.00026488156,0.0013726399,0.0011111796],"genre_scores_gemma":[0.14714587,0.0005495882,0.84738505,0.00008486611,0.00011581804,0.0002987227,0.0017530106,0.00022639401,0.0024406547],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9986362,0.00026377907,0.000097227974,0.00038386713,0.0005369549,0.000081991915],"domain_scores_gemma":[0.9981053,0.00046781916,0.00010710085,0.00028927575,0.0009385781,0.00009201203],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.001366455,0.0009733977,0.0013741251,0.0042588515,0.0012697527,0.001264602,0.0014311553,0.00083991163,0.0008342603],"category_scores_gemma":[0.004492652,0.00041817335,0.0012655514,0.004411822,0.00035600952,0.0029103195,0.001405986,0.0010281991,0.0006209695],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00019660266,0.00024162393,0.0044595366,0.00021635287,0.0003947328,0.00023553966,0.0007530415,0.09307894,0.016149115,0.009088778,0.008453849,0.86673194],"study_design_scores_gemma":[0.000022151555,0.00008851442,0.0017558897,0.000031217194,0.0001454138,0.00028758674,0.00023766907,0.95994776,0.009863091,0.016462388,0.01109447,0.00006382505],"about_ca_topic_score_codex":0.0064837956,"about_ca_topic_score_gemma":0.01006279,"teacher_disagreement_score":0.0064837956,"about_ca_system_score_codex":0.0006130686,"about_ca_system_score_gemma":0.00088491954,"threshold_uncertainty_score":0.012892127},"labels":[],"label_agreement":null},{"id":"W2029246745","doi":"10.1002/meet.2008.1450450271","title":"Approximate phrase searching: Movie scripts and song lyrics","year":2008,"lang":"en","type":"article","venue":"Proceedings of the American Society for Information Science and Technology","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Dalhousie University","funders":"","keywords":"Phrase; Phrase search; Computer science; Scripting language; Complement (music); Information retrieval; Task (project management); Lyrics; Search engine; Full text search; Natural language processing; Artificial intelligence; Web search query; Search analytics","score_opus":0.017210966916795717,"score_gpt":0.24946928758755085,"score_spread":0.23225832067075514,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2029246745","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.93122137,0.0038304594,0.049930558,0.00026931544,0.000059803006,0.00022618503,0.0015615097,0.0021609098,0.010739798],"genre_scores_gemma":[0.9256158,0.0007292872,0.06925873,0.00006086996,0.000063210115,0.00003436402,0.0020770535,0.00007500397,0.002085708],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9990355,0.0003385325,0.000089884925,0.00012811544,0.0003422634,0.00006567749],"domain_scores_gemma":[0.9973641,0.0017442118,0.00022671113,0.00025337562,0.00029561823,0.0001160369],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0006885185,0.0004041236,0.0010078067,0.0029683246,0.00041816736,0.0010567588,0.00055547757,0.0005571776,0.0038789748],"category_scores_gemma":[0.006682721,0.00013946788,0.00033376145,0.0039519914,0.00029343436,0.0022702538,0.00077472144,0.0002625583,0.001178832],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.005301839,0.0007605786,0.04013233,0.002209443,0.0002738082,0.0013894098,0.0015539653,0.018673664,0.07036575,0.008164325,0.0135227265,0.8376522],"study_design_scores_gemma":[0.00046931588,0.0034727093,0.1059256,0.00023969373,0.00044345882,0.00805997,0.0029536346,0.741184,0.087665595,0.013400387,0.035957567,0.00022803023],"about_ca_topic_score_codex":0.0049176593,"about_ca_topic_score_gemma":0.0045993505,"teacher_disagreement_score":0.0049176593,"about_ca_system_score_codex":0.00022743466,"about_ca_system_score_gemma":0.00031857943,"threshold_uncertainty_score":0.012976468},"labels":[],"label_agreement":null},{"id":"W2034113406","doi":"10.1145/1835449.1835663","title":"User comments for news recommendation in social media","year":2010,"lang":"en","type":"article","venue":"","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":16,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Memorial University of Newfoundland","funders":"","keywords":"Computer science; Social media; World Wide Web; Moderation; Reading (process); Online discussion; Information retrieval","score_opus":0.03634548955345622,"score_gpt":0.3027201027762963,"score_spread":0.26637461322284006,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2034113406","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.1548156,0.0034180253,0.80878866,0.0048245643,0.00067927915,0.0015215437,0.0032771823,0.0045708995,0.018104268],"genre_scores_gemma":[0.5751919,0.00100282,0.4097495,0.00025974555,0.00051771017,0.0005809968,0.0026401896,0.0002349297,0.009822169],"study_design_codex":"design_other","study_design_gemma":"observational","domain_scores_codex":[0.99547184,0.002351761,0.00023231786,0.00045802176,0.0012924199,0.00019363145],"domain_scores_gemma":[0.98634756,0.006534001,0.0009374943,0.0012986694,0.0043837996,0.0004984227],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.005939549,0.0010215134,0.0010461684,0.0036689376,0.0019490431,0.0025021846,0.0013762625,0.0015547089,0.0052820253],"category_scores_gemma":[0.026319912,0.00052246876,0.0011007724,0.0028681853,0.00086474133,0.0031110456,0.0010608642,0.0010929664,0.0025717693],"study_design_candidate":"observational","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0017754658,0.0011065978,0.02591864,0.001142434,0.00030932104,0.0004455905,0.0020754545,0.03563606,0.012307809,0.0407228,0.04117844,0.8373813],"study_design_scores_gemma":[0.00025866422,0.0005818501,0.013030148,0.00036641405,0.00036763438,0.00026808778,0.0017163698,0.8766507,0.015701285,0.036887288,0.053926565,0.00024499552],"about_ca_topic_score_codex":0.017108034,"about_ca_topic_score_gemma":0.037902866,"teacher_disagreement_score":0.017108034,"about_ca_system_score_codex":0.0012675015,"about_ca_system_score_gemma":0.0018493949,"threshold_uncertainty_score":0.034016907},"labels":[],"label_agreement":null},{"id":"W2034148711","doi":"10.1109/ijcnn.2013.6707027","title":"Online news topic detection and tracking via localized feature selection","year":2013,"lang":"en","type":"article","venue":"","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":14,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Concordia University","funders":"","keywords":"Computer science; Feature selection; Cluster analysis; Flexibility (engineering); Context (archaeology); The Internet; Social media; Feature (linguistics); Selection (genetic algorithm); Representation (politics); Data science; Topic model; Feature extraction; Tracking (education); Word (group theory); Artificial intelligence; Quality (philosophy); Data mining; Machine learning; World Wide Web","score_opus":0.011240153952315472,"score_gpt":0.23082213496264728,"score_spread":0.2195819810103318,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2034148711","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.05932991,0.00046776223,0.9371158,0.0001519701,0.00003989953,0.000068782465,0.0003038433,0.0019221159,0.00059989386],"genre_scores_gemma":[0.6277008,0.00045748212,0.36624435,0.00012736708,0.00033888067,0.00022173209,0.0023897376,0.00014018237,0.002379479],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9988944,0.00031409142,0.000062993815,0.00034171253,0.00027051853,0.000116303316],"domain_scores_gemma":[0.9973443,0.0015135865,0.0002929538,0.00032035675,0.00042379223,0.00010503437],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0016079411,0.0008634741,0.0014355097,0.0026662254,0.0004974391,0.0010929081,0.0013366553,0.0008287877,0.00085926487],"category_scores_gemma":[0.004650062,0.00047854168,0.00093524146,0.0024238937,0.0003932716,0.0016163222,0.001164169,0.00080540375,0.0011517649],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00076209765,0.0005215102,0.011408186,0.00015840282,0.00023952374,0.00036084768,0.0003245835,0.08583144,0.036106348,0.0032122433,0.007344782,0.85373],"study_design_scores_gemma":[0.000041070056,0.00009641727,0.0032890565,0.0000060168795,0.000052486386,0.00014260058,0.00005644032,0.98394644,0.00796041,0.0031777003,0.0012097276,0.00002167801],"about_ca_topic_score_codex":0.0030419696,"about_ca_topic_score_gemma":0.0038169175,"teacher_disagreement_score":0.0030419696,"about_ca_system_score_codex":0.0003304607,"about_ca_system_score_gemma":0.0005454357,"threshold_uncertainty_score":0.008503675},"labels":[],"label_agreement":null},{"id":"W2034607275","doi":"10.1145/1046456.1046459","title":"Learning important models for web page blocks based on layout and content analysis","year":2004,"lang":"en","type":"article","venue":"ACM SIGKDD Explorations Newsletter","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":40,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Toronto","funders":"","keywords":"Computer science; Web page; Block (permutation group theory); Information retrieval; Partition (number theory); Page view; Static web page; Data mining; World Wide Web; Web navigation","score_opus":0.07156513468895788,"score_gpt":0.263723749372729,"score_spread":0.19215861468377116,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2034607275","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.14887087,0.0007031263,0.8453839,0.00039213494,0.000062891806,0.0002692192,0.00056047045,0.0026848374,0.001072639],"genre_scores_gemma":[0.7508843,0.00048557977,0.24209806,0.00017084298,0.00015111576,0.0004258105,0.0022813198,0.0002894324,0.0032135905],"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9991167,0.00024342508,0.000068788024,0.0002612631,0.00020048211,0.000109278975],"domain_scores_gemma":[0.9950523,0.0032721024,0.0004518704,0.00038024716,0.0006836073,0.00015994116],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.00182862,0.0011691232,0.0013060028,0.0045896354,0.00045901287,0.0014242451,0.001739314,0.0017638055,0.0014744546],"category_scores_gemma":[0.00860346,0.0008015702,0.0018850367,0.0016802186,0.0008838507,0.0031087585,0.00073388894,0.0020003573,0.00093794486],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0010161531,0.00084581244,0.027305206,0.00031486584,0.00027841216,0.00034441962,0.0004048986,0.621131,0.012515796,0.010281082,0.0058882185,0.31967425],"study_design_scores_gemma":[0.00000810925,0.000022406104,0.00080966094,0.0000062870913,0.000014915551,0.0000302837,0.000010083996,0.9954496,0.0007566248,0.0027009079,0.00018595137,0.0000051776456],"about_ca_topic_score_codex":0.0067615258,"about_ca_topic_score_gemma":0.011957768,"teacher_disagreement_score":0.0067615258,"about_ca_system_score_codex":0.0015955915,"about_ca_system_score_gemma":0.00075548736,"threshold_uncertainty_score":0.0134443045},"labels":[],"label_agreement":null},{"id":"W2036101886","doi":"10.5430/air.v2n1p44","title":"Exploiting web scraping in a collaborative filtering- based approach to web advertising","year":2012,"lang":"en","type":"article","venue":"Artificial Intelligence Research","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":132,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":true,"route_about_ca":false,"ca_institutions":"","funders":"","keywords":"Computer science; World Wide Web; Web page; Scraper site; Copying; Web mining; Web development; Static web page; Web modeling; Web analytics; Web navigation; Information retrieval; Data Web; Web intelligence","score_opus":0.21157754419777228,"score_gpt":0.41026095760821296,"score_spread":0.19868341341044068,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2036101886","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.04540999,0.00057959795,0.9452137,0.00037398073,0.00007204533,0.00028721584,0.00006570897,0.0024817956,0.005516069],"genre_scores_gemma":[0.40494895,0.0003696035,0.58825547,0.0002444978,0.00013369012,0.00011746726,0.00018211287,0.00013771598,0.0056105712],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.99632263,0.0011876632,0.00030603228,0.0007165942,0.001249246,0.00021781157],"domain_scores_gemma":[0.99279106,0.003688662,0.0005472398,0.0013908339,0.001341695,0.00024048933],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.004107118,0.0008189813,0.0014035874,0.0038703613,0.0018617697,0.0030210672,0.0016782489,0.00203931,0.0012285081],"category_scores_gemma":[0.008080201,0.00065622426,0.0014484484,0.0034107459,0.0010145884,0.0021562334,0.0011658558,0.0011303761,0.0007827381],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0007397262,0.0014462239,0.010368706,0.00044163887,0.00059575436,0.001224169,0.0024287126,0.11580248,0.056230113,0.025303787,0.005564742,0.77985394],"study_design_scores_gemma":[0.00006089207,0.00029130912,0.0041415417,0.000040742292,0.0002518052,0.0010963304,0.00025954752,0.9397591,0.02396388,0.015374719,0.014598742,0.00016148303],"about_ca_topic_score_codex":0.011051816,"about_ca_topic_score_gemma":0.013039537,"teacher_disagreement_score":0.011051816,"about_ca_system_score_codex":0.00091966277,"about_ca_system_score_gemma":0.0010664922,"threshold_uncertainty_score":0.021974921},"labels":[],"label_agreement":null},{"id":"W2036362156","doi":"10.1145/2611040.2611060","title":"Term Impact-Based Web Page Ranking","year":2014,"lang":"en","type":"article","venue":"","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":3,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Ottawa","funders":"","keywords":"Computer science; Information retrieval; Search engine indexing; Ranking (information retrieval); Web page; Task (project management); Set (abstract data type); Search engine; Index (typography); World Wide Web; Term (time); Variety (cybernetics); Artificial intelligence","score_opus":0.011330150113227078,"score_gpt":0.25016033233427104,"score_spread":0.23883018222104396,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2036362156","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.2735596,0.018563889,0.6477426,0.00072224904,0.0009448401,0.0015382667,0.010783532,0.014314848,0.031830143],"genre_scores_gemma":[0.7693672,0.0021081092,0.2075726,0.00012782573,0.00083808973,0.0003894932,0.011870792,0.00047931334,0.0072465874],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.993519,0.0011425538,0.00039861494,0.00045443574,0.004130255,0.00035513545],"domain_scores_gemma":[0.99019074,0.004226171,0.00086438796,0.00096577895,0.0034211327,0.00033169522],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.002757086,0.0012582655,0.0020290434,0.01828404,0.0008761132,0.0021628353,0.0012755139,0.0009682724,0.002943669],"category_scores_gemma":[0.014429647,0.00023115907,0.0009292959,0.0117771495,0.00058014755,0.0028315051,0.0010393284,0.0007969121,0.0023840987],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0009877294,0.00086348696,0.033007987,0.0011563649,0.00052190415,0.00022774062,0.00016889758,0.04279153,0.027567811,0.009743831,0.028951362,0.8540113],"study_design_scores_gemma":[0.0003168545,0.0019793315,0.08227538,0.00012869135,0.0006368956,0.0018336516,0.00026718617,0.7944969,0.04824258,0.039639484,0.029706733,0.00047636195],"about_ca_topic_score_codex":0.003468071,"about_ca_topic_score_gemma":0.0068828487,"teacher_disagreement_score":0.01828404,"about_ca_system_score_codex":0.00089660264,"about_ca_system_score_gemma":0.0009812901,"threshold_uncertainty_score":0.014581025},"labels":[],"label_agreement":null},{"id":"W2037276439","doi":"10.1109/soca.2012.6449448","title":"Extracting RESTful services from Web applications","year":2012,"lang":"en","type":"article","venue":"","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":11,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Queen's University","funders":"","keywords":"Computer science; Web service; World Wide Web; Reuse; Web modeling; Web development; Web standards; Task (project management); Web API; Component (thermodynamics); Data Web; Web navigation; Web engineering; Web design; Mashup; Web application security; Engineering","score_opus":0.015305448065168214,"score_gpt":0.25534358609379565,"score_spread":0.24003813802862745,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2037276439","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.18812339,0.001376898,0.7667946,0.0007572682,0.00015792424,0.00088365853,0.0096521545,0.026569383,0.0056846817],"genre_scores_gemma":[0.4835378,0.0012934718,0.47095072,0.00021862357,0.000116213225,0.00045453585,0.036082685,0.0017725946,0.0055733114],"study_design_codex":"design_other","study_design_gemma":"not_applicable","domain_scores_codex":[0.9991685,0.00009294763,0.000106508705,0.00011220182,0.0003759242,0.00014391055],"domain_scores_gemma":[0.9986689,0.00032863684,0.00011326613,0.0003874322,0.00040381087,0.00009795283],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0004151634,0.0016103596,0.000739129,0.0043123,0.0007614524,0.001689048,0.0011781461,0.0010388616,0.0010581657],"category_scores_gemma":[0.004035612,0.00057651807,0.0022234272,0.0027096868,0.00044128153,0.0014187706,0.0011757554,0.0009868884,0.0015034763],"study_design_candidate":"not_applicable","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00079889916,0.0005894579,0.034361962,0.0015352304,0.00023944562,0.0053412616,0.0013548078,0.040474348,0.114801235,0.019536372,0.02177201,0.75919497],"study_design_scores_gemma":[0.000072144474,0.00017800587,0.026339289,0.00023808212,0.00025223437,0.0018216443,0.00092748454,0.7348187,0.12287728,0.05048637,0.061866853,0.000121891186],"about_ca_topic_score_codex":0.010939783,"about_ca_topic_score_gemma":0.014386528,"teacher_disagreement_score":0.010939783,"about_ca_system_score_codex":0.00066981756,"about_ca_system_score_gemma":0.0016908298,"threshold_uncertainty_score":0.021752179},"labels":[],"label_agreement":null},{"id":"W2037976912","doi":"10.1002/meet.14504301271","title":"An exploration of web‐based monitoring activities","year":2006,"lang":"en","type":"article","venue":"Proceedings of the American Society for Information Science and Technology","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Dalhousie University","funders":"Natural Sciences and Engineering Research Council of Canada","keywords":"World Wide Web; Computer science; Web application; Environmental monitoring; Self-monitoring; Work (physics); Data science; Engineering; Psychology","score_opus":0.01734616504561408,"score_gpt":0.2685182931222733,"score_spread":0.25117212807665923,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2037976912","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.8578471,0.001622499,0.07189967,0.0033254009,0.00006964124,0.00022755591,0.0018201567,0.0023254328,0.060862534],"genre_scores_gemma":[0.9794382,0.00036438115,0.017281119,0.00008590276,0.000024435492,0.000056417317,0.0006237058,0.0001330988,0.001992727],"study_design_codex":"design_other","study_design_gemma":"observational","domain_scores_codex":[0.9975777,0.0015284996,0.000092234615,0.00021966315,0.00047362567,0.000108138236],"domain_scores_gemma":[0.98198444,0.013398889,0.0016975648,0.00126723,0.0011449164,0.00050702255],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0023565623,0.0002453751,0.00019379935,0.0034014275,0.00083039515,0.00385907,0.00064927636,0.0005773649,0.0022301355],"category_scores_gemma":[0.011923119,0.00019291847,0.00027734315,0.003990733,0.0008154432,0.0041511133,0.0014019936,0.00077883113,0.0003457547],"study_design_candidate":"observational","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0011153467,0.0005440535,0.24175894,0.0010503655,0.00015650288,0.0021485775,0.123904295,0.004397035,0.011427039,0.059964657,0.013075763,0.5404574],"study_design_scores_gemma":[0.00007885376,0.00048120462,0.32931542,0.0013969752,0.00019638072,0.0038367559,0.116694234,0.12942168,0.011350605,0.07935913,0.32764181,0.00022700752],"about_ca_topic_score_codex":0.002438473,"about_ca_topic_score_gemma":0.0037267508,"teacher_disagreement_score":0.00385907,"about_ca_system_score_codex":0.00074411515,"about_ca_system_score_gemma":0.0006126845,"threshold_uncertainty_score":0.012462795},"labels":[],"label_agreement":null},{"id":"W2038522479","doi":"10.5555/3191835.3191975","title":"Estimating the size of hidden data sources by queries","year":2014,"lang":"en","type":"article","venue":"","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":1,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Windsor","funders":"","keywords":"Computer science; Variance (accounting); Variety (cybernetics); Data mining; Sample (material); Competitor analysis; Sample size determination; Baseline (sea); Information retrieval; Artificial intelligence; Statistics; Mathematics","score_opus":0.021067527741500204,"score_gpt":0.2535414358595014,"score_spread":0.2324739081180012,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2038522479","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.15844756,0.003313487,0.8309913,0.0017769577,0.00008320284,0.00029900478,0.0024953487,0.0013176182,0.0012755202],"genre_scores_gemma":[0.7517394,0.001830817,0.238899,0.00035585466,0.0003699033,0.00050208106,0.0050291563,0.00022952248,0.0010441724],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9937676,0.0019951882,0.00067775487,0.001767568,0.0014112145,0.0003807633],"domain_scores_gemma":[0.94472635,0.04386817,0.0027987096,0.0055256556,0.0026264188,0.00045465352],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0102527235,0.0012586729,0.0020667561,0.0041298848,0.0012093304,0.0032720182,0.0033523522,0.0020464943,0.0007535008],"category_scores_gemma":[0.05220307,0.0014904701,0.0018821117,0.0038914627,0.0015430562,0.010408236,0.0035117436,0.002379622,0.00041917313],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0017689323,0.0006691513,0.12651193,0.0021422226,0.0010129856,0.0014613379,0.0044443225,0.21174034,0.05486923,0.050511092,0.017362274,0.52750623],"study_design_scores_gemma":[0.000117034106,0.00012179804,0.013987834,0.00009747998,0.00024859267,0.00066121406,0.00071953255,0.92047405,0.020283299,0.037840065,0.0053484202,0.00010072464],"about_ca_topic_score_codex":0.007056588,"about_ca_topic_score_gemma":0.004575621,"teacher_disagreement_score":0.0102527235,"about_ca_system_score_codex":0.0015482495,"about_ca_system_score_gemma":0.0019249299,"threshold_uncertainty_score":0.054222286},"labels":[],"label_agreement":null},{"id":"W2039447541","doi":"10.1145/564376.564448","title":"The impact of corpus size on question answering performance","year":2002,"lang":"en","type":"article","venue":"","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":31,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Waterloo","funders":"","keywords":"Terabyte; Question answering; Computer science; Information retrieval; World Wide Web; Natural language processing","score_opus":0.01666226182163508,"score_gpt":0.2518497277000022,"score_spread":0.2351874658783671,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2039447541","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.93625075,0.008690783,0.01787249,0.004187755,0.0010690701,0.00042522012,0.0053052427,0.012323319,0.013875367],"genre_scores_gemma":[0.94339514,0.0026663048,0.027186207,0.00092583953,0.00070520595,0.00064599386,0.016668443,0.0022411975,0.005565571],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9848387,0.007107618,0.002057667,0.002479654,0.0028589035,0.0006574888],"domain_scores_gemma":[0.8332128,0.142969,0.0019747438,0.008808692,0.011062978,0.0019717987],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.016041178,0.0012668637,0.0020808042,0.0023027293,0.0020313466,0.0044902433,0.0019543867,0.0021232157,0.005413017],"category_scores_gemma":[0.13368183,0.0012262266,0.00081768614,0.0032998212,0.0015067769,0.009438394,0.003028657,0.0018420377,0.0031681603],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.015931176,0.0029935788,0.059053093,0.0047370777,0.0011628554,0.0019325655,0.004540185,0.059452295,0.15940084,0.004260576,0.0978894,0.5886463],"study_design_scores_gemma":[0.0028379608,0.010552518,0.089050755,0.0007058725,0.002627199,0.004648715,0.004963093,0.50011945,0.3007023,0.015598904,0.06743614,0.000757053],"about_ca_topic_score_codex":0.006996242,"about_ca_topic_score_gemma":0.0073100026,"teacher_disagreement_score":0.016041178,"about_ca_system_score_codex":0.0012573315,"about_ca_system_score_gemma":0.0019373548,"threshold_uncertainty_score":0.08483487},"labels":[],"label_agreement":null},{"id":"W2043893472","doi":"10.1145/2132176.2132232","title":"VDMs for finding and re-finding web search results","year":2012,"lang":"en","type":"article","venue":"Proceedings of the 2012 iConference","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":4,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Dalhousie University","funders":"","keywords":"Computer science; World Wide Web; Information retrieval","score_opus":0.078359101481355,"score_gpt":0.29966842871168514,"score_spread":0.22130932723033014,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2043893472","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.112984166,0.004674139,0.73084575,0.00091469596,0.000346505,0.0012797043,0.0045068474,0.12999284,0.014455369],"genre_scores_gemma":[0.19679134,0.0009754241,0.7879631,0.00030634055,0.00009169936,0.00089778437,0.0034312312,0.0020821118,0.007460956],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.99816364,0.00067526975,0.000169658,0.00026701667,0.0006311199,0.00009327804],"domain_scores_gemma":[0.9895281,0.007736688,0.0003830018,0.0013790604,0.0005773817,0.00039565115],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0026012608,0.0012639596,0.0009290516,0.0028738761,0.00047588337,0.0017039955,0.0020873386,0.0013692635,0.012443974],"category_scores_gemma":[0.014377375,0.00055697927,0.0009034498,0.0015333162,0.00043953615,0.0034432528,0.004062388,0.0010590557,0.004009933],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0022964785,0.0005062166,0.004865532,0.0031097753,0.00019568135,0.00083376083,0.0038133895,0.002573817,0.061328907,0.006070708,0.041135278,0.87327045],"study_design_scores_gemma":[0.0018169059,0.0032611445,0.033753894,0.002334854,0.0006781134,0.007268199,0.006275434,0.21751888,0.1156482,0.046591815,0.5639132,0.000939314],"about_ca_topic_score_codex":0.001000923,"about_ca_topic_score_gemma":0.0020213807,"teacher_disagreement_score":0.012443974,"about_ca_system_score_codex":0.0002821524,"about_ca_system_score_gemma":0.00047657083,"threshold_uncertainty_score":0.041629195},"labels":[],"label_agreement":null},{"id":"W2044194343","doi":"10.4018/jdwm.2012100101","title":"Towards Comparative Mining of Web Document Objects with NFA","year":2012,"lang":"en","type":"article","venue":"International Journal of Data Warehousing and Mining","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":6,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Windsor","funders":"","keywords":"Computer science; Web mining; Data Web; Web page; Web modeling; Information retrieval; Web standards; World Wide Web; Web intelligence; Static web page; Web navigation; Database","score_opus":0.07416393370134935,"score_gpt":0.3429523755542617,"score_spread":0.2687884418529124,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2044194343","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.051842723,0.0004870047,0.9435182,0.00008934259,0.000012631935,0.00014310412,0.0005537666,0.002001055,0.0013522485],"genre_scores_gemma":[0.21263532,0.00024188597,0.7837634,0.000042433956,0.000014716395,0.00026519148,0.0020850324,0.00013449752,0.0008174551],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9982967,0.00034743035,0.0002189699,0.000534926,0.0005102107,0.0000918649],"domain_scores_gemma":[0.99587506,0.002483474,0.00035528676,0.00052376144,0.00068612455,0.00007633213],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0021199652,0.00065939873,0.0010339293,0.0075914613,0.0009912963,0.0020760738,0.0013265124,0.0011917981,0.0010545568],"category_scores_gemma":[0.009742036,0.0005840982,0.002355622,0.0044718706,0.0012033478,0.0029293855,0.0012106196,0.0007356054,0.00052534894],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00043816812,0.0003543235,0.034366425,0.00087680685,0.0002914202,0.0011300779,0.001590031,0.101367086,0.042583343,0.04182286,0.0016484975,0.77353084],"study_design_scores_gemma":[0.000020485575,0.00015881733,0.008322048,0.00013079615,0.00012127008,0.0008504272,0.0003891366,0.9055477,0.018148214,0.05670725,0.009559535,0.000044321736],"about_ca_topic_score_codex":0.006823195,"about_ca_topic_score_gemma":0.006116615,"teacher_disagreement_score":0.0075914613,"about_ca_system_score_codex":0.0012732684,"about_ca_system_score_gemma":0.0013586056,"threshold_uncertainty_score":0.013566911},"labels":[],"label_agreement":null},{"id":"W2046650055","doi":"10.1145/2343045.2343090","title":"Asking the impossible on SSX","year":2012,"lang":"en","type":"article","venue":"","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":3,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Electronic Arts (Canada)","funders":"","keywords":"Computer science; Multimedia","score_opus":0.022655980964294206,"score_gpt":0.2528206358338812,"score_spread":0.23016465486958698,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2046650055","genre_codex":"commentary","genre_gemma":"other","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"other","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.011895505,0.007086033,0.007657924,0.69238704,0.014599105,0.000037031972,0.00023928378,0.00070454535,0.2653936],"genre_scores_gemma":[0.2926647,0.008142029,0.008116943,0.2898753,0.014257958,0.00017601847,0.00045301413,0.0022629115,0.38405114],"study_design_codex":"not_applicable","study_design_gemma":"not_applicable","domain_scores_codex":[0.9932069,0.003161241,0.00019986898,0.0008393615,0.0017484449,0.0008442153],"domain_scores_gemma":[0.98888946,0.00543358,0.00037576837,0.0010970822,0.0020597265,0.0021443763],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.008915462,0.00074340386,0.00060767704,0.0007913211,0.009582886,0.011007672,0.00086908374,0.0071176263,0.05125056],"category_scores_gemma":[0.028582983,0.0005034855,0.00042681445,0.0006163809,0.013474302,0.025034258,0.0065918327,0.012990926,0.015149776],"study_design_candidate":"not_applicable","study_design_consensus":"not_applicable","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00012794585,0.000047189194,0.00076008396,0.00009845094,0.000015620433,0.00024283226,0.005509273,0.0001590072,0.00061427656,0.24974194,0.70531183,0.037371602],"study_design_scores_gemma":[0.00001985486,0.000041498257,0.00043165684,0.00018169047,0.000005570204,0.00013257854,0.005241329,0.00027764236,0.0002804408,0.104488544,0.88886553,0.000033517874],"about_ca_topic_score_codex":0.0062791402,"about_ca_topic_score_gemma":0.008944039,"teacher_disagreement_score":0.05125056,"about_ca_system_score_codex":0.0029426392,"about_ca_system_score_gemma":0.0031168035,"threshold_uncertainty_score":0.1714502},"labels":[],"label_agreement":null},{"id":"W2049107633","doi":"10.1145/860435.860540","title":"A light weight PDA-friendly collection fusion technique","year":2003,"lang":"en","type":"article","venue":"","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":2,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Alberta","funders":"","keywords":"Merge (version control); Computer science; Database; Fusion; Information retrieval; Search engine; Artificial intelligence","score_opus":0.006890538473102351,"score_gpt":0.21832884673219474,"score_spread":0.21143830825909238,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2049107633","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.010917146,0.00073109905,0.9724201,0.00019019096,0.00014989973,0.00028705437,0.00058159645,0.00890205,0.005820903],"genre_scores_gemma":[0.07967388,0.00061289314,0.9007534,0.000365852,0.00018721442,0.0002874877,0.0021003215,0.0007659601,0.015253025],"study_design_codex":"design_other","study_design_gemma":"bench_or_experimental","domain_scores_codex":[0.996354,0.00023448562,0.00020007786,0.0005361709,0.0024324525,0.00024270405],"domain_scores_gemma":[0.9977907,0.00038249182,0.00013088831,0.0008037855,0.00079147983,0.000100772835],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.001736626,0.00095568,0.0011946919,0.0051053786,0.0016497682,0.003098467,0.0021659846,0.001005378,0.009517827],"category_scores_gemma":[0.0033485421,0.00080863317,0.0014592168,0.006289118,0.000579176,0.005155068,0.0043381555,0.0015314003,0.0066572824],"study_design_candidate":"bench_or_experimental","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00056973984,0.0002265875,0.0015988434,0.00031565034,0.00019436178,0.00032040104,0.0004667511,0.0016950346,0.16809295,0.008930747,0.010782514,0.8068064],"study_design_scores_gemma":[0.00016863926,0.00076624064,0.008881446,0.0001889809,0.0005860768,0.0044950834,0.0009317023,0.119363695,0.6187562,0.028589047,0.216847,0.00042596154],"about_ca_topic_score_codex":0.0028006819,"about_ca_topic_score_gemma":0.0035008027,"teacher_disagreement_score":0.009517827,"about_ca_system_score_codex":0.00067705096,"about_ca_system_score_gemma":0.0012674677,"threshold_uncertainty_score":0.031840265},"labels":[],"label_agreement":null},{"id":"W2050925949","doi":"10.1145/1076034.1076154","title":"A dual index model for contextual information retrieval","year":2005,"lang":"en","type":"article","venue":"","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":11,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"York University","funders":"University of Massachusetts","keywords":"Merge (version control); Computer science; Metadata; Information retrieval; Granularity; Index (typography); Dual (grammatical number); Data mining; World Wide Web","score_opus":0.022370498938647565,"score_gpt":0.25416405135332054,"score_spread":0.23179355241467298,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2050925949","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.007258086,0.0008659223,0.9860248,0.0004884864,0.00009051015,0.00012291467,0.00024403131,0.00071381626,0.0041914997],"genre_scores_gemma":[0.37989348,0.0016246415,0.6065429,0.0006141688,0.00052123284,0.00067638315,0.0011570035,0.00034234306,0.008627866],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9962747,0.0009898653,0.00027345645,0.00078104984,0.001390731,0.00029023745],"domain_scores_gemma":[0.99610656,0.001311695,0.00026722503,0.0012599532,0.0008494884,0.00020505625],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0027191937,0.00076075655,0.0017310055,0.0031498785,0.0011003452,0.0034808647,0.0031385797,0.0018600036,0.0044717174],"category_scores_gemma":[0.010340076,0.00078806875,0.0015059995,0.0038291279,0.0013743103,0.010798434,0.0030861322,0.0019694243,0.0022872037],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0007651622,0.00044610922,0.0030697738,0.00059138855,0.0002711507,0.00043595696,0.00093963963,0.12624817,0.016084818,0.54850876,0.017277192,0.28536183],"study_design_scores_gemma":[0.00007834101,0.00017617483,0.00039274004,0.00004220457,0.00013851286,0.00047232426,0.000075000506,0.80954117,0.0029392815,0.16870487,0.017344479,0.00009491338],"about_ca_topic_score_codex":0.004906856,"about_ca_topic_score_gemma":0.0036177642,"teacher_disagreement_score":0.004906856,"about_ca_system_score_codex":0.0017479073,"about_ca_system_score_gemma":0.0015768709,"threshold_uncertainty_score":0.014959395},"labels":[],"label_agreement":null},{"id":"W2055383765","doi":"10.1109/isda.2010.5687170","title":"Information gathering within websites: Visualized links for navigation (VLN)","year":2010,"lang":"en","type":"article","venue":"","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":2,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Dalhousie University","funders":"","keywords":"Computer science; Web navigation; Hypertext; World Wide Web; Information retrieval; Web page; Turn-by-turn navigation; Process (computing); Complement (music); Hypermedia; Presentation (obstetrics); Tree (set theory); Human–computer interaction; Artificial intelligence; Robot","score_opus":0.0118850368055523,"score_gpt":0.2827822365013415,"score_spread":0.2708971996957892,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2055383765","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.024866166,0.0035558462,0.9427004,0.002135752,0.0002743897,0.00033284945,0.00039651402,0.0059291883,0.019808976],"genre_scores_gemma":[0.17586032,0.0024946062,0.81551903,0.00024229761,0.00013174082,0.00032691014,0.00039234807,0.00038435432,0.0046483423],"study_design_codex":"design_other","study_design_gemma":"bench_or_experimental","domain_scores_codex":[0.99875736,0.00066947413,0.00006285928,0.000107854714,0.00035659553,0.00004581382],"domain_scores_gemma":[0.9968616,0.0016750415,0.00031474448,0.0005372422,0.0004259973,0.00018529572],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0014823052,0.0007716689,0.00037531962,0.00148344,0.00080427405,0.0029855855,0.0011006995,0.0010253662,0.004534362],"category_scores_gemma":[0.007453754,0.00030653548,0.0005220469,0.0017060521,0.0013785982,0.005149307,0.0021671928,0.0009732803,0.0012354896],"study_design_candidate":"bench_or_experimental","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00035295796,0.0002059848,0.0032058135,0.0024087555,0.00006228581,0.0006461914,0.0074510286,0.0074475943,0.03528948,0.124403164,0.023038134,0.79548854],"study_design_scores_gemma":[0.00027097762,0.0013805546,0.007452361,0.0027095657,0.00029709117,0.0057131476,0.004979611,0.15675394,0.03733168,0.19701648,0.5855482,0.0005463395],"about_ca_topic_score_codex":0.0018145631,"about_ca_topic_score_gemma":0.0038004662,"teacher_disagreement_score":0.004534362,"about_ca_system_score_codex":0.000596272,"about_ca_system_score_gemma":0.0011440205,"threshold_uncertainty_score":0.015168965},"labels":[],"label_agreement":null},{"id":"W2056563603","doi":"10.1145/1321211.1321214","title":"Automated conversion of table-based websites to structured stylesheets using table recognition and clone detection","year":2007,"lang":"en","type":"article","venue":"Proceedings of CASCON","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":9,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":true,"route_about_ca":false,"ca_institutions":"Queen's University","funders":"Natural Sciences and Engineering Research Council of Canada","keywords":"Computer science; Table (database); Cascading Style Sheets; Information retrieval; Web page; World Wide Web; HTML; Consistency (knowledge bases); Style sheet; Database; XML; Artificial intelligence","score_opus":0.02097638934551703,"score_gpt":0.24465535412258974,"score_spread":0.22367896477707272,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2056563603","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.10819983,0.0005539783,0.77072835,0.0002264836,0.00036148186,0.0010068251,0.009992359,0.10111189,0.007818831],"genre_scores_gemma":[0.13282198,0.00033339392,0.8363446,0.000132306,0.000058811976,0.00040931703,0.019711751,0.0029846444,0.007203153],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.99826354,0.00015474917,0.00019310674,0.0005164385,0.0007618198,0.000110303736],"domain_scores_gemma":[0.9933003,0.0018130981,0.00063017535,0.0018017064,0.0022404885,0.00021427454],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0011899644,0.0011118519,0.0011453136,0.0048089284,0.0005506305,0.0026394965,0.0015202906,0.00091592956,0.005171564],"category_scores_gemma":[0.00851904,0.00064237503,0.0011238251,0.0040835915,0.00037273948,0.0019572387,0.0009703347,0.0012895382,0.0071067135],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00041000158,0.00039977866,0.016196102,0.0004351462,0.000094810064,0.00062294176,0.0006154538,0.0044488655,0.06524923,0.002655055,0.03407488,0.87479776],"study_design_scores_gemma":[0.00012125313,0.0003891614,0.04885608,0.00017944454,0.0002019012,0.0025517046,0.0010412453,0.4478164,0.38062483,0.013528564,0.10435925,0.00033014442],"about_ca_topic_score_codex":0.0034635633,"about_ca_topic_score_gemma":0.0047376123,"teacher_disagreement_score":0.005171564,"about_ca_system_score_codex":0.00051883486,"about_ca_system_score_gemma":0.001018322,"threshold_uncertainty_score":0.017300606},"labels":[],"label_agreement":null},{"id":"W2056767790","doi":"10.1145/2508037.2508038","title":"Mining search and browse logs for web search","year":2013,"lang":"en","type":"article","venue":"ACM Transactions on Intelligent Systems and Technology","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":60,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Simon Fraser University","funders":"Natural Sciences and Engineering Research Council of Canada","keywords":"Computer science; Web search query; Terabyte; Web search engine; Search engine; Search analytics; Information retrieval; World Wide Web; Web crawler; Ranking (information retrieval); Web log analysis software; Transaction log; Metasearch engine; Database; Web page; Static web page; Web navigation","score_opus":0.03611578898037965,"score_gpt":0.2776240375976158,"score_spread":0.24150824861723613,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2056767790","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.48686495,0.010470663,0.44118428,0.002202977,0.00016151737,0.0012428174,0.036179483,0.01580373,0.0058896104],"genre_scores_gemma":[0.6979474,0.003472952,0.24835062,0.00023345073,0.0002232196,0.0007238422,0.04615836,0.0004018934,0.0024883277],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9978048,0.0005919825,0.00031347066,0.00033779978,0.00079618144,0.00015567966],"domain_scores_gemma":[0.9870617,0.0077763447,0.0013022635,0.001769589,0.0017963251,0.00029389292],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0023315127,0.0010311435,0.0012576447,0.011554946,0.0006983242,0.002165049,0.0012835286,0.000967674,0.00079088315],"category_scores_gemma":[0.023172092,0.0005779457,0.0012152508,0.008466845,0.0004119478,0.0043778927,0.0011185628,0.00132113,0.0012067],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00073349976,0.0014588296,0.20035475,0.002215625,0.0005400669,0.00088820205,0.0017787578,0.03315032,0.013542418,0.009022283,0.03115232,0.7051629],"study_design_scores_gemma":[0.00007272461,0.00032383399,0.08191785,0.00028078226,0.00028111393,0.0012760949,0.0016628383,0.8479558,0.012889029,0.033130467,0.020085102,0.00012439548],"about_ca_topic_score_codex":0.005932498,"about_ca_topic_score_gemma":0.0129755465,"teacher_disagreement_score":0.011554946,"about_ca_system_score_codex":0.00067336374,"about_ca_system_score_gemma":0.0017446363,"threshold_uncertainty_score":0.012330353},"labels":[],"label_agreement":null},{"id":"W2057116787","doi":"10.1098/rsta.2012.0381","title":"Standards opportunities around data-bearing Web pages","year":2013,"lang":"en","type":"article","venue":"Philosophical Transactions of the Royal Society A Mathematical Physical and Engineering Sciences","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":6,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Artificial Intelligence in Medicine (Canada)","funders":"","keywords":"Computer science; World Wide Web; Leverage (statistics); Schema (genetic algorithms); Web page; Data management; Web development; Web standards; Data science; Information retrieval; Database","score_opus":0.06244890800260953,"score_gpt":0.2616696039209436,"score_spread":0.1992206959183341,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2057116787","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.01794093,0.008342537,0.73266757,0.057063237,0.006023489,0.0007305042,0.0010767156,0.006418165,0.16973688],"genre_scores_gemma":[0.18521437,0.018559534,0.6935621,0.01713943,0.006295324,0.0018580278,0.0071069077,0.0049107443,0.06535351],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.9510968,0.015951524,0.008618124,0.0044860602,0.017981596,0.0018659832],"domain_scores_gemma":[0.83350617,0.051319595,0.007096679,0.06866611,0.03271207,0.006699389],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.062202137,0.0010101016,0.0011820676,0.0074799326,0.0044317325,0.028942324,0.0062230467,0.009401933,0.006012318],"category_scores_gemma":[0.10322125,0.0022782625,0.0019183399,0.008150067,0.0117212515,0.041185085,0.013820565,0.013534472,0.005828679],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00005080861,0.0001319052,0.0013036138,0.0003190869,0.00003287102,0.00032443154,0.0029409472,0.0011577505,0.0021098221,0.90072244,0.018365532,0.0725409],"study_design_scores_gemma":[0.000031737458,0.000052061263,0.0007617992,0.0007313122,0.000026064627,0.00059462356,0.0010188814,0.0019602638,0.0032984272,0.47791266,0.5135273,0.00008489707],"about_ca_topic_score_codex":0.0037157869,"about_ca_topic_score_gemma":0.0028309368,"teacher_disagreement_score":0.062202137,"about_ca_system_score_codex":0.0034138868,"about_ca_system_score_gemma":0.007953371,"threshold_uncertainty_score":0.3289603},"labels":[],"label_agreement":null},{"id":"W2058488627","doi":"10.14778/1687627.1687715","title":"Improved search for socially annotated data","year":2009,"lang":"en","type":"article","venue":"Proceedings of the VLDB Endowment","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":14,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Toronto","funders":"","keywords":"Computer science; Ranking (information retrieval); Scalability; Information retrieval; Annotation; Resource (disambiguation); Process (computing); Data mining; Similarity (geometry); Probabilistic logic; Cluster analysis; Machine learning; Database; Artificial intelligence","score_opus":0.045248350600693536,"score_gpt":0.2941844958611444,"score_spread":0.24893614526045088,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2058488627","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.045622483,0.0010801173,0.9433795,0.0012107451,0.000082817554,0.00019169287,0.0016816425,0.0032879026,0.0034631705],"genre_scores_gemma":[0.33114594,0.0005093559,0.6563451,0.00038456268,0.0001604278,0.00036002195,0.006554449,0.0004254505,0.004114712],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9914664,0.0037822218,0.000516582,0.0017141058,0.0021416498,0.00037900824],"domain_scores_gemma":[0.9887931,0.006161369,0.0008281162,0.0026660732,0.0013196849,0.00023176314],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0061486107,0.0015439522,0.002666839,0.005093778,0.0015177968,0.0033407134,0.0030192768,0.0026207878,0.0029110196],"category_scores_gemma":[0.028889991,0.0007921253,0.0015595455,0.006476096,0.0011052581,0.005898339,0.005734315,0.0014192795,0.0018609212],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00076631334,0.00055547646,0.0068694837,0.0009426858,0.00038321165,0.00067179714,0.001652628,0.37940124,0.010985517,0.09670877,0.021757703,0.4793051],"study_design_scores_gemma":[0.000025880307,0.000055050063,0.00037748928,0.000018293556,0.000026866845,0.00007900206,0.00020129103,0.9592072,0.0015074342,0.035345767,0.0031347594,0.000020952193],"about_ca_topic_score_codex":0.008264619,"about_ca_topic_score_gemma":0.013073079,"teacher_disagreement_score":0.008264619,"about_ca_system_score_codex":0.0020246964,"about_ca_system_score_gemma":0.0032029096,"threshold_uncertainty_score":0.032517314},"labels":[],"label_agreement":null},{"id":"W2059882478","doi":"10.1145/1394251.1394268","title":"The Fourth Asian Information Retrieval Symposium (AIRS 08)","year":2008,"lang":"en","type":"article","venue":"ACM SIGIR Forum","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":1,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Université de Montréal","funders":"","keywords":"Beijing; Computer science; China; Library science; TRACE (psycholinguistics); Information retrieval; History; Linguistics","score_opus":0.010923728138995347,"score_gpt":0.21613401612441624,"score_spread":0.2052102879854209,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2059882478","genre_codex":"other","genre_gemma":"other","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"other","genre_consensus":"other","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.030263344,0.17030351,0.101272315,0.0922255,0.24045451,0.0019540377,0.017164985,0.019409506,0.32695234],"genre_scores_gemma":[0.034923386,0.049200557,0.05247125,0.012679006,0.032379255,0.00083350006,0.03009142,0.0037418634,0.7836798],"study_design_codex":"not_applicable","study_design_gemma":"not_applicable","domain_scores_codex":[0.9945227,0.0012512126,0.0005514252,0.0005689744,0.002499551,0.0006061531],"domain_scores_gemma":[0.98726153,0.0010240808,0.00047195196,0.0013304731,0.0076259566,0.002285991],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.014976143,0.001525148,0.0030311977,0.004672792,0.0021214453,0.011444744,0.0020937508,0.003214412,0.09920398],"category_scores_gemma":[0.008991472,0.00054293015,0.0014405635,0.0032090137,0.0012638428,0.009094774,0.0035644986,0.0037432737,0.12421028],"study_design_candidate":"not_applicable","study_design_consensus":"not_applicable","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00012598078,0.00010069767,0.0004992754,0.00025156236,0.00002889839,0.000096501746,0.00012764266,0.00006292197,0.0023159755,0.0013190539,0.8579493,0.1371221],"study_design_scores_gemma":[0.000021730279,0.000100632176,0.0013614715,0.00018571698,0.000035104604,0.00022060728,0.00019798076,0.0007072388,0.0015025636,0.0012537637,0.9943808,0.000032518576],"about_ca_topic_score_codex":0.0029148173,"about_ca_topic_score_gemma":0.006071456,"teacher_disagreement_score":0.09920398,"about_ca_system_score_codex":0.0020427676,"about_ca_system_score_gemma":0.0045745177,"threshold_uncertainty_score":0.33187038},"labels":[],"label_agreement":null},{"id":"W2059984218","doi":"10.1145/584792.584802","title":"Topic-oriented collaborative crawling","year":2002,"lang":"en","type":"article","venue":"","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":25,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Waterloo","funders":"","keywords":"Web crawler; Computer science; Crawling; Focused crawler; Hash function; Information retrieval; Web page; World Wide Web; Classifier (UML); Data mining; Static web page; Web navigation; Artificial intelligence","score_opus":0.01527913115665228,"score_gpt":0.22174585621769394,"score_spread":0.20646672506104166,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2059984218","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.027422337,0.00046188344,0.9633326,0.00014677442,0.000053804994,0.00044235596,0.00008592719,0.003614099,0.0044402974],"genre_scores_gemma":[0.27374783,0.0005278944,0.71581405,0.00017403014,0.00016254967,0.0008163683,0.0006718443,0.0004846431,0.007600824],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9939374,0.0021541326,0.0003981176,0.0011536346,0.00204515,0.00031151774],"domain_scores_gemma":[0.98643947,0.0041001905,0.00088718516,0.004781169,0.003238152,0.000553832],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0046582483,0.0008305669,0.0017575076,0.0025000956,0.0015768958,0.002564414,0.0025941394,0.0013100778,0.0015544329],"category_scores_gemma":[0.014841929,0.0007541631,0.00076869794,0.0029269014,0.00094764977,0.0031642835,0.002744594,0.0009954751,0.0018019642],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00040497043,0.00090024073,0.009167388,0.0008503404,0.0004410791,0.00045928478,0.002655813,0.07173027,0.04587611,0.038333297,0.018994566,0.8101867],"study_design_scores_gemma":[0.00025097487,0.00053695985,0.006021608,0.00008183948,0.00033902732,0.0012723937,0.0010522311,0.82659334,0.045076348,0.062181976,0.056453623,0.00013962902],"about_ca_topic_score_codex":0.0022566982,"about_ca_topic_score_gemma":0.004499533,"teacher_disagreement_score":0.0046582483,"about_ca_system_score_codex":0.0006836327,"about_ca_system_score_gemma":0.0016838145,"threshold_uncertainty_score":0.024635494},"labels":[],"label_agreement":null},{"id":"W2061022164","doi":"10.1145/1451940.1451960","title":"A bottom-up approach for XML documents classification","year":2008,"lang":"en","type":"article","venue":"","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":8,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Memorial University of Newfoundland","funders":"","keywords":"Computer science; Document Structure Description; Information retrieval; XML; SGML; XML Schema Editor; XML validation; Efficient XML Interchange; Document type definition; XML Schema (W3C); XML database; Schema (genetic algorithms); World Wide Web","score_opus":0.0649444665900192,"score_gpt":0.2806387728962791,"score_spread":0.21569430630625988,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2061022164","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0026827555,0.0006959802,0.99182445,0.00021808787,0.000114568575,0.00037050297,0.0004261867,0.0025180029,0.0011494401],"genre_scores_gemma":[0.026444873,0.00043992436,0.96748406,0.00023932329,0.00016633928,0.0003236503,0.002026809,0.00012686905,0.002748125],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9947777,0.00073024374,0.00049907464,0.0009259802,0.0028029208,0.00026402087],"domain_scores_gemma":[0.9969727,0.00084565894,0.00019215205,0.0006528539,0.0012026582,0.00013393002],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0018701536,0.0016071216,0.0017703453,0.008751831,0.0023052809,0.0033864197,0.0031403436,0.0025847945,0.0034376741],"category_scores_gemma":[0.004502883,0.00056949985,0.002709446,0.006514924,0.0010622446,0.002752258,0.0023170996,0.0024429963,0.004292121],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00009277344,0.00024317551,0.001992316,0.00029223197,0.0001106007,0.00018099781,0.0002195073,0.0062673404,0.011036875,0.006853147,0.012412749,0.9602983],"study_design_scores_gemma":[0.00007779914,0.00039541532,0.0047791675,0.00029185877,0.00036438572,0.0019302354,0.00048932835,0.7658583,0.052416977,0.07219787,0.10094107,0.00025761803],"about_ca_topic_score_codex":0.0039178873,"about_ca_topic_score_gemma":0.0043359273,"teacher_disagreement_score":0.008751831,"about_ca_system_score_codex":0.0009587548,"about_ca_system_score_gemma":0.0016490803,"threshold_uncertainty_score":0.01150012},"labels":[],"label_agreement":null},{"id":"W2061410315","doi":"10.1145/2254129.2254192","title":"Intelligent web page retrieval using Wikipedia knowledge","year":2012,"lang":"en","type":"article","venue":"","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":6,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Ottawa","funders":"","keywords":"Information retrieval; Computer science; Web page; Vector space model; World Wide Web; Task (project management); Filter (signal processing); Index (typography)","score_opus":0.061077385498119585,"score_gpt":0.3046138679786422,"score_spread":0.24353648248052262,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2061410315","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.28619072,0.00487506,0.6689508,0.00086308736,0.00026544515,0.00054562924,0.0012133822,0.020554932,0.016540889],"genre_scores_gemma":[0.61558735,0.0012757581,0.37087712,0.00037435786,0.00032462485,0.0001670933,0.0041044783,0.0004733112,0.0068159904],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9989336,0.00026979693,0.000086810025,0.00020626144,0.0004050249,0.00009855777],"domain_scores_gemma":[0.99791795,0.0008890528,0.00014708684,0.0003162916,0.0006297136,0.00009995874],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.00092056976,0.00074493245,0.0012734958,0.0057595256,0.00079413154,0.0019942133,0.00082211173,0.001023818,0.001508371],"category_scores_gemma":[0.005382349,0.00031147464,0.00061058183,0.0028226383,0.00041455572,0.0042614485,0.0010404221,0.0006044645,0.002048283],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00059404905,0.00081366405,0.0074397405,0.00049924076,0.00029018894,0.0003943012,0.00037209044,0.025649188,0.05074084,0.0035241232,0.015108907,0.8945737],"study_design_scores_gemma":[0.00015720892,0.000609464,0.013218922,0.00008975067,0.00045449645,0.0011847704,0.00043117066,0.86685,0.06763002,0.023027437,0.026129348,0.00021751698],"about_ca_topic_score_codex":0.0039598886,"about_ca_topic_score_gemma":0.0057199295,"teacher_disagreement_score":0.0057595256,"about_ca_system_score_codex":0.00039366714,"about_ca_system_score_gemma":0.0006125572,"threshold_uncertainty_score":0.007873714},"labels":[],"label_agreement":null},{"id":"W2063446501","doi":"10.1109/ccece.2012.6334966","title":"Matchmaking through semantic annotation and similarity measurement","year":2012,"lang":"en","type":"article","venue":"","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":4,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of New Brunswick","funders":"","keywords":"Computer science; Information retrieval; Ontology; Annotation; Semantic similarity; Set (abstract data type); Similarity (geometry); Semantic Web; Information extraction; Domain (mathematical analysis); Natural language processing; Artificial intelligence; Image (mathematics)","score_opus":0.06381196539689483,"score_gpt":0.27163839523163785,"score_spread":0.20782642983474303,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2063446501","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.012346565,0.00023819286,0.9797285,0.00016965166,0.000065681386,0.00030094755,0.0003348658,0.0020848643,0.004730668],"genre_scores_gemma":[0.14785822,0.00032051085,0.84620696,0.0000971452,0.000055306602,0.00036372573,0.0015587483,0.00033996228,0.003199404],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9876078,0.0035451436,0.0012917251,0.002518839,0.0046177413,0.0004188519],"domain_scores_gemma":[0.9912777,0.0029758413,0.0009964997,0.0020728114,0.002448097,0.00022902687],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.005390626,0.00096967205,0.0013916986,0.010350552,0.0017985189,0.0046116225,0.0024712838,0.0016213971,0.0029871757],"category_scores_gemma":[0.019420056,0.00059133995,0.0012951518,0.010287432,0.001711653,0.008995153,0.004359206,0.0014008986,0.0020489604],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00042406534,0.00044854902,0.0053082434,0.00090310944,0.00022634953,0.0004073383,0.00308545,0.01327604,0.035118964,0.07270459,0.007303027,0.86079425],"study_design_scores_gemma":[0.00008324177,0.00039699062,0.010683169,0.00043072258,0.0003888394,0.0012975772,0.004339934,0.47716475,0.13309203,0.23568991,0.13605325,0.00037958715],"about_ca_topic_score_codex":0.003536214,"about_ca_topic_score_gemma":0.003117611,"teacher_disagreement_score":0.010350552,"about_ca_system_score_codex":0.0014964169,"about_ca_system_score_gemma":0.0026577485,"threshold_uncertainty_score":0.028508723},"labels":[],"label_agreement":null},{"id":"W2063777281","doi":"10.12968/sece.2004.10.317","title":"A marriage made in heaven","year":2004,"lang":"en","type":"article","venue":"SecEd","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":26,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Earl Haig Secondary School","funders":"","keywords":"Heaven; Deep Web; World Wide Web; History; Genealogy; Library science; The Internet; Computer science; Archaeology","score_opus":0.009326711620309815,"score_gpt":0.22531531817798844,"score_spread":0.21598860655767863,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2063777281","genre_codex":"commentary","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.036568664,0.025713338,0.017162459,0.503987,0.07167819,0.00006748536,0.0006613783,0.0007203726,0.3434411],"genre_scores_gemma":[0.2925638,0.007107,0.013552676,0.11018315,0.010177842,0.000059037604,0.0003420509,0.001096286,0.5649183],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"not_applicable","domain_scores_codex":[0.99737287,0.0008850869,0.00010267937,0.00053385133,0.0007442248,0.00036128494],"domain_scores_gemma":[0.99534,0.0008958776,0.00018843143,0.0012169697,0.0010931976,0.0012655599],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0051149908,0.00051141874,0.0008781408,0.0018805257,0.011023251,0.010319875,0.00089602784,0.003862437,0.023940576],"category_scores_gemma":[0.011383465,0.00046909633,0.0005131921,0.0021508345,0.016332181,0.012060959,0.0099894395,0.01188259,0.006796872],"study_design_candidate":"not_applicable","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0002315318,0.00005179423,0.0015072004,0.000077436525,0.000037945218,0.00043636438,0.013185348,0.00008686087,0.00044968058,0.68930453,0.24283585,0.05179558],"study_design_scores_gemma":[0.000013749807,0.000029625524,0.00046548573,0.00012051422,0.00000630088,0.00018422407,0.0041383845,0.000081925406,0.00019425494,0.07205238,0.9226913,0.000021929005],"about_ca_topic_score_codex":0.004019352,"about_ca_topic_score_gemma":0.008165944,"teacher_disagreement_score":0.023940576,"about_ca_system_score_codex":0.0024376125,"about_ca_system_score_gemma":0.0026501694,"threshold_uncertainty_score":0.08008915},"labels":[],"label_agreement":null},{"id":"W2063784997","doi":"10.1145/1772690.1772925","title":"Web search/browse log mining","year":2010,"lang":"en","type":"article","venue":"","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":4,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Simon Fraser University","funders":"Natural Sciences and Engineering Research Council of Canada","keywords":"Computer science; Process (computing); Crowds; Search engine; World Wide Web; Web search engine; Web search query; Scale (ratio); The Internet; Information retrieval; Data mining; Geography","score_opus":0.0204817308758582,"score_gpt":0.25903043481511795,"score_spread":0.23854870393925975,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2063784997","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.4246514,0.00699086,0.4371381,0.0031230662,0.00025760673,0.0026573122,0.07059116,0.026463367,0.028126994],"genre_scores_gemma":[0.7058429,0.0030598927,0.21439119,0.00041070403,0.000275288,0.000797893,0.06397894,0.0004982052,0.010744921],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.99832577,0.00027762147,0.00015986565,0.00025324267,0.00081810006,0.0001654418],"domain_scores_gemma":[0.9967906,0.0010288346,0.000435068,0.0006722464,0.0008606214,0.00021261109],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0014661744,0.00088995235,0.0010640485,0.01045332,0.0009421504,0.0018455172,0.0014766023,0.000904087,0.0021330633],"category_scores_gemma":[0.0070009106,0.00048277288,0.0009811046,0.007099047,0.00046055918,0.0025346917,0.0012278049,0.0009299811,0.0025838627],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00051873736,0.0014768929,0.12922718,0.0013512478,0.0003939761,0.0013728547,0.000580094,0.026635734,0.017614987,0.010455844,0.0706918,0.7396807],"study_design_scores_gemma":[0.00013292156,0.0003000151,0.09451711,0.00031212493,0.0002633926,0.0023501741,0.0010893472,0.7695912,0.03147648,0.04368161,0.056138277,0.00014744932],"about_ca_topic_score_codex":0.008369223,"about_ca_topic_score_gemma":0.014040123,"teacher_disagreement_score":0.01045332,"about_ca_system_score_codex":0.00048743133,"about_ca_system_score_gemma":0.001943199,"threshold_uncertainty_score":0.01664102},"labels":[],"label_agreement":null},{"id":"W2064224510","doi":"10.1145/2422256.2422269","title":"Open source information retrieval","year":2012,"lang":"en","type":"article","venue":"ACM SIGIR Forum","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":27,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Waterloo","funders":"","keywords":"Computer science; Open source; Information retrieval; World Wide Web; Library science; Data science; Software","score_opus":0.021498732009247255,"score_gpt":0.26906679720650123,"score_spread":0.24756806519725397,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2064224510","genre_codex":"other","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.009697001,0.046672158,0.22986929,0.044103708,0.03767788,0.0029908216,0.062923245,0.053890876,0.51217514],"genre_scores_gemma":[0.04526415,0.01996594,0.1102884,0.010223072,0.011299982,0.0012753316,0.13399942,0.014785227,0.65289855],"study_design_codex":"not_applicable","study_design_gemma":"not_applicable","domain_scores_codex":[0.9845829,0.0027747434,0.0012565808,0.0017733877,0.008358213,0.0012541512],"domain_scores_gemma":[0.9635176,0.006646232,0.0013368538,0.010439805,0.01497398,0.003085497],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.011081004,0.0014759621,0.0017104807,0.01790104,0.003566262,0.013890911,0.0031008448,0.003674598,0.14009155],"category_scores_gemma":[0.05673837,0.0010273551,0.0015737601,0.012900432,0.0018350257,0.018043514,0.011277499,0.0044832802,0.13160855],"study_design_candidate":"not_applicable","study_design_consensus":"not_applicable","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00018262063,0.00011432086,0.0005028386,0.0007527223,0.00004719748,0.00020321282,0.00038225518,0.0002509511,0.002672236,0.022030374,0.6311412,0.34172007],"study_design_scores_gemma":[0.000019026797,0.000032756274,0.00044778478,0.00018806303,0.000011705335,0.00018807255,0.00013353277,0.00055712834,0.0015599674,0.010454903,0.9863686,0.000038533803],"about_ca_topic_score_codex":0.002893934,"about_ca_topic_score_gemma":0.0054258625,"teacher_disagreement_score":0.14009155,"about_ca_system_score_codex":0.0029687735,"about_ca_system_score_gemma":0.0048031425,"threshold_uncertainty_score":0.46865296},"labels":[],"label_agreement":null},{"id":"W2064433041","doi":"10.1109/sws.2010.5607479","title":"Exploring the concepts of visualization, clustering, and re-finding in Web information gathering tasks: A survey","year":2010,"lang":"en","type":"article","venue":"","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":3,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Dalhousie University","funders":"","keywords":"Computer science; Information retrieval; Web intelligence; Information visualization; World Wide Web; Task (project management); Cluster analysis; Web modeling; Visualization; Web mapping; Data science; The Internet; Data mining; Artificial intelligence; Engineering","score_opus":0.07535403722000403,"score_gpt":0.3068175441937105,"score_spread":0.23146350697370646,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2064433041","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.043591112,0.2900591,0.6231858,0.008894801,0.00033458296,0.00060361205,0.0004284708,0.001297291,0.031605136],"genre_scores_gemma":[0.2881964,0.1868377,0.51635456,0.0012989156,0.0011219949,0.00092459115,0.00092773593,0.00042342072,0.003914635],"study_design_codex":"design_other","study_design_gemma":"observational","domain_scores_codex":[0.99137527,0.0043214047,0.00071677304,0.0010974809,0.0021851447,0.00030397152],"domain_scores_gemma":[0.9273612,0.06232878,0.0025210846,0.0025491877,0.004314411,0.000925356],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.01244596,0.0017138436,0.0023747594,0.013942665,0.001794559,0.009562529,0.0022413235,0.0030284454,0.0025538357],"category_scores_gemma":[0.034504503,0.0013763837,0.0019685163,0.017322255,0.0048312484,0.021617532,0.002132766,0.0030624354,0.0010159507],"study_design_candidate":"observational","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00021517278,0.00053531455,0.017712012,0.007150388,0.00024940993,0.00017008667,0.009198334,0.007894102,0.002145591,0.075446546,0.008254752,0.8710283],"study_design_scores_gemma":[0.000123693,0.0013004271,0.052258667,0.009691065,0.0005723588,0.004425464,0.030839415,0.15549943,0.0072861803,0.48539045,0.25192985,0.00068301975],"about_ca_topic_score_codex":0.0054875803,"about_ca_topic_score_gemma":0.004301309,"teacher_disagreement_score":0.013942665,"about_ca_system_score_codex":0.0023085854,"about_ca_system_score_gemma":0.002303197,"threshold_uncertainty_score":0.06582129},"labels":[],"label_agreement":null},{"id":"W2064514861","doi":"10.1142/s021848850400317x","title":"TEXTUAL-BASED CLUSTERING OF WEB DOCUMENTS","year":2004,"lang":"en","type":"article","venue":"International Journal of Uncertainty Fuzziness and Knowledge-Based Systems","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":1,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Alberta","funders":"","keywords":"Cluster analysis; Computer science; Information retrieval; Schematic; Fuzzy clustering; Directory; Web page; HTML element; Document clustering; Data mining; Web mining; Feature (linguistics); World Wide Web; Artificial intelligence","score_opus":0.01590388508604498,"score_gpt":0.2784247356577021,"score_spread":0.26252085057165714,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2064514861","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.11334738,0.0015829903,0.87124914,0.00038199598,0.00017420467,0.00081271934,0.0031303242,0.0031484314,0.0061727683],"genre_scores_gemma":[0.28938335,0.00059383054,0.6981568,0.00014355741,0.00016213134,0.00043495445,0.0057793893,0.000326807,0.005019155],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9970638,0.0005823976,0.00037057314,0.00064288394,0.0012163483,0.00012390918],"domain_scores_gemma":[0.994493,0.0015835806,0.00047620502,0.00055155886,0.0027606706,0.00013504313],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0017865067,0.00075658853,0.0008142604,0.009386598,0.0010065314,0.0023305812,0.0012526012,0.0010627091,0.00240019],"category_scores_gemma":[0.010881517,0.0002860634,0.0008883723,0.006979939,0.0005883536,0.0019449188,0.00066709256,0.00054602505,0.0022039928],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.000890999,0.0005289171,0.016571127,0.0024236706,0.00031166716,0.00049088366,0.0014516722,0.045517575,0.08154033,0.013173443,0.008719961,0.8283798],"study_design_scores_gemma":[0.00014150234,0.00054836494,0.04135919,0.00046475304,0.00037457954,0.0017909601,0.0020423604,0.73575103,0.13913901,0.028320018,0.04977795,0.00029035698],"about_ca_topic_score_codex":0.0038959624,"about_ca_topic_score_gemma":0.005035459,"teacher_disagreement_score":0.009386598,"about_ca_system_score_codex":0.0013336875,"about_ca_system_score_gemma":0.0010203852,"threshold_uncertainty_score":0.009676576},"labels":[],"label_agreement":null},{"id":"W2065337340","doi":"10.5555/2664446.2664460","title":"Mining usage data and development artifacts","year":2012,"lang":"en","type":"article","venue":"","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":3,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Waterloo","funders":"","keywords":"Software deployment; Computer science; World Wide Web; Software; Focus (optics); Software engineering; Operating system","score_opus":0.09831788754945207,"score_gpt":0.28789675836811424,"score_spread":0.18957887081866215,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2065337340","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.92394626,0.00064376957,0.052881464,0.0003351432,0.000029605644,0.0003181687,0.018097272,0.0010599052,0.0026884044],"genre_scores_gemma":[0.90341973,0.00043294716,0.0654968,0.000055796347,0.000035696587,0.00048613,0.02920786,0.00017291076,0.00069215446],"study_design_codex":"observational","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9911612,0.0025689092,0.0017689884,0.001433337,0.0027264885,0.00034100434],"domain_scores_gemma":[0.9196336,0.046844114,0.012374053,0.010347776,0.009709394,0.0010910836],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.006961243,0.0008483547,0.0008603303,0.015502963,0.00044719927,0.0019226053,0.0010917016,0.0009076958,0.00062611274],"category_scores_gemma":[0.049745232,0.00051237753,0.0008138701,0.013105073,0.00049940887,0.003661269,0.0011555314,0.0009330262,0.0006097357],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00015709069,0.0004398501,0.86572576,0.0005794173,0.00033252517,0.00031162362,0.0011245867,0.0055966713,0.003829183,0.0010859083,0.0019908277,0.11882657],"study_design_scores_gemma":[0.000046079098,0.00048639945,0.8430786,0.0002476979,0.00029088356,0.0016204737,0.0026935334,0.118557744,0.013068805,0.005580731,0.014181881,0.00014707967],"about_ca_topic_score_codex":0.0026094501,"about_ca_topic_score_gemma":0.004882263,"teacher_disagreement_score":0.015502963,"about_ca_system_score_codex":0.00054382434,"about_ca_system_score_gemma":0.00092161313,"threshold_uncertainty_score":0.036814988},"labels":[],"label_agreement":null},{"id":"W2069086951","doi":"10.1109/icsdm.2011.5969046","title":"Thematic data extraction from Web for GIS and applications","year":2011,"lang":"en","type":"article","venue":"","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":9,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Calgary","funders":"","keywords":"Geospatial analysis; Computer science; Geospatial PDF; Web Coverage Service; World Wide Web; Web mapping; Information retrieval; Web page; Thematic map; Data Web; Geospatial metadata; Geography; Meta Data Services; Metadata; Remote sensing; Cartography","score_opus":0.13010562483125548,"score_gpt":0.3067918044317426,"score_spread":0.1766861796004871,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2069086951","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.04015806,0.002171755,0.8550136,0.0011692306,0.00039807442,0.000987832,0.053149328,0.021559201,0.025392922],"genre_scores_gemma":[0.12353376,0.0021837624,0.79468715,0.00018605222,0.00013818528,0.00065331435,0.07052,0.0012405036,0.0068573235],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9993624,0.000094128285,0.0000787055,0.00011290138,0.00029185694,0.000059906375],"domain_scores_gemma":[0.99883777,0.00027926508,0.00008819192,0.0002945512,0.0004542154,0.000046003985],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.00067075854,0.00085621554,0.0007303398,0.01049269,0.0008783265,0.0019989898,0.0007686031,0.00070738676,0.006266858],"category_scores_gemma":[0.0033041022,0.00045954305,0.0014752608,0.011522033,0.00043926347,0.00227912,0.0015100525,0.00097258977,0.005585734],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00019410336,0.00019565091,0.009633449,0.001743702,0.00015253387,0.0015871554,0.0014041116,0.009793589,0.036270443,0.025347691,0.072128296,0.8415493],"study_design_scores_gemma":[0.00005902525,0.00012097123,0.025116354,0.0005264416,0.00025680877,0.0029279732,0.0042662905,0.18167877,0.08351035,0.08064225,0.6207411,0.00015364587],"about_ca_topic_score_codex":0.004315782,"about_ca_topic_score_gemma":0.0061120717,"teacher_disagreement_score":0.01049269,"about_ca_system_score_codex":0.0006569612,"about_ca_system_score_gemma":0.0015375993,"threshold_uncertainty_score":0.020964742},"labels":[],"label_agreement":null},{"id":"W2070347268","doi":"10.1145/1753326.1753426","title":"A study of tabbed browsing among mozilla firefox users","year":2010,"lang":"en","type":"article","venue":"","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":66,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Toronto","funders":"","keywords":"World Wide Web; Computer science; Web browser; Web page; Web navigation; Information retrieval; The Internet","score_opus":0.014484879796487396,"score_gpt":0.24810446915686038,"score_spread":0.23361958936037297,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2070347268","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.99942505,0.000041487692,0.00017501152,0.000048026428,0.0000015832399,0.00001702174,0.000012341867,0.0000051491406,0.00027435544],"genre_scores_gemma":[0.99880064,0.000101921614,0.0005424703,0.00008662283,0.0000051654138,0.00003042836,0.000020509431,0.000005280178,0.00040703206],"study_design_codex":"qualitative","study_design_gemma":"observational","domain_scores_codex":[0.99871826,0.000734305,0.00009093362,0.00012014278,0.00016341459,0.000172903],"domain_scores_gemma":[0.9880982,0.008426962,0.0011797559,0.00044147047,0.00094818656,0.00090535113],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.002591301,0.00028934673,0.00047161587,0.0011298519,0.001991138,0.0017659351,0.00051369594,0.0009696203,0.0016609898],"category_scores_gemma":[0.0104141105,0.00053137896,0.00025541033,0.00090374466,0.0011047671,0.0022761011,0.00070884207,0.000955345,0.0002895562],"study_design_candidate":"observational","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00038748112,0.00073787395,0.18634719,0.00029061898,0.00003235058,0.0013867771,0.7731162,0.00006474564,0.012772611,0.00031334365,0.00040467162,0.024146104],"study_design_scores_gemma":[0.00007646575,0.002598357,0.26214182,0.00020103395,0.00005284539,0.0022653537,0.72115326,0.001420189,0.002953198,0.0003255322,0.006706845,0.00010512147],"about_ca_topic_score_codex":0.0057867994,"about_ca_topic_score_gemma":0.008536211,"teacher_disagreement_score":0.0057867994,"about_ca_system_score_codex":0.00059471343,"about_ca_system_score_gemma":0.0006048056,"threshold_uncertainty_score":0.01370424},"labels":[],"label_agreement":null},{"id":"W2070388635","doi":"10.1145/1233341.1233422","title":"Challenges of using LSI for concept location","year":2007,"lang":"en","type":"article","venue":"","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":4,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Algoma University; Laurentian University","funders":"","keywords":"Computer science; Search engine indexing; Feature (linguistics); Natural language; Code (set theory); Key (lock); Information retrieval; Data science; Artificial intelligence; Programming language; Computer security","score_opus":0.08481388063617268,"score_gpt":0.32655249023346417,"score_spread":0.2417386095972915,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2070388635","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0056602987,0.0029656133,0.9798615,0.0061797635,0.00023915234,0.00011328064,0.000220403,0.00087374944,0.0038861816],"genre_scores_gemma":[0.20358585,0.0026299153,0.78956896,0.0006512968,0.00043752487,0.00046563084,0.00045060564,0.0003005764,0.0019096673],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.96334887,0.021308308,0.002538208,0.0032877375,0.008925601,0.0005912118],"domain_scores_gemma":[0.87077254,0.08967268,0.0062199943,0.017413663,0.014823269,0.0010979545],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.025587363,0.0010541416,0.002741711,0.005583064,0.0033883355,0.009688421,0.0045690085,0.0037451999,0.003164318],"category_scores_gemma":[0.114328355,0.0010437976,0.001315503,0.0065486114,0.006689859,0.021677868,0.0061387843,0.005182171,0.0035991287],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00022929409,0.000112442394,0.004097636,0.0010470063,0.00015362268,0.00041964333,0.0033938554,0.018703235,0.004918359,0.42519718,0.013559064,0.52816874],"study_design_scores_gemma":[0.0000615329,0.00012143124,0.0014141098,0.0003298763,0.000061467916,0.0016556026,0.0045236284,0.26892778,0.011792283,0.6663746,0.044433367,0.00030425936],"about_ca_topic_score_codex":0.0040374696,"about_ca_topic_score_gemma":0.0019389985,"teacher_disagreement_score":0.025587363,"about_ca_system_score_codex":0.002669811,"about_ca_system_score_gemma":0.0034545544,"threshold_uncertainty_score":0.13532054},"labels":[],"label_agreement":null},{"id":"W2072323150","doi":"10.1145/1277741.1277979","title":"Geographic ranking for a local search engine","year":2007,"lang":"en","type":"article","venue":"","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":3,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Minnow Environmental (Canada)","funders":"","keywords":"Information retrieval; Ranking (information retrieval); Computer science; Relevance (law); Web crawler; Web search engine; Volunteered geographic information; World Wide Web; Web page; Geographic information system; Web search query; Search engine; Geography; Data science; Cartography","score_opus":0.017489439733326742,"score_gpt":0.27074392923752044,"score_spread":0.2532544895041937,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2072323150","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.031393692,0.0009886153,0.9527069,0.00025913905,0.00008590259,0.00023810525,0.00058301084,0.007368061,0.006376659],"genre_scores_gemma":[0.24215522,0.00047714243,0.7439539,0.00012680716,0.00013945262,0.0002547183,0.0014438462,0.00038590495,0.011063103],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9990164,0.0002666623,0.000073620555,0.0001587749,0.00040021175,0.00008430212],"domain_scores_gemma":[0.99862933,0.0003844826,0.000115366944,0.00033840555,0.0004777324,0.000054660533],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0011896912,0.00049564295,0.0010022937,0.003118447,0.0006404937,0.0016025574,0.001062616,0.0008031922,0.005624216],"category_scores_gemma":[0.0046539414,0.0002803847,0.0005907563,0.0030227005,0.00033085063,0.0019189926,0.0007192101,0.00047024156,0.0036822383],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00022296103,0.00024333301,0.005231908,0.00045953473,0.00015894133,0.00027503303,0.00017247078,0.068621516,0.019541837,0.058379594,0.028197203,0.81849563],"study_design_scores_gemma":[0.00008871432,0.0002767928,0.004157768,0.000041894848,0.00012406737,0.00084079464,0.00011818523,0.9291457,0.012310746,0.022213636,0.03060343,0.000078254874],"about_ca_topic_score_codex":0.0044884165,"about_ca_topic_score_gemma":0.0099592665,"teacher_disagreement_score":0.005624216,"about_ca_system_score_codex":0.00073842186,"about_ca_system_score_gemma":0.0011834381,"threshold_uncertainty_score":0.018814862},"labels":[],"label_agreement":null},{"id":"W2074126326","doi":"10.1145/2213836.2213912","title":"Automatic web-scale information extraction","year":2012,"lang":"en","type":"article","venue":"","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":27,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Toronto","funders":"","keywords":"Computer science; Scale (ratio); Extraction (chemistry); Information extraction; Information retrieval; World Wide Web; Chromatography; Geography","score_opus":0.010528182572821168,"score_gpt":0.24570805675362892,"score_spread":0.23517987418080774,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2074126326","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.012879394,0.0006461523,0.9019634,0.00077803014,0.00013518755,0.00040906217,0.006126782,0.069307655,0.007754353],"genre_scores_gemma":[0.07970366,0.00058745354,0.89511514,0.00047922408,0.00006708245,0.0003558366,0.014229529,0.0035807004,0.0058813468],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.99823004,0.0002992116,0.00016895335,0.0003671594,0.000842334,0.00009221179],"domain_scores_gemma":[0.9950412,0.0020476498,0.00021970515,0.0015863095,0.0009908361,0.00011442109],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.001842135,0.0010522342,0.0010683831,0.0029680212,0.00093195593,0.0028591456,0.0010566678,0.0010619274,0.007828068],"category_scores_gemma":[0.007879726,0.000643889,0.0011116412,0.004147124,0.0005179131,0.0035887484,0.0032229621,0.0012457127,0.009169497],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00050174404,0.0003574795,0.004810782,0.0011703118,0.00022892897,0.0012571511,0.00086368667,0.006285354,0.09071698,0.020010438,0.11892405,0.75487304],"study_design_scores_gemma":[0.00020064245,0.0001453915,0.009068615,0.00039931605,0.00021908943,0.002279092,0.00084993104,0.278426,0.25249895,0.07677985,0.37891293,0.00022017324],"about_ca_topic_score_codex":0.0015295488,"about_ca_topic_score_gemma":0.0025880656,"teacher_disagreement_score":0.007828068,"about_ca_system_score_codex":0.00045424228,"about_ca_system_score_gemma":0.00089524104,"threshold_uncertainty_score":0.02618748},"labels":[],"label_agreement":null},{"id":"W2074691516","doi":"10.1109/icstw.2014.26","title":"Exhaustive Exploration of Ajax Web Applications with Selective Jumping","year":2014,"lang":"en","type":"article","venue":"","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":5,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Université du Québec à Chicoutimi","funders":"","keywords":"Web crawler; Ajax; Computer science; JavaScript; Client-side; Web application; World Wide Web; Task (project management); State (computer science); Web server; Web page; Code (set theory); The Internet; Database; Programming language","score_opus":0.01757971920537383,"score_gpt":0.2397132628486129,"score_spread":0.2221335436432391,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2074691516","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.39593595,0.0006904272,0.5817486,0.0003698679,0.000030238767,0.0002164643,0.00029172294,0.013807162,0.0069096005],"genre_scores_gemma":[0.70318806,0.00021255488,0.29171747,0.00011670996,0.0000148552235,0.00021165697,0.0005796459,0.0005701518,0.0033889764],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9991265,0.0002530504,0.000059985807,0.00015053201,0.00029469476,0.000115277515],"domain_scores_gemma":[0.9968034,0.0020140337,0.00021433982,0.0006300711,0.00023379961,0.000104234394],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0008997944,0.0005750059,0.000593567,0.0012602786,0.00082207687,0.0010784037,0.0010634521,0.0006560517,0.0011714502],"category_scores_gemma":[0.00459452,0.0004707315,0.0006458403,0.0009287294,0.0010091792,0.0021551545,0.0019001829,0.0007243414,0.00032047572],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0013438703,0.00072893675,0.022331016,0.0009953403,0.00023661241,0.0015509062,0.0022916952,0.30228657,0.10842895,0.05141966,0.008012625,0.50037384],"study_design_scores_gemma":[0.00004622158,0.00014894776,0.0022016673,0.00003436459,0.000041566527,0.0003106298,0.00016747828,0.94832766,0.019309495,0.024322663,0.0050641703,0.000025083833],"about_ca_topic_score_codex":0.002209569,"about_ca_topic_score_gemma":0.0051776906,"teacher_disagreement_score":0.002209569,"about_ca_system_score_codex":0.00039234405,"about_ca_system_score_gemma":0.000988032,"threshold_uncertainty_score":0.0047585964},"labels":[],"label_agreement":null},{"id":"W2075487780","doi":"10.1109/skg.2013.29","title":"Semantic Analysis for Keywords Based User Segmentation from Internet Data","year":2013,"lang":"en","type":"article","venue":"","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of New Brunswick","funders":"","keywords":"Computer science; Key (lock); Component (thermodynamics); Plug-in; The Internet; Segmentation; Information retrieval; Similarity (geometry); World Wide Web; Web page; Semantic similarity; Artificial intelligence; Image (mathematics)","score_opus":0.04659145356278281,"score_gpt":0.2827339632047855,"score_spread":0.23614250964200267,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2075487780","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.27422538,0.0013087286,0.7074796,0.00051674957,0.000082479564,0.000522863,0.00800917,0.004747361,0.0031077086],"genre_scores_gemma":[0.6540941,0.00031299438,0.33203045,0.00011423202,0.000111556255,0.00043395042,0.012132994,0.00013791278,0.0006317254],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.99773276,0.00053348043,0.00035701838,0.00046708074,0.0007062098,0.00020329766],"domain_scores_gemma":[0.9964419,0.0018611295,0.00048855273,0.00041699552,0.0006264735,0.00016487515],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0016480647,0.00071571145,0.0011597521,0.011071622,0.0008153361,0.0012989728,0.00087607105,0.00097516924,0.0009082793],"category_scores_gemma":[0.00746937,0.0002498609,0.0013562222,0.006224321,0.0006417448,0.002498776,0.0012969564,0.0007292447,0.00075145066],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0018420396,0.0015656679,0.0944143,0.0013044254,0.00046448465,0.0010780036,0.0019671484,0.047140826,0.06289244,0.025510017,0.0093008485,0.7525198],"study_design_scores_gemma":[0.00005260034,0.00026512943,0.035702515,0.00008768458,0.00013391318,0.0007085991,0.0012261611,0.8954809,0.01925015,0.03886582,0.008133326,0.00009328609],"about_ca_topic_score_codex":0.0036718599,"about_ca_topic_score_gemma":0.004892263,"teacher_disagreement_score":0.011071622,"about_ca_system_score_codex":0.00094652764,"about_ca_system_score_gemma":0.0011454446,"threshold_uncertainty_score":0.008715928},"labels":[],"label_agreement":null},{"id":"W2075963766","doi":"10.1109/ainaw.2007.88","title":"An Investigation of Chip-Level Hardware Support for Web Mining","year":2007,"lang":"en","type":"article","venue":"","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":9,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Victoria","funders":"","keywords":"Computer science; Field-programmable gate array; Embedded system; Software; Computer hardware; Hardware architecture; Hardware compatibility list; System on a chip; Abstraction; Computer architecture; Chip; Open source hardware; Operating system","score_opus":0.05465481537802433,"score_gpt":0.2922490401042279,"score_spread":0.2375942247262036,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2075963766","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.61238754,0.0013134705,0.36603603,0.0007408493,0.00027674314,0.00023670103,0.0001760242,0.004147768,0.014684881],"genre_scores_gemma":[0.916892,0.00019287593,0.080697894,0.00018128972,0.000039045684,0.000068683155,0.000113878115,0.000057474994,0.00175688],"study_design_codex":"bench_or_experimental","study_design_gemma":"bench_or_experimental","domain_scores_codex":[0.99956375,0.00009358687,0.000026843609,0.00006228578,0.0001511654,0.00010239938],"domain_scores_gemma":[0.9983909,0.00075975625,0.00013493521,0.00034308116,0.00032491813,0.000046359746],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.00035898227,0.00044929702,0.0003163015,0.0003325098,0.00025985745,0.0007841618,0.0013755785,0.00041231202,0.0048857788],"category_scores_gemma":[0.0022684012,0.00020119055,0.00028114812,0.0003254442,0.00030864982,0.0011381448,0.00031159847,0.0005013453,0.00071043335],"study_design_candidate":"bench_or_experimental","study_design_consensus":"bench_or_experimental","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0008998558,0.00045137687,0.012022757,0.0014401845,0.00019698612,0.0010007197,0.00021165326,0.07696082,0.52784574,0.026948577,0.004493717,0.3475276],"study_design_scores_gemma":[0.00019926339,0.0037823576,0.009390449,0.00012920343,0.0003217393,0.0011441894,0.00022930834,0.40419912,0.5504144,0.0061152563,0.024010103,0.00006465395],"about_ca_topic_score_codex":0.0006366789,"about_ca_topic_score_gemma":0.00089095184,"teacher_disagreement_score":0.0048857788,"about_ca_system_score_codex":0.0003848013,"about_ca_system_score_gemma":0.0006800499,"threshold_uncertainty_score":0.016344607},"labels":[],"label_agreement":null},{"id":"W207646885","doi":"10.1007/978-3-642-38457-8_11","title":"Selective Retrieval for Categorization of Semi-structured Web Resources","year":2013,"lang":"en","type":"book-chapter","venue":"Lecture notes in computer science","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":2,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Dalhousie University","funders":"","keywords":"Computer science; Categorization; Information retrieval; Ranking (information retrieval); Directory; Set (abstract data type); Process (computing); Task (project management); Entity linking; World Wide Web; Web page; Data mining; Artificial intelligence; Knowledge base","score_opus":0.01253512869794304,"score_gpt":0.2330384927091037,"score_spread":0.22050336401116066,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W207646885","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.18609951,0.0060514617,0.78705347,0.0005602065,0.000208424,0.0008288503,0.0042731236,0.007010245,0.007914694],"genre_scores_gemma":[0.45967066,0.0022484623,0.5128947,0.00029967175,0.00032459619,0.0006554818,0.013668632,0.0004144417,0.009823339],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.99879706,0.00024254902,0.00014271973,0.0002494775,0.0004263157,0.00014172946],"domain_scores_gemma":[0.99748826,0.0011390622,0.00020691942,0.00056470116,0.00047100367,0.00013010342],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.001471736,0.0007610726,0.0013904136,0.0060925675,0.00094413816,0.0017354459,0.001536569,0.00090671825,0.0034523783],"category_scores_gemma":[0.0034706048,0.0003126909,0.0009769775,0.0047294125,0.0007899021,0.0029816623,0.0018996315,0.00070386817,0.0037078762],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0006273712,0.00032899217,0.0037011902,0.0011708342,0.00017308071,0.00031069535,0.000764538,0.0026978129,0.07857682,0.007950078,0.018994398,0.8847041],"study_design_scores_gemma":[0.0002985239,0.0014031489,0.03410978,0.00046231237,0.0010766444,0.0045705554,0.003839328,0.611559,0.16366316,0.10628339,0.07244467,0.0002895597],"about_ca_topic_score_codex":0.002104992,"about_ca_topic_score_gemma":0.0039776294,"teacher_disagreement_score":0.0060925675,"about_ca_system_score_codex":0.0006855956,"about_ca_system_score_gemma":0.0014306518,"threshold_uncertainty_score":0.011549413},"labels":[],"label_agreement":null},{"id":"W2076811080","doi":"10.5539/mas.v6n6p39","title":"An Improved Ontology-Based User Interest Model","year":2012,"lang":"en","type":"article","venue":"Modern Applied Science","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":1,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":true,"route_about_ca":false,"ca_institutions":"","funders":"","keywords":"Computer science; Vector space model; Ontology; Term (time); Key (lock); Information retrieval; Space (punctuation); Data mining; Computer security","score_opus":0.039002076632884554,"score_gpt":0.2810073069907489,"score_spread":0.24200523035786434,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2076811080","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.02060399,0.0005229769,0.9735779,0.00046889405,0.00006736171,0.000075003874,0.0004078211,0.0007266981,0.0035493255],"genre_scores_gemma":[0.7539047,0.0009899328,0.2339452,0.0003323583,0.00016826561,0.00038554746,0.0020937333,0.00017863452,0.008001643],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.99802387,0.0004663963,0.00014150377,0.0004707216,0.00074173015,0.00015588709],"domain_scores_gemma":[0.9987067,0.00041456212,0.000103749764,0.00018102166,0.0005327926,0.000061262814],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0014825404,0.000557908,0.0006770345,0.0015554293,0.0005014072,0.0014587792,0.0021145772,0.0009987496,0.0013344085],"category_scores_gemma":[0.0044075157,0.00034828437,0.001315594,0.0021247477,0.00047068845,0.0053390814,0.0010108718,0.0014303705,0.000825309],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0007143107,0.0005670175,0.0140905315,0.0003702951,0.00038611423,0.0005841329,0.0014825435,0.24832834,0.018941123,0.19925624,0.01571701,0.4995623],"study_design_scores_gemma":[0.000021311538,0.00005606185,0.0012310612,0.00001085432,0.00006526208,0.00016594207,0.00005844891,0.97057533,0.001666157,0.020813715,0.005300919,0.00003491908],"about_ca_topic_score_codex":0.012888876,"about_ca_topic_score_gemma":0.008381059,"teacher_disagreement_score":0.012888876,"about_ca_system_score_codex":0.0014204206,"about_ca_system_score_gemma":0.0011759172,"threshold_uncertainty_score":0.025627732},"labels":[],"label_agreement":null},{"id":"W2077110404","doi":"10.1145/2215676.2215680","title":"Report on BooksOnline'11","year":2012,"lang":"en","type":"article","venue":"ACM SIGIR Forum","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":3,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"","funders":"City, University of London; Connaught Fund; University of Toronto; University of Twente","keywords":"Computer science; Crowdsourcing; Salient; Social media; Reading (process); Context (archaeology); Digital library; World Wide Web; Key (lock); Library science; Data science; Political science; History","score_opus":0.02475597731603267,"score_gpt":0.2790317875960136,"score_spread":0.2542758102799809,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2077110404","genre_codex":"other","genre_gemma":"other","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"other","genre_consensus":"other","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.004182182,0.004713701,0.002214641,0.03303844,0.07530647,0.0013892992,0.054094,0.0031040679,0.8219572],"genre_scores_gemma":[0.0034974827,0.0010632966,0.00045384342,0.0029045923,0.0022939688,0.0004740373,0.014989909,0.0010307406,0.9732921],"study_design_codex":"not_applicable","study_design_gemma":"not_applicable","domain_scores_codex":[0.99175733,0.00066304393,0.00031476043,0.0007352734,0.0051996456,0.0013300395],"domain_scores_gemma":[0.9861645,0.0013145672,0.00039966442,0.0015526065,0.0062977104,0.0042709024],"candidate_categories":["insufficient_payload"],"consensus_categories":[],"category_scores_codex":[0.0067032794,0.0013115541,0.001006157,0.0037351665,0.004913335,0.018408997,0.003601164,0.0058691404,0.5611682],"category_scores_gemma":[0.013021587,0.000660293,0.0013013757,0.0042055333,0.0009270126,0.0068897097,0.008681709,0.0056033474,0.4270426],"study_design_candidate":"not_applicable","study_design_consensus":"not_applicable","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.000087758985,0.0000493795,0.00025453453,0.0001310569,0.000003968634,0.00008785948,0.00009383433,0.000027910115,0.00026398734,0.0023083664,0.9825675,0.01412388],"study_design_scores_gemma":[0.0000042649813,0.000017326101,0.0005531255,0.000035906818,0.0000014059589,0.000015444199,0.0001243422,0.0000115508,0.00014196924,0.00011370838,0.9989759,0.0000050792287],"about_ca_topic_score_codex":0.010943153,"about_ca_topic_score_gemma":0.01762899,"teacher_disagreement_score":0.5611682,"about_ca_system_score_codex":0.0037760518,"about_ca_system_score_gemma":0.009936724,"threshold_uncertainty_score":0.6259403},"labels":[],"label_agreement":null},{"id":"W2077457668","doi":"10.1145/1039140.1039151","title":"Focus on ACM SIGGRAPH Canadian chapters","year":2004,"lang":"en","type":"article","venue":"ACM SIGGRAPH Computer Graphics","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":true,"ca_institutions":"","funders":"","keywords":"Library science; Focus (optics); Visual arts; Media studies; Art history; Sociology; Art; Computer science","score_opus":0.02081988893877568,"score_gpt":0.23142135831851143,"score_spread":0.21060146937973576,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2077457668","genre_codex":"other","genre_gemma":"commentary","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"commentary","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.00096039625,0.16010623,0.0062345387,0.05584518,0.12106834,0.00066175614,0.0058646654,0.0025433493,0.6467155],"genre_scores_gemma":[0.0041000084,0.08900127,0.0031216827,0.009957416,0.014887554,0.00024393741,0.0038525052,0.0018221007,0.8730135],"study_design_codex":"not_applicable","study_design_gemma":"not_applicable","domain_scores_codex":[0.99517435,0.00024621637,0.00015770084,0.00050248497,0.0032338633,0.0006854682],"domain_scores_gemma":[0.9771174,0.00062280556,0.0003816389,0.0005755952,0.017134808,0.004167737],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0037363395,0.0016424771,0.0010940076,0.012650933,0.0056070234,0.01245269,0.002388777,0.0027739874,0.21448474],"category_scores_gemma":[0.009136898,0.0009486543,0.0010320811,0.0180048,0.0014997463,0.00545449,0.0044259443,0.0046483255,0.1288152],"study_design_candidate":"not_applicable","study_design_consensus":"not_applicable","about_ca_topic_candidate":true,"about_ca_topic_consensus":false,"about_ca_system_candidate":true,"about_ca_system_consensus":false,"study_design_scores_codex":[0.000006514283,0.000008375521,0.00008433989,0.00015983802,0.0000021558913,0.000018498167,0.000042224812,0.00004777139,0.00013980397,0.0021654193,0.96260977,0.034715235],"study_design_scores_gemma":[8.8673283e-7,0.0000018247542,0.00013645744,0.00009969094,0.000002224977,0.000017749666,0.00003068418,0.0000134434085,0.000025209854,0.00015019342,0.9995179,0.0000036521596],"about_ca_topic_score_codex":0.45469972,"about_ca_topic_score_gemma":0.6678552,"teacher_disagreement_score":0.97823125,"about_ca_system_score_codex":0.021768771,"about_ca_system_score_gemma":0.041475162,"threshold_uncertainty_score":0.90410614},"labels":[],"label_agreement":null},{"id":"W2078886133","doi":"10.1145/1866218.1866249","title":"What can internet search engines \"suggest\" about the usage and usability of popular desktop applications?","year":2010,"lang":"en","type":"article","venue":"","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":1,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Waterloo","funders":"","keywords":"Usability; Computer science; The Internet; World Wide Web; Search engine; Raw data; Software; Web search query; Information retrieval; Database; Human–computer interaction","score_opus":0.020275285748035526,"score_gpt":0.27730717581199055,"score_spread":0.257031890063955,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2078886133","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.9507983,0.0037958967,0.012830482,0.009720803,0.00008553368,0.00013750899,0.004201436,0.00032086988,0.018109247],"genre_scores_gemma":[0.9919383,0.00096518185,0.003737298,0.0008872333,0.00014986434,0.00008394659,0.0017516674,0.000041323954,0.00044516035],"study_design_codex":"observational","study_design_gemma":"observational","domain_scores_codex":[0.9953832,0.0019446564,0.00047156404,0.0006934039,0.0012747223,0.0002323712],"domain_scores_gemma":[0.9173187,0.05857278,0.011062474,0.0041881073,0.007836819,0.0010212184],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.007901469,0.00051335304,0.0008999663,0.007667841,0.00069056184,0.005826204,0.0009919538,0.0026192863,0.0020067368],"category_scores_gemma":[0.08791937,0.00043048486,0.0007141022,0.0068470323,0.0020893926,0.00934854,0.00079381646,0.0017027071,0.0010323318],"study_design_candidate":"observational","study_design_consensus":"observational","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0004650655,0.00032106374,0.89003533,0.0007389083,0.0003721411,0.00014687696,0.0045098704,0.0014388028,0.0012138827,0.004077142,0.00507614,0.091604665],"study_design_scores_gemma":[0.00004934343,0.00036221728,0.9378468,0.00038184726,0.00025427464,0.0005364872,0.010337503,0.016196711,0.0013813608,0.02327907,0.009192896,0.00018155506],"about_ca_topic_score_codex":0.007170918,"about_ca_topic_score_gemma":0.009174883,"teacher_disagreement_score":0.007901469,"about_ca_system_score_codex":0.001186241,"about_ca_system_score_gemma":0.00066305464,"threshold_uncertainty_score":0.041787505},"labels":[],"label_agreement":null},{"id":"W2080132606","doi":"10.14778/1938545.1938547","title":"Automatic wrappers for large scale web extraction","year":2011,"lang":"en","type":"article","venue":"Proceedings of the VLDB Endowment","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":135,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Waterloo","funders":"","keywords":"Computer science; Noise (video); Scale (ratio); Noisy data; Extraction (chemistry); Data extraction; Data mining; Information extraction; Training set; Artificial intelligence; Machine learning; Information retrieval; Pattern recognition (psychology)","score_opus":0.024150020816393863,"score_gpt":0.24482076550129492,"score_spread":0.22067074468490105,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2080132606","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0031549018,0.00019294542,0.9661502,0.000074524694,0.000031540334,0.000090067624,0.00072441215,0.029092854,0.000488524],"genre_scores_gemma":[0.047401983,0.00028773822,0.9415964,0.00015835953,0.000066819746,0.00019969858,0.005358897,0.003137903,0.0017921901],"study_design_codex":"design_other","study_design_gemma":"bench_or_experimental","domain_scores_codex":[0.99720925,0.0006067707,0.00040087255,0.00073269784,0.0008799857,0.0001704273],"domain_scores_gemma":[0.99242604,0.0019609737,0.000627239,0.0038188882,0.0010246101,0.00014217118],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0026021963,0.0016685073,0.0016136818,0.004270602,0.0012979667,0.0021851072,0.0018846114,0.0014766214,0.0030215972],"category_scores_gemma":[0.011390459,0.001200313,0.0018287584,0.0040854034,0.0008858842,0.0043441863,0.0035201989,0.0020417792,0.0067998017],"study_design_candidate":"bench_or_experimental","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00022913846,0.00033475284,0.005182769,0.000811688,0.00033163125,0.00082561193,0.0005330854,0.025445588,0.049934812,0.017023679,0.04627993,0.85306734],"study_design_scores_gemma":[0.00006642007,0.00012907303,0.0032843056,0.00020809141,0.00021874384,0.0013361936,0.00019067098,0.61503506,0.20124885,0.09832586,0.079823345,0.00013338237],"about_ca_topic_score_codex":0.000926681,"about_ca_topic_score_gemma":0.001707474,"teacher_disagreement_score":0.004270602,"about_ca_system_score_codex":0.0004966936,"about_ca_system_score_gemma":0.0013461636,"threshold_uncertainty_score":0.013761878},"labels":[],"label_agreement":null},{"id":"W2082225138","doi":"10.1145/1046456.1046458","title":"Extracting relational data from HTML repositories","year":2004,"lang":"en","type":"article","venue":"ACM SIGKDD Explorations Newsletter","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":8,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of British Columbia","funders":"","keywords":"Computer science; Set (abstract data type); Information retrieval; Data mining; Information extraction; Quality (philosophy)","score_opus":0.12972045116927916,"score_gpt":0.3005306323875561,"score_spread":0.17081018121827696,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2082225138","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.16765764,0.0019118423,0.7773164,0.000998979,0.000070925045,0.0006377461,0.020846236,0.025099998,0.005460272],"genre_scores_gemma":[0.24147119,0.001131223,0.7131192,0.0001314196,0.000077599776,0.00025762434,0.0415202,0.0008820247,0.0014095011],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9969796,0.0004648877,0.000426762,0.00039901468,0.0015794813,0.00015028278],"domain_scores_gemma":[0.9853367,0.0059638396,0.0013581554,0.004004272,0.0030000184,0.00033695696],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0023204528,0.0009021745,0.0010544589,0.010877822,0.00070956664,0.0030615823,0.0015825682,0.00096500764,0.0011589874],"category_scores_gemma":[0.019864539,0.0007102127,0.0013212337,0.009080175,0.00045675263,0.003221844,0.0018944183,0.0009342164,0.0019221323],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00036618853,0.00038592107,0.042028774,0.0014497873,0.0002699603,0.0017714334,0.001875047,0.025569743,0.046132784,0.008904273,0.016328966,0.8549171],"study_design_scores_gemma":[0.00013233109,0.00046191522,0.03943773,0.0004592144,0.000741255,0.0037483403,0.0025866593,0.5392147,0.28624675,0.044680744,0.08199382,0.00029665176],"about_ca_topic_score_codex":0.002656304,"about_ca_topic_score_gemma":0.0040337974,"teacher_disagreement_score":0.010877822,"about_ca_system_score_codex":0.00055777666,"about_ca_system_score_gemma":0.0013296778,"threshold_uncertainty_score":0.012271881},"labels":[],"label_agreement":null},{"id":"W2084241405","doi":"10.1002/(sici)1097-4571(2000)51:9<793::aid-asi20>3.3.co;2-h","title":"Rating news documents for similarity","year":2000,"lang":"en","type":"article","venue":"Journal of the American Society for Information Science","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":11,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Acadia University; Dalhousie University","funders":"","keywords":"Personalization; Computer science; Information retrieval; Feature (linguistics); Event (particle physics); Similarity (geometry); Precision and recall; Representation (politics); World Wide Web; Artificial intelligence","score_opus":0.016784334779100574,"score_gpt":0.30043839086948027,"score_spread":0.2836540560903797,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2084241405","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.77450657,0.008060239,0.15738848,0.0010939956,0.0010096248,0.0019891672,0.010840022,0.003750401,0.04136153],"genre_scores_gemma":[0.8858247,0.0016148918,0.09575031,0.000101335245,0.00077795115,0.0003246063,0.008982409,0.00016663359,0.006457236],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.993893,0.000927205,0.00089080207,0.00081693864,0.0031987217,0.0002732521],"domain_scores_gemma":[0.98759204,0.0040149363,0.0016518316,0.0011268053,0.0051136524,0.0005007175],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0023993556,0.0007408455,0.001338182,0.016533852,0.0006936474,0.002606048,0.00075451704,0.0010665043,0.0066181193],"category_scores_gemma":[0.026228148,0.00022665836,0.0008792736,0.010840771,0.0003660322,0.0028366216,0.0009803071,0.000769039,0.0050670397],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0013935398,0.00066056196,0.14327925,0.00091470435,0.0007215476,0.0004138865,0.00091633014,0.0040565426,0.027140595,0.002589229,0.027351916,0.7905618],"study_design_scores_gemma":[0.00040347333,0.004300661,0.63553804,0.00031900138,0.0012050761,0.0048819925,0.003968736,0.22506253,0.05032617,0.01162069,0.061904784,0.00046879574],"about_ca_topic_score_codex":0.0022444907,"about_ca_topic_score_gemma":0.00398213,"teacher_disagreement_score":0.016533852,"about_ca_system_score_codex":0.00064520974,"about_ca_system_score_gemma":0.0006877679,"threshold_uncertainty_score":0.022139788},"labels":[{"model":"gemma","categories":[],"domain":null,"study_design":"simulation_or_modeling","genre":"empirical","about_ca_system":false,"about_ca_topic":false,"confidence":"low"},{"model":"gpt","categories":[],"domain":null,"study_design":"design_other","genre":"methods","about_ca_system":false,"about_ca_topic":false,"confidence":"high"}],"label_agreement":"split"},{"id":"W2088253480","doi":"10.1145/2661714.2661721","title":"Towards Storytelling by Extracting Social Information from OSN Photo's Metadata","year":2014,"lang":"en","type":"article","venue":"","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":6,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Ottawa","funders":"","keywords":"Timeline; Computer science; Metadata; Popularity; Snapshot (computer storage); World Wide Web; Social media; Storytelling; Event (particle physics); Focus (optics); Information retrieval; Social network (sociolinguistics); Multimedia; Narrative; Database","score_opus":0.015301497365386406,"score_gpt":0.23290218189665857,"score_spread":0.21760068453127215,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2088253480","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.24656878,0.0040719537,0.67934966,0.001455823,0.00028712695,0.0014997906,0.033249944,0.0075188032,0.025998158],"genre_scores_gemma":[0.37384847,0.0018734573,0.57583386,0.00017297358,0.00019152457,0.00064252585,0.040360615,0.00023679354,0.006839672],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9992181,0.00020120776,0.000073596806,0.00021381902,0.00022794802,0.00006519594],"domain_scores_gemma":[0.99857044,0.00060449465,0.00023728926,0.00021717233,0.00026763268,0.00010307823],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0005665438,0.001207471,0.00044234982,0.0074755875,0.00065064937,0.0015115393,0.0008071701,0.0008370736,0.0020873724],"category_scores_gemma":[0.0034254019,0.00030196554,0.00081809843,0.0035888026,0.00039169192,0.0035831155,0.001481386,0.0007368241,0.0019520044],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00042729892,0.00035189302,0.03125267,0.0012812582,0.00015838916,0.0018886137,0.006325472,0.0053249793,0.02304463,0.008487277,0.026653161,0.89480424],"study_design_scores_gemma":[0.000059031147,0.0004933458,0.07007121,0.0007774494,0.00045294798,0.004665817,0.022523826,0.5085204,0.06502426,0.033836287,0.29336286,0.00021260568],"about_ca_topic_score_codex":0.0037303255,"about_ca_topic_score_gemma":0.009976282,"teacher_disagreement_score":0.0074755875,"about_ca_system_score_codex":0.00047252013,"about_ca_system_score_gemma":0.00045030485,"threshold_uncertainty_score":0.007417202},"labels":[],"label_agreement":null},{"id":"W2090018148","doi":"10.1109/dnsr.2004.1344743","title":"Weighted PageRank algorithm","year":2004,"lang":"en","type":"article","venue":"","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":562,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of New Brunswick","funders":"Atlantic Canada Opportunities Agency","keywords":"PageRank; Computer science; Ranking (information retrieval); HITS algorithm; Web page; Information retrieval; Popularity; Rank (graph theory); Categorization; Learning to rank; Data mining; World Wide Web; Theoretical computer science; Web search engine; Web navigation; Artificial intelligence; Mathematics","score_opus":0.008709172515255128,"score_gpt":0.218913923281581,"score_spread":0.21020475076632586,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2090018148","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.005974591,0.0036281638,0.95651555,0.0007866667,0.00096159795,0.00087927975,0.0015000494,0.0052224314,0.024531618],"genre_scores_gemma":[0.1269929,0.004750919,0.80934644,0.0006439817,0.0012610407,0.001148127,0.0066225748,0.0007233185,0.04851066],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.99607265,0.0013346113,0.00033035997,0.00056640705,0.0014055911,0.000290505],"domain_scores_gemma":[0.99615353,0.0014561313,0.0002956435,0.00062522315,0.0013285276,0.00014088397],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0022371716,0.0021590567,0.0031303836,0.0046889563,0.0014470153,0.0036242038,0.0031375028,0.0027533115,0.022665635],"category_scores_gemma":[0.009484827,0.00071677624,0.0009801054,0.00542103,0.00086246687,0.00435491,0.0013539484,0.0014026212,0.02436554],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00032661177,0.00029577108,0.0013655301,0.0006956443,0.00026612275,0.00024665424,0.00008140763,0.109490015,0.0028968118,0.038701296,0.09781807,0.7478162],"study_design_scores_gemma":[0.0003808018,0.000340955,0.0005573682,0.00013906593,0.00015537867,0.0010022912,0.00011423498,0.7485837,0.004785503,0.12265789,0.12119005,0.00009274607],"about_ca_topic_score_codex":0.002438524,"about_ca_topic_score_gemma":0.0035725995,"teacher_disagreement_score":0.022665635,"about_ca_system_score_codex":0.0007499558,"about_ca_system_score_gemma":0.0023553183,"threshold_uncertainty_score":0.07582414},"labels":[],"label_agreement":null},{"id":"W2091118897","doi":"10.1145/1985441.1985481","title":"A tale of two browsers","year":2011,"lang":"en","type":"article","venue":"","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":23,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Waterloo","funders":"","keywords":"Artifact (error); Computer science; World Wide Web; Web browser; Open source; Base (topology); Space (punctuation); User space; Operating system; Software; The Internet","score_opus":0.03600055270816515,"score_gpt":0.24547841702242157,"score_spread":0.2094778643142564,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2091118897","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.33891633,0.010102515,0.23702815,0.12956204,0.0037976212,0.00041279712,0.0014224262,0.005583912,0.2731743],"genre_scores_gemma":[0.74463415,0.0028878737,0.103427276,0.014625446,0.0010046564,0.00029452503,0.0009563374,0.0028267729,0.12934297],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"observational","domain_scores_codex":[0.9961093,0.0017764586,0.00009706504,0.0008443817,0.0007236413,0.00044921692],"domain_scores_gemma":[0.9918041,0.0027657251,0.00040651063,0.0016165653,0.0014173537,0.0019896838],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0052951444,0.0006767868,0.0005101439,0.0041712206,0.0070284153,0.010759101,0.0014652726,0.002939201,0.01888189],"category_scores_gemma":[0.018840695,0.0009190321,0.00070805755,0.0030458244,0.009950807,0.02171516,0.00881988,0.004104443,0.0053426553],"study_design_candidate":"observational","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0005958184,0.00024387744,0.040034443,0.00028342762,0.0001244535,0.002026732,0.13948555,0.0010527853,0.00750736,0.44781566,0.12689397,0.23393603],"study_design_scores_gemma":[0.00005374163,0.00023838598,0.010262323,0.0005002788,0.000062643245,0.0027770004,0.05726436,0.0042994004,0.0020004616,0.16548136,0.7568566,0.000203507],"about_ca_topic_score_codex":0.008748117,"about_ca_topic_score_gemma":0.009344045,"teacher_disagreement_score":0.01888189,"about_ca_system_score_codex":0.0016517729,"about_ca_system_score_gemma":0.001731782,"threshold_uncertainty_score":0.0631662},"labels":[],"label_agreement":null},{"id":"W2092140407","doi":"10.1145/504216.504247","title":"Interaction design for Web-based, within-page collection making and management","year":2001,"lang":"en","type":"article","venue":"","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":9,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Toronto","funders":"","keywords":"Computer science; Copying; Heuristics; Web page; World Wide Web; Focus (optics); Task (project management); Process (computing); Information retrieval","score_opus":0.04310703156730382,"score_gpt":0.28666884295551537,"score_spread":0.24356181138821154,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2092140407","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.007995995,0.00021223254,0.9813436,0.0003722684,0.000023142824,0.00038643653,0.00003744462,0.0020267493,0.007602155],"genre_scores_gemma":[0.11778352,0.00021410735,0.87392974,0.00019346953,0.000028354241,0.0014652151,0.00017400032,0.00072931196,0.0054822247],"study_design_codex":"design_other","study_design_gemma":"not_applicable","domain_scores_codex":[0.9891263,0.0070602107,0.0007432531,0.00069102895,0.002055837,0.00032347126],"domain_scores_gemma":[0.98562163,0.009572438,0.0006140599,0.0019624925,0.0016843409,0.00054513913],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0100642955,0.0009756725,0.0006860047,0.0017036103,0.0021507393,0.0052196137,0.002645719,0.0019778467,0.007341735],"category_scores_gemma":[0.021087842,0.0012597074,0.00095150515,0.0011428054,0.0025210993,0.0057601538,0.003142972,0.0014999649,0.0024483022],"study_design_candidate":"not_applicable","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0007074681,0.000921055,0.0072642206,0.0028298504,0.00024312826,0.0022374147,0.044525936,0.029241404,0.05898326,0.31835398,0.020082192,0.5146101],"study_design_scores_gemma":[0.00042318826,0.0010366354,0.0053640124,0.0010781826,0.0004260313,0.0032543584,0.008059504,0.2636149,0.037641432,0.29840288,0.3803675,0.00033135398],"about_ca_topic_score_codex":0.0015248089,"about_ca_topic_score_gemma":0.002215033,"teacher_disagreement_score":0.0100642955,"about_ca_system_score_codex":0.0012930224,"about_ca_system_score_gemma":0.0016978192,"threshold_uncertainty_score":0.053225696},"labels":[],"label_agreement":null},{"id":"W2093990026","doi":"10.1145/1571941.1572135","title":"Term-based commercial intent analysis","year":2009,"lang":"en","type":"article","venue":"","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":20,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Waterloo","funders":"","keywords":"Computer science; Probabilistic logic; Term (time); Information retrieval; Work (physics); Query optimization; Query language; Statistical analysis; Database query; Data mining; Artificial intelligence; Statistics; Mathematics","score_opus":0.01639214201473977,"score_gpt":0.2603525579274163,"score_spread":0.24396041591267653,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2093990026","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.536915,0.0046784,0.44320872,0.0008289182,0.00013733031,0.00043741363,0.0022549808,0.0017739261,0.009765301],"genre_scores_gemma":[0.96061754,0.00059690047,0.034850452,0.00010884993,0.0002134858,0.000093847746,0.0016786107,0.000066931425,0.001773411],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9968064,0.00095316226,0.00023695569,0.00038445534,0.0013722475,0.00024678343],"domain_scores_gemma":[0.980082,0.01426654,0.0017114013,0.000969738,0.002555803,0.00041462504],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0045947335,0.001055819,0.0012665053,0.009549319,0.0005642887,0.0019626925,0.0011040631,0.0010279494,0.0021338663],"category_scores_gemma":[0.019125383,0.0002542039,0.0012531232,0.005182591,0.0006233345,0.0031150484,0.00086149113,0.0013612573,0.00103773],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0024517502,0.0016647411,0.26462066,0.001343171,0.0011368722,0.0010581929,0.0009629509,0.10617336,0.05123497,0.03363019,0.007892654,0.52783054],"study_design_scores_gemma":[0.000038984334,0.00045452188,0.056729116,0.00004503089,0.0003215665,0.0010296925,0.00018941797,0.91636413,0.007306351,0.015136246,0.002296039,0.00008902599],"about_ca_topic_score_codex":0.0035670397,"about_ca_topic_score_gemma":0.0026865157,"teacher_disagreement_score":0.009549319,"about_ca_system_score_codex":0.000732429,"about_ca_system_score_gemma":0.00069838605,"threshold_uncertainty_score":0.024299562},"labels":[],"label_agreement":null},{"id":"W2094060849","doi":"10.1016/j.datak.2010.03.007","title":"Ranking bias in deep web size estimation using capture recapture method","year":2010,"lang":"en","type":"article","venue":"Data & Knowledge Engineering","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":19,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Windsor","funders":"Natural Sciences and Engineering Research Council of Canada; State Key Laboratory of Novel Software Technology","keywords":"Ranking (information retrieval); Computer science; Estimation; Sampling (signal processing); Data mining; Process (computing); Matching (statistics); Mark and recapture; Rank (graph theory); Limit (mathematics); Statistics; Information retrieval; Mathematics","score_opus":0.04137654040511619,"score_gpt":0.3090537414834847,"score_spread":0.2676772010783685,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2094060849","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.12112279,0.00043932727,0.87661743,0.00018591573,0.000058894846,0.00003705051,0.0001817816,0.0005524368,0.000804336],"genre_scores_gemma":[0.8827783,0.00019595302,0.11281955,0.00023021144,0.00011076278,0.00010232664,0.0006749718,0.00015513922,0.002932728],"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9954774,0.0023979014,0.00016951055,0.0009810714,0.00062389224,0.00035040063],"domain_scores_gemma":[0.93984675,0.049281977,0.0029360321,0.0054532024,0.0020614092,0.00042060268],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.016332176,0.0006481474,0.0013342382,0.0026301013,0.0007127601,0.0013767312,0.0034134812,0.0017189778,0.0013951575],"category_scores_gemma":[0.046589427,0.0008022934,0.0011061846,0.0019508564,0.0011135978,0.002739721,0.0014044784,0.001309363,0.00046845264],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00049397536,0.0002090281,0.15134063,0.0003782659,0.0013050429,0.0005498679,0.00038657465,0.4513527,0.0070024063,0.06371681,0.006325785,0.3169389],"study_design_scores_gemma":[0.000016742431,0.00005036124,0.0109271,0.000018540773,0.00009993631,0.00012445166,0.000035843816,0.9651141,0.0026106953,0.020254418,0.00071280106,0.00003503654],"about_ca_topic_score_codex":0.004529726,"about_ca_topic_score_gemma":0.0051086154,"teacher_disagreement_score":0.016332176,"about_ca_system_score_codex":0.00093922764,"about_ca_system_score_gemma":0.0006469178,"threshold_uncertainty_score":0.086373866},"labels":[],"label_agreement":null},{"id":"W2094190061","doi":"10.1145/2534398","title":"Location- and Query-Aware Modeling of Browsing and Click Behavior in Sponsored Search","year":2014,"lang":"en","type":"article","venue":"ACM Transactions on Intelligent Systems and Technology","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":1,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Waterloo","funders":"","keywords":"Perplexity; Computer science; Information retrieval; Search engine; Selection (genetic algorithm); Quality (philosophy); Click-through rate; Web search query; Language model; World Wide Web; Machine learning; Artificial intelligence","score_opus":0.028719234723659545,"score_gpt":0.2720875666664144,"score_spread":0.24336833194275487,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2094190061","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.80589926,0.001581012,0.18789856,0.0008004737,0.000039178445,0.000073301155,0.00086016656,0.0005001439,0.0023479017],"genre_scores_gemma":[0.98875743,0.00046110476,0.008114911,0.0000470247,0.000033912314,0.000045634355,0.0003950991,0.000027637145,0.00211716],"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.99924904,0.0002983092,0.000043566273,0.00016286726,0.000119911005,0.00012616145],"domain_scores_gemma":[0.9959758,0.0029000733,0.0004744574,0.0002558405,0.00025290015,0.0001409533],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0024051012,0.0007149949,0.001040375,0.0010300885,0.00032134986,0.0012026494,0.001600414,0.0015040761,0.0008690063],"category_scores_gemma":[0.008466736,0.00078182336,0.000766349,0.0015803522,0.00081708253,0.0019070719,0.0007227003,0.0012800912,0.00045189477],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0002746146,0.0001483708,0.024312561,0.0000637388,0.000060439066,0.00017219703,0.0002654029,0.9451481,0.001941417,0.009134542,0.0007798393,0.017698914],"study_design_scores_gemma":[0.000006661104,0.000020898071,0.0017706016,0.000004189866,0.000008582237,0.000029620538,0.0000093165345,0.99605906,0.000119408345,0.0018610099,0.000103710925,0.000006877992],"about_ca_topic_score_codex":0.026590547,"about_ca_topic_score_gemma":0.02399438,"teacher_disagreement_score":0.026590547,"about_ca_system_score_codex":0.0013207601,"about_ca_system_score_gemma":0.0009924216,"threshold_uncertainty_score":0.052871585},"labels":[],"label_agreement":null},{"id":"W2096189179","doi":"10.1109/mic.2008.37","title":"Is HTML in a Race to the Bottom? A Large-Scale Survey and Analysis of Conformance to W3C Standards","year":2008,"lang":"en","type":"article","venue":"IEEE Internet Computing","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":12,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Alberta","funders":"","keywords":"Computer science; Web standards; World Wide Web; XHTML; Markup language; Web page; XML","score_opus":0.0251020429677193,"score_gpt":0.2961699298857022,"score_spread":0.2710678869179829,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2096189179","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":"reporting","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":"reporting","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.8701305,0.015868543,0.030723449,0.022641657,0.00037932873,0.00022958114,0.0017802346,0.0008733389,0.05737337],"genre_scores_gemma":[0.9636922,0.009712726,0.011252614,0.004668239,0.00026359834,0.00007597071,0.0034644709,0.0007514713,0.006118704],"study_design_codex":"design_other","study_design_gemma":"observational","domain_scores_codex":[0.9797691,0.005445264,0.0016581304,0.0015431248,0.0107967425,0.0007875079],"domain_scores_gemma":[0.8798553,0.058549035,0.017109988,0.0102933,0.032124627,0.002067714],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.016950035,0.00018838925,0.00034513883,0.004482159,0.00095592765,0.004984147,0.0008292975,0.0008259904,0.002133107],"category_scores_gemma":[0.07957116,0.00035273875,0.00034657132,0.009461572,0.0021106368,0.0073898085,0.0014969327,0.0019407176,0.0008884498],"study_design_candidate":"observational","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00025622905,0.00024104881,0.4241357,0.0008562038,0.00012936801,0.00030865532,0.022003675,0.0006162304,0.003319307,0.023299655,0.026472664,0.4983612],"study_design_scores_gemma":[0.000019757668,0.00037460675,0.613426,0.0017096605,0.00016445947,0.001430373,0.03890367,0.0035471183,0.0054441094,0.016120594,0.3187506,0.00010914463],"about_ca_topic_score_codex":0.007487867,"about_ca_topic_score_gemma":0.004747914,"teacher_disagreement_score":0.98305,"about_ca_system_score_codex":0.0012474153,"about_ca_system_score_gemma":0.0017252176,"threshold_uncertainty_score":0.08964145},"labels":[],"label_agreement":null},{"id":"W2096442483","doi":"10.1145/967900.968042","title":"Simplified access to structured databases by adapting keyword search and database selection","year":2004,"lang":"en","type":"article","venue":"","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":6,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Calgary","funders":"","keywords":"Computer science; Database; Information retrieval; Intranet; Relational database; Information schema; The Internet; Selection (genetic algorithm); View; Database testing; Semi-structured data; World Wide Web; Database model; Database design","score_opus":0.05385984744687429,"score_gpt":0.3255884238805828,"score_spread":0.2717285764337085,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2096442483","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.01445742,0.00051934144,0.9740407,0.00012845974,0.000032517488,0.00021110423,0.0002449457,0.008438321,0.0019271781],"genre_scores_gemma":[0.14991201,0.000715806,0.84425616,0.00017667032,0.00012625661,0.00024269547,0.001029372,0.00083165785,0.0027093117],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9948775,0.0017577133,0.00059235335,0.0007044817,0.001853193,0.00021467515],"domain_scores_gemma":[0.9818272,0.009834773,0.00089393003,0.005216727,0.0018791521,0.00034823464],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0040290304,0.00092829816,0.001582266,0.004504658,0.00064681517,0.0022775473,0.0021375439,0.0008460508,0.004416992],"category_scores_gemma":[0.022169523,0.0006851302,0.0010767494,0.0051851086,0.00075941184,0.005902932,0.0032153593,0.00078847253,0.0029813899],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0009955602,0.00034643474,0.004379241,0.0006903236,0.0002133125,0.0005212889,0.0011726427,0.015769275,0.055334646,0.020864291,0.008087393,0.8916255],"study_design_scores_gemma":[0.00058619987,0.0012128443,0.0066754106,0.0002878282,0.0005584246,0.0041101566,0.0016888378,0.6280338,0.13002457,0.103249826,0.12294659,0.00062552467],"about_ca_topic_score_codex":0.0020957522,"about_ca_topic_score_gemma":0.0033599283,"teacher_disagreement_score":0.004504658,"about_ca_system_score_codex":0.00046529513,"about_ca_system_score_gemma":0.0009877237,"threshold_uncertainty_score":0.021307826},"labels":[],"label_agreement":null},{"id":"W2096780831","doi":"10.11575/prism/30667","title":"CONTRASTING STACK-BASED AND RECENCY-BASED BACK BUTTONS ON WEB BROWSERS","year":2000,"lang":"en","type":"article","venue":"PRISM (University of Calgary)","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":5,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Calgary","funders":"Natural Sciences and Engineering Research Council of Canada","keywords":"Stack (abstract data type); Computer science; World Wide Web; Information retrieval; Web page; Artificial intelligence; Operating system","score_opus":0.010750978740578176,"score_gpt":0.1855882193692906,"score_spread":0.17483724062871242,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2096780831","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.98443675,0.00035994186,0.008033182,0.00020521804,0.000020277406,0.00009220493,0.0000659801,0.00026788563,0.006518542],"genre_scores_gemma":[0.98763484,0.00022655637,0.010134484,0.00018686365,0.000022963817,0.00007254773,0.00009730212,0.00014444249,0.0014801013],"study_design_codex":"design_other","study_design_gemma":"observational","domain_scores_codex":[0.99420565,0.00307586,0.0004112795,0.000525506,0.001401801,0.000379864],"domain_scores_gemma":[0.95557284,0.03329454,0.0030544633,0.0034942115,0.0035865875,0.0009973346],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.007993184,0.00066495436,0.000540381,0.0014702687,0.0007297363,0.0033722762,0.000760866,0.0013616678,0.0016231202],"category_scores_gemma":[0.05138573,0.0007186592,0.0006404073,0.0006752325,0.001567188,0.005558158,0.0018890791,0.0012671901,0.0004537284],"study_design_candidate":"observational","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.014973926,0.0023126716,0.34421906,0.0016367433,0.00072860543,0.0010997156,0.108086355,0.0097213285,0.0876278,0.019773154,0.004661801,0.40515876],"study_design_scores_gemma":[0.0012500766,0.0076964647,0.7331801,0.001174714,0.0019327363,0.0019172968,0.044757124,0.09136238,0.062822215,0.024322925,0.028349264,0.0012348236],"about_ca_topic_score_codex":0.00791624,"about_ca_topic_score_gemma":0.013019001,"teacher_disagreement_score":0.007993184,"about_ca_system_score_codex":0.0011085368,"about_ca_system_score_gemma":0.0005739995,"threshold_uncertainty_score":0.04227245},"labels":[],"label_agreement":null},{"id":"W2096887009","doi":"10.1109/wiiat.2008.86","title":"Enabling Social Navigation on the Web","year":2008,"lang":"en","type":"article","venue":"","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":3,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Toronto","funders":"","keywords":"World Wide Web; Computer science; Session (web analytics); Web navigation; Web browser; Web page; The Internet","score_opus":0.045148200973839994,"score_gpt":0.2507546830585836,"score_spread":0.20560648208474364,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2096887009","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.25950783,0.0015178312,0.6268395,0.0018080749,0.00031260075,0.00082924217,0.0005225735,0.051859677,0.056802757],"genre_scores_gemma":[0.76694506,0.0006161876,0.2185643,0.0004273237,0.00019267117,0.0003396597,0.00068592635,0.0007992138,0.011429768],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9988738,0.0004932624,0.000065245986,0.00015401344,0.00029930263,0.000114351715],"domain_scores_gemma":[0.9960204,0.001871819,0.00025335205,0.0010331445,0.00042105006,0.00040031254],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0015027692,0.0005954465,0.00058979314,0.00089425815,0.0013174163,0.0024535882,0.00087445637,0.0014275046,0.0038951908],"category_scores_gemma":[0.0071673235,0.0004267254,0.00042502925,0.0006401089,0.00054333446,0.0044859033,0.004955208,0.0009738712,0.002107285],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00088157615,0.0012804259,0.028759006,0.0007798163,0.00015144108,0.0015716978,0.005773848,0.0065166852,0.07375707,0.03915898,0.03674259,0.8046269],"study_design_scores_gemma":[0.00032792095,0.0009934062,0.021578541,0.00064106775,0.00038833843,0.0049001356,0.0037129817,0.34398347,0.06770675,0.12793165,0.42736572,0.0004699357],"about_ca_topic_score_codex":0.0014833516,"about_ca_topic_score_gemma":0.002477972,"teacher_disagreement_score":0.0038951908,"about_ca_system_score_codex":0.00024293225,"about_ca_system_score_gemma":0.0005880974,"threshold_uncertainty_score":0.013030708},"labels":[],"label_agreement":null},{"id":"W2097918264","doi":"10.21083/partnership.v10i1.3328","title":"White Hat Search Engine Optimization (SEO): Structured Web Data for Libraries","year":2015,"lang":"en","type":"article","venue":"Partnership The Canadian Journal of Library and Information Practice and Research","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":13,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":true,"route_about_ca":true,"ca_institutions":"Laurentian University","funders":"","keywords":"Search engine optimization; Search engine; Spamdexing; Search analytics; World Wide Web; Computer science; Web search engine; Web page; Information retrieval; Organic search; Web search query","score_opus":0.1311707516220742,"score_gpt":0.34388093265251046,"score_spread":0.21271018103043626,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2097918264","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.06493645,0.002695804,0.86357313,0.008343621,0.00027155876,0.0008691952,0.020668555,0.012193933,0.02644774],"genre_scores_gemma":[0.24896194,0.0020220252,0.7099375,0.0007693583,0.00021111922,0.00060886354,0.02858825,0.0013418781,0.0075591006],"study_design_codex":"design_other","study_design_gemma":"not_applicable","domain_scores_codex":[0.99662423,0.0014190107,0.00032568563,0.00034913968,0.0011551502,0.00012685373],"domain_scores_gemma":[0.98844403,0.006740277,0.00073270587,0.002318009,0.0014772242,0.00028773435],"candidate_categories":["scholarly_communication"],"consensus_categories":[],"category_scores_codex":[0.004690525,0.0006308501,0.00087324326,0.004073516,0.0011208149,0.0044073607,0.0013984498,0.0010820414,0.00465042],"category_scores_gemma":[0.027917348,0.00053282676,0.0009667221,0.008842126,0.0010476251,0.005489363,0.0024867377,0.0014735829,0.002459035],"study_design_candidate":"not_applicable","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00081230036,0.00065585016,0.018965432,0.0017519562,0.00023740162,0.000414176,0.0016049899,0.0907627,0.004938651,0.15232189,0.118581116,0.60895354],"study_design_scores_gemma":[0.00015821698,0.00029001842,0.00613032,0.00054566015,0.00010361587,0.0003655859,0.001708314,0.609539,0.017542357,0.22212774,0.1413316,0.0001576254],"about_ca_topic_score_codex":0.00866347,"about_ca_topic_score_gemma":0.015705235,"teacher_disagreement_score":0.99559265,"about_ca_system_score_codex":0.0012757108,"about_ca_system_score_gemma":0.004353033,"threshold_uncertainty_score":0.024806201},"labels":[],"label_agreement":null},{"id":"W2098019961","doi":"10.1109/ideas.2004.1","title":"A gateway from HTML to XML","year":2004,"lang":"en","type":"article","venue":"International Database Engineering and Applications Symposium","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":1,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Carleton University","funders":"","keywords":"Computer science; XML; Efficient XML Interchange; World Wide Web; Document Structure Description; Streaming XML; XML Schema Editor; Information retrieval; XML validation; Database","score_opus":0.0056051551398095785,"score_gpt":0.21754439570136172,"score_spread":0.21193924056155214,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2098019961","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0031784456,0.0012623981,0.7921913,0.0017413951,0.00088653836,0.0011362033,0.006521908,0.13965194,0.053429883],"genre_scores_gemma":[0.027634475,0.00419103,0.8096447,0.004183638,0.0008386228,0.0016238373,0.036405735,0.036462307,0.079015665],"study_design_codex":"design_other","study_design_gemma":"not_applicable","domain_scores_codex":[0.9972139,0.00050993223,0.0005625353,0.00036334858,0.0011406549,0.00020970352],"domain_scores_gemma":[0.9961367,0.0009722782,0.00017227494,0.0014893414,0.00082494103,0.00040434857],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0037230914,0.0012128795,0.0011812167,0.002998798,0.0010208163,0.0074175475,0.003333626,0.0033241513,0.028818272],"category_scores_gemma":[0.007872523,0.0017626197,0.0013293574,0.0030741347,0.0013544507,0.006839572,0.006197426,0.0050978153,0.041831754],"study_design_candidate":"not_applicable","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00050241203,0.0005273452,0.0011905041,0.0013454974,0.000096399286,0.0019654853,0.0024714193,0.0028158303,0.031327885,0.2112992,0.2851357,0.46132234],"study_design_scores_gemma":[0.00009272552,0.0000840159,0.0007436957,0.00045665217,0.00003075424,0.0007586039,0.00026207152,0.009473777,0.0145054925,0.06051014,0.9129936,0.00008850808],"about_ca_topic_score_codex":0.000904155,"about_ca_topic_score_gemma":0.0005534993,"teacher_disagreement_score":0.028818272,"about_ca_system_score_codex":0.0007234642,"about_ca_system_score_gemma":0.0012581107,"threshold_uncertainty_score":0.09640676},"labels":[],"label_agreement":null},{"id":"W2098181468","doi":"10.1109/hicss.2005.114","title":"Automatic Identification of Home Pages on the Web","year":2005,"lang":"en","type":"article","venue":"","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":68,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Dalhousie University","funders":"","keywords":"Identification (biology); Computer science; World Wide Web; Web page; Biology","score_opus":0.019447005480412696,"score_gpt":0.2397336240570869,"score_spread":0.2202866185766742,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2098181468","genre_codex":"empirical","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.89942676,0.0021689073,0.061909236,0.00023466961,0.0001471911,0.0003533649,0.005381771,0.0061322,0.024245873],"genre_scores_gemma":[0.906306,0.0007988726,0.07426788,0.000076764016,0.000090633606,0.000087602,0.008886081,0.00028411506,0.009202112],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.99961406,0.00008116393,0.000025125437,0.00008516265,0.0001440765,0.000050384104],"domain_scores_gemma":[0.99843186,0.00049219595,0.00019275029,0.0002079458,0.0005756733,0.0000995697],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.00042424694,0.0002948503,0.0004404297,0.0055125435,0.00045276622,0.0013574085,0.00034728835,0.0005282444,0.00202577],"category_scores_gemma":[0.0021175565,0.00018826518,0.0002953387,0.0018492849,0.00022504826,0.0012069115,0.0005619791,0.00043602503,0.0017283066],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0007962265,0.00041967412,0.17369355,0.00058913964,0.00012890543,0.0018332037,0.0011353068,0.003187215,0.048115123,0.003842104,0.028110009,0.7381495],"study_design_scores_gemma":[0.000065664906,0.00025056335,0.5271004,0.0002973563,0.00023964689,0.0045565073,0.0027570724,0.32210654,0.08394375,0.011691249,0.046875402,0.00011586307],"about_ca_topic_score_codex":0.0029650242,"about_ca_topic_score_gemma":0.005142911,"teacher_disagreement_score":0.0055125435,"about_ca_system_score_codex":0.00024821423,"about_ca_system_score_gemma":0.00029267304,"threshold_uncertainty_score":0.006776929},"labels":[],"label_agreement":null},{"id":"W2100703320","doi":"10.1109/wi.2007.132","title":"Enhancing Search Engine Quality Using Concept-based Text Retrieval","year":2007,"lang":"en","type":"article","venue":"","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":22,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Waterloo","funders":"","keywords":"Sentence; Computer science; Natural language processing; Phrase; Representation (politics); Semantics (computer science); Term (time); Artificial intelligence; Text graph; Search engine indexing; Information retrieval; Text mining","score_opus":0.057475500790977636,"score_gpt":0.35115404258612953,"score_spread":0.2936785417951519,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2100703320","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.20717393,0.013297966,0.75477695,0.00087422685,0.0003070798,0.0011295333,0.0016532516,0.010980215,0.0098068705],"genre_scores_gemma":[0.543032,0.0028152517,0.44759983,0.00033786776,0.00018545026,0.00028016366,0.0027792815,0.00029128714,0.0026788334],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.99813604,0.00035417,0.00014327746,0.00021422558,0.0010627426,0.00008949476],"domain_scores_gemma":[0.9974975,0.0011690342,0.00027545067,0.000226974,0.0007785735,0.000052400945],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0019661644,0.0010543363,0.0018430918,0.006656141,0.00042955272,0.0016241124,0.001421715,0.0010748253,0.0017209657],"category_scores_gemma":[0.00799949,0.00021233008,0.0009190956,0.00561361,0.00046144263,0.004613013,0.0009775171,0.00067787705,0.0008825362],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0009262312,0.0005433239,0.0018762616,0.0020251258,0.00022796859,0.00041909693,0.00054739363,0.036127437,0.08639862,0.010053953,0.011689247,0.8491653],"study_design_scores_gemma":[0.00032201942,0.0008930574,0.0050783902,0.00015718935,0.00039206806,0.00095546106,0.00055745395,0.90811276,0.054731518,0.015049492,0.013563997,0.00018662427],"about_ca_topic_score_codex":0.0039357995,"about_ca_topic_score_gemma":0.0030266494,"teacher_disagreement_score":0.006656141,"about_ca_system_score_codex":0.0009837666,"about_ca_system_score_gemma":0.0009660168,"threshold_uncertainty_score":0.010398209},"labels":[],"label_agreement":null},{"id":"W2100860222","doi":"10.7202/012247ar","title":"Variations morphologiques, syntaxiques, sémantiques et Repérage d’Information sur le Web","year":2006,"lang":"fr","type":"article","venue":"Revue québécoise de linguistique","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":1,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":true,"route_about_ca":false,"ca_institutions":"Université du Québec à Montréal","funders":"","keywords":"Humanities; Philosophy; Physics","score_opus":0.01461364815665919,"score_gpt":0.24804509429751276,"score_spread":0.23343144614085357,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2100860222","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.46359703,0.0071900575,0.46849045,0.0038774267,0.00023293954,0.00016584671,0.0026444588,0.00200008,0.051801678],"genre_scores_gemma":[0.8040976,0.0032167193,0.1802071,0.00034971896,0.000102313636,0.0001402411,0.0020744118,0.00078775175,0.009024245],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.99521095,0.0015523965,0.00048953487,0.00075369334,0.0018323188,0.00016112124],"domain_scores_gemma":[0.9886176,0.007295666,0.00081143936,0.0014083774,0.0017566078,0.00011033716],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0031249123,0.00053848175,0.00058096735,0.004166054,0.0011802674,0.005176107,0.0006149556,0.00097207975,0.0033701134],"category_scores_gemma":[0.012863669,0.0004403371,0.0008130958,0.00584312,0.0026934517,0.006015701,0.0015371273,0.0014541293,0.0009825793],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00054223405,0.0001489617,0.0393915,0.002423311,0.00032124724,0.0028415557,0.032984037,0.005426419,0.099076316,0.23165047,0.007151182,0.5780428],"study_design_scores_gemma":[0.0000877927,0.00035171158,0.122659855,0.0013435942,0.00094255264,0.012435586,0.032419868,0.06571218,0.16436446,0.22158258,0.377608,0.00049178046],"about_ca_topic_score_codex":0.0059498735,"about_ca_topic_score_gemma":0.006034466,"teacher_disagreement_score":0.0059498735,"about_ca_system_score_codex":0.0016549667,"about_ca_system_score_gemma":0.0010434884,"threshold_uncertainty_score":0.016526282},"labels":[],"label_agreement":null},{"id":"W2101307329","doi":"10.1109/hicss.2003.1174245","title":"PDA access to Internet content: focus on forms","year":2003,"lang":"en","type":"article","venue":"","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":8,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Dalhousie University","funders":"","keywords":"Computer science; World Wide Web; Focus (optics); Transformation (genetics); Context (archaeology); Web page; The Internet; Mobile device; Web content; Web modeling; Task (project management); Multimedia; Perspective (graphical); Human–computer interaction; Engineering; Artificial intelligence","score_opus":0.06850360008790213,"score_gpt":0.2866914342036892,"score_spread":0.21818783411578707,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2101307329","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.13931133,0.0017047233,0.76262534,0.0013831244,0.00021945189,0.0008306296,0.0016855409,0.01486916,0.077370785],"genre_scores_gemma":[0.43722785,0.0027498626,0.49934277,0.0005186362,0.00017395776,0.0004901253,0.0037793436,0.0035409543,0.05217646],"study_design_codex":"design_other","study_design_gemma":"not_applicable","domain_scores_codex":[0.9990846,0.00014366428,0.000059612554,0.0003066519,0.00032391425,0.00008143021],"domain_scores_gemma":[0.99794203,0.000797713,0.00011665586,0.0006514582,0.0003738246,0.000118241194],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.00055772456,0.000850725,0.000915527,0.002018601,0.0009807294,0.0039176363,0.00093137944,0.0008698977,0.011871213],"category_scores_gemma":[0.004799545,0.0005359238,0.0010762495,0.0027570652,0.0016201957,0.0039047454,0.0021213344,0.0010802612,0.009275438],"study_design_candidate":"not_applicable","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00035897648,0.00017058357,0.008755232,0.00037165315,0.000019594196,0.0005149687,0.0015701825,0.0025543007,0.033256803,0.010955241,0.012428401,0.929044],"study_design_scores_gemma":[0.00012439543,0.00055449945,0.03914897,0.00038939455,0.00022377624,0.005277754,0.0051196543,0.17976744,0.16825464,0.063999586,0.53697497,0.00016485692],"about_ca_topic_score_codex":0.0026551345,"about_ca_topic_score_gemma":0.0027378844,"teacher_disagreement_score":0.011871213,"about_ca_system_score_codex":0.0006292252,"about_ca_system_score_gemma":0.00076618034,"threshold_uncertainty_score":0.039713204},"labels":[],"label_agreement":null},{"id":"W2102861482","doi":"","title":"York University at TREC 2008: Blog Track","year":2008,"lang":"en","type":"article","venue":"","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":2,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"York University","funders":"","keywords":"Relevance (law); Computer science; Strengths and weaknesses; Information retrieval; Track (disk drive); Function (biology); Sentiment analysis; Microblogging; Compass; Artificial intelligence; Social media; World Wide Web; Psychology; Political science; Geography; Cartography","score_opus":0.026599648985917643,"score_gpt":0.18965851836352665,"score_spread":0.163058869377609,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2102861482","genre_codex":"empirical","genre_gemma":"other","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"other","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.4456785,0.0042744465,0.025234755,0.01407506,0.011632394,0.008216567,0.21173961,0.03793183,0.2412169],"genre_scores_gemma":[0.28942692,0.0012340811,0.049474403,0.0019357279,0.0010572723,0.0043411804,0.3234489,0.002352053,0.32672954],"study_design_codex":"not_applicable","study_design_gemma":"not_applicable","domain_scores_codex":[0.9967949,0.00096119463,0.00021169103,0.00039704127,0.0012481574,0.00038697355],"domain_scores_gemma":[0.98855954,0.0022359998,0.00027520515,0.0013462631,0.006131175,0.0014518325],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.007895125,0.0014275719,0.0013684519,0.0017127695,0.0032920795,0.0028914844,0.0011349358,0.0015682941,0.026062133],"category_scores_gemma":[0.010165867,0.00067159877,0.0003495049,0.0019734353,0.00058565685,0.0026584957,0.0012314598,0.0027224272,0.016249806],"study_design_candidate":"not_applicable","study_design_consensus":"not_applicable","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0011851274,0.0013546939,0.003260178,0.00032906426,0.00005462773,0.00010425393,0.00023805362,0.0011228616,0.011229624,0.0009555203,0.92141294,0.05875302],"study_design_scores_gemma":[0.0028248248,0.0030685093,0.06199532,0.0001716014,0.0002445385,0.00029957326,0.0010288388,0.039540716,0.05543976,0.0018510836,0.83303744,0.00049785146],"about_ca_topic_score_codex":0.09899355,"about_ca_topic_score_gemma":0.22371249,"teacher_disagreement_score":0.09899355,"about_ca_system_score_codex":0.003547368,"about_ca_system_score_gemma":0.004400025,"threshold_uncertainty_score":0.19683468},"labels":[],"label_agreement":null},{"id":"W2106629558","doi":"10.1007/11795018_24","title":"A Model for Interactive Web Information Retrieval","year":2006,"lang":"en","type":"book-chapter","venue":"Lecture notes in computer science","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":2,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Regina","funders":"","keywords":"Computer science; Information retrieval; World Wide Web; Search engine; Web page; Web search engine; Web navigation; Human–computer information retrieval; Visualization; Data mining","score_opus":0.018116103017700103,"score_gpt":0.2503018270429477,"score_spread":0.23218572402524756,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2106629558","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0071663377,0.00036165706,0.9764133,0.0007368192,0.000076059805,0.00012326373,0.00059133704,0.0017974295,0.01273388],"genre_scores_gemma":[0.40869123,0.0012535666,0.5338006,0.000739823,0.00032733192,0.001099536,0.002218102,0.0010810909,0.05078875],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.9985598,0.00042084392,0.000099586054,0.00029877684,0.00043974599,0.00018125362],"domain_scores_gemma":[0.9975114,0.0013967471,0.00011009803,0.00047292124,0.00038328543,0.00012556993],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0016319606,0.0008059012,0.0010376475,0.0017179562,0.0011664912,0.003857604,0.0036813866,0.002787363,0.018767413],"category_scores_gemma":[0.007878149,0.0007189929,0.0017060798,0.002133517,0.001464621,0.007939718,0.0020765935,0.0020418998,0.00604468],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00029830405,0.00022604913,0.0008478431,0.00025314372,0.000086381006,0.0003976595,0.0007198867,0.1316527,0.0036721835,0.7617604,0.014969989,0.08511553],"study_design_scores_gemma":[0.00004282723,0.00004519645,0.000107987245,0.000023891063,0.000050013696,0.00016858258,0.00005312995,0.68226594,0.00087430637,0.30651602,0.009824927,0.000027088236],"about_ca_topic_score_codex":0.0075196535,"about_ca_topic_score_gemma":0.0051622307,"teacher_disagreement_score":0.018767413,"about_ca_system_score_codex":0.001984979,"about_ca_system_score_gemma":0.0014117393,"threshold_uncertainty_score":0.06278324},"labels":[],"label_agreement":null},{"id":"W2106700114","doi":"10.1007/s10618-012-0257-y","title":"Guest editorial: special issue on a decade of mining the Web","year":2012,"lang":"en","type":"editorial","venue":"Data Mining and Knowledge Discovery","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":5,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Alberta","funders":"","keywords":"Web mining; World Wide Web; Computer science; Data science; Domain (mathematical analysis); Web intelligence; Web development; The Internet; Web page","score_opus":0.02640097352747741,"score_gpt":0.29970399963040983,"score_spread":0.27330302610293244,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2106700114","genre_codex":"editorial","genre_gemma":"editorial","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"editorial","genre_consensus":"editorial","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.000027486307,0.005134751,0.00012208176,0.024627257,0.969138,0.0000116946885,0.00004997384,0.000042606596,0.0008461766],"genre_scores_gemma":[0.0002774598,0.0036413192,0.00011744154,0.0092667155,0.9809971,0.000014510774,0.000037112914,0.00003867278,0.0056096283],"study_design_codex":"not_applicable","study_design_gemma":"not_applicable","domain_scores_codex":[0.993512,0.0010367059,0.0007581705,0.0008912482,0.003322983,0.00047884823],"domain_scores_gemma":[0.96270037,0.011951606,0.0028115555,0.0009171404,0.016112903,0.0055063646],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.007987171,0.0036990882,0.004478125,0.0067825974,0.0030681111,0.010900081,0.003323148,0.010650857,0.017602824],"category_scores_gemma":[0.030964632,0.0013121819,0.0027092448,0.0027588804,0.002650972,0.0047526257,0.001847062,0.016115746,0.012180073],"study_design_candidate":"not_applicable","study_design_consensus":"not_applicable","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.000031312393,0.000011342426,0.000027162994,0.00016512083,0.000018737184,0.00007309381,0.0000070744995,0.000010104675,0.00004584702,0.00013875517,0.99598336,0.0034879688],"study_design_scores_gemma":[0.000057025933,0.000036336525,0.00036344465,0.00045660397,0.00008241004,0.00031800385,0.00004905686,0.00015328391,0.00017447122,0.00091642555,0.99737203,0.000020794972],"about_ca_topic_score_codex":0.0011204296,"about_ca_topic_score_gemma":0.0040338533,"teacher_disagreement_score":0.017602824,"about_ca_system_score_codex":0.0025259855,"about_ca_system_score_gemma":0.0030916857,"threshold_uncertainty_score":0.058887362},"labels":[],"label_agreement":null},{"id":"W2107131706","doi":"10.1109/icdm.2006.64","title":"Enhancing Text Clustering Using Concept-based Mining Model","year":2006,"lang":"en","type":"article","venue":"Proceedings","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":61,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Waterloo","funders":"","keywords":"Computer science; Cluster analysis; Phrase; Sentence; Document clustering; Term (time); Semantics (computer science); Similarity (geometry); Natural language processing; Matching (statistics); Artificial intelligence; Similarity measure; Measure (data warehouse); Word (group theory); Information retrieval; Data mining; Mathematics; Image (mathematics)","score_opus":0.02220185227204753,"score_gpt":0.24525524873387258,"score_spread":0.22305339646182504,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2107131706","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.017942254,0.00025489213,0.97928417,0.0001721745,0.000043985736,0.0001875405,0.00009928611,0.0008893226,0.0011263888],"genre_scores_gemma":[0.11771674,0.00031740466,0.88001275,0.00011653725,0.00006641315,0.0003179471,0.00041129524,0.00007115544,0.0009696566],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9981452,0.00046579714,0.000121793404,0.0003266412,0.0008691802,0.00007133373],"domain_scores_gemma":[0.9959488,0.0020421715,0.00024810692,0.0003281452,0.0013672612,0.0000654908],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0025436734,0.0009222404,0.0015223896,0.003132153,0.000723102,0.0014662176,0.0018876618,0.0012459998,0.0011240055],"category_scores_gemma":[0.009291006,0.00037175117,0.0011657542,0.0036640482,0.0005518639,0.00331083,0.0010964596,0.000997918,0.0008760668],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00038242244,0.0008514712,0.0040255957,0.0007997977,0.00038225108,0.00039632374,0.0008550308,0.19519831,0.033622947,0.026019707,0.0073410054,0.7301251],"study_design_scores_gemma":[0.00003807523,0.000099085395,0.00058618636,0.00002483846,0.00007191855,0.0002761485,0.00010914352,0.97187096,0.010345353,0.012964625,0.0035748899,0.00003877798],"about_ca_topic_score_codex":0.0020670197,"about_ca_topic_score_gemma":0.0021520876,"teacher_disagreement_score":0.003132153,"about_ca_system_score_codex":0.0008505969,"about_ca_system_score_gemma":0.0012513257,"threshold_uncertainty_score":0.013452411},"labels":[],"label_agreement":null},{"id":"W2107212069","doi":"10.1109/fuzzy.2007.4295422","title":"Adaptive hyperlinks using page access sequences and minimum spanning trees","year":2007,"lang":"en","type":"article","venue":"Proceedings of ... IEEE International Conference on Fuzzy Systems","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":2,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Saint Mary's University","funders":"","keywords":"Hyperlink; Computer science; Spanning tree; Minimum spanning tree; Web page; Computer network; World Wide Web; Combinatorics; Mathematics; Algorithm","score_opus":0.12824196688662032,"score_gpt":0.3407101067631872,"score_spread":0.21246813987656687,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2107212069","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.070525214,0.00038801297,0.92654514,0.000098381344,0.000022470811,0.000078462705,0.000110066874,0.0005761089,0.0016561094],"genre_scores_gemma":[0.7333029,0.0004697828,0.2641268,0.000033682274,0.000054785618,0.00012781248,0.0003123353,0.000098020966,0.0014738137],"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.99879324,0.00041076652,0.00008335206,0.00028017614,0.00036733574,0.00006517195],"domain_scores_gemma":[0.99585766,0.0024249724,0.00069333124,0.00033118788,0.00053147937,0.00016144643],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0012054686,0.0005094087,0.0008586694,0.004373821,0.00062569365,0.0012745733,0.0009750484,0.0009429667,0.0009821688],"category_scores_gemma":[0.010770876,0.0005279321,0.0009222404,0.0030412872,0.00085448887,0.003337286,0.00085506635,0.0005189419,0.0003178589],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00019187936,0.00015952143,0.0067247814,0.00023926936,0.00017223557,0.00020229444,0.0005327101,0.7010639,0.006515877,0.05028557,0.0011055423,0.23280649],"study_design_scores_gemma":[0.000012496714,0.00006425371,0.0011643725,0.000016860648,0.000030977575,0.00010492749,0.000043553013,0.94790035,0.0012222371,0.048712146,0.000709059,0.000018722132],"about_ca_topic_score_codex":0.0025480848,"about_ca_topic_score_gemma":0.0023252778,"teacher_disagreement_score":0.004373821,"about_ca_system_score_codex":0.0006602574,"about_ca_system_score_gemma":0.0005022752,"threshold_uncertainty_score":0.006375253},"labels":[],"label_agreement":null},{"id":"W2107298418","doi":"10.1109/wcre.2000.891453","title":"Constructing XML-speaking wrappers for WEB applications: towards an interoperating WEB","year":2002,"lang":"en","type":"article","venue":"","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":25,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Alberta","funders":"Natural Sciences and Engineering Research Council of Canada","keywords":"Computer science; Interoperation; World Wide Web; XML; Efficient XML Interchange; Web service; XML Signature; SOAP; XML Schema Editor; Streaming XML; Database; XPath; XML validation; Information retrieval; Interoperability","score_opus":0.04085959662385039,"score_gpt":0.27664391297811153,"score_spread":0.23578431635426114,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2107298418","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.005836914,0.00026572472,0.9909667,0.0003144795,0.000039295188,0.00011862397,0.000028687024,0.0012800611,0.0011495489],"genre_scores_gemma":[0.023421409,0.000490321,0.97317797,0.0002010649,0.000021107833,0.0001304538,0.00021812423,0.0003692993,0.0019703263],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.99694127,0.0011854904,0.00038695033,0.0003217616,0.0008788226,0.0002856419],"domain_scores_gemma":[0.9977557,0.0006378772,0.00024613476,0.00081235083,0.00040301762,0.00014496477],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0065300954,0.000975225,0.0008448605,0.0013596079,0.0014515104,0.004799577,0.0019556445,0.00281784,0.0011469705],"category_scores_gemma":[0.0055107507,0.0013806387,0.0018561727,0.0021023003,0.0022599753,0.006495484,0.0032501782,0.0026629164,0.0016159205],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00021880485,0.0007303856,0.0059691668,0.0012589578,0.0002746429,0.004339138,0.0070823543,0.041418403,0.08531618,0.48505947,0.011088031,0.35724452],"study_design_scores_gemma":[0.00009189143,0.00025987247,0.0019392949,0.00058142457,0.00032351568,0.0026796667,0.0017637924,0.22497968,0.19284327,0.23956634,0.3347534,0.00021788571],"about_ca_topic_score_codex":0.0010459477,"about_ca_topic_score_gemma":0.0010758671,"teacher_disagreement_score":0.0065300954,"about_ca_system_score_codex":0.0005453333,"about_ca_system_score_gemma":0.0015105853,"threshold_uncertainty_score":0.034534812},"labels":[],"label_agreement":null},{"id":"W2108394954","doi":"10.1109/cmv.2006.8","title":"Exploring Web Search Results Using Coordinated Views","year":2006,"lang":"en","type":"article","venue":"","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":8,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Regina","funders":"","keywords":"Search engine; Computer science; Information retrieval; Search analytics; Limiting; World Wide Web; Representation (politics); Metasearch engine; Web search engine; Semantic search; Window (computing); Web page; Web crawler; Web search query; Spamdexing; Engineering","score_opus":0.2811304343169525,"score_gpt":0.3125883100152188,"score_spread":0.0314578756982663,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2108394954","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.12089397,0.0029086627,0.8437914,0.0006180602,0.00006327182,0.00031940185,0.0026877462,0.016990576,0.01172701],"genre_scores_gemma":[0.4539259,0.0017666811,0.5360666,0.00014894982,0.00006269117,0.00033800668,0.0035394176,0.0012938542,0.0028578574],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9989851,0.00031953098,0.00007424307,0.00017597273,0.00035521225,0.00008998125],"domain_scores_gemma":[0.99632084,0.0022136744,0.00021701874,0.00047560863,0.00047662255,0.00029625144],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.001440272,0.0012209342,0.0013124608,0.0041457396,0.0004986533,0.004847233,0.00110572,0.00080873177,0.0044700434],"category_scores_gemma":[0.0066512153,0.00073849893,0.0012174451,0.0030929323,0.00052463333,0.004009143,0.003944901,0.0009081327,0.0013722928],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.003499682,0.00055018964,0.011185774,0.0019214662,0.00055057305,0.0017467982,0.008676971,0.074952096,0.08442888,0.037782867,0.03436004,0.74034464],"study_design_scores_gemma":[0.0005888591,0.0007304272,0.0073732026,0.00039581154,0.00047896217,0.0013129084,0.0048618815,0.7500923,0.06431009,0.08870922,0.080792196,0.00035414298],"about_ca_topic_score_codex":0.0029442066,"about_ca_topic_score_gemma":0.004547426,"teacher_disagreement_score":0.004847233,"about_ca_system_score_codex":0.0005210626,"about_ca_system_score_gemma":0.0007001638,"threshold_uncertainty_score":0.014953792},"labels":[],"label_agreement":null},{"id":"W2110780226","doi":"10.1145/1031453.1031458","title":"Probabilistic models for focused web crawling","year":2004,"lang":"en","type":"article","venue":"","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":36,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Dalhousie University","funders":"Mitacs","keywords":"CRFS; Crawling; Computer science; Conditional random field; Hidden Markov model; Web crawler; Probabilistic logic; Context (archaeology); Relevance (law); Artificial intelligence; Web page; Machine learning; Information retrieval; Data mining; World Wide Web","score_opus":0.038194723882322826,"score_gpt":0.2513862193380534,"score_spread":0.21319149545573057,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2110780226","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0056239935,0.00038305254,0.9906483,0.00019942979,0.00002721714,0.00006482,0.000469889,0.0015834415,0.0009999096],"genre_scores_gemma":[0.25361755,0.0017481685,0.7343921,0.00026132763,0.00023879911,0.00097202795,0.0030650385,0.0006217817,0.0050831996],"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.99797946,0.0007983723,0.00015879188,0.0004190495,0.0005387891,0.00010548867],"domain_scores_gemma":[0.9877757,0.009223141,0.0006189485,0.0012763925,0.0009460825,0.00015968416],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0034164914,0.00091185933,0.0013229941,0.0029191636,0.00083949516,0.002074781,0.002630862,0.0023953004,0.0035837132],"category_scores_gemma":[0.01888295,0.0013562203,0.0016223491,0.0027712688,0.0008107136,0.003769011,0.0011051702,0.0018018846,0.001767436],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00009509427,0.00011321894,0.0019155085,0.00018273908,0.00013455933,0.00022336855,0.0002498979,0.85001445,0.0012402195,0.065299824,0.006349663,0.074181505],"study_design_scores_gemma":[0.0000116088495,0.000008815004,0.00024317487,0.000010000814,0.00001461418,0.000047787988,0.000008449565,0.96411216,0.00019287123,0.033717755,0.0016166994,0.000016069438],"about_ca_topic_score_codex":0.011108453,"about_ca_topic_score_gemma":0.013995392,"teacher_disagreement_score":0.011108453,"about_ca_system_score_codex":0.0012947368,"about_ca_system_score_gemma":0.0013817187,"threshold_uncertainty_score":0.022087574},"labels":[],"label_agreement":null},{"id":"W2111543529","doi":"10.5752/p.2316-9451.2012v1n1p28","title":"Impact of template removal on Web search DOI 10.5752/P.2316-9451.2012v1n1p28","year":2012,"lang":"en","type":"article","venue":"Abakós","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Impact","funders":"","keywords":"Computer science; Template; Information retrieval; Scale (ratio); Web page; Quality (philosophy); Search engine; World Wide Web; Data mining","score_opus":0.040288329315889104,"score_gpt":0.32479127668564234,"score_spread":0.28450294736975323,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2111543529","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.78517824,0.008359916,0.16168392,0.0015403441,0.0007043804,0.0008064701,0.002582572,0.020777024,0.018367108],"genre_scores_gemma":[0.8067668,0.0017465099,0.17702347,0.00040824924,0.00023576761,0.000213069,0.0050149616,0.0019839418,0.00660723],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.986463,0.0037700227,0.0008912192,0.0014062491,0.0070223063,0.00044709112],"domain_scores_gemma":[0.8709659,0.09346382,0.0059822192,0.018349536,0.010072373,0.0011661013],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.006193087,0.0013509233,0.0015662779,0.0042172577,0.0015338222,0.0035000744,0.001586678,0.0015385374,0.0044621355],"category_scores_gemma":[0.08056315,0.0007162287,0.0012802491,0.005189538,0.0012574255,0.0036344684,0.0018199224,0.0014027375,0.0035066996],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0021396058,0.001118636,0.03773536,0.0010590428,0.00034605316,0.0007955022,0.00040885224,0.035151582,0.07258225,0.0012188622,0.010852843,0.8365915],"study_design_scores_gemma":[0.00017660725,0.003058142,0.12273945,0.000208828,0.00074410264,0.004119584,0.0010905676,0.5667082,0.27429888,0.0044417973,0.022093007,0.0003208774],"about_ca_topic_score_codex":0.008377335,"about_ca_topic_score_gemma":0.008830779,"teacher_disagreement_score":0.008377335,"about_ca_system_score_codex":0.0010712353,"about_ca_system_score_gemma":0.0017029236,"threshold_uncertainty_score":0.032752573},"labels":[],"label_agreement":null},{"id":"W2112518607","doi":"10.1145/1595836.1595838","title":"Towards efficient document content sharing in social networks","year":2009,"lang":"en","type":"article","venue":"","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":7,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Athabasca University","funders":"","keywords":"Computer science; Ranking (information retrieval); World Wide Web; Reuse; Annotation; Information retrieval; Context (archaeology); Architecture; Social network (sociolinguistics); Focus (optics); Digital library; Social media; Artificial intelligence","score_opus":0.03603403391786326,"score_gpt":0.2723809499562019,"score_spread":0.23634691603833863,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2112518607","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.06359341,0.0004560344,0.9290783,0.00056757836,0.000037453687,0.00044849093,0.0002945865,0.0024267696,0.0030973007],"genre_scores_gemma":[0.29809165,0.00037123743,0.69510883,0.00008994791,0.00007260651,0.00043764702,0.00088353944,0.00028538864,0.004659148],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9923609,0.0034021141,0.00047299647,0.0009441097,0.0023219262,0.00049794],"domain_scores_gemma":[0.9869201,0.005379674,0.0011058034,0.0038032485,0.0022713125,0.00051974895],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.006599665,0.0011520782,0.0023378269,0.005330974,0.0027636203,0.0044754897,0.002659583,0.0020593717,0.001691258],"category_scores_gemma":[0.020546364,0.0009206153,0.0011965586,0.0060746106,0.0015082095,0.008061126,0.005058203,0.0013494028,0.0013439199],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0005841096,0.00054178364,0.0061512953,0.00041356776,0.00018380002,0.00022299716,0.0019255803,0.12253668,0.021494687,0.08458766,0.010143791,0.751214],"study_design_scores_gemma":[0.000090520036,0.00013988258,0.0011693565,0.00004057111,0.00007180645,0.00016362043,0.0008352058,0.86783636,0.016806226,0.09924283,0.013548236,0.000055382356],"about_ca_topic_score_codex":0.00507017,"about_ca_topic_score_gemma":0.006138563,"teacher_disagreement_score":0.006599665,"about_ca_system_score_codex":0.0019046465,"about_ca_system_score_gemma":0.002693572,"threshold_uncertainty_score":0.03490275},"labels":[],"label_agreement":null},{"id":"W2115537376","doi":"10.1109/re.2011.6051638","title":"Logical structure extraction from software requirements documents","year":2011,"lang":"en","type":"article","venue":"","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":19,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Waterloo","funders":"","keywords":"Computer science; Traceability; Interoperability; Rendering (computer graphics); Software; Information retrieval; Data mining; Software engineering; Natural language processing; Artificial intelligence; Programming language; World Wide Web","score_opus":0.05706790301655199,"score_gpt":0.2844332931568394,"score_spread":0.22736539014028742,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2115537376","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.08055973,0.0011247712,0.86817884,0.0013374292,0.000108854954,0.0017418854,0.021632524,0.015281336,0.01003468],"genre_scores_gemma":[0.125926,0.0007178031,0.8252096,0.00018611072,0.000048284564,0.00078479946,0.04463151,0.00063649344,0.001859382],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9952016,0.00094970025,0.00085825566,0.0006239008,0.0021903182,0.00017631947],"domain_scores_gemma":[0.979187,0.011259725,0.002299343,0.0032094223,0.0038080115,0.0002364581],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0031926865,0.0011210333,0.0009966329,0.010821812,0.0010497966,0.0032810569,0.0014609208,0.0014170827,0.002693722],"category_scores_gemma":[0.027359093,0.0006943157,0.0016085942,0.005817546,0.0007446777,0.00313218,0.0019467237,0.0013755484,0.0029491715],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00041807265,0.00038390525,0.012655573,0.00338084,0.00017063643,0.0021327338,0.0021866537,0.019855864,0.06032643,0.025743926,0.03162208,0.8411233],"study_design_scores_gemma":[0.0003198849,0.0004631755,0.021335648,0.0010961461,0.0004402146,0.005541918,0.0037370916,0.35359257,0.27575344,0.07051709,0.266835,0.00036790426],"about_ca_topic_score_codex":0.0030256019,"about_ca_topic_score_gemma":0.0045162686,"teacher_disagreement_score":0.010821812,"about_ca_system_score_codex":0.0013253941,"about_ca_system_score_gemma":0.0033110392,"threshold_uncertainty_score":0.016884804},"labels":[],"label_agreement":null},{"id":"W2116567044","doi":"","title":"With Free Google Alert Services.","year":2005,"lang":"en","type":"article","venue":"Teacher librarian","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":0,"is_retracted":false,"has_abstract":false,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":true,"route_about_ca":false,"ca_institutions":"","funders":"","keywords":"World Wide Web; Internet privacy; Computer science","score_opus":0.009309253028738529,"score_gpt":0.19449710722414357,"score_spread":0.18518785419540504,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2116567044","genre_codex":"other","genre_gemma":"other","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"other","genre_consensus":"other","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0018078847,0.0016882368,0.0077364948,0.0037173547,0.0010654976,0.00043827717,0.062731564,0.13100772,0.7898069],"genre_scores_gemma":[0.01019962,0.0014702842,0.010111193,0.0016677751,0.0006281438,0.0003028951,0.058182515,0.012690747,0.9047467],"study_design_codex":"not_applicable","study_design_gemma":"not_applicable","domain_scores_codex":[0.99878114,0.00009783574,0.00007932431,0.00017265783,0.000645173,0.00022380496],"domain_scores_gemma":[0.99681926,0.0004955388,0.00015998057,0.0010710944,0.0008579926,0.00059623487],"candidate_categories":["insufficient_payload"],"consensus_categories":[],"category_scores_codex":[0.000901284,0.002223866,0.0022236905,0.009354891,0.00143737,0.006722731,0.00395993,0.0037423258,0.6997675],"category_scores_gemma":[0.0062531536,0.0011929816,0.0013538508,0.008665014,0.00068912806,0.009143548,0.0060016583,0.0019847325,0.7790648],"study_design_candidate":"not_applicable","study_design_consensus":"not_applicable","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.000099230245,0.00005840141,0.0002554664,0.00021940575,0.0000114660925,0.000083700055,0.000050154005,0.000043800745,0.00041351357,0.0013926189,0.92091244,0.07645974],"study_design_scores_gemma":[0.000054899512,0.00002006216,0.0011055771,0.00011712321,0.000019681009,0.00013837664,0.00008565248,0.00060810195,0.0007907124,0.0035861256,0.99343854,0.000035037712],"about_ca_topic_score_codex":0.00915179,"about_ca_topic_score_gemma":0.014525338,"teacher_disagreement_score":0.6997675,"about_ca_system_score_codex":0.0006161938,"about_ca_system_score_gemma":0.0014932597,"threshold_uncertainty_score":0.42824525},"labels":[],"label_agreement":null},{"id":"W2118158571","doi":"10.1109/wse.2001.988788","title":"Maintenance support for web sites: a case study","year":2001,"lang":"en","type":"article","venue":"","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":7,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Advanced Micro Devices (Canada)","funders":"","keywords":"Computer science; Web application; World Wide Web; Data science","score_opus":0.041303120904267444,"score_gpt":0.30131925206591076,"score_spread":0.2600161311616433,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2118158571","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.9958175,0.0001024646,0.0025986044,0.00022695096,0.0000073237125,0.00009964101,0.00012756026,0.000054702326,0.0009652786],"genre_scores_gemma":[0.9865745,0.00019260505,0.01154176,0.00008659057,0.000017628116,0.00007977301,0.00026000728,0.000024612873,0.0012224038],"study_design_codex":"observational","study_design_gemma":"observational","domain_scores_codex":[0.99677354,0.0014138009,0.00021416668,0.00034342107,0.00095603673,0.00029900507],"domain_scores_gemma":[0.9763263,0.01648786,0.0022266752,0.0018415457,0.0019607171,0.0011568783],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.00258883,0.00044237447,0.00036996594,0.0021754287,0.0021669506,0.001154461,0.0018774103,0.0027439294,0.00094872614],"category_scores_gemma":[0.013927609,0.00032965673,0.00045020314,0.0023910643,0.001008137,0.0015266582,0.00083520095,0.0011076438,0.0002523652],"study_design_candidate":"observational","study_design_consensus":"observational","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0015422945,0.012815938,0.42029443,0.002251483,0.0003925456,0.14936854,0.08262424,0.030563567,0.04541797,0.005948673,0.0087747155,0.24000552],"study_design_scores_gemma":[0.0007115649,0.010624289,0.465266,0.00078962586,0.00062696624,0.122317106,0.12085487,0.12853162,0.08991312,0.0046695797,0.055296715,0.00039867376],"about_ca_topic_score_codex":0.0065549184,"about_ca_topic_score_gemma":0.017829297,"teacher_disagreement_score":0.0065549184,"about_ca_system_score_codex":0.0010428737,"about_ca_system_score_gemma":0.0007043063,"threshold_uncertainty_score":0.013691187},"labels":[],"label_agreement":null},{"id":"W2118650979","doi":"","title":"Enterprise Search: Identifying Relevant Sentences and using them for Query Expansion","year":2007,"lang":"en","type":"article","venue":"","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":2,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Waterloo","funders":"","keywords":"Query expansion; Computer science; Web search query; Query optimization; Sargable; Information retrieval; Task (project management); Context (archaeology); Web query classification; Query language; Baseline (sea); Search engine; Natural language processing","score_opus":0.11665227222313493,"score_gpt":0.3327305208286858,"score_spread":0.2160782486055509,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2118650979","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.46458,0.0063650054,0.4788786,0.0016938256,0.00019350553,0.001775782,0.0037976783,0.03272457,0.009991051],"genre_scores_gemma":[0.44137383,0.0009874629,0.54402846,0.000554335,0.0001601714,0.0005045064,0.0064346255,0.0004815294,0.005475047],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.99885345,0.0004632557,0.00008654385,0.0002326988,0.000279737,0.00008435005],"domain_scores_gemma":[0.9973109,0.0017729857,0.00015906473,0.00019329961,0.0004345112,0.00012925916],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0018150925,0.0011373211,0.0012593522,0.0016909249,0.0006495369,0.0008498248,0.0008634498,0.00095905585,0.0042423285],"category_scores_gemma":[0.005726026,0.00030064044,0.00046700586,0.0014011167,0.00035681055,0.0024234683,0.00082785386,0.00082747213,0.002338078],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0015787729,0.0008049147,0.008187497,0.0014071617,0.0001571632,0.00043276948,0.0011798453,0.0036604723,0.29655507,0.001371268,0.018589001,0.6660761],"study_design_scores_gemma":[0.0006915875,0.003757033,0.05456296,0.00028744387,0.0011650289,0.005383917,0.0029181817,0.52321947,0.33432457,0.0065903626,0.066699274,0.00040021623],"about_ca_topic_score_codex":0.0040808795,"about_ca_topic_score_gemma":0.007280009,"teacher_disagreement_score":0.0042423285,"about_ca_system_score_codex":0.00037494572,"about_ca_system_score_gemma":0.0010059213,"threshold_uncertainty_score":0.014191985},"labels":[],"label_agreement":null},{"id":"W2120376711","doi":"10.1145/634067.634291","title":"Integrating back, history and bookmarks in web browsers","year":2001,"lang":"en","type":"article","venue":"","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":93,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Calgary","funders":"","keywords":"Computer science; Web browser; World Wide Web; Multimedia; The Internet","score_opus":0.01732150180113526,"score_gpt":0.21530581892906503,"score_spread":0.19798431712792977,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2120376711","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.031950347,0.0011317362,0.76193184,0.0009365286,0.00026088435,0.00039563584,0.0014664889,0.18733,0.014596464],"genre_scores_gemma":[0.28141406,0.0013889327,0.66230696,0.00098933,0.00034954213,0.00032464194,0.0027271518,0.013475277,0.037024107],"study_design_codex":"design_other","study_design_gemma":"not_applicable","domain_scores_codex":[0.99744725,0.0006041384,0.0003595341,0.00042921866,0.0009965947,0.00016325394],"domain_scores_gemma":[0.98556817,0.005065703,0.0007284647,0.0060815196,0.0018917987,0.0006643473],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0053511555,0.0009734515,0.0012826718,0.0025523119,0.0008110934,0.0059716282,0.0021392726,0.0013913163,0.0060374383],"category_scores_gemma":[0.01967826,0.0014710594,0.00089163973,0.0017261904,0.0010698278,0.011712819,0.0033701744,0.0017166972,0.0042455485],"study_design_candidate":"not_applicable","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0013876104,0.0004283308,0.019445805,0.00075193617,0.00016061013,0.0008609089,0.004364089,0.013490675,0.016460912,0.052573115,0.053536467,0.83653957],"study_design_scores_gemma":[0.00028102583,0.00048549616,0.008141293,0.0006879765,0.00048563833,0.0017856985,0.00115339,0.32740673,0.08929617,0.10036982,0.46900854,0.00089825713],"about_ca_topic_score_codex":0.010682948,"about_ca_topic_score_gemma":0.013189987,"teacher_disagreement_score":0.010682948,"about_ca_system_score_codex":0.0010896854,"about_ca_system_score_gemma":0.0017200534,"threshold_uncertainty_score":0.028299928},"labels":[],"label_agreement":null},{"id":"W2120855387","doi":"10.1109/waim.2008.62","title":"PLEDS: A Personalized Entity Detection System Based on Web Log Mining Techniques","year":2008,"lang":"en","type":"article","venue":"","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":1,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Simon Fraser University","funders":"","keywords":"Computer science; The Internet; World Wide Web; Theme (computing); Web mining; Subject (documents); Internet users; Subject matter; Data science; Web page","score_opus":0.020377583095088598,"score_gpt":0.22891757580697614,"score_spread":0.20853999271188753,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2120855387","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.07680529,0.00081309053,0.55725056,0.00072013395,0.00018333014,0.0011741513,0.02472234,0.33394384,0.004387223],"genre_scores_gemma":[0.29173297,0.00074617367,0.6393024,0.00072095625,0.0001782625,0.00092466164,0.049044676,0.00266103,0.014688889],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9991416,0.0001624415,0.000101482525,0.0002623222,0.00029245132,0.000039730323],"domain_scores_gemma":[0.99725693,0.0012267947,0.00032517893,0.00066907814,0.00031742876,0.00020462809],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0013740212,0.00093962107,0.000911234,0.0044263415,0.00059756625,0.0011374977,0.0015031463,0.00069476716,0.004065148],"category_scores_gemma":[0.005430502,0.00065968407,0.0005476646,0.0020959845,0.000336089,0.0036348035,0.0017721832,0.00094371627,0.0032636654],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0020281705,0.00080703973,0.024597475,0.0009224159,0.0004878688,0.0011290864,0.0007314474,0.0061556934,0.045433085,0.0033281965,0.14909677,0.76528275],"study_design_scores_gemma":[0.00071858853,0.0010437658,0.04556988,0.00017530397,0.0005217304,0.0035570033,0.0006555158,0.6093964,0.11407224,0.013781196,0.21004617,0.0004623426],"about_ca_topic_score_codex":0.00236356,"about_ca_topic_score_gemma":0.004651806,"teacher_disagreement_score":0.0044263415,"about_ca_system_score_codex":0.0003652237,"about_ca_system_score_gemma":0.00065380184,"threshold_uncertainty_score":0.013599277},"labels":[],"label_agreement":null},{"id":"W2121185525","doi":"10.5555/1516124.1516132","title":"Correlation-based content adaptation for mobile web browsing","year":2007,"lang":"en","type":"article","venue":"","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":5,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Toronto","funders":"","keywords":"Computer science; Content adaptation; Adaptation (eye); Web content; Fidelity; World Wide Web; Multimedia; Mobile device; Web page; Resource (disambiguation); Web navigation; Human–computer interaction; Ubiquitous computing; Computer network","score_opus":0.05438046324734681,"score_gpt":0.26990595042711746,"score_spread":0.21552548717977066,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2121185525","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.6131963,0.00051411765,0.3771228,0.00014307731,0.000053562373,0.00025497936,0.00034869846,0.0070285457,0.0013378501],"genre_scores_gemma":[0.9389451,0.00007365746,0.060534023,0.000025424473,0.000017564524,0.000048710288,0.00014759679,0.000054699267,0.00015317867],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9991679,0.00026262397,0.000046123896,0.00019132067,0.00026924428,0.000062821346],"domain_scores_gemma":[0.99536246,0.0024896995,0.00067909114,0.0006555976,0.0006035787,0.00020958202],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0011191352,0.00053377857,0.0007465062,0.0018795612,0.0004105725,0.0005885695,0.0006006806,0.000501635,0.00046818855],"category_scores_gemma":[0.007901328,0.00031063004,0.00036553302,0.0015238698,0.00036915758,0.0006882449,0.0004437721,0.0007003887,0.00029074127],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0018735824,0.0012105332,0.09924153,0.000334622,0.00031631681,0.0008197113,0.0006128479,0.20867743,0.09564737,0.0011220068,0.0034955658,0.5866485],"study_design_scores_gemma":[0.000018349314,0.00011865836,0.02192671,0.00000990043,0.000026922404,0.00016685133,0.000037498416,0.96602637,0.010776956,0.0004984418,0.0003658009,0.00002755181],"about_ca_topic_score_codex":0.0054594018,"about_ca_topic_score_gemma":0.007873786,"teacher_disagreement_score":0.0054594018,"about_ca_system_score_codex":0.000552341,"about_ca_system_score_gemma":0.0006479433,"threshold_uncertainty_score":0.0108552575},"labels":[],"label_agreement":null},{"id":"W2121256563","doi":"10.1109/saint.2006.11","title":"A Web census is possible","year":2006,"lang":"en","type":"article","venue":"","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":4,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Acadia University","funders":"","keywords":"Census; Computer science; Data science; Big data; Statistical hypothesis testing; World Wide Web; Data mining; Statistics; Mathematics; Population; Demography","score_opus":0.012522746357731297,"score_gpt":0.23050407033394596,"score_spread":0.21798132397621467,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2121256563","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.43845305,0.0144071765,0.18480735,0.054211468,0.0022327325,0.00086611044,0.0467388,0.002584838,0.2556985],"genre_scores_gemma":[0.9004583,0.0048154127,0.057167374,0.003217079,0.00057559693,0.00065629184,0.014656092,0.0004601448,0.017993687],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.9933176,0.0021398533,0.00054918806,0.0012637101,0.0023369668,0.00039264312],"domain_scores_gemma":[0.95807546,0.016899113,0.0041021,0.0104870545,0.008983366,0.001452791],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.004968024,0.0004793571,0.00076104037,0.00314539,0.002247935,0.005328282,0.0008628269,0.0015131811,0.010987461],"category_scores_gemma":[0.063637525,0.00061388186,0.00049531047,0.006886741,0.0021914023,0.011979505,0.0029611571,0.0019186639,0.0042075147],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00047298294,0.00021592353,0.17399444,0.0007438908,0.00018072143,0.0009078604,0.0046461467,0.004969653,0.0022743877,0.3461439,0.13264489,0.33280516],"study_design_scores_gemma":[0.000058265705,0.00012537904,0.07808294,0.0005887844,0.00008485439,0.0013770995,0.007443043,0.015746385,0.0034144202,0.32921392,0.5636922,0.00017268103],"about_ca_topic_score_codex":0.010143623,"about_ca_topic_score_gemma":0.008942649,"teacher_disagreement_score":0.010987461,"about_ca_system_score_codex":0.0012811109,"about_ca_system_score_gemma":0.0024089417,"threshold_uncertainty_score":0.036756694},"labels":[],"label_agreement":null},{"id":"W2121415061","doi":"10.1109/iv.2006.108","title":"The Visual Exploration ofWeb Search Results Using HotMap","year":2006,"lang":"en","type":"article","venue":"","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":46,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Regina","funders":"","keywords":"Computer science; Information retrieval; Search engine; Relevance (law); Set (abstract data type); Representation (politics); Result set; World Wide Web; Web search query; Usability; Search analytics; Visual search; Web search engine; Human–computer interaction; Artificial intelligence","score_opus":0.04998496559217664,"score_gpt":0.3085191218787094,"score_spread":0.25853415628653276,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2121415061","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.09554125,0.0052831774,0.7761848,0.002112751,0.00057593064,0.0007536608,0.009183022,0.05235628,0.05800919],"genre_scores_gemma":[0.38844028,0.003534739,0.5787446,0.0008598398,0.00033519926,0.00077942264,0.006831602,0.0039823786,0.016491886],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9995185,0.00016827436,0.000026208167,0.000049891223,0.00018153805,0.000055549925],"domain_scores_gemma":[0.99801457,0.0011752751,0.000106441,0.00019775145,0.00033343755,0.0001724799],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0011173157,0.0012254687,0.0005595824,0.0038776225,0.00040433652,0.00239282,0.0008043326,0.0008047401,0.015107964],"category_scores_gemma":[0.00425005,0.00040137809,0.0007029424,0.0023658234,0.00040756224,0.003012836,0.003133383,0.0007250583,0.0030262102],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0036165256,0.00038597116,0.0051033394,0.004412219,0.00031116456,0.00244598,0.009292649,0.017502971,0.06602743,0.02966002,0.18086451,0.68037724],"study_design_scores_gemma":[0.0007243792,0.0012680914,0.019949423,0.0016840996,0.00034164378,0.005473693,0.0057821986,0.34094882,0.066403195,0.10367092,0.45312002,0.0006334881],"about_ca_topic_score_codex":0.0012342511,"about_ca_topic_score_gemma":0.0018993438,"teacher_disagreement_score":0.015107964,"about_ca_system_score_codex":0.0002880863,"about_ca_system_score_gemma":0.0003929126,"threshold_uncertainty_score":0.050541162},"labels":[],"label_agreement":null},{"id":"W2121466546","doi":"10.1109/mmsp.2008.4665164","title":"Modelling an individual&amp;#x2019;s Web search interests by utilizing navigational data","year":2008,"lang":"en","type":"article","venue":"","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":4,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Toronto Metropolitan University","funders":"","keywords":"Computer science; Premise; World Wide Web; Web service; Web page; User modeling; Web navigation; Information retrieval; User interface; Data mining","score_opus":0.29879153506105643,"score_gpt":0.3568539184613533,"score_spread":0.058062383400296846,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2121466546","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.35689238,0.00040481222,0.63642746,0.00044349759,0.000023574528,0.00016818377,0.0007703688,0.00068418734,0.0041856235],"genre_scores_gemma":[0.89271635,0.00018466012,0.103393525,0.000056241402,0.000026265463,0.00013647183,0.0004904127,0.00003706003,0.0029590018],"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.999373,0.0001954193,0.000052203308,0.00016832819,0.0001505726,0.000060511175],"domain_scores_gemma":[0.9979747,0.0012106013,0.00022149987,0.00020218131,0.00031945447,0.000071573384],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.00129846,0.0005739926,0.0005730617,0.001715529,0.00028553754,0.0013220771,0.001008089,0.0008737185,0.0010363439],"category_scores_gemma":[0.0044138855,0.0003522918,0.0006669695,0.0014273239,0.00040212396,0.0023152274,0.00059466384,0.0008266939,0.0005013358],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00078610773,0.0012467833,0.15832905,0.0003881882,0.0005033479,0.0006042756,0.002363424,0.4834563,0.019997183,0.039046943,0.0030173268,0.29026112],"study_design_scores_gemma":[0.0000060839197,0.00008149298,0.0058808587,0.000012143166,0.00003283505,0.00009858639,0.000062892774,0.98836446,0.0010198546,0.0037633798,0.0006572928,0.000020072945],"about_ca_topic_score_codex":0.015977928,"about_ca_topic_score_gemma":0.02380648,"teacher_disagreement_score":0.015977928,"about_ca_system_score_codex":0.00086665497,"about_ca_system_score_gemma":0.0006988918,"threshold_uncertainty_score":0.031769812},"labels":[],"label_agreement":null},{"id":"W2122467011","doi":"10.1145/2678025.2701387","title":"Exploring Personalized Command Recommendations based on Information Found in Web Documentation","year":2015,"lang":"en","type":"article","venue":"","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":12,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Manitoba","funders":"","keywords":"Documentation; Computer science; Task (project management); World Wide Web; Software; Plan (archaeology); Feature (linguistics); Web application; Software documentation; Information retrieval; Human–computer interaction; Software system; Programming language; Software construction","score_opus":0.1594357004825164,"score_gpt":0.3110716892556313,"score_spread":0.15163598877311488,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2122467011","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.66630596,0.0022792113,0.27982497,0.0016074042,0.00010720735,0.0008785052,0.013585398,0.024269022,0.011142253],"genre_scores_gemma":[0.68202955,0.0006031107,0.29953134,0.00018152273,0.000033576536,0.00027584072,0.014338852,0.0008979204,0.002108326],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9978067,0.0007903479,0.00017660914,0.0004911263,0.00061500026,0.000120225595],"domain_scores_gemma":[0.98398536,0.011657893,0.0009401124,0.0012533015,0.0018296102,0.00033366564],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0025944505,0.00128422,0.0009529146,0.007058904,0.00078766444,0.0020918914,0.0012655715,0.0011117328,0.0020757073],"category_scores_gemma":[0.020035384,0.00061975274,0.0007572543,0.003933613,0.00041096547,0.004442332,0.0010583487,0.0013611328,0.0012814202],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0010592255,0.0017729335,0.13226861,0.0019289423,0.0003766418,0.0013407639,0.004931475,0.05930017,0.016686657,0.004506156,0.03126176,0.74456674],"study_design_scores_gemma":[0.00022336558,0.0005395207,0.042286,0.0003735554,0.00039194725,0.00057149644,0.005049962,0.864178,0.024810053,0.021083543,0.04027437,0.00021815723],"about_ca_topic_score_codex":0.01807906,"about_ca_topic_score_gemma":0.05394702,"teacher_disagreement_score":0.01807906,"about_ca_system_score_codex":0.001054896,"about_ca_system_score_gemma":0.0019840081,"threshold_uncertainty_score":0.03594768},"labels":[],"label_agreement":null},{"id":"W2122522197","doi":"10.1145/765891.765928","title":"The gateway","year":2003,"lang":"en","type":"article","venue":"","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":14,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Dalhousie University","funders":"","keywords":"Automatic summarization; Computer science; Gateway (web page); Context (archaeology); Variety (cybernetics); World Wide Web; Web navigation; Web page; Information retrieval; Human–computer interaction; Artificial intelligence; Geography","score_opus":0.009027003916211493,"score_gpt":0.21042588515390634,"score_spread":0.20139888123769484,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2122522197","genre_codex":"methods","genre_gemma":"other","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"other","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.019871574,0.001639098,0.53146356,0.0084520485,0.0025089094,0.0012667726,0.0062327376,0.11213623,0.31642905],"genre_scores_gemma":[0.17963924,0.0037441484,0.38363764,0.007149902,0.00076968776,0.0014456194,0.014985002,0.015277113,0.39335158],"study_design_codex":"not_applicable","study_design_gemma":"not_applicable","domain_scores_codex":[0.9991141,0.00013705206,0.000055840766,0.00022117405,0.00034861462,0.00012319892],"domain_scores_gemma":[0.9977781,0.00029010905,0.00009376832,0.00096480834,0.00051416684,0.00035904988],"candidate_categories":["insufficient_payload"],"consensus_categories":[],"category_scores_codex":[0.0007806791,0.00095983694,0.0006449048,0.0012110993,0.0010608106,0.0050039534,0.0021312067,0.002305532,0.058731515],"category_scores_gemma":[0.005092773,0.0006623874,0.00071402086,0.0010122817,0.0008181928,0.006836437,0.005304302,0.0020315796,0.04805751],"study_design_candidate":"not_applicable","study_design_consensus":"not_applicable","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00062274735,0.00029345945,0.0020611628,0.00037449138,0.000044742872,0.00051865773,0.001666691,0.0016381511,0.013237743,0.15113047,0.44448704,0.3839248],"study_design_scores_gemma":[0.00005559398,0.00011350152,0.0009097284,0.0001755458,0.000035636043,0.0005053726,0.00040411556,0.007438999,0.006490518,0.039216958,0.94459146,0.000062576495],"about_ca_topic_score_codex":0.0031279544,"about_ca_topic_score_gemma":0.0023759764,"teacher_disagreement_score":0.9412685,"about_ca_system_score_codex":0.00056864036,"about_ca_system_score_gemma":0.0015941511,"threshold_uncertainty_score":0.19647646},"labels":[],"label_agreement":null},{"id":"W2123339646","doi":"10.1109/wiiat.2008.212","title":"QoS Based Ranking for Web Search","year":2008,"lang":"en","type":"article","venue":"","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":6,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Toronto Metropolitan University","funders":"","keywords":"Ranking (information retrieval); Computer science; Rank (graph theory); Web page; World Wide Web; The Internet; Quality (philosophy); Process (computing); Information retrieval; Learning to rank; Mathematics","score_opus":0.05999504063288926,"score_gpt":0.27326858041804125,"score_spread":0.21327353978515198,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2123339646","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.030682534,0.0043040956,0.9512244,0.0009484836,0.0004312656,0.00034417002,0.00087145925,0.0034762064,0.007717455],"genre_scores_gemma":[0.5936002,0.0017118392,0.3959911,0.00022599328,0.0006671782,0.00029242382,0.0015908479,0.00031385306,0.0056065996],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.99538463,0.0014208354,0.00030674651,0.00049230596,0.002049907,0.00034551678],"domain_scores_gemma":[0.9919133,0.003836293,0.00076720596,0.0009160077,0.002164268,0.00040298016],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.003278494,0.0011264328,0.001573384,0.0061092135,0.0011323796,0.0023931263,0.0017277712,0.0011310736,0.0039459034],"category_scores_gemma":[0.017454019,0.00036262965,0.0006032041,0.0051855217,0.00068879547,0.0036273026,0.0008947546,0.0010752723,0.00171877],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00061909255,0.0003531177,0.009417559,0.0007853105,0.00017414145,0.00020568915,0.00019416011,0.19696142,0.006545887,0.08259935,0.02386624,0.6782781],"study_design_scores_gemma":[0.000043759483,0.00019111771,0.0025934302,0.000038808186,0.000043302785,0.00017507265,0.00007474633,0.94372785,0.0019571674,0.043598685,0.0074920645,0.00006405146],"about_ca_topic_score_codex":0.0056270063,"about_ca_topic_score_gemma":0.00542337,"teacher_disagreement_score":0.0061092135,"about_ca_system_score_codex":0.0019075377,"about_ca_system_score_gemma":0.001403709,"threshold_uncertainty_score":0.017338514},"labels":[],"label_agreement":null},{"id":"W2124641329","doi":"","title":"Experiments in Web Page Classification for Semantic Web.","year":2004,"lang":"en","type":"article","venue":"","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":2,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Dalhousie University","funders":"","keywords":"Computer science; Web page; Information retrieval; Semantic Web Stack; Social Semantic Web; Semantic Web; Data Web; Feature (linguistics); Static web page; Web query classification; World Wide Web; Set (abstract data type); Web navigation; Search engine; Web search query","score_opus":0.04975569911295407,"score_gpt":0.3016392804686949,"score_spread":0.25188358135574085,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2124641329","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.89333797,0.00903252,0.039815634,0.0031130696,0.0016595225,0.0032125216,0.024020756,0.01295737,0.012850608],"genre_scores_gemma":[0.6745386,0.0022741165,0.23104881,0.0014431919,0.0007899835,0.002251105,0.07597569,0.0006797249,0.010998787],"study_design_codex":"design_other","study_design_gemma":"bench_or_experimental","domain_scores_codex":[0.99302715,0.0027436416,0.0009106285,0.0011625044,0.001700502,0.00045547128],"domain_scores_gemma":[0.9839184,0.010523998,0.0007507994,0.002157229,0.0016802031,0.0009693543],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0071841734,0.0022407358,0.0018320697,0.003955548,0.0017357334,0.0016385199,0.0022636382,0.0039490964,0.0034166474],"category_scores_gemma":[0.01833566,0.0005310516,0.0019476811,0.0050658425,0.0009341211,0.003052575,0.0014136476,0.0021343243,0.0027832943],"study_design_candidate":"bench_or_experimental","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.008367325,0.029933156,0.0554074,0.005684506,0.0018137404,0.0021249815,0.0012640991,0.10462572,0.030398287,0.0037264172,0.17899457,0.5776597],"study_design_scores_gemma":[0.0030018822,0.006355097,0.059772864,0.0003260901,0.00071196177,0.002730664,0.0019246282,0.79433763,0.058210578,0.014092563,0.05824066,0.0002954115],"about_ca_topic_score_codex":0.007311906,"about_ca_topic_score_gemma":0.007947662,"teacher_disagreement_score":0.007311906,"about_ca_system_score_codex":0.0012914472,"about_ca_system_score_gemma":0.0012376792,"threshold_uncertainty_score":0.037994027},"labels":[],"label_agreement":null},{"id":"W2126253873","doi":"","title":"Extracting data cubes from multidimensional tables on the web","year":2011,"lang":"en","type":"dissertation","venue":"Summit (Simon Fraser University)","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":1,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":true,"ca_institutions":"","funders":"","keywords":"Computer science; Information retrieval; Online analytical processing; Data mining; Data science; Data warehouse","score_opus":0.039564969314814805,"score_gpt":0.23693843412078122,"score_spread":0.1973734648059664,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2126253873","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.045969304,0.0037665607,0.77797025,0.003015199,0.000838669,0.0018142414,0.09441313,0.045266174,0.02694651],"genre_scores_gemma":[0.105983846,0.0038975931,0.74246484,0.00037412738,0.00021398335,0.000835656,0.1322239,0.0020223388,0.011983826],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9979818,0.00021831416,0.0002852354,0.00032694734,0.0010808195,0.00010684584],"domain_scores_gemma":[0.9968213,0.0010033797,0.00023806324,0.0011353712,0.00065678975,0.00014513957],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.001064675,0.00097622524,0.0010710118,0.007852664,0.00088302314,0.005754861,0.0009691751,0.0008534555,0.01498473],"category_scores_gemma":[0.008999502,0.00074013637,0.0017235925,0.012506667,0.0007575535,0.00376631,0.0037209184,0.0012745224,0.014290146],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00020135219,0.00022186946,0.01087513,0.001313833,0.00024619422,0.0011206357,0.0008276267,0.008153283,0.020073917,0.020466676,0.09983807,0.8366614],"study_design_scores_gemma":[0.000101386584,0.00024202831,0.030494355,0.0016303612,0.00024240102,0.0031010024,0.00385265,0.30219024,0.053891867,0.1697122,0.4343418,0.00019966089],"about_ca_topic_score_codex":0.0029510371,"about_ca_topic_score_gemma":0.004423201,"teacher_disagreement_score":0.01498473,"about_ca_system_score_codex":0.0005334531,"about_ca_system_score_gemma":0.0015019736,"threshold_uncertainty_score":0.050128877},"labels":[],"label_agreement":null},{"id":"W2127735179","doi":"10.1641/0006-3568(2005)055[0924:ibse]2.0.co;2","title":"Ineffective Bibliographic Search Engines?","year":2005,"lang":"en","type":"article","venue":"BioScience","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":1,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Toronto","funders":"","keywords":"Information retrieval; Computer science","score_opus":0.015492190839201458,"score_gpt":0.2577253146159371,"score_spread":0.24223312377673567,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2127735179","genre_codex":"commentary","genre_gemma":"empirical","domain_codex":null,"domain_gemma":"evaluation","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":"evaluation","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.03482733,0.23038982,0.051435534,0.4789616,0.00767684,0.002652353,0.011250325,0.010623006,0.17218323],"genre_scores_gemma":[0.2696417,0.23823586,0.18152677,0.22403072,0.012123788,0.004721589,0.031381927,0.0073044887,0.031033274],"study_design_codex":"not_applicable","study_design_gemma":"observational","domain_scores_codex":[0.8223478,0.108882554,0.024114711,0.0058054966,0.035457782,0.003391641],"domain_scores_gemma":[0.38089845,0.51891977,0.02261966,0.022316119,0.05107399,0.0041719256],"candidate_categories":["metaresearch","scholarly_communication"],"consensus_categories":[],"category_scores_codex":[0.13159044,0.0017280962,0.004399077,0.052857097,0.0034053237,0.024504585,0.0067100455,0.005568219,0.023557104],"category_scores_gemma":[0.48935685,0.0026269385,0.0025077164,0.067411035,0.005085375,0.04670965,0.010087448,0.0031796999,0.022500964],"study_design_candidate":"observational","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00043917896,0.00028967875,0.008888914,0.015500572,0.00047218506,0.0006222134,0.006336665,0.0004973444,0.00062939,0.047274154,0.463584,0.45546573],"study_design_scores_gemma":[0.00046331147,0.00025256703,0.008467051,0.023967184,0.0009289229,0.0036922083,0.017436534,0.004279038,0.0024141348,0.12370177,0.81401575,0.00038161004],"about_ca_topic_score_codex":0.010438779,"about_ca_topic_score_gemma":0.012449231,"teacher_disagreement_score":0.9754954,"about_ca_system_score_codex":0.008295336,"about_ca_system_score_gemma":0.016882513,"threshold_uncertainty_score":0.6959251},"labels":[],"label_agreement":null},{"id":"W2129546202","doi":"10.1109/tkde.2009.174","title":"An Efficient Concept-Based Mining Model for Enhancing Text Clustering","year":2009,"lang":"en","type":"article","venue":"IEEE Transactions on Knowledge and Data Engineering","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":131,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Waterloo","funders":"","keywords":"Computer science; Sentence; Natural language processing; Phrase; Term (time); Similarity (geometry); Semantics (computer science); Cluster analysis; Artificial intelligence; Document clustering; Meaning (existential); Word (group theory); Measure (data warehouse); Information retrieval; Similarity measure; Semantic similarity; Data mining; Linguistics","score_opus":0.02779020595604768,"score_gpt":0.2810140212831417,"score_spread":0.253223815327094,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2129546202","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.004177923,0.00016792033,0.9939487,0.00014103999,0.000031562126,0.0001640004,0.00013614744,0.0005482856,0.0006844412],"genre_scores_gemma":[0.06240765,0.0003027297,0.93394667,0.00016234317,0.000045913082,0.00055062526,0.0007043881,0.00008416014,0.0017954471],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.99803203,0.00042183872,0.00012758425,0.0004775755,0.0008587477,0.00008221613],"domain_scores_gemma":[0.99803144,0.00076307275,0.00012661787,0.00018156884,0.00084948016,0.000047796864],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0024012534,0.0012081497,0.0015636203,0.002691224,0.001174269,0.001540669,0.0031651182,0.0014817126,0.0018518734],"category_scores_gemma":[0.0059894016,0.000546024,0.0016378001,0.0038363833,0.00065004634,0.0037742942,0.0012812141,0.0016015565,0.0013824913],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00025778115,0.00046383947,0.0022565767,0.0004817782,0.00022717258,0.00036037917,0.0006281056,0.3258717,0.012870876,0.05980281,0.011179038,0.5855999],"study_design_scores_gemma":[0.00001140514,0.000028721808,0.0001354591,0.000011420226,0.000015415562,0.000096718,0.000026594382,0.9864913,0.0013247916,0.009396266,0.0024488636,0.000013027726],"about_ca_topic_score_codex":0.006205599,"about_ca_topic_score_gemma":0.0064928136,"teacher_disagreement_score":0.006205599,"about_ca_system_score_codex":0.0014675299,"about_ca_system_score_gemma":0.002304716,"threshold_uncertainty_score":0.012699187},"labels":[],"label_agreement":null},{"id":"W2129787199","doi":"10.1007/978-3-642-39995-4_4","title":"A Framework for Composing Personalized Web Resources","year":2013,"lang":"en","type":"book-chapter","venue":"Lecture notes in computer science","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":2,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"IBM (Canada); Queen's University","funders":"","keywords":"Computer science; World Wide Web; Web modeling; Web resource; Web standards; The Internet; Data Web; Web development; Web service; Web application; Web engineering; Web navigation; Process (computing); Web Accessibility Initiative; Web intelligence","score_opus":0.024940329847421165,"score_gpt":0.2672150106315403,"score_spread":0.24227468078411912,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2129787199","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.002138708,0.00015507947,0.98284274,0.000120639015,0.000048112626,0.00021335855,0.00023999781,0.011764387,0.0024770296],"genre_scores_gemma":[0.028128993,0.00023647455,0.96334237,0.0000909516,0.000035546134,0.0002344882,0.0008606527,0.0012477618,0.0058228015],"study_design_codex":"design_other","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.9976313,0.0003075905,0.0003030598,0.0005278923,0.0009968337,0.00023326567],"domain_scores_gemma":[0.9977932,0.0004936652,0.00011268552,0.00101807,0.000341245,0.00024120849],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0030889048,0.001311082,0.0014438638,0.0029950081,0.0022798434,0.0060818586,0.0035620048,0.0020587386,0.008653557],"category_scores_gemma":[0.0059939995,0.0016418252,0.002519766,0.0033893709,0.0016237105,0.008834094,0.005812355,0.0028022046,0.0043111965],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00031116654,0.00043294363,0.0026073116,0.00064584776,0.00023320015,0.0009363786,0.0018417169,0.04114699,0.016355967,0.33425134,0.037194584,0.5640426],"study_design_scores_gemma":[0.000084476414,0.000116052426,0.0006318112,0.0002486587,0.0002840939,0.00071722176,0.00055457366,0.45591787,0.028545951,0.30296546,0.20975679,0.00017701638],"about_ca_topic_score_codex":0.010454336,"about_ca_topic_score_gemma":0.018578859,"teacher_disagreement_score":0.010454336,"about_ca_system_score_codex":0.0011918474,"about_ca_system_score_gemma":0.002075899,"threshold_uncertainty_score":0.028949022},"labels":[],"label_agreement":null},{"id":"W2130309882","doi":"10.1109/hicss.2001.926475","title":"Browsing and keyword-based profiles: a cautionary tale","year":2005,"lang":"en","type":"article","venue":"","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":7,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Dalhousie University","funders":"","keywords":"Computer science; Adaptation (eye); Task (project management); Reading (process); Hebbian theory; World Wide Web; Information retrieval; Web page; User modeling; Style (visual arts); Human–computer interaction; Multimedia; User interface; Artificial intelligence; Artificial neural network","score_opus":0.010853088560207136,"score_gpt":0.22644745820246745,"score_spread":0.2155943696422603,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2130309882","genre_codex":"commentary","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0047509405,0.021616468,0.07497451,0.8551918,0.027099494,0.00033753592,0.0003453328,0.0013856094,0.014298299],"genre_scores_gemma":[0.09485118,0.025704984,0.13144958,0.61180234,0.081170075,0.0016959253,0.0002994451,0.0010597769,0.051966637],"study_design_codex":"not_applicable","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.97822714,0.01002296,0.0023141915,0.00325788,0.0056659533,0.0005119207],"domain_scores_gemma":[0.7915054,0.15153266,0.0042857244,0.018525602,0.031317975,0.0028326395],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.041059777,0.0021954128,0.0026199704,0.0039473074,0.004536517,0.0136246225,0.0107490625,0.012049125,0.0056801517],"category_scores_gemma":[0.17498589,0.001040888,0.0018502516,0.0026928089,0.021431109,0.028193923,0.006303695,0.038940504,0.0062937685],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0015085221,0.0003815094,0.015094906,0.002756002,0.0010455812,0.0043257633,0.010624812,0.0029740403,0.0030955076,0.2684861,0.5040276,0.18567969],"study_design_scores_gemma":[0.0002026801,0.00035849187,0.0071225343,0.0017476424,0.00030710467,0.0037143049,0.005839458,0.013553269,0.0028184103,0.44544682,0.51814336,0.00074602064],"about_ca_topic_score_codex":0.014304131,"about_ca_topic_score_gemma":0.008920969,"teacher_disagreement_score":0.041059777,"about_ca_system_score_codex":0.0025871142,"about_ca_system_score_gemma":0.0028231887,"threshold_uncertainty_score":0.21714747},"labels":[],"label_agreement":null},{"id":"W2130394570","doi":"10.1080/17483100902903325","title":"WAI-ARIA live regions and channels: ReefChat as a case example","year":2009,"lang":"en","type":"article","venue":"Disability and Rehabilitation Assistive Technology","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":8,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Toronto","funders":"Mozilla Foundation","keywords":"Ajax; World Wide Web; Computer science; Documentation; Markup language; Web 2.0; Web page; Web application; The Internet; Rich Internet application; Web development; XML","score_opus":0.016225686750615347,"score_gpt":0.27175967412391017,"score_spread":0.2555339873732948,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2130394570","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.76188046,0.0010774262,0.015178462,0.0069688144,0.00020618574,0.00051225134,0.0016739817,0.0009078508,0.2115946],"genre_scores_gemma":[0.8743499,0.0010774175,0.016161999,0.0010580283,0.00008461696,0.00028752472,0.00071669393,0.00035315283,0.1059107],"study_design_codex":"case_report","study_design_gemma":"case_report","domain_scores_codex":[0.9993026,0.00017957877,0.000025036823,0.00008794171,0.00021678054,0.00018798867],"domain_scores_gemma":[0.9987419,0.00047523456,0.00009839011,0.000134484,0.00014690594,0.00040317752],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0006368825,0.00030824196,0.00025110322,0.0010199342,0.0034772872,0.0030364562,0.0012108115,0.0025081532,0.008512036],"category_scores_gemma":[0.0023914443,0.00024170222,0.0004929136,0.0018087012,0.001563147,0.0019266933,0.0021075918,0.0012229473,0.0016189258],"study_design_candidate":"case_report","study_design_consensus":"case_report","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0009892613,0.0023550892,0.09022546,0.0013141792,0.00012087939,0.30634305,0.09474045,0.009966908,0.009188413,0.09290717,0.114894986,0.27695405],"study_design_scores_gemma":[0.00016126494,0.0008203584,0.059912227,0.0004587885,0.000104106664,0.101798065,0.11716914,0.015765691,0.006123431,0.013789369,0.6836807,0.0002168286],"about_ca_topic_score_codex":0.03037844,"about_ca_topic_score_gemma":0.08689481,"teacher_disagreement_score":0.03037844,"about_ca_system_score_codex":0.001433468,"about_ca_system_score_gemma":0.001201121,"threshold_uncertainty_score":0.060403228},"labels":[],"label_agreement":null},{"id":"W2130930574","doi":"10.1109/wse.2001.988791","title":"Issues in accessing Web sites from mobile devices","year":2001,"lang":"en","type":"article","venue":"","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":10,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Alberta","funders":"","keywords":"Mobile Web; Mobile device; Computer science; World Wide Web; Mobile computing; The Internet; Mobile technology; Mobile database; Multimedia; Internet privacy; Computer network; Mobile station","score_opus":0.026689995138844052,"score_gpt":0.30358547956419957,"score_spread":0.2768954844253555,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2130930574","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.19412982,0.043871593,0.43317205,0.1890017,0.003305064,0.0021994626,0.0009828734,0.0056695226,0.1276679],"genre_scores_gemma":[0.5262843,0.03402078,0.36907858,0.014867072,0.006000643,0.0010414213,0.0012467164,0.0026697593,0.044790782],"study_design_codex":"design_other","study_design_gemma":"observational","domain_scores_codex":[0.95579857,0.016646782,0.0055356054,0.0023018173,0.018382851,0.0013344511],"domain_scores_gemma":[0.7991117,0.13410515,0.010363506,0.017080517,0.035263374,0.004075776],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.038483497,0.0006698013,0.001058445,0.0036449234,0.005605681,0.015249188,0.005127863,0.0069852783,0.005162209],"category_scores_gemma":[0.16923589,0.0020423245,0.0010125712,0.005771084,0.004990534,0.038635295,0.0063385456,0.0063966135,0.006128117],"study_design_candidate":"observational","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0003630404,0.00042028597,0.035769653,0.0020937047,0.00008070868,0.0031520943,0.029490119,0.0016845833,0.008692594,0.045595575,0.05604216,0.8166155],"study_design_scores_gemma":[0.00018443979,0.00086042547,0.066426545,0.00495281,0.00028425848,0.03905414,0.06582544,0.020784732,0.017111344,0.13279927,0.6509204,0.00079623563],"about_ca_topic_score_codex":0.0063634887,"about_ca_topic_score_gemma":0.006192066,"teacher_disagreement_score":0.038483497,"about_ca_system_score_codex":0.001410155,"about_ca_system_score_gemma":0.0019323225,"threshold_uncertainty_score":0.20352262},"labels":[],"label_agreement":null},{"id":"W2134929670","doi":"10.1080/1206212x.2004.11441740","title":"Guided Google: A Meta Search Engine and its Implementation Using the Google Distributed Web Services","year":2004,"lang":"en","type":"article","venue":"International Journal of Computers and Applications","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":27,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"","funders":"University of Saskatchewan","keywords":"Computer science; Metasearch engine; World Wide Web; Web crawler; Search engine; Spamdexing; Web search engine; Search analytics; Search engine optimization; Web search query; The Internet; Organic search; Semantic search; Search engine indexing; Web service; Information retrieval","score_opus":0.03942485117968676,"score_gpt":0.3474935057485819,"score_spread":0.30806865456889515,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2134929670","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.05126943,0.0016775822,0.65101546,0.0013238027,0.0003357498,0.0017622943,0.002580537,0.25975347,0.030281734],"genre_scores_gemma":[0.32549158,0.0014569447,0.63261825,0.0008175417,0.000115829054,0.0007726471,0.0067205643,0.0110507,0.020955954],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.99849904,0.000256427,0.00013742367,0.00016266014,0.0007677029,0.00017670303],"domain_scores_gemma":[0.99848,0.00031051235,0.000073375995,0.00043282655,0.00053217454,0.00017112165],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0019596424,0.00082307233,0.0008050707,0.0021482857,0.00078019046,0.0028244911,0.0034101382,0.0017363755,0.0043323864],"category_scores_gemma":[0.0055355662,0.00091709103,0.0012087385,0.0024904972,0.00072424917,0.0036561827,0.0018999956,0.0013617221,0.0034701447],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0038664672,0.00092932704,0.011548897,0.0016937414,0.0008774471,0.0022221853,0.0026733878,0.03984915,0.0520766,0.08689112,0.1624253,0.63494635],"study_design_scores_gemma":[0.0010848145,0.0006765467,0.0044490243,0.00033845034,0.00053898105,0.002015913,0.0006789608,0.5331234,0.06611291,0.034177486,0.3562338,0.0005697739],"about_ca_topic_score_codex":0.020256096,"about_ca_topic_score_gemma":0.016946366,"teacher_disagreement_score":0.020256096,"about_ca_system_score_codex":0.0012927479,"about_ca_system_score_gemma":0.0027337123,"threshold_uncertainty_score":0.04027641},"labels":[],"label_agreement":null},{"id":"W2135220386","doi":"","title":"Query-Structure Based Web Page Indexing","year":2012,"lang":"en","type":"article","venue":"Text REtrieval Conference","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":4,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Ottawa","funders":"","keywords":"Search engine indexing; Computer science; Information retrieval; Web page; Index (typography); World Wide Web; Web search query; Set (abstract data type); Static web page; Search engine; Web navigation","score_opus":0.02983501488973424,"score_gpt":0.2575284238493121,"score_spread":0.22769340895957788,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2135220386","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.022839045,0.0027877616,0.93333066,0.00061656086,0.00023034067,0.0011976997,0.004581975,0.026819477,0.007596481],"genre_scores_gemma":[0.20104505,0.0017974123,0.7693122,0.0004087705,0.00043160978,0.0008591648,0.015932808,0.0015971481,0.008615846],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.99597126,0.00061101577,0.0005147148,0.0005409865,0.0020567535,0.00030527677],"domain_scores_gemma":[0.99261546,0.0017394004,0.00049420935,0.0028723576,0.002026619,0.00025186306],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0025060042,0.0010287914,0.0022462842,0.007955873,0.0015783964,0.0035101438,0.0028930097,0.0012447924,0.004643549],"category_scores_gemma":[0.010185452,0.0006456714,0.0012040886,0.01168967,0.001344521,0.0066773486,0.0029018938,0.0012564025,0.0047821617],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00037246008,0.0007020903,0.004344872,0.00086464774,0.00015114239,0.00022258631,0.0007940956,0.015694553,0.071589075,0.039746016,0.071065605,0.79445285],"study_design_scores_gemma":[0.0002465493,0.00078097987,0.006111533,0.00012765254,0.00023895441,0.0016671973,0.00071334455,0.596708,0.12889333,0.10967939,0.15453932,0.0002937441],"about_ca_topic_score_codex":0.0054097064,"about_ca_topic_score_gemma":0.0073990836,"teacher_disagreement_score":0.007955873,"about_ca_system_score_codex":0.0014854146,"about_ca_system_score_gemma":0.002561274,"threshold_uncertainty_score":0.015534282},"labels":[],"label_agreement":null},{"id":"W2135390635","doi":"10.1111/j.1467-8640.2012.00411.x","title":"PROBABILISTIC MODELS FOR FOCUSED WEB CRAWLING","year":2012,"lang":"en","type":"article","venue":"Computational Intelligence","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":26,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Dalhousie University","funders":"","keywords":"Computer science; Conditional random field; Web crawler; Crawling; Hidden Markov model; Probabilistic logic; Graphical model; Maximum-entropy Markov model; Artificial intelligence; Web page; Markov chain; Statistical model; Data mining; Information retrieval; Machine learning; Markov model; World Wide Web","score_opus":0.08854326872503002,"score_gpt":0.31133538775887465,"score_spread":0.22279211903384463,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2135390635","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.019457633,0.00051548326,0.97750163,0.0002655941,0.000025516701,0.000065589746,0.00041917348,0.00068813143,0.0010613197],"genre_scores_gemma":[0.64373875,0.0016447357,0.34407666,0.00027165288,0.0001781951,0.00092328514,0.0025064363,0.0002985772,0.0063616754],"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9987214,0.00048698328,0.00007896136,0.0003130616,0.00030512788,0.00009443969],"domain_scores_gemma":[0.9931553,0.005360044,0.00047451866,0.00047272458,0.00045412427,0.00008325056],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0020568322,0.0008941154,0.0012879113,0.0022591527,0.0005951401,0.0012184764,0.0024871412,0.0021423898,0.0022545604],"category_scores_gemma":[0.010779111,0.00097120507,0.0014097079,0.002195017,0.00087563455,0.003019386,0.0008960207,0.0015227434,0.00093959115],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00005230639,0.000056654186,0.0014533579,0.00009500521,0.00005947077,0.00010032961,0.00011568105,0.92782843,0.0007756218,0.043444697,0.0016160576,0.024402348],"study_design_scores_gemma":[0.0000055298565,0.0000070818182,0.00016983936,0.0000044945587,0.0000061861333,0.000017941442,0.000003980622,0.98380566,0.00008386149,0.015582514,0.00030629596,0.000006574249],"about_ca_topic_score_codex":0.0105761,"about_ca_topic_score_gemma":0.010388329,"teacher_disagreement_score":0.0105761,"about_ca_system_score_codex":0.0012335487,"about_ca_system_score_gemma":0.00093430316,"threshold_uncertainty_score":0.021029055},"labels":[],"label_agreement":null},{"id":"W2135808337","doi":"","title":"University of Waterloo: Logistic Regression and Reciprocal Rank Fusion at the Microblog Track","year":2012,"lang":"en","type":"article","venue":"","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":2,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Waterloo","funders":"","keywords":"Computer science; Microblogging; Task (project management); Logistic regression; Social media; Information retrieval; Relevance feedback; Artificial intelligence; Classifier (UML); Rank (graph theory); Machine learning; World Wide Web","score_opus":0.02672127808955461,"score_gpt":0.2301696962094894,"score_spread":0.2034484181199348,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2135808337","genre_codex":"empirical","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.49211338,0.007286998,0.41165572,0.021340206,0.0010026055,0.00047355148,0.006102612,0.0079847565,0.05204022],"genre_scores_gemma":[0.87917656,0.00064928987,0.096998796,0.00027702173,0.00024181374,0.00013842287,0.002241969,0.00034174978,0.019934326],"study_design_codex":"design_other","study_design_gemma":"not_applicable","domain_scores_codex":[0.9947745,0.002926266,0.00013905994,0.0007206355,0.0009402723,0.00049928576],"domain_scores_gemma":[0.98206574,0.012899255,0.00058065425,0.0013370778,0.0022930051,0.0008243289],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.012511054,0.0006902523,0.0012921355,0.0013698648,0.0016261929,0.0028585938,0.0011514127,0.0020106044,0.0077427193],"category_scores_gemma":[0.052677903,0.0006319185,0.00058358297,0.0025651923,0.00059160346,0.0040452946,0.0015021039,0.0021880632,0.003549516],"study_design_candidate":"not_applicable","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.002682461,0.0012257308,0.057071228,0.00034712712,0.00033406424,0.00043297597,0.0019192845,0.049573854,0.003493476,0.028150294,0.13866423,0.7161052],"study_design_scores_gemma":[0.00029615144,0.00034503956,0.04455212,0.000103697814,0.00012009189,0.00016952492,0.001522163,0.8731584,0.0062184613,0.041586112,0.031742867,0.0001853044],"about_ca_topic_score_codex":0.2008487,"about_ca_topic_score_gemma":0.22639894,"teacher_disagreement_score":0.2008487,"about_ca_system_score_codex":0.0031554517,"about_ca_system_score_gemma":0.004989667,"threshold_uncertainty_score":0.3993593},"labels":[],"label_agreement":null},{"id":"W2137468922","doi":"10.1145/2633651.2633658","title":"Toward automated categorization of mobile health and fitness applications","year":2014,"lang":"en","type":"article","venue":"","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":5,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"McMaster University","funders":"","keywords":"Categorization; Computer science; Android (operating system); Crawling; Feature selection; Keyword extraction; Health records; Mobile device; Mobile phone; Artificial intelligence; Machine learning; Information retrieval; Health care; World Wide Web; Medicine","score_opus":0.014866735209860132,"score_gpt":0.27061248163168733,"score_spread":0.2557457464218272,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2137468922","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.6970812,0.0049452023,0.25644603,0.0019973633,0.0003034524,0.0023280233,0.010985566,0.013181683,0.012731546],"genre_scores_gemma":[0.6212236,0.0010327513,0.34605813,0.00050730136,0.0001776292,0.0008250885,0.023638709,0.00032432933,0.0062124515],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9958151,0.0010946775,0.00055194966,0.000844907,0.0013283604,0.0003649466],"domain_scores_gemma":[0.987538,0.00496315,0.0010443636,0.00090864435,0.0053045005,0.00024138753],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0027436046,0.0011331484,0.0012603104,0.0137208095,0.0011101479,0.0026603357,0.0013439455,0.00137089,0.0009556846],"category_scores_gemma":[0.011064707,0.00035057226,0.0009222461,0.0046562348,0.00037952673,0.0023573043,0.001235479,0.000923988,0.002171775],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00041570293,0.0010640376,0.097150736,0.0010496712,0.00013512543,0.00066877436,0.0014944532,0.0038306504,0.040612765,0.0022923888,0.024640303,0.8266453],"study_design_scores_gemma":[0.00018810638,0.0008278618,0.25526652,0.0006700909,0.00035057773,0.0023233232,0.009150279,0.5462053,0.10587609,0.017536176,0.061362576,0.00024320913],"about_ca_topic_score_codex":0.008259785,"about_ca_topic_score_gemma":0.011043309,"teacher_disagreement_score":0.0137208095,"about_ca_system_score_codex":0.00092009216,"about_ca_system_score_gemma":0.0018875505,"threshold_uncertainty_score":0.016423404},"labels":[],"label_agreement":null},{"id":"W2137763598","doi":"10.1109/tkde.2004.58","title":"Efficient phrase-based document indexing for Web document clustering","year":2004,"lang":"en","type":"article","venue":"IEEE Transactions on Knowledge and Data Engineering","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":320,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Waterloo","funders":"","keywords":"Document clustering; Computer science; Cluster analysis; Vector space model; Search engine indexing; Phrase; Information retrieval; Document classification; Data mining; tf–idf; Artificial intelligence; Term (time)","score_opus":0.020283882135440662,"score_gpt":0.2679597706680517,"score_spread":0.24767588853261105,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2137763598","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0033131705,0.0003755327,0.993883,0.000062756495,0.000034330118,0.000090919486,0.0003639852,0.0011645204,0.0007118771],"genre_scores_gemma":[0.03637255,0.0005158997,0.9601054,0.00004729038,0.00007315654,0.0002402213,0.0016766472,0.00021146996,0.0007574298],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.99835736,0.00043355348,0.00012424887,0.00026482795,0.0007371228,0.00008283414],"domain_scores_gemma":[0.9980203,0.0006195031,0.00016766375,0.0005740468,0.0005630313,0.00005553494],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.001256536,0.000784139,0.0013990686,0.0044058217,0.0010985264,0.0016053497,0.0017828386,0.0010073637,0.0023364516],"category_scores_gemma":[0.007110163,0.0004591109,0.0010245938,0.009499787,0.00066112063,0.0027966232,0.0016434251,0.001270631,0.0026181182],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00020136283,0.00012079171,0.00089925394,0.00042227894,0.000103364946,0.000107588065,0.0002800754,0.0887168,0.02255181,0.059162132,0.01699824,0.8104363],"study_design_scores_gemma":[0.000045926172,0.00008310653,0.0005826834,0.000024824387,0.000049003404,0.00023363775,0.00007138492,0.9032925,0.008853515,0.07417627,0.012537624,0.000049595845],"about_ca_topic_score_codex":0.004000303,"about_ca_topic_score_gemma":0.0041786847,"teacher_disagreement_score":0.0044058217,"about_ca_system_score_codex":0.0011038744,"about_ca_system_score_gemma":0.0015698292,"threshold_uncertainty_score":0.008009255},"labels":[],"label_agreement":null},{"id":"W2138276461","doi":"10.1109/fuzzy.2009.5277205","title":"Updating user profile using ontology-based semantic similarity","year":2009,"lang":"en","type":"article","venue":"","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":14,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Alberta","funders":"","keywords":"Computer science; Ontology; User profile; Relevance (law); Information retrieval; Similarity (geometry); Measure (data warehouse); Semantic Web; User modeling; Semantic similarity; Domain (mathematical analysis); World Wide Web; Similarity measure; Space (punctuation); User information; User interface; Data mining; Information system; Artificial intelligence; Mathematics","score_opus":0.029168160945835103,"score_gpt":0.2822229676793225,"score_spread":0.25305480673348735,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2138276461","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.26697838,0.00036833368,0.7250006,0.00035401413,0.000063866086,0.0003596552,0.0006421173,0.0013444943,0.0048884125],"genre_scores_gemma":[0.78516793,0.00020157709,0.21245411,0.000045462482,0.000030531675,0.00012353213,0.0010014456,0.0000584469,0.0009168889],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9971457,0.0006985344,0.00035620175,0.0003701363,0.0013100476,0.000119254175],"domain_scores_gemma":[0.99610883,0.0009786274,0.0005377158,0.00062834326,0.0015597192,0.00018684554],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0019102495,0.0003677792,0.0006887557,0.005004008,0.00069759355,0.0015743267,0.000710626,0.000502638,0.00041282154],"category_scores_gemma":[0.008498496,0.00020914814,0.0006076857,0.0033445642,0.00033380918,0.0036167263,0.001032412,0.00057699054,0.00028811267],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0005978948,0.00079521997,0.076161064,0.0002977903,0.000364893,0.00060277665,0.002520224,0.016476467,0.037342824,0.01955818,0.0041993964,0.8410833],"study_design_scores_gemma":[0.00006695482,0.00046781526,0.05493248,0.00011071687,0.00039101334,0.0016747342,0.002174227,0.84492373,0.042365354,0.030855222,0.02176953,0.00026820673],"about_ca_topic_score_codex":0.0041616177,"about_ca_topic_score_gemma":0.004472584,"teacher_disagreement_score":0.005004008,"about_ca_system_score_codex":0.0006911749,"about_ca_system_score_gemma":0.00083104626,"threshold_uncertainty_score":0.01010251},"labels":[],"label_agreement":null},{"id":"W2140309919","doi":"10.1109/mahc.2004.1299660","title":"People, languages, and computers: a short memoir","year":2004,"lang":"en","type":"article","venue":"IEEE Annals of the History of Computing","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":2,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":true,"ca_institutions":"University of Alberta","funders":"","keywords":"Memoir; Passions; Variety (cybernetics); Focus (optics); Work (physics); Sociology; Management; Computer science; History; Engineering; Art history; Art; Literature; Artificial intelligence","score_opus":0.04173689602156952,"score_gpt":0.2866436666461424,"score_spread":0.24490677062457286,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2140309919","genre_codex":"commentary","genre_gemma":"other","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"other","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0066710184,0.20425051,0.010567942,0.5284743,0.082123004,0.00008447216,0.00069027423,0.00045006277,0.16668844],"genre_scores_gemma":[0.17002723,0.23713166,0.012749696,0.15252692,0.09401223,0.00047275098,0.0007835216,0.0011198822,0.3311762],"study_design_codex":"not_applicable","study_design_gemma":"not_applicable","domain_scores_codex":[0.99908423,0.0005204893,0.00004896345,0.000093633986,0.00017834768,0.00007440064],"domain_scores_gemma":[0.9971283,0.002200475,0.000095788855,0.00013100253,0.00023696035,0.0002074722],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0014944971,0.0009479558,0.00040207105,0.0014241739,0.0033150937,0.0068735494,0.0008996611,0.003020421,0.007396006],"category_scores_gemma":[0.004209939,0.0003999557,0.00037016688,0.0021147411,0.008961372,0.010907115,0.0018826742,0.0051941755,0.0026485955],"study_design_candidate":"not_applicable","study_design_consensus":"not_applicable","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00005845938,0.000022478427,0.00028530214,0.0003492842,0.000018248114,0.00032130227,0.022373471,0.00015465022,0.00048629192,0.16036107,0.776809,0.03876036],"study_design_scores_gemma":[0.000002672275,0.000010763129,0.00018087866,0.00023364504,0.0000018407887,0.00021428577,0.003175835,0.000037683305,0.00005469868,0.012488265,0.98359203,0.000007350127],"about_ca_topic_score_codex":0.003544849,"about_ca_topic_score_gemma":0.0035530443,"teacher_disagreement_score":0.007396006,"about_ca_system_score_codex":0.0012675371,"about_ca_system_score_gemma":0.0011581894,"threshold_uncertainty_score":0.024742126},"labels":[],"label_agreement":null},{"id":"W2140946067","doi":"10.5555/381473.381747","title":"Babel: representing business rules in XML for application integration","year":2001,"lang":"en","type":"article","venue":"International Conference on Software Engineering","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":3,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Alberta","funders":"","keywords":"Computer science; XML; Programming language; Information retrieval; World Wide Web","score_opus":0.0319088513250415,"score_gpt":0.2809522497821025,"score_spread":0.24904339845706097,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2140946067","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0022575832,0.00042590906,0.9665695,0.00042802564,0.00014730524,0.0002191677,0.0009148938,0.025818763,0.0032188343],"genre_scores_gemma":[0.042330973,0.0011425116,0.9418355,0.0007878847,0.00010176251,0.00043748104,0.0046460535,0.0030499597,0.0056677707],"study_design_codex":"design_other","study_design_gemma":"not_applicable","domain_scores_codex":[0.9962817,0.0013156869,0.0005700117,0.00042330517,0.0011703413,0.00023904884],"domain_scores_gemma":[0.9958733,0.0023594964,0.00032171895,0.0006799245,0.0005892365,0.00017633637],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0064619742,0.0014228441,0.0010711434,0.0031794067,0.0012554815,0.007093234,0.0030062303,0.0024794175,0.0080343615],"category_scores_gemma":[0.0109739555,0.0015657784,0.0015977748,0.0028027962,0.0012835359,0.007161948,0.0032470825,0.0032246907,0.0036532849],"study_design_candidate":"not_applicable","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0010748227,0.00054687815,0.0032328,0.0027494316,0.0004988698,0.0024365375,0.0020774272,0.037832007,0.022989351,0.34492362,0.08542613,0.49621207],"study_design_scores_gemma":[0.00024647443,0.00019960619,0.0006138239,0.0010205699,0.0002977495,0.001249836,0.00040175318,0.27957368,0.05581452,0.17763793,0.48272613,0.00021803107],"about_ca_topic_score_codex":0.0031652024,"about_ca_topic_score_gemma":0.0034968958,"teacher_disagreement_score":0.0080343615,"about_ca_system_score_codex":0.0007165068,"about_ca_system_score_gemma":0.0015460758,"threshold_uncertainty_score":0.03417462},"labels":[],"label_agreement":null},{"id":"W2141870796","doi":"10.5539/cis.v6n3p89","title":"Clustering of Web Search Results Based on Document Segmentation","year":2013,"lang":"en","type":"article","venue":"Computer and Information Science","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":true,"route_about_ca":false,"ca_institutions":"","funders":"","keywords":"Cluster analysis; Computer science; Document clustering; Information retrieval; Data mining; Similarity (geometry); Brown clustering; Segmentation; Fuzzy clustering; Correlation clustering; Search engine; CURE data clustering algorithm; Pattern recognition (psychology); Artificial intelligence; Image (mathematics)","score_opus":0.015165491259061848,"score_gpt":0.26153199633499985,"score_spread":0.246366505075938,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2141870796","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.4855112,0.0026672012,0.50200933,0.00023174174,0.00008484702,0.0008476316,0.0010772974,0.0036426033,0.003928004],"genre_scores_gemma":[0.649484,0.00053294277,0.34437746,0.000054148233,0.000053465348,0.0002773136,0.003189844,0.000337504,0.0016932058],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.99780256,0.0005522038,0.00022183622,0.00037789272,0.00085872505,0.00018686702],"domain_scores_gemma":[0.99449015,0.0017767426,0.0007276607,0.0006168422,0.002218256,0.0001703951],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.002107654,0.0008456829,0.0016088655,0.008912053,0.0010880869,0.0019892799,0.000874446,0.0009544447,0.000638651],"category_scores_gemma":[0.008555495,0.00043514147,0.00090227893,0.006798681,0.0007919506,0.0015051313,0.00080829766,0.00047623072,0.00065557664],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0026359644,0.0005122033,0.030376356,0.0010933446,0.0006717912,0.00038157057,0.0020639878,0.22055313,0.089636676,0.004340783,0.007914179,0.63982004],"study_design_scores_gemma":[0.00010763082,0.0004980227,0.03594643,0.00009656137,0.00027257449,0.00046197983,0.0009967076,0.8965944,0.053896014,0.007182532,0.0037916033,0.00015554616],"about_ca_topic_score_codex":0.0098912995,"about_ca_topic_score_gemma":0.009555783,"teacher_disagreement_score":0.0098912995,"about_ca_system_score_codex":0.0012937506,"about_ca_system_score_gemma":0.0011515669,"threshold_uncertainty_score":0.019667447},"labels":[],"label_agreement":null},{"id":"W2142873033","doi":"10.1109/trustcom.2013.131","title":"Real-Time Effective Framework for Unstructured Data Mining","year":2013,"lang":"en","type":"article","venue":"","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":5,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Saskatchewan","funders":"","keywords":"Computer science; NoSQL; Data mining; Cluster analysis; Unstructured data; Search engine indexing; Knowledge extraction; Pruning; Information retrieval; Big data; Machine learning","score_opus":0.019354609798089336,"score_gpt":0.2800036593329589,"score_spread":0.26064904953486956,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2142873033","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0009010067,0.00012536654,0.99501365,0.000097525925,0.000023258051,0.00008783082,0.00012416382,0.0032948118,0.00033230465],"genre_scores_gemma":[0.046185493,0.00015925891,0.95144856,0.000076289914,0.00005222504,0.00032048605,0.00075158244,0.00019107242,0.0008150985],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.99678826,0.0009104354,0.0003159007,0.00053851714,0.0012326997,0.00021414207],"domain_scores_gemma":[0.9958747,0.0020563186,0.00026286536,0.0008146549,0.00078817096,0.00020331558],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0036341718,0.0014650647,0.0014627449,0.002863634,0.00088501186,0.0024033778,0.0034234347,0.001057898,0.004161823],"category_scores_gemma":[0.011407165,0.0006829394,0.0013287461,0.0025854362,0.0008960066,0.0031724463,0.002588068,0.0016302181,0.0023451475],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0006562528,0.00043968877,0.0020852897,0.0006706292,0.00018298673,0.0007880282,0.00042247016,0.25939232,0.012296588,0.123743184,0.029151427,0.5701711],"study_design_scores_gemma":[0.000038556318,0.000031477244,0.00009864169,0.000013216752,0.000014644185,0.00010361268,0.00003536953,0.9646931,0.002037853,0.025474386,0.0074448646,0.000014255244],"about_ca_topic_score_codex":0.004269236,"about_ca_topic_score_gemma":0.0052729915,"teacher_disagreement_score":0.004269236,"about_ca_system_score_codex":0.000935089,"about_ca_system_score_gemma":0.0019183708,"threshold_uncertainty_score":0.019219577},"labels":[],"label_agreement":null},{"id":"W2142980440","doi":"10.1109/wiiat.2008.200","title":"Empirical Analysis of the Rank Distribution of Relevant Documents in Web Search","year":2008,"lang":"en","type":"article","venue":"","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":7,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Alberta","funders":"Google","keywords":"Computer science; Information retrieval; Relevance (law); Rank (graph theory); Database transaction; Point (geometry); Transaction log; Empirical research; Search engine; World Wide Web; Data mining; Database; Mathematics; Statistics","score_opus":0.034716065770785405,"score_gpt":0.30825543184121595,"score_spread":0.27353936607043056,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2142980440","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.9497183,0.0017720977,0.04394345,0.00069958635,0.000014802194,0.000079897516,0.00045846665,0.00019618336,0.0031172817],"genre_scores_gemma":[0.99695456,0.00024912035,0.0019706716,0.000038095754,0.000043583626,0.000025815623,0.0002764349,0.000027366274,0.00041433377],"study_design_codex":"observational","study_design_gemma":"observational","domain_scores_codex":[0.9899977,0.005613531,0.00046749169,0.00068691076,0.0027170957,0.00051730056],"domain_scores_gemma":[0.7633244,0.20700788,0.012916514,0.007843482,0.00674614,0.002161696],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.012641275,0.0003605732,0.001010828,0.0058222166,0.00063773256,0.00205101,0.001079539,0.0013557632,0.0024761988],"category_scores_gemma":[0.16743468,0.00041760408,0.00044162493,0.0051265736,0.002188822,0.0037398254,0.0011297808,0.0018063268,0.0006772655],"study_design_candidate":"observational","study_design_consensus":"observational","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.003480651,0.0012016253,0.6683574,0.00086316746,0.0006863933,0.0012899502,0.0034045412,0.055249974,0.0063836733,0.05719765,0.0042762607,0.19760872],"study_design_scores_gemma":[0.00026075027,0.0011292673,0.57177407,0.00015481935,0.0003290385,0.0024937456,0.002577089,0.3345116,0.0051822052,0.07736699,0.0039996984,0.0002208049],"about_ca_topic_score_codex":0.002016049,"about_ca_topic_score_gemma":0.0012541692,"teacher_disagreement_score":0.012641275,"about_ca_system_score_codex":0.00072212104,"about_ca_system_score_gemma":0.0005783695,"threshold_uncertainty_score":0.0668543},"labels":[],"label_agreement":null},{"id":"W2144630894","doi":"10.1007/s10844-005-0861-z","title":"Post-Supervised Template Induction for Information Extraction from Lists and Tables in Dynamic Web Sources","year":2005,"lang":"en","type":"article","venue":"Journal of Intelligent Information Systems","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":6,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Dalhousie University","funders":"Natural Sciences and Engineering Research Council of Canada","keywords":"Computer science; Row; Machine learning; Data mining; Artificial intelligence; Dynamic programming; Supervised learning; Exploit; Information extraction; Unsupervised learning; Row and column spaces; Pattern recognition (psychology); Information retrieval; Algorithm; Database; Artificial neural network","score_opus":0.014891960653374848,"score_gpt":0.25725309418324166,"score_spread":0.24236113352986682,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2144630894","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.017312478,0.0007059392,0.95068073,0.00031168494,0.000104132894,0.00036572095,0.005603068,0.02338484,0.0015315188],"genre_scores_gemma":[0.1102483,0.00057398103,0.8583773,0.00013673127,0.00011782251,0.00039502123,0.02522999,0.0011630751,0.0037577548],"study_design_codex":"design_other","study_design_gemma":"bench_or_experimental","domain_scores_codex":[0.9980123,0.00035393162,0.00027266875,0.0005484342,0.000627723,0.00018492671],"domain_scores_gemma":[0.9922516,0.0040998445,0.0005878345,0.0013077455,0.0015473191,0.00020570851],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0018476511,0.0011586751,0.0014759339,0.006852447,0.0013322517,0.0021306148,0.002776451,0.0016015718,0.0057921764],"category_scores_gemma":[0.008698764,0.0009154249,0.0021822583,0.0066127735,0.00072883203,0.0038337419,0.0018603695,0.0016108181,0.0070705474],"study_design_candidate":"bench_or_experimental","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00037002264,0.00027689402,0.004875461,0.000700468,0.00015420411,0.00056488335,0.00034112405,0.009101298,0.022398056,0.0063342694,0.026342371,0.92854095],"study_design_scores_gemma":[0.00013107953,0.00025759786,0.0059959763,0.00021697646,0.0004823359,0.0013675942,0.00063724164,0.7902204,0.11056168,0.04768267,0.042314623,0.00013181816],"about_ca_topic_score_codex":0.005343763,"about_ca_topic_score_gemma":0.010385481,"teacher_disagreement_score":0.006852447,"about_ca_system_score_codex":0.0009410227,"about_ca_system_score_gemma":0.0035839244,"threshold_uncertainty_score":0.019376755},"labels":[],"label_agreement":null},{"id":"W2145378194","doi":"10.1109/hicss.2006.256","title":"Lookahead Cascade for Table Access on Small Devices","year":2006,"lang":"en","type":"article","venue":"","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":2,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Dalhousie University","funders":"","keywords":"Computer science; Table (database); Mobile device; Column (typography); Data access; Cascade; Wireless; The Internet; Representation (politics); Web application; Simple (philosophy); Computer network; Database; World Wide Web; Telecommunications","score_opus":0.04024150784100254,"score_gpt":0.2864256307623424,"score_spread":0.24618412292133984,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2145378194","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.37666667,0.001237134,0.57041425,0.00056506775,0.00020935122,0.00051027077,0.0016805945,0.03718039,0.011536311],"genre_scores_gemma":[0.7292529,0.0004509578,0.26104614,0.00015379983,0.000059574613,0.00018219631,0.0010235771,0.0004201397,0.007410873],"study_design_codex":"design_other","study_design_gemma":"not_applicable","domain_scores_codex":[0.9995989,0.00008531369,0.000034643588,0.00008007496,0.000147719,0.000053305725],"domain_scores_gemma":[0.9966366,0.0019234219,0.00019020024,0.0007877944,0.0002927839,0.0001691492],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0005702603,0.0005031046,0.00052294787,0.0005946007,0.00037613377,0.0008079831,0.0008819989,0.00036567086,0.01271639],"category_scores_gemma":[0.005729703,0.00035861475,0.00029751024,0.0008079431,0.00033313234,0.0024195611,0.0009700851,0.0005266043,0.0015049572],"study_design_candidate":"not_applicable","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0037582407,0.00034161733,0.004519984,0.0003816385,0.000051725783,0.0009261783,0.0008258126,0.014736507,0.08582788,0.007330594,0.019206025,0.8620937],"study_design_scores_gemma":[0.0005082907,0.0028847011,0.016974056,0.00018205435,0.00020055432,0.002260327,0.0011428042,0.71476793,0.1808334,0.022179196,0.05777645,0.0002902096],"about_ca_topic_score_codex":0.0032210327,"about_ca_topic_score_gemma":0.0055756327,"teacher_disagreement_score":0.01271639,"about_ca_system_score_codex":0.0002904534,"about_ca_system_score_gemma":0.00061469426,"threshold_uncertainty_score":0.04254055},"labels":[],"label_agreement":null},{"id":"W2147293034","doi":"10.1145/2348283.2348327","title":"Mining query subtopics from search log data","year":2012,"lang":"en","type":"article","venue":"","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":65,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Simon Fraser University","funders":"","keywords":"Computer science; Web search query; Information retrieval; Ranking (information retrieval); Cluster analysis; Web query classification; Search engine; Leverage (statistics); Data mining; Artificial intelligence","score_opus":0.1367392867182668,"score_gpt":0.32062556630482847,"score_spread":0.18388627958656167,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2147293034","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.8021984,0.008368642,0.15190965,0.00070524844,0.000120953206,0.0010077469,0.024957923,0.0065832217,0.0041482537],"genre_scores_gemma":[0.8446642,0.0014752327,0.108621754,0.00018198293,0.00014127354,0.00036309514,0.042440828,0.00023599085,0.001875571],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.997203,0.00044461119,0.00036046217,0.0006172497,0.0010649359,0.0003098988],"domain_scores_gemma":[0.99347806,0.00316849,0.0007368273,0.000688947,0.0016144387,0.00031308923],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0015748617,0.0017437224,0.0016082389,0.012420971,0.0009117637,0.0013465637,0.0011092832,0.0010267553,0.00061213726],"category_scores_gemma":[0.008716805,0.00040187236,0.0018270654,0.007518508,0.0005638376,0.0024197786,0.0013370464,0.0010128696,0.0008979856],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0024808825,0.001199951,0.19255766,0.0028528052,0.0005884253,0.0023971708,0.0030166218,0.035792828,0.13964579,0.004315716,0.02773596,0.58741623],"study_design_scores_gemma":[0.00013545908,0.00082253775,0.19196466,0.00023738082,0.00045105684,0.0027460002,0.003207405,0.7142742,0.050004747,0.012113617,0.023780862,0.0002619752],"about_ca_topic_score_codex":0.01619411,"about_ca_topic_score_gemma":0.023746416,"teacher_disagreement_score":0.01619411,"about_ca_system_score_codex":0.00094388536,"about_ca_system_score_gemma":0.0016846186,"threshold_uncertainty_score":0.03219968},"labels":[],"label_agreement":null},{"id":"W2147979708","doi":"10.1145/967900.968022","title":"Framework for mining web content outliers","year":2004,"lang":"en","type":"article","venue":"","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":29,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Calgary","funders":"","keywords":"Computer science; Outlier; Content (measure theory); Web mining; Information retrieval; World Wide Web; Web service; Artificial intelligence; Mathematics","score_opus":0.0725405980701763,"score_gpt":0.2891242805934112,"score_spread":0.21658368252323493,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2147979708","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.003253691,0.00024792217,0.9934443,0.00038802324,0.000028922592,0.00027857657,0.0003657996,0.0008806591,0.0011121193],"genre_scores_gemma":[0.08181082,0.0005307154,0.9130067,0.000167548,0.00013713121,0.00067829026,0.0016638523,0.00011418842,0.0018907015],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9937133,0.0015544881,0.00062300585,0.0010820804,0.0026592216,0.0003679045],"domain_scores_gemma":[0.9935796,0.0021262756,0.0008977355,0.0010665479,0.002030211,0.0002995704],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0044957795,0.0015906177,0.0019101767,0.009274991,0.0016263376,0.005238258,0.0039471574,0.0022302088,0.0016534879],"category_scores_gemma":[0.012914162,0.00078056677,0.0027782077,0.0078002405,0.0020669883,0.0048382822,0.00352299,0.0024016646,0.0011763318],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00022396584,0.00058066734,0.019453743,0.00094391307,0.00049427,0.0022460325,0.0016400927,0.16953969,0.0062781633,0.42829308,0.019274818,0.3510316],"study_design_scores_gemma":[0.00004827313,0.00007980555,0.0018785123,0.0001020969,0.000086647604,0.0005951339,0.00056569517,0.80107987,0.002335707,0.1695558,0.023608016,0.00006433149],"about_ca_topic_score_codex":0.010121288,"about_ca_topic_score_gemma":0.008329951,"teacher_disagreement_score":0.010121288,"about_ca_system_score_codex":0.0019006551,"about_ca_system_score_gemma":0.0029258193,"threshold_uncertainty_score":0.023776293},"labels":[],"label_agreement":null},{"id":"W2148387158","doi":"10.1145/1557914.1557947","title":"Individual and social behavior in tagging systems","year":2009,"lang":"en","type":"article","venue":"","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":55,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of British Columbia","funders":"","keywords":"Computer science; Pairwise comparison; Reuse; Similarity (geometry); Metric (unit); Information retrieval; Tag system; Recommender system; World Wide Web; Artificial intelligence","score_opus":0.02698872560099214,"score_gpt":0.2641396343212282,"score_spread":0.2371509087202361,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2148387158","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.8934022,0.00023976102,0.09844465,0.00047823467,0.000016357153,0.00016894832,0.00024488964,0.00037495335,0.0066299154],"genre_scores_gemma":[0.98551464,0.000059446113,0.013004555,0.00004878906,0.000016689977,0.000083680374,0.00018133647,0.0000625297,0.0010283719],"study_design_codex":"observational","study_design_gemma":"observational","domain_scores_codex":[0.98953295,0.005814731,0.00069436495,0.0019585753,0.0015342233,0.00046527918],"domain_scores_gemma":[0.93749064,0.04126967,0.0070044813,0.0076663727,0.004226576,0.0023422157],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.008612054,0.00043664334,0.0006651864,0.0030706981,0.0021031587,0.0036808006,0.0008796154,0.0014718692,0.0016195478],"category_scores_gemma":[0.04264173,0.0005718624,0.0005277663,0.0028509886,0.0031867067,0.007255884,0.0023774349,0.00093233876,0.0006235428],"study_design_candidate":"observational","study_design_consensus":"observational","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0008063021,0.00078348845,0.69182926,0.00044875508,0.00058254687,0.00084777776,0.024930453,0.038654804,0.02375675,0.06530495,0.0017580743,0.15029685],"study_design_scores_gemma":[0.00009313605,0.0007379232,0.3781594,0.00008927495,0.00027310647,0.001819415,0.011408993,0.40019292,0.013451331,0.17395982,0.019422112,0.0003925739],"about_ca_topic_score_codex":0.0034053884,"about_ca_topic_score_gemma":0.0033142574,"teacher_disagreement_score":0.008612054,"about_ca_system_score_codex":0.0017760254,"about_ca_system_score_gemma":0.0008097347,"threshold_uncertainty_score":0.0455454},"labels":[],"label_agreement":null},{"id":"W2152056009","doi":"10.1145/1526709.1526868","title":"News article extraction with template-independent wrapper","year":2009,"lang":"en","type":"article","venue":"","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":20,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Simon Fraser University","funders":"","keywords":"Template; Computer science; Information retrieval; Information extraction; Data mining; Programming language","score_opus":0.01283927497978943,"score_gpt":0.2512661544123126,"score_spread":0.23842687943252316,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2152056009","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.031216655,0.00080281834,0.94587606,0.00026416182,0.00018171393,0.00021520861,0.0012774927,0.018645141,0.0015205931],"genre_scores_gemma":[0.15537032,0.00064536807,0.8289565,0.00028059146,0.00027161828,0.00025187343,0.007688016,0.0010093546,0.005526286],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9983847,0.00025169062,0.00022501132,0.00057411654,0.00044809395,0.00011638295],"domain_scores_gemma":[0.9953694,0.0015326081,0.00054487167,0.0014958365,0.0009423822,0.000114885544],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0015605808,0.0014857394,0.0015653833,0.0054546893,0.00063640164,0.0016842425,0.0014534483,0.0015584009,0.0017401188],"category_scores_gemma":[0.0072941817,0.0007782005,0.0016370954,0.003953373,0.0005463731,0.0038279225,0.0015151737,0.0010643937,0.00429526],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00023036203,0.00025176865,0.0060799103,0.00043768965,0.00025046992,0.0008482886,0.00021404856,0.018873645,0.030870501,0.001962382,0.016717562,0.9232633],"study_design_scores_gemma":[0.000053769014,0.00024027746,0.0046228534,0.000056690962,0.00025752428,0.0017250454,0.00017457517,0.7809541,0.17763539,0.012114539,0.022059785,0.000105372244],"about_ca_topic_score_codex":0.00084532757,"about_ca_topic_score_gemma":0.0011393767,"teacher_disagreement_score":0.0054546893,"about_ca_system_score_codex":0.000380207,"about_ca_system_score_gemma":0.00076798955,"threshold_uncertainty_score":0.008253276},"labels":[],"label_agreement":null},{"id":"W2152531434","doi":"10.1109/icdim.2010.5664665","title":"Augmenting the visual presentation of Web search results","year":2010,"lang":"en","type":"article","venue":"","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":13,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Dalhousie University","funders":"","keywords":"Computer science; Information retrieval; Search engine; Web search query; Visualization; Redundancy (engineering); Relevance (law); Presentation (obstetrics); Process (computing); Web query classification; Web page; World Wide Web; Data mining","score_opus":0.02198616967084627,"score_gpt":0.31566484993244004,"score_spread":0.29367868026159377,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2152531434","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.20710754,0.00689174,0.6711865,0.0031455008,0.0010628252,0.0011066705,0.0025502953,0.051589508,0.055359457],"genre_scores_gemma":[0.5257058,0.0041860985,0.4505689,0.00083314127,0.0006695918,0.0005538426,0.0018904066,0.002543159,0.013048951],"study_design_codex":"design_other","study_design_gemma":"not_applicable","domain_scores_codex":[0.99929893,0.00027919345,0.000046736597,0.00007823609,0.00023136837,0.000065526925],"domain_scores_gemma":[0.9928758,0.0050763,0.00028950858,0.00054879434,0.0009810346,0.00022852598],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0016947147,0.0013747802,0.0006713853,0.0021370396,0.00027086522,0.0028989234,0.0010085189,0.0011146017,0.015756244],"category_scores_gemma":[0.013211671,0.00029389383,0.0006620658,0.0010519094,0.00044553643,0.0026809243,0.0023036222,0.00089083984,0.0028344037],"study_design_candidate":"not_applicable","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0037718283,0.0005717116,0.0028340088,0.0041933535,0.00014244959,0.001311497,0.0034671447,0.014005706,0.11804241,0.011262378,0.03351448,0.80688304],"study_design_scores_gemma":[0.0017929266,0.004957842,0.027712297,0.0026111794,0.0012481587,0.00543013,0.0036492583,0.2931365,0.17278002,0.052988324,0.43275252,0.0009408851],"about_ca_topic_score_codex":0.00072336564,"about_ca_topic_score_gemma":0.0006886691,"teacher_disagreement_score":0.015756244,"about_ca_system_score_codex":0.0002759413,"about_ca_system_score_gemma":0.00038284846,"threshold_uncertainty_score":0.052709877},"labels":[],"label_agreement":null},{"id":"W2155847630","doi":"10.1142/s0129054102001254","title":"A DYNAMICS RECOMMENDATION SYSTEM BASED ON LOG MINING","year":2002,"lang":"en","type":"article","venue":"International Journal of Foundations of Computer Science","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":3,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"","funders":"McMaster University; Chinese Academy of Sciences; University of Saskatchewan; National Science Foundation","keywords":"Computer science; Recommender system; Classifier (UML); Web page; Web mining; Data mining; Information retrieval; Search engine; World Wide Web; Artificial intelligence","score_opus":0.025673810077958128,"score_gpt":0.28154205429292,"score_spread":0.2558682442149619,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2155847630","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.06171865,0.0007927329,0.86374754,0.0006288251,0.00029286806,0.00049359567,0.0022164914,0.06398353,0.0061258003],"genre_scores_gemma":[0.48925033,0.0007539584,0.48868605,0.00036021695,0.00029105027,0.00063426304,0.0054950025,0.0005920123,0.013937257],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9993567,0.000058555823,0.000059597405,0.00019641119,0.00028758377,0.00004117238],"domain_scores_gemma":[0.9988079,0.000295968,0.00010217665,0.0002516406,0.0004260996,0.000116248106],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0006972851,0.00074690575,0.0013520623,0.001923636,0.00079667225,0.0010993859,0.0018396825,0.000951415,0.003636073],"category_scores_gemma":[0.0023309074,0.0005311896,0.00042663285,0.0012920568,0.00021032542,0.0021887356,0.00069174846,0.0008818796,0.0037380615],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.001140769,0.00087916385,0.0135721,0.00033744617,0.00026672203,0.0004802627,0.00017314454,0.023715539,0.04759024,0.003790449,0.02906495,0.8789892],"study_design_scores_gemma":[0.00017932343,0.00026814328,0.0063790125,0.000028946304,0.00013381813,0.00045865442,0.000053193708,0.94375515,0.021550538,0.004065261,0.02302665,0.000101290396],"about_ca_topic_score_codex":0.008493917,"about_ca_topic_score_gemma":0.009409411,"teacher_disagreement_score":0.008493917,"about_ca_system_score_codex":0.00049835676,"about_ca_system_score_gemma":0.0007259609,"threshold_uncertainty_score":0.016888976},"labels":[],"label_agreement":null},{"id":"W2158194600","doi":"10.1109/ccece.2008.4564790","title":"HTTP modification to reduce client latency","year":2008,"lang":"en","type":"article","venue":"Conference proceedings - Canadian Conference on Electrical and Computer Engineering","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":6,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":true,"route_about_ca":false,"ca_institutions":"Toronto Metropolitan University","funders":"","keywords":"Computer science; Fat client; Operating system; Web server; Client–server model; Client-side; Web API; File server; Server-side; Client; Application server; AppleShare; Latency (audio); Thin client; Hypertext Transfer Protocol; Protocol (science); Dynamic web page; Web page; World Wide Web; Web service; Server; The Internet","score_opus":0.03274375160961306,"score_gpt":0.220396071540161,"score_spread":0.18765231993054793,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2158194600","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.090948164,0.002611307,0.7657487,0.0017949835,0.0028069403,0.0023784395,0.000785331,0.10692665,0.025999565],"genre_scores_gemma":[0.6260666,0.001253653,0.29708996,0.0024837044,0.0012420625,0.0018097954,0.0025262178,0.009299652,0.058228318],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.99255025,0.0013130449,0.00092010124,0.0008659587,0.0031335528,0.0012171391],"domain_scores_gemma":[0.9837167,0.0030091566,0.0005995693,0.0067476835,0.005155262,0.00077158137],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0036278765,0.0018408975,0.0014354186,0.0013361591,0.0014733031,0.00320895,0.0059665185,0.0023908108,0.011393859],"category_scores_gemma":[0.015459074,0.0011512142,0.0010602479,0.0013736901,0.0007930861,0.0075667882,0.0046515963,0.005565949,0.007547187],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0030075281,0.0016207371,0.0105331,0.0015643154,0.00033175733,0.00395197,0.0016181996,0.011666982,0.34882286,0.028562969,0.048557904,0.5397617],"study_design_scores_gemma":[0.0005082186,0.00112267,0.008468359,0.00026177993,0.0005146523,0.005778001,0.0008526462,0.2203544,0.5075626,0.015936276,0.23808166,0.00055875746],"about_ca_topic_score_codex":0.0020397983,"about_ca_topic_score_gemma":0.0014301587,"teacher_disagreement_score":0.011393859,"about_ca_system_score_codex":0.0011675395,"about_ca_system_score_gemma":0.0016897146,"threshold_uncertainty_score":0.038116217},"labels":[],"label_agreement":null},{"id":"W2158943277","doi":"10.1109/tvcg.2008.175","title":"VisGets: Coordinated Visualizations for Web-based Information Exploration and Discovery","year":2008,"lang":"en","type":"article","venue":"IEEE Transactions on Visualization and Computer Graphics","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":175,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Toronto; University of Calgary","funders":"Natural Sciences and Engineering Research Council of Canada","keywords":"Computer science; Information retrieval; Web navigation; World Wide Web; RSS; Filter (signal processing); Exploratory search; Web search query; Visualization; Web page; Data visualization; Dimension (graph theory); Search engine; Data mining","score_opus":0.025776883203994575,"score_gpt":0.2634437113893258,"score_spread":0.23766682818533125,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2158943277","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.019984843,0.001299863,0.9083993,0.0008064612,0.00017161357,0.00032155917,0.003364645,0.05993368,0.0057180473],"genre_scores_gemma":[0.16060072,0.0013056406,0.82447535,0.0003140298,0.00011579536,0.0008017748,0.0040787887,0.005015922,0.0032919303],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.99907136,0.0003886021,0.00008223215,0.00011575047,0.00026014142,0.000081959224],"domain_scores_gemma":[0.99556917,0.002704052,0.00027488696,0.00063054886,0.00047321327,0.00034823647],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0018412934,0.0017531884,0.0010113881,0.0032547985,0.00077937456,0.0046497555,0.0013573891,0.0013521468,0.010989829],"category_scores_gemma":[0.009667491,0.00080524944,0.0011264655,0.0024505975,0.0007846782,0.0045795077,0.005113581,0.0017638281,0.001959249],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0035676772,0.00045373672,0.007858132,0.0026884868,0.00039529812,0.0013198592,0.0098147625,0.024014324,0.078231096,0.08553024,0.11484719,0.6712792],"study_design_scores_gemma":[0.0006420211,0.0008178957,0.007681282,0.0009512277,0.000291597,0.0016717874,0.0037930529,0.3632571,0.064646944,0.16817547,0.3874883,0.000583266],"about_ca_topic_score_codex":0.0023055002,"about_ca_topic_score_gemma":0.0031332388,"teacher_disagreement_score":0.010989829,"about_ca_system_score_codex":0.00051910913,"about_ca_system_score_gemma":0.0007111297,"threshold_uncertainty_score":0.03676462},"labels":[],"label_agreement":null},{"id":"W2162076845","doi":"10.1145/1645953.1646270","title":"Data extraction from the web using wild card queries","year":2009,"lang":"en","type":"article","venue":"","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":7,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Alberta","funders":"","keywords":"Computer science; Unary operation; Tuple; Information retrieval; Task (project management); Information extraction; Set (abstract data type); Web query classification; Simple (philosophy); Query language; Web search query; Search engine; Programming language","score_opus":0.0866031512683388,"score_gpt":0.3185218247687534,"score_spread":0.23191867350041462,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2162076845","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.018263843,0.0021545729,0.95990866,0.0011198733,0.000077137876,0.00067496917,0.0051023914,0.009490691,0.003207813],"genre_scores_gemma":[0.09396028,0.0019802405,0.8845831,0.0006299559,0.000118980526,0.00039281909,0.015974915,0.00064121064,0.0017184702],"study_design_codex":"design_other","study_design_gemma":"bench_or_experimental","domain_scores_codex":[0.99404174,0.0013753697,0.00113664,0.0011305735,0.0020799711,0.00023561982],"domain_scores_gemma":[0.98925614,0.0058289063,0.00081485684,0.0028058204,0.001080031,0.00021424],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0043462496,0.0014624344,0.0023133745,0.009708743,0.0016059116,0.0058656055,0.002617325,0.0015223701,0.0031906397],"category_scores_gemma":[0.017649671,0.0010546332,0.0020700712,0.011113709,0.0014792137,0.013232282,0.004428004,0.0019882473,0.0019194767],"study_design_candidate":"bench_or_experimental","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0006723314,0.0005827517,0.010439857,0.0031670146,0.0004301304,0.0032932337,0.003990647,0.01989608,0.043709166,0.060282085,0.039398845,0.8141378],"study_design_scores_gemma":[0.00023981954,0.00034357738,0.006856044,0.0007200925,0.00044204798,0.005840495,0.0042833933,0.39613596,0.09750126,0.24616821,0.24106818,0.00040097916],"about_ca_topic_score_codex":0.003692688,"about_ca_topic_score_gemma":0.0046926914,"teacher_disagreement_score":0.009708743,"about_ca_system_score_codex":0.0009979369,"about_ca_system_score_gemma":0.0016963676,"threshold_uncertainty_score":0.022985458},"labels":[],"label_agreement":null},{"id":"W2162672362","doi":"10.1109/wiiat.2008.24","title":"An Unsupervised Approach to Cluster Web Search Results Based on Word Sense Communities","year":2008,"lang":"en","type":"article","venue":"","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":17,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Alberta","funders":"","keywords":"Computer science; Cluster analysis; Word (group theory); Information retrieval; Measure (data warehouse); Process (computing); Modularity (biology); Web page; Artificial intelligence; Unsupervised learning; Data mining; World Wide Web","score_opus":0.06940130893529436,"score_gpt":0.27190628954784374,"score_spread":0.20250498061254937,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2162672362","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.026227698,0.0004503436,0.9703658,0.00024476062,0.0000432085,0.00034708926,0.00023263901,0.0007708013,0.0013176441],"genre_scores_gemma":[0.23069346,0.00028865904,0.7657697,0.0001244301,0.000112740134,0.000436293,0.0006878452,0.00014328674,0.0017436191],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.99741614,0.0007199423,0.00019687683,0.00073057006,0.000799006,0.00013740429],"domain_scores_gemma":[0.99425125,0.0019063423,0.0010712545,0.0007870489,0.0017479272,0.00023632914],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.002149212,0.00088532944,0.0009217185,0.010539315,0.0018636244,0.0016148445,0.0016282294,0.0010663489,0.00070271565],"category_scores_gemma":[0.009886341,0.00058812817,0.0013336645,0.006438124,0.0015172499,0.003062252,0.0018078336,0.0010878475,0.00053551124],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0004043869,0.000989418,0.02725777,0.00088729645,0.00078936905,0.0004959653,0.0042395494,0.051578138,0.04371579,0.060735673,0.010831221,0.79807556],"study_design_scores_gemma":[0.00010317602,0.00026948733,0.014243669,0.00016070383,0.0002600081,0.0012505408,0.0012929293,0.84675294,0.017834608,0.10640962,0.011177372,0.00024485766],"about_ca_topic_score_codex":0.0050336127,"about_ca_topic_score_gemma":0.013885433,"teacher_disagreement_score":0.010539315,"about_ca_system_score_codex":0.0010395686,"about_ca_system_score_gemma":0.0019994236,"threshold_uncertainty_score":0.011366248},"labels":[],"label_agreement":null},{"id":"W2163656795","doi":"10.1109/iri.2009.5211539","title":"Visual integration tool for heterogeneous data type by unified vectorization","year":2009,"lang":"en","type":"article","venue":"","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":7,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Ontario Tech University","funders":"","keywords":"Computer science; Schema (genetic algorithms); Data integration; Vectorization (mathematics); Data mining; Visualization; Data type; Information retrieval; Bin; Algorithm; Programming language","score_opus":0.03482391784012756,"score_gpt":0.30787124631833146,"score_spread":0.2730473284782039,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2163656795","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0020320758,0.000108222644,0.965243,0.00018007623,0.00007509107,0.000085756285,0.0009097834,0.029692214,0.0016737796],"genre_scores_gemma":[0.043305356,0.00025611705,0.94687545,0.00017269018,0.000053764466,0.00038249706,0.002294211,0.0039452515,0.002714665],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9991892,0.00017508172,0.00010977985,0.00013837259,0.0003158888,0.000071672446],"domain_scores_gemma":[0.99807066,0.00084357813,0.00012978914,0.00031551265,0.00051918207,0.00012120729],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0019848684,0.0014670542,0.0010301548,0.0059488914,0.0005607987,0.0031575942,0.0016233982,0.0009025025,0.020664403],"category_scores_gemma":[0.0055543245,0.00059773686,0.001383105,0.004029103,0.0005867852,0.0043821223,0.003068388,0.0014779415,0.004456756],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0008842803,0.0002097231,0.0023662809,0.00096703385,0.00023473389,0.0007398338,0.0016144745,0.015974551,0.029688153,0.060381692,0.106593184,0.7803461],"study_design_scores_gemma":[0.00030335214,0.00020135779,0.0031129955,0.00035148076,0.0001547692,0.0009934779,0.00094483513,0.60621744,0.03945677,0.11779026,0.23022899,0.0002442003],"about_ca_topic_score_codex":0.0024278793,"about_ca_topic_score_gemma":0.0020267062,"teacher_disagreement_score":0.020664403,"about_ca_system_score_codex":0.00059012574,"about_ca_system_score_gemma":0.0007940585,"threshold_uncertainty_score":0.06912929},"labels":[],"label_agreement":null},{"id":"W2165050191","doi":"10.1109/ccece.2006.277719","title":"Extracting Document Semantics for Semantic Header","year":2006,"lang":"en","type":"article","venue":"","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":3,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Concordia University","funders":"","keywords":"Computer science; Header; Information retrieval; Semantics (computer science); Search engine indexing; Context (archaeology); Key (lock); Generator (circuit theory); Programming language","score_opus":0.015068688998266298,"score_gpt":0.2610216164655017,"score_spread":0.2459529274672354,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2165050191","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.11462574,0.0005195104,0.84779066,0.00036352169,0.000100983205,0.0006681394,0.0044884933,0.027159514,0.004283381],"genre_scores_gemma":[0.2812763,0.0003902582,0.70260257,0.00009131394,0.000078074045,0.00030909007,0.012947206,0.0010366401,0.0012685952],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.99894553,0.0002479892,0.00013890691,0.00021244459,0.00037010942,0.000085045],"domain_scores_gemma":[0.9952826,0.0018563069,0.000617346,0.0010963127,0.0010264223,0.00012107291],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0017411958,0.00081526116,0.0006558551,0.009024794,0.00066526345,0.0018271958,0.00057994685,0.0008969321,0.002157613],"category_scores_gemma":[0.009310769,0.0004572222,0.00074056565,0.0035625088,0.00077123666,0.0039635804,0.0013943133,0.000672949,0.0017543004],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00075876305,0.0002661452,0.01065117,0.00070631807,0.00007495238,0.0006966231,0.0011326028,0.010300559,0.08423885,0.042093664,0.0132631445,0.83581716],"study_design_scores_gemma":[0.00026352407,0.0006246827,0.013848999,0.00029677534,0.00027450963,0.0018866988,0.0013908638,0.5126721,0.2623828,0.1350672,0.07106191,0.00022998452],"about_ca_topic_score_codex":0.00095910794,"about_ca_topic_score_gemma":0.0008246852,"teacher_disagreement_score":0.009024794,"about_ca_system_score_codex":0.00088288897,"about_ca_system_score_gemma":0.0014317884,"threshold_uncertainty_score":0.009208441},"labels":[],"label_agreement":null},{"id":"W2166367071","doi":"10.1109/wi.2006.103","title":"Interactive Web Information Retrieval Using WordBars","year":2006,"lang":"en","type":"article","venue":"","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":33,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Regina","funders":"","keywords":"Computer science; Information retrieval; Web query classification; Web search query; Query expansion; Set (abstract data type); sort; Result set; Search engine; Query language; World Wide Web; Information needs","score_opus":0.009736650522841726,"score_gpt":0.2347955252822921,"score_spread":0.22505887475945038,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2166367071","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.02008684,0.0017159226,0.734092,0.0007599405,0.0004455325,0.000789423,0.0057764505,0.21204978,0.02428404],"genre_scores_gemma":[0.1403288,0.0019931844,0.7967836,0.00091686926,0.00035513128,0.0017216548,0.012778052,0.016386054,0.028736684],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.99800926,0.00065685646,0.00031418324,0.00027449505,0.00059213344,0.00015306521],"domain_scores_gemma":[0.99101126,0.0063167317,0.00044839497,0.00072381017,0.0011809478,0.0003188551],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0027597174,0.0023787958,0.0014042438,0.0064896406,0.0006789435,0.0037790092,0.001836573,0.0014867634,0.048824105],"category_scores_gemma":[0.013912379,0.0008491825,0.0009503111,0.005457579,0.0008593377,0.007450326,0.003733596,0.0009414828,0.016439037],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0026857043,0.00031148398,0.0017556611,0.002965143,0.00017027075,0.0014315534,0.003802317,0.00562846,0.04157156,0.034851693,0.18034185,0.72448426],"study_design_scores_gemma":[0.0010425916,0.0007129612,0.0020634448,0.0012428348,0.00021615425,0.0018852878,0.0020838813,0.11525775,0.07189903,0.108079456,0.69500285,0.00051376916],"about_ca_topic_score_codex":0.0014525474,"about_ca_topic_score_gemma":0.0017456715,"teacher_disagreement_score":0.048824105,"about_ca_system_score_codex":0.00073952676,"about_ca_system_score_gemma":0.0005539018,"threshold_uncertainty_score":0.16333288},"labels":[],"label_agreement":null},{"id":"W2166597489","doi":"10.1145/1978942.1979205","title":"Characterizing the usability of interactive applications through query log analysis","year":2011,"lang":"en","type":"article","venue":"","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":33,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Waterloo","funders":"","keywords":"Usability; Computer science; Troubleshooting; Web search query; Set (abstract data type); Information retrieval; Selection (genetic algorithm); Web query classification; Process (computing); Product (mathematics); Usability inspection; The Internet; Query expansion; Heuristic evaluation; Search engine; World Wide Web; Human–computer interaction; Artificial intelligence","score_opus":0.04529209062245151,"score_gpt":0.2802455875017747,"score_spread":0.23495349687932318,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2166597489","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.9361542,0.0003426906,0.059252866,0.00015752052,0.00001041534,0.0003706956,0.0010490135,0.00089737645,0.0017652201],"genre_scores_gemma":[0.9540259,0.00017733143,0.04294873,0.000052393036,0.000019015806,0.00037826144,0.0018913586,0.00010690696,0.0004001097],"study_design_codex":"observational","study_design_gemma":"observational","domain_scores_codex":[0.9869012,0.0059521412,0.0014778669,0.0009240329,0.004293564,0.00045119354],"domain_scores_gemma":[0.8460579,0.12374823,0.009525083,0.00998084,0.009809538,0.00087834994],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.010240261,0.00079887384,0.0007263896,0.007060168,0.00068633887,0.0025552681,0.0008684641,0.0007423583,0.0004910577],"category_scores_gemma":[0.07077404,0.00037409132,0.00060938427,0.004492343,0.0009307053,0.0032201232,0.0012649345,0.001130668,0.00030492304],"study_design_candidate":"observational","study_design_consensus":"observational","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0015879499,0.0016766551,0.6130834,0.0013078735,0.00053683855,0.0004445805,0.01080184,0.01976259,0.030261286,0.0032746585,0.0035006036,0.31376174],"study_design_scores_gemma":[0.00009622318,0.002523347,0.6692505,0.00018815433,0.00031497361,0.0007587814,0.0066435323,0.27300313,0.03019226,0.010531122,0.0062041837,0.00029381487],"about_ca_topic_score_codex":0.0063338657,"about_ca_topic_score_gemma":0.008335097,"teacher_disagreement_score":0.010240261,"about_ca_system_score_codex":0.0007815407,"about_ca_system_score_gemma":0.0007877504,"threshold_uncertainty_score":0.054156303},"labels":[],"label_agreement":null},{"id":"W2167213883","doi":"10.1145/2047196.2047224","title":"Query-feature graphs","year":2011,"lang":"en","type":"article","venue":"","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":37,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Waterloo","funders":"","keywords":"Computer science; USable; Web query classification; Feature (linguistics); Information retrieval; Graphics; Web search query; Search engine; Theoretical computer science; World Wide Web; Computer graphics (images)","score_opus":0.026125892937535113,"score_gpt":0.21315343806837164,"score_spread":0.18702754513083653,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2167213883","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0051292214,0.00039661012,0.9714116,0.0009231092,0.00011284055,0.00040275327,0.004286741,0.0063864724,0.010950685],"genre_scores_gemma":[0.17515367,0.0010122953,0.7885288,0.0014172125,0.00015270698,0.0010938301,0.014556238,0.0031549372,0.014930362],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.99537,0.0012165504,0.0004469105,0.0010290829,0.0015640402,0.0003734871],"domain_scores_gemma":[0.98965424,0.0051941047,0.00053057075,0.00257912,0.0016990282,0.00034303823],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0032091998,0.001283427,0.00084941846,0.003988916,0.0016268449,0.0040483945,0.0025799272,0.0019756048,0.013727457],"category_scores_gemma":[0.01936449,0.0008224835,0.0018529843,0.004588518,0.0022620761,0.011928828,0.0033766767,0.0020144803,0.0033686836],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0002370097,0.00015352869,0.0028244255,0.00060879317,0.000088241744,0.0007673587,0.0015760426,0.019715665,0.004241255,0.7463613,0.040096626,0.18332966],"study_design_scores_gemma":[0.000037461617,0.0000893024,0.00063358626,0.0001500909,0.00006243928,0.0007044699,0.0005232106,0.07363593,0.00530256,0.6535125,0.26525152,0.000096933974],"about_ca_topic_score_codex":0.009941251,"about_ca_topic_score_gemma":0.00904359,"teacher_disagreement_score":0.013727457,"about_ca_system_score_codex":0.0018248586,"about_ca_system_score_gemma":0.0016513664,"threshold_uncertainty_score":0.045922935},"labels":[],"label_agreement":null},{"id":"W2167435152","doi":"10.1145/1242572.1242838","title":"Adaptive record extraction from web pages","year":2007,"lang":"en","type":"article","venue":"","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":21,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Calgary","funders":"","keywords":"Computer science; Cluster analysis; Matching (statistics); Tree (set theory); Metric (unit); Web page; Data mining; Information retrieval; World Wide Web; Artificial intelligence; Engineering; Mathematics","score_opus":0.03173912972544339,"score_gpt":0.2678346333360881,"score_spread":0.23609550361064469,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2167435152","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.016427694,0.000614106,0.97099465,0.00019906496,0.0000847326,0.00042510664,0.0028608982,0.0071871453,0.0012066308],"genre_scores_gemma":[0.03587163,0.00037424287,0.9538886,0.00010817799,0.0000739724,0.00029871124,0.0070091183,0.00038551714,0.001990026],"study_design_codex":"design_other","study_design_gemma":"bench_or_experimental","domain_scores_codex":[0.9959462,0.00048608135,0.00061697495,0.00092462695,0.0018578715,0.00016820212],"domain_scores_gemma":[0.98921585,0.0033931436,0.0011609105,0.003477554,0.0025395616,0.0002128337],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0017535733,0.0008071263,0.0013064892,0.008197604,0.00089722994,0.0024307983,0.0026866307,0.0013305608,0.0026013425],"category_scores_gemma":[0.013369507,0.0006576242,0.0012891114,0.012926842,0.00058507966,0.0033256474,0.002084091,0.0013929298,0.0037901772],"study_design_candidate":"bench_or_experimental","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00016046036,0.0002874292,0.009413445,0.000743253,0.00018035005,0.00029506814,0.0003926848,0.004016516,0.04603907,0.003500025,0.011818693,0.92315286],"study_design_scores_gemma":[0.00015991324,0.0006000651,0.03427827,0.00032225915,0.00073746964,0.0053362628,0.0009469673,0.4537959,0.25211605,0.041512582,0.20975865,0.00043559226],"about_ca_topic_score_codex":0.0019412513,"about_ca_topic_score_gemma":0.004124977,"teacher_disagreement_score":0.008197604,"about_ca_system_score_codex":0.0003772423,"about_ca_system_score_gemma":0.0015925409,"threshold_uncertainty_score":0.009273887},"labels":[],"label_agreement":null},{"id":"W2168791733","doi":"10.1109/i-society16502.2010.6018792","title":"Utilizing visualisation for improving Web search effectiveness","year":2010,"lang":"en","type":"article","venue":"","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":3,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Dalhousie University","funders":"","keywords":"Computer science; Visualization; Information retrieval; Relevance (law); World Wide Web; Rendering (computer graphics); Search engine; Web search query; Process (computing); Web page; Scroll; Data mining; Artificial intelligence; Engineering","score_opus":0.029854972991748573,"score_gpt":0.3190512389916688,"score_spread":0.28919626599992027,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2168791733","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.23294625,0.015101915,0.67412233,0.003640899,0.0005588805,0.000538523,0.00094778644,0.03872965,0.03341373],"genre_scores_gemma":[0.58765566,0.0063951034,0.39903268,0.0002623184,0.00034587085,0.0002614994,0.00077574194,0.001703032,0.0035680456],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9975374,0.0013232895,0.00018097446,0.00014348791,0.00067005504,0.00014476728],"domain_scores_gemma":[0.9807926,0.014626481,0.0008329472,0.001406248,0.0020759318,0.00026587475],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0035642546,0.0016824252,0.0017582497,0.0038816435,0.0005349587,0.0070991744,0.001117552,0.001497622,0.0060750195],"category_scores_gemma":[0.037252,0.0006095881,0.00080706936,0.0035828396,0.0005684149,0.006488727,0.0024068272,0.001266661,0.0018318432],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0014556871,0.00034901855,0.0047158417,0.0020191623,0.00020686042,0.00045806714,0.0028268145,0.037633877,0.044514466,0.013370276,0.0153205255,0.87712944],"study_design_scores_gemma":[0.00088352925,0.001823978,0.012991945,0.0015076771,0.0011204692,0.0023275565,0.0029082696,0.70541245,0.12211408,0.068007976,0.080250524,0.0006515389],"about_ca_topic_score_codex":0.0012576598,"about_ca_topic_score_gemma":0.0010822838,"teacher_disagreement_score":0.0070991744,"about_ca_system_score_codex":0.0005664582,"about_ca_system_score_gemma":0.00068468077,"threshold_uncertainty_score":0.020322978},"labels":[],"label_agreement":null},{"id":"W2169558036","doi":"10.1109/dnsr.2004.1344744","title":"The reconstruction of user sessions from a server log using improved time-oriented heuristics","year":2004,"lang":"en","type":"article","venue":"","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":46,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of New Brunswick","funders":"Atlantic Canada Opportunities Agency","keywords":"Computer science; Heuristics; Web log analysis software; Web mining; Web server; Personalization; Web page; Web modeling; Web service; Clickstream; Data Web; World Wide Web; Web navigation; Adaptation (eye); Information retrieval; Data mining; Static web page; Web API; The Internet","score_opus":0.013346417128876329,"score_gpt":0.23628772171043813,"score_spread":0.2229413045815618,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2169558036","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.11920151,0.0002790579,0.8774001,0.00010592329,0.000023206829,0.00018403628,0.00022754833,0.0018557762,0.0007228588],"genre_scores_gemma":[0.404364,0.00015318247,0.5933832,0.00006627006,0.00003066271,0.00023235964,0.0009889359,0.00021446624,0.0005669669],"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9973699,0.0010007086,0.00023879153,0.00047710256,0.0006182209,0.00029531226],"domain_scores_gemma":[0.98758847,0.008014772,0.0011183486,0.0014298031,0.0013648098,0.00048386594],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0024139406,0.0010057723,0.0014585486,0.0023880769,0.0005705187,0.0012584506,0.0017477542,0.00092508295,0.00082865305],"category_scores_gemma":[0.014624457,0.0005644748,0.0010048408,0.0021662856,0.00064698316,0.0019214475,0.00078863365,0.0008825605,0.00032803652],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0010509471,0.0007631638,0.019027816,0.0002448884,0.00025828936,0.00024264224,0.0006921047,0.62830323,0.013251893,0.008034924,0.0023037859,0.3258262],"study_design_scores_gemma":[0.000038155067,0.00008717447,0.0015389945,0.0000068406766,0.000035163404,0.00007549763,0.00006699444,0.9928976,0.0024763066,0.0022936407,0.00046062501,0.000022962715],"about_ca_topic_score_codex":0.0103389835,"about_ca_topic_score_gemma":0.01085926,"teacher_disagreement_score":0.0103389835,"about_ca_system_score_codex":0.0011820868,"about_ca_system_score_gemma":0.0031247283,"threshold_uncertainty_score":0.020557642},"labels":[],"label_agreement":null},{"id":"W2174703538","doi":"10.1007/978-3-642-41230-1_37","title":"Automatically Training Form Classifiers","year":2013,"lang":"en","type":"book-chapter","venue":"Lecture notes in computer science","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":0,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Alberta","funders":"","keywords":"Computer science; Web crawler; Domain (mathematical analysis); Machine learning; Training set; Quality (philosophy); Training (meteorology); Data mining; Artificial intelligence; State (computer science); Information retrieval; World Wide Web; Mathematics","score_opus":0.02991305767942924,"score_gpt":0.24679241226717488,"score_spread":0.21687935458774565,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2174703538","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.024109764,0.0016637418,0.9233162,0.0006566629,0.0006138805,0.0003276016,0.0014985747,0.026599618,0.021213941],"genre_scores_gemma":[0.16213188,0.0013662573,0.77142817,0.0004765061,0.00038967308,0.000348241,0.008162202,0.0023091605,0.05338795],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.99855655,0.00018709722,0.000077183795,0.0005367641,0.0004915175,0.00015093878],"domain_scores_gemma":[0.9987871,0.0003513134,0.0000693122,0.0003261727,0.00041249223,0.000053639236],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0010327651,0.0019311843,0.001652118,0.0024093897,0.0012706564,0.0028490343,0.0020141706,0.0016976504,0.021377336],"category_scores_gemma":[0.003717565,0.00084083725,0.0014769026,0.0018905847,0.0006680064,0.004907445,0.0028549454,0.0020336853,0.023224028],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00014266587,0.00008099598,0.0011267061,0.00010349738,0.000028395953,0.00011631586,0.000070972186,0.00383879,0.009697177,0.0070047867,0.029030062,0.94875973],"study_design_scores_gemma":[0.00007089021,0.0002400656,0.0025655443,0.00022371304,0.000173545,0.0014485066,0.00036372553,0.6943678,0.086853474,0.07275118,0.14088774,0.000053710173],"about_ca_topic_score_codex":0.0014167365,"about_ca_topic_score_gemma":0.003215648,"teacher_disagreement_score":0.021377336,"about_ca_system_score_codex":0.0008723073,"about_ca_system_score_gemma":0.00092017517,"threshold_uncertainty_score":0.07151425},"labels":[],"label_agreement":null},{"id":"W2180448061","doi":"10.1007/978-1-4939-7131-2_101177","title":"Social Networking Sites","year":2018,"lang":"en","type":"book-chapter","venue":"","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":0,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Calgary","funders":"","keywords":"Business; Computer science","score_opus":0.05026094257965078,"score_gpt":0.26146404396930645,"score_spread":0.21120310138965567,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2180448061","genre_codex":"other","genre_gemma":"other","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"other","genre_consensus":"other","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0022939988,0.0019943158,0.0053106644,0.0013679505,0.0007709845,0.00009087846,0.002112419,0.0013117666,0.98474693],"genre_scores_gemma":[0.013844698,0.0031171623,0.0039528697,0.00051305856,0.00069933716,0.00008725418,0.003109999,0.00047661457,0.97419894],"study_design_codex":"not_applicable","study_design_gemma":"not_applicable","domain_scores_codex":[0.9996387,0.000054788416,0.000012165204,0.000064840846,0.00019083629,0.000038725993],"domain_scores_gemma":[0.99949384,0.00010316371,0.000032588738,0.00012334743,0.00013200716,0.00011502456],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.00032282036,0.00073476083,0.00035961645,0.0034302021,0.0014200108,0.003812074,0.00091767847,0.0011200428,0.22349408],"category_scores_gemma":[0.0014960449,0.00032752714,0.00029859858,0.0041216016,0.00043797898,0.005183338,0.002176023,0.0009983074,0.17224838],"study_design_candidate":"not_applicable","study_design_consensus":"not_applicable","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.000019118464,0.000063056745,0.00043281948,0.00019182416,0.000007181749,0.00009130013,0.00026786415,0.00021240208,0.0011610066,0.08138757,0.4964078,0.41975802],"study_design_scores_gemma":[0.0000021894716,0.000006845026,0.00032186188,0.000071645736,0.000003456144,0.0001499527,0.00009127415,0.00029803516,0.00035640792,0.008756363,0.9899368,0.000005213404],"about_ca_topic_score_codex":0.0011982488,"about_ca_topic_score_gemma":0.0030791042,"teacher_disagreement_score":0.22349408,"about_ca_system_score_codex":0.0006477032,"about_ca_system_score_gemma":0.0005692849,"threshold_uncertainty_score":0.7476622},"labels":[],"label_agreement":null},{"id":"W2185172136","doi":"","title":"An Analysis on Google Chrome","year":2010,"lang":"en","type":"article","venue":"","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of British Columbia","funders":"","keywords":"Computer science; JavaScript; Popularity; Feature (linguistics); Process (computing); World Wide Web; Database; Operating system","score_opus":0.008643757878000818,"score_gpt":0.2594108885652123,"score_spread":0.2507671306872115,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2185172136","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.81151855,0.0045335763,0.0079116905,0.001406885,0.00020362345,0.0003346181,0.03411401,0.0060306382,0.13394642],"genre_scores_gemma":[0.85142785,0.0025430114,0.012181922,0.00042374208,0.00010747515,0.00010797423,0.055052735,0.0027145094,0.07544071],"study_design_codex":"design_other","study_design_gemma":"observational","domain_scores_codex":[0.99776316,0.00010660261,0.00007615494,0.00020588559,0.0015707221,0.00027750523],"domain_scores_gemma":[0.9961356,0.00081210764,0.00016388089,0.00028023202,0.0024458722,0.00016232776],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.00050616893,0.0006851344,0.00049056084,0.008657198,0.0011381931,0.002257597,0.00043507616,0.0005871836,0.0055012596],"category_scores_gemma":[0.0040531177,0.0002520853,0.0008086036,0.01229577,0.00044709738,0.0018882424,0.00060493534,0.0006151628,0.0039242883],"study_design_candidate":"observational","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0016868265,0.0005905767,0.21230038,0.00156969,0.00041574537,0.008489993,0.006107018,0.004805798,0.03519871,0.018652497,0.23890418,0.47127858],"study_design_scores_gemma":[0.0000400848,0.00032836964,0.60638344,0.00022676692,0.00030687006,0.0033160225,0.004785099,0.026451917,0.021871665,0.0022667374,0.33376032,0.0002626932],"about_ca_topic_score_codex":0.09588037,"about_ca_topic_score_gemma":0.082073875,"teacher_disagreement_score":0.09588037,"about_ca_system_score_codex":0.0014414232,"about_ca_system_score_gemma":0.001233379,"threshold_uncertainty_score":0.19064456},"labels":[],"label_agreement":null},{"id":"W2188227831","doi":"","title":"BUPTTeam Participation at TAC 2013 Entity Linking","year":2013,"lang":"en","type":"article","venue":"Theory and applications of categories","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":true,"route_about_ca":false,"ca_institutions":"","funders":"","keywords":"Entity linking; Computer science; Task (project management); Cluster analysis; Named-entity recognition; Named entity; Information retrieval; Natural language processing; Artificial intelligence; Knowledge base","score_opus":0.010119150116038887,"score_gpt":0.24970958457119705,"score_spread":0.23959043445515815,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2188227831","genre_codex":"other","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.06647434,0.0060670814,0.28946126,0.038633093,0.021902798,0.0028331883,0.026764931,0.060725737,0.48713756],"genre_scores_gemma":[0.17161834,0.0021908474,0.23160763,0.005758388,0.004904283,0.002552074,0.10821839,0.012622247,0.4605279],"study_design_codex":"not_applicable","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.98809797,0.0034229648,0.0003721674,0.0016758699,0.005137583,0.0012934246],"domain_scores_gemma":[0.9863572,0.0030267674,0.00024522378,0.0035032446,0.0037902272,0.0030773287],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.015868437,0.0015737736,0.0015845017,0.0037505396,0.005976017,0.007140236,0.0042715166,0.003881354,0.052062836],"category_scores_gemma":[0.02149011,0.0009019957,0.0009528347,0.004111591,0.0012439158,0.008670115,0.011831342,0.005215354,0.038288105],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00077327364,0.0005920987,0.0014283234,0.00022301097,0.00006224736,0.00077016454,0.0012389392,0.0022771135,0.005791981,0.011568258,0.7279225,0.24735208],"study_design_scores_gemma":[0.00012908304,0.00016950065,0.0012123698,0.0000900711,0.00003275364,0.000453079,0.00037534264,0.017809808,0.00827702,0.007918947,0.9634419,0.00009013091],"about_ca_topic_score_codex":0.010740198,"about_ca_topic_score_gemma":0.015763205,"teacher_disagreement_score":0.052062836,"about_ca_system_score_codex":0.0022726126,"about_ca_system_score_gemma":0.004305373,"threshold_uncertainty_score":0.17416757},"labels":[],"label_agreement":null},{"id":"W2210001673","doi":"10.1007/1-4020-5263-4_13","title":"Different Strategies for Web Mining","year":2007,"lang":"en","type":"book-chapter","venue":"","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":0,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Western University","funders":"","keywords":"Web mining; Computer science; The Internet; World Wide Web; Web intelligence; Web page; Data science; Search engine indexing; Web development; Data mining","score_opus":0.06444501899863472,"score_gpt":0.279843575477952,"score_spread":0.2153985564793173,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2210001673","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0026224386,0.0171931,0.90061235,0.008044077,0.00080359424,0.00023078812,0.00032191994,0.0017956262,0.06837616],"genre_scores_gemma":[0.04761744,0.020187369,0.8531522,0.0028298222,0.0008804989,0.00051991834,0.00094339944,0.0011906164,0.07267871],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"not_applicable","domain_scores_codex":[0.99668413,0.0009132607,0.0002569684,0.00057010463,0.0014172337,0.00015823967],"domain_scores_gemma":[0.99497944,0.00250625,0.00009438277,0.0013577432,0.0009112701,0.0001509136],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0045915702,0.0017040701,0.0012319995,0.007337285,0.0017200295,0.008830736,0.0044212043,0.0023540177,0.010096433],"category_scores_gemma":[0.012006021,0.0012486747,0.0019131701,0.0075089494,0.004590383,0.018528597,0.003398605,0.003988141,0.0069096144],"study_design_candidate":"not_applicable","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.000029305587,0.00007003306,0.00035466105,0.00034874128,0.000053124608,0.000061974766,0.0005560251,0.0010450088,0.0006519736,0.6020979,0.023818597,0.37091255],"study_design_scores_gemma":[0.000016918995,0.000019049185,0.00033327425,0.00023682613,0.00004646815,0.00037314233,0.00039365838,0.013476741,0.003263264,0.8402156,0.14157788,0.000047075122],"about_ca_topic_score_codex":0.0017033257,"about_ca_topic_score_gemma":0.002314788,"teacher_disagreement_score":0.010096433,"about_ca_system_score_codex":0.0016725496,"about_ca_system_score_gemma":0.0013268036,"threshold_uncertainty_score":0.033775926},"labels":[],"label_agreement":null},{"id":"W2228746700","doi":"10.1007/978-1-4419-6287-4_11","title":"Integrating Genetic Algorithms and Fuzzy Logic for Web Structure Optimization","year":2010,"lang":"en","type":"book-chapter","venue":"Annals of information systems","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":0,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Calgary","funders":"","keywords":"Fuzzy logic; Restructuring; Rank (graph theory); Mathematics; Algorithm; Index (typography); Fuzzy classification; Fuzzy number; Fuzzy set operations; Value (mathematics); Computer science; Degree (music); Data mining; Fuzzy set; Artificial intelligence; Machine learning; Combinatorics; Programming language","score_opus":0.03329288621915474,"score_gpt":0.2659942045610276,"score_spread":0.23270131834187288,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2228746700","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0077059506,0.00057995965,0.9851059,0.00020728676,0.0000563405,0.00003287867,0.00002583193,0.00021949185,0.006066372],"genre_scores_gemma":[0.21386772,0.00090285105,0.7798593,0.00016258698,0.0001272725,0.00012332674,0.00008700522,0.00012779953,0.0047420566],"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.99974746,0.00007102479,0.000010942427,0.000029020426,0.00012231393,0.00001929854],"domain_scores_gemma":[0.99954444,0.00030449033,0.00002158683,0.000032243213,0.000084804655,0.000012380903],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0008465242,0.0005962524,0.0008282484,0.0009773714,0.00041691813,0.0009727571,0.0012138787,0.0012886849,0.0024973524],"category_scores_gemma":[0.0023369198,0.00039865784,0.00066156435,0.0013325404,0.0005011248,0.0011649249,0.00061149674,0.0010553036,0.0004589853],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.000022247124,0.000066170316,0.0002525026,0.000054649034,0.00004361678,0.000026632872,0.00003244237,0.79133457,0.0013246122,0.026847728,0.0014357846,0.17855899],"study_design_scores_gemma":[0.0000056738945,0.000010243384,0.00004104061,0.000008889844,0.000007946955,0.0000074628324,0.000005586792,0.9810539,0.0003099387,0.018023696,0.0005220817,0.0000036812237],"about_ca_topic_score_codex":0.0069438512,"about_ca_topic_score_gemma":0.008953563,"teacher_disagreement_score":0.0069438512,"about_ca_system_score_codex":0.00085684966,"about_ca_system_score_gemma":0.00088227383,"threshold_uncertainty_score":0.0138068795},"labels":[],"label_agreement":null},{"id":"W2243050748","doi":"10.1109/ase.2015.52","title":"SpyREST: Automated RESTful API Documentation Using an HTTP Proxy Server (N)","year":2015,"lang":"en","type":"article","venue":"","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":30,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Calgary","funders":"","keywords":"Documentation; Computer science; Application programming interface; Web API; World Wide Web; Proxy server; Database; Operating system; Web server; Software engineering; The Internet","score_opus":0.06536810781060924,"score_gpt":0.33197130241102113,"score_spread":0.2666031946004119,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2243050748","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.02304738,0.00017793298,0.6756616,0.00020918575,0.00008917175,0.0005536745,0.0012093817,0.29459226,0.004459343],"genre_scores_gemma":[0.1732698,0.00024270239,0.79746157,0.00025207008,0.00004595711,0.00049110333,0.00573038,0.012147583,0.010358826],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.99768305,0.0005066154,0.00030690874,0.00039529518,0.0009909923,0.00011707993],"domain_scores_gemma":[0.99138194,0.001981924,0.0008856488,0.0038957756,0.0016044776,0.000250211],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.002857133,0.0011863377,0.0006827706,0.0018915756,0.0006424558,0.0018937023,0.002059847,0.0007874986,0.0037518386],"category_scores_gemma":[0.010233783,0.0008952667,0.00097448146,0.0010407541,0.00065802794,0.002296904,0.0019561034,0.001464071,0.004341895],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0010183905,0.00060845714,0.011233547,0.00079431967,0.00018225813,0.0016227767,0.0010702644,0.011434758,0.08145555,0.007897514,0.076365456,0.8063167],"study_design_scores_gemma":[0.00033384174,0.00039354915,0.010714147,0.0002793513,0.00010565996,0.002218592,0.0002846405,0.525373,0.34739828,0.008104595,0.10451911,0.0002753295],"about_ca_topic_score_codex":0.0024637827,"about_ca_topic_score_gemma":0.0030666923,"teacher_disagreement_score":0.0037518386,"about_ca_system_score_codex":0.0005209461,"about_ca_system_score_gemma":0.001808065,"threshold_uncertainty_score":0.015110135},"labels":[],"label_agreement":null},{"id":"W2244791503","doi":"10.1109/ase.2015.110","title":"LED: Tool for Synthesizing Web Element Locators","year":2015,"lang":"en","type":"article","venue":"","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":4,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of British Columbia","funders":"Intel Corporation","keywords":"JavaScript; Document Object Model; Computer science; Web application; Task (project management); Code (set theory); World Wide Web; Database; Programming language; Web page; Engineering","score_opus":0.03584674453809787,"score_gpt":0.2679729573401599,"score_spread":0.23212621280206203,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2244791503","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.011417565,0.0002788628,0.6489945,0.00013752347,0.00010970455,0.00040438864,0.011379251,0.3239572,0.0033210404],"genre_scores_gemma":[0.05761661,0.00018690813,0.8903298,0.00017241969,0.000032037777,0.00077575503,0.025145711,0.021513076,0.0042276965],"study_design_codex":"design_other","study_design_gemma":"bench_or_experimental","domain_scores_codex":[0.9979377,0.00031381633,0.0003491212,0.00059934263,0.0007037621,0.000096282674],"domain_scores_gemma":[0.99302435,0.0040107686,0.00051906094,0.0009383947,0.0013836361,0.00012375804],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0020838312,0.0020067615,0.00084909634,0.0049077617,0.0006114464,0.0018408379,0.0020345342,0.0013618636,0.011781185],"category_scores_gemma":[0.014114609,0.0013118647,0.0013639521,0.0018285792,0.0006436181,0.0021947308,0.0017840288,0.0016052427,0.010021652],"study_design_candidate":"bench_or_experimental","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0007984805,0.00044571978,0.014669367,0.0031370514,0.00023070043,0.0010632623,0.0020860753,0.018273553,0.08196833,0.007722944,0.10718111,0.7624233],"study_design_scores_gemma":[0.00039163246,0.00035055255,0.0065261563,0.0004852425,0.00020703638,0.0013316799,0.0009080943,0.3890641,0.25893968,0.012515813,0.32900155,0.0002784481],"about_ca_topic_score_codex":0.0025184564,"about_ca_topic_score_gemma":0.0031344008,"teacher_disagreement_score":0.011781185,"about_ca_system_score_codex":0.0010239449,"about_ca_system_score_gemma":0.0015061328,"threshold_uncertainty_score":0.03941202},"labels":[],"label_agreement":null},{"id":"W2255450113","doi":"10.1007/978-3-662-43871-8_60","title":"Internet Advertisements Prediction","year":2015,"lang":"en","type":"book-chapter","venue":"","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":2,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"York University","funders":"","keywords":"The Internet; Openness to experience; Variety (cybernetics); Advertising; Internet privacy; World Wide Web; Identification (biology); Computer science; Business; Psychology; Artificial intelligence","score_opus":0.056542658659358654,"score_gpt":0.2422449917830784,"score_spread":0.18570233312371975,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2255450113","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.14487061,0.017509827,0.5287642,0.0075832885,0.0026976536,0.00070956437,0.024722027,0.023993956,0.24914885],"genre_scores_gemma":[0.5821698,0.0070643015,0.20405863,0.0011218665,0.0022644894,0.00027171086,0.027882399,0.0005712556,0.1745956],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9995639,0.000054472563,0.000016980082,0.00014709684,0.0001694161,0.000048022426],"domain_scores_gemma":[0.99940896,0.0002190237,0.000041110343,0.00009593217,0.00018840499,0.0000466857],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0006718007,0.001139751,0.0007683863,0.002601007,0.0004214624,0.0012939656,0.001079213,0.00066322443,0.009839602],"category_scores_gemma":[0.0017682626,0.00040481845,0.0008731318,0.0023715296,0.00017018369,0.0014455003,0.0005069627,0.0012368108,0.011056325],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00010989338,0.0004535236,0.014402036,0.00011329746,0.00007171401,0.000071108436,0.00003842236,0.011890679,0.0013991883,0.0049832347,0.11669654,0.8497704],"study_design_scores_gemma":[0.000030991807,0.00013780792,0.017671956,0.00016237616,0.0001962033,0.0004199238,0.00012871169,0.8668492,0.0087668,0.027679838,0.07789041,0.00006577141],"about_ca_topic_score_codex":0.0064219935,"about_ca_topic_score_gemma":0.007833321,"teacher_disagreement_score":0.009839602,"about_ca_system_score_codex":0.00057913654,"about_ca_system_score_gemma":0.0005466606,"threshold_uncertainty_score":0.032916725},"labels":[],"label_agreement":null},{"id":"W2257560390","doi":"10.29173/cais11","title":"Vers des systèmes de découverte et de filtrage d'information documentaire : quelle stratégie faut-il mettre en place?","year":2013,"lang":"fr","type":"article","venue":"Proceedings of the Annual Conference of CAIS / Actes du congrès annuel de l ACSI","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":2,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":true,"route_about_ca":false,"ca_institutions":"","funders":"","keywords":"Computer science; Humanities; Political science; Philosophy","score_opus":0.016831260144480317,"score_gpt":0.25466920787534997,"score_spread":0.23783794773086964,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2257560390","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.035962343,0.0042617084,0.89939463,0.018348578,0.0003958619,0.00061179296,0.00058547966,0.017856373,0.022583153],"genre_scores_gemma":[0.15938811,0.0037394722,0.7865022,0.0025029439,0.0003068786,0.00079619174,0.0018622823,0.0030305227,0.041871436],"study_design_codex":"design_other","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.98292863,0.0056736534,0.0014765928,0.0040269135,0.0050950954,0.00079910643],"domain_scores_gemma":[0.96028876,0.018197086,0.0019723736,0.010989444,0.006558962,0.0019933518],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.034293015,0.0017202221,0.0025710196,0.0064966045,0.0038298557,0.03720429,0.0036244981,0.0053518945,0.01474685],"category_scores_gemma":[0.061577506,0.0023230752,0.002360906,0.007051272,0.0063430825,0.050337918,0.007966444,0.00690845,0.009932774],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":true,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00064288924,0.00038793747,0.005115542,0.0014566293,0.00027845654,0.0002480868,0.018903399,0.0042170556,0.015794102,0.13897392,0.016055703,0.79792625],"study_design_scores_gemma":[0.0004252574,0.0006818136,0.0062090107,0.0018647719,0.0006268525,0.0013427216,0.014739731,0.08863192,0.07737223,0.20512547,0.60236275,0.0006173948],"about_ca_topic_score_codex":0.015679566,"about_ca_topic_score_gemma":0.00997565,"teacher_disagreement_score":0.9959222,"about_ca_system_score_codex":0.004077764,"about_ca_system_score_gemma":0.007170697,"threshold_uncertainty_score":0.18136096},"labels":[],"label_agreement":null},{"id":"W2277681113","doi":"10.1007/978-3-319-18356-5_34","title":"A Framework for Discovering Bursty Events and Their Relationships from Online News Articles","year":2015,"lang":"en","type":"book-chapter","venue":"Lecture notes in computer science","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":0,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of New Brunswick","funders":"","keywords":"Timestamp; Computer science; Set (abstract data type); Event (particle physics); Search engine indexing; Information retrieval; Data mining; Feature (linguistics); Computer security","score_opus":0.07314784756382184,"score_gpt":0.2881140631343033,"score_spread":0.21496621557048148,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2277681113","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.011526684,0.0014463624,0.98096085,0.00039759476,0.00006099177,0.0002345155,0.0019432128,0.0021165858,0.0013131825],"genre_scores_gemma":[0.12905152,0.0012994531,0.86094004,0.00015712103,0.00019381366,0.000379927,0.0042716237,0.00015905622,0.0035473693],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9984478,0.00031050324,0.00016425236,0.0004923968,0.00042727595,0.00015774799],"domain_scores_gemma":[0.99605834,0.0022443135,0.00045796263,0.00037128382,0.0005945407,0.00027357493],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0031819872,0.0011933463,0.0012563266,0.009872623,0.0013896134,0.00404498,0.0026844647,0.0018069906,0.0027242855],"category_scores_gemma":[0.008012108,0.00083856325,0.0021980256,0.0076821097,0.00097134657,0.0052658753,0.0022753566,0.002039635,0.0015657962],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0007490399,0.0011919002,0.03439337,0.0010588345,0.0008167293,0.0016598015,0.0018504764,0.079632565,0.015028292,0.17084989,0.024648806,0.6681204],"study_design_scores_gemma":[0.000057303958,0.00017216447,0.0062927688,0.0001350162,0.00024201453,0.0006831237,0.00048916024,0.80835986,0.0032814436,0.16187347,0.018304521,0.000109136],"about_ca_topic_score_codex":0.018162016,"about_ca_topic_score_gemma":0.02732577,"teacher_disagreement_score":0.018162016,"about_ca_system_score_codex":0.0011800751,"about_ca_system_score_gemma":0.0024344516,"threshold_uncertainty_score":0.036112607},"labels":[],"label_agreement":null},{"id":"W2280764953","doi":"10.1177/0165551515618589","title":"Time sensitive blog retrieval using temporal properties of queries","year":2015,"lang":"en","type":"article","venue":"Journal of Information Science","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":11,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Memorial University of Newfoundland","funders":"","keywords":"Blogosphere; Computer science; Information retrieval; Ranking (information retrieval); Relevance (law); Focus (optics); Set (abstract data type); Microblogging; Social media; World Wide Web; The Internet","score_opus":0.04922243145149023,"score_gpt":0.26833248302982055,"score_spread":0.2191100515783303,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2280764953","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.54178894,0.0055371528,0.44015118,0.00045259844,0.00027543172,0.0005273035,0.0016193811,0.0044281934,0.005219777],"genre_scores_gemma":[0.87375826,0.0012103237,0.11982264,0.00013698221,0.0003149805,0.00015776168,0.0020971894,0.00011009129,0.0023917444],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.99812096,0.00029431394,0.00025977477,0.00035023087,0.00081963645,0.00015499734],"domain_scores_gemma":[0.996403,0.0017129481,0.00058200496,0.0004896447,0.000680843,0.00013155653],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0014398915,0.0008615408,0.0015722504,0.0040009827,0.00048449522,0.0016491729,0.0009322601,0.00072204706,0.00079064985],"category_scores_gemma":[0.007671194,0.00026997575,0.00060481194,0.004359672,0.00033015336,0.0026790907,0.00085620454,0.0005194029,0.00063558185],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0021195246,0.0008789137,0.027008364,0.0007585147,0.00023252763,0.0006501394,0.00053849694,0.059693445,0.130051,0.003307501,0.009460736,0.7653009],"study_design_scores_gemma":[0.00011057776,0.00064384606,0.025643699,0.00003272896,0.00020244856,0.0014413424,0.00039851168,0.92734057,0.034825895,0.0041016173,0.0051433323,0.000115408264],"about_ca_topic_score_codex":0.0031170538,"about_ca_topic_score_gemma":0.0042044036,"teacher_disagreement_score":0.0040009827,"about_ca_system_score_codex":0.0006507216,"about_ca_system_score_gemma":0.00088162126,"threshold_uncertainty_score":0.0076149106},"labels":[],"label_agreement":null},{"id":"W2286710848","doi":"","title":"Large scale distribution of popular internet user generated content to mobile devices","year":2008,"lang":"en","type":"article","venue":"","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":1,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Communications Research Centre Canada","funders":"","keywords":"The Internet; Scale (ratio); Computer science; Content distribution; User-generated content; Mobile device; World Wide Web; Geography; Social media; Cartography; Computer network","score_opus":0.03246992949565837,"score_gpt":0.24873600583713937,"score_spread":0.21626607634148098,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2286710848","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.98934513,0.00022223734,0.0024327,0.00024175066,0.000029009923,0.000023174476,0.0057072174,0.00037703034,0.0016218325],"genre_scores_gemma":[0.99021435,0.0001452136,0.0008510108,0.000036552246,0.00004564097,0.000023451694,0.0072248154,0.00005488168,0.0014040916],"study_design_codex":"observational","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9993824,0.000100434474,0.000029875346,0.00014018347,0.00026723003,0.00007983392],"domain_scores_gemma":[0.9962226,0.0016323219,0.00045932332,0.00048535684,0.00093348575,0.0002668993],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.00036542767,0.0002780946,0.00036398528,0.0027974185,0.00042802028,0.00078710733,0.0004616402,0.00058785075,0.0018906092],"category_scores_gemma":[0.0052688206,0.0002371871,0.000353016,0.0030905101,0.00031070824,0.0009113181,0.0006800963,0.0005854685,0.0012797358],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0014391692,0.0008324404,0.745484,0.00039584984,0.00049860834,0.0018294384,0.0015100159,0.030211728,0.031834107,0.004021931,0.033736967,0.14820573],"study_design_scores_gemma":[0.000025522884,0.00014094626,0.85643286,0.000023363893,0.00007643671,0.00092738867,0.000933831,0.12939377,0.0055790376,0.0012769654,0.0051516527,0.000038159917],"about_ca_topic_score_codex":0.00475369,"about_ca_topic_score_gemma":0.005959885,"teacher_disagreement_score":0.00475369,"about_ca_system_score_codex":0.00051875744,"about_ca_system_score_gemma":0.0001876655,"threshold_uncertainty_score":0.009452045},"labels":[],"label_agreement":null},{"id":"W2287148974","doi":"10.1145/2888422.2888439","title":"Report on the SIGIR 2015 Workshop on Reproducibility, Inexplicability, and Generalizability of Results (RIGOR)","year":2016,"lang":"en","type":"article","venue":"ACM SIGIR Forum","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":59,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Waterloo","funders":"Università degli Studi di Padova","keywords":"Generalizability theory; Computer science; Presentation (obstetrics); Thursday; Information retrieval; Library science; Data science; Statistics; Medicine","score_opus":0.04259519423738254,"score_gpt":0.3006233049999692,"score_spread":0.25802811076258664,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2287148974","genre_codex":"methods","genre_gemma":"review","domain_codex":null,"domain_gemma":"reproducibility","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"review","genre_consensus":null,"domain_candidate":"reproducibility","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.028312158,0.06595184,0.33255008,0.3050986,0.14598331,0.008227564,0.01420851,0.01117791,0.088490106],"genre_scores_gemma":[0.26155975,0.023340307,0.32119054,0.087445684,0.06198272,0.013389722,0.06458687,0.017432543,0.14907177],"study_design_codex":"not_applicable","study_design_gemma":"not_applicable","domain_scores_codex":[0.6590006,0.18768106,0.020074673,0.025249636,0.09905916,0.008935003],"domain_scores_gemma":[0.3206436,0.32358348,0.01790087,0.10746204,0.20691216,0.023497783],"candidate_categories":["metaresearch"],"consensus_categories":["metaresearch"],"category_scores_codex":[0.42046374,0.0040470166,0.00427287,0.0073079686,0.007461053,0.025335962,0.008611387,0.009897928,0.03964162],"category_scores_gemma":[0.5271295,0.0021153218,0.005136801,0.003938264,0.0074516837,0.029162167,0.024709728,0.013567521,0.025024159],"study_design_candidate":"not_applicable","study_design_consensus":"not_applicable","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0019186866,0.0007566003,0.0059575504,0.0020479823,0.0006152798,0.000409784,0.0040645953,0.0014578832,0.0044446923,0.013525789,0.748414,0.21638726],"study_design_scores_gemma":[0.0010913746,0.001509704,0.013340116,0.0040331194,0.0008992302,0.00077779155,0.005072844,0.011368116,0.014246927,0.08823447,0.85860294,0.00082338817],"about_ca_topic_score_codex":0.009034202,"about_ca_topic_score_gemma":0.0061960784,"teacher_disagreement_score":0.57953626,"about_ca_system_score_codex":0.0070946882,"about_ca_system_score_gemma":0.0151345795,"threshold_uncertainty_score":0.7146714},"labels":[],"label_agreement":null},{"id":"W2288294667","doi":"10.6084/m9.figshare.2008569.v2","title":"A test of browser impacts on ecosystem function.","year":2017,"lang":"en","type":"article","venue":"Figshare","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":true,"ca_institutions":"","funders":"","keywords":"Function (biology); Test (biology); Ecosystem; Computer science; Environmental resource management; Environmental science; Biology; Ecology","score_opus":0.04666847763148641,"score_gpt":0.2627818645426847,"score_spread":0.2161133869111983,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2288294667","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.7869268,0.0005894708,0.014268276,0.0009970062,0.00076306576,0.00039324517,0.17243879,0.0025466983,0.02107675],"genre_scores_gemma":[0.9161279,0.0001082362,0.0071492433,0.00076847716,0.00009044914,0.0017270417,0.05790851,0.0025188061,0.013601339],"study_design_codex":"observational","study_design_gemma":"bench_or_experimental","domain_scores_codex":[0.9932776,0.0018814271,0.000341496,0.00191444,0.0019765825,0.00060839293],"domain_scores_gemma":[0.9467099,0.04082498,0.003402819,0.0045432122,0.0023853187,0.0021337068],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.006387301,0.001068263,0.0013601643,0.0015216056,0.00070423016,0.0013204701,0.002017698,0.0013452491,0.041766077],"category_scores_gemma":[0.030846473,0.0003170919,0.0025197638,0.0024718812,0.0012092125,0.0026690303,0.0023010022,0.0048487997,0.0064421515],"study_design_candidate":"bench_or_experimental","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.026644012,0.0054843905,0.5615553,0.0036147493,0.019184297,0.0021576155,0.0025999614,0.016654905,0.041106913,0.016593566,0.2246932,0.079711005],"study_design_scores_gemma":[0.0008010863,0.007921344,0.90946513,0.000138014,0.0023012776,0.0012170967,0.0013116851,0.02362255,0.010654307,0.007186519,0.035225302,0.00015566363],"about_ca_topic_score_codex":0.009339671,"about_ca_topic_score_gemma":0.005482516,"teacher_disagreement_score":0.041766077,"about_ca_system_score_codex":0.00089332345,"about_ca_system_score_gemma":0.0012661327,"threshold_uncertainty_score":0.13972145},"labels":[],"label_agreement":null},{"id":"W2293067129","doi":"10.1007/978-3-319-25252-0_26","title":"MUSETS: Diversity-Aware Web Query Suggestions for Shortening User Sessions","year":2015,"lang":"en","type":"book-chapter","venue":"Lecture notes in computer science","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":0,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Dalhousie University","funders":"","keywords":"Computer science; Session (web analytics); Query optimization; Web query classification; Query expansion; Web search query; Information retrieval; Set (abstract data type); Sargable; Query language; Spatial query; Task (project management); Function (biology); Result set; Representation (politics); RDF query language; Search engine; World Wide Web; Programming language","score_opus":0.042894266190562975,"score_gpt":0.27658497074646765,"score_spread":0.23369070455590468,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2293067129","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.059384763,0.0019071096,0.80414706,0.0008886603,0.00043585763,0.0005450894,0.0029654065,0.123065546,0.0066605466],"genre_scores_gemma":[0.3259802,0.0007580229,0.6398629,0.0006649184,0.00041597156,0.00057418965,0.00635095,0.008905198,0.016487641],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9969489,0.0008106949,0.00020043917,0.0004765136,0.0013524016,0.00021112047],"domain_scores_gemma":[0.99269426,0.0033373397,0.00037737808,0.0018073493,0.0011377588,0.00064592535],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0029790732,0.0017227674,0.0015540526,0.002105141,0.0013802219,0.00203519,0.0031434528,0.0015924159,0.010845517],"category_scores_gemma":[0.012732631,0.00084710674,0.001116705,0.0018513306,0.00062643114,0.0047518993,0.0042086598,0.0019743745,0.0049232463],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.004700232,0.0008140856,0.006039377,0.00091207266,0.00026297467,0.00047191523,0.0021467288,0.009422462,0.08826168,0.0090011135,0.098441824,0.7795255],"study_design_scores_gemma":[0.0010972214,0.0014425385,0.007210059,0.000325532,0.0007017747,0.0019243965,0.002443302,0.6232555,0.12054676,0.051588375,0.1889637,0.0005008974],"about_ca_topic_score_codex":0.001808776,"about_ca_topic_score_gemma":0.0040901555,"teacher_disagreement_score":0.010845517,"about_ca_system_score_codex":0.00060799683,"about_ca_system_score_gemma":0.0010475402,"threshold_uncertainty_score":0.036281824},"labels":[],"label_agreement":null},{"id":"W2293919411","doi":"10.29173/cais549","title":"Collecting Bibliographic References: A Bibliometric Analysis of CiteULike's Collection as Grounds for In-Depth Interviews","year":2013,"lang":"fr","type":"article","venue":"Proceedings of the Annual Conference of CAIS / Actes du congrès annuel de l ACSI","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":1,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":true,"route_about_ca":false,"ca_institutions":"","funders":"","keywords":"Library science; Web of science; Sociology; Humanities; Political science; Art; Computer science; MEDLINE","score_opus":0.0674813722550687,"score_gpt":0.3005287766883557,"score_spread":0.233047404433287,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2293919411","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.7775832,0.006064553,0.05307657,0.0033940652,0.00040038227,0.0059292563,0.018533168,0.0007526674,0.13426615],"genre_scores_gemma":[0.8759063,0.004983058,0.08110178,0.00046452592,0.00028232884,0.008218347,0.010790133,0.00034909006,0.017904297],"study_design_codex":"design_other","study_design_gemma":"observational","domain_scores_codex":[0.9757193,0.00918252,0.0031003573,0.0011172676,0.009893346,0.0009871448],"domain_scores_gemma":[0.92748016,0.037916146,0.0053347116,0.0035991382,0.024756806,0.0009131073],"candidate_categories":["bibliometrics"],"consensus_categories":[],"category_scores_codex":[0.021050574,0.0005167641,0.0011182283,0.09400995,0.0050623757,0.005883977,0.0012739404,0.0010696821,0.004046724],"category_scores_gemma":[0.0769557,0.00034096054,0.00073314516,0.11178861,0.0021412931,0.004922562,0.004169878,0.0006614078,0.0011115893],"study_design_candidate":"observational","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00021185288,0.00019572926,0.08183652,0.0061275894,0.00024480885,0.0010415951,0.3283257,0.0008574619,0.011571117,0.036880296,0.021699492,0.51100785],"study_design_scores_gemma":[0.000062555315,0.00027835087,0.2426386,0.0039666113,0.00043555256,0.0010869635,0.35362616,0.0035514925,0.010860677,0.01865501,0.3645488,0.00028921975],"about_ca_topic_score_codex":0.009028775,"about_ca_topic_score_gemma":0.018833412,"teacher_disagreement_score":0.90599006,"about_ca_system_score_codex":0.006507188,"about_ca_system_score_gemma":0.009704933,"threshold_uncertainty_score":0.11132741},"labels":[],"label_agreement":null},{"id":"W2293959390","doi":"","title":"Identifikation von Kundenrezensionen im WWW als Basis eines Crawlers für das Opinion Mining.","year":2013,"lang":"de","type":"article","venue":"Ingénierie des systèmes d information","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":1,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":true,"route_about_ca":false,"ca_institutions":"","funders":"","keywords":"Humanities; Political science; Gynecology; Art; Medicine","score_opus":0.01999062851664853,"score_gpt":0.2688001022604891,"score_spread":0.24880947374384058,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2293959390","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.22667368,0.00220503,0.7410194,0.0011168924,0.00039425615,0.0013040645,0.008958556,0.0066448143,0.011683302],"genre_scores_gemma":[0.37594882,0.0014217203,0.59603155,0.00026711638,0.00023119719,0.00068968115,0.01711473,0.00057034625,0.0077249096],"study_design_codex":"design_other","study_design_gemma":"not_applicable","domain_scores_codex":[0.9963586,0.0011701877,0.00037823324,0.0006737854,0.0012368612,0.00018241093],"domain_scores_gemma":[0.9879893,0.0059600137,0.00090404093,0.0010252062,0.0038511099,0.00027037607],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.002871594,0.000917559,0.00062515895,0.0070096175,0.00080326153,0.002572151,0.0009100917,0.0013244502,0.0028919862],"category_scores_gemma":[0.022375403,0.00041021942,0.0010095917,0.0032839053,0.0003660652,0.0026335546,0.0013174213,0.00093162793,0.0046936963],"study_design_candidate":"not_applicable","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00052192993,0.00039220505,0.0325107,0.0014086008,0.00046443593,0.0009365428,0.0029800972,0.007995377,0.08008594,0.006384454,0.025084235,0.84123564],"study_design_scores_gemma":[0.00013312374,0.00091332506,0.04719218,0.0008613097,0.0013007434,0.0025140175,0.0043786555,0.57516706,0.21101524,0.02773442,0.1285961,0.00019388221],"about_ca_topic_score_codex":0.002402461,"about_ca_topic_score_gemma":0.0044049826,"teacher_disagreement_score":0.0070096175,"about_ca_system_score_codex":0.0005940472,"about_ca_system_score_gemma":0.0008085353,"threshold_uncertainty_score":0.015186608},"labels":[],"label_agreement":null},{"id":"W2294544352","doi":"10.3166/isi.20.2.119-143","title":"Forum Jeunes Chercheurs à Inforsid 2014","year":2015,"lang":"fr","type":"article","venue":"Ingénierie des systèmes d information","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":true,"route_about_ca":false,"ca_institutions":"","funders":"Agence Nationale de la Recherche","keywords":"Humanities; Art; Political science","score_opus":0.04856390435645567,"score_gpt":0.26508320742157165,"score_spread":0.216519303065116,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2294544352","genre_codex":"empirical","genre_gemma":"other","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"other","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.5281796,0.024290487,0.040696558,0.1526082,0.05436527,0.0019923062,0.006973895,0.006906619,0.18398714],"genre_scores_gemma":[0.516324,0.005596071,0.029432643,0.006691845,0.009779916,0.0009999191,0.007065463,0.0018544343,0.42225575],"study_design_codex":"not_applicable","study_design_gemma":"not_applicable","domain_scores_codex":[0.99233586,0.0027541365,0.000259856,0.0006702058,0.0025561794,0.0014237609],"domain_scores_gemma":[0.96531636,0.009558883,0.0018893549,0.0019690224,0.011134317,0.010132005],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.014803943,0.0006432082,0.0006472058,0.0041386746,0.0049446626,0.005581362,0.0008974394,0.002534195,0.025538359],"category_scores_gemma":[0.032534145,0.00037367642,0.0007922888,0.0019219073,0.0011007714,0.0040308847,0.0044198846,0.0029720343,0.010122013],"study_design_candidate":"not_applicable","study_design_consensus":"not_applicable","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0015429128,0.00077891786,0.028319823,0.00092233595,0.00009323822,0.0013754173,0.025516307,0.00053867785,0.015131922,0.017636416,0.4984861,0.40965787],"study_design_scores_gemma":[0.000056561774,0.00036389354,0.017994972,0.00027975085,0.000023068576,0.0002939261,0.0060616336,0.00064658775,0.0034088027,0.0017108683,0.96908814,0.00007171371],"about_ca_topic_score_codex":0.0044664503,"about_ca_topic_score_gemma":0.011332508,"teacher_disagreement_score":0.025538359,"about_ca_system_score_codex":0.0023569076,"about_ca_system_score_gemma":0.0032617687,"threshold_uncertainty_score":0.08543432},"labels":[],"label_agreement":null},{"id":"W2295126561","doi":"10.14279/tuj.eceasst.63.923.915","title":"About Metrics for Clone Detection","year":2014,"lang":"en","type":"article","venue":"PolyPublie (École Polytechnique de Montréal)","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":1,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Polytechnique Montréal","funders":"","keywords":"Similarity (geometry); clone (Java method); Computer science; Cosine similarity; Scalability; Function (biology); Detector; Data mining; Trigonometric functions; Quality (philosophy); Artificial intelligence; Pattern recognition (psychology); Mathematics; Telecommunications; Gene; Database","score_opus":0.011564530569624283,"score_gpt":0.23131366396336944,"score_spread":0.21974913339374516,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2295126561","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.017807025,0.021534402,0.94214106,0.0066420967,0.0010573905,0.00022467352,0.0009838018,0.0016901349,0.007919393],"genre_scores_gemma":[0.23397495,0.014620384,0.73432714,0.0025935338,0.0030330028,0.0010648613,0.0044862875,0.0023867863,0.0035130826],"study_design_codex":"design_other","study_design_gemma":"not_applicable","domain_scores_codex":[0.9328217,0.028243748,0.006856975,0.008653293,0.021474147,0.0019501491],"domain_scores_gemma":[0.7810317,0.15865529,0.009820765,0.019776858,0.028149221,0.002566197],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.027800173,0.0043004556,0.0036873396,0.015281816,0.0030628971,0.009403893,0.003255781,0.0054462985,0.00514285],"category_scores_gemma":[0.21146093,0.0016007669,0.0035576038,0.019412983,0.0053117545,0.02978329,0.004070163,0.007915345,0.0020630714],"study_design_candidate":"not_applicable","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00031825295,0.0002874819,0.017490497,0.0029816746,0.00044675366,0.0003331063,0.0009569293,0.037020806,0.007844597,0.34875387,0.020783095,0.56278294],"study_design_scores_gemma":[0.00006481827,0.00067494926,0.0070291325,0.0012105467,0.00035865893,0.0015688536,0.000502522,0.10948243,0.01634135,0.7933375,0.06910966,0.00031950037],"about_ca_topic_score_codex":0.0033512674,"about_ca_topic_score_gemma":0.001508119,"teacher_disagreement_score":0.027800173,"about_ca_system_score_codex":0.0047056717,"about_ca_system_score_gemma":0.0023523609,"threshold_uncertainty_score":0.14702314},"labels":[],"label_agreement":null},{"id":"W2296700935","doi":"","title":"Grammar Inference for Web Documents","year":2011,"lang":"en","type":"article","venue":"","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":2,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Waterloo","funders":"","keywords":"XML validation; Computer science; Presentational and representational acting; Document Structure Description; XML Schema Editor; Efficient XML Interchange; Streaming XML; XML Schema (W3C); Information retrieval; SGML; XML Encryption; XML; XML Signature; Programming language; Natural language processing; World Wide Web; Linguistics","score_opus":0.04948157682302046,"score_gpt":0.2802402359717129,"score_spread":0.23075865914869242,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2296700935","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0031806454,0.00018835734,0.9919093,0.00026054485,0.000032462445,0.00010429874,0.0006065518,0.002575562,0.0011422326],"genre_scores_gemma":[0.10527576,0.00052650477,0.88409704,0.00042298101,0.00012668355,0.00036140962,0.0055535156,0.00093224103,0.0027037552],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.99246466,0.0027024357,0.0007152692,0.0017420196,0.0021084168,0.00026710812],"domain_scores_gemma":[0.97220755,0.022431696,0.00094816904,0.0026092224,0.0015514961,0.00025189185],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0063978257,0.0011074556,0.0012929277,0.0048362394,0.0016359704,0.0033060957,0.0032643354,0.0023261474,0.0059306924],"category_scores_gemma":[0.041296523,0.0012844488,0.004018066,0.0032367522,0.0024032965,0.005620159,0.0026657828,0.0033290314,0.002562406],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0002153018,0.0002022064,0.0055019264,0.00084464013,0.00035618222,0.0009475566,0.0009874109,0.2873624,0.0036598651,0.2818397,0.017085271,0.40099755],"study_design_scores_gemma":[0.000042075277,0.000018963909,0.00036936224,0.00008033343,0.0000405299,0.00028808566,0.00007789318,0.611073,0.0024408917,0.37590268,0.009633627,0.000032476437],"about_ca_topic_score_codex":0.0085913325,"about_ca_topic_score_gemma":0.008566297,"teacher_disagreement_score":0.0085913325,"about_ca_system_score_codex":0.0022598065,"about_ca_system_score_gemma":0.0025718515,"threshold_uncertainty_score":0.03383535},"labels":[],"label_agreement":null},{"id":"W2317139291","doi":"10.1145/2854946.2854991","title":"TwIST","year":2016,"lang":"en","type":"article","venue":"","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":1,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Regina","funders":"","keywords":"Exploratory search; Computer science; Search engine; Information retrieval; Mode (computer interface); Simple (philosophy); Visualization; World Wide Web; Search analytics; Human–computer interaction; Web search query; Data mining","score_opus":0.010081292897696315,"score_gpt":0.20995129380131727,"score_spread":0.19987000090362095,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2317139291","genre_codex":"other","genre_gemma":"other","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"other","genre_consensus":"other","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.025661465,0.002780144,0.30402255,0.002530217,0.0024192142,0.0012596477,0.044389226,0.2466187,0.37031883],"genre_scores_gemma":[0.22118647,0.0035166168,0.19711438,0.0021467227,0.0008681501,0.0023163655,0.07503064,0.035344247,0.46247637],"study_design_codex":"not_applicable","study_design_gemma":"not_applicable","domain_scores_codex":[0.9992093,0.000097930526,0.000065858774,0.00014537298,0.0003224247,0.00015907142],"domain_scores_gemma":[0.9986278,0.00037471022,0.00008365055,0.000318608,0.00036783292,0.0002273888],"candidate_categories":["insufficient_payload"],"consensus_categories":[],"category_scores_codex":[0.00079926365,0.0011110853,0.00064924825,0.0017688434,0.0011932458,0.0027134558,0.0013733348,0.0011036583,0.160527],"category_scores_gemma":[0.0049555795,0.00052299944,0.0009247578,0.0015215976,0.0005680464,0.004718795,0.0042168433,0.0009162945,0.08016827],"study_design_candidate":"not_applicable","study_design_consensus":"not_applicable","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0018826913,0.000099000186,0.002913351,0.001342809,0.000047760182,0.0005985892,0.0011312346,0.0017999159,0.015609002,0.054364834,0.505961,0.41424975],"study_design_scores_gemma":[0.0001393967,0.0001446708,0.0012602749,0.00016337242,0.00003247362,0.0006388511,0.00034565516,0.006414319,0.0069601745,0.015454006,0.9683524,0.00009454387],"about_ca_topic_score_codex":0.002029529,"about_ca_topic_score_gemma":0.0029377132,"teacher_disagreement_score":0.839473,"about_ca_system_score_codex":0.00064964895,"about_ca_system_score_gemma":0.0012919909,"threshold_uncertainty_score":0},"labels":[],"label_agreement":null},{"id":"W2328683430","doi":"10.1109/idam.2014.6912682","title":"A preliminary study on design and development of a journal focused crawler system using EBD methodology: Part II &amp;#x2014; Conflict identification and solution generation","year":2014,"lang":"en","type":"article","venue":"","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":1,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Concordia University","funders":"","keywords":"Web crawler; Identification (biology); Computer science; Focused crawler; World Wide Web; The Internet; Biology","score_opus":0.32465349820669026,"score_gpt":0.34864840854514806,"score_spread":0.023994910338457798,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2328683430","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.5406599,0.00027937893,0.43285254,0.0006931958,0.000106558364,0.0070365025,0.0006526035,0.0033249736,0.014394404],"genre_scores_gemma":[0.30116054,0.00023856976,0.6842477,0.00028866515,0.000019969333,0.0025769246,0.0008374925,0.0005533456,0.010076851],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9933282,0.003646358,0.00070601975,0.00085001497,0.0011312439,0.00033821518],"domain_scores_gemma":[0.9859152,0.0076221144,0.0005741279,0.0014834668,0.0037539282,0.0006511984],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.006740034,0.00064214336,0.00055252237,0.0016418635,0.0013006465,0.0022287448,0.0012530856,0.0010016875,0.0037097002],"category_scores_gemma":[0.014546047,0.0008059688,0.00052701053,0.0007326961,0.00066217594,0.0018033999,0.0010421193,0.0008939634,0.0010280722],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0009512166,0.0055425563,0.026085727,0.0029033497,0.00018438046,0.0025425109,0.036487646,0.016019208,0.2598755,0.008967572,0.010165023,0.63027525],"study_design_scores_gemma":[0.0013293393,0.016843855,0.046997715,0.0010352121,0.0005656801,0.002971286,0.026022736,0.18144073,0.4838798,0.004610166,0.23389833,0.00040512512],"about_ca_topic_score_codex":0.0025285182,"about_ca_topic_score_gemma":0.003577031,"teacher_disagreement_score":0.006740034,"about_ca_system_score_codex":0.001173409,"about_ca_system_score_gemma":0.0022404206,"threshold_uncertainty_score":0.035645127},"labels":[],"label_agreement":null},{"id":"W2336182153","doi":"","title":"Rough Set and Knowledge Technology: 6th International Conference, RSKT 2011, Banff, Canada, October 9-12, 2011, Proceedings","year":2011,"lang":"en","type":"book","venue":"Springer eBooks","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":4,"is_retracted":false,"has_abstract":false,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":true,"ca_institutions":"","funders":"","keywords":"Rough set; Session (web analytics); Computer science; Set (abstract data type); Library science; Selection (genetic algorithm); Feature (linguistics); Feature selection; Operations research; Artificial intelligence; Engineering; World Wide Web","score_opus":0.026533104639266235,"score_gpt":0.22781077169182037,"score_spread":0.20127766705255415,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2336182153","genre_codex":"methods","genre_gemma":"other","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"other","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.01610003,0.31611836,0.4709781,0.02361028,0.024087355,0.00042994315,0.002894438,0.004315782,0.14146571],"genre_scores_gemma":[0.07588211,0.20357747,0.28287038,0.0015607665,0.004188038,0.00030848276,0.0056595425,0.0011813736,0.4247719],"study_design_codex":"design_other","study_design_gemma":"not_applicable","domain_scores_codex":[0.99873763,0.00028462888,0.00007992071,0.00012311128,0.0006708145,0.00010402792],"domain_scores_gemma":[0.99764144,0.0007036652,0.00006267622,0.0002918705,0.0011033487,0.00019707986],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0035709366,0.00092191173,0.0018692521,0.0019271914,0.0009632353,0.0049951742,0.0014145271,0.0009315858,0.01994983],"category_scores_gemma":[0.0038044325,0.00061111164,0.0008813572,0.0037339476,0.0017599092,0.0026743615,0.0015283478,0.002051496,0.0063390266],"study_design_candidate":"not_applicable","study_design_consensus":null,"about_ca_topic_candidate":true,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00016964687,0.0001183626,0.00046363953,0.0007697431,0.00007631337,0.0001018038,0.00029385698,0.004547972,0.0017066344,0.03238126,0.4228931,0.5364777],"study_design_scores_gemma":[0.0000503784,0.00010701184,0.0035622427,0.00091777474,0.00012694913,0.00044226978,0.00061434624,0.02228136,0.0030045304,0.047145985,0.92166805,0.00007903633],"about_ca_topic_score_codex":0.0733904,"about_ca_topic_score_gemma":0.08413466,"teacher_disagreement_score":0.9266096,"about_ca_system_score_codex":0.0041687675,"about_ca_system_score_gemma":0.00721852,"threshold_uncertainty_score":0.14592642},"labels":[],"label_agreement":null},{"id":"W2340183493","doi":"10.7287/peerj.preprints.1947v1","title":"Boa: a link between worlds","year":2016,"lang":"en","type":"article","venue":"","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Alberta","funders":"","keywords":"Computer science; Commit; World Wide Web; Software; Software engineering; Traceability; Database; Operating system","score_opus":0.022245809662072662,"score_gpt":0.2500516888583013,"score_spread":0.22780587919622866,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2340183493","genre_codex":"methods","genre_gemma":"other","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"other","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.03671594,0.0035607386,0.55808705,0.014700086,0.0020287558,0.0012533453,0.025318997,0.032476164,0.32585886],"genre_scores_gemma":[0.32014757,0.0031509278,0.506176,0.002904205,0.00038259482,0.001625087,0.038323637,0.009491002,0.11779902],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"not_applicable","domain_scores_codex":[0.9974456,0.0008779964,0.0001497957,0.0005447615,0.0006924779,0.00028940203],"domain_scores_gemma":[0.99407154,0.0022703733,0.00042033565,0.0016470151,0.00072612875,0.00086454634],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0024179374,0.00078841916,0.00056538964,0.00500615,0.0047664717,0.00894488,0.001821991,0.0025041765,0.046133574],"category_scores_gemma":[0.011610629,0.00092275103,0.0013813463,0.0056559276,0.0028518466,0.01917937,0.010627684,0.0029545592,0.015550604],"study_design_candidate":"not_applicable","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0004497025,0.00018364053,0.0073626535,0.0009310191,0.000107643544,0.00093544595,0.0108150635,0.0017566613,0.0028385017,0.5720321,0.23270696,0.16988064],"study_design_scores_gemma":[0.000025887299,0.00003193495,0.0015086592,0.00026921395,0.000024813442,0.00041929248,0.0024376756,0.003508464,0.0006690007,0.087594904,0.90345836,0.000051839594],"about_ca_topic_score_codex":0.014852335,"about_ca_topic_score_gemma":0.024401518,"teacher_disagreement_score":0.046133574,"about_ca_system_score_codex":0.0014951768,"about_ca_system_score_gemma":0.0022206148,"threshold_uncertainty_score":0.15433222},"labels":[],"label_agreement":null},{"id":"W2342140360","doi":"","title":"An exploratory look at 3,039,804 #elxn42 tweets","year":2016,"lang":"en","type":"article","venue":"University of North Texas Digital Library (University of North Texas)","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":true,"ca_institutions":"","funders":"","keywords":"Computer science","score_opus":0.011766688917363299,"score_gpt":0.16740447520940158,"score_spread":0.15563778629203828,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2342140360","genre_codex":"dataset","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.36873767,0.0027880387,0.0074474867,0.0058580334,0.0012471353,0.0011530208,0.48383453,0.0023661281,0.12656799],"genre_scores_gemma":[0.4293012,0.0045479788,0.021013692,0.0033029113,0.00091175037,0.0031242168,0.35702837,0.0043074246,0.17646258],"study_design_codex":"not_applicable","study_design_gemma":"observational","domain_scores_codex":[0.9988777,0.0001553701,0.00007910555,0.00015539648,0.0004933246,0.00023908388],"domain_scores_gemma":[0.9967765,0.0016052978,0.00020389345,0.00017891891,0.0010640273,0.00017126866],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0010639695,0.0004812635,0.00037349283,0.007637138,0.0033716543,0.0022997526,0.00052428915,0.00053232646,0.018344307],"category_scores_gemma":[0.0059663407,0.00027249317,0.00032812005,0.01165724,0.0005022206,0.0023668173,0.0027627689,0.0006640928,0.009961231],"study_design_candidate":"observational","study_design_consensus":null,"about_ca_topic_candidate":true,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.000661926,0.00013070692,0.07464387,0.0030294214,0.0000704967,0.0037826442,0.08652372,0.0007012319,0.01840666,0.0145253595,0.5302587,0.2672653],"study_design_scores_gemma":[0.000009738398,0.000039737763,0.066274896,0.0005767162,0.000026557054,0.00049963605,0.047875833,0.00091572566,0.0037522237,0.0016147149,0.87834466,0.000069567635],"about_ca_topic_score_codex":0.031288967,"about_ca_topic_score_gemma":0.09171023,"teacher_disagreement_score":0.968711,"about_ca_system_score_codex":0.001569975,"about_ca_system_score_gemma":0.0018392518,"threshold_uncertainty_score":0.06221372},"labels":[],"label_agreement":null},{"id":"W2347242354","doi":"","title":"A Quickly Respond System of Stream Media Cluster Server","year":2005,"lang":"en","type":"article","venue":"Microcomputer applications","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":true,"route_about_ca":false,"ca_institutions":"","funders":"","keywords":"Computer science; Cache; Operating system; Node (physics); Server farm; Cluster (spacecraft); Computer network; Database; Server; Client–server model","score_opus":0.00853662851571744,"score_gpt":0.22738305637427997,"score_spread":0.21884642785856254,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2347242354","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.07713053,0.00076410326,0.83110064,0.000841498,0.0005817394,0.0008135575,0.0005057205,0.07425774,0.014004586],"genre_scores_gemma":[0.76333046,0.00053915835,0.19818339,0.0010242431,0.00036430414,0.00071207836,0.0018818441,0.0018688972,0.032095492],"study_design_codex":"design_other","study_design_gemma":"not_applicable","domain_scores_codex":[0.99877244,0.00024140216,0.00007343011,0.00026148412,0.0004968849,0.00015431257],"domain_scores_gemma":[0.99864584,0.00013569991,0.000055907447,0.00028789655,0.0006093306,0.00026535406],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.001111647,0.0007474889,0.0010038614,0.0010791955,0.0012596461,0.0018570776,0.0034320885,0.0010498271,0.006862848],"category_scores_gemma":[0.0019076448,0.0005473246,0.0004069508,0.0007410898,0.0005265353,0.0027125333,0.0015049265,0.0012530789,0.003304388],"study_design_candidate":"not_applicable","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0055003916,0.0012932093,0.016297987,0.00096984033,0.00037954169,0.0013741128,0.001649338,0.048254486,0.19396296,0.052021928,0.14902408,0.52927214],"study_design_scores_gemma":[0.00059683074,0.0009165593,0.0030339237,0.00007778518,0.00024575123,0.0009076404,0.00035649334,0.7900253,0.09688783,0.006968621,0.099639624,0.00034353277],"about_ca_topic_score_codex":0.0051446212,"about_ca_topic_score_gemma":0.001979065,"teacher_disagreement_score":0.006862848,"about_ca_system_score_codex":0.0014335669,"about_ca_system_score_gemma":0.00199924,"threshold_uncertainty_score":0.022958517},"labels":[],"label_agreement":null},{"id":"W2348677414","doi":"","title":"Query Relaxation and Answer Integration Based on Agent for Cross-Media Meta-Searches","year":2007,"lang":"en","type":"article","venue":"Microcomputer applications","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":true,"route_about_ca":false,"ca_institutions":"","funders":"","keywords":"Computer science; Search engine; Information retrieval; Relaxation (psychology); Recall; Precision and recall; Metasearch engine; Data mining; Web search query","score_opus":0.05275532356669788,"score_gpt":0.31406535718252776,"score_spread":0.2613100336158299,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2348677414","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.038733706,0.0011833532,0.951454,0.00044067486,0.000071569804,0.00043648618,0.000098634824,0.003731323,0.0038502913],"genre_scores_gemma":[0.2887504,0.0003781838,0.7055141,0.00029412986,0.00009452685,0.00043152794,0.00040574075,0.00022567618,0.0039057792],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.99743205,0.001010997,0.00028140473,0.00033985416,0.0007731781,0.00016237171],"domain_scores_gemma":[0.9965844,0.001672607,0.00022133267,0.0006338213,0.00074145047,0.00014636146],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0026629346,0.00080895185,0.0015399635,0.0014223427,0.0007713204,0.0016691985,0.0022117451,0.0014956383,0.0029849613],"category_scores_gemma":[0.005971085,0.0006565815,0.0010344371,0.0013557213,0.0007850848,0.0045276196,0.0018156334,0.0018893767,0.0010006927],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0025765104,0.001931421,0.0033923252,0.0009256165,0.00045882253,0.0005548609,0.0022013255,0.053342264,0.119906746,0.045293305,0.010126386,0.75929046],"study_design_scores_gemma":[0.00033711013,0.0005080492,0.0009986443,0.00004743008,0.00029086633,0.0004675858,0.0003291239,0.92235184,0.045473732,0.012093396,0.016978158,0.0001241341],"about_ca_topic_score_codex":0.003808266,"about_ca_topic_score_gemma":0.0038250305,"teacher_disagreement_score":0.003808266,"about_ca_system_score_codex":0.0007543424,"about_ca_system_score_gemma":0.0012677063,"threshold_uncertainty_score":0.014083147},"labels":[],"label_agreement":null},{"id":"W2349506973","doi":"","title":"The Design and Implementation of Information Collection Based on Internet","year":2006,"lang":"en","type":"article","venue":"Microcomputer applications","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":true,"route_about_ca":false,"ca_institutions":"","funders":"","keywords":"Computer science; The Internet; World Wide Web; Function (biology); Search engine; Data collection; Database; Information retrieval","score_opus":0.005845179091672406,"score_gpt":0.2319753779061489,"score_spread":0.2261301988144765,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2349506973","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.013365379,0.00030120177,0.96657646,0.00033793517,0.00009113535,0.00072145276,0.0001026184,0.00880702,0.009696831],"genre_scores_gemma":[0.1539313,0.0004538128,0.8360715,0.00033974455,0.00006658308,0.0010431535,0.0004478,0.00046331278,0.007182807],"study_design_codex":"design_other","study_design_gemma":"not_applicable","domain_scores_codex":[0.9973289,0.0007392955,0.0002431506,0.0005675797,0.0009041045,0.0002170163],"domain_scores_gemma":[0.99815136,0.00036298533,0.0001090638,0.00045626817,0.0007857359,0.00013460829],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.002312404,0.0003965544,0.00069759623,0.0017793382,0.0010015258,0.003062568,0.0025274553,0.00081949116,0.002367065],"category_scores_gemma":[0.003639293,0.00078643824,0.0006268489,0.0021749,0.0008515157,0.003114699,0.0010606055,0.0011691477,0.0014297243],"study_design_candidate":"not_applicable","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0007264158,0.0008593771,0.00965241,0.0009291626,0.00029018542,0.00066605146,0.0023941782,0.011594787,0.061463144,0.14692913,0.022986053,0.7415091],"study_design_scores_gemma":[0.00031746153,0.00090798823,0.008062378,0.00046682032,0.0006180555,0.0018164527,0.0009237406,0.41713366,0.20722593,0.04575504,0.31644806,0.00032448652],"about_ca_topic_score_codex":0.0025551114,"about_ca_topic_score_gemma":0.0018428821,"teacher_disagreement_score":0.003062568,"about_ca_system_score_codex":0.00088055886,"about_ca_system_score_gemma":0.0017476287,"threshold_uncertainty_score":0.012229323},"labels":[],"label_agreement":null},{"id":"W2351124331","doi":"","title":"CSS Based Segmentation of Web Pages","year":2008,"lang":"en","type":"article","venue":"Microcomputer applications","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":true,"route_about_ca":false,"ca_institutions":"","funders":"","keywords":"Computer science; Web page; Preprocessor; Cluster analysis; Parsing; Segmentation; Information retrieval; HTML element; Process (computing); Data mining; Artificial intelligence; World Wide Web; Operating system","score_opus":0.018656828883113548,"score_gpt":0.2351980580747528,"score_spread":0.21654122919163926,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2351124331","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.15842895,0.0011982352,0.80595195,0.00019241605,0.00025088032,0.00044890816,0.00266308,0.018076856,0.012788851],"genre_scores_gemma":[0.27189344,0.00069022446,0.7070411,0.00015719919,0.000102970924,0.00027419243,0.007478125,0.0013538882,0.011009017],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9993728,0.000055114855,0.00006143454,0.00018299454,0.0002502527,0.00007731624],"domain_scores_gemma":[0.998547,0.0002480324,0.00013441326,0.00026376208,0.00073275977,0.00007404001],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0003022948,0.00076157757,0.0007420551,0.0032280951,0.00048617477,0.0013263684,0.0005933331,0.00055323326,0.0038855025],"category_scores_gemma":[0.0016745095,0.00032549354,0.000708235,0.0032646053,0.00039256632,0.0011312013,0.00049124286,0.00046396043,0.0036362736],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00046799192,0.00012000038,0.005015382,0.00043798014,0.000064076354,0.0003564018,0.00047882993,0.0072966903,0.3914237,0.003563908,0.012018076,0.578757],"study_design_scores_gemma":[0.00004417658,0.00035685275,0.04464682,0.000106598905,0.00019224636,0.0020074835,0.00055005884,0.25176147,0.63625085,0.008596568,0.055348925,0.00013797081],"about_ca_topic_score_codex":0.0030766039,"about_ca_topic_score_gemma":0.0038477639,"teacher_disagreement_score":0.0038855025,"about_ca_system_score_codex":0.0004952722,"about_ca_system_score_gemma":0.00087221124,"threshold_uncertainty_score":0.0129983425},"labels":[],"label_agreement":null},{"id":"W2355815374","doi":"","title":"Chaining Technology Used in Dynamic Binary Translation","year":2009,"lang":"en","type":"article","venue":"Microcomputer applications","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":true,"route_about_ca":false,"ca_institutions":"","funders":"","keywords":"Computer science; Chaining; Binary translation; Block (permutation group theory); Translation (biology); Binary number; TRACE (psycholinguistics); Software; Programming language; Arithmetic","score_opus":0.01080496121663548,"score_gpt":0.26043548439986075,"score_spread":0.24963052318322526,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2355815374","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.02903376,0.0024343345,0.9174949,0.00044126224,0.00051678694,0.0003004599,0.00027750127,0.006447119,0.04305392],"genre_scores_gemma":[0.39725107,0.003942419,0.5531168,0.0006153095,0.00029578138,0.00059897586,0.0010425295,0.0020343177,0.041102774],"study_design_codex":"design_other","study_design_gemma":"not_applicable","domain_scores_codex":[0.998672,0.00019642025,0.00015409192,0.00038049836,0.00044178334,0.00015525191],"domain_scores_gemma":[0.9985372,0.00037240953,0.00015780484,0.000492996,0.00039717977,0.00004238091],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0006886849,0.0008150514,0.00054844655,0.0014865509,0.0014244913,0.0016034135,0.0007826642,0.00091194833,0.015167402],"category_scores_gemma":[0.0029593941,0.0006457837,0.00050191884,0.0027660762,0.0013470524,0.003937817,0.0013418486,0.0015298963,0.005978978],"study_design_candidate":"not_applicable","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00050741085,0.00015708536,0.0015447333,0.00095214194,0.00004522734,0.00095517957,0.0014852424,0.0076746447,0.1859061,0.20280607,0.011527518,0.5864386],"study_design_scores_gemma":[0.000109861976,0.0007104515,0.00094422547,0.0002853719,0.00015921076,0.002857931,0.0003364605,0.0412579,0.6210288,0.061296143,0.27085617,0.00015749974],"about_ca_topic_score_codex":0.001027246,"about_ca_topic_score_gemma":0.000639896,"teacher_disagreement_score":0.015167402,"about_ca_system_score_codex":0.0006777986,"about_ca_system_score_gemma":0.0008822406,"threshold_uncertainty_score":0.050740063},"labels":[],"label_agreement":null},{"id":"W2358584529","doi":"","title":"Research on QE Based on Local Co-occurrence Analysis and Concept Semanteme","year":2010,"lang":"en","type":"article","venue":"Microcomputer applications","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":true,"route_about_ca":false,"ca_institutions":"","funders":"","keywords":"Computer science; Information retrieval; Co-occurrence; Filter (signal processing); Query expansion; Data mining; Word (group theory); Function (biology); Space (punctuation); Natural language processing; Mathematics","score_opus":0.02639344383310647,"score_gpt":0.34632763853390974,"score_spread":0.31993419470080325,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2358584529","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.022059454,0.0049659456,0.9689473,0.00036444524,0.000113374124,0.00010935761,0.000102490645,0.0011257625,0.0022118513],"genre_scores_gemma":[0.48567092,0.0065629203,0.49786288,0.00035417252,0.00045112032,0.00030589997,0.00066446495,0.00030235172,0.007825291],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.99718755,0.00080975285,0.00019406102,0.00060375914,0.0010372426,0.00016765296],"domain_scores_gemma":[0.99512273,0.003017669,0.0001912388,0.00035496723,0.0012072743,0.000106142805],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0031435606,0.0008109941,0.0017147085,0.0032978128,0.00052547763,0.0015052912,0.0014835127,0.00072181894,0.003709843],"category_scores_gemma":[0.008516958,0.00039560912,0.0010216575,0.0042014895,0.0011547474,0.008954641,0.00074054545,0.0009200642,0.0006698284],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00068276154,0.00032373416,0.0048837415,0.0015577937,0.00035465398,0.00033395647,0.0005331784,0.02450371,0.04261414,0.053683594,0.006090218,0.8644385],"study_design_scores_gemma":[0.00014024686,0.00053107145,0.007788316,0.00009616823,0.00029586075,0.0011975141,0.00038290967,0.8948424,0.04110945,0.03337547,0.02008859,0.00015203179],"about_ca_topic_score_codex":0.006455047,"about_ca_topic_score_gemma":0.0022913585,"teacher_disagreement_score":0.006455047,"about_ca_system_score_codex":0.0009661429,"about_ca_system_score_gemma":0.0013083222,"threshold_uncertainty_score":0.016624928},"labels":[],"label_agreement":null},{"id":"W2359493093","doi":"","title":"Duplicate Web Page Elimination Based on HTML and Extraction of Long Sentence","year":2009,"lang":"en","type":"article","venue":"Microcomputer applications","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":1,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":true,"route_about_ca":false,"ca_institutions":"","funders":"","keywords":"Computer science; Web page; HTML element; Sentence; Information retrieval; Page view; Document Object Model; Static web page; Metric (unit); Filter (signal processing); Process (computing); Tree (set theory); Data mining; World Wide Web; Artificial intelligence; Programming language; Web navigation","score_opus":0.00940447532469173,"score_gpt":0.252788167655731,"score_spread":0.24338369233103924,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2359493093","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.059576564,0.00084936677,0.9301629,0.00019327847,0.00012595042,0.00034777453,0.001107291,0.00570171,0.0019351476],"genre_scores_gemma":[0.110499665,0.00031446377,0.88081473,0.00012981048,0.00009222031,0.0002542601,0.0036390182,0.00066423335,0.0035915629],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9980496,0.0003339072,0.0002672756,0.00037435937,0.0008324367,0.00014246829],"domain_scores_gemma":[0.99416226,0.0018984812,0.00063425564,0.00066531514,0.002498315,0.0001413887],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0017054725,0.0010806641,0.0013576561,0.005129108,0.0009199458,0.0013479494,0.0013311786,0.0010326274,0.0021014092],"category_scores_gemma":[0.0072749997,0.00051767495,0.0010258309,0.004092238,0.00060536445,0.0021564183,0.00090837025,0.00091114757,0.0023182374],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00035650196,0.0002969504,0.010525367,0.0010134969,0.00022682067,0.0013249387,0.0012360032,0.005289081,0.12468528,0.0069796764,0.013595317,0.8344706],"study_design_scores_gemma":[0.00014528038,0.00059298,0.03503275,0.00023230136,0.00066265196,0.007421814,0.0013021088,0.5047527,0.36713424,0.025134493,0.057259236,0.00032937364],"about_ca_topic_score_codex":0.0016317632,"about_ca_topic_score_gemma":0.0021840055,"teacher_disagreement_score":0.005129108,"about_ca_system_score_codex":0.00032809563,"about_ca_system_score_gemma":0.0012193013,"threshold_uncertainty_score":0.009019494},"labels":[],"label_agreement":null},{"id":"W2360351865","doi":"","title":"Research on User Identification algorithm in Web Log Mining","year":2007,"lang":"en","type":"article","venue":"Microcomputer applications","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":true,"route_about_ca":false,"ca_institutions":"","funders":"","keywords":"Computer science; Web mining; Identification (biology); Data mining; World Wide Web; Web log analysis software; Order (exchange); Web server; Clickstream; Information retrieval; Web service; The Internet; Static web page; Web API","score_opus":0.04027831469101268,"score_gpt":0.35350643821856476,"score_spread":0.3132281235275521,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2360351865","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.038222905,0.0008622241,0.9574935,0.00036063226,0.000066126195,0.00013205156,0.00005205453,0.0011726236,0.0016378319],"genre_scores_gemma":[0.3958464,0.0008596876,0.59971195,0.00021779,0.00016708669,0.0002676003,0.00025358683,0.00013260434,0.0025433074],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9942907,0.0024413588,0.00031807888,0.0010018328,0.0016701752,0.0002778162],"domain_scores_gemma":[0.9731429,0.019804288,0.0008074783,0.0015044133,0.004368612,0.00037214987],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0054855067,0.00093430275,0.0013046527,0.003910044,0.0011861658,0.0023683864,0.0021594698,0.0022356673,0.0015532168],"category_scores_gemma":[0.030068148,0.0004857451,0.0008455269,0.0036907746,0.0013780601,0.0058264746,0.00085481704,0.0021905652,0.00094732427],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0006184844,0.0008846092,0.028905468,0.00029728317,0.00013347082,0.00024995895,0.0005888133,0.0778806,0.009114184,0.045953248,0.0034575316,0.8319163],"study_design_scores_gemma":[0.000026286916,0.00017871438,0.0028814597,0.00003605758,0.000037586567,0.00042857003,0.00011297536,0.9676595,0.011316386,0.01439758,0.0028795477,0.000045426863],"about_ca_topic_score_codex":0.0019529939,"about_ca_topic_score_gemma":0.0008963003,"teacher_disagreement_score":0.0054855067,"about_ca_system_score_codex":0.0009809041,"about_ca_system_score_gemma":0.001258447,"threshold_uncertainty_score":0.029010475},"labels":[],"label_agreement":null},{"id":"W2360827880","doi":"","title":"Investigation on Buffer Cache Scheme for VoD System","year":2009,"lang":"en","type":"article","venue":"Microcomputer applications","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":true,"route_about_ca":false,"ca_institutions":"","funders":"","keywords":"Computer science; Cache; Write buffer; Scheme (mathematics); Buffer (optical fiber); Computer network; Smart Cache; The Internet; Cache algorithms; Server; Cache invalidation; Bandwidth (computing); Disk buffer; CPU cache; Operating system; Telecommunications","score_opus":0.029114379196294178,"score_gpt":0.24412067345433605,"score_spread":0.21500629425804188,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2360827880","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.5096158,0.027934726,0.42177263,0.0025762331,0.00086023734,0.001043999,0.0011269131,0.0025740433,0.032495458],"genre_scores_gemma":[0.9617356,0.003340893,0.030847743,0.00025688944,0.00016720626,0.00018404463,0.00054412463,0.000094675284,0.002828959],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.99622667,0.00067865674,0.0004070005,0.0004853762,0.0016420982,0.0005602283],"domain_scores_gemma":[0.99259734,0.0015619543,0.00047818094,0.0008015187,0.0042669843,0.0002940413],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0022581911,0.0005428109,0.0009627527,0.002504142,0.0016399169,0.0038445175,0.0027822491,0.0012233823,0.0024835332],"category_scores_gemma":[0.008915639,0.00046429335,0.00053723616,0.0026767752,0.0008339663,0.0073851934,0.0011160519,0.00089205103,0.00040040683],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0035057894,0.00066424796,0.086726554,0.0033626372,0.00045417293,0.0028125695,0.0033130022,0.07325489,0.16057049,0.2419333,0.026766412,0.39663592],"study_design_scores_gemma":[0.00033350184,0.0015367911,0.014490855,0.0006281359,0.00074288185,0.005207204,0.002924112,0.6760857,0.1794794,0.035431035,0.08273678,0.0004035469],"about_ca_topic_score_codex":0.0047282055,"about_ca_topic_score_gemma":0.0034951132,"teacher_disagreement_score":0.0047282055,"about_ca_system_score_codex":0.0028678048,"about_ca_system_score_gemma":0.0022830246,"threshold_uncertainty_score":0.020807445},"labels":[],"label_agreement":null},{"id":"W2361229183","doi":"","title":"A Functional Online Editing Based on Web Service","year":2004,"lang":"en","type":"article","venue":"Microcomputer applications","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":true,"route_about_ca":false,"ca_institutions":"","funders":"","keywords":"Computer science; World Wide Web; Word (group theory); Visual Basic for Applications; Web service; Service (business); Feature (linguistics); Mode (computer interface); Service model; Web application; Multimedia; Human–computer interaction; Operating system","score_opus":0.01638622786974468,"score_gpt":0.23500812238744404,"score_spread":0.21862189451769937,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2361229183","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.008337029,0.00037553988,0.89143664,0.0005711494,0.0017040855,0.00038092284,0.00031288306,0.07044424,0.026437586],"genre_scores_gemma":[0.13195378,0.00076881936,0.7203426,0.0010011857,0.0017150507,0.00051826186,0.0014527946,0.00821638,0.13403124],"study_design_codex":"design_other","study_design_gemma":"not_applicable","domain_scores_codex":[0.9983822,0.00027336171,0.000111055335,0.00031419125,0.0008140118,0.00010525354],"domain_scores_gemma":[0.9975988,0.00042636134,0.00006401312,0.0007326227,0.0008226799,0.0003555211],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0012805777,0.0009942893,0.0009198218,0.0017728286,0.00089545734,0.0022143405,0.0019993456,0.0009978404,0.021663487],"category_scores_gemma":[0.002993556,0.00045924025,0.00070951995,0.0011436702,0.00054722105,0.0036198136,0.0013917449,0.0011459014,0.011039529],"study_design_candidate":"not_applicable","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0010173251,0.0004296679,0.00095013634,0.000552327,0.00009151281,0.0013232797,0.0005264757,0.002538366,0.08244334,0.04007874,0.13287672,0.7371722],"study_design_scores_gemma":[0.00044843627,0.00067235425,0.0013547506,0.00008701504,0.00023587048,0.004614204,0.00023923923,0.13468112,0.11542427,0.022790914,0.7191203,0.0003315397],"about_ca_topic_score_codex":0.0009816806,"about_ca_topic_score_gemma":0.00071146456,"teacher_disagreement_score":0.021663487,"about_ca_system_score_codex":0.00029980237,"about_ca_system_score_gemma":0.00075948855,"threshold_uncertainty_score":0.07247156},"labels":[],"label_agreement":null},{"id":"W23637940","doi":"10.1371/journal.pone.0061981","title":"Crawling rich internet applications: the state of the art","year":2012,"lang":"en","type":"article","venue":"PLoS ONE","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":34,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Ottawa","funders":"","keywords":"Crawling; Computer science; Ajax; World Wide Web; Web crawler; The Internet; Web application; Asynchronous communication; Rich Internet application; State (computer science); Server; Multimedia; Telecommunications","score_opus":0.04276188563729921,"score_gpt":0.2296142188181238,"score_spread":0.1868523331808246,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W23637940","genre_codex":"review","genre_gemma":"review","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"review","genre_consensus":"review","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.15557134,0.46749464,0.30378926,0.015414225,0.0011320714,0.00095248397,0.006699489,0.012310952,0.036635447],"genre_scores_gemma":[0.42401758,0.30470484,0.23812202,0.0027931856,0.0036810024,0.00071919616,0.0155302165,0.0017718987,0.00865997],"study_design_codex":"design_other","study_design_gemma":"not_applicable","domain_scores_codex":[0.99071175,0.0019801357,0.00079197425,0.0025974237,0.0036244062,0.00029431542],"domain_scores_gemma":[0.93750936,0.04158517,0.0026579192,0.010160012,0.0070922575,0.0009952594],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0056037833,0.0018378437,0.0036022065,0.012367285,0.0014487347,0.013435477,0.0049661314,0.0041402467,0.0024529183],"category_scores_gemma":[0.03296741,0.0021040505,0.0016184518,0.01569673,0.0035208347,0.017244548,0.002948873,0.002001035,0.0028736605],"study_design_candidate":"not_applicable","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0001465946,0.00031754762,0.019418584,0.0053842757,0.00039611757,0.00010499358,0.0012402396,0.008594858,0.0024612814,0.015217037,0.018144134,0.92857426],"study_design_scores_gemma":[0.00015870492,0.00064184464,0.06173541,0.008127819,0.001013043,0.0023659742,0.006394217,0.38731262,0.015702555,0.1089438,0.40701702,0.00058698293],"about_ca_topic_score_codex":0.009247414,"about_ca_topic_score_gemma":0.0060829716,"teacher_disagreement_score":0.013435477,"about_ca_system_score_codex":0.001290965,"about_ca_system_score_gemma":0.002273544,"threshold_uncertainty_score":0.029636025},"labels":[],"label_agreement":null},{"id":"W2364829796","doi":"","title":"Enterprise Competitor Intelligence Information Mining Platform based the Internet","year":2004,"lang":"en","type":"article","venue":"Microcomputer applications","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":true,"route_about_ca":false,"ca_institutions":"","funders":"","keywords":"Computer science; Web mining; Web intelligence; Heuristic; World Wide Web; Web page; Information extraction; The Internet; Competitive intelligence; Path (computing); Process (computing); Data mining; Information retrieval; Data science; Web modeling; Knowledge management; Artificial intelligence","score_opus":0.010770661156035071,"score_gpt":0.2266985275613494,"score_spread":0.21592786640531433,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2364829796","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.27298585,0.00066479354,0.6110735,0.0014673526,0.00023220154,0.0012762982,0.0024777912,0.023856705,0.085965544],"genre_scores_gemma":[0.4772375,0.00035035482,0.492044,0.00018789993,0.00015784403,0.00040104418,0.0056991396,0.00035103125,0.023571275],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.99926156,0.000092184535,0.00003107318,0.00012674635,0.0004419329,0.00004646443],"domain_scores_gemma":[0.9989158,0.00023118482,0.00009225499,0.00022578164,0.00043733275,0.00009763789],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0010757134,0.00044494495,0.0005461546,0.0032005827,0.00078038714,0.0020484768,0.0009217902,0.00049531425,0.0039076437],"category_scores_gemma":[0.00223111,0.00029485422,0.00045645406,0.0028137271,0.00036751264,0.0024287284,0.000878843,0.0006480767,0.0017332878],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00073962216,0.00078394654,0.016184121,0.0002565698,0.00014665198,0.00065146555,0.00047302284,0.010892893,0.02497685,0.056982387,0.031084746,0.8568277],"study_design_scores_gemma":[0.0003251181,0.0010519862,0.029661968,0.00015985705,0.00036069757,0.0019828796,0.0005824354,0.68592244,0.075753525,0.05322547,0.15074259,0.00023101953],"about_ca_topic_score_codex":0.0025552595,"about_ca_topic_score_gemma":0.0020941743,"teacher_disagreement_score":0.0039076437,"about_ca_system_score_codex":0.0004985725,"about_ca_system_score_gemma":0.0011395676,"threshold_uncertainty_score":0.0130723715},"labels":[],"label_agreement":null},{"id":"W2367671471","doi":"","title":"Detecting Near-replicas of Web Pages Based on Keywords","year":2008,"lang":"en","type":"article","venue":"Microcomputer applications","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":true,"route_about_ca":false,"ca_institutions":"","funders":"","keywords":"Computer science; Information retrieval; Similarity (geometry); Search engine; Web page; World Wide Web; Web crawler; Spamdexing; Web search engine; Artificial intelligence; Web search query","score_opus":0.019382731823286935,"score_gpt":0.23908508231255776,"score_spread":0.21970235048927084,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2367671471","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.8324338,0.0031776717,0.1594489,0.00022840603,0.00023883094,0.00030014673,0.0008824066,0.0016353228,0.0016544757],"genre_scores_gemma":[0.8959436,0.00051080994,0.10058896,0.000051110354,0.00007693418,0.00007685909,0.0008565739,0.00008278192,0.0018123972],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9974483,0.0002840921,0.00034034427,0.0007590585,0.0010047742,0.0001635173],"domain_scores_gemma":[0.9905082,0.0027050332,0.0015994452,0.002083643,0.0024915596,0.0006121379],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0014357358,0.0007377344,0.002005763,0.005352126,0.0010338781,0.0017350768,0.0015590622,0.001586268,0.0007720297],"category_scores_gemma":[0.010485825,0.0005603747,0.00085748633,0.0048029535,0.0006670458,0.0035353198,0.0012986722,0.00088091503,0.0008651501],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0030509476,0.00065738114,0.190644,0.0013453583,0.0007276393,0.0051097223,0.0024440598,0.025435977,0.25860924,0.0075263786,0.005398924,0.4990504],"study_design_scores_gemma":[0.00017607653,0.001797448,0.086353,0.00015757393,0.0006952183,0.015228787,0.002472381,0.66081625,0.1951273,0.022419289,0.014467618,0.000289072],"about_ca_topic_score_codex":0.0020103469,"about_ca_topic_score_gemma":0.0023018892,"teacher_disagreement_score":0.005352126,"about_ca_system_score_codex":0.00047649638,"about_ca_system_score_gemma":0.0007928432,"threshold_uncertainty_score":0.0075930357},"labels":[],"label_agreement":null},{"id":"W2368095729","doi":"","title":"Web Page Text Information Extraction and Result Estimation","year":2007,"lang":"en","type":"article","venue":"Microcomputer applications","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":true,"route_about_ca":false,"ca_institutions":"","funders":"","keywords":"Computer science; Realization (probability); Construct (python library); Information retrieval; Noise (video); Quality (philosophy); Web page; Information extraction; Process (computing); Data mining; World Wide Web; Artificial intelligence; Statistics; Mathematics; Programming language","score_opus":0.006941790469211877,"score_gpt":0.25230708024884624,"score_spread":0.24536528977963437,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2368095729","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.040557038,0.00085027586,0.92433864,0.00019197632,0.00013225216,0.00089349214,0.0037578468,0.024326382,0.00495223],"genre_scores_gemma":[0.15986337,0.00079231506,0.8152635,0.000088290646,0.00018593969,0.00091364357,0.012667488,0.0011687479,0.009056733],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9963905,0.00054117705,0.0005360308,0.0007098475,0.001589203,0.00023318738],"domain_scores_gemma":[0.9957125,0.0010929265,0.00037254437,0.00064945075,0.0020800426,0.00009247803],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0021009974,0.0019876172,0.0017557188,0.009608653,0.0006884837,0.0023797362,0.0011472031,0.0011134556,0.005440539],"category_scores_gemma":[0.010631033,0.000589352,0.0013077778,0.006073416,0.0004001605,0.0021509635,0.00094751385,0.00072984333,0.009671499],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0005252365,0.0002644624,0.006606849,0.00080249173,0.00009670529,0.0003926542,0.00018305135,0.005207268,0.043063164,0.0018980458,0.01095078,0.93000937],"study_design_scores_gemma":[0.00015285252,0.00059950654,0.042139247,0.00012651054,0.0005234482,0.0015427477,0.000568568,0.43332452,0.46022862,0.0098235095,0.050722484,0.0002480748],"about_ca_topic_score_codex":0.0016656654,"about_ca_topic_score_gemma":0.0009055388,"teacher_disagreement_score":0.009608653,"about_ca_system_score_codex":0.00047072343,"about_ca_system_score_gemma":0.0008752284,"threshold_uncertainty_score":0.018200397},"labels":[],"label_agreement":null},{"id":"W2368492172","doi":"","title":"An Improved Page Rank Algorithm of Search Engine-based on Web Content Mining","year":2007,"lang":"en","type":"article","venue":"Microcomputer applications","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":true,"route_about_ca":false,"ca_institutions":"","funders":"","keywords":"Computer science; Web page; Search engine; Information retrieval; Search engine optimization; PageRank; Rank (graph theory); Data mining; Spamdexing; Web search engine; Domain (mathematical analysis); HITS algorithm; Algorithm; World Wide Web; Web search query; Mathematics","score_opus":0.02126091491683312,"score_gpt":0.268020495142297,"score_spread":0.24675958022546385,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2368492172","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.043383196,0.0022993677,0.9419729,0.00022812127,0.0002629451,0.0003184986,0.0005918141,0.007659518,0.0032836574],"genre_scores_gemma":[0.25077406,0.0011433124,0.7375712,0.00016278774,0.00053414184,0.000318184,0.0024680845,0.00044285905,0.006585395],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9967423,0.00067415397,0.00015473335,0.0003520671,0.0018870581,0.00018972471],"domain_scores_gemma":[0.99702954,0.00071354164,0.00019697683,0.00045084918,0.0015286434,0.00008048666],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0015412765,0.0008649671,0.0017239157,0.0055971686,0.00076071883,0.001608135,0.0015076975,0.0009936568,0.002271359],"category_scores_gemma":[0.006675123,0.00038130156,0.0007271341,0.0058299033,0.00044417605,0.0034374683,0.0007240328,0.00078669644,0.0026741924],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00040381815,0.00034721714,0.0047511235,0.0003278888,0.0001932195,0.00010643621,0.00008848562,0.03420602,0.013671711,0.0064536757,0.012613313,0.926837],"study_design_scores_gemma":[0.00011940321,0.00026757005,0.0032938146,0.000022958366,0.0001282601,0.00045565446,0.000048605085,0.9644528,0.014444608,0.0058480306,0.010831458,0.00008685204],"about_ca_topic_score_codex":0.00482648,"about_ca_topic_score_gemma":0.004241277,"teacher_disagreement_score":0.0055971686,"about_ca_system_score_codex":0.0005514596,"about_ca_system_score_gemma":0.0013129945,"threshold_uncertainty_score":0.009596765},"labels":[],"label_agreement":null},{"id":"W2370498574","doi":"","title":"Principles Analysis and Function Comparison of MicroFtp Search Engine","year":2006,"lang":"en","type":"article","venue":"Microcomputer applications","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":true,"route_about_ca":false,"ca_institutions":"","funders":"","keywords":"Computer science; Search engine; Information retrieval; Key (lock); Function (biology); Segmentation; Data mining; Artificial intelligence; Computer security","score_opus":0.01594430900126793,"score_gpt":0.26159353041817096,"score_spread":0.24564922141690304,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2370498574","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.1412594,0.0052462835,0.81345594,0.00043713607,0.00014689995,0.0003107963,0.00057257264,0.0019006743,0.036670197],"genre_scores_gemma":[0.74779564,0.0026656939,0.22784273,0.00019362757,0.00016824949,0.00041000964,0.0010576613,0.00035786515,0.019508572],"study_design_codex":"design_other","study_design_gemma":"not_applicable","domain_scores_codex":[0.9978801,0.00024634722,0.00012226676,0.00019917583,0.001409451,0.00014274461],"domain_scores_gemma":[0.9983387,0.00054900924,0.00009770235,0.00014479752,0.0008375779,0.000032129097],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0013786283,0.00041666167,0.0007592584,0.00494455,0.0007959191,0.002054863,0.0010935304,0.0005609254,0.0048218714],"category_scores_gemma":[0.004168231,0.00032242882,0.0009977738,0.0029083884,0.0005860246,0.003431162,0.0004545841,0.00041247872,0.0012640668],"study_design_candidate":"not_applicable","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0005357877,0.00013434749,0.008741507,0.0009217722,0.00018923171,0.000402965,0.0006476765,0.04024363,0.033398163,0.20159823,0.010338428,0.70284826],"study_design_scores_gemma":[0.000086185326,0.0005267366,0.016807292,0.000107542684,0.00022211373,0.0027955875,0.00036915464,0.7884322,0.05571509,0.09306021,0.041703045,0.00017493463],"about_ca_topic_score_codex":0.0040715877,"about_ca_topic_score_gemma":0.0023339654,"teacher_disagreement_score":0.00494455,"about_ca_system_score_codex":0.0016165022,"about_ca_system_score_gemma":0.0009648918,"threshold_uncertainty_score":0.016130745},"labels":[],"label_agreement":null},{"id":"W2371279400","doi":"","title":"Research and Design of Fashion Websites Linkage","year":2009,"lang":"en","type":"article","venue":"Microcomputer applications","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":true,"route_about_ca":false,"ca_institutions":"","funders":"","keywords":"Linkage (software); Computer science; Design elements and principles; World Wide Web; Human–computer interaction; Software engineering","score_opus":0.046387457850129495,"score_gpt":0.31813911351181884,"score_spread":0.27175165566168935,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2371279400","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.09168458,0.0015588923,0.85346085,0.0008461462,0.00014722561,0.0004496378,0.00013643103,0.0016010449,0.05011514],"genre_scores_gemma":[0.539964,0.001763218,0.43240848,0.00020713742,0.00007793029,0.00054268376,0.0003852155,0.00029406603,0.024357228],"study_design_codex":"design_other","study_design_gemma":"not_applicable","domain_scores_codex":[0.99584794,0.00161998,0.00024682045,0.0006722396,0.0013622241,0.00025079196],"domain_scores_gemma":[0.9972805,0.0008661415,0.0002770812,0.00047885525,0.00093046547,0.00016688819],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0030256594,0.00047067946,0.00045387636,0.0027947887,0.0014316344,0.0034673412,0.0019138103,0.0010814716,0.005727194],"category_scores_gemma":[0.00799868,0.00065445044,0.0009278097,0.0031105753,0.0012958328,0.0054676565,0.00157559,0.00069107016,0.0014218626],"study_design_candidate":"not_applicable","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0003168787,0.00045565827,0.0168575,0.0012190972,0.000108212946,0.00082950864,0.0068905633,0.019279715,0.014550989,0.22979376,0.0063128206,0.70338535],"study_design_scores_gemma":[0.00024753518,0.0016621304,0.026243163,0.0009326969,0.0007553754,0.0042866226,0.015795756,0.33659494,0.09216284,0.13632728,0.38458624,0.00040535492],"about_ca_topic_score_codex":0.0025250341,"about_ca_topic_score_gemma":0.0015752278,"teacher_disagreement_score":0.005727194,"about_ca_system_score_codex":0.0015128879,"about_ca_system_score_gemma":0.0018975765,"threshold_uncertainty_score":0.019159377},"labels":[],"label_agreement":null},{"id":"W2371870663","doi":"","title":"Development and Application Development of E-mail System Based on SMTP and POP3","year":2007,"lang":"en","type":"article","venue":"Microcomputer applications","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":true,"route_about_ca":false,"ca_institutions":"","funders":"","keywords":"Computer science; The Internet; Service (business); Postal service; Electronic mail; World Wide Web; Business; Marketing","score_opus":0.008189887482912443,"score_gpt":0.22535090234487415,"score_spread":0.2171610148619617,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2371870663","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.2790351,0.0014048838,0.68582684,0.0005165423,0.00029779365,0.00096995424,0.00023268978,0.006887779,0.02482839],"genre_scores_gemma":[0.6078683,0.0018790407,0.3701779,0.00022850232,0.00009363744,0.00040337906,0.0008471447,0.00034928144,0.018152859],"study_design_codex":"design_other","study_design_gemma":"not_applicable","domain_scores_codex":[0.999464,0.00008998833,0.000037615748,0.000060745195,0.00027590315,0.000071692295],"domain_scores_gemma":[0.9995821,0.00005460265,0.000015838354,0.000045668276,0.00025880738,0.000042914387],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0007823063,0.00027971718,0.0002490912,0.00050800154,0.00033792207,0.00039153566,0.00063530204,0.00048591458,0.0021372389],"category_scores_gemma":[0.0009995245,0.00020352108,0.00038074364,0.00038328886,0.00016367449,0.0006734687,0.00039728393,0.0004435803,0.0007433107],"study_design_candidate":"not_applicable","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00044570884,0.0005988141,0.01052767,0.0008100717,0.00006673876,0.0018714966,0.0008768642,0.010641944,0.43792072,0.014401416,0.010717949,0.5111206],"study_design_scores_gemma":[0.00021447267,0.0014695233,0.018937448,0.00015533854,0.00023342481,0.003239412,0.00045274885,0.13874975,0.6943183,0.003251359,0.13888103,0.00009715619],"about_ca_topic_score_codex":0.0009187965,"about_ca_topic_score_gemma":0.00041393912,"teacher_disagreement_score":0.0021372389,"about_ca_system_score_codex":0.00021673864,"about_ca_system_score_gemma":0.00064676057,"threshold_uncertainty_score":0.0071498156},"labels":[],"label_agreement":null},{"id":"W2373343167","doi":"","title":"Computer system assisting the implementation of tour information prediction measure","year":2004,"lang":"en","type":"article","venue":"","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":1,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"CAE (Canada)","funders":"","keywords":"Measure (data warehouse); Statistic; Computer science; Tourism; Function (biology); Information system; Data mining; Information retrieval; Data science; Statistics; Mathematics; Geography; Engineering","score_opus":0.01303392319960381,"score_gpt":0.23595039977716256,"score_spread":0.22291647657755875,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2373343167","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.23908412,0.0010535087,0.59338427,0.00067759136,0.00042615377,0.0016641275,0.0030068294,0.104965776,0.055737667],"genre_scores_gemma":[0.8367576,0.00040214337,0.14236422,0.00017619097,0.0001608166,0.00056310906,0.002872204,0.00045183842,0.016251815],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.99936575,0.00014899907,0.000045446483,0.00015674216,0.00022359475,0.000059502367],"domain_scores_gemma":[0.99867296,0.00042623162,0.000076133496,0.0001705185,0.0005874089,0.000066712346],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0007919284,0.00043030558,0.00044885653,0.0016418026,0.00037560973,0.0010052612,0.00066551013,0.0003377879,0.008343027],"category_scores_gemma":[0.0029751319,0.00015200577,0.00017013356,0.0012045852,0.00018980933,0.0009550829,0.0004707499,0.00034612638,0.0027341102],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0009375226,0.0004003262,0.023222083,0.00036666117,0.0000672325,0.00027591438,0.0006846671,0.008126665,0.029741146,0.006755663,0.053848412,0.8755737],"study_design_scores_gemma":[0.00037038865,0.0015735438,0.07986624,0.00019814276,0.00037861677,0.00085970765,0.0006648656,0.6072547,0.14015386,0.0057445965,0.1626957,0.00023951153],"about_ca_topic_score_codex":0.0034431575,"about_ca_topic_score_gemma":0.0016227328,"teacher_disagreement_score":0.008343027,"about_ca_system_score_codex":0.000429947,"about_ca_system_score_gemma":0.0006221196,"threshold_uncertainty_score":0.027910233},"labels":[],"label_agreement":null},{"id":"W2376241126","doi":"","title":"Research on Search Engines and Meta Search Engine","year":2006,"lang":"en","type":"article","venue":"Microcomputer applications","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":true,"route_about_ca":false,"ca_institutions":"","funders":"","keywords":"Metasearch engine; Search engine; Computer science; Search analytics; Spamdexing; Quality (philosophy); Database search engine; Information retrieval; Beam search; Keyword search; Search algorithm; Web search query; Algorithm","score_opus":0.057287334674651254,"score_gpt":0.33491160981065515,"score_spread":0.2776242751360039,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2376241126","genre_codex":"methods","genre_gemma":"review","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"review","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.041062478,0.16881359,0.70214146,0.006861664,0.0009826912,0.00027940335,0.00043763657,0.0015686325,0.07785242],"genre_scores_gemma":[0.3362248,0.12953252,0.50030243,0.002833356,0.0022905937,0.0005801741,0.0012614123,0.0006650454,0.0263097],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"not_applicable","domain_scores_codex":[0.99518603,0.0015013228,0.0003543458,0.0008114407,0.0019199592,0.00022681936],"domain_scores_gemma":[0.98872256,0.0064879297,0.00052537676,0.0014722489,0.0025953264,0.0001965576],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0066118436,0.0008675676,0.0015026374,0.0058128485,0.000917947,0.0066140178,0.0021546993,0.002157115,0.004374803],"category_scores_gemma":[0.015184057,0.0009788008,0.0010663114,0.008873703,0.0017855205,0.028428154,0.00135021,0.0021787384,0.0025912812],"study_design_candidate":"not_applicable","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00015785989,0.00016285443,0.0030825238,0.0023596827,0.0001699978,0.00012998916,0.0006839911,0.006633606,0.004380237,0.61279464,0.0072894963,0.36215523],"study_design_scores_gemma":[0.00012238201,0.00059573766,0.0026797117,0.0015464489,0.00047181683,0.0020521546,0.0010731902,0.122368276,0.022065928,0.5125753,0.33423778,0.00021114432],"about_ca_topic_score_codex":0.0015166381,"about_ca_topic_score_gemma":0.0012982776,"teacher_disagreement_score":0.0066140178,"about_ca_system_score_codex":0.0021147795,"about_ca_system_score_gemma":0.0022564512,"threshold_uncertainty_score":0.034967184},"labels":[],"label_agreement":null},{"id":"W2377710661","doi":"","title":"Research on Extracting Topic Content from News Webpages","year":2007,"lang":"en","type":"article","venue":"Microcomputer applications","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":1,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":true,"route_about_ca":false,"ca_institutions":"","funders":"","keywords":"Computer science; Web page; Information retrieval; Thematic map; World Wide Web; Content (measure theory); Web content; Feature (linguistics); Mathematics","score_opus":0.1454054382448359,"score_gpt":0.3790545827980879,"score_spread":0.233649144553252,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2377710661","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.37174538,0.017981702,0.5931021,0.001066391,0.00031145333,0.00055730913,0.001490103,0.002503131,0.011242418],"genre_scores_gemma":[0.47763583,0.015829464,0.4876793,0.0003049767,0.00053977023,0.0004172883,0.006158644,0.0003368555,0.011097908],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9989605,0.00019788227,0.00011381338,0.00025829222,0.00039622694,0.00007332691],"domain_scores_gemma":[0.9970847,0.0013035563,0.00022050261,0.00024320863,0.0010636988,0.00008438686],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.001279176,0.000701154,0.00074309396,0.0069503747,0.000845614,0.0014371928,0.0006784222,0.00063361286,0.0011075563],"category_scores_gemma":[0.004955676,0.00046837112,0.0007475569,0.00619782,0.000418568,0.0040476085,0.00039405856,0.00048441137,0.0009945992],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0002298907,0.00022672277,0.019143693,0.0018901981,0.00014924076,0.0004902759,0.0016283069,0.003164999,0.095693305,0.0038666,0.004279638,0.8692372],"study_design_scores_gemma":[0.00014930592,0.00083097344,0.10144567,0.0007609691,0.0011731317,0.004571873,0.0039099283,0.2863048,0.4805315,0.014607311,0.10550901,0.00020557543],"about_ca_topic_score_codex":0.0031249064,"about_ca_topic_score_gemma":0.0021430035,"teacher_disagreement_score":0.0069503747,"about_ca_system_score_codex":0.0003521815,"about_ca_system_score_gemma":0.0007103149,"threshold_uncertainty_score":0.006765008},"labels":[],"label_agreement":null},{"id":"W2377813358","doi":"","title":"Comparative research of web technology application of Olympic Committee official websites of China,U.S.A,Australia and Canada","year":2007,"lang":"en","type":"article","venue":"Wuhan Ti-Yuan xuebao","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":true,"ca_institutions":"","funders":"","keywords":"China; Beijing; World Wide Web; Mistake; Function (biology); Index (typography); Web page; Political science; Advertising; Computer science; Library science; Business; Law","score_opus":0.04804168467738931,"score_gpt":0.3456807888824034,"score_spread":0.29763910420501405,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2377813358","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.98590475,0.0008086186,0.00011796908,0.00015555073,0.000013121232,0.000039205053,0.00054043235,0.000012260686,0.012407998],"genre_scores_gemma":[0.9967603,0.00049460115,0.00017893684,0.00003919132,0.0000039434544,0.000017763772,0.0004922779,0.00001001159,0.0020030325],"study_design_codex":"observational","study_design_gemma":"observational","domain_scores_codex":[0.99702054,0.00050577783,0.00015337991,0.00027220717,0.0014585423,0.0005895458],"domain_scores_gemma":[0.9808141,0.0033065856,0.0014118825,0.00042773565,0.012202627,0.0018371654],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0025153512,0.0002200717,0.0003585542,0.008503295,0.0028274136,0.0027743569,0.0004903972,0.0002861221,0.0024791898],"category_scores_gemma":[0.014272164,0.00019340818,0.00040595882,0.015313429,0.0009117664,0.0012859495,0.0013543965,0.00045021775,0.00021205675],"study_design_candidate":"observational","study_design_consensus":"observational","about_ca_topic_candidate":true,"about_ca_topic_consensus":true,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0004522842,0.00015160651,0.87024707,0.00048675828,0.0003125287,0.0009963523,0.049167406,0.00043781952,0.0017258363,0.0043998035,0.006219757,0.06540291],"study_design_scores_gemma":[0.0000032463938,0.000038384977,0.9771803,0.000040653158,0.000036807363,0.00008127038,0.018039044,0.0002873366,0.00021191257,0.00004652802,0.00402042,0.000014153672],"about_ca_topic_score_codex":0.82497907,"about_ca_topic_score_gemma":0.9284362,"teacher_disagreement_score":0.17502093,"about_ca_system_score_codex":0.011097261,"about_ca_system_score_gemma":0.01108854,"threshold_uncertainty_score":0.3521033},"labels":[],"label_agreement":null},{"id":"W2383193820","doi":"","title":"Design and Implementation of Network Search Engine","year":2014,"lang":"en","type":"article","venue":"Microcomputer applications","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":true,"route_about_ca":false,"ca_institutions":"","funders":"","keywords":"Computer science; Tree traversal; Web crawler; Information retrieval; Search engine; Index (typography); World Wide Web; Crawling; Web search engine; Web page; Parsing; Search analytics; Web search query; Programming language","score_opus":0.01158142914504863,"score_gpt":0.2663024263377802,"score_spread":0.25472099719273156,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2383193820","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.022636363,0.0006625917,0.9229194,0.0002511584,0.00016275949,0.0008373496,0.00050123624,0.025882183,0.026146984],"genre_scores_gemma":[0.39090317,0.0010808442,0.55500984,0.00050233305,0.000088875306,0.001458191,0.003093865,0.0013054751,0.04655734],"study_design_codex":"design_other","study_design_gemma":"not_applicable","domain_scores_codex":[0.99931705,0.000084932006,0.00008239417,0.00013216317,0.00027592733,0.00010749156],"domain_scores_gemma":[0.99954706,0.00004778976,0.000023029206,0.000060971095,0.0002716418,0.000049474693],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0006247896,0.00048132526,0.0005635808,0.0011341777,0.00057573855,0.0014353312,0.0021622356,0.00064790866,0.005702416],"category_scores_gemma":[0.0011461169,0.00039212548,0.000344101,0.0007223289,0.00023936256,0.0018866397,0.00071928994,0.00049148407,0.0031947752],"study_design_candidate":"not_applicable","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0017060569,0.0006439742,0.008256796,0.001617383,0.0002719967,0.0012186186,0.0008002016,0.047816925,0.13192423,0.06746424,0.045125283,0.6931542],"study_design_scores_gemma":[0.00036153963,0.0005835947,0.0028958765,0.00013954489,0.0003392652,0.0016221096,0.00030456713,0.62624174,0.1490435,0.009289199,0.2089603,0.00021874142],"about_ca_topic_score_codex":0.0052695386,"about_ca_topic_score_gemma":0.0033559883,"teacher_disagreement_score":0.005702416,"about_ca_system_score_codex":0.00074653927,"about_ca_system_score_gemma":0.0014398779,"threshold_uncertainty_score":0.019076467},"labels":[],"label_agreement":null},{"id":"W2385577549","doi":"","title":"Research on Ontology-based Meta Search Engine","year":2008,"lang":"en","type":"article","venue":"Microcomputer applications","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":true,"route_about_ca":false,"ca_institutions":"","funders":"","keywords":"Computer science; Ontology; Information retrieval; Search engine; Upper ontology; OWL-S; Semantic Web; World Wide Web; Semantic Web Stack","score_opus":0.1731160275249039,"score_gpt":0.3692062117848389,"score_spread":0.19609018425993502,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2385577549","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.030821156,0.0058610234,0.9270716,0.0015849345,0.00018237553,0.00018130467,0.00025768884,0.0022226777,0.03181723],"genre_scores_gemma":[0.4582811,0.006813883,0.51992655,0.00068925816,0.00017900439,0.0002565489,0.0012577163,0.0004004128,0.012195474],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"bench_or_experimental","domain_scores_codex":[0.9973431,0.00081383024,0.0002248932,0.00028373912,0.0011680315,0.00016642328],"domain_scores_gemma":[0.9978339,0.0009264709,0.00011659207,0.0003954892,0.0006556894,0.00007194581],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0037075258,0.00047927414,0.0009617506,0.003662948,0.0007551163,0.0050410405,0.0021618272,0.0013630143,0.0028565612],"category_scores_gemma":[0.0059074666,0.000423887,0.0012621016,0.0035533786,0.0010813057,0.014672689,0.0010689609,0.0010471835,0.0010524432],"study_design_candidate":"bench_or_experimental","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0001735358,0.00021209558,0.0037355497,0.00090011634,0.00021610703,0.00025273833,0.0015056834,0.017892474,0.008710327,0.67432874,0.005542154,0.2865305],"study_design_scores_gemma":[0.00009197439,0.00027198953,0.0021973331,0.0005240441,0.00041508625,0.0015020581,0.0017544416,0.52364373,0.02657653,0.2911964,0.1516272,0.0001991391],"about_ca_topic_score_codex":0.003987022,"about_ca_topic_score_gemma":0.00241659,"teacher_disagreement_score":0.0050410405,"about_ca_system_score_codex":0.0016222912,"about_ca_system_score_gemma":0.002556862,"threshold_uncertainty_score":0.019607544},"labels":[],"label_agreement":null},{"id":"W2385636393","doi":"","title":"The Design of One kind of Web Map Service Search Engine","year":2009,"lang":"en","type":"article","venue":"Microcomputer applications","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":true,"route_about_ca":false,"ca_institutions":"","funders":"","keywords":"Computer science; World Wide Web; Search engine; Web service; Frame (networking); Metadata; Service (business); Information retrieval; Web crawler; Web page; Database; Computer network","score_opus":0.02304865679809098,"score_gpt":0.24812192369085764,"score_spread":0.22507326689276666,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2385636393","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.018522505,0.0005455907,0.9490861,0.00039960752,0.0003372676,0.0010595738,0.00027952308,0.015713738,0.014056001],"genre_scores_gemma":[0.32073128,0.0006352369,0.64346004,0.00087543216,0.00023873214,0.0012315916,0.0014012278,0.0008680929,0.030558452],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.99836475,0.00017821246,0.0001600623,0.00036220232,0.00070155115,0.0002331257],"domain_scores_gemma":[0.9988937,0.000103644954,0.00004563265,0.00015659312,0.000674355,0.00012621791],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0011072272,0.00070072716,0.0013792732,0.0023980376,0.00102151,0.0028277887,0.0032504715,0.0018547986,0.004474752],"category_scores_gemma":[0.0016731054,0.00094745465,0.0009477947,0.001737218,0.00051459175,0.0037975535,0.0011134779,0.000982356,0.0037892915],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0026961607,0.0009840068,0.009707349,0.0022820213,0.0007531461,0.0020201919,0.0010767377,0.020255378,0.22332536,0.14347582,0.04475396,0.5486699],"study_design_scores_gemma":[0.00055540417,0.0010789024,0.0035161895,0.00016196744,0.00083021057,0.0037255317,0.0003677448,0.5031486,0.26125336,0.0136562325,0.21121788,0.00048800162],"about_ca_topic_score_codex":0.0042253993,"about_ca_topic_score_gemma":0.0025099146,"teacher_disagreement_score":0.004474752,"about_ca_system_score_codex":0.0011381145,"about_ca_system_score_gemma":0.0021342847,"threshold_uncertainty_score":0.014969587},"labels":[],"label_agreement":null},{"id":"W2386567032","doi":"","title":"A Search Engine Solution Based on Vertical Search Technology","year":2008,"lang":"en","type":"article","venue":"Microcomputer applications","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":1,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":true,"route_about_ca":false,"ca_institutions":"","funders":"","keywords":"Search engine; Computer science; Search-oriented architecture; Economic shortage; Metasearch engine; Search analytics; Spamdexing; The Internet; Beam search; Database search engine; Information retrieval; World Wide Web; Search algorithm; Web search query; Algorithm","score_opus":0.021197852909885233,"score_gpt":0.25954820498291004,"score_spread":0.2383503520730248,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2386567032","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.044682533,0.002393389,0.9004055,0.0015304212,0.00040554564,0.0006785897,0.00053097174,0.0031938783,0.04617912],"genre_scores_gemma":[0.36006698,0.002258623,0.57693875,0.00085177744,0.00031559722,0.0005728446,0.0015714325,0.0002475557,0.0571765],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.99892575,0.00017030355,0.00010535413,0.00014557393,0.00050703867,0.00014594421],"domain_scores_gemma":[0.99924195,0.00016689589,0.000053256204,0.00009362403,0.000388437,0.000055887445],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.00074154756,0.0006979509,0.0008318919,0.0025280218,0.0009680041,0.0017110127,0.0014439333,0.0014856565,0.0066397856],"category_scores_gemma":[0.002057446,0.00034479387,0.001025999,0.002840745,0.00035157969,0.0033725682,0.0015156541,0.0007126399,0.0027519753],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.000581959,0.0006138589,0.002164881,0.0010467562,0.00024149989,0.0006642382,0.00038553152,0.0290449,0.03894467,0.19013982,0.033582825,0.70258915],"study_design_scores_gemma":[0.00065205706,0.0012413335,0.0015704456,0.00028354244,0.00057858514,0.003137333,0.0005297932,0.6853939,0.048254266,0.1082566,0.14989763,0.0002044858],"about_ca_topic_score_codex":0.0026170313,"about_ca_topic_score_gemma":0.0027076916,"teacher_disagreement_score":0.0066397856,"about_ca_system_score_codex":0.0005602745,"about_ca_system_score_gemma":0.001661356,"threshold_uncertainty_score":0.022212267},"labels":[],"label_agreement":null},{"id":"W2386579087","doi":"","title":"Web User Clustering Based On Genetic Algorithm","year":2008,"lang":"en","type":"article","venue":"Microcomputer applications","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":true,"route_about_ca":false,"ca_institutions":"","funders":"","keywords":"Computer science; Cluster analysis; Adaptability; Data mining; Path (computing); Genetic algorithm; Similarity (geometry); Key (lock); Web application; Algorithm; Machine learning; Artificial intelligence; World Wide Web","score_opus":0.012279509318922625,"score_gpt":0.2239413828964657,"score_spread":0.21166187357754307,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2386579087","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.028609259,0.00018116654,0.96612686,0.00013557197,0.00004538516,0.00013507485,0.000060146845,0.0013473245,0.0033593113],"genre_scores_gemma":[0.4969023,0.0003384892,0.4954445,0.00013833042,0.000065926346,0.00038507325,0.00041120354,0.00022383695,0.0060902694],"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9988888,0.00026440277,0.000043475793,0.00024809837,0.00044751287,0.00010779898],"domain_scores_gemma":[0.9993279,0.0002068788,0.000051061354,0.000079319,0.00029702688,0.000037862905],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0010219505,0.00077923015,0.001152392,0.0022541208,0.0009811532,0.0011072109,0.0017819556,0.0010886997,0.0013527843],"category_scores_gemma":[0.002674649,0.00037478778,0.0009997126,0.0019976974,0.0007294557,0.0012394328,0.0007121728,0.00071178464,0.0005470104],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00015091749,0.00015419169,0.0040679155,0.00010942309,0.00021123256,0.00013185709,0.0003391388,0.6723584,0.006039198,0.017656825,0.003614187,0.29516673],"study_design_scores_gemma":[0.000017098726,0.000029127521,0.00072677206,0.0000074736704,0.000021623577,0.00005849936,0.00003008757,0.9924561,0.0015781678,0.003919056,0.0011370627,0.000018898281],"about_ca_topic_score_codex":0.023307804,"about_ca_topic_score_gemma":0.011346609,"teacher_disagreement_score":0.023307804,"about_ca_system_score_codex":0.0015307362,"about_ca_system_score_gemma":0.0016879282,"threshold_uncertainty_score":0.04634428},"labels":[],"label_agreement":null},{"id":"W2389133654","doi":"","title":"Design and Implementation of Website Searching by Text Message in Chinese","year":2007,"lang":"en","type":"article","venue":"Microcomputer applications","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":true,"route_about_ca":false,"ca_institutions":"","funders":"","keywords":"Computer science; World Wide Web; Value (mathematics); Text messaging; Short Message Service; Text message; Information retrieval; Telecommunications; Computer network","score_opus":0.007509813520371854,"score_gpt":0.29331935592459396,"score_spread":0.2858095424042221,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2389133654","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.38647678,0.00027175128,0.56961197,0.00082962925,0.00011798816,0.0052973144,0.00014531545,0.0043338765,0.032915376],"genre_scores_gemma":[0.6167678,0.00022485397,0.36704138,0.00021206538,0.00001884339,0.0024928798,0.00024100223,0.00017215605,0.012829058],"study_design_codex":"design_other","study_design_gemma":"bench_or_experimental","domain_scores_codex":[0.9988433,0.00040534168,0.000112144335,0.00019533787,0.00032784021,0.0001160234],"domain_scores_gemma":[0.9989693,0.00030183955,0.00007697997,0.000103958606,0.00040868652,0.00013929413],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0014219709,0.00044424995,0.0003430247,0.0009187086,0.00085837865,0.0013813904,0.0012610633,0.00067988405,0.0028969736],"category_scores_gemma":[0.0024032302,0.0003885225,0.00047898092,0.0005570764,0.0006780965,0.0016029364,0.00074163487,0.00047240933,0.0005673346],"study_design_candidate":"bench_or_experimental","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0017170353,0.0028683583,0.026240682,0.0022140006,0.00016972699,0.0024153828,0.014818869,0.02549453,0.16461816,0.064473525,0.007785965,0.6871838],"study_design_scores_gemma":[0.0011101556,0.004843669,0.037234586,0.0002926973,0.0010070581,0.0018762761,0.007088648,0.6621856,0.19781727,0.009935568,0.07625909,0.00034939477],"about_ca_topic_score_codex":0.0052874726,"about_ca_topic_score_gemma":0.003234504,"teacher_disagreement_score":0.0052874726,"about_ca_system_score_codex":0.0011097383,"about_ca_system_score_gemma":0.00292046,"threshold_uncertainty_score":0.010513365},"labels":[],"label_agreement":null},{"id":"W2390208607","doi":"","title":"Implementation of Authentication and Authorization on Windows Media Service","year":2006,"lang":"en","type":"article","venue":"Microcomputer applications","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":true,"route_about_ca":false,"ca_institutions":"","funders":"","keywords":"Computer science; Internet Authentication Service; Authentication (law); Authorization; Service (business); Computer security; Authentication server; Windows Rally; Windows Vista; Computer network; Microsoft Windows; Operating system; Server","score_opus":0.007719257852921292,"score_gpt":0.2477652953004292,"score_spread":0.2400460374475079,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2390208607","genre_codex":"methods","genre_gemma":"other","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"other","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.055206418,0.0008275957,0.87283677,0.00086340896,0.00068883883,0.0008266156,0.00039456334,0.03985283,0.028502995],"genre_scores_gemma":[0.7954288,0.0010268629,0.16761416,0.0007491512,0.00057923305,0.00073367794,0.0013230381,0.0022455256,0.030299509],"study_design_codex":"design_other","study_design_gemma":"not_applicable","domain_scores_codex":[0.9972898,0.0003907221,0.00032174148,0.00037939637,0.0011282277,0.00049017393],"domain_scores_gemma":[0.99735355,0.00041037082,0.00022187643,0.000729926,0.0010240908,0.00026028772],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0018707347,0.0007697388,0.00074822974,0.0010212074,0.0011348742,0.0028040374,0.0014900423,0.00092761166,0.0053184726],"category_scores_gemma":[0.0044257403,0.00040118644,0.0006507641,0.00047240904,0.0009001177,0.0043075816,0.001871751,0.0020655715,0.0024766498],"study_design_candidate":"not_applicable","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0036073998,0.0007734955,0.014588055,0.00090776244,0.00026251463,0.0022270246,0.0036028596,0.005520735,0.17024569,0.2438914,0.054059744,0.5003133],"study_design_scores_gemma":[0.000346427,0.00052859436,0.0048854486,0.0002164631,0.00033375697,0.001732805,0.0007187944,0.14976017,0.49577054,0.036138102,0.309216,0.00035282096],"about_ca_topic_score_codex":0.0027001272,"about_ca_topic_score_gemma":0.0009086901,"teacher_disagreement_score":0.0053184726,"about_ca_system_score_codex":0.0007683816,"about_ca_system_score_gemma":0.0016382813,"threshold_uncertainty_score":0.017792046},"labels":[],"label_agreement":null},{"id":"W2390238747","doi":"","title":"Internet Explorer and Email System for the Blind","year":2000,"lang":"en","type":"article","venue":"","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"CAE (Canada)","funders":"","keywords":"The Internet; Computer science; Decoding methods; Key (lock); Depth sounding; World Wide Web; Software; Telecommunications; Operating system; Geology","score_opus":0.04384418673308252,"score_gpt":0.24338376467385658,"score_spread":0.19953957794077407,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2390238747","genre_codex":"methods","genre_gemma":"other","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"other","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.020910311,0.0016091955,0.44340017,0.0046052393,0.002585252,0.0015040828,0.006704553,0.40194824,0.1167329],"genre_scores_gemma":[0.17468873,0.002470063,0.40498355,0.006448062,0.0031973498,0.0027101391,0.013797897,0.029789036,0.3619152],"study_design_codex":"not_applicable","study_design_gemma":"not_applicable","domain_scores_codex":[0.9990814,0.00023315668,0.00008765099,0.000107577776,0.00038213542,0.00010800212],"domain_scores_gemma":[0.99603736,0.00103205,0.00023258112,0.00087653653,0.000866256,0.0009550761],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0022520006,0.0005948886,0.0009115735,0.0019515277,0.00135894,0.0012713452,0.00094085693,0.0015233866,0.13198656],"category_scores_gemma":[0.0057262485,0.00040811003,0.00032207766,0.0007298966,0.0005019892,0.002921256,0.0036512166,0.0015236535,0.07648754],"study_design_candidate":"not_applicable","study_design_consensus":"not_applicable","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0008013813,0.00020270239,0.0013281275,0.00021120755,0.00001708799,0.0006608581,0.00041380202,0.0001845732,0.024392853,0.009707115,0.5616382,0.40044203],"study_design_scores_gemma":[0.00037302045,0.00071040785,0.0066107796,0.000208901,0.000059632574,0.003177112,0.00032608546,0.0063773054,0.016554177,0.015548028,0.94979143,0.000263106],"about_ca_topic_score_codex":0.00028075624,"about_ca_topic_score_gemma":0.0003769164,"teacher_disagreement_score":0.13198656,"about_ca_system_score_codex":0.00022708319,"about_ca_system_score_gemma":0.00064464146,"threshold_uncertainty_score":0.44153905},"labels":[],"label_agreement":null},{"id":"W2391604923","doi":"","title":"An Advanced the Forecasting Strategy for Intelligence Topic Relativity Based on PageRank","year":2010,"lang":"en","type":"article","venue":"Microcomputer applications","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":true,"route_about_ca":false,"ca_institutions":"","funders":"","keywords":"Computer science; PageRank; Competitive intelligence; Web page; Quality (philosophy); Information retrieval; Computational intelligence; World Wide Web; Data science; Artificial intelligence; Knowledge management","score_opus":0.03311330771514345,"score_gpt":0.2947385013842957,"score_spread":0.26162519366915227,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2391604923","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.027177915,0.001242297,0.9619373,0.00079579337,0.00029157448,0.00016791608,0.00030917823,0.0010891546,0.006988814],"genre_scores_gemma":[0.71633035,0.0022151947,0.2672834,0.00023863354,0.00092941895,0.0003833828,0.0012046718,0.0002238343,0.011191134],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9975521,0.00052279595,0.00016510308,0.00054134696,0.0009983395,0.00022034906],"domain_scores_gemma":[0.99673295,0.0009795473,0.0003343679,0.00025317376,0.001531516,0.00016855008],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0021123004,0.0011864918,0.0013727634,0.0045321477,0.0012403765,0.0028845062,0.0015773185,0.0011593794,0.0023760826],"category_scores_gemma":[0.009024449,0.0003975946,0.0008566533,0.0032836527,0.00091600866,0.0055339835,0.00095586624,0.0015079259,0.0010357808],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00019176715,0.00018870532,0.011506272,0.00037907704,0.00022863418,0.00031514166,0.0005561353,0.2910626,0.0067884573,0.16522776,0.021768963,0.5017865],"study_design_scores_gemma":[0.000027044644,0.000056499026,0.0012583252,0.000017299644,0.00004353595,0.00011767775,0.00006474724,0.9506426,0.0019423597,0.04098593,0.004795335,0.000048649727],"about_ca_topic_score_codex":0.008411792,"about_ca_topic_score_gemma":0.0053113108,"teacher_disagreement_score":0.008411792,"about_ca_system_score_codex":0.0019531101,"about_ca_system_score_gemma":0.002051865,"threshold_uncertainty_score":0.01672566},"labels":[],"label_agreement":null},{"id":"W2392055549","doi":"","title":"On Pivotal Techniques of the Internet Information Checking","year":2006,"lang":"en","type":"article","venue":"Microcomputer applications","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":true,"route_about_ca":false,"ca_institutions":"","funders":"","keywords":"Computer science; The Internet; Key (lock); Architecture; Object (grammar); Word (group theory); World Wide Web; Information retrieval; Computer security; Artificial intelligence","score_opus":0.003547873753416126,"score_gpt":0.19637045423375746,"score_spread":0.19282258048034134,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2392055549","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.010378068,0.0061121616,0.94835055,0.0012707097,0.00032749353,0.00013412829,0.00009832229,0.00073969015,0.032588903],"genre_scores_gemma":[0.26173583,0.009646995,0.7135004,0.0006733981,0.0010589039,0.00030901897,0.00027618746,0.00027131682,0.012527934],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.9962155,0.0012186816,0.00021797101,0.00063931703,0.001509898,0.00019862656],"domain_scores_gemma":[0.9954665,0.002279385,0.0002452213,0.0009946706,0.00092444033,0.00008982925],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0026740958,0.0007129157,0.0006599082,0.0054287454,0.0015090348,0.0030684904,0.001588967,0.0011353656,0.0047350656],"category_scores_gemma":[0.011000038,0.0005927464,0.0010363652,0.0053096833,0.004273817,0.0063869045,0.0020057429,0.0024308898,0.0018165965],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00010698562,0.00005691639,0.0010551211,0.0002537333,0.00003027729,0.00015822447,0.0005352494,0.0032297035,0.0029006412,0.74832326,0.005646057,0.2377038],"study_design_scores_gemma":[0.000066224835,0.00016847841,0.0015351394,0.0002933623,0.00009258164,0.0012850654,0.00031681644,0.10099428,0.016144482,0.7734071,0.10555337,0.00014315796],"about_ca_topic_score_codex":0.0019168148,"about_ca_topic_score_gemma":0.0007848447,"teacher_disagreement_score":0.0054287454,"about_ca_system_score_codex":0.0012404734,"about_ca_system_score_gemma":0.001439655,"threshold_uncertainty_score":0.015840352},"labels":[],"label_agreement":null},{"id":"W2395725456","doi":"10.3233/978-1-61499-125-0-146","title":"Continuation/Frame-based Semantics for Aspect Matching and Weaving","year":2012,"lang":"en","type":"book-chapter","venue":"Frontiers in artificial intelligence and applications","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Concordia University","funders":"","keywords":"Weaving; Continuation; Frame (networking); Computer science; Matching (statistics); Semantics (computer science); Programming language; Mathematics; Engineering; Mechanical engineering; Statistics","score_opus":0.042788862962674076,"score_gpt":0.27763569427226253,"score_spread":0.23484683130958844,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2395725456","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0027187064,0.0013673834,0.97580427,0.0005043257,0.00028288466,0.00008720364,0.00008620397,0.0011798793,0.017969113],"genre_scores_gemma":[0.13905723,0.0029947527,0.83259577,0.0006741623,0.0005491885,0.00044079646,0.00042482364,0.0010471486,0.022216061],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.9984226,0.00026906474,0.00019218464,0.00025453581,0.00070535275,0.00015620836],"domain_scores_gemma":[0.9992254,0.0002538078,0.00007413575,0.00016087452,0.00023416527,0.000051695257],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.002135524,0.0012456112,0.00073905865,0.001627239,0.001114659,0.0036751342,0.0020309184,0.0018535587,0.003930112],"category_scores_gemma":[0.002582541,0.0007681849,0.0016828849,0.0015985903,0.003748792,0.00514949,0.0018684826,0.00416718,0.0015624356],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.000014098291,0.000016453783,0.000043411634,0.0000830491,0.000007120098,0.00010331282,0.00041498322,0.0013650323,0.0021325022,0.96828866,0.0021939687,0.025337322],"study_design_scores_gemma":[0.000031011794,0.000032337706,0.000111809044,0.0001261259,0.000033700697,0.00037216605,0.00011821467,0.019530023,0.00414187,0.83464783,0.14081101,0.00004393312],"about_ca_topic_score_codex":0.0026354063,"about_ca_topic_score_gemma":0.0017423326,"teacher_disagreement_score":0.003930112,"about_ca_system_score_codex":0.0020590355,"about_ca_system_score_gemma":0.0017174762,"threshold_uncertainty_score":0.014939487},"labels":[],"label_agreement":null},{"id":"W2395903628","doi":"10.1007/978-3-662-49521-6_4","title":"Data Driven Discovery of Attribute Dictionaries","year":2016,"lang":"en","type":"book-chapter","venue":"Lecture notes in computer science","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":0,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Toronto; McMaster University","funders":"","keywords":"Computer science; Information retrieval; Product (mathematics); Laptop; Task (project management); Relevance (law); Data mining; Value (mathematics); Scope (computer science); String (physics); Machine learning; Programming language","score_opus":0.033790143420077634,"score_gpt":0.26049764693606653,"score_spread":0.2267075035159889,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2395903628","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.07814061,0.0017217539,0.90576094,0.0012252249,0.0002740759,0.0003723236,0.005078564,0.0041585467,0.0032679318],"genre_scores_gemma":[0.25778294,0.0010642707,0.7191808,0.00049695687,0.00016728789,0.0002699752,0.015923448,0.00049346447,0.0046207905],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.99600106,0.0006237622,0.00035166452,0.00078474596,0.0019429162,0.00029576937],"domain_scores_gemma":[0.98443776,0.008969525,0.0005865247,0.002762396,0.0028570462,0.0003866407],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0035666705,0.0006686332,0.0017005728,0.005319686,0.0011141617,0.0044871853,0.0035686756,0.001271198,0.0025353765],"category_scores_gemma":[0.021409882,0.0009576141,0.0018413286,0.0075137024,0.00103773,0.0051195114,0.0036438517,0.0023742083,0.00239351],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00060928386,0.00073884043,0.019134315,0.0007458328,0.00029007657,0.00055478653,0.0006067861,0.028656283,0.014651849,0.037343316,0.021646932,0.87502176],"study_design_scores_gemma":[0.000054987304,0.00012769639,0.0031213528,0.00016269997,0.0001251322,0.00090799213,0.00046030627,0.8501614,0.027988698,0.097299166,0.019523881,0.000066681314],"about_ca_topic_score_codex":0.002137782,"about_ca_topic_score_gemma":0.0049686413,"teacher_disagreement_score":0.005319686,"about_ca_system_score_codex":0.0010964909,"about_ca_system_score_gemma":0.0028333555,"threshold_uncertainty_score":0.018862545},"labels":[],"label_agreement":null},{"id":"W2396344332","doi":"","title":"Some Research Opportunities on Twitter Advertising.","year":2013,"lang":"en","type":"article","venue":"IEEE Data(base) Engineering Bulletin","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":10,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Toronto","funders":"","keywords":"Social media; Computer science; Advertising; Online advertising; Domain (mathematical analysis); Advertising research; World Wide Web; Advertising campaign; Business; The Internet","score_opus":0.16251831734252722,"score_gpt":0.30615641549415484,"score_spread":0.14363809815162762,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2396344332","genre_codex":"other","genre_gemma":"commentary","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"commentary","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.02914671,0.3626312,0.057134733,0.15983881,0.009173127,0.00028656799,0.001667827,0.00034932673,0.37977168],"genre_scores_gemma":[0.3213105,0.4561767,0.054422673,0.023964692,0.043686673,0.0005358379,0.0028481514,0.0002967805,0.09675797],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"not_applicable","domain_scores_codex":[0.9978144,0.0008718529,0.0001494415,0.00041041878,0.0005585555,0.000195359],"domain_scores_gemma":[0.9849045,0.010626529,0.0006701873,0.0008589329,0.0023078392,0.0006319944],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0033329052,0.0010632166,0.00081878866,0.0049958806,0.002447636,0.007919181,0.0011170327,0.0027535434,0.016896147],"category_scores_gemma":[0.012609373,0.0006216099,0.0011494248,0.0103720715,0.0019742693,0.0144985905,0.0015066549,0.0030718413,0.0044234237],"study_design_candidate":"not_applicable","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00014939402,0.0004267831,0.0093843145,0.0017560294,0.00007639037,0.0010914311,0.0017295427,0.002775423,0.0012868238,0.50260645,0.11804427,0.36067322],"study_design_scores_gemma":[0.000030167785,0.00012397867,0.007475384,0.0013831367,0.000072084134,0.0011616125,0.003980878,0.02421693,0.0017224458,0.34657326,0.61311656,0.00014357739],"about_ca_topic_score_codex":0.003690875,"about_ca_topic_score_gemma":0.0038037119,"teacher_disagreement_score":0.016896147,"about_ca_system_score_codex":0.0025550674,"about_ca_system_score_gemma":0.0016650185,"threshold_uncertainty_score":0.056523263},"labels":[],"label_agreement":null},{"id":"W2396862742","doi":"10.1016/j.jlamp.2016.04.001","title":"Declarative layout constraints for testing web applications","year":2016,"lang":"en","type":"article","venue":"Journal of Logical and Algebraic Methods in Programming","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":24,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Université du Québec à Chicoutimi","funders":"Natural Sciences and Engineering Research Council of Canada","keywords":"Computer science; Set (abstract data type); Web page; Window (computing); World Wide Web; Web application; Client-side scripting; Web browser; Information retrieval; Static web page; Programming language; Web navigation; The Internet","score_opus":0.10147900924795987,"score_gpt":0.3946221533810154,"score_spread":0.29314314413305553,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2396862742","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.036021132,0.00021994801,0.95013845,0.0008383026,0.00013614191,0.00029944498,0.0011230252,0.0068392637,0.00438426],"genre_scores_gemma":[0.43677744,0.0001826344,0.55591834,0.00055837433,0.00012429844,0.0004222338,0.0019909404,0.0011733415,0.0028523528],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.9867049,0.0040069236,0.0014870754,0.0015040229,0.005023659,0.0012733649],"domain_scores_gemma":[0.93562657,0.04605351,0.003575815,0.0076054144,0.005723243,0.0014155178],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0077113677,0.00143094,0.0012796627,0.0019276034,0.00092943455,0.004074116,0.0057687485,0.0023130598,0.006144099],"category_scores_gemma":[0.046138108,0.001483851,0.002110026,0.001533087,0.0031379964,0.008826293,0.004550261,0.004004884,0.0010191931],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0010588906,0.0013463253,0.014221644,0.0011698037,0.0003430894,0.0019752716,0.0012129709,0.28880075,0.028685544,0.4019953,0.017731491,0.24145898],"study_design_scores_gemma":[0.00018510532,0.00021969792,0.0009945306,0.00017263868,0.00011181899,0.00037434316,0.00033686208,0.68939644,0.02310122,0.27618068,0.008835131,0.00009159585],"about_ca_topic_score_codex":0.0053979424,"about_ca_topic_score_gemma":0.008609754,"teacher_disagreement_score":0.0077113677,"about_ca_system_score_codex":0.0017135263,"about_ca_system_score_gemma":0.003753452,"threshold_uncertainty_score":0.040782094},"labels":[],"label_agreement":null},{"id":"W2396873128","doi":"","title":"Context extraction in recommendation systems in software engineering: a preliminary survey","year":2015,"lang":"en","type":"article","venue":"Computer Science and Software Engineering","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":4,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"École de Technologie Supérieure","funders":"","keywords":"Computer science; Context (archaeology); Task (project management); Software; Key (lock); Focus (optics); Software engineering; Data science; Recommender system; Software system; World Wide Web; Systems engineering; Engineering; Computer security; Programming language","score_opus":0.0331688464224023,"score_gpt":0.24746798886799398,"score_spread":0.21429914244559167,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2396873128","genre_codex":"review","genre_gemma":"review","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"review","genre_consensus":"review","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.029934045,0.5449102,0.40488726,0.0031416859,0.00051070977,0.0005813649,0.0009445334,0.0013846785,0.013705507],"genre_scores_gemma":[0.19781518,0.37427303,0.41655,0.0012395337,0.0016219225,0.00052185747,0.0022889501,0.00026496736,0.005424627],"study_design_codex":"design_other","study_design_gemma":"not_applicable","domain_scores_codex":[0.9940282,0.0021052877,0.000905571,0.001372365,0.0013679557,0.00022065551],"domain_scores_gemma":[0.9855399,0.01059921,0.00043671066,0.0011346538,0.00210396,0.00018560822],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0066889348,0.0012242688,0.0025315098,0.0062456466,0.0010636016,0.003901664,0.0021014942,0.002224444,0.0033339094],"category_scores_gemma":[0.016252825,0.0011920694,0.0019646718,0.011907461,0.0008750015,0.007018346,0.0012853672,0.001538974,0.0018589771],"study_design_candidate":"not_applicable","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00019430222,0.0002482361,0.00791162,0.004651281,0.0003077474,0.00011230056,0.00050731975,0.004824472,0.0017122795,0.014430015,0.0056659556,0.95943445],"study_design_scores_gemma":[0.0001910189,0.0018476872,0.040700726,0.0087583745,0.0018849726,0.0042535043,0.0031760398,0.21561258,0.020072423,0.066151306,0.6366548,0.0006965233],"about_ca_topic_score_codex":0.006532698,"about_ca_topic_score_gemma":0.004713293,"teacher_disagreement_score":0.0066889348,"about_ca_system_score_codex":0.0013373393,"about_ca_system_score_gemma":0.001299034,"threshold_uncertainty_score":0.03537488},"labels":[],"label_agreement":null},{"id":"W2398381414","doi":"10.1504/ijbpim.2015.071262","title":"An approach to extract RESTful services from web applications","year":2015,"lang":"en","type":"article","venue":"International Journal of Business Process Integration and Management","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":3,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Polytechnique Montréal; Queen's University","funders":"","keywords":"World Wide Web; Web service; Computer science","score_opus":0.025780558179418187,"score_gpt":0.3034133070062464,"score_spread":0.2776327488268282,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2398381414","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.020076277,0.00051006186,0.957881,0.00034601658,0.000045589957,0.00047911424,0.00086588296,0.017733894,0.0020622332],"genre_scores_gemma":[0.12421719,0.00039912775,0.86693054,0.00021419443,0.000038749342,0.00027762336,0.0036561333,0.00079316844,0.003473161],"study_design_codex":"design_other","study_design_gemma":"not_applicable","domain_scores_codex":[0.99836034,0.00023660554,0.00022373545,0.0003182983,0.00072726165,0.000133763],"domain_scores_gemma":[0.99729556,0.0007675018,0.00036357623,0.0006767156,0.0007869132,0.00010972718],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0008857416,0.0017079975,0.0007635302,0.006378685,0.0010381838,0.002217703,0.0015703584,0.0014820802,0.0011726174],"category_scores_gemma":[0.004710176,0.0008661853,0.0022539212,0.0025256625,0.0006423677,0.002202263,0.0023301411,0.0014714235,0.0016377269],"study_design_candidate":"not_applicable","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00028467344,0.00037717924,0.0117005035,0.0010311365,0.00018735154,0.0019504353,0.0022768218,0.010945861,0.07667273,0.013054485,0.012682548,0.8688363],"study_design_scores_gemma":[0.00007639983,0.00023547307,0.01635447,0.00040029275,0.0003820429,0.0037858372,0.0012587779,0.6329694,0.1925669,0.041944932,0.10979259,0.00023285826],"about_ca_topic_score_codex":0.008193042,"about_ca_topic_score_gemma":0.010891566,"teacher_disagreement_score":0.008193042,"about_ca_system_score_codex":0.0008499338,"about_ca_system_score_gemma":0.0019165886,"threshold_uncertainty_score":0.016290724},"labels":[],"label_agreement":null},{"id":"W2403375692","doi":"","title":"Guided Summarization with Aspect Recognition.","year":2011,"lang":"en","type":"article","venue":"Theory and applications of categories","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":12,"is_retracted":false,"has_abstract":false,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":true,"route_about_ca":false,"ca_institutions":"","funders":"","keywords":"Automatic summarization; Computer science; Artificial intelligence","score_opus":0.024410019180402816,"score_gpt":0.23257516640533613,"score_spread":0.20816514722493332,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2403375692","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0111977095,0.0017571746,0.9670012,0.0003301019,0.00029177155,0.000357809,0.001864538,0.011968123,0.0052314107],"genre_scores_gemma":[0.12913918,0.00080724247,0.85229945,0.0002426646,0.0002806119,0.0004023246,0.009563979,0.00085886184,0.006405686],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9987056,0.00030998007,0.00013599073,0.00034809645,0.00038015246,0.000120208424],"domain_scores_gemma":[0.99773103,0.0007168121,0.00023661838,0.00053041545,0.0007040634,0.000081120976],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0010525616,0.0009925299,0.0011521834,0.00327591,0.0006732582,0.0022300591,0.0015862806,0.0009257443,0.004893261],"category_scores_gemma":[0.0061661243,0.00038137537,0.0010234914,0.003032919,0.00049378054,0.0025502476,0.0016617016,0.0012778041,0.0038178475],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00027474388,0.00009838736,0.0012130919,0.00056765345,0.00011922687,0.00017538757,0.0003793498,0.006301567,0.020686748,0.011642123,0.032183792,0.9263579],"study_design_scores_gemma":[0.00014950767,0.00042560275,0.0043362286,0.00027700549,0.00042979192,0.0010498402,0.0011619808,0.59240913,0.08105105,0.1532893,0.16529486,0.0001256668],"about_ca_topic_score_codex":0.0017363533,"about_ca_topic_score_gemma":0.0033933325,"teacher_disagreement_score":0.004893261,"about_ca_system_score_codex":0.0004472726,"about_ca_system_score_gemma":0.0008910996,"threshold_uncertainty_score":0.01636964},"labels":[],"label_agreement":null},{"id":"W2403585915","doi":"","title":"University of Ottawa at TREC 2010 Web Track Ranking Web Documents Using Meta-Data","year":2010,"lang":"en","type":"article","venue":"Text REtrieval Conference","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":2,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":true,"ca_institutions":"University of Ottawa","funders":"","keywords":"Computer science; Track (disk drive); Ranking (information retrieval); Information retrieval; World Wide Web","score_opus":0.0936111074354567,"score_gpt":0.2862664339247185,"score_spread":0.1926553264892618,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2403585915","genre_codex":"dataset","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.10931018,0.03715201,0.04969872,0.08597151,0.0227293,0.0022159358,0.41203952,0.039171446,0.24171138],"genre_scores_gemma":[0.13009557,0.010174849,0.06737836,0.00160501,0.0012487255,0.00040158862,0.2184267,0.0032584756,0.5674107],"study_design_codex":"not_applicable","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9934769,0.00088965247,0.00030148996,0.00087781233,0.0034477073,0.0010064715],"domain_scores_gemma":[0.96078986,0.0029428916,0.00047303137,0.0028956009,0.028404629,0.0044940957],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.009206556,0.001996802,0.002186654,0.0073616435,0.0049867914,0.008567633,0.0029802052,0.001699443,0.04607755],"category_scores_gemma":[0.015572188,0.0013875022,0.0009926368,0.0074916384,0.001691746,0.005238658,0.0016671784,0.0025758224,0.0240755],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":true,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0004684631,0.00021171676,0.0024078775,0.00022219933,0.000055493656,0.00006542487,0.00016651789,0.0016724099,0.0026425784,0.0017912171,0.929446,0.060850132],"study_design_scores_gemma":[0.00051249715,0.0003809478,0.026948264,0.00042824273,0.00031366365,0.00017852493,0.0014574144,0.028034309,0.025043093,0.0046117073,0.9117294,0.00036192263],"about_ca_topic_score_codex":0.832477,"about_ca_topic_score_gemma":0.89487916,"teacher_disagreement_score":0.832477,"about_ca_system_score_codex":0.023484394,"about_ca_system_score_gemma":0.035178125,"threshold_uncertainty_score":0.33701915},"labels":[],"label_agreement":null},{"id":"W2407544020","doi":"","title":"Ranking Web Pages Using Collective Knowledge.","year":2011,"lang":"en","type":"article","venue":"Text REtrieval Conference","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":2,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Ottawa","funders":"","keywords":"Computer science; Search engine indexing; Information retrieval; Web page; Ranking (information retrieval); World Wide Web; Static web page; Index (typography); Web navigation","score_opus":0.1401130716483935,"score_gpt":0.29170747471099256,"score_spread":0.15159440306259905,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2407544020","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.212673,0.01673969,0.6544166,0.002420217,0.00073563855,0.0020499197,0.022166776,0.021948617,0.06684953],"genre_scores_gemma":[0.63497293,0.0033536877,0.313951,0.00024725276,0.0006964006,0.00050181575,0.030667339,0.0006419564,0.014967623],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9968514,0.0005423191,0.00022878204,0.00047844838,0.0016947594,0.00020423338],"domain_scores_gemma":[0.99248934,0.0027097627,0.0008930835,0.001777537,0.0016775366,0.00045282757],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0029273832,0.00110925,0.0017341346,0.023128038,0.0012879107,0.0043132356,0.0012254197,0.0010149837,0.0028735579],"category_scores_gemma":[0.013375169,0.00044651964,0.0011279656,0.014216083,0.0005735827,0.004948688,0.0019896738,0.00097449304,0.003321356],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0002112216,0.0005819359,0.022251723,0.00082064717,0.00057943945,0.00021923539,0.0005069761,0.012425773,0.007846484,0.011128358,0.050875254,0.892553],"study_design_scores_gemma":[0.00019522994,0.0010659243,0.06435592,0.00057335786,0.0012640757,0.0018359494,0.0019111873,0.51135695,0.034045607,0.22630538,0.15669318,0.0003972744],"about_ca_topic_score_codex":0.004978637,"about_ca_topic_score_gemma":0.014357913,"teacher_disagreement_score":0.023128038,"about_ca_system_score_codex":0.0012513781,"about_ca_system_score_gemma":0.0014806822,"threshold_uncertainty_score":0.015481651},"labels":[],"label_agreement":null},{"id":"W2408481345","doi":"","title":"Extracting Data from the Deep Web with Global-as-View Mediators Using Rule-Enriched Semantic Annotations.","year":2014,"lang":"en","type":"article","venue":"","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":3,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of New Brunswick","funders":"","keywords":"Computer science; Information retrieval; Semantic Web Stack; Deep Web; Semantic Web; Exploit; Social Semantic Web; Data Web; Semantic search; World Wide Web; Web page; Index (typography); Web search engine; Web modeling; Web crawler; Web search query; Search engine; The Internet","score_opus":0.03602283158405946,"score_gpt":0.2909176166049133,"score_spread":0.25489478502085383,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2408481345","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0961656,0.0008137705,0.8654076,0.0007440019,0.00007631682,0.0006312937,0.005678456,0.025040034,0.0054429043],"genre_scores_gemma":[0.37665907,0.00042640525,0.6059644,0.0002681011,0.000029800802,0.00031575456,0.0129563315,0.0008680084,0.002512044],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9982186,0.00042587257,0.00020847398,0.0004094253,0.00065869,0.00007896527],"domain_scores_gemma":[0.99370664,0.003169225,0.0006119392,0.0016279013,0.0007112243,0.0001730853],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0028630132,0.000770513,0.00071798183,0.0035872378,0.00066547113,0.0034546298,0.0011538613,0.0010838866,0.00117947],"category_scores_gemma":[0.010342501,0.0004905823,0.000954122,0.003268493,0.000735732,0.0037926391,0.0032193474,0.0012520852,0.0009278923],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0014642308,0.0014084835,0.060545463,0.001523246,0.00068195997,0.0057086684,0.0052201916,0.051145677,0.081609316,0.04532847,0.020436902,0.7249275],"study_design_scores_gemma":[0.000098374876,0.00024550754,0.0100663025,0.00030130427,0.0004446097,0.001135877,0.0017685986,0.6884685,0.1262996,0.103884794,0.067142434,0.0001440782],"about_ca_topic_score_codex":0.0033977472,"about_ca_topic_score_gemma":0.007824672,"teacher_disagreement_score":0.0035872378,"about_ca_system_score_codex":0.0006091061,"about_ca_system_score_gemma":0.0015068471,"threshold_uncertainty_score":0.015141249},"labels":[],"label_agreement":null},{"id":"W2417268199","doi":"10.29173/cais5","title":"Metadata et profil utilisateur","year":2013,"lang":"fr","type":"article","venue":"Proceedings of the Annual Conference of CAIS / Actes du congrès annuel de l ACSI","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":1,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":true,"route_about_ca":false,"ca_institutions":"","funders":"","keywords":"Humanities; Philosophy; Physics","score_opus":0.046912735947367105,"score_gpt":0.2647341540724865,"score_spread":0.2178214181251194,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2417268199","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.05120259,0.010532315,0.6138521,0.018187782,0.0013093242,0.000580022,0.005395477,0.0074931146,0.29144725],"genre_scores_gemma":[0.40823394,0.012414913,0.36544496,0.0033524982,0.0014872294,0.0012126236,0.009199311,0.0036033422,0.19505121],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"not_applicable","domain_scores_codex":[0.9870919,0.0037685554,0.0015456358,0.0016484745,0.005236344,0.000709186],"domain_scores_gemma":[0.9808714,0.006291786,0.0014984326,0.004363874,0.006344563,0.00062992633],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.009944862,0.000806021,0.00065741426,0.0062613934,0.0022393665,0.014441315,0.001498463,0.0019960667,0.01238463],"category_scores_gemma":[0.018951794,0.0006750848,0.00072071375,0.0071425023,0.004236342,0.021518867,0.006153937,0.002525935,0.005782368],"study_design_candidate":"not_applicable","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00014780778,0.000053084237,0.004555499,0.0006091552,0.000031665564,0.000279043,0.009432087,0.0009469143,0.0045466884,0.7949109,0.017681492,0.16680564],"study_design_scores_gemma":[0.000026056421,0.00009420003,0.002356769,0.0010292212,0.000046789915,0.00082846597,0.0039096544,0.0040197344,0.010382832,0.1467456,0.8303926,0.00016811736],"about_ca_topic_score_codex":0.007564823,"about_ca_topic_score_gemma":0.0047932556,"teacher_disagreement_score":0.014441315,"about_ca_system_score_codex":0.0032869831,"about_ca_system_score_gemma":0.0037372413,"threshold_uncertainty_score":0.052594066},"labels":[],"label_agreement":null},{"id":"W2460629871","doi":"10.1109/icpc.2016.7503744","title":"WAVI: A reverse engineering tool for web applications","year":2016,"lang":"en","type":"article","venue":"","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":7,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"École de Technologie Supérieure","funders":"","keywords":"Computer science; JavaScript; Program comprehension; Reverse engineering; Web modeling; World Wide Web; Web application; Visualization; Documentation; Programming language; Web page; Software engineering; Artificial intelligence; Software; Software system","score_opus":0.010283315852155084,"score_gpt":0.21944293071076806,"score_spread":0.20915961485861298,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2460629871","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0033541357,0.00018402122,0.8539643,0.00015001737,0.00007666779,0.00019419524,0.0007905424,0.13946733,0.00181867],"genre_scores_gemma":[0.04227926,0.00048290624,0.92867655,0.0002446475,0.000041569747,0.0004805747,0.0047638486,0.016165031,0.006865711],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.99850744,0.0002633362,0.00019057836,0.00025204686,0.0007000893,0.00008638097],"domain_scores_gemma":[0.9948873,0.0026760262,0.000372062,0.0012324675,0.0007442579,0.0000879723],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0022603192,0.0017970325,0.00072071404,0.0029410531,0.0006169372,0.0023782968,0.0027921002,0.0015908662,0.0065199137],"category_scores_gemma":[0.011749394,0.0012023029,0.0015100043,0.0012720446,0.00059357035,0.0031924376,0.0021218876,0.0033977327,0.0037808698],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0003137503,0.00033213905,0.0039739404,0.0014000569,0.00021021263,0.0014841306,0.0015258775,0.016124425,0.056968216,0.023255162,0.07300173,0.82141036],"study_design_scores_gemma":[0.00021187885,0.0003340024,0.003966568,0.00069007144,0.00016664936,0.0036204157,0.00046973818,0.39129496,0.17851207,0.03885519,0.3815263,0.0003520845],"about_ca_topic_score_codex":0.0016919731,"about_ca_topic_score_gemma":0.0023870491,"teacher_disagreement_score":0.0065199137,"about_ca_system_score_codex":0.0003988521,"about_ca_system_score_gemma":0.0012688865,"threshold_uncertainty_score":0.021811306},"labels":[],"label_agreement":null},{"id":"W2466509469","doi":"10.29173/cais175","title":"Metasearch Result Visualization: An Exploratory Study","year":2013,"lang":"fr","type":"article","venue":"Proceedings of the Annual Conference of CAIS / Actes du congrès annuel de l ACSI","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":5,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":true,"route_about_ca":false,"ca_institutions":"","funders":"","keywords":"Metasearch engine; Visualization; Information retrieval; World Wide Web; Computer science; Search engine; Artificial intelligence; Web search query","score_opus":0.06344066003243704,"score_gpt":0.302437622278605,"score_spread":0.23899696224616795,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2466509469","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.9774139,0.0005050136,0.014042834,0.00047327203,0.000022950524,0.00059053284,0.00041090848,0.000411419,0.0061291144],"genre_scores_gemma":[0.9812889,0.0003881568,0.015297635,0.00014719808,0.000025672913,0.0005384143,0.00035221086,0.00023515076,0.0017266985],"study_design_codex":"qualitative","study_design_gemma":"observational","domain_scores_codex":[0.986779,0.00939303,0.00063062453,0.0006857936,0.0019788928,0.0005326159],"domain_scores_gemma":[0.86615634,0.1181672,0.0031700782,0.0037509017,0.0077136997,0.0010417702],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.019363893,0.00065188424,0.0006893865,0.0036268581,0.001722523,0.00356023,0.0012781017,0.0013824919,0.0028158405],"category_scores_gemma":[0.078025185,0.00052898965,0.0007819016,0.0027560086,0.0015047336,0.003722133,0.0025757588,0.0012287403,0.00057001493],"study_design_candidate":"observational","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.001675855,0.0026062015,0.11824573,0.00338951,0.00022265897,0.003765409,0.69635713,0.0013593507,0.028706834,0.003895907,0.004944197,0.13483122],"study_design_scores_gemma":[0.00037839435,0.00812152,0.23980542,0.002366445,0.00048146714,0.007701208,0.5822385,0.020727882,0.047919042,0.0060906205,0.08366192,0.0005075773],"about_ca_topic_score_codex":0.0019964704,"about_ca_topic_score_gemma":0.0023581423,"teacher_disagreement_score":0.019363893,"about_ca_system_score_codex":0.00083694165,"about_ca_system_score_gemma":0.0010522121,"threshold_uncertainty_score":0.10240728},"labels":[],"label_agreement":null},{"id":"W2470615246","doi":"10.30000/ijfs.201006.0001","title":"Rule- and OWA-based Semantic Similarity for User Profiling","year":2010,"lang":"en","type":"article","venue":"International Journal of Fuzzy Systems","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":8,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Alberta","funders":"","keywords":"Computer science; Profiling (computer programming); Information retrieval; User profile; Similarity measure; Relevance (law); The Internet; Semantic similarity; Ontology; Similarity (geometry); Data mining; Semantic Web; World Wide Web; Artificial intelligence","score_opus":0.016647977072944926,"score_gpt":0.2797645338934923,"score_spread":0.2631165568205474,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2470615246","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.2898087,0.0007186523,0.69563,0.00028495918,0.00016514474,0.00044310407,0.0028339582,0.0021764718,0.007938928],"genre_scores_gemma":[0.8715195,0.00011760615,0.12528948,0.000038796265,0.00003550807,0.0001574831,0.0017415964,0.000044134955,0.0010558591],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.99724185,0.00058864197,0.00040115853,0.00041883183,0.0011637214,0.00018590318],"domain_scores_gemma":[0.9964561,0.0013575586,0.00029586302,0.00051238865,0.0012157054,0.00016238556],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0015987989,0.00041169405,0.0008750199,0.005604341,0.00077539653,0.0016762967,0.0009788764,0.000748347,0.0019908566],"category_scores_gemma":[0.0092343,0.00015429495,0.0010133152,0.0037553227,0.00040109773,0.0030048015,0.0011936977,0.0006427507,0.0010708363],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0015283899,0.0010925889,0.04527396,0.0005531709,0.00042536223,0.00039013487,0.0009758578,0.026205536,0.025970204,0.0207811,0.0044408976,0.87236285],"study_design_scores_gemma":[0.000045112378,0.0003257966,0.02561058,0.00008951318,0.00024273568,0.00046204255,0.00084145454,0.9162144,0.020010203,0.031189943,0.0048700166,0.00009819555],"about_ca_topic_score_codex":0.002967382,"about_ca_topic_score_gemma":0.0027150847,"teacher_disagreement_score":0.005604341,"about_ca_system_score_codex":0.00060080143,"about_ca_system_score_gemma":0.0009414811,"threshold_uncertainty_score":0.008455396},"labels":[],"label_agreement":null},{"id":"W2477968620","doi":"10.7202/1052615ar","title":"Télédéchargement et création de bases de données locales : communication, conversion et droit d’auteur","year":2018,"lang":"fr","type":"article","venue":"Documentation et bibliothèques","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":true,"route_about_ca":false,"ca_institutions":"Université de Montréal","funders":"","keywords":"Humanities; Physics; Philosophy","score_opus":0.0403401756693092,"score_gpt":0.33335207774426034,"score_spread":0.29301190207495115,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2477968620","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.11621667,0.027017863,0.5156019,0.030793937,0.0012718664,0.0006517205,0.00751124,0.004267963,0.2966668],"genre_scores_gemma":[0.48235363,0.029924182,0.3403373,0.003090736,0.0007640637,0.00078030134,0.007505294,0.0016793411,0.13356514],"study_design_codex":"design_other","study_design_gemma":"not_applicable","domain_scores_codex":[0.99312335,0.0018672016,0.0006186023,0.0010755219,0.0029532504,0.0003620944],"domain_scores_gemma":[0.9817456,0.0072400756,0.0011186865,0.006109473,0.0033439514,0.00044207522],"candidate_categories":["scholarly_communication"],"consensus_categories":[],"category_scores_codex":[0.0064433664,0.00044757646,0.00069164665,0.0053636497,0.0024798173,0.011218397,0.001835079,0.0014816653,0.012436352],"category_scores_gemma":[0.019161522,0.0006413131,0.000980139,0.011405267,0.0040084575,0.013095611,0.0053555537,0.0025103097,0.0028136992],"study_design_candidate":"not_applicable","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00017966183,0.00008022699,0.010065687,0.0019125714,0.00010142262,0.0013947241,0.02475339,0.0039997506,0.007022182,0.36999226,0.025066791,0.55543125],"study_design_scores_gemma":[0.000020374939,0.000044877244,0.008358589,0.0018266842,0.00007520822,0.0014202056,0.010726017,0.0044184146,0.010038398,0.039799802,0.92316294,0.00010852999],"about_ca_topic_score_codex":0.027355142,"about_ca_topic_score_gemma":0.021074174,"teacher_disagreement_score":0.98878163,"about_ca_system_score_codex":0.0044667386,"about_ca_system_score_gemma":0.0054020584,"threshold_uncertainty_score":0.0543918},"labels":[],"label_agreement":null},{"id":"W2484827747","doi":"10.1090/gsm/089/02","title":"The web graph","year":2008,"lang":"en","type":"book-chapter","venue":"Graduate studies in mathematics","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":2,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Toronto Metropolitan University","funders":"","keywords":"Computer science; Graph; World Wide Web; Theoretical computer science","score_opus":0.16040352518637496,"score_gpt":0.3125267142228352,"score_spread":0.15212318903646022,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2484827747","genre_codex":"other","genre_gemma":"other","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"other","genre_consensus":"other","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.021714985,0.012602093,0.36307743,0.014231802,0.0017217448,0.00023045973,0.0043607466,0.0016349431,0.58042574],"genre_scores_gemma":[0.37108088,0.030383084,0.21939339,0.0053623244,0.0029819526,0.00060957356,0.010108796,0.0020359408,0.35804412],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"not_applicable","domain_scores_codex":[0.99957675,0.00010756524,0.000017360166,0.0001382591,0.00013037445,0.000029718938],"domain_scores_gemma":[0.99908113,0.00038395418,0.00007185638,0.0002415491,0.00013398218,0.00008757703],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.00034609815,0.0006566979,0.00059080584,0.0031626069,0.0015535139,0.0037275443,0.00087397284,0.0014105963,0.021184396],"category_scores_gemma":[0.0026339428,0.00050495047,0.00065760256,0.0045060567,0.002014069,0.007326069,0.0014801789,0.0018304051,0.0055756913],"study_design_candidate":"not_applicable","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.000007861212,0.000010632355,0.00016407322,0.00008606358,0.000009528428,0.000071429684,0.00013823179,0.0009832407,0.0002671851,0.91864705,0.034747787,0.044866957],"study_design_scores_gemma":[0.0000027808105,0.0000032315177,0.00013095044,0.00004035075,0.00001014104,0.00016046909,0.00006986202,0.0031515555,0.00020265394,0.88862187,0.10760059,0.0000055072237],"about_ca_topic_score_codex":0.003371108,"about_ca_topic_score_gemma":0.003046195,"teacher_disagreement_score":0.021184396,"about_ca_system_score_codex":0.001203094,"about_ca_system_score_gemma":0.00078034,"threshold_uncertainty_score":0.07086885},"labels":[],"label_agreement":null},{"id":"W2493237406","doi":"10.1145/2897073.2897101","title":"Migrating user interfaces in native mobile applications","year":2016,"lang":"en","type":"article","venue":"","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":9,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Alberta","funders":"","keywords":"Porting; Computer science; Android (operating system); User interface; Mobile device; Mobile computing; Source code; Mobile Web; Process migration; Human–computer interaction; Process (computing); Mobile technology; Embedded system; Operating system; Software","score_opus":0.01026904760670829,"score_gpt":0.2595201833456993,"score_spread":0.24925113573899102,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2493237406","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.12035753,0.0008100443,0.83732045,0.00033895808,0.00024411824,0.0007000297,0.00021907363,0.032509428,0.007500325],"genre_scores_gemma":[0.43666196,0.0005249108,0.5421847,0.00066212175,0.000059852893,0.00065053813,0.0009354857,0.0045375675,0.01378273],"study_design_codex":"design_other","study_design_gemma":"not_applicable","domain_scores_codex":[0.9982315,0.0003852294,0.00020078685,0.00036108436,0.0006086493,0.00021276741],"domain_scores_gemma":[0.9950342,0.0013466417,0.00041624522,0.0020124225,0.0009815779,0.0002089331],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0015315885,0.00074956537,0.0005193739,0.0008990553,0.0008060548,0.0020021372,0.0017603535,0.0013104784,0.0020325487],"category_scores_gemma":[0.0113486955,0.0010273057,0.00076421374,0.0005010348,0.00083411566,0.0022643867,0.0031316308,0.0015732665,0.0017978436],"study_design_candidate":"not_applicable","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0010525477,0.0006494076,0.017272735,0.0012465921,0.00014812594,0.0026783277,0.008151128,0.014511111,0.19269621,0.032046728,0.020079665,0.7094674],"study_design_scores_gemma":[0.00020370902,0.00071046734,0.020780435,0.0006233181,0.00024368455,0.0041262824,0.002816824,0.39464185,0.30636972,0.04503826,0.22415979,0.00028574918],"about_ca_topic_score_codex":0.0011538403,"about_ca_topic_score_gemma":0.0013787636,"teacher_disagreement_score":0.0020325487,"about_ca_system_score_codex":0.00045666032,"about_ca_system_score_gemma":0.0008124456,"threshold_uncertainty_score":0.008099914},"labels":[],"label_agreement":null},{"id":"W2494293062","doi":"10.4018/978-1-60566-014-1.ch062","title":"E-Learning Systems Content Adaptation Frameworks and Techniques","year":2009,"lang":"en","type":"book-chapter","venue":"IGI Global eBooks","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Athabasca University","funders":"","keywords":"Adaptation (eye); Content adaptation; Computer science; Multimedia; Mobile device; World Wide Web; Web content; The Internet; Process (computing); Context (archaeology); Digital content; Human–computer interaction; Ubiquitous computing","score_opus":0.02774518903818485,"score_gpt":0.23958244559390804,"score_spread":0.2118372565557232,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2494293062","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.005075127,0.00468786,0.9585721,0.0005898268,0.00012253753,0.0005456361,0.00021447365,0.0058750683,0.024317475],"genre_scores_gemma":[0.13334641,0.0136050545,0.804771,0.00048610882,0.00023032687,0.00083271426,0.001379172,0.0010656038,0.044283565],"study_design_codex":"design_other","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.9987832,0.00029617807,0.000107149375,0.00020722578,0.00051506114,0.000091255155],"domain_scores_gemma":[0.99890864,0.0004286863,0.000047991725,0.00033964132,0.0002246477,0.00005030919],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0014463147,0.00069714896,0.0006836584,0.0016270106,0.00058002345,0.0030287257,0.0029725346,0.0013116791,0.005870958],"category_scores_gemma":[0.003128722,0.0005052225,0.00091847224,0.0025458024,0.00077093835,0.003411195,0.0024501884,0.0016065149,0.003678556],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.000070185066,0.00021186276,0.00062669854,0.00088355655,0.00006099913,0.0002524722,0.00086075335,0.014634026,0.009651653,0.05518457,0.014956617,0.9026066],"study_design_scores_gemma":[0.00006367,0.00009785892,0.0028275512,0.00073969306,0.00010652036,0.0016709118,0.0008831199,0.26600215,0.030751178,0.11048125,0.5862615,0.00011455759],"about_ca_topic_score_codex":0.0022957046,"about_ca_topic_score_gemma":0.0013206683,"teacher_disagreement_score":0.005870958,"about_ca_system_score_codex":0.00093191565,"about_ca_system_score_gemma":0.0007229159,"threshold_uncertainty_score":0.019640326},"labels":[],"label_agreement":null},{"id":"W2508222813","doi":"10.1007/s11280-016-0410-4","title":"Crawling ranked deep Web data sources","year":2016,"lang":"en","type":"article","venue":"World Wide Web","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":5,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Windsor","funders":"Natural Sciences and Engineering Research Council of Canada; National Natural Science Foundation of China","keywords":"Computer science; Crawling; Ranking (information retrieval); Web crawler; Information retrieval; Deep Web; Hyperlink; Web search query; Variety (cybernetics); Web page; Data mining; Learning to rank; World Wide Web; Search engine; Artificial intelligence; The Internet","score_opus":0.02944221598943287,"score_gpt":0.2526845032144845,"score_spread":0.22324228722505163,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2508222813","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.53878266,0.0082430625,0.3185281,0.0027110104,0.00085629564,0.0014473704,0.08949837,0.026533606,0.0133995395],"genre_scores_gemma":[0.52873194,0.0026559117,0.3061214,0.00049553864,0.00028924146,0.00048588176,0.14954938,0.0015492681,0.010121375],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9958781,0.00050313154,0.00044153922,0.0004700963,0.0023749494,0.0003321376],"domain_scores_gemma":[0.98679084,0.0048096213,0.0009664129,0.002571285,0.004293388,0.0005684369],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.002314832,0.0013546763,0.0012805564,0.023522802,0.0017151339,0.003640346,0.0014274067,0.0014842192,0.0015653275],"category_scores_gemma":[0.020463191,0.0010052085,0.0013925185,0.015195106,0.00052416674,0.00409341,0.002507459,0.0016099105,0.0016542028],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0005524491,0.0013736761,0.12979059,0.002558257,0.0013217811,0.002047802,0.0013960277,0.0130618,0.028238192,0.012141908,0.10993968,0.6975778],"study_design_scores_gemma":[0.00014193894,0.0005091097,0.07508997,0.00082562066,0.0014686185,0.0037539166,0.0021836238,0.65342104,0.07217038,0.06536436,0.12485773,0.00021373418],"about_ca_topic_score_codex":0.011261315,"about_ca_topic_score_gemma":0.038498595,"teacher_disagreement_score":0.023522802,"about_ca_system_score_codex":0.0010440128,"about_ca_system_score_gemma":0.0035403313,"threshold_uncertainty_score":0.022391558},"labels":[],"label_agreement":null},{"id":"W2510806312","doi":"10.1108/ajim-09-2015-0147","title":"Canadian public libraries and search engines: barriers to visibility","year":2016,"lang":"en","type":"article","venue":"Aslib Journal of Information Management","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":10,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":true,"ca_institutions":"Dalhousie University","funders":"","keywords":"Visibility; Originality; Value (mathematics); Thematic analysis; Computer science; Thematic map; Search analytics; Search engine optimization; Search engine; Public relations; Information retrieval; World Wide Web; Data science; Sociology; Political science; Qualitative research; Geography; Web search query; Social science","score_opus":0.00982251207246257,"score_gpt":0.21449286144593374,"score_spread":0.20467034937347117,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2510806312","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.8682121,0.0047707874,0.0017969306,0.015923023,0.00007592941,0.00023299301,0.00084491825,0.00015430198,0.10798902],"genre_scores_gemma":[0.99285156,0.0013627674,0.0006802984,0.000563714,0.000015807505,0.000043511016,0.0001308054,0.00002436844,0.004327089],"study_design_codex":"observational","study_design_gemma":"observational","domain_scores_codex":[0.9832743,0.0033330657,0.0008378327,0.00089409394,0.00730377,0.0043569193],"domain_scores_gemma":[0.93295956,0.031052887,0.00945428,0.0021441814,0.016464384,0.007924652],"candidate_categories":["scholarly_communication"],"consensus_categories":[],"category_scores_codex":[0.009219565,0.00034560013,0.0007018145,0.005671037,0.018359099,0.015682666,0.0022922046,0.0011546831,0.009902051],"category_scores_gemma":[0.052137144,0.0005295385,0.00045876857,0.017072335,0.007049733,0.0046755406,0.0065844953,0.001328052,0.0005443759],"study_design_candidate":"observational","study_design_consensus":"observational","about_ca_topic_candidate":true,"about_ca_topic_consensus":true,"about_ca_system_candidate":true,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00050462974,0.000307035,0.35625264,0.0032620037,0.00015216635,0.002046813,0.325827,0.0009030182,0.0017285589,0.0488608,0.02543834,0.23471704],"study_design_scores_gemma":[0.000045787543,0.0001454498,0.38862845,0.0013632604,0.00014875554,0.0005864059,0.46831462,0.00095771055,0.001157813,0.005384839,0.13303202,0.00023487127],"about_ca_topic_score_codex":0.9509953,"about_ca_topic_score_gemma":0.9537715,"teacher_disagreement_score":0.98431736,"about_ca_system_score_codex":0.066682436,"about_ca_system_score_gemma":0.15099332,"threshold_uncertainty_score":0.48381722},"labels":[],"label_agreement":null},{"id":"W2519452335","doi":"10.1145/2938503.2938522","title":"Comparative Mining of B2C Web Sites by Discovering Web Database Schemas","year":2016,"lang":"en","type":"article","venue":"","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Windsor","funders":"","keywords":"Computer science; Web page; Data Web; Document Object Model; Web mining; Web modeling; Information retrieval; World Wide Web; Schema matching; Web mapping; Parsing; Web intelligence; Static web page; Database; Web navigation; Data integration; Artificial intelligence","score_opus":0.03579551979941218,"score_gpt":0.2790814370437026,"score_spread":0.2432859172442904,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2519452335","genre_codex":"empirical","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.84868735,0.0025513216,0.09123208,0.00048303156,0.00006091135,0.0009973012,0.026532792,0.0017981536,0.02765711],"genre_scores_gemma":[0.7886619,0.0010997483,0.15851283,0.00014465177,0.000024214067,0.0003474473,0.04886451,0.0003348226,0.0020097655],"study_design_codex":"observational","study_design_gemma":"not_applicable","domain_scores_codex":[0.9977946,0.00060908217,0.00025646712,0.0004327392,0.00073461374,0.00017245061],"domain_scores_gemma":[0.99358314,0.0026649837,0.00048180792,0.0011958667,0.0017306719,0.00034340663],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0020816212,0.000497635,0.00058716815,0.017016595,0.0009968365,0.0029424361,0.0013531529,0.0010366298,0.0031225514],"category_scores_gemma":[0.008310943,0.00038207383,0.0013397537,0.01465238,0.00041763872,0.0033664093,0.00086084404,0.000551718,0.0016864889],"study_design_candidate":"not_applicable","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0013218512,0.0014472299,0.47055963,0.0018092281,0.0010221315,0.0020147255,0.0022891744,0.027301023,0.026273454,0.0281244,0.019746086,0.41809106],"study_design_scores_gemma":[0.00022050265,0.00062805065,0.38832292,0.0005612441,0.0007520877,0.0038848945,0.0090123275,0.43271697,0.058183394,0.03575268,0.06976087,0.00020404797],"about_ca_topic_score_codex":0.012431908,"about_ca_topic_score_gemma":0.018978853,"teacher_disagreement_score":0.017016595,"about_ca_system_score_codex":0.0010261358,"about_ca_system_score_gemma":0.0014232356,"threshold_uncertainty_score":0.02471912},"labels":[],"label_agreement":null},{"id":"W2532952661","doi":"10.5703/1288284316316","title":"Improving the Availability of ISSN—A Joint Project","year":2016,"lang":"en","type":"article","venue":"","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Purdue Pharma (Canada)","funders":"","keywords":"Work (physics); Session (web analytics); Schedule; Library science; Identifier; Operations research; Computer science; Political science; Public relations; Engineering management; Business; Engineering; World Wide Web","score_opus":0.031887876283162794,"score_gpt":0.2427356407448244,"score_spread":0.2108477644616616,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2532952661","genre_codex":"empirical","genre_gemma":"other","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"other","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.43624747,0.003420103,0.31770527,0.090415165,0.0069854315,0.005487453,0.0015341513,0.013813361,0.12439157],"genre_scores_gemma":[0.59059936,0.0014417527,0.33176705,0.0044398033,0.0013623702,0.0018965781,0.002772786,0.0035355666,0.062184714],"study_design_codex":"design_other","study_design_gemma":"not_applicable","domain_scores_codex":[0.94064236,0.02972488,0.0037203282,0.0057074465,0.017176984,0.0030279763],"domain_scores_gemma":[0.7673704,0.074751236,0.0069451034,0.044261206,0.0875843,0.019087786],"candidate_categories":["scholarly_communication"],"consensus_categories":[],"category_scores_codex":[0.11852038,0.0006578587,0.0010248784,0.0043700705,0.005668008,0.017813222,0.0036606814,0.0023990497,0.012266427],"category_scores_gemma":[0.15637545,0.0011730007,0.0007708193,0.003885903,0.004277977,0.024759628,0.013358277,0.005636347,0.0036371131],"study_design_candidate":"not_applicable","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00065712567,0.0023793515,0.013617864,0.0005862858,0.000040032704,0.0005657446,0.024406062,0.0015768063,0.007745064,0.025945906,0.06195472,0.860525],"study_design_scores_gemma":[0.0002508107,0.003704408,0.025366291,0.00079908944,0.00014087009,0.0015414086,0.053619865,0.011518998,0.020008607,0.018099561,0.86461574,0.00033429326],"about_ca_topic_score_codex":0.0061280783,"about_ca_topic_score_gemma":0.004067357,"teacher_disagreement_score":0.9821868,"about_ca_system_score_codex":0.005289371,"about_ca_system_score_gemma":0.023000365,"threshold_uncertainty_score":0.62680316},"labels":[],"label_agreement":null},{"id":"W2536823992","doi":"10.1109/step.2005.7","title":"Accurate and Efficient HTML Differencing","year":2005,"lang":"en","type":"article","venue":"","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":9,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Alberta","funders":"","keywords":"Computer science; HTML element; Tree (set theory); Information retrieval; Web page; Web site; Tree structure; Document Object Model; World Wide Web; Natural language processing; Algorithm; The Internet; Binary tree; Mathematics","score_opus":0.01329653818081446,"score_gpt":0.23131192357104816,"score_spread":0.21801538539023368,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2536823992","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.04671418,0.00078533654,0.93079287,0.00024386618,0.00015497678,0.00020231432,0.001202439,0.016470099,0.0034338664],"genre_scores_gemma":[0.18141249,0.0003570608,0.80947304,0.00010264421,0.000057865644,0.000083928666,0.0033734452,0.00071596453,0.0044236244],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.99677724,0.00033852705,0.00031417087,0.0006544419,0.0017175222,0.00019812353],"domain_scores_gemma":[0.992409,0.0018134225,0.0006118134,0.0026165212,0.0024047326,0.00014438677],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0018027732,0.0008234057,0.0012630636,0.0044301045,0.00082556787,0.0030818311,0.00243924,0.0013875689,0.002706399],"category_scores_gemma":[0.012424335,0.00049817155,0.00063442776,0.0045602224,0.00045858973,0.0029165568,0.0017566276,0.0011294273,0.003920326],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00025737062,0.00015318302,0.008248987,0.00019885234,0.000055442557,0.00025223644,0.00030809897,0.015987746,0.03184753,0.0050192517,0.010578291,0.92709297],"study_design_scores_gemma":[0.00010532061,0.00016201183,0.013326546,0.00009069364,0.00008894346,0.0019547874,0.0007763874,0.7516539,0.14952816,0.02261963,0.059564587,0.00012908249],"about_ca_topic_score_codex":0.0027091831,"about_ca_topic_score_gemma":0.0034183073,"teacher_disagreement_score":0.0044301045,"about_ca_system_score_codex":0.0006121321,"about_ca_system_score_gemma":0.00092305744,"threshold_uncertainty_score":0.009534061},"labels":[],"label_agreement":null},{"id":"W2568073323","doi":"10.1109/iwsm-mensura.2016.036","title":"Evaluating Security in Web Application Design Using Functional and Structural Size Measurements","year":2016,"lang":"en","type":"article","venue":"","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":6,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"","funders":"École de technologie supérieure","keywords":"Computer science","score_opus":0.15794590008553677,"score_gpt":0.33920437894694144,"score_spread":0.18125847886140467,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2568073323","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.61023724,0.00038226962,0.3807558,0.00015180107,0.000025745348,0.00029185423,0.0001442312,0.00073852745,0.007272465],"genre_scores_gemma":[0.9016617,0.00011445453,0.09711581,0.00001867847,0.00000963194,0.00016893921,0.00013791665,0.000061031173,0.0007117638],"study_design_codex":"design_other","study_design_gemma":"observational","domain_scores_codex":[0.99180424,0.002934938,0.0005373797,0.00039689077,0.0041486183,0.00017785263],"domain_scores_gemma":[0.96350366,0.020939559,0.0057540745,0.0026973654,0.006665591,0.00043973752],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0057370835,0.0006769497,0.0002752938,0.0035053517,0.00032172014,0.0011497572,0.0005047529,0.00062656193,0.001019904],"category_scores_gemma":[0.02499881,0.0003241783,0.0005646217,0.0015158823,0.0007077317,0.001776045,0.00064224954,0.00048007612,0.0002510886],"study_design_candidate":"observational","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00093067274,0.0008011638,0.18625054,0.00083643006,0.00024063262,0.00034826616,0.0020044926,0.13626093,0.24091212,0.011936571,0.00093469134,0.41854346],"study_design_scores_gemma":[0.00006776899,0.0045084488,0.18763557,0.00014667783,0.00026717532,0.00055668986,0.000991166,0.60408276,0.1877111,0.00885786,0.005013519,0.00016123365],"about_ca_topic_score_codex":0.0013137645,"about_ca_topic_score_gemma":0.0020708789,"teacher_disagreement_score":0.0057370835,"about_ca_system_score_codex":0.0008584297,"about_ca_system_score_gemma":0.00065641693,"threshold_uncertainty_score":0.03034097},"labels":[],"label_agreement":null},{"id":"W2575812256","doi":"10.1609/icwsm.v10i1.14769","title":"Tracking the Trackers: A Large-Scale Analysis of Embedded Web Trackers","year":2021,"lang":"en","type":"article","venue":"Proceedings of the International AAAI Conference on Web and Social Media","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":29,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"","funders":"Banting and Best Diabetes Centre, University of Toronto; Bundesministerium für Bildung und Forschung; Deutsche Forschungsgemeinschaft","keywords":"BitTorrent tracker; Tracking (education); Computer science; Scale (ratio); Activity tracker; Deep Web; World Wide Web; The Internet; Artificial intelligence; Geography; Eye tracking; Psychology; Cartography","score_opus":0.030583683843358182,"score_gpt":0.26698908974125274,"score_spread":0.23640540589789455,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2575812256","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.86467946,0.0054781744,0.040735483,0.0008721624,0.00041329037,0.00018992934,0.075040884,0.0054013245,0.0071893455],"genre_scores_gemma":[0.7700718,0.001626894,0.040289808,0.0003200863,0.0002934144,0.00024017268,0.17864098,0.0009824123,0.0075344564],"study_design_codex":"observational","study_design_gemma":"observational","domain_scores_codex":[0.9990602,0.00021537486,0.00007735673,0.00028424605,0.00022854713,0.00013418101],"domain_scores_gemma":[0.99744797,0.0009569122,0.00039748824,0.00061961677,0.00038481376,0.00019327088],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.000921391,0.0008816982,0.0007028707,0.005084893,0.0006642852,0.0014683804,0.000595453,0.00095847214,0.0016196773],"category_scores_gemma":[0.004370106,0.00034497224,0.0009988534,0.0055780765,0.00053497043,0.0027120123,0.0016941832,0.0011742315,0.003311028],"study_design_candidate":"observational","study_design_consensus":"observational","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0010609184,0.0013554958,0.40566128,0.0019019886,0.001167519,0.0031722146,0.003836429,0.018236902,0.027587764,0.005600076,0.1879601,0.34245932],"study_design_scores_gemma":[0.00015867548,0.0004925211,0.58353704,0.00034295715,0.00037183362,0.0036750059,0.0036415888,0.22260877,0.012417502,0.011567227,0.1609402,0.00024666943],"about_ca_topic_score_codex":0.0054476806,"about_ca_topic_score_gemma":0.010675944,"teacher_disagreement_score":0.0054476806,"about_ca_system_score_codex":0.0003635353,"about_ca_system_score_gemma":0.0004282115,"threshold_uncertainty_score":0.010831952},"labels":[],"label_agreement":null},{"id":"W2576853603","doi":"","title":"Laval University and Lakehead University at TREC Dynamic Domain 2015: Combination of Techniques for Subtopics Coverage.","year":2015,"lang":"en","type":"article","venue":"Text REtrieval Conference","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":2,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":true,"ca_institutions":"Lakehead University; Université Laval","funders":"","keywords":"Computer science; Domain (mathematical analysis); Information retrieval; Library science; Mathematics","score_opus":0.02569653499890819,"score_gpt":0.25028060544675074,"score_spread":0.22458407044784254,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2576853603","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.17292416,0.022459364,0.37592927,0.011731887,0.0038517532,0.0022926691,0.17987332,0.13524316,0.095694445],"genre_scores_gemma":[0.23006018,0.003026803,0.44501102,0.0010104065,0.0009927576,0.0012622413,0.24386168,0.007998213,0.066776715],"study_design_codex":"design_other","study_design_gemma":"not_applicable","domain_scores_codex":[0.9922167,0.0019328629,0.00040837404,0.0014372821,0.0032353841,0.0007693003],"domain_scores_gemma":[0.9856039,0.0038136635,0.00051843096,0.0025913506,0.005955839,0.0015168845],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0055801766,0.0019357669,0.001460173,0.012680181,0.0016489233,0.0031611654,0.0023052962,0.0017364227,0.017197683],"category_scores_gemma":[0.02187644,0.0008030303,0.0012188578,0.0072277114,0.0006933728,0.005870084,0.0035208229,0.00220693,0.013038678],"study_design_candidate":"not_applicable","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0008685585,0.0005761759,0.008367204,0.00048233327,0.00016467198,0.0001213156,0.00039471572,0.003370088,0.02119266,0.0023970727,0.38671637,0.57534885],"study_design_scores_gemma":[0.0007435952,0.0011962168,0.06814034,0.0004058972,0.00045944162,0.000935797,0.0020498675,0.2730742,0.12267448,0.016062895,0.51376355,0.0004937129],"about_ca_topic_score_codex":0.04595241,"about_ca_topic_score_gemma":0.11152819,"teacher_disagreement_score":0.04595241,"about_ca_system_score_codex":0.0020722738,"about_ca_system_score_gemma":0.004106578,"threshold_uncertainty_score":0.09136987},"labels":[],"label_agreement":null},{"id":"W2579224800","doi":"","title":"News Article Position Recommendation Based on the Analysis of Article's Content - Time Matters.","year":2016,"lang":"en","type":"article","venue":"Conference on Recommender Systems","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":5,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Toronto Metropolitan University","funders":"","keywords":"Computer science; Position (finance); Content (measure theory); Information retrieval; Multimedia; Business; Mathematics","score_opus":0.07671448070239394,"score_gpt":0.26042287371307454,"score_spread":0.1837083930106806,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2579224800","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.7298116,0.021540139,0.18196888,0.0041509806,0.0026223087,0.00062823476,0.014697814,0.0032402535,0.041339796],"genre_scores_gemma":[0.9295167,0.003178919,0.045229405,0.00032475227,0.0014245438,0.00011406848,0.0079457285,0.00011170634,0.012154251],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.99917966,0.00013747803,0.00007979984,0.00023500601,0.00028364683,0.00008444264],"domain_scores_gemma":[0.9957938,0.0015843799,0.00030475672,0.00019978314,0.0018785289,0.00023868811],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0009768109,0.0007171473,0.0008790788,0.004922067,0.00062343467,0.0016028121,0.0005593501,0.0009475522,0.003035],"category_scores_gemma":[0.0062151044,0.00030056277,0.0007203048,0.0035352563,0.00016081026,0.0018350212,0.00033341447,0.00076392613,0.0035120824],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0023191955,0.0011797828,0.18602288,0.0008570097,0.0010057865,0.00060099416,0.00042856106,0.008887044,0.026235132,0.0018010739,0.09484437,0.67581815],"study_design_scores_gemma":[0.00026758973,0.0009285765,0.1681219,0.00017266169,0.002171908,0.0009943297,0.0009364719,0.7711423,0.021670653,0.0031750123,0.030205397,0.00021316827],"about_ca_topic_score_codex":0.011928592,"about_ca_topic_score_gemma":0.03731408,"teacher_disagreement_score":0.011928592,"about_ca_system_score_codex":0.00048501152,"about_ca_system_score_gemma":0.0006715689,"threshold_uncertainty_score":0.023718297},"labels":[],"label_agreement":null},{"id":"W2585438896","doi":"","title":"The data civilizer system","year":2017,"lang":"en","type":"article","venue":"Conference on Innovative Data Systems Research","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":88,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Waterloo","funders":"","keywords":"Computer science","score_opus":0.6414419922836844,"score_gpt":0.5044311967031525,"score_spread":0.13701079558053186,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2585438896","genre_codex":"software","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.008063158,0.0011110948,0.23219302,0.004031873,0.0014593517,0.001158295,0.10974009,0.571889,0.07035417],"genre_scores_gemma":[0.11580239,0.0016482578,0.17544621,0.0033487284,0.0011570258,0.001850672,0.4921064,0.101246625,0.107393675],"study_design_codex":"not_applicable","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.994228,0.0014798114,0.0007081583,0.0014228495,0.0017159085,0.0004451861],"domain_scores_gemma":[0.9850706,0.0026855823,0.00047331201,0.008820027,0.0020723073,0.0008781185],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0072541297,0.001461874,0.0017636066,0.006275731,0.0014398119,0.0063187554,0.002672391,0.001623552,0.11997876],"category_scores_gemma":[0.025643243,0.0015157582,0.0014388423,0.005629128,0.0011624187,0.0071261907,0.0058362805,0.003323982,0.11066848],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0011036276,0.0002016102,0.0026510928,0.00038543774,0.00016510747,0.00020487123,0.0003120849,0.0015148073,0.005294672,0.034713924,0.78111106,0.17234163],"study_design_scores_gemma":[0.00035112753,0.00008609988,0.0015607974,0.000089320594,0.000062636835,0.00021845588,0.00009128368,0.017561108,0.013038223,0.017968744,0.9488799,0.000092294016],"about_ca_topic_score_codex":0.003654358,"about_ca_topic_score_gemma":0.0020243118,"teacher_disagreement_score":0.11997876,"about_ca_system_score_codex":0.0014685014,"about_ca_system_score_gemma":0.0042784465,"threshold_uncertainty_score":0.40136892},"labels":[],"label_agreement":null},{"id":"W2587820242","doi":"10.29173/cais720","title":"Content Analysis of Electronic Mail Messages from Users of UTLink, the University of Toronto's Online Catalogue and Information System","year":2013,"lang":"en","type":"article","venue":"Proceedings of the Annual Conference of CAIS / Actes du congrès annuel de l ACSI","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":true,"route_about_ca":true,"ca_institutions":"University of Toronto","funders":"","keywords":"World Wide Web; Computer science; Advertising; Internet privacy; Business","score_opus":0.01712490912837327,"score_gpt":0.20110488390440787,"score_spread":0.1839799747760346,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2587820242","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.98608494,0.00015452279,0.0005937706,0.00013572484,0.00002842216,0.00013662022,0.00908673,0.00026790609,0.0035113443],"genre_scores_gemma":[0.9635451,0.00026381738,0.001970179,0.00006686213,0.000059438356,0.00012643955,0.023786219,0.00008892012,0.010093017],"study_design_codex":"observational","study_design_gemma":"observational","domain_scores_codex":[0.99908996,0.00016692207,0.000095401294,0.00007372884,0.0004425102,0.0001315614],"domain_scores_gemma":[0.9921693,0.0036774527,0.00080709223,0.00030148047,0.0027499672,0.00029467623],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.00051463174,0.00024677717,0.00024414877,0.007278796,0.000788867,0.0012211249,0.0002826691,0.0004427776,0.003941481],"category_scores_gemma":[0.0070627052,0.00012671335,0.00013818569,0.0046305885,0.00030131103,0.0004887205,0.00051524263,0.0002241463,0.001516786],"study_design_candidate":"observational","study_design_consensus":"observational","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0021011315,0.00067068136,0.63579345,0.0012267164,0.00013177398,0.0012950007,0.024851589,0.0011530239,0.03256004,0.0010383546,0.03940039,0.25977787],"study_design_scores_gemma":[0.000018241433,0.00018358022,0.96783644,0.00007853294,0.00008479241,0.00023348075,0.0055009103,0.0039524697,0.009495567,0.00011942067,0.012466793,0.000029885166],"about_ca_topic_score_codex":0.07244052,"about_ca_topic_score_gemma":0.111817025,"teacher_disagreement_score":0.07244052,"about_ca_system_score_codex":0.0019759529,"about_ca_system_score_gemma":0.001538818,"threshold_uncertainty_score":0.14403772},"labels":[],"label_agreement":null},{"id":"W2592457904","doi":"","title":"18th International Conference on Discovery Science, Banff, Canada, October 4-6, 2015","year":2015,"lang":"en","type":"article","venue":"Cambridge International Law Journal","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":0,"is_retracted":false,"has_abstract":false,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":true,"ca_institutions":"","funders":"","keywords":"Library science; Geography; Political science; Computer science","score_opus":0.03309734621751375,"score_gpt":0.28560021480501946,"score_spread":0.2525028685875057,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2592457904","genre_codex":"other","genre_gemma":"other","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"other","genre_consensus":"other","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.006894368,0.07747133,0.07257945,0.08329272,0.061575074,0.00044502434,0.010190377,0.0062495074,0.6813021],"genre_scores_gemma":[0.022020163,0.019914908,0.013766461,0.0025925438,0.002934208,0.0000868102,0.0057134014,0.0008857955,0.9320858],"study_design_codex":"not_applicable","study_design_gemma":"not_applicable","domain_scores_codex":[0.99650866,0.00041222,0.00009377673,0.0003804474,0.0018814357,0.00072350865],"domain_scores_gemma":[0.9919213,0.00097488926,0.00014299911,0.0011314766,0.0039629424,0.001866486],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.008083015,0.0012384399,0.0018331611,0.004951788,0.0040251114,0.013491135,0.0028474133,0.002297971,0.1629812],"category_scores_gemma":[0.008082762,0.0006334816,0.0010134773,0.0041876114,0.003673303,0.005486612,0.0046664155,0.003284272,0.057551183],"study_design_candidate":"not_applicable","study_design_consensus":"not_applicable","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.000122755,0.000081591344,0.0005605528,0.00019568883,0.000032432297,0.00006941044,0.00015919861,0.00047986585,0.0005936644,0.037865117,0.8452243,0.11461549],"study_design_scores_gemma":[0.000013355285,0.000017981065,0.0006613427,0.0001764897,0.00001454666,0.00003779574,0.0001988051,0.0011986486,0.00047808557,0.013291546,0.98389405,0.000017294054],"about_ca_topic_score_codex":0.19850132,"about_ca_topic_score_gemma":0.38418612,"teacher_disagreement_score":0.19850132,"about_ca_system_score_codex":0.016139224,"about_ca_system_score_gemma":0.027815372,"threshold_uncertainty_score":0.54522645},"labels":[],"label_agreement":null},{"id":"W2592514963","doi":"","title":"Cleaning Web pages for effective Web content mining.","year":2006,"lang":"en","type":"dissertation","venue":"Scholarship at UWindsor (University of Windsor)","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":true,"ca_institutions":"","funders":"","keywords":"Computer science; Web page; Information retrieval; Web mining; Static web page; World Wide Web; Block (permutation group theory); Categorization; Web navigation; Artificial intelligence; Mathematics","score_opus":0.026585510999416345,"score_gpt":0.23288120447005123,"score_spread":0.2062956934706349,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2592514963","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0580407,0.0072298814,0.8859855,0.0013243707,0.00055824465,0.002677868,0.008657476,0.026119657,0.009406321],"genre_scores_gemma":[0.09927096,0.0033467985,0.87380975,0.00044459142,0.00032184462,0.00059804437,0.014711785,0.0011296937,0.0063663917],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.99821967,0.00025404274,0.00015315764,0.00034477084,0.00092805765,0.000100278405],"domain_scores_gemma":[0.99648345,0.0010507369,0.0005797723,0.0007088212,0.0010588786,0.00011823209],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0011790774,0.001409022,0.0013863556,0.0069609834,0.0011773446,0.0023237385,0.0011752582,0.0011527071,0.0041085887],"category_scores_gemma":[0.006900919,0.00065558107,0.0014943093,0.0047826567,0.00064242765,0.0037260554,0.0011748503,0.0010224315,0.0104096355],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00014316021,0.00030738502,0.00883762,0.0015658146,0.00017745337,0.00041069006,0.000357963,0.0027749566,0.059607353,0.0024714032,0.03557667,0.88776946],"study_design_scores_gemma":[0.00012714096,0.00061232323,0.06635289,0.0010689729,0.0006905616,0.005749014,0.0027680688,0.35320008,0.24852365,0.04769659,0.27291897,0.00029173205],"about_ca_topic_score_codex":0.0025034011,"about_ca_topic_score_gemma":0.0040541952,"teacher_disagreement_score":0.0069609834,"about_ca_system_score_codex":0.0004912211,"about_ca_system_score_gemma":0.0013935062,"threshold_uncertainty_score":0.013744533},"labels":[],"label_agreement":null},{"id":"W2594639334","doi":"","title":"D-ForenRIA: a distributed tool to reconstruct user sessions for rich internet applications","year":2016,"lang":"en","type":"article","venue":"Computer Science and Software Engineering","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Ottawa","funders":"","keywords":"Ajax; Computer science; JavaScript; Session (web analytics); Rich Internet application; Scalability; The Internet; World Wide Web; Web application; Human–computer interaction; Database","score_opus":0.009351037355425324,"score_gpt":0.22341029738963478,"score_spread":0.21405926003420944,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2594639334","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.014121932,0.00023106509,0.65172803,0.00011008512,0.00006229527,0.00033678242,0.0055126487,0.32589835,0.0019987992],"genre_scores_gemma":[0.11083666,0.0002467808,0.8531667,0.00012924366,0.000044015447,0.0006337777,0.01834572,0.012306554,0.004290482],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9989354,0.00019595711,0.00011320951,0.0003768946,0.00030256016,0.00007592855],"domain_scores_gemma":[0.9961935,0.0016214093,0.00035455506,0.0012382341,0.0003533532,0.00023887363],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0020307899,0.0015744271,0.0008990814,0.003144952,0.0005912889,0.0014520612,0.0025460906,0.0009943941,0.007347409],"category_scores_gemma":[0.0073948335,0.000960686,0.0014059633,0.0015047824,0.0004880162,0.0022001811,0.002652029,0.001818176,0.004918625],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0014579521,0.0007924023,0.022389526,0.001151077,0.00052069256,0.0007439155,0.0023213674,0.033109214,0.025840165,0.007661038,0.08761635,0.8163963],"study_design_scores_gemma":[0.00027822933,0.00031278553,0.014126316,0.00016697015,0.00014730441,0.0011968521,0.000596025,0.8194811,0.049282487,0.01436878,0.09980114,0.00024202575],"about_ca_topic_score_codex":0.0028241542,"about_ca_topic_score_gemma":0.0063511003,"teacher_disagreement_score":0.007347409,"about_ca_system_score_codex":0.0005088615,"about_ca_system_score_gemma":0.0013160476,"threshold_uncertainty_score":0.024579525},"labels":[],"label_agreement":null},{"id":"W2606911632","doi":"","title":"Structuring Job Search via Local Grammars","year":2008,"lang":"en","type":"article","venue":"HAL (Le Centre pour la Communication Scientifique Directe)","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":11,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Alberta","funders":"","keywords":"Structuring; Rule-based machine translation; Computer science; Artificial intelligence; Business; Finance","score_opus":0.01579993507602929,"score_gpt":0.21919223143449296,"score_spread":0.20339229635846368,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2606911632","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.056027114,0.00052349514,0.9125597,0.0011339535,0.00014720796,0.00033634962,0.00098281,0.01459663,0.013692833],"genre_scores_gemma":[0.5515436,0.00044935825,0.41573277,0.0004803022,0.00016984393,0.00039802352,0.0032850946,0.007129965,0.020811103],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9964844,0.0012578631,0.00024069988,0.0006671345,0.0008367345,0.00051317434],"domain_scores_gemma":[0.98782504,0.007538692,0.0003880127,0.0028624292,0.0008328539,0.00055290386],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0025846653,0.00068935956,0.001961151,0.002424626,0.0025551028,0.0041641104,0.0024502503,0.0018110495,0.01627369],"category_scores_gemma":[0.013324834,0.0009794029,0.0020427871,0.0030693277,0.0033871103,0.00730029,0.0057661724,0.0024559316,0.0055327686],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0013605417,0.00066849135,0.005128552,0.0013657546,0.00014800744,0.00075517735,0.0056810114,0.10278281,0.021642577,0.3559944,0.04085021,0.46362254],"study_design_scores_gemma":[0.00012252976,0.00019691694,0.0006889233,0.00016238965,0.00010579087,0.00018131016,0.0015336535,0.37462133,0.01601286,0.5661892,0.040082686,0.00010236211],"about_ca_topic_score_codex":0.0039285235,"about_ca_topic_score_gemma":0.0069345394,"teacher_disagreement_score":0.01627369,"about_ca_system_score_codex":0.0014126975,"about_ca_system_score_gemma":0.002419546,"threshold_uncertainty_score":0.054440856},"labels":[],"label_agreement":null},{"id":"W2610518069","doi":"10.1609/aimag.v38i1.2720","title":"RuleML (Web Rule Symposium) 2016 Report","year":2017,"lang":"en","type":"article","venue":"AI Magazine","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Carleton University","funders":"","keywords":"RuleML; World Wide Web; Web site; Library science; Computer science; XML; The Internet; Markup language; XHTML","score_opus":0.014430066977399653,"score_gpt":0.27351818989565657,"score_spread":0.2590881229182569,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2610518069","genre_codex":"methods","genre_gemma":"other","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"other","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0050098593,0.006341586,0.5474913,0.025134088,0.01916684,0.0034973086,0.099266,0.13911629,0.15497667],"genre_scores_gemma":[0.01758825,0.010184197,0.44431916,0.008372204,0.0042274306,0.002399005,0.31174558,0.044712745,0.1564514],"study_design_codex":"not_applicable","study_design_gemma":"not_applicable","domain_scores_codex":[0.98016363,0.0044150897,0.0026340443,0.001973079,0.010064536,0.0007496695],"domain_scores_gemma":[0.9618024,0.009932733,0.0013627734,0.0083168885,0.015703147,0.0028819938],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.028916707,0.0030977938,0.002246051,0.0056561255,0.0019066882,0.014839119,0.005942624,0.004224994,0.072373375],"category_scores_gemma":[0.04858554,0.0023378357,0.0032591964,0.00397304,0.0014390169,0.011897586,0.004934355,0.009089894,0.1278618],"study_design_candidate":"not_applicable","study_design_consensus":"not_applicable","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00022561962,0.00040032325,0.000618392,0.0006261625,0.00006319116,0.00028012507,0.00016389196,0.0029007758,0.002381999,0.020021396,0.8270106,0.14530757],"study_design_scores_gemma":[0.00008111595,0.00008498414,0.00035034135,0.00040302568,0.00004347073,0.00023201255,0.00007127115,0.008900484,0.0054521235,0.0103756795,0.9739468,0.00005871278],"about_ca_topic_score_codex":0.015192495,"about_ca_topic_score_gemma":0.011772677,"teacher_disagreement_score":0.072373375,"about_ca_system_score_codex":0.0029433388,"about_ca_system_score_gemma":0.012937456,"threshold_uncertainty_score":0.24211305},"labels":[],"label_agreement":null},{"id":"W2611609447","doi":"","title":"An Open-Source Strategy for Documenting Events: The Case Study of the 42nd Canadian Federal Election on Twitter","year":2016,"lang":"en","type":"article","venue":"DOAJ (DOAJ: Directory of Open Access Journals)","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":6,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":true,"ca_institutions":"","funders":"","keywords":"Open source; Federal election; Social media; Political science; Public relations; Internet privacy; Public administration; Business; Computer science; Politics; Law","score_opus":0.23227411340755108,"score_gpt":0.5247786107583614,"score_spread":0.2925044973508103,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2611609447","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.67194283,0.0013077436,0.032216046,0.02490455,0.00066827156,0.0015004255,0.005118471,0.0028125348,0.2595291],"genre_scores_gemma":[0.90353125,0.0009202377,0.032974355,0.001060087,0.00017204383,0.0002987697,0.003579261,0.00079475367,0.056669354],"study_design_codex":"design_other","study_design_gemma":"qualitative","domain_scores_codex":[0.99479717,0.0023872873,0.00020730027,0.0003203893,0.0015484943,0.00073934335],"domain_scores_gemma":[0.98090816,0.009274363,0.0013463069,0.002166909,0.004333753,0.0019705135],"candidate_categories":["open_science"],"consensus_categories":[],"category_scores_codex":[0.007729925,0.00056807866,0.000269738,0.006038709,0.0126002105,0.0063242423,0.0021958076,0.0023588382,0.0085660415],"category_scores_gemma":[0.024750555,0.00033144827,0.00035031952,0.008898469,0.0025344423,0.005553792,0.0038728255,0.0013872201,0.002573229],"study_design_candidate":"qualitative","study_design_consensus":null,"about_ca_topic_candidate":true,"about_ca_topic_consensus":true,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00059841893,0.00073877396,0.107784264,0.00093890855,0.000117179094,0.011144569,0.2330245,0.003573096,0.007907315,0.0570515,0.18194376,0.39517772],"study_design_scores_gemma":[0.00008305675,0.00016371392,0.065769,0.0006352226,0.00012907176,0.0016609685,0.22775032,0.0134557355,0.0044949516,0.0076870737,0.6779393,0.00023160712],"about_ca_topic_score_codex":0.5869573,"about_ca_topic_score_gemma":0.7989047,"teacher_disagreement_score":0.99780416,"about_ca_system_score_codex":0.010141989,"about_ca_system_score_gemma":0.015950274,"threshold_uncertainty_score":0.83095044},"labels":[],"label_agreement":null},{"id":"W2621107543","doi":"10.1109/icse-c.2017.77","title":"App Store Mining Is Not Enough","year":2017,"lang":"en","type":"article","venue":"","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":30,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Toronto; University of Calgary","funders":"Natural Sciences and Engineering Research Council of Canada; Alberta Innovates - Technology Futures","keywords":"App store; Mobile apps; Social media; Computer science; Feature (linguistics); World Wide Web; Smartphone app; Internet privacy; Period (music)","score_opus":0.04209013110754205,"score_gpt":0.28401480231970044,"score_spread":0.24192467121215838,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2621107543","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.34362963,0.038088147,0.27854717,0.09617521,0.0075514093,0.0037695416,0.13228853,0.025617559,0.0743328],"genre_scores_gemma":[0.5759582,0.012297598,0.27102154,0.010730028,0.004456756,0.0020917612,0.08655857,0.00302664,0.033858832],"study_design_codex":"design_other","study_design_gemma":"observational","domain_scores_codex":[0.9850572,0.002428348,0.0016127026,0.00322057,0.0069210157,0.00076014985],"domain_scores_gemma":[0.95100343,0.018578116,0.004680431,0.010076719,0.014664351,0.0009970046],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.006433236,0.0020972355,0.0030590787,0.008629235,0.0018345148,0.007846562,0.00438976,0.0027031987,0.006066627],"category_scores_gemma":[0.03755349,0.0014985665,0.0023986937,0.009216273,0.0012397186,0.013194835,0.002785667,0.0034085598,0.01260307],"study_design_candidate":"observational","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00031042067,0.00059361756,0.09869485,0.0031944585,0.0010356914,0.0008554605,0.001495817,0.00329435,0.00648657,0.005101513,0.18016303,0.69877416],"study_design_scores_gemma":[0.0001687413,0.00052692776,0.12773563,0.003096869,0.0008823984,0.004239378,0.010209162,0.08613574,0.016415644,0.052211866,0.6980084,0.00036922892],"about_ca_topic_score_codex":0.009335066,"about_ca_topic_score_gemma":0.017316965,"teacher_disagreement_score":0.009335066,"about_ca_system_score_codex":0.0011950169,"about_ca_system_score_gemma":0.0024012146,"threshold_uncertainty_score":0.03402257},"labels":[],"label_agreement":null},{"id":"W2626887684","doi":"10.6000/1929-7092.2017.06.39","title":"Comparing Statistical and Data Mining Techniques for Enrichment Ontology with Instances","year":2017,"lang":"en","type":"article","venue":"Journal of Reviews on Global Economics","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":2,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":true,"route_about_ca":false,"ca_institutions":"","funders":"","keywords":"Ontology; Computer science; Data mining; Data science; Philosophy; Epistemology","score_opus":0.11073702933954807,"score_gpt":0.3689221692097123,"score_spread":0.2581851398701642,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2626887684","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.13483077,0.0027721664,0.8517911,0.0011891432,0.00013546557,0.00037417622,0.001359891,0.0023251409,0.005222203],"genre_scores_gemma":[0.39313474,0.0013949485,0.6012054,0.0001616255,0.00008599655,0.00031418924,0.0025998086,0.00014002538,0.0009632067],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.99213445,0.0023311044,0.0007697709,0.0009155284,0.0036433148,0.00020586634],"domain_scores_gemma":[0.95411545,0.0341991,0.002420186,0.0031166773,0.005803178,0.00034539556],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.012210456,0.00081254274,0.0009270214,0.01085394,0.00074165117,0.0020704276,0.0010900632,0.00070154667,0.00082324725],"category_scores_gemma":[0.044107456,0.00029243398,0.0019680453,0.009899601,0.0007136685,0.0041381535,0.0012408828,0.00108752,0.00041819486],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00047962612,0.00046905637,0.0819553,0.00095233304,0.00093924557,0.00016942873,0.00064955023,0.033989873,0.0063387803,0.019667918,0.004596959,0.8497918],"study_design_scores_gemma":[0.00010178,0.00062184985,0.07638574,0.0003543917,0.0010672299,0.00090047397,0.0021029348,0.79079944,0.026085986,0.071831346,0.02956661,0.00018227774],"about_ca_topic_score_codex":0.0045074853,"about_ca_topic_score_gemma":0.006135867,"teacher_disagreement_score":0.012210456,"about_ca_system_score_codex":0.0016657488,"about_ca_system_score_gemma":0.0019298871,"threshold_uncertainty_score":0.06457585},"labels":[],"label_agreement":null},{"id":"W2674238586","doi":"10.1145/3091107","title":"Search by Screenshots for Universal Article Clipping in Mobile Apps","year":2017,"lang":"en","type":"article","venue":"ACM Transactions on Information Systems","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":6,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Université de Montréal","funders":"","keywords":"Computer science; Information retrieval; Chunking (psychology); Usability; Clipping (morphology); Rank (graph theory); Learning to rank; Key (lock); Artificial intelligence; Human–computer interaction; Ranking (information retrieval)","score_opus":0.029745840002553325,"score_gpt":0.28246270193654077,"score_spread":0.25271686193398746,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2674238586","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.19634454,0.006087406,0.6551557,0.0011557685,0.00051529624,0.0025558555,0.010734816,0.10193511,0.025515521],"genre_scores_gemma":[0.36591813,0.0013368855,0.60608107,0.000514795,0.0003234268,0.0009857392,0.010297353,0.0018994387,0.012643146],"study_design_codex":"design_other","study_design_gemma":"bench_or_experimental","domain_scores_codex":[0.9991404,0.00018469503,0.00006398889,0.00019684945,0.00030572285,0.00010837137],"domain_scores_gemma":[0.9964379,0.0018226852,0.00024342738,0.00058485643,0.00063190196,0.00027925326],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0006953799,0.0021402685,0.0013386008,0.0046945317,0.0007877069,0.001683909,0.0010326181,0.0010142694,0.011766221],"category_scores_gemma":[0.005920581,0.00046007909,0.00089612947,0.002061674,0.0005616792,0.003227294,0.002094809,0.00074096833,0.0049979524],"study_design_candidate":"bench_or_experimental","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0018597784,0.0005601875,0.003890076,0.0023267104,0.00018011304,0.0013877718,0.0017784674,0.0052913358,0.09023091,0.0044937464,0.074982256,0.8130186],"study_design_scores_gemma":[0.00042126802,0.002819408,0.02893196,0.0005531135,0.00042838548,0.0043150065,0.0050226473,0.56386715,0.18767305,0.026617458,0.178857,0.00049349206],"about_ca_topic_score_codex":0.0034769932,"about_ca_topic_score_gemma":0.0093339905,"teacher_disagreement_score":0.011766221,"about_ca_system_score_codex":0.0005753562,"about_ca_system_score_gemma":0.00070331164,"threshold_uncertainty_score":0.039361954},"labels":[],"label_agreement":null},{"id":"W2689456674","doi":"10.20965/jaciii.2010.p0383","title":"Selected Papers from IWI 2009","year":2010,"lang":"en","type":"article","venue":"Journal of Advanced Computational Intelligence and Intelligent Informatics","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":true,"ca_institutions":"","funders":"","keywords":"Computer science; World Wide Web; Personalization; Web intelligence; Web modeling; Web development; User interface; Field (mathematics); Web service; Presentation (obstetrics); Web design","score_opus":0.013906355751156561,"score_gpt":0.26350778203804537,"score_spread":0.2496014262868888,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2689456674","genre_codex":"other","genre_gemma":"other","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"other","genre_consensus":"other","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0029582814,0.13704482,0.006368467,0.03929267,0.30368298,0.0015600068,0.016843386,0.001989199,0.4902602],"genre_scores_gemma":[0.006671003,0.07790085,0.0052444213,0.009674849,0.060468458,0.0007474846,0.021516226,0.0015787552,0.816198],"study_design_codex":"not_applicable","study_design_gemma":"not_applicable","domain_scores_codex":[0.9965364,0.0003144528,0.00043375455,0.00042083452,0.0020272331,0.0002673472],"domain_scores_gemma":[0.98986477,0.0008379831,0.00064590137,0.0005157335,0.0060961456,0.002039428],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0031482712,0.001494633,0.0017431206,0.008900012,0.0019076803,0.010103049,0.0018566649,0.0021370589,0.28217527],"category_scores_gemma":[0.00895854,0.00052908197,0.0014131208,0.008841311,0.0003717597,0.003980937,0.003088043,0.0019567572,0.24170724],"study_design_candidate":"not_applicable","study_design_consensus":"not_applicable","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00006418238,0.000037711772,0.00010840496,0.00088010065,0.000013344756,0.00009926258,0.00004353035,0.00005743951,0.00046707815,0.0011281878,0.921557,0.07554379],"study_design_scores_gemma":[0.000007345703,0.000017235534,0.00042475923,0.00039464666,0.000009528319,0.00007020448,0.000042434378,0.00003236008,0.00015315508,0.00038756436,0.9984534,0.0000072137855],"about_ca_topic_score_codex":0.0014686972,"about_ca_topic_score_gemma":0.0029628386,"teacher_disagreement_score":0.28217527,"about_ca_system_score_codex":0.0033764858,"about_ca_system_score_gemma":0.0039498787,"threshold_uncertainty_score":0.9439703},"labels":[],"label_agreement":null},{"id":"W2724387372","doi":"10.32628/ijsrset1732170","title":"A Semantic Metadata Enrichment Software Ecosystem based on Sentiment and Emotion Metadata Enrichments","year":2017,"lang":"en","type":"article","venue":"International Journal of Scientific Research in Science Engineering and Technology","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":1,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Université de Montréal; École de Technologie Supérieure; Polytechnique Montréal; Université du Québec à Montréal","funders":"","keywords":"Metadata; Computer science; World Wide Web; Ecosystem; Information retrieval; Ecology; Biology","score_opus":0.042443683168746235,"score_gpt":0.34465168172349847,"score_spread":0.3022079985547522,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2724387372","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.064948045,0.000478655,0.73886645,0.0010650548,0.00037271474,0.000899075,0.0033477305,0.17819566,0.01182662],"genre_scores_gemma":[0.20594724,0.00064597145,0.7333781,0.0011412038,0.00020897215,0.000653171,0.023224626,0.008865356,0.025935275],"study_design_codex":"design_other","study_design_gemma":"bench_or_experimental","domain_scores_codex":[0.99873596,0.00014566277,0.00018772106,0.0002610224,0.00058288616,0.000086750406],"domain_scores_gemma":[0.99752635,0.0004205419,0.00016375651,0.0006343163,0.0009917797,0.00026331842],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0028977601,0.0009896174,0.0009821956,0.004739879,0.0010524136,0.0023064646,0.0012578532,0.0009940119,0.0035686723],"category_scores_gemma":[0.00550472,0.0006389064,0.0014037704,0.0023308063,0.00040694262,0.005466039,0.0046287887,0.0012634589,0.0030871036],"study_design_candidate":"bench_or_experimental","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0016494723,0.0020581656,0.030508,0.00094811956,0.0008463293,0.0021254467,0.0014992327,0.0035754472,0.11849203,0.017288221,0.06284682,0.75816274],"study_design_scores_gemma":[0.0004529896,0.0007343416,0.033432033,0.00047229,0.0012674521,0.0031707177,0.001290705,0.40696874,0.17892295,0.06346187,0.3091365,0.0006893864],"about_ca_topic_score_codex":0.0021071245,"about_ca_topic_score_gemma":0.0041567846,"teacher_disagreement_score":0.004739879,"about_ca_system_score_codex":0.0004328658,"about_ca_system_score_gemma":0.0013324883,"threshold_uncertainty_score":0.01532495},"labels":[],"label_agreement":null},{"id":"W2730278700","doi":"","title":"Library: GOVINFO: Canadian Federal Government Information: Search Techniques","year":2014,"lang":"en","type":"article","venue":"","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":0,"is_retracted":false,"has_abstract":false,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":true,"ca_institutions":"","funders":"","keywords":"Government (linguistics); Political science; Public administration; Business","score_opus":0.005500903172505325,"score_gpt":0.18934583201206112,"score_spread":0.1838449288395558,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2730278700","genre_codex":"other","genre_gemma":"other","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"other","genre_consensus":"other","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0018852783,0.0033330482,0.0010680447,0.01017501,0.0011856174,0.0003857842,0.21367542,0.0067595774,0.76153225],"genre_scores_gemma":[0.009709274,0.005027318,0.002978705,0.001657288,0.00031941314,0.00016819936,0.03916851,0.002452362,0.93851894],"study_design_codex":"not_applicable","study_design_gemma":"not_applicable","domain_scores_codex":[0.9986645,0.000059672962,0.00006140178,0.00011678018,0.000868499,0.00022909325],"domain_scores_gemma":[0.9921462,0.001008509,0.00013757701,0.00065034605,0.0053250743,0.0007323098],"candidate_categories":["insufficient_payload"],"consensus_categories":[],"category_scores_codex":[0.0012532986,0.0014806187,0.0022503533,0.014889273,0.008971893,0.010151875,0.0026561653,0.0033714524,0.73500323],"category_scores_gemma":[0.012908776,0.0010308694,0.001241409,0.027968656,0.0017100453,0.0038310455,0.0024735914,0.0016653318,0.39225483],"study_design_candidate":"not_applicable","study_design_consensus":"not_applicable","about_ca_topic_candidate":true,"about_ca_topic_consensus":true,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0000320847,0.000017812343,0.00021618554,0.0002229015,0.0000060045404,0.000026389234,0.00007663452,0.00009288674,0.00009068268,0.0019649204,0.9663246,0.03092891],"study_design_scores_gemma":[0.000021687743,0.0000069723815,0.0018057632,0.00030843832,0.000023423889,0.000021395575,0.00026137906,0.0002981614,0.000417671,0.0012705888,0.99553216,0.000032291537],"about_ca_topic_score_codex":0.9313276,"about_ca_topic_score_gemma":0.9687584,"teacher_disagreement_score":0.73500323,"about_ca_system_score_codex":0.025212675,"about_ca_system_score_gemma":0.069625184,"threshold_uncertainty_score":0.37798572},"labels":[{"model":"gemma","categories":[],"domain":null,"study_design":"not_applicable","genre":"methods","about_ca_system":false,"about_ca_topic":true,"confidence":"low"},{"model":"gpt","categories":[],"domain":null,"study_design":"not_applicable","genre":"other","about_ca_system":false,"about_ca_topic":true,"confidence":"low"}],"label_agreement":"agree"},{"id":"W2734341340","doi":"10.1109/iccct2.2017.7972241","title":"A study on smart mobility in Kuala Lumpur","year":2017,"lang":"en","type":"article","venue":"","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":5,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":true,"ca_institutions":"","funders":"","keywords":"Kuala lumpur; Quarter (Canadian coin); Transport engineering; Plan (archaeology); Smart growth; Greenhouse gas; Population; Index (typography); Public transport; Business; Geography; Telecommunications; Engineering; Urban planning; Computer science; Civil engineering; Marketing","score_opus":0.05601727540513368,"score_gpt":0.32614586998727246,"score_spread":0.2701285945821388,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2734341340","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.9884263,0.00037878865,0.00006660503,0.0006214551,0.000012210922,0.00003447859,0.00011001061,0.0000033442518,0.010346755],"genre_scores_gemma":[0.9955244,0.0009815113,0.000093998504,0.00014993997,0.0000063135094,0.000023716371,0.000083138715,0.000002307665,0.0031346928],"study_design_codex":"observational","study_design_gemma":"observational","domain_scores_codex":[0.99946266,0.00014660928,0.000043945387,0.000048905455,0.00009762466,0.00020025416],"domain_scores_gemma":[0.99944,0.00008483866,0.00011921027,0.0000202937,0.00013192769,0.00020369951],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0005194115,0.00026989082,0.00017550896,0.0011647497,0.0019828896,0.0017091623,0.0004455568,0.000457991,0.0035489022],"category_scores_gemma":[0.0008283206,0.00017783871,0.00037587318,0.0016396709,0.0007604017,0.0017613397,0.0012738106,0.00069016055,0.0006181823],"study_design_candidate":"observational","study_design_consensus":"observational","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.000121599136,0.00081196224,0.74600726,0.00063155557,0.00007325422,0.00379983,0.16465154,0.00083564885,0.0012148026,0.011202248,0.0062484434,0.06440179],"study_design_scores_gemma":[0.0000040489335,0.00023754241,0.63258237,0.00037256337,0.000031629188,0.000768235,0.33278194,0.0008270145,0.00028183073,0.00024541144,0.03183124,0.00003627878],"about_ca_topic_score_codex":0.07342879,"about_ca_topic_score_gemma":0.10154365,"teacher_disagreement_score":0.07342879,"about_ca_system_score_codex":0.003357427,"about_ca_system_score_gemma":0.002336565,"threshold_uncertainty_score":0.14600277},"labels":[],"label_agreement":null},{"id":"W2740290295","doi":"10.1145/3097570","title":"Warcbase","year":2017,"lang":"en","type":"article","venue":"Journal on Computing and Cultural Heritage","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":25,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Waterloo","funders":"Social Sciences and Humanities Research Council of Canada; Natural Sciences and Engineering Research Council of Canada","keywords":"Computer science; World Wide Web; SPARK (programming language); Scalability; Big data; Process (computing); Data science; Web modeling; Analytics; Filter (signal processing); Resource (disambiguation); Web service; Database","score_opus":0.031070718112735356,"score_gpt":0.30158265523694144,"score_spread":0.27051193712420607,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2740290295","genre_codex":"software","genre_gemma":"software","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"software","genre_consensus":"software","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.007703133,0.0031619833,0.12778972,0.0032570895,0.002121629,0.0013166836,0.11828859,0.37448213,0.36187902],"genre_scores_gemma":[0.040333025,0.0037681414,0.17301908,0.002614278,0.0004954087,0.001981154,0.28224343,0.15458445,0.34096098],"study_design_codex":"not_applicable","study_design_gemma":"not_applicable","domain_scores_codex":[0.99792576,0.00024841243,0.0001861343,0.00046251196,0.0009435234,0.00023359637],"domain_scores_gemma":[0.99392164,0.0011138162,0.0003088443,0.0025544083,0.0014673084,0.0006339383],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0025857168,0.0015544365,0.0010148213,0.004040709,0.0022200444,0.010206911,0.0046758447,0.002323923,0.18929102],"category_scores_gemma":[0.012704315,0.0012055994,0.001428624,0.004957642,0.0011496679,0.011043147,0.007784723,0.0035129853,0.18333142],"study_design_candidate":"not_applicable","study_design_consensus":"not_applicable","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0004219402,0.00010787334,0.0011555381,0.00087133714,0.000056118835,0.00036032443,0.0010368059,0.0005595397,0.003815475,0.022669338,0.824981,0.14396475],"study_design_scores_gemma":[0.000033589404,0.00001814693,0.00049930124,0.00012453808,0.000012023981,0.00022815539,0.00021176886,0.0012724643,0.0022842973,0.006809942,0.9884658,0.00004003822],"about_ca_topic_score_codex":0.006669295,"about_ca_topic_score_gemma":0.008675506,"teacher_disagreement_score":0.18929102,"about_ca_system_score_codex":0.0013364053,"about_ca_system_score_gemma":0.0035467038,"threshold_uncertainty_score":0},"labels":[],"label_agreement":null},{"id":"W2740568281","doi":"","title":"Growing a web archiving program: A case study for evolving an organization-management plan","year":2015,"lang":"en","type":"article","venue":"","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":true,"ca_institutions":"University of Alberta","funders":"","keywords":"World Wide Web; Metadata; Presentation (obstetrics); Plan (archaeology); Work (physics); Casual; Computer science; Knowledge management; Business; Engineering; Political science; Geography","score_opus":0.04982163397052669,"score_gpt":0.30536545313660035,"score_spread":0.25554381916607366,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2740568281","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.90117335,0.0005569279,0.014549275,0.020277215,0.00015052484,0.0012272856,0.000156813,0.00025535782,0.061653294],"genre_scores_gemma":[0.93584454,0.0008757508,0.041893046,0.0019111853,0.00007723702,0.00050079264,0.00020247133,0.00020394998,0.018491056],"study_design_codex":"qualitative","study_design_gemma":"observational","domain_scores_codex":[0.9844126,0.009224556,0.0005074592,0.0007483314,0.002310565,0.002796565],"domain_scores_gemma":[0.9728535,0.009255116,0.0018055491,0.0026304505,0.0052970303,0.0081582535],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.021199279,0.00042932612,0.00034510132,0.0031278178,0.025868857,0.012435555,0.0046127657,0.0051578977,0.0029225617],"category_scores_gemma":[0.025542269,0.00076618395,0.00064765936,0.0048430534,0.005856595,0.008621643,0.007133235,0.0057188203,0.00070390233],"study_design_candidate":"observational","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00019995852,0.005235423,0.06540158,0.00041920584,0.000048363025,0.024058215,0.64346224,0.003114783,0.0030494616,0.058929607,0.022053618,0.17402758],"study_design_scores_gemma":[0.000040815394,0.0004978351,0.014894412,0.00030743814,0.000038917024,0.0029013888,0.8282056,0.004417218,0.0016604422,0.005853116,0.14110072,0.00008205308],"about_ca_topic_score_codex":0.06596755,"about_ca_topic_score_gemma":0.16590999,"teacher_disagreement_score":0.06596755,"about_ca_system_score_codex":0.01931912,"about_ca_system_score_gemma":0.025479913,"threshold_uncertainty_score":0.14017063},"labels":[],"label_agreement":null},{"id":"W2743289809","doi":"10.14257/ijsia.2017.11.5.03","title":"Mobile App User Licensing with Little or No Backend Server","year":2017,"lang":"en","type":"article","venue":"International Journal of Security and Its Applications","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Lakehead University","funders":"","keywords":"Computer science; Mobile apps; Operating system; World Wide Web","score_opus":0.016007360188775348,"score_gpt":0.29066955567972147,"score_spread":0.2746621954909461,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2743289809","genre_codex":"other","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.09131454,0.0023823234,0.063566275,0.010365902,0.002906147,0.0011865766,0.0018013831,0.019124443,0.8073525],"genre_scores_gemma":[0.44840756,0.0013001816,0.0143140815,0.005913637,0.0017094101,0.00109164,0.0026118855,0.0038463252,0.5208053],"study_design_codex":"design_other","study_design_gemma":"bench_or_experimental","domain_scores_codex":[0.9879368,0.0016691857,0.0009774335,0.0016087965,0.005863695,0.001944118],"domain_scores_gemma":[0.9483448,0.008296468,0.0025336782,0.023688514,0.014015598,0.003120927],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0071839155,0.00096227264,0.00096271874,0.002862398,0.0038294175,0.0082514,0.0034898045,0.0044480925,0.08345162],"category_scores_gemma":[0.04523147,0.00091471,0.0014821,0.0018028677,0.0040789014,0.016476063,0.010413069,0.0050538396,0.08728313],"study_design_candidate":"bench_or_experimental","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00084039784,0.0014516833,0.013005613,0.000857903,0.000105902735,0.002128632,0.0027312075,0.00044330076,0.024884285,0.25342327,0.20314975,0.49697813],"study_design_scores_gemma":[0.00017583361,0.00059215684,0.01669874,0.0010362047,0.00018423058,0.007053836,0.0012324154,0.0038745243,0.027115464,0.06188705,0.87986153,0.00028800196],"about_ca_topic_score_codex":0.0028438712,"about_ca_topic_score_gemma":0.0024294273,"teacher_disagreement_score":0.08345162,"about_ca_system_score_codex":0.001507483,"about_ca_system_score_gemma":0.0048390976,"threshold_uncertainty_score":0.2791735},"labels":[],"label_agreement":null},{"id":"W2743351590","doi":"10.29173/cais754","title":"Genres of Search: A Concept for Understanding Successive Search Strategies","year":2013,"lang":"fr","type":"article","venue":"Proceedings of the Annual Conference of CAIS / Actes du congrès annuel de l ACSI","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":true,"route_about_ca":false,"ca_institutions":"","funders":"","keywords":"Phenomenon; Computer science; Process (computing); Epistemology; Humanities; Philosophy","score_opus":0.09824054417666066,"score_gpt":0.29868850935575725,"score_spread":0.20044796517909658,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2743351590","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.144351,0.008036743,0.69529647,0.007025761,0.00047897408,0.00076842704,0.0005455776,0.00065196404,0.1428451],"genre_scores_gemma":[0.70063037,0.0039300895,0.27059597,0.0008474781,0.00042572888,0.00078071485,0.00064295804,0.00038943213,0.02175732],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"qualitative","domain_scores_codex":[0.99401975,0.0025955488,0.00056974817,0.00088112,0.0014942955,0.0004396918],"domain_scores_gemma":[0.96664363,0.022936292,0.002858848,0.003621316,0.002554888,0.0013849492],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.006231876,0.00069246616,0.0008602402,0.008651741,0.0029449232,0.0084997425,0.0019050274,0.0025977101,0.006788556],"category_scores_gemma":[0.037852835,0.00060427433,0.0015261663,0.0047092084,0.009873359,0.021036841,0.0043180794,0.0028322937,0.001178617],"study_design_candidate":"qualitative","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00011534121,0.00007003348,0.007799812,0.00043913268,0.000034403063,0.00042567152,0.04617756,0.0014075806,0.003148018,0.87645954,0.0023351754,0.061587866],"study_design_scores_gemma":[0.00007135165,0.00030378622,0.011692969,0.00077090284,0.00007309562,0.0024950423,0.034046788,0.021088809,0.0021937576,0.7992463,0.12785135,0.00016586893],"about_ca_topic_score_codex":0.0049182614,"about_ca_topic_score_gemma":0.0033272693,"teacher_disagreement_score":0.008651741,"about_ca_system_score_codex":0.002484248,"about_ca_system_score_gemma":0.002388895,"threshold_uncertainty_score":0.032957673},"labels":[],"label_agreement":null},{"id":"W2745149761","doi":"","title":"Analysis of Social Media and Ubiquitous Data: International Workshops MSM 2010, Toronto, Canada, June 13, 2010, and MUSE 2010, Barcelona, Spain, ... / Lecture Notes in Artificial Intelligence)","year":2011,"lang":"en","type":"book","venue":"Springer eBooks","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":1,"is_retracted":false,"has_abstract":false,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":true,"ca_institutions":"","funders":"","keywords":"Social media; Interdependence; Library science; Media studies; Data science; Computer science; Sociology; World Wide Web; Social science","score_opus":0.037494165752986225,"score_gpt":0.24901573776543312,"score_spread":0.2115215720124469,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2745149761","genre_codex":"methods","genre_gemma":"other","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"other","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.027190432,0.10020098,0.76582503,0.017341504,0.007515381,0.00071690173,0.017873773,0.014998279,0.04833761],"genre_scores_gemma":[0.09432347,0.084468156,0.49556682,0.0016250875,0.0035601286,0.00061100785,0.04732552,0.00402725,0.26849264],"study_design_codex":"design_other","study_design_gemma":"not_applicable","domain_scores_codex":[0.99872017,0.00022010607,0.000063737585,0.00023178522,0.0006570032,0.00010730736],"domain_scores_gemma":[0.9972488,0.0011459843,0.000099038014,0.00035868422,0.0007867612,0.00036075662],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0037552423,0.0014245923,0.0012073175,0.0030489913,0.000977566,0.0045427918,0.0011451899,0.0010856387,0.010811867],"category_scores_gemma":[0.0041219126,0.00089166744,0.0010066719,0.0035494433,0.0010268893,0.003354196,0.0023065787,0.0016311916,0.0066859503],"study_design_candidate":"not_applicable","study_design_consensus":null,"about_ca_topic_candidate":true,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00010783572,0.00010873737,0.0018029977,0.00059148436,0.000102076265,0.00020141658,0.00048786576,0.0013671116,0.00661765,0.0059211007,0.437703,0.54498863],"study_design_scores_gemma":[0.00003253202,0.000117153984,0.01956171,0.0007349121,0.00014384415,0.0009447133,0.0012762415,0.025629705,0.020130873,0.02541562,0.9058954,0.00011725033],"about_ca_topic_score_codex":0.013332573,"about_ca_topic_score_gemma":0.04164099,"teacher_disagreement_score":0.98666745,"about_ca_system_score_codex":0.0015470432,"about_ca_system_score_gemma":0.0028993895,"threshold_uncertainty_score":0.03616929},"labels":[],"label_agreement":null},{"id":"W2747317259","doi":"10.4018/ijssoe.2017010101","title":"On the Concept of Automatic User Behavior Profiling of Websites","year":2017,"lang":"en","type":"article","venue":"International Journal of Systems and Service-Oriented Engineering","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"IBM (Canada); University of Calgary; University of Alberta","funders":"","keywords":"Profiling (computer programming); Computer science; TRACE (psycholinguistics); Web mining; Hidden Markov model; Markov chain; World Wide Web; Data mining; Information retrieval; Web page; Machine learning; Artificial intelligence","score_opus":0.012726550478166182,"score_gpt":0.24479082738079475,"score_spread":0.23206427690262857,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2747317259","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.019702066,0.00059866515,0.9724922,0.0005680719,0.00008437626,0.00019266547,0.00040823998,0.0013974907,0.0045562442],"genre_scores_gemma":[0.42340028,0.0007919205,0.57035065,0.00056849903,0.00028578975,0.0003423936,0.00090035476,0.00012611374,0.0032339888],"study_design_codex":"design_other","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.9965879,0.0009127563,0.00022604996,0.0010448627,0.0010503171,0.00017813395],"domain_scores_gemma":[0.9902292,0.00548178,0.0011269404,0.0016176781,0.0013008552,0.00024344244],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.002169032,0.0009462026,0.0010725964,0.0052158437,0.0007207357,0.003463753,0.0013025462,0.0020316928,0.001067501],"category_scores_gemma":[0.010598723,0.0007235169,0.0010041441,0.005313856,0.0017279786,0.00416521,0.0012764734,0.0017654789,0.0009876362],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0005277701,0.0011654034,0.045690116,0.0006760022,0.0004255811,0.00063993933,0.0016612178,0.0879408,0.030110933,0.18139507,0.008971197,0.640796],"study_design_scores_gemma":[0.00003765549,0.0003782283,0.014811739,0.00020545999,0.00011798259,0.001215183,0.00038626938,0.8414021,0.014481837,0.10595611,0.020841608,0.00016589096],"about_ca_topic_score_codex":0.0029711316,"about_ca_topic_score_gemma":0.0018764365,"teacher_disagreement_score":0.0052158437,"about_ca_system_score_codex":0.0008089685,"about_ca_system_score_gemma":0.0010552076,"threshold_uncertainty_score":0.011471033},"labels":[],"label_agreement":null},{"id":"W2752935397","doi":"10.1504/ijwet.2017.086415","title":"Estimating similarity of rich internet pages using visual information","year":2017,"lang":"en","type":"article","venue":"International Journal of Web Engineering and Technology","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":4,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Alberta","funders":"","keywords":"Computer science; Similarity (geometry); The Internet; Information retrieval; World Wide Web; Artificial intelligence; Image (mathematics)","score_opus":0.011111599718237209,"score_gpt":0.2672239810553102,"score_spread":0.256112381337073,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2752935397","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.62142587,0.0009364265,0.37317201,0.000060928538,0.00006070165,0.00019919922,0.0005956611,0.0014512306,0.002098018],"genre_scores_gemma":[0.90834415,0.00022800904,0.089467265,0.000020590443,0.000033786448,0.000058987913,0.001000669,0.00008264416,0.0007639469],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9991229,0.00015666761,0.00007226644,0.00023030622,0.00034075425,0.00007701465],"domain_scores_gemma":[0.997422,0.0011376367,0.00038701174,0.0002855415,0.00063278724,0.00013507606],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0008618836,0.0005646723,0.0008851304,0.0079198815,0.00027410375,0.0014115457,0.00059754576,0.00094811624,0.00078070554],"category_scores_gemma":[0.0057319826,0.00026884835,0.00069929083,0.0031181786,0.00038784882,0.0022705982,0.0009539138,0.00044109582,0.00061637734],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0012750493,0.0008970147,0.078009486,0.000748531,0.00044809456,0.0008409782,0.0007875379,0.15753219,0.092366405,0.0061596646,0.0037377253,0.65719736],"study_design_scores_gemma":[0.00002121929,0.00023720201,0.02777226,0.000022076778,0.00007886946,0.00046464492,0.00016860741,0.9519955,0.014029971,0.004211041,0.0009584409,0.000040188377],"about_ca_topic_score_codex":0.0022904004,"about_ca_topic_score_gemma":0.0025066482,"teacher_disagreement_score":0.0079198815,"about_ca_system_score_codex":0.00042407433,"about_ca_system_score_gemma":0.0003538101,"threshold_uncertainty_score":0.004558146},"labels":[],"label_agreement":null},{"id":"W2753568608","doi":"","title":"Microblog contextualization using continuous space vectors: Multi-sentence compression of cultural documents","year":2017,"lang":"en","type":"preprint","venue":"PolyPublie (École Polytechnique de Montréal)","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":3,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Polytechnique Montréal","funders":"","keywords":"Contextualization; Microblogging; Computer science; Social media; Sentence; Space (punctuation); Compression (physics); Natural language processing; Information retrieval; Artificial intelligence; World Wide Web; Physics","score_opus":0.030797782309093167,"score_gpt":0.294759967713554,"score_spread":0.2639621854044608,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2753568608","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.581902,0.010905179,0.3734645,0.002061622,0.0018843377,0.0004212,0.013362667,0.0072160065,0.008782453],"genre_scores_gemma":[0.80477256,0.0030264568,0.16729526,0.00025495444,0.0011337713,0.00026520956,0.014592543,0.00049510255,0.00816415],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.99958175,0.00008630798,0.0000416311,0.00008819493,0.00012925915,0.000072923474],"domain_scores_gemma":[0.99899274,0.0003845563,0.0000771782,0.000121407815,0.000358341,0.00006578964],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0004322988,0.0008239528,0.0007351993,0.0030108844,0.00048109936,0.0008499225,0.0004050964,0.0005703119,0.0029817459],"category_scores_gemma":[0.001998694,0.00016555298,0.00047012477,0.0029570453,0.00025074653,0.00091195403,0.00072104967,0.00064826413,0.0018438138],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0016594931,0.00034089494,0.0037026792,0.0004965179,0.00009472569,0.0005408612,0.00035412222,0.0115181375,0.08677424,0.001855621,0.02079305,0.8718697],"study_design_scores_gemma":[0.00013105125,0.00087045424,0.032148533,0.00014630283,0.00031568456,0.0009797324,0.001531094,0.81582934,0.107593216,0.0057176803,0.034641415,0.00009550497],"about_ca_topic_score_codex":0.00613895,"about_ca_topic_score_gemma":0.010545617,"teacher_disagreement_score":0.00613895,"about_ca_system_score_codex":0.0003791555,"about_ca_system_score_gemma":0.00079109904,"threshold_uncertainty_score":0.012206435},"labels":[],"label_agreement":null},{"id":"W2756914837","doi":"10.1145/3121050.3121052","title":"Mining the Temporal Statistics of Query Terms for Searching Social Media Posts","year":2017,"lang":"en","type":"article","venue":"","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":7,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Waterloo","funders":"Natural Sciences and Engineering Research Council of Canada; National Science Foundation","keywords":"Computer science; Ranking (information retrieval); Timestamp; Relevance (law); Information retrieval; Query expansion; Kernel density estimation; Data mining; Statistics; Mathematics","score_opus":0.06087900319667349,"score_gpt":0.32995884236089423,"score_spread":0.26907983916422074,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2756914837","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.6020635,0.0043610353,0.38126144,0.0012404951,0.00009220731,0.00042349056,0.0052123377,0.0029331092,0.0024123634],"genre_scores_gemma":[0.9120589,0.000932003,0.08104928,0.00007095375,0.0002198985,0.00020234926,0.004575392,0.00009684475,0.00079436926],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.99873525,0.0003373931,0.00014787482,0.0002712266,0.00040563926,0.00010265571],"domain_scores_gemma":[0.99349856,0.003642522,0.0014068756,0.00047218517,0.00079173065,0.00018811782],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0020848003,0.0009737362,0.0011097186,0.010266892,0.0004700753,0.0012731059,0.0010498386,0.00093504274,0.0004480069],"category_scores_gemma":[0.013711282,0.00038337472,0.00085012615,0.0066112676,0.0004222355,0.0028097255,0.0006015434,0.00077136635,0.0006435469],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0015279923,0.001309379,0.18803783,0.0017523097,0.00064433663,0.0011074542,0.0010294958,0.09111241,0.111312345,0.008484492,0.011698263,0.58198375],"study_design_scores_gemma":[0.00007000793,0.00040443667,0.0556728,0.00004727893,0.00018013686,0.0006178493,0.0004389026,0.91280234,0.016952697,0.00934807,0.0033838823,0.00008154495],"about_ca_topic_score_codex":0.0056832656,"about_ca_topic_score_gemma":0.012631519,"teacher_disagreement_score":0.010266892,"about_ca_system_score_codex":0.0008282591,"about_ca_system_score_gemma":0.0011728542,"threshold_uncertainty_score":0.011300385},"labels":[],"label_agreement":null},{"id":"W2763767559","doi":"10.1002/9780470050118.ecse465","title":"Web Intelligence (<scp>WI</scp>)","year":2008,"lang":"en","type":"other","venue":"Wiley Encyclopedia of Computer Science and Engineering","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":16,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Regina","funders":"","keywords":"Web intelligence; World Wide Web; Computer science; Web application; Collective intelligence; Web development; Data science; The Internet","score_opus":0.007405429330755762,"score_gpt":0.20058065705083883,"score_spread":0.19317522772008305,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2763767559","genre_codex":"other","genre_gemma":"other","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"other","genre_consensus":"other","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0006899269,0.0015916523,0.013974206,0.004546137,0.0035362982,0.00015687903,0.0046532685,0.004150438,0.9667012],"genre_scores_gemma":[0.012886697,0.004241021,0.013251277,0.0030540603,0.0028034109,0.00020197112,0.008854259,0.0025464732,0.9521609],"study_design_codex":"not_applicable","study_design_gemma":"not_applicable","domain_scores_codex":[0.9988213,0.0001721856,0.00011581159,0.00013206486,0.00067453197,0.0000839758],"domain_scores_gemma":[0.9969593,0.0005678574,0.00021669894,0.0008284657,0.0011147906,0.00031291426],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0009379341,0.000660817,0.00053202716,0.0037664066,0.001247628,0.00768484,0.0010647445,0.002159179,0.2777968],"category_scores_gemma":[0.004915753,0.00036140464,0.00042002852,0.0088471165,0.0010208694,0.004199878,0.0028000681,0.001762019,0.22297716],"study_design_candidate":"not_applicable","study_design_consensus":"not_applicable","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.000014790027,0.000020377427,0.0001688629,0.0002844168,0.0000059893473,0.00016049472,0.00007388057,0.00017590304,0.00070913305,0.038620852,0.7605335,0.19923174],"study_design_scores_gemma":[0.0000022929526,0.0000036767115,0.00023906893,0.00011413451,0.0000022505913,0.000172433,0.000019495988,0.00028935453,0.0003887765,0.0046872306,0.9940752,0.0000060996013],"about_ca_topic_score_codex":0.00550999,"about_ca_topic_score_gemma":0.008473765,"teacher_disagreement_score":0.2777968,"about_ca_system_score_codex":0.0014593092,"about_ca_system_score_gemma":0.0012103716,"threshold_uncertainty_score":0.9293229},"labels":[],"label_agreement":null},{"id":"W2763817197","doi":"10.1108/ijwis-04-2017-0037","title":"Set of tuples expansion by example with reliability","year":2017,"lang":"en","type":"article","venue":"International Journal of Web Information Systems","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":1,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":true,"ca_institutions":"","funders":"","keywords":"Computer science; Tuple; Information retrieval; PageRank; Web page; Relation (database); Set (abstract data type); Web search engine; Web search query; HITS algorithm; Data mining; Search engine; Algorithm; World Wide Web; Mathematics; Discrete mathematics","score_opus":0.019495770096594988,"score_gpt":0.265419159993739,"score_spread":0.24592338989714402,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2763817197","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.01885104,0.00085999887,0.96343476,0.00085916714,0.00011932644,0.00045198482,0.0013246778,0.00671821,0.0073808744],"genre_scores_gemma":[0.14237846,0.0005515816,0.8501611,0.0002662568,0.000113980204,0.0003395002,0.0022204989,0.00079100556,0.003177745],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9922982,0.0020195125,0.0006815783,0.0013511704,0.0033199457,0.0003295676],"domain_scores_gemma":[0.98351884,0.009724739,0.0008569665,0.004092599,0.0015777937,0.00022914779],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0038208028,0.0009888042,0.0011435061,0.003655238,0.0008894146,0.0026884966,0.0021306106,0.000848122,0.008089868],"category_scores_gemma":[0.026644247,0.00071663177,0.0026023474,0.003916012,0.0016502537,0.007650068,0.003939877,0.0021184254,0.002815143],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0007867044,0.00018701806,0.007887557,0.0016078705,0.00016576562,0.0010934118,0.0019900159,0.063402385,0.012320553,0.16627857,0.020472322,0.7238079],"study_design_scores_gemma":[0.000097759956,0.00032358602,0.0026654575,0.00065907754,0.00025621135,0.0024689129,0.0010014717,0.48477614,0.034311224,0.329377,0.14390437,0.00015876319],"about_ca_topic_score_codex":0.0018061291,"about_ca_topic_score_gemma":0.0016413289,"teacher_disagreement_score":0.008089868,"about_ca_system_score_codex":0.00088512147,"about_ca_system_score_gemma":0.0010416092,"threshold_uncertainty_score":0.02706331},"labels":[],"label_agreement":null},{"id":"W2767149477","doi":"10.4018/ijssoe.2017070101","title":"Towards Building a New Age Commercial Contextual Advertising System","year":2017,"lang":"en","type":"article","venue":"International Journal of Systems and Service-Oriented Engineering","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"IBM (Canada); University of Alberta","funders":"","keywords":"Computer science; Web page; The Internet; Information retrieval; Taxonomy (biology); Implementation; Architecture; World Wide Web; Software engineering","score_opus":0.015366485742997392,"score_gpt":0.2563414551936086,"score_spread":0.24097496945061123,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2767149477","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.1168013,0.0014776364,0.7873093,0.0010972571,0.00029972574,0.0011767674,0.0010520371,0.06069023,0.030095806],"genre_scores_gemma":[0.37293452,0.00049768353,0.61298674,0.00059967313,0.00014265637,0.00023719137,0.0019537364,0.0004317305,0.010215982],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9991425,0.00014645168,0.00009794593,0.0002385837,0.0002810238,0.00009350381],"domain_scores_gemma":[0.9989548,0.00019152902,0.000057374436,0.00024274887,0.00045983866,0.000093693394],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0011575398,0.0005055394,0.000755433,0.0014952915,0.0008748919,0.0028526618,0.00095558167,0.001143076,0.0026345516],"category_scores_gemma":[0.0021245324,0.00040831434,0.00062110624,0.0011097689,0.000538249,0.003195337,0.0013377303,0.0010284862,0.0023814237],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0008476796,0.00095088844,0.010057316,0.00064867694,0.00022786135,0.0007422978,0.0011165751,0.014850346,0.08531895,0.035241622,0.026139751,0.823858],"study_design_scores_gemma":[0.00009231679,0.00050515815,0.006627311,0.00011854197,0.0004642454,0.00076036603,0.000621093,0.7611458,0.08160646,0.013555411,0.13432373,0.00017959133],"about_ca_topic_score_codex":0.013299775,"about_ca_topic_score_gemma":0.010758071,"teacher_disagreement_score":0.013299775,"about_ca_system_score_codex":0.0008748569,"about_ca_system_score_gemma":0.0013706929,"threshold_uncertainty_score":0.026444674},"labels":[],"label_agreement":null},{"id":"W2775565065","doi":"","title":"Aboriginal Canada Portal: Client-side CSS for enhancing accessibility – List of Styles","year":2010,"lang":"en","type":"article","venue":"","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":0,"is_retracted":false,"has_abstract":false,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":true,"ca_institutions":"","funders":"","keywords":"Client-side; World Wide Web; Computer science; Medicine; Business","score_opus":0.007975049170440448,"score_gpt":0.28203419886894093,"score_spread":0.2740591496985005,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2775565065","genre_codex":"methods","genre_gemma":"software","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"software","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.19162409,0.00092428026,0.28985187,0.0022769656,0.00042232618,0.001672658,0.055151504,0.24644761,0.21162866],"genre_scores_gemma":[0.39121127,0.0016332334,0.25762185,0.0007313403,0.00010860668,0.0008842415,0.03798598,0.024223031,0.28560036],"study_design_codex":"design_other","study_design_gemma":"not_applicable","domain_scores_codex":[0.99963856,0.000029247249,0.000021650943,0.000034059085,0.00019412179,0.00008235145],"domain_scores_gemma":[0.99741733,0.00039541666,0.000057015255,0.00040313037,0.0014693227,0.0002577762],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0007644741,0.0008547739,0.00038721706,0.0016192442,0.001411359,0.002170238,0.0009588023,0.0005614501,0.038229857],"category_scores_gemma":[0.0028456103,0.00043330897,0.00054779847,0.0022826956,0.0003240544,0.0014931585,0.0010947259,0.00086675904,0.009183653],"study_design_candidate":"not_applicable","study_design_consensus":null,"about_ca_topic_candidate":true,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0012578783,0.00043837572,0.021702277,0.0009417268,0.00007647337,0.0010644625,0.0048033083,0.0017239565,0.06989106,0.013627452,0.3240767,0.5603964],"study_design_scores_gemma":[0.00015301204,0.00017150775,0.029810175,0.00037988965,0.00020986595,0.0008313177,0.0021392894,0.028134037,0.10701355,0.0050676866,0.82581615,0.00027347467],"about_ca_topic_score_codex":0.19653098,"about_ca_topic_score_gemma":0.334791,"teacher_disagreement_score":0.803469,"about_ca_system_score_codex":0.0013853223,"about_ca_system_score_gemma":0.003562301,"threshold_uncertainty_score":0.39077413},"labels":[],"label_agreement":null},{"id":"W2776578796","doi":"10.1109/eisic.2017.28","title":"Catchem: A Browser Plugin for the Panama Papers Using Approximate String Matching","year":2017,"lang":"en","type":"article","venue":"","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":true,"ca_institutions":"","funders":"","keywords":"Plug-in; Levenshtein distance; Computer science; Panama; Matching (statistics); Information retrieval; Index (typography); String searching algorithm; World Wide Web; Government (linguistics); Sample (material); String (physics); Artificial intelligence; Computer security; Pattern matching; Mathematics; Programming language; Statistics","score_opus":0.05775512202307357,"score_gpt":0.30060490239858667,"score_spread":0.2428497803755131,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2776578796","genre_codex":"software","genre_gemma":"software","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"software","genre_consensus":"software","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.024599705,0.0007951423,0.2915561,0.00022581438,0.00024618808,0.00045518854,0.01105147,0.6660332,0.0050372574],"genre_scores_gemma":[0.2262398,0.00133391,0.59810114,0.00060468,0.00017938644,0.0010693591,0.0626209,0.07706839,0.03278249],"study_design_codex":"design_other","study_design_gemma":"not_applicable","domain_scores_codex":[0.9992612,0.000086746615,0.00009018896,0.00018677593,0.00032080873,0.00005424402],"domain_scores_gemma":[0.99881375,0.0004434339,0.00010138675,0.0003624547,0.00018143254,0.00009749691],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0010628742,0.0015306532,0.0009871235,0.0026730264,0.0003890353,0.0014722056,0.001668254,0.0010712903,0.025026327],"category_scores_gemma":[0.0046682633,0.00068168255,0.0010159217,0.0021993532,0.0002408405,0.003067869,0.0023234223,0.00085899845,0.0109221],"study_design_candidate":"not_applicable","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0029112096,0.0006214346,0.012245773,0.0016705304,0.0007562767,0.0020991846,0.00093858334,0.006171077,0.063771926,0.0073407893,0.30478647,0.5966868],"study_design_scores_gemma":[0.00077795656,0.0006351652,0.025630644,0.00027471644,0.00017862472,0.003871674,0.0006247346,0.336325,0.10808664,0.016025579,0.5072363,0.00033305102],"about_ca_topic_score_codex":0.0025146527,"about_ca_topic_score_gemma":0.0031932418,"teacher_disagreement_score":0.025026327,"about_ca_system_score_codex":0.00036560203,"about_ca_system_score_gemma":0.00054451084,"threshold_uncertainty_score":0.0837214},"labels":[],"label_agreement":null},{"id":"W2792771535","doi":"10.4018/978-1-59904-002-8.ch014","title":"Browser-Less Surfing and Mobile Internet Access","year":2007,"lang":"en","type":"book-chapter","venue":"IGI Global eBooks","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of New Brunswick","funders":"","keywords":"World Wide Web; JavaScript; Computer science; The Internet; Multimedia; RSS; Download; Mobile device; Mobile Web; Web browser; XML; Mobile technology","score_opus":0.043658629486575805,"score_gpt":0.2894321925750561,"score_spread":0.24577356308848028,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2792771535","genre_codex":"other","genre_gemma":"other","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"other","genre_consensus":"other","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.063963,0.0783302,0.18624891,0.008613436,0.0012858355,0.00022369501,0.000993773,0.0037417663,0.6565994],"genre_scores_gemma":[0.3031307,0.0710302,0.1265538,0.0033445165,0.0019120451,0.0002532502,0.0027408246,0.0012866154,0.4897481],"study_design_codex":"design_other","study_design_gemma":"not_applicable","domain_scores_codex":[0.9990771,0.00022776137,0.00005360622,0.00020855243,0.00037000165,0.00006289632],"domain_scores_gemma":[0.9977036,0.0012942413,0.00015064167,0.00043604872,0.00025210032,0.00016332237],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0008596117,0.0005034481,0.00059823674,0.002190729,0.0005116167,0.004598303,0.0014457186,0.0014497082,0.029374862],"category_scores_gemma":[0.0041033085,0.00036172848,0.0005131099,0.0035918427,0.0012334683,0.006613645,0.0018263776,0.001336026,0.009165893],"study_design_candidate":"not_applicable","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00006725624,0.00011016917,0.0034144754,0.0009755608,0.000025991827,0.00041512988,0.0010861057,0.0009504828,0.003960872,0.12225864,0.040325593,0.82640964],"study_design_scores_gemma":[0.000021858952,0.00013168916,0.009035021,0.0010704052,0.000053646218,0.004782994,0.0010249405,0.009136233,0.002942966,0.09691871,0.8748229,0.000058615035],"about_ca_topic_score_codex":0.0013092633,"about_ca_topic_score_gemma":0.0019763657,"teacher_disagreement_score":0.029374862,"about_ca_system_score_codex":0.00057552074,"about_ca_system_score_gemma":0.00071480795,"threshold_uncertainty_score":0.09826875},"labels":[],"label_agreement":null},{"id":"W2793625150","doi":"10.1002/asi.24048","title":"If these crawls could talk: Studying and documenting web archives provenance","year":2018,"lang":"en","type":"article","venue":"Journal of the Association for Information Science and Technology","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":41,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Waterloo; University of Toronto","funders":"Social Sciences and Humanities Research Council of Canada; Natural Sciences and Engineering Research Council of Canada; University of Toronto","keywords":"World Wide Web; Computer science; Transparency (behavior); Context (archaeology); Data science; Process (computing); Geography; Archaeology","score_opus":0.009031874620079431,"score_gpt":0.25727710376468954,"score_spread":0.2482452291446101,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2793625150","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.8341457,0.0021115346,0.110602595,0.0039477586,0.00021196717,0.0011087311,0.0013010154,0.0011073236,0.045463283],"genre_scores_gemma":[0.91644764,0.0010922153,0.075242184,0.00026490988,0.00007829519,0.0004572193,0.0007548556,0.00044325044,0.0052193413],"study_design_codex":"qualitative","study_design_gemma":"qualitative","domain_scores_codex":[0.9790562,0.01231174,0.0018758727,0.0015735733,0.0045261527,0.0006564723],"domain_scores_gemma":[0.8665952,0.08960489,0.012522984,0.018479886,0.011442951,0.0013541116],"candidate_categories":["scholarly_communication"],"consensus_categories":[],"category_scores_codex":[0.028883142,0.0003587739,0.0005278946,0.00808701,0.0061250594,0.010657452,0.001260891,0.0014572615,0.0017573342],"category_scores_gemma":[0.14851397,0.00095276296,0.0006184802,0.0065824655,0.006081573,0.014546595,0.0052310494,0.0020921354,0.0005452758],"study_design_candidate":"qualitative","study_design_consensus":"qualitative","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0005412119,0.00029089817,0.21667174,0.00081069075,0.00012869753,0.0022445838,0.41908684,0.002723923,0.006205402,0.118385404,0.0043157595,0.22859493],"study_design_scores_gemma":[0.00010700448,0.00033589263,0.18187888,0.0028907058,0.0004034496,0.0030856847,0.26745716,0.02474111,0.026877731,0.20690025,0.28487208,0.00045005954],"about_ca_topic_score_codex":0.0120176105,"about_ca_topic_score_gemma":0.01849698,"teacher_disagreement_score":0.9893426,"about_ca_system_score_codex":0.0035131488,"about_ca_system_score_gemma":0.006998329,"threshold_uncertainty_score":0.15275049},"labels":[],"label_agreement":null},{"id":"W2794968280","doi":"","title":"DWASTIC: Automating Coverage Metrics for Dynamic Web Applications","year":2009,"lang":"en","type":"article","venue":"","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":4,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Queen's University","funders":"","keywords":"Computer science; Distributed computing","score_opus":0.011508947142357761,"score_gpt":0.2738638154912051,"score_spread":0.2623548683488473,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2794968280","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.1358011,0.00048241403,0.80774796,0.00019408396,0.000035905585,0.0003696852,0.0019731196,0.051260885,0.0021349317],"genre_scores_gemma":[0.5556202,0.00014912135,0.43534085,0.00007552448,0.000027479047,0.0004613289,0.0050277924,0.0022280458,0.0010695517],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.99551165,0.0013303864,0.00052530604,0.00068509136,0.00164502,0.00030253932],"domain_scores_gemma":[0.98394185,0.0093279965,0.0018359158,0.0017921671,0.0027461185,0.0003559983],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0030051873,0.0012340442,0.001035322,0.006277159,0.00056416984,0.0016249601,0.0014691883,0.0006466484,0.0020481104],"category_scores_gemma":[0.019199427,0.0006440179,0.00076704816,0.0024020532,0.00062486413,0.0017193502,0.0023180004,0.0008308281,0.0007327491],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00047416482,0.00034469375,0.043829184,0.00058674597,0.0001506111,0.0003495637,0.0005528114,0.123181894,0.052634332,0.0064104344,0.010403049,0.7610824],"study_design_scores_gemma":[0.000042418822,0.000112678215,0.006181814,0.000035588168,0.000021332819,0.00013420847,0.00008116511,0.95552754,0.03063233,0.0041460562,0.0030517185,0.0000330691],"about_ca_topic_score_codex":0.00784015,"about_ca_topic_score_gemma":0.007846057,"teacher_disagreement_score":0.00784015,"about_ca_system_score_codex":0.0011692735,"about_ca_system_score_gemma":0.0011692535,"threshold_uncertainty_score":0.015893161},"labels":[],"label_agreement":null},{"id":"W2795268402","doi":"10.5539/ies.v11n4p84","title":"Invisible Web and Academic Research: A Partnership for Quality","year":2018,"lang":"en","type":"article","venue":"International Education Studies","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":5,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":true,"route_about_ca":false,"ca_institutions":"","funders":"","keywords":"General partnership; Paragraph; Sample (material); Quality (philosophy); Arabic; Descriptive research; Higher education; Psychology; Sociology; Medical education; World Wide Web; Computer science; Political science; Medicine; Social science","score_opus":0.6143202558448452,"score_gpt":0.6043780340355053,"score_spread":0.009942221809339902,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2795268402","genre_codex":"commentary","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.019072669,0.024084823,0.029526006,0.8265531,0.0033860565,0.00019793249,0.000043095373,0.00020901233,0.096927434],"genre_scores_gemma":[0.85295624,0.017430289,0.028608479,0.0739864,0.004024532,0.0003173535,0.00006279331,0.00024786964,0.022365961],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"not_applicable","domain_scores_codex":[0.8594392,0.11015935,0.0038631444,0.0036467544,0.017275736,0.0056158802],"domain_scores_gemma":[0.6175707,0.2020937,0.026634447,0.036790483,0.036325842,0.08058485],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.12714018,0.00045821702,0.0008268117,0.0048592016,0.010383208,0.040249657,0.002164638,0.007644022,0.0077815596],"category_scores_gemma":[0.11447324,0.0006563209,0.0008051455,0.0051352563,0.03935485,0.030595355,0.035251945,0.013274738,0.0014505306],"study_design_candidate":"not_applicable","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.000086512024,0.00040073355,0.013131987,0.0010351326,0.00012364675,0.0006351153,0.055779766,0.00043780595,0.0006612904,0.5939612,0.05961297,0.27413377],"study_design_scores_gemma":[0.000069824884,0.00018284885,0.005120321,0.0020889256,0.000040061434,0.0006981992,0.06798316,0.0007960959,0.0003491807,0.3120264,0.61057633,0.00006869372],"about_ca_topic_score_codex":0.0024640393,"about_ca_topic_score_gemma":0.002570258,"teacher_disagreement_score":0.12714018,"about_ca_system_score_codex":0.00944888,"about_ca_system_score_gemma":0.046258353,"threshold_uncertainty_score":0.67238957},"labels":[],"label_agreement":null},{"id":"W2795493637","doi":"10.1371/journal.pone.0202223","title":"Automatically assembling a full census of an academic field","year":2018,"lang":"en","type":"article","venue":"PLoS ONE","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":6,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":true,"ca_institutions":"","funders":"National Science Foundation","keywords":"Census; Directory; Workforce; American Community Survey; Field (mathematics); Computer science; Data science; World Wide Web; Population; Sociology; Mathematics; Political science; Demography; Law","score_opus":0.07600938300478349,"score_gpt":0.29144244149186255,"score_spread":0.21543305848707905,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2795493637","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.21063365,0.0018226234,0.45710725,0.0015871392,0.0005723288,0.0022184837,0.2519023,0.047839686,0.02631652],"genre_scores_gemma":[0.183699,0.0010363245,0.55204093,0.00028505464,0.00017077802,0.0014461587,0.251435,0.0023586538,0.007527966],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.99774337,0.00029496537,0.00030933574,0.0006301128,0.0008522311,0.00016998392],"domain_scores_gemma":[0.9857109,0.0034692767,0.0014910378,0.002928886,0.0056287223,0.00077110954],"candidate_categories":["bibliometrics"],"consensus_categories":[],"category_scores_codex":[0.0019124019,0.0007976172,0.0009532651,0.012533371,0.0012101152,0.0023238687,0.0009463094,0.0007929686,0.0043114135],"category_scores_gemma":[0.019002091,0.0007851248,0.00082510896,0.010080109,0.0003737493,0.0026486283,0.0029077954,0.00096422876,0.0070919106],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00026689345,0.00031998637,0.14106236,0.0015816947,0.00024724434,0.0006629462,0.003093729,0.008462445,0.020044206,0.00860531,0.20937842,0.6062748],"study_design_scores_gemma":[0.00013958494,0.00016371618,0.20893595,0.000588387,0.00020332822,0.0011529736,0.004867161,0.19730316,0.041758478,0.026979908,0.51764786,0.00025948303],"about_ca_topic_score_codex":0.03369083,"about_ca_topic_score_gemma":0.060486566,"teacher_disagreement_score":0.98746663,"about_ca_system_score_codex":0.0011866485,"about_ca_system_score_gemma":0.0052765394,"threshold_uncertainty_score":0.06698948},"labels":[],"label_agreement":null},{"id":"W2799255978","doi":"10.1145/3184558.3188749","title":"The Shifting Landscape of Web Search and Mining","year":2018,"lang":"en","type":"article","venue":"","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Alberta","funders":"","keywords":"World Wide Web; Computer science; Session (web analytics); Heading (navigation); The Internet; Web mining; Web content; Web page; Semantics (computer science); Engineering","score_opus":0.019737510207748533,"score_gpt":0.2612473597444664,"score_spread":0.24150984953671786,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2799255978","genre_codex":"commentary","genre_gemma":"review","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"review","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.077341616,0.11231773,0.094893254,0.6201774,0.0022461032,0.00029330153,0.0011779114,0.00092794537,0.09062469],"genre_scores_gemma":[0.6566956,0.11438107,0.14371434,0.037855536,0.014237708,0.000728858,0.0018233265,0.0013057153,0.029257838],"study_design_codex":"design_other","study_design_gemma":"not_applicable","domain_scores_codex":[0.963625,0.02068649,0.0015127732,0.0034787082,0.009585946,0.0011111503],"domain_scores_gemma":[0.9076381,0.0714432,0.0024359266,0.006678256,0.008185793,0.0036187745],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0442081,0.0006896588,0.002287812,0.011044949,0.0049450593,0.027362209,0.0042313263,0.006272345,0.005412583],"category_scores_gemma":[0.062463142,0.001055004,0.0013194004,0.014350015,0.017170988,0.04573758,0.009203972,0.0074481824,0.002185567],"study_design_candidate":"not_applicable","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00015886064,0.0002723022,0.009033716,0.0020968225,0.00013537135,0.00035782869,0.014551555,0.0033484593,0.001852789,0.3956281,0.07254436,0.50001985],"study_design_scores_gemma":[0.000044382265,0.00014273693,0.010705066,0.0015043244,0.000038598315,0.0009671166,0.024826206,0.01876501,0.0015136285,0.46533275,0.47598115,0.00017913246],"about_ca_topic_score_codex":0.0026780614,"about_ca_topic_score_gemma":0.0035025666,"teacher_disagreement_score":0.0442081,"about_ca_system_score_codex":0.0054707634,"about_ca_system_score_gemma":0.0048374813,"threshold_uncertainty_score":0.23379755},"labels":[],"label_agreement":null},{"id":"W2800935968","doi":"10.19153/cleiej.21.1.7","title":"Towards Technological Approaches for Concept Maps Mining from Text","year":2018,"lang":"en","type":"article","venue":"CLEI electronic journal","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":4,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Ottawa","funders":"","keywords":"Categorization; Computer science; Representation (politics); Data science; Resource (disambiguation); Subject (documents); Information retrieval; Data mining; Artificial intelligence; World Wide Web","score_opus":0.036832174107150915,"score_gpt":0.25628713337261416,"score_spread":0.21945495926546324,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2800935968","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.005402625,0.0012741535,0.9841733,0.0014446347,0.00005735979,0.0005931407,0.00061580696,0.00041148637,0.0060274173],"genre_scores_gemma":[0.022431536,0.0011344136,0.972559,0.00014300148,0.000059484104,0.001299419,0.0011844977,0.000075712764,0.0011129024],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9837961,0.006982944,0.0018885513,0.0020687098,0.0049676527,0.0002961082],"domain_scores_gemma":[0.95909166,0.029053258,0.0024362588,0.0036546323,0.005278214,0.0004859561],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.015254889,0.0016320383,0.00073747145,0.034563772,0.002460747,0.014762046,0.004080401,0.0026263588,0.0040794727],"category_scores_gemma":[0.05164039,0.0011736925,0.0022714378,0.024161436,0.0048782085,0.016043518,0.005431274,0.0031506484,0.002845969],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00007580692,0.00027040296,0.0042340923,0.0029863806,0.00014956814,0.00063560007,0.0121712005,0.0062699416,0.006013538,0.50751144,0.006876091,0.4528059],"study_design_scores_gemma":[0.00004607881,0.00010015896,0.0046392893,0.0017077135,0.00012522271,0.0011772373,0.013945421,0.06875047,0.011269196,0.7092717,0.18881786,0.00014958423],"about_ca_topic_score_codex":0.0018883464,"about_ca_topic_score_gemma":0.0023366606,"teacher_disagreement_score":0.034563772,"about_ca_system_score_codex":0.0034435028,"about_ca_system_score_gemma":0.005057716,"threshold_uncertainty_score":0.080676496},"labels":[],"label_agreement":null},{"id":"W2806438009","doi":"10.1007/978-3-540-85902-4_35","title":"University of Waterloo at INEX2007: Adhoc and Link-the-Wiki Tracks","year":2008,"lang":"en","type":"book-chapter","venue":"Lecture notes in computer science","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":45,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Waterloo","funders":"","keywords":"Computer science; Link (geometry); XML; Embedding; Track (disk drive); Context (archaeology); Point (geometry); Information retrieval; World Wide Web; Computer network; Artificial intelligence; Operating system","score_opus":0.013577574969926363,"score_gpt":0.19887995854184615,"score_spread":0.18530238357191978,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2806438009","genre_codex":"other","genre_gemma":"other","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"other","genre_consensus":"other","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.018970776,0.018001236,0.07299695,0.023273364,0.0112159625,0.0005511136,0.16106953,0.059596404,0.6343247],"genre_scores_gemma":[0.017840868,0.0046673515,0.042428475,0.0008839474,0.0011827232,0.00015401746,0.09465922,0.009482441,0.8287009],"study_design_codex":"not_applicable","study_design_gemma":"not_applicable","domain_scores_codex":[0.99807286,0.00017324288,0.00006512737,0.00027739262,0.0011978426,0.00021349698],"domain_scores_gemma":[0.99546,0.0004441982,0.00010933507,0.0005291447,0.0021882588,0.0012691689],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.002930558,0.0010390423,0.001138129,0.0040553217,0.0027981275,0.00546907,0.0016881236,0.0010173862,0.1363685],"category_scores_gemma":[0.0058318963,0.00083410693,0.00044123677,0.008213246,0.0005836933,0.0062726038,0.0020499756,0.0014671023,0.06827516],"study_design_candidate":"not_applicable","study_design_consensus":"not_applicable","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.000040818137,0.00007284785,0.00037349426,0.00008227738,0.000004411404,0.000022651044,0.00009735884,0.00024314827,0.00041996315,0.0036853368,0.8612062,0.13375154],"study_design_scores_gemma":[0.000015008014,0.000022520011,0.0012717663,0.00005115059,0.0000049362357,0.000044347133,0.0000920664,0.0014994782,0.0013268921,0.0020996924,0.9935529,0.000019253883],"about_ca_topic_score_codex":0.11779962,"about_ca_topic_score_gemma":0.2055963,"teacher_disagreement_score":0.1363685,"about_ca_system_score_codex":0.00331049,"about_ca_system_score_gemma":0.009096751,"threshold_uncertainty_score":0.4561981},"labels":[],"label_agreement":null},{"id":"W2808777947","doi":"10.1145/3365376","title":"A Pure Visual Approach for Automatically Extracting and Aligning Structured Web Data","year":2019,"lang":"en","type":"article","venue":"ACM Transactions on Internet Technology","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":4,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Alberta","funders":"","keywords":"Computer science; Gestalt psychology; Information retrieval; Similarity (geometry); Web page; Task (project management); Information extraction; Data extraction; Object (grammar); Data mining; Artificial intelligence; Perception; Image (mathematics); World Wide Web","score_opus":0.02330713402028758,"score_gpt":0.28761873796595855,"score_spread":0.264311603945671,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2808777947","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.008394723,0.0004971866,0.9782833,0.00012732753,0.0000615397,0.00017623797,0.00031266597,0.010282625,0.0018643584],"genre_scores_gemma":[0.054523937,0.0004971172,0.9404232,0.00020562287,0.000045139033,0.00017270686,0.0012549154,0.00034197737,0.002535366],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9989348,0.00011962411,0.00007795314,0.0004656109,0.0003351318,0.00006683174],"domain_scores_gemma":[0.9988813,0.00030247017,0.00013513854,0.00025952377,0.000339038,0.00008253798],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0007738493,0.001051755,0.00086994126,0.0037970536,0.00054708467,0.0019212598,0.0017949765,0.0012845619,0.002958526],"category_scores_gemma":[0.0026043034,0.00070569303,0.001234524,0.0024927384,0.00083907845,0.0027465352,0.0015949939,0.0010812382,0.0026796842],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00021042879,0.00019520294,0.0011343585,0.0006518398,0.000071476425,0.0002133544,0.0002524794,0.002740514,0.11248358,0.0035520243,0.007884198,0.8706106],"study_design_scores_gemma":[0.00014808096,0.0006887511,0.0118945725,0.00030218944,0.00030608455,0.0034000317,0.0008933342,0.498207,0.34712347,0.024935685,0.11184725,0.00025356506],"about_ca_topic_score_codex":0.001996863,"about_ca_topic_score_gemma":0.0027811774,"teacher_disagreement_score":0.0037970536,"about_ca_system_score_codex":0.00037730325,"about_ca_system_score_gemma":0.00096889265,"threshold_uncertainty_score":0.009897292},"labels":[],"label_agreement":null},{"id":"W2810665014","doi":"","title":"Clustering Search to Navigate A Case Study of the Canadian World Wide Web as a Historical Resource.","year":2014,"lang":"en","type":"article","venue":"DH","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":0,"is_retracted":false,"has_abstract":false,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":true,"ca_institutions":"","funders":"","keywords":"Cluster analysis; Resource (disambiguation); Computer science; World Wide Web; Information retrieval; Data science; Artificial intelligence","score_opus":0.028631825005621468,"score_gpt":0.2670395947622431,"score_spread":0.23840776975662162,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2810665014","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.88838434,0.0016814069,0.016371764,0.0038905444,0.00010605971,0.0007380098,0.0042957277,0.000999072,0.08353307],"genre_scores_gemma":[0.91531956,0.0012165033,0.044432163,0.00031398056,0.000018675943,0.00008771275,0.0039229123,0.00023688497,0.034451645],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.999019,0.00025607363,0.00005539851,0.00010334014,0.00034325573,0.00022297258],"domain_scores_gemma":[0.99636143,0.0018934672,0.0001248771,0.00026286798,0.000955765,0.00040165614],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0013539413,0.000324728,0.00023968982,0.004110575,0.006222819,0.0025984577,0.0016004797,0.0014583381,0.0045529096],"category_scores_gemma":[0.007901122,0.00018691101,0.00041982174,0.010153682,0.0011442945,0.002328644,0.0008239528,0.0006775429,0.00079610985],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":true,"about_ca_topic_consensus":true,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0007996576,0.0014944843,0.1488733,0.0017894414,0.00018395843,0.019065708,0.08049795,0.020583987,0.009554503,0.05629336,0.12778874,0.5330749],"study_design_scores_gemma":[0.00011456591,0.00046752943,0.1572588,0.00078516884,0.0004139779,0.008795219,0.20416579,0.10323005,0.017755823,0.0145094395,0.49216148,0.00034213797],"about_ca_topic_score_codex":0.8212336,"about_ca_topic_score_gemma":0.9299054,"teacher_disagreement_score":0.17876643,"about_ca_system_score_codex":0.007640142,"about_ca_system_score_gemma":0.011353608,"threshold_uncertainty_score":0.3596384},"labels":[],"label_agreement":null},{"id":"W2823780422","doi":"10.1007/978-3-319-96133-0_10","title":"When Different Is Wrong: Visual Unsupervised Validation for Web Information Extraction","year":2018,"lang":"en","type":"book-chapter","venue":"Lecture notes in computer science","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":1,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Université du Québec à Montréal","funders":"Natural Sciences and Engineering Research Council of Canada","keywords":"Computer science; Outlier; Robustness (evolution); Information extraction; Artificial intelligence; Data mining; Context (archaeology); Information retrieval; Machine learning","score_opus":0.021952899054827328,"score_gpt":0.2721291305623071,"score_spread":0.25017623150747975,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2823780422","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.039966296,0.0014196137,0.9121793,0.0015954517,0.00044928968,0.0003332256,0.0022196649,0.033202533,0.008634584],"genre_scores_gemma":[0.26729906,0.0006120384,0.7118711,0.0010270566,0.00015399996,0.00024931296,0.0056979363,0.0060054897,0.007083941],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.99641824,0.0010730304,0.00028388124,0.00057216827,0.0014219357,0.00023071238],"domain_scores_gemma":[0.98535293,0.008954848,0.0008083121,0.0020843095,0.002538635,0.00026101965],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.006149456,0.0009969111,0.0008395859,0.0034065426,0.0009917595,0.004169298,0.0024221381,0.002201734,0.0047180783],"category_scores_gemma":[0.02153685,0.0006198962,0.0010197515,0.0014438673,0.0016148322,0.0034183885,0.0037383635,0.0019240453,0.0026073349],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0010145628,0.00018968697,0.0072519467,0.0008404246,0.00021187522,0.0009385634,0.0016460539,0.014555169,0.033251755,0.018953023,0.07794246,0.8432045],"study_design_scores_gemma":[0.00012910894,0.00012422373,0.008615131,0.00088894565,0.00014979955,0.0014395145,0.0013079483,0.65865606,0.09913882,0.13910477,0.09027478,0.0001709786],"about_ca_topic_score_codex":0.004072187,"about_ca_topic_score_gemma":0.0077376207,"teacher_disagreement_score":0.006149456,"about_ca_system_score_codex":0.00074918906,"about_ca_system_score_gemma":0.0015037498,"threshold_uncertainty_score":0.032521844},"labels":[],"label_agreement":null},{"id":"W2884831277","doi":"10.4018/978-1-5225-2255-3.ch695","title":"An Efficient and Effective Index Structure for Query Evaluation in Search Engines","year":2017,"lang":"en","type":"book-chapter","venue":"IGI Global eBooks","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Winnipeg","funders":"","keywords":"Inverted index; Computer science; Disjoint sets; Intersection (aeronautics); Trie; Information retrieval; Word (group theory); Set (abstract data type); Interval (graph theory); Sequence (biology); Index (typography); Data mining; Coding (social sciences); Data structure; Theoretical computer science; Search engine indexing; Mathematics; Programming language; Combinatorics; Engineering","score_opus":0.02005119448670625,"score_gpt":0.30106550752547123,"score_spread":0.281014313038765,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2884831277","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.008272073,0.0026244393,0.97630364,0.00061779824,0.00014051396,0.0007362869,0.0010451139,0.0065845456,0.0036755323],"genre_scores_gemma":[0.047951475,0.0010082573,0.94435304,0.0002281731,0.00019329281,0.00056803034,0.0016999496,0.000562435,0.0034352927],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9942731,0.0012111211,0.0009088204,0.0005508664,0.0027360492,0.000319987],"domain_scores_gemma":[0.9943467,0.0021832136,0.00040155847,0.001701544,0.0011953725,0.00017154832],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0042957435,0.0010286983,0.0024002495,0.005093918,0.0019852216,0.00512528,0.0030302873,0.0017184804,0.006146449],"category_scores_gemma":[0.015167224,0.001142227,0.0010534439,0.0071787816,0.0011658259,0.010291224,0.0037460504,0.0019297521,0.0046429364],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00043784175,0.0003898215,0.0017987385,0.0010356624,0.0001464781,0.00030825246,0.00088754494,0.0132202385,0.041066904,0.11250213,0.043109752,0.7850966],"study_design_scores_gemma":[0.00032954456,0.0008508777,0.0023825127,0.00049614883,0.00031636006,0.0022787713,0.0007870668,0.54752564,0.08094458,0.2182187,0.1455623,0.00030746264],"about_ca_topic_score_codex":0.00238147,"about_ca_topic_score_gemma":0.0029968624,"teacher_disagreement_score":0.006146449,"about_ca_system_score_codex":0.0018546194,"about_ca_system_score_gemma":0.0023586517,"threshold_uncertainty_score":0.02271831},"labels":[],"label_agreement":null},{"id":"W2897050313","doi":"10.1145/3269206.3271728","title":"Personalizing Search Results Using Hierarchical RNN with Query-aware Attention","year":2018,"lang":"en","type":"article","venue":"","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":57,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Université de Montréal","funders":"","keywords":"Computer science; Personalization; Exploit; Information retrieval; Ranking (information retrieval); Search engine; Query expansion; Web search query; Personalized search; User information; Data mining; Quality (philosophy); World Wide Web","score_opus":0.047308661750868994,"score_gpt":0.29626452760118677,"score_spread":0.24895586585031776,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2897050313","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.34426212,0.0019611148,0.6433402,0.00054997916,0.00014237313,0.00019213512,0.00044510685,0.004781292,0.0043256963],"genre_scores_gemma":[0.95287406,0.0002885176,0.044073347,0.00015645016,0.00007055569,0.00006453434,0.00040325272,0.0000763442,0.0019930177],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9995492,0.00009244767,0.000029810997,0.00017229564,0.000080282705,0.00007595355],"domain_scores_gemma":[0.9991295,0.00046927246,0.000093875715,0.00008727676,0.00017700695,0.000043094147],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0010386553,0.0009080851,0.0007252904,0.00094637304,0.00021007188,0.00043331974,0.00097635,0.00072923605,0.00081112434],"category_scores_gemma":[0.0032651005,0.00041065435,0.00070012634,0.0008609626,0.00029583919,0.0010887018,0.00049017544,0.00086358155,0.00044236396],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0005822016,0.00051979464,0.010440555,0.00020780497,0.00023164661,0.00019984657,0.0002794213,0.44866365,0.033216525,0.0020707084,0.0042385403,0.4993493],"study_design_scores_gemma":[0.0000064532965,0.000039036677,0.00089162105,0.0000033419194,0.000019510922,0.000019765399,0.000006156821,0.9969023,0.001401057,0.0005765474,0.00012876338,0.000005392826],"about_ca_topic_score_codex":0.016513968,"about_ca_topic_score_gemma":0.018668598,"teacher_disagreement_score":0.016513968,"about_ca_system_score_codex":0.0010165451,"about_ca_system_score_gemma":0.0005760325,"threshold_uncertainty_score":0.032835722},"labels":[],"label_agreement":null},{"id":"W2898655989","doi":"10.1145/3236024.3264592","title":"Vista: web test repair using computer vision","year":2018,"lang":"en","type":"article","venue":"","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":4,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of British Columbia","funders":"","keywords":"Computer science; Test (biology); World Wide Web; Human–computer interaction; Geology","score_opus":0.019126079648310902,"score_gpt":0.27947286829860823,"score_spread":0.2603467886502973,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2898655989","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.032825217,0.00088195043,0.646261,0.00038023412,0.00018955195,0.00060218637,0.0045628687,0.30810982,0.0061872024],"genre_scores_gemma":[0.262963,0.0003852882,0.70663714,0.00034658238,0.000093553324,0.0005684053,0.0155605255,0.007666355,0.005779161],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.99837327,0.0002023097,0.00012339202,0.00041590113,0.00075633783,0.00012874557],"domain_scores_gemma":[0.9961932,0.0010042931,0.00062706665,0.0011373035,0.0008253324,0.00021282479],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0013407858,0.0013585751,0.00086230616,0.005461779,0.0005164248,0.0018604357,0.0023911486,0.0013548654,0.004415715],"category_scores_gemma":[0.008364926,0.0007534045,0.0011455046,0.0017425424,0.0005794877,0.002096261,0.0017483291,0.0015013217,0.0044042296],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00041160992,0.0004167026,0.01055802,0.00041427324,0.00024524008,0.0003546809,0.0002017642,0.0207801,0.024905758,0.004002497,0.112187415,0.82552195],"study_design_scores_gemma":[0.000108697335,0.00025211333,0.008544529,0.00009002273,0.000054711265,0.0007432913,0.00013506977,0.8947471,0.05080055,0.009884621,0.034557924,0.00008141047],"about_ca_topic_score_codex":0.0062934076,"about_ca_topic_score_gemma":0.0086566005,"teacher_disagreement_score":0.0062934076,"about_ca_system_score_codex":0.0008951059,"about_ca_system_score_gemma":0.001114778,"threshold_uncertainty_score":0.0147720575},"labels":[],"label_agreement":null},{"id":"W2899794679","doi":"10.20383/101.036","title":"Derivative data for Web Archives for Longitudinal Knowledge (WALK)","year":2018,"lang":"en","type":"article","venue":"Open MIND","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":true,"ca_institutions":"","funders":"","keywords":"World Wide Web; Computer science; Data file; Hyperlink; File format; Web page; Information retrieval; Database","score_opus":0.2073289002366643,"score_gpt":0.40692249761543453,"score_spread":0.19959359737877022,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2899794679","genre_codex":"dataset","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0010226932,0.000042740645,0.0017416942,0.00020818142,0.00008063441,0.00010711244,0.98587835,0.005448118,0.0054704873],"genre_scores_gemma":[0.0036020004,0.00009069965,0.006041876,0.00009564501,0.00003126322,0.0005094521,0.97970635,0.0034467196,0.006476028],"study_design_codex":"not_applicable","study_design_gemma":"not_applicable","domain_scores_codex":[0.99745625,0.0003553449,0.0004474681,0.00036701027,0.0011214322,0.000252578],"domain_scores_gemma":[0.9711902,0.006080103,0.0023025651,0.007649262,0.011479158,0.0012986277],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0034025833,0.00075801136,0.0006385351,0.0072429017,0.0013743686,0.0037752253,0.0016491754,0.0010122953,0.13258208],"category_scores_gemma":[0.03437067,0.0008792455,0.0006266016,0.012219649,0.00047919675,0.0036167228,0.0030155142,0.0016511031,0.08569799],"study_design_candidate":"not_applicable","study_design_consensus":"not_applicable","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00014998765,0.00002952663,0.0018212877,0.00046773689,0.000021696273,0.00005907492,0.00033786157,0.0001926934,0.0003522037,0.0031773471,0.9793114,0.014079156],"study_design_scores_gemma":[0.00008479886,0.000014285538,0.0071563753,0.00022035063,0.000018547467,0.00007264591,0.00034691964,0.00031058217,0.0009228681,0.002348032,0.9884558,0.000048815993],"about_ca_topic_score_codex":0.06880875,"about_ca_topic_score_gemma":0.09452575,"teacher_disagreement_score":0.13258208,"about_ca_system_score_codex":0.0025159686,"about_ca_system_score_gemma":0.0070149135,"threshold_uncertainty_score":0.44353127},"labels":[],"label_agreement":null},{"id":"W2902584426","doi":"10.1002/pra2.2018.14505501036","title":"What's cached is prologue: Reviewing recent web archives research towards supporting scholarly use","year":2018,"lang":"en","type":"article","venue":"Proceedings of the Association for Information Science and Technology","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":6,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Toronto","funders":"","keywords":"Scholarship; Web engineering; Field (mathematics); World Wide Web; Sociotechnical system; Computer science; Data science; Web intelligence; Web development; The Internet; Knowledge management; Political science","score_opus":0.06167223104596187,"score_gpt":0.34235550684367494,"score_spread":0.28068327579771307,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2902584426","genre_codex":"review","genre_gemma":"review","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"review","genre_consensus":"review","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.016770506,0.8591914,0.004800131,0.08753607,0.003864582,0.00016192952,0.00014675799,0.00007463302,0.027453974],"genre_scores_gemma":[0.09654383,0.88415015,0.0051505757,0.009161002,0.0025710242,0.00017784956,0.00019959355,0.000118573495,0.0019275337],"study_design_codex":"design_other","study_design_gemma":"not_applicable","domain_scores_codex":[0.9857013,0.008370353,0.0018041871,0.0007171569,0.0029609962,0.00044595925],"domain_scores_gemma":[0.82525915,0.14015314,0.009933414,0.002976877,0.019617403,0.0020600941],"candidate_categories":["scholarly_communication"],"consensus_categories":[],"category_scores_codex":[0.022317126,0.0004110152,0.00095100445,0.017260918,0.0042979876,0.015567021,0.0017622766,0.0027046003,0.002790709],"category_scores_gemma":[0.08449128,0.00060379197,0.00075544417,0.018837411,0.008866586,0.01574863,0.0033189624,0.003687723,0.00090915174],"study_design_candidate":"not_applicable","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00013099512,0.00015859817,0.008470851,0.048147853,0.000172952,0.0009599753,0.06488315,0.00082357245,0.0007119586,0.093975134,0.06911957,0.7124454],"study_design_scores_gemma":[0.000011715422,0.00007367072,0.0052710455,0.07605134,0.00024816277,0.00075870554,0.061081093,0.0004572603,0.000470659,0.008744161,0.84678775,0.000044457294],"about_ca_topic_score_codex":0.012211894,"about_ca_topic_score_gemma":0.03253488,"teacher_disagreement_score":0.984433,"about_ca_system_score_codex":0.0065840962,"about_ca_system_score_gemma":0.025433013,"threshold_uncertainty_score":0.11802566},"labels":[],"label_agreement":null},{"id":"W2910789842","doi":"10.1145/3297001.3297014","title":"Root Rank","year":2019,"lang":"en","type":"article","venue":"","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":2,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":true,"ca_institutions":"","funders":"","keywords":"Computer science; Rank (graph theory); Relevance (law); Function (biology); Information retrieval; Data mining; Mathematics","score_opus":0.007677740220595694,"score_gpt":0.21568411369808355,"score_spread":0.20800637347748785,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2910789842","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.027074322,0.0040537105,0.79945457,0.0023634161,0.0012389639,0.0013957174,0.016719004,0.036915958,0.110784404],"genre_scores_gemma":[0.30190122,0.0027239018,0.5434881,0.0011273674,0.0011310725,0.0010642876,0.03451022,0.0067128357,0.107341014],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.99123865,0.0018185952,0.0006120203,0.0012318821,0.0043017333,0.0007970946],"domain_scores_gemma":[0.9821456,0.0061713555,0.0009962359,0.0061107962,0.004072924,0.00050305796],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0047052493,0.0019247083,0.0025413856,0.0058213035,0.0022861974,0.0053847106,0.00336979,0.0019128178,0.091493376],"category_scores_gemma":[0.037566133,0.0005589771,0.001101981,0.006017546,0.0010643885,0.006224695,0.0038626278,0.0018114987,0.084007084],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00058445137,0.00033404207,0.00438652,0.0010254722,0.00014298958,0.00026801665,0.00029126217,0.018381324,0.0035419287,0.11293922,0.21499132,0.64311343],"study_design_scores_gemma":[0.00038932054,0.00089026743,0.0023445718,0.00033537883,0.00015914632,0.0016634462,0.00082534784,0.24916089,0.017819118,0.29404926,0.432162,0.00020131818],"about_ca_topic_score_codex":0.0023050737,"about_ca_topic_score_gemma":0.005672167,"teacher_disagreement_score":0.091493376,"about_ca_system_score_codex":0.0012603914,"about_ca_system_score_gemma":0.0031407946,"threshold_uncertainty_score":0},"labels":[],"label_agreement":null},{"id":"W2911677306","doi":"","title":"Proceedings of the 7th international conference on Knowledge Discovery on the Web: advances in Web Mining and Web Usage Analysis","year":2005,"lang":"en","type":"article","venue":"Web Mining and Web Usage Analysis","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":0,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Alberta","funders":"","keywords":"Web mining; Computer science; World Wide Web; Web intelligence; Web standards; Data Web; Web development; Web application security; Web modeling; Web application; Knowledge extraction; The Internet; Data science; Web service; Data mining","score_opus":0.01868072246058774,"score_gpt":0.26646787436681213,"score_spread":0.24778715190622438,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2911677306","genre_codex":"methods","genre_gemma":"other","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"other","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.05158248,0.124035165,0.5568772,0.041716203,0.082311854,0.00083518977,0.0029931625,0.0049767056,0.13467199],"genre_scores_gemma":[0.14971572,0.079276904,0.27944484,0.0057384493,0.028065627,0.00052374945,0.013642335,0.0021276544,0.4414647],"study_design_codex":"design_other","study_design_gemma":"not_applicable","domain_scores_codex":[0.9976374,0.00067643315,0.00018341762,0.00033030007,0.00096860586,0.00020400202],"domain_scores_gemma":[0.99263144,0.0021073557,0.00022323577,0.00078335294,0.003183281,0.0010712098],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.005239438,0.0009914119,0.002112017,0.002320452,0.001167509,0.007103279,0.0016850934,0.0017052134,0.027483076],"category_scores_gemma":[0.0062408806,0.00047355224,0.0011299461,0.0022431784,0.0013852516,0.005050127,0.0018736351,0.0028726207,0.011465986],"study_design_candidate":"not_applicable","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0006941752,0.0007877664,0.0035560958,0.0006923442,0.00028375865,0.00044148436,0.0005240337,0.0011156464,0.007181614,0.010891611,0.29210553,0.6817259],"study_design_scores_gemma":[0.000097492346,0.00034352505,0.007303292,0.00056595483,0.0003689553,0.0011754928,0.00082204357,0.02487046,0.011263324,0.025943544,0.92713624,0.00010972885],"about_ca_topic_score_codex":0.0049095135,"about_ca_topic_score_gemma":0.009607451,"teacher_disagreement_score":0.027483076,"about_ca_system_score_codex":0.0010480309,"about_ca_system_score_gemma":0.0026799873,"threshold_uncertainty_score":0.091940045},"labels":[],"label_agreement":null},{"id":"W2911944568","doi":"","title":"Proceedings of the eleventh international workshop on Web information and data management","year":2009,"lang":"en","type":"article","venue":"","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":2,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":true,"ca_institutions":"","funders":"","keywords":"Eleventh; Computer science; Schedule; China; Library science; Online database; World Wide Web; Operations research; Political science","score_opus":0.019113299949955132,"score_gpt":0.2595063944747928,"score_spread":0.24039309452483765,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2911944568","genre_codex":"methods","genre_gemma":"other","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"other","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.013768148,0.095192485,0.5620416,0.07365408,0.09033801,0.0020818792,0.0053881574,0.011623248,0.14591232],"genre_scores_gemma":[0.050988168,0.079818115,0.28094986,0.013035219,0.023313006,0.0019130531,0.03028023,0.0056472244,0.5140551],"study_design_codex":"not_applicable","study_design_gemma":"not_applicable","domain_scores_codex":[0.9918292,0.0027966965,0.0009891203,0.0010080021,0.0027494938,0.00062744913],"domain_scores_gemma":[0.9862894,0.003906529,0.00049554376,0.0024590725,0.00419835,0.0026510537],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0118945725,0.0019359196,0.0022219084,0.0033444103,0.001770149,0.010459146,0.0033943567,0.0031218005,0.048593413],"category_scores_gemma":[0.014984785,0.001039874,0.0018013982,0.00318255,0.0018574852,0.012159983,0.005599239,0.006620525,0.028890606],"study_design_candidate":"not_applicable","study_design_consensus":"not_applicable","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00022480276,0.000378021,0.0009511916,0.00061581604,0.00012101645,0.00034718495,0.00089305616,0.00059960445,0.0036926118,0.011866792,0.6662908,0.31401893],"study_design_scores_gemma":[0.000022717526,0.00007953545,0.0008439418,0.00036645736,0.00003919416,0.00033189077,0.00035652946,0.002075589,0.0012028338,0.009356875,0.98528683,0.000037716534],"about_ca_topic_score_codex":0.0024720374,"about_ca_topic_score_gemma":0.003471446,"teacher_disagreement_score":0.048593413,"about_ca_system_score_codex":0.0015295729,"about_ca_system_score_gemma":0.0037484588,"threshold_uncertainty_score":0.16256112},"labels":[],"label_agreement":null},{"id":"W2913556077","doi":"","title":"Proceedings of the 25th International Conference on World Wide Web","year":2016,"lang":"en","type":"article","venue":"","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":635,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Université du Québec à Montréal; Université TÉLUQ","funders":"","keywords":"Computer science; World Wide Web; Track (disk drive); Social media; Consistency (knowledge bases); Personalization; Phishing; Data science; The Internet","score_opus":0.0271719921717674,"score_gpt":0.24642227199119954,"score_spread":0.21925027981943213,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2913556077","genre_codex":"other","genre_gemma":"other","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"other","genre_consensus":"other","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.014982948,0.14944874,0.10738158,0.045259796,0.16829547,0.0016861971,0.019748924,0.017656647,0.47553965],"genre_scores_gemma":[0.039638914,0.07584099,0.042643752,0.011388011,0.025027001,0.00094122253,0.049312726,0.004014378,0.7511929],"study_design_codex":"not_applicable","study_design_gemma":"not_applicable","domain_scores_codex":[0.9965071,0.0008328085,0.00033417804,0.00060748664,0.001365594,0.00035274378],"domain_scores_gemma":[0.9933648,0.0013706627,0.0003167014,0.0012758164,0.00241857,0.0012535534],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0032635569,0.0016653031,0.0023331705,0.0027376476,0.0014657212,0.009391792,0.0020198422,0.0023763506,0.14682575],"category_scores_gemma":[0.008963847,0.0005060015,0.0010511045,0.0027896543,0.0011360917,0.010217808,0.0033757542,0.0037688713,0.1359949],"study_design_candidate":"not_applicable","study_design_consensus":"not_applicable","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00008432579,0.000107697786,0.0006485438,0.0005566505,0.00006197642,0.00017002676,0.00012017764,0.00012579671,0.0018337113,0.0044394024,0.7940987,0.197753],"study_design_scores_gemma":[0.0000081828675,0.00003366674,0.00086416816,0.00022617045,0.000026001453,0.00023542554,0.00013323076,0.0006980333,0.00049232214,0.0035421143,0.9937196,0.000020966487],"about_ca_topic_score_codex":0.0018247049,"about_ca_topic_score_gemma":0.0024991457,"teacher_disagreement_score":0.14682575,"about_ca_system_score_codex":0.00094598223,"about_ca_system_score_gemma":0.002246858,"threshold_uncertainty_score":0.49118108},"labels":[],"label_agreement":null},{"id":"W2913657031","doi":"10.33633/jais.v3i1.1809","title":"An Automated Testing Framework for Cross-Browser Visual Incompatibility Detection","year":2018,"lang":"en","type":"article","venue":"Journal of Applied Intelligent System","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Alberta","funders":"","keywords":"Computer science; Automation; Web browser; Identification (biology); Web application; World Wide Web; Similarity (geometry); Software engineering; Human–computer interaction; Data science; The Internet; Artificial intelligence; Engineering; Image (mathematics)","score_opus":0.034743460626450326,"score_gpt":0.3625228491711121,"score_spread":0.32777938854466176,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2913657031","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.006344897,0.00010393,0.9852836,0.00010023209,0.000016294312,0.00024881013,0.00014385833,0.007034737,0.0007235248],"genre_scores_gemma":[0.14196539,0.00008262113,0.85576236,0.000091900634,0.00002676594,0.0002670359,0.00069369475,0.00022343775,0.00088680163],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9960157,0.00085764565,0.00039450589,0.000720818,0.0016704461,0.0003407382],"domain_scores_gemma":[0.996268,0.0013469248,0.0005233142,0.0005704188,0.001096526,0.00019482365],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0032401693,0.0012674176,0.001192082,0.004345554,0.000810534,0.0020932576,0.002794402,0.0015349523,0.0019705503],"category_scores_gemma":[0.007843474,0.00055095734,0.0019237284,0.0012299786,0.0012950611,0.0022191533,0.0021944821,0.0013706355,0.00072150363],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00036516407,0.0010915123,0.021097654,0.00057658757,0.00032829045,0.0028093816,0.0010841796,0.10442607,0.048889007,0.071765125,0.013124789,0.73444223],"study_design_scores_gemma":[0.00004579157,0.00018762746,0.0027822931,0.00008395302,0.00009874231,0.0011861407,0.00012965922,0.9407765,0.01826048,0.026654921,0.009718894,0.00007496247],"about_ca_topic_score_codex":0.008344391,"about_ca_topic_score_gemma":0.0078198165,"teacher_disagreement_score":0.008344391,"about_ca_system_score_codex":0.00097351684,"about_ca_system_score_gemma":0.0027996702,"threshold_uncertainty_score":0.017135859},"labels":[],"label_agreement":null},{"id":"W2919507111","doi":"","title":"AMBER Alerts on Facebook","year":2015,"lang":"en","type":"article","venue":"UWM Digital Commons (University of Wisconsin–Milwaukee)","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":true,"ca_institutions":"","funders":"","keywords":"Internet privacy; World Wide Web; Social media; Computer science; Advertising; Computer security; Business","score_opus":0.03709991813037335,"score_gpt":0.20484717499507454,"score_spread":0.1677472568647012,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2919507111","genre_codex":"other","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0036104454,0.00091265683,0.0011657939,0.006526164,0.0036135833,0.0003239558,0.02508772,0.019181173,0.93957853],"genre_scores_gemma":[0.013185079,0.0009886484,0.0018345611,0.0053527267,0.0015960672,0.00021591257,0.016323252,0.002752759,0.95775104],"study_design_codex":"not_applicable","study_design_gemma":"observational","domain_scores_codex":[0.9996549,0.00004147124,0.000012561955,0.000032489897,0.00014592684,0.000112657006],"domain_scores_gemma":[0.99759597,0.0002954471,0.00013328722,0.00021219804,0.0007973558,0.00096570264],"candidate_categories":["insufficient_payload"],"consensus_categories":[],"category_scores_codex":[0.00032339146,0.0011069766,0.00054696185,0.0014054539,0.002594336,0.0022383642,0.0007372164,0.0020156396,0.6144152],"category_scores_gemma":[0.0034405552,0.00043182023,0.00036165726,0.0009595462,0.00028086224,0.0031938597,0.002801179,0.0017166531,0.49540788],"study_design_candidate":"observational","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00001482901,0.0000113582655,0.0001400903,0.000016438093,7.097866e-7,0.000023339277,0.000032201136,0.000006181987,0.00003940034,0.00011499526,0.99148774,0.008112758],"study_design_scores_gemma":[0.000012280245,0.000014294189,0.0014770273,0.00006752938,0.0000032275289,0.00006564593,0.00020642734,0.00011994876,0.00016263849,0.00024559416,0.99761236,0.000013044096],"about_ca_topic_score_codex":0.018740583,"about_ca_topic_score_gemma":0.052613992,"teacher_disagreement_score":0.6144152,"about_ca_system_score_codex":0.0008375105,"about_ca_system_score_gemma":0.00079817,"threshold_uncertainty_score":0.5499898},"labels":[],"label_agreement":null},{"id":"W2920554262","doi":"10.5555/2872518.3251216","title":"Session details: OD4LS'16","year":2016,"lang":"en","type":"article","venue":"The Web Conference","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":true,"ca_institutions":"Université du Québec à Montréal","funders":"","keywords":"Computer science; World Wide Web; USable; Semantic search; Service (business); Session (web analytics); Geolocation; Semantic Web; Data science; Information retrieval","score_opus":0.03571743253908267,"score_gpt":0.2535780763176482,"score_spread":0.21786064377856557,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2920554262","genre_codex":"other","genre_gemma":"other","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"other","genre_consensus":"other","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0022198139,0.0029129942,0.02092994,0.01397854,0.04379672,0.0016918518,0.033901993,0.021330435,0.8592376],"genre_scores_gemma":[0.003918581,0.0010236946,0.005321779,0.0024250662,0.0016445596,0.00041800048,0.020304555,0.0041981502,0.9607455],"study_design_codex":"not_applicable","study_design_gemma":"not_applicable","domain_scores_codex":[0.99837554,0.00028599502,0.00007715376,0.000340834,0.000603009,0.000317408],"domain_scores_gemma":[0.9972078,0.00018745994,0.00004252063,0.00041215844,0.00095478364,0.0011951738],"candidate_categories":["insufficient_payload"],"consensus_categories":["insufficient_payload"],"category_scores_codex":[0.004562002,0.0012842127,0.0014431725,0.0011896426,0.0030909053,0.008578917,0.002654559,0.003394595,0.7312985],"category_scores_gemma":[0.0037336124,0.00053979544,0.0014664661,0.001449475,0.0006387426,0.004926406,0.0067640534,0.003105468,0.65532434],"study_design_candidate":"not_applicable","study_design_consensus":"not_applicable","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0001506535,0.000068730194,0.000097903634,0.00013778397,0.000005769237,0.000024786206,0.000044169086,0.00008063439,0.0006287153,0.0016597809,0.9610777,0.03602325],"study_design_scores_gemma":[0.00001973994,0.000016691432,0.00009364747,0.00003157347,0.0000019345669,0.000009138844,0.00004519349,0.00009692249,0.00015345248,0.00036581236,0.9991604,0.0000056116237],"about_ca_topic_score_codex":0.007253411,"about_ca_topic_score_gemma":0.016179567,"teacher_disagreement_score":0.2687015,"about_ca_system_score_codex":0.002754925,"about_ca_system_score_gemma":0.0037406979,"threshold_uncertainty_score":0.38327003},"labels":[],"label_agreement":null},{"id":"W2927581056","doi":"10.1007/978-3-030-14799-0_7","title":"Robust Web Data Extraction Based on Unsupervised Visual Validation","year":2019,"lang":"en","type":"book-chapter","venue":"Lecture notes in computer science","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":6,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Université du Québec à Montréal","funders":"Natural Sciences and Engineering Research Council of Canada","keywords":"Computer science; Extractor; Robustness (evolution); Artificial intelligence; Data extraction; Information extraction; Information retrieval; Data mining; Machine learning","score_opus":0.05360116226821633,"score_gpt":0.28637844600660023,"score_spread":0.2327772837383839,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2927581056","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.014935451,0.00024794508,0.97674567,0.00006921817,0.000057789075,0.00011639585,0.0003946301,0.006026827,0.0014061775],"genre_scores_gemma":[0.23442972,0.00030112188,0.75521773,0.00015930152,0.00006812705,0.0003138645,0.0031986388,0.0015786946,0.0047327946],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9972916,0.00044924297,0.00019667773,0.0005923219,0.0012623229,0.00020777887],"domain_scores_gemma":[0.9935767,0.0019894626,0.00045278488,0.0016909086,0.0021938328,0.000096280535],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0022946007,0.0009271901,0.0011430314,0.00466042,0.00061279256,0.0032901447,0.0019941565,0.0012255703,0.0027027514],"category_scores_gemma":[0.0074673053,0.00059637055,0.0014706292,0.0024556161,0.00094806374,0.0023922431,0.002623857,0.001076289,0.0031536794],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00036289112,0.00019593429,0.003540768,0.00025159807,0.00014724441,0.00016161459,0.000121205914,0.01606132,0.09394462,0.0039804913,0.006829635,0.87440264],"study_design_scores_gemma":[0.00004546901,0.0001109167,0.0056071207,0.000090785295,0.00009204679,0.00047620313,0.00013551141,0.82168955,0.14970219,0.011659332,0.01031326,0.000077561],"about_ca_topic_score_codex":0.0023281523,"about_ca_topic_score_gemma":0.002930873,"teacher_disagreement_score":0.00466042,"about_ca_system_score_codex":0.00052647956,"about_ca_system_score_gemma":0.0010789062,"threshold_uncertainty_score":0.012135148},"labels":[],"label_agreement":null},{"id":"W2929109815","doi":"10.1007/978-3-030-15712-8_17","title":"Predicting the Topic of Your Next Query for Just-In-Time IR","year":2019,"lang":"en","type":"book-chapter","venue":"Lecture notes in computer science","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":3,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Toronto Metropolitan University","funders":"","keywords":"Computer science; Query optimization; Information retrieval; Data mining","score_opus":0.03061626623356764,"score_gpt":0.259551514599702,"score_spread":0.22893524836613435,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2929109815","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.1806618,0.011621759,0.7645444,0.0036109507,0.002378061,0.00060321996,0.005682321,0.016292455,0.014604995],"genre_scores_gemma":[0.5423426,0.0038012895,0.41089705,0.00062540534,0.0026882258,0.00025451937,0.012567221,0.0010922241,0.025731413],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.999218,0.00022287262,0.00006712872,0.00016857596,0.000206622,0.00011669446],"domain_scores_gemma":[0.9984408,0.000885989,0.000062789404,0.00021521773,0.0002791605,0.00011607181],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0017327507,0.0010651245,0.0015010886,0.0018542503,0.00072057603,0.0019415721,0.0012551825,0.0014252111,0.00936162],"category_scores_gemma":[0.0037591872,0.00036987584,0.0010104298,0.001561993,0.00039321123,0.002847171,0.0008030353,0.0013243172,0.0054388316],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0021643955,0.0006842042,0.0075157816,0.0006058607,0.00016172201,0.00028529234,0.00016887882,0.016873427,0.08251438,0.0047690053,0.08026099,0.80399615],"study_design_scores_gemma":[0.00014590961,0.0006590239,0.0048160367,0.000048810387,0.00022229088,0.0007831649,0.00022459801,0.9396094,0.024086576,0.014709249,0.01461812,0.00007686161],"about_ca_topic_score_codex":0.0024992705,"about_ca_topic_score_gemma":0.004900248,"teacher_disagreement_score":0.00936162,"about_ca_system_score_codex":0.0004643843,"about_ca_system_score_gemma":0.0010709893,"threshold_uncertainty_score":0.03131777},"labels":[],"label_agreement":null},{"id":"W2942423334","doi":"","title":"Unsupervised Deep Learning Recommender System for Personal Computer Users","year":2017,"lang":"en","type":"article","venue":"International Conference on Intelligent Systems","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":0,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Ottawa","funders":"","keywords":"Recommender system; Computer science; Deep learning; Unsupervised learning; Artificial intelligence; World Wide Web; Multimedia","score_opus":0.10358797581995478,"score_gpt":0.3226185428700852,"score_spread":0.2190305670501304,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2942423334","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.45603225,0.004034233,0.51986957,0.0021422643,0.00063351373,0.00029285834,0.0044885017,0.0052627553,0.0072441013],"genre_scores_gemma":[0.9062518,0.0006191278,0.07781033,0.00027493903,0.00019375025,0.00008626106,0.0029145947,0.000059075108,0.011790226],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9994073,0.0001434523,0.00003966437,0.0001777893,0.00014695727,0.00008492923],"domain_scores_gemma":[0.9986197,0.0004222568,0.00008206183,0.00020412325,0.0005798193,0.000092001435],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0010041705,0.000608157,0.0009374008,0.0013244099,0.00056726026,0.00061390153,0.0011814951,0.0011621154,0.0020062411],"category_scores_gemma":[0.0024296157,0.0003058973,0.0006266772,0.0007610792,0.00015242276,0.0010369009,0.00058889214,0.0010006106,0.0014699544],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0013534843,0.0022825198,0.06686556,0.00030037714,0.0007573419,0.00036062894,0.00021631537,0.06300672,0.018784558,0.002860401,0.042407412,0.80080456],"study_design_scores_gemma":[0.000028703804,0.00015047581,0.0059900717,0.00001569647,0.00011903639,0.00010200382,0.000036759848,0.98826015,0.0025573226,0.0010552045,0.0016609296,0.000023695246],"about_ca_topic_score_codex":0.019402424,"about_ca_topic_score_gemma":0.057626378,"teacher_disagreement_score":0.019402424,"about_ca_system_score_codex":0.00066570804,"about_ca_system_score_gemma":0.0009711911,"threshold_uncertainty_score":0.038578987},"labels":[],"label_agreement":null},{"id":"W2952865927","doi":"10.1109/iri.2016.66","title":"Rapid Prototyping of a Text Mining Application for Cryptocurrency Market Intelligence","year":2016,"lang":"en","type":"preprint","venue":"","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"York University; Seneca Polytechnic","funders":"","keywords":"Cryptocurrency; Sentiment analysis; Computer science; Analytics; Data science; Cloud computing; Blockchain; Pipeline (software); Big data; Formal concept analysis; Scale (ratio); Software; Social media; Software engineering; World Wide Web; Artificial intelligence; Computer security; Data mining; Operating system","score_opus":0.03646573168083288,"score_gpt":0.29615409659209785,"score_spread":0.25968836491126496,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2952865927","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.089330025,0.00054710155,0.6911955,0.0024777255,0.0006648914,0.0033203696,0.007197423,0.18609081,0.019176107],"genre_scores_gemma":[0.29541582,0.00046273498,0.66844493,0.00061684265,0.00019663069,0.0011964034,0.008301011,0.0046166196,0.020749068],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.99888307,0.0002299889,0.00010049684,0.00023904459,0.00046703807,0.00008042125],"domain_scores_gemma":[0.9965389,0.0019891069,0.00012715887,0.0004199047,0.0006824276,0.00024262135],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0021637392,0.0009191901,0.0006438663,0.0018362523,0.0005369692,0.0017139603,0.0018581924,0.0009919084,0.015153008],"category_scores_gemma":[0.0058344905,0.0004826843,0.0005679985,0.0012397002,0.00040043084,0.002899771,0.001036767,0.0013238266,0.0061390926],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0017095759,0.0014403365,0.008523703,0.0014795739,0.00040377284,0.0032190443,0.0018067425,0.020537844,0.13400404,0.015381453,0.11609993,0.6953939],"study_design_scores_gemma":[0.0005217474,0.0005416451,0.006090442,0.00019941397,0.00008904118,0.0009100885,0.0004561437,0.76268476,0.08812607,0.015995596,0.12424835,0.00013681466],"about_ca_topic_score_codex":0.0016801088,"about_ca_topic_score_gemma":0.0025042123,"teacher_disagreement_score":0.015153008,"about_ca_system_score_codex":0.00046648685,"about_ca_system_score_gemma":0.0008297232,"threshold_uncertainty_score":0.050691903},"labels":[],"label_agreement":null},{"id":"W2956462957","doi":"10.1109/compsac.2019.00070","title":"Xu: An Automated Query Expansion and Optimization Tool","year":2019,"lang":"en","type":"preprint","venue":"","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":7,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Gnowit (Canada); Queen's University","funders":"","keywords":"Computer science; Query expansion; Information retrieval; Scalability; Query optimization; Set (abstract data type); Precision and recall; Noise (video); Search engine; Similarity (geometry); Data mining; Semantic similarity; Artificial intelligence; Database","score_opus":0.018104118413940603,"score_gpt":0.27206039722684916,"score_spread":0.25395627881290855,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2956462957","genre_codex":"methods","genre_gemma":"software","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"software","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.010738122,0.00070275966,0.74474645,0.00021155919,0.000060680628,0.00041502126,0.0032233587,0.23816456,0.0017374925],"genre_scores_gemma":[0.11503632,0.000495765,0.86097497,0.00044111427,0.00007881032,0.0009517928,0.010367941,0.0077701,0.0038832184],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.997693,0.0006355966,0.00030158358,0.00047233657,0.000743145,0.00015426139],"domain_scores_gemma":[0.99748755,0.0015769212,0.00016959953,0.00028708996,0.00040999762,0.000068843336],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0020965342,0.0020587416,0.0014654861,0.002793982,0.00055895734,0.0013955343,0.001984756,0.0009592052,0.008766429],"category_scores_gemma":[0.008769255,0.000802885,0.0014423219,0.0024524853,0.0005098534,0.0026329898,0.0021524336,0.0011549372,0.0040015434],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0018547984,0.0003262808,0.00442575,0.0018390282,0.00035835872,0.0006172487,0.0007642966,0.021001881,0.059755422,0.009888528,0.118570566,0.78059787],"study_design_scores_gemma":[0.00056137226,0.0008058852,0.0038157895,0.000113190006,0.00014022627,0.0010542034,0.00047060061,0.8113702,0.09592757,0.01464071,0.07087789,0.00022232757],"about_ca_topic_score_codex":0.0029549482,"about_ca_topic_score_gemma":0.0028319815,"teacher_disagreement_score":0.008766429,"about_ca_system_score_codex":0.0005440058,"about_ca_system_score_gemma":0.00107834,"threshold_uncertainty_score":0.029326677},"labels":[],"label_agreement":null},{"id":"W2962970579","doi":"10.33965/ijwi_2018161201","title":"REAL-TIME BROWSING ASSISTANT ON WEB","year":2018,"lang":"en","type":"article","venue":"IADIS INTERNATIONAL JOURNAL ON WWW/INTERNET","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Alberta","funders":"","keywords":"Computer science; World Wide Web","score_opus":0.018560809903932454,"score_gpt":0.2843157343075571,"score_spread":0.26575492440362464,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2962970579","genre_codex":"methods","genre_gemma":"software","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"software","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.37709683,0.00046272713,0.5559835,0.00027372644,0.000042894288,0.0002723446,0.00096462324,0.06035389,0.004549487],"genre_scores_gemma":[0.7905197,0.00016094887,0.20231853,0.00014335061,0.000031706433,0.00010757845,0.00085769297,0.0002426816,0.0056177583],"study_design_codex":"design_other","study_design_gemma":"not_applicable","domain_scores_codex":[0.9995296,0.0001106699,0.000033132615,0.00015926649,0.00013748552,0.000029858697],"domain_scores_gemma":[0.9986627,0.00055309397,0.00013283658,0.0002918162,0.00023110818,0.00012847305],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.00066607835,0.00039281487,0.00051287276,0.000494361,0.00024993333,0.0005053364,0.00069106685,0.00053253985,0.0021860672],"category_scores_gemma":[0.0021538425,0.00021565972,0.00025025188,0.00031015478,0.00011147648,0.00077155273,0.0004982207,0.00045182608,0.001181708],"study_design_candidate":"not_applicable","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0021262132,0.001022389,0.023622125,0.00043925294,0.000110673755,0.0013428761,0.0015033878,0.022332402,0.09749537,0.002386048,0.013906477,0.8337127],"study_design_scores_gemma":[0.00010998906,0.00039571768,0.014041223,0.00004069673,0.00009662418,0.0013232231,0.00030322012,0.9240165,0.040717155,0.0029696326,0.015888667,0.00009736168],"about_ca_topic_score_codex":0.0019108643,"about_ca_topic_score_gemma":0.003028713,"teacher_disagreement_score":0.0021860672,"about_ca_system_score_codex":0.00016144894,"about_ca_system_score_gemma":0.00039938345,"threshold_uncertainty_score":0.0073130727},"labels":[],"label_agreement":null},{"id":"W2963451689","doi":"","title":"SocialScope: Enabling Information Discovery on Social Content Sites","year":2009,"lang":"en","type":"article","venue":"","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":35,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of British Columbia","funders":"","keywords":"Computer science; World Wide Web; Presentation (obstetrics); Data science; Information sharing; Content management; Knowledge management","score_opus":0.05891721385290173,"score_gpt":0.27186466543494436,"score_spread":0.21294745158204265,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2963451689","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0072849435,0.00015761488,0.9825156,0.0008247097,0.00004051369,0.00029624836,0.0002776681,0.002697592,0.0059050913],"genre_scores_gemma":[0.15380536,0.00052177743,0.83866,0.00019391735,0.00009991496,0.0004059228,0.001147391,0.00028622977,0.004879454],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9940713,0.0022183475,0.00049314875,0.0007593831,0.0020645806,0.00039317174],"domain_scores_gemma":[0.99185973,0.0032556003,0.0006332854,0.0026513254,0.0010805647,0.0005195243],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0056119175,0.0006363692,0.0008432532,0.0033316985,0.002880103,0.0069370517,0.0031421818,0.0016009293,0.0044117467],"category_scores_gemma":[0.015304371,0.0010103125,0.0016366823,0.0046040467,0.004339952,0.014052221,0.008920477,0.0023461774,0.0017272597],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00014057427,0.00017329708,0.0026390576,0.00030575116,0.00007792689,0.0003391588,0.00071711774,0.027862323,0.006164516,0.8368026,0.012497588,0.11228005],"study_design_scores_gemma":[0.000100348705,0.000119036195,0.00097568025,0.00010928679,0.00008595043,0.0004826772,0.0005422861,0.4323016,0.014595282,0.44100735,0.109580584,0.000099951576],"about_ca_topic_score_codex":0.006690759,"about_ca_topic_score_gemma":0.0094742505,"teacher_disagreement_score":0.0069370517,"about_ca_system_score_codex":0.0021723362,"about_ca_system_score_gemma":0.003685896,"threshold_uncertainty_score":0.029679},"labels":[],"label_agreement":null},{"id":"W2964559961","doi":"10.29173/cais760","title":"From Editors' Choice to Readers’ Favorites: Analyzing Server Logs of China's Biggest Online Newspaper","year":2013,"lang":"fr","type":"article","venue":"Proceedings of the Annual Conference of CAIS / Actes du congrès annuel de l ACSI","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":4,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":true,"route_about_ca":false,"ca_institutions":"Western University","funders":"","keywords":"Newspaper; China; Ligne; History; Art; Humanities; Advertising; Business; Archaeology","score_opus":0.029254216231583835,"score_gpt":0.25829464710775796,"score_spread":0.22904043087617412,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2964559961","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.99573874,0.00011110491,0.00027857974,0.00009206889,0.000017095163,0.000028167424,0.0024111609,0.0000933996,0.0012296534],"genre_scores_gemma":[0.99381423,0.00010889397,0.00048046227,0.000035297784,0.00004370499,0.000038417355,0.00351146,0.00002621603,0.0019413311],"study_design_codex":"observational","study_design_gemma":"observational","domain_scores_codex":[0.99889886,0.0001578885,0.000106372776,0.00020978718,0.00047418033,0.00015296834],"domain_scores_gemma":[0.9871361,0.0054492783,0.0026810614,0.0007320148,0.002651888,0.001349617],"candidate_categories":["bibliometrics"],"consensus_categories":[],"category_scores_codex":[0.0011039238,0.00037017776,0.00044846864,0.0039808876,0.00061246095,0.0017780191,0.00040821993,0.0004072659,0.0013898138],"category_scores_gemma":[0.00776534,0.00024022542,0.00015991283,0.003740339,0.00033294724,0.0011294052,0.0006291764,0.00041340338,0.0010134358],"study_design_candidate":"observational","study_design_consensus":"observational","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0002478888,0.00019945113,0.94358283,0.00015397387,0.00005803805,0.00056328584,0.0060896864,0.0002980305,0.0034532615,0.00012841451,0.0034719205,0.041753188],"study_design_scores_gemma":[0.00000724072,0.00006531332,0.986437,0.000017442359,0.000031338535,0.00014875346,0.003376026,0.004015149,0.0022931176,0.000080734906,0.0035029822,0.000024783474],"about_ca_topic_score_codex":0.019775964,"about_ca_topic_score_gemma":0.028724493,"teacher_disagreement_score":0.9960191,"about_ca_system_score_codex":0.00069687795,"about_ca_system_score_gemma":0.0010215805,"threshold_uncertainty_score":0.03932172},"labels":[],"label_agreement":null},{"id":"W2967988912","doi":"10.1093/acrefore/9780190228613.013.792","title":"Content Management Systems and Journalism","year":2019,"lang":"en","type":"reference-entry","venue":"Oxford Research Encyclopedia of Communication","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":5,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Université de Montréal","funders":"","keywords":"Publication; World Wide Web; Terminology; The Internet; Journalism; New media; Process (computing); Computer science; Media studies; Sociology; Business; Advertising","score_opus":0.10418278642400082,"score_gpt":0.34742459579458185,"score_spread":0.24324180937058104,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2967988912","genre_codex":"other","genre_gemma":"other","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"other","genre_consensus":"other","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.13911924,0.016378365,0.06302007,0.06785825,0.0016413596,0.00031172897,0.00045026967,0.0008208278,0.7103999],"genre_scores_gemma":[0.96877384,0.0028118286,0.010277914,0.0011879584,0.0014133351,0.00013434528,0.0001852722,0.00011237328,0.015103118],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"not_applicable","domain_scores_codex":[0.9884644,0.0076359436,0.0007203644,0.0010608584,0.0016175471,0.0005009558],"domain_scores_gemma":[0.93132025,0.047142137,0.00802698,0.005305515,0.0052298377,0.0029753041],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.010844458,0.0003194575,0.0003802438,0.0058096144,0.0054951212,0.018704506,0.0014500205,0.0024994286,0.010786383],"category_scores_gemma":[0.032832813,0.00042209987,0.00037542588,0.0048120995,0.0144339055,0.014320699,0.005637943,0.0017284226,0.001270669],"study_design_candidate":"not_applicable","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.000042079908,0.000085750056,0.0027156137,0.00022761985,0.000020734085,0.00020498499,0.009989747,0.00064172514,0.00059232354,0.9413448,0.007299516,0.036835],"study_design_scores_gemma":[0.00008513231,0.00009721507,0.003957737,0.00042727054,0.000030639625,0.00045176366,0.010776693,0.0049336986,0.0013410486,0.7296923,0.24815597,0.000050538707],"about_ca_topic_score_codex":0.0012760614,"about_ca_topic_score_gemma":0.00061453664,"teacher_disagreement_score":0.018704506,"about_ca_system_score_codex":0.0063968976,"about_ca_system_score_gemma":0.0035724775,"threshold_uncertainty_score":0.05735165},"labels":[],"label_agreement":null},{"id":"W2977307372","doi":"","title":"Migrating GWT to Angular 6 using MDE","year":2019,"lang":"en","type":"preprint","venue":"HAL (Le Centre pour la Communication Scientifique Directe)","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Berger (Canada)","funders":"","keywords":"Computer science; Java; Programming language; XML; Abstraction; Focus (optics); TypeScript; Context (archaeology); World Wide Web; Web application; Web page","score_opus":0.020418893573933505,"score_gpt":0.24571821664801277,"score_spread":0.22529932307407927,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2977307372","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.05347332,0.00077800284,0.57971585,0.001210929,0.0024061904,0.00037494747,0.0112427045,0.27446577,0.076332256],"genre_scores_gemma":[0.3387249,0.00066364056,0.5154081,0.0009667934,0.00038723694,0.00041879405,0.036839135,0.048098672,0.058492776],"study_design_codex":"design_other","study_design_gemma":"not_applicable","domain_scores_codex":[0.99901485,0.00012136824,0.000067834546,0.00019184913,0.00039855542,0.00020543089],"domain_scores_gemma":[0.9984957,0.00024601963,0.000041866093,0.00083314005,0.00025220832,0.00013100728],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0008907477,0.0013386919,0.0010052114,0.0017799786,0.00074964,0.0028882886,0.0022401784,0.0010637672,0.06528453],"category_scores_gemma":[0.006975079,0.00067394186,0.0018009756,0.0018305419,0.00082201225,0.0034365032,0.0059702503,0.0017209526,0.02743456],"study_design_candidate":"not_applicable","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0034791094,0.0005306928,0.006472454,0.0007227582,0.00030468847,0.00095252256,0.0006142339,0.05400404,0.024838086,0.05189645,0.29708615,0.5590988],"study_design_scores_gemma":[0.0005300736,0.00026238294,0.0021365858,0.00019207882,0.00011893835,0.0003450306,0.0005451752,0.4546333,0.03848643,0.08406104,0.4185318,0.00015723493],"about_ca_topic_score_codex":0.0046992847,"about_ca_topic_score_gemma":0.0072307303,"teacher_disagreement_score":0.06528453,"about_ca_system_score_codex":0.0006577969,"about_ca_system_score_gemma":0.0011432153,"threshold_uncertainty_score":0.21839845},"labels":[],"label_agreement":null},{"id":"W2978766144","doi":"","title":"LibGuides: Canadian Business: Data/Statistics","year":2010,"lang":"en","type":"libguides","venue":"","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":0,"is_retracted":false,"has_abstract":false,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":true,"ca_institutions":"","funders":"","keywords":"Statistics; Business statistics; Computer science; Data science; Mathematics","score_opus":0.03706926848245962,"score_gpt":0.2693066887681571,"score_spread":0.2322374202856975,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2978766144","genre_codex":"dataset","genre_gemma":"other","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"other","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.002051714,0.0020619417,0.014362641,0.0038120921,0.0006707641,0.00023441145,0.5463626,0.07868421,0.35175967],"genre_scores_gemma":[0.017767053,0.0048634256,0.034585338,0.0011176334,0.00039436785,0.00045380212,0.47096738,0.03920638,0.4306446],"study_design_codex":"not_applicable","study_design_gemma":"not_applicable","domain_scores_codex":[0.99629515,0.00017804667,0.00022364002,0.00033448855,0.0026203394,0.0003482821],"domain_scores_gemma":[0.98349667,0.0020236648,0.0005167439,0.0018541304,0.011094698,0.0010140296],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0019769245,0.0022264237,0.0016708155,0.01166527,0.0033111067,0.009569666,0.0032575054,0.0015135803,0.28974357],"category_scores_gemma":[0.020197095,0.0015788255,0.00083776383,0.034921955,0.0012070363,0.0044571604,0.0022402424,0.0025744839,0.19691423],"study_design_candidate":"not_applicable","study_design_consensus":"not_applicable","about_ca_topic_candidate":true,"about_ca_topic_consensus":true,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.000025989619,0.000013104906,0.00041525532,0.00009997494,0.000007525005,0.000017951186,0.000045161098,0.00016555942,0.00008299563,0.0036945709,0.9529938,0.04243799],"study_design_scores_gemma":[0.000036988233,0.000007119032,0.0023101978,0.00019741557,0.000021018375,0.000060652565,0.00012554842,0.0020800864,0.0011096804,0.006094329,0.98790073,0.00005625329],"about_ca_topic_score_codex":0.8439329,"about_ca_topic_score_gemma":0.82979536,"teacher_disagreement_score":0.28974357,"about_ca_system_score_codex":0.015902884,"about_ca_system_score_gemma":0.057640567,"threshold_uncertainty_score":0.9692888},"labels":[],"label_agreement":null},{"id":"W2990948754","doi":"10.5220/0009367504010409","title":"Learning to Determine the Quality of News Headlines","year":2020,"lang":"en","type":"article","venue":"","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":3,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":true,"ca_institutions":"York University","funders":"","keywords":"Headline; Quality (philosophy); Dwell time; User engagement; Clickstream; Topic model","score_opus":0.09879043369962427,"score_gpt":0.33085551225760934,"score_spread":0.23206507855798508,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2990948754","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.7194391,0.0024809828,0.26007074,0.0012593945,0.00018856322,0.0001633378,0.005193598,0.0054902826,0.0057140207],"genre_scores_gemma":[0.96745324,0.0004383207,0.023488047,0.00015113097,0.0001571915,0.000064815904,0.0049238806,0.00008068647,0.0032425544],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.99962413,0.00005709205,0.000037312206,0.00015512096,0.000074668,0.00005164733],"domain_scores_gemma":[0.99721885,0.0014194294,0.00054452807,0.00013671868,0.0005544562,0.00012594729],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.00070119643,0.0007166728,0.00055526977,0.001975368,0.0002145346,0.000852936,0.00068598473,0.0007748743,0.0011428636],"category_scores_gemma":[0.00452331,0.00028576032,0.00043433622,0.0011432443,0.00039862288,0.001336439,0.0004197353,0.0010784284,0.0010597208],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00096771534,0.0010729638,0.15663047,0.0005910439,0.00027795826,0.0005016215,0.000696892,0.12765956,0.015943298,0.0017879175,0.020258058,0.6736125],"study_design_scores_gemma":[0.000029116907,0.00010488771,0.017565211,0.00003493792,0.000065562665,0.00007565968,0.0000759293,0.9743773,0.0044672666,0.0014105882,0.0017758803,0.000017696795],"about_ca_topic_score_codex":0.010161789,"about_ca_topic_score_gemma":0.015507346,"teacher_disagreement_score":0.010161789,"about_ca_system_score_codex":0.0008289902,"about_ca_system_score_gemma":0.00060750335,"threshold_uncertainty_score":0.02020526},"labels":[],"label_agreement":null},{"id":"W2993628941","doi":"","title":"Save Searching Time with Google Shortcuts.","year":2005,"lang":"en","type":"article","venue":"Teacher librarian","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":0,"is_retracted":false,"has_abstract":false,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":true,"route_about_ca":false,"ca_institutions":"","funders":"","keywords":"World Wide Web; Computer science; Information retrieval; Data science; Multimedia","score_opus":0.009455080652237442,"score_gpt":0.20360863922889794,"score_spread":0.1941535585766605,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2993628941","genre_codex":"software","genre_gemma":"commentary","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"commentary","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.025776925,0.003918565,0.050179027,0.0036256842,0.0021529798,0.000606861,0.11293729,0.711063,0.08973966],"genre_scores_gemma":[0.1537427,0.004468267,0.29789755,0.0023468197,0.0010264416,0.0009526353,0.29494715,0.10795227,0.13666615],"study_design_codex":"not_applicable","study_design_gemma":"not_applicable","domain_scores_codex":[0.99798787,0.00021297285,0.00019484085,0.00027584247,0.0010139208,0.00031451945],"domain_scores_gemma":[0.99161196,0.0024591137,0.00037751687,0.002381087,0.002359682,0.0008105291],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0010866403,0.0031462724,0.0016981895,0.0082872985,0.0010845873,0.003922274,0.0030346927,0.0018795549,0.0931075],"category_scores_gemma":[0.016326506,0.0013132059,0.0016903791,0.010138625,0.0003927613,0.0066782157,0.0026928524,0.0014602747,0.08068557],"study_design_candidate":"not_applicable","study_design_consensus":"not_applicable","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0008918753,0.0001586378,0.0021632211,0.0005475706,0.00008125044,0.00018565042,0.00020180801,0.00033464038,0.0019236483,0.002348619,0.7466129,0.24455023],"study_design_scores_gemma":[0.0007717954,0.00028957875,0.013492591,0.0006767066,0.0002750397,0.0010131281,0.00090749905,0.023986485,0.019839553,0.025546212,0.9128422,0.00035920995],"about_ca_topic_score_codex":0.01749661,"about_ca_topic_score_gemma":0.032125678,"teacher_disagreement_score":0.0931075,"about_ca_system_score_codex":0.00089270325,"about_ca_system_score_gemma":0.0022589045,"threshold_uncertainty_score":0.31147557},"labels":[],"label_agreement":null},{"id":"W3008190682","doi":"10.1109/bigdata47090.2019.9006564","title":"An Intelligent Class: The Development Of A Novel Context Capturing Framework Supporting The Functional Auto-Classification Of Records","year":2019,"lang":"en","type":"article","venue":"","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":4,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of British Columbia","funders":"","keywords":"Computer science; Context (archaeology); Precision and recall; Artificial intelligence; Operationalization; Recall; Class (philosophy); Feature (linguistics); Focus (optics); Machine learning; Data mining","score_opus":0.059878684111262424,"score_gpt":0.2894482548941413,"score_spread":0.22956957078287885,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W3008190682","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0045551164,0.00012544771,0.9897307,0.0003946642,0.000058836886,0.00015564826,0.0003066257,0.0028997564,0.0017732001],"genre_scores_gemma":[0.055265624,0.00015332164,0.9408008,0.0002405945,0.000089920046,0.0001733071,0.0005952227,0.00031007937,0.0023711605],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9965065,0.000500948,0.00034927775,0.0010576834,0.0013569098,0.00022877137],"domain_scores_gemma":[0.9962909,0.0010907456,0.0005230326,0.0011542795,0.000704602,0.00023635122],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0031991287,0.0005437235,0.0010465068,0.0023060718,0.0012782722,0.0047313077,0.002818379,0.0011590845,0.0022543224],"category_scores_gemma":[0.007974789,0.00056431047,0.0014267877,0.0019494802,0.0014528857,0.0075136023,0.0030060902,0.002023242,0.0009711448],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.000343013,0.00038431754,0.012724587,0.00051294925,0.00015533803,0.00058077084,0.0030615348,0.015893042,0.021282574,0.3427971,0.020065844,0.5821989],"study_design_scores_gemma":[0.000071621645,0.00025407303,0.0059748837,0.00030483078,0.00021765432,0.0011938569,0.000863502,0.5945441,0.043727007,0.19073774,0.16189739,0.00021325253],"about_ca_topic_score_codex":0.0055615352,"about_ca_topic_score_gemma":0.009723497,"teacher_disagreement_score":0.0055615352,"about_ca_system_score_codex":0.0012969668,"about_ca_system_score_gemma":0.0029487174,"threshold_uncertainty_score":0.016918838},"labels":[],"label_agreement":null},{"id":"W3011888447","doi":"10.1145/3343413.3377986","title":"Spectator","year":2020,"lang":"en","type":"article","venue":"","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Cisco Systems (Canada)","funders":"","keywords":"Computer science; Context (archaeology); Task (project management); World Wide Web; Sample (material); Information retrieval; Human–computer interaction; Bundle","score_opus":0.02265543935394646,"score_gpt":0.206615565636449,"score_spread":0.18396012628250255,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W3011888447","genre_codex":"methods","genre_gemma":"other","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"other","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.018675981,0.0010137341,0.5255692,0.0033380487,0.0014362232,0.0010342805,0.011688446,0.30846024,0.12878387],"genre_scores_gemma":[0.13662396,0.0009626943,0.4173475,0.003247992,0.0006680361,0.0010459772,0.032314703,0.10127928,0.30650976],"study_design_codex":"not_applicable","study_design_gemma":"not_applicable","domain_scores_codex":[0.9980677,0.00043961732,0.000116966556,0.0006949339,0.0004891786,0.00019176377],"domain_scores_gemma":[0.9911992,0.0021197912,0.00027148015,0.0031700043,0.0022792467,0.0009603188],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.003748069,0.0016240468,0.0014232221,0.0020133234,0.0011781984,0.0042662,0.002772683,0.0017545252,0.13005775],"category_scores_gemma":[0.013232774,0.0010695216,0.001414436,0.0013131828,0.0010608096,0.0067078783,0.007484455,0.0021110957,0.07640873],"study_design_candidate":"not_applicable","study_design_consensus":"not_applicable","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0016310456,0.00020211763,0.006476989,0.00078802253,0.00014182855,0.00068266375,0.004068034,0.0011277819,0.021160372,0.026220007,0.5885983,0.34890285],"study_design_scores_gemma":[0.00018991237,0.00022717529,0.002669795,0.00019192664,0.00007045433,0.0008881147,0.00085268234,0.017589074,0.017870635,0.010810597,0.9484927,0.0001470122],"about_ca_topic_score_codex":0.003550491,"about_ca_topic_score_gemma":0.0077915327,"teacher_disagreement_score":0.13005775,"about_ca_system_score_codex":0.0010342333,"about_ca_system_score_gemma":0.0014687902,"threshold_uncertainty_score":0},"labels":[],"label_agreement":null},{"id":"W3020829086","doi":"","title":"A survey of utilizing user-reviews posted on Google play store.","year":2019,"lang":"en","type":"article","venue":"Conference of the Centre for Advanced Studies on Collaborative Research","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":14,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Toronto; Queen's University","funders":"","keywords":"Computer science; World Wide Web; Database","score_opus":0.22437945805730564,"score_gpt":0.4353966868680049,"score_spread":0.2110172288106993,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W3020829086","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.9264748,0.026884219,0.0023195322,0.001680895,0.0003814211,0.00029473755,0.015883744,0.0005522562,0.025528299],"genre_scores_gemma":[0.9620924,0.012101147,0.0029142261,0.00080246676,0.0002830811,0.00019914111,0.009686815,0.00017339805,0.011747438],"study_design_codex":"observational","study_design_gemma":"observational","domain_scores_codex":[0.9933763,0.0018798698,0.000617952,0.00047590694,0.0033220935,0.00032789118],"domain_scores_gemma":[0.9553579,0.019158483,0.007521149,0.0015964246,0.014785853,0.0015801867],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.003435845,0.000465696,0.0004904601,0.0077003054,0.0008581701,0.002633631,0.0006530823,0.0006503022,0.002715702],"category_scores_gemma":[0.025040463,0.0002398375,0.0004230534,0.007150419,0.0003427573,0.0025182015,0.00083966914,0.00043068087,0.0026893395],"study_design_candidate":"observational","study_design_consensus":"observational","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00047438222,0.00028788875,0.70073634,0.003233627,0.00034027468,0.0005509854,0.007343246,0.00012648485,0.00327207,0.000549053,0.045952186,0.2371334],"study_design_scores_gemma":[0.000009738166,0.00031270573,0.89512455,0.00080387597,0.00018888978,0.0014259869,0.008643779,0.0010279034,0.0019177136,0.00010356605,0.09034742,0.00009380536],"about_ca_topic_score_codex":0.01008632,"about_ca_topic_score_gemma":0.027069246,"teacher_disagreement_score":0.01008632,"about_ca_system_score_codex":0.0005689928,"about_ca_system_score_gemma":0.0009499082,"threshold_uncertainty_score":0.020055234},"labels":[],"label_agreement":null},{"id":"W3021388641","doi":"","title":"Proceedings of the 2017 Web Archiving and Digital Libraries Workshop","year":2017,"lang":"en","type":"article","venue":"VTechWorks (Virginia Tech)","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":true,"ca_institutions":"","funders":"National Science Foundation","keywords":"World Wide Web; Computer science; Library science","score_opus":0.013501435343226613,"score_gpt":0.22347651286460882,"score_spread":0.2099750775213822,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W3021388641","genre_codex":"other","genre_gemma":"other","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"other","genre_consensus":"other","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.015454043,0.09692409,0.080655105,0.20737043,0.0948426,0.0011454772,0.0097081,0.014233809,0.47966644],"genre_scores_gemma":[0.021801662,0.046715863,0.031136282,0.012370413,0.012191178,0.00076808146,0.019766603,0.004781828,0.85046816],"study_design_codex":"not_applicable","study_design_gemma":"not_applicable","domain_scores_codex":[0.99530375,0.001271003,0.0002664325,0.00043338083,0.00219994,0.00052538747],"domain_scores_gemma":[0.99014217,0.0018542453,0.00025644785,0.0011812046,0.003712151,0.0028537388],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.009041826,0.0012091099,0.0011082735,0.0026988392,0.003766262,0.013830668,0.0029487398,0.0034336336,0.088228874],"category_scores_gemma":[0.009881012,0.0007196859,0.0011548861,0.0033601646,0.0017710853,0.010584736,0.009868023,0.0044663125,0.06466975],"study_design_candidate":"not_applicable","study_design_consensus":"not_applicable","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.000087953165,0.00009527671,0.00030127884,0.00024917582,0.000012221871,0.00011565428,0.0008336937,0.000157637,0.0009010442,0.005385627,0.86937124,0.12248923],"study_design_scores_gemma":[0.0000046919217,0.0000074819623,0.00015983752,0.00015901665,0.0000047382823,0.000058825615,0.0005650421,0.00023724115,0.00037500166,0.0015383237,0.9968791,0.00001069631],"about_ca_topic_score_codex":0.011942561,"about_ca_topic_score_gemma":0.025627872,"teacher_disagreement_score":0.088228874,"about_ca_system_score_codex":0.004741787,"about_ca_system_score_gemma":0.0106801,"threshold_uncertainty_score":0.295155},"labels":[],"label_agreement":null},{"id":"W303073260","doi":"","title":"Going beyond Google for Faster and Smarter Web Searching.","year":2004,"lang":"en","type":"article","venue":"Teacher librarian","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":7,"is_retracted":false,"has_abstract":false,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":true,"route_about_ca":false,"ca_institutions":"","funders":"","keywords":"World Wide Web; Computer science; Internet privacy; Data science; Information retrieval; Multimedia","score_opus":0.01827505313145956,"score_gpt":0.2360738780640262,"score_spread":0.21779882493256664,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W303073260","genre_codex":"commentary","genre_gemma":"other","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"other","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.073620096,0.061984196,0.16892584,0.32710117,0.009786069,0.0006694808,0.025647035,0.05050839,0.28175765],"genre_scores_gemma":[0.18593639,0.030786922,0.4228867,0.051689096,0.0037183743,0.0003690592,0.035203144,0.013802041,0.25560832],"study_design_codex":"not_applicable","study_design_gemma":"not_applicable","domain_scores_codex":[0.99512213,0.0009794862,0.00035083454,0.00053543964,0.0024844015,0.0005277762],"domain_scores_gemma":[0.9804921,0.0052839858,0.0010770913,0.003764911,0.007230184,0.002151683],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0044254065,0.0008944921,0.0010305528,0.005841027,0.0019301596,0.011381458,0.0017705552,0.0031597326,0.04044612],"category_scores_gemma":[0.02297244,0.00082871894,0.0010756324,0.008569221,0.0012253381,0.030064192,0.004149145,0.003613844,0.044733994],"study_design_candidate":"not_applicable","study_design_consensus":"not_applicable","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00024053003,0.00015619321,0.007929566,0.00075125764,0.0001151052,0.0001656167,0.000785023,0.00032412884,0.005459949,0.015792405,0.5461398,0.42214042],"study_design_scores_gemma":[0.000044685716,0.00005674965,0.0087034255,0.0004901554,0.0000846773,0.00055885897,0.002274129,0.0028536387,0.0058219363,0.043001104,0.9359766,0.00013392688],"about_ca_topic_score_codex":0.015400515,"about_ca_topic_score_gemma":0.03369732,"teacher_disagreement_score":0.04044612,"about_ca_system_score_codex":0.0011012187,"about_ca_system_score_gemma":0.0034471734,"threshold_uncertainty_score":0.13530582},"labels":[],"label_agreement":null},{"id":"W3031495110","doi":"10.11575/prism/29707","title":"Social Networking Tools","year":2009,"lang":"en","type":"article","venue":"Open MIND","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":2,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":true,"ca_institutions":"","funders":"","keywords":"Computer science; Business; Internet privacy; World Wide Web","score_opus":0.10421972961887833,"score_gpt":0.34439670406930656,"score_spread":0.24017697445042824,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W3031495110","genre_codex":"other","genre_gemma":"other","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"other","genre_consensus":"other","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.005712449,0.008610718,0.11085723,0.0108984355,0.00656426,0.0010693615,0.03439463,0.11570153,0.7061914],"genre_scores_gemma":[0.01432451,0.006031059,0.04353001,0.0016486323,0.0014051474,0.0005430995,0.026412454,0.009298244,0.8968069],"study_design_codex":"not_applicable","study_design_gemma":"not_applicable","domain_scores_codex":[0.99904877,0.00012963194,0.00006026364,0.000117169664,0.00053724047,0.000106943444],"domain_scores_gemma":[0.9979049,0.0005632565,0.00006393597,0.00031667165,0.00070233364,0.00044902242],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0017698582,0.0012265034,0.0007126243,0.0033866854,0.0020328504,0.0052833986,0.0012367017,0.00114456,0.24953511],"category_scores_gemma":[0.004814345,0.00069367915,0.0007671224,0.0033219117,0.00043146982,0.005762044,0.0038593195,0.0016230381,0.14733817],"study_design_candidate":"not_applicable","study_design_consensus":"not_applicable","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00005543025,0.000069980044,0.00034886436,0.00018121883,0.00001375119,0.00008350567,0.00024336431,0.00012220799,0.0011950571,0.0060205595,0.79083014,0.200836],"study_design_scores_gemma":[0.00001268746,0.000014143292,0.0006342176,0.00011479816,0.000007770911,0.000103029604,0.00017858714,0.00060605136,0.00051291456,0.003408766,0.99438745,0.000019492072],"about_ca_topic_score_codex":0.0101958895,"about_ca_topic_score_gemma":0.02682657,"teacher_disagreement_score":0.24953511,"about_ca_system_score_codex":0.00088716147,"about_ca_system_score_gemma":0.001834018,"threshold_uncertainty_score":0.83477813},"labels":[],"label_agreement":null},{"id":"W3034396897","doi":"10.1007/978-3-030-50578-3_3","title":"Structural Profiling of Web Sites in the Wild","year":2020,"lang":"en","type":"book-chapter","venue":"Lecture notes in computer science","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":3,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Université du Québec à Chicoutimi","funders":"","keywords":"Computer science; Profiling (computer programming); Information retrieval; World Wide Web; Point (geometry); Data mining; Data science; Mathematics","score_opus":0.025408006769250525,"score_gpt":0.24920812461273587,"score_spread":0.22380011784348533,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W3034396897","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.8727206,0.0024302108,0.097018756,0.00074997847,0.00013953722,0.00013987336,0.011385596,0.0024090162,0.013006473],"genre_scores_gemma":[0.9370651,0.00084352214,0.045864154,0.000093048584,0.00008605111,0.00006371789,0.0106461,0.00035578932,0.0049824133],"study_design_codex":"observational","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9988649,0.00019350207,0.00008463183,0.0002811371,0.00044082696,0.00013502863],"domain_scores_gemma":[0.9954159,0.0017451631,0.00062297797,0.00087682967,0.000984882,0.0003541327],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0005495821,0.0002562228,0.00040012656,0.004223466,0.00056533737,0.0020958919,0.0006480443,0.0005532101,0.0013918251],"category_scores_gemma":[0.00472836,0.00034940962,0.0003737135,0.005596441,0.0003610711,0.0026711253,0.0006676847,0.0007050497,0.0015674932],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0004976911,0.000511531,0.46636817,0.00065864605,0.0002461834,0.0008606538,0.002097892,0.019820945,0.06779081,0.025444048,0.020863006,0.39484042],"study_design_scores_gemma":[0.000024642286,0.00027962262,0.40833887,0.00025775106,0.00018246878,0.0029368184,0.0037126865,0.43894455,0.03568158,0.06378625,0.045752175,0.00010263585],"about_ca_topic_score_codex":0.0029766383,"about_ca_topic_score_gemma":0.010817842,"teacher_disagreement_score":0.004223466,"about_ca_system_score_codex":0.00041992965,"about_ca_system_score_gemma":0.00047389203,"threshold_uncertainty_score":0.005918622},"labels":[],"label_agreement":null},{"id":"W3035050964","doi":"10.1007/978-3-030-50578-3_1","title":"Detecting Responsive Web Design Bugs with Declarative Specifications","year":2020,"lang":"en","type":"book-chapter","venue":"Lecture notes in computer science","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":2,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Université du Québec à Chicoutimi","funders":"","keywords":"Computer science; Crawling; Window (computing); Software engineering; Web application; Programming language; Human–computer interaction; World Wide Web","score_opus":0.059377615250169914,"score_gpt":0.25285541217276464,"score_spread":0.19347779692259473,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W3035050964","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.12524736,0.00043545352,0.82501537,0.0008675076,0.00014493559,0.0003829233,0.0012669272,0.042581417,0.004058105],"genre_scores_gemma":[0.53252715,0.0003032612,0.45544994,0.00063351245,0.00005569813,0.0003119715,0.0027040485,0.0043460317,0.0036684684],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9884384,0.0027632052,0.0009467841,0.0012327707,0.00567068,0.0009480712],"domain_scores_gemma":[0.94285685,0.036945377,0.0056166206,0.00842432,0.005598198,0.00055860414],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0058788946,0.0015615439,0.0007814837,0.0019436226,0.0005066246,0.0026162523,0.0030087966,0.0023284748,0.0026933774],"category_scores_gemma":[0.044966523,0.0016822281,0.0015937103,0.0009522357,0.0012722131,0.004602502,0.0028471425,0.002725873,0.0012791046],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0014028301,0.0015274412,0.09144763,0.0027227816,0.00042919806,0.004615346,0.0041625337,0.13652146,0.09724929,0.06355436,0.030728837,0.56563836],"study_design_scores_gemma":[0.00014582832,0.00044880007,0.0040417667,0.00036609528,0.00025833544,0.0012766311,0.0011303694,0.8549489,0.08169668,0.039490294,0.016072249,0.00012417148],"about_ca_topic_score_codex":0.0027430945,"about_ca_topic_score_gemma":0.0049247835,"teacher_disagreement_score":0.0058788946,"about_ca_system_score_codex":0.0007835321,"about_ca_system_score_gemma":0.00227645,"threshold_uncertainty_score":0.031090915},"labels":[],"label_agreement":null},{"id":"W3035986930","doi":"10.1080/24701475.2020.1778309","title":"Internet histories early career researcher award","year":2020,"lang":"en","type":"article","venue":"Internet Histories","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Waterloo","funders":"","keywords":"The Internet; Sociology; History; Engineering ethics; World Wide Web; Computer science; Engineering","score_opus":0.08436990834017351,"score_gpt":0.260899731334953,"score_spread":0.17652982299477948,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W3035986930","genre_codex":"other","genre_gemma":"other","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"other","genre_consensus":"other","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0057691946,0.0038075286,0.0035785057,0.08631421,0.095723614,0.0011101218,0.0052133305,0.0019313236,0.79655224],"genre_scores_gemma":[0.0045571015,0.0009234263,0.00064195576,0.0013088312,0.005296186,0.00009822714,0.00091956835,0.00025343584,0.9860014],"study_design_codex":"not_applicable","study_design_gemma":"not_applicable","domain_scores_codex":[0.994773,0.0005347339,0.00015641454,0.00037434933,0.0035352465,0.000626267],"domain_scores_gemma":[0.9401629,0.0020710249,0.0010610645,0.0026730779,0.028810443,0.02522162],"candidate_categories":["insufficient_payload"],"consensus_categories":[],"category_scores_codex":[0.0057460167,0.0006587382,0.0011269705,0.004607201,0.003200616,0.008304124,0.0016232475,0.0029231957,0.56530297],"category_scores_gemma":[0.022193126,0.00050375,0.00051136076,0.0027250135,0.0006978621,0.0030506486,0.0048744646,0.0023899248,0.3606324],"study_design_candidate":"not_applicable","study_design_consensus":"not_applicable","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.000036658428,0.00009643528,0.0005184293,0.00007215784,0.000004489161,0.00008558649,0.00004646246,0.000022480637,0.0002443374,0.002356945,0.94043314,0.05608291],"study_design_scores_gemma":[0.000016183887,0.000043195243,0.0010770794,0.00007037762,0.000004954047,0.000089251764,0.0001270526,0.00010625851,0.00022536649,0.0011129183,0.99712,0.000007380876],"about_ca_topic_score_codex":0.0012849217,"about_ca_topic_score_gemma":0.008274564,"teacher_disagreement_score":0.56530297,"about_ca_system_score_codex":0.0020093159,"about_ca_system_score_gemma":0.009524829,"threshold_uncertainty_score":0.62004256},"labels":[],"label_agreement":null},{"id":"W3037999728","doi":"10.1002/meet.14504901269","title":"Information curation","year":2012,"lang":"en","type":"article","venue":"Proceedings of the American Society for Information Science and Technology","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":6,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Toronto","funders":"","keywords":"Bookmarking; World Wide Web; Computer science; Identity (music); Data curation; Data science","score_opus":0.009416937024244412,"score_gpt":0.24788586658765613,"score_spread":0.2384689295634117,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W3037999728","genre_codex":"other","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.007480982,0.0065507796,0.2524668,0.052101348,0.013495869,0.0066793133,0.0150595885,0.018127112,0.6280382],"genre_scores_gemma":[0.1378509,0.0109405285,0.27918977,0.026190352,0.007183488,0.008493667,0.027364317,0.014964936,0.48782197],"study_design_codex":"not_applicable","study_design_gemma":"not_applicable","domain_scores_codex":[0.9074565,0.036851473,0.008969621,0.00876336,0.035113517,0.002845501],"domain_scores_gemma":[0.7041641,0.07802864,0.011419316,0.11564227,0.08599065,0.004755025],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.044124015,0.0018968893,0.0017524351,0.017722324,0.0086405175,0.01940562,0.005415975,0.0039243163,0.11572363],"category_scores_gemma":[0.20926568,0.0010999098,0.0025540555,0.014689699,0.0055281795,0.01698488,0.018075196,0.0060470835,0.069645084],"study_design_candidate":"not_applicable","study_design_consensus":"not_applicable","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00012516894,0.000099312216,0.0013649683,0.0026584363,0.00007180209,0.00035024105,0.010634082,0.00041713653,0.0025750285,0.15932372,0.5354996,0.28688064],"study_design_scores_gemma":[0.000010454183,0.000011696658,0.00026328437,0.00067599997,0.000015944983,0.00012932044,0.0007480993,0.00029503612,0.00095806626,0.012107363,0.98475885,0.000025893309],"about_ca_topic_score_codex":0.005949743,"about_ca_topic_score_gemma":0.005404011,"teacher_disagreement_score":0.11572363,"about_ca_system_score_codex":0.006397013,"about_ca_system_score_gemma":0.017822426,"threshold_uncertainty_score":0.38713413},"labels":[],"label_agreement":null},{"id":"W3039489849","doi":"10.48550/arxiv.2007.01973","title":"Detecting Opportunities for Differential Maintenance of Extracted Views","year":2020,"lang":"en","type":"preprint","venue":"arXiv (Cornell University)","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":1,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Waterloo","funders":"Natural Sciences and Engineering Research Council of Canada; University of Waterloo","keywords":"Computer science; Extractor; Focus (optics); Context (archaeology); Information extraction; Information retrieval; Range (aeronautics); Data mining","score_opus":0.27818718141725435,"score_gpt":0.22034965308937746,"score_spread":0.05783752832787689,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W3039489849","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.42717034,0.00081219175,0.5646341,0.00085472764,0.000059887323,0.0002240259,0.00080676057,0.0031469036,0.0022911248],"genre_scores_gemma":[0.8089946,0.0002023224,0.18750198,0.00015680508,0.0000526387,0.00011180734,0.0012357871,0.00049223576,0.0012518067],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.99318343,0.0011217268,0.00064822193,0.0017451551,0.0028506161,0.00045087724],"domain_scores_gemma":[0.94171333,0.032562573,0.00776168,0.01150032,0.0053443015,0.0011177933],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0055068135,0.00049386924,0.0008270934,0.002169794,0.000828715,0.0023529206,0.0016695124,0.0012662925,0.00088687957],"category_scores_gemma":[0.047970306,0.0006527148,0.0007496475,0.0017695819,0.001595224,0.0061894604,0.0027154826,0.0017455311,0.00023693348],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0019098031,0.0004324591,0.20693585,0.0011977629,0.0003274478,0.0036023278,0.005703604,0.047359634,0.120128065,0.14848796,0.0066247,0.45729032],"study_design_scores_gemma":[0.000084153144,0.00046730728,0.037151206,0.00022649717,0.00034880676,0.0029515796,0.0014657693,0.5580105,0.196497,0.17744957,0.02519547,0.00015206692],"about_ca_topic_score_codex":0.0010986698,"about_ca_topic_score_gemma":0.0018493464,"teacher_disagreement_score":0.0055068135,"about_ca_system_score_codex":0.0009688017,"about_ca_system_score_gemma":0.0013167426,"threshold_uncertainty_score":0.029123187},"labels":[],"label_agreement":null},{"id":"W3046447243","doi":"","title":"Separating Treasure from Trash: Quantifying Data Waste in App Reviews.","year":2020,"lang":"en","type":"article","venue":"Journal of the Association for Information Systems","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":4,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Université Laval","funders":"","keywords":"Treasure; Computer science; Waste management; Data science; Engineering; Archaeology; Geography","score_opus":0.12832491453530664,"score_gpt":0.3105887907497892,"score_spread":0.18226387621448253,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W3046447243","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.59356344,0.020307202,0.27904484,0.008387158,0.0017575116,0.008367392,0.045470018,0.0035722957,0.039530106],"genre_scores_gemma":[0.6857121,0.00301285,0.27462766,0.002054832,0.00071241625,0.006625777,0.019124363,0.0005842236,0.0075458903],"study_design_codex":"design_other","study_design_gemma":"observational","domain_scores_codex":[0.90194225,0.03562912,0.015572033,0.00651797,0.03898562,0.0013529519],"domain_scores_gemma":[0.4922966,0.33790684,0.066594444,0.019148126,0.082025334,0.0020286464],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.04733322,0.0012008551,0.0012583828,0.021389535,0.0015179312,0.0048656412,0.0019783962,0.0015447764,0.0013754606],"category_scores_gemma":[0.3178284,0.0006992562,0.0011017675,0.018967697,0.0010505255,0.0058739195,0.0028211235,0.0013077753,0.0011811936],"study_design_candidate":"observational","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0010566083,0.00053288654,0.42447707,0.010683593,0.0014436229,0.0009029211,0.011350299,0.0029400112,0.01090183,0.008512447,0.040709257,0.48648947],"study_design_scores_gemma":[0.00021134604,0.0016268458,0.58496714,0.0056385947,0.0024748072,0.003498055,0.014734385,0.0917498,0.05939152,0.030155694,0.20483287,0.00071891746],"about_ca_topic_score_codex":0.0056064995,"about_ca_topic_score_gemma":0.012588357,"teacher_disagreement_score":0.04733322,"about_ca_system_score_codex":0.002060143,"about_ca_system_score_gemma":0.0036120398,"threshold_uncertainty_score":0.25032502},"labels":[],"label_agreement":null},{"id":"W3049699960","doi":"10.1007/978-3-030-54956-5_6","title":"Correspondence as the Primary Measure of Quality for Web Archives: A Grounded Theory Study","year":2020,"lang":"en","type":"book-chapter","venue":"Lecture notes in computer science","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":2,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Alberta","funders":"","keywords":"World Wide Web; Computer science; Grounded theory; Quality (philosophy); The Internet; Web development; Field (mathematics); Relevance (law); Sociology; Qualitative research; Political science; Mathematics","score_opus":0.03758715106019515,"score_gpt":0.2870381769926996,"score_spread":0.24945102593250448,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W3049699960","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.79869646,0.0010237239,0.11533873,0.0055381167,0.000115585135,0.0029817335,0.0009485287,0.000099485085,0.07525761],"genre_scores_gemma":[0.9722269,0.00013973667,0.02620079,0.00012997455,0.00000806442,0.00065464876,0.00011585537,0.00004071629,0.0004832582],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"qualitative","domain_scores_codex":[0.9443366,0.038626067,0.0025762417,0.0030277725,0.010404501,0.0010287846],"domain_scores_gemma":[0.67471385,0.28284237,0.0117429895,0.011467529,0.01683383,0.002399481],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.045082796,0.0004893825,0.0011161701,0.008499962,0.0067117647,0.010722403,0.0031182957,0.001649743,0.004791216],"category_scores_gemma":[0.13553515,0.0008294457,0.0012959877,0.010897463,0.013606013,0.01200303,0.0059251543,0.004465119,0.00032125702],"study_design_candidate":"qualitative","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00068545225,0.0015328625,0.0763822,0.0021768967,0.00021328246,0.00022964066,0.35468513,0.0015722273,0.0024643075,0.39942923,0.0019450656,0.15868375],"study_design_scores_gemma":[0.00028239522,0.0011855423,0.06895759,0.0026384748,0.0007166347,0.0005083405,0.61533505,0.020876464,0.010777663,0.26247963,0.01603321,0.00020902729],"about_ca_topic_score_codex":0.0074486975,"about_ca_topic_score_gemma":0.009151367,"teacher_disagreement_score":0.045082796,"about_ca_system_score_codex":0.017528212,"about_ca_system_score_gemma":0.01548696,"threshold_uncertainty_score":0.23842347},"labels":[],"label_agreement":null},{"id":"W3082162291","doi":"10.14778/3407790.3407810","title":"<i>Pytheas</i>","year":2020,"lang":"en","type":"article","venue":"Proceedings of the VLDB Endowment","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":27,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":true,"ca_institutions":"University of Toronto","funders":"","keywords":"Computer science; Information retrieval; Metadata; Table (database); File format; Data extraction; Data mining; World Wide Web; Database","score_opus":0.014954288133886124,"score_gpt":0.18961740079404488,"score_spread":0.17466311266015874,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W3082162291","genre_codex":"dataset","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.007709616,0.0006335343,0.093025595,0.0023396006,0.0007328788,0.0006765134,0.44539255,0.42260516,0.026884604],"genre_scores_gemma":[0.041405845,0.0007234283,0.18481089,0.001402944,0.000226226,0.00094796956,0.7138702,0.035723258,0.020889195],"study_design_codex":"not_applicable","study_design_gemma":"not_applicable","domain_scores_codex":[0.9975503,0.0001925856,0.00023640976,0.0005374386,0.0012362697,0.00024701236],"domain_scores_gemma":[0.9831871,0.0037034417,0.0012174617,0.005718846,0.00540029,0.0007728932],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0025992624,0.0016612809,0.00082611,0.007179614,0.0014173737,0.0040207724,0.0030476595,0.0013481894,0.050810087],"category_scores_gemma":[0.02578024,0.0009935838,0.0011780619,0.010749899,0.0015924514,0.0063315374,0.004091737,0.0017538213,0.04787798],"study_design_candidate":"not_applicable","study_design_consensus":"not_applicable","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0002907939,0.00004070865,0.0055712773,0.0005753144,0.000046450674,0.00019675629,0.00043950733,0.000829757,0.004446347,0.0043130973,0.8754288,0.1078212],"study_design_scores_gemma":[0.000045904213,0.000042722924,0.010077972,0.0002071694,0.000019884288,0.00035831044,0.00028124164,0.010022224,0.018866425,0.00504396,0.95491487,0.0001192311],"about_ca_topic_score_codex":0.10816597,"about_ca_topic_score_gemma":0.12076589,"teacher_disagreement_score":0.10816597,"about_ca_system_score_codex":0.0028784056,"about_ca_system_score_gemma":0.0058220155,"threshold_uncertainty_score":0.21507275},"labels":[],"label_agreement":null},{"id":"W3086284023","doi":"10.14778/3415478.3415500","title":"ActiveDeeper","year":2020,"lang":"en","type":"article","venue":"Proceedings of the VLDB Endowment","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":4,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Simon Fraser University","funders":"","keywords":"Deep Web; Computer science; World Wide Web; State (computer science); Database; The Internet; Programming language","score_opus":0.017852573838847422,"score_gpt":0.1999878516851466,"score_spread":0.18213527784629918,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W3086284023","genre_codex":"software","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.017696014,0.001270787,0.37481964,0.0008266026,0.00043928804,0.00046246315,0.043219727,0.5401314,0.02113399],"genre_scores_gemma":[0.2335577,0.0014104302,0.49121177,0.0031785336,0.00016240583,0.0011960944,0.18970205,0.031453565,0.04812748],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.99911577,0.00008473951,0.00006653577,0.0003573285,0.00032059662,0.000054912824],"domain_scores_gemma":[0.9985285,0.00043919976,0.000059975464,0.00062880036,0.0002369462,0.00010649368],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0012390758,0.0011410166,0.00083720684,0.0015613448,0.00048286052,0.0017078512,0.003067923,0.00092957757,0.019431055],"category_scores_gemma":[0.0041572624,0.00091471866,0.00094472343,0.001311914,0.0004287564,0.004761297,0.003721675,0.0016562996,0.01288255],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0014745309,0.00062180473,0.007680128,0.0011486533,0.0004655102,0.0005036025,0.0003402035,0.010377942,0.016701635,0.0138461515,0.44002163,0.5068182],"study_design_scores_gemma":[0.00024199596,0.00030527302,0.004237163,0.00015050582,0.00013935904,0.0010377258,0.00014818742,0.29411298,0.05979939,0.043659747,0.5959935,0.0001740897],"about_ca_topic_score_codex":0.0026999793,"about_ca_topic_score_gemma":0.00550953,"teacher_disagreement_score":0.019431055,"about_ca_system_score_codex":0.000546101,"about_ca_system_score_gemma":0.0008770599,"threshold_uncertainty_score":0.065003335},"labels":[],"label_agreement":null},{"id":"W3087820244","doi":"10.1145/3395027.3419587","title":"A Framework to Evaluate Webpage Segment Recognizers","year":2020,"lang":"en","type":"article","venue":"","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Dalhousie University","funders":"","keywords":"Computer science; Web page; Information retrieval; Search engine; World Wide Web; Natural language processing; Artificial intelligence","score_opus":0.05614677183258542,"score_gpt":0.29955253778576585,"score_spread":0.24340576595318042,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W3087820244","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.1056317,0.0008601739,0.86494386,0.00030185687,0.00017556509,0.00220111,0.002041381,0.013836591,0.010007706],"genre_scores_gemma":[0.4608882,0.00026255462,0.52495563,0.00021493401,0.000079372956,0.001727891,0.0050426302,0.0006024425,0.006226319],"study_design_codex":"design_other","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.9949576,0.0010375067,0.00053495914,0.0007278552,0.0022868575,0.0004552587],"domain_scores_gemma":[0.99293584,0.002219173,0.0005895814,0.0006155264,0.0031762125,0.00046358933],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0071185906,0.0020035505,0.0013554831,0.005938558,0.00090421154,0.0038147494,0.00229152,0.002374424,0.0045348634],"category_scores_gemma":[0.016068717,0.0004654355,0.0011420959,0.0014567343,0.0011123986,0.0033310507,0.002120875,0.0011787938,0.0028128857],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.002263143,0.0024704896,0.028618257,0.0008199043,0.00063317036,0.00057094917,0.00047602743,0.17614026,0.1007861,0.032507658,0.015634514,0.6390796],"study_design_scores_gemma":[0.00014593484,0.0015453305,0.0052659647,0.00009260697,0.00012824875,0.00022010932,0.00024856668,0.9431938,0.030482471,0.010922904,0.0076650763,0.00008893899],"about_ca_topic_score_codex":0.008934129,"about_ca_topic_score_gemma":0.005601414,"teacher_disagreement_score":0.008934129,"about_ca_system_score_codex":0.0018434094,"about_ca_system_score_gemma":0.0020798577,"threshold_uncertainty_score":0.037647188},"labels":[],"label_agreement":null},{"id":"W3093354771","doi":"10.1007/s42803-021-00032-5","title":"‘Go fish’: Conceptualising the challenges of engaging national web archives for digital research","year":2021,"lang":"en","type":"article","venue":"International Journal of Digital Humanities","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":12,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Toronto","funders":"ESRC National Centre for Research Methods, University of Southampton; Economic and Social Research Council; UK Research and Innovation; Social Sciences and Humanities Research Council of Canada; University of Southampton; Aarhus Universitet","keywords":"World Wide Web; Context (archaeology); Scholarship; Web 2.0; Sociology; Computer science; Web service; Political science; Geography","score_opus":0.18455358254609616,"score_gpt":0.3625338833797037,"score_spread":0.17798030083360755,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W3093354771","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.41351572,0.008139187,0.24323124,0.09445807,0.00065489043,0.0008576933,0.00038363415,0.00059947354,0.23816],"genre_scores_gemma":[0.9404721,0.0013274371,0.051007576,0.0015700363,0.000055299515,0.0006752677,0.00009734882,0.00024465602,0.0045501855],"study_design_codex":"qualitative","study_design_gemma":"qualitative","domain_scores_codex":[0.9093851,0.07753874,0.0021063741,0.0030855078,0.0051361388,0.0027481979],"domain_scores_gemma":[0.8664426,0.10577474,0.00503887,0.01406581,0.0053191795,0.003358654],"candidate_categories":["scholarly_communication"],"consensus_categories":[],"category_scores_codex":[0.08378688,0.00091080857,0.0012702588,0.008421606,0.022375891,0.04424956,0.006716185,0.008666505,0.0066899797],"category_scores_gemma":[0.09588349,0.0017578597,0.0011763911,0.009688541,0.091662146,0.050779242,0.029886764,0.007167945,0.0010380973],"study_design_candidate":"qualitative","study_design_consensus":"qualitative","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.000047789403,0.000027854587,0.0029751027,0.0003312873,0.000019677218,0.0006777265,0.6380785,0.0004327391,0.00034729374,0.34410888,0.0011844151,0.011768729],"study_design_scores_gemma":[0.000012759714,0.000041785057,0.0013166553,0.0011396398,0.00003227258,0.00066157745,0.69929516,0.0016082989,0.0004374015,0.19574517,0.09965959,0.00004965331],"about_ca_topic_score_codex":0.013901974,"about_ca_topic_score_gemma":0.018889194,"teacher_disagreement_score":0.95575047,"about_ca_system_score_codex":0.015246066,"about_ca_system_score_gemma":0.019007906,"threshold_uncertainty_score":0.44311267},"labels":[],"label_agreement":null},{"id":"W3098665331","doi":"10.29173/cais1145","title":"Quality Matters: A New Approach for Detecting Quality Problems in Web Archives","year":2020,"lang":"en","type":"article","venue":"Proceedings of the Annual Conference of CAIS / Actes du congrès annuel de l ACSI","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":true,"route_about_ca":false,"ca_institutions":"University of Alberta","funders":"","keywords":"World Wide Web; Web site; Computer science; Quality (philosophy); Similarity (geometry); Humanities; Library science; Information retrieval; The Internet; Art; Artificial intelligence; Image (mathematics); Philosophy","score_opus":0.0750485152629651,"score_gpt":0.2913280194931412,"score_spread":0.21627950423017608,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W3098665331","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.29889572,0.0016071245,0.677345,0.00096851325,0.00020747179,0.0009624959,0.0011662218,0.0041104914,0.014736936],"genre_scores_gemma":[0.7254095,0.00043899243,0.2693983,0.00015760606,0.00015308092,0.00031333932,0.000691905,0.0002716825,0.0031655873],"study_design_codex":"design_other","study_design_gemma":"bench_or_experimental","domain_scores_codex":[0.9914824,0.0013618515,0.0011197202,0.00122204,0.0044154827,0.00039849948],"domain_scores_gemma":[0.9686846,0.0098896315,0.0076712496,0.0030914783,0.009721373,0.0009416919],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.006569357,0.0009261337,0.00096666673,0.015838195,0.0014172521,0.005114969,0.001570461,0.0019172718,0.0023543348],"category_scores_gemma":[0.037494358,0.0005887642,0.0011863924,0.008640713,0.0019513922,0.007566549,0.0034864428,0.0016941451,0.0008028788],"study_design_candidate":"bench_or_experimental","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0008500866,0.00047817262,0.31361526,0.0010540655,0.0005167792,0.0011953677,0.008804529,0.008482277,0.028252674,0.024432948,0.0067806304,0.60553724],"study_design_scores_gemma":[0.00018326103,0.001801384,0.40144914,0.00049203576,0.0009855357,0.0070564435,0.016846089,0.39093024,0.06554047,0.061638616,0.052544087,0.0005326958],"about_ca_topic_score_codex":0.0045731287,"about_ca_topic_score_gemma":0.0035827802,"teacher_disagreement_score":0.015838195,"about_ca_system_score_codex":0.0018012671,"about_ca_system_score_gemma":0.0012878714,"threshold_uncertainty_score":0.034742475},"labels":[],"label_agreement":null},{"id":"W3100308720","doi":"10.3233/faia200731","title":"Focused Crawler Strategy Based on Improved Energy Landscape Paving Algorithm","year":2020,"lang":"en","type":"book-chapter","venue":"Frontiers in artificial intelligence and applications","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Alberta","funders":"National Social Science Fund of China","keywords":"Web crawler; Focused crawler; Hyperlink; Domain (mathematical analysis); Computer science; Crawling; Data mining; Information retrieval; Web page; World Wide Web; Mathematics; Web navigation; Static web page","score_opus":0.03050407268648987,"score_gpt":0.24420265418079376,"score_spread":0.2136985814943039,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W3100308720","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.037085712,0.00073950615,0.9557049,0.00015983779,0.000059851038,0.00019590926,0.00014831778,0.0021449062,0.003761015],"genre_scores_gemma":[0.39660493,0.00062452245,0.59335154,0.00020540183,0.00007949246,0.0004820043,0.000910239,0.00040703514,0.0073348093],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9992569,0.00013622006,0.00006354564,0.00019147461,0.00027431318,0.00007750504],"domain_scores_gemma":[0.9991942,0.00021981986,0.00007238824,0.00011550632,0.00035412345,0.00004397089],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.00057780195,0.0010832296,0.0014721145,0.0027360413,0.0006375818,0.0013378329,0.0017269604,0.0012628164,0.0020853113],"category_scores_gemma":[0.0020439092,0.0005381651,0.0008520628,0.0020313293,0.00040419895,0.0018774994,0.0008565669,0.00059508905,0.00089260447],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00015906105,0.00025615672,0.0038864966,0.00028654808,0.00018332641,0.0002872666,0.00026225808,0.29733777,0.025904857,0.012033067,0.011412943,0.64799017],"study_design_scores_gemma":[0.00003184006,0.00006314453,0.0006759586,0.000010245367,0.0000428752,0.00014656558,0.000028597782,0.99004656,0.0036954267,0.002743372,0.0024979112,0.000017490944],"about_ca_topic_score_codex":0.0044134706,"about_ca_topic_score_gemma":0.00472075,"teacher_disagreement_score":0.0044134706,"about_ca_system_score_codex":0.00067624135,"about_ca_system_score_gemma":0.001073497,"threshold_uncertainty_score":0.008775592},"labels":[],"label_agreement":null},{"id":"W3112675244","doi":"10.1145/3447556.3447563","title":"A Report on the First Workshop on Document Intelligence (DI) at NeurIPS 2019","year":2021,"lang":"en","type":"article","venue":"ACM SIGKDD Explorations Newsletter","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":6,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":true,"ca_institutions":"","funders":"","keywords":"Computer science; Library science; Intelligence analysis; Data science; World Wide Web; Computer security","score_opus":0.051440865561647335,"score_gpt":0.2786518561287233,"score_spread":0.22721099056707594,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W3112675244","genre_codex":"other","genre_gemma":"other","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"other","genre_consensus":"other","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.021402722,0.040274758,0.0886662,0.14029378,0.21958995,0.004308079,0.037439145,0.0072454754,0.44077998],"genre_scores_gemma":[0.023357784,0.013450496,0.035907023,0.008208128,0.011727274,0.0010795508,0.041724637,0.0030985493,0.86144656],"study_design_codex":"not_applicable","study_design_gemma":"not_applicable","domain_scores_codex":[0.9882081,0.0023860107,0.0004642483,0.0013875149,0.0059139803,0.0016400993],"domain_scores_gemma":[0.977434,0.0023340676,0.00038442045,0.0012720033,0.011187529,0.0073880805],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.014243333,0.0017670501,0.0012710565,0.0036552104,0.0030212756,0.012603111,0.0024048907,0.003095025,0.10614094],"category_scores_gemma":[0.014971792,0.00071648054,0.0016136074,0.0035290616,0.0010214433,0.0075982,0.0075699193,0.0053466023,0.086400755],"study_design_candidate":"not_applicable","study_design_consensus":"not_applicable","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0002511496,0.00017514484,0.0004981045,0.00028444166,0.00002017323,0.00011208115,0.000308093,0.00024839767,0.002287738,0.003005009,0.90778047,0.08502915],"study_design_scores_gemma":[0.000029930658,0.000086179534,0.0006569277,0.00013583388,0.000014667918,0.00006385956,0.00037201022,0.0003112793,0.0016468472,0.0013582222,0.9952968,0.000027530477],"about_ca_topic_score_codex":0.013954963,"about_ca_topic_score_gemma":0.019817747,"teacher_disagreement_score":0.10614094,"about_ca_system_score_codex":0.0043092994,"about_ca_system_score_gemma":0.011654351,"threshold_uncertainty_score":0.35507685},"labels":[],"label_agreement":null},{"id":"W3125017558","doi":"10.7287/peerj.preprints.1947","title":"Boa: a link between worlds","year":2016,"lang":"en","type":"article","venue":"","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Alberta","funders":"","keywords":"Computer science; Commit; World Wide Web; Software; Software engineering; Traceability; Software development; Database; Operating system","score_opus":0.022245809662072662,"score_gpt":0.2500516888583013,"score_spread":0.22780587919622866,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W3125017558","genre_codex":"methods","genre_gemma":"software","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"software","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.03671594,0.0035607386,0.55808705,0.014700086,0.0020287558,0.0012533453,0.025318997,0.032476164,0.32585886],"genre_scores_gemma":[0.32014757,0.0031509278,0.506176,0.002904205,0.00038259482,0.001625087,0.038323637,0.009491002,0.11779902],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"not_applicable","domain_scores_codex":[0.9974456,0.0008779964,0.0001497957,0.0005447615,0.0006924779,0.00028940203],"domain_scores_gemma":[0.99407154,0.0022703733,0.00042033565,0.0016470151,0.00072612875,0.00086454634],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0024179374,0.00078841916,0.00056538964,0.00500615,0.0047664717,0.00894488,0.001821991,0.0025041765,0.046133574],"category_scores_gemma":[0.011610629,0.00092275103,0.0013813463,0.0056559276,0.0028518466,0.01917937,0.010627684,0.0029545592,0.015550604],"study_design_candidate":"not_applicable","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0004497025,0.00018364053,0.0073626535,0.0009310191,0.000107643544,0.00093544595,0.0108150635,0.0017566613,0.0028385017,0.5720321,0.23270696,0.16988064],"study_design_scores_gemma":[0.000025887299,0.00003193495,0.0015086592,0.00026921395,0.000024813442,0.00041929248,0.0024376756,0.003508464,0.0006690007,0.087594904,0.90345836,0.000051839594],"about_ca_topic_score_codex":0.014852335,"about_ca_topic_score_gemma":0.024401518,"teacher_disagreement_score":0.046133574,"about_ca_system_score_codex":0.0014951768,"about_ca_system_score_gemma":0.0022206148,"threshold_uncertainty_score":0.15433222},"labels":[],"label_agreement":null},{"id":"W3136176769","doi":"10.5555/2872518.3251208","title":"Session details: Demonstrations","year":2016,"lang":"en","type":"article","venue":"The Web Conference","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":true,"ca_institutions":"University of Ottawa","funders":"","keywords":"Session (web analytics); World Wide Web; Computer science; Cloud computing","score_opus":0.03646121102750051,"score_gpt":0.25639285367462494,"score_spread":0.21993164264712445,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W3136176769","genre_codex":"other","genre_gemma":"other","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"other","genre_consensus":"other","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.020395353,0.0020984032,0.08381986,0.014425543,0.01736944,0.005082271,0.029727422,0.053052608,0.7740292],"genre_scores_gemma":[0.116818026,0.0019620566,0.066056535,0.0039863447,0.0018462692,0.005097008,0.03749038,0.007462253,0.75928116],"study_design_codex":"not_applicable","study_design_gemma":"not_applicable","domain_scores_codex":[0.9988978,0.00024916834,0.000054060976,0.00020681952,0.00036563532,0.00022640242],"domain_scores_gemma":[0.9968156,0.00048277993,0.000067100686,0.00050234026,0.00075832533,0.0013737227],"candidate_categories":["insufficient_payload"],"consensus_categories":["insufficient_payload"],"category_scores_codex":[0.002462331,0.0013262187,0.000848738,0.0006200449,0.0020940197,0.0029712752,0.0024419508,0.0024398677,0.47858608],"category_scores_gemma":[0.004972764,0.00046183824,0.0010115057,0.0007093448,0.00043349428,0.0028333648,0.003620631,0.0027062693,0.2104445],"study_design_candidate":"not_applicable","study_design_consensus":"not_applicable","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0008445835,0.0012133811,0.00049960526,0.0003621457,0.00002601324,0.00025717058,0.00021738908,0.001920396,0.0023525348,0.004952611,0.9135694,0.07378482],"study_design_scores_gemma":[0.00039998326,0.00069197203,0.0011094118,0.00009508384,0.000021887518,0.00014874246,0.00023803093,0.004472902,0.0024191835,0.0057630804,0.98459345,0.000046306544],"about_ca_topic_score_codex":0.0049603544,"about_ca_topic_score_gemma":0.0063151964,"teacher_disagreement_score":0.5214139,"about_ca_system_score_codex":0.0010353453,"about_ca_system_score_gemma":0.00162999,"threshold_uncertainty_score":0.74373364},"labels":[],"label_agreement":null},{"id":"W3137173172","doi":"10.11371/iieej.39.644","title":"“WebFingerprint: A New Scheme to Arbitrate Mismatch of Web Pages”","year":2010,"lang":"fi","type":"article","venue":"Gazou Denshi Gakkaishi/Gazō Denshi Gakkaishi/Gazo Denshi Gakkaishi","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":0,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Hatch (Canada)","funders":"","keywords":"Computer science; Scheme (mathematics); Web page; World Wide Web; Mathematics","score_opus":0.025787940267232416,"score_gpt":0.2611535221808273,"score_spread":0.2353655819135949,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W3137173172","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.043247707,0.00045582224,0.87582517,0.0019317424,0.0013435791,0.0005465138,0.0013837345,0.064393535,0.010872281],"genre_scores_gemma":[0.49267384,0.00016805493,0.47720197,0.0013436589,0.0008043591,0.0005853221,0.0022421263,0.0040808464,0.020899827],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9893935,0.002537035,0.0010652695,0.0018285685,0.0042623538,0.00091323984],"domain_scores_gemma":[0.96881527,0.006704958,0.0018881459,0.015825234,0.005294366,0.0014720372],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0108288275,0.0012769409,0.0018079764,0.004333999,0.0019391072,0.0042709815,0.0037792013,0.0039983485,0.022611052],"category_scores_gemma":[0.039160546,0.00093558006,0.0007999254,0.0035320546,0.0019731666,0.011389541,0.006824883,0.0023551167,0.008544778],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.003782223,0.0005360748,0.012343327,0.00025687297,0.00019205864,0.0006081485,0.0005753976,0.00574041,0.024635501,0.041698575,0.060855858,0.8487755],"study_design_scores_gemma":[0.0008457818,0.0009942915,0.011595218,0.00016008546,0.0002907303,0.0022157638,0.00054734526,0.47512648,0.15016903,0.17633231,0.18107454,0.0006483808],"about_ca_topic_score_codex":0.0010086024,"about_ca_topic_score_gemma":0.0012397392,"teacher_disagreement_score":0.022611052,"about_ca_system_score_codex":0.0011239895,"about_ca_system_score_gemma":0.0017117627,"threshold_uncertainty_score":0.07564151},"labels":[],"label_agreement":null},{"id":"W3139529231","doi":"10.5555/2872518.3251210","title":"Session details: PhD Symposium","year":2016,"lang":"en","type":"article","venue":"The Web Conference","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":true,"ca_institutions":"University of Waterloo","funders":"","keywords":"Session (web analytics); Gratitude; Library science; Excellence; Variety (cybernetics); Pleasure; Computer science; Political science; World Wide Web; Operations research; Psychology; Engineering","score_opus":0.036544667886983496,"score_gpt":0.2468162468180241,"score_spread":0.21027157893104062,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W3139529231","genre_codex":"other","genre_gemma":"other","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"other","genre_consensus":"other","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0015917649,0.012334102,0.0026184192,0.10020924,0.39672878,0.0011142757,0.006815241,0.002039656,0.4765485],"genre_scores_gemma":[0.0071838344,0.0066714273,0.0015170833,0.018604737,0.07070868,0.00078507524,0.003273625,0.00090118137,0.8903543],"study_design_codex":"not_applicable","study_design_gemma":"not_applicable","domain_scores_codex":[0.99721766,0.00041971452,0.00020193355,0.0006100023,0.0010452598,0.0005053115],"domain_scores_gemma":[0.99010974,0.00041859574,0.0002909009,0.00043320714,0.003506713,0.0052407896],"candidate_categories":["insufficient_payload"],"consensus_categories":["insufficient_payload"],"category_scores_codex":[0.0039058304,0.001574451,0.0012970305,0.001859955,0.003367667,0.009949576,0.0024719245,0.006969021,0.5770003],"category_scores_gemma":[0.008936261,0.0005893099,0.0014842638,0.0013134961,0.00066863385,0.0040263217,0.0052786167,0.006087283,0.45851374],"study_design_candidate":"not_applicable","study_design_consensus":"not_applicable","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.000049602273,0.00005120484,0.000096100775,0.00014932237,0.0000041744274,0.000042774027,0.00003108723,0.000023964232,0.000166271,0.0011099543,0.9772678,0.02100771],"study_design_scores_gemma":[0.000017961838,0.000039068695,0.00032604238,0.00011991159,0.000003904264,0.000058933205,0.000060983562,0.00003028184,0.00008653348,0.0007928409,0.9984566,0.0000070165647],"about_ca_topic_score_codex":0.0011289353,"about_ca_topic_score_gemma":0.0019815774,"teacher_disagreement_score":0.42299968,"about_ca_system_score_codex":0.0029270812,"about_ca_system_score_gemma":0.007355502,"threshold_uncertainty_score":0.6033577},"labels":[],"label_agreement":null},{"id":"W3140527107","doi":"10.1109/wi.2007.40","title":"ExploringWeb Search Results by Visually Specifying Utility Functions","year":2007,"lang":"en","type":"article","venue":"","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":4,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Memorial University of Newfoundland","funders":"","keywords":"Computer science; Search engine; Information retrieval; Exploratory search; Search analytics; Visual search; Coding (social sciences); Function (biology); Information needs; World Wide Web; Web search query; Artificial intelligence; Mathematics","score_opus":0.07226804054369801,"score_gpt":0.3095734374705453,"score_spread":0.23730539692684727,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W3140527107","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.04759889,0.00047006962,0.91847676,0.000348455,0.000029300363,0.00041302742,0.0014248617,0.0245787,0.006659806],"genre_scores_gemma":[0.38672045,0.0007147038,0.60205173,0.000185947,0.000031601812,0.0008761232,0.002091509,0.0027024278,0.0046255006],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9986487,0.00054848625,0.00018270436,0.00013491882,0.00036885586,0.00011634214],"domain_scores_gemma":[0.99213433,0.005695886,0.00038768753,0.0007338377,0.0008130457,0.00023524239],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.003661189,0.0015813442,0.0009580206,0.0036838043,0.00055252947,0.0040404964,0.0012554396,0.00093337917,0.006190496],"category_scores_gemma":[0.014720065,0.0005915426,0.00095450657,0.0020151532,0.00072170136,0.0039110803,0.0025936053,0.0009865927,0.0018801786],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.003479342,0.0005870477,0.010969845,0.00242637,0.0001583363,0.0013325159,0.008093883,0.07015866,0.07727836,0.086996,0.031691026,0.70682853],"study_design_scores_gemma":[0.00039864084,0.00043934965,0.0053480095,0.0006295236,0.00017010653,0.000828237,0.002020228,0.69412214,0.08286588,0.124615446,0.08812255,0.00043995134],"about_ca_topic_score_codex":0.003313449,"about_ca_topic_score_gemma":0.0041812654,"teacher_disagreement_score":0.006190496,"about_ca_system_score_codex":0.00077598944,"about_ca_system_score_gemma":0.000836759,"threshold_uncertainty_score":0.020709336},"labels":[],"label_agreement":null},{"id":"W3143517422","doi":"10.32628/cseit203116","title":"Personalized Web Search : A Review","year":2020,"lang":"en","type":"review","venue":"International Journal of Scientific Research in Computer Science Engineering and Information Technology","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":11,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Horizon College and Seminary","funders":"","keywords":"Computer science; World Wide Web; Information retrieval","score_opus":0.06038603487204426,"score_gpt":0.3766556468376558,"score_spread":0.31626961196561154,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W3143517422","genre_codex":"review","genre_gemma":"review","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"review","genre_consensus":"review","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0001440835,0.99890304,0.00015967384,0.0003544912,0.00010828499,0.000009942605,0.000040643677,0.000009777917,0.00027017767],"genre_scores_gemma":[0.0010322068,0.9977296,0.0003395871,0.00044394156,0.00021825981,0.000014479786,0.00006144523,0.0000029589103,0.00015755187],"study_design_codex":"design_other","study_design_gemma":"not_applicable","domain_scores_codex":[0.99914134,0.00015653443,0.00015809167,0.00015361633,0.00032598356,0.00006440944],"domain_scores_gemma":[0.9956475,0.002951594,0.00039312066,0.00007605835,0.00074661156,0.00018521484],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0020417317,0.0010003682,0.0029473845,0.005997663,0.0003935793,0.0021586283,0.0017470606,0.0018520831,0.005041026],"category_scores_gemma":[0.0054148086,0.0005466648,0.0012484988,0.007403186,0.0005563341,0.0035166896,0.0010366727,0.0015855333,0.0015800361],"study_design_candidate":"not_applicable","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00017451312,0.00017458102,0.00089410035,0.05197031,0.00043247393,0.0001243818,0.000064792475,0.00032075137,0.0004316025,0.0011232984,0.038019963,0.9062693],"study_design_scores_gemma":[0.00028055458,0.00060517143,0.007974213,0.055039622,0.0048552104,0.003052687,0.00032995423,0.0011741527,0.001171388,0.0040485077,0.9213049,0.00016383825],"about_ca_topic_score_codex":0.002794685,"about_ca_topic_score_gemma":0.006128988,"teacher_disagreement_score":0.005997663,"about_ca_system_score_codex":0.0010097673,"about_ca_system_score_gemma":0.0031335456,"threshold_uncertainty_score":0.016863942},"labels":[],"label_agreement":null},{"id":"W3146380147","doi":"","title":"The ldentification and Cloning of Human Ubiquitin Binding Enzyme cDNA","year":2000,"lang":"en","type":"article","venue":"Zhongguo Yixue Kexueyuan xuebao","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"CAE (Canada)","funders":"","keywords":"Complementary DNA; cDNA library; Biology; Northern blot; Molecular biology; Ubiquitin; Ubiquitin-conjugating enzyme; Gene; Peptide sequence; Exon; Enzyme; Isozyme; Biochemistry; Ubiquitin ligase","score_opus":0.01450117124829581,"score_gpt":0.2501203639627452,"score_spread":0.23561919271444937,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W3146380147","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.80914325,0.023215631,0.1312703,0.0016465521,0.00055495586,0.00069243973,0.018176753,0.00081496726,0.014485211],"genre_scores_gemma":[0.7283811,0.019709101,0.15739542,0.0006443943,0.00026767122,0.00067797233,0.044505384,0.00018481427,0.048234127],"study_design_codex":"bench_or_experimental","study_design_gemma":"bench_or_experimental","domain_scores_codex":[0.99985445,0.000010014054,0.000014235229,0.000050668696,0.000040612693,0.000030017118],"domain_scores_gemma":[0.99991286,0.000020648398,0.000009800392,0.000012534821,0.000024303394,0.000019847506],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.00016084537,0.00029638264,0.0003333668,0.0006239194,0.0003190539,0.00033188114,0.00021143955,0.00033779404,0.0029841836],"category_scores_gemma":[0.00022808027,0.00021137444,0.00031191026,0.000499003,0.0001773434,0.00023378848,0.00021047167,0.0005073722,0.0017048701],"study_design_candidate":"bench_or_experimental","study_design_consensus":"bench_or_experimental","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.000138888,0.000047917958,0.00085474545,0.00018417912,0.000009995502,0.00033416974,0.0000464199,0.00015198045,0.97471243,0.00067846465,0.00062404905,0.02221687],"study_design_scores_gemma":[0.000092353424,0.00045667382,0.029364264,0.00006540063,0.0000811071,0.0042037377,0.00014698367,0.0041485988,0.8542975,0.00086514355,0.10624615,0.00003207406],"about_ca_topic_score_codex":0.0015130745,"about_ca_topic_score_gemma":0.001518931,"teacher_disagreement_score":0.0029841836,"about_ca_system_score_codex":0.0003402329,"about_ca_system_score_gemma":0.0005389816,"threshold_uncertainty_score":0.009983122},"labels":[],"label_agreement":null},{"id":"W3169038444","doi":"10.13052/jwe1540-9589.2042","title":"A New Semantic Approach to Improve Webpage Segmentation","year":2021,"lang":"en","type":"article","venue":"Journal of Web Engineering","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":5,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Alberta","funders":"","keywords":"Segmentation; Web page; Computer science; Merge (version control); Information retrieval; Artificial intelligence; Data mining; World Wide Web","score_opus":0.008387315172901347,"score_gpt":0.21164046107917184,"score_spread":0.2032531459062705,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W3169038444","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.016234774,0.00066123036,0.9750063,0.00013215428,0.00009411589,0.00016069062,0.00039660564,0.004751304,0.0025629066],"genre_scores_gemma":[0.19221368,0.00064022973,0.8010054,0.00025001343,0.00015694696,0.00024985135,0.0019827539,0.0007553951,0.0027456246],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9983785,0.00019407706,0.00013869599,0.00048973376,0.0006634122,0.00013556582],"domain_scores_gemma":[0.9987067,0.0002180685,0.00015068216,0.00022508152,0.00062624004,0.00007321005],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0011182773,0.0014527335,0.0013224895,0.007802607,0.0007351345,0.0016425664,0.0012905889,0.0014119026,0.0021674724],"category_scores_gemma":[0.0025468995,0.0004915084,0.0022033323,0.0054284926,0.0011525099,0.004071897,0.0015158014,0.0011475584,0.0016666942],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00044879413,0.00049657206,0.006575519,0.0007410759,0.00028554216,0.00023480935,0.0005039462,0.054573257,0.074368745,0.017664086,0.010629925,0.8334777],"study_design_scores_gemma":[0.000050156355,0.00019436218,0.006353241,0.00007653213,0.00021058855,0.0004268135,0.00025706136,0.9048557,0.04125565,0.023983765,0.022258364,0.00007772066],"about_ca_topic_score_codex":0.0050860755,"about_ca_topic_score_gemma":0.006864782,"teacher_disagreement_score":0.007802607,"about_ca_system_score_codex":0.0009200326,"about_ca_system_score_gemma":0.0015900999,"threshold_uncertainty_score":0.010112941},"labels":[],"label_agreement":null},{"id":"W3169956799","doi":"10.22215/etd/2021-14417","title":"Search Engines That Scan For Internet-Connected Services: Classification and Empirical Study","year":2021,"lang":"en","type":"dissertation","venue":"","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Carleton University","funders":"","keywords":"The Internet; World Wide Web; Scope (computer science); Computer science; Internet presence management; Internet research; Internet appliance; Search engine; Internet Draft; Internet Connection Sharing; Metasearch engine; Web page; Information retrieval; Internet access; Web search query","score_opus":0.07018848024639512,"score_gpt":0.35056178507489766,"score_spread":0.28037330482850253,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W3169956799","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.99494225,0.0010960334,0.0004537009,0.0005141044,0.00001646123,0.000051180265,0.0009641346,0.00001514364,0.0019468914],"genre_scores_gemma":[0.9945103,0.0009506263,0.00052767206,0.00013941759,0.0000947561,0.000046334702,0.0030760516,0.000024011344,0.00063081546],"study_design_codex":"observational","study_design_gemma":"observational","domain_scores_codex":[0.99656737,0.001034715,0.00044454075,0.0003933278,0.001068262,0.00049178896],"domain_scores_gemma":[0.9308016,0.046868067,0.01267716,0.0026458283,0.0045110486,0.0024962428],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0054675345,0.00050533924,0.0009382988,0.009374368,0.0009773672,0.0037864235,0.001190765,0.0013741427,0.0037116003],"category_scores_gemma":[0.045955963,0.00031878453,0.0010786323,0.015438962,0.0014093663,0.005810818,0.0014532373,0.0023147066,0.0023640369],"study_design_candidate":"observational","study_design_consensus":"observational","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00009924559,0.00028896012,0.9883342,0.00008580377,0.00008001483,0.00005492048,0.00059700164,0.00013173658,0.000093702976,0.00060278305,0.0008522052,0.008779416],"study_design_scores_gemma":[0.000026236461,0.0001424791,0.9836166,0.00017289564,0.00017027116,0.0007837939,0.0050358805,0.006501556,0.00032458213,0.0013677583,0.0018309384,0.000026903093],"about_ca_topic_score_codex":0.0070359437,"about_ca_topic_score_gemma":0.005638574,"teacher_disagreement_score":0.009374368,"about_ca_system_score_codex":0.000978762,"about_ca_system_score_gemma":0.0010841092,"threshold_uncertainty_score":0.028915405},"labels":[],"label_agreement":null},{"id":"W3174795705","doi":"","title":"Invited Talk: Search Engine Experience and Internals","year":2001,"lang":"en","type":"article","venue":"USENIX Symposium on Internet Technologies and Systems","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":0,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"PQ Corporation (Canada)","funders":"","keywords":"Computer science","score_opus":0.02599620732254052,"score_gpt":0.2577178404254412,"score_spread":0.2317216331029007,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W3174795705","genre_codex":"empirical","genre_gemma":"other","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"other","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.44296113,0.022152193,0.005921821,0.17128272,0.027571796,0.00018426118,0.009890274,0.0024152112,0.31762058],"genre_scores_gemma":[0.6120643,0.005672203,0.0016350222,0.018965911,0.0109101115,0.0001271352,0.0050724633,0.0017078103,0.34384498],"study_design_codex":"not_applicable","study_design_gemma":"not_applicable","domain_scores_codex":[0.9987519,0.00027490687,0.0000713909,0.00017626249,0.00052765483,0.00019786433],"domain_scores_gemma":[0.9906131,0.0038821995,0.0005573715,0.0003966671,0.0024303745,0.0021202266],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.003362668,0.0003842247,0.00047214865,0.0018483292,0.0018647771,0.006973193,0.0006256373,0.0019802304,0.050578613],"category_scores_gemma":[0.015155504,0.00027387516,0.00051749166,0.0022187456,0.000652997,0.0047614416,0.0018990301,0.0018513236,0.016673863],"study_design_candidate":"not_applicable","study_design_consensus":"not_applicable","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00051504857,0.00046917598,0.042433295,0.00034495885,0.000058335296,0.00060956454,0.013826834,0.0001780624,0.0020013843,0.005003878,0.809765,0.12479448],"study_design_scores_gemma":[0.000075349715,0.00046710513,0.09197961,0.0003590155,0.00016098308,0.0015438916,0.022491245,0.0010592988,0.0033990743,0.0042276313,0.8740722,0.00016449607],"about_ca_topic_score_codex":0.0021179395,"about_ca_topic_score_gemma":0.0040664184,"teacher_disagreement_score":0.050578613,"about_ca_system_score_codex":0.00092775124,"about_ca_system_score_gemma":0.0007474975,"threshold_uncertainty_score":0.16920233},"labels":[],"label_agreement":null},{"id":"W3175228675","doi":"","title":"Abstract Podcast Summarization using BART with Longformer Attention.","year":2020,"lang":"en","type":"article","venue":"Text REtrieval Conference","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":3,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Simon Fraser University","funders":"","keywords":"Automatic summarization; Computer science; Information retrieval; Bartok; Multi-document summarization; Natural language processing; Literature; Art","score_opus":0.059727043961456026,"score_gpt":0.25761752029275026,"score_spread":0.19789047633129422,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W3175228675","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.045153964,0.004560372,0.9017177,0.0012647854,0.0036348628,0.00056418433,0.004816881,0.026451245,0.011836024],"genre_scores_gemma":[0.5331414,0.0015930879,0.39766186,0.0007625823,0.0037786204,0.00041183448,0.016962564,0.0016116793,0.04407635],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9992656,0.00012949262,0.000065175416,0.00017820034,0.00025022155,0.000111199195],"domain_scores_gemma":[0.9976566,0.0005678583,0.0001373334,0.0004382987,0.0009879549,0.00021192052],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0009880287,0.0011888943,0.0015567029,0.0030791175,0.0011313532,0.0021896826,0.0012668883,0.0011741868,0.017863858],"category_scores_gemma":[0.004906649,0.00031765108,0.00072577305,0.002821326,0.00041253673,0.0023560736,0.0016281588,0.0012452708,0.006409601],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.001663616,0.00028613425,0.0011329409,0.0003821042,0.00013199716,0.00022978312,0.00018192794,0.01262534,0.027719375,0.002966675,0.056443617,0.8962366],"study_design_scores_gemma":[0.0002745067,0.0009269057,0.0054987436,0.00009988905,0.00045058804,0.00035887733,0.00068830233,0.86170053,0.048216872,0.017840115,0.063831165,0.000113457994],"about_ca_topic_score_codex":0.0050418894,"about_ca_topic_score_gemma":0.0111743845,"teacher_disagreement_score":0.017863858,"about_ca_system_score_codex":0.0005375932,"about_ca_system_score_gemma":0.0013659657,"threshold_uncertainty_score":0.05976057},"labels":[],"label_agreement":null},{"id":"W3175691360","doi":"10.31341/jios.45.1.13","title":"Real-time Web Search Framework for Performing Efficient Retrieval of Data","year":2021,"lang":"en","type":"article","venue":"Journal of information and organizational sciences","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":3,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Ottawa","funders":"","keywords":"Computer science; Relevance (law); Context (archaeology); Information retrieval; Real-time data; Key (lock); The Internet; Data mining; World Wide Web","score_opus":0.027346471104697942,"score_gpt":0.29858475094524944,"score_spread":0.2712382798405515,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W3175691360","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.021717295,0.0022579378,0.9681911,0.0002898763,0.00007707366,0.00020083529,0.0002577473,0.0043371986,0.002671027],"genre_scores_gemma":[0.43609124,0.0011666698,0.55609256,0.00024699917,0.00015074556,0.00029865888,0.0006767102,0.00027008663,0.0050063385],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.99855345,0.00034081918,0.00012797002,0.0003542171,0.00045326454,0.00017020584],"domain_scores_gemma":[0.99903095,0.00025023488,0.000111980604,0.00021830661,0.00028767763,0.00010090136],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0015112443,0.00070725294,0.0011777153,0.001763489,0.00067580875,0.0017554924,0.0020147467,0.0009870662,0.0023449967],"category_scores_gemma":[0.0034937898,0.0002911096,0.0008239756,0.0020984884,0.000496057,0.0033454148,0.0013738459,0.0008978837,0.001274041],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.001117607,0.0008459306,0.0050976244,0.0011487317,0.00028946888,0.0006789417,0.00076738896,0.22772104,0.039781563,0.07966174,0.022960858,0.6199291],"study_design_scores_gemma":[0.000046528374,0.00015834885,0.00059950916,0.00001944731,0.000050088092,0.0003030281,0.00009817496,0.96723735,0.0045666923,0.017387073,0.009500573,0.00003310355],"about_ca_topic_score_codex":0.0075866235,"about_ca_topic_score_gemma":0.008593891,"teacher_disagreement_score":0.0075866235,"about_ca_system_score_codex":0.000988864,"about_ca_system_score_gemma":0.0017469542,"threshold_uncertainty_score":0.015084922},"labels":[],"label_agreement":null},{"id":"W3175911760","doi":"10.1145/3471485.3471494","title":"Efficient Directed Densest Subgraph Discovery","year":2021,"lang":"en","type":"article","venue":"ACM SIGMOD Record","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":15,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of British Columbia","funders":"","keywords":"Scalability; Computer science; Induced subgraph isomorphism problem; Graph; Enhanced Data Rates for GSM Evolution; Subgraph isomorphism problem; Core (optical fiber); Theoretical computer science; Graph factorization; Efficient algorithm; Algorithm; Database; Line graph; Artificial intelligence; Voltage graph","score_opus":0.01560761602411701,"score_gpt":0.23701589540386872,"score_spread":0.22140827937975172,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W3175911760","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.05953621,0.001437167,0.91809434,0.0015176787,0.00015416765,0.00050292996,0.0046239356,0.00794359,0.006189918],"genre_scores_gemma":[0.22555059,0.00054795924,0.75403965,0.0004047903,0.00009434208,0.0003013645,0.013296161,0.0005298563,0.0052353996],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.99785465,0.00042533423,0.00011526602,0.0006622122,0.00068283937,0.0002597783],"domain_scores_gemma":[0.99507153,0.0020252871,0.0004126014,0.0015211515,0.00071022875,0.00025928483],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0013756008,0.0014002289,0.0019965654,0.0034538913,0.0014033555,0.00216501,0.0031527968,0.0016420207,0.0041606375],"category_scores_gemma":[0.009554587,0.00093083165,0.0018441174,0.0054556434,0.0008949503,0.00408294,0.0029121686,0.0014927705,0.0017282045],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00048032985,0.00049685634,0.009645627,0.000995839,0.00028105275,0.0005265068,0.00073066796,0.23649108,0.010193095,0.048327584,0.07449201,0.6173393],"study_design_scores_gemma":[0.00008589556,0.00005413729,0.0010392214,0.000034712655,0.000055965473,0.00034231256,0.00028185107,0.92299825,0.0037124283,0.06293352,0.008440258,0.00002142733],"about_ca_topic_score_codex":0.012571457,"about_ca_topic_score_gemma":0.028330615,"teacher_disagreement_score":0.012571457,"about_ca_system_score_codex":0.0017899616,"about_ca_system_score_gemma":0.004011743,"threshold_uncertainty_score":0.024996579},"labels":[],"label_agreement":null},{"id":"W3182578261","doi":"10.13052/jwe1540-9589.2044","title":"An Empirical Study of Web Page Structural Properties","year":2021,"lang":"en","type":"article","venue":"Journal of Web Engineering","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":1,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Université du Québec à Chicoutimi","funders":"","keywords":"Computer science; World Wide Web; Web page; Empirical research; Markup language; The Internet; Information retrieval; Point (geometry); Scale (ratio); Data science; Geography; Mathematics; XML; Statistics; Cartography","score_opus":0.02353228315998903,"score_gpt":0.2631916756365842,"score_spread":0.23965939247659515,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W3182578261","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.99662256,0.000083943545,0.0008757072,0.000051362033,0.0000028024767,0.000028849707,0.00061300455,0.000019626212,0.001702033],"genre_scores_gemma":[0.99755126,0.0000707676,0.00097649643,0.000014328853,0.000010514312,0.00002797102,0.000990622,0.000011910242,0.00034619294],"study_design_codex":"observational","study_design_gemma":"observational","domain_scores_codex":[0.99771297,0.0008892542,0.00022242001,0.00026386642,0.00077354704,0.00013795812],"domain_scores_gemma":[0.85046697,0.113297395,0.016557945,0.0068617053,0.010827239,0.0019887132],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0030712048,0.00021736031,0.00022827827,0.0029001683,0.00050848984,0.0011207887,0.00047484797,0.00052460184,0.003510953],"category_scores_gemma":[0.046560194,0.00021777373,0.00024493824,0.004096072,0.00090839446,0.0029222227,0.00051193574,0.000827121,0.00080164574],"study_design_candidate":"observational","study_design_consensus":"observational","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00017485517,0.0009043317,0.97069,0.00015541282,0.00006232817,0.00016460923,0.0016177701,0.001292713,0.0015335288,0.0014275941,0.0006851351,0.021291714],"study_design_scores_gemma":[0.000013699012,0.00048084155,0.98244435,0.000045198267,0.00004295199,0.0005734802,0.0031417666,0.007510324,0.0020515309,0.001133385,0.002543203,0.00001923788],"about_ca_topic_score_codex":0.001236246,"about_ca_topic_score_gemma":0.001570576,"teacher_disagreement_score":0.003510953,"about_ca_system_score_codex":0.00037624658,"about_ca_system_score_gemma":0.00043269724,"threshold_uncertainty_score":0.016242266},"labels":[],"label_agreement":null},{"id":"W3193697788","doi":"10.1007/978-3-030-86324-1_9","title":"Where Did the Web Archive Go?","year":2021,"lang":"en","type":"preprint","venue":"Lecture notes in computer science","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":0,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Columbia College","funders":"","keywords":"World Wide Web; Sample (material); Computer science; Web page; Code (set theory); History","score_opus":0.014523735052984326,"score_gpt":0.25279544355612504,"score_spread":0.23827170850314072,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W3193697788","genre_codex":"other","genre_gemma":"other","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"other","genre_consensus":"other","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.071236566,0.025846403,0.04565802,0.35369375,0.022359783,0.00041186807,0.034019668,0.019903349,0.42687058],"genre_scores_gemma":[0.5359206,0.024281807,0.060082246,0.04137134,0.0090451995,0.00029330418,0.02567201,0.021934483,0.28139907],"study_design_codex":"not_applicable","study_design_gemma":"not_applicable","domain_scores_codex":[0.99704665,0.00064430083,0.00025576312,0.00052852544,0.0009609635,0.0005638303],"domain_scores_gemma":[0.9817784,0.0023255716,0.0010772954,0.0036573785,0.00823843,0.0029228767],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0052744616,0.0004941214,0.0010174593,0.0079526035,0.0044388743,0.019885411,0.0016595111,0.004123387,0.040430285],"category_scores_gemma":[0.023721186,0.0006929071,0.0007198358,0.009702977,0.0033139011,0.035607252,0.0036729749,0.005616126,0.030887369],"study_design_candidate":"not_applicable","study_design_consensus":"not_applicable","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00039114934,0.00012562251,0.013809495,0.0005520226,0.000046055105,0.0008711885,0.003210711,0.00038146795,0.0017353977,0.13183555,0.5678095,0.2792318],"study_design_scores_gemma":[0.000024521469,0.000025617823,0.00584949,0.00067773875,0.00003764707,0.00064608396,0.005731593,0.0007637217,0.0028786585,0.033143748,0.9501219,0.00009927729],"about_ca_topic_score_codex":0.024066275,"about_ca_topic_score_gemma":0.02422781,"teacher_disagreement_score":0.040430285,"about_ca_system_score_codex":0.003691646,"about_ca_system_score_gemma":0.005313029,"threshold_uncertainty_score":0.13525277},"labels":[],"label_agreement":null},{"id":"W31965721","doi":"10.1111/cob.12355","title":"Enhanced Information Retrieval by Using HTML Tags.","year":2005,"lang":"en","type":"article","venue":"DMIN","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":4,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"","funders":"Institut du savoir Montfort-Recherche","keywords":"Information retrieval; Computer science; World Wide Web","score_opus":0.011341666335156944,"score_gpt":0.24429231449894137,"score_spread":0.2329506481637844,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W31965721","genre_codex":"software","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.007449282,0.0049843066,0.33061492,0.0022254302,0.0021941965,0.0018366026,0.20290418,0.34228787,0.10550328],"genre_scores_gemma":[0.05688145,0.0053032213,0.3854118,0.0037849536,0.00088607933,0.0020691422,0.31931478,0.031543456,0.19480512],"study_design_codex":"not_applicable","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.99879694,0.00024834965,0.0002084039,0.00021079494,0.00040425817,0.00013135186],"domain_scores_gemma":[0.99660987,0.0013928245,0.00023179362,0.00080973003,0.00071651035,0.00023928408],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0019833653,0.0026825964,0.0013075673,0.006492402,0.0006403478,0.004295517,0.0016377292,0.0023236123,0.17124496],"category_scores_gemma":[0.0071144733,0.0009367392,0.0016688529,0.00585089,0.0003134592,0.006674414,0.004128291,0.001367264,0.19198935],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0005634144,0.00022557478,0.0011104001,0.0024209782,0.0001294168,0.00057485484,0.00040857962,0.00064410345,0.010480755,0.0059417835,0.5211906,0.45630956],"study_design_scores_gemma":[0.0001816475,0.00019442043,0.0027232955,0.0007726843,0.00012699387,0.00086543633,0.00034802905,0.013284636,0.012978296,0.019844003,0.9485387,0.00014183886],"about_ca_topic_score_codex":0.0024273435,"about_ca_topic_score_gemma":0.0029982275,"teacher_disagreement_score":0.17124496,"about_ca_system_score_codex":0.0006625011,"about_ca_system_score_gemma":0.0009586534,"threshold_uncertainty_score":0.57287145},"labels":[],"label_agreement":null},{"id":"W32038199","doi":"10.3389/fnhum.2019.00463","title":"XML Query Support for Web Information Extraction: A Study on HTML Element Depth Distribution ?","year":2005,"lang":"en","type":"article","venue":"Frontiers in Human Neuroscience","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"","funders":"Natural Sciences and Engineering Research Council of Canada","keywords":"Computer science; Information retrieval; XML; Database; Information extraction; XML database; Document Structure Description; Web query classification; Point (geometry); Database query; Data mining; Search engine; Web search query; World Wide Web; Mathematics","score_opus":0.02458695769088694,"score_gpt":0.29784153428579846,"score_spread":0.27325457659491154,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W32038199","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.58843875,0.008049925,0.06947382,0.004947411,0.00029579623,0.0057213996,0.19058557,0.034408264,0.0980791],"genre_scores_gemma":[0.6020726,0.00595968,0.11823293,0.0026427538,0.0002398943,0.0027053256,0.20752725,0.008028701,0.052590854],"study_design_codex":"design_other","study_design_gemma":"observational","domain_scores_codex":[0.9974986,0.00086869416,0.00049454806,0.00036293548,0.00062535924,0.00014988969],"domain_scores_gemma":[0.9789691,0.016461559,0.00083112426,0.0012062407,0.0021747428,0.00035725796],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.003866053,0.0006244658,0.00086998474,0.0049218168,0.0007895717,0.0021854816,0.0007748994,0.0009730871,0.035999186],"category_scores_gemma":[0.02564164,0.00035305167,0.00081857643,0.0058671627,0.00031324683,0.0041660247,0.0015215251,0.0005020885,0.014499593],"study_design_candidate":"observational","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0028259247,0.0012146179,0.06697768,0.008310268,0.00019042139,0.0025146306,0.008784467,0.0005099105,0.012836914,0.0040805466,0.11943985,0.77231485],"study_design_scores_gemma":[0.00062289974,0.0010751807,0.23693742,0.0024266932,0.0008399337,0.005637427,0.012109693,0.0226782,0.019119315,0.0057039093,0.69257814,0.00027120762],"about_ca_topic_score_codex":0.009378744,"about_ca_topic_score_gemma":0.007940364,"teacher_disagreement_score":0.035999186,"about_ca_system_score_codex":0.0005561721,"about_ca_system_score_gemma":0.0013954837,"threshold_uncertainty_score":0.12042928},"labels":[],"label_agreement":null},{"id":"W3203911409","doi":"10.1145/3465403","title":"CodeMatcher: Searching Code Based on Sequential Semantics of Important Query Words","year":2021,"lang":"en","type":"article","venue":"ACM Transactions on Software Engineering and Methodology","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":29,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Queen's University","funders":"","keywords":"Computer science; Programming language; Semantics (computer science); Information retrieval; Natural language processing","score_opus":0.08444068339043621,"score_gpt":0.3254469426044706,"score_spread":0.2410062592140344,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W3203911409","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.1780628,0.0029701104,0.72513103,0.0009161563,0.00015847168,0.0009104634,0.00716982,0.07825727,0.0064239176],"genre_scores_gemma":[0.4117323,0.0009371737,0.5618519,0.00061476947,0.00005592271,0.00055850885,0.015321497,0.0016720268,0.007255972],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9987949,0.00011452373,0.000102757826,0.00045978941,0.00044123895,0.00008674254],"domain_scores_gemma":[0.9985311,0.0005212316,0.00019407617,0.00031292884,0.00034719572,0.00009348483],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0007698426,0.0014424277,0.0011202177,0.004536153,0.00057744334,0.0011234772,0.002385695,0.0010952735,0.0030016876],"category_scores_gemma":[0.0052586216,0.00055770064,0.001066542,0.0028888308,0.00078474596,0.0045948755,0.0020141294,0.0010039691,0.0015127979],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0010813017,0.00046946338,0.01876595,0.0014773442,0.00020349283,0.000585572,0.00087769056,0.03997193,0.05615087,0.015828174,0.037824843,0.82676333],"study_design_scores_gemma":[0.00012220212,0.00038428028,0.0039879205,0.000060986124,0.00010309291,0.00061859406,0.0002730038,0.9161671,0.037940763,0.018143337,0.022120127,0.0000785571],"about_ca_topic_score_codex":0.015530403,"about_ca_topic_score_gemma":0.023631757,"teacher_disagreement_score":0.015530403,"about_ca_system_score_codex":0.0010753665,"about_ca_system_score_gemma":0.0024424305,"threshold_uncertainty_score":0.030880034},"labels":[],"label_agreement":null},{"id":"W3210708818","doi":"10.5281/zenodo.3633290","title":"General web archive collection derivatives","year":2020,"lang":"en","type":"dataset","venue":"Zenodo (CERN European Organization for Nuclear Research)","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"York University","funders":"","keywords":"World Wide Web; Computer science; Information retrieval; Database","score_opus":0.03233145758320511,"score_gpt":0.24343452146020633,"score_spread":0.21110306387700123,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W3210708818","genre_codex":"other","genre_gemma":"dataset","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"dataset","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0009973821,0.0008743412,0.005857302,0.001220219,0.001540496,0.00058926165,0.2667815,0.072790235,0.6493493],"genre_scores_gemma":[0.002920053,0.0011838729,0.00818497,0.0007358606,0.00038584386,0.000536999,0.32377946,0.041702643,0.62057024],"study_design_codex":"not_applicable","study_design_gemma":"not_applicable","domain_scores_codex":[0.9969777,0.00022795158,0.0002736345,0.0003284012,0.0019164016,0.00027595667],"domain_scores_gemma":[0.9862781,0.00072519237,0.0003708175,0.0036541668,0.0077242795,0.0012475327],"candidate_categories":["insufficient_payload"],"consensus_categories":[],"category_scores_codex":[0.0018353121,0.0018867133,0.0016995118,0.017082378,0.004190987,0.012273865,0.0034350958,0.0014524326,0.6011736],"category_scores_gemma":[0.012545056,0.0018040824,0.0010017363,0.026656905,0.0011455766,0.006684811,0.0060538594,0.0033431866,0.6421238],"study_design_candidate":"not_applicable","study_design_consensus":"not_applicable","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.000023019038,0.000013622677,0.00011027684,0.00011905543,0.0000028357554,0.000028079525,0.000057968504,0.000027912334,0.00017015774,0.0013357026,0.9778788,0.020232676],"study_design_scores_gemma":[0.0000054195307,0.0000024173053,0.0002857235,0.000058609527,0.0000026660214,0.00003503652,0.00003317267,0.00003754463,0.00023193631,0.00043788282,0.9988557,0.0000137574725],"about_ca_topic_score_codex":0.08523905,"about_ca_topic_score_gemma":0.10267765,"teacher_disagreement_score":0.6011736,"about_ca_system_score_codex":0.0057553225,"about_ca_system_score_gemma":0.012622547,"threshold_uncertainty_score":0.56887746},"labels":[],"label_agreement":null},{"id":"W3210786751","doi":"10.1007/s00799-021-00314-x","title":"Correspondence as the primary measure of information quality for web archives: a human-centered grounded theory study","year":2021,"lang":"en","type":"article","venue":"International Journal on Digital Libraries","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":5,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Alberta","funders":"","keywords":"World Wide Web; Computer science; Quality (philosophy); Web development; Grounded theory; The Internet; Field (mathematics); Relevance (law); Web standards; Sociology; Qualitative research; Political science","score_opus":0.0373775472066888,"score_gpt":0.29931203503727,"score_spread":0.2619344878305812,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W3210786751","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.90485984,0.00045377327,0.049483705,0.0028936833,0.000064023814,0.0010546591,0.0004043112,0.000086367676,0.040699556],"genre_scores_gemma":[0.98899406,0.00006681115,0.010301548,0.0000930111,0.000007072042,0.00018012762,0.00005418686,0.000019403406,0.00028382166],"study_design_codex":"qualitative","study_design_gemma":"qualitative","domain_scores_codex":[0.959915,0.025951425,0.0016425472,0.0020706109,0.009621451,0.00079891767],"domain_scores_gemma":[0.67422277,0.27370062,0.014588599,0.009700208,0.024707569,0.003080279],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.029232094,0.00038986467,0.00086129864,0.0073848646,0.0042061885,0.008956208,0.0016959412,0.0013306545,0.003176337],"category_scores_gemma":[0.12940821,0.0005100573,0.0010596929,0.007782543,0.0063401563,0.0066772792,0.003757086,0.0030034417,0.00024096269],"study_design_candidate":"qualitative","study_design_consensus":"qualitative","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0008951096,0.0028665583,0.2850129,0.0024949142,0.00045887593,0.00035632786,0.32029685,0.0031440319,0.0037903474,0.19350895,0.0021062978,0.18506879],"study_design_scores_gemma":[0.00035808363,0.0023088495,0.31124386,0.0027142556,0.0011856896,0.00067276374,0.44512054,0.04526355,0.02032303,0.15186518,0.018607348,0.00033680265],"about_ca_topic_score_codex":0.006616145,"about_ca_topic_score_gemma":0.0069167414,"teacher_disagreement_score":0.029232094,"about_ca_system_score_codex":0.010924161,"about_ca_system_score_gemma":0.013889148,"threshold_uncertainty_score":0.15459597},"labels":[],"label_agreement":null},{"id":"W3214838052","doi":"10.5206/mt.v1i2.14351","title":"Problems, Puzzles, and Challenges","year":2021,"lang":"en","type":"article","venue":"Maple Transactions","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":true,"route_about_ca":false,"ca_institutions":"Western University","funders":"","keywords":"Computation; Computer science; Data science; Mathematical economics; Mathematics; Algorithm","score_opus":0.045290284758621166,"score_gpt":0.2181544542287218,"score_spread":0.17286416947010064,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W3214838052","genre_codex":"commentary","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.006466223,0.04694735,0.105826855,0.7805641,0.013271859,0.00011340255,0.00079880597,0.0007310795,0.04528024],"genre_scores_gemma":[0.2782062,0.12970306,0.31724107,0.1471049,0.048948545,0.0011307667,0.0028201446,0.0016777768,0.07316756],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.9923394,0.0031793716,0.00044600276,0.0014642561,0.0018164073,0.00075453415],"domain_scores_gemma":[0.9647747,0.023906711,0.00087074505,0.0034475045,0.0049341414,0.0020662146],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.011872796,0.0015815046,0.0017904806,0.0024657454,0.005856415,0.008569943,0.0040851897,0.007734338,0.019130044],"category_scores_gemma":[0.05083615,0.0008838262,0.0015313945,0.0029253906,0.015688974,0.028214945,0.0072326576,0.016820136,0.006298387],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.000093374976,0.00013870755,0.00067259296,0.00059703505,0.000053497693,0.0003062375,0.00087009,0.00446529,0.0002972827,0.6940007,0.22478653,0.073718615],"study_design_scores_gemma":[0.000010928043,0.000009644055,0.0001314782,0.0002016069,0.0000043435184,0.00014770709,0.0010556945,0.0022278011,0.000072014846,0.9320944,0.06401254,0.00003189112],"about_ca_topic_score_codex":0.0056618247,"about_ca_topic_score_gemma":0.003614536,"teacher_disagreement_score":0.019130044,"about_ca_system_score_codex":0.002896891,"about_ca_system_score_gemma":0.0056734444,"threshold_uncertainty_score":0.063996375},"labels":[],"label_agreement":null},{"id":"W350185006","doi":"","title":"DUTIR at TREC 2009: Chemical IR Track","year":2009,"lang":"en","type":"article","venue":"","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":2,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"York University","funders":"","keywords":"Computer science; Track (disk drive); Task (project management); Information retrieval; Query expansion; Natural language processing; Engineering","score_opus":0.013030513315104717,"score_gpt":0.2357257767141397,"score_spread":0.22269526339903498,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W350185006","genre_codex":"dataset","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.073056936,0.028117264,0.07524288,0.048350405,0.043967824,0.012695604,0.43587348,0.08478896,0.19790666],"genre_scores_gemma":[0.078488424,0.0046553346,0.06272692,0.007442812,0.0039074942,0.0023625207,0.61359894,0.006291847,0.22052568],"study_design_codex":"not_applicable","study_design_gemma":"bench_or_experimental","domain_scores_codex":[0.9928982,0.0015058665,0.000330393,0.0009118477,0.0037379763,0.00061572855],"domain_scores_gemma":[0.9807792,0.0018080528,0.00046143698,0.0018472546,0.0132484995,0.0018556733],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.012079859,0.0025283596,0.0034530412,0.0034504824,0.0034904894,0.004839089,0.0033887848,0.003006233,0.036493734],"category_scores_gemma":[0.013610667,0.00061435514,0.0010632647,0.003120513,0.00092115405,0.0026737598,0.0019312174,0.004091939,0.037621755],"study_design_candidate":"bench_or_experimental","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.000232093,0.00025335443,0.00023492897,0.00026768493,0.000040121526,0.00004317518,0.00002166457,0.00045947864,0.005416365,0.0003400875,0.96951854,0.023172438],"study_design_scores_gemma":[0.0011813339,0.0014466816,0.00895668,0.00019770615,0.00016168761,0.00050476455,0.0002444651,0.01992452,0.054549977,0.0032481463,0.90934306,0.00024094601],"about_ca_topic_score_codex":0.038350336,"about_ca_topic_score_gemma":0.06815017,"teacher_disagreement_score":0.038350336,"about_ca_system_score_codex":0.006388636,"about_ca_system_score_gemma":0.0073119137,"threshold_uncertainty_score":0.12208372},"labels":[],"label_agreement":null},{"id":"W4221060798","doi":"10.29173/cais1304","title":"UNIX techniques that make life easier for information specialists / Techniques destinées à faciliter aux spécialistes de l’information l'utilisation du système Unix","year":2022,"lang":"fr","type":"article","venue":"Proceedings of the Annual Conference of CAIS / Actes du congrès annuel de l ACSI","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":true,"route_about_ca":false,"ca_institutions":"","funders":"","keywords":"Unix; Operating system; Computer science; Unix architecture; Software","score_opus":0.04100418018857512,"score_gpt":0.257961926545621,"score_spread":0.21695774635704587,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4221060798","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.013255619,0.004497764,0.8682681,0.0045619523,0.002092823,0.0005849392,0.0010507851,0.049144745,0.056543283],"genre_scores_gemma":[0.0541473,0.004421704,0.81802404,0.0013182032,0.0015663046,0.0007448331,0.002206313,0.011160479,0.106410846],"study_design_codex":"design_other","study_design_gemma":"not_applicable","domain_scores_codex":[0.99724704,0.00085285015,0.00029182827,0.00054073933,0.00084132154,0.0002262107],"domain_scores_gemma":[0.99106336,0.002634992,0.00064201944,0.0039472464,0.0013885478,0.00032387764],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0037145354,0.0015298359,0.0008207146,0.0032323538,0.001946054,0.0045912196,0.0015853778,0.0014483657,0.056149755],"category_scores_gemma":[0.013792102,0.0013503702,0.001379465,0.0029421593,0.001246603,0.011490696,0.003934858,0.0030059514,0.029678239],"study_design_candidate":"not_applicable","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0003717844,0.0002087015,0.002380838,0.00086382095,0.00009259473,0.00034283113,0.0025414038,0.00086322846,0.02065725,0.083880454,0.108256906,0.7795401],"study_design_scores_gemma":[0.00016505104,0.0002156666,0.0040693786,0.0006790611,0.00018374619,0.0014702114,0.00084877136,0.008755059,0.036850307,0.05940771,0.8872331,0.000121947654],"about_ca_topic_score_codex":0.0012014529,"about_ca_topic_score_gemma":0.0014621685,"teacher_disagreement_score":0.056149755,"about_ca_system_score_codex":0.0006772662,"about_ca_system_score_gemma":0.0011761613,"threshold_uncertainty_score":0.18783963},"labels":[],"label_agreement":null},{"id":"W4221066006","doi":"10.1080/24701475.2022.2051331","title":"The death of GeoCities: seeking destruction and platform eulogies in Web archives","year":2022,"lang":"en","type":"article","venue":"Internet Histories","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":10,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Toronto","funders":"","keywords":"World Wide Web; Database transaction; State (computer science); Web navigation; Web 2.0; Web application; Deep Web; Internet privacy; Computer science; The Internet; Database","score_opus":0.017178795330752516,"score_gpt":0.21715587028155364,"score_spread":0.19997707495080114,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4221066006","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.97322243,0.0009284121,0.001693849,0.002222161,0.00003817952,0.000034534914,0.00074767455,0.00006166903,0.021051137],"genre_scores_gemma":[0.99223655,0.0006847495,0.0013311428,0.00018478885,0.000026970738,0.000020873793,0.00045506028,0.00005204113,0.0050078216],"study_design_codex":"qualitative","study_design_gemma":"qualitative","domain_scores_codex":[0.99891853,0.00039542853,0.00008081075,0.0001488479,0.00031711758,0.00013927775],"domain_scores_gemma":[0.9917652,0.0045539057,0.001498364,0.0008665595,0.0009001427,0.00041569237],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0022424648,0.00015244544,0.00025972,0.0052131377,0.0036657804,0.0058567366,0.0007228336,0.0012023184,0.0030596997],"category_scores_gemma":[0.01503791,0.00025776078,0.00012383802,0.00825026,0.003957777,0.007554395,0.003590512,0.0015774867,0.0007235494],"study_design_candidate":"qualitative","study_design_consensus":"qualitative","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00029281486,0.00014066155,0.28046367,0.0003588546,0.000037268754,0.0030069947,0.54045963,0.00054073246,0.0012841749,0.048232187,0.012516479,0.11266651],"study_design_scores_gemma":[0.000010703054,0.000060102193,0.15947679,0.00065873895,0.00004812501,0.0021024123,0.6585292,0.0029494588,0.003682742,0.019412007,0.1529837,0.00008596796],"about_ca_topic_score_codex":0.019888483,"about_ca_topic_score_gemma":0.045579378,"teacher_disagreement_score":0.019888483,"about_ca_system_score_codex":0.0021931117,"about_ca_system_score_gemma":0.0011337899,"threshold_uncertainty_score":0.039545476},"labels":[],"label_agreement":null},{"id":"W4221117373","doi":"10.1145/3490100.3516452","title":"BareTQL: An Interactive System for Searching and Extraction of Open Data Tables","year":2022,"lang":"en","type":"article","venue":"","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Alberta","funders":"","keywords":"Computer science; Schema (genetic algorithms); Information retrieval; Table (database); Data extraction; Open government; World Wide Web; Open data; Data science; Publishing; Data mining","score_opus":0.10847350330765518,"score_gpt":0.38853483745610423,"score_spread":0.280061334148449,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4221117373","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.006457428,0.0006941336,0.48271012,0.0008030327,0.00026466185,0.0005596633,0.03812763,0.45725888,0.013124402],"genre_scores_gemma":[0.107626416,0.0016919925,0.63256633,0.0019511438,0.00031738493,0.0016870113,0.17554873,0.056980856,0.021630175],"study_design_codex":"not_applicable","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9956632,0.00077021355,0.00056159735,0.0007076868,0.0020406789,0.00025650204],"domain_scores_gemma":[0.99178785,0.004398658,0.00040056466,0.0017965233,0.0011316395,0.00048482983],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0055247094,0.0017290777,0.0015213984,0.0043984484,0.001496706,0.006374863,0.0046048225,0.0018500525,0.028832253],"category_scores_gemma":[0.018044177,0.0015785114,0.0022620815,0.0036601073,0.0012655829,0.009320433,0.008468218,0.0021800562,0.010951647],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0026545934,0.00051312445,0.009687541,0.0026588566,0.00066820474,0.00241511,0.003168743,0.0083229365,0.028260797,0.043672852,0.618507,0.27947012],"study_design_scores_gemma":[0.0007303893,0.00022863936,0.0041782237,0.0004474663,0.0001815819,0.002404568,0.0012853356,0.13364838,0.03849778,0.09044169,0.7274392,0.00051674515],"about_ca_topic_score_codex":0.0060950313,"about_ca_topic_score_gemma":0.0060324245,"teacher_disagreement_score":0.028832253,"about_ca_system_score_codex":0.0012211284,"about_ca_system_score_gemma":0.0024465537,"threshold_uncertainty_score":0.09645349},"labels":[],"label_agreement":null},{"id":"W4223909614","doi":"10.13052/jwe1540-9589.2146","title":"Integrated-Block: A New Combination Model to Improve Web Page Segmentation","year":2022,"lang":"en","type":"article","venue":"Journal of Web Engineering","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":4,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Alberta","funders":"","keywords":"Computer science; Web page; Segmentation; Block (permutation group theory); Information retrieval; Gestalt psychology; Context (archaeology); Similarity (geometry); Artificial intelligence; Data mining; World Wide Web; Perception; Image (mathematics)","score_opus":0.011588279690456189,"score_gpt":0.2223981886257918,"score_spread":0.2108099089353356,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4223909614","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.038637545,0.0016487573,0.9475656,0.00033306621,0.0001618295,0.00030895503,0.0007113986,0.006795011,0.0038377517],"genre_scores_gemma":[0.35483652,0.00097410934,0.6299925,0.0004251159,0.000234141,0.0006099103,0.003563849,0.0012872899,0.00807664],"study_design_codex":"design_other","study_design_gemma":"bench_or_experimental","domain_scores_codex":[0.9981086,0.00029770573,0.00013615814,0.0006818677,0.00059153984,0.00018410305],"domain_scores_gemma":[0.9983247,0.00048586406,0.00019256132,0.0003063009,0.0005445155,0.00014606187],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0018009088,0.0016254089,0.002119938,0.00500955,0.0009183322,0.001971254,0.0027212156,0.0020946853,0.0042467318],"category_scores_gemma":[0.0032372617,0.0007439854,0.0025842413,0.0038439038,0.0009865579,0.0047353376,0.0017768483,0.001475355,0.002453414],"study_design_candidate":"bench_or_experimental","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0013985514,0.0006344194,0.013639097,0.00057695806,0.000575305,0.0003965475,0.00063774025,0.17324401,0.027179075,0.010179613,0.015358072,0.7561807],"study_design_scores_gemma":[0.0000418932,0.00016954,0.0024885952,0.000027414557,0.00014785695,0.00015441004,0.000055509423,0.9788289,0.0051047294,0.00589769,0.0070500076,0.000033341264],"about_ca_topic_score_codex":0.012984312,"about_ca_topic_score_gemma":0.016513456,"teacher_disagreement_score":0.012984312,"about_ca_system_score_codex":0.0014960207,"about_ca_system_score_gemma":0.0016595316,"threshold_uncertainty_score":0.025817454},"labels":[],"label_agreement":null},{"id":"W4224308015","doi":"10.3390/s22093186","title":"Weakly Supervised Occupancy Prediction Using Training Data Collected via Interactive Learning","year":2022,"lang":"en","type":"article","venue":"Sensors","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":14,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Concordia University","funders":"","keywords":"Occupancy; Training (meteorology); Computer science; Machine learning; Training set; Artificial intelligence; Engineering; Geography","score_opus":0.07356807976357183,"score_gpt":0.2831314134841884,"score_spread":0.20956333372061658,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4224308015","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.3020912,0.00024151616,0.6916725,0.00019120376,0.00007084552,0.00008566742,0.00035438774,0.0027700304,0.0025226937],"genre_scores_gemma":[0.9641761,0.00004245484,0.03448023,0.00005368546,0.000026824215,0.00006521639,0.0004413677,0.000035485817,0.0006786067],"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.99942183,0.00014328059,0.000029576224,0.00020158917,0.00010515564,0.00009858591],"domain_scores_gemma":[0.998027,0.0010443006,0.00020481618,0.00033700405,0.0002989363,0.0000877347],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.00084803393,0.0009669058,0.0009817736,0.00041629066,0.00031508194,0.00061350554,0.0016365461,0.0006801776,0.0009572488],"category_scores_gemma":[0.0037892647,0.00040379784,0.00059281895,0.00052477163,0.0005577517,0.0011138995,0.0012567946,0.0011892748,0.00033058264],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0005095371,0.00035598964,0.012694068,0.000096362724,0.00007300025,0.00013192126,0.00017000509,0.8364303,0.004325062,0.0009912892,0.001213523,0.14300892],"study_design_scores_gemma":[0.000005001369,0.000024900828,0.00075000554,0.000002066231,0.000003853361,0.0000061828437,0.000010062974,0.99778265,0.00095866574,0.0003680397,0.00008490818,0.000003693734],"about_ca_topic_score_codex":0.0077681956,"about_ca_topic_score_gemma":0.010274148,"teacher_disagreement_score":0.0077681956,"about_ca_system_score_codex":0.00054184604,"about_ca_system_score_gemma":0.0008239025,"threshold_uncertainty_score":0.015445948},"labels":[],"label_agreement":null},{"id":"W4226336902","doi":"10.1108/jices-12-2021-0125","title":"Critical care for the early web: ethical digital methods for archived youth data","year":2022,"lang":"en","type":"article","venue":"Journal of Information Communication and Ethics in Society","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":12,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Toronto","funders":"","keywords":"Framing (construction); Context (archaeology); Originality; Indigenous; World Wide Web; Sociology; Computer science; Engineering; History; Social science; Qualitative research","score_opus":0.16258407231304436,"score_gpt":0.44689956027195255,"score_spread":0.28431548795890815,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4226336902","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.045337997,0.0153296115,0.61425066,0.11329294,0.003264034,0.009357444,0.000528406,0.00058964477,0.19804935],"genre_scores_gemma":[0.4423525,0.008627479,0.47536314,0.016504463,0.0014369425,0.02557719,0.00029038207,0.0006939917,0.029153805],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.8156029,0.16579294,0.003764568,0.004264856,0.00875628,0.001818402],"domain_scores_gemma":[0.8084002,0.1339031,0.009730255,0.029719284,0.012411703,0.0058354675],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.14431977,0.0010965012,0.00085255894,0.0043174666,0.012910515,0.01875628,0.0040710773,0.004314788,0.011407606],"category_scores_gemma":[0.15508565,0.0008030495,0.0009685026,0.0035335955,0.042837538,0.017772604,0.020103574,0.008031497,0.0030975712],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.000068416884,0.00016908426,0.0019769224,0.0013063314,0.000023824232,0.0005600468,0.36048272,0.00021879419,0.0006224111,0.5204794,0.012174424,0.10191771],"study_design_scores_gemma":[0.000058984304,0.00012706999,0.0009422821,0.00820423,0.00003606749,0.0012484574,0.20755278,0.0007051759,0.0022106,0.33470288,0.44414455,0.00006692466],"about_ca_topic_score_codex":0.0017292695,"about_ca_topic_score_gemma":0.0029952216,"teacher_disagreement_score":0.8556802,"about_ca_system_score_codex":0.00777267,"about_ca_system_score_gemma":0.023597492,"threshold_uncertainty_score":0.76324505},"labels":[],"label_agreement":null},{"id":"W4226367007","doi":"10.1145/3486622.3494008","title":"Interpretable Mining of Influential Patterns from Sparse Web","year":2021,"lang":"en","type":"article","venue":"IEEE/WIC/ACM International Conference on Web Intelligence","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":9,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Manitoba","funders":"Natural Sciences and Engineering Research Council of Canada; University of Manitoba","keywords":"Web mining; Computer science; Web page; Data Web; Web modeling; Web intelligence; World Wide Web; Web mapping; Web development; Web standards; Web navigation; Web analytics; Web crawler; Web search engine; Information retrieval","score_opus":0.06615833634061803,"score_gpt":0.31120399450047004,"score_spread":0.24504565815985202,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4226367007","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.28058958,0.001398888,0.70874125,0.00072226883,0.000089479705,0.00021661268,0.002950024,0.0017491023,0.003542834],"genre_scores_gemma":[0.8521522,0.00084132864,0.13931526,0.00016635741,0.00014684687,0.00024672796,0.005426621,0.00010414849,0.0016003731],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.99882036,0.00029824523,0.00010986624,0.00024512896,0.00036328562,0.00016309404],"domain_scores_gemma":[0.99403113,0.003521547,0.0006779859,0.00070752605,0.0008632503,0.0001984229],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0010238152,0.0009999226,0.001138315,0.0061787814,0.0006092486,0.0013403925,0.0010699313,0.0009985503,0.0009006616],"category_scores_gemma":[0.012454227,0.000509263,0.0011191869,0.004887757,0.0007011634,0.002349812,0.0012876856,0.0011283901,0.00048117107],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0009466859,0.0007112994,0.10970057,0.0011795897,0.0006546869,0.00452228,0.0017180318,0.2320168,0.023296626,0.03437451,0.013632387,0.57724655],"study_design_scores_gemma":[0.000028717497,0.00006901753,0.010480713,0.000068513866,0.000076829725,0.00044456345,0.00034720163,0.9339141,0.0034672667,0.04803465,0.0030416914,0.000026760681],"about_ca_topic_score_codex":0.0030693554,"about_ca_topic_score_gemma":0.004322871,"teacher_disagreement_score":0.0061787814,"about_ca_system_score_codex":0.00037287365,"about_ca_system_score_gemma":0.00054720195,"threshold_uncertainty_score":0.006102979},"labels":[],"label_agreement":null},{"id":"W4230221959","doi":"10.1007/978-1-4939-7131-2_101462","title":"Web Preservation","year":2018,"lang":"en","type":"book-chapter","venue":"","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":0,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Calgary","funders":"","keywords":"World Wide Web; Computer science","score_opus":0.03371937093211747,"score_gpt":0.23681255934491074,"score_spread":0.20309318841279328,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4230221959","genre_codex":"other","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0034242794,0.006742443,0.041897465,0.003479843,0.002249506,0.0001446377,0.0011134732,0.004205981,0.9367422],"genre_scores_gemma":[0.02011092,0.0058028074,0.0140806995,0.00096403545,0.00086551876,0.00006632053,0.0020068954,0.0016214406,0.9544813],"study_design_codex":"design_other","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.9994295,0.00006205243,0.000023065466,0.00009684713,0.00033636653,0.000052052146],"domain_scores_gemma":[0.99880075,0.0001402987,0.000038620172,0.00062752434,0.00030357222,0.00008921679],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.00074723817,0.0005728973,0.00037459203,0.0032187277,0.0013241457,0.004534209,0.0013203424,0.00089410774,0.10667537],"category_scores_gemma":[0.0020435436,0.00034040972,0.00046128168,0.003384618,0.0011251544,0.006466975,0.0028802524,0.001624298,0.06462736],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.000039484312,0.00006097513,0.00022745978,0.0002506318,0.0000076125384,0.000096092066,0.00039765783,0.0002662667,0.0019066989,0.09707844,0.2762605,0.62340814],"study_design_scores_gemma":[0.0000028481031,0.000007467116,0.0001790637,0.00008959741,0.0000050031927,0.00020404543,0.00009436795,0.0002903438,0.001818624,0.016248181,0.9810555,0.000005030963],"about_ca_topic_score_codex":0.0013369839,"about_ca_topic_score_gemma":0.001999967,"teacher_disagreement_score":0.10667537,"about_ca_system_score_codex":0.0008036776,"about_ca_system_score_gemma":0.0010269631,"threshold_uncertainty_score":0.3568647},"labels":[],"label_agreement":null},{"id":"W4230556844","doi":"10.1007/978-3-642-03761-0_14","title":"University of Waterloo at INEX 2008: Adhoc, Book, and Link-the-Wiki Tracks","year":2009,"lang":"en","type":"book-chapter","venue":"Lecture notes in computer science","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":11,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Waterloo","funders":"","keywords":"Computer science; Task (project management); PageRank; Context (archaeology); Track (disk drive); Information retrieval; Link (geometry); World Wide Web; Computer network; Operating system","score_opus":0.01151207044429106,"score_gpt":0.20230034885294138,"score_spread":0.1907882784086503,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4230556844","genre_codex":"other","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0045595476,0.0618149,0.04069577,0.020462431,0.015029958,0.00017411984,0.022835176,0.010320226,0.82410777],"genre_scores_gemma":[0.0061659757,0.016128903,0.01754181,0.00083860825,0.0013740555,0.00007591212,0.008830007,0.0023422474,0.94670254],"study_design_codex":"not_applicable","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.99880433,0.00007064866,0.000052378506,0.00012984914,0.000865445,0.000077320765],"domain_scores_gemma":[0.998086,0.00024126016,0.000082025166,0.00017448093,0.0009957284,0.0004206107],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0012462331,0.0008136802,0.0010019104,0.0038230068,0.0019043747,0.0056744693,0.0009790219,0.000822972,0.11163225],"category_scores_gemma":[0.003824596,0.00076449633,0.00032294073,0.009494485,0.0006948509,0.0054925424,0.0015317671,0.0013539109,0.05545204],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.000010538262,0.000025064786,0.00015774737,0.000098664015,0.000002118209,0.000015130215,0.00006136,0.0001482988,0.00018333846,0.0054038684,0.80546445,0.18842943],"study_design_scores_gemma":[0.0000018785671,0.0000055560354,0.00040482782,0.000077871606,0.0000019570703,0.000052831456,0.000047100628,0.00021661371,0.00024040604,0.0015242278,0.9974191,0.000007554024],"about_ca_topic_score_codex":0.053659372,"about_ca_topic_score_gemma":0.12698701,"teacher_disagreement_score":0.11163225,"about_ca_system_score_codex":0.003639583,"about_ca_system_score_gemma":0.008051028,"threshold_uncertainty_score":0.37344712},"labels":[],"label_agreement":null},{"id":"W4230852174","doi":"10.32920/ryerson.14653005","title":"QoS Based Ranking For Web Search","year":2021,"lang":"en","type":"preprint","venue":"","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Toronto Metropolitan University","funders":"","keywords":"Ranking (information retrieval); Computer science; Search engine; Quality of service; Information retrieval; The Internet; Rank (graph theory); Quality (philosophy); Web page; World Wide Web; Reliability (semiconductor); Data mining; Computer network; Mathematics","score_opus":0.055215923502134556,"score_gpt":0.304444143029373,"score_spread":0.24922821952723845,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4230852174","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.06354212,0.008630416,0.9096173,0.0012992037,0.0005346265,0.0004046849,0.0018033185,0.0046341964,0.009534284],"genre_scores_gemma":[0.6419404,0.0025247342,0.34701684,0.0001872663,0.00061066035,0.0002783825,0.0024421627,0.00029917792,0.0047002323],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.99640286,0.0010931524,0.00027167736,0.00040989407,0.0015105889,0.00031196538],"domain_scores_gemma":[0.99402833,0.0028664495,0.0006269547,0.0007794069,0.0014461651,0.0002527108],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.002576059,0.00093695166,0.0013412533,0.0051692976,0.0008469627,0.0023532934,0.0011019302,0.0009237371,0.002628353],"category_scores_gemma":[0.014847439,0.00030782758,0.00072073535,0.0053180917,0.00055145856,0.0026019204,0.0007000023,0.00094291463,0.0014961625],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00045883184,0.00032004144,0.008695593,0.000784898,0.00014474995,0.0001723306,0.00019003954,0.2883933,0.0072005074,0.07625185,0.021968164,0.59541965],"study_design_scores_gemma":[0.000027243746,0.00012976582,0.0025696564,0.000030427283,0.000032572247,0.00016141718,0.00006724616,0.948068,0.002053918,0.040918905,0.0058980496,0.00004278398],"about_ca_topic_score_codex":0.0060958923,"about_ca_topic_score_gemma":0.0050386065,"teacher_disagreement_score":0.0060958923,"about_ca_system_score_codex":0.0018302883,"about_ca_system_score_gemma":0.0014058909,"threshold_uncertainty_score":0.013623655},"labels":[],"label_agreement":null},{"id":"W4230874668","doi":"10.1007/978-1-4614-6170-8_100858","title":"Web Crawling","year":2014,"lang":"en","type":"book-chapter","venue":"","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":0,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Calgary","funders":"","keywords":"Crawling; Computer science; World Wide Web; Medicine; Anatomy","score_opus":0.01957269536115172,"score_gpt":0.2193976681005148,"score_spread":0.1998249727393631,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4230874668","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.016865006,0.028888782,0.52125865,0.0045175445,0.002569847,0.0008398642,0.007295329,0.049054146,0.36871082],"genre_scores_gemma":[0.054471735,0.026339976,0.41638467,0.0020626301,0.0014052816,0.00046590975,0.023334334,0.009373492,0.4661621],"study_design_codex":"design_other","study_design_gemma":"not_applicable","domain_scores_codex":[0.99852353,0.00013692051,0.00010081589,0.00030620387,0.00084190414,0.00009063315],"domain_scores_gemma":[0.9980129,0.00042638642,0.00010456889,0.00073484384,0.00063544966,0.000085833126],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0009024483,0.0015928517,0.001109437,0.007775414,0.0013993863,0.003422517,0.0015803123,0.0011935727,0.015448191],"category_scores_gemma":[0.0036199274,0.00088200276,0.0009912419,0.007977644,0.00061452785,0.0044386806,0.0021588502,0.0015361682,0.025598507],"study_design_candidate":"not_applicable","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.000018214887,0.00007862091,0.0004611563,0.00041319217,0.0000319766,0.00007978525,0.00011784604,0.00095276715,0.0031721722,0.0110575175,0.16049321,0.8231235],"study_design_scores_gemma":[0.000014132169,0.000050499326,0.0020351566,0.00050946366,0.00008442548,0.0017542032,0.00013324582,0.02181667,0.01790778,0.043607518,0.9120272,0.00005967875],"about_ca_topic_score_codex":0.002358608,"about_ca_topic_score_gemma":0.0051603965,"teacher_disagreement_score":0.015448191,"about_ca_system_score_codex":0.00085632654,"about_ca_system_score_gemma":0.0014000509,"threshold_uncertainty_score":0.051679313},"labels":[],"label_agreement":null},{"id":"W4231677615","doi":"10.22215/etd/2006-07816","title":"Information management with multiple-categorization hierarchical structure","year":2006,"lang":"en","type":"dissertation","venue":"","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":1,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Carleton University; Canadian Heritage; Library and Archives Canada","funders":"","keywords":"Categorization; Computer science; Information retrieval; Humanities; Artificial intelligence; Philosophy","score_opus":0.003664651165008273,"score_gpt":0.20342974524766078,"score_spread":0.1997650940826525,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4231677615","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.027675888,0.0020712034,0.94821596,0.0022270305,0.00019983859,0.00056378375,0.0022216996,0.009598113,0.007226435],"genre_scores_gemma":[0.27938336,0.00089425285,0.7007157,0.00053344603,0.00024227137,0.00036227016,0.0065688677,0.00038518873,0.010914592],"study_design_codex":"design_other","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.9965443,0.0009747407,0.00042977298,0.0005756068,0.0011538564,0.00032171936],"domain_scores_gemma":[0.9923936,0.0021412252,0.0005813422,0.0030403316,0.0014429665,0.0004005323],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0038469706,0.00048046824,0.0011477272,0.004237652,0.0020895745,0.0039651636,0.0025525873,0.0014158256,0.0055126455],"category_scores_gemma":[0.010493913,0.0006681707,0.0014462852,0.0058388286,0.0007254885,0.007961136,0.0029849045,0.0013256813,0.0024401986],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.000350443,0.00057860935,0.007020293,0.0005396422,0.00031623113,0.00032233374,0.00091892487,0.0379088,0.0055264737,0.06378544,0.0511978,0.831535],"study_design_scores_gemma":[0.0001029564,0.00027872532,0.0030264724,0.00017437543,0.00022386706,0.00032717636,0.00051461096,0.6907581,0.011041046,0.23796733,0.055487826,0.00009750004],"about_ca_topic_score_codex":0.011324917,"about_ca_topic_score_gemma":0.01876726,"teacher_disagreement_score":0.011324917,"about_ca_system_score_codex":0.0022733698,"about_ca_system_score_gemma":0.0034105578,"threshold_uncertainty_score":0.02251798},"labels":[],"label_agreement":null},{"id":"W4232386687","doi":"10.1007/978-0-387-39940-9_3972","title":"Visual Web Information Extraction","year":2009,"lang":"en","type":"book-chapter","venue":"Encyclopedia of Database Systems","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":1,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Waterloo","funders":"","keywords":"Information extraction; Computer science; Extraction (chemistry); World Wide Web; Information retrieval; Chemistry; Chromatography","score_opus":0.01116611132904541,"score_gpt":0.24656012360515003,"score_spread":0.23539401227610462,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4232386687","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0060071684,0.0058996463,0.57013464,0.0012755066,0.00074265053,0.00096903316,0.038682498,0.13617042,0.24011838],"genre_scores_gemma":[0.04579778,0.007832138,0.4718187,0.0011335758,0.0003716822,0.0005845173,0.088829145,0.015515726,0.36811662],"study_design_codex":"design_other","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.99972004,0.00002317542,0.000023047145,0.00007044327,0.00013756326,0.00002579076],"domain_scores_gemma":[0.9995316,0.00012594333,0.000023472014,0.00010364243,0.0001840537,0.000031264743],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.00041454527,0.0012555406,0.0006232309,0.006536719,0.000609302,0.002939655,0.0011166864,0.0006167464,0.09511406],"category_scores_gemma":[0.0014664026,0.00064436905,0.000826603,0.004550315,0.0002735915,0.0024667683,0.0014712792,0.00078554876,0.059413552],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00007235181,0.0000492391,0.0003706821,0.00058632664,0.000033973312,0.00017480284,0.00010263994,0.00053438655,0.009329395,0.0069849496,0.26138112,0.72038007],"study_design_scores_gemma":[0.000029241304,0.00003132028,0.002023618,0.00034035704,0.000060572638,0.0008966619,0.0001565296,0.012617278,0.029455174,0.018329097,0.9360111,0.000049033526],"about_ca_topic_score_codex":0.003853822,"about_ca_topic_score_gemma":0.007000961,"teacher_disagreement_score":0.09511406,"about_ca_system_score_codex":0.0005122882,"about_ca_system_score_gemma":0.00069363846,"threshold_uncertainty_score":0.3181882},"labels":[],"label_agreement":null},{"id":"W4233156490","doi":"10.1007/978-1-4614-6170-8_100044","title":"Deep Web","year":2014,"lang":"en","type":"book-chapter","venue":"","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":0,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Calgary","funders":"","keywords":"Computer science","score_opus":0.015255392193822362,"score_gpt":0.210450566680493,"score_spread":0.19519517448667065,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4233156490","genre_codex":"other","genre_gemma":"other","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"other","genre_consensus":"other","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.003951323,0.009389043,0.40805095,0.0048507643,0.0026486206,0.00017424754,0.0056389566,0.016276577,0.5490196],"genre_scores_gemma":[0.026217185,0.009698718,0.12968682,0.002076189,0.00095700996,0.00016436269,0.010185104,0.003468699,0.8175459],"study_design_codex":"design_other","study_design_gemma":"not_applicable","domain_scores_codex":[0.9996686,0.000022613858,0.000013601837,0.000067949084,0.00019512359,0.000032178832],"domain_scores_gemma":[0.99949706,0.00010486151,0.000018728853,0.00016589089,0.00016078848,0.000052736534],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.00042549524,0.00088684785,0.00052203,0.0018576494,0.0006836248,0.002972369,0.0010514555,0.0009736156,0.067491814],"category_scores_gemma":[0.0015964959,0.0005501686,0.00047006874,0.0023610317,0.00051359995,0.0053225406,0.0023077398,0.0020376241,0.05405926],"study_design_candidate":"not_applicable","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.000021883101,0.00004294894,0.00016268369,0.00017332821,0.000017001457,0.000037094138,0.000050866685,0.0012195333,0.0021586719,0.05682569,0.28809452,0.6511958],"study_design_scores_gemma":[0.0000051410593,0.000008688268,0.00027170396,0.00010650192,0.000013551749,0.00015090333,0.0000345176,0.0071848636,0.0033318817,0.10187275,0.8870034,0.000016086655],"about_ca_topic_score_codex":0.0020933044,"about_ca_topic_score_gemma":0.0041480926,"teacher_disagreement_score":0.067491814,"about_ca_system_score_codex":0.0006401806,"about_ca_system_score_gemma":0.001133785,"threshold_uncertainty_score":0},"labels":[],"label_agreement":null},{"id":"W4233201867","doi":"10.1145/504243.504247","title":"Interaciton design for Web-based, within-page collection making and management","year":2001,"lang":"en","type":"article","venue":"","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Toronto","funders":"","keywords":"Computer science; Copying; Heuristics; Web page; World Wide Web; Focus (optics); Task (project management); Process (computing); Information retrieval","score_opus":0.035449701238036035,"score_gpt":0.2748328921425407,"score_spread":0.23938319090450466,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4233201867","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0077517135,0.0001046405,0.9787281,0.00019360286,0.000041111445,0.0004466991,0.000045353067,0.0033971313,0.009291652],"genre_scores_gemma":[0.09103822,0.00017656463,0.8863737,0.00020596088,0.000037516173,0.0013414292,0.00030034067,0.0015226776,0.019003661],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9957541,0.0013730327,0.00054121454,0.00061367714,0.001470468,0.0002475024],"domain_scores_gemma":[0.99238634,0.0019248433,0.0005585874,0.00257392,0.0020364178,0.0005198784],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0067188665,0.0007817772,0.0006414622,0.0017661763,0.0015044564,0.0054749916,0.0029188069,0.0018104737,0.007877996],"category_scores_gemma":[0.014013375,0.0013463738,0.0008389645,0.0015576674,0.0013938646,0.006889608,0.0037538726,0.0016492758,0.004470523],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0007721081,0.0010434694,0.008954373,0.0013930204,0.00019845854,0.002167687,0.013152383,0.027574671,0.064207755,0.22250715,0.02108581,0.63694316],"study_design_scores_gemma":[0.00025133757,0.0006662873,0.0041537415,0.0004888694,0.00032581194,0.0027624085,0.0025758697,0.3043444,0.0760684,0.1268391,0.48131207,0.00021172337],"about_ca_topic_score_codex":0.0010710878,"about_ca_topic_score_gemma":0.001930088,"teacher_disagreement_score":0.007877996,"about_ca_system_score_codex":0.0010968936,"about_ca_system_score_gemma":0.0015515944,"threshold_uncertainty_score":0.03553313},"labels":[],"label_agreement":null},{"id":"W4233635250","doi":"10.4018/978-1-5225-7598-6.ch127","title":"An Efficient and Effective Index Structure for Query Evaluation in Search Engines","year":2018,"lang":"en","type":"book-chapter","venue":"Advances in computer and electrical engineering book series","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Winnipeg","funders":"","keywords":"Inverted index; Disjoint sets; Computer science; Intersection (aeronautics); Trie; Word (group theory); Information retrieval; Interval (graph theory); Set (abstract data type); Sequence (biology); Index (typography); Coding (social sciences); Data mining; Theoretical computer science; Data structure; Search engine indexing; Mathematics; Combinatorics; Programming language; Engineering","score_opus":0.005626805189591924,"score_gpt":0.24678763732620654,"score_spread":0.2411608321366146,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4233635250","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0068169087,0.002509864,0.9792418,0.00053231587,0.00018501679,0.00063576916,0.000809115,0.0061302404,0.0031389974],"genre_scores_gemma":[0.038758915,0.0010009306,0.953428,0.0002440654,0.00022131231,0.0005416052,0.001646788,0.0005792593,0.0035791616],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.99437296,0.0011264147,0.0008657876,0.00054967636,0.002774588,0.00031050763],"domain_scores_gemma":[0.9946737,0.0020763325,0.0003583033,0.0015049455,0.0012377301,0.00014889515],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0036466506,0.001021743,0.002328673,0.0046168943,0.0019374727,0.0047425274,0.0029690969,0.0016359425,0.0065432563],"category_scores_gemma":[0.013911031,0.0011643886,0.0011008893,0.006611618,0.0010943443,0.009761547,0.003607063,0.0019792214,0.0045715356],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0004686876,0.0003857384,0.0015124949,0.0009497783,0.00014295048,0.00027268246,0.0007702832,0.012623642,0.03869246,0.12778863,0.053032454,0.7633602],"study_design_scores_gemma":[0.0003242993,0.0008962281,0.001916763,0.00041711124,0.00030825447,0.0020822412,0.0006566782,0.56064665,0.07756485,0.19706164,0.1578217,0.00030363203],"about_ca_topic_score_codex":0.0020228848,"about_ca_topic_score_gemma":0.0025821577,"teacher_disagreement_score":0.0065432563,"about_ca_system_score_codex":0.0017974952,"about_ca_system_score_gemma":0.002069619,"threshold_uncertainty_score":0.021889329},"labels":[],"label_agreement":null},{"id":"W4234514341","doi":"10.1007/978-1-4939-7131-2_100199","title":"Content and Opinion Social Network Applications","year":2018,"lang":"en","type":"book-chapter","venue":"","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":0,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Calgary","funders":"","keywords":"Opinion leadership; Social network (sociolinguistics); Computer science; Sociology; Psychology; World Wide Web; Social media; Social science","score_opus":0.060579353000491935,"score_gpt":0.25965745795044026,"score_spread":0.19907810494994832,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4234514341","genre_codex":"other","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.05642744,0.025868528,0.358448,0.011609141,0.0023521956,0.00015360316,0.00159648,0.0016010092,0.5419436],"genre_scores_gemma":[0.5636463,0.025074398,0.11700035,0.0015884875,0.0057557854,0.00033249194,0.0021072198,0.0008909202,0.2836041],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.999699,0.00008750842,0.000010144685,0.000051101706,0.00012807015,0.000024193125],"domain_scores_gemma":[0.9987205,0.0008229073,0.000057194375,0.00010088541,0.00025510564,0.00004338717],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0005821341,0.00042567414,0.00025669517,0.001433601,0.00040725793,0.0018947086,0.0005843987,0.00061702274,0.010479139],"category_scores_gemma":[0.0047044703,0.00017514268,0.0003189508,0.0021103777,0.000517434,0.0034242936,0.0008158082,0.0007084625,0.0030964364],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.000038877526,0.00006133127,0.0021752524,0.00027432299,0.000032734784,0.00010879696,0.0005345135,0.003168752,0.0021157602,0.44131228,0.06848237,0.4816951],"study_design_scores_gemma":[0.000009915535,0.000036566857,0.0033333676,0.00017622215,0.00005735529,0.00037003309,0.00041987907,0.09435885,0.0034541078,0.585611,0.3121435,0.000029139575],"about_ca_topic_score_codex":0.0011378641,"about_ca_topic_score_gemma":0.0016378188,"teacher_disagreement_score":0.010479139,"about_ca_system_score_codex":0.0007491958,"about_ca_system_score_gemma":0.00020669033,"threshold_uncertainty_score":0.035056233},"labels":[],"label_agreement":null},{"id":"W4234778484","doi":"10.1145/1030397","title":"Proceedings of the 2004 ACM symposium on Document engineering","year":2004,"lang":"en","type":"paratext","venue":"","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":8,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":true,"ca_institutions":"","funders":"","keywords":"Gratitude; Presentation (obstetrics); Computer science; IBM; Library science; Variety (cybernetics); World Wide Web; Artificial intelligence; Psychology","score_opus":0.008252235018341946,"score_gpt":0.22116155175708882,"score_spread":0.21290931673874688,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4234778484","genre_codex":"other","genre_gemma":"other","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"other","genre_consensus":"other","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.011085599,0.12558612,0.31265387,0.039780293,0.082879506,0.0016901483,0.006059035,0.009018245,0.4112472],"genre_scores_gemma":[0.02881502,0.08053947,0.18791859,0.0057447534,0.01048714,0.0010059497,0.017206678,0.0034906932,0.66479176],"study_design_codex":"not_applicable","study_design_gemma":"not_applicable","domain_scores_codex":[0.99361706,0.0014597069,0.0009440129,0.00094156334,0.0026767969,0.00036078374],"domain_scores_gemma":[0.98966193,0.0021965853,0.0003042651,0.0022799696,0.0043847263,0.0011724845],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0061863465,0.0017737385,0.001983151,0.0027163478,0.001894594,0.012347812,0.002620146,0.0027632522,0.115118355],"category_scores_gemma":[0.013966488,0.001071072,0.0016265475,0.0030239956,0.0015133165,0.00872514,0.0036769698,0.004715535,0.070041224],"study_design_candidate":"not_applicable","study_design_consensus":"not_applicable","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00013793942,0.00017129256,0.0007885231,0.0007107122,0.00008028789,0.00021574917,0.0005124314,0.0005611844,0.0035569551,0.02165813,0.6432374,0.32836938],"study_design_scores_gemma":[0.00001149317,0.000033905177,0.00030004611,0.00024044448,0.000019182622,0.00025959325,0.000122060206,0.00092993263,0.0004726156,0.0055452106,0.9920494,0.000016154714],"about_ca_topic_score_codex":0.0036067376,"about_ca_topic_score_gemma":0.0042546173,"teacher_disagreement_score":0.115118355,"about_ca_system_score_codex":0.0023037624,"about_ca_system_score_gemma":0.004143764,"threshold_uncertainty_score":0.38510925},"labels":[],"label_agreement":null},{"id":"W4236760935","doi":"10.1109/wi.2004.10057","title":"Focused Crawling by Learning HMM from User's Topic-specific Browsing","year":2005,"lang":"en","type":"article","venue":"IEEE/WIC/ACM International Conference on Web Intelligence (WI'04)","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":4,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Dalhousie University","funders":"","keywords":"Crawling; Computer science; Hidden Markov model; Web page; Information retrieval; Focused crawler; World Wide Web; Web crawler; Session (web analytics); Task (project management); Traverse; Construct (python library); Static web page; Artificial intelligence; Web navigation","score_opus":0.06551536332156896,"score_gpt":0.30103601129159774,"score_spread":0.23552064797002878,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4236760935","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.24754077,0.0005309444,0.7407102,0.00013773087,0.000037657763,0.0001991028,0.0011050293,0.008861635,0.0008769526],"genre_scores_gemma":[0.70688325,0.00039623346,0.28457475,0.00013333358,0.000062468775,0.0003176686,0.00480302,0.00030909647,0.002520294],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9993517,0.0001869117,0.000043618315,0.00024169378,0.000124033,0.000052081163],"domain_scores_gemma":[0.9965718,0.0020296148,0.00019315396,0.000559684,0.00051126286,0.00013440974],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0011583815,0.0009282389,0.0012281248,0.0021213465,0.0003271926,0.00069975655,0.0011022262,0.0011296382,0.00064157933],"category_scores_gemma":[0.0049196198,0.0007483457,0.0008947196,0.0013673375,0.00033419192,0.0018194866,0.0005853767,0.000999208,0.0008339487],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0009174813,0.0012872549,0.058527112,0.00043246822,0.00067238347,0.00059420225,0.0009162541,0.2735412,0.026856394,0.00274738,0.012237457,0.6212705],"study_design_scores_gemma":[0.000015646767,0.00009562601,0.00397765,0.000007661928,0.000052304622,0.000111305686,0.000029410046,0.9901406,0.0033344422,0.0017301348,0.00048577532,0.000019531151],"about_ca_topic_score_codex":0.009964434,"about_ca_topic_score_gemma":0.019743243,"teacher_disagreement_score":0.009964434,"about_ca_system_score_codex":0.0005169235,"about_ca_system_score_gemma":0.00087523257,"threshold_uncertainty_score":0.019812882},"labels":[],"label_agreement":null},{"id":"W4237485813","doi":"10.1007/978-1-4939-7131-2_101457","title":"Web Archiving","year":2018,"lang":"en","type":"book-chapter","venue":"","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":0,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Calgary","funders":"","keywords":"Web application; World Wide Web; Computer science","score_opus":0.02202557748373077,"score_gpt":0.22626937488853888,"score_spread":0.2042437974048081,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4237485813","genre_codex":"other","genre_gemma":"other","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"other","genre_consensus":"other","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0016695672,0.008020135,0.14362182,0.0023045586,0.0027188852,0.00022215891,0.0041463743,0.015342021,0.8219545],"genre_scores_gemma":[0.0077331415,0.00906521,0.059614502,0.0010732563,0.00078582583,0.00011897642,0.0071121086,0.0060216347,0.90847534],"study_design_codex":"design_other","study_design_gemma":"not_applicable","domain_scores_codex":[0.99906653,0.00008616285,0.00007456632,0.0001390157,0.00057434704,0.00005945376],"domain_scores_gemma":[0.99781334,0.0002847978,0.000052896306,0.0011434667,0.0006258168,0.00007970395],"candidate_categories":["scholarly_communication"],"consensus_categories":[],"category_scores_codex":[0.0011553383,0.001075155,0.0007420269,0.0056926613,0.001665728,0.00859227,0.0022172893,0.0014582096,0.1399167],"category_scores_gemma":[0.0034061442,0.0007868992,0.0007926762,0.0078033223,0.0009841064,0.008401727,0.002818033,0.0025769058,0.13338935],"study_design_candidate":"not_applicable","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.000020138561,0.000035615034,0.00010601548,0.00028799204,0.0000100073175,0.00007510673,0.0003435113,0.00033690638,0.0020280993,0.06244009,0.36731347,0.567003],"study_design_scores_gemma":[0.000002021554,0.0000035579164,0.00011313534,0.00014091608,0.000005823367,0.00019451333,0.00007270234,0.00048001218,0.0017610193,0.01612254,0.9810931,0.000010714734],"about_ca_topic_score_codex":0.0030188118,"about_ca_topic_score_gemma":0.002903819,"teacher_disagreement_score":0.99140775,"about_ca_system_score_codex":0.0012808449,"about_ca_system_score_gemma":0.001659098,"threshold_uncertainty_score":0.468068},"labels":[],"label_agreement":null},{"id":"W4239254818","doi":"10.29173/cais394","title":"Ditch the Smileys: Customizing a Stopword List for Email-based Data","year":2013,"lang":"fr","type":"article","venue":"Proceedings of the Annual Conference of CAIS / Actes du congrès annuel de l ACSI","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":1,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":true,"route_about_ca":false,"ca_institutions":"University of Alberta","funders":"","keywords":"Computer science","score_opus":0.06965376117248033,"score_gpt":0.27812799292369156,"score_spread":0.20847423175121121,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4239254818","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0751917,0.00044519376,0.8964507,0.0011226464,0.00040895803,0.0035862334,0.0035698505,0.013755102,0.0054696877],"genre_scores_gemma":[0.09436355,0.00021995394,0.8943262,0.00037862643,0.00005396092,0.0018572409,0.0033173277,0.0014122117,0.004070926],"study_design_codex":"design_other","study_design_gemma":"not_applicable","domain_scores_codex":[0.9909236,0.0045023444,0.0013691348,0.0010303364,0.0019719065,0.00020274842],"domain_scores_gemma":[0.9362501,0.042496588,0.0041368045,0.0063447785,0.010053925,0.00071783987],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.011361789,0.0010400168,0.00085513643,0.0056708413,0.0013662382,0.0030755831,0.0017083318,0.0012966316,0.0052624797],"category_scores_gemma":[0.06303105,0.0006311751,0.0009759124,0.004275289,0.0014215554,0.0044093993,0.0025624132,0.0017481827,0.004102644],"study_design_candidate":"not_applicable","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.000893211,0.00038252212,0.017391304,0.0045288056,0.00016073919,0.0008017121,0.03352166,0.0019008368,0.06769369,0.015020646,0.021431617,0.8362734],"study_design_scores_gemma":[0.00038343543,0.0024000658,0.059061833,0.004150596,0.00060705945,0.0038959682,0.0457266,0.114655286,0.19007756,0.06159766,0.51635504,0.0010889058],"about_ca_topic_score_codex":0.001926411,"about_ca_topic_score_gemma":0.004313068,"teacher_disagreement_score":0.011361789,"about_ca_system_score_codex":0.00090748013,"about_ca_system_score_gemma":0.0024497432,"threshold_uncertainty_score":0.06008762},"labels":[],"label_agreement":null},{"id":"W4239308454","doi":"10.1007/978-0-387-39940-9_3991","title":"Web Content Extraction","year":2009,"lang":"en","type":"book-chapter","venue":"Encyclopedia of Database Systems","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":0,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Waterloo","funders":"","keywords":"Computer science; Extraction (chemistry); Web content; World Wide Web; Chromatography; Chemistry; The Internet","score_opus":0.03516957540448347,"score_gpt":0.25051859540041105,"score_spread":0.2153490199959276,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4239308454","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.021110915,0.006647136,0.49501878,0.0014074919,0.0014597594,0.00460898,0.12331133,0.09373361,0.25270194],"genre_scores_gemma":[0.056690395,0.0065017384,0.4849615,0.000704063,0.0006168089,0.0015093435,0.20099206,0.006933812,0.24109034],"study_design_codex":"design_other","study_design_gemma":"not_applicable","domain_scores_codex":[0.99909747,0.000058580623,0.00009003223,0.00023975282,0.0004295474,0.000084569394],"domain_scores_gemma":[0.99867696,0.0002576974,0.000085909895,0.00030073652,0.0006123316,0.000066316665],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0005897639,0.0013902944,0.0010834122,0.014652779,0.0011801156,0.0032453602,0.0011625992,0.00072001317,0.052324574],"category_scores_gemma":[0.003295685,0.0005929464,0.0012226438,0.009635367,0.00037728314,0.0033208935,0.0020051217,0.0008898095,0.08592618],"study_design_candidate":"not_applicable","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00009462941,0.00010459798,0.0015406316,0.0008501424,0.000051658117,0.00027264486,0.00015252361,0.00032201485,0.016770912,0.0056592957,0.15163477,0.82254606],"study_design_scores_gemma":[0.00003328437,0.00007539353,0.008539542,0.0005285015,0.00020036055,0.0015664921,0.00041369832,0.011772088,0.068205714,0.011450148,0.89714366,0.00007115626],"about_ca_topic_score_codex":0.002419246,"about_ca_topic_score_gemma":0.003533817,"teacher_disagreement_score":0.052324574,"about_ca_system_score_codex":0.00064381165,"about_ca_system_score_gemma":0.001433599,"threshold_uncertainty_score":0.17504317},"labels":[],"label_agreement":null},{"id":"W4240288647","doi":"10.1145/584938.584940","title":"A framework for web table mining","year":2002,"lang":"en","type":"article","venue":"","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":3,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Simon Fraser University","funders":"","keywords":"Computer science; Table (database); Web page; Information retrieval; World Wide Web; Web mining; Table of contents; Information extraction; Process (computing); Data mining","score_opus":0.047218706857434414,"score_gpt":0.2677927006460024,"score_spread":0.220573993788568,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4240288647","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.00035300557,0.0003522526,0.99533737,0.0003607813,0.00004295688,0.00025049443,0.0006239568,0.0016376917,0.0010414469],"genre_scores_gemma":[0.006604623,0.00035822534,0.9901085,0.00012887512,0.00006463225,0.0003205226,0.0015143738,0.00014425705,0.00075600354],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9912164,0.002539047,0.0011444675,0.0014296408,0.0033418841,0.00032856062],"domain_scores_gemma":[0.9902029,0.004705448,0.0007015966,0.0024368663,0.0015704315,0.0003826529],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.008295611,0.0018657419,0.0018931329,0.009678522,0.0024240008,0.008419906,0.0061322944,0.0025928877,0.005897294],"category_scores_gemma":[0.021354763,0.0016896309,0.0052618505,0.010018894,0.0034224424,0.009660353,0.0047745607,0.0039006802,0.0046984707],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.000089906214,0.00024883074,0.0026478092,0.0010425539,0.0002775374,0.000910937,0.001074759,0.03867513,0.002343336,0.59232014,0.03732972,0.32303938],"study_design_scores_gemma":[0.000047083824,0.000058127567,0.0006027419,0.0003705869,0.000076396456,0.0009875651,0.00033159895,0.2066089,0.0020913915,0.6479988,0.14074054,0.000086414606],"about_ca_topic_score_codex":0.0072014616,"about_ca_topic_score_gemma":0.008264365,"teacher_disagreement_score":0.009678522,"about_ca_system_score_codex":0.0018539038,"about_ca_system_score_gemma":0.003942176,"threshold_uncertainty_score":0.04387188},"labels":[],"label_agreement":null},{"id":"W4240504823","doi":"10.1109/ideas.2004.1319793","title":"A gateway from HTML to XML","year":2004,"lang":"en","type":"article","venue":"","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":1,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Carleton University","funders":"","keywords":"Computer science; XML; World Wide Web; Efficient XML Interchange; Document Structure Description; Streaming XML; Information retrieval; XML Schema Editor; XML validation; Gateway (web page); Database","score_opus":0.010400234746715345,"score_gpt":0.22316331077160437,"score_spread":0.21276307602488903,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4240504823","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.003006085,0.0011969423,0.8210363,0.0017909518,0.0007943186,0.0010346095,0.006106333,0.11578406,0.049250454],"genre_scores_gemma":[0.025235295,0.0038974436,0.83388627,0.0036144152,0.0007241733,0.0014525178,0.03246491,0.02791698,0.07080793],"study_design_codex":"design_other","study_design_gemma":"not_applicable","domain_scores_codex":[0.9974009,0.00049597793,0.00051705027,0.00033535418,0.0010682567,0.00018241136],"domain_scores_gemma":[0.9963792,0.0009687931,0.00016612138,0.001373782,0.0007455751,0.00036653335],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0035598103,0.0011195659,0.0011058621,0.0029536842,0.0010040494,0.0070640696,0.0031394302,0.003243849,0.026929094],"category_scores_gemma":[0.0076248245,0.0016559938,0.0012525134,0.0032266974,0.0013851547,0.0065457765,0.0055308826,0.004841578,0.03827609],"study_design_candidate":"not_applicable","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00042070125,0.00046295152,0.0010989305,0.0012887891,0.000090576905,0.0016716459,0.0023731105,0.0028386277,0.027891777,0.22367255,0.25935155,0.47883877],"study_design_scores_gemma":[0.00008103538,0.000075110045,0.00072010636,0.0004408251,0.00002835536,0.00067853654,0.00024270645,0.009247157,0.013207152,0.06647646,0.9087235,0.00007922375],"about_ca_topic_score_codex":0.00089660176,"about_ca_topic_score_gemma":0.0005675536,"teacher_disagreement_score":0.026929094,"about_ca_system_score_codex":0.0007015072,"about_ca_system_score_gemma":0.0012384315,"threshold_uncertainty_score":0.09008676},"labels":[],"label_agreement":null},{"id":"W4240635190","doi":"10.1002/(sici)1097-4571(2000)51:9<793::aid-asi20>3.0.co;2-q","title":"Rating news documents for similarity","year":2000,"lang":"en","type":"article","venue":"Journal of the American Society for Information Science","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":11,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Acadia University; Dalhousie University","funders":"Natural Sciences and Engineering Research Council of Canada","keywords":"Personalization; Computer science; Information retrieval; Feature (linguistics); Similarity (geometry); Precision and recall; Event (particle physics); Representation (politics); World Wide Web; News aggregator; Artificial intelligence","score_opus":0.016784334779100574,"score_gpt":0.30043839086948027,"score_spread":0.2836540560903797,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4240635190","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.77450657,0.008060239,0.15738848,0.0010939956,0.0010096248,0.0019891672,0.010840022,0.003750401,0.04136153],"genre_scores_gemma":[0.8858247,0.0016148918,0.09575031,0.000101335245,0.00077795115,0.0003246063,0.008982409,0.00016663359,0.006457236],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.993893,0.000927205,0.00089080207,0.00081693864,0.0031987217,0.0002732521],"domain_scores_gemma":[0.98759204,0.0040149363,0.0016518316,0.0011268053,0.0051136524,0.0005007175],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0023993556,0.0007408455,0.001338182,0.016533852,0.0006936474,0.002606048,0.00075451704,0.0010665043,0.0066181193],"category_scores_gemma":[0.026228148,0.00022665836,0.0008792736,0.010840771,0.0003660322,0.0028366216,0.0009803071,0.000769039,0.0050670397],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0013935398,0.00066056196,0.14327925,0.00091470435,0.0007215476,0.0004138865,0.00091633014,0.0040565426,0.027140595,0.002589229,0.027351916,0.7905618],"study_design_scores_gemma":[0.00040347333,0.004300661,0.63553804,0.00031900138,0.0012050761,0.0048819925,0.003968736,0.22506253,0.05032617,0.01162069,0.061904784,0.00046879574],"about_ca_topic_score_codex":0.0022444907,"about_ca_topic_score_gemma":0.00398213,"teacher_disagreement_score":0.016533852,"about_ca_system_score_codex":0.00064520974,"about_ca_system_score_gemma":0.0006877679,"threshold_uncertainty_score":0.022139788},"labels":[{"model":"gemma","categories":[],"domain":null,"study_design":"simulation_or_modeling","genre":"empirical","about_ca_system":false,"about_ca_topic":false,"confidence":"low"},{"model":"gpt","categories":[],"domain":null,"study_design":"bench_or_experimental","genre":"empirical","about_ca_system":false,"about_ca_topic":false,"confidence":"low"}],"label_agreement":"split"},{"id":"W4240671233","doi":"10.1007/978-1-4939-7131-2_101332","title":"Temporal-Textual Web Search","year":2018,"lang":"en","type":"book-chapter","venue":"","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":0,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Calgary","funders":"","keywords":"Computer science; Information retrieval; World Wide Web","score_opus":0.039218979537862506,"score_gpt":0.2626171063825488,"score_spread":0.2233981268446863,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4240671233","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.014839579,0.016260728,0.69734037,0.0035765008,0.0012113658,0.00024240166,0.004203259,0.0072180186,0.25510776],"genre_scores_gemma":[0.28984323,0.017920904,0.35361743,0.0015739952,0.0019679696,0.00029001848,0.011965551,0.0028255994,0.3199954],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9989405,0.00017630166,0.000077585944,0.00017416695,0.0005538404,0.00007755886],"domain_scores_gemma":[0.99738234,0.0013435702,0.00013031956,0.0005429351,0.00050611555,0.00009471272],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0010596693,0.00078675,0.00055785215,0.0027075305,0.0006957468,0.0031137648,0.001411545,0.00088113203,0.021766344],"category_scores_gemma":[0.0065619987,0.00046160456,0.00077394635,0.0041767685,0.0009888272,0.008351406,0.0013695081,0.0011129125,0.010385261],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00016993514,0.00010879231,0.00096779736,0.0010020686,0.00004960803,0.00016387325,0.0003164677,0.006111461,0.0058299312,0.30443808,0.09309109,0.5877509],"study_design_scores_gemma":[0.000028304283,0.00006878404,0.0012652944,0.00044010472,0.00009820466,0.0013585584,0.00031532336,0.14693283,0.011406065,0.45654395,0.38146982,0.00007286226],"about_ca_topic_score_codex":0.003629882,"about_ca_topic_score_gemma":0.0052485894,"teacher_disagreement_score":0.021766344,"about_ca_system_score_codex":0.0014529432,"about_ca_system_score_gemma":0.0011985581,"threshold_uncertainty_score":0.07281566},"labels":[],"label_agreement":null},{"id":"W4241273680","doi":"10.1007/978-1-4939-7131-2_100953","title":"Real-Time Social Media Analysis","year":2018,"lang":"en","type":"book-chapter","venue":"","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":0,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Calgary","funders":"","keywords":"Social media; Computer science; World Wide Web","score_opus":0.02270892991541675,"score_gpt":0.24114363036953052,"score_spread":0.21843470045411376,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4241273680","genre_codex":"methods","genre_gemma":"other","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"other","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.011397516,0.009574802,0.9179061,0.0018742386,0.0016675103,0.00017364937,0.0038593705,0.012281281,0.04126553],"genre_scores_gemma":[0.21470597,0.015410097,0.61160386,0.0009458369,0.002915747,0.00036969595,0.011937224,0.0030904047,0.13902122],"study_design_codex":"design_other","study_design_gemma":"not_applicable","domain_scores_codex":[0.9991843,0.00009846111,0.000037443042,0.00017677102,0.0004571155,0.000045935274],"domain_scores_gemma":[0.9984977,0.00081546773,0.0000904928,0.00025220163,0.0002868454,0.000057296795],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.00090561045,0.0012678801,0.0006499614,0.0025899075,0.0003881375,0.0024315892,0.0012471891,0.00070529635,0.010389697],"category_scores_gemma":[0.0030026466,0.0004823474,0.00060113514,0.0024835002,0.00043288665,0.0026570559,0.0011447269,0.0009818274,0.010459601],"study_design_candidate":"not_applicable","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.000063549334,0.000079554855,0.0014571204,0.00037071464,0.00007798979,0.0001496718,0.00017841488,0.005416573,0.01581675,0.016186437,0.069839,0.89036417],"study_design_scores_gemma":[0.000018026587,0.00009814696,0.007575735,0.00027443247,0.0001301998,0.001388006,0.0006057981,0.39343214,0.059124272,0.13461909,0.40259817,0.00013596551],"about_ca_topic_score_codex":0.0008033928,"about_ca_topic_score_gemma":0.0014821895,"teacher_disagreement_score":0.010389697,"about_ca_system_score_codex":0.000373902,"about_ca_system_score_gemma":0.00038079152,"threshold_uncertainty_score":0.03475696},"labels":[],"label_agreement":null},{"id":"W4243293655","doi":"10.1007/978-0-387-39940-9_3998","title":"Web Indexing","year":2009,"lang":"en","type":"book-chapter","venue":"Encyclopedia of Database Systems","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":0,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Waterloo","funders":"","keywords":"Search engine indexing; Computer science; Web application; Information retrieval; World Wide Web","score_opus":0.01638023600136304,"score_gpt":0.2304763259337418,"score_spread":0.21409608993237875,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4243293655","genre_codex":"other","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0024642984,0.011186492,0.11784051,0.0022434548,0.0032344498,0.0009161142,0.051019445,0.052856673,0.7582385],"genre_scores_gemma":[0.013987139,0.013152331,0.094399326,0.0015730474,0.0015080365,0.00044934085,0.1273969,0.00899112,0.73854285],"study_design_codex":"not_applicable","study_design_gemma":"not_applicable","domain_scores_codex":[0.998904,0.000076921664,0.00010628288,0.00016124295,0.0006621877,0.00008931209],"domain_scores_gemma":[0.9984603,0.00019051666,0.000066674045,0.0006406745,0.00049638154,0.00014551719],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0007235321,0.0013641495,0.0013239962,0.0101969,0.0014407617,0.0067261583,0.0020895824,0.0011273404,0.25388426],"category_scores_gemma":[0.003338544,0.00067275215,0.0009010821,0.013640473,0.00060286216,0.0071671847,0.003036205,0.0012223352,0.33543286],"study_design_candidate":"not_applicable","study_design_consensus":"not_applicable","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.000036391528,0.000056044944,0.00015731089,0.0004421579,0.000013806804,0.000051809573,0.00005678259,0.00017374412,0.0024177695,0.015986703,0.54380655,0.43680087],"study_design_scores_gemma":[0.000009211587,0.000012985837,0.00032684542,0.00014037325,0.000012560813,0.0002531629,0.000045200704,0.00070995063,0.0023572054,0.013590191,0.9825236,0.000018598692],"about_ca_topic_score_codex":0.0018738669,"about_ca_topic_score_gemma":0.0029852064,"teacher_disagreement_score":0.25388426,"about_ca_system_score_codex":0.0008682358,"about_ca_system_score_gemma":0.0013811594,"threshold_uncertainty_score":0.84932745},"labels":[],"label_agreement":null},{"id":"W4243874002","doi":"10.4108/infoscale.2007.932","title":"Comparing Different Units for Query Translation in Chinese Cross-Language Information Retrieval","year":2007,"lang":"en","type":"article","venue":"","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":4,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Université de Montréal","funders":"","keywords":"Computer science; Cross-language information retrieval; Natural language processing; Word (group theory); Translation (biology); Chinese language; Machine translation; Artificial intelligence; Query language; Language translation; Information retrieval; Linguistics","score_opus":0.03117436582316791,"score_gpt":0.30805281831315634,"score_spread":0.27687845248998844,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4243874002","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.9627629,0.0021702473,0.027258975,0.00016646633,0.00007545001,0.00023289607,0.0002701603,0.00047255168,0.0065903855],"genre_scores_gemma":[0.9779546,0.0003697515,0.019590357,0.00007538877,0.000028120909,0.0001383038,0.0005579281,0.00010933951,0.0011762715],"study_design_codex":"design_other","study_design_gemma":"bench_or_experimental","domain_scores_codex":[0.9966186,0.0016661569,0.0005025172,0.00031792306,0.00062789884,0.00026681728],"domain_scores_gemma":[0.9925398,0.0041033733,0.0004203112,0.0007617737,0.001925634,0.00024912212],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.00421577,0.00052154285,0.00071024615,0.0033084091,0.0010616594,0.0015785198,0.0005100668,0.0004765938,0.0021546478],"category_scores_gemma":[0.01607478,0.00019902614,0.0006494042,0.002690543,0.0007584297,0.0036231447,0.0011712746,0.00036846544,0.00072893035],"study_design_candidate":"bench_or_experimental","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.004967884,0.00077323517,0.08353274,0.001723268,0.0005484047,0.00061745883,0.003920507,0.021754757,0.10469397,0.009461195,0.005262587,0.76274407],"study_design_scores_gemma":[0.0006653855,0.005803247,0.3141292,0.00022066165,0.001751682,0.0013571766,0.007849756,0.42578647,0.21363647,0.014683058,0.013748185,0.0003687864],"about_ca_topic_score_codex":0.006405029,"about_ca_topic_score_gemma":0.008498733,"teacher_disagreement_score":0.006405029,"about_ca_system_score_codex":0.0013485292,"about_ca_system_score_gemma":0.0015242617,"threshold_uncertainty_score":0.022295415},"labels":[],"label_agreement":null},{"id":"W4244698755","doi":"10.32388/noleo5","title":"Curly-Coated Retriever","year":2020,"lang":"en","type":"reference-entry","venue":"Definitions","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":true,"ca_institutions":"","funders":"","keywords":"Labrador Retriever; Medicine; Surgery","score_opus":0.09314210818823906,"score_gpt":0.26376055027276885,"score_spread":0.17061844208452978,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4244698755","genre_codex":"other","genre_gemma":"other","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"other","genre_consensus":"other","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.004779089,0.0022745626,0.16223465,0.0030275818,0.0047496464,0.0010322818,0.10565767,0.31522882,0.40101567],"genre_scores_gemma":[0.025699165,0.0024995618,0.12831901,0.0036337038,0.001462209,0.0004922066,0.18957756,0.1555471,0.49276954],"study_design_codex":"not_applicable","study_design_gemma":"not_applicable","domain_scores_codex":[0.9948591,0.00042387928,0.00055764127,0.0007667904,0.002798121,0.0005944315],"domain_scores_gemma":[0.9872047,0.0012597365,0.00037019516,0.005652476,0.0050939424,0.00041886486],"candidate_categories":["insufficient_payload"],"consensus_categories":[],"category_scores_codex":[0.0028726317,0.0031558538,0.0022455598,0.008190772,0.0021985257,0.0074025723,0.0034288624,0.003019037,0.27930838],"category_scores_gemma":[0.01490625,0.001614797,0.0024271817,0.006367051,0.0011037518,0.010737083,0.006233684,0.0024269926,0.40352815],"study_design_candidate":"not_applicable","study_design_consensus":"not_applicable","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00021158624,0.000057038604,0.0005076861,0.00057053583,0.000036123096,0.00014100679,0.00016328802,0.00023999473,0.0054338886,0.013969868,0.89603406,0.082634896],"study_design_scores_gemma":[0.00003517812,0.000027796063,0.00061677885,0.00018693645,0.00003344325,0.0003282314,0.00005507317,0.0019324974,0.009905782,0.005763204,0.9810528,0.00006223551],"about_ca_topic_score_codex":0.0120099075,"about_ca_topic_score_gemma":0.019760735,"teacher_disagreement_score":0.7206916,"about_ca_system_score_codex":0.0022350813,"about_ca_system_score_gemma":0.0032753402,"threshold_uncertainty_score":0.93437964},"labels":[],"label_agreement":null},{"id":"W4245054559","doi":"10.1007/978-1-4939-7131-2_101026","title":"Science of the Internet","year":2018,"lang":"en","type":"book-chapter","venue":"","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":0,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Calgary","funders":"","keywords":"The Internet; Internet privacy; Computer science; World Wide Web","score_opus":0.02226405397480169,"score_gpt":0.23189209521942972,"score_spread":0.20962804124462803,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4245054559","genre_codex":"other","genre_gemma":"other","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"other","genre_consensus":"other","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0011595367,0.077625945,0.010086626,0.0265488,0.0043490776,0.0000333362,0.00040318133,0.00020811256,0.87958544],"genre_scores_gemma":[0.059989966,0.12328062,0.009286051,0.011069663,0.010401917,0.00016642644,0.00091151876,0.00033562622,0.78455824],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"not_applicable","domain_scores_codex":[0.99927336,0.00015850934,0.000020957772,0.00013814754,0.00035145343,0.000057625602],"domain_scores_gemma":[0.9990803,0.00041293338,0.000042359425,0.00018527967,0.0001820412,0.000097035314],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.00072674826,0.00073420967,0.0004909989,0.002994205,0.0016450173,0.0066827745,0.00095898414,0.0021525433,0.029388249],"category_scores_gemma":[0.003011931,0.00039260052,0.0003655775,0.0032085243,0.004856385,0.009799124,0.0017147746,0.0042148554,0.013262863],"study_design_candidate":"not_applicable","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.000005365363,0.000016315991,0.00012560154,0.00010872127,0.000006218916,0.000022904389,0.00028916402,0.00020164697,0.00011112091,0.73748684,0.2178554,0.043770727],"study_design_scores_gemma":[0.0000016771361,0.0000027337962,0.00013233612,0.00012617634,0.0000020416303,0.000041937685,0.00011013276,0.00020040023,0.000057847235,0.26185846,0.73746276,0.0000035207242],"about_ca_topic_score_codex":0.0030234596,"about_ca_topic_score_gemma":0.003124878,"teacher_disagreement_score":0.029388249,"about_ca_system_score_codex":0.0023679887,"about_ca_system_score_gemma":0.0026425587,"threshold_uncertainty_score":0.09831351},"labels":[],"label_agreement":null},{"id":"W4245651902","doi":"10.1109/sbst.2017.8","title":"Searching for Behavioural Bugs with Stateful Test Oracles in Web Crawlers","year":2017,"lang":"en","type":"article","venue":"","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Université du Québec à Chicoutimi","funders":"","keywords":"Stateful firewall; Computer science; Crawling; Web crawler; World Wide Web; Web application; Software engineering; Computer security","score_opus":0.04706703872081627,"score_gpt":0.30316232910267543,"score_spread":0.2560952903818592,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4245651902","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.63902456,0.00065593515,0.31825832,0.00072385994,0.00007545628,0.0003091361,0.0010105076,0.037916865,0.0020253314],"genre_scores_gemma":[0.872787,0.000114120674,0.12444646,0.00015307005,0.000022448135,0.00013986121,0.0011193821,0.0006049892,0.0006125641],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9931896,0.0025949895,0.0006524689,0.0010615485,0.0019543504,0.000547104],"domain_scores_gemma":[0.9541146,0.02974353,0.006316484,0.005460943,0.0033242323,0.0010401446],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0043042,0.0011078207,0.0010314053,0.0037541972,0.00054806273,0.0021626027,0.0019206582,0.0016827247,0.00087514916],"category_scores_gemma":[0.045335636,0.0011673277,0.000893753,0.0015589234,0.0013641702,0.0032599058,0.0015714227,0.0012983098,0.0004567578],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0014520958,0.0019523982,0.29655424,0.001029751,0.0003790382,0.0044544023,0.0029517848,0.10819212,0.057418693,0.015172246,0.009325486,0.5011177],"study_design_scores_gemma":[0.000097544376,0.00043180105,0.019217221,0.00012893551,0.00012008707,0.0011284758,0.00039610258,0.9289856,0.031648856,0.015549324,0.00220597,0.00009012266],"about_ca_topic_score_codex":0.0035776393,"about_ca_topic_score_gemma":0.0047658226,"teacher_disagreement_score":0.0043042,"about_ca_system_score_codex":0.00070484984,"about_ca_system_score_gemma":0.0014219331,"threshold_uncertainty_score":0.022763073},"labels":[],"label_agreement":null},{"id":"W4245995216","doi":"10.1007/978-3-642-45135-5","title":"Recommendation Systems in Software Engineering","year":2014,"lang":"en","type":"book","venue":"","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":212,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Calgary; McGill University","funders":"","keywords":"Software engineering; Computer science","score_opus":0.01132452895672102,"score_gpt":0.20092878674647766,"score_spread":0.18960425778975665,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4245995216","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0059074927,0.2063984,0.4978111,0.009098535,0.0073317583,0.00023828787,0.0008138796,0.004156639,0.26824388],"genre_scores_gemma":[0.038031444,0.10350796,0.22071552,0.0021639394,0.0046495856,0.00019982578,0.0015059083,0.00077695743,0.6284489],"study_design_codex":"design_other","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.9992254,0.00010252513,0.000040136554,0.00011912239,0.00047144474,0.000041321004],"domain_scores_gemma":[0.999143,0.0003806288,0.000031684525,0.00016587452,0.00024181942,0.00003694513],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.00072856824,0.0011304198,0.0011879796,0.0018099612,0.0005659245,0.0021866632,0.0012525879,0.0010008261,0.01794387],"category_scores_gemma":[0.0027474079,0.00052515895,0.0005961978,0.004284193,0.0007715285,0.0042353505,0.0008306876,0.001897469,0.015899086],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.000020390386,0.000057279754,0.00018791699,0.00035366352,0.000045206954,0.00003245975,0.000084458516,0.0026632925,0.000912038,0.04333989,0.17799245,0.77431107],"study_design_scores_gemma":[0.000024634612,0.00009374178,0.0012997034,0.00048161793,0.00006780656,0.0004676387,0.00011940574,0.030067526,0.0017484609,0.17790376,0.78767353,0.000052204625],"about_ca_topic_score_codex":0.0038435003,"about_ca_topic_score_gemma":0.0055634845,"teacher_disagreement_score":0.01794387,"about_ca_system_score_codex":0.0010610557,"about_ca_system_score_gemma":0.00094296405,"threshold_uncertainty_score":0.060028195},"labels":[],"label_agreement":null},{"id":"W4246123172","doi":"10.1002/1097-4571(2000)9999:9999<::aid-asi1055>3.0.co;2-y","title":"The role of user profiles for news filtering","year":2001,"lang":"en","type":"article","venue":"Journal of the American Society for Information Science and Technology","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":11,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Dalhousie University","funders":"","keywords":"Newspaper; Filter (signal processing); Computer science; Subject (documents); Preference; Task (project management); User profile; Information retrieval; World Wide Web; Advertising; Mathematics; Engineering","score_opus":0.009267190326634119,"score_gpt":0.2582203156164686,"score_spread":0.24895312528983446,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4246123172","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.77588946,0.0015243005,0.19516708,0.0015966223,0.00012981586,0.0008164807,0.0004582648,0.0015830155,0.02283489],"genre_scores_gemma":[0.9800411,0.00016276875,0.018455107,0.00007914414,0.000037472175,0.000069819085,0.00012596749,0.00006164175,0.00096693553],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9822134,0.012784931,0.00072902703,0.0010899033,0.0026094778,0.0005733107],"domain_scores_gemma":[0.88916606,0.085144155,0.0055065067,0.009908064,0.0077806897,0.0024945159],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.016222388,0.0010327401,0.001027808,0.0020978376,0.0016432522,0.0052192565,0.0008309338,0.0013939443,0.0023203306],"category_scores_gemma":[0.0827757,0.0006499187,0.0006415344,0.0015661288,0.0008751658,0.007584107,0.0014452271,0.0012624749,0.0009801058],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.005758265,0.0014863072,0.34901562,0.00083721033,0.0005851117,0.00042499555,0.010681579,0.014338459,0.013676412,0.020851895,0.0045268703,0.5778174],"study_design_scores_gemma":[0.0006268517,0.004466259,0.40723088,0.0005857378,0.001564296,0.0024184568,0.009682821,0.44488767,0.026710695,0.064986825,0.035935134,0.0009043208],"about_ca_topic_score_codex":0.0035469364,"about_ca_topic_score_gemma":0.00309255,"teacher_disagreement_score":0.016222388,"about_ca_system_score_codex":0.0007890854,"about_ca_system_score_gemma":0.0010149074,"threshold_uncertainty_score":0.0857932},"labels":[],"label_agreement":null},{"id":"W4246334120","doi":"10.1007/978-1-4614-6170-8_100434","title":"Web Preservation","year":2014,"lang":"en","type":"book-chapter","venue":"","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":0,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Calgary","funders":"","keywords":"Web application; World Wide Web; Computer science","score_opus":0.025911474190345972,"score_gpt":0.22249130474096537,"score_spread":0.1965798305506194,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4246334120","genre_codex":"other","genre_gemma":"other","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"other","genre_consensus":"other","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0035421385,0.005910637,0.041995235,0.0029375567,0.0017357382,0.00014141608,0.0010109714,0.004032542,0.9386938],"genre_scores_gemma":[0.018523583,0.0048794053,0.012988781,0.0007917432,0.00061213336,0.00005890717,0.0016977892,0.0014011323,0.9590466],"study_design_codex":"design_other","study_design_gemma":"not_applicable","domain_scores_codex":[0.9994605,0.00005806391,0.00002083397,0.00008832496,0.0003226322,0.000049621754],"domain_scores_gemma":[0.99894184,0.00012282669,0.00003467633,0.0005485933,0.00027445273,0.000077609875],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.00068895955,0.0005543161,0.0003646151,0.0030942617,0.001299711,0.0042649284,0.0012878261,0.000849257,0.10694985],"category_scores_gemma":[0.0018231259,0.00033231676,0.00043454207,0.0032633923,0.0010893475,0.006139346,0.0027760246,0.0014909024,0.06117975],"study_design_candidate":"not_applicable","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.000038617058,0.000059755275,0.00023389269,0.00022296426,0.0000071232193,0.00009843631,0.00039077015,0.00026563008,0.0019773517,0.08859953,0.25642398,0.65168196],"study_design_scores_gemma":[0.000002811621,0.00000771569,0.00019750462,0.00008874707,0.00000497567,0.00021699625,0.00010289726,0.00031367876,0.0019917178,0.015447202,0.98162055,0.000005259376],"about_ca_topic_score_codex":0.0015232163,"about_ca_topic_score_gemma":0.0023293288,"teacher_disagreement_score":0.10694985,"about_ca_system_score_codex":0.00077636767,"about_ca_system_score_gemma":0.0010022732,"threshold_uncertainty_score":0.3577829},"labels":[],"label_agreement":null},{"id":"W4246750514","doi":"10.1109/wi.2004.10071","title":"A Weighted Freshness Metric for Maintaining Search Engine Local Repository","year":2005,"lang":"en","type":"article","venue":"IEEE/WIC/ACM International Conference on Web Intelligence (WI'04)","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":2,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Dalhousie University","funders":"","keywords":"Web crawler; Computer science; Web search engine; Web page; Metric (unit); World Wide Web; Information retrieval; Search engine; Database; Web search query; Engineering","score_opus":0.061735620025617916,"score_gpt":0.3275296771444546,"score_spread":0.26579405711883664,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4246750514","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.17233299,0.0028635026,0.81633145,0.0006410214,0.0002752438,0.000560433,0.0011850215,0.0024582741,0.0033520996],"genre_scores_gemma":[0.7695138,0.0006289683,0.22584483,0.00010892443,0.0002856004,0.00039402398,0.0013049204,0.00037772648,0.0015413438],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.989486,0.0020593086,0.00206159,0.0016332115,0.0041381987,0.0006216003],"domain_scores_gemma":[0.95289963,0.016279824,0.008067179,0.009507083,0.010639926,0.0026064215],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.007595615,0.0012092815,0.0016768507,0.0072878324,0.0011254251,0.0031785953,0.0030217408,0.0016674196,0.0011933037],"category_scores_gemma":[0.057173766,0.0006701359,0.0006598089,0.0060497783,0.0014184592,0.011871269,0.00271859,0.0013879978,0.00046911868],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0017669401,0.0006525946,0.053820707,0.0012111195,0.0006493515,0.0005761012,0.001188976,0.21342592,0.060907457,0.07878655,0.011025931,0.57598835],"study_design_scores_gemma":[0.0001100292,0.0016125279,0.018704932,0.00010465382,0.00034430771,0.0014286982,0.00039814174,0.88318354,0.037752282,0.039552346,0.01647544,0.0003331515],"about_ca_topic_score_codex":0.0020322138,"about_ca_topic_score_gemma":0.0018268112,"teacher_disagreement_score":0.007595615,"about_ca_system_score_codex":0.0023498992,"about_ca_system_score_gemma":0.0017908367,"threshold_uncertainty_score":0.040169895},"labels":[],"label_agreement":null},{"id":"W4246852754","doi":"10.1145/584800.584802","title":"Topic-oriented collaborative crawling","year":2002,"lang":"en","type":"article","venue":"","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":9,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Waterloo","funders":"","keywords":"Web crawler; Crawling; Computer science; Focused crawler; Hash function; Information retrieval; Web page; World Wide Web; Context (archaeology); Data mining; Database; Static web page; Web navigation; Computer security","score_opus":0.01527913115665228,"score_gpt":0.22174585621769394,"score_spread":0.20646672506104166,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4246852754","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.027422337,0.00046188344,0.9633326,0.00014677442,0.000053804994,0.00044235596,0.00008592719,0.003614099,0.0044402974],"genre_scores_gemma":[0.27374783,0.0005278944,0.71581405,0.00017403014,0.00016254967,0.0008163683,0.0006718443,0.0004846431,0.007600824],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9939374,0.0021541326,0.0003981176,0.0011536346,0.00204515,0.00031151774],"domain_scores_gemma":[0.98643947,0.0041001905,0.00088718516,0.004781169,0.003238152,0.000553832],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0046582483,0.0008305669,0.0017575076,0.0025000956,0.0015768958,0.002564414,0.0025941394,0.0013100778,0.0015544329],"category_scores_gemma":[0.014841929,0.0007541631,0.00076869794,0.0029269014,0.00094764977,0.0031642835,0.002744594,0.0009954751,0.0018019642],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00040497043,0.00090024073,0.009167388,0.0008503404,0.0004410791,0.00045928478,0.002655813,0.07173027,0.04587611,0.038333297,0.018994566,0.8101867],"study_design_scores_gemma":[0.00025097487,0.00053695985,0.006021608,0.00008183948,0.00033902732,0.0012723937,0.0010522311,0.82659334,0.045076348,0.062181976,0.056453623,0.00013962902],"about_ca_topic_score_codex":0.0022566982,"about_ca_topic_score_gemma":0.004499533,"teacher_disagreement_score":0.0046582483,"about_ca_system_score_codex":0.0006836327,"about_ca_system_score_gemma":0.0016838145,"threshold_uncertainty_score":0.024635494},"labels":[],"label_agreement":null},{"id":"W4247195816","doi":"10.1007/978-1-4614-6170-8_100616","title":"Social Content Search","year":2014,"lang":"en","type":"book-chapter","venue":"","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":0,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Calgary","funders":"","keywords":"Content (measure theory); Computer science; Information retrieval; Mathematics","score_opus":0.1175462183618695,"score_gpt":0.2799440761377891,"score_spread":0.16239785777591959,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4247195816","genre_codex":"other","genre_gemma":"other","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"other","genre_consensus":"other","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.021053616,0.014600586,0.065258764,0.005111654,0.0009380361,0.00027934098,0.0016497459,0.0017173426,0.88939095],"genre_scores_gemma":[0.20895676,0.014228621,0.038439054,0.0012743692,0.001676581,0.00021688535,0.0037740637,0.0007313653,0.7307024],"study_design_codex":"design_other","study_design_gemma":"not_applicable","domain_scores_codex":[0.9992901,0.00015192761,0.000026612086,0.00011335506,0.00034577856,0.000072246694],"domain_scores_gemma":[0.99900705,0.00045761908,0.000058095324,0.00018782198,0.00021843384,0.000070956754],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.00059895555,0.0006451317,0.0005320546,0.004105784,0.0013235417,0.0036370927,0.00083197997,0.0011925804,0.0433936],"category_scores_gemma":[0.0031564555,0.00030668982,0.00044590162,0.004918301,0.0009643408,0.0075144493,0.0019736511,0.0007180547,0.022444798],"study_design_candidate":"not_applicable","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.000063652646,0.00011189492,0.00097480253,0.00046600925,0.000040174516,0.0001235301,0.0006011745,0.0011439009,0.0030475091,0.24406017,0.1671296,0.5822376],"study_design_scores_gemma":[0.00001561345,0.000053400614,0.0016125776,0.00029869954,0.000047641388,0.000782009,0.00069922174,0.014462015,0.0045801974,0.13515213,0.8422574,0.000039159037],"about_ca_topic_score_codex":0.0025516865,"about_ca_topic_score_gemma":0.0040096664,"teacher_disagreement_score":0.0433936,"about_ca_system_score_codex":0.0015144733,"about_ca_system_score_gemma":0.0010235533,"threshold_uncertainty_score":0.1451661},"labels":[],"label_agreement":null},{"id":"W4247470814","doi":"10.32920/ryerson.14656917.v1","title":"Semantic analysis of Twitter content","year":2021,"lang":"en","type":"preprint","venue":"","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Toronto Metropolitan University","funders":"","keywords":"Semantic similarity; Computer science; Explicit semantic analysis; Semantic computing; Information retrieval; Natural language processing; Closeness; Task (project management); Similarity (geometry); Semantic compression; Process (computing); Semantic grid; Semantic analysis (machine learning); Artificial intelligence; Semantic technology; Semantics (computer science); Semantic Web","score_opus":0.08276999196305927,"score_gpt":0.2837956206522319,"score_spread":0.20102562868917262,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4247470814","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.36532316,0.0038852058,0.33692634,0.00638836,0.001153987,0.0018287672,0.1209368,0.0051903822,0.15836701],"genre_scores_gemma":[0.8266361,0.0021249598,0.0986765,0.00045143682,0.00068628497,0.0012362387,0.05317966,0.000532007,0.016476842],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.99867946,0.00031917074,0.0001381927,0.00020583543,0.0005272775,0.00012997858],"domain_scores_gemma":[0.9977508,0.00068878185,0.0003975606,0.0002226101,0.00085319066,0.000087150846],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0007683841,0.00064547756,0.00038358895,0.011689417,0.0012288837,0.0016699599,0.00038406372,0.0005188583,0.004937805],"category_scores_gemma":[0.0057390584,0.00013390995,0.0007943727,0.007845196,0.00061711506,0.003550076,0.001284776,0.0004580048,0.0028012025],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.000957624,0.00024399214,0.06334399,0.0025242255,0.00033770574,0.0017170995,0.006686316,0.0155619625,0.04234307,0.21182206,0.090745956,0.56371593],"study_design_scores_gemma":[0.000057133864,0.00022493825,0.1251704,0.0006700325,0.00032021588,0.0016065888,0.012370662,0.22206189,0.03423739,0.18710874,0.41597858,0.00019352132],"about_ca_topic_score_codex":0.0036814793,"about_ca_topic_score_gemma":0.0038871234,"teacher_disagreement_score":0.011689417,"about_ca_system_score_codex":0.0015172897,"about_ca_system_score_gemma":0.0008982465,"threshold_uncertainty_score":0.016518593},"labels":[],"label_agreement":null},{"id":"W4248354819","doi":"10.1007/978-1-4614-6170-8_110062","title":"Real-Time Social Media Analysis","year":2014,"lang":"en","type":"book-chapter","venue":"","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":0,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Calgary","funders":"","keywords":"Social media; Computer science; Sociology; World Wide Web","score_opus":0.01825955107277977,"score_gpt":0.22927911999301526,"score_spread":0.2110195689202355,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4248354819","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.00959654,0.00973495,0.9180969,0.0015628906,0.0013052302,0.00016620335,0.0031529795,0.011224302,0.045159988],"genre_scores_gemma":[0.1842732,0.015708126,0.6214881,0.000836915,0.0022278086,0.00033686514,0.0096235825,0.00287058,0.1626349],"study_design_codex":"design_other","study_design_gemma":"not_applicable","domain_scores_codex":[0.9992353,0.0000893983,0.000034583194,0.00015031414,0.00044955607,0.000040881616],"domain_scores_gemma":[0.9987394,0.0006923737,0.00007396901,0.00019953545,0.0002519725,0.00004280528],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0008194458,0.0012244903,0.00062292506,0.0025400515,0.0003798449,0.0022772483,0.0011877267,0.00064368284,0.01025875],"category_scores_gemma":[0.0024687333,0.00049288286,0.00056366564,0.0024005885,0.00042614184,0.0024441446,0.0010291007,0.00088981714,0.010097271],"study_design_candidate":"not_applicable","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.000048739417,0.00006468499,0.0011825,0.00032687618,0.00006543081,0.0001322031,0.00017222766,0.004699986,0.014273846,0.015193002,0.06254019,0.9013004],"study_design_scores_gemma":[0.000017301896,0.000093985785,0.0075272005,0.00029663698,0.00013082688,0.0014828526,0.0006268842,0.35978448,0.06418628,0.12880592,0.43690708,0.0001405664],"about_ca_topic_score_codex":0.0009161722,"about_ca_topic_score_gemma":0.00179413,"teacher_disagreement_score":0.01025875,"about_ca_system_score_codex":0.00037733454,"about_ca_system_score_gemma":0.00037334708,"threshold_uncertainty_score":0.034318984},"labels":[],"label_agreement":null},{"id":"W4249062193","doi":"10.22215/etd/2008-09314","title":"An evaluation of new browser indicators for extended validation certificates","year":2008,"lang":"en","type":"dissertation","venue":"","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Library and Archives Canada","funders":"","keywords":"Computer science; World Wide Web; Library science","score_opus":0.07602925105041271,"score_gpt":0.3555771386192112,"score_spread":0.2795478875687985,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4249062193","genre_codex":"empirical","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.69201976,0.0020528468,0.22178207,0.00071498187,0.0008143396,0.002581707,0.007169514,0.053019423,0.019845363],"genre_scores_gemma":[0.8787991,0.00031388886,0.10932429,0.00011074765,0.00008432246,0.0005259023,0.0060194368,0.0012513244,0.0035710067],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.970565,0.008718272,0.004103975,0.0026748797,0.012723789,0.0012139936],"domain_scores_gemma":[0.79657584,0.1089705,0.014714666,0.0176728,0.054829337,0.007236799],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.03122187,0.001526348,0.0013930777,0.007085065,0.0007541336,0.005418359,0.0021188993,0.0017201271,0.0053704157],"category_scores_gemma":[0.16474937,0.000563497,0.0007829141,0.0037426776,0.0007501063,0.00838617,0.00269617,0.0017131199,0.0024011824],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.014921386,0.0042896695,0.29341596,0.0022401342,0.00046567092,0.00036621914,0.002071006,0.020421196,0.03165159,0.015596747,0.023325374,0.59123504],"study_design_scores_gemma":[0.0017363827,0.0087786345,0.21273626,0.001227453,0.0007286035,0.0014100613,0.0022424138,0.6259262,0.08994288,0.008301474,0.046397183,0.0005724099],"about_ca_topic_score_codex":0.003987094,"about_ca_topic_score_gemma":0.004046799,"teacher_disagreement_score":0.03122187,"about_ca_system_score_codex":0.0020952038,"about_ca_system_score_gemma":0.0030702674,"threshold_uncertainty_score":0.16511899},"labels":[],"label_agreement":null},{"id":"W4249201959","doi":"10.32920/ryerson.14653005.v1","title":"QoS Based Ranking For Web Search","year":2021,"lang":"en","type":"preprint","venue":"","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Toronto Metropolitan University","funders":"","keywords":"Ranking (information retrieval); Computer science; Search engine; Quality of service; Information retrieval; The Internet; Quality (philosophy); Rank (graph theory); Web page; World Wide Web; Reliability (semiconductor); Data mining; Computer network; Mathematics","score_opus":0.055215923502134556,"score_gpt":0.304444143029373,"score_spread":0.24922821952723845,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4249201959","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.06354212,0.008630416,0.9096173,0.0012992037,0.0005346265,0.0004046849,0.0018033185,0.0046341964,0.009534284],"genre_scores_gemma":[0.6419404,0.0025247342,0.34701684,0.0001872663,0.00061066035,0.0002783825,0.0024421627,0.00029917792,0.0047002323],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.99640286,0.0010931524,0.00027167736,0.00040989407,0.0015105889,0.00031196538],"domain_scores_gemma":[0.99402833,0.0028664495,0.0006269547,0.0007794069,0.0014461651,0.0002527108],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.002576059,0.00093695166,0.0013412533,0.0051692976,0.0008469627,0.0023532934,0.0011019302,0.0009237371,0.002628353],"category_scores_gemma":[0.014847439,0.00030782758,0.00072073535,0.0053180917,0.00055145856,0.0026019204,0.0007000023,0.00094291463,0.0014961625],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00045883184,0.00032004144,0.008695593,0.000784898,0.00014474995,0.0001723306,0.00019003954,0.2883933,0.0072005074,0.07625185,0.021968164,0.59541965],"study_design_scores_gemma":[0.000027243746,0.00012976582,0.0025696564,0.000030427283,0.000032572247,0.00016141718,0.00006724616,0.948068,0.002053918,0.040918905,0.0058980496,0.00004278398],"about_ca_topic_score_codex":0.0060958923,"about_ca_topic_score_gemma":0.0050386065,"teacher_disagreement_score":0.0060958923,"about_ca_system_score_codex":0.0018302883,"about_ca_system_score_gemma":0.0014058909,"threshold_uncertainty_score":0.013623655},"labels":[],"label_agreement":null},{"id":"W4249280562","doi":"10.1007/978-1-4614-6170-8_100368","title":"Science of the Internet","year":2014,"lang":"en","type":"book-chapter","venue":"","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":0,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Calgary","funders":"","keywords":"The Internet; Computer science; World Wide Web","score_opus":0.0172378385300114,"score_gpt":0.21844526190915287,"score_spread":0.20120742337914146,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4249280562","genre_codex":"other","genre_gemma":"other","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"other","genre_consensus":"other","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0011304612,0.074205786,0.010208474,0.02264617,0.0034159133,0.000032549888,0.00034870833,0.00017613397,0.8878358],"genre_scores_gemma":[0.05932359,0.12043979,0.0095049385,0.010071658,0.008217971,0.00015404359,0.000778523,0.00028603768,0.79122335],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.99933666,0.00014857203,0.000019049656,0.00012211836,0.00032110725,0.00005256715],"domain_scores_gemma":[0.9992525,0.00033737117,0.00003473627,0.00014399282,0.00015381021,0.000077539145],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0006544415,0.0006944478,0.0004651521,0.0028233912,0.0015496484,0.006022254,0.0009349421,0.002010455,0.02752426],"category_scores_gemma":[0.002524722,0.00037225138,0.00034209754,0.0029486092,0.0047810613,0.008933871,0.001600677,0.0038497895,0.01142031],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0000048539146,0.000015323585,0.00011975504,0.000096543554,0.000005763721,0.000023673683,0.0002956067,0.00020769195,0.00010877169,0.7596416,0.1969143,0.04256626],"study_design_scores_gemma":[0.0000016489025,0.000002796571,0.00013232586,0.00012672838,0.0000019082747,0.00004514496,0.00011637084,0.00021306887,0.00006119546,0.27092895,0.7283663,0.000003562696],"about_ca_topic_score_codex":0.0033637644,"about_ca_topic_score_gemma":0.0036815964,"teacher_disagreement_score":0.02752426,"about_ca_system_score_codex":0.0023093852,"about_ca_system_score_gemma":0.0025535454,"threshold_uncertainty_score":0.09207785},"labels":[],"label_agreement":null},{"id":"W4249907135","doi":"10.1007/978-1-4614-6170-8_100525","title":"Temporal-Textual Web Search","year":2014,"lang":"en","type":"book-chapter","venue":"","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":0,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Calgary","funders":"","keywords":"World Wide Web; Computer science; Information retrieval","score_opus":0.0311336363441318,"score_gpt":0.2490328836489754,"score_spread":0.2178992473048436,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4249907135","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.013534146,0.015360173,0.6667938,0.0029588256,0.0009887252,0.00023383333,0.0037021986,0.006468965,0.28995922],"genre_scores_gemma":[0.25905168,0.01755489,0.3448638,0.001352057,0.0015463942,0.00027296276,0.010059088,0.0024814205,0.3628177],"study_design_codex":"design_other","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.99908686,0.0001514008,0.00006827547,0.00014336704,0.00048393992,0.00006625435],"domain_scores_gemma":[0.99798214,0.0010466643,0.000105007566,0.00040097037,0.00039440737,0.00007072447],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.00091220863,0.00073994696,0.00051718694,0.002656807,0.0006556863,0.0029087465,0.0012886641,0.0007900967,0.022154965],"category_scores_gemma":[0.0051834243,0.0004312026,0.00070315076,0.00403543,0.00094044907,0.007698065,0.0012288949,0.0009591518,0.010020559],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0001385646,0.000093687864,0.0008721023,0.000832021,0.00003980421,0.00015253972,0.00029751493,0.005221049,0.0056147953,0.29620305,0.083599396,0.60693544],"study_design_scores_gemma":[0.000025574429,0.000065465036,0.0012926927,0.000429012,0.000087980756,0.0014650587,0.000337791,0.13382663,0.011817577,0.43494534,0.41563603,0.00007081017],"about_ca_topic_score_codex":0.0038034571,"about_ca_topic_score_gemma":0.00558073,"teacher_disagreement_score":0.022154965,"about_ca_system_score_codex":0.0013362393,"about_ca_system_score_gemma":0.0010606591,"threshold_uncertainty_score":0.07411569},"labels":[],"label_agreement":null},{"id":"W4250013712","doi":"10.32920/ryerson.14656917","title":"Semantic analysis of Twitter content","year":2021,"lang":"en","type":"preprint","venue":"","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Toronto Metropolitan University","funders":"","keywords":"Semantic similarity; Computer science; Explicit semantic analysis; Information retrieval; Semantic computing; Natural language processing; Closeness; Task (project management); Similarity (geometry); Process (computing); Semantic compression; Semantic analysis (machine learning); Artificial intelligence; Semantic grid; Semantics (computer science); Semantic technology; Semantic Web","score_opus":0.08276999196305927,"score_gpt":0.2837956206522319,"score_spread":0.20102562868917262,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4250013712","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.36532316,0.0038852058,0.33692634,0.00638836,0.001153987,0.0018287672,0.1209368,0.0051903822,0.15836701],"genre_scores_gemma":[0.8266361,0.0021249598,0.0986765,0.00045143682,0.00068628497,0.0012362387,0.05317966,0.000532007,0.016476842],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.99867946,0.00031917074,0.0001381927,0.00020583543,0.0005272775,0.00012997858],"domain_scores_gemma":[0.9977508,0.00068878185,0.0003975606,0.0002226101,0.00085319066,0.000087150846],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0007683841,0.00064547756,0.00038358895,0.011689417,0.0012288837,0.0016699599,0.00038406372,0.0005188583,0.004937805],"category_scores_gemma":[0.0057390584,0.00013390995,0.0007943727,0.007845196,0.00061711506,0.003550076,0.001284776,0.0004580048,0.0028012025],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.000957624,0.00024399214,0.06334399,0.0025242255,0.00033770574,0.0017170995,0.006686316,0.0155619625,0.04234307,0.21182206,0.090745956,0.56371593],"study_design_scores_gemma":[0.000057133864,0.00022493825,0.1251704,0.0006700325,0.00032021588,0.0016065888,0.012370662,0.22206189,0.03423739,0.18710874,0.41597858,0.00019352132],"about_ca_topic_score_codex":0.0036814793,"about_ca_topic_score_gemma":0.0038871234,"teacher_disagreement_score":0.011689417,"about_ca_system_score_codex":0.0015172897,"about_ca_system_score_gemma":0.0008982465,"threshold_uncertainty_score":0.016518593},"labels":[],"label_agreement":null},{"id":"W4250082276","doi":"10.1109/icse.2001.919195","title":"Babel: representing business rules in XML for application integration","year":2005,"lang":"en","type":"article","venue":"Proceedings of the 23rd International Conference on Software Engineering. ICSE 2001","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":1,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Alberta","funders":"","keywords":"Interoperation; Computer science; XML; Programming language; Information retrieval; Software engineering; Database; World Wide Web; Interoperability","score_opus":0.024165516349808763,"score_gpt":0.26183554837622974,"score_spread":0.23767003202642098,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4250082276","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0022284891,0.00039192283,0.96414775,0.0004064859,0.00014637908,0.00023063214,0.0010692378,0.028046884,0.0033322305],"genre_scores_gemma":[0.04373518,0.0011056233,0.93906945,0.0008249774,0.00010278623,0.000471051,0.0054154317,0.0034851297,0.0057904115],"study_design_codex":"design_other","study_design_gemma":"not_applicable","domain_scores_codex":[0.99615604,0.0013381375,0.0005994466,0.0004544045,0.0012109875,0.00024091998],"domain_scores_gemma":[0.995389,0.0026339712,0.00035351038,0.00078259496,0.00065644557,0.00018450466],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0067018443,0.0014646066,0.0011298432,0.0034471785,0.0012342011,0.007420136,0.0031398435,0.0024922274,0.009370747],"category_scores_gemma":[0.011502629,0.0015931566,0.0017103391,0.002875202,0.0012561077,0.007214274,0.0034645759,0.0032560795,0.0040222066],"study_design_candidate":"not_applicable","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0011362316,0.0006199042,0.0037277488,0.0030175163,0.00057021173,0.0026242414,0.002211545,0.04037166,0.02312945,0.32438794,0.08534845,0.51285505],"study_design_scores_gemma":[0.0002580334,0.00020733535,0.0006822425,0.0011051184,0.0003171854,0.001303041,0.00042226666,0.28729308,0.057179064,0.16734709,0.4836623,0.00022326029],"about_ca_topic_score_codex":0.0030649113,"about_ca_topic_score_gemma":0.0034581823,"teacher_disagreement_score":0.009370747,"about_ca_system_score_codex":0.0007337361,"about_ca_system_score_gemma":0.0015919472,"threshold_uncertainty_score":0.035443127},"labels":[],"label_agreement":null},{"id":"W4251596819","doi":"10.1007/978-3-540-78646-7_22","title":"Automatic Extraction of Domain-Specific Stopwords from Labeled Documents","year":2008,"lang":"en","type":"book-chapter","venue":"Lecture notes in computer science","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":34,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Waterloo","funders":"","keywords":"Computer science; Classifier (UML); Information loss; Filter (signal processing); Data mining; Set (abstract data type); Artificial intelligence; Information retrieval","score_opus":0.016860157106389422,"score_gpt":0.25073532390945685,"score_spread":0.23387516680306744,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4251596819","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.23881242,0.0090813,0.6758901,0.0010817674,0.0014373355,0.0013706535,0.022263598,0.03889545,0.011167378],"genre_scores_gemma":[0.23784034,0.0039240373,0.65891296,0.0005011,0.00040835567,0.0006231207,0.08146454,0.0021161125,0.014209536],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.998919,0.00014173622,0.00017378556,0.00025396774,0.00039061316,0.000121005505],"domain_scores_gemma":[0.99530953,0.0015081926,0.0004611314,0.00035183618,0.002210665,0.00015872056],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.00076447777,0.0021874239,0.0019860042,0.0062684915,0.001396435,0.0025056396,0.0013795478,0.0018409245,0.0023027402],"category_scores_gemma":[0.0031647212,0.0007532107,0.0012463483,0.004833257,0.0004474839,0.0015409603,0.0009874395,0.0016409883,0.007610884],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0007764255,0.00041706004,0.006500702,0.0030118194,0.00026411825,0.0027411869,0.0006736444,0.0025856683,0.29176006,0.0025701546,0.041768085,0.646931],"study_design_scores_gemma":[0.0002522324,0.000784207,0.028054696,0.00085883576,0.0013525714,0.007786584,0.0019845178,0.2016178,0.6168149,0.010392459,0.12981123,0.0002899544],"about_ca_topic_score_codex":0.002476505,"about_ca_topic_score_gemma":0.0053109457,"teacher_disagreement_score":0.0062684915,"about_ca_system_score_codex":0.0006389024,"about_ca_system_score_gemma":0.00229727,"threshold_uncertainty_score":0.0077034235},"labels":[],"label_agreement":null},{"id":"W4251675061","doi":"10.1109/ideas.2007.4318093","title":"CINDI Robot: an Intelligent Web Crawler Based on Multi-level Inspection","year":2007,"lang":"en","type":"article","venue":"","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":4,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Motorola (Canada); Concordia University","funders":"","keywords":"Web crawler; Computer science; Web page; Focused crawler; World Wide Web; Scheme (mathematics); Software; Web modeling; Web application; Process (computing); Robot; Information retrieval; Web navigation; Static web page; Artificial intelligence","score_opus":0.08017709034278094,"score_gpt":0.3119869579433168,"score_spread":0.2318098676005359,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4251675061","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.043629486,0.00082055543,0.8057121,0.00021010105,0.0001441854,0.0007207909,0.00091896846,0.14412053,0.0037231664],"genre_scores_gemma":[0.12212951,0.00025981438,0.86577755,0.00018531687,0.00004824998,0.00036714022,0.0034339777,0.0014219182,0.006376581],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.99902296,0.00012299092,0.00007522388,0.0002307488,0.00047153246,0.00007650705],"domain_scores_gemma":[0.9981127,0.0004956817,0.00020583342,0.00048349297,0.0005647304,0.000137564],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0007665378,0.0011420943,0.0014283621,0.003136556,0.0005678012,0.0009885832,0.0016619997,0.0009788629,0.0016148076],"category_scores_gemma":[0.0026876798,0.0007940525,0.0005398667,0.0016920818,0.00040898786,0.0016326117,0.0011173477,0.0009359479,0.0014147998],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00069909525,0.000517075,0.009818739,0.00071099785,0.00024565757,0.00048759332,0.0002839234,0.014271345,0.08164208,0.0025006104,0.05197406,0.83684886],"study_design_scores_gemma":[0.0002814643,0.0005619644,0.013585559,0.00006586777,0.00019004603,0.0018788176,0.00009260241,0.85004157,0.08616007,0.0017815994,0.04517244,0.00018808809],"about_ca_topic_score_codex":0.0048123416,"about_ca_topic_score_gemma":0.007724843,"teacher_disagreement_score":0.0048123416,"about_ca_system_score_codex":0.00054414093,"about_ca_system_score_gemma":0.0012394842,"threshold_uncertainty_score":0.009568632},"labels":[],"label_agreement":null},{"id":"W4251852459","doi":"10.1007/978-1-4939-7131-2_101458","title":"Web Crawling","year":2018,"lang":"en","type":"book-chapter","venue":"","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":0,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Calgary","funders":"","keywords":"Crawling; World Wide Web; Web application; Computer science; Biology; Anatomy","score_opus":0.025587670281006253,"score_gpt":0.23370725576406032,"score_spread":0.20811958548305406,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4251852459","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.016000753,0.030723222,0.5129437,0.005087267,0.0031847146,0.00085883983,0.00829218,0.052821267,0.37008813],"genre_scores_gemma":[0.0574109,0.029432312,0.42865697,0.0023808747,0.0018668845,0.0005136227,0.027670851,0.010645407,0.4414222],"study_design_codex":"design_other","study_design_gemma":"not_applicable","domain_scores_codex":[0.99844736,0.00014554223,0.000111417336,0.00034508112,0.0008565951,0.00009407708],"domain_scores_gemma":[0.99772793,0.00047290503,0.000115798604,0.000873209,0.0007109298,0.00009920331],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0009894794,0.0016516022,0.0011250612,0.008280111,0.0014358617,0.0036553096,0.001630475,0.0012504613,0.016168725],"category_scores_gemma":[0.004135352,0.0008892734,0.0010582372,0.008596869,0.0006370346,0.004728739,0.0022627627,0.0016798882,0.028199391],"study_design_candidate":"not_applicable","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.000019698431,0.000081464954,0.00045222606,0.00047939282,0.00003531504,0.000079763515,0.00011819409,0.00095286383,0.0032035506,0.011923459,0.17540777,0.8072462],"study_design_scores_gemma":[0.000013592883,0.00004711531,0.0018397198,0.00049050816,0.00008398266,0.0015782805,0.00012008823,0.019271633,0.016347483,0.04386087,0.9162918,0.00005491448],"about_ca_topic_score_codex":0.002141871,"about_ca_topic_score_gemma":0.0045735952,"teacher_disagreement_score":0.016168725,"about_ca_system_score_codex":0.00088901457,"about_ca_system_score_gemma":0.001453658,"threshold_uncertainty_score":0.054089725},"labels":[],"label_agreement":null},{"id":"W4252852578","doi":"10.1007/978-1-4939-7131-2_101351","title":"Time-Aware User Interests Extraction","year":2018,"lang":"en","type":"book-chapter","venue":"","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":0,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Calgary","funders":"","keywords":"Extraction (chemistry); Computer science; Chromatography; Chemistry","score_opus":0.02418005018874671,"score_gpt":0.2618660613247257,"score_spread":0.23768601113597895,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4252852578","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.04286891,0.009185141,0.9099412,0.0006471432,0.0005434796,0.00021762417,0.0048865634,0.008692283,0.023017762],"genre_scores_gemma":[0.42936957,0.006796679,0.51243937,0.00033146786,0.00085635076,0.00021168725,0.0127171315,0.00088707055,0.036390588],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.99913377,0.0001213298,0.00006142183,0.00019854477,0.00039878214,0.00008614729],"domain_scores_gemma":[0.99860483,0.00054266636,0.00009768032,0.00030266948,0.00037746294,0.00007463727],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.00076753955,0.0009563226,0.0008235909,0.0030148332,0.00041231044,0.001386759,0.0009754411,0.00053525047,0.002772831],"category_scores_gemma":[0.003098698,0.0003896889,0.0008872612,0.0036765118,0.00016457526,0.0027201483,0.0010527405,0.0008623592,0.004238696],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00027143466,0.00016511443,0.00455289,0.00032907413,0.00009653319,0.0001559469,0.00021106437,0.0043172566,0.024790548,0.0070120445,0.026439052,0.9316591],"study_design_scores_gemma":[0.000038345705,0.0002470378,0.0175511,0.00024490926,0.00039621853,0.002572068,0.0005291594,0.6605949,0.13455375,0.051267475,0.13182077,0.00018426418],"about_ca_topic_score_codex":0.0016038081,"about_ca_topic_score_gemma":0.0027182787,"teacher_disagreement_score":0.0030148332,"about_ca_system_score_codex":0.00044044483,"about_ca_system_score_gemma":0.00039204423,"threshold_uncertainty_score":0.009276092},"labels":[],"label_agreement":null},{"id":"W4253282743","doi":"10.1007/s11042-017-4721-y","title":"Editorial Note: Web Data Analysis in Pervasive Multimedia Environment","year":2017,"lang":"en","type":"editorial","venue":"Multimedia Tools and Applications","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":0,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Athabasca University","funders":"","keywords":"Computer science; World Wide Web; Multimedia","score_opus":0.025540232456799976,"score_gpt":0.29356165530028483,"score_spread":0.26802142284348485,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4253282743","genre_codex":"editorial","genre_gemma":"editorial","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"editorial","genre_consensus":"editorial","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.000028449193,0.0032405257,0.00029996413,0.023460058,0.97209483,0.000012491271,0.000050620296,0.00006334572,0.0007497369],"genre_scores_gemma":[0.00029967836,0.0025599857,0.00021714105,0.009792292,0.98204136,0.000016084367,0.000042480413,0.00007331499,0.0049576615],"study_design_codex":"not_applicable","study_design_gemma":"not_applicable","domain_scores_codex":[0.9877507,0.0014308156,0.0013576455,0.0013557333,0.0075746826,0.0005304322],"domain_scores_gemma":[0.9287511,0.021011306,0.0038010378,0.0021429746,0.03518214,0.009111535],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.011041887,0.0034104509,0.0045480975,0.009376193,0.004373696,0.012805199,0.003488059,0.013161089,0.011765307],"category_scores_gemma":[0.04355506,0.0011527033,0.0026260966,0.0044372124,0.0039221602,0.0057849973,0.0027137126,0.019211173,0.012642103],"study_design_candidate":"not_applicable","study_design_consensus":"not_applicable","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.000016756847,0.000010393644,0.000032224256,0.000100909085,0.000014585631,0.00007412961,0.000008935077,0.000019721545,0.00005005391,0.00015062564,0.99494654,0.0045751343],"study_design_scores_gemma":[0.00004110783,0.000020080915,0.00032999567,0.0003702379,0.000059727012,0.00035132768,0.00006610156,0.00038389812,0.00017908032,0.0016875503,0.9964843,0.000026752105],"about_ca_topic_score_codex":0.0019138749,"about_ca_topic_score_gemma":0.005897937,"teacher_disagreement_score":0.013161089,"about_ca_system_score_codex":0.002969269,"about_ca_system_score_gemma":0.0047597084,"threshold_uncertainty_score":0.058395803},"labels":[],"label_agreement":null},{"id":"W4254692379","doi":"10.32920/ryerson.14657823.v1","title":"Meta search engine","year":2021,"lang":"en","type":"preprint","venue":"","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Toronto Metropolitan University","funders":"","keywords":"Search engine; Search analytics; Metasearch engine; sort; Computer science; Spamdexing; Information retrieval; Search engine optimization; Database search engine; Quality (philosophy); Frame (networking); World Wide Web; Web search query","score_opus":0.11130489887193458,"score_gpt":0.29689282077891277,"score_spread":0.1855879219069782,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4254692379","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0078958245,0.01026775,0.45924562,0.0025051786,0.001179781,0.0027069622,0.11994916,0.22413486,0.17211488],"genre_scores_gemma":[0.07210586,0.0074895173,0.57542866,0.0033528332,0.00064586266,0.0026583248,0.21754622,0.026457373,0.09431532],"study_design_codex":"not_applicable","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9972799,0.00063306466,0.00044187027,0.000442352,0.0009690199,0.00023379941],"domain_scores_gemma":[0.9939492,0.0022924074,0.0003990063,0.0013487259,0.0017198754,0.00029083356],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0031007668,0.0016012173,0.0019265539,0.008087458,0.00089236774,0.0055096555,0.0034740302,0.002116212,0.061265502],"category_scores_gemma":[0.013152496,0.0010452195,0.0021038225,0.0067940974,0.0004017322,0.006058019,0.002899199,0.001735887,0.053164463],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.001182322,0.0002380945,0.0028937075,0.00466298,0.00064497744,0.0005624461,0.00034117888,0.004802656,0.011050875,0.057923008,0.50449264,0.4112051],"study_design_scores_gemma":[0.00025278365,0.00016175992,0.0013421993,0.000649395,0.00031430088,0.001029524,0.00020977075,0.031299796,0.016337898,0.036018234,0.9122214,0.00016292837],"about_ca_topic_score_codex":0.002528736,"about_ca_topic_score_gemma":0.0033449933,"teacher_disagreement_score":0.061265502,"about_ca_system_score_codex":0.0012396525,"about_ca_system_score_gemma":0.002864236,"threshold_uncertainty_score":0.20495349},"labels":[],"label_agreement":null},{"id":"W4254899182","doi":"10.1007/978-1-4939-7131-2_100262","title":"Deep Web","year":2018,"lang":"en","type":"book-chapter","venue":"","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":0,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Calgary","funders":"","keywords":"Computer science; World Wide Web","score_opus":0.019813573053806103,"score_gpt":0.22386508521909812,"score_spread":0.20405151216529202,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4254899182","genre_codex":"other","genre_gemma":"other","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"other","genre_consensus":"other","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0040885815,0.010845097,0.4025167,0.0057223733,0.0034751005,0.00017877412,0.0062860562,0.016298978,0.5505883],"genre_scores_gemma":[0.030080939,0.011590479,0.13089582,0.0023821932,0.0013173153,0.00017704073,0.011907304,0.003731957,0.8079169],"study_design_codex":"design_other","study_design_gemma":"not_applicable","domain_scores_codex":[0.9996623,0.000023333441,0.000014248002,0.00007141831,0.00019578724,0.000032842094],"domain_scores_gemma":[0.9994443,0.000114430455,0.00002021253,0.00019135844,0.00017176227,0.0000578606],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.00044027856,0.0008984597,0.00050618,0.0018742995,0.00068350433,0.0030798174,0.0010417367,0.0009913808,0.06597455],"category_scores_gemma":[0.0017658973,0.00054061256,0.00047872876,0.0023818044,0.0005405845,0.0055971523,0.0023649908,0.0021771064,0.05506704],"study_design_candidate":"not_applicable","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.000022904884,0.000045307275,0.0001656516,0.00019693821,0.000018360115,0.000037512727,0.00005089537,0.0012541958,0.0022245594,0.06398427,0.29789266,0.6341068],"study_design_scores_gemma":[0.000004939921,0.000008375423,0.0002568457,0.000105646264,0.000013218704,0.00014203493,0.000031039097,0.006723353,0.0031121382,0.10796748,0.88162,0.0000149639345],"about_ca_topic_score_codex":0.0018764971,"about_ca_topic_score_gemma":0.003573822,"teacher_disagreement_score":0.06597455,"about_ca_system_score_codex":0.0006571618,"about_ca_system_score_gemma":0.0011243396,"threshold_uncertainty_score":0},"labels":[],"label_agreement":null},{"id":"W4255377955","doi":"10.22215/etd/2014-10139","title":"Structured Web Data Extraction: University Domain","year":2014,"lang":"en","type":"dissertation","venue":"","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":1,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Carleton University","funders":"University of Toronto","keywords":"Computer science; World Wide Web; Information retrieval; Data Web; Semantic Web; Web modeling; Information extraction; Unstructured data; Web intelligence; Domain (mathematical analysis); Web page; Web search engine; Web development; Data mining; Big data","score_opus":0.018756102864325365,"score_gpt":0.26445754383226067,"score_spread":0.2457014409679353,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4255377955","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.1580183,0.013379294,0.6749485,0.013005021,0.0010083785,0.0015626407,0.057976007,0.018242504,0.06185933],"genre_scores_gemma":[0.3612504,0.009840143,0.52450144,0.0014880648,0.00081254065,0.00067470217,0.080920294,0.0013467894,0.019165566],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.99789184,0.0005211011,0.00018272754,0.00033603146,0.00096464687,0.00010371336],"domain_scores_gemma":[0.99600756,0.0013047043,0.0002847768,0.0010391808,0.0011683176,0.0001954355],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0016588911,0.00045863978,0.0005131735,0.0060471063,0.001379237,0.0027354367,0.00080941914,0.0012628705,0.0038652138],"category_scores_gemma":[0.007023256,0.00034690948,0.00055512163,0.011439603,0.0007767625,0.0040442958,0.0021440317,0.0010984956,0.004243785],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00029108583,0.00068733643,0.012781776,0.0011673459,0.000084057676,0.0006437919,0.0011462711,0.0054674796,0.008391274,0.039792467,0.10771506,0.821832],"study_design_scores_gemma":[0.0001080662,0.0002019963,0.021001814,0.00095740706,0.00019917118,0.0018265917,0.0029213873,0.11539738,0.09156494,0.11946328,0.646208,0.00015004119],"about_ca_topic_score_codex":0.0031890448,"about_ca_topic_score_gemma":0.005416116,"teacher_disagreement_score":0.0060471063,"about_ca_system_score_codex":0.00090402074,"about_ca_system_score_gemma":0.0025989953,"threshold_uncertainty_score":0.012930393},"labels":[],"label_agreement":null},{"id":"W4255612408","doi":"10.1007/978-1-4939-7131-2_101105","title":"Social Content Search","year":2018,"lang":"en","type":"book-chapter","venue":"","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":0,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Calgary","funders":"","keywords":"Content (measure theory); Information retrieval; Computer science; Mathematics","score_opus":0.14612679856295235,"score_gpt":0.2956212185535082,"score_spread":0.14949441999055585,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4255612408","genre_codex":"other","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0211122,0.015940882,0.062955394,0.005946816,0.001152911,0.0002751776,0.0018012293,0.0018365524,0.88897884],"genre_scores_gemma":[0.22596902,0.01589021,0.037175626,0.0014994362,0.0021921238,0.00023123884,0.004296729,0.000812844,0.7119328],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9992261,0.00016677739,0.000029262348,0.00012785109,0.00037025823,0.00007979921],"domain_scores_gemma":[0.99883837,0.000536213,0.00006653271,0.0002268603,0.00024717094,0.00008486412],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.00064539915,0.000659985,0.0005421175,0.0041967263,0.0013597206,0.003929942,0.0008590995,0.0012763093,0.044594835],"category_scores_gemma":[0.0036558947,0.00031265692,0.0004722738,0.005190604,0.0010039682,0.008020017,0.0021228723,0.00078845595,0.024125868],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00006877881,0.00011556133,0.00097018003,0.00052561803,0.00004324558,0.00012549592,0.00060772477,0.0011483663,0.003143478,0.25536484,0.1745546,0.56333214],"study_design_scores_gemma":[0.000015324222,0.000051502095,0.0015057536,0.00029447954,0.000047360918,0.00073300913,0.0006499789,0.013069694,0.004293629,0.13184837,0.847454,0.000036991885],"about_ca_topic_score_codex":0.0023315682,"about_ca_topic_score_gemma":0.0035441115,"teacher_disagreement_score":0.044594835,"about_ca_system_score_codex":0.001557052,"about_ca_system_score_gemma":0.0010599843,"threshold_uncertainty_score":0.14918453},"labels":[],"label_agreement":null},{"id":"W4255895206","doi":"10.3821/1913-701x-141.6.311.b","title":"Website Appreciation","year":2008,"lang":"en","type":"article","venue":"Canadian Pharmacists Journal / Revue des Pharmaciens du Canada","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":0,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":true,"route_about_ca":false,"ca_institutions":"Centre for Drug Research and Development","funders":"","keywords":"Computer science; World Wide Web","score_opus":0.03493075725544313,"score_gpt":0.22596464686329923,"score_spread":0.1910338896078561,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4255895206","genre_codex":"other","genre_gemma":"other","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"other","genre_consensus":"other","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.00090223405,0.0006256361,0.0005029275,0.0061163506,0.0099582095,0.00012414198,0.0023494023,0.002018725,0.9774024],"genre_scores_gemma":[0.0010086797,0.00012390512,0.00011160233,0.0010812939,0.0005080659,0.000016809146,0.00044664287,0.00023661523,0.9964664],"study_design_codex":"not_applicable","study_design_gemma":"not_applicable","domain_scores_codex":[0.99938726,0.000049584156,0.00001642736,0.000062945495,0.00038887493,0.00009488491],"domain_scores_gemma":[0.9963595,0.00029060725,0.000088184526,0.00026738772,0.0016605087,0.0013339006],"candidate_categories":["insufficient_payload"],"consensus_categories":[],"category_scores_codex":[0.0005409708,0.00072533917,0.00066337764,0.0016499825,0.0014970353,0.004206444,0.00081956066,0.001589163,0.85459614],"category_scores_gemma":[0.0041087917,0.00022675714,0.0004432011,0.0013451345,0.0003401917,0.0016036212,0.0022445845,0.0014751591,0.72171617],"study_design_candidate":"not_applicable","study_design_consensus":"not_applicable","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.000016162201,0.000015508362,0.00006758372,0.00002158283,6.0516396e-7,0.000025646676,0.000016381764,0.000010805683,0.000094206385,0.0004142538,0.9708446,0.028472608],"study_design_scores_gemma":[0.0000056699805,0.000007070612,0.0004424349,0.000020687106,9.367874e-7,0.000031570464,0.000053931508,0.00003287527,0.000037726528,0.00020955395,0.99915385,0.0000036571123],"about_ca_topic_score_codex":0.009316308,"about_ca_topic_score_gemma":0.036328115,"teacher_disagreement_score":0.85459614,"about_ca_system_score_codex":0.0010695909,"about_ca_system_score_gemma":0.0015959274,"threshold_uncertainty_score":0.20740086},"labels":[],"label_agreement":null},{"id":"W4256487648","doi":"10.1007/978-1-4939-7131-2_100812","title":"Online Social Networking Platforms","year":2018,"lang":"en","type":"book-chapter","venue":"","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":0,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Calgary","funders":"","keywords":"Computer science; Internet privacy; World Wide Web","score_opus":0.046742227284226445,"score_gpt":0.2568216293041787,"score_spread":0.21007940201995223,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4256487648","genre_codex":"other","genre_gemma":"other","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"other","genre_consensus":"other","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.007003401,0.00652309,0.03305946,0.0039582504,0.001637558,0.00014103216,0.0014910311,0.0013632672,0.94482297],"genre_scores_gemma":[0.039785072,0.012718244,0.021959055,0.0011054883,0.0021849175,0.00018231338,0.0025879052,0.0005592087,0.9189177],"study_design_codex":"design_other","study_design_gemma":"not_applicable","domain_scores_codex":[0.9995528,0.000063987405,0.000013341622,0.000071114446,0.000255792,0.000042939657],"domain_scores_gemma":[0.99948955,0.00017424906,0.000030748597,0.00012876409,0.00009889497,0.00007779459],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.00044520423,0.0008118717,0.00028287587,0.0028790818,0.0010948224,0.004157061,0.00083415466,0.0010171772,0.06581977],"category_scores_gemma":[0.0017356442,0.0003791546,0.00034123778,0.003391116,0.00053486286,0.008071053,0.0027695785,0.0012570622,0.043770406],"study_design_candidate":"not_applicable","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.000015580807,0.00007493402,0.0006398905,0.00019794198,0.000012233459,0.000093764495,0.00037397398,0.0003232188,0.0015120056,0.14518784,0.2301161,0.6214525],"study_design_scores_gemma":[0.0000017914726,0.000010743179,0.0006764117,0.00015695562,0.0000069066336,0.00023856922,0.00020628811,0.0011089491,0.00081221946,0.03610557,0.9606666,0.000009171005],"about_ca_topic_score_codex":0.0006954389,"about_ca_topic_score_gemma":0.0019627344,"teacher_disagreement_score":0.06581977,"about_ca_system_score_codex":0.0005603843,"about_ca_system_score_gemma":0.00062468665,"threshold_uncertainty_score":0.2201891},"labels":[],"label_agreement":null},{"id":"W4285540454","doi":"10.52458/978-93-91842-08-6-38","title":"Web Scraping Techniques and Applications: A Literature Review","year":2021,"lang":"en","type":"review","venue":"Soft Computing Research Society eBooks","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":52,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Cégep de Chicoutimi; Université du Québec à Chicoutimi","funders":"","keywords":"Computer science; World Wide Web; Web intelligence; Big data; Data science; Web mining; Web analytics; Web application; Analytics; Social media; Web standards; Web development; Web engineering; Web modeling; The Internet; Web page; Data mining","score_opus":0.0854457235976239,"score_gpt":0.42366133798306665,"score_spread":0.3382156143854428,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4285540454","genre_codex":"review","genre_gemma":"review","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"review","genre_consensus":"review","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.00030339876,0.99766195,0.00049182365,0.0003452962,0.00011819854,0.000018072185,0.000027224918,0.000016588083,0.0010173685],"genre_scores_gemma":[0.00135018,0.9972824,0.00073953957,0.00018269573,0.000102053295,0.000019157515,0.00003818344,0.000005478057,0.00028033025],"study_design_codex":"design_other","study_design_gemma":"not_applicable","domain_scores_codex":[0.9987337,0.0002478078,0.00024894596,0.00016816004,0.0005303852,0.00007093301],"domain_scores_gemma":[0.99334043,0.004302704,0.00056519994,0.00013719799,0.0015157706,0.00013869535],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0020496869,0.0010710699,0.0015600474,0.010089334,0.0007076002,0.0020799271,0.0013900409,0.001316542,0.0039735604],"category_scores_gemma":[0.006809024,0.00068059616,0.0013165729,0.012375192,0.00078005256,0.003373937,0.00097581197,0.0013184438,0.0017012625],"study_design_candidate":"not_applicable","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.000044739412,0.000099311284,0.0005179359,0.053528346,0.00011200583,0.00019053233,0.00021508553,0.0003964326,0.0006128149,0.0025103302,0.014803957,0.9269685],"study_design_scores_gemma":[0.000018550636,0.00020474853,0.0038007337,0.07926469,0.00075799023,0.0026453922,0.00067141914,0.00061143294,0.0013983806,0.004310669,0.90623933,0.000076575285],"about_ca_topic_score_codex":0.0033100825,"about_ca_topic_score_gemma":0.0049243653,"teacher_disagreement_score":0.010089334,"about_ca_system_score_codex":0.0009278256,"about_ca_system_score_gemma":0.003572143,"threshold_uncertainty_score":0.013292909},"labels":[],"label_agreement":null},{"id":"W4287631240","doi":"10.5281/zenodo.4000749","title":"Draft template for data extraction","year":2020,"lang":"en","type":"article","venue":"Zenodo (CERN European Organization for Nuclear Research)","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":1,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"McMaster University","funders":"","keywords":"Extraction (chemistry); Data extraction; Computer science; Information retrieval; Chromatography; Political science; MEDLINE; Chemistry; Law","score_opus":0.13308255452381065,"score_gpt":0.2989105927735164,"score_spread":0.16582803824970574,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4287631240","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0013637326,0.0005955789,0.46106422,0.0031326523,0.0022925884,0.013276177,0.44606987,0.03279671,0.039408494],"genre_scores_gemma":[0.00508889,0.0007543433,0.54527116,0.0020704486,0.00043384644,0.0193429,0.37239915,0.01194174,0.04269753],"study_design_codex":"not_applicable","study_design_gemma":"not_applicable","domain_scores_codex":[0.99100107,0.0022355968,0.0030386942,0.00094635534,0.0023829746,0.00039538322],"domain_scores_gemma":[0.91332483,0.035333678,0.0025267967,0.016322445,0.03108821,0.0014040619],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.010141928,0.0018995779,0.001812469,0.0077966033,0.0013632838,0.004655289,0.0029328957,0.00227299,0.2367113],"category_scores_gemma":[0.081676826,0.0023509045,0.0028044735,0.0058977967,0.00076395774,0.0033829345,0.0042872857,0.003005207,0.19846684],"study_design_candidate":"not_applicable","study_design_consensus":"not_applicable","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00033809498,0.00010839212,0.0008594971,0.0033500306,0.00009451534,0.00039616067,0.00058701664,0.00089792,0.0070822616,0.008383236,0.83322054,0.14468238],"study_design_scores_gemma":[0.00013973088,0.000052408177,0.0008611444,0.0007264773,0.00006831249,0.00028993972,0.00019215654,0.0012685833,0.0062723304,0.008362086,0.98171127,0.00005564793],"about_ca_topic_score_codex":0.0043593757,"about_ca_topic_score_gemma":0.0045557655,"teacher_disagreement_score":0.2367113,"about_ca_system_score_codex":0.0017579435,"about_ca_system_score_gemma":0.009322864,"threshold_uncertainty_score":0.79187816},"labels":[],"label_agreement":null},{"id":"W4288685011","doi":"10.4242/balisagevol27.takeda01","title":"Serverless Searching with XSLT and JavaScript","year":2022,"lang":"en","type":"article","venue":"Balisage series on markup technologies","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":1,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Victoria; Simon Fraser University","funders":"","keywords":"XSLT; JavaScript; Computer science; World Wide Web; Bytecode; Ajax; Presentation (obstetrics); XML; Information retrieval; Programming language; Web application; Virtual machine","score_opus":0.008208968830791925,"score_gpt":0.19156553632581513,"score_spread":0.18335656749502321,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4288685011","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.02532064,0.0010548491,0.7739262,0.0005981016,0.00025547808,0.00026827265,0.0044709635,0.15939508,0.03471039],"genre_scores_gemma":[0.19320512,0.0013722718,0.7188498,0.0008219897,0.00026510956,0.0002898755,0.016152253,0.024954144,0.04408952],"study_design_codex":"design_other","study_design_gemma":"not_applicable","domain_scores_codex":[0.99648273,0.0005050178,0.00049074326,0.0006890154,0.0016025505,0.0002299304],"domain_scores_gemma":[0.9930307,0.0021822508,0.00044329235,0.0029305385,0.0011744802,0.00023870435],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0026357258,0.00093843654,0.0012510213,0.0038421294,0.0012036477,0.0053816293,0.0017966016,0.0010543303,0.010656653],"category_scores_gemma":[0.010877838,0.0009100044,0.0012104794,0.0049096486,0.0011996039,0.007909952,0.0026418704,0.0012712048,0.013491408],"study_design_candidate":"not_applicable","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00093376567,0.00035271028,0.006141546,0.000924097,0.00018590516,0.0008236925,0.0019967065,0.0048487657,0.075623736,0.051057704,0.102525875,0.7545855],"study_design_scores_gemma":[0.00020114142,0.00038866984,0.006773272,0.00054677937,0.0002024603,0.0020523078,0.00073193625,0.14208351,0.2519754,0.07975338,0.5148934,0.00039778068],"about_ca_topic_score_codex":0.0032691967,"about_ca_topic_score_gemma":0.0040193903,"teacher_disagreement_score":0.010656653,"about_ca_system_score_codex":0.00090663315,"about_ca_system_score_gemma":0.002129517,"threshold_uncertainty_score":0.035650074},"labels":[],"label_agreement":null},{"id":"W4295094076","doi":"10.1080/23257962.2022.2100336","title":"Creating order from the mess: web archive derivative datasets and notebooks","year":2022,"lang":"en","type":"article","venue":"Archives and Records","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":8,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Waterloo; York University","funders":"Andrew W. Mellon Foundation","keywords":"World Wide Web; Computer science; Point (geometry); Order (exchange)","score_opus":0.011058044257130738,"score_gpt":0.22535700376401688,"score_spread":0.21429895950688613,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4295094076","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.011444878,0.0003355567,0.9567773,0.007275556,0.00013412637,0.0003490016,0.00064630294,0.004410648,0.01862662],"genre_scores_gemma":[0.08214237,0.00055333093,0.90553665,0.0005061801,0.00006978304,0.0002510198,0.0009686905,0.0011789053,0.008793111],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"not_applicable","domain_scores_codex":[0.9921631,0.0036799838,0.0007201562,0.00077944825,0.0024530743,0.0002042953],"domain_scores_gemma":[0.9678537,0.011969088,0.0016844873,0.014995428,0.0026233285,0.0008739235],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.014755993,0.000573985,0.00055686245,0.0052274256,0.0030978126,0.016606651,0.0035703308,0.0016337414,0.004697041],"category_scores_gemma":[0.036737088,0.0010009377,0.0010519505,0.005508848,0.008269963,0.026896976,0.009789324,0.0036974559,0.002103472],"study_design_candidate":"not_applicable","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.000083778854,0.00008740333,0.004938898,0.0002917815,0.000031532756,0.0004637858,0.01746922,0.0055356626,0.0013743623,0.70918816,0.017513338,0.24302205],"study_design_scores_gemma":[0.000035995654,0.00005641716,0.001325002,0.0005482697,0.00004764331,0.0007025928,0.009504679,0.02974008,0.0061409296,0.3603589,0.5914206,0.00011892991],"about_ca_topic_score_codex":0.0072986237,"about_ca_topic_score_gemma":0.009600621,"teacher_disagreement_score":0.016606651,"about_ca_system_score_codex":0.0026562207,"about_ca_system_score_gemma":0.0055797375,"threshold_uncertainty_score":0.0780381},"labels":[],"label_agreement":null},{"id":"W4296665658","doi":"10.2139/ssrn.4225390","title":"On the Impact of Single and Co-Occurrent Refactorings on Quality Attributes in Android Applications","year":2022,"lang":"en","type":"article","venue":"SSRN Electronic Journal","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":0,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Université Laval; Université du Québec à Montréal","funders":"","keywords":"Android (operating system); Computer science; Quality (philosophy); Android application; Operating system","score_opus":0.03457295495891609,"score_gpt":0.3206869133752695,"score_spread":0.2861139584163534,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4296665658","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.99536926,0.0013271291,0.0009923266,0.0002893289,0.000060606042,0.00002696352,0.00053737476,0.00027853006,0.0011182957],"genre_scores_gemma":[0.99529487,0.00034834063,0.002209353,0.00009460494,0.00002848137,0.000012716925,0.0010322728,0.00011682674,0.000862516],"study_design_codex":"observational","study_design_gemma":"observational","domain_scores_codex":[0.9890682,0.0022304526,0.0009607513,0.0016713126,0.0051363925,0.00093292276],"domain_scores_gemma":[0.6743708,0.28423354,0.01266356,0.009386907,0.01672318,0.0026220095],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0066572293,0.00068392,0.00058018375,0.0034931374,0.0009121417,0.0017813143,0.001102305,0.0011627842,0.0019252524],"category_scores_gemma":[0.087472074,0.0003803799,0.0012443999,0.002643098,0.0009389772,0.003136954,0.0013522229,0.0020130407,0.00045331707],"study_design_candidate":"observational","study_design_consensus":"observational","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.003957472,0.0018900733,0.7144596,0.0011224503,0.0012586592,0.0024998887,0.0016021213,0.036645025,0.031690452,0.0014990817,0.0048851594,0.19849002],"study_design_scores_gemma":[0.00015046484,0.0025267627,0.7204053,0.00038518937,0.0030175704,0.002553862,0.0038515176,0.23430389,0.024470145,0.0033852088,0.004752156,0.00019802897],"about_ca_topic_score_codex":0.0156662,"about_ca_topic_score_gemma":0.032311395,"teacher_disagreement_score":0.0156662,"about_ca_system_score_codex":0.001171718,"about_ca_system_score_gemma":0.002030995,"threshold_uncertainty_score":0.035207212},"labels":[],"label_agreement":null},{"id":"W4298286664","doi":"10.1007/978-3-031-39141-5_4","title":"Evaluation of Search Methods on Community Documents","year":2023,"lang":"en","type":"book-chapter","venue":"Communications in computer and information science","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":1,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Women's and Gender Studies et Recherches Féministes; York University","funders":"","keywords":"Computer science; Information retrieval; Search engine; Domain (mathematical analysis); Search analytics; World Wide Web; Semantic search; Full text search; Web search query; Mathematics","score_opus":0.25751136249603956,"score_gpt":0.4624863153932656,"score_spread":0.20497495289722606,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4298286664","genre_codex":"empirical","genre_gemma":"other","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"other","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.83200675,0.033467047,0.0983494,0.0012116764,0.00083594146,0.0018142953,0.005663915,0.0050494755,0.02160153],"genre_scores_gemma":[0.89275825,0.0029651052,0.089159,0.00013741727,0.00039731336,0.00046312212,0.0063481415,0.0005067966,0.007264845],"study_design_codex":"design_other","study_design_gemma":"not_applicable","domain_scores_codex":[0.9872896,0.0063255797,0.0008450792,0.0008155406,0.004260115,0.00046405572],"domain_scores_gemma":[0.89662707,0.087259695,0.0017488755,0.003168762,0.00972826,0.0014673062],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.01451631,0.0016199033,0.0024901703,0.012077112,0.0012679627,0.0025478678,0.0018173384,0.0024231812,0.005637122],"category_scores_gemma":[0.06292076,0.00035282943,0.001075155,0.0076653124,0.0007299602,0.0047517167,0.0017917287,0.0008277194,0.001237387],"study_design_candidate":"not_applicable","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.018311527,0.0036210453,0.019470165,0.004363318,0.0013913217,0.00018794577,0.0004974753,0.0826691,0.007794164,0.007917183,0.023020506,0.8307562],"study_design_scores_gemma":[0.0015459963,0.0044846926,0.009093585,0.0002576863,0.0007046368,0.00036029643,0.00054535526,0.9594314,0.0100252,0.009578779,0.00387661,0.00009568727],"about_ca_topic_score_codex":0.0102974195,"about_ca_topic_score_gemma":0.010478282,"teacher_disagreement_score":0.01451631,"about_ca_system_score_codex":0.0023622348,"about_ca_system_score_gemma":0.0022483317,"threshold_uncertainty_score":0.076770484},"labels":[],"label_agreement":null},{"id":"W4310183442","doi":"10.18280/isi.270507","title":"A Hybrid Approach for Web Pages Classification","year":2022,"lang":"en","type":"article","venue":"Ingénierie des systèmes d information","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":1,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":true,"route_about_ca":false,"ca_institutions":"","funders":"","keywords":"Computer science; Web page; Cover (algebra); The Internet; Information retrieval; World Wide Web; Artificial intelligence; Data mining; Engineering","score_opus":0.029669734198815745,"score_gpt":0.2344146807610414,"score_spread":0.20474494656222567,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4310183442","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.032578085,0.0011854598,0.9578744,0.000205249,0.00015163962,0.00022600012,0.0004804802,0.0037002952,0.0035984006],"genre_scores_gemma":[0.33699748,0.00061097514,0.6446963,0.0002978473,0.00024792718,0.00035502517,0.0018235305,0.00023520598,0.014735846],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9987161,0.00019175628,0.00009352284,0.00032564078,0.0005495238,0.00012333483],"domain_scores_gemma":[0.999199,0.00019696708,0.000050446444,0.000120715384,0.00038786468,0.000045009507],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.00085825595,0.0009149292,0.0010986353,0.004576811,0.0005233525,0.0013367954,0.0013948812,0.0015482678,0.0023588794],"category_scores_gemma":[0.0014149474,0.00029524326,0.0012986808,0.0025961935,0.00037875937,0.0015971259,0.00083827495,0.00072379963,0.0019394747],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00032485728,0.0004492862,0.0049401973,0.00018568758,0.0003168859,0.00019372675,0.00013962999,0.020640757,0.02943333,0.0050403946,0.0054999185,0.9328353],"study_design_scores_gemma":[0.000022913726,0.00020515369,0.0038387233,0.000028465862,0.00013127117,0.00040653453,0.00011507146,0.9686738,0.010981348,0.008134293,0.007413895,0.000048504935],"about_ca_topic_score_codex":0.004178008,"about_ca_topic_score_gemma":0.0075049424,"teacher_disagreement_score":0.004576811,"about_ca_system_score_codex":0.00056419516,"about_ca_system_score_gemma":0.00059051,"threshold_uncertainty_score":0.008307397},"labels":[],"label_agreement":null},{"id":"W4312919289","doi":"10.1609/icwsm.v16i1.19357","title":"An Automated Approach to Identifying Corporate Editing","year":2022,"lang":"en","type":"article","venue":"Proceedings of the International AAAI Conference on Web and Social Media","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":8,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Toronto; Carleton University","funders":"","keywords":"Scholarship; Computer science; Geospatial analysis; World Wide Web; Data science; Peer production; Public relations; Knowledge management; Political science","score_opus":0.06922907683257923,"score_gpt":0.2866961814587961,"score_spread":0.21746710462621688,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4312919289","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.15335539,0.0015048176,0.7893996,0.0018289473,0.00062325597,0.00075978966,0.009527098,0.021079833,0.021921279],"genre_scores_gemma":[0.45465577,0.00055097695,0.5170422,0.00026228835,0.0004707042,0.0003442698,0.01398177,0.00069107994,0.012000914],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9954022,0.0007801433,0.000396789,0.001672942,0.0013735165,0.00037442843],"domain_scores_gemma":[0.9858931,0.004963479,0.0018241743,0.0026062247,0.0042389035,0.00047418496],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0023589928,0.0011037067,0.00085538905,0.01113394,0.0016566962,0.003440709,0.002382576,0.0017662595,0.0024942232],"category_scores_gemma":[0.013994826,0.0004270658,0.00082889776,0.0069805738,0.0008789599,0.0035379685,0.002629287,0.0017137604,0.0038457832],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00014315743,0.0006561258,0.0678793,0.0004264462,0.00012573057,0.0009508856,0.0012873341,0.013934478,0.01651125,0.011058384,0.051862337,0.83516467],"study_design_scores_gemma":[0.000028087392,0.00010419244,0.036357515,0.00010726862,0.00010988901,0.0012884412,0.0020810724,0.8259464,0.024230981,0.028435972,0.081194006,0.00011624073],"about_ca_topic_score_codex":0.006746095,"about_ca_topic_score_gemma":0.011500172,"teacher_disagreement_score":0.01113394,"about_ca_system_score_codex":0.0009159,"about_ca_system_score_gemma":0.0022267925,"threshold_uncertainty_score":0.013413608},"labels":[],"label_agreement":null},{"id":"W4323266498","doi":"10.1142/s0219622023500360","title":"An Entity Extraction and Categorization Technique on Twitter Streams","year":2023,"lang":"en","type":"article","venue":"International Journal of Information Technology & Decision Making","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Athabasca University","funders":"","keywords":"Computer science; Word2vec; Information retrieval; Categorization; Social media; Entity linking; Task (project management); Information extraction; Process (computing); Semantic Web; Annotation; World Wide Web; Knowledge base; Data science; Artificial intelligence","score_opus":0.012003788284921947,"score_gpt":0.32843837913247204,"score_spread":0.3164345908475501,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4323266498","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.17637382,0.0020766987,0.7696031,0.0016137523,0.0011343095,0.001406237,0.01795998,0.013881135,0.015950937],"genre_scores_gemma":[0.38652107,0.0013323437,0.55317444,0.0003000436,0.00056733063,0.00065938785,0.035939284,0.00037007008,0.021136012],"study_design_codex":"design_other","study_design_gemma":"bench_or_experimental","domain_scores_codex":[0.9993174,0.00006834015,0.000077601304,0.00020293698,0.00022041461,0.000113347895],"domain_scores_gemma":[0.9992206,0.00016742044,0.00006235572,0.00010779664,0.00039674912,0.000045068165],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0006067427,0.0010137835,0.00073922134,0.0055781426,0.0014922973,0.0011520211,0.0008963327,0.000983327,0.0032348128],"category_scores_gemma":[0.0020386036,0.00023562685,0.0010071411,0.004630705,0.0002103535,0.0025590772,0.0009843436,0.00078183494,0.0031346898],"study_design_candidate":"bench_or_experimental","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0007929359,0.00039020012,0.011087553,0.00034590426,0.00015171393,0.0015641593,0.0005474846,0.005921174,0.051748466,0.0048913253,0.040108956,0.8824502],"study_design_scores_gemma":[0.0000946656,0.00032107803,0.02712382,0.00010759958,0.00025195093,0.0017777253,0.002336426,0.73354584,0.12212856,0.012745435,0.099394314,0.00017260574],"about_ca_topic_score_codex":0.006926324,"about_ca_topic_score_gemma":0.009668878,"teacher_disagreement_score":0.006926324,"about_ca_system_score_codex":0.00051542924,"about_ca_system_score_gemma":0.00076268986,"threshold_uncertainty_score":0.013772011},"labels":[],"label_agreement":null},{"id":"W4324277966","doi":"10.1177/20539517231163172","title":"All WARC and no playback: The materialities of data-centered web archives research","year":2023,"lang":"en","type":"article","venue":"Big Data & Society","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":10,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"","funders":"Social Sciences and Humanities Research Council of Canada","keywords":"Computer science; Standardization; Metadata; World Wide Web; Interoperability; Data science","score_opus":0.4562295496170037,"score_gpt":0.3975399753386789,"score_spread":0.058689574278324774,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4324277966","genre_codex":"other","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.22705027,0.014574662,0.31220475,0.09902659,0.0024843144,0.0006870534,0.00080318673,0.0010992851,0.3420699],"genre_scores_gemma":[0.91046685,0.0036910314,0.06929074,0.0040805275,0.00081958965,0.0007913467,0.0003103751,0.0008371609,0.009712418],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"qualitative","domain_scores_codex":[0.9553988,0.034436848,0.001434767,0.002764444,0.0050163036,0.00094874017],"domain_scores_gemma":[0.8821685,0.08321582,0.0040052487,0.025175387,0.0037772695,0.0016578914],"candidate_categories":["sts"],"consensus_categories":[],"category_scores_codex":[0.05241829,0.00057468866,0.0006344186,0.008180865,0.011386631,0.033866473,0.0021022963,0.0024137648,0.0058128512],"category_scores_gemma":[0.09719202,0.0010039844,0.00066850765,0.008507095,0.06463737,0.045593932,0.015571055,0.0043868246,0.0008010112],"study_design_candidate":"qualitative","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.000077144505,0.00003400837,0.0023950825,0.00024582897,0.00001535208,0.00024431516,0.12540147,0.00024559206,0.0003756211,0.8171774,0.0028136238,0.05097456],"study_design_scores_gemma":[0.000038118713,0.00010032165,0.0025648405,0.0018585039,0.000040955358,0.00084694725,0.12509146,0.001003284,0.0020078446,0.58479846,0.28156298,0.000086291446],"about_ca_topic_score_codex":0.002334212,"about_ca_topic_score_gemma":0.0028016423,"teacher_disagreement_score":0.98861337,"about_ca_system_score_codex":0.006974788,"about_ca_system_score_gemma":0.0071673817,"threshold_uncertainty_score":0.27721775},"labels":[],"label_agreement":null},{"id":"W4360765061","doi":"10.1109/asonam55673.2022.10068716","title":"Social Network Analysis on Interpretable Compressed Sparse Networks","year":2022,"lang":"en","type":"article","venue":"","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":9,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Manitoba","funders":"Natural Sciences and Engineering Research Council of Canada; University of Manitoba","keywords":"Computer science; Web page; Web mining; Data Web; Web modeling; World Wide Web; Web intelligence; Web development; Web standards; Web mapping; Web navigation; Web analytics; Web search engine; Web crawler; Information retrieval; Social Semantic Web; Web service","score_opus":0.017416709746597724,"score_gpt":0.24952479824174234,"score_spread":0.2321080884951446,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4360765061","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.10899343,0.00054324104,0.8843355,0.0008929,0.0000603238,0.00012112829,0.0017319955,0.0005973634,0.0027241057],"genre_scores_gemma":[0.8244924,0.0010789087,0.16553189,0.00028206763,0.00020147472,0.00036766037,0.004309186,0.00010749766,0.0036289992],"study_design_codex":"simulation_or_modeling","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.9990671,0.00032868105,0.000049370217,0.00019285196,0.00025468552,0.00010732048],"domain_scores_gemma":[0.99473876,0.0035464943,0.00062761945,0.00045561674,0.00047435914,0.00015717337],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0009363297,0.00077344576,0.0007029772,0.0034091156,0.0005002882,0.0009840586,0.001080288,0.00084967987,0.0020221157],"category_scores_gemma":[0.011524689,0.00040186854,0.0007480112,0.0026628787,0.0010205057,0.0030148104,0.0011293832,0.0013167679,0.00033644834],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00032918493,0.00013304681,0.008753804,0.00031432364,0.00013025502,0.0009692178,0.00077064586,0.7088425,0.005219991,0.13782637,0.006280637,0.13043001],"study_design_scores_gemma":[0.000006961273,0.000014290145,0.0009862918,0.000013461939,0.000007476395,0.00006206492,0.000058134592,0.94785494,0.00035969287,0.04968903,0.00094093825,0.0000067406913],"about_ca_topic_score_codex":0.006622899,"about_ca_topic_score_gemma":0.0047626323,"teacher_disagreement_score":0.006622899,"about_ca_system_score_codex":0.0008667268,"about_ca_system_score_gemma":0.00048684693,"threshold_uncertainty_score":0.013168693},"labels":[],"label_agreement":null},{"id":"W4366231507","doi":"10.5281/zenodo.7839032","title":"What Causes Exceptions in Machine Learning Applications? Mining Machine Learning-Related Stack Traces on Stack Overflow","year":2023,"lang":"en","type":"article","venue":"PolyPublie (École Polytechnique de Montréal)","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Polytechnique Montréal","funders":"","keywords":"Stack (abstract data type); Computer science; Call stack; Artificial intelligence; Machine learning; Operating system","score_opus":0.016488836341580434,"score_gpt":0.2529274777351662,"score_spread":0.23643864139358578,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4366231507","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.93528837,0.0011798635,0.05145316,0.0023203497,0.00015424442,0.0001022115,0.0040149996,0.003363116,0.0021237491],"genre_scores_gemma":[0.9727966,0.00041535456,0.021633368,0.00030846757,0.00008416667,0.000047241105,0.0030750094,0.00046073156,0.0011790752],"study_design_codex":"observational","study_design_gemma":"observational","domain_scores_codex":[0.99728084,0.00038416323,0.00029397287,0.0006560492,0.0010005888,0.0003843512],"domain_scores_gemma":[0.9680035,0.019435281,0.004367719,0.003420729,0.0036516304,0.0011210883],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0023783138,0.0006719771,0.00063944916,0.003479196,0.0011091639,0.002347726,0.0009266351,0.0013018649,0.0010307957],"category_scores_gemma":[0.03853538,0.00052169646,0.00083020324,0.0029862714,0.0010823178,0.0043425635,0.0011050286,0.0019168295,0.00039746083],"study_design_candidate":"observational","study_design_consensus":"observational","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0007081561,0.0004922759,0.7038518,0.0005193751,0.00022586837,0.0023435235,0.001949821,0.018785588,0.016084533,0.007550722,0.01227867,0.23520963],"study_design_scores_gemma":[0.00006576742,0.0004132834,0.33486727,0.00058749807,0.00040374722,0.002863305,0.0039088544,0.52048606,0.05357094,0.0646451,0.017996956,0.0001912423],"about_ca_topic_score_codex":0.009873178,"about_ca_topic_score_gemma":0.014010667,"teacher_disagreement_score":0.009873178,"about_ca_system_score_codex":0.000970459,"about_ca_system_score_gemma":0.0027194626,"threshold_uncertainty_score":0.019631445},"labels":[],"label_agreement":null},{"id":"W4366967382","doi":"10.1109/wi-iat55865.2022.00097","title":"Web Mining from Interpretable Compressed Representation of Sparse Web","year":2022,"lang":"en","type":"article","venue":"","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":1,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Manitoba","funders":"Natural Sciences and Engineering Research Council of Canada; University of Manitoba","keywords":"Computer science; Web page; Web mining; Data Web; Web modeling; Information retrieval; Web intelligence; Web mapping; Bitmap; World Wide Web; Data mining; Web navigation; Artificial intelligence","score_opus":0.028984931745447234,"score_gpt":0.2614506699920739,"score_spread":0.23246573824662667,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4366967382","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.1294305,0.0007464731,0.85811967,0.001039531,0.00008354877,0.00017027897,0.0046768705,0.0028500117,0.0028831668],"genre_scores_gemma":[0.61939234,0.0011132029,0.36243725,0.00029739956,0.00017613152,0.00037255514,0.013704721,0.00025747487,0.002249046],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9994641,0.00010343144,0.000046265828,0.00009792626,0.0002108742,0.0000774512],"domain_scores_gemma":[0.99752146,0.001235452,0.00026811985,0.0004842293,0.0004265918,0.00006409306],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.00057526823,0.0006023449,0.00066295045,0.00321469,0.00035885273,0.0012612891,0.0006888181,0.00072955614,0.001277761],"category_scores_gemma":[0.005793742,0.00030845156,0.000521925,0.0032757246,0.0006196783,0.002032864,0.0011481111,0.0010160649,0.0007940018],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.000981993,0.0003796851,0.012881795,0.00076328946,0.00013348414,0.0023132574,0.00072227075,0.20205449,0.04839127,0.048227455,0.022910222,0.6602408],"study_design_scores_gemma":[0.000021156187,0.000059998434,0.0024288585,0.00004283971,0.000017818526,0.0004382128,0.0002276193,0.9249621,0.0072458815,0.060638405,0.003899449,0.000017694807],"about_ca_topic_score_codex":0.0017196154,"about_ca_topic_score_gemma":0.0019404967,"teacher_disagreement_score":0.00321469,"about_ca_system_score_codex":0.00036056907,"about_ca_system_score_gemma":0.0006059674,"threshold_uncertainty_score":0.0042746067},"labels":[],"label_agreement":null},{"id":"W4367310562","doi":"10.1145/3543873.3587331","title":"The Web Data Commons Schema.org Data Set Series","year":2023,"lang":"en","type":"article","venue":"","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":9,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"","funders":"University of Massachusetts Amherst; Singapore Management University; National Cheng Kung University; Korea Advanced Institute of Science and Technology; Universität des Saarlandes; Centre National de la Recherche Scientifique; Carnegie Mellon University; Central European University; RMIT University; Tsinghua University; Linköpings Universitet; University of Technology Sydney; University of Illinois at Urbana-Champaign; National Taiwan University; University of South Carolina; Universität Passau; University of Glasgow; York University; Università della Calabria; Tongji University; Harvard University; Syracuse University; University of Connecticut; City University of Hong Kong; Hong Kong Polytechnic University; University of Sydney; Pennsylvania State University; Emory University","keywords":"Computer science; Information retrieval; World Wide Web; Schema (genetic algorithms); Conceptual schema; Commons","score_opus":0.20564505790972812,"score_gpt":0.35010118439137144,"score_spread":0.14445612648164333,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4367310562","genre_codex":"dataset","genre_gemma":"dataset","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"dataset","genre_consensus":"dataset","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0035000676,0.0003009172,0.0025777956,0.0005966764,0.00016266304,0.00015678983,0.9829941,0.003768702,0.005942269],"genre_scores_gemma":[0.0022168406,0.00014860732,0.002243168,0.00013993637,0.000011955171,0.00011864789,0.9940253,0.00032187253,0.00077364454],"study_design_codex":"not_applicable","study_design_gemma":"not_applicable","domain_scores_codex":[0.9960247,0.00064185605,0.0006403972,0.00046900185,0.002003977,0.00022009561],"domain_scores_gemma":[0.986878,0.0032106156,0.0011856246,0.002903555,0.0049736663,0.0008485079],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0033383202,0.0013183163,0.0009158424,0.008178657,0.0009900357,0.0025856467,0.0015856163,0.0017407127,0.01131497],"category_scores_gemma":[0.01711859,0.0006406814,0.0010011152,0.011040498,0.00074973615,0.0034580575,0.002510612,0.0027233618,0.016361548],"study_design_candidate":"not_applicable","study_design_consensus":"not_applicable","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00024091208,0.00016730947,0.007239013,0.0014795321,0.00011051553,0.00023231897,0.00029017532,0.0012684923,0.002603043,0.006904472,0.95640236,0.02306188],"study_design_scores_gemma":[0.00005726546,0.000034896213,0.010009478,0.0002963684,0.000027142592,0.00021552235,0.00027679716,0.0014939836,0.0028615943,0.002640363,0.98203206,0.000054599226],"about_ca_topic_score_codex":0.027331179,"about_ca_topic_score_gemma":0.03748068,"teacher_disagreement_score":0.027331179,"about_ca_system_score_codex":0.0017722886,"about_ca_system_score_gemma":0.0032073199,"threshold_uncertainty_score":0.054344177},"labels":[],"label_agreement":null},{"id":"W4367310939","doi":"10.1145/3543873.3587671","title":"Gone, Gone, but Not Really, and Gone, But Not forgotten: A Typology of Website Recoverability","year":2023,"lang":"en","type":"article","venue":"","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":1,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Alberta","funders":"","keywords":"Web page; Computer science; Crawling; World Wide Web; Web content; Content analysis; Web crawler; Typology; Content (measure theory); Information retrieval; History; Mathematics","score_opus":0.025598906889763906,"score_gpt":0.2598745866211452,"score_spread":0.2342756797313813,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4367310939","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.9523955,0.0005838737,0.028636178,0.0013703046,0.000030572788,0.00016586973,0.00045797272,0.00037872777,0.015981145],"genre_scores_gemma":[0.9931306,0.00015508196,0.00508253,0.00008317096,0.0000146450975,0.00006655048,0.00027652175,0.00011272719,0.0010781095],"study_design_codex":"qualitative","study_design_gemma":"not_applicable","domain_scores_codex":[0.992945,0.002508447,0.0005526077,0.0007770984,0.0025570507,0.0006596193],"domain_scores_gemma":[0.954055,0.028888078,0.006653038,0.0057872203,0.0035547456,0.0010619308],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.00614721,0.00039179536,0.00033505357,0.008271282,0.0025864618,0.0037349695,0.0013881577,0.0011872443,0.0015418013],"category_scores_gemma":[0.03745092,0.00029528182,0.00064478925,0.004587821,0.008862077,0.007939132,0.0040785354,0.0016081616,0.00019506425],"study_design_candidate":"not_applicable","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0003826149,0.00017963619,0.27400997,0.0009457644,0.00021556702,0.002841653,0.5055291,0.0034262808,0.014261112,0.05563189,0.0051713106,0.13740516],"study_design_scores_gemma":[0.000028963103,0.00033253772,0.2933046,0.0008613144,0.0001269499,0.0048542526,0.5548412,0.012410684,0.0076547195,0.056896728,0.06835368,0.00033434376],"about_ca_topic_score_codex":0.005627452,"about_ca_topic_score_gemma":0.0043748096,"teacher_disagreement_score":0.008271282,"about_ca_system_score_codex":0.001885279,"about_ca_system_score_gemma":0.0011115654,"threshold_uncertainty_score":0.032509923},"labels":[],"label_agreement":null},{"id":"W4367840001","doi":"10.32920/22748633","title":"The Local News Map: Tell us what is happening to local news in your community","year":2023,"lang":"en","type":"preprint","venue":"","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":true,"ca_institutions":"","funders":"","keywords":"Newspaper; Closing (real estate); Happening; Service (business); News bureau; Advertising; Political science; History; Media studies; Geography; Business; Sociology; Law; Marketing","score_opus":0.07500799991922757,"score_gpt":0.31023167166605414,"score_spread":0.23522367174682657,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4367840001","genre_codex":"dataset","genre_gemma":"other","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"other","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.01779344,0.0018562556,0.008686842,0.015869493,0.0013058571,0.00031978157,0.70134515,0.017384702,0.2354385],"genre_scores_gemma":[0.12056289,0.0049262824,0.050647035,0.0028913664,0.00092975266,0.0008027327,0.6050401,0.008143636,0.2060562],"study_design_codex":"not_applicable","study_design_gemma":"not_applicable","domain_scores_codex":[0.9994904,0.000063590014,0.000021717959,0.000086422064,0.00024768073,0.00009022419],"domain_scores_gemma":[0.99601525,0.00063439424,0.0002499687,0.0004671531,0.0016901466,0.0009430337],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0008452777,0.000645852,0.00033496125,0.0047070165,0.0020850056,0.005346881,0.0007209761,0.00094340526,0.08565556],"category_scores_gemma":[0.0079478305,0.0004916869,0.00032203348,0.010249216,0.0006020482,0.00403525,0.0022499915,0.0012288884,0.057037212],"study_design_candidate":"not_applicable","study_design_consensus":"not_applicable","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00003379992,0.000014002217,0.003739293,0.00016281015,0.000010666037,0.000062299565,0.0009965696,0.00012080645,0.00017929812,0.0009755678,0.9608687,0.03283611],"study_design_scores_gemma":[0.000018282877,0.000010724196,0.01573375,0.00014724318,0.000017936267,0.00005537693,0.0036741178,0.0005712201,0.0005654775,0.0017064448,0.9774635,0.000036033493],"about_ca_topic_score_codex":0.24596244,"about_ca_topic_score_gemma":0.4243644,"teacher_disagreement_score":0.24596244,"about_ca_system_score_codex":0.0018270828,"about_ca_system_score_gemma":0.00349659,"threshold_uncertainty_score":0.48906153},"labels":[],"label_agreement":null},{"id":"W4367840002","doi":"10.32920/22748633.v1","title":"The Local News Map: Tell us what is happening to local news in your community","year":2023,"lang":"en","type":"preprint","venue":"","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":true,"ca_institutions":"","funders":"","keywords":"Newspaper; Closing (real estate); Happening; Service (business); News bureau; Local history; Local community; Advertising; Political science; History; Media studies; Geography; Business; Sociology; Law; Marketing","score_opus":0.07500799991922757,"score_gpt":0.31023167166605414,"score_spread":0.23522367174682657,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4367840002","genre_codex":"dataset","genre_gemma":"other","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"other","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.01779344,0.0018562556,0.008686842,0.015869493,0.0013058571,0.00031978157,0.70134515,0.017384702,0.2354385],"genre_scores_gemma":[0.12056289,0.0049262824,0.050647035,0.0028913664,0.00092975266,0.0008027327,0.6050401,0.008143636,0.2060562],"study_design_codex":"not_applicable","study_design_gemma":"not_applicable","domain_scores_codex":[0.9994904,0.000063590014,0.000021717959,0.000086422064,0.00024768073,0.00009022419],"domain_scores_gemma":[0.99601525,0.00063439424,0.0002499687,0.0004671531,0.0016901466,0.0009430337],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0008452777,0.000645852,0.00033496125,0.0047070165,0.0020850056,0.005346881,0.0007209761,0.00094340526,0.08565556],"category_scores_gemma":[0.0079478305,0.0004916869,0.00032203348,0.010249216,0.0006020482,0.00403525,0.0022499915,0.0012288884,0.057037212],"study_design_candidate":"not_applicable","study_design_consensus":"not_applicable","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00003379992,0.000014002217,0.003739293,0.00016281015,0.000010666037,0.000062299565,0.0009965696,0.00012080645,0.00017929812,0.0009755678,0.9608687,0.03283611],"study_design_scores_gemma":[0.000018282877,0.000010724196,0.01573375,0.00014724318,0.000017936267,0.00005537693,0.0036741178,0.0005712201,0.0005654775,0.0017064448,0.9774635,0.000036033493],"about_ca_topic_score_codex":0.24596244,"about_ca_topic_score_gemma":0.4243644,"teacher_disagreement_score":0.24596244,"about_ca_system_score_codex":0.0018270828,"about_ca_system_score_gemma":0.00349659,"threshold_uncertainty_score":0.48906153},"labels":[],"label_agreement":null},{"id":"W4385285635","doi":"10.1109/icde55515.2023.00367","title":"HyperMinHash: MinHash in LogLog Space (Extended Abstract)","year":2023,"lang":"en","type":"article","venue":"","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Toronto","funders":"","keywords":"Computer science; Space (punctuation); Operating system","score_opus":0.024807512853394907,"score_gpt":0.2683701622410557,"score_spread":0.24356264938766078,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4385285635","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.013957239,0.0010250463,0.9558577,0.00085434667,0.00044337552,0.00019286785,0.001798449,0.017344547,0.0085265],"genre_scores_gemma":[0.25928053,0.00094988476,0.7124198,0.0012229701,0.00056373834,0.0006884776,0.0042677056,0.0036252635,0.01698163],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9980782,0.0003161358,0.0001505411,0.00028259316,0.0010124221,0.00016016033],"domain_scores_gemma":[0.9951048,0.0015805697,0.00022800232,0.0021976603,0.0007196919,0.0001692575],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0015442439,0.0009448535,0.0007995687,0.0011048912,0.0006092637,0.0029552393,0.0021259463,0.0010317409,0.028811688],"category_scores_gemma":[0.011216989,0.000626753,0.00075966155,0.0021389388,0.0015322026,0.0069071506,0.0030781648,0.0019663563,0.009032013],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0015242058,0.00019631794,0.001687883,0.0008150456,0.000074315525,0.0003334279,0.00056342693,0.046982437,0.021245765,0.20367147,0.080784075,0.6421215],"study_design_scores_gemma":[0.00023855014,0.00034859194,0.0008850994,0.00016522822,0.00003926903,0.00064264267,0.00020307687,0.5396723,0.0414966,0.3158114,0.10038961,0.000107710635],"about_ca_topic_score_codex":0.0013753513,"about_ca_topic_score_gemma":0.0018193782,"teacher_disagreement_score":0.028811688,"about_ca_system_score_codex":0.0013137882,"about_ca_system_score_gemma":0.001463202,"threshold_uncertainty_score":0.096384704},"labels":[],"label_agreement":null},{"id":"W4385653228","doi":"10.14778/3603581.3603585","title":"Autonomously Computable Information Extraction","year":2023,"lang":"en","type":"article","venue":"Proceedings of the VLDB Endowment","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":2,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Waterloo","funders":"","keywords":"Computer science; Information extraction; Perspective (graphical); Mechanism (biology); Data mining; Relation (database); Information retrieval; Artificial intelligence","score_opus":0.01020545676619336,"score_gpt":0.2254807868001845,"score_spread":0.21527533003399113,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4385653228","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.022067048,0.00018989149,0.9630607,0.0005309041,0.000046322155,0.00012506983,0.0003238888,0.009787342,0.0038688686],"genre_scores_gemma":[0.4180244,0.00025230797,0.5742159,0.0002919889,0.0000878605,0.00028546675,0.0010850374,0.0011086226,0.004648423],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9949886,0.0010824332,0.00041174606,0.0013559299,0.0017831115,0.00037823588],"domain_scores_gemma":[0.9858596,0.006676912,0.0009419799,0.005231976,0.0011421874,0.00014738696],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0024192065,0.0009100305,0.0010972396,0.0013451248,0.0010912364,0.0035933005,0.0024823877,0.0013044438,0.00465021],"category_scores_gemma":[0.020023579,0.0011004866,0.0012502951,0.0015832018,0.0026284943,0.0076741492,0.004436542,0.0019783436,0.0016779604],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0007784635,0.00023832354,0.0057284064,0.0008185203,0.00019296411,0.00043410802,0.0008626973,0.12629344,0.05275756,0.2993072,0.012342173,0.5002461],"study_design_scores_gemma":[0.00008694655,0.000097591015,0.0009903444,0.00006422737,0.00009916662,0.0002519953,0.00011475718,0.643613,0.060714673,0.2737583,0.0201339,0.00007520321],"about_ca_topic_score_codex":0.0023150225,"about_ca_topic_score_gemma":0.003073125,"teacher_disagreement_score":0.00465021,"about_ca_system_score_codex":0.0013805572,"about_ca_system_score_gemma":0.0028322695,"threshold_uncertainty_score":0.015556514},"labels":[],"label_agreement":null},{"id":"W4385688709","doi":"10.1145/3578337.3605115","title":"A is for Adele: An Offline Evaluation Metric for Instant Search","year":2023,"lang":"en","type":"article","venue":"","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":7,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Waterloo","funders":"","keywords":"Instant; Computer science; Metric (unit); Instant messaging; Search engine; Information retrieval; Key (lock); Search problem; Incremental heuristic search; Beam search; Search algorithm; World Wide Web; Computer security; Engineering","score_opus":0.22375189650027025,"score_gpt":0.4305085783964246,"score_spread":0.20675668189615434,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4385688709","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.49169496,0.015581924,0.38884157,0.0019635952,0.0012483442,0.0031323223,0.009110703,0.009042278,0.079384334],"genre_scores_gemma":[0.86291075,0.0008498278,0.1263512,0.00026442585,0.0002157473,0.0008490844,0.003782244,0.0005198357,0.0042569283],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9792188,0.007213732,0.0023232654,0.0013277951,0.00920873,0.0007076585],"domain_scores_gemma":[0.9220666,0.04768605,0.006034245,0.0070728105,0.014833308,0.0023069356],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.009113801,0.0015289431,0.0015578395,0.006610231,0.0009213239,0.0032894476,0.0015102682,0.0018850907,0.0029268432],"category_scores_gemma":[0.06500841,0.0002547656,0.0006699526,0.0040618367,0.00084427226,0.0066912984,0.0017140247,0.0013883739,0.0016578631],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.004397969,0.0021612032,0.05393954,0.00400606,0.0008184981,0.0004284713,0.0013758735,0.053586468,0.035677318,0.02428066,0.037141543,0.7821864],"study_design_scores_gemma":[0.0005555072,0.009791954,0.071372025,0.00081573054,0.0007018326,0.002468703,0.0020638101,0.7868542,0.045240507,0.026400637,0.053120457,0.0006146682],"about_ca_topic_score_codex":0.0031438938,"about_ca_topic_score_gemma":0.0034540028,"teacher_disagreement_score":0.009113801,"about_ca_system_score_codex":0.0014815828,"about_ca_system_score_gemma":0.0016166676,"threshold_uncertainty_score":0.048198998},"labels":[],"label_agreement":null},{"id":"W4386070844","doi":"10.11159/mvml23.108","title":"NLP-based Traffic Scene Retrieval via Representation Learning","year":2023,"lang":"en","type":"article","venue":"Proceedings of the World Congress on Electrical Engineering and Computer Systems and Science","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":2,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":true,"route_about_ca":false,"ca_institutions":"","funders":"","keywords":"Computer science; Artificial intelligence; Natural language processing; Representation (politics); Feature learning; Information retrieval; Pattern recognition (psychology)","score_opus":0.010131675750858422,"score_gpt":0.22270165729548705,"score_spread":0.21256998154462864,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4386070844","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.08393517,0.0040427325,0.7977954,0.0012204055,0.0005639781,0.00080235006,0.018779084,0.07696337,0.015897596],"genre_scores_gemma":[0.36487898,0.0023253472,0.4945196,0.0010308869,0.00055612205,0.00061402976,0.11961848,0.0010666108,0.015389986],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9992281,0.00009708523,0.00004738718,0.00029874768,0.00020372181,0.00012495293],"domain_scores_gemma":[0.9995921,0.00009021453,0.000042292944,0.0001467136,0.000107607215,0.000021022557],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0004550317,0.0018686071,0.00129418,0.004572705,0.0006341324,0.0013367911,0.0018661221,0.0014232539,0.0065234727],"category_scores_gemma":[0.0017376058,0.0003967828,0.0016817685,0.0038861614,0.00050644524,0.00432751,0.0014794742,0.001236691,0.0067584296],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00036436826,0.0004933709,0.000878695,0.00043100343,0.00010136052,0.00030122916,0.00012705845,0.03311687,0.022497818,0.00611544,0.088712566,0.84686023],"study_design_scores_gemma":[0.00012752684,0.00024399922,0.0017738976,0.00004944708,0.000117347525,0.0005564282,0.00036448464,0.9094955,0.028402202,0.022040613,0.036745556,0.00008306985],"about_ca_topic_score_codex":0.010424622,"about_ca_topic_score_gemma":0.009919775,"teacher_disagreement_score":0.010424622,"about_ca_system_score_codex":0.0011557977,"about_ca_system_score_gemma":0.0012319408,"threshold_uncertainty_score":0.021823168},"labels":[],"label_agreement":null},{"id":"W4386234647","doi":"10.1007/978-3-031-43088-6","title":"Web Information Systems and Technologies","year":2023,"lang":"en","type":"book","venue":"Lecture notes in business information processing","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":3,"is_retracted":false,"has_abstract":false,"route_ca_aff":false,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"","funders":"University of West Attica; Universidad de Valladolid; RWTH Aachen University; Trakya Üniversitesi; University of South Australia; Universidad Carlos III de Madrid; Università di Bologna; Dalhousie University; Tallinna Tehnikaülikool; Libera Università di Bolzano; Jyväskylän Yliopisto; University of New England; Università degli Studi di Torino; Lviv Polytechnic National University; Northumbria University","keywords":"Focus (optics); Computer science; World Wide Web; Web intelligence; Web application; Data science; Web development; The Internet","score_opus":0.011387771333481886,"score_gpt":0.22517500738543672,"score_spread":0.21378723605195482,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4386234647","genre_codex":"other","genre_gemma":"other","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"other","genre_consensus":"other","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0027146882,0.10294292,0.06400387,0.0045687375,0.004703863,0.00018890947,0.0011999329,0.0027283495,0.8169488],"genre_scores_gemma":[0.012326777,0.06279939,0.026133046,0.0015499657,0.0018757911,0.00016772369,0.0024469083,0.0010441939,0.8916563],"study_design_codex":"design_other","study_design_gemma":"not_applicable","domain_scores_codex":[0.99944943,0.00006012119,0.000028276867,0.000059660604,0.00036727398,0.000035230216],"domain_scores_gemma":[0.9996513,0.00012604722,0.00001690875,0.0000808694,0.00008743876,0.00003740271],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0004477602,0.0011104366,0.0008224922,0.0038430076,0.0006158885,0.0045084376,0.0006506702,0.0009994297,0.04297162],"category_scores_gemma":[0.0011689088,0.000748484,0.00038056145,0.006974243,0.0007637991,0.0068962644,0.001597971,0.001831756,0.039996777],"study_design_candidate":"not_applicable","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.000017075223,0.00007664745,0.00020255266,0.0004563359,0.000026881293,0.00008942239,0.00021780774,0.00060926215,0.0022544714,0.083048336,0.3517442,0.56125706],"study_design_scores_gemma":[0.0000042557763,0.000014913082,0.0005059116,0.00022221963,0.000011940016,0.00021646127,0.00006574879,0.00087856175,0.00053646514,0.046377238,0.9511576,0.000008633005],"about_ca_topic_score_codex":0.0014215519,"about_ca_topic_score_gemma":0.0025451027,"teacher_disagreement_score":0.04297162,"about_ca_system_score_codex":0.0009213103,"about_ca_system_score_gemma":0.0010209384,"threshold_uncertainty_score":0.14375436},"labels":[],"label_agreement":null},{"id":"W4386328151","doi":"10.1108/jd-04-2023-0070","title":"Does a name make a difference? The neo-documentalist movement, where does it stand after 27 years 1996–2023","year":2023,"lang":"en","type":"article","venue":"Journal of Documentation","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"","funders":"University of Toronto; Fordham University","keywords":"Documentation; Originality; Value (mathematics); Object (grammar); Field (mathematics); Sociology; Movement (music); Perspective (graphical); Epistemology; Library science; Social science; Linguistics; Computer science; Qualitative research; Aesthetics; Art","score_opus":0.010093619589559627,"score_gpt":0.27342350706276936,"score_spread":0.26332988747320973,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4386328151","genre_codex":"commentary","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.10742672,0.12548509,0.0067385766,0.4512551,0.00921231,0.000056013945,0.00026724208,0.00008880956,0.2994701],"genre_scores_gemma":[0.8767225,0.02899732,0.004100511,0.019582547,0.0019397502,0.00013983046,0.00023291734,0.0003307463,0.06795377],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"not_applicable","domain_scores_codex":[0.97189057,0.013616738,0.002048641,0.0032134645,0.0073688226,0.0018618495],"domain_scores_gemma":[0.9666859,0.019288879,0.004242562,0.0025660074,0.0054859156,0.001730781],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.033235755,0.00038306604,0.0006512834,0.0028345964,0.01060474,0.01779873,0.0018239408,0.004214087,0.004662765],"category_scores_gemma":[0.045854505,0.00037734082,0.0005331712,0.0057459,0.030421054,0.017382422,0.007357731,0.008137269,0.0010688691],"study_design_candidate":"not_applicable","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00011602544,0.000023794875,0.0024625985,0.00041824704,0.000012738181,0.00045007642,0.13716912,0.0001398812,0.00034368547,0.7622936,0.026182495,0.070387766],"study_design_scores_gemma":[0.000010897705,0.000033641616,0.0037970603,0.0017275965,0.000011636246,0.00034633628,0.050021015,0.00006829994,0.0004591999,0.025461607,0.91802865,0.00003403174],"about_ca_topic_score_codex":0.033286605,"about_ca_topic_score_gemma":0.023715517,"teacher_disagreement_score":0.035127684,"about_ca_system_score_codex":0.035127684,"about_ca_system_score_gemma":0.02309219,"threshold_uncertainty_score":0.25487036},"labels":[],"label_agreement":null},{"id":"W4386768554","doi":"10.14778/3611540.3611616","title":"Web Connector: A Unified API Wrapper to Simplify Web Data Collection","year":2023,"lang":"en","type":"article","venue":"Proceedings of the VLDB Endowment","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":1,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Simon Fraser University","funders":"","keywords":"Computer science; Application programming interface; World Wide Web; Web API; Web application; Web service; Database; Web development; Operating system","score_opus":0.04619606448523445,"score_gpt":0.2756170296515338,"score_spread":0.22942096516629934,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4386768554","genre_codex":"methods","genre_gemma":"software","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"software","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0036689525,0.0001414673,0.6587129,0.00035904185,0.00029935208,0.00079108245,0.001881705,0.327244,0.006901391],"genre_scores_gemma":[0.05508042,0.00066712376,0.7397883,0.0028576101,0.0004815099,0.0030608934,0.023047075,0.1416182,0.03339893],"study_design_codex":"not_applicable","study_design_gemma":"not_applicable","domain_scores_codex":[0.9946274,0.0009091798,0.0007839623,0.00078288716,0.0023412784,0.00055531424],"domain_scores_gemma":[0.9868023,0.0033224868,0.0007123409,0.005117121,0.003040759,0.0010050375],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0068174587,0.0026232954,0.0012840482,0.0037967132,0.0011092902,0.004641606,0.0036728212,0.0019763845,0.016288437],"category_scores_gemma":[0.016736893,0.0022544144,0.0024194815,0.0025198562,0.0011514988,0.007701629,0.007230097,0.0047175293,0.021009117],"study_design_candidate":"not_applicable","study_design_consensus":"not_applicable","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.001504418,0.0010153679,0.006792056,0.0010728298,0.00033697023,0.0031944867,0.0018796978,0.005473885,0.06112909,0.039491802,0.49177197,0.3863374],"study_design_scores_gemma":[0.00039103904,0.00033837865,0.0047713104,0.0003673952,0.00019052596,0.0024603314,0.000278532,0.09699093,0.11648856,0.022537645,0.7546852,0.0005001139],"about_ca_topic_score_codex":0.0023852808,"about_ca_topic_score_gemma":0.0021342074,"teacher_disagreement_score":0.016288437,"about_ca_system_score_codex":0.00080503966,"about_ca_system_score_gemma":0.002595412,"threshold_uncertainty_score":0.05449021},"labels":[],"label_agreement":null},{"id":"W4386802863","doi":"10.1080/24701475.2023.2258697","title":"Sorting URLs out: seeing the web through infrastructural inversion of archival crawling","year":2023,"lang":"en","type":"article","venue":"Internet Histories","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":9,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"","funders":"Social Sciences and Humanities Research Council of Canada","keywords":"Crawling; World Wide Web; Sorting; Computer science; Web crawler; Biology; Algorithm; Anatomy","score_opus":0.027721488948929736,"score_gpt":0.25903134692848073,"score_spread":0.231309857979551,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4386802863","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.80706596,0.0028702256,0.065639935,0.008410998,0.00009421474,0.000112304704,0.00028121396,0.00037543732,0.11514982],"genre_scores_gemma":[0.9840793,0.00053906866,0.012119066,0.00022089834,0.000020070818,0.000047008874,0.00007062025,0.00014760075,0.0027563488],"study_design_codex":"qualitative","study_design_gemma":"qualitative","domain_scores_codex":[0.9950348,0.003164031,0.00019351619,0.00048034271,0.00065828045,0.00046905634],"domain_scores_gemma":[0.9868233,0.009333084,0.0010514425,0.0016410735,0.0007487473,0.00040228374],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.006978214,0.00041622936,0.00047204134,0.006793641,0.0074844654,0.015795046,0.0013567229,0.0016278846,0.002671913],"category_scores_gemma":[0.015685603,0.0006126156,0.000373005,0.005526929,0.02020105,0.01615783,0.009871802,0.0028213514,0.0005488655],"study_design_candidate":"qualitative","study_design_consensus":"qualitative","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00007075501,0.000027298525,0.014430684,0.0001582465,0.000014579025,0.00078078854,0.85616684,0.0002786176,0.002359174,0.09026129,0.0011402607,0.034311462],"study_design_scores_gemma":[0.000013047998,0.000041387517,0.017512362,0.0004413681,0.000055088047,0.0011905449,0.7775674,0.002697718,0.0038721843,0.09618125,0.100365676,0.00006203689],"about_ca_topic_score_codex":0.012356114,"about_ca_topic_score_gemma":0.020931372,"teacher_disagreement_score":0.015795046,"about_ca_system_score_codex":0.0048998506,"about_ca_system_score_gemma":0.0032390794,"threshold_uncertainty_score":0.036904752},"labels":[],"label_agreement":null},{"id":"W4387299697","doi":"10.1109/jcdl57899.2023.00074","title":"Web Archiving and Digital Libraries (WADL) 2023","year":2023,"lang":"en","type":"article","venue":"","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":1,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Alberta","funders":"Social Sciences and Humanities Research Council of Canada; University of Alberta; Old Dominion University; University of North Texas; Drexel University; Institute of Museum and Library Services","keywords":"Computer science; Web application; World Wide Web; Digital library; Multimedia","score_opus":0.015560432811391868,"score_gpt":0.2149464964970147,"score_spread":0.19938606368562284,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4387299697","genre_codex":"other","genre_gemma":"other","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"other","genre_consensus":"other","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.009227045,0.03848087,0.16398369,0.118301205,0.09154289,0.0035924206,0.016951783,0.0252058,0.53271425],"genre_scores_gemma":[0.013348482,0.014367593,0.062805526,0.031910542,0.0074637323,0.0014146152,0.02267473,0.0059806765,0.84003407],"study_design_codex":"not_applicable","study_design_gemma":"not_applicable","domain_scores_codex":[0.99369144,0.00080569705,0.00049832335,0.00039248026,0.003884405,0.00072752894],"domain_scores_gemma":[0.98898166,0.0017099683,0.00054437004,0.0014626448,0.0044788313,0.0028224892],"candidate_categories":["scholarly_communication"],"consensus_categories":[],"category_scores_codex":[0.011652451,0.0012132631,0.0007583538,0.004115447,0.0023794454,0.01455661,0.0029541813,0.008906285,0.040084522],"category_scores_gemma":[0.013203858,0.0009673955,0.0011883022,0.0032294225,0.0020654122,0.007595083,0.007964997,0.0072344826,0.049775504],"study_design_candidate":"not_applicable","study_design_consensus":"not_applicable","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.000108801556,0.00014843921,0.00033423453,0.00034721068,0.000016318747,0.00014577374,0.00023573301,0.00036438624,0.0031718186,0.0216937,0.8209164,0.15251727],"study_design_scores_gemma":[0.000007833764,0.000015809628,0.00026732258,0.00014265622,0.0000031083034,0.000057043802,0.00004535264,0.00022802773,0.0010495809,0.0022201284,0.995943,0.00001999083],"about_ca_topic_score_codex":0.016894389,"about_ca_topic_score_gemma":0.020964142,"teacher_disagreement_score":0.9854434,"about_ca_system_score_codex":0.0041549117,"about_ca_system_score_gemma":0.011052635,"threshold_uncertainty_score":0.13409603},"labels":[],"label_agreement":null},{"id":"W4387846449","doi":"10.1145/3583780.3615129","title":"RePair: An Extensible Toolkit to Generate Large-Scale Datasets for Query Refinement via Transformers","year":2023,"lang":"en","type":"article","venue":"","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":2,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Windsor","funders":"","keywords":"Computer science; Information retrieval; Benchmark (surveying); Query expansion; Metric (unit); Relevance (law); Extensibility; Transformer; Data mining; Web search query; Query optimization; Context (archaeology); Ranking (information retrieval); Search engine; Programming language","score_opus":0.02939475885107794,"score_gpt":0.297565424999566,"score_spread":0.26817066614848806,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4387846449","genre_codex":"software","genre_gemma":"software","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"software","genre_consensus":"software","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.01565985,0.0016342815,0.21728584,0.00069389725,0.00045737487,0.0016428141,0.18045637,0.5769536,0.0052160104],"genre_scores_gemma":[0.07221909,0.0007539636,0.3220377,0.0008494099,0.000104468396,0.0036680219,0.5727466,0.024129193,0.003491576],"study_design_codex":"not_applicable","study_design_gemma":"not_applicable","domain_scores_codex":[0.99211687,0.0019332104,0.0012754657,0.001994716,0.002235037,0.00044470283],"domain_scores_gemma":[0.98585224,0.0047312574,0.0005914227,0.0062100817,0.002049548,0.0005654816],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.006926108,0.0038470344,0.0017894326,0.005945853,0.0012267961,0.003658906,0.005887931,0.001953917,0.010017835],"category_scores_gemma":[0.03781478,0.0016552827,0.0035836909,0.006000182,0.0014026453,0.0067491313,0.008126258,0.003652839,0.017068846],"study_design_candidate":"not_applicable","study_design_consensus":"not_applicable","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0023380413,0.00072970655,0.011881228,0.005037324,0.00095235184,0.00071146264,0.00123789,0.030638294,0.022363288,0.011590222,0.6661515,0.24636872],"study_design_scores_gemma":[0.002259939,0.0010891961,0.015280442,0.00051532034,0.00032236162,0.0016057501,0.0013282113,0.43796426,0.06863381,0.066610396,0.4036944,0.0006959064],"about_ca_topic_score_codex":0.010875555,"about_ca_topic_score_gemma":0.019372862,"teacher_disagreement_score":0.010875555,"about_ca_system_score_codex":0.0015987769,"about_ca_system_score_gemma":0.003250124,"threshold_uncertainty_score":0.0366292},"labels":[],"label_agreement":null},{"id":"W4387967031","doi":"","title":"A Cosine Maximization-Minimization approach for UserOriented Multi-Document Update Summarization","year":2007,"lang":"en","type":"preprint","venue":"PolyPublie (École Polytechnique de Montréal)","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Polytechnique Montréal","funders":"","keywords":"Automatic summarization; Computer science; Minification; Maximization; Information retrieval; Programming language; Mathematical optimization; Mathematics","score_opus":0.018688584141445575,"score_gpt":0.255964727084503,"score_spread":0.23727614294305743,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4387967031","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0038145755,0.0003880678,0.9937744,0.00008997287,0.00003374871,0.00009384669,0.00009409449,0.0011978612,0.0005133838],"genre_scores_gemma":[0.053300202,0.00027599942,0.9425086,0.000080079095,0.00013784089,0.0002009149,0.000638925,0.00034823312,0.0025091958],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.99732435,0.00083858345,0.000289448,0.0005018892,0.0009711179,0.00007451292],"domain_scores_gemma":[0.9972371,0.00097164104,0.00026334298,0.00035132727,0.001090501,0.00008605734],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0031674677,0.0010811584,0.0013624124,0.0022462788,0.0007079604,0.001267659,0.0015486225,0.0008308047,0.0020837204],"category_scores_gemma":[0.005579597,0.00047425603,0.00086942327,0.0020946616,0.00046659823,0.0018929536,0.0010256032,0.001143839,0.001665713],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00041756054,0.00020432477,0.0009864941,0.0005348826,0.00019217431,0.00011348214,0.00044375536,0.01919931,0.07636648,0.009780684,0.009167673,0.8825931],"study_design_scores_gemma":[0.00010593862,0.00053583685,0.0027315011,0.000049047718,0.00023019586,0.0005298912,0.00021360898,0.8383626,0.10704767,0.014135162,0.035915926,0.00014267079],"about_ca_topic_score_codex":0.0014356942,"about_ca_topic_score_gemma":0.0022281967,"teacher_disagreement_score":0.0031674677,"about_ca_system_score_codex":0.0006331094,"about_ca_system_score_gemma":0.0006763232,"threshold_uncertainty_score":0.016751349},"labels":[],"label_agreement":null},{"id":"W4390401285","doi":"10.1002/9781394264964.ch1","title":"Observing the Web through the Lens of Websites","year":2023,"lang":"en","type":"other","venue":"","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Université du Québec à Montréal","funders":"","keywords":"World Wide Web; Hypertext; Visibility; The Internet; Computer science; Search engine indexing; Architecture; Semiotics; Order (exchange); Geography","score_opus":0.04564987199468851,"score_gpt":0.26064383058136414,"score_spread":0.21499395858667564,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4390401285","genre_codex":"other","genre_gemma":"other","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"other","genre_consensus":"other","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.03325661,0.022389423,0.081910916,0.037050363,0.00072521425,0.000074019474,0.0008805347,0.00041366965,0.8232993],"genre_scores_gemma":[0.77522737,0.03245901,0.09219932,0.005664389,0.0018529851,0.00023569129,0.0009941199,0.0010132554,0.09035387],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"not_applicable","domain_scores_codex":[0.9975733,0.0015141817,0.000056545232,0.00026903156,0.00046080528,0.00012612875],"domain_scores_gemma":[0.9956655,0.0028800764,0.0002791627,0.00061195664,0.0002877928,0.0002754589],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.002338154,0.00088509877,0.00034945345,0.00855916,0.004275061,0.022800416,0.0010531528,0.002767655,0.007822059],"category_scores_gemma":[0.005184177,0.00043435773,0.00046676237,0.0075673903,0.028498001,0.027835855,0.005870682,0.005609526,0.0015827992],"study_design_candidate":"not_applicable","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0000081798635,0.000011050333,0.00064779335,0.00009331053,0.000005808402,0.0001759411,0.018256746,0.0002419068,0.0002741681,0.9641533,0.0053465744,0.010785179],"study_design_scores_gemma":[0.000005148339,0.000008683429,0.0013223215,0.00035192264,0.000008459286,0.00039108424,0.023303963,0.0010161246,0.0003693647,0.5854732,0.38773507,0.000014717015],"about_ca_topic_score_codex":0.009638785,"about_ca_topic_score_gemma":0.014695505,"teacher_disagreement_score":0.022800416,"about_ca_system_score_codex":0.0044316775,"about_ca_system_score_gemma":0.002440159,"threshold_uncertainty_score":0.032154262},"labels":[],"label_agreement":null},{"id":"W4391617684","doi":"10.32920/25175192","title":"News Personalization: Do Journalism Audiences Prefer Algorithms Over Editors?","year":2024,"lang":"en","type":"preprint","venue":"","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Guelph; Toronto Metropolitan University; Centre for Social Innovation; York University","funders":"","keywords":"Personalization; Journalism; Preference; Computer science; Variety (cybernetics); Social media; World Wide Web; Algorithm; Advertising; Business; Artificial intelligence; Mathematics","score_opus":0.02530754122415092,"score_gpt":0.28759105753532443,"score_spread":0.2622835163111735,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4391617684","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.97025776,0.0003448326,0.005217852,0.0020119194,0.00006878194,0.00009004087,0.00014773992,0.000061015522,0.021799985],"genre_scores_gemma":[0.99672323,0.0001660409,0.0014425864,0.00037216433,0.00007361152,0.000039669216,0.000073068135,0.000013702073,0.0010959124],"study_design_codex":"observational","study_design_gemma":"observational","domain_scores_codex":[0.99618196,0.0020299368,0.00027490093,0.00054334983,0.00066816155,0.00030173134],"domain_scores_gemma":[0.96614367,0.02143308,0.0066382186,0.001450145,0.0029937222,0.0013411265],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.008304941,0.00024837072,0.00037229093,0.0013354497,0.0011797469,0.004851458,0.00032527174,0.0010645016,0.0076568513],"category_scores_gemma":[0.043617602,0.00026605546,0.0003681205,0.0010267778,0.0009072138,0.0041151377,0.00087999395,0.0010497936,0.0010435003],"study_design_candidate":"observational","study_design_consensus":"observational","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0019525632,0.00081623555,0.6923594,0.000657302,0.00035869677,0.00024355965,0.037979603,0.000558745,0.007697691,0.00641533,0.0055400315,0.24542092],"study_design_scores_gemma":[0.00021721055,0.0013116573,0.9017732,0.00023316183,0.0004101553,0.00050027575,0.057481617,0.0059184856,0.005495799,0.008694999,0.017834328,0.00012917006],"about_ca_topic_score_codex":0.0012329627,"about_ca_topic_score_gemma":0.0014676382,"teacher_disagreement_score":0.008304941,"about_ca_system_score_codex":0.0004905089,"about_ca_system_score_gemma":0.00026078225,"threshold_uncertainty_score":0.043921232},"labels":[],"label_agreement":null},{"id":"W4391618161","doi":"10.32920/25175192.v1","title":"News Personalization: Do Journalism Audiences Prefer Algorithms Over Editors?","year":2024,"lang":"en","type":"preprint","venue":"","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Guelph; Toronto Metropolitan University; Centre for Social Innovation; York University","funders":"","keywords":"Personalization; Journalism; Preference; Variety (cybernetics); Computer science; World Wide Web; Social media; Democracy; Algorithm; Political science; Advertising; Business; Mathematics; Artificial intelligence","score_opus":0.02530754122415092,"score_gpt":0.28759105753532443,"score_spread":0.2622835163111735,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4391618161","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.97025776,0.0003448326,0.005217852,0.0020119194,0.00006878194,0.00009004087,0.00014773992,0.000061015522,0.021799985],"genre_scores_gemma":[0.99672323,0.0001660409,0.0014425864,0.00037216433,0.00007361152,0.000039669216,0.000073068135,0.000013702073,0.0010959124],"study_design_codex":"observational","study_design_gemma":"observational","domain_scores_codex":[0.99618196,0.0020299368,0.00027490093,0.00054334983,0.00066816155,0.00030173134],"domain_scores_gemma":[0.96614367,0.02143308,0.0066382186,0.001450145,0.0029937222,0.0013411265],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.008304941,0.00024837072,0.00037229093,0.0013354497,0.0011797469,0.004851458,0.00032527174,0.0010645016,0.0076568513],"category_scores_gemma":[0.043617602,0.00026605546,0.0003681205,0.0010267778,0.0009072138,0.0041151377,0.00087999395,0.0010497936,0.0010435003],"study_design_candidate":"observational","study_design_consensus":"observational","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0019525632,0.00081623555,0.6923594,0.000657302,0.00035869677,0.00024355965,0.037979603,0.000558745,0.007697691,0.00641533,0.0055400315,0.24542092],"study_design_scores_gemma":[0.00021721055,0.0013116573,0.9017732,0.00023316183,0.0004101553,0.00050027575,0.057481617,0.0059184856,0.005495799,0.008694999,0.017834328,0.00012917006],"about_ca_topic_score_codex":0.0012329627,"about_ca_topic_score_gemma":0.0014676382,"teacher_disagreement_score":0.008304941,"about_ca_system_score_codex":0.0004905089,"about_ca_system_score_gemma":0.00026078225,"threshold_uncertainty_score":0.043921232},"labels":[],"label_agreement":null},{"id":"W4393089651","doi":"10.1007/978-3-031-56063-7_27","title":"BertPE: A BERT-Based Pre-retrieval Estimator for Query Performance Prediction","year":2024,"lang":"en","type":"book-chapter","venue":"Lecture notes in computer science","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":9,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Waterloo; University of Guelph","funders":"","keywords":"Computer science; Estimator; Information retrieval; Data mining; Artificial intelligence; Statistics; Mathematics","score_opus":0.013603147393727807,"score_gpt":0.24540206133341977,"score_spread":0.23179891393969196,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4393089651","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0061698165,0.00068257673,0.98565394,0.00009618684,0.00009943141,0.000070483366,0.00049249845,0.0057952767,0.0009396204],"genre_scores_gemma":[0.35080323,0.0009079114,0.62736416,0.0003861701,0.0006020647,0.0004261011,0.0045369775,0.0011858473,0.013787512],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.998483,0.00034954926,0.00005937813,0.000256308,0.00069857365,0.00015319277],"domain_scores_gemma":[0.9972166,0.0014459194,0.000185776,0.0004434421,0.0006008138,0.00010745012],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0025092056,0.0013110165,0.001816586,0.001724657,0.00045646142,0.0010828504,0.00238361,0.0016001071,0.0047584595],"category_scores_gemma":[0.009416263,0.0006103491,0.00059502834,0.0016306163,0.0005054079,0.0020904616,0.0011784812,0.0015845613,0.0044726436],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0013418221,0.00045787144,0.0044280575,0.00028091125,0.00024028757,0.00011951201,0.00006172119,0.22904298,0.030794332,0.010132305,0.027435778,0.6956644],"study_design_scores_gemma":[0.000023749859,0.000066576504,0.0009916428,0.000010028769,0.000017219008,0.000062663974,0.00000539074,0.9888391,0.004887134,0.0026419305,0.0024258092,0.000028717004],"about_ca_topic_score_codex":0.0059888195,"about_ca_topic_score_gemma":0.0068264143,"teacher_disagreement_score":0.0059888195,"about_ca_system_score_codex":0.00085149263,"about_ca_system_score_gemma":0.0011104468,"threshold_uncertainty_score":0.015918612},"labels":[],"label_agreement":null},{"id":"W4393159749","doi":"10.1609/aaai.v38i9.28927","title":"Exact ASP Counting with Compact Encodings","year":2024,"lang":"en","type":"article","venue":"Proceedings of the AAAI Conference on Artificial Intelligence","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":2,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Toronto","funders":"National Supercomputing Centre Singapore; Ministry of Education, India; National Research Foundation Singapore; National Research Foundation","keywords":"Computer science; Mathematics","score_opus":0.06447184882877637,"score_gpt":0.29221073264395614,"score_spread":0.22773888381517976,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4393159749","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.078912675,0.0020084605,0.8680536,0.0026638717,0.0003633186,0.0004311414,0.006316217,0.01508263,0.026168117],"genre_scores_gemma":[0.40114802,0.0010829669,0.576365,0.0008430897,0.00018634995,0.0006573934,0.009558449,0.0016618331,0.008496884],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.992792,0.0018145671,0.0006430154,0.0011820795,0.002885026,0.0006832751],"domain_scores_gemma":[0.99134374,0.004381672,0.0006689907,0.0019414377,0.0013696526,0.00029450937],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0025031143,0.0014433503,0.0011630607,0.0021484075,0.0009287131,0.0057351086,0.003143293,0.0014204951,0.01061704],"category_scores_gemma":[0.019374313,0.0006274762,0.0018030986,0.0030372012,0.0015423483,0.009618459,0.0036589373,0.0031971098,0.0025180504],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0007114333,0.0005566831,0.0035012166,0.00090096705,0.00010696233,0.0004675261,0.00055876514,0.109584674,0.009694166,0.47307625,0.031961426,0.36887997],"study_design_scores_gemma":[0.00012391861,0.00016919519,0.0004620507,0.00015371937,0.00008444183,0.00030890692,0.00024183614,0.4583915,0.01027301,0.50274837,0.026987985,0.00005514705],"about_ca_topic_score_codex":0.0030211287,"about_ca_topic_score_gemma":0.005625601,"teacher_disagreement_score":0.01061704,"about_ca_system_score_codex":0.0026592277,"about_ca_system_score_gemma":0.0033344356,"threshold_uncertainty_score":0.035517573},"labels":[],"label_agreement":null},{"id":"W4393466454","doi":"10.5281/zenodo.3687255","title":"Quebec Ministry of Agriculture, Fisheries and Food from 2012-2018 web archive collection derivatives","year":2020,"lang":"en","type":"dataset","venue":"Zenodo (CERN European Organization for Nuclear Research)","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":true,"ca_institutions":"Bibliothèque et Archives nationales du Québec; York University","funders":"","keywords":"Christian ministry; Agriculture; Fishery; Agricultural economics; Fisheries Research; Food web; Agricultural science; Business; Geography; World Wide Web; Political science; Fish <Actinopterygii>; Environmental science; Computer science; Economics; Biology; Ecology; Archaeology","score_opus":0.024522483238894315,"score_gpt":0.21106232375014275,"score_spread":0.18653984051124844,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4393466454","genre_codex":"dataset","genre_gemma":"dataset","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"dataset","genre_consensus":"dataset","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0012044441,0.001172442,0.0012619848,0.0014852892,0.00069975026,0.00026092172,0.82410973,0.0083376635,0.16146767],"genre_scores_gemma":[0.0055851066,0.0020350707,0.0050164526,0.0007236782,0.00014764535,0.00032975344,0.6399984,0.004868732,0.34129518],"study_design_codex":"not_applicable","study_design_gemma":"not_applicable","domain_scores_codex":[0.9972844,0.00009811132,0.0000980322,0.00027795543,0.0019208204,0.00032064834],"domain_scores_gemma":[0.9839225,0.000428324,0.00025102295,0.0009311921,0.013526701,0.00094030204],"candidate_categories":["insufficient_payload"],"consensus_categories":[],"category_scores_codex":[0.0017620492,0.0017150458,0.0012168265,0.008915006,0.0035279954,0.00530148,0.0022876998,0.0009022738,0.3204132],"category_scores_gemma":[0.009115966,0.00089253095,0.00085831323,0.014889847,0.00071309233,0.0025400138,0.0018952532,0.0016582578,0.19286269],"study_design_candidate":"not_applicable","study_design_consensus":"not_applicable","about_ca_topic_candidate":true,"about_ca_topic_consensus":true,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.000021262407,0.000008094657,0.00038611484,0.00009632469,0.0000046103937,0.00001687715,0.000044499986,0.000036940648,0.000098545606,0.0004026839,0.9862931,0.012591062],"study_design_scores_gemma":[0.000008359028,0.0000024211918,0.0025229699,0.00008129265,0.0000055067794,0.000015156857,0.00006129794,0.00006694429,0.00022012554,0.00009787276,0.9969024,0.000015558908],"about_ca_topic_score_codex":0.96170956,"about_ca_topic_score_gemma":0.9709315,"teacher_disagreement_score":0.3204132,"about_ca_system_score_codex":0.030671995,"about_ca_system_score_gemma":0.040789012,"threshold_uncertainty_score":0.9693481},"labels":[],"label_agreement":null},{"id":"W4393477082","doi":"10.5281/zenodo.5361068","title":"How Do I Refactor This? An Empirical Study on Refactoring Trends and Topics in Stack Overflow","year":2021,"lang":"en","type":"dataset","venue":"Zenodo (CERN European Organization for Nuclear Research)","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Université du Québec","funders":"","keywords":"Code refactoring; Stack (abstract data type); Computer science; Empirical research; Programming language; Software engineering; Mathematics; Statistics; Software","score_opus":0.0732749163253318,"score_gpt":0.31174687450851096,"score_spread":0.23847195818317918,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4393477082","genre_codex":"empirical","genre_gemma":"dataset","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"dataset","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.99703217,0.00022002576,0.00057827594,0.00046883302,0.000010598375,0.00006957883,0.0005451242,0.000029738509,0.0010456949],"genre_scores_gemma":[0.9937651,0.00046646572,0.0025331448,0.00034425396,0.000025682113,0.00022975732,0.0014635447,0.000055823893,0.0011161916],"study_design_codex":"observational","study_design_gemma":"not_applicable","domain_scores_codex":[0.99497354,0.002063406,0.0006453108,0.00069796696,0.0011770789,0.0004426821],"domain_scores_gemma":[0.8695428,0.088057555,0.023253009,0.0033615385,0.01182504,0.003960133],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0108227,0.0002980434,0.00035025072,0.003371776,0.0014526608,0.0019338403,0.0009383087,0.0010594528,0.0021211093],"category_scores_gemma":[0.07551829,0.00039410027,0.00034560476,0.0029098075,0.0013297176,0.0045732,0.0017115609,0.0019793955,0.00055510097],"study_design_candidate":"not_applicable","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0003003307,0.00091630017,0.6374008,0.0008763362,0.0000524126,0.0006617551,0.29579034,0.0003128795,0.0032999176,0.0010750886,0.00614711,0.053166747],"study_design_scores_gemma":[0.000035464247,0.00040130247,0.7153026,0.0006214578,0.00005537142,0.00034370128,0.2593821,0.0018389189,0.0018877009,0.0008461984,0.019145472,0.00013972551],"about_ca_topic_score_codex":0.008084727,"about_ca_topic_score_gemma":0.013365526,"teacher_disagreement_score":0.0108227,"about_ca_system_score_codex":0.0022002982,"about_ca_system_score_gemma":0.0019908368,"threshold_uncertainty_score":0.05723661},"labels":[],"label_agreement":null},{"id":"W4393540695","doi":"10.5281/zenodo.3660457","title":"Resistance web archive collection derivatives","year":2020,"lang":"en","type":"dataset","venue":"Zenodo (CERN European Organization for Nuclear Research)","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"York University","funders":"","keywords":"World Wide Web; Resistance (ecology); Computer science; Database; Biology; Ecology","score_opus":0.029029733521886748,"score_gpt":0.2366768129421977,"score_spread":0.20764707942031094,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4393540695","genre_codex":"other","genre_gemma":"dataset","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"dataset","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0025670968,0.0005734026,0.009162179,0.0017872659,0.0013067707,0.0007579919,0.25286248,0.115508445,0.6154744],"genre_scores_gemma":[0.006007637,0.000754117,0.011059159,0.00083540246,0.00033673344,0.0007709111,0.32691324,0.05769488,0.595628],"study_design_codex":"not_applicable","study_design_gemma":"not_applicable","domain_scores_codex":[0.9954958,0.00035756265,0.00038329206,0.00041039943,0.0029903315,0.00036258472],"domain_scores_gemma":[0.9850221,0.0010301537,0.0005209185,0.0042197686,0.008062119,0.001144976],"candidate_categories":["insufficient_payload"],"consensus_categories":[],"category_scores_codex":[0.0020667363,0.0014762516,0.0015178293,0.014507314,0.0037352764,0.010088973,0.0031432798,0.0013342039,0.4953113],"category_scores_gemma":[0.015095567,0.0018042336,0.00097358506,0.017729554,0.0011151539,0.0065528164,0.0057431413,0.003900945,0.52579993],"study_design_candidate":"not_applicable","study_design_consensus":"not_applicable","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.000041132662,0.00002685154,0.00019258985,0.00014703647,0.000004180047,0.000049834453,0.00013243427,0.000038844842,0.0003725076,0.0019437023,0.9689663,0.02808453],"study_design_scores_gemma":[0.000010266032,0.000004890404,0.00051460107,0.00006778323,0.000004207342,0.00006157394,0.00006372109,0.000073743504,0.00055933435,0.00046135447,0.9981571,0.000021405804],"about_ca_topic_score_codex":0.06457482,"about_ca_topic_score_gemma":0.07630903,"teacher_disagreement_score":0.4953113,"about_ca_system_score_codex":0.004609174,"about_ca_system_score_gemma":0.010010754,"threshold_uncertainty_score":0.7198772},"labels":[],"label_agreement":null},{"id":"W4393586178","doi":"10.5281/zenodo.3660456","title":"Resistance web archive collection derivatives","year":2020,"lang":"en","type":"dataset","venue":"Zenodo (CERN European Organization for Nuclear Research)","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"York University","funders":"","keywords":"Resistance (ecology); World Wide Web; Computer science; Information retrieval; Biology; Ecology","score_opus":0.029029733521886748,"score_gpt":0.2366768129421977,"score_spread":0.20764707942031094,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4393586178","genre_codex":"other","genre_gemma":"dataset","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"dataset","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0025670968,0.0005734026,0.009162179,0.0017872659,0.0013067707,0.0007579919,0.25286248,0.115508445,0.6154744],"genre_scores_gemma":[0.006007637,0.000754117,0.011059159,0.00083540246,0.00033673344,0.0007709111,0.32691324,0.05769488,0.595628],"study_design_codex":"not_applicable","study_design_gemma":"not_applicable","domain_scores_codex":[0.9954958,0.00035756265,0.00038329206,0.00041039943,0.0029903315,0.00036258472],"domain_scores_gemma":[0.9850221,0.0010301537,0.0005209185,0.0042197686,0.008062119,0.001144976],"candidate_categories":["insufficient_payload"],"consensus_categories":[],"category_scores_codex":[0.0020667363,0.0014762516,0.0015178293,0.014507314,0.0037352764,0.010088973,0.0031432798,0.0013342039,0.4953113],"category_scores_gemma":[0.015095567,0.0018042336,0.00097358506,0.017729554,0.0011151539,0.0065528164,0.0057431413,0.003900945,0.52579993],"study_design_candidate":"not_applicable","study_design_consensus":"not_applicable","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.000041132662,0.00002685154,0.00019258985,0.00014703647,0.000004180047,0.000049834453,0.00013243427,0.000038844842,0.0003725076,0.0019437023,0.9689663,0.02808453],"study_design_scores_gemma":[0.000010266032,0.000004890404,0.00051460107,0.00006778323,0.000004207342,0.00006157394,0.00006372109,0.000073743504,0.00055933435,0.00046135447,0.9981571,0.000021405804],"about_ca_topic_score_codex":0.06457482,"about_ca_topic_score_gemma":0.07630903,"teacher_disagreement_score":0.4953113,"about_ca_system_score_codex":0.004609174,"about_ca_system_score_gemma":0.010010754,"threshold_uncertainty_score":0.7198772},"labels":[],"label_agreement":null},{"id":"W4393706517","doi":"10.5281/zenodo.3598450","title":"Ministry of Environment of Québec (2011-2014) web archive collection derivatives","year":2020,"lang":"en","type":"dataset","venue":"Figshare","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":true,"ca_institutions":"York University","funders":"","keywords":"Christian ministry; World Wide Web; Computer science; Political science","score_opus":0.022506225084336855,"score_gpt":0.22437416903863125,"score_spread":0.2018679439542944,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4393706517","genre_codex":"dataset","genre_gemma":"dataset","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"dataset","genre_consensus":"dataset","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.001982471,0.0016564869,0.00278049,0.0018098352,0.0009100549,0.00025007926,0.77076983,0.0069070305,0.21293373],"genre_scores_gemma":[0.013144956,0.0028635394,0.008529254,0.0007593484,0.00014651536,0.00031866494,0.48081005,0.005749373,0.48767835],"study_design_codex":"not_applicable","study_design_gemma":"not_applicable","domain_scores_codex":[0.9975345,0.000100979836,0.00009059563,0.00023460678,0.0017607141,0.00027865372],"domain_scores_gemma":[0.9872113,0.00040210487,0.00020746826,0.0008274631,0.010564426,0.000787154],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0016235497,0.0014142771,0.0012364691,0.0080556255,0.003987673,0.006305243,0.002020919,0.000910455,0.22921929],"category_scores_gemma":[0.0075805625,0.00091154914,0.00086482905,0.017567491,0.0008973531,0.0021299191,0.0017333406,0.0019407286,0.08337434],"study_design_candidate":"not_applicable","study_design_consensus":"not_applicable","about_ca_topic_candidate":true,"about_ca_topic_consensus":true,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.000034751054,0.00001533384,0.0009985013,0.00017438958,0.000012415307,0.000038513,0.000107526146,0.00016423479,0.00018668972,0.0017480511,0.97295153,0.023568047],"study_design_scores_gemma":[0.000009325018,0.0000029198795,0.004367588,0.00008549463,0.0000074159225,0.00002418698,0.000105780186,0.00012842419,0.00029129072,0.00016072493,0.9947941,0.00002282292],"about_ca_topic_score_codex":0.98323476,"about_ca_topic_score_gemma":0.9872801,"teacher_disagreement_score":0.22921929,"about_ca_system_score_codex":0.04015717,"about_ca_system_score_gemma":0.06264965,"threshold_uncertainty_score":0.7668149},"labels":[],"label_agreement":null},{"id":"W4394334709","doi":"10.6084/m9.figshare.19950896","title":"FIDMAC Standardized Yellow Perch Mercury Dataset for Canada","year":2022,"lang":"en","type":"dataset","venue":"Figshare","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":true,"ca_institutions":"","funders":"","keywords":"Perch; Mercury (programming language); Fishery; Geography; Biology; Computer science; Fish <Actinopterygii>","score_opus":0.037777905219367136,"score_gpt":0.279245386759033,"score_spread":0.24146748153966585,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4394334709","genre_codex":"dataset","genre_gemma":"dataset","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"dataset","genre_consensus":"dataset","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.00014482194,0.000022454142,0.0000914218,0.000045307992,0.000009804354,0.000017239767,0.9983348,0.00024591057,0.0010881604],"genre_scores_gemma":[0.0009066344,0.00006473352,0.0007677146,0.00006048779,0.000005015663,0.00011371699,0.99587244,0.00014890193,0.0020603586],"study_design_codex":"not_applicable","study_design_gemma":"not_applicable","domain_scores_codex":[0.99896085,0.00004164748,0.0001120705,0.00021000399,0.00047738967,0.00019804582],"domain_scores_gemma":[0.9945615,0.0002618981,0.00026050414,0.00036889125,0.0042715115,0.00027573877],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0007200433,0.0010804768,0.0009140839,0.005481177,0.0016583849,0.0020438216,0.0026696648,0.0008224494,0.07763232],"category_scores_gemma":[0.0052554673,0.0005744444,0.0010921608,0.011309163,0.0003336768,0.0010506075,0.0014010378,0.0012494089,0.044579763],"study_design_candidate":"not_applicable","study_design_consensus":"not_applicable","about_ca_topic_candidate":true,"about_ca_topic_consensus":true,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.000040054405,0.000007690547,0.0025351872,0.00019286147,0.00002430544,0.000015588583,0.000023231483,0.00019709453,0.00007149839,0.00040004568,0.9921469,0.004345614],"study_design_scores_gemma":[0.00009023089,0.000007412333,0.021947876,0.0002805458,0.00004024322,0.00003879176,0.0001554332,0.00071106845,0.0004554778,0.00075680105,0.9754557,0.000060349634],"about_ca_topic_score_codex":0.9369453,"about_ca_topic_score_gemma":0.94832766,"teacher_disagreement_score":0.07763232,"about_ca_system_score_codex":0.0109071825,"about_ca_system_score_gemma":0.02852591,"threshold_uncertainty_score":0.25970602},"labels":[],"label_agreement":null},{"id":"W4394368432","doi":"10.6084/m9.figshare.2008569.v1","title":"A test of browser impacts on ecosystem function.","year":2015,"lang":"en","type":"dataset","venue":"Figshare","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":1,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":true,"ca_institutions":"","funders":"","keywords":"Function (biology); Ecosystem; Test (biology); Computer science; Environmental science; Environmental resource management; Ecology; Biology","score_opus":0.04806528525507564,"score_gpt":0.26221944071998665,"score_spread":0.214154155464911,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4394368432","genre_codex":"dataset","genre_gemma":"dataset","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"dataset","genre_consensus":"dataset","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.002604186,0.00008297024,0.00022987188,0.00015709363,0.000054008153,0.000027732587,0.99548835,0.000320622,0.0010351813],"genre_scores_gemma":[0.009547481,0.00005451286,0.001102889,0.00016589758,0.00001628224,0.000271445,0.98680407,0.00030886024,0.0017286474],"study_design_codex":"not_applicable","study_design_gemma":"not_applicable","domain_scores_codex":[0.9976221,0.00035031163,0.00027383852,0.00081983994,0.00063961674,0.0002943156],"domain_scores_gemma":[0.99165326,0.003374575,0.0012054993,0.0019388638,0.0013378747,0.0004898974],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0036243482,0.0010703559,0.0010796532,0.0023247346,0.000618342,0.001507536,0.0024865214,0.0011338309,0.03258903],"category_scores_gemma":[0.017671676,0.00037394676,0.0017877963,0.003313397,0.000554736,0.0013398239,0.0020952416,0.0022803338,0.017478602],"study_design_candidate":"not_applicable","study_design_consensus":"not_applicable","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00040274265,0.00011707341,0.034230396,0.0013292143,0.00066488737,0.000063069994,0.00011925503,0.0012101035,0.00045565376,0.0019233989,0.9527875,0.0066967155],"study_design_scores_gemma":[0.00092130486,0.00021178437,0.22559099,0.00054216734,0.00048748672,0.00033269392,0.0003758972,0.0030810756,0.0015275923,0.0037245727,0.76307994,0.00012451477],"about_ca_topic_score_codex":0.02379253,"about_ca_topic_score_gemma":0.04282103,"teacher_disagreement_score":0.03258903,"about_ca_system_score_codex":0.0017082155,"about_ca_system_score_gemma":0.0019092225,"threshold_uncertainty_score":0.10902113},"labels":[],"label_agreement":null},{"id":"W4394505531","doi":"10.6084/m9.figshare.2008569","title":"A test of browser impacts on ecosystem function.","year":2015,"lang":"en","type":"dataset","venue":"Figshare","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":true,"ca_institutions":"","funders":"","keywords":"Ecosystem; Function (biology); Test (biology); Computer science; Environmental science; Environmental resource management; Ecology; Biology; Evolutionary biology","score_opus":0.04806528525507564,"score_gpt":0.26221944071998665,"score_spread":0.214154155464911,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4394505531","genre_codex":"dataset","genre_gemma":"dataset","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"dataset","genre_consensus":"dataset","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.002604186,0.00008297024,0.00022987188,0.00015709363,0.000054008153,0.000027732587,0.99548835,0.000320622,0.0010351813],"genre_scores_gemma":[0.009547481,0.00005451286,0.001102889,0.00016589758,0.00001628224,0.000271445,0.98680407,0.00030886024,0.0017286474],"study_design_codex":"not_applicable","study_design_gemma":"observational","domain_scores_codex":[0.9976221,0.00035031163,0.00027383852,0.00081983994,0.00063961674,0.0002943156],"domain_scores_gemma":[0.99165326,0.003374575,0.0012054993,0.0019388638,0.0013378747,0.0004898974],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0036243482,0.0010703559,0.0010796532,0.0023247346,0.000618342,0.001507536,0.0024865214,0.0011338309,0.03258903],"category_scores_gemma":[0.017671676,0.00037394676,0.0017877963,0.003313397,0.000554736,0.0013398239,0.0020952416,0.0022803338,0.017478602],"study_design_candidate":"observational","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00040274265,0.00011707341,0.034230396,0.0013292143,0.00066488737,0.000063069994,0.00011925503,0.0012101035,0.00045565376,0.0019233989,0.9527875,0.0066967155],"study_design_scores_gemma":[0.00092130486,0.00021178437,0.22559099,0.00054216734,0.00048748672,0.00033269392,0.0003758972,0.0030810756,0.0015275923,0.0037245727,0.76307994,0.00012451477],"about_ca_topic_score_codex":0.02379253,"about_ca_topic_score_gemma":0.04282103,"teacher_disagreement_score":0.03258903,"about_ca_system_score_codex":0.0017082155,"about_ca_system_score_gemma":0.0019092225,"threshold_uncertainty_score":0.10902113},"labels":[],"label_agreement":null},{"id":"W4395669106","doi":"10.18280/ijsse.140214","title":"Performance Analysis of Regex-Based Processing for Dark Web Targeted Crawling","year":2024,"lang":"en","type":"article","venue":"International Journal of Safety and Security Engineering","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":true,"route_about_ca":false,"ca_institutions":"","funders":"Universitas Telkom","keywords":"Crawling; Computer science; Medicine","score_opus":0.006726398278615291,"score_gpt":0.23728305681697492,"score_spread":0.23055665853835963,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4395669106","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.91552824,0.0023192037,0.039575998,0.00021253357,0.00020090942,0.00032427406,0.0018981773,0.03435175,0.0055889077],"genre_scores_gemma":[0.91163635,0.0005785154,0.07583847,0.00014210246,0.00005063805,0.00021987085,0.00692856,0.0009707561,0.0036346307],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.994333,0.00092954293,0.00087333267,0.0012010603,0.0020736258,0.0005893497],"domain_scores_gemma":[0.9844615,0.0063322224,0.0010209276,0.0023669288,0.005181514,0.0006369567],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.003125003,0.0014810764,0.0015613603,0.0034141676,0.00071953365,0.0019800107,0.0012203087,0.00094434235,0.00089578965],"category_scores_gemma":[0.016454928,0.00044685774,0.0006780076,0.0023765462,0.0004615161,0.002153742,0.00080577837,0.00077665364,0.001827702],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.008517315,0.0016309478,0.058756806,0.0014921868,0.0007677516,0.0011589553,0.001119304,0.09420841,0.106055975,0.002341823,0.02833302,0.6956174],"study_design_scores_gemma":[0.00014932406,0.0016475897,0.030641291,0.00004728727,0.00020515421,0.0008972354,0.00032699987,0.86071426,0.09919477,0.000601835,0.0054413825,0.0001329223],"about_ca_topic_score_codex":0.010247156,"about_ca_topic_score_gemma":0.006207695,"teacher_disagreement_score":0.010247156,"about_ca_system_score_codex":0.0008117809,"about_ca_system_score_gemma":0.0012997363,"threshold_uncertainty_score":0.020375073},"labels":[],"label_agreement":null},{"id":"W4398625640","doi":"10.7910/dvn/4qjw0v/6v5mdu","title":"Votefoot survey data for POP.tab","year":2019,"lang":"en","type":"dataset","venue":"Harvard Dataverse","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"McGill University; Université de Montréal","funders":"","keywords":"Computer science","score_opus":0.08798275637520361,"score_gpt":0.3045315107010221,"score_spread":0.21654875432581847,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4398625640","genre_codex":"dataset","genre_gemma":"dataset","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"dataset","genre_consensus":"dataset","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.00055264833,0.000017699163,0.00003740643,0.000052013733,0.000029400991,0.00001593916,0.99823016,0.00012790601,0.00093683583],"genre_scores_gemma":[0.0008772057,0.000016203585,0.00013654545,0.000034952314,0.000008536638,0.000060837,0.9972109,0.000035892877,0.001618828],"study_design_codex":"not_applicable","study_design_gemma":"not_applicable","domain_scores_codex":[0.99917114,0.00009796705,0.00009850583,0.00016392583,0.0002990165,0.00016956417],"domain_scores_gemma":[0.99779487,0.00037011915,0.00025073218,0.00035814106,0.0009398813,0.00028618952],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0007806858,0.0013721786,0.0007081291,0.003566611,0.0007464542,0.0014784758,0.0016430598,0.0011548959,0.04887409],"category_scores_gemma":[0.0042227,0.00042547798,0.0007225206,0.0051674787,0.00026125807,0.00071979465,0.0013019231,0.0012738567,0.068490416],"study_design_candidate":"not_applicable","study_design_consensus":"not_applicable","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.000043979482,0.00003250792,0.0020160084,0.00012967641,0.000009749113,0.00001419045,0.000017769267,0.00008220219,0.0000775103,0.00023860332,0.99541736,0.0019204093],"study_design_scores_gemma":[0.00020605569,0.000030286532,0.017881833,0.0001314417,0.00001695318,0.000065648725,0.0002470469,0.00047047524,0.00053311494,0.00049082417,0.9799018,0.000024529472],"about_ca_topic_score_codex":0.029018601,"about_ca_topic_score_gemma":0.07076139,"teacher_disagreement_score":0.04887409,"about_ca_system_score_codex":0.00088515185,"about_ca_system_score_gemma":0.002116106,"threshold_uncertainty_score":0.16350007},"labels":[],"label_agreement":null},{"id":"W4400274608","doi":"10.1007/s10878-024-01186-y","title":"Improved kernelization and fixed-parameter algorithms for bicluster editing","year":2024,"lang":"en","type":"article","venue":"Journal of Combinatorial Optimization","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":1,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Université de Sherbrooke","funders":"Natural Sciences and Engineering Research Council of Canada","keywords":"Kernelization; Theory of computation; Algorithm; Computer science; Graph algorithms; Mathematics; Parameterized complexity; Theoretical computer science; Graph","score_opus":0.013719061549456483,"score_gpt":0.2644857166018327,"score_spread":0.2507666550523762,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4400274608","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0030459529,0.00009794417,0.9947643,0.00007682852,0.000038875063,0.00005357861,0.0000697955,0.0015032878,0.00034944055],"genre_scores_gemma":[0.0801073,0.00012290661,0.9142884,0.00015604713,0.000107045154,0.00033425353,0.00072471803,0.0012032295,0.0029560882],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.99573356,0.0016481208,0.0003555854,0.0010071825,0.00091220567,0.0003433197],"domain_scores_gemma":[0.98102194,0.011155307,0.0006148097,0.004208219,0.002495459,0.00050425023],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.004236746,0.0017647982,0.0031397452,0.0027589628,0.0014484387,0.002623031,0.0063721933,0.0022915788,0.0119056385],"category_scores_gemma":[0.030380862,0.0011776546,0.0023879963,0.0034141513,0.0016487859,0.0043527763,0.004232329,0.0046548583,0.0044289185],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00089077867,0.00058884453,0.0016057536,0.00039492946,0.00026263727,0.00021265364,0.00044196562,0.27574235,0.011555147,0.051972315,0.012457415,0.64387524],"study_design_scores_gemma":[0.00005706773,0.00004580215,0.00016695942,0.000011496394,0.000025038218,0.00006493887,0.000034173056,0.9704939,0.002531758,0.025121557,0.001418854,0.000028419247],"about_ca_topic_score_codex":0.005745181,"about_ca_topic_score_gemma":0.008954684,"teacher_disagreement_score":0.0119056385,"about_ca_system_score_codex":0.0013203601,"about_ca_system_score_gemma":0.0026927614,"threshold_uncertainty_score":0.03982836},"labels":[],"label_agreement":null},{"id":"W4400360175","doi":"10.31341/jios.48.1.1","title":"Relevancy between Anchor Text and Wikipedia. A Web Search Framework","year":2024,"lang":"en","type":"article","venue":"Journal of information and organizational sciences","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Ottawa","funders":"","keywords":"Computer science; Information retrieval; PageRank; Weighting; tf–idf; Ranking (information retrieval); Hypertext; Set (abstract data type); World Wide Web; Term (time)","score_opus":0.011629418109666924,"score_gpt":0.26628436726279425,"score_spread":0.2546549491531273,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4400360175","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.024804864,0.005235045,0.9504935,0.0008635605,0.00022960616,0.00069297676,0.0014068383,0.003309993,0.012963628],"genre_scores_gemma":[0.29611284,0.0016860153,0.6832868,0.00030462872,0.00032613764,0.000517387,0.0030990893,0.0005153743,0.014151729],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9969494,0.0011042679,0.00027854685,0.00053388934,0.0009814003,0.00015243964],"domain_scores_gemma":[0.99668026,0.0013120705,0.00044589958,0.00043930608,0.0009579948,0.00016449536],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0034900699,0.00071389606,0.00089649536,0.012150076,0.0010656158,0.0030353537,0.0018236439,0.0010938357,0.0025165216],"category_scores_gemma":[0.010804537,0.00040905943,0.0011117503,0.005688242,0.0012309666,0.0052711633,0.002272644,0.0010808005,0.0016203538],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00038142467,0.00029765785,0.0061761187,0.00085348386,0.0002114762,0.0007870644,0.0010531351,0.03842307,0.012375586,0.34577385,0.021984663,0.5716825],"study_design_scores_gemma":[0.00008145163,0.0003726847,0.0066459016,0.00022662187,0.00016272525,0.0018890497,0.0005797559,0.56241715,0.015170389,0.298221,0.114068925,0.00016424959],"about_ca_topic_score_codex":0.0057637733,"about_ca_topic_score_gemma":0.0073755872,"teacher_disagreement_score":0.012150076,"about_ca_system_score_codex":0.0010677273,"about_ca_system_score_gemma":0.0015876301,"threshold_uncertainty_score":0.018457532},"labels":[],"label_agreement":null},{"id":"W4400526908","doi":"10.1145/3626772.3657707","title":"Large Language Models can Accurately Predict Searcher Preferences","year":2024,"lang":"en","type":"article","venue":"","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":132,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Microsoft (Canada)","funders":"","keywords":"Computer science; Artificial intelligence; Natural language processing","score_opus":0.07561307685075239,"score_gpt":0.3207369305742917,"score_spread":0.24512385372353931,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4400526908","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.54080945,0.003284117,0.42384148,0.002813431,0.00022505183,0.00032690057,0.005663665,0.010475597,0.012560276],"genre_scores_gemma":[0.9461505,0.0003771155,0.044708606,0.0003633359,0.00010350126,0.00016459677,0.004041461,0.0004485297,0.0036423288],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9978168,0.0010943817,0.00014427217,0.00045696294,0.00034802285,0.00013947645],"domain_scores_gemma":[0.98032093,0.015792353,0.0008369018,0.0015151011,0.0012087562,0.0003260803],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.003934912,0.00122099,0.0008440518,0.0017287437,0.00049045094,0.0019151799,0.0007727705,0.0013174415,0.0033290994],"category_scores_gemma":[0.02667455,0.00051431305,0.00074925966,0.0013328114,0.0004580048,0.0049401573,0.0010257404,0.0022966857,0.004614863],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0026317704,0.0009692283,0.088875845,0.0008766433,0.0005902198,0.000403602,0.0015483645,0.37493545,0.026941516,0.0079631675,0.035309944,0.45895436],"study_design_scores_gemma":[0.00004752091,0.00013815406,0.00596815,0.000039044473,0.000045695877,0.000107310225,0.00016067593,0.97903156,0.003095741,0.009054905,0.00226655,0.000044657343],"about_ca_topic_score_codex":0.005657483,"about_ca_topic_score_gemma":0.01307887,"teacher_disagreement_score":0.005657483,"about_ca_system_score_codex":0.0008836073,"about_ca_system_score_gemma":0.0007891445,"threshold_uncertainty_score":0.020810008},"labels":[],"label_agreement":null},{"id":"W4400530959","doi":"10.1145/3626772.3657862","title":"Resources for Brewing BEIR: Reproducible Reference Models and Statistical Analyses","year":2024,"lang":"en","type":"article","venue":"","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":14,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Waterloo","funders":"Universitas Brawijaya","keywords":"Computer science; Brewing; Chemistry; Food science","score_opus":0.17575726662516913,"score_gpt":0.38564489913420313,"score_spread":0.209887632509034,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4400530959","genre_codex":"dataset","genre_gemma":"dataset","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"dataset","genre_consensus":"dataset","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0130614,0.0074635097,0.37489116,0.0044294912,0.0018492482,0.0032535288,0.38122898,0.18282162,0.031001061],"genre_scores_gemma":[0.059190612,0.002360177,0.3671527,0.00288942,0.00053807814,0.014412067,0.48975605,0.055306274,0.008394669],"study_design_codex":"not_applicable","study_design_gemma":"not_applicable","domain_scores_codex":[0.95177287,0.025013968,0.0057257884,0.004541706,0.011835167,0.0011105951],"domain_scores_gemma":[0.6894241,0.13787991,0.009542019,0.12391481,0.036114555,0.0031245612],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.05796076,0.0035714628,0.0034822708,0.011862462,0.0019270261,0.0059089256,0.0116466805,0.0047334703,0.060066674],"category_scores_gemma":[0.3103389,0.0026006573,0.005685775,0.011042173,0.0018489442,0.007874099,0.008125055,0.004692852,0.058145594],"study_design_candidate":"not_applicable","study_design_consensus":"not_applicable","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0010482547,0.00076999905,0.0062908637,0.006934292,0.001846347,0.00022799276,0.00043704052,0.013193424,0.0023670762,0.015174342,0.801712,0.14999838],"study_design_scores_gemma":[0.003465886,0.0014571343,0.015437481,0.008293915,0.002231501,0.0010043742,0.00061501533,0.0751805,0.018836927,0.09490203,0.77749497,0.0010803061],"about_ca_topic_score_codex":0.013091062,"about_ca_topic_score_gemma":0.023706807,"teacher_disagreement_score":0.060066674,"about_ca_system_score_codex":0.0027233283,"about_ca_system_score_gemma":0.007676187,"threshold_uncertainty_score":0.30652946},"labels":[],"label_agreement":null},{"id":"W4401117157","doi":"10.5206/elip.v6i1.16744","title":"WARCreate","year":2024,"lang":"en","type":"article","venue":"Emerging Library & Information Perspectives","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":true,"route_about_ca":false,"ca_institutions":"","funders":"","keywords":"World Wide Web; Computer science; Usability; Password; Web page; Digital library; Web service; Web development; Human–computer interaction; Operating system","score_opus":0.004597960864546841,"score_gpt":0.21603754571883987,"score_spread":0.21143958485429304,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4401117157","genre_codex":"software","genre_gemma":"software","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"software","genre_consensus":"software","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.008607442,0.00227155,0.10045074,0.0015568096,0.0011295235,0.0012671675,0.05925494,0.43298653,0.3924754],"genre_scores_gemma":[0.03726108,0.002650464,0.11180048,0.003045732,0.00037722776,0.0012085261,0.117533006,0.16810627,0.55801725],"study_design_codex":"not_applicable","study_design_gemma":"not_applicable","domain_scores_codex":[0.99831355,0.00012399069,0.00008821014,0.0003445648,0.0009307172,0.00019897426],"domain_scores_gemma":[0.996021,0.0008242861,0.00019171194,0.0011630751,0.0013872529,0.00041261222],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0016295803,0.001613062,0.0010077164,0.003267336,0.001526877,0.00498223,0.0030408637,0.0015313538,0.25704494],"category_scores_gemma":[0.008520925,0.001191931,0.0011709962,0.002890047,0.0007678655,0.0066835,0.005115282,0.002000898,0.23985104],"study_design_candidate":"not_applicable","study_design_consensus":"not_applicable","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00042604067,0.00011508898,0.0009677093,0.0006109299,0.00003474778,0.0002302628,0.0005288648,0.00019341793,0.0053986255,0.0068710614,0.78633267,0.1982906],"study_design_scores_gemma":[0.000039565806,0.000033928005,0.0011927313,0.00009245042,0.000020617405,0.00038878675,0.00012949531,0.00079004146,0.0076623377,0.0027908774,0.9867951,0.00006409047],"about_ca_topic_score_codex":0.0035836415,"about_ca_topic_score_gemma":0.0059727808,"teacher_disagreement_score":0.25704494,"about_ca_system_score_codex":0.0007379484,"about_ca_system_score_gemma":0.0020611736,"threshold_uncertainty_score":0},"labels":[],"label_agreement":null},{"id":"W4401381293","doi":"10.1145/3687273.3687288","title":"Report on the Search Futures Workshop at ECIR 2024","year":2024,"lang":"en","type":"article","venue":"ACM SIGIR Forum","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":9,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Microsoft (Canada); University of Waterloo","funders":"National Institute of Standards and Technology; University of Waterloo; Sapienza Università di Roma; Technische Universiteit Eindhoven; Universiteit van Amsterdam; Universiteit Leiden; Johns Hopkins University; RMIT University; Microsoft Research","keywords":"Futures contract; Computer science; Economics; Financial economics","score_opus":0.03133616214902856,"score_gpt":0.29761942985122747,"score_spread":0.2662832677021989,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4401381293","genre_codex":"other","genre_gemma":"editorial","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"editorial","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0362374,0.02493292,0.029220399,0.25925434,0.07930624,0.0023161874,0.031706434,0.006955899,0.5300702],"genre_scores_gemma":[0.060977597,0.005061849,0.014806447,0.021515038,0.0064009894,0.0017554499,0.032226887,0.0039257826,0.85332984],"study_design_codex":"not_applicable","study_design_gemma":"not_applicable","domain_scores_codex":[0.9898555,0.0025273333,0.0002938609,0.000785863,0.0045424914,0.001994882],"domain_scores_gemma":[0.9881942,0.002142364,0.00020577002,0.0007389696,0.0036923138,0.005026414],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.015851438,0.0015616815,0.001254729,0.0018493949,0.0057330183,0.013069979,0.002844136,0.0077366033,0.13576896],"category_scores_gemma":[0.01645702,0.00074422325,0.0018540166,0.0021807202,0.00150361,0.011128775,0.009448032,0.0074135405,0.08705115],"study_design_candidate":"not_applicable","study_design_consensus":"not_applicable","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0002682659,0.00011275608,0.00020427635,0.00017296415,0.000013396713,0.00021182877,0.00092275435,0.0002719414,0.0007776728,0.006310144,0.96595633,0.02477766],"study_design_scores_gemma":[0.000051182775,0.00007990295,0.0005536333,0.00011739149,0.0000075573685,0.000080243,0.001474068,0.00027981313,0.0006179078,0.002578015,0.9941174,0.000042813324],"about_ca_topic_score_codex":0.02293169,"about_ca_topic_score_gemma":0.027093086,"teacher_disagreement_score":0.13576896,"about_ca_system_score_codex":0.004637576,"about_ca_system_score_gemma":0.0120531665,"threshold_uncertainty_score":0.45419246},"labels":[],"label_agreement":null},{"id":"W4401399530","doi":"10.36253/979-12-215-0413-2.10","title":"Challenges in archiving the personalized web","year":2024,"lang":"en","type":"book-chapter","venue":"Proceedings e report","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Canadian Nautical Research Society","funders":"","keywords":"Personalization; World Wide Web; Computer science; Rendering (computer graphics); Key (lock); Web navigation; Web intelligence; The Internet; Data science; Web development; Computer security; Artificial intelligence","score_opus":0.06863849345386841,"score_gpt":0.2718004443288881,"score_spread":0.2031619508750197,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4401399530","genre_codex":"methods","genre_gemma":"other","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"other","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.037384015,0.032886915,0.7642725,0.06957272,0.0016137016,0.00043378703,0.0024132917,0.0023002825,0.08912271],"genre_scores_gemma":[0.15497716,0.030417228,0.7715827,0.0069470387,0.0018293672,0.0008290945,0.0019403718,0.0014484894,0.030028557],"study_design_codex":"design_other","study_design_gemma":"not_applicable","domain_scores_codex":[0.9938351,0.0024368726,0.00030155093,0.00084688107,0.0023695023,0.00021017787],"domain_scores_gemma":[0.97502375,0.01287658,0.00065023487,0.008192345,0.0028222338,0.00043488658],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.01349149,0.0004154924,0.00085062685,0.0028693706,0.0029505654,0.012825958,0.0025204963,0.0021580101,0.002937498],"category_scores_gemma":[0.030125719,0.0007474618,0.00054155226,0.006657626,0.005051014,0.017231502,0.003880591,0.0057681985,0.0032390405],"study_design_candidate":"not_applicable","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.000030397616,0.00007552222,0.003781847,0.00048589986,0.0000384149,0.0001468888,0.009118306,0.0049574855,0.0012969784,0.3087969,0.044666424,0.6266049],"study_design_scores_gemma":[0.0000084568,0.000033344524,0.0047058254,0.0007784042,0.000026108693,0.0006373267,0.008315427,0.014561716,0.0033294347,0.52965575,0.4378754,0.000072822586],"about_ca_topic_score_codex":0.004628716,"about_ca_topic_score_gemma":0.0057378234,"teacher_disagreement_score":0.01349149,"about_ca_system_score_codex":0.0019219943,"about_ca_system_score_gemma":0.003569583,"threshold_uncertainty_score":0.07135069},"labels":[],"label_agreement":null},{"id":"W4401667831","doi":"10.1007/978-3-031-68323-7_25","title":"A Novel Technique for Query Plan Representation Based on Graph Neural Nets","year":2024,"lang":"en","type":"book-chapter","venue":"Lecture notes in computer science","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":1,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Wilfrid Laurier University; University of Ottawa","funders":"","keywords":"Computer science; Graph; Representation (politics); Artificial neural network; Theoretical computer science; Artificial intelligence; Information retrieval","score_opus":0.031953712129237866,"score_gpt":0.27810816285875806,"score_spread":0.2461544507295202,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4401667831","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.003292109,0.00016505383,0.9912685,0.00012181047,0.000046330875,0.00012709144,0.00031439232,0.0034960795,0.0011685326],"genre_scores_gemma":[0.10071317,0.00031091596,0.8929463,0.00015982435,0.000052028787,0.00018563957,0.0014435746,0.00029620482,0.003892355],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.99925536,0.000092855415,0.00005514597,0.00018604135,0.00034524527,0.00006538355],"domain_scores_gemma":[0.99934965,0.0002304031,0.00005069714,0.00016818017,0.00017050163,0.000030475878],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.00057387614,0.0007790835,0.00088334334,0.0019158856,0.0006043363,0.0013128533,0.0018148766,0.00075269013,0.004749575],"category_scores_gemma":[0.0022405016,0.00043201042,0.00086295593,0.0022272037,0.0005211706,0.0023617088,0.0012575095,0.0016424874,0.0010119645],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00027546159,0.00023634912,0.0008109697,0.00022984989,0.0000837906,0.00011968136,0.000155553,0.08147185,0.015285978,0.035586197,0.0146722505,0.8510721],"study_design_scores_gemma":[0.000017813862,0.00003632122,0.00020725022,0.000016854892,0.00003199369,0.000058813708,0.000040856292,0.9716988,0.006559829,0.01634,0.0049761455,0.000015338626],"about_ca_topic_score_codex":0.015000854,"about_ca_topic_score_gemma":0.022057332,"teacher_disagreement_score":0.015000854,"about_ca_system_score_codex":0.001116464,"about_ca_system_score_gemma":0.0016960948,"threshold_uncertainty_score":0.029827058},"labels":[],"label_agreement":null},{"id":"W4401704942","doi":"10.2139/ssrn.4927726","title":"An Empirical Evaluation of Static, Dynamic, and Hybrid Slicing of Webassembly Binaries","year":2024,"lang":"en","type":"preprint","venue":"SSRN Electronic Journal","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":0,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Université du Québec à Montréal","funders":"","keywords":"Slicing; Computer science; Program slicing; Computer graphics (images)","score_opus":0.021878526541483426,"score_gpt":0.34049915482976234,"score_spread":0.3186206282882789,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4401704942","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.9929636,0.00044919478,0.0036897324,0.00004597522,0.00001800242,0.00007369963,0.0007224321,0.0007909777,0.0012463838],"genre_scores_gemma":[0.9880276,0.00014581224,0.008832842,0.000022873393,0.000020159609,0.000046698977,0.0021638875,0.00015132346,0.0005889676],"study_design_codex":"observational","study_design_gemma":"bench_or_experimental","domain_scores_codex":[0.9936094,0.0014745484,0.0005797886,0.0010064148,0.002936777,0.00039310002],"domain_scores_gemma":[0.88652426,0.0760903,0.009588844,0.0132168885,0.013063007,0.0015166827],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0070114536,0.0008608757,0.000502787,0.0035570357,0.00064888725,0.0014567357,0.0017878389,0.0007727429,0.0023224354],"category_scores_gemma":[0.049179487,0.00049529015,0.0005817117,0.00328359,0.001439982,0.003969861,0.0010831285,0.00088783033,0.00059119565],"study_design_candidate":"bench_or_experimental","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0077566067,0.0039596474,0.474517,0.0016458621,0.00053111324,0.00032564942,0.0024223265,0.08460508,0.023712648,0.0044196234,0.005425508,0.39067894],"study_design_scores_gemma":[0.00040484092,0.0068626823,0.36196628,0.00028642928,0.0006744476,0.0009199004,0.002924723,0.5777719,0.03636494,0.0039031468,0.007770048,0.00015058364],"about_ca_topic_score_codex":0.00693494,"about_ca_topic_score_gemma":0.009316863,"teacher_disagreement_score":0.0070114536,"about_ca_system_score_codex":0.001242054,"about_ca_system_score_gemma":0.0015641534,"threshold_uncertainty_score":0.037080586},"labels":[],"label_agreement":null},{"id":"W4401927927","doi":"10.18280/jesa.570427","title":"Product Matching with Two-Branch Neural Network Embedding","year":2024,"lang":"en","type":"article","venue":"Journal Européen des Systèmes Automatisés","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":2,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":true,"route_about_ca":false,"ca_institutions":"","funders":"","keywords":"Embedding; Artificial neural network; Product (mathematics); Matching (statistics); Computer science; Mathematics; Artificial intelligence; Statistics; Geometry","score_opus":0.01659119362090604,"score_gpt":0.26830516067603977,"score_spread":0.2517139670551337,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4401927927","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.11030699,0.00042636128,0.88312495,0.0003626731,0.00007336963,0.00006975554,0.00016849887,0.0015977201,0.0038695873],"genre_scores_gemma":[0.83197606,0.00020801809,0.15520997,0.00024060158,0.000048872458,0.00013348307,0.0006202537,0.00013493604,0.011427741],"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9996786,0.00007588431,0.000017759869,0.00010466333,0.0000838275,0.000039372993],"domain_scores_gemma":[0.9994923,0.0001751649,0.00006517106,0.00008988538,0.00014828332,0.000029084158],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.000655721,0.000761484,0.00070725335,0.0006790044,0.0002734994,0.00080030964,0.0009535985,0.0011882943,0.00365019],"category_scores_gemma":[0.0020836846,0.00030160908,0.0005191017,0.0007960632,0.00046707594,0.0019497083,0.0011385563,0.0011471512,0.0011499646],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00033158984,0.00023168323,0.0016362794,0.00007062345,0.000062614214,0.00010164376,0.00006269745,0.50733685,0.007963033,0.009034502,0.0040055066,0.469163],"study_design_scores_gemma":[0.0000021838125,0.000017195192,0.00007612379,0.0000017342132,0.0000022812399,0.000009406395,0.0000033082467,0.99736834,0.0006767904,0.0016785209,0.00016201362,0.0000020703012],"about_ca_topic_score_codex":0.003448466,"about_ca_topic_score_gemma":0.003529523,"teacher_disagreement_score":0.00365019,"about_ca_system_score_codex":0.00071955257,"about_ca_system_score_gemma":0.00053069514,"threshold_uncertainty_score":0.012211084},"labels":[],"label_agreement":null},{"id":"W4402265125","doi":"10.1109/tqcebt59414.2024.10545060","title":"Adaptive Web Crawling Strategies Based on Ontological User Interest Modeling for Personalized Content Retrieval","year":2024,"lang":"en","type":"article","venue":"","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Horizon College and Seminary","funders":"","keywords":"Computer science; Crawling; Information retrieval; World Wide Web; Web content; Content (measure theory); Web page","score_opus":0.2001224066024497,"score_gpt":0.3218837302668836,"score_spread":0.1217613236644339,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4402265125","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.090562694,0.00031371895,0.9031119,0.00022148267,0.000021653379,0.00020846374,0.000105349696,0.0028578674,0.0025968014],"genre_scores_gemma":[0.6202447,0.00030559974,0.37662727,0.000086274944,0.000026485175,0.00019493319,0.0004250572,0.00024853923,0.0018412474],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.99812335,0.00073089637,0.00014899416,0.0003348402,0.0005441894,0.00011764129],"domain_scores_gemma":[0.99696976,0.0012378218,0.0002749177,0.0008661557,0.0005531955,0.00009815401],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0020698013,0.0006213176,0.00076665287,0.0021788732,0.0006949933,0.0021358125,0.0011423875,0.0008748723,0.00047318582],"category_scores_gemma":[0.0076725734,0.00043420997,0.0008018994,0.0015573588,0.00067831133,0.0034774179,0.0011965528,0.0009866125,0.00052814174],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00045784962,0.0012120503,0.03132631,0.0004242788,0.00033921786,0.00046504682,0.0033461568,0.1573193,0.078572795,0.060258165,0.0067630694,0.6595158],"study_design_scores_gemma":[0.000013187018,0.000087668435,0.0025622868,0.00001699514,0.00007133228,0.00017285121,0.0001877793,0.9712587,0.011792911,0.009992534,0.003799845,0.00004391311],"about_ca_topic_score_codex":0.0054769004,"about_ca_topic_score_gemma":0.0075244773,"teacher_disagreement_score":0.0054769004,"about_ca_system_score_codex":0.001103898,"about_ca_system_score_gemma":0.001190584,"threshold_uncertainty_score":0.010946274},"labels":[],"label_agreement":null},{"id":"W4402438636","doi":"10.11159/icmie24.139","title":"Hard Example Detection at Actual Environment for Semantic Segmentation Used in Visual Navigation","year":2024,"lang":"en","type":"article","venue":"Proceedings of the World Congress on Mechanical, Chemical, and Material Engineering","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":1,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":true,"route_about_ca":false,"ca_institutions":"","funders":"Japan Society for the Promotion of Science","keywords":"Computer science; Segmentation; Computer vision; Artificial intelligence; Image segmentation; Human–computer interaction","score_opus":0.011472560633218838,"score_gpt":0.22426040328341443,"score_spread":0.2127878426501956,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4402438636","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.08690615,0.0003760367,0.9063749,0.000099939876,0.00011560141,0.00012723882,0.00031946696,0.002623888,0.003056829],"genre_scores_gemma":[0.44426465,0.0002373539,0.55225724,0.00009084746,0.000036599635,0.00012415268,0.0009890931,0.00039971244,0.0016003692],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.99930954,0.00008145787,0.000038719,0.00025144833,0.0002115774,0.00010723284],"domain_scores_gemma":[0.9988918,0.00029927347,0.00013576479,0.00019004865,0.00041871174,0.00006450251],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.00045320753,0.0009775907,0.00086129364,0.0020609226,0.00064723945,0.0010384317,0.0010888064,0.001168808,0.00215107],"category_scores_gemma":[0.0023588368,0.00033576202,0.00062103814,0.0010917234,0.0007456143,0.0015561848,0.0011171369,0.0007146649,0.0011629792],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00078734476,0.00020717112,0.010652307,0.00073958485,0.00012030622,0.0006491598,0.0007365147,0.027064947,0.21359192,0.0078285765,0.0061156387,0.7315066],"study_design_scores_gemma":[0.000041679523,0.00039483362,0.015219333,0.0001352987,0.0001430453,0.0014373047,0.00065539865,0.7380201,0.2148364,0.013774016,0.01520421,0.00013843208],"about_ca_topic_score_codex":0.0023440488,"about_ca_topic_score_gemma":0.004209461,"teacher_disagreement_score":0.0023440488,"about_ca_system_score_codex":0.00032860463,"about_ca_system_score_gemma":0.0006970343,"threshold_uncertainty_score":0.0071960688},"labels":[],"label_agreement":null},{"id":"W4402464111","doi":"10.11159/cist24.162","title":"A BoW-BoC Indexing Method to Enhance Business-Related Document Representation and Retrieval","year":2024,"lang":"en","type":"article","venue":"Proceedings of the World Congress on Electrical Engineering and Computer Systems and Science","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":true,"route_about_ca":false,"ca_institutions":"","funders":"","keywords":"Search engine indexing; Information retrieval; Computer science; Representation (politics); Natural language processing","score_opus":0.006808312459740094,"score_gpt":0.26196683094425044,"score_spread":0.2551585184845103,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4402464111","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.011647395,0.0021742317,0.9755585,0.00032870282,0.00045414577,0.0004900415,0.00081564643,0.004600132,0.0039312076],"genre_scores_gemma":[0.07700071,0.0014530609,0.90816927,0.00032630403,0.00042327493,0.000572204,0.0035066523,0.00037592428,0.008172727],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.99789375,0.00025882202,0.00020971683,0.00037365447,0.001059427,0.00020459187],"domain_scores_gemma":[0.998111,0.00032315732,0.00014194188,0.00028375315,0.0010424028,0.000097718075],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0017012383,0.0010383634,0.0015279221,0.008844562,0.0011416794,0.0021695327,0.0014123612,0.0011701749,0.0049631163],"category_scores_gemma":[0.005565202,0.00039532353,0.0012135527,0.011584934,0.0006089099,0.0034254717,0.0020249574,0.0015861169,0.005523683],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00015892505,0.00022540204,0.0007332724,0.00030812595,0.00006327325,0.00009124295,0.00017512325,0.0043321825,0.047673047,0.010888001,0.023824394,0.911527],"study_design_scores_gemma":[0.00017495366,0.0006777637,0.006022521,0.00016677774,0.00028488002,0.002127357,0.0004647663,0.7356345,0.09491943,0.025151148,0.13405624,0.00031969434],"about_ca_topic_score_codex":0.0061555584,"about_ca_topic_score_gemma":0.007971194,"teacher_disagreement_score":0.008844562,"about_ca_system_score_codex":0.0010850385,"about_ca_system_score_gemma":0.0026331502,"threshold_uncertainty_score":0.01660335},"labels":[],"label_agreement":null},{"id":"W4402516515","doi":"10.1145/3695995","title":"Deep API Sequence Generation via Golden Solution Samples and API Seeds","year":2024,"lang":"en","type":"article","venue":"ACM Transactions on Software Engineering and Methodology","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":1,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"York University","funders":"National Natural Science Foundation of China","keywords":"Computer science; Sequence (biology); Programming language; Biology","score_opus":0.13558136938960888,"score_gpt":0.31603201239977097,"score_spread":0.1804506430101621,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4402516515","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.24227068,0.002272755,0.71006984,0.00091445877,0.0003032501,0.000604444,0.001916925,0.035627127,0.006020565],"genre_scores_gemma":[0.4911722,0.00036541553,0.4928754,0.00050815026,0.000076800105,0.000480016,0.008389559,0.0013878595,0.0047445893],"study_design_codex":"design_other","study_design_gemma":"bench_or_experimental","domain_scores_codex":[0.99863476,0.00028572488,0.00009391275,0.00044388094,0.0003878509,0.00015384566],"domain_scores_gemma":[0.99681133,0.0013924259,0.00021528472,0.0006619907,0.0007361301,0.00018273381],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0013490642,0.0018349148,0.0014316583,0.002234122,0.0006996028,0.0010855767,0.0022121114,0.0015524811,0.0038875903],"category_scores_gemma":[0.009938694,0.0007640226,0.0014314232,0.0014482387,0.0007268334,0.0024087045,0.0013148254,0.0015549192,0.0022422397],"study_design_candidate":"bench_or_experimental","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0009223768,0.00092989614,0.015652258,0.0007312198,0.00017517856,0.0007519417,0.0003880062,0.15945417,0.026191311,0.008510452,0.037806846,0.74848646],"study_design_scores_gemma":[0.00010445218,0.00018489138,0.00077514973,0.000025879332,0.000057681602,0.00017152216,0.00010007748,0.9814388,0.008418509,0.0051447446,0.0035576115,0.000020578584],"about_ca_topic_score_codex":0.008114816,"about_ca_topic_score_gemma":0.01682202,"teacher_disagreement_score":0.008114816,"about_ca_system_score_codex":0.0008620215,"about_ca_system_score_gemma":0.0023316336,"threshold_uncertainty_score":0.016135156},"labels":[],"label_agreement":null},{"id":"W4402571456","doi":"10.1109/tce.2024.3456792","title":"LALDM: A Multimodal Aspect-Level Text Analysis Method and Its Application in Online Consumer Electronics","year":2024,"lang":"en","type":"article","venue":"IEEE Transactions on Consumer Electronics","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"","funders":"Federation for the Humanities and Social Sciences","keywords":"Electronics; Computer science; Electrical engineering; Multimedia; Engineering","score_opus":0.020762111076245916,"score_gpt":0.30057843145128627,"score_spread":0.27981632037504034,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4402571456","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.035626262,0.0007680631,0.95015204,0.00031232755,0.00012698006,0.00025356768,0.000979137,0.008999994,0.002781678],"genre_scores_gemma":[0.24400504,0.000622555,0.7427887,0.00025246487,0.00012189824,0.00035415884,0.0031647396,0.0005723686,0.008118075],"study_design_codex":"design_other","study_design_gemma":"bench_or_experimental","domain_scores_codex":[0.99951947,0.00009210251,0.000045174995,0.0001532173,0.0001509432,0.00003906503],"domain_scores_gemma":[0.9995974,0.00011594911,0.000050103245,0.00004649747,0.00015991625,0.000030233057],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0005717891,0.0010392913,0.0005405793,0.0024390784,0.00048278,0.00090940035,0.0006582638,0.00075717026,0.0026926065],"category_scores_gemma":[0.0013755562,0.00027099877,0.00096173363,0.0012075376,0.00031712308,0.001907309,0.0008385074,0.00077326776,0.0015449411],"study_design_candidate":"bench_or_experimental","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00023882868,0.00014711886,0.00279114,0.0002939456,0.00006374297,0.0004711477,0.00041725734,0.0064585204,0.064316414,0.0028541503,0.011632967,0.9103147],"study_design_scores_gemma":[0.000058500344,0.00020615994,0.006897678,0.00004181565,0.00009222233,0.0007587902,0.00052629673,0.8881523,0.063077964,0.0077552195,0.03233896,0.00009412048],"about_ca_topic_score_codex":0.003288483,"about_ca_topic_score_gemma":0.004837924,"teacher_disagreement_score":0.003288483,"about_ca_system_score_codex":0.00057770696,"about_ca_system_score_gemma":0.0006444578,"threshold_uncertainty_score":0.009007692},"labels":[],"label_agreement":null},{"id":"W4402606258","doi":"10.22541/au.172665939.98271085/v1","title":"Scanning HTML at Tens of Gigabytes per Second on ARM Processors","year":2024,"lang":"en","type":"preprint","venue":"","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Université TÉLUQ","funders":"","keywords":"Computer science; ARM architecture; Parallel computing; Operating system","score_opus":0.02248724263591914,"score_gpt":0.2658976587368829,"score_spread":0.24341041610096378,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4402606258","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.17483139,0.003654357,0.5379032,0.0015776273,0.0005021486,0.00036159542,0.0075271633,0.20073941,0.07290307],"genre_scores_gemma":[0.5468363,0.0020521032,0.39970556,0.0007259449,0.00020582379,0.00033681907,0.009843325,0.0036411048,0.03665304],"study_design_codex":"design_other","study_design_gemma":"bench_or_experimental","domain_scores_codex":[0.9988306,0.0001195976,0.00009851002,0.00026554722,0.0005556893,0.00013006038],"domain_scores_gemma":[0.9982469,0.0005131638,0.00013286917,0.00050739216,0.00051583775,0.00008371423],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0007705615,0.000950409,0.00065438094,0.0014648966,0.00044454922,0.0017963065,0.001087012,0.00082583376,0.020177357],"category_scores_gemma":[0.0039914194,0.00060448865,0.0003701688,0.0023715296,0.00028566606,0.0018200445,0.00081262056,0.00066959165,0.0117519805],"study_design_candidate":"bench_or_experimental","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0020030823,0.00021300229,0.0072052795,0.00048602393,0.00017438772,0.0003654414,0.00034860155,0.0108663235,0.080265656,0.008101528,0.118530266,0.7714404],"study_design_scores_gemma":[0.0004080698,0.0005522101,0.021644752,0.00036561425,0.00022114042,0.0012212784,0.000592314,0.4392783,0.23557808,0.030449847,0.26949787,0.00019038732],"about_ca_topic_score_codex":0.0023327677,"about_ca_topic_score_gemma":0.0023478288,"teacher_disagreement_score":0.020177357,"about_ca_system_score_codex":0.00048839126,"about_ca_system_score_gemma":0.00063028187,"threshold_uncertainty_score":0.067499995},"labels":[],"label_agreement":null},{"id":"W4402897251","doi":"10.1109/iwqos61813.2024.10682841","title":"Every Little Bit Helps: A Semantic-aware Tail Label Understanding Framework","year":2024,"lang":"en","type":"article","venue":"","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Simon Fraser University","funders":"","keywords":"Computer science; Bit (key); Artificial intelligence; Computer network","score_opus":0.06244874694233285,"score_gpt":0.2902957683956629,"score_spread":0.22784702145333005,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4402897251","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.009254832,0.00041145826,0.9822534,0.0007769636,0.00006940876,0.00008712511,0.00079233694,0.0029514115,0.0034030427],"genre_scores_gemma":[0.20624925,0.0004901978,0.7830057,0.0006028946,0.00011064021,0.00015273795,0.0026820193,0.0003912822,0.00631533],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9991672,0.00019855502,0.000045812343,0.00021385461,0.0002858287,0.00008865156],"domain_scores_gemma":[0.9985103,0.0005510472,0.0001150897,0.00036734587,0.00033151568,0.00012467125],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0014019161,0.0006438381,0.0007549166,0.0017312338,0.0012021798,0.0017740494,0.002358682,0.0017871344,0.0025651753],"category_scores_gemma":[0.004100679,0.00038164793,0.0012147167,0.0022425533,0.0011364796,0.0048562605,0.0022739982,0.0020239817,0.0013331115],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0005681202,0.00068421476,0.0075285165,0.00027899139,0.00020442635,0.0004428235,0.0010662001,0.12888445,0.012270098,0.21166258,0.03672476,0.5996848],"study_design_scores_gemma":[0.000022939395,0.000059884638,0.0004570067,0.000033100907,0.00005754899,0.00009504833,0.00015248361,0.8251977,0.0035400107,0.15566887,0.014678967,0.00003650585],"about_ca_topic_score_codex":0.010810818,"about_ca_topic_score_gemma":0.02719885,"teacher_disagreement_score":0.010810818,"about_ca_system_score_codex":0.00082196796,"about_ca_system_score_gemma":0.0022332624,"threshold_uncertainty_score":0.02149582},"labels":[],"label_agreement":null},{"id":"W4403447917","doi":"10.1109/vl/hcc60511.2024.00032","title":"FlexDoc: Flexible Document Adaptation through Optimizing both Content and Layout","year":2024,"lang":"en","type":"article","venue":"","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":2,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Simon Fraser University","funders":"Engineering and Physical Sciences Research Council","keywords":"Adaptation (eye); Computer science; Content adaptation; Content (measure theory); Information retrieval; Human–computer interaction; Ubiquitous computing","score_opus":0.07299222884257507,"score_gpt":0.28701245141584264,"score_spread":0.21402022257326758,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4403447917","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.020993259,0.0005280945,0.9591342,0.000118163895,0.00006544857,0.00010926049,0.00031200962,0.015397822,0.0033417863],"genre_scores_gemma":[0.16532327,0.00044108607,0.8213087,0.00018697164,0.000049955463,0.00023347732,0.0012834581,0.004601369,0.0065715895],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9991756,0.00016569856,0.000051924508,0.00020255534,0.00034150344,0.00006271145],"domain_scores_gemma":[0.9980988,0.00066665636,0.00016134362,0.0006198543,0.00034132606,0.000111970476],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0011193826,0.0013146232,0.0007782436,0.0010618666,0.00051357475,0.0020495798,0.001799758,0.0010235016,0.003825303],"category_scores_gemma":[0.0042689336,0.0005667695,0.0007636492,0.00109015,0.00067925453,0.0021175072,0.0019634827,0.0012107596,0.0024750554],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0003323012,0.00032208228,0.0031777134,0.0006940056,0.00013530342,0.00042583316,0.00073387945,0.11856805,0.14977504,0.010432849,0.029926296,0.6854766],"study_design_scores_gemma":[0.00010987306,0.0002655405,0.0020683655,0.00006250207,0.000075500175,0.00071380526,0.00036185625,0.8077248,0.11700276,0.010753831,0.060709637,0.00015157726],"about_ca_topic_score_codex":0.0015404263,"about_ca_topic_score_gemma":0.0032763288,"teacher_disagreement_score":0.003825303,"about_ca_system_score_codex":0.0005292436,"about_ca_system_score_gemma":0.0006865076,"threshold_uncertainty_score":0.012796938},"labels":[],"label_agreement":null},{"id":"W4403744840","doi":"10.18280/isi.290529","title":"Discrete Bat Algorithm for Efficient Multi-Document Summarization","year":2024,"lang":"fr","type":"article","venue":"Ingénierie des systèmes d information","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":3,"is_retracted":false,"has_abstract":false,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":true,"route_about_ca":false,"ca_institutions":"","funders":"","keywords":"Automatic summarization; Computer science; Algorithm; Artificial intelligence","score_opus":0.020259862985473436,"score_gpt":0.26542043083483174,"score_spread":0.2451605678493583,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4403744840","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0051400834,0.0005545263,0.99178493,0.00017338802,0.00014959717,0.00005121392,0.0001770305,0.0010175662,0.0009516341],"genre_scores_gemma":[0.102253266,0.0005000652,0.8861301,0.00022635284,0.00024840777,0.00024428457,0.0012461654,0.00024786138,0.00890351],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9990287,0.00025316325,0.00007851072,0.00020456433,0.0003464201,0.00008869043],"domain_scores_gemma":[0.9985935,0.0006507937,0.00007974193,0.00015790437,0.00044659918,0.000071404786],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.00092137174,0.0007188065,0.0017363168,0.0012468618,0.0006978047,0.0013958937,0.0014959744,0.0012505453,0.0052244607],"category_scores_gemma":[0.0027530654,0.000449876,0.00064753095,0.0022002491,0.00045174168,0.0015729009,0.00092223514,0.0015569822,0.0029065928],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0005154363,0.0001778502,0.00033551326,0.00033366797,0.000119207056,0.00009877176,0.00012556072,0.13738804,0.022101691,0.016411982,0.015384449,0.80700785],"study_design_scores_gemma":[0.000051344636,0.0001031705,0.00021977427,0.000012124391,0.000025048206,0.00008385231,0.000026029651,0.98326844,0.004209439,0.00795049,0.004033261,0.00001704673],"about_ca_topic_score_codex":0.00286526,"about_ca_topic_score_gemma":0.003782375,"teacher_disagreement_score":0.0052244607,"about_ca_system_score_codex":0.0005127552,"about_ca_system_score_gemma":0.0014269977,"threshold_uncertainty_score":0.017477572},"labels":[],"label_agreement":null},{"id":"W4404180996","doi":"10.2139/ssrn.5014547","title":"Group Matching Method for Search-Space Reduction: Development, Proof, and Comparison","year":2024,"lang":"en","type":"preprint","venue":"SSRN Electronic Journal","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":0,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Regina","funders":"","keywords":"Reduction (mathematics); Matching (statistics); Proof of concept; Development (topology); Space (punctuation); Group (periodic table); Computer science; Mathematics; Algorithm; Statistics; Physics; Geometry; Mathematical analysis","score_opus":0.02799141617354471,"score_gpt":0.32879422846141804,"score_spread":0.3008028122878733,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4404180996","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0034132968,0.00077622983,0.9882615,0.00081886625,0.00022262424,0.00020442148,0.00010819419,0.0009970374,0.0051977932],"genre_scores_gemma":[0.1453226,0.0015433771,0.83888966,0.0010289107,0.00083735696,0.00085787335,0.00057455985,0.0009893517,0.009956298],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9911867,0.0024588187,0.00043288516,0.001410205,0.0037918289,0.00071951293],"domain_scores_gemma":[0.9817577,0.009733341,0.00057785294,0.005234278,0.0022116452,0.00048530402],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.005615199,0.0014788749,0.0027894513,0.0040508374,0.0017008949,0.0030249374,0.0049421834,0.0034111578,0.015293753],"category_scores_gemma":[0.027046317,0.00088753813,0.003270973,0.005846961,0.004237911,0.008894815,0.006835505,0.005373929,0.0044485293],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.000616809,0.0006104523,0.0012272064,0.0008579702,0.00031253067,0.00014356564,0.00036884125,0.03353364,0.0054727816,0.47837773,0.024908088,0.45357051],"study_design_scores_gemma":[0.00027422703,0.00035381335,0.00062570977,0.0001292149,0.00028360274,0.00045971756,0.00017121376,0.34103176,0.007980432,0.6276657,0.02094856,0.00007614785],"about_ca_topic_score_codex":0.0022392566,"about_ca_topic_score_gemma":0.0020862492,"teacher_disagreement_score":0.015293753,"about_ca_system_score_codex":0.0018797795,"about_ca_system_score_gemma":0.0047533205,"threshold_uncertainty_score":0.05116266},"labels":[],"label_agreement":null},{"id":"W4404514816","doi":"10.1145/3689944.3696168","title":"What's in a URL? An Analysis of Hardcoded URLs in npm Packages","year":2023,"lang":"en","type":"article","venue":"","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Calgary","funders":"","keywords":"Computer science; World Wide Web; Information retrieval","score_opus":0.03086991434910744,"score_gpt":0.30384198385611716,"score_spread":0.2729720695070097,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4404514816","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.9843978,0.0007107909,0.008539534,0.00034786348,0.0000424632,0.000057034427,0.001611179,0.0011021893,0.003191023],"genre_scores_gemma":[0.97597325,0.00034688774,0.017077517,0.00017294775,0.00004032183,0.000049605304,0.0040619676,0.0005079159,0.0017696446],"study_design_codex":"observational","study_design_gemma":"observational","domain_scores_codex":[0.9966169,0.00078497775,0.00033463966,0.00045413483,0.0015100397,0.00029924817],"domain_scores_gemma":[0.9473323,0.030240161,0.009314461,0.0063562733,0.00572144,0.0010354382],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.002439783,0.0003770733,0.0004749172,0.0068414123,0.0009603479,0.0019446383,0.0006049241,0.0010138222,0.000836166],"category_scores_gemma":[0.02866473,0.0003540436,0.0005693107,0.006496977,0.0015579364,0.0030347172,0.0017018651,0.0013562416,0.0007326391],"study_design_candidate":"observational","study_design_consensus":"observational","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0012615597,0.00077998947,0.7403329,0.000882082,0.00019948022,0.008010737,0.009947599,0.009567014,0.022703484,0.017006304,0.013154551,0.1761543],"study_design_scores_gemma":[0.000041447634,0.0004864966,0.71178454,0.00048527564,0.00024668864,0.01191377,0.006573143,0.16364561,0.027234918,0.019993702,0.057309277,0.00028507214],"about_ca_topic_score_codex":0.0028671667,"about_ca_topic_score_gemma":0.0022521396,"teacher_disagreement_score":0.0068414123,"about_ca_system_score_codex":0.0008024953,"about_ca_system_score_gemma":0.00059619494,"threshold_uncertainty_score":0.012902975},"labels":[],"label_agreement":null},{"id":"W4404572650","doi":"10.2139/ssrn.5029273","title":"Extracting Information from Reddit for Emergency Management - a Case Study on British Columbia Wildfire","year":2024,"lang":"en","type":"preprint","venue":"SSRN Electronic Journal","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":2,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":true,"ca_institutions":"University of Calgary","funders":"","keywords":"Emergency management; Geography; History; Environmental resource management; Political science; Environmental science","score_opus":0.013343250222386827,"score_gpt":0.2681041399708129,"score_spread":0.2547608897484261,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4404572650","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.98113614,0.00057805044,0.0037821436,0.0009402835,0.00003304074,0.00022477645,0.0035846473,0.00039341854,0.009327559],"genre_scores_gemma":[0.95748115,0.0007320724,0.026055083,0.0001637795,0.00001602466,0.0000574691,0.006322916,0.0001415489,0.009029984],"study_design_codex":"design_other","study_design_gemma":"observational","domain_scores_codex":[0.99943405,0.00008829096,0.0000411802,0.000077680255,0.0002754188,0.000083288454],"domain_scores_gemma":[0.9964211,0.0018548563,0.00020088023,0.0003509469,0.001002494,0.00016975767],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0009956904,0.00039800396,0.00030176036,0.0028395203,0.002057813,0.0018048752,0.00089896703,0.001088089,0.0016661445],"category_scores_gemma":[0.0043792003,0.00024822156,0.00024966206,0.004462354,0.0006756719,0.0009738629,0.0006688913,0.0007518185,0.00041866873],"study_design_candidate":"observational","study_design_consensus":null,"about_ca_topic_candidate":true,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.000908535,0.0011829484,0.3027352,0.0012244694,0.00015745252,0.02565731,0.015342549,0.028921071,0.030255359,0.0024760107,0.039683234,0.5514558],"study_design_scores_gemma":[0.00011258342,0.00039677465,0.59137505,0.0008059264,0.00044488427,0.0047204085,0.054198235,0.1681547,0.042822823,0.003594901,0.13314277,0.00023083398],"about_ca_topic_score_codex":0.42618433,"about_ca_topic_score_gemma":0.7212183,"teacher_disagreement_score":0.5738157,"about_ca_system_score_codex":0.00290091,"about_ca_system_score_gemma":0.0031054162,"threshold_uncertainty_score":0.84740734},"labels":[],"label_agreement":null},{"id":"W4404573117","doi":"10.5206/cjils-rcsib.v47i3.18988","title":"Lack of Collections as Data","year":2024,"lang":"en","type":"article","venue":"Canadian Journal of Information and Library Science","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":true,"route_about_ca":true,"ca_institutions":"Concordia University","funders":"","keywords":"Data science; Computer science","score_opus":0.031295588292527605,"score_gpt":0.25733587994817675,"score_spread":0.22604029165564915,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4404573117","genre_codex":"other","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.1308234,0.018299235,0.05772082,0.14946705,0.0048882794,0.0031786214,0.09109012,0.001757844,0.54277456],"genre_scores_gemma":[0.74738514,0.017744554,0.060443755,0.026191685,0.0031996493,0.0041051097,0.045514118,0.0027168475,0.09269912],"study_design_codex":"design_other","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.85503274,0.040438734,0.01753656,0.016975602,0.065476775,0.0045395344],"domain_scores_gemma":[0.6199421,0.15014274,0.03748547,0.09475552,0.0877809,0.009893225],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.072479665,0.00065499684,0.0015740583,0.01677287,0.010892778,0.03177315,0.0068305125,0.0024048083,0.021378597],"category_scores_gemma":[0.27721703,0.0020742738,0.0007769446,0.04017551,0.0140233,0.032608602,0.017228514,0.005089063,0.0067624706],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00050796353,0.00014379519,0.067903355,0.005501714,0.00021334167,0.0010129217,0.09743756,0.000849549,0.0021668389,0.30763087,0.19209495,0.3245371],"study_design_scores_gemma":[0.00001588986,0.00003207756,0.01304343,0.0025454054,0.00005811139,0.0004285468,0.0339086,0.0003145054,0.0009337952,0.01703041,0.93160146,0.00008770433],"about_ca_topic_score_codex":0.18623249,"about_ca_topic_score_gemma":0.1810824,"teacher_disagreement_score":0.18623249,"about_ca_system_score_codex":0.026501477,"about_ca_system_score_gemma":0.050391067,"threshold_uncertainty_score":0.38331372},"labels":[],"label_agreement":null},{"id":"W4405138524","doi":"10.1007/s00521-024-10408-7","title":"AI-UNet: Attention Information-based deep URL Network for adult webpage classification","year":2024,"lang":"en","type":"article","venue":"Neural Computing and Applications","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":0,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Waterloo","funders":"Science and Engineering Research Board","keywords":"Computational Science and Engineering; Computer science; Artificial intelligence; Web page; Information retrieval; Machine learning; Data mining; World Wide Web","score_opus":0.013932700842538533,"score_gpt":0.2715575898749068,"score_spread":0.25762488903236824,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4405138524","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.17603849,0.007658381,0.6953059,0.0023119098,0.0027488614,0.00064647215,0.019239161,0.07609375,0.019957146],"genre_scores_gemma":[0.66022027,0.0017003983,0.26706383,0.0016275758,0.0006397865,0.000628308,0.020575685,0.00091568957,0.046628475],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.999739,0.000031778465,0.000011490227,0.00009911748,0.00005366108,0.000064984175],"domain_scores_gemma":[0.9995345,0.00013450344,0.000032227148,0.000076035336,0.00014670221,0.00007611747],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0006465686,0.0014246507,0.0010094512,0.0012717728,0.0005487647,0.00075503933,0.002030416,0.0016294973,0.0087313615],"category_scores_gemma":[0.0016040793,0.00048116723,0.0009654426,0.0012008654,0.00028901175,0.0017348025,0.0016667641,0.0023226035,0.004130495],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.000525456,0.0007647367,0.004011216,0.0002192389,0.00018952548,0.00023087156,0.00007336926,0.029830707,0.012695553,0.0028580853,0.080605485,0.8679958],"study_design_scores_gemma":[0.00004567939,0.00015589599,0.0014879275,0.000035467652,0.000070568756,0.00010054503,0.00002866621,0.9801737,0.007492891,0.005310649,0.0050712903,0.00002667763],"about_ca_topic_score_codex":0.015226712,"about_ca_topic_score_gemma":0.026937596,"teacher_disagreement_score":0.015226712,"about_ca_system_score_codex":0.0010356599,"about_ca_system_score_gemma":0.0010309431,"threshold_uncertainty_score":0.03027618},"labels":[],"label_agreement":null},{"id":"W4406887032","doi":"10.1007/978-3-031-79007-2_2","title":"Towards Exploring Cross-Regional and Cross-Platform Differences in Login Throttling","year":2025,"lang":"en","type":"book-chapter","venue":"Lecture notes in computer science","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":0,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Carleton University","funders":"","keywords":"Login; Computer science; Cross-platform; Bandwidth throttling; Operating system; Computer graphics (images); Engineering","score_opus":0.07895612646373804,"score_gpt":0.2994523595525498,"score_spread":0.22049623308881175,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4406887032","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.937498,0.0004214918,0.02768806,0.0005309129,0.00004030382,0.00004596848,0.00062547374,0.0003721032,0.032777686],"genre_scores_gemma":[0.99241555,0.00006238038,0.0049281786,0.000047738286,0.000007486227,0.000011497796,0.00026199679,0.00007322247,0.0021920097],"study_design_codex":"observational","study_design_gemma":"observational","domain_scores_codex":[0.999183,0.000237168,0.000033091448,0.00023339399,0.00018566508,0.00012756765],"domain_scores_gemma":[0.99426913,0.0033235846,0.0007952585,0.0005620307,0.00082977803,0.00022007508],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0017854747,0.00022374104,0.0002566886,0.00092231727,0.00044491547,0.0037035472,0.0006981901,0.00054442056,0.0053940094],"category_scores_gemma":[0.0105784265,0.00025065377,0.00035102424,0.0016863493,0.00055909244,0.003716426,0.0012994275,0.0010786487,0.0012624022],"study_design_candidate":"observational","study_design_consensus":"observational","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0013493019,0.0005780331,0.6552889,0.00029824252,0.00037878807,0.00036560366,0.009111668,0.022443518,0.031291056,0.038607355,0.0050290194,0.23525856],"study_design_scores_gemma":[0.000025223326,0.00023584734,0.8461196,0.00009999871,0.00015662021,0.00017880466,0.014674298,0.09452892,0.008732334,0.023593552,0.01157047,0.00008435565],"about_ca_topic_score_codex":0.009007765,"about_ca_topic_score_gemma":0.013319689,"teacher_disagreement_score":0.009007765,"about_ca_system_score_codex":0.00072417577,"about_ca_system_score_gemma":0.00064784515,"threshold_uncertainty_score":0.01804477},"labels":[],"label_agreement":null},{"id":"W4406937501","doi":"10.1007/s10502-025-09475-z","title":"Conceptualizing aggregate-level description in web archives","year":2025,"lang":"en","type":"article","venue":"Archival Science","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"","funders":"Social Sciences and Humanities Research Council; Social Sciences and Humanities Research Council of Canada","keywords":"Cultural heritage; Web application; Aggregate (composite); World Wide Web; History; Data science; Geography; Computer science; Archaeology","score_opus":0.03931571689309058,"score_gpt":0.28205240739156784,"score_spread":0.24273669049847726,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4406937501","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.13419227,0.004882377,0.7006361,0.012519368,0.00028235454,0.00045865687,0.0009829531,0.0007498305,0.14529614],"genre_scores_gemma":[0.83070767,0.0022992603,0.15645911,0.0005207423,0.00018578178,0.0005402894,0.0009556909,0.00022674797,0.008104793],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.99009806,0.0051777186,0.0011646533,0.00092296506,0.0021070875,0.00052948506],"domain_scores_gemma":[0.98454595,0.0079954965,0.0016998444,0.0036738177,0.0015700434,0.0005149255],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.011177573,0.00047052314,0.00061847345,0.010437115,0.004990531,0.019589338,0.002190756,0.002358295,0.0030471787],"category_scores_gemma":[0.019583246,0.0006149028,0.00093569997,0.013837759,0.017592955,0.03417632,0.009209013,0.0028981336,0.0005257359],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.000009948252,0.000009042873,0.0021647983,0.00006800646,0.000012340602,0.00013885734,0.022293026,0.000858038,0.00014581227,0.9644979,0.0004999031,0.009302219],"study_design_scores_gemma":[0.000009321625,0.000024336596,0.0022616463,0.00039916643,0.00005195294,0.00055485906,0.037587117,0.008512066,0.00066100346,0.8494827,0.10041503,0.000040777006],"about_ca_topic_score_codex":0.01135402,"about_ca_topic_score_gemma":0.0073264292,"teacher_disagreement_score":0.019589338,"about_ca_system_score_codex":0.0059159123,"about_ca_system_score_gemma":0.004158668,"threshold_uncertainty_score":0.059113324},"labels":[],"label_agreement":null},{"id":"W4407114865","doi":"10.22541/au.173865299.90947187/v1","title":"Clustering Textual Features for Log Summarization in Large Software Systems","year":2025,"lang":"en","type":"preprint","venue":"","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":1,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Polytechnique Montréal","funders":"Natural Sciences and Engineering Research Council of Canada; Compute Canada","keywords":"Automatic summarization; Computer science; Cluster analysis; Software; Data mining; Artificial intelligence; Information retrieval; Programming language","score_opus":0.01947680944847312,"score_gpt":0.2768511037566182,"score_spread":0.25737429430814507,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4407114865","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.33861172,0.0023413848,0.6180473,0.0010289447,0.0002578219,0.0009490624,0.014771873,0.021613982,0.0023779285],"genre_scores_gemma":[0.5640582,0.0005891917,0.4013266,0.0001236831,0.0003024394,0.00063833036,0.030139348,0.0007132355,0.0021089888],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9988876,0.0002693616,0.00016760072,0.0002886578,0.00029798297,0.00008879706],"domain_scores_gemma":[0.9925962,0.003397295,0.0013744762,0.0006725756,0.0017311223,0.00022831917],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0012628152,0.0010542154,0.00077309203,0.008666468,0.0007397478,0.0013286056,0.0009236064,0.00085243303,0.0013261321],"category_scores_gemma":[0.009939871,0.00029024744,0.00074287347,0.0054270593,0.0003300973,0.0021271573,0.0007851121,0.0008356129,0.0015102071],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00082037516,0.00055961293,0.028781934,0.0014287287,0.00018728765,0.00042556264,0.0013761891,0.026957914,0.042901132,0.0016116145,0.023659546,0.87129015],"study_design_scores_gemma":[0.00012517853,0.0006064029,0.063072614,0.00022290875,0.0002897071,0.0005455599,0.0023034322,0.84718955,0.049048916,0.01220594,0.024243252,0.00014652255],"about_ca_topic_score_codex":0.0025826257,"about_ca_topic_score_gemma":0.0056797266,"teacher_disagreement_score":0.008666468,"about_ca_system_score_codex":0.00057818735,"about_ca_system_score_gemma":0.0007113127,"threshold_uncertainty_score":0.006678462},"labels":[],"label_agreement":null},{"id":"W4407942167","doi":"10.1016/j.jaip.2025.02.019","title":"Diagnosing and Managing Drug Reaction With Eosinophilia and Systemic Symptoms (DRESS) Amidst Remaining Uncertainty","year":2025,"lang":"en","type":"article","venue":"The Journal of Allergy and Clinical Immunology In Practice","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":3,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Sunnybrook Health Science Centre","funders":"National Institutes of Health","keywords":"Medicine; MEDLINE; Law","score_opus":0.011431487610594251,"score_gpt":0.30272468343486053,"score_spread":0.29129319582426627,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4407942167","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.39569783,0.110576436,0.2884719,0.16011691,0.0026789894,0.0013777019,0.0038797194,0.0027300555,0.034470472],"genre_scores_gemma":[0.7334876,0.057568073,0.18590485,0.014714306,0.00307667,0.00031851596,0.0024712628,0.00024254479,0.0022161438],"study_design_codex":"design_other","study_design_gemma":"not_applicable","domain_scores_codex":[0.99472976,0.0021177754,0.0011338083,0.00049447105,0.0012300872,0.00029420012],"domain_scores_gemma":[0.9841176,0.0102452235,0.0020279204,0.00078499335,0.0020132891,0.00081099314],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0078230435,0.0005528192,0.0012088122,0.0040088804,0.0010075215,0.0037544807,0.001051421,0.001330858,0.0019262449],"category_scores_gemma":[0.038545437,0.00032219468,0.00075991056,0.0018264567,0.00086962135,0.0027733159,0.002023135,0.002705448,0.0010233505],"study_design_candidate":"not_applicable","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00036735277,0.00023077012,0.25149146,0.0019585392,0.000318922,0.012378515,0.0018396898,0.0041052136,0.0030655987,0.0039979317,0.037053216,0.6831928],"study_design_scores_gemma":[0.00020764649,0.0009317206,0.21600132,0.015042035,0.001250856,0.13564284,0.021759912,0.10866761,0.019530727,0.15136355,0.32902396,0.0005778637],"about_ca_topic_score_codex":0.0016601146,"about_ca_topic_score_gemma":0.003022985,"teacher_disagreement_score":0.0078230435,"about_ca_system_score_codex":0.0005881139,"about_ca_system_score_gemma":0.0018375131,"threshold_uncertainty_score":0.041372716},"labels":[],"label_agreement":null},{"id":"W4408500266","doi":"10.1002/spe.3420","title":"Scanning HTML at Tens of Gigabytes Per Second on ARM Processors","year":2025,"lang":"en","type":"article","venue":"Software Practice and Experience","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Université TÉLUQ; Université du Québec à Montréal","funders":"Natural Sciences and Engineering Research Council of Canada","keywords":"Computer science; Operating system","score_opus":0.012210890309218783,"score_gpt":0.2917902655946673,"score_spread":0.2795793752854485,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4408500266","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.4717845,0.0030878638,0.34512487,0.0011072544,0.000312504,0.00030736614,0.004191886,0.1257685,0.048315156],"genre_scores_gemma":[0.780702,0.00091505033,0.20126796,0.00029951372,0.000081124424,0.00016889459,0.004258581,0.0011289244,0.011178032],"study_design_codex":"design_other","study_design_gemma":"bench_or_experimental","domain_scores_codex":[0.99924314,0.000085206906,0.00007271789,0.00019012493,0.00031999475,0.000088956585],"domain_scores_gemma":[0.9984877,0.00049895886,0.00012845677,0.00030450162,0.0005035986,0.00007673044],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.00059085456,0.0007571623,0.0003610369,0.0012715457,0.0003909056,0.0010942088,0.0008885073,0.0004237787,0.009923591],"category_scores_gemma":[0.0023599975,0.00032563042,0.00024999218,0.00188707,0.0002527565,0.0011075267,0.00055786496,0.0004742113,0.0033091279],"study_design_candidate":"bench_or_experimental","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.002469267,0.00032517343,0.013804741,0.0005463376,0.00016793769,0.00052569667,0.00042220214,0.02616298,0.113857634,0.006671849,0.048632037,0.7864142],"study_design_scores_gemma":[0.00029525356,0.0008036352,0.022796791,0.00021444223,0.00015173072,0.0006790904,0.00046639558,0.5909233,0.2870277,0.012159563,0.08435827,0.00012381173],"about_ca_topic_score_codex":0.0029037972,"about_ca_topic_score_gemma":0.0029225063,"teacher_disagreement_score":0.009923591,"about_ca_system_score_codex":0.0006421559,"about_ca_system_score_gemma":0.0006791548,"threshold_uncertainty_score":0.0331977},"labels":[],"label_agreement":null},{"id":"W4408738728","doi":"10.23977/jnca.2025.100106","title":"Entity Relation Extraction for Table Filling Based on Dynamic Convolution","year":2025,"lang":"en","type":"article","venue":"Journal of Network Computing and Applications","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":true,"route_about_ca":false,"ca_institutions":"","funders":"","keywords":"Relation (database); Table (database); Convolution (computer science); Relationship extraction; Computer science; Extraction (chemistry); Algorithm; Mathematics; Arithmetic; Data mining; Artificial intelligence; Chromatography","score_opus":0.01005511350812982,"score_gpt":0.288876106385591,"score_spread":0.2788209928774612,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4408738728","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.008949567,0.0003223722,0.9843779,0.00023343044,0.000051635114,0.0000562906,0.00062475965,0.0035283589,0.001855651],"genre_scores_gemma":[0.24224964,0.00074706675,0.7439539,0.00037252324,0.00009819019,0.00017266703,0.004543675,0.0005316623,0.0073307212],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.99931407,0.000080139835,0.0000501399,0.00026192126,0.0002130717,0.000080663],"domain_scores_gemma":[0.9991629,0.00028827152,0.00007056237,0.00031539044,0.00013258877,0.000030341636],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.00086080015,0.00085780874,0.0011297405,0.0017793637,0.00064831175,0.0021945073,0.0020824515,0.0012148248,0.0045644515],"category_scores_gemma":[0.002896624,0.0005066818,0.0014949369,0.0029701355,0.0006378927,0.0050351555,0.001880693,0.0012404663,0.0025127768],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0004454654,0.00020275974,0.0037288938,0.00029766143,0.00014109451,0.0006862663,0.00032322799,0.14677174,0.03425015,0.060194813,0.02485557,0.7281025],"study_design_scores_gemma":[0.00001020291,0.00002696209,0.0006137699,0.000013037294,0.000031366093,0.0003338918,0.000040908628,0.95472866,0.010934211,0.024536047,0.008710271,0.000020702759],"about_ca_topic_score_codex":0.0065734847,"about_ca_topic_score_gemma":0.010493338,"teacher_disagreement_score":0.0065734847,"about_ca_system_score_codex":0.001054691,"about_ca_system_score_gemma":0.0016280814,"threshold_uncertainty_score":0.015269637},"labels":[],"label_agreement":null},{"id":"W4408750113","doi":"10.14722/ndss.2025.230366","title":"EvoCrawl: Exploring Web Application Code and State using Evolutionary Search","year":2025,"lang":"en","type":"article","venue":"","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Toronto","funders":"Natural Sciences and Engineering Research Council of Canada","keywords":"Computer science; Code (set theory); Programming language; State (computer science); Theoretical computer science","score_opus":0.05987192101028712,"score_gpt":0.30022626561034826,"score_spread":0.24035434460006114,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4408750113","genre_codex":"empirical","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.53361464,0.0022393882,0.42853367,0.0008370488,0.00011201848,0.0005831367,0.0035423583,0.023494279,0.0070435107],"genre_scores_gemma":[0.48958528,0.00039045932,0.49892414,0.00029171337,0.000024151113,0.00042996512,0.007264313,0.0011667684,0.0019232347],"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.99893326,0.00032225696,0.00007313859,0.00029462372,0.0002760158,0.00010076688],"domain_scores_gemma":[0.99638027,0.002705789,0.00023263457,0.00029441214,0.00030467633,0.00008215775],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0017637702,0.0013876661,0.00091916387,0.005020054,0.00066998583,0.0012582048,0.001890494,0.0013644886,0.0013362353],"category_scores_gemma":[0.008306817,0.00070791016,0.001221418,0.0020106654,0.00067813165,0.0013194638,0.0013261568,0.00086514145,0.0004993437],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00042418166,0.00083058106,0.06462611,0.0013508765,0.0007177609,0.0012362694,0.0012260288,0.48610026,0.020679325,0.012560827,0.0153095,0.39493823],"study_design_scores_gemma":[0.00004457428,0.00007530297,0.0022641656,0.00003304131,0.0000473303,0.00010679932,0.00017039746,0.9873181,0.002071051,0.0050652935,0.0027847239,0.000019253848],"about_ca_topic_score_codex":0.007816777,"about_ca_topic_score_gemma":0.015307094,"teacher_disagreement_score":0.007816777,"about_ca_system_score_codex":0.0009880997,"about_ca_system_score_gemma":0.0015964729,"threshold_uncertainty_score":0.015542567},"labels":[],"label_agreement":null},{"id":"W4409166892","doi":"10.1007/978-3-031-88720-8_48","title":"The Second Search Futures Workshop at ECIR’25","year":2025,"lang":"en","type":"book-chapter","venue":"Lecture notes in computer science","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":0,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Nuvo Pharmaceuticals (Canada); University of Waterloo","funders":"","keywords":"Futures contract; Computer science; Financial economics; Economics","score_opus":0.01779428728388715,"score_gpt":0.2622388455176787,"score_spread":0.24444455823379152,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4409166892","genre_codex":"other","genre_gemma":"other","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"other","genre_consensus":"other","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.040097572,0.04487164,0.19934502,0.10596839,0.11843359,0.0011655717,0.022107806,0.021904368,0.44610602],"genre_scores_gemma":[0.069882795,0.0052016103,0.049537983,0.0068923477,0.0045662485,0.00056026055,0.020624794,0.004113439,0.8386204],"study_design_codex":"not_applicable","study_design_gemma":"not_applicable","domain_scores_codex":[0.9964367,0.0010112429,0.00011692197,0.000568838,0.0012402054,0.0006260671],"domain_scores_gemma":[0.99423873,0.0014795588,0.000075251235,0.00078760594,0.0016861331,0.0017327174],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.008149593,0.0019390825,0.0020289854,0.0017638752,0.0030456956,0.011699675,0.0027493134,0.0040761866,0.099942386],"category_scores_gemma":[0.008036688,0.0007746425,0.001380707,0.0016895544,0.001300618,0.008534907,0.0038243511,0.0046102284,0.06742333],"study_design_candidate":"not_applicable","study_design_consensus":"not_applicable","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0005268695,0.00018999637,0.00026577793,0.00021100572,0.00002952173,0.000118409895,0.00034961684,0.00073573267,0.0026882007,0.01173762,0.90386575,0.07928153],"study_design_scores_gemma":[0.00010614196,0.00015178244,0.00048190338,0.0001277716,0.00003357809,0.00012917815,0.00064367213,0.0047613555,0.0038679359,0.0140455505,0.975594,0.000056968653],"about_ca_topic_score_codex":0.015135261,"about_ca_topic_score_gemma":0.024805408,"teacher_disagreement_score":0.099942386,"about_ca_system_score_codex":0.003296885,"about_ca_system_score_gemma":0.005505931,"threshold_uncertainty_score":0.33434057},"labels":[],"label_agreement":null},{"id":"W4409692806","doi":"10.63485/6nagy-whm74","title":"Another reason to dislike PDF&amp;#39;s","year":2005,"lang":"en","type":"preprint","venue":"","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":true,"ca_institutions":"","funders":"","keywords":"Economics","score_opus":0.031441779721191505,"score_gpt":0.27955081438632745,"score_spread":0.24810903466513595,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4409692806","genre_codex":"commentary","genre_gemma":"commentary","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"commentary","genre_consensus":"commentary","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.010062271,0.00312008,0.0033637595,0.62361574,0.022313658,0.000042239146,0.0010837755,0.0015681366,0.33483034],"genre_scores_gemma":[0.08037066,0.0018641592,0.0026766497,0.25992578,0.008124848,0.000054703047,0.0006987907,0.0013737866,0.64491063],"study_design_codex":"not_applicable","study_design_gemma":"not_applicable","domain_scores_codex":[0.995756,0.0006577606,0.00016700503,0.00042409007,0.0025653022,0.00042981116],"domain_scores_gemma":[0.9815896,0.0042228387,0.0010396161,0.0016505317,0.008360419,0.0031369564],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0032517307,0.00046838564,0.0003650138,0.0012352172,0.008393544,0.009922829,0.00104966,0.010463871,0.119164206],"category_scores_gemma":[0.020655544,0.000346866,0.0005175627,0.0016143387,0.0039620255,0.0088510355,0.0021889398,0.008421997,0.04891752],"study_design_candidate":"not_applicable","study_design_consensus":"not_applicable","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.000025845666,0.000017646387,0.0008219186,0.00002786365,0.000003625273,0.00041525153,0.0007157974,0.000023507087,0.0003166875,0.007041025,0.9753422,0.015248662],"study_design_scores_gemma":[0.0000075295093,0.000022053662,0.0013102138,0.000041006257,0.0000021631079,0.0013071892,0.0014905473,0.00005688791,0.0002679662,0.0012192049,0.9942515,0.000023805183],"about_ca_topic_score_codex":0.010359099,"about_ca_topic_score_gemma":0.016808754,"teacher_disagreement_score":0.119164206,"about_ca_system_score_codex":0.0024134733,"about_ca_system_score_gemma":0.0016807809,"threshold_uncertainty_score":0.39864397},"labels":[],"label_agreement":null},{"id":"W4409787574","doi":"10.61091/jcmcc127a-364","title":"Improved Web Page Categorization with Semantic-Aware Focused Crawling Using GloVe and TF-IDF","year":2025,"lang":"en","type":"article","venue":"Journal of Combinatorial Mathematics and Combinatorial Computing","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":true,"route_about_ca":false,"ca_institutions":"","funders":"","keywords":"Categorization; Computer science; Information retrieval; Crawling; World Wide Web; Natural language processing; Artificial intelligence; Medicine","score_opus":0.01147456424054291,"score_gpt":0.24480942934840252,"score_spread":0.2333348651078596,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4409787574","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.10173483,0.001630319,0.88671345,0.00016982887,0.00012762303,0.00022850877,0.0005974898,0.0076388232,0.0011591594],"genre_scores_gemma":[0.35311997,0.00085699843,0.6360706,0.000259147,0.00012187159,0.00032061755,0.0036341,0.00032760028,0.0052891024],"study_design_codex":"design_other","study_design_gemma":"bench_or_experimental","domain_scores_codex":[0.9990889,0.00013325064,0.00007899252,0.00023782012,0.00038108908,0.000079933954],"domain_scores_gemma":[0.9985642,0.00035682638,0.0001374317,0.0001981402,0.0006897165,0.00005366574],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.00070206303,0.000989989,0.0014569368,0.004803177,0.00045851804,0.0010203394,0.0008210337,0.001079413,0.0007219308],"category_scores_gemma":[0.0026718574,0.00032052217,0.0014669928,0.002624536,0.0002989096,0.0023245742,0.0005750835,0.0006752956,0.0012155424],"study_design_candidate":"bench_or_experimental","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00021932456,0.0004453306,0.0043296088,0.00022522954,0.00015653417,0.0001626596,0.00021185433,0.020768441,0.0511023,0.0011347963,0.0073237987,0.91392004],"study_design_scores_gemma":[0.00004134817,0.00027770267,0.006047087,0.000035293375,0.00009584936,0.000486012,0.00012248557,0.95586216,0.03009195,0.0027107121,0.0041701947,0.0000592662],"about_ca_topic_score_codex":0.006451005,"about_ca_topic_score_gemma":0.008061461,"teacher_disagreement_score":0.006451005,"about_ca_system_score_codex":0.0005033514,"about_ca_system_score_gemma":0.00080162135,"threshold_uncertainty_score":0.01282692},"labels":[],"label_agreement":null},{"id":"W4410087067","doi":"10.1109/wi-iat62293.2024.00110","title":"Dense Retrieval Systems with LLM-Based Query Expansion","year":2024,"lang":"en","type":"article","venue":"","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":1,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"York University","funders":"","keywords":"Query expansion; Computer science; Query optimization; Information retrieval; Web search query; Sargable; Query language; Search engine","score_opus":0.013224908537769038,"score_gpt":0.22964638379619554,"score_spread":0.2164214752584265,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4410087067","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.044426985,0.0022239191,0.94218695,0.00048762374,0.00010420805,0.0005851156,0.0003450625,0.00678744,0.0028526837],"genre_scores_gemma":[0.526027,0.0010078299,0.465467,0.00053969095,0.00032158248,0.00060893723,0.0013664903,0.00025571883,0.0044057723],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9971806,0.00093036605,0.00025696866,0.00047250386,0.0010269826,0.00013256822],"domain_scores_gemma":[0.9952128,0.0023648497,0.00038404137,0.0011071408,0.00083994895,0.0000912602],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0028865533,0.0011848052,0.0018694594,0.0021777619,0.00058913947,0.0013711302,0.0018176307,0.0010745607,0.0022908964],"category_scores_gemma":[0.01001567,0.00061194977,0.0010018274,0.0018667777,0.000783038,0.0038913242,0.0020575156,0.0012617932,0.0021683045],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00080315943,0.0007797751,0.003225313,0.0011425859,0.00024593028,0.00041794076,0.00066925865,0.11805749,0.09251019,0.008349932,0.0100488365,0.76374954],"study_design_scores_gemma":[0.00011138304,0.00059980445,0.001415286,0.00003747196,0.00011682241,0.000555886,0.00011330119,0.9630396,0.019492337,0.0072838515,0.007153092,0.00008124328],"about_ca_topic_score_codex":0.0038907956,"about_ca_topic_score_gemma":0.004759555,"teacher_disagreement_score":0.0038907956,"about_ca_system_score_codex":0.00092427636,"about_ca_system_score_gemma":0.0011147206,"threshold_uncertainty_score":0.015265703},"labels":[],"label_agreement":null},{"id":"W4411357793","doi":"10.1007/978-3-031-82606-1_3","title":"Dynamic Web Page Modification for Accessibility Using AI and Large Language Models","year":2025,"lang":"en","type":"book-chapter","venue":"Studies in computational intelligence","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":3,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Sault College; Thompson Rivers University; Algoma University; CARE Canada","funders":"","keywords":"Computer science; Dynamic web page; World Wide Web; Artificial intelligence; Natural language processing; Information retrieval; Web page","score_opus":0.12239077389140043,"score_gpt":0.41909605091324326,"score_spread":0.2967052770218428,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4411357793","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.025926653,0.0005141807,0.94761497,0.00069111335,0.0001611303,0.00008757913,0.00047417625,0.0057553137,0.01877483],"genre_scores_gemma":[0.58396995,0.0005296606,0.39125636,0.00017589398,0.00015891911,0.00018175771,0.0010181406,0.0017826897,0.020926636],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.99913687,0.00023740123,0.000050455335,0.00022956957,0.0002860041,0.000059725786],"domain_scores_gemma":[0.9957913,0.0025911357,0.00017957416,0.0009739415,0.00036102536,0.00010297002],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0011074892,0.00056666526,0.0008069448,0.0012213396,0.0006882239,0.0021089972,0.0016173965,0.00080964825,0.009009616],"category_scores_gemma":[0.007868353,0.00043783267,0.0014309584,0.0013355605,0.001177768,0.00538979,0.0014535589,0.0019698022,0.0017733494],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0002726012,0.00035083512,0.0040858802,0.00035124458,0.00012441922,0.0004892929,0.00088390114,0.13910054,0.011165136,0.29780674,0.020636626,0.5247328],"study_design_scores_gemma":[0.000012289358,0.000033684293,0.0007205619,0.0000294545,0.00004798002,0.0001830539,0.00011994519,0.79618615,0.003319703,0.1881852,0.0111348145,0.000027090877],"about_ca_topic_score_codex":0.004304991,"about_ca_topic_score_gemma":0.005367146,"teacher_disagreement_score":0.009009616,"about_ca_system_score_codex":0.0010870001,"about_ca_system_score_gemma":0.0010160794,"threshold_uncertainty_score":0.030140221},"labels":[],"label_agreement":null},{"id":"W4411618073","doi":"10.51847/atpldrcg4z","title":"10.51847/aTpldRCG4Z","year":2000,"lang":"en","type":"article","venue":"Time to knit","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":true,"route_about_ca":false,"ca_institutions":"","funders":"","keywords":"Join (topology); Computer science; Hash function; Algorithm; Theoretical computer science; Parallel computing; Programming language; Mathematics","score_opus":0.0069145905744145576,"score_gpt":0.18145419950079444,"score_spread":0.17453960892637987,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4411618073","genre_codex":"other","genre_gemma":"other","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"other","genre_consensus":"other","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0023797576,0.0008194761,0.009231534,0.0014456111,0.00071003626,0.00016745865,0.0029887704,0.006619977,0.97563744],"genre_scores_gemma":[0.008662985,0.00050373713,0.005425644,0.0006564998,0.00013651917,0.00010174795,0.0032666847,0.0007725229,0.9804735],"study_design_codex":"design_other","study_design_gemma":"not_applicable","domain_scores_codex":[0.9995603,0.00005240635,0.00003238187,0.00013153224,0.00013829822,0.00008500122],"domain_scores_gemma":[0.9990538,0.0002504772,0.000045263892,0.00022762555,0.00027271232,0.00015010506],"candidate_categories":["insufficient_payload"],"consensus_categories":["insufficient_payload"],"category_scores_codex":[0.0005939411,0.0015161985,0.00068514096,0.0023725235,0.0009944206,0.00261696,0.0014403152,0.003676299,0.9353282],"category_scores_gemma":[0.0012648399,0.0004422204,0.00059097767,0.0027207616,0.0006463197,0.0021284532,0.0017174942,0.0012257413,0.9546439],"study_design_candidate":"not_applicable","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00023887279,0.00023648034,0.0009255948,0.00029905577,0.000020207059,0.0003088818,0.000063381485,0.00068718544,0.003494963,0.005529099,0.27617472,0.7120216],"study_design_scores_gemma":[0.000085941596,0.000066423614,0.00077386614,0.0001670428,0.000016909495,0.00046653388,0.00008310154,0.001699707,0.0018928853,0.0019691952,0.9927579,0.000020391124],"about_ca_topic_score_codex":0.0042722165,"about_ca_topic_score_gemma":0.002326539,"teacher_disagreement_score":0.064671814,"about_ca_system_score_codex":0.0009727014,"about_ca_system_score_gemma":0.0005914465,"threshold_uncertainty_score":0.09224647},"labels":[],"label_agreement":null},{"id":"W4412042268","doi":"10.18280/isi.300504","title":"Hybrid Contextual Ontology-Fuzzy Logic and LSTM Model for Efficient Web Crawler Prediction and Traffic Optimization","year":2025,"lang":"en","type":"article","venue":"Ingénierie des systèmes d information","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":true,"route_about_ca":false,"ca_institutions":"","funders":"","keywords":"Web crawler; Computer science; Fuzzy logic; Artificial intelligence; Ontology; Machine learning; Data mining; Natural language processing; Information retrieval; World Wide Web","score_opus":0.014183157054761019,"score_gpt":0.23151052096759264,"score_spread":0.2173273639128316,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4412042268","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.1367593,0.0011531005,0.8534737,0.00043969834,0.00011165554,0.0000913409,0.0005351412,0.003252313,0.0041837106],"genre_scores_gemma":[0.89189607,0.0004751319,0.10428168,0.00016878625,0.000049115948,0.0001406583,0.0005912681,0.000053093736,0.0023442213],"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9997863,0.000032309938,0.000018344243,0.00007244986,0.00005106505,0.0000395533],"domain_scores_gemma":[0.99976677,0.000084669475,0.000026679323,0.000020147198,0.00009023382,0.000011467098],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0003827065,0.0007907124,0.0006816617,0.0009277296,0.00032923147,0.00090715545,0.00089306815,0.00088507344,0.000999485],"category_scores_gemma":[0.0011103473,0.00029685858,0.00069036544,0.00077743194,0.00027567547,0.0013116933,0.00048441254,0.0006852298,0.00029832797],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00022400293,0.00021504752,0.0035367322,0.00012343725,0.000132689,0.00021025578,0.000095568656,0.7986067,0.008799501,0.0042060837,0.002438828,0.18141113],"study_design_scores_gemma":[0.000002238629,0.000009641819,0.00015303763,0.0000025348852,0.000010346746,0.000007834386,0.000004897054,0.99844724,0.0005146598,0.0007161789,0.00012869608,0.0000026753],"about_ca_topic_score_codex":0.02088836,"about_ca_topic_score_gemma":0.021931693,"teacher_disagreement_score":0.02088836,"about_ca_system_score_codex":0.0009945148,"about_ca_system_score_gemma":0.0010749573,"threshold_uncertainty_score":0.04153353},"labels":[],"label_agreement":null},{"id":"W4412737366","doi":"10.20944/preprints202507.2313.v1","title":"A Multimodal Scene Command Classification Method Based on Hybrid Deep Learning","year":2025,"lang":"en","type":"preprint","venue":"Preprints.org","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Toronto","funders":"","keywords":"Artificial intelligence; Computer science; Deep learning; Pattern recognition (psychology); Machine learning","score_opus":0.11812496370365515,"score_gpt":0.3728834249469656,"score_spread":0.2547584612433104,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4412737366","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.061719142,0.0003364442,0.92970085,0.0001682963,0.00007349707,0.00010910823,0.00037930484,0.004551636,0.0029617865],"genre_scores_gemma":[0.6828874,0.00023266984,0.3053217,0.00027146118,0.000069477595,0.00018029024,0.0017416979,0.00021705279,0.009078229],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9996263,0.000048222908,0.00001688604,0.00011931142,0.00011126065,0.000077895515],"domain_scores_gemma":[0.9997348,0.00004682776,0.000023054168,0.000044933688,0.00012299314,0.000027394739],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.00032678017,0.0010802848,0.0006624613,0.0015598654,0.00036385015,0.00043927872,0.001033654,0.000521972,0.0028587135],"category_scores_gemma":[0.0005954672,0.00021879087,0.00076755893,0.0009049696,0.00030221755,0.0011015875,0.0008838898,0.00074413285,0.00090693025],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00027040738,0.00025208225,0.003537634,0.000076078875,0.00008951758,0.00016626094,0.00009946858,0.042604063,0.03799634,0.0020736777,0.00573021,0.90710425],"study_design_scores_gemma":[0.000011894553,0.000065966786,0.0016192064,0.00000649023,0.00002846704,0.00008483489,0.000048706726,0.97743785,0.01739909,0.0017832805,0.0014956478,0.000018536297],"about_ca_topic_score_codex":0.006604247,"about_ca_topic_score_gemma":0.008222325,"teacher_disagreement_score":0.006604247,"about_ca_system_score_codex":0.00056644063,"about_ca_system_score_gemma":0.0006944037,"threshold_uncertainty_score":0.0131316185},"labels":[],"label_agreement":null},{"id":"W4412877105","doi":"10.1145/3711896.3737207","title":"Cross-Domain Web Information Extraction at Pinterest","year":2025,"lang":"en","type":"preprint","venue":"","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Bridgepoint Active Healthcare","funders":"","keywords":"Computer science; World Wide Web; Information extraction; Domain (mathematical analysis); Information retrieval","score_opus":0.018789882561621535,"score_gpt":0.3083364524968135,"score_spread":0.289546569935192,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4412877105","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.065415055,0.0017645631,0.5652616,0.0017030875,0.0004516168,0.0007603056,0.015233662,0.3301452,0.019264862],"genre_scores_gemma":[0.21439481,0.0007595267,0.6820048,0.00092308014,0.00012745424,0.000398763,0.061795432,0.00885859,0.03073751],"study_design_codex":"design_other","study_design_gemma":"not_applicable","domain_scores_codex":[0.9973105,0.0002953138,0.00013289705,0.0012164183,0.00087623106,0.00016866994],"domain_scores_gemma":[0.9978248,0.00048937934,0.00010006119,0.00088764733,0.0005419302,0.00015623309],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0026660275,0.0016702525,0.001427205,0.0038232084,0.0014213583,0.0021535913,0.00169375,0.0018257883,0.010625929],"category_scores_gemma":[0.006204205,0.0013009197,0.0011670447,0.003072925,0.0007867823,0.005047009,0.0038621651,0.0027376164,0.010244264],"study_design_candidate":"not_applicable","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00085792865,0.0005536859,0.005698609,0.0004916513,0.0003302677,0.0013234547,0.0005628505,0.0072596977,0.056282114,0.0053361147,0.1792708,0.74203277],"study_design_scores_gemma":[0.00028176917,0.0002891779,0.014092015,0.00014412383,0.00015525323,0.0032220245,0.000421669,0.502102,0.20158021,0.021433743,0.25604498,0.00023298759],"about_ca_topic_score_codex":0.007179645,"about_ca_topic_score_gemma":0.011962242,"teacher_disagreement_score":0.010625929,"about_ca_system_score_codex":0.00097648613,"about_ca_system_score_gemma":0.0016135827,"threshold_uncertainty_score":0.035547256},"labels":[],"label_agreement":null},{"id":"W4413757641","doi":"10.1145/3704268.3742687","title":"Exploiting Query Reformulation and Reciprocal Rank Fusion in Math-Aware Search Engines","year":2025,"lang":"en","type":"article","venue":"","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":1,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Waterloo","funders":"Canada Excellence Research Chairs, Government of Canada","keywords":"Reciprocal; Mean reciprocal rank; Web search query; Computer science; Rank (graph theory); Query expansion; Sargable; Query language; Search engine; Query optimization; Fusion; Information retrieval; Theoretical computer science; Mathematics; Combinatorics","score_opus":0.017528024569497955,"score_gpt":0.2710835870457755,"score_spread":0.25355556247627753,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4413757641","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.034637313,0.0011108607,0.95568454,0.0011684364,0.00010219581,0.00013244063,0.00027443204,0.0018118052,0.0050778603],"genre_scores_gemma":[0.63308966,0.0009155247,0.35995013,0.0005680899,0.0004843354,0.0001511007,0.0007652283,0.0002885366,0.0037872714],"study_design_codex":"design_other","study_design_gemma":"bench_or_experimental","domain_scores_codex":[0.994079,0.0022386748,0.00045622472,0.00066578045,0.00215689,0.0004034708],"domain_scores_gemma":[0.99380976,0.0025508115,0.00057300774,0.0018157345,0.0011132894,0.00013735502],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0049184132,0.000831251,0.0021629825,0.003196074,0.00082946674,0.0041915104,0.0021724529,0.0012899959,0.0034322029],"category_scores_gemma":[0.022498365,0.0005442773,0.0012198078,0.0037715344,0.0016211052,0.008825401,0.0023273383,0.001415779,0.0017821387],"study_design_candidate":"bench_or_experimental","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0008228262,0.00045072046,0.0018558021,0.00059797836,0.00019021526,0.00029544736,0.0006671904,0.16408685,0.018748658,0.33943942,0.011050482,0.46179447],"study_design_scores_gemma":[0.00005958581,0.000197703,0.00044033877,0.000031490832,0.000076759505,0.00018952375,0.00011850394,0.76780605,0.010092676,0.2159528,0.0049733543,0.00006123841],"about_ca_topic_score_codex":0.0029249846,"about_ca_topic_score_gemma":0.0036022265,"teacher_disagreement_score":0.0049184132,"about_ca_system_score_codex":0.0014246663,"about_ca_system_score_gemma":0.0018102997,"threshold_uncertainty_score":0.026011348},"labels":[],"label_agreement":null},{"id":"W4414001734","doi":"10.7746/jkros.2025.20.3.546","title":"User Identification and Tracking System via LLM-Based Semantic Style Analysis","year":2025,"lang":"en","type":"article","venue":"The Journal of Korea Robotics Society","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":0,"is_retracted":false,"has_abstract":false,"route_ca_aff":false,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"","funders":"Ministry of Agriculture, Food and Rural Affairs; Ministry of Agriculture and Food","keywords":"Identification (biology); Style (visual arts); Computer science; Natural language processing; Tracking (education); Information retrieval; Artificial intelligence; Human–computer interaction; Psychology; Art; Visual arts","score_opus":0.011901055415695925,"score_gpt":0.24909028110342743,"score_spread":0.23718922568773151,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4414001734","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.124059916,0.0009331179,0.83944756,0.00027094386,0.00031682046,0.00032939808,0.0043293666,0.022066636,0.008246259],"genre_scores_gemma":[0.6914886,0.0004945558,0.29171652,0.00036058537,0.00019751627,0.00036227013,0.0044334256,0.00033566976,0.010610917],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9991252,0.000102474296,0.000065735265,0.00023207898,0.00037862538,0.000095856834],"domain_scores_gemma":[0.99944156,0.000051007246,0.00006214295,0.00009628166,0.00028819934,0.000060722],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.00043675554,0.0008130229,0.00094887847,0.0028750682,0.00040277807,0.0008030151,0.0006536507,0.0006119381,0.0035575088],"category_scores_gemma":[0.0010213212,0.0002391812,0.0007756452,0.0014781266,0.00015601523,0.0011296344,0.0011563038,0.00044870167,0.004198849],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00072996574,0.00031810335,0.019306554,0.000304547,0.00013881971,0.00028210643,0.00015421273,0.0023009086,0.08683118,0.0008075108,0.011102162,0.8777239],"study_design_scores_gemma":[0.00008701409,0.00059167546,0.07514287,0.000082344006,0.0002794373,0.0014425709,0.00034537163,0.8090876,0.09497162,0.002895974,0.01486109,0.00021255389],"about_ca_topic_score_codex":0.0023766737,"about_ca_topic_score_gemma":0.004324331,"teacher_disagreement_score":0.0035575088,"about_ca_system_score_codex":0.0003169922,"about_ca_system_score_gemma":0.0004400407,"threshold_uncertainty_score":0.011901021},"labels":[],"label_agreement":null},{"id":"W4414793550","doi":"10.1145/3720533.3756896","title":"Web Archiving and Digital Libraries (WADL)","year":2025,"lang":"en","type":"article","venue":"","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":1,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Alberta","funders":"","keywords":"Hypertext; Digital library; Digital Archives; Intersection (aeronautics); Web navigation; Digital ecosystem; Semantic Web; Hypermedia","score_opus":0.006110613610534008,"score_gpt":0.2043336353578198,"score_spread":0.1982230217472858,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4414793550","genre_codex":"other","genre_gemma":"other","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"other","genre_consensus":"other","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.014421227,0.0254116,0.22261266,0.03850516,0.008749019,0.0012256466,0.002408029,0.014949527,0.67171717],"genre_scores_gemma":[0.12346912,0.024535915,0.18918411,0.011775088,0.002705758,0.0010011373,0.005493389,0.00437532,0.6374602],"study_design_codex":"design_other","study_design_gemma":"not_applicable","domain_scores_codex":[0.99416083,0.0016049163,0.00056550646,0.00047352616,0.0026783103,0.00051686005],"domain_scores_gemma":[0.9921072,0.0015986217,0.00042232097,0.0030228859,0.0013790228,0.0014699382],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.008795581,0.0005462419,0.00033872697,0.0038419415,0.0033299492,0.017791552,0.0018910663,0.0037311902,0.025188122],"category_scores_gemma":[0.012768862,0.0005709181,0.00066066714,0.0051098466,0.0033365057,0.01151535,0.012735215,0.003034146,0.017850978],"study_design_candidate":"not_applicable","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00007525836,0.00012246874,0.00065402646,0.00070055743,0.000018250807,0.0002630891,0.0032158727,0.0004676163,0.0036275063,0.21123755,0.21194513,0.5676727],"study_design_scores_gemma":[0.0000074638187,0.000028956132,0.00038107467,0.00027801347,0.0000045897905,0.00023907525,0.000469214,0.00038188414,0.0022301888,0.017413864,0.97853994,0.000025746283],"about_ca_topic_score_codex":0.0030079444,"about_ca_topic_score_gemma":0.0038083147,"teacher_disagreement_score":0.025188122,"about_ca_system_score_codex":0.0021681034,"about_ca_system_score_gemma":0.0049670483,"threshold_uncertainty_score":0.08426267},"labels":[],"label_agreement":null},{"id":"W4415303429","doi":"10.1002/pra2.1478","title":"Cross‐Session Aggregated Search: Organizing and Summarizing Found Resources","year":2025,"lang":"en","type":"article","venue":"Proceedings of the Association for Information Science and Technology","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":1,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Regina","funders":"","keywords":"Variety (cybernetics); Context (archaeology); Task (project management); Exploratory search; Sensemaking; Generative grammar; Exploratory analysis","score_opus":0.009932238387313897,"score_gpt":0.26110409248861466,"score_spread":0.2511718541013008,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4415303429","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.37132376,0.0031228147,0.5810954,0.0014047936,0.00028254566,0.00077085727,0.002360358,0.016659854,0.022979543],"genre_scores_gemma":[0.67871684,0.00080788066,0.30839914,0.00016707461,0.00013603318,0.00031735405,0.0028428016,0.0011440213,0.0074688857],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.99837744,0.0007138208,0.00013654114,0.0002696426,0.0003931918,0.0001092873],"domain_scores_gemma":[0.98873806,0.006071107,0.00084368105,0.002303269,0.0013340479,0.0007097958],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.002857894,0.000681753,0.00076817255,0.0047246073,0.0013691351,0.004267902,0.0014946267,0.00084001326,0.004845782],"category_scores_gemma":[0.013885577,0.00036083505,0.0005040872,0.0051777405,0.0007714825,0.004908963,0.00496302,0.00083193043,0.0017849266],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0017366287,0.00074929546,0.012981579,0.0024760792,0.00026401953,0.00087076804,0.03616644,0.01588274,0.056513976,0.021462988,0.02926652,0.82162905],"study_design_scores_gemma":[0.00031718184,0.0023091235,0.044829916,0.001538119,0.0009482725,0.0014415728,0.038010553,0.37599406,0.08723534,0.118897036,0.3278679,0.0006109181],"about_ca_topic_score_codex":0.0018797403,"about_ca_topic_score_gemma":0.0045841644,"teacher_disagreement_score":0.004845782,"about_ca_system_score_codex":0.00047581212,"about_ca_system_score_gemma":0.0011769605,"threshold_uncertainty_score":0.016210735},"labels":[],"label_agreement":null},{"id":"W4415345326","doi":"10.48550/arxiv.2507.03922","title":"Dynamic Injection of Entity Knowledge into Dense Retrievers","year":2025,"lang":"en","type":"preprint","venue":"ArXiv.org","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":true,"ca_institutions":"","funders":"","keywords":"Code (set theory); Layer (electronics); Labrador Retriever; Set (abstract data type)","score_opus":0.023821283186802593,"score_gpt":0.28919823626770813,"score_spread":0.26537695308090553,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4415345326","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.17543264,0.0052546235,0.6945788,0.001985024,0.00050549244,0.00081354275,0.012483992,0.09514051,0.0138053605],"genre_scores_gemma":[0.6142779,0.0017376235,0.33557206,0.0013218122,0.00040257728,0.00033581874,0.028916745,0.0026931441,0.014742364],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9984628,0.00028900758,0.0001418567,0.000510539,0.00045364542,0.00014220901],"domain_scores_gemma":[0.9948996,0.001966392,0.00029881916,0.0020027987,0.00065372756,0.00017862084],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.002350542,0.00202572,0.0015542383,0.0029342973,0.00063121394,0.0020697825,0.0032392147,0.0017920561,0.0053524203],"category_scores_gemma":[0.014444398,0.0006885824,0.0011525869,0.0029020247,0.0011316211,0.009895802,0.004299543,0.0021127115,0.005935676],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0011603421,0.000974268,0.01485776,0.0014043764,0.0004977055,0.0013226753,0.0011747378,0.076293446,0.048097793,0.0102779735,0.08936086,0.75457805],"study_design_scores_gemma":[0.00017912441,0.0007180593,0.004888616,0.000118326505,0.00034794866,0.0014996524,0.00065393955,0.855795,0.052817374,0.029231245,0.05357305,0.00017759965],"about_ca_topic_score_codex":0.0048689623,"about_ca_topic_score_gemma":0.0091806855,"teacher_disagreement_score":0.0053524203,"about_ca_system_score_codex":0.00072132144,"about_ca_system_score_gemma":0.00092052494,"threshold_uncertainty_score":0.017905593},"labels":[],"label_agreement":null},{"id":"W4415507076","doi":"10.1007/978-3-032-08887-1_5","title":"When Does Naïve Evaluation Work for Datalog?","year":2025,"lang":"en","type":"book-chapter","venue":"Lecture notes in computer science","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":0,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Simon Fraser University","funders":"","keywords":"Datalog; Tuple; Set (abstract data type); Database query; Deductive database; Query language; Logic program; Boolean conjunctive query","score_opus":0.026913599170352364,"score_gpt":0.28186297101788155,"score_spread":0.2549493718475292,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4415507076","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.08365024,0.033480834,0.72639716,0.060511343,0.0073418934,0.0006683774,0.0028356004,0.022968702,0.06214581],"genre_scores_gemma":[0.66481036,0.0047642747,0.290236,0.009333283,0.004041487,0.00040990105,0.00284412,0.0059803436,0.017580215],"study_design_codex":"design_other","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.9673953,0.015351476,0.0018269742,0.0040016677,0.009593951,0.0018306857],"domain_scores_gemma":[0.8658713,0.09695006,0.0020974055,0.016042033,0.016611192,0.0024279929],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.033662006,0.001526146,0.003794836,0.0031689089,0.0020079871,0.0075608976,0.003948586,0.004100416,0.00930799],"category_scores_gemma":[0.17259811,0.0012121426,0.0013905573,0.0027780607,0.0034693335,0.028786475,0.0034509301,0.0042396784,0.006711021],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0014427787,0.00047998718,0.015882166,0.0012162527,0.00034307028,0.00020019873,0.00057253055,0.009064906,0.0029875988,0.04558919,0.14258517,0.7796362],"study_design_scores_gemma":[0.0003705568,0.00070246536,0.007919311,0.0012305006,0.0002802626,0.00094850047,0.0018944059,0.30310285,0.010411599,0.60753936,0.06535462,0.00024567518],"about_ca_topic_score_codex":0.006502325,"about_ca_topic_score_gemma":0.009298484,"teacher_disagreement_score":0.033662006,"about_ca_system_score_codex":0.0023818328,"about_ca_system_score_gemma":0.0035325647,"threshold_uncertainty_score":0.17802382},"labels":[],"label_agreement":null},{"id":"W569220443","doi":"","title":"AIRWeb 2007 : proceedings of the 3rd International Workshop on Adversarial Information Retrieval on the Web, May 8, 2007, Banff, Alberta, Canada","year":2007,"lang":"en","type":"book","venue":"Association for Computing Machinery eBooks","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":12,"is_retracted":false,"has_abstract":false,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":true,"ca_institutions":"","funders":"","keywords":"Library science; Information retrieval; World Wide Web; Computer science; History; Geography","score_opus":0.008542198134156664,"score_gpt":0.218037418495747,"score_spread":0.20949522036159035,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W569220443","genre_codex":"methods","genre_gemma":"other","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"other","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.015012258,0.03348672,0.8369805,0.014160967,0.0132344505,0.00066562445,0.0050841006,0.008565862,0.07280947],"genre_scores_gemma":[0.14157587,0.04034819,0.3249525,0.0045549865,0.005754735,0.00053974154,0.02586477,0.002855403,0.45355374],"study_design_codex":"not_applicable","study_design_gemma":"not_applicable","domain_scores_codex":[0.9991468,0.00023587194,0.0000352038,0.000106491556,0.00035079484,0.00012480687],"domain_scores_gemma":[0.9981975,0.0007519584,0.000028516419,0.00028828153,0.00058047666,0.00015321557],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.002553232,0.0011315995,0.0021331557,0.00088226295,0.0007383093,0.0027028543,0.0017527931,0.0010714118,0.02696569],"category_scores_gemma":[0.0034927009,0.00045633936,0.0005544384,0.0009515981,0.0008417664,0.0028516406,0.0014087228,0.0020052008,0.009634048],"study_design_candidate":"not_applicable","study_design_consensus":"not_applicable","about_ca_topic_candidate":true,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00022865218,0.00020649558,0.00037871773,0.00019649208,0.000068322486,0.000082590625,0.00009501048,0.0115700485,0.0023642357,0.013444606,0.64359456,0.32777026],"study_design_scores_gemma":[0.00011251404,0.00019100326,0.0028339922,0.00028287809,0.00012703487,0.00044625622,0.00033388194,0.33374086,0.012263714,0.08120269,0.56837803,0.000087178916],"about_ca_topic_score_codex":0.018740803,"about_ca_topic_score_gemma":0.039932717,"teacher_disagreement_score":0.9812592,"about_ca_system_score_codex":0.0013340979,"about_ca_system_score_gemma":0.0020346455,"threshold_uncertainty_score":0.090209186},"labels":[],"label_agreement":null},{"id":"W574550031","doi":"","title":"2nd ACM Workshop on Story Representation, Mechanism and Context 2008 (SRMC 08) : held at ACM Multimedia 2008 : Vancouver, BC, Canada 31 October 2008","year":2008,"lang":"en","type":"book","venue":"Association for Computing Machinery eBooks","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":0,"is_retracted":false,"has_abstract":false,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":true,"ca_institutions":"","funders":"","keywords":"Context (archaeology); Computer science; Representation (politics); Multimedia; Library science; History; Political science; Archaeology; Law","score_opus":0.020155494324051886,"score_gpt":0.244983381079423,"score_spread":0.2248278867553711,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W574550031","genre_codex":"methods","genre_gemma":"other","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"other","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.015471235,0.02042859,0.8609082,0.0065148883,0.0047096577,0.00072987535,0.0032869133,0.014663806,0.07328684],"genre_scores_gemma":[0.11335288,0.018841965,0.56352466,0.0013815085,0.0018127284,0.0007291002,0.014090964,0.0030689826,0.2831972],"study_design_codex":"design_other","study_design_gemma":"not_applicable","domain_scores_codex":[0.999368,0.00022675321,0.00003654066,0.00014114476,0.00016087801,0.00006665852],"domain_scores_gemma":[0.998664,0.0006096024,0.00003650834,0.00025082356,0.00028738717,0.0001516164],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0018171085,0.00084876514,0.0010145903,0.0010770131,0.0007741779,0.0041515296,0.0018399031,0.0012134712,0.047218457],"category_scores_gemma":[0.0048493613,0.00062507496,0.0007475708,0.0013687523,0.0006411679,0.0051196567,0.0020751879,0.0014041294,0.010193377],"study_design_candidate":"not_applicable","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00033328455,0.00016660486,0.00048056865,0.00036792547,0.00004564547,0.00015730462,0.0007809518,0.0017023688,0.006428785,0.03069999,0.25958073,0.69925576],"study_design_scores_gemma":[0.00006750372,0.00016825576,0.0022491685,0.00030777967,0.00015099361,0.0006255151,0.0007547989,0.033487555,0.009864837,0.04921554,0.90303373,0.000074262105],"about_ca_topic_score_codex":0.0063854274,"about_ca_topic_score_gemma":0.012572671,"teacher_disagreement_score":0.047218457,"about_ca_system_score_codex":0.0010095859,"about_ca_system_score_gemma":0.0013726746,"threshold_uncertainty_score":0.15796155},"labels":[],"label_agreement":null},{"id":"W609043110","doi":"","title":"Model checking: Correct Web page navigations with browser behavior.","year":2004,"lang":"en","type":"article","venue":"Scholarship at UWindsor (University of Windsor)","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":true,"ca_institutions":"","funders":"","keywords":"Computer science; World Wide Web; Web page; Web browser; Static web page; Information retrieval; The Internet; Web navigation","score_opus":0.0276791058059839,"score_gpt":0.22330929221471205,"score_spread":0.19563018640872815,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W609043110","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.018645346,0.00020960934,0.9640537,0.00038500037,0.000103212646,0.0003597322,0.00046436302,0.013457109,0.0023218384],"genre_scores_gemma":[0.49622762,0.00036718388,0.49256626,0.0005250615,0.00011114689,0.001018985,0.002186434,0.00268967,0.004307471],"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9859418,0.0059323213,0.0007572468,0.0020726996,0.0045102607,0.0007856434],"domain_scores_gemma":[0.9781853,0.011486761,0.0017593979,0.0064329933,0.0019363477,0.00019919172],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0064671286,0.0019538798,0.001235049,0.0014003849,0.00085180585,0.0032305585,0.0036390803,0.0020986493,0.005824423],"category_scores_gemma":[0.040944766,0.0013569852,0.003046847,0.0010762818,0.0030026797,0.006007837,0.0028353338,0.002707443,0.0018064867],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0015153176,0.0010866518,0.017929524,0.0019684914,0.00072526914,0.0012245486,0.0014838001,0.51486886,0.045205407,0.1500729,0.014778118,0.24914114],"study_design_scores_gemma":[0.00014200059,0.00015402953,0.0006847379,0.00017250307,0.00016368266,0.00025557596,0.00007140987,0.89359033,0.023298604,0.0757272,0.0056871674,0.000052686333],"about_ca_topic_score_codex":0.008224818,"about_ca_topic_score_gemma":0.0067996923,"teacher_disagreement_score":0.008224818,"about_ca_system_score_codex":0.0015166417,"about_ca_system_score_gemma":0.005502817,"threshold_uncertainty_score":0.03420186},"labels":[],"label_agreement":null},{"id":"W640474702","doi":"10.1007/978-3-642-30541-2","title":"Algorithms and models for the web graph : 9th International Workshop, WAW 2012, Halifax, NS, Canada, June 22-23, 2012, proceedings","year":2012,"lang":"en","type":"book","venue":"","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":1,"is_retracted":false,"has_abstract":false,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":true,"ca_institutions":"","funders":"","keywords":"Computer science; PageRank; Nova scotia; Graph; Computation; Theoretical computer science; World Wide Web; Algorithm; Geography","score_opus":0.021587718097319568,"score_gpt":0.232488496541823,"score_spread":0.21090077844450342,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W640474702","genre_codex":"methods","genre_gemma":"other","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"other","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0051004435,0.010854583,0.9629877,0.0054119956,0.0008649833,0.00020874555,0.0033003357,0.0044845953,0.0067866384],"genre_scores_gemma":[0.05629746,0.015738502,0.88013303,0.0012868078,0.00089604105,0.00060774153,0.015725186,0.0030921171,0.026223088],"study_design_codex":"design_other","study_design_gemma":"not_applicable","domain_scores_codex":[0.9984666,0.0004752563,0.00010138515,0.00041217604,0.00043062746,0.00011389726],"domain_scores_gemma":[0.9943684,0.0031762496,0.00020788945,0.0010966497,0.0009116976,0.00023916613],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.002901593,0.0022909292,0.0023926676,0.0029573378,0.0014555175,0.0063171717,0.004578973,0.0027313917,0.00986372],"category_scores_gemma":[0.009270483,0.0022094534,0.0035517076,0.0044431053,0.0014281704,0.007962564,0.0021461188,0.0050390386,0.004979436],"study_design_candidate":"not_applicable","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00016478862,0.0004283588,0.0014243585,0.0009820338,0.00023487362,0.00015039317,0.00029124744,0.1831205,0.0013375429,0.13623975,0.256761,0.41886514],"study_design_scores_gemma":[0.00006701326,0.0000360728,0.00061670697,0.00020562457,0.00009244973,0.0001714774,0.00014977765,0.5485449,0.0010540279,0.38950366,0.05951041,0.00004792868],"about_ca_topic_score_codex":0.04628574,"about_ca_topic_score_gemma":0.07099418,"teacher_disagreement_score":0.04628574,"about_ca_system_score_codex":0.004774334,"about_ca_system_score_gemma":0.0046740565,"threshold_uncertainty_score":0.09203267},"labels":[],"label_agreement":null},{"id":"W65541001","doi":"10.1145/3410566","title":"Proceedings of the 24th Symposium on International Database Engineering &amp; Applications","year":2020,"lang":"en","type":"paratext","venue":"","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":true,"ca_institutions":"","funders":"","keywords":"Computer science; Database","score_opus":0.01645647948662667,"score_gpt":0.24393805077895067,"score_spread":0.227481571292324,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W65541001","genre_codex":"methods","genre_gemma":"other","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"other","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.009694711,0.19860604,0.34604934,0.036618236,0.06650321,0.0013927937,0.0076794964,0.010251677,0.32320455],"genre_scores_gemma":[0.04564801,0.088714495,0.17371577,0.0075113354,0.020904237,0.0009866451,0.026353313,0.0032461314,0.6329201],"study_design_codex":"not_applicable","study_design_gemma":"not_applicable","domain_scores_codex":[0.99354666,0.001569001,0.00084452174,0.0008516484,0.002870243,0.00031786633],"domain_scores_gemma":[0.9913093,0.0019168679,0.000340921,0.0019029251,0.00325023,0.0012797035],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.008085817,0.0014375842,0.0021012733,0.0027021565,0.0014751997,0.01062951,0.0022972494,0.0020930662,0.08658805],"category_scores_gemma":[0.010124513,0.0007651789,0.0012246649,0.003277575,0.0013461162,0.007975792,0.0038091962,0.0039535495,0.056502465],"study_design_candidate":"not_applicable","study_design_consensus":"not_applicable","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00018100646,0.0001486518,0.00088932953,0.0005311645,0.000088577064,0.00014935962,0.00027898554,0.00037600799,0.0027185937,0.017878694,0.6968201,0.2799395],"study_design_scores_gemma":[0.00001412655,0.00004130153,0.0005122435,0.00018489842,0.000026316518,0.00022076516,0.00007927047,0.0016010983,0.0008056557,0.0054227174,0.9910767,0.000014917153],"about_ca_topic_score_codex":0.0023217483,"about_ca_topic_score_gemma":0.0034257586,"teacher_disagreement_score":0.08658805,"about_ca_system_score_codex":0.0017673589,"about_ca_system_score_gemma":0.0036528353,"threshold_uncertainty_score":0.28966588},"labels":[],"label_agreement":null},{"id":"W68392726","doi":"10.11575/prism/30796","title":"Tracking Visual Differences for Generation and Playback of User-Customized Notifications","year":2005,"lang":"en","type":"article","venue":"PRISM (University of Calgary)","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":1,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Calgary","funders":"","keywords":"Computer science; Timestamp; Bitmap; World Wide Web; Information retrieval; Home page; Web page; Page view; Artificial intelligence; The Internet; Web navigation; Static web page; Computer security","score_opus":0.026230815730037927,"score_gpt":0.23069145883697725,"score_spread":0.20446064310693932,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W68392726","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.07123373,0.00038074123,0.8497367,0.00020414274,0.00044840082,0.0006643368,0.0012135473,0.069355085,0.0067634387],"genre_scores_gemma":[0.35729074,0.00027700327,0.6275641,0.00022822824,0.00013026016,0.00046598824,0.0017086605,0.005061541,0.007273454],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.99854434,0.00021321968,0.0000962927,0.00036805938,0.0006587583,0.00011939343],"domain_scores_gemma":[0.9963391,0.0014897854,0.00029104837,0.0007434102,0.0007214586,0.00041535823],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0018993593,0.0010980059,0.00074470317,0.0019033119,0.00049594115,0.0017553271,0.0013710676,0.00090105983,0.008977391],"category_scores_gemma":[0.010039096,0.0006225244,0.0004870679,0.00066546735,0.00041677867,0.0016317345,0.0025161002,0.0011354506,0.0030664983],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0025998678,0.00034992766,0.01109507,0.0005951982,0.00008637553,0.0008419391,0.0030586899,0.0048940624,0.15181784,0.005337045,0.01924411,0.8000799],"study_design_scores_gemma":[0.00039415364,0.0010131946,0.035302665,0.0003026176,0.0002627904,0.0015825476,0.0013531232,0.41682872,0.37588668,0.01089591,0.15573299,0.00044462696],"about_ca_topic_score_codex":0.0022984706,"about_ca_topic_score_gemma":0.0027408858,"teacher_disagreement_score":0.008977391,"about_ca_system_score_codex":0.00063867477,"about_ca_system_score_gemma":0.0005695723,"threshold_uncertainty_score":0.030032337},"labels":[],"label_agreement":null},{"id":"W6888792948","doi":"10.23636/1307","title":"UKWA Interim Report Second Quarter 2018","year":2018,"lang":"en","type":"article","venue":"British Library Research Repository","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":true,"ca_institutions":"","funders":"","keywords":"Quarter (Canadian coin); Reading (process); Interim; Feature (linguistics); Narrative; Key (lock)","score_opus":0.0378805664954514,"score_gpt":0.3051840202014744,"score_spread":0.267303453706023,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W6888792948","genre_codex":"other","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0029861347,0.005456837,0.0025123088,0.020638892,0.028862275,0.0009467751,0.41010654,0.0063191787,0.522171],"genre_scores_gemma":[0.0067947367,0.0031580008,0.0019090014,0.0016559259,0.0021360877,0.001203249,0.11580927,0.0029324093,0.86440116],"study_design_codex":"not_applicable","study_design_gemma":"not_applicable","domain_scores_codex":[0.99281454,0.0005675401,0.00072454655,0.00060159544,0.0044559906,0.0008357015],"domain_scores_gemma":[0.98064065,0.0012789092,0.0013734837,0.0027464004,0.0123777455,0.0015828199],"candidate_categories":["insufficient_payload"],"consensus_categories":[],"category_scores_codex":[0.00544345,0.0009988287,0.0010462098,0.007026199,0.00190577,0.012196115,0.0022230388,0.0024639796,0.3702822],"category_scores_gemma":[0.024883978,0.00083200895,0.00089363125,0.0063324524,0.00079742,0.005192505,0.003535925,0.0022160658,0.38416687],"study_design_candidate":"not_applicable","study_design_consensus":"not_applicable","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00006749583,0.000014491954,0.00034665322,0.00016022808,0.000004635438,0.000028494485,0.000054444252,0.000026349775,0.00010028193,0.0016876406,0.97962016,0.017889282],"study_design_scores_gemma":[0.000007838952,0.000012352365,0.0015238001,0.00010427911,0.0000028093991,0.000017143364,0.000059058115,0.000018850635,0.00016298321,0.0002615426,0.9978218,0.00000765177],"about_ca_topic_score_codex":0.029702477,"about_ca_topic_score_gemma":0.03329446,"teacher_disagreement_score":0.3702822,"about_ca_system_score_codex":0.0060300487,"about_ca_system_score_gemma":0.012335978,"threshold_uncertainty_score":0.898216},"labels":[],"label_agreement":null},{"id":"W6920336244","doi":"10.60692/mf63k-29160","title":"Hash data files for \"Hashes are not suitable to verify fixity of the public archived web\"","year":2022,"lang":"en","type":"article","venue":"Greater South Information System","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Columbia College","funders":"","keywords":"Hash function; SHA-2; Merkle tree; Hash tree; Construct (python library); Set (abstract data type); Hash chain; Double hashing","score_opus":0.10131826298522206,"score_gpt":0.2350507976600053,"score_spread":0.13373253467478324,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W6920336244","genre_codex":"empirical","genre_gemma":"dataset","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"dataset","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.7973173,0.0013339136,0.048259966,0.0014524241,0.0010091162,0.0006240903,0.10246781,0.03800178,0.009533605],"genre_scores_gemma":[0.85590655,0.00032225784,0.05313171,0.000546808,0.00019554875,0.0006607555,0.081383295,0.0036034314,0.004249682],"study_design_codex":"observational","study_design_gemma":"not_applicable","domain_scores_codex":[0.99213576,0.0013601991,0.0012759591,0.0016766416,0.003044594,0.000506982],"domain_scores_gemma":[0.900319,0.04316417,0.010418469,0.034236856,0.010892487,0.0009689877],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.007943024,0.00070585473,0.0007686056,0.0027386476,0.0012917842,0.0022076273,0.0012703314,0.0012038591,0.0054255873],"category_scores_gemma":[0.087935634,0.00058292586,0.0004595102,0.003830649,0.0017742545,0.0065258183,0.002202851,0.0015515538,0.00359604],"study_design_candidate":"not_applicable","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.005712825,0.00078397815,0.45383805,0.004005761,0.0008589893,0.0012283912,0.006827432,0.008602229,0.02966438,0.01974475,0.1810075,0.2877258],"study_design_scores_gemma":[0.00084506924,0.001821602,0.38920078,0.0011513026,0.00040196488,0.004109356,0.006612633,0.07825161,0.12945382,0.031428277,0.35622323,0.0005003416],"about_ca_topic_score_codex":0.0022670426,"about_ca_topic_score_gemma":0.0024531141,"teacher_disagreement_score":0.007943024,"about_ca_system_score_codex":0.0010608071,"about_ca_system_score_gemma":0.0013392774,"threshold_uncertainty_score":0.042007208},"labels":[],"label_agreement":null},{"id":"W6925803611","doi":"10.17895/ices.pub.25071083","title":"Linking Climate and Fisheries Variability in the Mid-Atlantic Bight: A Case Study on the Atlantic Mackerel Fishery","year":2009,"lang":"en","type":"other","venue":"Open MIND","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":true,"ca_institutions":"","funders":"","keywords":"Mackerel; Range (aeronautics); Fish <Actinopterygii>; Fishing; Pelagic zone; Fisheries management","score_opus":0.048546546332748415,"score_gpt":0.2920954309827341,"score_spread":0.2435488846499857,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W6925803611","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.9980635,0.00009483572,0.00013419514,0.00026476997,0.0000029788566,0.000010479866,0.00015848542,0.00000285838,0.0012678682],"genre_scores_gemma":[0.9980088,0.00023467578,0.000543783,0.00006461941,0.000007122042,0.000009073337,0.00020360209,0.0000042907664,0.00092403],"study_design_codex":"observational","study_design_gemma":"observational","domain_scores_codex":[0.9996537,0.00017210457,0.000020307429,0.000028945344,0.00004903427,0.000075974676],"domain_scores_gemma":[0.9987717,0.0007125628,0.00017354236,0.00006139214,0.00014000885,0.00014063164],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0008098388,0.00015880012,0.00018457025,0.00078131363,0.00084107573,0.0006751994,0.0004300692,0.00057483575,0.0012652858],"category_scores_gemma":[0.0018379757,0.000112705675,0.0004044217,0.0014124648,0.00036743085,0.0006238047,0.0007022213,0.00043105567,0.000107323765],"study_design_candidate":"observational","study_design_consensus":"observational","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00012165294,0.00037154718,0.9574876,0.000064360436,0.00013220725,0.013879277,0.006310206,0.0020245337,0.00079730636,0.00065447955,0.0012531911,0.016903713],"study_design_scores_gemma":[0.000014367978,0.0001723131,0.9625985,0.00005386397,0.00008266017,0.0015416474,0.027527515,0.005154474,0.00031174626,0.0003205263,0.0022002452,0.000022166781],"about_ca_topic_score_codex":0.13977341,"about_ca_topic_score_gemma":0.31860667,"teacher_disagreement_score":0.13977341,"about_ca_system_score_codex":0.0011938073,"about_ca_system_score_gemma":0.000808416,"threshold_uncertainty_score":0.2779197},"labels":[],"label_agreement":null},{"id":"W6931241193","doi":"10.5281/zenodo.3867921","title":"Leptoiulus oribates","year":2017,"lang":"en","type":"article","venue":"Zenodo (CERN European Organization for Nuclear Research)","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"BC Research (Canada)","funders":"","keywords":"Distribution (mathematics); Natural (archaeology); Action (physics)","score_opus":0.04495941424074139,"score_gpt":0.2609594661041425,"score_spread":0.2160000518634011,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W6931241193","genre_codex":"empirical","genre_gemma":"other","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"other","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.508314,0.022040522,0.0072487043,0.0009272352,0.0007648101,0.00052664155,0.008604307,0.0010724365,0.45050126],"genre_scores_gemma":[0.9444233,0.0035259668,0.0049577975,0.0005491962,0.00028084219,0.00028076454,0.006127851,0.00006871302,0.039785434],"study_design_codex":"design_other","study_design_gemma":"not_applicable","domain_scores_codex":[0.9997695,0.000019461408,0.000018230538,0.00006657081,0.00008250406,0.000043757653],"domain_scores_gemma":[0.9996953,0.000055090437,0.00014111747,0.000016159036,0.00005615177,0.000036233705],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0001561547,0.00062304974,0.0002769716,0.002144853,0.0016074651,0.0006737688,0.000493668,0.00045762945,0.014827823],"category_scores_gemma":[0.0005947905,0.0002576856,0.00024285237,0.0011261699,0.0006629264,0.0009611699,0.0010561916,0.00062517717,0.00529304],"study_design_candidate":"not_applicable","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0009396396,0.0001267535,0.085461386,0.0008641197,0.00006942632,0.0030547436,0.002633533,0.000653471,0.06794987,0.0052944855,0.028644685,0.804308],"study_design_scores_gemma":[0.00007971056,0.00028227054,0.54698765,0.00041286682,0.00010142777,0.0049901414,0.002100321,0.00059922255,0.00572988,0.0015949976,0.43706438,0.000057125915],"about_ca_topic_score_codex":0.013383352,"about_ca_topic_score_gemma":0.026768558,"teacher_disagreement_score":0.014827823,"about_ca_system_score_codex":0.0007859797,"about_ca_system_score_gemma":0.00044222354,"threshold_uncertainty_score":0.049604},"labels":[],"label_agreement":null},{"id":"W6931251810","doi":"10.5281/zenodo.4000748","title":"Draft template for data extraction","year":2020,"lang":"en","type":"article","venue":"Zenodo (CERN European Organization for Nuclear Research)","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"McMaster University","funders":"","keywords":"Extraction (chemistry); Data extraction; Pattern recognition (psychology); Hull; Matching (statistics)","score_opus":0.13308255452381065,"score_gpt":0.2989105927735164,"score_spread":0.16582803824970574,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W6931251810","genre_codex":"methods","genre_gemma":"other","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"other","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0013637327,0.0005955798,0.46106473,0.0031326513,0.0022925884,0.013276167,0.44606948,0.032796707,0.039408453],"genre_scores_gemma":[0.0050888937,0.0007543438,0.5452718,0.0020704463,0.00043384594,0.019342894,0.3723986,0.011941727,0.04269748],"study_design_codex":"not_applicable","study_design_gemma":"not_applicable","domain_scores_codex":[0.99100107,0.0022355977,0.0030386942,0.0009463563,0.0023829746,0.00039538322],"domain_scores_gemma":[0.9133249,0.03533363,0.0025267922,0.016322445,0.03108816,0.0014040594],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.010141928,0.0018995799,0.001812469,0.0077966033,0.0013632852,0.004655293,0.0029328957,0.0022729912,0.23671089],"category_scores_gemma":[0.08167681,0.0023509033,0.002804476,0.0058978,0.00076395774,0.0033829377,0.0042872857,0.003005207,0.19846657],"study_design_candidate":"not_applicable","study_design_consensus":"not_applicable","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00033809512,0.00010839207,0.0008594982,0.0033500353,0.00009451547,0.00039616087,0.00058701745,0.00089792255,0.0070822723,0.008383255,0.8332201,0.14468263],"study_design_scores_gemma":[0.00013973047,0.000052408122,0.0008611436,0.000726477,0.00006831249,0.00028993943,0.00019215654,0.0012685847,0.006272336,0.008362089,0.98171127,0.00005564793],"about_ca_topic_score_codex":0.004359382,"about_ca_topic_score_gemma":0.004555763,"teacher_disagreement_score":0.23671089,"about_ca_system_score_codex":0.001757945,"about_ca_system_score_gemma":0.009322864,"threshold_uncertainty_score":0.7918768},"labels":[],"label_agreement":null},{"id":"W6968786326","doi":"10.5281/zenodo.16883647","title":"Evie Magazine web archive collection derivatives","year":2025,"lang":"en","type":"dataset","venue":"Zenodo (CERN European Organization for Nuclear Research)","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"York University","funders":"","keywords":"Web page; Web site; The Internet; Web application","score_opus":0.02408323032524898,"score_gpt":0.2513722150065768,"score_spread":0.22728898468132783,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W6968786326","genre_codex":"dataset","genre_gemma":"dataset","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"dataset","genre_consensus":"dataset","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.00039779293,0.00016152405,0.00021780298,0.00013914303,0.00013774652,0.000027214666,0.98910636,0.0024173195,0.007395167],"genre_scores_gemma":[0.0004143181,0.000101812715,0.000357506,0.0000633121,0.000020192772,0.000050540777,0.99357647,0.00038347577,0.0050325375],"study_design_codex":"not_applicable","study_design_gemma":"not_applicable","domain_scores_codex":[0.998789,0.00013269966,0.0001266746,0.0002499332,0.00049904065,0.00020266668],"domain_scores_gemma":[0.9965706,0.00047046805,0.00019637535,0.0009711403,0.0013912057,0.000400283],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0010685552,0.0017758143,0.0012924143,0.0073368056,0.0010776961,0.0033258053,0.0016110613,0.0009435424,0.09796042],"category_scores_gemma":[0.004973892,0.0007141832,0.00084851764,0.009222671,0.0003563338,0.002045905,0.0024183309,0.0018467808,0.24592857],"study_design_candidate":"not_applicable","study_design_consensus":"not_applicable","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.000019166444,0.000008597192,0.000153672,0.000093280134,0.0000040381747,0.000008480994,0.000009269798,0.000022568389,0.000057287263,0.00014933571,0.9972487,0.0022255166],"study_design_scores_gemma":[0.00002115572,0.0000081733715,0.0013202027,0.00007317614,0.0000063405028,0.00004701917,0.00004952578,0.00011180835,0.0002872154,0.00032219038,0.9977435,0.000009785353],"about_ca_topic_score_codex":0.016362492,"about_ca_topic_score_gemma":0.032354422,"teacher_disagreement_score":0.09796042,"about_ca_system_score_codex":0.0010543037,"about_ca_system_score_gemma":0.0023636871,"threshold_uncertainty_score":0.3277102},"labels":[],"label_agreement":null},{"id":"W6976634595","doi":"10.60692/3wvbb-1e357","title":"Burden of Diarrhea in the Eastern Mediterranean Region, 1990–2013: Findings from the Global Burden of Disease Study 2013","year":2016,"lang":"en","type":"article","venue":"Greater South Information System","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of British Columbia; Public Health Agency of Canada; SickKids Foundation; Hospital for Sick Children; University of Toronto","funders":"","keywords":"Burden of disease; Diarrhea; Disease burden; Disability-adjusted life year; Disease; Diarrheal disease; Diarrheal diseases; Psychological intervention; Livelihood","score_opus":0.03607471410958666,"score_gpt":0.22949542715463014,"score_spread":0.1934207130450435,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W6976634595","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.91657037,0.011651833,0.00048419143,0.0021559787,0.00014600616,0.00017367107,0.06530754,0.000054554563,0.0034559078],"genre_scores_gemma":[0.95796573,0.008240262,0.0008453375,0.00097186095,0.00016266012,0.00022255785,0.030939098,0.000018760715,0.000633787],"study_design_codex":"observational","study_design_gemma":"observational","domain_scores_codex":[0.99945563,0.0001232328,0.00012255901,0.000073068324,0.00013738817,0.00008811402],"domain_scores_gemma":[0.9992248,0.00005329833,0.00033869853,0.000027514969,0.0002569729,0.000098855],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0014268958,0.0004054414,0.00051758956,0.0010575957,0.00034944693,0.0005617416,0.00047185353,0.00027503542,0.0008590176],"category_scores_gemma":[0.0027806922,0.00023011322,0.0011557351,0.0025366612,0.00020774081,0.0005261001,0.0012763785,0.0005039527,0.00023979819],"study_design_candidate":"observational","study_design_consensus":"observational","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00015007406,0.00003216602,0.97328544,0.00043468585,0.00048181458,0.00007402965,0.00053187535,0.0002455912,0.00011249293,0.000077375815,0.010346231,0.014228178],"study_design_scores_gemma":[0.00001784866,0.000021499638,0.9966414,0.00012895896,0.00012719572,0.000063828724,0.00031740713,0.00012949864,0.000025897505,0.00003922033,0.0024803039,0.000006980303],"about_ca_topic_score_codex":0.07711015,"about_ca_topic_score_gemma":0.09846338,"teacher_disagreement_score":0.07711015,"about_ca_system_score_codex":0.001284806,"about_ca_system_score_gemma":0.0013863596,"threshold_uncertainty_score":0.15332264},"labels":[],"label_agreement":null},{"id":"W6977184349","doi":"10.6084/m9.figshare.17071985","title":"Assessing the predictive validity of the UCAT—A systematic review and narrative synthesis","year":2021,"lang":"en","type":"article","venue":"Figshare","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":true,"ca_institutions":"","funders":"","keywords":"Predictive power; Predictive validity; Aptitude; Cognition; Univariate; Inclusion (mineral); Predictive value; Narrative","score_opus":0.0728562355696405,"score_gpt":0.30747780216488113,"score_spread":0.23462156659524064,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W6977184349","genre_codex":"review","genre_gemma":"review","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"review","genre_consensus":"review","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0024076505,0.9894846,0.0009857429,0.0012894903,0.00038009972,0.0030740462,0.001635661,0.000025197356,0.00071741],"genre_scores_gemma":[0.049243625,0.9344169,0.0039530843,0.0020074337,0.00029601096,0.008712123,0.0010877444,0.000022708795,0.00026042454],"study_design_codex":"systematic_review","study_design_gemma":"systematic_review","domain_scores_codex":[0.9538361,0.015308495,0.019988861,0.002467721,0.00750601,0.0008928288],"domain_scores_gemma":[0.8083871,0.15183897,0.025602117,0.0027483215,0.010590809,0.00083278056],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0504267,0.0022581008,0.009540893,0.027579488,0.0011292655,0.0062825177,0.0035841372,0.0027423108,0.005816741],"category_scores_gemma":[0.22786093,0.0018037597,0.009276722,0.020979226,0.002376041,0.0068586604,0.003475166,0.0023021158,0.00053705444],"study_design_candidate":"systematic_review","study_design_consensus":"systematic_review","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00009633992,0.000008868654,0.0007377828,0.9759975,0.0050502373,0.00009333579,0.0004977247,0.00010405123,0.00007382772,0.0004736431,0.0008927572,0.015973972],"study_design_scores_gemma":[0.000059163835,0.000059880538,0.0012638373,0.9678984,0.022356695,0.0001552407,0.00051512575,0.0000729599,0.00008846935,0.00040188804,0.007104185,0.000024128807],"about_ca_topic_score_codex":0.007990353,"about_ca_topic_score_gemma":0.021005504,"teacher_disagreement_score":0.0504267,"about_ca_system_score_codex":0.007899582,"about_ca_system_score_gemma":0.028528368,"threshold_uncertainty_score":0.26668513},"labels":[],"label_agreement":null},{"id":"W6987236217","doi":"","title":"Snapshot of Web harvesting in Canada","year":2015,"lang":"en","type":"article","venue":"Scholarship@Western (Western University)","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":true,"ca_institutions":"","funders":"","keywords":"Ephemeral key; Snapshot (computer storage); Web page; Web development; Web standards; Digital preservation; Web Accessibility Initiative; Web navigation; Web 2.0","score_opus":0.13427881095658967,"score_gpt":0.2926737398953594,"score_spread":0.15839492893876972,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W6987236217","genre_codex":"other","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.13438424,0.009143306,0.0029920102,0.012851339,0.0015286439,0.00089518767,0.11799646,0.0027387585,0.71747],"genre_scores_gemma":[0.2779009,0.0145251965,0.008903767,0.0034547066,0.00017726667,0.00031811168,0.055999074,0.0013059094,0.63741505],"study_design_codex":"not_applicable","study_design_gemma":"observational","domain_scores_codex":[0.9969223,0.00006881626,0.0000934434,0.00019204305,0.0021418324,0.0005816434],"domain_scores_gemma":[0.9922982,0.00022546451,0.00018404845,0.00027135693,0.005903958,0.0011170626],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0012108722,0.0004426628,0.00055164465,0.012487399,0.01344073,0.0078039765,0.0018237995,0.0008136391,0.03380957],"category_scores_gemma":[0.0032917901,0.00055672444,0.0005598099,0.023452777,0.0015477946,0.0015174443,0.0021834236,0.0012990155,0.006962332],"study_design_candidate":"observational","study_design_consensus":null,"about_ca_topic_candidate":true,"about_ca_topic_consensus":true,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00033599482,0.00019617713,0.06145979,0.0009907025,0.0001226785,0.0022073055,0.008630185,0.0010939222,0.0031993445,0.019942362,0.6498076,0.25201392],"study_design_scores_gemma":[0.0000097602815,0.00002285331,0.13907258,0.00035755633,0.000028660865,0.00021025876,0.009044248,0.00039939338,0.0010706082,0.0007907744,0.8489223,0.00007095784],"about_ca_topic_score_codex":0.9903915,"about_ca_topic_score_gemma":0.9958872,"teacher_disagreement_score":0.06782395,"about_ca_system_score_codex":0.06782395,"about_ca_system_score_gemma":0.11918724,"threshold_uncertainty_score":0.49209946},"labels":[],"label_agreement":null},{"id":"W7015989721","doi":"","title":"Web Archiving Effort in National Library of China: Paper - iPRES 2012 - Digital Curation Institute, iSchool, Toronto","year":2012,"lang":"en","type":"article","venue":"Phaidra (Universität Wien)","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":0,"is_retracted":false,"has_abstract":false,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":true,"ca_institutions":"","funders":"","keywords":"National library; Digital curation; Data curation; Digital library; The Internet; Web technology","score_opus":0.010369659443205649,"score_gpt":0.2156266103098082,"score_spread":0.20525695086660256,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W7015989721","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.78729194,0.01219514,0.0032354086,0.016947208,0.0007684234,0.00035966726,0.04595252,0.0028554692,0.13039422],"genre_scores_gemma":[0.8234626,0.0059438674,0.007510206,0.0011108747,0.00020209367,0.00013568044,0.027828967,0.00060615357,0.13319948],"study_design_codex":"design_other","study_design_gemma":"not_applicable","domain_scores_codex":[0.9950256,0.00046143396,0.00062302174,0.00059806264,0.0027353074,0.00055669114],"domain_scores_gemma":[0.974259,0.0023718267,0.0016464939,0.0040195105,0.015157432,0.0025456515],"candidate_categories":["scholarly_communication"],"consensus_categories":[],"category_scores_codex":[0.0065185395,0.00036077452,0.0009861243,0.012033309,0.007072587,0.005296998,0.0013637306,0.00089138275,0.010896842],"category_scores_gemma":[0.012457113,0.0005882257,0.000666976,0.025287254,0.0012273215,0.0022336121,0.0027696271,0.0008153784,0.0026196998],"study_design_candidate":"not_applicable","study_design_consensus":null,"about_ca_topic_candidate":true,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0009329598,0.0002488226,0.34274668,0.0019019577,0.0002798714,0.0011033068,0.022722885,0.0014956068,0.006656403,0.01748305,0.21335872,0.39106977],"study_design_scores_gemma":[0.000025759178,0.000065979155,0.663545,0.00024196098,0.00020356182,0.0003868224,0.0068624816,0.0019785785,0.008045792,0.00062897534,0.3179202,0.00009478862],"about_ca_topic_score_codex":0.63557357,"about_ca_topic_score_gemma":0.6829654,"teacher_disagreement_score":0.994703,"about_ca_system_score_codex":0.023452606,"about_ca_system_score_gemma":0.07115172,"threshold_uncertainty_score":0.73314524},"labels":[],"label_agreement":null},{"id":"W7020410642","doi":"","title":"Language for locating information in HTML documents","year":2003,"lang":"en","type":"dissertation","venue":"DSpace@MIT (Massachusetts Institute of Technology)","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Artificial Intelligence in Medicine (Canada)","funders":"","keywords":"Natural language; Information system; HTML; Key (lock)","score_opus":0.00796818736233549,"score_gpt":0.2644743625342398,"score_spread":0.25650617517190427,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W7020410642","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0027128612,0.00040402843,0.87538266,0.0012204221,0.00027076155,0.00059082994,0.0114705255,0.095127665,0.012820255],"genre_scores_gemma":[0.0352932,0.00095669454,0.88255167,0.0009960571,0.00027089106,0.0013168483,0.03400348,0.01896968,0.025641521],"study_design_codex":"not_applicable","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.9972601,0.0007244922,0.0008324035,0.0003431761,0.0006725829,0.00016713531],"domain_scores_gemma":[0.99212366,0.0035319396,0.0005491524,0.0018015932,0.0015681168,0.0004255007],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0035719632,0.0019436132,0.0013102901,0.0042801267,0.0015022742,0.0047749775,0.0034650038,0.002075101,0.02980805],"category_scores_gemma":[0.009631824,0.0019130245,0.0014838835,0.003573367,0.0019692248,0.0078057596,0.0039789747,0.003376659,0.0372788],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0006642861,0.0003009848,0.0019053161,0.0019139029,0.00009938307,0.0009486641,0.0025883194,0.0037955646,0.037811656,0.24283889,0.39166507,0.31546798],"study_design_scores_gemma":[0.00025002472,0.00023666133,0.0012575145,0.00069683156,0.00012685145,0.0022834875,0.00067984447,0.04536963,0.04112372,0.087311395,0.8204625,0.00020160584],"about_ca_topic_score_codex":0.00309225,"about_ca_topic_score_gemma":0.0040851627,"teacher_disagreement_score":0.02980805,"about_ca_system_score_codex":0.0011104833,"about_ca_system_score_gemma":0.0026105386,"threshold_uncertainty_score":0.099717855},"labels":[],"label_agreement":null},{"id":"W7027402428","doi":"","title":"Culturally Appropriate Web Interface Design: Web Crawler Study","year":2005,"lang":"en","type":"article","venue":"NPARC","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":5,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":true,"route_about_ca":false,"ca_institutions":"","funders":"","keywords":"Web design; Web crawler; User interface; Interface (matter); Web standards; Web navigation; User interface design; Web Accessibility Initiative","score_opus":0.02796604568965034,"score_gpt":0.27145912376645803,"score_spread":0.2434930780768077,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W7027402428","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.98536265,0.00024076074,0.007673718,0.0003076946,0.000014828898,0.00035473183,0.000050104893,0.000092182316,0.0059032985],"genre_scores_gemma":[0.9695351,0.0006472217,0.024789259,0.00041888002,0.000017737637,0.00047062454,0.00013994041,0.00013046245,0.0038508545],"study_design_codex":"qualitative","study_design_gemma":"observational","domain_scores_codex":[0.9917585,0.005951535,0.00043301412,0.0004042823,0.001199717,0.00025283254],"domain_scores_gemma":[0.9708985,0.01885796,0.0019716457,0.002350511,0.0051988964,0.00072247884],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0070944563,0.00033824166,0.0005476583,0.00231398,0.0020921691,0.002687055,0.00074177905,0.0010995263,0.0010587581],"category_scores_gemma":[0.044283375,0.00045393908,0.00033246924,0.0018245832,0.0012758395,0.0024934795,0.0014826363,0.001178503,0.00048443745],"study_design_candidate":"observational","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00029609838,0.0055408007,0.2232806,0.0011647316,0.000102046586,0.0051620826,0.47758546,0.0015925101,0.013016084,0.01847568,0.0066239834,0.24715994],"study_design_scores_gemma":[0.0002279136,0.0038235874,0.2685197,0.0018762455,0.00041022178,0.01279592,0.45495284,0.023213457,0.053698666,0.011749169,0.16829117,0.00044120202],"about_ca_topic_score_codex":0.003962635,"about_ca_topic_score_gemma":0.008484453,"teacher_disagreement_score":0.0070944563,"about_ca_system_score_codex":0.0014679967,"about_ca_system_score_gemma":0.0020649757,"threshold_uncertainty_score":0.037519515},"labels":[],"label_agreement":null},{"id":"W7028235858","doi":"","title":"Federated Searching in an Age of Web Services","year":2005,"lang":"en","type":"article","venue":"NPARC","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":true,"route_about_ca":false,"ca_institutions":"","funders":"","keywords":"","score_opus":0.019704684959225883,"score_gpt":0.2740003092903897,"score_spread":0.2542956243311638,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W7028235858","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.19697712,0.01704547,0.54995495,0.06561577,0.0051544355,0.00048750627,0.0042659827,0.0117421085,0.14875671],"genre_scores_gemma":[0.6024097,0.009338417,0.31918934,0.0052261944,0.0024658102,0.00011051589,0.0042838035,0.0014548085,0.055521403],"study_design_codex":"design_other","study_design_gemma":"not_applicable","domain_scores_codex":[0.99006605,0.0020632471,0.00092922925,0.0013437488,0.004700351,0.00089738704],"domain_scores_gemma":[0.95180297,0.015931977,0.0023241153,0.014196523,0.013097847,0.0026466805],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.013921088,0.00047464517,0.0015965535,0.007350317,0.003405364,0.012463497,0.002797352,0.0033489938,0.009129571],"category_scores_gemma":[0.04166873,0.00083412044,0.0010771013,0.010488304,0.0028273491,0.03724514,0.0051339823,0.0034213997,0.003640031],"study_design_candidate":"not_applicable","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0009899143,0.0004636238,0.016266044,0.00051797996,0.00014323779,0.0012029603,0.0016207349,0.004664929,0.0041321823,0.30460352,0.07583345,0.58956146],"study_design_scores_gemma":[0.00007753079,0.00025479452,0.0055403374,0.0006935874,0.00019271509,0.0028738065,0.0021351737,0.10363687,0.016140157,0.49432394,0.37398618,0.00014493613],"about_ca_topic_score_codex":0.007095098,"about_ca_topic_score_gemma":0.007928477,"teacher_disagreement_score":0.013921088,"about_ca_system_score_codex":0.003790467,"about_ca_system_score_gemma":0.0044662594,"threshold_uncertainty_score":0.073622584},"labels":[],"label_agreement":null},{"id":"W7030977488","doi":"","title":"Cedarleaf","year":2010,"lang":"en","type":"other","venue":"Bulletin of Miscellaneous Information (Royal Gardens Kew)","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":true,"ca_institutions":"","funders":"","keywords":"Guitar; EPIC; Period (music); Rest (music); Shore","score_opus":0.005268660163110949,"score_gpt":0.18144119145463763,"score_spread":0.17617253129152669,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W7030977488","genre_codex":"other","genre_gemma":"other","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"other","genre_consensus":"other","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0020984302,0.0018049533,0.003390403,0.0025071523,0.001533936,0.00007371007,0.0065828557,0.00757106,0.97443753],"genre_scores_gemma":[0.0022348645,0.0005689958,0.0012963653,0.00045752325,0.00007982562,0.0000134308475,0.0031150726,0.0009823866,0.9912515],"study_design_codex":"not_applicable","study_design_gemma":"not_applicable","domain_scores_codex":[0.9993309,0.000023938872,0.000015754931,0.00019365124,0.00037568063,0.000060140665],"domain_scores_gemma":[0.9989436,0.00009239527,0.00003733982,0.0001790195,0.00047785492,0.0002697137],"candidate_categories":["insufficient_payload"],"consensus_categories":[],"category_scores_codex":[0.0004819099,0.00076584384,0.0004714201,0.0013912937,0.0016813636,0.0040308447,0.0009340935,0.000807374,0.5931289],"category_scores_gemma":[0.0016020965,0.0003466964,0.0003370654,0.0013001108,0.0002895722,0.0021700996,0.0016544934,0.0012924463,0.5077285],"study_design_candidate":"not_applicable","study_design_consensus":"not_applicable","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00005506976,0.000027704735,0.00040420578,0.00005969557,0.0000036049819,0.00007112502,0.000067566376,0.000032906806,0.0010622839,0.0035357054,0.8521958,0.1424844],"study_design_scores_gemma":[0.00000339697,0.0000061680594,0.00060661987,0.000018003024,0.0000012589363,0.00004820672,0.000033659875,0.000053060983,0.00025455287,0.00022041438,0.9987514,0.0000031736704],"about_ca_topic_score_codex":0.012760918,"about_ca_topic_score_gemma":0.045102444,"teacher_disagreement_score":0.40687108,"about_ca_system_score_codex":0.0009787006,"about_ca_system_score_gemma":0.00090162246,"threshold_uncertainty_score":0},"labels":[],"label_agreement":null},{"id":"W7034049626","doi":"","title":"“‘STATE OF WAR’: BRITISH RACIAL CONSTRUCTION, NEW WORLD SLAVERY &amp; THE IMPACT OF SOMERSET’S CASE IN THE ANGLO-AMERICAN DIASPORA\"","year":2023,"lang":"en","type":"article","venue":"OpenSIUC (Southern Illinois University Carbondale)","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":true,"ca_institutions":"","funders":"","keywords":"Verdict; Parliament; Servant; English law; Quarter (Canadian coin); Economic Justice; Inquest; Common law; Entitlement (fair division); Abolitionism; Britishness","score_opus":0.01592372317852879,"score_gpt":0.2353243036274671,"score_spread":0.2194005804489383,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W7034049626","genre_codex":"other","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.32236716,0.011952453,0.00026885673,0.09213188,0.0010604587,0.000023252738,0.000036708552,0.000014900313,0.57214427],"genre_scores_gemma":[0.9303551,0.0017300871,0.0000774011,0.0119864205,0.0001708626,0.000017463155,0.000009210566,0.000020073034,0.055633426],"study_design_codex":"qualitative","study_design_gemma":"not_applicable","domain_scores_codex":[0.9962394,0.0017054424,0.000046667687,0.00024485766,0.00039527658,0.0013683295],"domain_scores_gemma":[0.9989711,0.00045880274,0.00010161724,0.000048954877,0.00011798569,0.00030150492],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.002268101,0.00026699642,0.00026671452,0.0010379688,0.036870763,0.009039891,0.0011312282,0.0047068307,0.0064457473],"category_scores_gemma":[0.0026232367,0.00040203618,0.00021225255,0.0013212853,0.02780931,0.003715282,0.0053200624,0.0070907995,0.00048173856],"study_design_candidate":"not_applicable","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.000032759093,0.00002966701,0.001879381,0.000035334215,0.0000066217763,0.002000313,0.53687555,0.000042279073,0.00017437017,0.42167962,0.02873364,0.008510605],"study_design_scores_gemma":[0.000013031459,0.000027422166,0.009187325,0.0004033241,0.000011201779,0.00082600134,0.38242683,0.00010835731,0.00018876235,0.016770573,0.5899888,0.00004838059],"about_ca_topic_score_codex":0.41313374,"about_ca_topic_score_gemma":0.6321811,"teacher_disagreement_score":0.41313374,"about_ca_system_score_codex":0.015937397,"about_ca_system_score_gemma":0.0066942493,"threshold_uncertainty_score":0.8214581},"labels":[],"label_agreement":null},{"id":"W7034424827","doi":"","title":"Technical Comparison of Three Surgical Methods: Open, Semi-closure, and Primary Closure in the Treatment of Pilonidal Sinus","year":2023,"lang":"en","type":"article","venue":"DOAJ (DOAJ: Directory of Open Access Journals)","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":true,"ca_institutions":"","funders":"","keywords":"Sinus (botany); Significant difference; Sacrum; Closure (psychology); Clinical trial; Surgical procedures","score_opus":0.35003698757748924,"score_gpt":0.5842824639723286,"score_spread":0.2342454763948394,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W7034424827","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.9928768,0.0051983786,0.0007797375,0.00006112853,0.00012763764,0.0004009016,0.000060780214,0.000013304814,0.00048141097],"genre_scores_gemma":[0.9941175,0.0023250703,0.0023245374,0.00009219791,0.00019406172,0.0005332183,0.00010451029,0.000004174177,0.0003046763],"study_design_codex":"randomized_trial","study_design_gemma":"observational","domain_scores_codex":[0.9987435,0.0005061061,0.00020016637,0.00018217988,0.00026852512,0.00009962832],"domain_scores_gemma":[0.9968239,0.0015768282,0.0006169827,0.0002487722,0.00020459112,0.00052893243],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0016336248,0.00041840386,0.0014247164,0.0005409319,0.00033522642,0.0005071725,0.00034652985,0.00042990068,0.0026317379],"category_scores_gemma":[0.0031526634,0.00023250475,0.0010402239,0.00029368768,0.0007022052,0.00063054776,0.0003747779,0.00071087526,0.0002389191],"study_design_candidate":"observational","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.5138627,0.036672678,0.028798636,0.0056520794,0.001351378,0.00065585005,0.0006516149,0.0013333865,0.025857693,0.0005770506,0.0007283248,0.38385856],"study_design_scores_gemma":[0.07328741,0.8398022,0.06914003,0.0004226261,0.0014221212,0.0019654417,0.00044392346,0.0017308427,0.008487185,0.00047527775,0.0027282145,0.000094705465],"about_ca_topic_score_codex":0.000121181394,"about_ca_topic_score_gemma":0.00023883187,"teacher_disagreement_score":0.0026317379,"about_ca_system_score_codex":0.00023212268,"about_ca_system_score_gemma":0.0006425248,"threshold_uncertainty_score":0.008803964},"labels":[],"label_agreement":null},{"id":"W7039146432","doi":"","title":"Les dÃ©terminants du succÃ¨s subjectif de carriÃ¨re : possibilitÃ©s de mobilitÃ© externe et congruence personne-organisation","year":2012,"lang":"fr","type":"other","venue":"Library and Archives Canada (Government of Canada)","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":true,"route_about_ca":false,"ca_institutions":"","funders":"","keywords":"Perspective (graphical); Context (archaeology); Meaning (existential)","score_opus":0.007280476109293291,"score_gpt":0.17928520639802403,"score_spread":0.17200473028873076,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W7039146432","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.8264123,0.0024304006,0.014665889,0.0018643806,0.0001259508,0.00010976681,0.00029508662,0.000051550393,0.15404479],"genre_scores_gemma":[0.98099995,0.0008501265,0.0041526123,0.00009560932,0.00007316254,0.00010759778,0.00025055747,0.000038312413,0.013431932],"study_design_codex":"observational","study_design_gemma":"observational","domain_scores_codex":[0.9965184,0.0012533175,0.0002366041,0.0006369656,0.0010049219,0.00034983363],"domain_scores_gemma":[0.9836414,0.00726947,0.0041831154,0.001029807,0.0023900273,0.0014862904],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.00461893,0.00048594334,0.00037033504,0.0014566268,0.0015152041,0.0055245627,0.00068014296,0.0012278687,0.017539605],"category_scores_gemma":[0.015854316,0.00044150034,0.0005460849,0.0012685347,0.0032375525,0.0038547704,0.002635771,0.0014773844,0.0018832388],"study_design_candidate":"observational","study_design_consensus":"observational","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00119529,0.00049269997,0.48234048,0.0010705859,0.00023047191,0.0013713723,0.10675937,0.0006813007,0.01128091,0.17314102,0.0031488365,0.21828765],"study_design_scores_gemma":[0.00006907704,0.00048586732,0.83513284,0.0005323958,0.00011670527,0.0018480326,0.046215832,0.0017588484,0.0036573948,0.04976102,0.06028782,0.00013425958],"about_ca_topic_score_codex":0.003195887,"about_ca_topic_score_gemma":0.0036445702,"teacher_disagreement_score":0.017539605,"about_ca_system_score_codex":0.001340706,"about_ca_system_score_gemma":0.0015238719,"threshold_uncertainty_score":0.058675766},"labels":[],"label_agreement":null},{"id":"W7040111353","doi":"","title":"Firebird","year":2016,"lang":"en","type":"other","venue":"RMIT Research Repository (RMIT University Library)","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":true,"ca_institutions":"","funders":"","keywords":"Movie theater; Narrative; Excellence; Film studies; Field (mathematics); Wish; Focus (optics); Feature film; Face (sociological concept); Chose","score_opus":0.022702267506140593,"score_gpt":0.25586522431779124,"score_spread":0.23316295681165064,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W7040111353","genre_codex":"other","genre_gemma":"other","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"other","genre_consensus":"other","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.007824214,0.0020389527,0.000830587,0.0036220525,0.0016295249,0.00008636437,0.0017363101,0.000339994,0.98189193],"genre_scores_gemma":[0.04936144,0.002615468,0.0019257099,0.0019424539,0.00032358858,0.00007025594,0.0024780093,0.00035264398,0.9409305],"study_design_codex":"not_applicable","study_design_gemma":"not_applicable","domain_scores_codex":[0.9994765,0.000060724295,0.000015748212,0.0001582461,0.00018732213,0.00010153445],"domain_scores_gemma":[0.99959296,0.000053808504,0.000024375824,0.00004076767,0.00014925582,0.0001387051],"candidate_categories":["insufficient_payload"],"consensus_categories":[],"category_scores_codex":[0.00042571028,0.00044453904,0.00019963944,0.00071196986,0.0026912738,0.0024996118,0.0010302038,0.0011376115,0.2977698],"category_scores_gemma":[0.0012480025,0.00017622348,0.0002043013,0.0005900852,0.00073310744,0.0016856277,0.0017430766,0.001380663,0.08128375],"study_design_candidate":"not_applicable","study_design_consensus":"not_applicable","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00020299276,0.00013226361,0.0024433408,0.00046627506,0.0000062373997,0.0008107152,0.0034749038,0.00014274317,0.0014210085,0.04966091,0.67497885,0.26625976],"study_design_scores_gemma":[0.0000025988086,0.000014748325,0.0010236753,0.00009561077,0.0000011604417,0.00017326897,0.00055017887,0.000022562645,0.00016693574,0.0005830118,0.99736196,0.000004283849],"about_ca_topic_score_codex":0.02041081,"about_ca_topic_score_gemma":0.03718342,"teacher_disagreement_score":0.7022302,"about_ca_system_score_codex":0.0019853786,"about_ca_system_score_gemma":0.0016966842,"threshold_uncertainty_score":0},"labels":[],"label_agreement":null},{"id":"W7071286743","doi":"","title":"SECULARISM, FEMINISM, AND ISLAMOPHOBIA: A STUDY OF ANTI-VEILING LAWS IN FRANCE AND QUEBEC","year":2022,"lang":"en","type":"other","venue":"York University Digital Library (York University)","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":true,"ca_institutions":"","funders":"","keywords":"Islamophobia; Secularism; Politics; Islam; Order (exchange); State (computer science); Feminism","score_opus":0.005546959517153561,"score_gpt":0.15201985013116795,"score_spread":0.1464728906140144,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W7071286743","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.98590857,0.00062105287,0.00018896117,0.0022726324,0.000028655308,0.00005371405,0.00017143102,0.0000072511275,0.010747716],"genre_scores_gemma":[0.9925684,0.0003778538,0.00015713586,0.0007074584,0.000008378321,0.000046082656,0.00007612824,0.000010230092,0.0060484726],"study_design_codex":"qualitative","study_design_gemma":"qualitative","domain_scores_codex":[0.9979107,0.0008915961,0.00003542081,0.0001861592,0.00030928673,0.0006667793],"domain_scores_gemma":[0.99573946,0.0016902651,0.0005228154,0.0001099598,0.0010888752,0.00084876287],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0024862622,0.00049328257,0.000529313,0.0020689415,0.022883577,0.0043279952,0.0022366557,0.0018273522,0.005294592],"category_scores_gemma":[0.0036338212,0.0004785713,0.00035220786,0.0028085394,0.009873108,0.0018315188,0.0025632824,0.0024923473,0.00029999393],"study_design_candidate":"qualitative","study_design_consensus":"qualitative","about_ca_topic_candidate":true,"about_ca_topic_consensus":true,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.000042650343,0.00016656518,0.0392007,0.0000738643,0.0000151595195,0.00066117424,0.9450562,0.00010129036,0.0008209129,0.0034964175,0.0029024023,0.0074626175],"study_design_scores_gemma":[0.0000071118498,0.000051626026,0.06251056,0.00016004004,0.000009094944,0.000109785055,0.9140097,0.00022872335,0.00019667005,0.00014050683,0.022540793,0.00003541184],"about_ca_topic_score_codex":0.98221326,"about_ca_topic_score_gemma":0.9937494,"teacher_disagreement_score":0.0570518,"about_ca_system_score_codex":0.0570518,"about_ca_system_score_gemma":0.03408656,"threshold_uncertainty_score":0.41394174},"labels":[],"label_agreement":null},{"id":"W7095329675","doi":"","title":"Combining Multiple Sources of Evidence in Web Information Extraction. Toronto 2008. In: Foundations of Intelligent Systems","year":2008,"lang":"en","type":"article","venue":"","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":0,"is_retracted":false,"has_abstract":false,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":true,"ca_institutions":"","funders":"","keywords":"Information extraction; Ontology; Ranking (information retrieval); Selection (genetic algorithm); Domain (mathematical analysis); Web page; HTML element; Data extraction","score_opus":0.10723786828746223,"score_gpt":0.30887435157094795,"score_spread":0.2016364832834857,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W7095329675","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.041331265,0.21002899,0.6798703,0.020923676,0.0012783139,0.00085991813,0.015913205,0.0030280724,0.026766261],"genre_scores_gemma":[0.29489687,0.03987803,0.6468495,0.0006610819,0.00075316627,0.00025515287,0.0078113833,0.00033733025,0.008557557],"study_design_codex":"design_other","study_design_gemma":"bench_or_experimental","domain_scores_codex":[0.99353504,0.0020691322,0.00086311036,0.0005343652,0.0027436211,0.00025478454],"domain_scores_gemma":[0.9596662,0.028396962,0.0015202118,0.0022964517,0.0075101326,0.0006101181],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.010588997,0.001456882,0.0023361915,0.015282584,0.0021217403,0.00849558,0.002099608,0.002458946,0.004669559],"category_scores_gemma":[0.04412125,0.0022666361,0.0016156659,0.01559518,0.0022131547,0.009590751,0.0048170025,0.0021225864,0.0013270664],"study_design_candidate":"bench_or_experimental","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00054716936,0.00014563967,0.024973085,0.0052313316,0.0016320152,0.0021598472,0.0019109574,0.01664659,0.0036148294,0.030324407,0.05520095,0.85761327],"study_design_scores_gemma":[0.00030984447,0.00025841364,0.056378786,0.011467183,0.0075328774,0.004308899,0.006439258,0.30502313,0.036081634,0.32118386,0.2504238,0.0005922403],"about_ca_topic_score_codex":0.06702279,"about_ca_topic_score_gemma":0.21470046,"teacher_disagreement_score":0.06702279,"about_ca_system_score_codex":0.004209515,"about_ca_system_score_gemma":0.00829552,"threshold_uncertainty_score":0.13326538},"labels":[],"label_agreement":null},{"id":"W7095379129","doi":"","title":"CO-OPERATION AMONG URANIUM SUPLLIERS IN FUTHERANCE OF NUCLEAR","year":2007,"lang":"en","type":"article","venue":"","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":true,"ca_institutions":"","funders":"","keywords":"Subject (documents); Government (linguistics); Web site; Web page; Web application","score_opus":0.008008587633452755,"score_gpt":0.23845181886900002,"score_spread":0.23044323123554727,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W7095379129","genre_codex":"empirical","genre_gemma":"other","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"other","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.7292244,0.0018384003,0.005000327,0.018763918,0.0007698218,0.00013791381,0.00028280675,0.0001604513,0.24382201],"genre_scores_gemma":[0.8415361,0.0004535265,0.0018775092,0.0009326435,0.00009064874,0.000038469283,0.00018012566,0.00008526128,0.15480563],"study_design_codex":"design_other","study_design_gemma":"not_applicable","domain_scores_codex":[0.9970433,0.0010606442,0.000073996925,0.00031315588,0.0005170148,0.0009918296],"domain_scores_gemma":[0.99457127,0.0011951021,0.0006961565,0.000480721,0.0012177603,0.0018389032],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.003416638,0.00020691927,0.0002530145,0.0013629165,0.011414264,0.0037792423,0.0010060329,0.0010515723,0.030154731],"category_scores_gemma":[0.008792148,0.000238246,0.00026016287,0.001727267,0.0019837325,0.0020809923,0.0053072665,0.001426366,0.0044518523],"study_design_candidate":"not_applicable","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00069434085,0.00032248825,0.29251844,0.00018843681,0.00011722468,0.006521255,0.15155387,0.0007938913,0.005371976,0.08135302,0.09239035,0.3681747],"study_design_scores_gemma":[0.000020063857,0.0003176641,0.10021338,0.0001529494,0.000064180094,0.0017045289,0.18551849,0.0013290818,0.0022231236,0.008917258,0.69946927,0.000070069895],"about_ca_topic_score_codex":0.054340776,"about_ca_topic_score_gemma":0.17544381,"teacher_disagreement_score":0.054340776,"about_ca_system_score_codex":0.0058836783,"about_ca_system_score_gemma":0.0100206025,"threshold_uncertainty_score":0.108048975},"labels":[],"label_agreement":null},{"id":"W7096884987","doi":"","title":"FOR THE DETECTION OF ROCKET LAUNCHES","year":2007,"lang":"en","type":"article","venue":"","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":true,"ca_institutions":"","funders":"","keywords":"Subject (documents); Government (linguistics); Web page; Web site; Web application","score_opus":0.02150896753733757,"score_gpt":0.25589180420934476,"score_spread":0.23438283667200718,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W7096884987","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.35098937,0.0030935598,0.056281567,0.004627824,0.003080137,0.0026568845,0.313726,0.022983663,0.24256101],"genre_scores_gemma":[0.63928,0.0016124614,0.063202314,0.0011120207,0.00066175533,0.001019176,0.1379516,0.0011271071,0.15403353],"study_design_codex":"observational","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.99904853,0.00004475082,0.00006926148,0.00020282163,0.0004946716,0.00013989574],"domain_scores_gemma":[0.9974819,0.0003359384,0.0005460885,0.00024207377,0.001063676,0.00033046468],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0006317767,0.0005342644,0.0004948737,0.00613307,0.0006514253,0.0011605733,0.000768204,0.0011796262,0.04718704],"category_scores_gemma":[0.004790088,0.00026389217,0.00054728857,0.0031018103,0.00024325488,0.0010258029,0.00087835285,0.0010172398,0.028634321],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0006716936,0.0002382094,0.365095,0.000951914,0.00018938824,0.0016271805,0.000955052,0.002575738,0.01112087,0.003948201,0.30966514,0.30296156],"study_design_scores_gemma":[0.000061265,0.0003124847,0.6325313,0.0004695375,0.00013317965,0.0022258419,0.0020643256,0.028202837,0.010631351,0.0025251578,0.32067952,0.0001632408],"about_ca_topic_score_codex":0.015598109,"about_ca_topic_score_gemma":0.034763463,"teacher_disagreement_score":0.04718704,"about_ca_system_score_codex":0.0005024579,"about_ca_system_score_gemma":0.0011162561,"threshold_uncertainty_score":0.15785635},"labels":[],"label_agreement":null},{"id":"W7097434379","doi":"","title":"Halifax, N.S.,","year":2002,"lang":"en","type":"article","venue":"","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":true,"ca_institutions":"","funders":"","keywords":"Automatic summarization; Web site; Web page; Web navigation; Process (computing); Directory; Natural language; Web standards","score_opus":0.02886512900588607,"score_gpt":0.21468209389186893,"score_spread":0.18581696488598287,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W7097434379","genre_codex":"other","genre_gemma":"other","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"other","genre_consensus":"other","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0024710305,0.021590231,0.0009267787,0.009968914,0.002303448,0.0000673258,0.011750974,0.000726939,0.9501943],"genre_scores_gemma":[0.008301874,0.010000529,0.0012648557,0.001354473,0.00011303049,0.000073327064,0.0039520203,0.0002437141,0.9746962],"study_design_codex":"not_applicable","study_design_gemma":"not_applicable","domain_scores_codex":[0.99959034,0.000029557523,0.000022408127,0.00016486805,0.0001288868,0.00006395857],"domain_scores_gemma":[0.9991636,0.00016323599,0.00006649785,0.00009083243,0.0003552244,0.00016067585],"candidate_categories":["insufficient_payload"],"consensus_categories":["insufficient_payload"],"category_scores_codex":[0.00033679462,0.0015375577,0.0007829786,0.0016313384,0.0027731683,0.004277457,0.0011608419,0.0018233854,0.5408003],"category_scores_gemma":[0.001384041,0.00033387155,0.00039160176,0.0022280281,0.0010866936,0.0020719878,0.0016563028,0.0022277683,0.3284285],"study_design_candidate":"not_applicable","study_design_consensus":"not_applicable","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00030957512,0.000043060965,0.0015123513,0.00045191395,0.000023132025,0.0008855712,0.00038271098,0.00037383716,0.0018586697,0.016216075,0.708154,0.2697891],"study_design_scores_gemma":[0.000008988917,0.00001011437,0.0017019467,0.00015299015,0.0000034824498,0.00015213582,0.0002004865,0.0001025437,0.0002089722,0.0010745483,0.9963743,0.000009459041],"about_ca_topic_score_codex":0.04136523,"about_ca_topic_score_gemma":0.08918625,"teacher_disagreement_score":0.45919973,"about_ca_system_score_codex":0.0038297304,"about_ca_system_score_gemma":0.0026493918,"threshold_uncertainty_score":0.6549927},"labels":[],"label_agreement":null},{"id":"W7101139332","doi":"","title":"[30] T. W. Yan, and H. Garcia-Molina.","year":2007,"lang":"en","type":"article","venue":"","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":true,"ca_institutions":"","funders":"","keywords":"Information resource; Resource (disambiguation); Web site; The Internet; Document retrieval; Information system","score_opus":0.010350972463200043,"score_gpt":0.24554314572468375,"score_spread":0.2351921732614837,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W7101139332","genre_codex":"methods","genre_gemma":"other","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"other","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.08535351,0.12292526,0.66951394,0.01625099,0.0033412527,0.0010097655,0.027495865,0.009418725,0.06469064],"genre_scores_gemma":[0.35586578,0.04790912,0.517801,0.0020337352,0.0016915927,0.00086582365,0.028126994,0.0015981045,0.04410786],"study_design_codex":"design_other","study_design_gemma":"not_applicable","domain_scores_codex":[0.9978947,0.0006929377,0.00017022027,0.00026432003,0.00074757845,0.00023034142],"domain_scores_gemma":[0.9880626,0.0056574694,0.0006300847,0.0016382135,0.00366518,0.00034647243],"candidate_categories":["insufficient_payload"],"consensus_categories":[],"category_scores_codex":[0.0035134144,0.0015633397,0.0017553394,0.010545721,0.001990062,0.0022318838,0.0022636855,0.0014501495,0.0143926],"category_scores_gemma":[0.027722258,0.001447941,0.0020840664,0.0075418134,0.0009798738,0.0067913025,0.00166239,0.0014407797,0.010964623],"study_design_candidate":"not_applicable","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0009496947,0.00028592342,0.032672398,0.0010531413,0.00052051485,0.00048212506,0.0004319304,0.016336236,0.0043440736,0.01998581,0.32719728,0.595741],"study_design_scores_gemma":[0.00046063165,0.00053194247,0.08463421,0.00092639885,0.0014928393,0.002246341,0.0020973054,0.396538,0.026177593,0.18971743,0.29455382,0.00062355143],"about_ca_topic_score_codex":0.034274157,"about_ca_topic_score_gemma":0.067314304,"teacher_disagreement_score":0.9856074,"about_ca_system_score_codex":0.0015170425,"about_ca_system_score_gemma":0.0020429117,"threshold_uncertainty_score":0.06814933},"labels":[],"label_agreement":null},{"id":"W7138957623","doi":"10.1109/icaiccit68829.2025.11434468","title":"AI-Enhanced Web Crawler for Real-Time Discovery of Emerging Trends in Sustainable Finance","year":2025,"lang":"","type":"article","venue":"","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Artificial Intelligence in Medicine (Canada)","funders":"","keywords":"Web crawler; Crawling; Latent Dirichlet allocation; Relevance (law); Semantic Web; Field (mathematics); Hyperlink; Term (time); Baseline (sea)","score_opus":0.007792141997870805,"score_gpt":0.2766169907717067,"score_spread":0.2688248487738359,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W7138957623","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.1931275,0.0013374414,0.46171603,0.0007582091,0.00031484055,0.0008378551,0.01598408,0.31684923,0.009074891],"genre_scores_gemma":[0.2899058,0.0003405861,0.671089,0.00027918324,0.00008343366,0.00054470106,0.028049842,0.001980442,0.007726982],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9990515,0.00016916303,0.00010912542,0.00027356064,0.00033513707,0.000061494495],"domain_scores_gemma":[0.99723685,0.0009471878,0.00019552503,0.00049318274,0.0010122017,0.000114996416],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.00079166464,0.00078753417,0.00069569476,0.0054486645,0.00066405797,0.0011182852,0.00071517244,0.00076484535,0.0017079138],"category_scores_gemma":[0.005193828,0.00041371226,0.0005243891,0.0026599613,0.00018561771,0.0014947577,0.00065915205,0.0007044758,0.0022551771],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0003370683,0.0004947822,0.014872861,0.00065989484,0.00021931737,0.00085544755,0.00059751206,0.015326029,0.042726956,0.0030748043,0.0787991,0.8420363],"study_design_scores_gemma":[0.00007261266,0.00018754137,0.012026955,0.00004726519,0.00006787273,0.0006672574,0.00019981788,0.90724736,0.038579762,0.0028238145,0.038015425,0.000064373846],"about_ca_topic_score_codex":0.008466241,"about_ca_topic_score_gemma":0.017239537,"teacher_disagreement_score":0.008466241,"about_ca_system_score_codex":0.0004891411,"about_ca_system_score_gemma":0.0009982744,"threshold_uncertainty_score":0.016833901},"labels":[],"label_agreement":null},{"id":"W7154241600","doi":"10.5281/zenodo.19561442","title":"Unlocking Web Histories: Leveraging LLMs and RAG to Transform Discovery in Web Archives","year":2025,"lang":"","type":"article","venue":"Zenodo (CERN European Organization for Nuclear Research)","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Victoria","funders":"","keywords":"Transparency (behavior); Stewardship (theology); Pipeline (software); Semantic Web; Digital preservation; Digital library; Cultural heritage","score_opus":0.023130088181055747,"score_gpt":0.23890262253628738,"score_spread":0.21577253435523164,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W7154241600","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.03880965,0.00094336073,0.9350391,0.0020536298,0.00008239445,0.00019386156,0.0009225946,0.016652625,0.0053026862],"genre_scores_gemma":[0.328576,0.0006875968,0.66169804,0.00043115957,0.00007985361,0.00016291022,0.0024089054,0.0019250007,0.004030546],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9973558,0.001203079,0.00018177135,0.00048637303,0.0006368844,0.00013603974],"domain_scores_gemma":[0.9905233,0.0056759035,0.0005113192,0.0024883074,0.0006150248,0.00018609966],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0046825935,0.0005695316,0.000682445,0.0032878097,0.0010323216,0.004952049,0.0016394687,0.0010810354,0.002697024],"category_scores_gemma":[0.023942571,0.00065807876,0.001317378,0.002175876,0.002394036,0.009978707,0.0047666347,0.0017694479,0.0017830874],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0003904567,0.00021367815,0.00789946,0.00068332383,0.00013039156,0.0007726981,0.0058070174,0.09687634,0.011617324,0.13474175,0.011802043,0.72906554],"study_design_scores_gemma":[0.000044340974,0.000112842514,0.0013693919,0.00014603908,0.00009027306,0.00042243546,0.0014516407,0.6539151,0.017296802,0.26922122,0.05581623,0.00011358339],"about_ca_topic_score_codex":0.00711574,"about_ca_topic_score_gemma":0.010575113,"teacher_disagreement_score":0.00711574,"about_ca_system_score_codex":0.0013117415,"about_ca_system_score_gemma":0.0019072917,"threshold_uncertainty_score":0.02476424},"labels":[],"label_agreement":null},{"id":"W7154409946","doi":"10.5281/zenodo.19561441","title":"Unlocking Web Histories: Leveraging LLMs and RAG to Transform Discovery in Web Archives","year":2025,"lang":"","type":"article","venue":"Zenodo (CERN European Organization for Nuclear Research)","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Victoria","funders":"","keywords":"Transparency (behavior); Stewardship (theology); Pipeline (software); Semantic Web; Digital preservation; Digital library; Cultural heritage","score_opus":0.023130088181055747,"score_gpt":0.23890262253628738,"score_spread":0.21577253435523164,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W7154409946","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.03880965,0.00094336073,0.9350391,0.0020536298,0.00008239445,0.00019386156,0.0009225946,0.016652625,0.0053026862],"genre_scores_gemma":[0.328576,0.0006875968,0.66169804,0.00043115957,0.00007985361,0.00016291022,0.0024089054,0.0019250007,0.004030546],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9973558,0.001203079,0.00018177135,0.00048637303,0.0006368844,0.00013603974],"domain_scores_gemma":[0.9905233,0.0056759035,0.0005113192,0.0024883074,0.0006150248,0.00018609966],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0046825935,0.0005695316,0.000682445,0.0032878097,0.0010323216,0.004952049,0.0016394687,0.0010810354,0.002697024],"category_scores_gemma":[0.023942571,0.00065807876,0.001317378,0.002175876,0.002394036,0.009978707,0.0047666347,0.0017694479,0.0017830874],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0003904567,0.00021367815,0.00789946,0.00068332383,0.00013039156,0.0007726981,0.0058070174,0.09687634,0.011617324,0.13474175,0.011802043,0.72906554],"study_design_scores_gemma":[0.000044340974,0.000112842514,0.0013693919,0.00014603908,0.00009027306,0.00042243546,0.0014516407,0.6539151,0.017296802,0.26922122,0.05581623,0.00011358339],"about_ca_topic_score_codex":0.00711574,"about_ca_topic_score_gemma":0.010575113,"teacher_disagreement_score":0.00711574,"about_ca_system_score_codex":0.0013117415,"about_ca_system_score_gemma":0.0019072917,"threshold_uncertainty_score":0.02476424},"labels":[],"label_agreement":null},{"id":"W73242358","doi":"","title":"Matching Unstructured Offers to Structured Product Descriptions","year":2011,"lang":"en","type":"article","venue":"Knowledge Discovery and Data Mining","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":3,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Toronto","funders":"","keywords":"Computer science; Matching (statistics); Product (mathematics); Component (thermodynamics); Function (biology); Information retrieval; Database; World Wide Web","score_opus":0.07683517453153065,"score_gpt":0.2881091713015354,"score_spread":0.21127399677000475,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W73242358","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.4234449,0.0007813415,0.5049238,0.0013994576,0.00019714097,0.001260351,0.02100552,0.032007746,0.014979691],"genre_scores_gemma":[0.44660598,0.00032360226,0.51455426,0.00044581454,0.00005846481,0.00021567314,0.030802162,0.0007748322,0.006219278],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.99824715,0.0002784183,0.0002012952,0.0004721291,0.0007158299,0.00008514592],"domain_scores_gemma":[0.99482524,0.0026286484,0.00060833374,0.0010158753,0.0007181194,0.00020384627],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.001953774,0.0006226811,0.00072205736,0.0035682772,0.0005247964,0.002077727,0.0015759884,0.001025189,0.006714671],"category_scores_gemma":[0.014228028,0.00047440952,0.0007366433,0.0031818408,0.00046466212,0.0036959245,0.002048856,0.00074175897,0.0024078144],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0019016948,0.0014585229,0.04512915,0.0011011367,0.0003121494,0.001479739,0.0015179378,0.04679032,0.025603686,0.031105718,0.05311886,0.79048115],"study_design_scores_gemma":[0.00020715664,0.0004391403,0.01305419,0.00014978931,0.00017382725,0.0010604417,0.0013126909,0.8041967,0.053906735,0.04545854,0.079896614,0.00014418401],"about_ca_topic_score_codex":0.0062731234,"about_ca_topic_score_gemma":0.009098802,"teacher_disagreement_score":0.006714671,"about_ca_system_score_codex":0.0009208868,"about_ca_system_score_gemma":0.0015393874,"threshold_uncertainty_score":0.022462845},"labels":[],"label_agreement":null},{"id":"W748835016","doi":"10.71781/23005","title":"Archivage du Web organisationnel dans une perspective archivistique","year":2012,"lang":"fr","type":"dissertation","venue":"Open MIND","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":true,"ca_institutions":"","funders":"Bibliothèque et Archives nationales du Québec","keywords":"World Wide Web; Web 2.0; Documentation; Web development; Web standards; Computer science; Political science; The Internet","score_opus":0.036603464457295586,"score_gpt":0.3076116863960171,"score_spread":0.27100822193872154,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W748835016","genre_codex":"other","genre_gemma":"other","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"other","genre_consensus":"other","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.05802645,0.038520165,0.06965349,0.08912566,0.002158021,0.000117754695,0.0005240097,0.00039568363,0.7414787],"genre_scores_gemma":[0.6709823,0.03965383,0.041887715,0.009593789,0.002323211,0.0002912867,0.00043293944,0.0004412326,0.23439367],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.9967069,0.0017556164,0.00013280864,0.00042309103,0.0006908283,0.00029082142],"domain_scores_gemma":[0.9958406,0.0022331288,0.00041468706,0.0005571575,0.00063368713,0.00032066664],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0032955315,0.000672374,0.00039985657,0.0031814415,0.00586768,0.020598894,0.0010817946,0.0037119386,0.0124586085],"category_scores_gemma":[0.0035733553,0.00033251173,0.00056859106,0.0031169192,0.021130137,0.019822817,0.0050935056,0.005463706,0.0021947445],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.000011319483,0.000009440876,0.00036817457,0.00011275433,0.000005160982,0.00019846154,0.029070277,0.00014953414,0.00033315422,0.9576943,0.004428736,0.0076186997],"study_design_scores_gemma":[0.000007864486,0.000019008632,0.0015582588,0.0006497189,0.000017858898,0.00083439413,0.048020348,0.0004913526,0.00079487107,0.24723865,0.70033944,0.000028247248],"about_ca_topic_score_codex":0.013975922,"about_ca_topic_score_gemma":0.015301807,"teacher_disagreement_score":0.020598894,"about_ca_system_score_codex":0.0063988375,"about_ca_system_score_gemma":0.004971268,"threshold_uncertainty_score":0.04642707},"labels":[],"label_agreement":null},{"id":"W75489045","doi":"10.1007/978-3-642-00672-2","title":"Advances in Data and Web Management","year":2009,"lang":"en","type":"book","venue":"Lecture notes in computer science","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":21,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Simon Fraser University","funders":"","keywords":"Computer science; China; Data management; World Wide Web; Joint (building); Library science; Data science; Database; History; Engineering","score_opus":0.014896951155173201,"score_gpt":0.2655749467259828,"score_spread":0.2506779955708096,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W75489045","genre_codex":"review","genre_gemma":"other","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"other","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.004191814,0.53329426,0.22245519,0.023100449,0.013735836,0.0001379917,0.0013300909,0.0028979746,0.1988564],"genre_scores_gemma":[0.0426363,0.5303198,0.16439298,0.0051640416,0.016173145,0.0002097076,0.002241991,0.0010630272,0.2377991],"study_design_codex":"design_other","study_design_gemma":"not_applicable","domain_scores_codex":[0.9988242,0.00013792752,0.00008176768,0.00013705934,0.0007610833,0.000057886442],"domain_scores_gemma":[0.9964083,0.0019865714,0.00014554185,0.0005901386,0.0007084453,0.00016106498],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0017673193,0.00096776383,0.0012563427,0.0037741812,0.000590404,0.0046131266,0.0013505054,0.001076228,0.017410347],"category_scores_gemma":[0.006035779,0.00053270586,0.0005705813,0.010042944,0.001273155,0.009479904,0.0018022216,0.0025971036,0.0097062625],"study_design_candidate":"not_applicable","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.000023249648,0.00007813921,0.00038039926,0.00092679186,0.000030550593,0.00005971131,0.00012463755,0.0010498352,0.0008589,0.13168244,0.19431321,0.6704721],"study_design_scores_gemma":[0.0000056813524,0.000015459786,0.00041781273,0.0002386913,0.000022417189,0.00022124381,0.00006674638,0.004450727,0.0006960614,0.12258593,0.8712647,0.000014491745],"about_ca_topic_score_codex":0.0010638362,"about_ca_topic_score_gemma":0.001234592,"teacher_disagreement_score":0.017410347,"about_ca_system_score_codex":0.0011650537,"about_ca_system_score_gemma":0.0014181236,"threshold_uncertainty_score":0.058243394},"labels":[],"label_agreement":null},{"id":"W78560407","doi":"10.1007/978-3-642-10687-3_10","title":"Automatic Topic Learning for Personalized Re-Ordering of Web Search Results","year":2010,"lang":"en","type":"book-chapter","venue":"Advances in intelligent and soft computing","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":7,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Memorial University of Newfoundland","funders":"","keywords":"Personalization; Computer science; Personalized search; Process (computing); World Wide Web; Information retrieval; Human–computer interaction","score_opus":0.028712808099205095,"score_gpt":0.30151495105577153,"score_spread":0.27280214295656646,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W78560407","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.07645814,0.005452663,0.8975279,0.0005013145,0.00035601313,0.00024774444,0.0019962632,0.013501367,0.003958577],"genre_scores_gemma":[0.41749668,0.001608079,0.5634425,0.00012260559,0.00072461955,0.00025446137,0.0060428805,0.00080722827,0.009500931],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9987531,0.0003452529,0.00010670084,0.00026272086,0.000360205,0.0001720924],"domain_scores_gemma":[0.9971414,0.0014152239,0.00018051213,0.0004946751,0.00062972243,0.00013836095],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0015626149,0.00080097996,0.0014776327,0.004194969,0.00077438453,0.0014163475,0.0014625626,0.00083642657,0.003228256],"category_scores_gemma":[0.0051846243,0.0005016575,0.0010784648,0.004090876,0.00033995227,0.002563881,0.0011129254,0.0014130824,0.0027997221],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00052275794,0.00032296963,0.0033757228,0.00025215716,0.000112660404,0.0000694119,0.0002170758,0.014102241,0.016917203,0.0028557174,0.024979534,0.93627256],"study_design_scores_gemma":[0.00008928608,0.00019723608,0.004665689,0.000037750404,0.00016971496,0.00033177756,0.00015963025,0.94578713,0.024624335,0.01383657,0.010033263,0.00006759285],"about_ca_topic_score_codex":0.0044933944,"about_ca_topic_score_gemma":0.009662479,"teacher_disagreement_score":0.0044933944,"about_ca_system_score_codex":0.00076152646,"about_ca_system_score_gemma":0.001330633,"threshold_uncertainty_score":0.010799587},"labels":[],"label_agreement":null},{"id":"W78876378","doi":"","title":"Intimate learning: a novel approach for combining labelled and unlabelled data","year":2005,"lang":"en","type":"article","venue":"","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":1,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Simon Fraser University","funders":"","keywords":"Bootstrapping (finance); Computer science; Task (project management); Web page; Set (abstract data type); Recall; Baseline (sea); Information retrieval; Data set; Information extraction; World Wide Web; Artificial intelligence; Machine learning; Psychology; Mathematics","score_opus":0.05913590242214067,"score_gpt":0.28420837584960196,"score_spread":0.22507247342746128,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W78876378","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.006890905,0.00023065138,0.98885894,0.00015424198,0.00007087546,0.00016793227,0.00014037892,0.0018794407,0.001606597],"genre_scores_gemma":[0.14567846,0.00024125836,0.8485394,0.00058368687,0.00026329965,0.00046123436,0.0013207449,0.00040407717,0.0025077905],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9876274,0.005807387,0.0005365252,0.0023702644,0.0032621396,0.00039622697],"domain_scores_gemma":[0.9774948,0.012647713,0.0010764183,0.0058493665,0.0024243146,0.00050730666],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.011574716,0.0016779805,0.0018290214,0.0053344467,0.0011613518,0.002539218,0.0052616536,0.0030607036,0.0028726168],"category_scores_gemma":[0.037033394,0.0010007523,0.0019297134,0.0040978445,0.0020387338,0.0061891438,0.0071200226,0.0030091687,0.0024441783],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.000331561,0.000483804,0.009075113,0.00034999466,0.00034998966,0.00032352333,0.0005781922,0.028562972,0.008133217,0.012643618,0.009068268,0.93009967],"study_design_scores_gemma":[0.000108206106,0.00043132462,0.0039778063,0.000241974,0.00020437871,0.00095756346,0.0003663938,0.86156654,0.01791998,0.08623116,0.027859125,0.0001356118],"about_ca_topic_score_codex":0.0011432759,"about_ca_topic_score_gemma":0.0024969452,"teacher_disagreement_score":0.011574716,"about_ca_system_score_codex":0.00078323984,"about_ca_system_score_gemma":0.00129682,"threshold_uncertainty_score":0.061213672},"labels":[],"label_agreement":null},{"id":"W791487440","doi":"10.29173/cais580","title":"Seeking Knowledge: The Role of Social Networks in the Adoption of eBooks by Historians","year":2013,"lang":"fr","type":"article","venue":"Proceedings of the Annual Conference of CAIS / Actes du congrès annuel de l ACSI","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":2,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":true,"route_about_ca":true,"ca_institutions":"Western University","funders":"","keywords":"Serendipity; Sociology; Humanities; Social science; Ethnology; Art; Epistemology; Philosophy","score_opus":0.017913602153492247,"score_gpt":0.23216347795410638,"score_spread":0.21424987580061414,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W791487440","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.98731333,0.0007730071,0.00037092983,0.0013010467,0.000007725112,0.000015996837,0.00005793209,0.0000054040706,0.010154507],"genre_scores_gemma":[0.99771833,0.0004984142,0.00022316613,0.000054464366,0.0000123924265,0.000005946031,0.000023816196,0.0000030185824,0.0014604229],"study_design_codex":"observational","study_design_gemma":"observational","domain_scores_codex":[0.9975401,0.0010535795,0.00016126239,0.00022903466,0.0007480465,0.0002678869],"domain_scores_gemma":[0.95872676,0.027052011,0.009182588,0.0009524285,0.0026776327,0.0014085382],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.005382137,0.00014184079,0.00021074718,0.0033134269,0.0017052963,0.003972968,0.00052047457,0.00067148736,0.004558478],"category_scores_gemma":[0.046329662,0.00022845177,0.00017578363,0.0029721402,0.0025555696,0.0037080948,0.001954824,0.0007087431,0.00029714315],"study_design_candidate":"observational","study_design_consensus":"observational","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.000155547,0.00007461404,0.6884607,0.0001616244,0.00004859536,0.00038465808,0.23888561,0.00016423146,0.00061686523,0.0033257096,0.0005832659,0.06713854],"study_design_scores_gemma":[0.00001655311,0.000106252395,0.6932702,0.00029106622,0.00005718733,0.00027527087,0.29156518,0.00066844904,0.00066785456,0.0016595464,0.011388608,0.00003389773],"about_ca_topic_score_codex":0.11451031,"about_ca_topic_score_gemma":0.15426508,"teacher_disagreement_score":0.11451031,"about_ca_system_score_codex":0.0037873604,"about_ca_system_score_gemma":0.0027186016,"threshold_uncertainty_score":0.22768754},"labels":[],"label_agreement":null},{"id":"W823080465","doi":"","title":"CHAPTERS: Focus On ACM SIGGRAPH Canadian Chapters","year":2004,"lang":"en","type":"article","venue":"ACM SIGGRAPH Computer Graphics","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":0,"is_retracted":false,"has_abstract":false,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":true,"ca_institutions":"","funders":"","keywords":"Focus (optics); Computer science; Computer graphics (images); Optics; Physics","score_opus":0.02261371538737573,"score_gpt":0.2321122006639958,"score_spread":0.20949848527662007,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W823080465","genre_codex":"other","genre_gemma":"other","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"other","genre_consensus":"other","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0019354557,0.05686617,0.0067776316,0.013233513,0.06616397,0.0004486984,0.009620457,0.0034301346,0.84152395],"genre_scores_gemma":[0.0034132919,0.023076713,0.0019074858,0.0009690672,0.0043287217,0.00008843139,0.003797921,0.0011650362,0.9612532],"study_design_codex":"not_applicable","study_design_gemma":"not_applicable","domain_scores_codex":[0.9992329,0.000048947582,0.000029465968,0.0001494661,0.00039270142,0.0001465658],"domain_scores_gemma":[0.9967283,0.00016864446,0.00008330358,0.00015127115,0.001836331,0.0010321557],"candidate_categories":["insufficient_payload"],"consensus_categories":[],"category_scores_codex":[0.00078853336,0.0015695811,0.0013320524,0.00829014,0.0030053144,0.006939348,0.0018998843,0.0012059113,0.41557503],"category_scores_gemma":[0.0023419322,0.0007059772,0.0010390996,0.01692018,0.00070985814,0.0037455538,0.002542181,0.0020464445,0.21544032],"study_design_candidate":"not_applicable","study_design_consensus":"not_applicable","about_ca_topic_candidate":true,"about_ca_topic_consensus":false,"about_ca_system_candidate":true,"about_ca_system_consensus":false,"study_design_scores_codex":[0.000008750408,0.000019609193,0.00010901038,0.00015245905,0.0000027018848,0.000008498092,0.000034671964,0.00011125968,0.00020662777,0.0021764496,0.94556636,0.051603533],"study_design_scores_gemma":[0.0000019847362,0.0000038248327,0.00036782358,0.00009342465,0.0000060062184,0.00001430439,0.00006543374,0.000056287256,0.00007101668,0.0005634706,0.99875283,0.0000035124522],"about_ca_topic_score_codex":0.085895754,"about_ca_topic_score_gemma":0.26239717,"teacher_disagreement_score":0.9965621,"about_ca_system_score_codex":0.0034378555,"about_ca_system_score_gemma":0.009385933,"threshold_uncertainty_score":0.8336113},"labels":[],"label_agreement":null},{"id":"W82701747","doi":"10.1145/2487788.2487913","title":"Automated exploration and analysis of ajax web applications with WebMole","year":2013,"lang":"en","type":"article","venue":"","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":3,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Université du Québec à Chicoutimi","funders":"","keywords":"Ajax; Computer science; JavaScript; Web page; World Wide Web; Web application; Client-side scripting; Programming language; Information retrieval; Static web page; Web navigation","score_opus":0.012066551487246946,"score_gpt":0.23238011955619892,"score_spread":0.22031356806895197,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W82701747","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.6022403,0.00079682085,0.2856204,0.00034481767,0.000048717204,0.00035157736,0.003748108,0.102536224,0.0043129683],"genre_scores_gemma":[0.75296444,0.00024985563,0.23413834,0.00013783632,0.000016347323,0.00024180488,0.0069376747,0.0028946176,0.0024190927],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9982729,0.00034380253,0.00016206315,0.00032918644,0.0007434351,0.0001486503],"domain_scores_gemma":[0.9942364,0.0032928851,0.0004644538,0.0010960859,0.0007690688,0.00014100777],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0015019465,0.00091354415,0.0007426533,0.002715156,0.000413746,0.0015108788,0.0012407994,0.0007248413,0.0018858837],"category_scores_gemma":[0.0070424457,0.000550134,0.0007293236,0.0013515423,0.0006256776,0.0019317091,0.001280715,0.0008101773,0.0007576546],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.002738713,0.001402993,0.08424287,0.0019855262,0.00047373658,0.0037529247,0.0023110253,0.07704539,0.2010821,0.0126404185,0.025317052,0.5870073],"study_design_scores_gemma":[0.00017792945,0.00046715673,0.02776416,0.00010786236,0.000076839504,0.0009424397,0.00039147562,0.8355126,0.10740281,0.011047565,0.015992606,0.00011657342],"about_ca_topic_score_codex":0.0015115062,"about_ca_topic_score_gemma":0.0026692294,"teacher_disagreement_score":0.002715156,"about_ca_system_score_codex":0.0003456598,"about_ca_system_score_gemma":0.0006183609,"threshold_uncertainty_score":0.007943153},"labels":[],"label_agreement":null},{"id":"W85218895","doi":"","title":"Omeka: Open Source Web Publishing for Research, Collections and Exhibitions","year":2008,"lang":"en","type":"article","venue":"The open source business resource","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":5,"is_retracted":false,"has_abstract":false,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":true,"route_about_ca":false,"ca_institutions":"","funders":"","keywords":"Exhibition; Open source; World Wide Web; Open access publishing; Publishing; Computer science; Art; Visual arts; Software; Operating system","score_opus":0.11726539085799516,"score_gpt":0.33029914494538454,"score_spread":0.2130337540873894,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W85218895","genre_codex":"software","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.008326491,0.0029729859,0.21747606,0.003530299,0.0056440607,0.00085094606,0.1473684,0.3782557,0.23557508],"genre_scores_gemma":[0.054415017,0.005109926,0.15931576,0.0012843542,0.0034580799,0.0011072301,0.23955338,0.13521047,0.40054575],"study_design_codex":"not_applicable","study_design_gemma":"not_applicable","domain_scores_codex":[0.9975211,0.00021409216,0.00031361773,0.00024892154,0.0014235964,0.00027864677],"domain_scores_gemma":[0.98777395,0.0031393347,0.00092681986,0.004295576,0.0021564264,0.0017078826],"candidate_categories":["scholarly_communication"],"consensus_categories":[],"category_scores_codex":[0.0023769438,0.0013132596,0.0012022926,0.012999649,0.001783955,0.008749866,0.0021751213,0.0013779046,0.19125034],"category_scores_gemma":[0.020292139,0.0010974376,0.001387148,0.012543963,0.0007178905,0.009285267,0.0054059387,0.0023579842,0.13805996],"study_design_candidate":"not_applicable","study_design_consensus":"not_applicable","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0003293191,0.00014500527,0.0010721266,0.0010253603,0.00009139656,0.00024857433,0.0002996715,0.0004059496,0.005241943,0.014468055,0.68409216,0.2925804],"study_design_scores_gemma":[0.00008286021,0.00003440648,0.0032809833,0.00021297613,0.000072551855,0.00039468094,0.00015479026,0.002703563,0.0039053857,0.01993486,0.96913344,0.000089557885],"about_ca_topic_score_codex":0.0018931321,"about_ca_topic_score_gemma":0.0032661373,"teacher_disagreement_score":0.99125016,"about_ca_system_score_codex":0.00057195395,"about_ca_system_score_gemma":0.0020127466,"threshold_uncertainty_score":0.63979614},"labels":[],"label_agreement":null},{"id":"W88942606","doi":"10.1007/978-1-4614-6596-6_14","title":"Novel and Applied Algorithms in a Search Engine for Java Code Snippets","year":2013,"lang":"en","type":"book-chapter","venue":"","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":0,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of British Columbia","funders":"","keywords":"Snippet; Computer science; Search engine indexing; Information retrieval; Metadata; Search engine; Code (set theory); Java; World Wide Web; Full text search; Web search engine; Matching (statistics); Web search query; Programming language","score_opus":0.0394253562477291,"score_gpt":0.25284778729985524,"score_spread":0.21342243105212613,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W88942606","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.010322154,0.00095640594,0.96141154,0.00039513235,0.0002723805,0.00026058187,0.00093061297,0.021151287,0.0042998167],"genre_scores_gemma":[0.03584495,0.0004688088,0.9503979,0.00020583953,0.00012122407,0.00019292974,0.0016735713,0.0011800546,0.009914702],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9982344,0.00023777585,0.00017296086,0.00034227985,0.0008999024,0.000112722664],"domain_scores_gemma":[0.9983785,0.0006991604,0.00007163615,0.0002508908,0.00052347867,0.00007628843],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0013403868,0.0013187006,0.0012250462,0.004431907,0.001149698,0.0032505845,0.0030644757,0.0017846369,0.009441434],"category_scores_gemma":[0.0054806885,0.00062537886,0.0013142745,0.004959169,0.0006929236,0.0035857295,0.0021446215,0.0015874812,0.006697218],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00030444658,0.00030985303,0.002023663,0.00046478907,0.00017580588,0.00022019727,0.00019298207,0.012161186,0.019961582,0.02891873,0.0403771,0.89488965],"study_design_scores_gemma":[0.000103182574,0.00013844232,0.0011563568,0.00011160485,0.00016605019,0.0008055307,0.00019362626,0.8706929,0.046237294,0.03845286,0.041863453,0.00007877922],"about_ca_topic_score_codex":0.004539345,"about_ca_topic_score_gemma":0.007753134,"teacher_disagreement_score":0.009441434,"about_ca_system_score_codex":0.00090614427,"about_ca_system_score_gemma":0.0016807953,"threshold_uncertainty_score":0.03158474},"labels":[],"label_agreement":null},{"id":"W939959114","doi":"10.1007/978-3-319-08245-5_12","title":"Indexing Rich Internet Applications Using Components-Based Crawling","year":2014,"lang":"en","type":"book-chapter","venue":"Lecture notes in computer science","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":6,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"IBM (Canada); University of Ottawa","funders":"Natural Sciences and Engineering Research Council of Canada","keywords":"Crawling; Computer science; Ajax; JavaScript; Search engine indexing; Component (thermodynamics); The Internet; Client-side; Server-side; Web crawler; Rich Internet application; Server; Data mining; Artificial intelligence; Database; Web application; Operating system; World Wide Web","score_opus":0.03151291672662897,"score_gpt":0.26692319427048083,"score_spread":0.23541027754385185,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W939959114","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.28056768,0.009085044,0.59690154,0.0006819517,0.00050394045,0.001725913,0.0144498,0.07826338,0.017820682],"genre_scores_gemma":[0.3885654,0.0034068194,0.5531982,0.00020463979,0.00028009608,0.00057271845,0.039183456,0.0035792377,0.011009438],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.99795437,0.00018890979,0.0002402863,0.000336309,0.0011124361,0.0001676725],"domain_scores_gemma":[0.99645185,0.0008564209,0.00025606313,0.00108659,0.0011714813,0.00017759776],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0006130572,0.0016967949,0.0018580165,0.018731192,0.0013075006,0.0034231253,0.0016937121,0.0011167369,0.0014851241],"category_scores_gemma":[0.0043654838,0.0010337264,0.0014830953,0.018400015,0.0005515753,0.0039308323,0.0019224031,0.00087927026,0.0022672703],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00036177362,0.00045076793,0.018797414,0.0010802918,0.00040278613,0.0005095011,0.00054455607,0.011348171,0.051781595,0.0059517347,0.04579649,0.8629748],"study_design_scores_gemma":[0.00010865649,0.0003633154,0.033650544,0.00022926954,0.00086158834,0.0019836745,0.00067763386,0.78675956,0.075446695,0.029437903,0.07026454,0.00021673729],"about_ca_topic_score_codex":0.009617379,"about_ca_topic_score_gemma":0.023614291,"teacher_disagreement_score":0.018731192,"about_ca_system_score_codex":0.0007000787,"about_ca_system_score_gemma":0.0013925027,"threshold_uncertainty_score":0.019122839},"labels":[],"label_agreement":null},{"id":"W99763915","doi":"","title":"Search Engine Adaptation by Feedback Control Adjustment for Time-sensitive Query","year":2009,"lang":"en","type":"article","venue":"North American Chapter of the Association for Computational Linguistics","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":3,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Université de Montréal","funders":"","keywords":"Computer science; Adaptation (eye); Search engine; Control (management); Information retrieval; Artificial intelligence; Psychology","score_opus":0.010310498709422678,"score_gpt":0.239400819674497,"score_spread":0.2290903209650743,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W99763915","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.17270596,0.0017611545,0.79989755,0.00057153666,0.0006526272,0.00040162663,0.00031174216,0.018999329,0.0046984837],"genre_scores_gemma":[0.92518115,0.000152708,0.07098637,0.0002116561,0.00014257034,0.00010164508,0.00027534142,0.00040036353,0.0025482813],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9984547,0.00027840666,0.000119681834,0.0004846414,0.00046873555,0.00019381238],"domain_scores_gemma":[0.99597734,0.0017293958,0.00022095855,0.0006216256,0.0012938015,0.00015690543],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0020204326,0.0009272467,0.001330773,0.0011136375,0.00053460523,0.001245438,0.0018552302,0.0011194774,0.0034422886],"category_scores_gemma":[0.013864012,0.00040592847,0.0004914049,0.0010265122,0.00046145587,0.00183312,0.0009396269,0.0012660627,0.0010309485],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0018725259,0.0013382096,0.0049124532,0.0002974466,0.00019936783,0.0002527951,0.00039209667,0.07376473,0.12476033,0.0031419045,0.012594447,0.7764737],"study_design_scores_gemma":[0.00009577196,0.00019298724,0.0024064193,0.000008428331,0.000088573746,0.00011077063,0.0000584281,0.96691185,0.026402334,0.0016809001,0.0020000713,0.000043571647],"about_ca_topic_score_codex":0.0077570155,"about_ca_topic_score_gemma":0.0059818467,"teacher_disagreement_score":0.0077570155,"about_ca_system_score_codex":0.0006733516,"about_ca_system_score_gemma":0.0011930895,"threshold_uncertainty_score":0.015423715},"labels":[],"label_agreement":null}]}