{"meta":{"query_hash":"8e06b9c4de61","filters":{"topic":"Authorship Attribution and Profiling"},"cohort_total":216,"direct_labels_cover":0,"predictions_cover":216,"exported":216,"export_cap":100000,"truncated":false,"label_status":"direct model label, unvalidated","prediction_status":"machine_predicted_unvalidated (Codex and Gemma teacher distillation)","score_status":"score_only:v0-immature-baseline","snapshot":{"source":"OpenAlex, pinned release, all 482 partitions","release":"2026-06-24","frame_built":"2026-07-12"},"permalink":"https://metacan.xera.ac/q/8e06b9c4de61","api":"https://metacan.xera.ac/api/v1/cohort?topic=Authorship+Attribution+and+Profiling"},"results":[{"id":"W1014449310","doi":"10.1609/icwsm.v6i1.14340","title":"Homophily and Latent Attribute Inference: Inferring Latent Attributes of Twitter Users from Neighbors","year":2021,"lang":"en","type":"article","venue":"Proceedings of the International AAAI Conference on Web and Social Media","topic":"Authorship Attribution and Profiling","field":"Computer Science","cited_by":319,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"McGill University","funders":"","keywords":"Homophily; Assortativity; Inference; Computer science; Context (archaeology); Instant messaging; Machine learning; Artificial intelligence; World Wide Web; Psychology; Social psychology; Geography; Complex network","score_opus":0.06759890956918559,"score_gpt":0.2797267150628564,"score_spread":0.21212780549367083,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W1014449310","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.48288795,0.00073030306,0.5093342,0.0007365027,0.000059251488,0.00009768425,0.0011463127,0.0006892769,0.0043184888],"genre_scores_gemma":[0.97432286,0.00010769291,0.02443077,0.00004943309,0.000057351594,0.000024441626,0.00048993825,0.000017834325,0.0004996461],"study_design_codex":"observational","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.99737597,0.0014095365,0.00012474989,0.00055749126,0.00036915683,0.00016306707],"domain_scores_gemma":[0.9836556,0.011222919,0.0013545302,0.0028214175,0.0006234149,0.00032222134],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0035144861,0.00059964956,0.0009368378,0.002604025,0.00092005194,0.0017448945,0.0011232942,0.0010498216,0.0017556421],"category_scores_gemma":[0.020837154,0.00035954104,0.00079604506,0.0019827196,0.00060292304,0.0044363383,0.0015584336,0.001253901,0.0007937892],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0012725315,0.00086734584,0.42363104,0.00037777555,0.0011842162,0.00047864093,0.0026201722,0.12745027,0.0051596044,0.034390837,0.0038894163,0.39867812],"study_design_scores_gemma":[0.00002570468,0.000088023124,0.02643022,0.000047370795,0.00011425702,0.00025881402,0.00067733857,0.9131336,0.0039157164,0.053873774,0.0013892592,0.000045909364],"about_ca_topic_score_codex":0.0027795052,"about_ca_topic_score_gemma":0.0030892324,"teacher_disagreement_score":0.0035144861,"about_ca_system_score_codex":0.00047125207,"about_ca_system_score_gemma":0.00051136734,"threshold_uncertainty_score":0.018586576},"labels":[],"label_agreement":null},{"id":"W112115809","doi":"","title":"Herbert west: deanonymizer","year":2011,"lang":"en","type":"article","venue":"","topic":"Authorship Attribution and Profiling","field":"Computer Science","cited_by":19,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of British Columbia","funders":"","keywords":"Anonymity; Computer science; Selection (genetic algorithm); Face (sociological concept); Quality (philosophy); Simple (philosophy); Internet privacy; Data science; World Wide Web; Computer security; Artificial intelligence; Sociology; Epistemology","score_opus":0.07896113860058249,"score_gpt":0.25476936750656703,"score_spread":0.17580822890598455,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W112115809","genre_codex":"other","genre_gemma":"software","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"software","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.008117647,0.017542481,0.27650568,0.13710313,0.03993601,0.0007770221,0.0085636,0.052790195,0.4586642],"genre_scores_gemma":[0.09404498,0.012282842,0.08957411,0.011418293,0.008988642,0.0006347202,0.005638757,0.011561816,0.76585585],"study_design_codex":"not_applicable","study_design_gemma":"not_applicable","domain_scores_codex":[0.9914266,0.0026968878,0.0007899555,0.0016874722,0.0029096948,0.0004894728],"domain_scores_gemma":[0.9764506,0.0066247997,0.002107057,0.0044723544,0.007711858,0.002633294],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.006817743,0.0009491135,0.0010221102,0.0058809877,0.0032718768,0.0046454803,0.0015325522,0.0023170488,0.16266589],"category_scores_gemma":[0.043053545,0.0008501829,0.00032983025,0.0061065215,0.0015998307,0.011058103,0.0036749314,0.0025596032,0.1487633],"study_design_candidate":"not_applicable","study_design_consensus":"not_applicable","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.000072759554,0.000014945937,0.0008150142,0.00012376676,0.000005552446,0.000090517846,0.0005023334,0.00014037927,0.0005929487,0.02963784,0.807933,0.16007094],"study_design_scores_gemma":[0.000012839994,0.000008280396,0.0002968531,0.0000633534,0.000003575334,0.00016323489,0.00018510717,0.0006169321,0.0008433891,0.008000125,0.98978007,0.00002615068],"about_ca_topic_score_codex":0.0026362387,"about_ca_topic_score_gemma":0.0032585226,"teacher_disagreement_score":0.16266589,"about_ca_system_score_codex":0.0016385511,"about_ca_system_score_gemma":0.0035336858,"threshold_uncertainty_score":0.5441716},"labels":[],"label_agreement":null},{"id":"W140340549","doi":"10.63317/2id75yrzanby","title":"Using the Complexity of the Distribution of Lexical Elements as a Feature in Authorship Attribution","year":2008,"lang":"en","type":"article","venue":"","topic":"Authorship Attribution and Profiling","field":"Computer Science","cited_by":15,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Ottawa","funders":"","keywords":"Punctuation; Authorship attribution; Computer science; Artificial intelligence; Natural language processing; Feature (linguistics); Support vector machine; Noun; Linguistics","score_opus":0.2062589589989079,"score_gpt":0.3485729465110212,"score_spread":0.14231398751211333,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W140340549","genre_codex":"empirical","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.53397,0.00037223165,0.46189144,0.00025888596,0.000086090935,0.000088239154,0.0005997791,0.0010903722,0.0016429881],"genre_scores_gemma":[0.9539549,0.00013002816,0.044798594,0.000015976868,0.00006542081,0.000049264483,0.0003902194,0.00006203394,0.00053354114],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9970521,0.00094681315,0.00037194535,0.00055571937,0.0009085485,0.00016498256],"domain_scores_gemma":[0.9538644,0.035015542,0.0049088784,0.0038105096,0.0018833946,0.000517314],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0038599665,0.0008225345,0.0008928261,0.0055729444,0.0006123842,0.002213079,0.000797908,0.0012500659,0.0011967893],"category_scores_gemma":[0.034197558,0.00042180606,0.0007751461,0.003594026,0.0010665912,0.00518641,0.0013469203,0.0011816949,0.0007398419],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0011622714,0.00062108366,0.22313946,0.0005398668,0.00039399104,0.00077521114,0.0011817054,0.07765642,0.06562121,0.011029327,0.0023589658,0.6155204],"study_design_scores_gemma":[0.000039803257,0.0004823197,0.108661115,0.00006656859,0.0001338281,0.0016279874,0.00032000188,0.8027042,0.052005652,0.03160568,0.0021012223,0.00025158495],"about_ca_topic_score_codex":0.00056271476,"about_ca_topic_score_gemma":0.00060021394,"teacher_disagreement_score":0.0055729444,"about_ca_system_score_codex":0.0006531607,"about_ca_system_score_gemma":0.00042365308,"threshold_uncertainty_score":0.020413697},"labels":[],"label_agreement":null},{"id":"W1529548342","doi":"10.19173/irrodl.v13i5.1239","title":"Protecting students' intellectual property in the web plagiarism detection process","year":2012,"lang":"en","type":"article","venue":"The International Review of Research in Open and Distributed Learning","topic":"Authorship Attribution and Profiling","field":"Computer Science","cited_by":11,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":true,"route_about_ca":false,"ca_institutions":"Concordia University of Edmonton","funders":"","keywords":"Intellectual property; Mainstream; Criticism; The Internet; Computer science; Class (philosophy); Architecture; Process (computing); World Wide Web; Plagiarism detection; Service (business); Property (philosophy); Learning Management; Political science; Business; Law; Information retrieval; Artificial intelligence","score_opus":0.1369554263725723,"score_gpt":0.4694045877902428,"score_spread":0.3324491614176705,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W1529548342","genre_codex":"empirical","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.44803742,0.0059999325,0.4359932,0.011340538,0.0005323003,0.0013507388,0.00030961694,0.0035297477,0.09290657],"genre_scores_gemma":[0.92266476,0.001207303,0.06522024,0.00041136827,0.00017219964,0.00022597231,0.00015249963,0.0001696365,0.0097760735],"study_design_codex":"design_other","study_design_gemma":"not_applicable","domain_scores_codex":[0.9603105,0.02268003,0.0024777174,0.002292444,0.0104132155,0.001826043],"domain_scores_gemma":[0.7776197,0.122103065,0.028430419,0.043090537,0.02458485,0.004171394],"candidate_categories":["research_integrity"],"consensus_categories":[],"category_scores_codex":[0.038479023,0.00042325747,0.00096856226,0.004415493,0.00370038,0.011170554,0.0023199155,0.0030111934,0.002972533],"category_scores_gemma":[0.1610466,0.00062168785,0.00045436202,0.003986513,0.003081743,0.012084572,0.005415667,0.0025913958,0.0029471572],"study_design_candidate":"not_applicable","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0005190269,0.00047505964,0.06040193,0.00041207173,0.00004259662,0.0005824656,0.009106929,0.0024208664,0.0046895402,0.049542923,0.006341294,0.8654654],"study_design_scores_gemma":[0.00036103456,0.001671725,0.16200039,0.0028856953,0.00055946346,0.0056649866,0.026888644,0.15024039,0.16509096,0.21800922,0.2660822,0.00054535497],"about_ca_topic_score_codex":0.0020201039,"about_ca_topic_score_gemma":0.0019008656,"teacher_disagreement_score":0.99698883,"about_ca_system_score_codex":0.0021977506,"about_ca_system_score_gemma":0.007627855,"threshold_uncertainty_score":0.2034989},"labels":[],"label_agreement":null},{"id":"W1543116020","doi":"","title":"Web-based inference detection","year":2007,"lang":"en","type":"article","venue":"","topic":"Authorship Attribution and Profiling","field":"Computer Science","cited_by":41,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Waterloo","funders":"","keywords":"Computer science; Inference; Salient; Information retrieval; Identification (biology); Web application; Data science; Data mining; Artificial intelligence; World Wide Web","score_opus":0.033159029223423515,"score_gpt":0.30233526106392966,"score_spread":0.26917623184050615,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W1543116020","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.035641443,0.0005536286,0.923868,0.00071369903,0.00016281837,0.0005473198,0.002803654,0.02843341,0.0072759534],"genre_scores_gemma":[0.43995243,0.00042724694,0.5419997,0.0006459935,0.00031460536,0.00064102723,0.0065929024,0.0020589887,0.007367108],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.97453386,0.0054237167,0.0022902002,0.004396348,0.01256462,0.00079122826],"domain_scores_gemma":[0.8664294,0.086227976,0.012544677,0.020646697,0.013088463,0.0010628462],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.014292241,0.0011905408,0.0016828688,0.00969508,0.0014271669,0.005859466,0.0037287397,0.002221305,0.00554397],"category_scores_gemma":[0.09779859,0.00086056814,0.0012597464,0.004239505,0.0013959742,0.0070990296,0.0033493584,0.0027302967,0.0028094957],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00095110014,0.0005093159,0.060028445,0.00096141064,0.00046133628,0.0014923374,0.002032486,0.023569867,0.023188379,0.06880824,0.029271405,0.7887257],"study_design_scores_gemma":[0.00008441694,0.00013010879,0.01403872,0.00015634242,0.00020580557,0.0014194803,0.00039749074,0.7648615,0.09124108,0.082140446,0.045155186,0.0001694419],"about_ca_topic_score_codex":0.0044681365,"about_ca_topic_score_gemma":0.0039922385,"teacher_disagreement_score":0.014292241,"about_ca_system_score_codex":0.0016436873,"about_ca_system_score_gemma":0.0024485164,"threshold_uncertainty_score":0.075585485},"labels":[],"label_agreement":null},{"id":"W1595390009","doi":"","title":"Cybergenre: automatic identification of home pages on the web","year":2004,"lang":"en","type":"article","venue":"Journal of Web Engineering","topic":"Authorship Attribution and Profiling","field":"Computer Science","cited_by":40,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Dalhousie University","funders":"","keywords":"Web page; Home page; Computer science; World Wide Web; Classifier (UML); Information retrieval; Static web page; Web development; The Internet; Artificial intelligence","score_opus":0.017422342403193965,"score_gpt":0.23196521824785749,"score_spread":0.21454287584466353,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W1595390009","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.8749635,0.001252102,0.087257266,0.0002586371,0.00014002717,0.0003959782,0.0069611487,0.017343452,0.011427803],"genre_scores_gemma":[0.87834567,0.00045753355,0.101511925,0.000053248896,0.00007881867,0.000115606614,0.010538473,0.00024029343,0.008658449],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.99946076,0.00014158484,0.000045996516,0.0001287626,0.00015922576,0.00006368572],"domain_scores_gemma":[0.9980952,0.0006870924,0.00030278633,0.00037865192,0.00039197668,0.00014435385],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0006991696,0.00047127344,0.0004645302,0.00547107,0.00032382246,0.0010835062,0.00039290174,0.00055583904,0.0025623525],"category_scores_gemma":[0.0025896514,0.00014800447,0.00026008152,0.0016596785,0.0002016907,0.001966214,0.0006500983,0.0003932257,0.002060993],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00088285486,0.00055346417,0.10173887,0.00048279096,0.000117041884,0.00057705166,0.0006385991,0.0040802364,0.031435028,0.0017996485,0.01772431,0.8399702],"study_design_scores_gemma":[0.00008390744,0.0004569212,0.2794515,0.00017431534,0.00011304287,0.0024442924,0.0015471721,0.5982065,0.08206464,0.0069633806,0.028389838,0.000104475],"about_ca_topic_score_codex":0.0016759512,"about_ca_topic_score_gemma":0.0030548803,"teacher_disagreement_score":0.00547107,"about_ca_system_score_codex":0.0002910169,"about_ca_system_score_gemma":0.00027812374,"threshold_uncertainty_score":0.008571923},"labels":[],"label_agreement":null},{"id":"W1970306474","doi":"10.1353/cjp.2011.0028","title":"Description, Disagreement, and Fictional Names","year":2011,"lang":"en","type":"article","venue":"Canadian Journal of Philosophy","topic":"Authorship Attribution and Profiling","field":"Computer Science","cited_by":15,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Lethbridge","funders":"","keywords":"Fictional universe; Philosophy; Proper noun; Epistemology; Emptiness; Linguistics; Narrative","score_opus":0.08777744241595391,"score_gpt":0.22824566053096923,"score_spread":0.1404682181150153,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W1970306474","genre_codex":"other","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.16614926,0.007612613,0.24002962,0.04706286,0.0006731388,0.00013964217,0.0005113138,0.00033777606,0.53748375],"genre_scores_gemma":[0.9826484,0.00058779237,0.007512926,0.0008932973,0.00013863112,0.000055927914,0.00017012676,0.000050533406,0.007942374],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.985657,0.0078019216,0.0007410701,0.0017382569,0.0030677565,0.0009940114],"domain_scores_gemma":[0.97674495,0.014383285,0.002335244,0.0031303472,0.0026379328,0.0007682601],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.010908727,0.0004138109,0.00065184414,0.0037682161,0.0074515496,0.008155659,0.0021175698,0.0039169625,0.006253047],"category_scores_gemma":[0.03292422,0.00044065437,0.00043726753,0.0048094103,0.030886583,0.026345817,0.007716376,0.0036354011,0.0005664536],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.000008877507,0.0000030665246,0.00032454662,0.000018129122,0.0000018699117,0.000025824487,0.0046451977,0.00010844824,0.000026166328,0.9904054,0.00067357405,0.0037587886],"study_design_scores_gemma":[0.0000088837405,0.000005353258,0.00029029624,0.000058436253,0.000005899523,0.00009191473,0.004727292,0.00091794145,0.00021184454,0.96386015,0.029807076,0.00001488042],"about_ca_topic_score_codex":0.0028626798,"about_ca_topic_score_gemma":0.0016565645,"teacher_disagreement_score":0.010908727,"about_ca_system_score_codex":0.008160269,"about_ca_system_score_gemma":0.0026556498,"threshold_uncertainty_score":0.05920714},"labels":[],"label_agreement":null},{"id":"W1972155407","doi":"10.5539/ass.v11n5p344","title":"Suicide Motives in Russian and European Literary Tradition","year":2015,"lang":"en","type":"article","venue":"Asian Social Science","topic":"Authorship Attribution and Profiling","field":"Computer Science","cited_by":2,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":true,"route_about_ca":false,"ca_institutions":"","funders":"","keywords":"Diversity (politics); Russian literature; Sociology; Psychology; Political science; Literature; History; Art; Law","score_opus":0.054734609613309226,"score_gpt":0.3019931995423561,"score_spread":0.24725858992904687,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W1972155407","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.9915895,0.0009802604,0.00012086258,0.00028961673,0.000018859628,0.0000021558767,0.000008843706,0.0000026958223,0.006987236],"genre_scores_gemma":[0.9991549,0.00030711276,0.00004227529,0.000019939005,0.000011759213,0.0000010702726,0.000006500665,0.0000019053413,0.00045444327],"study_design_codex":"qualitative","study_design_gemma":"qualitative","domain_scores_codex":[0.9988128,0.0007413939,0.0000767691,0.00009224284,0.00016477516,0.00011203295],"domain_scores_gemma":[0.99804735,0.0008428752,0.0006342501,0.00012047636,0.00018843614,0.00016660067],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.001629654,0.00018299803,0.00020700786,0.001695449,0.0016303929,0.0020569996,0.00022293015,0.00039989527,0.0010314849],"category_scores_gemma":[0.0045580086,0.000110868416,0.00010157907,0.0012402158,0.0028044067,0.0011886638,0.0013559504,0.00043718435,0.0001574244],"study_design_candidate":"qualitative","study_design_consensus":"qualitative","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0002343558,0.00006890554,0.22168747,0.00018268888,0.00007726893,0.0017097414,0.69085777,0.00016340354,0.0018601667,0.034530994,0.0010399303,0.047587216],"study_design_scores_gemma":[0.000019419807,0.0001971564,0.54857993,0.00045860332,0.00006132481,0.004736971,0.39502499,0.0006521835,0.0009935468,0.008368438,0.0408588,0.000048596845],"about_ca_topic_score_codex":0.00092676847,"about_ca_topic_score_gemma":0.0015928153,"teacher_disagreement_score":0.0020569996,"about_ca_system_score_codex":0.00057792896,"about_ca_system_score_gemma":0.00030175,"threshold_uncertainty_score":0.008618534},"labels":[],"label_agreement":null},{"id":"W1985913097","doi":"10.1109/eict.2014.6777864","title":"Native Language Identification using probabilistic graphical models","year":2014,"lang":"en","type":"article","venue":"2013 International Conference on Electrical Information and Communication Technology (EICT)","topic":"Authorship Attribution and Profiling","field":"Computer Science","cited_by":4,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Alberta","funders":"","keywords":"Computer science; Graphical model; Artificial intelligence; Support vector machine; Probabilistic logic; Task (project management); Feature (linguistics); Principle of maximum entropy; Point (geometry); Natural language processing; Entropy (arrow of time); Identification (biology); Naive Bayes classifier; Machine learning; Pattern recognition (psychology); Mathematics","score_opus":0.03629424243890863,"score_gpt":0.3031466464180493,"score_spread":0.2668524039791407,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W1985913097","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.04294455,0.0004631982,0.9489942,0.0010361087,0.000057642017,0.00006672666,0.00071036624,0.0028454363,0.0028817393],"genre_scores_gemma":[0.8515342,0.0004904906,0.14218408,0.00029627883,0.00010881962,0.00014355632,0.0017436465,0.00024839127,0.0032506087],"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9974597,0.001345587,0.00008815983,0.00049919204,0.00044300323,0.00016440042],"domain_scores_gemma":[0.9898432,0.007826376,0.0008372184,0.00062158454,0.0006865606,0.000185113],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.00269233,0.0009261134,0.0007613821,0.0032202548,0.0005977218,0.002512467,0.0014766403,0.001359909,0.0034619558],"category_scores_gemma":[0.017800905,0.00061577844,0.0013617352,0.0017559715,0.000901857,0.0035248436,0.0014521774,0.0016218942,0.0018073089],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00044450327,0.0002716185,0.018172013,0.00024765485,0.0002472611,0.0004723194,0.0006542901,0.6250513,0.0029997125,0.09484446,0.012854913,0.24373998],"study_design_scores_gemma":[0.000008472148,0.000013575456,0.00063290464,0.000014981615,0.00001351446,0.00006849758,0.000022276668,0.9552936,0.00027293776,0.042838205,0.00080820255,0.000012829177],"about_ca_topic_score_codex":0.0066378894,"about_ca_topic_score_gemma":0.006084185,"teacher_disagreement_score":0.0066378894,"about_ca_system_score_codex":0.0011050365,"about_ca_system_score_gemma":0.00090303924,"threshold_uncertainty_score":0.014238536},"labels":[],"label_agreement":null},{"id":"W1994431053","doi":"10.1007/s10502-012-9192-3","title":"Genre studies and archives: introduction to the special issue","year":2012,"lang":"en","type":"article","venue":"Archives and Museum Informatics","topic":"Authorship Attribution and Profiling","field":"Computer Science","cited_by":5,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Toronto","funders":"","keywords":"Relevance (law); Archivist; Discipline; Focus (optics); Quality (philosophy); Archival science; History; Sociology; Computer science; Linguistics; Library science; Epistemology; Social science; Political science","score_opus":0.02583383675212461,"score_gpt":0.2791640543703224,"score_spread":0.25333021761819774,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W1994431053","genre_codex":"editorial","genre_gemma":"editorial","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"editorial","genre_consensus":"editorial","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0007998949,0.30113083,0.006723731,0.12468458,0.5265829,0.00007723372,0.00043634334,0.00022411357,0.039340273],"genre_scores_gemma":[0.004209445,0.13712469,0.002572517,0.025024012,0.7765834,0.000118671545,0.00058069895,0.0003327997,0.053453725],"study_design_codex":"not_applicable","study_design_gemma":"not_applicable","domain_scores_codex":[0.9980494,0.00051900145,0.00026739866,0.0003660868,0.000636071,0.00016220422],"domain_scores_gemma":[0.9890398,0.0055592507,0.0005863606,0.00068611914,0.0026226628,0.001505956],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0035667992,0.0015985995,0.0022944761,0.00957639,0.0031997948,0.0111105135,0.0019263477,0.005744544,0.021935996],"category_scores_gemma":[0.00949562,0.00087553356,0.0015139492,0.008053877,0.003158276,0.012059675,0.005745674,0.010144777,0.0087536555],"study_design_candidate":"not_applicable","study_design_consensus":"not_applicable","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.000014858465,0.000055808465,0.00048435704,0.00035202457,0.000014756045,0.000083023624,0.00018426588,0.00007693668,0.00017045856,0.00995442,0.9257682,0.06284076],"study_design_scores_gemma":[0.000003992331,0.000022081995,0.0015563599,0.00065414154,0.000013060422,0.00030838844,0.0002912038,0.00014416927,0.000049003567,0.008226162,0.9887079,0.000023552677],"about_ca_topic_score_codex":0.0030899944,"about_ca_topic_score_gemma":0.010151789,"teacher_disagreement_score":0.021935996,"about_ca_system_score_codex":0.0024096211,"about_ca_system_score_gemma":0.002541597,"threshold_uncertainty_score":0.07338321},"labels":[],"label_agreement":null},{"id":"W1997648388","doi":"10.1109/asonam.2012.239","title":"Lessons from a Jihadi Corpus","year":2012,"lang":"en","type":"article","venue":"","topic":"Authorship Attribution and Profiling","field":"Computer Science","cited_by":8,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Queen's University","funders":"","keywords":"Deception; Rank (graph theory); Ranking (information retrieval); Computer science; Process (computing); Natural language processing; Artificial intelligence; Factor (programming language); Psychology; Social psychology; Mathematics; Programming language","score_opus":0.07617170086621515,"score_gpt":0.32239504019896537,"score_spread":0.2462233393327502,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W1997648388","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.7767776,0.00852262,0.045089014,0.060548306,0.002072425,0.00039584812,0.027523294,0.0012025792,0.07786829],"genre_scores_gemma":[0.89271736,0.0037883644,0.06438438,0.0029122646,0.0014781436,0.00047623093,0.022320023,0.00080920814,0.011114025],"study_design_codex":"design_other","study_design_gemma":"observational","domain_scores_codex":[0.9980751,0.001040912,0.00013873003,0.00026346178,0.00038319934,0.0000985003],"domain_scores_gemma":[0.95104265,0.04042082,0.0009137887,0.0031043503,0.0038228144,0.00069559354],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.00550975,0.0004560285,0.00045271724,0.0038930986,0.0023936385,0.0032889035,0.0011468775,0.0014187909,0.006020168],"category_scores_gemma":[0.040308733,0.0004405626,0.00028743062,0.0054066,0.0018071901,0.0035402977,0.0018521688,0.0019404552,0.0018758096],"study_design_candidate":"observational","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00066296797,0.0008551576,0.10188954,0.0023929602,0.0002020402,0.003966836,0.08936345,0.0051454795,0.01052207,0.09125797,0.20415853,0.48958293],"study_design_scores_gemma":[0.00021166725,0.00015765909,0.24437886,0.0020421145,0.0001395855,0.0022308116,0.06041606,0.02786733,0.006900587,0.11569669,0.53971785,0.00024074473],"about_ca_topic_score_codex":0.016641052,"about_ca_topic_score_gemma":0.038818344,"teacher_disagreement_score":0.016641052,"about_ca_system_score_codex":0.0013477819,"about_ca_system_score_gemma":0.0011005737,"threshold_uncertainty_score":0.033088386},"labels":[],"label_agreement":null},{"id":"W1999688040","doi":"10.1145/1940761.1940864","title":"Digging into Digg","year":2011,"lang":"en","type":"article","venue":"Proceedings of the 2011 iConference","topic":"Authorship Attribution and Profiling","field":"Computer Science","cited_by":3,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of British Columbia","funders":"","keywords":"Digging; Computer science; Domain (mathematical analysis); Data science; Work (physics); Multimedia; World Wide Web; Human–computer interaction; Information retrieval; Engineering","score_opus":0.05148322709674232,"score_gpt":0.23340941739675525,"score_spread":0.18192619030001292,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W1999688040","genre_codex":"other","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.03973855,0.0035231342,0.09839708,0.010301161,0.0025360337,0.0002040696,0.0030375863,0.0052054026,0.83705693],"genre_scores_gemma":[0.354295,0.0048090327,0.08258328,0.0051859817,0.0006973406,0.00020010727,0.0070306524,0.0032459234,0.5419527],"study_design_codex":"design_other","study_design_gemma":"observational","domain_scores_codex":[0.9992792,0.00021616521,0.00003903534,0.00016548343,0.0001844403,0.000115730836],"domain_scores_gemma":[0.99755424,0.0007456497,0.000118368516,0.00077771983,0.000466641,0.0003374318],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.00095856894,0.0007453269,0.00043592489,0.003080444,0.0024951333,0.0062829405,0.0009107617,0.0016220285,0.080584645],"category_scores_gemma":[0.007191595,0.00031512944,0.00037223208,0.003759296,0.0021595736,0.010220157,0.0043562893,0.0014212121,0.026806029],"study_design_candidate":"observational","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00024881115,0.000060372095,0.0045107557,0.0003656046,0.00002281945,0.0009893217,0.00973577,0.00086691626,0.002526066,0.34497207,0.19277206,0.4429294],"study_design_scores_gemma":[0.000011417598,0.0000480144,0.0012880084,0.00028984845,0.000013368614,0.0006519585,0.0049639037,0.0014634659,0.0009186565,0.09493324,0.89539057,0.000027558523],"about_ca_topic_score_codex":0.0023505029,"about_ca_topic_score_gemma":0.004894327,"teacher_disagreement_score":0.080584645,"about_ca_system_score_codex":0.0009434494,"about_ca_system_score_gemma":0.001045123,"threshold_uncertainty_score":0.2695825},"labels":[],"label_agreement":null},{"id":"W20039898","doi":"10.1007/978-3-642-23151-3_10","title":"Knowledge Discovery in Adversarial Settings","year":2012,"lang":"en","type":"book-chapter","venue":"Intelligent systems reference library","topic":"Authorship Attribution and Profiling","field":"Computer Science","cited_by":1,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Queen's University","funders":"","keywords":"Adversarial system; Computer science; Data science; Artificial intelligence","score_opus":0.06511608293467593,"score_gpt":0.27245710840221665,"score_spread":0.20734102546754074,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W20039898","genre_codex":"methods","genre_gemma":"other","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"other","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0030157524,0.004404902,0.96564394,0.0026026436,0.00023103697,0.000046044675,0.00017319091,0.00043569098,0.023446674],"genre_scores_gemma":[0.48517865,0.013281525,0.41717505,0.0016546568,0.0020563747,0.0004062445,0.001482471,0.0005789815,0.078186095],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.996759,0.001567274,0.0001390058,0.0004722816,0.00091271196,0.00014973457],"domain_scores_gemma":[0.9866877,0.010996021,0.0002897299,0.0014203646,0.00048473544,0.000121490164],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.004582511,0.0011122746,0.0012253228,0.0016031708,0.000708937,0.0031306022,0.0026211392,0.0018871829,0.0043456694],"category_scores_gemma":[0.016019208,0.0007281548,0.0007521707,0.0023869006,0.002651416,0.006019683,0.0033329176,0.004048135,0.001771888],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00006229612,0.00010934228,0.00052583194,0.00034197682,0.00009820504,0.00010703473,0.00021920502,0.18978918,0.0006525183,0.468669,0.033153277,0.30627212],"study_design_scores_gemma":[0.0000067182123,0.000013985061,0.00011737567,0.00007964972,0.000014865214,0.00008231142,0.00002679891,0.42992628,0.0008499548,0.55882084,0.010044433,0.000016731894],"about_ca_topic_score_codex":0.00094668596,"about_ca_topic_score_gemma":0.0009854424,"teacher_disagreement_score":0.004582511,"about_ca_system_score_codex":0.0014265846,"about_ca_system_score_gemma":0.00088922464,"threshold_uncertainty_score":0.024234891},"labels":[],"label_agreement":null},{"id":"W2004782477","doi":"10.1109/hicss.2010.58","title":"An n-Gram Based Approach to Multi-Labeled Web Page Genre Classification","year":2010,"lang":"en","type":"article","venue":"","topic":"Authorship Attribution and Profiling","field":"Computer Science","cited_by":12,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Dalhousie University","funders":"Killam Trusts","keywords":"Computer science; Web page; n-gram; Classifier (UML); Popularity; Artificial intelligence; Support vector machine; Information retrieval; Set (abstract data type); Precision and recall; World Wide Web; Language model","score_opus":0.07747908222797885,"score_gpt":0.3240996072120708,"score_spread":0.24662052498409198,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2004782477","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.119403526,0.0015028171,0.8605697,0.0009955975,0.000526719,0.0007367106,0.0025155668,0.006924446,0.0068248888],"genre_scores_gemma":[0.34934083,0.00042953523,0.6403479,0.00027571,0.00032837657,0.0004431105,0.003435143,0.00018772055,0.005211684],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9965785,0.0013771043,0.00031498325,0.00049288146,0.001019572,0.00021700945],"domain_scores_gemma":[0.99493045,0.0021552034,0.00046436646,0.0006696637,0.0015550901,0.00022514799],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0021292728,0.0010959321,0.0011611024,0.0076144584,0.0016410633,0.0017312429,0.0011045429,0.0017470116,0.001844803],"category_scores_gemma":[0.008372516,0.0002518621,0.0009022386,0.0048866156,0.00061503967,0.0021959476,0.0009506363,0.0015059902,0.0024153441],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0007767772,0.0010757176,0.013635966,0.0002692232,0.00016805163,0.00037923822,0.0006552502,0.011350671,0.028148312,0.0043756794,0.012623035,0.92654216],"study_design_scores_gemma":[0.000038889433,0.00023357663,0.011212336,0.00007747294,0.00008335106,0.00067750714,0.00059240125,0.9466376,0.01675832,0.014233816,0.009348034,0.00010664667],"about_ca_topic_score_codex":0.0054604267,"about_ca_topic_score_gemma":0.011528471,"teacher_disagreement_score":0.0076144584,"about_ca_system_score_codex":0.0010015815,"about_ca_system_score_gemma":0.0010877309,"threshold_uncertainty_score":0.0112608075},"labels":[],"label_agreement":null},{"id":"W2010794591","doi":"10.1080/02664760701592992","title":"A Stylometric Analysis of King Alfred's Literary Works","year":2007,"lang":"en","type":"article","venue":"Journal of Applied Statistics","topic":"Authorship Attribution and Profiling","field":"Computer Science","cited_by":12,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Actua; Simon Fraser University; University of British Columbia, Okanagan Campus; University of British Columbia","funders":"Natural Sciences and Engineering Research Council of Canada; University of Newcastle Australia","keywords":"Computer science; Perspective (graphical); Subject (documents); Stylometry; Simple (philosophy); Key (lock); Bayesian probability; Artificial intelligence; Linguistics; Natural language processing; Epistemology; Philosophy; Library science","score_opus":0.021858001564333224,"score_gpt":0.29520584941709904,"score_spread":0.27334784785276584,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2010794591","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.9636139,0.0007234372,0.0051954365,0.0005389866,0.000056424928,0.000077521036,0.0009444415,0.00007331905,0.028776487],"genre_scores_gemma":[0.9962374,0.00023352762,0.0015468765,0.000012134303,0.000043327986,0.000022902159,0.00038986746,0.000011818334,0.0015021145],"study_design_codex":"observational","study_design_gemma":"observational","domain_scores_codex":[0.99624336,0.0011312575,0.00042592784,0.00036491122,0.0015984448,0.00023618131],"domain_scores_gemma":[0.97357553,0.016889822,0.003643329,0.0015362226,0.003809901,0.0005452712],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.003119166,0.00020077584,0.00036130613,0.029864686,0.0021696514,0.0034873395,0.00039947729,0.000380964,0.0030073065],"category_scores_gemma":[0.030419853,0.0001429745,0.00024071493,0.027012574,0.0025389884,0.0015354246,0.0019032203,0.00033873782,0.00076968677],"study_design_candidate":"observational","study_design_consensus":"observational","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0004989447,0.0001392049,0.4476974,0.0007324171,0.00014437162,0.001580513,0.13506691,0.0039262245,0.007948754,0.10974844,0.01212703,0.28038982],"study_design_scores_gemma":[0.000014326607,0.00014515274,0.78087336,0.00028696095,0.00005992909,0.0013436276,0.08300528,0.016958944,0.003748188,0.030512087,0.08294519,0.000106897125],"about_ca_topic_score_codex":0.0036756927,"about_ca_topic_score_gemma":0.004702086,"teacher_disagreement_score":0.029864686,"about_ca_system_score_codex":0.0023101377,"about_ca_system_score_gemma":0.0007501338,"threshold_uncertainty_score":0.016761303},"labels":[],"label_agreement":null},{"id":"W2011554102","doi":"10.2466/28.pr0.108.2.358-366","title":"Challenging an Authorial Attribution: Vocabulary and Emotion in a Translation of Goethe's <i>Faust</i> Attributed to Samuel Taylor Coleridge","year":2011,"lang":"en","type":"article","venue":"Psychological Reports","topic":"Authorship Attribution and Profiling","field":"Computer Science","cited_by":1,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Laurentian University","funders":"","keywords":"FAUST; Attribution; Psychology; Vocabulary; Linguistics; Translation (biology); Literature; Philosophy; Social psychology; Art; Chemistry","score_opus":0.15569921669939035,"score_gpt":0.3486533556124111,"score_spread":0.19295413891302077,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2011554102","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.97905695,0.0002516207,0.0011739009,0.0025008305,0.00017403379,0.000012779352,0.000036005466,0.000016228516,0.016777609],"genre_scores_gemma":[0.9979583,0.00007408313,0.00023458492,0.00017164531,0.0000455303,0.0000040552745,0.000015264053,0.000012948026,0.0014835729],"study_design_codex":"qualitative","study_design_gemma":"observational","domain_scores_codex":[0.9941042,0.0036774715,0.00020647404,0.00035544462,0.0014189353,0.00023759509],"domain_scores_gemma":[0.9704138,0.02009536,0.005295465,0.0015861688,0.0021986477,0.0004106146],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0040131416,0.0002228035,0.00022378136,0.0011053734,0.0027763746,0.0035156189,0.00030317623,0.0006341412,0.0016614723],"category_scores_gemma":[0.034417626,0.00012861469,0.00010625274,0.00096647575,0.006700838,0.0019613944,0.0022423824,0.0014945804,0.00029422238],"study_design_candidate":"observational","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00033234953,0.000031073643,0.025684241,0.00009332238,0.000015353346,0.00079190533,0.9256058,0.00013268959,0.0073909005,0.015994862,0.0033315353,0.02059594],"study_design_scores_gemma":[0.000023301018,0.00015477074,0.073357336,0.0001791915,0.00002253567,0.0015906608,0.8473301,0.001470871,0.0061977915,0.0069541736,0.0626208,0.000098506884],"about_ca_topic_score_codex":0.0032192937,"about_ca_topic_score_gemma":0.0038480107,"teacher_disagreement_score":0.0040131416,"about_ca_system_score_codex":0.0016946195,"about_ca_system_score_gemma":0.0005077537,"threshold_uncertainty_score":0.021223724},"labels":[],"label_agreement":null},{"id":"W2011672789","doi":"10.1075/ssol.4.1.02nic","title":"Toward a science of science fiction","year":2014,"lang":"en","type":"article","venue":"Scientific Study of Literature","topic":"Authorship Attribution and Profiling","field":"Computer Science","cited_by":28,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of British Columbia","funders":"University of British Columbia; John Templeton Foundation","keywords":"Operationalization; Fantasy; Test (biology); Fiction theory; Literary fiction; Literature; Techno-thriller; Humanism; Literary criticism; Computer science; Linguistics; Epistemology; Art; Philosophy","score_opus":0.030592809718979826,"score_gpt":0.2935062790963196,"score_spread":0.2629134693773398,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2011672789","genre_codex":"other","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.16860108,0.011100979,0.29280525,0.115548745,0.0032560322,0.0005967173,0.00081088947,0.0005442313,0.40673602],"genre_scores_gemma":[0.7942697,0.005027997,0.17250043,0.0060817045,0.001743162,0.0006773314,0.0005472203,0.00033481416,0.018817682],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.98956466,0.0060419748,0.00046110462,0.0011647588,0.0025645706,0.00020295387],"domain_scores_gemma":[0.95511097,0.028407035,0.003608597,0.005050125,0.0065353783,0.0012878978],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.013769226,0.0005798189,0.00073753786,0.012583455,0.0054419483,0.020671912,0.0012819831,0.0027766426,0.0033891664],"category_scores_gemma":[0.04760298,0.0004229082,0.0006071508,0.007873432,0.03504195,0.021971963,0.005326427,0.005138295,0.0014998699],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.000024465468,0.000052598287,0.005119504,0.00026102524,0.00001414182,0.00008419817,0.058730543,0.00024933985,0.00081877504,0.8784984,0.0064847386,0.049662355],"study_design_scores_gemma":[0.000010078154,0.000020062307,0.0021649974,0.00037888097,0.00000912287,0.00014220522,0.020962458,0.0009660331,0.0006524932,0.8433429,0.13133249,0.000018203466],"about_ca_topic_score_codex":0.0011368239,"about_ca_topic_score_gemma":0.0010887717,"teacher_disagreement_score":0.020671912,"about_ca_system_score_codex":0.0037200137,"about_ca_system_score_gemma":0.0036605734,"threshold_uncertainty_score":0.07281947},"labels":[],"label_agreement":null},{"id":"W2022841435","doi":"10.2466/pr0.101.1.177-192","title":"Quantifying Genre: An Operational Definition of Tragedy and Comedy Based on Shakespeare's Plays","year":2007,"lang":"en","type":"article","venue":"Psychological Reports","topic":"Authorship Attribution and Profiling","field":"Computer Science","cited_by":5,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Laurentian University","funders":"","keywords":"Comedy; Tragedy (event); Psychology; Literature; Linguistics; Social psychology; Art; Philosophy","score_opus":0.18668200274492844,"score_gpt":0.39365860392358326,"score_spread":0.20697660117865482,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2022841435","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.9834948,0.00032340182,0.0055287792,0.00007909854,0.00006251782,0.00021395688,0.00032654754,0.00003002918,0.009940974],"genre_scores_gemma":[0.98823845,0.00017105346,0.009916157,0.00003257208,0.000044818997,0.00016398705,0.00032680001,0.000014379844,0.0010917165],"study_design_codex":"observational","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9986645,0.00043641165,0.00027685676,0.00011644078,0.00041628914,0.000089397254],"domain_scores_gemma":[0.9907928,0.0040230043,0.002762851,0.0005469498,0.001150514,0.000723839],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.002050318,0.00059603364,0.00035598798,0.004155245,0.00044362238,0.001503676,0.00042841546,0.00038658158,0.003039775],"category_scores_gemma":[0.012318451,0.00014456666,0.00042964608,0.0019757354,0.0013645953,0.00096819917,0.0016470075,0.0005528693,0.00047548662],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0012889382,0.0004194928,0.8337363,0.00055473135,0.00018757471,0.00038676994,0.012899336,0.0010301842,0.022740882,0.005160032,0.0013347355,0.12026115],"study_design_scores_gemma":[0.000050069975,0.0007834645,0.9703664,0.00017849877,0.00008038284,0.0013385913,0.01089358,0.003559812,0.0034964147,0.003288157,0.005904715,0.00005997045],"about_ca_topic_score_codex":0.00083715137,"about_ca_topic_score_gemma":0.0013292239,"teacher_disagreement_score":0.004155245,"about_ca_system_score_codex":0.000492123,"about_ca_system_score_gemma":0.0002979704,"threshold_uncertainty_score":0.010843277},"labels":[],"label_agreement":null},{"id":"W2025882237","doi":"10.1093/llc/fqm023","title":"Bigrams of Syntactic Labels for Authorship Discrimination of Short Texts","year":2007,"lang":"en","type":"article","venue":"Literary and Linguistic Computing","topic":"Authorship Attribution and Profiling","field":"Computer Science","cited_by":226,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Toronto","funders":"Natural Sciences and Engineering Research Council of Canada","keywords":"Bigram; Library science; History; Computer science; Media studies; Artificial intelligence; Sociology","score_opus":0.03613429507286367,"score_gpt":0.3221275605100855,"score_spread":0.2859932654372218,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2025882237","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.34521112,0.0021966945,0.62833184,0.00068100507,0.00044950412,0.00042743058,0.0036709034,0.005651139,0.013380382],"genre_scores_gemma":[0.6679199,0.00044503977,0.32390743,0.000081174774,0.00025607887,0.00030166042,0.0034261276,0.00038791966,0.0032747348],"study_design_codex":"design_other","study_design_gemma":"bench_or_experimental","domain_scores_codex":[0.9986418,0.00045359868,0.00013374368,0.00022368564,0.0004291409,0.00011808175],"domain_scores_gemma":[0.99058753,0.0056648827,0.0008117433,0.0011843862,0.0012591576,0.00049231265],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0012507865,0.00082291703,0.0006374476,0.0072634933,0.00090231723,0.0012770547,0.000798577,0.000958774,0.0033845422],"category_scores_gemma":[0.009121668,0.000282069,0.00041951373,0.004150359,0.0005722203,0.0022607183,0.0010202389,0.0012142602,0.00304708],"study_design_candidate":"bench_or_experimental","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00055225036,0.00036242598,0.021430774,0.00059382647,0.00011217437,0.0003604423,0.0010175662,0.0022432692,0.08248636,0.0057004024,0.0051881745,0.8799524],"study_design_scores_gemma":[0.00020267414,0.0009334332,0.11424792,0.00051482726,0.00037512498,0.0030415177,0.0025855969,0.5718406,0.19183595,0.07950472,0.034461014,0.0004566762],"about_ca_topic_score_codex":0.0005190025,"about_ca_topic_score_gemma":0.0013249309,"teacher_disagreement_score":0.0072634933,"about_ca_system_score_codex":0.00025929342,"about_ca_system_score_gemma":0.0005707532,"threshold_uncertainty_score":0.011322379},"labels":[],"label_agreement":null},{"id":"W2035395173","doi":"10.1145/1774088.1774428","title":"e-mail authorship verification for forensic investigation","year":2010,"lang":"en","type":"article","venue":"","topic":"Authorship Attribution and Profiling","field":"Computer Science","cited_by":65,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Concordia University","funders":"","keywords":"Computer science; Suspect; Phishing; Spamming; NIST; Matching (statistics); Context (archaeology); The Internet; Plagiarism detection; Sample (material); Computer security; Data mining; Information retrieval; World Wide Web; Natural language processing; Statistics","score_opus":0.04174213818809263,"score_gpt":0.2857227118872353,"score_spread":0.24398057369914267,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2035395173","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.1592423,0.0019601816,0.82507885,0.0012306041,0.00018485935,0.0003129296,0.00057315524,0.0041619013,0.0072551696],"genre_scores_gemma":[0.7575407,0.00062814204,0.23893152,0.00007873555,0.00012357319,0.00010036643,0.00058876164,0.00005971747,0.001948535],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9951984,0.0027954886,0.00025243708,0.0004509053,0.0011351705,0.00016762265],"domain_scores_gemma":[0.98133874,0.007789937,0.0026749002,0.0044587054,0.0032672423,0.00047049677],"candidate_categories":["research_integrity"],"consensus_categories":[],"category_scores_codex":[0.00442196,0.00058276445,0.000802446,0.0034005272,0.000805009,0.0018830623,0.0010428871,0.0015653573,0.002649853],"category_scores_gemma":[0.02214236,0.00022483015,0.00041068936,0.001463046,0.00065158645,0.0025485524,0.0013152242,0.00089348387,0.0024122258],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00047824133,0.00044025984,0.01670294,0.0002792333,0.00006539181,0.00026082966,0.00027127526,0.012697296,0.033710953,0.013526233,0.0063226363,0.9152448],"study_design_scores_gemma":[0.00007012601,0.00050685444,0.027000533,0.0002940086,0.00014597921,0.0033369788,0.0010020235,0.7586728,0.14030625,0.04390131,0.024640802,0.00012227394],"about_ca_topic_score_codex":0.00031110397,"about_ca_topic_score_gemma":0.00053948164,"teacher_disagreement_score":0.99843466,"about_ca_system_score_codex":0.0005144682,"about_ca_system_score_gemma":0.001058756,"threshold_uncertainty_score":0.023385882},"labels":[],"label_agreement":null},{"id":"W2036106933","doi":"10.2196/jmir.2514","title":"Can Anonymous Posters on Medical Forums be Reidentified?","year":2013,"lang":"en","type":"article","venue":"Journal of Medical Internet Research","topic":"Authorship Attribution and Profiling","field":"Computer Science","cited_by":8,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Privacy Analytics (Canada); Agricultural Research Institute of Ontario; University of Ottawa","funders":"","keywords":"Attribution; Context (archaeology); Authorship attribution; Computer science; Online discussion; Identity (music); World Wide Web; Psychology; Focus (optics); Internet privacy; Information retrieval; Social psychology; Artificial intelligence","score_opus":0.11889027437975289,"score_gpt":0.42798938405199566,"score_spread":0.30909910967224274,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2036106933","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.82067925,0.0020774354,0.14357753,0.00319044,0.00126964,0.0007837209,0.003633419,0.010166026,0.014622509],"genre_scores_gemma":[0.88847905,0.0007406403,0.10151275,0.0004208996,0.0005100125,0.00025744564,0.002057583,0.00038038674,0.0056412043],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.99281126,0.0029794844,0.00071634067,0.0012870746,0.0018320307,0.00037376792],"domain_scores_gemma":[0.9175869,0.041919,0.02137061,0.009374129,0.008227301,0.0015220356],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.009336028,0.00070156576,0.00060826837,0.0063152025,0.0010343721,0.002348615,0.00089468044,0.0013907176,0.0039487137],"category_scores_gemma":[0.06507748,0.0004377392,0.00042004295,0.0021624176,0.0007729797,0.0031201034,0.0016981321,0.0005571829,0.0035070546],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0011421319,0.0002505545,0.31990996,0.0013072654,0.00014190163,0.0014490014,0.0071042185,0.0017825622,0.027209492,0.0031668604,0.015867157,0.62066895],"study_design_scores_gemma":[0.00017689311,0.0012310309,0.467271,0.0017009642,0.0005080221,0.012709183,0.012323606,0.14342083,0.15159105,0.023286754,0.18523568,0.00054489204],"about_ca_topic_score_codex":0.0004666303,"about_ca_topic_score_gemma":0.0005113698,"teacher_disagreement_score":0.009336028,"about_ca_system_score_codex":0.00048553426,"about_ca_system_score_gemma":0.00061411364,"threshold_uncertainty_score":0.049374223},"labels":[],"label_agreement":null},{"id":"W2041413176","doi":"10.3115/1073445.1073470","title":"Language and task independent text categorization with simple language models","year":2003,"lang":"en","type":"article","venue":"","topic":"Authorship Attribution and Profiling","field":"Computer Science","cited_by":112,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Waterloo","funders":"","keywords":"Computer science; Natural language processing; Categorization; Artificial intelligence; Task (project management); Language identification; Simple (philosophy); Language model; Variety (cybernetics); Independence (probability theory); Selection (genetic algorithm); Identification (biology); Feature (linguistics); Character (mathematics); Text categorization; Feature selection; Natural language; Linguistics","score_opus":0.015934528884673376,"score_gpt":0.25159083267778576,"score_spread":0.2356563037931124,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2041413176","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.011736011,0.00019233038,0.9823314,0.0001633732,0.0001183709,0.00018936193,0.00029687976,0.003727485,0.0012449127],"genre_scores_gemma":[0.1596035,0.00018497846,0.830322,0.00033185614,0.00026097914,0.00065086404,0.0019632026,0.00031702494,0.0063655702],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.99763286,0.0007488006,0.0001570341,0.0005941322,0.00069865515,0.0001685146],"domain_scores_gemma":[0.9966821,0.001340087,0.00025560355,0.00095815375,0.0005762494,0.00018783628],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0023372977,0.0015093783,0.0011678843,0.0020459907,0.0008253244,0.0017138084,0.0021238714,0.0019415332,0.004718918],"category_scores_gemma":[0.007915046,0.0005162295,0.001770063,0.0015224491,0.0008695837,0.0040346826,0.0025800855,0.0017733079,0.005482635],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00043191775,0.00063119864,0.0021539673,0.00042506112,0.0003145985,0.00022500588,0.0003941887,0.028897323,0.07072942,0.009486802,0.011962572,0.874348],"study_design_scores_gemma":[0.00009453876,0.00039419223,0.002208825,0.000047356487,0.00010776483,0.00045384062,0.00017133719,0.90808916,0.040376164,0.037219327,0.010701812,0.00013569913],"about_ca_topic_score_codex":0.0011829219,"about_ca_topic_score_gemma":0.0028757914,"teacher_disagreement_score":0.004718918,"about_ca_system_score_codex":0.00048692912,"about_ca_system_score_gemma":0.0013054109,"threshold_uncertainty_score":0.01578641},"labels":[],"label_agreement":null},{"id":"W2042368861","doi":"10.1109/vast.2012.6400484","title":"Relative N-gram signatures: Document visualization at the level of character N-grams","year":2012,"lang":"en","type":"article","venue":"","topic":"Authorship Attribution and Profiling","field":"Computer Science","cited_by":19,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Dalhousie University","funders":"Boeing","keywords":"Visualization; n-gram; Computer science; Classifier (UML); Character (mathematics); Artificial intelligence; Gram; Data visualization; Natural language processing; Pattern recognition (psychology); Information retrieval; Mathematics; Language model","score_opus":0.09470629678166564,"score_gpt":0.34110767036158296,"score_spread":0.24640137357991732,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2042368861","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.06897633,0.0011758985,0.8586186,0.0016325515,0.00038559883,0.00026686763,0.0078102797,0.048614357,0.012519494],"genre_scores_gemma":[0.30455425,0.00084598496,0.68343884,0.00023893813,0.00018710717,0.00027851993,0.0033413148,0.0027799462,0.0043351473],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.99941254,0.00017193313,0.000060319227,0.00008736588,0.00021501895,0.000052810276],"domain_scores_gemma":[0.9962798,0.0017495276,0.00046291336,0.00044580075,0.00086985476,0.00019210349],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0011843758,0.0010791704,0.00047941922,0.0049548363,0.00063147873,0.0027853388,0.0007233349,0.0009550264,0.008730805],"category_scores_gemma":[0.008001673,0.0002542543,0.00034416723,0.0034714327,0.00044583488,0.0033873806,0.0017197791,0.0010700857,0.0023029188],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0015827399,0.00018432365,0.008642868,0.0011357319,0.00010735243,0.0008830819,0.0056323134,0.008884261,0.10918681,0.05044056,0.0678303,0.7454897],"study_design_scores_gemma":[0.00020108905,0.00039665095,0.018694013,0.0006563774,0.00016193933,0.0024101487,0.0042439154,0.44657087,0.14724807,0.1487254,0.23030269,0.00038884772],"about_ca_topic_score_codex":0.0013722545,"about_ca_topic_score_gemma":0.0012099054,"teacher_disagreement_score":0.008730805,"about_ca_system_score_codex":0.0004168788,"about_ca_system_score_gemma":0.0005524513,"threshold_uncertainty_score":0.029207408},"labels":[],"label_agreement":null},{"id":"W2045244401","doi":"10.1016/j.jcss.2014.12.019","title":"Authorship verification of e-mail and tweet messages applied for continuous authentication","year":2014,"lang":"en","type":"article","venue":"Journal of Computer and System Sciences","topic":"Authorship Attribution and Profiling","field":"Computer Science","cited_by":60,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Toronto Metropolitan University; University of Victoria","funders":"Natural Sciences and Engineering Research Council of Canada","keywords":"Computer science; Stylometry; Word error rate; Support vector machine; Set (abstract data type); Feature selection; Feature (linguistics); Authentication (law); Writing style; Information retrieval; Selection (genetic algorithm); Block (permutation group theory); Artificial intelligence; Natural language processing; Data mining; Computer security; Mathematics","score_opus":0.026529906452372357,"score_gpt":0.2698352296278049,"score_spread":0.24330532317543252,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2045244401","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.64578205,0.0007510817,0.3432447,0.0006555188,0.0007066503,0.00044633553,0.0010588025,0.0023341777,0.005020681],"genre_scores_gemma":[0.9702556,0.000077667304,0.027859764,0.000023907327,0.00007869899,0.000038294955,0.0002642541,0.00001748904,0.0013843416],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9936911,0.0022764918,0.00062933366,0.0008724642,0.0018528225,0.00067779445],"domain_scores_gemma":[0.9591695,0.01981974,0.004948449,0.007420041,0.0075246296,0.0011176069],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0047674626,0.0005042456,0.0009009118,0.002197944,0.0011018777,0.0020294336,0.00080138876,0.0014379156,0.0027253274],"category_scores_gemma":[0.030812465,0.00022191223,0.00040240868,0.0013556476,0.00056120055,0.0023215471,0.001511363,0.001043639,0.002001038],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0062150173,0.0011071534,0.07369824,0.0007344205,0.00029635333,0.001288553,0.001425277,0.033997457,0.1013377,0.018952329,0.0067626317,0.75418484],"study_design_scores_gemma":[0.000106341824,0.0007803144,0.025099391,0.0000991594,0.00012455547,0.000998581,0.0007300801,0.86669785,0.088780746,0.012448892,0.0040313834,0.00010275489],"about_ca_topic_score_codex":0.000605089,"about_ca_topic_score_gemma":0.00058494054,"teacher_disagreement_score":0.0047674626,"about_ca_system_score_codex":0.00056124706,"about_ca_system_score_gemma":0.0013031723,"threshold_uncertainty_score":0.025213063},"labels":[],"label_agreement":null},{"id":"W2047565779","doi":"10.1109/isi.2012.6284292","title":"Ranking documents by internal variability","year":2012,"lang":"en","type":"article","venue":"","topic":"Authorship Attribution and Profiling","field":"Computer Science","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Queen's University","funders":"","keywords":"Ranking (information retrieval); Computer science; Rank (graph theory); Selection (genetic algorithm); Information retrieval; Variable (mathematics); Learning to rank; Artificial intelligence; Natural language processing; Mathematics","score_opus":0.018277108319704385,"score_gpt":0.2866577562158385,"score_spread":0.26838064789613414,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2047565779","genre_codex":"empirical","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.7033954,0.0035701299,0.25643218,0.0022404536,0.00034298128,0.00075155485,0.007825535,0.00420469,0.021237032],"genre_scores_gemma":[0.821579,0.0009783846,0.1646398,0.00019350689,0.00037280333,0.0004440176,0.0069897734,0.0005914313,0.004211336],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9915828,0.0018455875,0.0008766293,0.0013261448,0.003860323,0.0005084859],"domain_scores_gemma":[0.9494068,0.028446991,0.004951496,0.0055798152,0.010019909,0.0015950263],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.005588197,0.0011375849,0.0017328952,0.011936598,0.0018060886,0.006190071,0.0009712239,0.0010298269,0.0023169497],"category_scores_gemma":[0.057612356,0.00049447786,0.0007887104,0.009606408,0.0009835187,0.003837892,0.001947949,0.0015469438,0.0016574402],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.001670187,0.0005085784,0.12930824,0.0011808663,0.0005440734,0.00043894743,0.0021471463,0.014950729,0.04370879,0.014173343,0.023577321,0.76779175],"study_design_scores_gemma":[0.00048367996,0.0020103739,0.30174893,0.00058948254,0.0012046,0.0027568033,0.0053158873,0.329077,0.15631631,0.106888,0.09282925,0.0007796843],"about_ca_topic_score_codex":0.0015412647,"about_ca_topic_score_gemma":0.0028916055,"teacher_disagreement_score":0.011936598,"about_ca_system_score_codex":0.0010647394,"about_ca_system_score_gemma":0.00148052,"threshold_uncertainty_score":0.029553592},"labels":[],"label_agreement":null},{"id":"W2057373098","doi":"10.1109/pst.2014.6890938","title":"Continuous authentication using micro-messages","year":2014,"lang":"en","type":"article","venue":"","topic":"Authorship Attribution and Profiling","field":"Computer Science","cited_by":10,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Victoria","funders":"Conselho Nacional de Desenvolvimento Científico e Tecnológico","keywords":"Computer science; Support vector machine; Authentication (law); Classifier (UML); Window (computing); Artificial intelligence; Word error rate; Logistic regression; Sample (material); Data mining; Natural language processing; Machine learning; World Wide Web; Computer security","score_opus":0.028135144174940046,"score_gpt":0.27917630706685204,"score_spread":0.251041162891912,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2057373098","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.53072184,0.0033144765,0.42771772,0.0015661407,0.000893128,0.00068429246,0.008557532,0.014161416,0.012383523],"genre_scores_gemma":[0.93298405,0.00040852578,0.05811486,0.000112525384,0.00021378975,0.00012502565,0.002743614,0.00012562287,0.005172087],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9960061,0.0009336816,0.00052020914,0.0010259944,0.0012386087,0.0002755158],"domain_scores_gemma":[0.9726605,0.009206833,0.006539836,0.007774436,0.0032435788,0.0005748015],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0021858863,0.0008574696,0.0009483344,0.0025049746,0.0006085577,0.00208986,0.0009985314,0.0012272116,0.00283689],"category_scores_gemma":[0.017967967,0.00025390813,0.00042265793,0.0018985685,0.00055809895,0.0043895408,0.0017507592,0.0009852509,0.0048636743],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.002078291,0.00044756368,0.055510867,0.0008429872,0.00016711224,0.0009107427,0.00072388176,0.010461931,0.043640632,0.0071626655,0.012850668,0.8652028],"study_design_scores_gemma":[0.00010260034,0.0012365514,0.06726935,0.0004313991,0.00021419706,0.0041799815,0.0012524397,0.6064087,0.21597639,0.04661784,0.056107078,0.00020347905],"about_ca_topic_score_codex":0.00041358135,"about_ca_topic_score_gemma":0.000520204,"teacher_disagreement_score":0.00283689,"about_ca_system_score_codex":0.0003976323,"about_ca_system_score_gemma":0.00058262533,"threshold_uncertainty_score":0.011560202},"labels":[],"label_agreement":null},{"id":"W2066783897","doi":"10.1145/2699910","title":"A Visualizable Evidence-Driven Approach for Authorship Attribution","year":2015,"lang":"en","type":"article","venue":"ACM Transactions on Information and System Security","topic":"Authorship Attribution and Profiling","field":"Computer Science","cited_by":26,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"McGill University; Concordia University","funders":"Natural Sciences and Engineering Research Council of Canada","keywords":"Stylometry; Computer science; Authorship attribution; Context (archaeology); Identification (biology); Attribution; The Internet; Data science; Information retrieval; World Wide Web; Natural language processing","score_opus":0.10748296186962741,"score_gpt":0.3201323593290201,"score_spread":0.2126493974593927,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2066783897","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.008464939,0.00042540993,0.9869468,0.0006039563,0.000055470602,0.00024269035,0.0003596918,0.001023764,0.0018772669],"genre_scores_gemma":[0.33446658,0.00038004143,0.661497,0.00022205316,0.0001177579,0.0003749224,0.0008663606,0.00016326582,0.001912044],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9886108,0.0065811626,0.0006597639,0.0018222948,0.0019784116,0.00034763536],"domain_scores_gemma":[0.95113784,0.030282766,0.0046137865,0.007494764,0.005365197,0.001105494],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.010547603,0.0014343883,0.0012509623,0.008343361,0.0011373503,0.006107213,0.004058761,0.0031050516,0.0038310636],"category_scores_gemma":[0.064131364,0.00088060874,0.0015980547,0.0035470275,0.0025596628,0.0076381243,0.006807819,0.0038159364,0.0012301216],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0009290891,0.0006148062,0.014833716,0.0010820662,0.0003073118,0.0011898954,0.0039445315,0.13289246,0.016197285,0.15119818,0.007015775,0.6697949],"study_design_scores_gemma":[0.00007600648,0.00017610696,0.0021982144,0.00021748505,0.000079066274,0.00051832886,0.00072629994,0.7566369,0.011185183,0.21634859,0.011735404,0.00010241553],"about_ca_topic_score_codex":0.001343078,"about_ca_topic_score_gemma":0.001681501,"teacher_disagreement_score":0.010547603,"about_ca_system_score_codex":0.0015002163,"about_ca_system_score_gemma":0.0016518869,"threshold_uncertainty_score":0.055781722},"labels":[],"label_agreement":null},{"id":"W2074887650","doi":"10.1109/eisic.2012.8","title":"Detecting Fraud in Financial Reports","year":2012,"lang":"en","type":"article","venue":"","topic":"Authorship Attribution and Profiling","field":"Computer Science","cited_by":7,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":true,"ca_institutions":"Queen's University","funders":"","keywords":"Deception; Predictive power; Financial fraud; Set (abstract data type); Computer science; Enforcement; Quarter (Canadian coin); Component (thermodynamics); Computer security; Actuarial science; Accounting; Business; Psychology; Law","score_opus":0.02900883725883877,"score_gpt":0.276071462371792,"score_spread":0.2470626251129532,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2074887650","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.94693357,0.0012188103,0.039928522,0.0019766197,0.00017537309,0.00016021838,0.0026782765,0.0010174058,0.005911173],"genre_scores_gemma":[0.9871452,0.00019085019,0.010152738,0.00008240043,0.00010910164,0.000021488015,0.0016368174,0.000019800598,0.0006415318],"study_design_codex":"observational","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.99387896,0.0029697288,0.00057976996,0.0006907329,0.0014560662,0.00042471036],"domain_scores_gemma":[0.90933114,0.056960505,0.015254635,0.009430538,0.007789634,0.0012335451],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.007014233,0.000812947,0.00067118544,0.0053129564,0.0007771467,0.0026561767,0.0011987095,0.0016995514,0.0020616082],"category_scores_gemma":[0.09022812,0.00026804217,0.0006259603,0.003581594,0.00067319145,0.0038707089,0.0013221495,0.001448554,0.0018711151],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0010705035,0.00084786786,0.59446794,0.00037416798,0.0002491163,0.00042266533,0.00082071027,0.056833617,0.0027689268,0.0047975834,0.013046215,0.32430068],"study_design_scores_gemma":[0.000077396966,0.00060576195,0.15637895,0.0002053723,0.00021008041,0.0010218106,0.0010426304,0.7956307,0.014951948,0.022144685,0.0076048914,0.00012569467],"about_ca_topic_score_codex":0.0028615908,"about_ca_topic_score_gemma":0.0022254898,"teacher_disagreement_score":0.007014233,"about_ca_system_score_codex":0.00085314695,"about_ca_system_score_gemma":0.000652411,"threshold_uncertainty_score":0.03709525},"labels":[],"label_agreement":null},{"id":"W2085509246","doi":"10.1016/j.diin.2009.01.004","title":"Towards an integrated e-mail forensic analysis framework","year":2009,"lang":"en","type":"article","venue":"Digital Investigation","topic":"Authorship Attribution and Profiling","field":"Computer Science","cited_by":86,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Concordia University","funders":"","keywords":"Computer science; Phishing; Spamming; Law enforcement; Harassment; Computer security; Context (archaeology); Child pornography; Cybercrime; Digital forensics; The Internet; Internet privacy; World Wide Web; Data science","score_opus":0.03798295588258519,"score_gpt":0.28808738460247124,"score_spread":0.25010442871988603,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2085509246","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0021275699,0.00006980805,0.99400336,0.00017347994,0.000015415144,0.00010658545,0.00008485108,0.0027167138,0.0007022418],"genre_scores_gemma":[0.07274595,0.00016873161,0.924455,0.00013497255,0.000049956947,0.00014214942,0.0005141214,0.00024750337,0.001541615],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.99477947,0.0012015555,0.0005785894,0.0007977075,0.0023180598,0.0003247407],"domain_scores_gemma":[0.9933124,0.0014948937,0.0006290728,0.0018734938,0.0022449382,0.0004451262],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.007012168,0.001231271,0.0015315564,0.005885012,0.0017470839,0.009114946,0.0036173812,0.0025512923,0.0021638072],"category_scores_gemma":[0.009473628,0.00094385253,0.0021952237,0.0025968282,0.0014994072,0.008689633,0.0064698006,0.0027905179,0.0016797284],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0003024941,0.0012099233,0.008035474,0.00054528855,0.0005741271,0.00091858575,0.0014087029,0.06595964,0.023923747,0.3295059,0.014250984,0.5533652],"study_design_scores_gemma":[0.00003292141,0.00009135954,0.0013244606,0.00020202152,0.00028772748,0.00058416737,0.0005655433,0.76305676,0.023690304,0.18177192,0.02830014,0.00009264102],"about_ca_topic_score_codex":0.0028398524,"about_ca_topic_score_gemma":0.004614846,"teacher_disagreement_score":0.009114946,"about_ca_system_score_codex":0.0012489394,"about_ca_system_score_gemma":0.004266826,"threshold_uncertainty_score":0.03708434},"labels":[],"label_agreement":null},{"id":"W2090908054","doi":"10.4304/jnw.9.12.3347-3355","title":"Verifying Online User Identity using Stylometric Analysis for Short Messages","year":2014,"lang":"en","type":"article","venue":"Journal of Networks","topic":"Authorship Attribution and Profiling","field":"Computer Science","cited_by":13,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Toronto Metropolitan University; University of Victoria","funders":"","keywords":"Computer science; Identity (music); Information retrieval; Computer security; Artificial intelligence; World Wide Web","score_opus":0.07910227027143786,"score_gpt":0.3555485818100229,"score_spread":0.27644631153858507,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2090908054","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.69441134,0.0010106211,0.28932452,0.0004420638,0.00021460086,0.00040761117,0.004682272,0.0036200085,0.0058870153],"genre_scores_gemma":[0.92629856,0.0002549453,0.069455504,0.000032057105,0.00010049908,0.00014572997,0.00243896,0.000049471648,0.0012242756],"study_design_codex":"design_other","study_design_gemma":"bench_or_experimental","domain_scores_codex":[0.9953452,0.0016187606,0.0006292328,0.00073573535,0.0014160818,0.00025495805],"domain_scores_gemma":[0.97933125,0.008932623,0.00458034,0.0034884093,0.003230742,0.00043656628],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0023460512,0.00065669575,0.0008181858,0.009069888,0.00083405647,0.0016167037,0.00055197364,0.00083825254,0.0010362205],"category_scores_gemma":[0.019819051,0.00017802551,0.00047585927,0.0055048238,0.00056636694,0.0023758758,0.0010450861,0.00062402704,0.0016929528],"study_design_candidate":"bench_or_experimental","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0010299255,0.0005777714,0.14184216,0.0006550311,0.00017716961,0.0007163363,0.0018443988,0.022326024,0.04412966,0.0070108036,0.007146656,0.7725441],"study_design_scores_gemma":[0.000032903386,0.0003466474,0.11292967,0.00013820315,0.00008109334,0.0014755559,0.0017145331,0.798314,0.05346164,0.019569827,0.011790396,0.0001456011],"about_ca_topic_score_codex":0.0010437135,"about_ca_topic_score_gemma":0.0016617585,"teacher_disagreement_score":0.009069888,"about_ca_system_score_codex":0.00072357245,"about_ca_system_score_gemma":0.0006253038,"threshold_uncertainty_score":0.012407243},"labels":[],"label_agreement":null},{"id":"W2096575814","doi":"10.1109/wi.2006.50","title":"Binary Cybergenre Classification Using Theoretic Feature Measures","year":2006,"lang":"en","type":"article","venue":"","topic":"Authorship Attribution and Profiling","field":"Computer Science","cited_by":9,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Dalhousie University","funders":"","keywords":"Feature selection; Computer science; Feature (linguistics); Binary classification; Artificial intelligence; Context (archaeology); Set (abstract data type); Pattern recognition (psychology); Selection (genetic algorithm); Binary number; Feature extraction; Web page; Data mining; Machine learning; Support vector machine; Mathematics; World Wide Web","score_opus":0.04985563926123843,"score_gpt":0.2836080435254115,"score_spread":0.2337524042641731,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2096575814","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.9168207,0.00038198597,0.080402635,0.00022319709,0.0000712435,0.00014958771,0.00020731865,0.00028686854,0.0014563191],"genre_scores_gemma":[0.9683544,0.00005025265,0.030976364,0.000040129187,0.000031909494,0.00009334729,0.00025437202,0.000018298688,0.00018101696],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.99481213,0.0023355265,0.00050041446,0.0007045838,0.0013986143,0.00024870312],"domain_scores_gemma":[0.94251585,0.046955213,0.0032183644,0.0042537,0.0026149563,0.00044192182],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.00817053,0.0007441569,0.001085949,0.0019454114,0.0004720069,0.0019583139,0.00074137346,0.0008055169,0.0012205936],"category_scores_gemma":[0.049220305,0.00015596749,0.0006974539,0.0012582798,0.0011078311,0.0027683277,0.00092583155,0.0008873804,0.00027504537],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.006088423,0.0018913752,0.1391573,0.0007715806,0.0004667958,0.00036469172,0.00064738374,0.062445916,0.060692325,0.010130717,0.0017201643,0.7156233],"study_design_scores_gemma":[0.00044210933,0.005294066,0.21642616,0.00012636455,0.00034653323,0.0010817872,0.0006304237,0.6807295,0.065417506,0.027247775,0.002012284,0.00024549858],"about_ca_topic_score_codex":0.00036295768,"about_ca_topic_score_gemma":0.00033055994,"teacher_disagreement_score":0.00817053,"about_ca_system_score_codex":0.0007505124,"about_ca_system_score_gemma":0.0003810087,"threshold_uncertainty_score":0.043210387},"labels":[],"label_agreement":null},{"id":"W2101143571","doi":"10.1016/j.ipm.2013.08.005","title":"You have e-mail, what happens next? Tracking the eyes for genre","year":2013,"lang":"en","type":"article","venue":"Information Processing & Management","topic":"Authorship Attribution and Profiling","field":"Computer Science","cited_by":12,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Ontario Institute for Cancer Research","funders":"National Key Research and Development Program of China; Engineering and Physical Sciences Research Council; Arts and Humanities Research Council; National Natural Science Foundation of China","keywords":"Disk formatting; Computer science; Metric (unit); Eye tracking; Information retrieval; Natural language processing; Representation (politics); Interpretation (philosophy); Tracking (education); Block (permutation group theory); Artificial intelligence; World Wide Web; Psychology","score_opus":0.03575201494546505,"score_gpt":0.2791742121898664,"score_spread":0.24342219724440134,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2101143571","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.9580374,0.00059901376,0.023395104,0.00037824747,0.00008150654,0.00021697115,0.0008255305,0.0003119133,0.01615421],"genre_scores_gemma":[0.9649697,0.00055218267,0.028517706,0.00015661118,0.000048363712,0.00009979317,0.00034606602,0.00005729558,0.0052522556],"study_design_codex":"design_other","study_design_gemma":"observational","domain_scores_codex":[0.99934775,0.0002691813,0.00004151492,0.00014604029,0.00013715525,0.000058425554],"domain_scores_gemma":[0.9953666,0.0025932179,0.0007469756,0.0003050699,0.0008642604,0.00012393207],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0010768505,0.00025512534,0.00022251923,0.0020285896,0.00048317408,0.0013090844,0.00021420266,0.00050333317,0.0030483364],"category_scores_gemma":[0.0071342085,0.00012208492,0.00015151015,0.0009313311,0.0002436063,0.0013842388,0.00045412758,0.00037741836,0.0009996803],"study_design_candidate":"observational","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0014411688,0.0002275465,0.21511473,0.0006836691,0.00008668083,0.00054867,0.03044036,0.00047773588,0.15896294,0.002575407,0.0056568384,0.5837843],"study_design_scores_gemma":[0.000047263384,0.0009936296,0.8306241,0.00035806824,0.00016936036,0.0019576189,0.04389057,0.01127575,0.07399523,0.005223469,0.031238154,0.00022680216],"about_ca_topic_score_codex":0.0012888451,"about_ca_topic_score_gemma":0.0032291217,"teacher_disagreement_score":0.0030483364,"about_ca_system_score_codex":0.0003325992,"about_ca_system_score_gemma":0.00023999008,"threshold_uncertainty_score":0.010197699},"labels":[],"label_agreement":null},{"id":"W2103195385","doi":"10.1145/2632188.2632207","title":"Automatic identification of arabic dialects in social media","year":2014,"lang":"en","type":"article","venue":"","topic":"Authorship Attribution and Profiling","field":"Computer Science","cited_by":58,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Université du Québec à Montréal","funders":"","keywords":"Computer science; Natural language processing; Artificial intelligence; Arabic; Classifier (UML); Hidden Markov model; Naive Bayes classifier; Modern Standard Arabic; Social media; Language identification; Context (archaeology); Probabilistic logic; n-gram; Language model; Linguistics; Natural language; Support vector machine; World Wide Web","score_opus":0.03165082704362224,"score_gpt":0.2818454130505005,"score_spread":0.2501945860068783,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2103195385","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.86661804,0.0018735422,0.0951743,0.0013427939,0.00063371594,0.0004541253,0.012679656,0.0060551427,0.015168639],"genre_scores_gemma":[0.90240043,0.0005617341,0.07971725,0.00018483358,0.00020785542,0.00014270048,0.009659707,0.00015062776,0.0069748587],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.99901307,0.00035864126,0.0000828594,0.00022698744,0.00020456738,0.00011383891],"domain_scores_gemma":[0.99746644,0.00083499146,0.00034376682,0.000274662,0.00094090437,0.00013924966],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.00087343174,0.0006868309,0.00042990787,0.004536909,0.000746098,0.0014693065,0.00036439966,0.0006106441,0.0023240303],"category_scores_gemma":[0.003553954,0.00018489735,0.0004024227,0.0016373611,0.00027410113,0.0017438028,0.0010023883,0.0005318662,0.003852466],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0010857712,0.00039881436,0.11647737,0.0007309649,0.00015663856,0.0014372751,0.004093414,0.0031699864,0.07751209,0.004073606,0.03771956,0.75314444],"study_design_scores_gemma":[0.00007399413,0.00040744268,0.2723301,0.00041466136,0.0002284531,0.003213195,0.0153662525,0.48715407,0.105129555,0.015678253,0.09974212,0.0002619048],"about_ca_topic_score_codex":0.003409623,"about_ca_topic_score_gemma":0.0047653834,"teacher_disagreement_score":0.004536909,"about_ca_system_score_codex":0.0004524586,"about_ca_system_score_gemma":0.0004185596,"threshold_uncertainty_score":0.0077747107},"labels":[],"label_agreement":null},{"id":"W2119140562","doi":"10.1007/s10032-007-0060-2","title":"Genre as noise: noise in genre","year":2007,"lang":"en","type":"article","venue":"International Journal on Document Analysis and Recognition (IJDAR)","topic":"Authorship Attribution and Profiling","field":"Computer Science","cited_by":18,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Alberta","funders":"","keywords":"Computer science; Noise (video); Perspective (graphical); Hierarchy; Feature (linguistics); Word error rate; Natural language processing; Artificial intelligence; Emphasis (telecommunications); Speech recognition; Selection (genetic algorithm); Pattern recognition (psychology); Linguistics","score_opus":0.020483563872654792,"score_gpt":0.31766699938688503,"score_spread":0.2971834355142302,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2119140562","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.7148488,0.0064564664,0.2371968,0.0042812275,0.0013510721,0.00016473245,0.0018355226,0.00087183365,0.03299347],"genre_scores_gemma":[0.98308384,0.00055831484,0.012404573,0.00017832406,0.00050135993,0.00004399843,0.00042363978,0.0001356076,0.002670407],"study_design_codex":"design_other","study_design_gemma":"not_applicable","domain_scores_codex":[0.9961378,0.0013637269,0.00032520734,0.00076513283,0.0011312941,0.00027673578],"domain_scores_gemma":[0.9653045,0.024176018,0.0028692023,0.0031674737,0.0028238534,0.001658897],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0037725058,0.0005028419,0.00087921956,0.0038610685,0.0013578455,0.007157531,0.0006359284,0.0009855335,0.0047258004],"category_scores_gemma":[0.035882115,0.00033358872,0.00050157384,0.0040916083,0.0021619217,0.0059456583,0.0026290931,0.001862126,0.0008613692],"study_design_candidate":"not_applicable","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.002365535,0.0005775017,0.22017327,0.00064233266,0.00023635842,0.00071689987,0.008353383,0.008914478,0.022321058,0.095168404,0.011657593,0.62887317],"study_design_scores_gemma":[0.000116584786,0.0006824649,0.27768672,0.00069871766,0.0006184805,0.0036202255,0.01255278,0.2893348,0.017241433,0.35284638,0.044269953,0.00033142685],"about_ca_topic_score_codex":0.001149518,"about_ca_topic_score_gemma":0.0010568928,"teacher_disagreement_score":0.007157531,"about_ca_system_score_codex":0.0007977855,"about_ca_system_score_gemma":0.00070617575,"threshold_uncertainty_score":0.019951165},"labels":[],"label_agreement":null},{"id":"W2123407642","doi":"10.1016/j.diin.2008.05.001","title":"A novel approach of mining write-prints for authorship attribution in e-mail forensics","year":2008,"lang":"en","type":"article","venue":"Digital Investigation","topic":"Authorship Attribution and Profiling","field":"Computer Science","cited_by":131,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Concordia University","funders":"","keywords":"Authorship attribution; Suspect; Computer science; Attribution; Decision tree; Support vector machine; Quality (philosophy); Information retrieval; Data mining; Data science; Computer security; Artificial intelligence; Psychology","score_opus":0.13829818981895015,"score_gpt":0.27741527439109653,"score_spread":0.1391170845721464,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2123407642","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.20626478,0.0007668533,0.78821474,0.00060956704,0.00014997779,0.00025287175,0.00075967005,0.0013864667,0.0015950437],"genre_scores_gemma":[0.60399765,0.00031513697,0.39253917,0.00008255549,0.00017302418,0.00017521874,0.0008403155,0.00004245376,0.0018345708],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9974917,0.0005328101,0.00031925208,0.0007190591,0.00075665355,0.00018054315],"domain_scores_gemma":[0.9945996,0.0019843995,0.0011529047,0.0008477832,0.0012002441,0.00021505894],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0016349576,0.00069685397,0.0010292879,0.0064855036,0.0009063369,0.0016764739,0.0014126544,0.0014776567,0.00073301553],"category_scores_gemma":[0.0092917485,0.00039823548,0.00080218597,0.0040884833,0.00069745927,0.00242967,0.0010447631,0.0009566247,0.0005856178],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00038246726,0.0011325609,0.06326223,0.00043085896,0.00021971007,0.0006944423,0.0009081998,0.021912621,0.021841696,0.0062782466,0.0032726077,0.8796643],"study_design_scores_gemma":[0.00006647349,0.0003894044,0.027341055,0.00009325144,0.00013845587,0.0022198164,0.00068724353,0.91833746,0.027105851,0.01631269,0.0072046067,0.00010365407],"about_ca_topic_score_codex":0.0007252286,"about_ca_topic_score_gemma":0.0011351602,"teacher_disagreement_score":0.0064855036,"about_ca_system_score_codex":0.000350546,"about_ca_system_score_gemma":0.000889021,"threshold_uncertainty_score":0.008646548},"labels":[],"label_agreement":null},{"id":"W2125962012","doi":"10.1016/j.diin.2010.03.003","title":"Mining writeprints from anonymous e-mails for forensic investigation","year":2010,"lang":"en","type":"article","venue":"Digital Investigation","topic":"Authorship Attribution and Profiling","field":"Computer Science","cited_by":146,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Concordia University","funders":"","keywords":"Computer science; Exploit; Cluster analysis; Stylometry; Anonymity; Identification (biology); Classifier (UML); Cybercrime; Focus (optics); Writing style; Information retrieval; World Wide Web; Data science; Data mining; Artificial intelligence; Computer security; The Internet","score_opus":0.04413737110212299,"score_gpt":0.2634196282676218,"score_spread":0.2192822571654988,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2125962012","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.9057133,0.0016238178,0.060448762,0.0010007338,0.00046635454,0.0004299869,0.016474094,0.0022946459,0.011548333],"genre_scores_gemma":[0.92615265,0.0008444351,0.0465415,0.00014817626,0.00045444403,0.00021533608,0.015058315,0.00021814238,0.0103669865],"study_design_codex":"design_other","study_design_gemma":"bench_or_experimental","domain_scores_codex":[0.994091,0.0012285531,0.0009818757,0.0007595256,0.0023700015,0.00056904746],"domain_scores_gemma":[0.9504859,0.019215893,0.01176661,0.008107142,0.008720583,0.0017040506],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0027368537,0.0007698136,0.00069779396,0.013489772,0.0013732362,0.0024397192,0.00089226733,0.0014091831,0.0031442584],"category_scores_gemma":[0.029553223,0.00035597407,0.00048213362,0.008154401,0.0005021053,0.0023763708,0.0016474702,0.0008320834,0.0054492205],"study_design_candidate":"bench_or_experimental","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0012614876,0.0006632371,0.35340017,0.001039289,0.00017818053,0.004060037,0.0035967533,0.0031001442,0.03670503,0.006260365,0.025939422,0.563796],"study_design_scores_gemma":[0.00010581076,0.0010975461,0.40966672,0.0010014748,0.0007170813,0.018174239,0.016438114,0.13005678,0.20334597,0.030487765,0.18861069,0.00029772337],"about_ca_topic_score_codex":0.000434737,"about_ca_topic_score_gemma":0.00093842665,"teacher_disagreement_score":0.013489772,"about_ca_system_score_codex":0.00038334297,"about_ca_system_score_gemma":0.0012211214,"threshold_uncertainty_score":0.014474034},"labels":[],"label_agreement":null},{"id":"W2129364433","doi":"10.1016/j.diin.2014.03.012","title":"OBA2: An Onion approach to Binary code Authorship Attribution","year":2014,"lang":"en","type":"article","venue":"Digital Investigation","topic":"Authorship Attribution and Profiling","field":"Computer Science","cited_by":73,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Concordia University","funders":"","keywords":"Computer science; Authorship attribution; Code (set theory); Binary number; Attribution; Information retrieval; World Wide Web; Programming language; Natural language processing; Arithmetic; Mathematics","score_opus":0.07222085393703048,"score_gpt":0.27987939711741455,"score_spread":0.20765854318038407,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2129364433","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.022304859,0.0007239009,0.92548674,0.0011628624,0.0005043003,0.0006452354,0.00226637,0.030051226,0.016854636],"genre_scores_gemma":[0.28171116,0.00061742397,0.67643225,0.00099894,0.00059685874,0.00077540014,0.0071775396,0.003853606,0.02783695],"study_design_codex":"design_other","study_design_gemma":"bench_or_experimental","domain_scores_codex":[0.99195284,0.0016287753,0.0006049283,0.0017558534,0.0031972092,0.0008602796],"domain_scores_gemma":[0.9883562,0.0031829095,0.001566611,0.0045192013,0.0018005928,0.0005744665],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0056384453,0.0023448372,0.0019313,0.01347886,0.0021679911,0.0055954433,0.0034326268,0.002495188,0.010614856],"category_scores_gemma":[0.020306861,0.0010374734,0.0025157377,0.005578621,0.0019002444,0.009082415,0.009773344,0.0029940798,0.005661183],"study_design_candidate":"bench_or_experimental","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0009929063,0.0005501937,0.022412159,0.00038829667,0.00038877057,0.0010814111,0.0016365997,0.019403506,0.009106222,0.06278166,0.040519558,0.84073865],"study_design_scores_gemma":[0.000090990834,0.00022288879,0.0057592914,0.00024290246,0.00016445387,0.0011974839,0.00081052165,0.7247509,0.020766016,0.15581581,0.090025835,0.00015288054],"about_ca_topic_score_codex":0.003724997,"about_ca_topic_score_gemma":0.006826123,"teacher_disagreement_score":0.01347886,"about_ca_system_score_codex":0.0015599144,"about_ca_system_score_gemma":0.0023830987,"threshold_uncertainty_score":0.035510182},"labels":[],"label_agreement":null},{"id":"W2133726639","doi":"10.1613/jair.2622","title":"Identification of Pleonastic It Using the Web","year":2009,"lang":"en","type":"article","venue":"Journal of Artificial Intelligence Research","topic":"Authorship Attribution and Profiling","field":"Computer Science","cited_by":4,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Alberta","funders":"","keywords":"Pronoun; Identification (biology); Set (abstract data type); Simple (philosophy); Natural language; Syntactic structure","score_opus":0.33272403793991595,"score_gpt":0.4899785421297413,"score_spread":0.15725450418982534,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2133726639","genre_codex":"empirical","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.71796685,0.0020932674,0.23722978,0.0013592895,0.00016106626,0.0005303103,0.0046502464,0.009054026,0.026955083],"genre_scores_gemma":[0.85259753,0.0009419585,0.13515854,0.00019575424,0.00008811302,0.000100998084,0.005573151,0.0004129701,0.004930913],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9976319,0.0004894241,0.0004039923,0.00046916917,0.0008557641,0.00014969028],"domain_scores_gemma":[0.9879423,0.0058048167,0.0022536293,0.0018473099,0.0018428264,0.00030918492],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0014311022,0.00061720685,0.0006830677,0.008239803,0.00096915115,0.002770104,0.0007859239,0.0010300992,0.0020949286],"category_scores_gemma":[0.010361373,0.00032192262,0.00043828823,0.0036895615,0.0005795054,0.004634425,0.0018095598,0.00076469965,0.0016320003],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00059734145,0.00039791063,0.15585458,0.00092386594,0.00011730067,0.009321836,0.006666495,0.0025725563,0.07672131,0.013523076,0.01631648,0.7169873],"study_design_scores_gemma":[0.00008790018,0.0002818805,0.15740696,0.0007337132,0.00038430642,0.025037078,0.021038776,0.29700983,0.24475232,0.055534292,0.19739944,0.0003334791],"about_ca_topic_score_codex":0.002013772,"about_ca_topic_score_gemma":0.0026061495,"teacher_disagreement_score":0.008239803,"about_ca_system_score_codex":0.0004985394,"about_ca_system_score_gemma":0.0008047823,"threshold_uncertainty_score":0.007568538},"labels":[],"label_agreement":null},{"id":"W2140161727","doi":"10.1186/1472-6874-9-21","title":"Pattern recognition in menstrual bleeding diaries by statistical cluster analysis","year":2009,"lang":"en","type":"article","venue":"BMC Women s Health","topic":"Authorship Attribution and Profiling","field":"Computer Science","cited_by":8,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Bayer (Canada)","funders":"","keywords":"Interpretability; Statistic; Cluster (spacecraft); Vaginal bleeding; Medicine; Statistical analysis; Statistics; Mathematics; Computer science; Artificial intelligence; Biology","score_opus":0.03710003514477386,"score_gpt":0.316423820189382,"score_spread":0.2793237850446081,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2140161727","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.21227719,0.00041298693,0.78252524,0.00034244772,0.00006694696,0.00068221067,0.0010114954,0.0012536161,0.0014278811],"genre_scores_gemma":[0.47338307,0.00012306117,0.524505,0.00003317103,0.000034247365,0.00042018417,0.0010244801,0.00010698329,0.0003697848],"study_design_codex":"design_other","study_design_gemma":"observational","domain_scores_codex":[0.9932749,0.003587404,0.0006650123,0.000971521,0.0012776842,0.00022344399],"domain_scores_gemma":[0.9779218,0.014025485,0.0021340358,0.0023701368,0.0032374356,0.00031105118],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0081671765,0.00071522663,0.0008922483,0.0050477413,0.0007542123,0.0016337523,0.0012072817,0.0006281925,0.0014574336],"category_scores_gemma":[0.03061031,0.0002616851,0.0011812403,0.0034314168,0.0010285279,0.0008262001,0.0011942146,0.0010498376,0.00055197545],"study_design_candidate":"observational","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0022413435,0.0005643982,0.16878961,0.0010051003,0.0010506854,0.00022625468,0.0022555892,0.08491919,0.014591538,0.0087518,0.005612368,0.70999205],"study_design_scores_gemma":[0.00019311356,0.00070285157,0.13432798,0.00018321032,0.00036237383,0.0009394288,0.0012022487,0.8084587,0.017605979,0.029477242,0.006275151,0.00027168787],"about_ca_topic_score_codex":0.0027071934,"about_ca_topic_score_gemma":0.002073718,"teacher_disagreement_score":0.0081671765,"about_ca_system_score_codex":0.00094651594,"about_ca_system_score_gemma":0.00165783,"threshold_uncertainty_score":0.043192685},"labels":[],"label_agreement":null},{"id":"W2140692822","doi":"10.1093/llc/fqt021","title":"Patterns of local discourse coherence as a feature for authorship attribution","year":2013,"lang":"en","type":"article","venue":"Literary and Linguistic Computing","topic":"Authorship Attribution and Profiling","field":"Computer Science","cited_by":14,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Toronto","funders":"","keywords":"Authorship attribution; Coherence (philosophical gambling strategy); Sentence; Computer science; Feature (linguistics); Natural language processing; Attribution; Linguistics; Character (mathematics); Artificial intelligence; Psychology; Statistics; Mathematics; Philosophy; Social psychology","score_opus":0.01861572687605888,"score_gpt":0.29324559752406826,"score_spread":0.27462987064800937,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2140692822","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.8277104,0.00054336217,0.162401,0.00050653884,0.00004947171,0.00014116032,0.0017131428,0.0013307983,0.0056042145],"genre_scores_gemma":[0.98580104,0.000041795767,0.013222717,0.000010433577,0.000018388568,0.000031372623,0.0005566868,0.00002555906,0.00029198735],"study_design_codex":"observational","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.998309,0.000560456,0.00019386101,0.00044134428,0.00035451257,0.00014082988],"domain_scores_gemma":[0.98527724,0.008336601,0.0030058944,0.0017260608,0.0011547714,0.0004993725],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0020280995,0.00042457567,0.00047902775,0.007133928,0.0007076143,0.0022444404,0.0005786521,0.0006375162,0.0020628772],"category_scores_gemma":[0.016583377,0.00020135616,0.00043502697,0.00532425,0.0008339313,0.0038445247,0.0015397179,0.0008094226,0.0007219772],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0008428098,0.000567955,0.5408863,0.00048570088,0.00029383684,0.00035858175,0.004098408,0.019093389,0.029806135,0.013463863,0.0037632107,0.38633984],"study_design_scores_gemma":[0.00006487198,0.0005456346,0.4418073,0.0001486568,0.0001791019,0.00074863806,0.0034181904,0.47676712,0.027390586,0.04123356,0.007532336,0.00016395973],"about_ca_topic_score_codex":0.0009350535,"about_ca_topic_score_gemma":0.0014592515,"teacher_disagreement_score":0.007133928,"about_ca_system_score_codex":0.0005580274,"about_ca_system_score_gemma":0.0003395079,"threshold_uncertainty_score":0.010725737},"labels":[],"label_agreement":null},{"id":"W2147608180","doi":"10.1109/hicss.2009.68","title":"An N-Gram Based Approach to Automatically Identifying Web Page Genre","year":2009,"lang":"en","type":"article","venue":"","topic":"Authorship Attribution and Profiling","field":"Computer Science","cited_by":27,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Dalhousie University","funders":"Killam Trusts","keywords":"Computer science; Web page; Feature (linguistics); Information retrieval; Set (abstract data type); Front page; Listing (finance); World Wide Web; Static web page; Artificial intelligence; Web navigation","score_opus":0.04993646941629454,"score_gpt":0.3202699916950935,"score_spread":0.270333522278799,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2147608180","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.25545868,0.003257402,0.69651747,0.0010486686,0.0005485586,0.001320943,0.007385842,0.018665519,0.015796943],"genre_scores_gemma":[0.35538813,0.00073117914,0.6274088,0.00023095134,0.00030866973,0.00048663391,0.008215684,0.0003920235,0.0068378756],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9982457,0.00052370364,0.0001679891,0.00042509104,0.0005061958,0.00013129714],"domain_scores_gemma":[0.99559915,0.0020244431,0.00046291816,0.0006380239,0.001027113,0.00024836324],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0015014975,0.0013036142,0.0010425404,0.008518155,0.001127335,0.0014353257,0.000848992,0.0011467923,0.0027188694],"category_scores_gemma":[0.0070371167,0.00030213833,0.0009176338,0.005598708,0.0004943883,0.0025611217,0.0010320063,0.0011988019,0.0033985032],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00073519954,0.0006288423,0.01875754,0.0003930122,0.00016606851,0.00025552986,0.0006047529,0.0025104322,0.04827377,0.002189423,0.01205384,0.9134315],"study_design_scores_gemma":[0.00019105188,0.00084209145,0.0850508,0.00021247541,0.00034880958,0.0029177978,0.0017497373,0.78302336,0.056922995,0.021578696,0.046865594,0.0002966226],"about_ca_topic_score_codex":0.0044044997,"about_ca_topic_score_gemma":0.009400314,"teacher_disagreement_score":0.008518155,"about_ca_system_score_codex":0.00055817474,"about_ca_system_score_gemma":0.0008347665,"threshold_uncertainty_score":0.00909549},"labels":[],"label_agreement":null},{"id":"W2148429219","doi":"10.1214/10-aoas378","title":"Detecting multiple authorship of United States Supreme Court legal decisions using function words","year":2011,"lang":"en","type":"article","venue":"The Annals of Applied Statistics","topic":"Authorship Attribution and Profiling","field":"Computer Science","cited_by":30,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Toronto","funders":"","keywords":"Supreme court; Style (visual arts); Function (biology); Legal writing; Writing style; Statistical analysis","score_opus":0.24488643153322526,"score_gpt":0.347889792177648,"score_spread":0.10300336064442273,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2148429219","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.9905393,0.00018142392,0.007059358,0.00007097789,0.000027630424,0.00002321938,0.000244178,0.00006341421,0.001790432],"genre_scores_gemma":[0.9962519,0.000037193142,0.003156318,0.000010058264,0.000019952206,0.000014789499,0.00022455075,0.000014410849,0.00027087875],"study_design_codex":"observational","study_design_gemma":"observational","domain_scores_codex":[0.992353,0.0038578245,0.0011695819,0.0009074754,0.0013089498,0.00040317318],"domain_scores_gemma":[0.8277453,0.1250159,0.026607294,0.009003758,0.0094291475,0.0021985483],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0057574096,0.0004954014,0.0004931457,0.010259413,0.0010464725,0.0026715167,0.00046905765,0.00073879317,0.001435474],"category_scores_gemma":[0.080438785,0.00022833288,0.0003710158,0.0055254037,0.00118372,0.0027378688,0.0014764625,0.0007525908,0.00055529835],"study_design_candidate":"observational","study_design_consensus":"observational","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0005703649,0.00015513733,0.8283071,0.00017978884,0.00013526891,0.00050704373,0.0085396115,0.0017534255,0.008934806,0.003688864,0.0010653995,0.14616321],"study_design_scores_gemma":[0.000053595228,0.0004381701,0.8638601,0.0001906005,0.00020160149,0.0022429945,0.013267135,0.063424334,0.022178095,0.027196432,0.0067506414,0.00019636391],"about_ca_topic_score_codex":0.0008307722,"about_ca_topic_score_gemma":0.0012413528,"teacher_disagreement_score":0.010259413,"about_ca_system_score_codex":0.00054201676,"about_ca_system_score_gemma":0.00062076416,"threshold_uncertainty_score":0.030448437},"labels":[],"label_agreement":null},{"id":"W2155085300","doi":"10.1109/hicss.2008.53","title":"An Examination of Genre Attributes for Web Page Classification","year":2008,"lang":"en","type":"article","venue":"","topic":"Authorship Attribution and Profiling","field":"Computer Science","cited_by":38,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Dalhousie University","funders":"","keywords":"Computer science; Web page; Set (abstract data type); Information retrieval; Identification (biology); World Wide Web; Recall; Precision and recall","score_opus":0.11918958509199881,"score_gpt":0.3147126104816039,"score_spread":0.19552302538960512,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2155085300","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.93053424,0.005001844,0.049411833,0.0013740046,0.00070844684,0.00076158566,0.0032654526,0.001767573,0.0071749133],"genre_scores_gemma":[0.9124268,0.0010051009,0.08129075,0.00024024665,0.00027489098,0.00020129507,0.0032745209,0.00018675254,0.0010996278],"study_design_codex":"design_other","study_design_gemma":"not_applicable","domain_scores_codex":[0.98068744,0.011893565,0.0017196888,0.0016320053,0.0036322444,0.00043496408],"domain_scores_gemma":[0.8187288,0.1564519,0.0055887317,0.009028865,0.007904597,0.0022970114],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.02758641,0.001110414,0.0015014047,0.0042884443,0.0017237983,0.00393315,0.0008136441,0.0009738601,0.0012504744],"category_scores_gemma":[0.112692825,0.00037400023,0.0012803723,0.0048673917,0.00083246053,0.004370969,0.00090792077,0.0024584902,0.00073302287],"study_design_candidate":"not_applicable","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0037827191,0.0026715274,0.28833285,0.0012339483,0.0009941119,0.00032370296,0.0013827818,0.014314709,0.022025714,0.0012360766,0.008835657,0.6548662],"study_design_scores_gemma":[0.0005543825,0.0094463965,0.47236356,0.0008851315,0.00157567,0.00318239,0.00351305,0.41342297,0.051454272,0.00966251,0.033308584,0.00063107035],"about_ca_topic_score_codex":0.0023585912,"about_ca_topic_score_gemma":0.0032669648,"teacher_disagreement_score":0.02758641,"about_ca_system_score_codex":0.00093683915,"about_ca_system_score_gemma":0.0009086823,"threshold_uncertainty_score":0.14589268},"labels":[],"label_agreement":null},{"id":"W2164704937","doi":"10.1109/wi-iat.2009.79","title":"Classifying Web Pages by Genre: An n-Gram Approach","year":2009,"lang":"en","type":"article","venue":"","topic":"Authorship Attribution and Profiling","field":"Computer Science","cited_by":5,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Dalhousie University","funders":"Natural Sciences and Engineering Research Council of Canada","keywords":"n-gram; Computer science; Web page; Set (abstract data type); Information retrieval; Range (aeronautics); Byte; Support vector machine; Artificial intelligence; Data mining; World Wide Web; Language model; Engineering","score_opus":0.049278043634269963,"score_gpt":0.2888195418324475,"score_spread":0.23954149819817755,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2164704937","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.40831035,0.003852731,0.5634565,0.0015905617,0.0005956955,0.0011827504,0.005118253,0.0041878293,0.011705362],"genre_scores_gemma":[0.6220639,0.0010824311,0.36699477,0.0002614751,0.00043522016,0.00044335783,0.0040784967,0.00020000194,0.004440304],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9982048,0.0005900609,0.00024939736,0.00030321436,0.00050226616,0.00015018333],"domain_scores_gemma":[0.99542195,0.0022579639,0.0004798294,0.0005117899,0.001083589,0.00024482576],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0017774547,0.0010531518,0.0011449548,0.0097693615,0.0010429561,0.0018435768,0.0007722909,0.0010301076,0.00206916],"category_scores_gemma":[0.008766185,0.00023995235,0.0011002341,0.0053929966,0.0006046996,0.002336226,0.0010115346,0.0009822194,0.0022825208],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0012275717,0.00077393046,0.03905606,0.00042513537,0.0002351917,0.0004293877,0.0008220294,0.006928304,0.02400198,0.002622156,0.007356214,0.91612196],"study_design_scores_gemma":[0.00013668138,0.0009269477,0.07699642,0.00026174178,0.00045445288,0.0020285652,0.002331759,0.8523761,0.016210673,0.030881023,0.017159602,0.00023603905],"about_ca_topic_score_codex":0.0034267888,"about_ca_topic_score_gemma":0.0049920445,"teacher_disagreement_score":0.0097693615,"about_ca_system_score_codex":0.00060386903,"about_ca_system_score_gemma":0.0007051949,"threshold_uncertainty_score":0.009400189},"labels":[],"label_agreement":null},{"id":"W2170770919","doi":"10.1109/cmpsac.2004.1342667","title":"N-gram-based detection of new malicious code","year":2004,"lang":"en","type":"article","venue":"","topic":"Authorship Attribution and Profiling","field":"Computer Science","cited_by":281,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Dalhousie University","funders":"","keywords":"Computer science; Code (set theory); Signature (topology); Computer virus; Software; Malware; Data mining; Artificial intelligence; Programming language; Computer security","score_opus":0.035639114309172375,"score_gpt":0.27907089942283175,"score_spread":0.24343178511365937,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2170770919","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.8939402,0.00058511435,0.090681605,0.00036011805,0.00016922184,0.00019927646,0.0032571456,0.006731578,0.0040756883],"genre_scores_gemma":[0.9198371,0.00010959771,0.074384116,0.0000569337,0.000048638096,0.000067815985,0.0032753085,0.00009787403,0.002122597],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9986603,0.0002582237,0.00012905036,0.00026068866,0.0005244445,0.00016729515],"domain_scores_gemma":[0.99594384,0.0015334224,0.00052653416,0.00044402096,0.0012259426,0.00032620374],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0007903779,0.0007409422,0.00060252467,0.00309685,0.0005946964,0.00052424317,0.0005681038,0.00079915853,0.0009834934],"category_scores_gemma":[0.0053036204,0.00011531991,0.0003742852,0.0011830588,0.00031478767,0.0009447788,0.000669959,0.0005630562,0.001253864],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0015941393,0.0007770638,0.10779793,0.00046596376,0.00015973602,0.0012563098,0.00059234403,0.020221684,0.20605887,0.0011862342,0.012709024,0.6471807],"study_design_scores_gemma":[0.000021710217,0.00031565462,0.059855614,0.000033504446,0.000047016274,0.0012542183,0.00018340346,0.8244221,0.10727795,0.0017917024,0.0047211125,0.00007604991],"about_ca_topic_score_codex":0.0035680686,"about_ca_topic_score_gemma":0.009542163,"teacher_disagreement_score":0.0035680686,"about_ca_system_score_codex":0.00035623292,"about_ca_system_score_gemma":0.00058099447,"threshold_uncertainty_score":0.0070946217},"labels":[],"label_agreement":null},{"id":"W2177050153","doi":"","title":"Feature Space Selection and Combination for Native Language Identification","year":2013,"lang":"en","type":"article","venue":"NPARC","topic":"Authorship Attribution and Profiling","field":"Computer Science","cited_by":14,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":true,"route_about_ca":true,"ca_institutions":"","funders":"","keywords":"Computer science; Classifier (UML); Artificial intelligence; Exploit; Feature selection; Spelling; Feature vector; Natural language processing; Support vector machine; Variety (cybernetics); Feature (linguistics); Machine learning; Linguistics","score_opus":0.014092624702228855,"score_gpt":0.2742992865545968,"score_spread":0.26020666185236796,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2177050153","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.20001838,0.0025496609,0.77202654,0.00113343,0.00080467097,0.0004150448,0.002261282,0.015154414,0.005636635],"genre_scores_gemma":[0.76060253,0.0003764198,0.22759867,0.00017208247,0.00027554433,0.00037280004,0.0044018105,0.00041635562,0.005783702],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.99466187,0.0024501414,0.00035431742,0.0006783088,0.0013948946,0.00046055784],"domain_scores_gemma":[0.9938513,0.002124777,0.00029654562,0.0015180289,0.0018960873,0.00031329106],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.005763473,0.0014641401,0.0013461263,0.0037745077,0.0008497682,0.001828547,0.0011012529,0.001091438,0.0034612238],"category_scores_gemma":[0.012325008,0.00036673425,0.0013100067,0.0030408595,0.00042238366,0.0021820103,0.0018532111,0.001484738,0.0035268923],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00064552354,0.0004373829,0.010963425,0.0001615592,0.00021948678,0.00018607662,0.00021081806,0.0150596,0.015436414,0.0015410869,0.018224698,0.9369139],"study_design_scores_gemma":[0.00011396747,0.00096821645,0.016256507,0.000073843876,0.0002400509,0.00082827,0.0004805528,0.8786407,0.05857366,0.016221602,0.027392931,0.00020965145],"about_ca_topic_score_codex":0.0011712137,"about_ca_topic_score_gemma":0.0016753162,"teacher_disagreement_score":0.005763473,"about_ca_system_score_codex":0.00034655744,"about_ca_system_score_gemma":0.0009804682,"threshold_uncertainty_score":0.030480504},"labels":[],"label_agreement":null},{"id":"W2180526599","doi":"10.1109/pacrim.2015.7334812","title":"Sociolinguistics and programming","year":2015,"lang":"en","type":"article","venue":"","topic":"Authorship Attribution and Profiling","field":"Computer Science","cited_by":4,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Lethbridge","funders":"University of Lethbridge","keywords":"Computer science; C4.5 algorithm; Naive Bayes classifier; Decision tree; Artificial intelligence; Natural language processing; Machine learning; Coding (social sciences); Random forest; Implementation; Programming language; Support vector machine","score_opus":0.08692363511330098,"score_gpt":0.3121883468085785,"score_spread":0.2252647116952775,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2180526599","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.6752796,0.011554603,0.049615517,0.00992393,0.00033475194,0.00008980208,0.0005071735,0.00031064454,0.25238398],"genre_scores_gemma":[0.98802465,0.001437886,0.006032511,0.00020619002,0.00006112708,0.000026509264,0.0000946854,0.000034519315,0.0040818793],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.9985746,0.0007348999,0.00007726222,0.0001822342,0.00034329356,0.00008762567],"domain_scores_gemma":[0.992716,0.0046340805,0.0014478588,0.00034665945,0.00051619456,0.00033921443],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0008985543,0.00020807981,0.00015079543,0.0028634013,0.0011358118,0.0024191262,0.00023608652,0.0003711108,0.006072728],"category_scores_gemma":[0.007538542,0.00009978833,0.00012457969,0.0028217311,0.0039330153,0.0020937766,0.0012940549,0.0005671021,0.0004952564],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00008962947,0.00015661561,0.14305346,0.00043395068,0.00003293472,0.0008986571,0.0556612,0.0016932118,0.0029182122,0.43896073,0.0048845997,0.35121676],"study_design_scores_gemma":[0.000014724144,0.00014372688,0.2682973,0.00048402557,0.000025766329,0.0028258536,0.05792432,0.0060332967,0.0019490946,0.37411183,0.2881015,0.00008850518],"about_ca_topic_score_codex":0.0040469165,"about_ca_topic_score_gemma":0.004530859,"teacher_disagreement_score":0.006072728,"about_ca_system_score_codex":0.0012755357,"about_ca_system_score_gemma":0.0010364717,"threshold_uncertainty_score":0.02031529},"labels":[],"label_agreement":null},{"id":"W2250174871","doi":"","title":"Classifying English Documents by National Dialect","year":2013,"lang":"en","type":"article","venue":"","topic":"Authorship Attribution and Profiling","field":"Computer Science","cited_by":42,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":true,"ca_institutions":"","funders":"","keywords":"British National Corpus; Linguistics; Variety (cybernetics); Variation (astronomy); Computer science; Natural language processing; Intuition; Artificial intelligence; Psychology","score_opus":0.021663359235563485,"score_gpt":0.2665022127154754,"score_spread":0.24483885347991194,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2250174871","genre_codex":"empirical","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.9383478,0.0035761194,0.012458182,0.0005826675,0.00013287363,0.000263947,0.0269882,0.0009031879,0.01674714],"genre_scores_gemma":[0.914391,0.0016115218,0.039128624,0.00011638192,0.000101217986,0.00017553799,0.037393104,0.00013064036,0.0069519645],"study_design_codex":"observational","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9988298,0.00022276945,0.00020868599,0.00027397322,0.00031367212,0.0001511622],"domain_scores_gemma":[0.9906883,0.00442545,0.00087615766,0.00086358195,0.00282074,0.00032581668],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0014583227,0.00047958284,0.00051401183,0.009016614,0.001003089,0.0023463168,0.00037413664,0.00042009196,0.0023174027],"category_scores_gemma":[0.009384949,0.00015423773,0.00037534768,0.0074507026,0.00044804602,0.0015837272,0.00090613135,0.00042062314,0.001324794],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0005742231,0.00037622073,0.49718508,0.0015332898,0.0003176052,0.00061983726,0.0058897086,0.0029061246,0.030219952,0.0039836112,0.027694123,0.42870027],"study_design_scores_gemma":[0.00006755948,0.00018070926,0.7812376,0.00038103407,0.00038230512,0.0013476006,0.010778779,0.047655452,0.036407363,0.004752112,0.11666903,0.00014050852],"about_ca_topic_score_codex":0.028389443,"about_ca_topic_score_gemma":0.053897347,"teacher_disagreement_score":0.028389443,"about_ca_system_score_codex":0.0010597111,"about_ca_system_score_gemma":0.0011419822,"threshold_uncertainty_score":0.0564484},"labels":[],"label_agreement":null},{"id":"W2250194349","doi":"10.18653/v1/d13-1114","title":"Gender Inference of Twitter Users in Non-English Contexts","year":2013,"lang":"en","type":"article","venue":"","topic":"Authorship Attribution and Profiling","field":"Computer Science","cited_by":133,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"McGill University","funders":"Social Sciences and Humanities Research Council of Canada; Natural Sciences and Engineering Research Council of Canada; Public Safety Canada","keywords":"Inference; Computer science; Orthography; Natural language processing; Social media; Artificial intelligence; Data science; Linguistics; World Wide Web","score_opus":0.045565338570214366,"score_gpt":0.2934247514939073,"score_spread":0.24785941292369293,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2250194349","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.9428589,0.00049093924,0.039576255,0.0014159238,0.00010710697,0.000048059657,0.004320519,0.00021328122,0.010969098],"genre_scores_gemma":[0.99296784,0.00011175569,0.004011413,0.0000864138,0.000040312436,0.000013421731,0.0014355301,0.000023853005,0.0013093937],"study_design_codex":"observational","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.99807966,0.0009908347,0.00011839608,0.00034706207,0.0002200308,0.00024405807],"domain_scores_gemma":[0.9915684,0.005205333,0.00086044,0.0009960046,0.001057472,0.00031245998],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0032453341,0.00036739686,0.00041816698,0.0011390466,0.00061249384,0.0014096274,0.00045178348,0.00057418057,0.0040130233],"category_scores_gemma":[0.021604232,0.00019760305,0.0004769192,0.0011136634,0.00040017633,0.0027060194,0.0010619502,0.0008982324,0.0016932269],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0011679141,0.00020327885,0.8532783,0.00016096483,0.00014822498,0.00040314288,0.006216015,0.004010012,0.004864778,0.008059033,0.0060137985,0.11547446],"study_design_scores_gemma":[0.0000730692,0.0002584507,0.6230617,0.00026284737,0.00023498204,0.0009503006,0.018846042,0.2667872,0.020747129,0.04776133,0.020838765,0.0001781422],"about_ca_topic_score_codex":0.0069072912,"about_ca_topic_score_gemma":0.009454398,"teacher_disagreement_score":0.0069072912,"about_ca_system_score_codex":0.00044547164,"about_ca_system_score_gemma":0.00038164793,"threshold_uncertainty_score":0.017163217},"labels":[],"label_agreement":null},{"id":"W2250418537","doi":"","title":"Author Verification Using Common N-Gram Profiles of Text Documents","year":2014,"lang":"en","type":"article","venue":"","topic":"Authorship Attribution and Profiling","field":"Computer Science","cited_by":28,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Dalhousie University","funders":"","keywords":"Computer science; n-gram; Natural language processing; Artificial intelligence; Classifier (UML); Set (abstract data type); Class (philosophy); Identification (biology); Information retrieval; Language model","score_opus":0.04998160390730941,"score_gpt":0.3299500645796463,"score_spread":0.27996846067233694,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2250418537","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.6984717,0.002632815,0.27409187,0.00048060904,0.00029246174,0.00039410222,0.005947844,0.0070978226,0.010590738],"genre_scores_gemma":[0.8467505,0.0004468881,0.14126685,0.0000537196,0.00010505747,0.00010905752,0.008194058,0.00019711826,0.0028767032],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9954601,0.0010270381,0.00051464594,0.0012132007,0.0014606861,0.00032433402],"domain_scores_gemma":[0.99092066,0.003201607,0.0017306262,0.0018725599,0.0017897057,0.00048473122],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0019762265,0.0009130938,0.001102358,0.007679213,0.0011762051,0.0022468688,0.00085472787,0.001323838,0.0013253745],"category_scores_gemma":[0.011725721,0.0002368472,0.00069490424,0.004544138,0.00048995053,0.0038238985,0.0023313386,0.0008608416,0.0024316912],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0016224249,0.0005018772,0.05265907,0.0007118862,0.00019756437,0.0008565885,0.001369335,0.009837159,0.076511115,0.004616748,0.008364639,0.8427517],"study_design_scores_gemma":[0.00009222982,0.0005978553,0.06350665,0.00022942269,0.00016510831,0.003876163,0.0018312639,0.73755586,0.13386713,0.027719302,0.030376919,0.00018217653],"about_ca_topic_score_codex":0.0017154196,"about_ca_topic_score_gemma":0.003522143,"teacher_disagreement_score":0.007679213,"about_ca_system_score_codex":0.0006437936,"about_ca_system_score_gemma":0.0008550158,"threshold_uncertainty_score":0.010451376},"labels":[],"label_agreement":null},{"id":"W2250996967","doi":"","title":"Cognate and Misspelling Features for Natural Language Identification","year":2013,"lang":"en","type":"article","venue":"Workshop on Innovative Use of NLP for Building Educational Applications","topic":"Authorship Attribution and Profiling","field":"Computer Science","cited_by":14,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Alberta","funders":"","keywords":"Bigram; Computer science; Cognate; Natural language processing; Artificial intelligence; Classifier (UML); Natural language; Word (group theory); Identification (biology); Spelling; Syntax; Language identification; Linguistics","score_opus":0.040169251186743346,"score_gpt":0.347697391551569,"score_spread":0.3075281403648256,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2250996967","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.7547152,0.0015576535,0.22565937,0.0006205891,0.0002668394,0.00025271246,0.0031016646,0.0077414857,0.006084489],"genre_scores_gemma":[0.88420665,0.00016973227,0.10946057,0.0000904362,0.00009078635,0.00014421457,0.0039754356,0.00023515287,0.0016271796],"study_design_codex":"design_other","study_design_gemma":"not_applicable","domain_scores_codex":[0.9971951,0.00090066507,0.00030017688,0.00059098494,0.0007678008,0.0002452282],"domain_scores_gemma":[0.98958874,0.0058066132,0.0008951103,0.0013986459,0.0017007849,0.00061007583],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0025270875,0.0013279256,0.0008709689,0.0038904662,0.0010203711,0.0013812963,0.000874899,0.0009793027,0.002749864],"category_scores_gemma":[0.010975695,0.00023774,0.0007656406,0.0019375603,0.0004682339,0.0020979284,0.0015370542,0.00150325,0.002163836],"study_design_candidate":"not_applicable","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.000848415,0.00083134806,0.047393586,0.00038701188,0.00015959796,0.00041805435,0.0005387546,0.008026438,0.04497234,0.001149729,0.0070680254,0.88820684],"study_design_scores_gemma":[0.00015190731,0.0012218261,0.06688757,0.00018599724,0.00031582854,0.0016966629,0.0013133194,0.7375987,0.15594783,0.018340869,0.01605993,0.00027946243],"about_ca_topic_score_codex":0.00158971,"about_ca_topic_score_gemma":0.002710665,"teacher_disagreement_score":0.0038904662,"about_ca_system_score_codex":0.00033096012,"about_ca_system_score_gemma":0.00082841975,"threshold_uncertainty_score":0.013364673},"labels":[],"label_agreement":null},{"id":"W2251370914","doi":"","title":"Robust, Lexicalized Native Language Identification","year":2012,"lang":"en","type":"article","venue":"","topic":"Authorship Attribution and Profiling","field":"Computer Science","cited_by":40,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Toronto","funders":"","keywords":"Computer science; Artificial intelligence; Natural language processing; Classifier (UML); Training set; Task (project management); Identification (biology); Set (abstract data type); Language identification; Test set; Natural language","score_opus":0.0716369537548322,"score_gpt":0.3186020371403878,"score_spread":0.24696508338555562,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2251370914","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.4496232,0.0014213196,0.48766145,0.00073396997,0.0007829505,0.0009320139,0.0064633107,0.021998793,0.030383067],"genre_scores_gemma":[0.78747004,0.0002248843,0.1937339,0.00030249226,0.00016823229,0.00050185766,0.0083198035,0.0012380307,0.0080408],"study_design_codex":"design_other","study_design_gemma":"not_applicable","domain_scores_codex":[0.9901154,0.0033762201,0.00068653654,0.003076663,0.0022526088,0.00049252645],"domain_scores_gemma":[0.9843875,0.0051768627,0.00085999264,0.0048345467,0.0043003713,0.00044065458],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.006571268,0.0012250907,0.001496895,0.0027139916,0.0011860298,0.003971785,0.0019052794,0.0021228176,0.0068046693],"category_scores_gemma":[0.028814357,0.0004464128,0.0005445026,0.0012530264,0.00092280196,0.005986751,0.0055742767,0.0016623882,0.010340496],"study_design_candidate":"not_applicable","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00086686393,0.000781297,0.018029535,0.00094593543,0.0002756432,0.0006974015,0.0024541605,0.012090377,0.14401697,0.00706928,0.028516637,0.784256],"study_design_scores_gemma":[0.0002445332,0.0011011951,0.078478545,0.00035719154,0.0002459796,0.0037764295,0.0056953602,0.55611765,0.25185955,0.05046263,0.051074162,0.00058684975],"about_ca_topic_score_codex":0.0012884124,"about_ca_topic_score_gemma":0.0019435394,"teacher_disagreement_score":0.0068046693,"about_ca_system_score_codex":0.00049095775,"about_ca_system_score_gemma":0.0012080312,"threshold_uncertainty_score":0.034752548},"labels":[],"label_agreement":null},{"id":"W2251433042","doi":"10.3115/v1/w14-5904","title":"Automatic Identification of Arabic Language Varieties and Dialects in Social Media","year":2014,"lang":"en","type":"article","venue":"","topic":"Authorship Attribution and Profiling","field":"Computer Science","cited_by":90,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Université du Québec à Montréal","funders":"","keywords":"Arabic; Computer science; Identification (biology); Natural language processing; Social media; Language identification; Linguistics; Artificial intelligence; Natural language; World Wide Web; Botany","score_opus":0.01806990496924178,"score_gpt":0.2669399753216908,"score_spread":0.248870070352449,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2251433042","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.9358654,0.0012924359,0.0455699,0.0006704699,0.00026438443,0.00026983896,0.006366311,0.001561825,0.008139399],"genre_scores_gemma":[0.9479809,0.00038998717,0.041722305,0.00008631561,0.00010057671,0.00009137209,0.0062394617,0.000049863065,0.0033391125],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9991266,0.0003011423,0.000078536985,0.00021225988,0.00017938216,0.00010218139],"domain_scores_gemma":[0.9975266,0.00093595195,0.0003846111,0.00027351896,0.00071950787,0.00015985167],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0008752725,0.0005792789,0.00038189668,0.0041598985,0.000706622,0.0012393,0.00034104768,0.00052912935,0.0014702464],"category_scores_gemma":[0.0041466807,0.00015820978,0.00035401777,0.0016603187,0.00024970016,0.001869543,0.0009432223,0.0005094813,0.0022426855],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0010251217,0.0004986657,0.27084675,0.000606929,0.00014156995,0.00089754735,0.003802615,0.0035608762,0.050542016,0.0034359368,0.021457119,0.64318484],"study_design_scores_gemma":[0.00006310661,0.00037461863,0.45432493,0.0003347096,0.00018857533,0.002926136,0.014181381,0.40618822,0.058827132,0.014323896,0.048071478,0.00019584212],"about_ca_topic_score_codex":0.002623127,"about_ca_topic_score_gemma":0.004596252,"teacher_disagreement_score":0.0041598985,"about_ca_system_score_codex":0.00035587905,"about_ca_system_score_gemma":0.00032637166,"threshold_uncertainty_score":0.005215764},"labels":[],"label_agreement":null},{"id":"W2251483280","doi":"10.18653/v1/d15-1088","title":"Mr. Bennet, his coachman, and the Archbishop walk into a bar but only one of them gets recognized: On The Difficulty of Detecting Characters in Literary Texts","year":2015,"lang":"en","type":"article","venue":"","topic":"Authorship Attribution and Profiling","field":"Computer Science","cited_by":59,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"McGill University","funders":"","keywords":"Character (mathematics); Archbishop; Computer science; Bar (unit); State (computer science); Artificial intelligence; Natural language processing; History; Mathematics; Algorithm; Physics","score_opus":0.06396051724858276,"score_gpt":0.26159500965184174,"score_spread":0.19763449240325898,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2251483280","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.31150606,0.016851906,0.39019838,0.10517604,0.01614972,0.00047865004,0.015031955,0.02090503,0.12370233],"genre_scores_gemma":[0.5025133,0.0046558473,0.29896176,0.0068471055,0.0017631488,0.00024650217,0.015729712,0.0024240443,0.16685851],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.99737984,0.0006148397,0.00019155962,0.0006944467,0.0009595206,0.00015980439],"domain_scores_gemma":[0.98996735,0.003162258,0.00067607855,0.002536406,0.0027914653,0.00086644455],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0027615905,0.0011175622,0.0006308522,0.004826061,0.0033650692,0.0036474543,0.0011136534,0.0020557079,0.010474664],"category_scores_gemma":[0.016044565,0.0004406537,0.00043596976,0.0035342232,0.00095802255,0.0055534053,0.002659669,0.002807271,0.01725922],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0005927154,0.00017364023,0.030944157,0.00036402524,0.00007079679,0.0011487027,0.0020532426,0.0023066192,0.014508497,0.015021086,0.2756159,0.6572007],"study_design_scores_gemma":[0.000032020464,0.00016610454,0.022445874,0.0005555462,0.00005343902,0.0060412535,0.005543214,0.05542721,0.05148065,0.039149836,0.8188731,0.00023171335],"about_ca_topic_score_codex":0.0038743787,"about_ca_topic_score_gemma":0.01937169,"teacher_disagreement_score":0.010474664,"about_ca_system_score_codex":0.00086791033,"about_ca_system_score_gemma":0.0009461151,"threshold_uncertainty_score":0.035041213},"labels":[],"label_agreement":null},{"id":"W2251848710","doi":"","title":"Authorship Attribution in Health Forums","year":2013,"lang":"en","type":"article","venue":"","topic":"Authorship Attribution and Profiling","field":"Computer Science","cited_by":4,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Children's Hospital of Eastern Ontario; Dalhousie University; University of Ottawa","funders":"","keywords":"Attribution; Authorship attribution; Social media; Computer science; World Wide Web; Linkage (software); Data science; Internet privacy; Psychology; Social psychology; Artificial intelligence","score_opus":0.031012603805849377,"score_gpt":0.2827549021966515,"score_spread":0.25174229839080214,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2251848710","genre_codex":"empirical","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.9621057,0.0015397829,0.022903461,0.0006961471,0.00029909037,0.00013048669,0.0022906186,0.0004004421,0.009634323],"genre_scores_gemma":[0.9927819,0.00013747923,0.0052491208,0.000030123465,0.0001055624,0.000030777766,0.0006816294,0.000023980792,0.00095948245],"study_design_codex":"observational","study_design_gemma":"not_applicable","domain_scores_codex":[0.9825897,0.010077985,0.001567432,0.002055307,0.0026913916,0.0010181786],"domain_scores_gemma":[0.71959096,0.1991063,0.04286907,0.021655636,0.013997555,0.0027804745],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.015467388,0.00040270493,0.00046739285,0.010145906,0.001445139,0.0030185033,0.00077393086,0.0012651103,0.0033166856],"category_scores_gemma":[0.15401265,0.00024081385,0.00034083184,0.0052278643,0.0010599317,0.0036856462,0.0023584273,0.00073479273,0.0012568407],"study_design_candidate":"not_applicable","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00081064226,0.00020628751,0.75589263,0.0006572784,0.00012882086,0.00049410295,0.011939223,0.0046777055,0.004300586,0.008203868,0.004713424,0.20797534],"study_design_scores_gemma":[0.00009422019,0.00040004245,0.60462916,0.0011662891,0.00022870595,0.0037447265,0.014151837,0.22148514,0.031143352,0.08390611,0.03879668,0.00025378194],"about_ca_topic_score_codex":0.0008279119,"about_ca_topic_score_gemma":0.0006533499,"teacher_disagreement_score":0.015467388,"about_ca_system_score_codex":0.00072371383,"about_ca_system_score_gemma":0.00053735473,"threshold_uncertainty_score":0.08180034},"labels":[],"label_agreement":null},{"id":"W2284070151","doi":"","title":"What's in a Name? Using First Names as Features for Gender Inference in Twitter","year":2013,"lang":"en","type":"article","venue":"National Conference on Artificial Intelligence","topic":"Authorship Attribution and Profiling","field":"Computer Science","cited_by":168,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"McGill University","funders":"","keywords":"Classifier (UML); Inference; Computer science; Artificial intelligence; Social media; Natural language processing; Baseline (sea); Information retrieval; Machine learning; World Wide Web","score_opus":0.2696613820475069,"score_gpt":0.4140428855734447,"score_spread":0.14438150352593782,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2284070151","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.81431276,0.0024743476,0.13095023,0.0031615803,0.0006328753,0.00018817373,0.022540443,0.002355075,0.023384599],"genre_scores_gemma":[0.95939136,0.00048156848,0.029971408,0.00021274369,0.00025190078,0.00008355264,0.0062468234,0.000105399966,0.0032552825],"study_design_codex":"observational","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.99857795,0.0005653019,0.00010826711,0.00032564538,0.00026442864,0.00015838725],"domain_scores_gemma":[0.99363166,0.0032338796,0.0013972211,0.00054918806,0.00093813747,0.0002499779],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0017659116,0.00051292556,0.00045867852,0.0034106744,0.00087775005,0.001315651,0.00049423915,0.00074853783,0.0025925708],"category_scores_gemma":[0.012056448,0.00019236244,0.0003527796,0.0020516063,0.00037330348,0.0034772065,0.00077625265,0.00083803013,0.0025649238],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0016822144,0.00023412569,0.5202211,0.00049521506,0.00012300527,0.0007208169,0.0035848503,0.005801283,0.01566314,0.008284723,0.033732377,0.4094571],"study_design_scores_gemma":[0.000074176394,0.00035800313,0.4110777,0.00045186703,0.00020419522,0.0017046878,0.009817742,0.3839645,0.048437297,0.042991795,0.10064966,0.00026835708],"about_ca_topic_score_codex":0.0039522806,"about_ca_topic_score_gemma":0.0072850487,"teacher_disagreement_score":0.0039522806,"about_ca_system_score_codex":0.0006499884,"about_ca_system_score_gemma":0.0005700513,"threshold_uncertainty_score":0.009339094},"labels":[],"label_agreement":null},{"id":"W2293603645","doi":"","title":"Proximity based one-class classification with Common N-Gram dissimilarity for authorship verification task Notebook for PAN at CLEF 2013","year":2013,"lang":"en","type":"article","venue":"CLEF (Working Notes)","topic":"Authorship Attribution and Profiling","field":"Computer Science","cited_by":10,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Dalhousie University","funders":"","keywords":"Ranking (information retrieval); Computer science; Task (project management); Set (abstract data type); Sample (material); Clef; Artificial intelligence; Natural language processing; Class (philosophy); Test set; Information retrieval; Thresholding; Image (mathematics)","score_opus":0.10315380752693581,"score_gpt":0.29994915414585527,"score_spread":0.19679534661891945,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2293603645","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.7008309,0.006731621,0.22115201,0.0033801296,0.0026488947,0.0022739999,0.023090431,0.020512737,0.01937933],"genre_scores_gemma":[0.7016178,0.0003747773,0.23614767,0.00051781646,0.00057851453,0.0013294817,0.04399881,0.0007399158,0.014695237],"study_design_codex":"design_other","study_design_gemma":"bench_or_experimental","domain_scores_codex":[0.99221605,0.00252054,0.00061199546,0.002209299,0.0018226415,0.00061954994],"domain_scores_gemma":[0.98819506,0.005982304,0.0006606737,0.00226681,0.0018733813,0.0010218072],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.006640342,0.0020688588,0.0024948556,0.0040873108,0.0022009904,0.0025974766,0.002039251,0.0035628832,0.007763492],"category_scores_gemma":[0.01976003,0.00031594795,0.0012571621,0.002630294,0.0006680017,0.0032457411,0.0031676756,0.0027880496,0.005003507],"study_design_candidate":"bench_or_experimental","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0035293915,0.0018207757,0.01337411,0.00093680643,0.0002843827,0.0007359146,0.000653591,0.014146847,0.026698073,0.00301402,0.14386006,0.790946],"study_design_scores_gemma":[0.00084413565,0.0017723631,0.027496684,0.00016450303,0.00013803554,0.0018214125,0.0014897478,0.8276279,0.05603148,0.019207384,0.06314675,0.00025967008],"about_ca_topic_score_codex":0.0039586923,"about_ca_topic_score_gemma":0.005742749,"teacher_disagreement_score":0.007763492,"about_ca_system_score_codex":0.001534389,"about_ca_system_score_gemma":0.0016526452,"threshold_uncertainty_score":0.035117924},"labels":[],"label_agreement":null},{"id":"W2344088191","doi":"10.5220/0005710103540361","title":"Authorship Attribution using Variable Length Part-of-Speech Patterns","year":2016,"lang":"en","type":"article","venue":"","topic":"Authorship Attribution and Profiling","field":"Computer Science","cited_by":24,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Université de Moncton","funders":"","keywords":"Variable (mathematics); Computer science; Speech recognition; Artificial intelligence; Natural language processing; Mathematics","score_opus":0.07725854955679153,"score_gpt":0.29568239750468917,"score_spread":0.21842384794789765,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2344088191","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.8350188,0.002033394,0.14551476,0.000980107,0.0005620297,0.00014221956,0.0083583845,0.0018162815,0.0055740667],"genre_scores_gemma":[0.9638288,0.00027513984,0.030277777,0.00004497527,0.00020943137,0.00004425203,0.003986597,0.00008395541,0.0012490635],"study_design_codex":"design_other","study_design_gemma":"bench_or_experimental","domain_scores_codex":[0.99614954,0.0013070151,0.00049987534,0.0010118644,0.0006848991,0.00034688332],"domain_scores_gemma":[0.96732986,0.020004809,0.005267708,0.0032283876,0.0031639016,0.001005388],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0033195158,0.00063520606,0.0007077968,0.009184351,0.00087973115,0.002256095,0.0008561144,0.0015790149,0.0017178621],"category_scores_gemma":[0.023194268,0.0002719738,0.0008160951,0.0070495885,0.0005053426,0.003089651,0.0011628922,0.001014382,0.0019380031],"study_design_candidate":"bench_or_experimental","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0028379187,0.0008580649,0.36999908,0.0006720756,0.0006477298,0.0019316056,0.0018835295,0.024606409,0.054367606,0.009978332,0.013119325,0.51909846],"study_design_scores_gemma":[0.000093310366,0.00037883507,0.1446278,0.00017111511,0.00037949043,0.0026061563,0.0013449057,0.756065,0.037472267,0.044642534,0.012009621,0.00020887569],"about_ca_topic_score_codex":0.0008046052,"about_ca_topic_score_gemma":0.0013805657,"teacher_disagreement_score":0.009184351,"about_ca_system_score_codex":0.0004647368,"about_ca_system_score_gemma":0.00056353566,"threshold_uncertainty_score":0.017555475},"labels":[],"label_agreement":null},{"id":"W2395204577","doi":"","title":"Authorship Verification with Entity Coherence and Other Rich Linguistic Features Notebook for PAN at CLEF 2013.","year":2013,"lang":"en","type":"article","venue":"","topic":"Authorship Attribution and Profiling","field":"Computer Science","cited_by":4,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Toronto","funders":"","keywords":"Clef; Computer science; Natural language processing; Coherence (philosophical gambling strategy); Artificial intelligence; Set (abstract data type); Test set; Linguistics; Engineering; Task (project management)","score_opus":0.03157653255970652,"score_gpt":0.27183383513712284,"score_spread":0.24025730257741632,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2395204577","genre_codex":"dataset","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.09082202,0.0050199367,0.2438387,0.009368282,0.0036824932,0.0021156734,0.3051896,0.2629777,0.07698557],"genre_scores_gemma":[0.21709223,0.0006855241,0.21576838,0.0007111269,0.00074009807,0.0009889114,0.5012985,0.013596743,0.04911849],"study_design_codex":"not_applicable","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9953466,0.0014968362,0.00039762232,0.0007411456,0.0017783822,0.00023935597],"domain_scores_gemma":[0.9843679,0.0062228674,0.0008735615,0.0049080844,0.0028132335,0.0008144399],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0061978726,0.001501822,0.0009438108,0.0060452605,0.0018548206,0.0018915208,0.0013845644,0.0012931414,0.07325104],"category_scores_gemma":[0.02213062,0.0006544125,0.000558091,0.0026850265,0.00040055855,0.004277894,0.0031013358,0.0012084806,0.03301991],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0003091217,0.00016125222,0.0022943425,0.00033713752,0.000045971075,0.00026755163,0.00018100049,0.0012069778,0.0066053467,0.0018496272,0.8157337,0.171008],"study_design_scores_gemma":[0.00055150077,0.00024408972,0.02006991,0.00029737235,0.000048996902,0.0013806657,0.0003750344,0.09547777,0.058613088,0.011072604,0.8116149,0.00025403884],"about_ca_topic_score_codex":0.0055981986,"about_ca_topic_score_gemma":0.012763482,"teacher_disagreement_score":0.07325104,"about_ca_system_score_codex":0.0012003382,"about_ca_system_score_gemma":0.0017346663,"threshold_uncertainty_score":0.24504912},"labels":[],"label_agreement":null},{"id":"W2407284108","doi":"","title":"CNG Text Classification for Authorship Profiling Task Notebook for PAN at CLEF 2013.","year":2013,"lang":"en","type":"article","venue":"CLEF (Working Notes)","topic":"Authorship Attribution and Profiling","field":"Computer Science","cited_by":8,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Dalhousie University","funders":"","keywords":"Clef; Classifier (UML); Computer science; Artificial intelligence; Natural language processing; Profiling (computer programming); Task (project management); Engineering","score_opus":0.09971323396320451,"score_gpt":0.30798310261268236,"score_spread":0.20826986864947783,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2407284108","genre_codex":"dataset","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.111008376,0.0047052186,0.070351265,0.00651447,0.0069942805,0.005201194,0.6307169,0.108422965,0.056085333],"genre_scores_gemma":[0.065978974,0.00037110838,0.06933977,0.00078462827,0.00060942705,0.0024138272,0.8247645,0.0032455584,0.032492183],"study_design_codex":"not_applicable","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.99449724,0.0014081247,0.0003914172,0.0013203492,0.0019042189,0.00047867603],"domain_scores_gemma":[0.9877395,0.0031967293,0.000657319,0.0030282512,0.00368539,0.0016928794],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0051780543,0.0029738673,0.0017526037,0.005982028,0.0021128997,0.0022122788,0.0019449957,0.0025977844,0.06573977],"category_scores_gemma":[0.01622037,0.00043084144,0.000968745,0.0033770958,0.00047557655,0.003818185,0.003242898,0.0019378988,0.059109792],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00027488096,0.0002494185,0.0013026199,0.00038009294,0.00004595286,0.00020322452,0.000116531985,0.0005225939,0.0070735826,0.0005926248,0.8971808,0.09205769],"study_design_scores_gemma":[0.00083531556,0.00063809624,0.022377871,0.0002467152,0.00006931759,0.0017994443,0.0008800589,0.046527114,0.03836344,0.0057484442,0.8823151,0.00019906591],"about_ca_topic_score_codex":0.005964975,"about_ca_topic_score_gemma":0.01163187,"teacher_disagreement_score":0.06573977,"about_ca_system_score_codex":0.0020597763,"about_ca_system_score_gemma":0.002534974,"threshold_uncertainty_score":0.21992147},"labels":[],"label_agreement":null},{"id":"W2413940460","doi":"10.7202/1035934ar","title":"Essai d’analyse lexicale et stemma codicum de quatre-vingt-trois rituels de Chevaliers Kadosh de la collation du fonds de l’atelier de recherches Sources","year":2016,"lang":"fr","type":"article","venue":"Nouvelles perspectives en sciences sociales","topic":"Authorship Attribution and Profiling","field":"Computer Science","cited_by":1,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":true,"route_about_ca":false,"ca_institutions":"","funders":"","keywords":"Humanities; Art; Philosophy","score_opus":0.1287079775374719,"score_gpt":0.3973763774111077,"score_spread":0.2686683998736358,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2413940460","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.5330808,0.00848313,0.37189916,0.001405379,0.0015630027,0.0005736724,0.020574316,0.007642098,0.054778438],"genre_scores_gemma":[0.580593,0.002645377,0.31360143,0.00029775992,0.00036900633,0.0006499656,0.026329562,0.004283192,0.0712307],"study_design_codex":"design_other","study_design_gemma":"qualitative","domain_scores_codex":[0.9983146,0.00026253564,0.00017541194,0.00050388795,0.00062744087,0.00011616599],"domain_scores_gemma":[0.99513125,0.0024382726,0.00022624672,0.00044924344,0.0016419351,0.00011311683],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0015867089,0.00095797237,0.00071132486,0.00583105,0.0014391765,0.0029783794,0.00062520604,0.0007349653,0.014354237],"category_scores_gemma":[0.0064743604,0.00038217878,0.0011132965,0.005562775,0.00075033755,0.0019489736,0.0010184151,0.0010498326,0.0074424986],"study_design_candidate":"qualitative","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0012543905,0.0000886458,0.019657958,0.0014268215,0.00022130605,0.00151165,0.015251711,0.0016850268,0.10003397,0.011975626,0.01519655,0.8316964],"study_design_scores_gemma":[0.000117267315,0.00039201547,0.13933806,0.0006216671,0.0005266142,0.0041810595,0.013945288,0.022702547,0.11889637,0.013636742,0.6853169,0.00032547672],"about_ca_topic_score_codex":0.008051534,"about_ca_topic_score_gemma":0.010447023,"teacher_disagreement_score":0.014354237,"about_ca_system_score_codex":0.0008055384,"about_ca_system_score_gemma":0.0012289153,"threshold_uncertainty_score":0.048019707},"labels":[],"label_agreement":null},{"id":"W2418050709","doi":"10.1109/tcyb.2017.2766189","title":"Learning Stylometric Representations for Authorship Analysis","year":2017,"lang":"en","type":"preprint","venue":"IEEE Transactions on Cybernetics","topic":"Authorship Attribution and Profiling","field":"Computer Science","cited_by":5,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"McGill University","funders":"Zayed University; Natural Sciences and Engineering Research Council of Canada; Canada Research Chairs","keywords":"Computer science; Natural language processing; Word2vec; Artificial intelligence; Latent Dirichlet allocation; Representation (politics); Latent semantic analysis; Feature (linguistics); Sentence; Set (abstract data type); Psycholinguistics; Feature engineering; Attributive; Linguistics; Topic model; Deep learning; Politics; Psychology","score_opus":0.07844246020336623,"score_gpt":0.3524052087635211,"score_spread":0.2739627485601549,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2418050709","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.09828579,0.00079054775,0.8927077,0.0005709276,0.0001472938,0.00013534575,0.0017616978,0.0026476285,0.0029530795],"genre_scores_gemma":[0.8662016,0.0005423117,0.12535205,0.00009825144,0.00028536425,0.00028962485,0.004070089,0.0001506507,0.003009981],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9988181,0.0004216175,0.00012499162,0.00029493103,0.00023457351,0.00010579442],"domain_scores_gemma":[0.9955433,0.0022074948,0.00069998996,0.00078814017,0.000624625,0.00013656705],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0013959914,0.0008773621,0.0007718502,0.005859883,0.0005472648,0.0015685413,0.00089205656,0.0008952091,0.0018015999],"category_scores_gemma":[0.011519796,0.00029556346,0.00066257204,0.004720065,0.00064281997,0.002844865,0.0011885739,0.0011748027,0.0012507096],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00027458958,0.00039671722,0.017497176,0.00014132449,0.00015875182,0.00018154473,0.00042928854,0.17052805,0.0047372663,0.031001013,0.010697196,0.7639571],"study_design_scores_gemma":[0.000012957197,0.000027212043,0.0016811773,0.000020102596,0.000016361386,0.000049908234,0.00006785746,0.9512551,0.0014226023,0.042973943,0.0024557905,0.00001703029],"about_ca_topic_score_codex":0.0013344695,"about_ca_topic_score_gemma":0.0022353057,"teacher_disagreement_score":0.005859883,"about_ca_system_score_codex":0.0011209229,"about_ca_system_score_gemma":0.000993741,"threshold_uncertainty_score":0.008132935},"labels":[],"label_agreement":null},{"id":"W2469248043","doi":"10.1016/j.concog.2016.06.004","title":"Automatic gender detection of dream reports: A promising approach","year":2016,"lang":"en","type":"article","venue":"Consciousness and Cognition","topic":"Authorship Attribution and Profiling","field":"Computer Science","cited_by":6,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Ottawa","funders":"Social Sciences and Humanities Research Council of Canada; University of Ottawa","keywords":"Psychology; Dream; Cognitive psychology; Cognitive science; Psychotherapist","score_opus":0.026106671130410285,"score_gpt":0.24478306032868602,"score_spread":0.21867638919827573,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2469248043","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.13478865,0.0026139962,0.84081334,0.0016588598,0.00051170384,0.00040002167,0.0046905004,0.00501978,0.009503197],"genre_scores_gemma":[0.6708172,0.00085883297,0.31834537,0.00027822895,0.00048834056,0.00024197169,0.0031574895,0.00033279043,0.005479796],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.99790895,0.0008232661,0.00014942359,0.0005986579,0.0003141103,0.00020572353],"domain_scores_gemma":[0.991204,0.0039006565,0.0009251983,0.0018070937,0.001637324,0.00052568567],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0026704483,0.00097597926,0.0012076246,0.005426104,0.0007493511,0.003112695,0.0014547332,0.0011584145,0.0042907842],"category_scores_gemma":[0.011078219,0.00032035995,0.00081081985,0.0027762584,0.0004688549,0.0023372576,0.0015979505,0.0012134752,0.0030996054],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00077120075,0.0006686922,0.053756215,0.0005462528,0.00027385633,0.00022219478,0.0007697426,0.0021644852,0.08285677,0.00833977,0.008819981,0.8408107],"study_design_scores_gemma":[0.00020373306,0.000969789,0.20945655,0.00041175212,0.00045726047,0.0028325457,0.0039303,0.48310965,0.11190908,0.14565368,0.0405742,0.00049143564],"about_ca_topic_score_codex":0.0010288184,"about_ca_topic_score_gemma":0.0022515398,"teacher_disagreement_score":0.005426104,"about_ca_system_score_codex":0.0003434969,"about_ca_system_score_gemma":0.0008030759,"threshold_uncertainty_score":0.01435411},"labels":[],"label_agreement":null},{"id":"W2477122767","doi":"10.1109/bracis.2016.071","title":"Authorship Attribution via Network Motifs Identification","year":2016,"lang":"en","type":"article","venue":"","topic":"Authorship Attribution and Profiling","field":"Computer Science","cited_by":17,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Toronto","funders":"","keywords":"Automatic summarization; Authorship attribution; Identification (biology); Attribution; Function (biology); Style (visual arts); Motif (music)","score_opus":0.028194521535274353,"score_gpt":0.26190395260485877,"score_spread":0.23370943106958442,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2477122767","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.43082264,0.0011682658,0.55491734,0.0008363301,0.00011753996,0.00021698327,0.0020775646,0.0017739079,0.008069433],"genre_scores_gemma":[0.9107173,0.00031801008,0.08585744,0.000033394248,0.00007096989,0.0001134286,0.0010200137,0.00006152642,0.0018079656],"study_design_codex":"design_other","study_design_gemma":"not_applicable","domain_scores_codex":[0.998171,0.0006915581,0.00014064333,0.00044167458,0.00039562318,0.00015954116],"domain_scores_gemma":[0.9890191,0.0065827626,0.0021500413,0.0008162138,0.0011626881,0.00026910176],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.001846663,0.0005661376,0.000630223,0.007977158,0.0006940058,0.0018160398,0.0006608413,0.0008823797,0.0022602407],"category_scores_gemma":[0.01841636,0.00028248885,0.00045846385,0.0039867098,0.0005774312,0.0028862609,0.0012579418,0.00073130504,0.00072036654],"study_design_candidate":"not_applicable","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00068941223,0.00023898407,0.13166489,0.00057000475,0.00032374298,0.0006373011,0.0016179733,0.07704359,0.019091422,0.03884124,0.0061249062,0.7231566],"study_design_scores_gemma":[0.000026380028,0.00009081372,0.028803816,0.000115122064,0.000097982294,0.0007446995,0.00058066205,0.8642119,0.011802769,0.08654211,0.00691878,0.000064882704],"about_ca_topic_score_codex":0.001267865,"about_ca_topic_score_gemma":0.0016786396,"teacher_disagreement_score":0.007977158,"about_ca_system_score_codex":0.00077550334,"about_ca_system_score_gemma":0.00053476036,"threshold_uncertainty_score":0.009766161},"labels":[],"label_agreement":null},{"id":"W2477807231","doi":"10.1093/acprof:oso/9780190212339.003.0008","title":"Investigating D in Languages With and Without Articles","year":2015,"lang":"en","type":"book-chapter","venue":"Oxford University Press eBooks","topic":"Authorship Attribution and Profiling","field":"Computer Science","cited_by":9,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":true,"ca_institutions":"","funders":"","keywords":"Linguistics; Computer science; Programming language; Philosophy","score_opus":0.059647964598459044,"score_gpt":0.2478762708901717,"score_spread":0.18822830629171267,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2477807231","genre_codex":"empirical","genre_gemma":"other","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"other","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.8265941,0.0012040946,0.012344966,0.0014523705,0.0000828801,0.00003677968,0.00042067596,0.00013370678,0.15773042],"genre_scores_gemma":[0.99510163,0.00016583102,0.0022722923,0.00010983635,0.000014056626,0.000014287806,0.00013295119,0.000045377117,0.0021438058],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"not_applicable","domain_scores_codex":[0.99851745,0.0006778737,0.000137293,0.00030153443,0.0002369542,0.000128941],"domain_scores_gemma":[0.9875381,0.009516552,0.0008755399,0.0008495894,0.0009710891,0.00024913932],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0017297107,0.0002651461,0.00035020098,0.0024652234,0.0016113167,0.0042790943,0.00050419604,0.0005401222,0.005914259],"category_scores_gemma":[0.009437119,0.00019566108,0.00026329604,0.0029712373,0.0047531757,0.0067381407,0.0028263894,0.0009537748,0.000542445],"study_design_candidate":"not_applicable","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00065052026,0.00018744517,0.09965633,0.0008669588,0.000054385975,0.0019235469,0.14309025,0.000771242,0.016069189,0.59658396,0.004384965,0.13576114],"study_design_scores_gemma":[0.000085977605,0.00022292409,0.12650798,0.0007796674,0.00007257351,0.003588254,0.19461025,0.008368145,0.021784436,0.47746035,0.16636312,0.00015635997],"about_ca_topic_score_codex":0.0017570691,"about_ca_topic_score_gemma":0.0015571269,"teacher_disagreement_score":0.005914259,"about_ca_system_score_codex":0.0013822668,"about_ca_system_score_gemma":0.00062377343,"threshold_uncertainty_score":0.019785225},"labels":[],"label_agreement":null},{"id":"W2527936838","doi":"10.63317/4e2puhxuby8y","title":"Discriminating Similar Languages: Evaluations and Explorations","year":2016,"lang":"en","type":"article","venue":"","topic":"Authorship Attribution and Profiling","field":"Computer Science","cited_by":35,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"National Research Council Canada","funders":"","keywords":"Computer science; Natural language processing; Artificial intelligence; Task (project management); Oracle; Digital subscriber line; Annotation; Machine learning; Programming language","score_opus":0.05894784463913573,"score_gpt":0.3522310635662659,"score_spread":0.29328321892713016,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2527936838","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.8927265,0.01749084,0.060589578,0.0016805518,0.0004931168,0.00053795456,0.0037228607,0.008498242,0.014260306],"genre_scores_gemma":[0.9315621,0.0014803788,0.053521436,0.00045415014,0.00019074019,0.00022563254,0.008559514,0.0013601753,0.0026457713],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9582401,0.024578888,0.003253248,0.004968994,0.006813744,0.0021449407],"domain_scores_gemma":[0.900428,0.07429386,0.0023536445,0.0117254285,0.0090332115,0.002165768],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.025761427,0.0043895394,0.003231489,0.006945222,0.0018865131,0.004616154,0.0029645844,0.003693311,0.0021911322],"category_scores_gemma":[0.086545065,0.00075574074,0.0017887648,0.005445751,0.0019371094,0.006718908,0.004313369,0.002526149,0.0020348295],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.007581749,0.0038880054,0.0602864,0.0032279454,0.0021471665,0.001466282,0.0036873082,0.13593206,0.021030689,0.003962701,0.04290391,0.71388584],"study_design_scores_gemma":[0.00069668336,0.0032844294,0.036174864,0.00066976034,0.0010292699,0.0026074836,0.005197299,0.86477846,0.044307895,0.022663763,0.018121952,0.00046807554],"about_ca_topic_score_codex":0.006661866,"about_ca_topic_score_gemma":0.006729185,"teacher_disagreement_score":0.025761427,"about_ca_system_score_codex":0.0018705709,"about_ca_system_score_gemma":0.0013302832,"threshold_uncertainty_score":0.13624108},"labels":[],"label_agreement":null},{"id":"W2551524644","doi":"10.1109/isi.2016.7745459","title":"Discovering structure in Islamist postings using systemic nets","year":2016,"lang":"en","type":"article","venue":"","topic":"Authorship Attribution and Profiling","field":"Computer Science","cited_by":1,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Queen's University","funders":"","keywords":"Representation (politics); Construct (python library); Computer science; Cluster analysis; Analytics; Politics; Systemic functional linguistics; Systemic functional grammar; Contrast (vision); Natural language processing; Linguistics; Data science; Artificial intelligence; Political science; Law","score_opus":0.02201571143297795,"score_gpt":0.2595588630152738,"score_spread":0.23754315158229586,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2551524644","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.7982557,0.00038909545,0.18576472,0.00059410656,0.000028714978,0.000118912045,0.0015353921,0.00034337456,0.012969916],"genre_scores_gemma":[0.9546696,0.00012793165,0.042149678,0.000033736447,0.00002019986,0.00005272929,0.0013543675,0.000021812115,0.0015699802],"study_design_codex":"observational","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.99925894,0.00026641053,0.00006263312,0.00019818428,0.00014516877,0.00006854724],"domain_scores_gemma":[0.99585354,0.00234868,0.00084259163,0.0003341699,0.0004037297,0.00021720675],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0011875745,0.0002306516,0.00021921974,0.0050486657,0.0009331933,0.0017925347,0.0003043001,0.00042251492,0.0017271297],"category_scores_gemma":[0.004878782,0.00019168318,0.00037490478,0.003943584,0.0010702468,0.0022008135,0.0010125489,0.00042271495,0.00030691214],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0005807431,0.00027802578,0.36112714,0.00056447124,0.00015757655,0.0010726871,0.016167732,0.026731296,0.016968122,0.2625229,0.004514883,0.30931446],"study_design_scores_gemma":[0.000045727644,0.00016101798,0.21866992,0.00022156615,0.00013476619,0.000686823,0.012553048,0.46519488,0.008487111,0.26223177,0.031521663,0.00009170529],"about_ca_topic_score_codex":0.0047303285,"about_ca_topic_score_gemma":0.01157151,"teacher_disagreement_score":0.0050486657,"about_ca_system_score_codex":0.0011208769,"about_ca_system_score_gemma":0.0007146486,"threshold_uncertainty_score":0.009405553},"labels":[],"label_agreement":null},{"id":"W2563642182","doi":"10.3138/ecf.29.2.121","title":"Mediation, Authorship, and Samuel Richardson: An Introduction","year":2016,"lang":"en","type":"article","venue":"Eighteenth-Century Fiction","topic":"Authorship Attribution and Profiling","field":"Computer Science","cited_by":0,"is_retracted":false,"has_abstract":false,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":true,"route_about_ca":false,"ca_institutions":"","funders":"","keywords":"Mediation; Psychology; Sociology; Social science","score_opus":0.01601018260132525,"score_gpt":0.2477149982202332,"score_spread":0.23170481561890796,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2563642182","genre_codex":"other","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.023182869,0.29666558,0.019866591,0.13839391,0.009249225,0.000103965154,0.0002516162,0.000139445,0.51214683],"genre_scores_gemma":[0.52871126,0.15029965,0.018801693,0.022078808,0.026590902,0.00029291355,0.0002145626,0.00023432862,0.25277588],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"not_applicable","domain_scores_codex":[0.9983872,0.00092990394,0.00008416246,0.00018868089,0.00024887218,0.0001612384],"domain_scores_gemma":[0.9944713,0.004717617,0.00017160844,0.000194276,0.00029319085,0.00015199548],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.001963578,0.0005631869,0.00053262996,0.0038419669,0.004455464,0.006248725,0.001118165,0.00367405,0.0076707085],"category_scores_gemma":[0.007698309,0.0003399401,0.00035053014,0.003718775,0.013895674,0.009834554,0.002980592,0.004161412,0.0011194688],"study_design_candidate":"not_applicable","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.000012104277,0.000021547072,0.00047286865,0.00011983669,0.0000037070056,0.00010074809,0.0069799474,0.00010350479,0.00007813987,0.94213986,0.024380835,0.025586877],"study_design_scores_gemma":[0.0000047881886,0.000019209352,0.0009100353,0.00050988677,0.000004936466,0.00028578768,0.005352473,0.00023925754,0.00018322816,0.2799175,0.71254575,0.00002705279],"about_ca_topic_score_codex":0.0033954247,"about_ca_topic_score_gemma":0.0051124776,"teacher_disagreement_score":0.0076707085,"about_ca_system_score_codex":0.0031299773,"about_ca_system_score_gemma":0.0016260783,"threshold_uncertainty_score":0.025661051},"labels":[],"label_agreement":null},{"id":"W2576057564","doi":"10.1002/dac.3259","title":"Authorship verification using deep belief network systems","year":2017,"lang":"en","type":"article","venue":"International Journal of Communication Systems","topic":"Authorship Attribution and Profiling","field":"Computer Science","cited_by":63,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Toronto Metropolitan University; University of Victoria","funders":"","keywords":"Computer science; Merge (version control); Bernoulli's principle; Gaussian; Word error rate; Basis (linear algebra); Artificial intelligence; Block (permutation group theory); Natural language processing; Data mining; Theoretical computer science; Algorithm; Information retrieval; Mathematics","score_opus":0.09828633259928508,"score_gpt":0.3644836674045816,"score_spread":0.2661973348052965,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2576057564","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.10827739,0.00078039273,0.88439757,0.0011641677,0.00009561376,0.00006991197,0.00023444156,0.0014586957,0.0035218343],"genre_scores_gemma":[0.9554681,0.00013704548,0.042457074,0.00009533272,0.000037060712,0.00003253576,0.00015246058,0.000022571925,0.0015977465],"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.99841905,0.0006802437,0.00009098513,0.00031750416,0.00031155738,0.0001806998],"domain_scores_gemma":[0.99380785,0.0038233157,0.00065137807,0.0006360002,0.0009458056,0.00013576227],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0026077975,0.0006136798,0.00085380604,0.0014119484,0.0005266399,0.0017612627,0.0011534095,0.0012975,0.0018986298],"category_scores_gemma":[0.010258096,0.0004407985,0.0006242468,0.00079196726,0.00090871,0.0024951666,0.0013862085,0.0017013459,0.00048974296],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0002897356,0.00011235898,0.0036666377,0.00008467699,0.00010339559,0.00009855064,0.00011703725,0.84293807,0.0015680349,0.013461107,0.0012447423,0.13631557],"study_design_scores_gemma":[0.000002524149,0.0000060675584,0.00010586022,0.0000039480396,0.0000030329588,0.000004756045,0.000004199157,0.9949734,0.00036314433,0.0044536334,0.00007667381,0.0000027000945],"about_ca_topic_score_codex":0.007227893,"about_ca_topic_score_gemma":0.005414616,"teacher_disagreement_score":0.007227893,"about_ca_system_score_codex":0.0016668093,"about_ca_system_score_gemma":0.0011215076,"threshold_uncertainty_score":0.0143716335},"labels":[],"label_agreement":null},{"id":"W2577065989","doi":"","title":"Authorship Attribution Using Small Sets of Frequent Part-of-Speech Skip-grams.","year":2016,"lang":"en","type":"article","venue":"The Florida AI Research Society","topic":"Authorship Attribution and Profiling","field":"Computer Science","cited_by":13,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Université de Moncton","funders":"","keywords":"Authorship attribution; Computer science; Speech recognition; Natural language processing; Attribution; Artificial intelligence; Psychology","score_opus":0.263147923505861,"score_gpt":0.41165690007068545,"score_spread":0.14850897656482442,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2577065989","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.68966496,0.0050136684,0.24112812,0.001010872,0.001458955,0.0004917546,0.0401038,0.009115882,0.012011926],"genre_scores_gemma":[0.85159004,0.0005854485,0.10590393,0.0001301819,0.00043824236,0.00021556496,0.036526393,0.0003680663,0.004242176],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.99750537,0.0006473867,0.0003507453,0.0007020323,0.00056566537,0.00022882734],"domain_scores_gemma":[0.9827383,0.010030011,0.002200527,0.0018885304,0.0024380467,0.0007045958],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0021062023,0.0009219873,0.00074403925,0.010004867,0.0010993697,0.0015451874,0.0008758895,0.0014555043,0.0023071659],"category_scores_gemma":[0.02158381,0.00029572978,0.0006095509,0.0059087714,0.00031042783,0.0025111996,0.0011770524,0.0010013679,0.003227492],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0025592858,0.0009862077,0.15105486,0.0016467697,0.0007228036,0.0020350209,0.0017901233,0.014468377,0.06999477,0.005499903,0.050824255,0.69841766],"study_design_scores_gemma":[0.00014842063,0.0005040854,0.12381224,0.00044277436,0.0005125224,0.0034897502,0.00199502,0.7083168,0.06496665,0.040702634,0.05488514,0.00022393157],"about_ca_topic_score_codex":0.0010739532,"about_ca_topic_score_gemma":0.0035943966,"teacher_disagreement_score":0.010004867,"about_ca_system_score_codex":0.00036446028,"about_ca_system_score_gemma":0.0007954384,"threshold_uncertainty_score":0.011138797},"labels":[],"label_agreement":null},{"id":"W2586163947","doi":"10.22148/16.008","title":"Genre Theory and Historicism","year":2016,"lang":"en","type":"article","venue":"Journal of Cultural Analytics","topic":"Authorship Attribution and Profiling","field":"Computer Science","cited_by":6,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":true,"route_about_ca":true,"ca_institutions":"","funders":"","keywords":"Poetics; Literature; New Historicism; Historicism; Reflexivity; Literary criticism; Criticism; Literary theory; Philosophy; Quarter (Canadian coin); Literary science; History; Art; Sociology; Poetry; Social science","score_opus":0.0330594690223462,"score_gpt":0.28266785351531826,"score_spread":0.24960838449297207,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2586163947","genre_codex":"other","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.016838217,0.017843083,0.02090868,0.017966589,0.0013591246,0.000044244345,0.00020390787,0.000066112945,0.92477],"genre_scores_gemma":[0.89820474,0.011499151,0.0076743886,0.002517655,0.0032816692,0.00012807205,0.00030735106,0.000224865,0.076162115],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.99687284,0.0016634712,0.00012774221,0.0005772521,0.00050378894,0.0002549802],"domain_scores_gemma":[0.995523,0.0025935313,0.00037460192,0.00068034127,0.00048331887,0.00034516264],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0042890203,0.0005236147,0.00058912,0.006247047,0.0058615725,0.010263098,0.0012459904,0.0019311548,0.0107045695],"category_scores_gemma":[0.007287808,0.00029617333,0.00047958858,0.0036210748,0.034154717,0.012177189,0.0033834826,0.0037737584,0.0014671849],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0000035972723,0.0000028988043,0.00012217098,0.000021240705,0.0000015072727,0.000014743106,0.0018222565,0.000050476483,0.000011823743,0.9932461,0.0012781852,0.0034249634],"study_design_scores_gemma":[0.0000063669154,0.000007272327,0.000313552,0.0001765124,0.000004088165,0.000093664516,0.0024445774,0.00015912189,0.00006148319,0.8869892,0.10973837,0.0000057839884],"about_ca_topic_score_codex":0.0031151106,"about_ca_topic_score_gemma":0.0030211315,"teacher_disagreement_score":0.0107045695,"about_ca_system_score_codex":0.007351103,"about_ca_system_score_gemma":0.0018424287,"threshold_uncertainty_score":0.053336203},"labels":[],"label_agreement":null},{"id":"W2604695895","doi":"10.1007/978-3-319-57735-7_15","title":"Assessing Code Authorship: The Case of the Linux Kernel","year":2017,"lang":"en","type":"book-chapter","venue":"IFIP advances in information and communication technology","topic":"Authorship Attribution and Profiling","field":"Computer Science","cited_by":8,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Waterloo","funders":"Universidade Federal do Piauí; Fundação de Amparo à Pesquisa do Estado de Minas Gerais; Conselho Nacional de Desenvolvimento Científico e Tecnológico; Coordenação de Aperfeiçoamento de Pessoal de Nível Superior","keywords":"Linux kernel; Key (lock); Code (set theory); Kernel (algebra); Division (mathematics); Source code; Work (physics)","score_opus":0.03407603336574625,"score_gpt":0.3305315520107275,"score_spread":0.2964555186449812,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2604695895","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.96128243,0.0011638174,0.01830588,0.0019936496,0.000072587834,0.000043720593,0.00030581842,0.00017838433,0.016653728],"genre_scores_gemma":[0.9885324,0.00022886532,0.0087400265,0.000061988205,0.000030774718,0.000013172073,0.00021526865,0.00006427499,0.0021132717],"study_design_codex":"observational","study_design_gemma":"observational","domain_scores_codex":[0.99583095,0.0023512188,0.00016943691,0.000449357,0.00097329734,0.00022572496],"domain_scores_gemma":[0.92543393,0.06256793,0.0038429855,0.0028125364,0.0042087077,0.001133863],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0055699144,0.00029713096,0.0003020073,0.0037841199,0.0018510867,0.0024744717,0.0007812332,0.0009801778,0.0020021286],"category_scores_gemma":[0.04237965,0.00015704944,0.00022300222,0.004442342,0.00126255,0.0030728213,0.0020827577,0.00092446484,0.00068535056],"study_design_candidate":"observational","study_design_consensus":"observational","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00046948082,0.00035798163,0.5102954,0.00045985833,0.000064596694,0.007339974,0.038607404,0.01691621,0.0052064518,0.027718373,0.025000557,0.36756372],"study_design_scores_gemma":[0.000053684584,0.00032536732,0.40772906,0.0008274184,0.00008920265,0.011461649,0.05556065,0.31918126,0.017534953,0.11104044,0.075932786,0.0002636178],"about_ca_topic_score_codex":0.004669196,"about_ca_topic_score_gemma":0.0054381764,"teacher_disagreement_score":0.0055699144,"about_ca_system_score_codex":0.0013214591,"about_ca_system_score_gemma":0.0005024294,"threshold_uncertainty_score":0.029456913},"labels":[],"label_agreement":null},{"id":"W2611114189","doi":"","title":"Labelled network motifs reveal stylistic subtleties in written texts.","year":2017,"lang":"en","type":"preprint","venue":"arXiv (Cornell University)","topic":"Authorship Attribution and Profiling","field":"Computer Science","cited_by":1,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":true,"ca_institutions":"","funders":"","keywords":"Computer science; Natural language processing; Artificial intelligence; GRASP; Authorship attribution; Representation (politics); Classifier (UML); Set (abstract data type); Machine translation","score_opus":0.10679256722795508,"score_gpt":0.2193976665030728,"score_spread":0.11260509927511772,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2611114189","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.5928304,0.0021614642,0.37969926,0.001090893,0.00017220431,0.0001952738,0.006484353,0.0013535519,0.016012534],"genre_scores_gemma":[0.9429102,0.0005456124,0.05101178,0.00009131043,0.00007620248,0.00013016639,0.0024338665,0.000094775125,0.0027059652],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9990693,0.00030390732,0.00007113098,0.00030054318,0.0001877701,0.00006742797],"domain_scores_gemma":[0.9863544,0.009518162,0.002312353,0.00090361806,0.00067864807,0.00023278514],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.00083412766,0.00039671586,0.00036922374,0.0052706883,0.0006659574,0.0015188385,0.00045669885,0.00087320706,0.0030014853],"category_scores_gemma":[0.011692574,0.00023425775,0.0003173826,0.004524399,0.0011345694,0.0028562204,0.0009667911,0.0006053296,0.0008508964],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0010760693,0.00024568234,0.18066414,0.0017961754,0.00035817033,0.0026128916,0.010513464,0.055680133,0.06075536,0.15745315,0.013462635,0.5153821],"study_design_scores_gemma":[0.000033501627,0.00022180106,0.10895096,0.00042625377,0.0001851961,0.002500714,0.0034682802,0.5110163,0.016623285,0.3116098,0.044822924,0.00014103664],"about_ca_topic_score_codex":0.0014032592,"about_ca_topic_score_gemma":0.0035906874,"teacher_disagreement_score":0.0052706883,"about_ca_system_score_codex":0.00073271454,"about_ca_system_score_gemma":0.0003566327,"threshold_uncertainty_score":0.010040939},"labels":[],"label_agreement":null},{"id":"W2618569315","doi":"10.16995/dm.59","title":"Alliteration and character focus in the York Plays","year":2015,"lang":"en","type":"article","venue":"Digital Medievalist","topic":"Authorship Attribution and Profiling","field":"Computer Science","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":true,"route_about_ca":false,"ca_institutions":"Lakehead University","funders":"","keywords":"Alliteration; Focus (optics); Character (mathematics); Context (archaeology); Reading (process); Linguistics; Natural language processing; Computer science; History; Mathematics; Rhyme; Philosophy; Poetry","score_opus":0.06614203493177835,"score_gpt":0.27721097458405963,"score_spread":0.2110689396522813,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2618569315","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.9858037,0.00029498432,0.0056868936,0.00006536451,0.000011676061,0.000027183252,0.0001785417,0.00004415013,0.007887598],"genre_scores_gemma":[0.9979456,0.000058683643,0.00064207875,0.0000068857307,0.0000082989745,0.000014459625,0.00011519037,0.000021327573,0.0011874307],"study_design_codex":"observational","study_design_gemma":"not_applicable","domain_scores_codex":[0.99882334,0.00038241327,0.00008936136,0.00023122075,0.0002995228,0.00017397919],"domain_scores_gemma":[0.9918522,0.0054172133,0.0012212164,0.00052665314,0.0006159369,0.00036684936],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0011344478,0.00024672164,0.00035420342,0.00372462,0.0010683164,0.001954142,0.00039026202,0.00025384326,0.0043315925],"category_scores_gemma":[0.013749729,0.00021236631,0.00017301609,0.0023608822,0.0023870333,0.0019314473,0.0019329066,0.00052523,0.00046598952],"study_design_candidate":"not_applicable","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0018457561,0.000106718675,0.6106159,0.00039491284,0.00012806425,0.000827881,0.097000875,0.0029952354,0.019083,0.05253875,0.0019566528,0.21250634],"study_design_scores_gemma":[0.000016571052,0.0001754086,0.93059814,0.00009604726,0.000041468757,0.00053857133,0.025978876,0.008264211,0.006600958,0.014420684,0.013192023,0.00007699551],"about_ca_topic_score_codex":0.00660849,"about_ca_topic_score_gemma":0.0076959897,"teacher_disagreement_score":0.00660849,"about_ca_system_score_codex":0.0009916268,"about_ca_system_score_gemma":0.00041927883,"threshold_uncertainty_score":0.014490604},"labels":[],"label_agreement":null},{"id":"W2758288680","doi":"10.18653/v1/w17-5022","title":"Native Language Identification Using a Mixture of Character and Word N-grams","year":2017,"lang":"en","type":"article","venue":"","topic":"Authorship Attribution and Profiling","field":"Computer Science","cited_by":4,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"","funders":"Concordia University","keywords":"Computer science; Character (mathematics); Task (project management); Natural language processing; Word (group theory); Word identification; Artificial intelligence; Identification (biology); First language; Linguistics; Transcription (linguistics); Speech recognition; Word recognition; Engineering","score_opus":0.04361739538232948,"score_gpt":0.334431434140087,"score_spread":0.2908140387577576,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2758288680","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.46709064,0.0019996925,0.49061656,0.0007857458,0.00074564095,0.00064325915,0.009542859,0.020694844,0.007880824],"genre_scores_gemma":[0.60336214,0.00046748202,0.3701675,0.00018398667,0.00021622963,0.00049591344,0.014234879,0.0008967389,0.009975099],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.99774927,0.00059331645,0.0002452056,0.00078944146,0.0004387727,0.00018391851],"domain_scores_gemma":[0.99544513,0.0018148622,0.00034103697,0.0007407144,0.0013802301,0.0002780128],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0026778765,0.0015820634,0.00093987444,0.0045399335,0.0010955955,0.0013347428,0.0008171078,0.0012066764,0.002978841],"category_scores_gemma":[0.008326327,0.00038255658,0.0008541983,0.001762331,0.0004813117,0.0023649873,0.00196578,0.0015212101,0.0060902783],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0015185424,0.0006250591,0.030661166,0.000608776,0.00021164774,0.00086620374,0.0013480755,0.0078365775,0.11672865,0.002203511,0.016350893,0.82104087],"study_design_scores_gemma":[0.00011304017,0.0009000277,0.04669295,0.00024770183,0.00023297379,0.0028396056,0.001816249,0.7294638,0.15930077,0.0119106565,0.0462683,0.0002138477],"about_ca_topic_score_codex":0.0025575624,"about_ca_topic_score_gemma":0.006710312,"teacher_disagreement_score":0.0045399335,"about_ca_system_score_codex":0.00045458495,"about_ca_system_score_gemma":0.000994197,"threshold_uncertainty_score":0.014162123},"labels":[],"label_agreement":null},{"id":"W2759906493","doi":"10.18653/v1/w17-5023","title":"Ensemble Methods for Native Language Identification","year":2017,"lang":"en","type":"article","venue":"","topic":"Authorship Attribution and Profiling","field":"Computer Science","cited_by":4,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Victoria","funders":"","keywords":"Computer science; Identification (biology); Natural language processing; Artificial intelligence; Language identification; Natural language","score_opus":0.0906035831245341,"score_gpt":0.4595583548269149,"score_spread":0.36895477170238083,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2759906493","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.029543892,0.0023107214,0.96154183,0.00033097994,0.0002897759,0.00007635317,0.00046402166,0.0025683572,0.0028741765],"genre_scores_gemma":[0.64006287,0.0014463646,0.34451297,0.00033987072,0.0007154959,0.00029769418,0.003258895,0.00062853965,0.008737436],"study_design_codex":"design_other","study_design_gemma":"bench_or_experimental","domain_scores_codex":[0.9972234,0.0010684119,0.00016320842,0.00067834614,0.00065116846,0.00021544767],"domain_scores_gemma":[0.9924465,0.0034743347,0.0003708434,0.0017054427,0.0017909742,0.00021194672],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0052039986,0.0013581701,0.0019325855,0.0034578291,0.0010219101,0.0016162974,0.0016745668,0.0012078442,0.0023904014],"category_scores_gemma":[0.012538991,0.0005084923,0.0013962947,0.0020058088,0.00042219282,0.0029590926,0.0020338423,0.0022200763,0.0018819432],"study_design_candidate":"bench_or_experimental","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00019816973,0.00017273665,0.011030438,0.00012892863,0.00063885626,0.00010232062,0.00027220524,0.16285188,0.0028622118,0.00692007,0.01089358,0.80392855],"study_design_scores_gemma":[0.000007609819,0.000054201817,0.0015642141,0.000024634426,0.00005494087,0.000072259056,0.000064848005,0.9815965,0.0016311061,0.012102847,0.002805427,0.000021453769],"about_ca_topic_score_codex":0.003835053,"about_ca_topic_score_gemma":0.0057096286,"teacher_disagreement_score":0.0052039986,"about_ca_system_score_codex":0.0005189281,"about_ca_system_score_gemma":0.00084763765,"threshold_uncertainty_score":0.02752167},"labels":[],"label_agreement":null},{"id":"W2773782067","doi":"","title":"Chat Disentanglement: Identifying Semantic Reply Relationships with Random Forests and Recurrent Neural Networks","year":2017,"lang":"en","type":"article","venue":"International Joint Conference on Natural Language Processing","topic":"Authorship Attribution and Profiling","field":"Computer Science","cited_by":33,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of British Columbia","funders":"","keywords":"Computer science; Thread (computing); Random forest; Recurrent neural network; Classifier (UML); Artificial intelligence; Machine learning; Artificial neural network; Natural language processing; Data mining; Programming language","score_opus":0.06351610469634573,"score_gpt":0.32617992000321583,"score_spread":0.2626638153068701,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2773782067","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.16883063,0.00070425705,0.8211468,0.0004794054,0.0001562678,0.00022400386,0.0011441298,0.0051633674,0.0021511929],"genre_scores_gemma":[0.7638399,0.00017602199,0.22653052,0.00014313462,0.000175316,0.00024840957,0.0038172328,0.00028790112,0.0047815763],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9987155,0.00045043134,0.00008588241,0.000409263,0.00018148254,0.00015755407],"domain_scores_gemma":[0.995201,0.0027468617,0.0006579058,0.00052033865,0.0006354248,0.0002384384],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.003155158,0.0015035019,0.0009468862,0.002752788,0.0007243079,0.0011596942,0.001670173,0.0013238563,0.0016412024],"category_scores_gemma":[0.008988333,0.00044148767,0.0010843405,0.0014214971,0.00047025585,0.0022926398,0.0012473274,0.0022187002,0.0015666836],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0009850193,0.0010418622,0.038010642,0.0002991072,0.0003162561,0.00049000996,0.0013736549,0.124744564,0.022228247,0.008482952,0.012373233,0.78965443],"study_design_scores_gemma":[0.000013327517,0.000044923225,0.0016566681,0.000013421482,0.000024421168,0.00003675342,0.00008850621,0.9881421,0.0025801386,0.006482776,0.0009024745,0.000014535975],"about_ca_topic_score_codex":0.005649163,"about_ca_topic_score_gemma":0.011865917,"teacher_disagreement_score":0.005649163,"about_ca_system_score_codex":0.00059253856,"about_ca_system_score_gemma":0.00092974456,"threshold_uncertainty_score":0.01668626},"labels":[],"label_agreement":null},{"id":"W2774011248","doi":"","title":"Identifying Users from Online Interactions in Twitter.","year":2016,"lang":"en","type":"article","venue":"Trans. Computational Science","topic":"Authorship Attribution and Profiling","field":"Computer Science","cited_by":4,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Calgary","funders":"","keywords":"Computer science; Identification (biology); World Wide Web; Social network (sociolinguistics); Process (computing); Authentication (law); Internet privacy; Biometrics; Online participation; Data science; Social media; Human–computer interaction; The Internet; Artificial intelligence; Computer security","score_opus":0.1019615192793068,"score_gpt":0.36914161950680313,"score_spread":0.26718010022749633,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2774011248","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.9030789,0.0013789763,0.06282984,0.00084525516,0.0002284625,0.0004098113,0.016273094,0.001302336,0.013653286],"genre_scores_gemma":[0.9669466,0.0005117983,0.020890828,0.000084047904,0.000113808375,0.00016971669,0.0064992574,0.000038626265,0.0047452487],"study_design_codex":"observational","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9990163,0.00027000872,0.00011966034,0.00016718695,0.0003277057,0.000099049415],"domain_scores_gemma":[0.99763,0.0007571064,0.00069034536,0.0003865063,0.00038963024,0.00014635525],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.00065092783,0.0006042917,0.00048575416,0.0033653858,0.00064276427,0.00075454946,0.00041763176,0.0006517243,0.0020895763],"category_scores_gemma":[0.00385843,0.00016359724,0.00035556604,0.0024004492,0.00022594784,0.0015721567,0.0009832147,0.00035917276,0.0025871512],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0011256586,0.00036440176,0.49538535,0.00075606676,0.00025215675,0.0012274409,0.0031713273,0.0040081767,0.05678502,0.003250443,0.015311812,0.41836214],"study_design_scores_gemma":[0.00002818282,0.0005472396,0.71562,0.00018921997,0.00021230837,0.0032923066,0.005492193,0.17175744,0.04589791,0.007996255,0.048812043,0.00015502577],"about_ca_topic_score_codex":0.0013507078,"about_ca_topic_score_gemma":0.0036202178,"teacher_disagreement_score":0.0033653858,"about_ca_system_score_codex":0.00028555605,"about_ca_system_score_gemma":0.00024872122,"threshold_uncertainty_score":0.006990373},"labels":[],"label_agreement":null},{"id":"W2774157693","doi":"10.1109/icdmw.2017.51","title":"Estimating Personality from Social Media Posts","year":2017,"lang":"en","type":"article","venue":"","topic":"Authorship Attribution and Profiling","field":"Computer Science","cited_by":22,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Queen's University","funders":"","keywords":"Personality psychology; Personality; Lexicon; Computer science; Repertoire; Social media; Artificial intelligence; Negotiation; Arabic; Robot; Natural language processing; Social psychology; Linguistics; Psychology; World Wide Web; Sociology","score_opus":0.09161803524495755,"score_gpt":0.33936273650546295,"score_spread":0.2477447012605054,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2774157693","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.96353066,0.00025248507,0.02511663,0.0002981414,0.000111397334,0.00014495348,0.0042598187,0.0007957144,0.0054902043],"genre_scores_gemma":[0.9793553,0.00012335295,0.015359292,0.000031052194,0.00009918297,0.000057087593,0.0024554497,0.000021840033,0.0024973897],"study_design_codex":"observational","study_design_gemma":"observational","domain_scores_codex":[0.9992519,0.00027272405,0.00007596702,0.0001493316,0.00016587629,0.00008411446],"domain_scores_gemma":[0.9941901,0.0029485333,0.0008929527,0.00052566215,0.0011242803,0.00031858098],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0010707313,0.0006891934,0.00028948468,0.0029860255,0.00042639274,0.0007496897,0.0002639284,0.00046622922,0.0016373083],"category_scores_gemma":[0.0073271818,0.000174201,0.00026228008,0.0012146148,0.00017880125,0.0010268996,0.0005228058,0.00041450554,0.0018173868],"study_design_candidate":"observational","study_design_consensus":"observational","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0010287667,0.00043394003,0.58347684,0.00030267442,0.00019141211,0.0006045181,0.0019015713,0.0069031753,0.019701002,0.0009122143,0.0107912095,0.37375274],"study_design_scores_gemma":[0.000029635776,0.000481381,0.65975595,0.000085743246,0.00013287508,0.000886836,0.0032013888,0.30057356,0.020033961,0.0034559981,0.011256794,0.00010586918],"about_ca_topic_score_codex":0.0017869312,"about_ca_topic_score_gemma":0.0037611357,"teacher_disagreement_score":0.0029860255,"about_ca_system_score_codex":0.0002566986,"about_ca_system_score_gemma":0.00019475128,"threshold_uncertainty_score":0.0056626797},"labels":[],"label_agreement":null},{"id":"W2783314643","doi":"10.1109/bigdata.2017.8258240","title":"Language identification in multilingual, short and noisy texts using common N-grams","year":2017,"lang":"en","type":"article","venue":"","topic":"Authorship Attribution and Profiling","field":"Computer Science","cited_by":3,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Dalhousie University","funders":"","keywords":"Computer science; Correctness; Language identification; Artificial intelligence; Natural language processing; Naive Bayes classifier; Support vector machine; Classifier (UML); Artificial neural network; Identification (biology); Natural language; Task (project management); Random forest; Machine learning; Algorithm","score_opus":0.06960196406045646,"score_gpt":0.3813035576215925,"score_spread":0.311701593561136,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2783314643","genre_codex":"empirical","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.75465345,0.0017061452,0.23272559,0.0006270093,0.00020042916,0.00019212229,0.0023019335,0.0027213988,0.0048718643],"genre_scores_gemma":[0.8694361,0.00035453876,0.12458366,0.00006669401,0.00009226368,0.00007918312,0.0027798638,0.00017637781,0.002431368],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.99759513,0.00086742133,0.00029158764,0.0005471906,0.00053811155,0.00016048696],"domain_scores_gemma":[0.99051416,0.00552384,0.0016459189,0.00079291424,0.0012237814,0.00029946354],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0016758977,0.0006039946,0.00073108065,0.0057683494,0.0009220176,0.0017827717,0.0004919464,0.000823525,0.0010528268],"category_scores_gemma":[0.012094504,0.00017875215,0.0003815588,0.0037723423,0.00060647615,0.0034072546,0.0012969676,0.00069470925,0.0012631117],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0013523323,0.00044262194,0.105546884,0.001021519,0.00020250914,0.0017809831,0.0043473714,0.013212065,0.05960755,0.007700883,0.006259421,0.79852587],"study_design_scores_gemma":[0.00006171628,0.000601638,0.11007672,0.00050133106,0.00020293503,0.002829617,0.007654742,0.6770831,0.11947926,0.047033653,0.034237403,0.00023784196],"about_ca_topic_score_codex":0.001288364,"about_ca_topic_score_gemma":0.003205209,"teacher_disagreement_score":0.0057683494,"about_ca_system_score_codex":0.0005468459,"about_ca_system_score_gemma":0.00050313,"threshold_uncertainty_score":0.008863151},"labels":[],"label_agreement":null},{"id":"W2798712760","doi":"10.1109/infoteh.2018.8345541","title":"Slavic language identification using cascade classifier approach","year":2018,"lang":"en","type":"article","venue":"","topic":"Authorship Attribution and Profiling","field":"Computer Science","cited_by":5,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Dalhousie University","funders":"","keywords":"Computer science; Slavic languages; Language identification; Preprocessor; Classifier (UML); Natural language processing; Artificial intelligence; Identification (biology); Cascade; Focus (optics); Natural language; Linguistics","score_opus":0.06249432480819379,"score_gpt":0.3338656570210166,"score_spread":0.27137133221282284,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2798712760","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.26271975,0.0037327113,0.6944423,0.0008878971,0.0011131539,0.001234993,0.0030164344,0.012294692,0.020558042],"genre_scores_gemma":[0.7809716,0.00074928615,0.1937623,0.00031593934,0.00047030245,0.00038726447,0.005296368,0.00032550425,0.017721368],"study_design_codex":"design_other","study_design_gemma":"bench_or_experimental","domain_scores_codex":[0.9973948,0.00040092898,0.00018828386,0.00079364487,0.0007928816,0.00042936904],"domain_scores_gemma":[0.99737287,0.0006391686,0.00017845712,0.00030276697,0.0012957792,0.00021098598],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0019312007,0.0017363897,0.0017724364,0.005200995,0.001926621,0.0020937098,0.0017140892,0.0018622484,0.0048807045],"category_scores_gemma":[0.0040100953,0.000432373,0.0012015164,0.0019646501,0.0004653494,0.0029562975,0.0012848923,0.001795461,0.0055929134],"study_design_candidate":"bench_or_experimental","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0016749148,0.0010313587,0.021477764,0.00043779708,0.00035120008,0.0022696708,0.0007384681,0.028593553,0.07575082,0.005692389,0.037732553,0.8242495],"study_design_scores_gemma":[0.000055549353,0.0004445879,0.0082027605,0.000065288055,0.0002073588,0.0010841774,0.0004077487,0.9270743,0.042205915,0.009147312,0.010987655,0.00011736885],"about_ca_topic_score_codex":0.005777112,"about_ca_topic_score_gemma":0.009332822,"teacher_disagreement_score":0.005777112,"about_ca_system_score_codex":0.00074931147,"about_ca_system_score_gemma":0.0012995482,"threshold_uncertainty_score":0.01632756},"labels":[],"label_agreement":null},{"id":"W2848618769","doi":"","title":"Authorship Identification for Literary Book Recommendations","year":2018,"lang":"en","type":"article","venue":"International Conference on Computational Linguistics","topic":"Authorship Attribution and Profiling","field":"Computer Science","cited_by":13,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Ottawa","funders":"","keywords":"Reading (process); Recommender system; Pleasure; Computer science; Identification (biology); Style (visual arts); Factor (programming language); Writing style; Qualitative analysis; Information retrieval; World Wide Web; Natural language processing; Artificial intelligence; Qualitative research; Psychology; Linguistics; Literature; Art; Sociology","score_opus":0.11276954657335071,"score_gpt":0.39432093701642357,"score_spread":0.28155139044307287,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2848618769","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.24852443,0.0070220935,0.6640635,0.0034457466,0.0014669421,0.0011230335,0.012542356,0.031553164,0.03025878],"genre_scores_gemma":[0.69592845,0.0010777458,0.2756044,0.00029210869,0.00045183479,0.0002178476,0.008792351,0.0003737731,0.017261589],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9978028,0.00051571836,0.00020759452,0.00074178335,0.00056051055,0.00017165375],"domain_scores_gemma":[0.9917223,0.0033830996,0.0007185491,0.0016966163,0.0020460014,0.000433442],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.002096687,0.00096812996,0.0009009565,0.0057971207,0.0014338086,0.0021347883,0.0013050844,0.0015248052,0.006038892],"category_scores_gemma":[0.015783997,0.00052353414,0.0009393167,0.0031727054,0.00029980292,0.0035105424,0.0011217566,0.0014014969,0.0071836365],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00045316745,0.00072953675,0.060161084,0.0005872764,0.00023798297,0.00032463166,0.0009987069,0.010957928,0.007996833,0.0032379576,0.038183697,0.87613124],"study_design_scores_gemma":[0.00009023163,0.00031324633,0.0373199,0.0003924035,0.00034414767,0.0012497363,0.0010993816,0.8548715,0.025238154,0.017777622,0.0611385,0.00016513866],"about_ca_topic_score_codex":0.0052645667,"about_ca_topic_score_gemma":0.01408992,"teacher_disagreement_score":0.006038892,"about_ca_system_score_codex":0.0008642376,"about_ca_system_score_gemma":0.0012890808,"threshold_uncertainty_score":0.02020216},"labels":[],"label_agreement":null},{"id":"W2885704429","doi":"10.5339/qfarc.2018.ictpd879","title":"Annotation Guidelines for Text Analytics in Social Media","year":2018,"lang":"en","type":"article","venue":"","topic":"Authorship Attribution and Profiling","field":"Computer Science","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":true,"ca_institutions":"","funders":"","keywords":"Annotation; Modern Standard Arabic; Computer science; Variety (cybernetics); Social media; Arabic; Profiling (computer programming); Analytics; Natural language processing; Linguistics; Artificial intelligence; World Wide Web; Data science","score_opus":0.2373113529841914,"score_gpt":0.4173617885935614,"score_spread":0.18005043560936998,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2885704429","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0018600668,0.0008171581,0.8635592,0.0052344147,0.0009896122,0.008238288,0.03682927,0.055531662,0.026940303],"genre_scores_gemma":[0.010361205,0.0010869975,0.88361716,0.0015904506,0.0004366717,0.015338072,0.056195106,0.015937386,0.015436995],"study_design_codex":"not_applicable","study_design_gemma":"not_applicable","domain_scores_codex":[0.9281799,0.03211921,0.01735495,0.0055451323,0.015205049,0.0015956834],"domain_scores_gemma":[0.7202429,0.11739084,0.012437157,0.048485655,0.09757379,0.0038695692],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.056832403,0.0025246018,0.0018635687,0.017444208,0.0042961254,0.010702721,0.005531591,0.0053962306,0.031854015],"category_scores_gemma":[0.18324706,0.0030077512,0.0023423801,0.01275911,0.004127095,0.014365048,0.010719391,0.0059899553,0.055065677],"study_design_candidate":"not_applicable","study_design_consensus":"not_applicable","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0005095899,0.0003700376,0.0023270396,0.0069074994,0.00015560196,0.0016066981,0.01510954,0.0039618546,0.022823216,0.086104594,0.52196294,0.3381614],"study_design_scores_gemma":[0.00007666036,0.00006310987,0.0022261534,0.0029188762,0.00004258007,0.00029735165,0.0020227588,0.010869688,0.010147039,0.056200277,0.91491735,0.00021819206],"about_ca_topic_score_codex":0.008502535,"about_ca_topic_score_gemma":0.012063295,"teacher_disagreement_score":0.056832403,"about_ca_system_score_codex":0.0027877437,"about_ca_system_score_gemma":0.008117534,"threshold_uncertainty_score":0.30056208},"labels":[],"label_agreement":null},{"id":"W2891582949","doi":"10.18653/v1/d18-1294","title":"Syntax Encoding with Application in Authorship Attribution","year":2018,"lang":"en","type":"article","venue":"","topic":"Authorship Attribution and Profiling","field":"Computer Science","cited_by":46,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Ottawa; National Research Council Canada","funders":"National Key Research and Development Program of China; Beijing Advanced Innovation Center for Big Data and Brain Computing; State Key Laboratory of Software Development Environment; National Natural Science Foundation of China","keywords":"Computer science; Syntax; Natural language processing; Sentence; Encoding (memory); Artificial intelligence; Abstract syntax; Embedding; Parsing; ENCODE; Abstract syntax tree; Word (group theory); Representation (politics); Parse tree; Tree (set theory); Lossless compression; Linguistics; Data compression; Mathematics","score_opus":0.029703671376822435,"score_gpt":0.28498408047600726,"score_spread":0.2552804090991848,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2891582949","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.020310864,0.00046915654,0.9684189,0.00090094283,0.00021010892,0.00010323934,0.0015726035,0.005841017,0.0021732445],"genre_scores_gemma":[0.5213835,0.0006335392,0.46848768,0.00047078976,0.00029444922,0.00030488416,0.0037352927,0.00072470255,0.003965071],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9980837,0.0007646951,0.00021962874,0.0004899232,0.0003157928,0.00012630512],"domain_scores_gemma":[0.9938486,0.0028171083,0.0006110903,0.00182159,0.00073886587,0.00016275092],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0018830164,0.0010946592,0.00081467204,0.0027715073,0.0007201408,0.002116267,0.0016091573,0.0017456083,0.005557085],"category_scores_gemma":[0.016501613,0.0004500731,0.0010240166,0.0031858315,0.0012908132,0.009693616,0.0030894408,0.0026412208,0.0021314328],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00036845903,0.00030562104,0.0042526075,0.00049152755,0.00009409347,0.00039212906,0.00083806034,0.0867096,0.0115276845,0.12214911,0.015760928,0.7571102],"study_design_scores_gemma":[0.00006175503,0.00011141867,0.0009462601,0.0001193144,0.00007206241,0.00034238197,0.00021416329,0.54580456,0.015140043,0.42273796,0.0143546155,0.00009546827],"about_ca_topic_score_codex":0.0012146524,"about_ca_topic_score_gemma":0.0013339289,"teacher_disagreement_score":0.005557085,"about_ca_system_score_codex":0.0010276595,"about_ca_system_score_gemma":0.001447355,"threshold_uncertainty_score":0.018590331},"labels":[],"label_agreement":null},{"id":"W2901907079","doi":"10.1145/3236391","title":"Arabic Authorship Attribution","year":2018,"lang":"en","type":"article","venue":"ACM Transactions on Asian and Low-Resource Language Information Processing","topic":"Authorship Attribution and Profiling","field":"Computer Science","cited_by":23,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"McGill University","funders":"","keywords":"Cybercrime; Computer science; Anonymity; Authorship attribution; The Internet; Identity (music); Cyberspace; Online identity; Stylometry; Artificial intelligence; Computer security; World Wide Web","score_opus":0.013757917713083193,"score_gpt":0.2626968309772169,"score_spread":0.24893891326413373,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2901907079","genre_codex":"other","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.20126367,0.0054930933,0.08116202,0.005533899,0.0115134,0.0019263963,0.10671379,0.03727564,0.54911804],"genre_scores_gemma":[0.6812867,0.0021701043,0.09899853,0.00070820807,0.0017320581,0.0009151732,0.04878244,0.002649119,0.16275764],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9953679,0.0009856735,0.00070858625,0.00078389567,0.0017526443,0.00040130038],"domain_scores_gemma":[0.97443193,0.0063085305,0.0044708056,0.0061397534,0.007569179,0.0010797523],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0029042235,0.0013072336,0.0005584363,0.009752351,0.0022600451,0.004161596,0.0007413141,0.0010577716,0.08837211],"category_scores_gemma":[0.033642072,0.00026479294,0.00038356576,0.006656724,0.00071925326,0.0025677374,0.0024693508,0.00078603474,0.05125925],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0008544648,0.00011700492,0.021399599,0.0013121594,0.00005910128,0.00064138084,0.0021809516,0.0021264695,0.006325555,0.013614195,0.19740245,0.7539667],"study_design_scores_gemma":[0.0000677564,0.00014577784,0.026989339,0.00063491514,0.000058263136,0.0022018864,0.0022826532,0.022568192,0.023447655,0.019366957,0.9020669,0.00016976323],"about_ca_topic_score_codex":0.0007378662,"about_ca_topic_score_gemma":0.0008996131,"teacher_disagreement_score":0.08837211,"about_ca_system_score_codex":0.0008603069,"about_ca_system_score_gemma":0.0012181683,"threshold_uncertainty_score":0.29563415},"labels":[],"label_agreement":null},{"id":"W2907199838","doi":"","title":"Machines and Humans, Schemes and Tropes","year":2018,"lang":"en","type":"article","venue":"Early modern literary studies","topic":"Authorship Attribution and Profiling","field":"Computer Science","cited_by":1,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Ontario Tech University; University of Calgary","funders":"","keywords":"Drama; Pity; Rhetorical question; GRASP; Pleasure; Reading (process); Style (visual arts); Computer science; Literature; Linguistics; Psychology; Art; Philosophy; Programming language","score_opus":0.04323215752272351,"score_gpt":0.30957918239597887,"score_spread":0.26634702487325534,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2907199838","genre_codex":"other","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.35843152,0.025811631,0.21949342,0.024422726,0.0006337426,0.00011185922,0.0003722643,0.00048525157,0.37023762],"genre_scores_gemma":[0.98090804,0.001384361,0.012858064,0.00029566442,0.00012890299,0.000037826525,0.000066591296,0.00007421389,0.00424628],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"qualitative","domain_scores_codex":[0.9954105,0.0032423628,0.0001513053,0.0005369029,0.00049530267,0.00016366527],"domain_scores_gemma":[0.9888176,0.008108955,0.00095011556,0.0015214692,0.00039366906,0.00020819245],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0036183386,0.0004033083,0.0003326528,0.0033582186,0.0024450796,0.0064006243,0.0007399448,0.0013522054,0.0037500637],"category_scores_gemma":[0.013757323,0.00026006988,0.00025783575,0.002708315,0.029552294,0.013036849,0.0023790924,0.0014328423,0.0004834005],"study_design_candidate":"qualitative","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.000024871302,0.0000063274556,0.0021819172,0.00009819292,0.000011146996,0.00006140579,0.029150885,0.0006470648,0.00028120042,0.9447762,0.0011715915,0.021589305],"study_design_scores_gemma":[0.00000981953,0.000017449915,0.0029867713,0.00014704627,0.0000071423538,0.00020882276,0.012732654,0.001993904,0.00049876317,0.9068596,0.0745201,0.000017940762],"about_ca_topic_score_codex":0.00094019197,"about_ca_topic_score_gemma":0.0010395374,"teacher_disagreement_score":0.0064006243,"about_ca_system_score_codex":0.0015312377,"about_ca_system_score_gemma":0.0006921616,"threshold_uncertainty_score":0.019135892},"labels":[],"label_agreement":null},{"id":"W2908132425","doi":"10.1007/978-3-030-02840-4_10","title":"Criminal Events Detection in News Stories Using Intuitive Classification","year":2018,"lang":"en","type":"book-chapter","venue":"Lecture notes in computer science","topic":"Authorship Attribution and Profiling","field":"Computer Science","cited_by":0,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Polytechnique Montréal","funders":"","keywords":"Extortion; Computer science; Identification (biology); Process (computing); Homicide; Artificial intelligence; Natural language processing; Criminology; Machine learning; Information retrieval; Poison control; Political science; Human factors and ergonomics; Psychology; Law","score_opus":0.08034848186983104,"score_gpt":0.31990412870041895,"score_spread":0.23955564683058791,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2908132425","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.40474662,0.0038219248,0.5356819,0.0015197842,0.0011872662,0.00084570656,0.008043999,0.011750166,0.03240262],"genre_scores_gemma":[0.8011287,0.00065058406,0.17875166,0.00016887649,0.0005690913,0.00021563079,0.008157157,0.00022610092,0.010132233],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9988845,0.00021437294,0.00011683899,0.00029881042,0.0003002971,0.00018516956],"domain_scores_gemma":[0.9967963,0.0015180588,0.00032668072,0.00040158973,0.0007673708,0.00019005536],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0010634911,0.0009870351,0.00057712884,0.004307757,0.0006796408,0.0022639008,0.0009116382,0.00095515884,0.0039988384],"category_scores_gemma":[0.0049764956,0.00025936292,0.0005469141,0.0022166502,0.00038631042,0.002794831,0.001367751,0.0008391908,0.0029222185],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00067516713,0.00049184443,0.03110582,0.00032399123,0.00009629824,0.0005611421,0.000645531,0.0035561766,0.022866886,0.0032856916,0.0271421,0.90924937],"study_design_scores_gemma":[0.000070137015,0.00037914116,0.0668614,0.0002534383,0.00024526656,0.0017547427,0.002112945,0.8086569,0.05551043,0.024886116,0.0391459,0.00012362735],"about_ca_topic_score_codex":0.0010052803,"about_ca_topic_score_gemma":0.0020762742,"teacher_disagreement_score":0.004307757,"about_ca_system_score_codex":0.00030899755,"about_ca_system_score_gemma":0.0003328041,"threshold_uncertainty_score":0.013377488},"labels":[],"label_agreement":null},{"id":"W2910216835","doi":"10.1109/smc.2018.00424","title":"Temporal Pattern in Tweeting Behavior for Persons' Identity Verification","year":2018,"lang":"en","type":"article","venue":"","topic":"Authorship Attribution and Profiling","field":"Computer Science","cited_by":6,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Calgary","funders":"","keywords":"Identity (music); Computer science; Behavioral pattern; Biometrics; Set (abstract data type); Authentication (law); Social network (sociolinguistics); Behavioral analysis; Artificial intelligence; Social media; Computer security; World Wide Web; Psychology; Cognitive psychology","score_opus":0.06386335509746444,"score_gpt":0.3477465304981755,"score_spread":0.28388317540071106,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2910216835","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.83955234,0.0009576249,0.14308678,0.0004298722,0.00023009029,0.00021414072,0.0032891918,0.0011957475,0.011044181],"genre_scores_gemma":[0.9797973,0.00017617519,0.017771078,0.000027400725,0.000050405724,0.000034406123,0.0007754578,0.000013536405,0.0013542415],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9991172,0.00028870624,0.00007398019,0.0001787135,0.00026354424,0.00007784308],"domain_scores_gemma":[0.99756455,0.00074142125,0.0006620504,0.00043257527,0.00046352643,0.00013584882],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.00093193655,0.00041748665,0.00036274895,0.0020016646,0.00033383846,0.0006009246,0.00035161723,0.00040772898,0.0015437513],"category_scores_gemma":[0.0050582723,0.00010400267,0.00023482485,0.0013239785,0.0001472445,0.001092279,0.00050540455,0.00039697895,0.0013378494],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0015406793,0.00049087254,0.26676524,0.00042682127,0.0001707154,0.00053864165,0.00048204482,0.011652554,0.034586098,0.0035325168,0.005377668,0.67443615],"study_design_scores_gemma":[0.00002955401,0.00052026374,0.25837806,0.000089539084,0.00016624347,0.0020789325,0.00083041476,0.691216,0.028821435,0.0051420005,0.012647432,0.00008017602],"about_ca_topic_score_codex":0.0013847023,"about_ca_topic_score_gemma":0.002723033,"teacher_disagreement_score":0.0020016646,"about_ca_system_score_codex":0.00027337586,"about_ca_system_score_gemma":0.00028041034,"threshold_uncertainty_score":0.005164385},"labels":[],"label_agreement":null},{"id":"W2913063409","doi":"10.16995/dscn.309","title":"“Fearful Dreams” in Thomas Kyd’s Restored Canon","year":2019,"lang":"fr","type":"article","venue":"Digital Studies / Le champ numérique","topic":"Authorship Attribution and Profiling","field":"Computer Science","cited_by":6,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":true,"route_about_ca":false,"ca_institutions":"","funders":"","keywords":"Humanities; Art; Order (exchange); Tragedy (event); Literature; Philosophy","score_opus":0.055665051861615626,"score_gpt":0.29655891864322237,"score_spread":0.24089386678160674,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2913063409","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.69233596,0.00489146,0.0026607725,0.009838481,0.0008768675,0.00005607562,0.00016003962,0.000065378044,0.289115],"genre_scores_gemma":[0.9666755,0.0008438559,0.00043372516,0.00040746824,0.000053279393,0.000018416607,0.00003210321,0.00004586834,0.031489752],"study_design_codex":"qualitative","study_design_gemma":"not_applicable","domain_scores_codex":[0.9992536,0.0003379436,0.000019185534,0.000092426846,0.00015854792,0.0001383431],"domain_scores_gemma":[0.99920017,0.00045909028,0.00008005539,0.000075574484,0.000080479316,0.00010460147],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0009983939,0.00044617156,0.00028568378,0.0013349823,0.0092830565,0.00618123,0.00084242196,0.0013953062,0.00444304],"category_scores_gemma":[0.0025167873,0.00017374134,0.00018544293,0.0010520818,0.015303186,0.002496469,0.004442998,0.0024309568,0.0004531604],"study_design_candidate":"not_applicable","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.000055559212,0.000011065081,0.0007745965,0.0000924616,0.0000042419642,0.0009649534,0.89543235,0.000078564444,0.00052094314,0.09321159,0.0029654,0.005888303],"study_design_scores_gemma":[0.0000057906122,0.000025302099,0.0024721306,0.00022211099,0.000006452204,0.00078748376,0.7150143,0.00010295222,0.0007781456,0.006732591,0.27382514,0.000027619564],"about_ca_topic_score_codex":0.031184005,"about_ca_topic_score_gemma":0.09358281,"teacher_disagreement_score":0.031184005,"about_ca_system_score_codex":0.008618697,"about_ca_system_score_gemma":0.0025778373,"threshold_uncertainty_score":0.06253332},"labels":[],"label_agreement":null},{"id":"W2914961791","doi":"10.1145/3292577","title":"Code Authorship Attribution","year":2019,"lang":"en","type":"review","venue":"ACM Computing Surveys","topic":"Authorship Attribution and Profiling","field":"Computer Science","cited_by":86,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of New Brunswick","funders":"New Brunswick Innovation Foundation","keywords":"Computer science; Malware; Attribution; Authorship attribution; Code (set theory); Field (mathematics); Cryptovirology; Categorization; Data science; Artificial intelligence; Computer security; Programming language; Set (abstract data type); Psychology","score_opus":0.26310978084345377,"score_gpt":0.4126861586154646,"score_spread":0.14957637777201083,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2914961791","genre_codex":"review","genre_gemma":"review","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"review","genre_consensus":"review","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.013919767,0.51763934,0.08781175,0.025887296,0.023143284,0.0011178615,0.0058727884,0.0024087122,0.32219926],"genre_scores_gemma":[0.26168197,0.51466376,0.043362863,0.009669034,0.013744585,0.0015136085,0.010761938,0.0011173172,0.14348495],"study_design_codex":"design_other","study_design_gemma":"not_applicable","domain_scores_codex":[0.9827711,0.0057094116,0.0019008038,0.001969503,0.006777773,0.00087128195],"domain_scores_gemma":[0.9019348,0.04851487,0.012979328,0.01278805,0.021535087,0.0022478243],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.010395616,0.0009543793,0.0011120929,0.012382169,0.002499507,0.005991335,0.0018283327,0.002811765,0.027380666],"category_scores_gemma":[0.09908952,0.00036595494,0.0006513151,0.01234018,0.0026929253,0.0070911082,0.0038996781,0.0017207044,0.016286893],"study_design_candidate":"not_applicable","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00006181095,0.00003486279,0.003571104,0.004735036,0.000059560072,0.00014910943,0.0007100572,0.00033300175,0.00038714753,0.057498917,0.1070481,0.8254113],"study_design_scores_gemma":[0.00001298113,0.000031891224,0.0031543155,0.006423503,0.00006236751,0.0010591323,0.00072637765,0.0005689332,0.0010859015,0.039307546,0.94752204,0.000044940396],"about_ca_topic_score_codex":0.0008827788,"about_ca_topic_score_gemma":0.0009773043,"teacher_disagreement_score":0.027380666,"about_ca_system_score_codex":0.0020247195,"about_ca_system_score_gemma":0.0053428076,"threshold_uncertainty_score":0.0915975},"labels":[],"label_agreement":null},{"id":"W2952204729","doi":"10.48550/arxiv.1702.06467","title":"Efficient Social Network Multilingual Classification using Character, POS n-grams and Dynamic Normalization","year":2017,"lang":"en","type":"preprint","venue":"arXiv (Cornell University)","topic":"Authorship Attribution and Profiling","field":"Computer Science","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Polytechnique Montréal","funders":"","keywords":"Normalization (sociology); Hyperlink; Computer science; Natural language processing; Artificial intelligence; Support vector machine; Social media; Information retrieval; World Wide Web; Web page","score_opus":0.14320879760101318,"score_gpt":0.25750212467585626,"score_spread":0.11429332707484308,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2952204729","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.16270505,0.0015436171,0.7925394,0.00093283947,0.00064461963,0.00046430167,0.0047060093,0.023478761,0.012985271],"genre_scores_gemma":[0.5669011,0.0006232882,0.40277752,0.00021137562,0.00046065674,0.0004968287,0.012789324,0.00094006065,0.014799913],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9986266,0.00031250337,0.000110917375,0.0004041075,0.00039475033,0.00015113692],"domain_scores_gemma":[0.9978442,0.00059648947,0.0003209786,0.0004995871,0.0006306069,0.00010821149],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0009563818,0.0012144875,0.0009582987,0.005018644,0.00097241276,0.001560447,0.0007002502,0.0006712551,0.0033617315],"category_scores_gemma":[0.004447668,0.00025162543,0.000667083,0.004080587,0.000410152,0.0022527496,0.0012008883,0.0009682462,0.0066166716],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00039875403,0.00027705726,0.009774628,0.00016980906,0.00011032365,0.0002691225,0.00028264328,0.0100761065,0.03392546,0.004030416,0.016294707,0.92439103],"study_design_scores_gemma":[0.000032236178,0.00015037198,0.022831814,0.00007236579,0.00009838086,0.00077224115,0.0007761073,0.85131,0.0572177,0.032535475,0.034089725,0.000113603426],"about_ca_topic_score_codex":0.0028165812,"about_ca_topic_score_gemma":0.0045880256,"teacher_disagreement_score":0.005018644,"about_ca_system_score_codex":0.0007738903,"about_ca_system_score_gemma":0.0008291127,"threshold_uncertainty_score":0.011246085},"labels":[],"label_agreement":null},{"id":"W2962830461","doi":"10.7202/1061915ar","title":"Exploring Verbal Relations between Arden of Faversham and John Lyly’s Endymion","year":2018,"lang":"en","type":"article","venue":"Renaissance and Reformation","topic":"Authorship Attribution and Profiling","field":"Computer Science","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":true,"route_about_ca":false,"ca_institutions":"","funders":"","keywords":"Comedy; Tragedy (event); Context (archaeology); Literature; Reading (process); Parallels; Order (exchange); Comics; History; Art; Philosophy; Linguistics; Engineering; Archaeology","score_opus":0.09769241602911997,"score_gpt":0.2795318203252295,"score_spread":0.1818394042961095,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2962830461","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.95037526,0.00085658405,0.0013459205,0.0009920874,0.000109475164,0.000023462424,0.00008962908,0.000020258325,0.046187397],"genre_scores_gemma":[0.9959084,0.0002318247,0.00046374937,0.000072342904,0.000028625316,0.000012586595,0.000043129672,0.000019458317,0.0032199137],"study_design_codex":"qualitative","study_design_gemma":"observational","domain_scores_codex":[0.9971854,0.001510257,0.00014079917,0.00039036912,0.0004943902,0.00027877997],"domain_scores_gemma":[0.9814858,0.014064081,0.0024700502,0.0007062186,0.0009034978,0.00037035017],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0025454103,0.0002599308,0.00028754905,0.003538915,0.0064434237,0.00535174,0.00053163123,0.00094949885,0.0033068263],"category_scores_gemma":[0.02002738,0.00025341864,0.00008551645,0.0039154743,0.008406683,0.00435885,0.0038671214,0.0016851401,0.00037708407],"study_design_candidate":"observational","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00004177744,0.000009548429,0.0110209705,0.00006594828,0.000005347379,0.00051933696,0.95922184,0.000024514504,0.0009497101,0.01780567,0.00072781666,0.009607396],"study_design_scores_gemma":[0.0000043256573,0.000030469779,0.029933607,0.00023319441,0.00001154215,0.0008329196,0.90783983,0.0001625733,0.001225302,0.00324776,0.05644696,0.000031513027],"about_ca_topic_score_codex":0.022864062,"about_ca_topic_score_gemma":0.05504846,"teacher_disagreement_score":0.022864062,"about_ca_system_score_codex":0.0042463006,"about_ca_system_score_gemma":0.0013581178,"threshold_uncertainty_score":0.045461953},"labels":[],"label_agreement":null},{"id":"W2963515066","doi":"10.1145/3209978.3210008","title":"SynTF","year":2018,"lang":"en","type":"article","venue":"","topic":"Authorship Attribution and Profiling","field":"Computer Science","cited_by":33,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Waterloo","funders":"European Commission","keywords":"Computer science; Information retrieval; Authorship attribution; Vector space model; Suspect; Task (project management); Term (time); Obfuscation; Identity (music); Stylometry; Contrast (vision); Data mining; Artificial intelligence; Computer security","score_opus":0.02695464514839649,"score_gpt":0.2845048336781714,"score_spread":0.25755018852977496,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2963515066","genre_codex":"other","genre_gemma":"other","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"other","genre_consensus":"other","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.012102548,0.002310691,0.30674663,0.003063491,0.002634084,0.000720971,0.1072656,0.24389651,0.3212596],"genre_scores_gemma":[0.095073946,0.00198522,0.19569394,0.003194506,0.00086055545,0.0012208084,0.3398724,0.04277418,0.3193245],"study_design_codex":"not_applicable","study_design_gemma":"not_applicable","domain_scores_codex":[0.99790275,0.00028646158,0.00017507355,0.0005276644,0.0007875783,0.00032041417],"domain_scores_gemma":[0.9979261,0.00038632157,0.0001193573,0.00081970706,0.0006042066,0.00014426913],"candidate_categories":["insufficient_payload"],"consensus_categories":[],"category_scores_codex":[0.0014685679,0.001751888,0.001253496,0.0026383835,0.0019954161,0.0039015994,0.0030575215,0.002557835,0.23655859],"category_scores_gemma":[0.0049998215,0.0009918597,0.0013880506,0.0024439134,0.000842322,0.004441543,0.0038991522,0.0021855545,0.22683084],"study_design_candidate":"not_applicable","study_design_consensus":"not_applicable","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0005822465,0.0001566644,0.0021996587,0.0008813133,0.00006980707,0.00052816025,0.00037710005,0.0021649264,0.0109696975,0.06438972,0.6255641,0.2921166],"study_design_scores_gemma":[0.00007769296,0.0000743986,0.0007697984,0.00011226776,0.00002908023,0.0006256024,0.00014219979,0.007166673,0.008815902,0.025598586,0.9565353,0.000052436695],"about_ca_topic_score_codex":0.003218113,"about_ca_topic_score_gemma":0.0034287584,"teacher_disagreement_score":0.76344144,"about_ca_system_score_codex":0.0014719841,"about_ca_system_score_gemma":0.002154326,"threshold_uncertainty_score":0},"labels":[],"label_agreement":null},{"id":"W2970253329","doi":"10.5539/ijel.v9n5p182","title":"Towards a Linguistic Stylometric Model for the Authorship Detection in Cybercrime Investigations","year":2019,"lang":"en","type":"article","venue":"International Journal of English Linguistics","topic":"Authorship Attribution and Profiling","field":"Computer Science","cited_by":6,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":true,"route_about_ca":false,"ca_institutions":"","funders":"","keywords":"Computer science; Natural language processing; Class (philosophy); Artificial intelligence; Word (group theory); Part of speech; Stylometry; Relation (database); Information retrieval; Linguistics; Data mining","score_opus":0.04973140992142759,"score_gpt":0.31932865230178364,"score_spread":0.26959724238035604,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2970253329","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.13987555,0.00037281838,0.8505725,0.0009088983,0.000079283265,0.00037201107,0.0006965689,0.0008570133,0.006265262],"genre_scores_gemma":[0.8085942,0.00038845695,0.18702736,0.000082586106,0.00015580219,0.00046924976,0.0007338579,0.00010120563,0.0024473134],"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9980223,0.000916793,0.0001388283,0.0003931505,0.00041841596,0.00011042758],"domain_scores_gemma":[0.99386793,0.0036760068,0.00081934297,0.00055711146,0.00092324015,0.00015642535],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0039520874,0.0008324887,0.0008346308,0.009387343,0.00084708136,0.00360374,0.0014553984,0.0014265446,0.002136997],"category_scores_gemma":[0.015512063,0.0006464703,0.0010761454,0.004197561,0.0015401717,0.0037408383,0.0016370283,0.0011002509,0.0010253912],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.000267752,0.0007026985,0.102178715,0.00042565292,0.0003668899,0.00050864025,0.0034905982,0.45360136,0.0067753703,0.12586775,0.00489299,0.30092147],"study_design_scores_gemma":[0.0000062527547,0.000021807406,0.006703051,0.000032405922,0.000014133868,0.00006533827,0.00018888846,0.96834844,0.00032560222,0.023030056,0.0012407175,0.000023211118],"about_ca_topic_score_codex":0.0063797394,"about_ca_topic_score_gemma":0.00464942,"teacher_disagreement_score":0.009387343,"about_ca_system_score_codex":0.0020199653,"about_ca_system_score_gemma":0.0013285675,"threshold_uncertainty_score":0.020900905},"labels":[],"label_agreement":null},{"id":"W2970435802","doi":"10.1109/mlsp.2019.8918842","title":"Towards Ethical Content-Based Detection Of Online Influence Campaigns","year":2019,"lang":"en","type":"article","venue":"","topic":"Authorship Attribution and Profiling","field":"Computer Science","cited_by":2,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Ottawa","funders":"","keywords":"Suspect; False positive paradox; Raising (metalworking); Identification (biology); Sentence; Key (lock)","score_opus":0.051939021398767056,"score_gpt":0.302325584586768,"score_spread":0.25038656318800095,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2970435802","genre_codex":"empirical","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.72111964,0.0006571941,0.2540524,0.0026509108,0.00022192713,0.0005742288,0.0019477813,0.0030400378,0.015735952],"genre_scores_gemma":[0.9296914,0.00009556345,0.06619408,0.00017022547,0.00010846121,0.00016962587,0.001464195,0.00008271526,0.0020237495],"study_design_codex":"observational","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.99539423,0.0024025938,0.00025199362,0.0006202046,0.0010267607,0.00030414527],"domain_scores_gemma":[0.9712965,0.01561063,0.0044403505,0.002918834,0.0049462514,0.00078749395],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0061765243,0.0006014669,0.000476851,0.0040292023,0.00079508417,0.0024707292,0.000742678,0.0012239546,0.0012369751],"category_scores_gemma":[0.033096354,0.00026137618,0.00032018073,0.001110266,0.0006426212,0.0021642393,0.0015913593,0.0010301641,0.0012413427],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00083192985,0.0006553656,0.44813544,0.0005982984,0.00020493791,0.0014316916,0.00743563,0.013647181,0.062301364,0.0219276,0.02155492,0.42127562],"study_design_scores_gemma":[0.000040948034,0.00029948927,0.13410701,0.00027779257,0.0001440541,0.0014486831,0.0048123263,0.73787504,0.059990328,0.03201335,0.028886233,0.00010470926],"about_ca_topic_score_codex":0.001751943,"about_ca_topic_score_gemma":0.0021663257,"teacher_disagreement_score":0.0061765243,"about_ca_system_score_codex":0.0006693747,"about_ca_system_score_gemma":0.0013249726,"threshold_uncertainty_score":0.032665014},"labels":[],"label_agreement":null},{"id":"W2973188659","doi":"10.48550/arxiv.1909.04181","title":"BERT-Based Arabic Social Media Author Profiling","year":2019,"lang":"en","type":"preprint","venue":"arXiv (Cornell University)","topic":"Authorship Attribution and Profiling","field":"Computer Science","cited_by":9,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of British Columbia","funders":"","keywords":"Profiling (computer programming); Arabic; Social media; Computer science; Political science; World Wide Web; Linguistics; Philosophy; Programming language","score_opus":0.1485086942761924,"score_gpt":0.2271549994698412,"score_spread":0.07864630519364879,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2973188659","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.625922,0.0021757476,0.2955538,0.0019374574,0.0009330586,0.00053698424,0.019112406,0.036559667,0.01726883],"genre_scores_gemma":[0.9035153,0.00030414842,0.064917505,0.00022870433,0.00012629108,0.0001716907,0.018352369,0.0003532779,0.012030686],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.99889356,0.00036535336,0.000058154794,0.00027717708,0.0002509037,0.00015495793],"domain_scores_gemma":[0.9966176,0.0012107545,0.00023039264,0.0008480673,0.0008578619,0.00023526857],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0020284313,0.0016321167,0.00062422664,0.0017618134,0.00051455107,0.0011191043,0.001074076,0.0008958371,0.0029098475],"category_scores_gemma":[0.0068061617,0.0003803192,0.0007212933,0.00090443256,0.00036265838,0.0022871625,0.0014806695,0.0019408257,0.005570094],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0014142882,0.0010539828,0.081197895,0.00040476915,0.00030453593,0.000528339,0.0010477698,0.12761956,0.024489839,0.0044063665,0.05774993,0.6997828],"study_design_scores_gemma":[0.000018889856,0.00016328292,0.011809118,0.00004233095,0.000037463105,0.00031931038,0.00022619253,0.95555717,0.018840948,0.0042566922,0.008671627,0.000056974466],"about_ca_topic_score_codex":0.0073988633,"about_ca_topic_score_gemma":0.013854023,"teacher_disagreement_score":0.0073988633,"about_ca_system_score_codex":0.00082788744,"about_ca_system_score_gemma":0.00083613815,"threshold_uncertainty_score":0.014711618},"labels":[],"label_agreement":null},{"id":"W2991402558","doi":"10.26615/978-954-452-056-4_062","title":"Classification of Micro-Texts Using Sub-Word Embeddings","year":2019,"lang":"en","type":"article","venue":"","topic":"Authorship Attribution and Profiling","field":"Computer Science","cited_by":6,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Dalhousie University","funders":"National Institute for Materials Science; Natural Sciences and Engineering Research Council of Canada; Dalhousie University","keywords":"Computer science; Word (group theory); Natural language processing; Artificial intelligence; Character (mathematics); Vocabulary; Word embedding; Feature (linguistics); Perceptron; Feature extraction; Layer (electronics); n-gram; Speech recognition; Embedding; Language model; Artificial neural network; Linguistics","score_opus":0.045426620894161426,"score_gpt":0.302340903005371,"score_spread":0.25691428211120954,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2991402558","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.51290625,0.001338683,0.4596788,0.00083158416,0.00085009786,0.0004966075,0.005922783,0.010060373,0.007914773],"genre_scores_gemma":[0.7952715,0.00054964545,0.18535195,0.00009496862,0.00025575174,0.00021888044,0.007297313,0.00023089604,0.010728989],"study_design_codex":"design_other","study_design_gemma":"bench_or_experimental","domain_scores_codex":[0.9994209,0.000092792005,0.000099451754,0.00018520538,0.00013260113,0.00006908558],"domain_scores_gemma":[0.99801576,0.0006845834,0.00035587122,0.0002697074,0.0005345521,0.00013953353],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.00050857395,0.00090875156,0.00047747415,0.0031269852,0.00026914765,0.0011338844,0.00040025453,0.0006348535,0.0029465647],"category_scores_gemma":[0.0028826937,0.00016413223,0.0004716961,0.0019556587,0.00020105937,0.002485878,0.0007849258,0.00061991165,0.004231678],"study_design_candidate":"bench_or_experimental","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0005727557,0.00041308254,0.02468671,0.0002874846,0.00010347875,0.00032350948,0.00043966374,0.0049065133,0.06356489,0.0015254779,0.008546142,0.8946302],"study_design_scores_gemma":[0.000045929664,0.0005447571,0.045293856,0.00011191878,0.00010561833,0.0007889014,0.001299365,0.844838,0.07294063,0.0128709115,0.021073023,0.00008700903],"about_ca_topic_score_codex":0.00046678446,"about_ca_topic_score_gemma":0.00092960236,"teacher_disagreement_score":0.0031269852,"about_ca_system_score_codex":0.0002324839,"about_ca_system_score_gemma":0.000258561,"threshold_uncertainty_score":0.009857237},"labels":[],"label_agreement":null},{"id":"W2998498250","doi":"10.16995/dm.86","title":"A Computational Approach to Source Adaptation in Thomas Malory’s Morte Darthur","year":2019,"lang":"en","type":"article","venue":"Digital Medievalist","topic":"Authorship Attribution and Profiling","field":"Computer Science","cited_by":1,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":true,"route_about_ca":false,"ca_institutions":"","funders":"","keywords":"Adaptation (eye); Computer science; Mathematical economics; Mathematics; Psychology; Neuroscience","score_opus":0.029351190705460918,"score_gpt":0.25554604071105097,"score_spread":0.22619485000559006,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2998498250","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.3875825,0.00084632164,0.5659101,0.004119946,0.00009418696,0.00029964003,0.001417756,0.000974744,0.03875474],"genre_scores_gemma":[0.88594705,0.00021004016,0.109544106,0.00008554613,0.00004567763,0.0001989863,0.00096631004,0.00014351566,0.0028588136],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.99362445,0.0038170896,0.00029203962,0.0010366548,0.00091478263,0.0003149241],"domain_scores_gemma":[0.9601333,0.03299753,0.0020841786,0.0033365802,0.0011185954,0.0003298639],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0076441085,0.0004252254,0.00072041055,0.008090197,0.0035530934,0.007903488,0.0022513845,0.0015289917,0.0065422924],"category_scores_gemma":[0.0633544,0.000577655,0.0010700572,0.012736958,0.0046361475,0.0067611253,0.0067869644,0.0017204005,0.0008323419],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00029294463,0.00021462621,0.073617615,0.0003347882,0.00012020911,0.0006675728,0.027769461,0.061014313,0.001378285,0.6236308,0.006105226,0.20485409],"study_design_scores_gemma":[0.0000323817,0.000028232967,0.022409592,0.00016136916,0.000046184778,0.00039652252,0.012212094,0.44213146,0.0015684072,0.49487275,0.02607194,0.000068944726],"about_ca_topic_score_codex":0.009121922,"about_ca_topic_score_gemma":0.013673977,"teacher_disagreement_score":0.009121922,"about_ca_system_score_codex":0.0041727345,"about_ca_system_score_gemma":0.0021895908,"threshold_uncertainty_score":0.040426373},"labels":[],"label_agreement":null},{"id":"W3007882868","doi":"10.3138/ecf.32.2.341","title":"<i>Reflections</i>","year":2019,"lang":"en","type":"article","venue":"Eighteenth-Century Fiction","topic":"Authorship Attribution and Profiling","field":"Computer Science","cited_by":3,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":true,"route_about_ca":false,"ca_institutions":"","funders":"","keywords":"Stylometry; Authorship attribution; Perspective (graphical); Attribution; Writing style; Style (visual arts); Sample (material); Corpus linguistics; Literature; Computer science; Linguistics; Psychology; Artificial intelligence; Art; Social psychology; Philosophy","score_opus":0.019098665802545347,"score_gpt":0.2822660144777429,"score_spread":0.2631673486751976,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W3007882868","genre_codex":"commentary","genre_gemma":"other","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"other","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0045900466,0.006177667,0.0048241904,0.8566567,0.033381972,0.000043731077,0.00048576144,0.0001185391,0.09372133],"genre_scores_gemma":[0.22606674,0.025741434,0.011896297,0.4604184,0.087418035,0.0005137829,0.0008987878,0.0007386644,0.18630795],"study_design_codex":"not_applicable","study_design_gemma":"not_applicable","domain_scores_codex":[0.9936546,0.003201743,0.00027384493,0.0007618485,0.0016763923,0.0004316559],"domain_scores_gemma":[0.9718873,0.01736354,0.0014013478,0.0019740039,0.0059055914,0.001468275],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.007492997,0.0005042746,0.00030089106,0.0016893455,0.0035659028,0.010460775,0.0016816678,0.003610434,0.016254434],"category_scores_gemma":[0.043215442,0.0002235391,0.0004922661,0.0017619436,0.009353999,0.010086572,0.0031011705,0.008933276,0.00821836],"study_design_candidate":"not_applicable","study_design_consensus":"not_applicable","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00006120275,0.000045262037,0.0017709722,0.00017077284,0.000015955584,0.00016969113,0.010571393,0.00018687025,0.00035001567,0.19843143,0.75963354,0.0285929],"study_design_scores_gemma":[0.000004210895,0.000014229145,0.0010718349,0.00040157622,0.000004129473,0.00018153236,0.009261935,0.00016362635,0.00049320346,0.038904447,0.94947284,0.00002637259],"about_ca_topic_score_codex":0.008290665,"about_ca_topic_score_gemma":0.0094362935,"teacher_disagreement_score":0.016254434,"about_ca_system_score_codex":0.004741888,"about_ca_system_score_gemma":0.0028600337,"threshold_uncertainty_score":0.054376483},"labels":[],"label_agreement":null},{"id":"W3009864101","doi":"10.1007/978-981-15-3380-8_27","title":"Genre-ous: The Movie Genre Detector","year":2020,"lang":"en","type":"book-chapter","venue":"Communications in computer and information science","topic":"Authorship Attribution and Profiling","field":"Computer Science","cited_by":3,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Concordia University","funders":"","keywords":"Film genre; Computer science; Natural language processing; Artificial intelligence; Natural (archaeology); Linguistics; Literature; Art; History; Philosophy; Movie theater","score_opus":0.06717658756664655,"score_gpt":0.2998178060410262,"score_spread":0.23264121847437966,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W3009864101","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.030626928,0.0047121434,0.5155755,0.001660367,0.0031570161,0.0006560147,0.094230875,0.31285933,0.03652179],"genre_scores_gemma":[0.14824094,0.0020037938,0.6489957,0.001073295,0.0015454637,0.00078726467,0.117754616,0.017772663,0.06182627],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9986745,0.0002548585,0.00010787128,0.0003004488,0.0005341281,0.00012815604],"domain_scores_gemma":[0.99777514,0.00075882795,0.00012094904,0.00068787206,0.00040888644,0.00024823402],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0018110237,0.0015860187,0.001485566,0.006017372,0.0008291372,0.002820846,0.0019074777,0.0014248006,0.021619024],"category_scores_gemma":[0.0077278228,0.0007981445,0.0009267631,0.0047577824,0.00030855864,0.0036123919,0.0025318481,0.0013622936,0.023165986],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0005951894,0.00022149067,0.0046664476,0.00028135648,0.00010174918,0.00012523495,0.000108412925,0.0016256713,0.0064714924,0.0074570724,0.4498755,0.52847034],"study_design_scores_gemma":[0.00031632217,0.00026860202,0.010151674,0.00019813274,0.00013766674,0.0011590204,0.00020142492,0.4390472,0.048546683,0.055061705,0.4446958,0.0002158381],"about_ca_topic_score_codex":0.0026596133,"about_ca_topic_score_gemma":0.0047176774,"teacher_disagreement_score":0.021619024,"about_ca_system_score_codex":0.0005839001,"about_ca_system_score_gemma":0.00091839966,"threshold_uncertainty_score":0.072322845},"labels":[],"label_agreement":null},{"id":"W3010414089","doi":"10.23919/cnsm46954.2019.9012722","title":"Compromised Tweet Detection Using Siamese Networks and fastText Representations","year":2019,"lang":"en","type":"article","venue":"","topic":"Authorship Attribution and Profiling","field":"Computer Science","cited_by":5,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Dalhousie University","funders":"","keywords":"Computer science; Representation (politics); Artificial intelligence; Ground truth; Information retrieval; Natural language processing; Machine learning","score_opus":0.02801955040137458,"score_gpt":0.2832377876872343,"score_spread":0.2552182372858597,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W3010414089","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.24677148,0.0005010777,0.7454867,0.0009602684,0.00014110522,0.0001970882,0.0010836528,0.0010822107,0.0037764774],"genre_scores_gemma":[0.9180499,0.0003192787,0.07535564,0.0000991653,0.0001444773,0.000109610955,0.00149966,0.000045697787,0.004376643],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.99922967,0.00024151543,0.00005915024,0.00019979758,0.00018034085,0.00008946773],"domain_scores_gemma":[0.9966468,0.0014607883,0.0006516643,0.000495344,0.00061834557,0.00012699084],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0012421677,0.00082800543,0.00053489424,0.002888375,0.00046118122,0.0014129209,0.0007468143,0.00097358186,0.0016865467],"category_scores_gemma":[0.0067286217,0.00021148652,0.0005056927,0.0015991757,0.00072083564,0.0023581258,0.0008534429,0.0011876057,0.0010030101],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0006110205,0.0006008515,0.03653941,0.00017515247,0.00025260856,0.0006842204,0.00042018938,0.37967947,0.022157455,0.018638974,0.0068121986,0.5334285],"study_design_scores_gemma":[0.0000045496813,0.000043844142,0.0019688082,0.00000634364,0.000009213618,0.000099150246,0.000030215735,0.9889586,0.0022023988,0.0059773047,0.00068841834,0.000011068833],"about_ca_topic_score_codex":0.0028954698,"about_ca_topic_score_gemma":0.0038178333,"teacher_disagreement_score":0.0028954698,"about_ca_system_score_codex":0.00063468143,"about_ca_system_score_gemma":0.00053775695,"threshold_uncertainty_score":0.0065692663},"labels":[],"label_agreement":null},{"id":"W3016943666","doi":"10.1109/infoteh48170.2020.9066277","title":"Language Distance using Common N-Grams Approach","year":2020,"lang":"en","type":"article","venue":"","topic":"Authorship Attribution and Profiling","field":"Computer Science","cited_by":3,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Dalhousie University","funders":"","keywords":"Computer science; Authorship attribution; Similarity (geometry); Natural language processing; Measure (data warehouse); Phenomenon; Artificial intelligence; Stability (learning theory); Data mining; Machine learning","score_opus":0.07502179611688059,"score_gpt":0.3015637118232853,"score_spread":0.2265419157064047,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W3016943666","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.1895954,0.00236234,0.7838391,0.00046444446,0.00040130122,0.00037247015,0.00387004,0.0041018697,0.014993015],"genre_scores_gemma":[0.72624767,0.00062105944,0.25959927,0.000104738836,0.00016204672,0.0002841994,0.004662524,0.000447725,0.007870734],"study_design_codex":"design_other","study_design_gemma":"bench_or_experimental","domain_scores_codex":[0.99682283,0.000651822,0.0003084541,0.0009542504,0.0010063304,0.00025620073],"domain_scores_gemma":[0.99654573,0.0011966759,0.00041034163,0.00071747106,0.0009549832,0.00017484784],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0011119262,0.00094792247,0.0010144395,0.010589437,0.0016257548,0.0021949355,0.0013503343,0.0013988621,0.004312257],"category_scores_gemma":[0.008567459,0.00028668047,0.0008856753,0.0070272605,0.000677119,0.0038520577,0.0024849665,0.0013399286,0.0029242449],"study_design_candidate":"bench_or_experimental","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0006373965,0.00047250232,0.030762034,0.00060511415,0.00050903315,0.00081625115,0.0021138715,0.033777673,0.017781267,0.066416316,0.015379938,0.8307287],"study_design_scores_gemma":[0.000055317018,0.0002714056,0.022935528,0.00017934444,0.00021370965,0.0014930177,0.0018388134,0.72918415,0.019064682,0.17937435,0.045198176,0.00019150051],"about_ca_topic_score_codex":0.005612133,"about_ca_topic_score_gemma":0.007656438,"teacher_disagreement_score":0.010589437,"about_ca_system_score_codex":0.0009974759,"about_ca_system_score_gemma":0.0011085242,"threshold_uncertainty_score":0.014425874},"labels":[],"label_agreement":null},{"id":"W3028491896","doi":"10.17032/shu-170007","title":"Reading Digital Fiction Project Hyperlink Study data","year":2017,"lang":"en","type":"article","venue":"Sheffield Hallam University Research Data Archive (SHURDA)","topic":"Authorship Attribution and Profiling","field":"Computer Science","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Alberta","funders":"","keywords":"Hyperlink; Reading (process); Session (web analytics); World Wide Web; Computer science; Linguistics; Web page","score_opus":0.38365561887407124,"score_gpt":0.43700797695949356,"score_spread":0.053352358085422324,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W3028491896","genre_codex":"empirical","genre_gemma":"dataset","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"dataset","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.554612,0.0012079015,0.0037555667,0.0030221238,0.0003261849,0.013915075,0.2767404,0.0004370868,0.1459836],"genre_scores_gemma":[0.510833,0.0018830778,0.011517574,0.0020098693,0.00027824938,0.074390374,0.21376146,0.0006948752,0.18463151],"study_design_codex":"not_applicable","study_design_gemma":"not_applicable","domain_scores_codex":[0.9947456,0.0013513636,0.00076734996,0.0005409173,0.0020313407,0.0005634477],"domain_scores_gemma":[0.9603912,0.013259073,0.003951226,0.005155061,0.014261584,0.0029818846],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.005008207,0.00035242533,0.0007021704,0.006000899,0.0023919074,0.0030144465,0.0010856113,0.0010299173,0.057332337],"category_scores_gemma":[0.037616126,0.0005100831,0.00015474773,0.007443859,0.0013310652,0.0018823596,0.0036912025,0.0012702788,0.025946606],"study_design_candidate":"not_applicable","study_design_consensus":"not_applicable","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00061596814,0.0011160674,0.10226481,0.0041618217,0.000029640692,0.0019573858,0.3212977,0.00024896621,0.003939924,0.0092409095,0.3443106,0.2108161],"study_design_scores_gemma":[0.00007580148,0.00022108255,0.18948884,0.00090966024,0.000019113266,0.0003625012,0.08825681,0.00013104643,0.0018604078,0.0014401168,0.7171569,0.000077722965],"about_ca_topic_score_codex":0.01566359,"about_ca_topic_score_gemma":0.031546123,"teacher_disagreement_score":0.057332337,"about_ca_system_score_codex":0.0028055578,"about_ca_system_score_gemma":0.004860788,"threshold_uncertainty_score":0.19179577},"labels":[],"label_agreement":null},{"id":"W3036475880","doi":"10.1353/vcr.2019.0060","title":"Dracula or Draculitz?: Translational Forgery and Bram Stoker’s “Lost Version” of Dracula","year":2019,"lang":"en","type":"article","venue":"Victorian review","topic":"Authorship Attribution and Profiling","field":"Computer Science","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":true,"route_about_ca":false,"ca_institutions":"","funders":"","keywords":"Dracula; Vampire; Icelandic; Subject (documents); Literature; Art; History; Philosophy; Computer science; Linguistics","score_opus":0.019983691844299104,"score_gpt":0.28638359130483676,"score_spread":0.26639989946053766,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W3036475880","genre_codex":"other","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.11823968,0.034246713,0.0030344352,0.18738528,0.0057443217,0.000038789854,0.00007004188,0.00011564,0.651125],"genre_scores_gemma":[0.89552265,0.0041869287,0.00050426496,0.01268118,0.0014208953,0.00003310928,0.00003028547,0.00018425976,0.08543644],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"not_applicable","domain_scores_codex":[0.9958994,0.0022009942,0.00010720488,0.00051342754,0.00070323213,0.00057580945],"domain_scores_gemma":[0.99718755,0.0012296669,0.00038223458,0.00054267375,0.00040870992,0.00024917693],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0035637736,0.00058721355,0.00055077195,0.0013242175,0.018863892,0.016187739,0.0014257202,0.005143655,0.0047116005],"category_scores_gemma":[0.0095342845,0.00033880095,0.00031779165,0.0009732507,0.046684556,0.009153071,0.0069256523,0.00864851,0.0015808805],"study_design_candidate":"not_applicable","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00003966373,0.000021380496,0.0003187473,0.00005926811,0.000007959944,0.00061538786,0.19214523,0.00007657739,0.0001412109,0.74563104,0.051729064,0.00921445],"study_design_scores_gemma":[0.000023402139,0.000034750406,0.0012785692,0.00061998976,0.000016663795,0.0011611701,0.124038585,0.00020177341,0.0006267511,0.095231354,0.7767147,0.000052225278],"about_ca_topic_score_codex":0.008560989,"about_ca_topic_score_gemma":0.012038394,"teacher_disagreement_score":0.018863892,"about_ca_system_score_codex":0.008149223,"about_ca_system_score_gemma":0.0035896997,"threshold_uncertainty_score":0.059127033},"labels":[],"label_agreement":null},{"id":"W3040858410","doi":"10.22148/001c.13680","title":"Like Two Pis in a Pod: Author Similarity Across Time in the Ancient Greek Corpus","year":2020,"lang":"en","type":"article","venue":"Journal of Cultural Analytics","topic":"Authorship Attribution and Profiling","field":"Computer Science","cited_by":7,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":true,"route_about_ca":false,"ca_institutions":"","funders":"Alfred P. Sloan Foundation; National Science Foundation","keywords":"Similarity (geometry); Divergence (linguistics); Focus (optics); Imitation; Range (aeronautics); Natural language processing; Reading (process); Feature (linguistics); Linguistics; Computer science; Artificial intelligence; History; Psychology","score_opus":0.08545780393490782,"score_gpt":0.3457816242500205,"score_spread":0.2603238203151127,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W3040858410","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.9879459,0.00080409163,0.0020798838,0.00021701015,0.00006762374,0.00002784063,0.003603871,0.00008194748,0.005171844],"genre_scores_gemma":[0.98117644,0.00039682386,0.0057244115,0.000051150786,0.000049042832,0.00007327032,0.010050297,0.000076945864,0.0024016376],"study_design_codex":"observational","study_design_gemma":"observational","domain_scores_codex":[0.99900454,0.0003492129,0.00016255015,0.00021749416,0.00021645415,0.000049722723],"domain_scores_gemma":[0.98964745,0.0070692203,0.0010537799,0.0010831226,0.00087562867,0.00027089877],"candidate_categories":["bibliometrics"],"consensus_categories":[],"category_scores_codex":[0.0012125064,0.0001863318,0.00025637698,0.0046346737,0.0010385113,0.0013746644,0.0002837037,0.00046178213,0.0017766384],"category_scores_gemma":[0.013897053,0.00010740937,0.0001611713,0.006446868,0.0010338564,0.0014218674,0.0012894112,0.00047120333,0.0006740511],"study_design_candidate":"observational","study_design_consensus":"observational","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.001358796,0.00044505007,0.43133578,0.0021740817,0.00028274537,0.004049053,0.104862824,0.005400187,0.020230623,0.020293314,0.03867621,0.37089136],"study_design_scores_gemma":[0.00010505489,0.00014368491,0.7394413,0.00048291293,0.00012519115,0.0050061657,0.03519248,0.020318335,0.008373646,0.012437415,0.17825389,0.00011996317],"about_ca_topic_score_codex":0.0018398524,"about_ca_topic_score_gemma":0.004118424,"teacher_disagreement_score":0.9953653,"about_ca_system_score_codex":0.0004381333,"about_ca_system_score_gemma":0.00034181442,"threshold_uncertainty_score":0.0064124465},"labels":[],"label_agreement":null},{"id":"W3046517752","doi":"10.31235/osf.io/nhbq7","title":"Features of Timelessness: Intermediate Report on a Quest for Stylistic Features that Mark Literary Canonicity.","year":2023,"lang":"en","type":"preprint","venue":"","topic":"Authorship Attribution and Profiling","field":"Computer Science","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Toronto; York University","funders":"","keywords":"Variation (astronomy); Literature; Vectorization (mathematics); Sentence; Linguistics; History; Computer science; Art; Philosophy","score_opus":0.05514652870199569,"score_gpt":0.327507193753362,"score_spread":0.2723606650513663,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W3046517752","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.92367166,0.0051039746,0.029918598,0.0019010697,0.0003741585,0.000186365,0.0063284324,0.00036114053,0.03215451],"genre_scores_gemma":[0.98413956,0.0008279499,0.009482197,0.00011467928,0.00036545531,0.00008318086,0.0026070832,0.00007347549,0.0023064073],"study_design_codex":"design_other","study_design_gemma":"observational","domain_scores_codex":[0.9980118,0.00047473138,0.00028040825,0.00037135836,0.0007424653,0.00011918373],"domain_scores_gemma":[0.9573335,0.023001662,0.0099354,0.0037877248,0.0047834907,0.0011582314],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0027991615,0.00034778152,0.0003289958,0.012666673,0.0012544302,0.003861969,0.0006254838,0.0005664007,0.004215128],"category_scores_gemma":[0.023370493,0.00016260751,0.00043135096,0.011889635,0.0019570878,0.0032968912,0.0015529203,0.00078575464,0.0010291056],"study_design_candidate":"observational","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0009844949,0.00022432722,0.41913754,0.0023085922,0.00033378083,0.0013720513,0.024621999,0.0012703767,0.038008448,0.049963426,0.011971018,0.44980395],"study_design_scores_gemma":[0.000037631395,0.0005322272,0.7744796,0.0006468677,0.00026429677,0.003456094,0.015080312,0.007768748,0.024728747,0.03819762,0.13459928,0.00020857727],"about_ca_topic_score_codex":0.0010379317,"about_ca_topic_score_gemma":0.0017118328,"teacher_disagreement_score":0.012666673,"about_ca_system_score_codex":0.0009854838,"about_ca_system_score_gemma":0.0008088478,"threshold_uncertainty_score":0.014803588},"labels":[],"label_agreement":null},{"id":"W3047361733","doi":"10.1002/nem.2130","title":"De‐anonymizing Ethereum blockchain smart contracts through code attribution","year":2020,"lang":"en","type":"article","venue":"International Journal of Network Management","topic":"Authorship Attribution and Profiling","field":"Computer Science","cited_by":26,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Saskatchewan; University of New Brunswick","funders":"","keywords":"Computer science; Blockchain; Anonymity; Database transaction; Stylometry; Computer security; Code (set theory); Field (mathematics); Source code; Smart contract; World Wide Web; Artificial intelligence; Database; Programming language","score_opus":0.048566640354403126,"score_gpt":0.3014062167132896,"score_spread":0.2528395763588865,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W3047361733","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.23592965,0.0003617125,0.75070375,0.000985327,0.000167131,0.0003086812,0.0009790214,0.0031822491,0.0073824828],"genre_scores_gemma":[0.81805223,0.00022128329,0.17459668,0.00014952899,0.0000646388,0.00019625171,0.0014460334,0.00020507892,0.0050681606],"study_design_codex":"design_other","study_design_gemma":"bench_or_experimental","domain_scores_codex":[0.99411315,0.0017097965,0.0004226608,0.0007839576,0.0025390345,0.00043137124],"domain_scores_gemma":[0.98297775,0.004779156,0.0028334279,0.007000026,0.0021046933,0.00030502948],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0032431292,0.0005160735,0.00077232067,0.0027390746,0.0010846438,0.0022577227,0.0009116873,0.0010550729,0.0016123734],"category_scores_gemma":[0.02270402,0.00032330022,0.00055782107,0.0027725038,0.0014628732,0.0031323154,0.003629806,0.0012009329,0.0010694987],"study_design_candidate":"bench_or_experimental","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00076086744,0.00021894691,0.024208374,0.00034033172,0.00012574958,0.001191579,0.0021758093,0.19856551,0.0347504,0.108976364,0.009647176,0.6190389],"study_design_scores_gemma":[0.00003172062,0.00005517664,0.0031175457,0.00008631148,0.000024258823,0.00043528035,0.00056145556,0.8675929,0.030155273,0.08530542,0.012581587,0.000053079104],"about_ca_topic_score_codex":0.0012620258,"about_ca_topic_score_gemma":0.0015514045,"teacher_disagreement_score":0.0032431292,"about_ca_system_score_codex":0.0009978665,"about_ca_system_score_gemma":0.0014696011,"threshold_uncertainty_score":0.017151535},"labels":[],"label_agreement":null},{"id":"W3048850354","doi":"10.48550/arxiv.2008.05713","title":"Exploration of Gender Differences in COVID-19 Discourse on Reddit","year":2020,"lang":"en","type":"preprint","venue":"arXiv (Cornell University)","topic":"Authorship Attribution and Profiling","field":"Computer Science","cited_by":7,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Toronto","funders":"","keywords":"Coronavirus disease 2019 (COVID-19); Social media; Pandemic; Psychology; Expression (computer science); 2019-20 coronavirus outbreak; Sociology; Social psychology; Linguistics; Political science; Computer science; Biology; Medicine","score_opus":0.35954391512715217,"score_gpt":0.27849265207341495,"score_spread":0.08105126305373722,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W3048850354","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.9713795,0.00046230765,0.0034877716,0.000799639,0.0001425143,0.0000758795,0.0051340684,0.00010060591,0.018417673],"genre_scores_gemma":[0.98622453,0.00023650395,0.003399234,0.00017070227,0.0001484008,0.00011482594,0.003641947,0.0001291062,0.0059347413],"study_design_codex":"qualitative","study_design_gemma":"qualitative","domain_scores_codex":[0.9970606,0.0015676279,0.00015947178,0.00045111397,0.0005399946,0.00022116702],"domain_scores_gemma":[0.96936405,0.023628704,0.0031673303,0.0012970563,0.001736635,0.00080630434],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0041816956,0.0003394621,0.00023835596,0.002667633,0.0016739276,0.0019402446,0.0003223824,0.0005243651,0.0039696144],"category_scores_gemma":[0.016402679,0.0001388392,0.000110643676,0.0020434891,0.0010774918,0.0017924707,0.002318028,0.0006092713,0.0012133874],"study_design_candidate":"qualitative","study_design_consensus":"qualitative","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0010016942,0.0002308774,0.28759477,0.0013905755,0.000060348655,0.0018317292,0.5005046,0.00052393926,0.051070396,0.01896893,0.023078924,0.113743216],"study_design_scores_gemma":[0.00004298484,0.0002850818,0.4325197,0.00068058,0.000048471138,0.001681015,0.2304228,0.0051983,0.021222549,0.0088559445,0.29888317,0.00015940251],"about_ca_topic_score_codex":0.0013615699,"about_ca_topic_score_gemma":0.0034103943,"teacher_disagreement_score":0.0041816956,"about_ca_system_score_codex":0.00083198433,"about_ca_system_score_gemma":0.00053216383,"threshold_uncertainty_score":0.022115171},"labels":[],"label_agreement":null},{"id":"W3081783897","doi":"10.2478/popets-2020-0068","title":"Effective writing style transfer via combinatorial paraphrasing","year":2020,"lang":"en","type":"article","venue":"Proceedings on Privacy Enhancing Technologies","topic":"Authorship Attribution and Profiling","field":"Computer Science","cited_by":9,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Waterloo","funders":"","keywords":"Computer science; Style (visual arts); Baseline (sea); Transfer (computing); Encoder; Adversarial system; Artificial intelligence; Natural language processing; Imitation; Randomness; Mathematics","score_opus":0.020559111958515147,"score_gpt":0.25585015580223913,"score_spread":0.23529104384372398,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W3081783897","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.20181854,0.0014745456,0.7226598,0.00069405604,0.00062545127,0.00077166886,0.0019675922,0.046355493,0.023632793],"genre_scores_gemma":[0.58673537,0.0004246601,0.3908227,0.00053114165,0.00022354595,0.0002592575,0.003170329,0.002063673,0.015769418],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.99719244,0.00095102174,0.00023456792,0.0005929763,0.0008889323,0.00014006102],"domain_scores_gemma":[0.99260396,0.0024859023,0.00040014676,0.003166694,0.0011675365,0.0001756948],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0018822317,0.0013713686,0.0010042948,0.0016292344,0.0005051144,0.0021931026,0.0022780232,0.0012313307,0.007196516],"category_scores_gemma":[0.012942945,0.00042083347,0.0007395081,0.0012537971,0.0007570851,0.0025381793,0.0022079991,0.0016430207,0.0056834896],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0003076722,0.000376025,0.001971107,0.00056445325,0.00011632707,0.0005862277,0.00060603063,0.014194095,0.07950458,0.004430197,0.013527925,0.88381535],"study_design_scores_gemma":[0.0002558702,0.0010412239,0.0049176244,0.00012544391,0.00021413625,0.0023247297,0.000660962,0.61607295,0.31369507,0.019726578,0.04078359,0.00018183894],"about_ca_topic_score_codex":0.0006861816,"about_ca_topic_score_gemma":0.0012342334,"teacher_disagreement_score":0.007196516,"about_ca_system_score_codex":0.0003305376,"about_ca_system_score_gemma":0.00066988944,"threshold_uncertainty_score":0.024074733},"labels":[],"label_agreement":null},{"id":"W3082418808","doi":"10.3390/app10175957","title":"Trend-Based Categories Recommendations and Age-Gender Prediction for Pinterest and Twitter Users","year":2020,"lang":"en","type":"article","venue":"Applied Sciences","topic":"Authorship Attribution and Profiling","field":"Computer Science","cited_by":14,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Ottawa","funders":"Universidad de Guanajuato; Consejo Nacional de Ciencia y Tecnología; University of Ottawa","keywords":"Computer science; Meaning (existential); Information retrieval; Convolutional neural network; Feature (linguistics); World Wide Web; Artificial intelligence; Psychology","score_opus":0.1518274713559655,"score_gpt":0.31829066825339075,"score_spread":0.16646319689742525,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W3082418808","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.9598178,0.0009058562,0.018607806,0.00045860655,0.00015573317,0.00013672053,0.014208296,0.0009918049,0.004717338],"genre_scores_gemma":[0.96476305,0.0003395826,0.016913282,0.000049735958,0.00007920226,0.000075563796,0.014120617,0.00003392144,0.0036250064],"study_design_codex":"observational","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.99970764,0.000036306516,0.000023361219,0.00009110047,0.00007943909,0.00006210178],"domain_scores_gemma":[0.9991934,0.00022999081,0.00012812727,0.000071479975,0.00027409414,0.0001029402],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.00038107298,0.0006399058,0.00034978858,0.0032765856,0.00032187538,0.00047294027,0.0005030137,0.0006549016,0.0020476524],"category_scores_gemma":[0.0023986276,0.00012289095,0.0004327649,0.0013685315,0.00009264172,0.00091226853,0.00034785166,0.00035805497,0.0017820699],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0011681255,0.0005216954,0.6567886,0.00024194179,0.000119402925,0.00063284737,0.00043358913,0.011863857,0.007291048,0.0008368336,0.020201905,0.29990017],"study_design_scores_gemma":[0.000027438064,0.00030159243,0.31799257,0.00007166133,0.000102686936,0.0006409444,0.0010142267,0.6583746,0.008914495,0.0016709098,0.010823811,0.00006495968],"about_ca_topic_score_codex":0.012644728,"about_ca_topic_score_gemma":0.02745325,"teacher_disagreement_score":0.012644728,"about_ca_system_score_codex":0.00038442417,"about_ca_system_score_gemma":0.00031826764,"threshold_uncertainty_score":0.025142252},"labels":[],"label_agreement":null},{"id":"W3095732274","doi":"10.1007/978-3-030-60290-1_17","title":"DeepStyle: User Style Embedding for Authorship Attribution of Short Texts","year":2020,"lang":"en","type":"book-chapter","venue":"Lecture notes in computer science","topic":"Authorship Attribution and Profiling","field":"Computer Science","cited_by":23,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Saskatchewan","funders":"","keywords":"Computer science; Task (project management); Salient; Authorship attribution; Embedding; Word embedding; Style (visual arts); Word (group theory); Artificial intelligence; Natural language processing; Attribution; Writing style; Information retrieval; Linguistics","score_opus":0.04678901294171871,"score_gpt":0.3068086415893817,"score_spread":0.260019628647663,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W3095732274","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.061267238,0.0021054912,0.8813132,0.00048439245,0.0013707081,0.00020395765,0.00964102,0.03676166,0.006852424],"genre_scores_gemma":[0.46782696,0.001669328,0.4632616,0.0003033133,0.0011073772,0.00043738703,0.02462968,0.0045320727,0.0362323],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.998642,0.0003497593,0.0001123103,0.00041544595,0.00037564893,0.00010489708],"domain_scores_gemma":[0.9968374,0.001227458,0.00024600132,0.0010044606,0.0004789256,0.00020583153],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.001388799,0.0015068889,0.00072175055,0.0030746916,0.00054863974,0.0017331006,0.000848335,0.0010546598,0.009637575],"category_scores_gemma":[0.006243602,0.0005157617,0.0007666668,0.0024161853,0.00037790262,0.0038361754,0.0023378024,0.0015357615,0.0076514874],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00046687704,0.00027953868,0.0042178747,0.00031695887,0.00009452069,0.0001425567,0.00049274246,0.007773196,0.0150998635,0.004636804,0.051479276,0.9149998],"study_design_scores_gemma":[0.00007953386,0.0003161242,0.007822172,0.0001680738,0.00010647497,0.00079002837,0.00032592073,0.8435799,0.03785366,0.05185326,0.056969367,0.00013554748],"about_ca_topic_score_codex":0.0007881228,"about_ca_topic_score_gemma":0.002080721,"teacher_disagreement_score":0.009637575,"about_ca_system_score_codex":0.00039945327,"about_ca_system_score_gemma":0.00047715043,"threshold_uncertainty_score":0.032240868},"labels":[],"label_agreement":null},{"id":"W3097253704","doi":"10.20948/abrau-2020-48","title":"On Identification of Authors of Scientific Publications in Digital Collections","year":2020,"lang":"en","type":"article","venue":"Naučnyj servis v seti internet","topic":"Authorship Attribution and Profiling","field":"Computer Science","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"","funders":"Institute for Catastrophic Loss Reduction","keywords":"Identification (biology); Computer science; Information retrieval; Data science","score_opus":0.0476567644775031,"score_gpt":0.28438952743862334,"score_spread":0.23673276296112022,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W3097253704","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.44416797,0.01731449,0.24831685,0.026100008,0.0063555827,0.0019584498,0.03437154,0.0028610723,0.21855398],"genre_scores_gemma":[0.8408555,0.0076976228,0.09697119,0.0011270697,0.0016259488,0.0005838235,0.01336771,0.00038009253,0.037390973],"study_design_codex":"design_other","study_design_gemma":"bench_or_experimental","domain_scores_codex":[0.9813036,0.007262581,0.0020718882,0.0021244378,0.0058574206,0.001380054],"domain_scores_gemma":[0.86431855,0.075771905,0.01806115,0.019121915,0.019524517,0.0032020127],"candidate_categories":["research_integrity"],"consensus_categories":[],"category_scores_codex":[0.015826521,0.00056820805,0.0010647674,0.020148577,0.00486388,0.008325875,0.0015038507,0.0016299194,0.007977531],"category_scores_gemma":[0.14044121,0.00033116684,0.0005908483,0.021632433,0.0021727786,0.008788837,0.005074863,0.0013781644,0.006242531],"study_design_candidate":"bench_or_experimental","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0007040911,0.00029076822,0.20134145,0.0009148403,0.00013410558,0.0005670549,0.006444331,0.00223243,0.0026738448,0.09490524,0.08020437,0.6095875],"study_design_scores_gemma":[0.00012155351,0.00043580038,0.26336324,0.002875279,0.00032407994,0.003500818,0.018274607,0.047295086,0.02897882,0.29359207,0.34081998,0.00041857027],"about_ca_topic_score_codex":0.0031510498,"about_ca_topic_score_gemma":0.005036159,"teacher_disagreement_score":0.99837005,"about_ca_system_score_codex":0.0015469533,"about_ca_system_score_gemma":0.0033866325,"threshold_uncertainty_score":0.08369964},"labels":[],"label_agreement":null},{"id":"W3110983064","doi":"10.1007/978-3-030-61675-5","title":"Machine Learning for Authorship Attribution and Cyber Forensics","year":2020,"lang":"en","type":"book","venue":"International series on computer entertainment and media technology","topic":"Authorship Attribution and Profiling","field":"Computer Science","cited_by":14,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"McGill University; Concordia University","funders":"","keywords":"Authorship attribution; Attribution; Computer forensics; Computer science; Computer security; Data science; Psychology; Internet privacy; Natural language processing; Digital forensics; Social psychology","score_opus":0.02230978867466325,"score_gpt":0.2477327119029573,"score_spread":0.22542292322829405,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W3110983064","genre_codex":"methods","genre_gemma":"other","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"other","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.006588633,0.052657053,0.8746688,0.005581482,0.0031596406,0.000091410795,0.0008411642,0.0030414567,0.053370453],"genre_scores_gemma":[0.2557347,0.042764865,0.4822898,0.0009811157,0.006520176,0.00027498952,0.002777819,0.0010535256,0.20760305],"study_design_codex":"design_other","study_design_gemma":"not_applicable","domain_scores_codex":[0.9985757,0.00038071137,0.00008548277,0.000253856,0.0006494196,0.000054967844],"domain_scores_gemma":[0.99183685,0.0061143697,0.00028732003,0.0008955641,0.0007954396,0.000070392074],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0021169018,0.0007788144,0.000954896,0.0028939836,0.000637728,0.0025224306,0.0012440366,0.0014145236,0.0075101764],"category_scores_gemma":[0.00967066,0.00048826815,0.00055016286,0.0032991641,0.0012634401,0.0049484065,0.0011117312,0.0025117884,0.0056644375],"study_design_candidate":"not_applicable","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.000035469773,0.000060500737,0.00042765995,0.00024177528,0.0000280551,0.000050190127,0.0000637918,0.011802559,0.0009689723,0.07574468,0.07198077,0.83859545],"study_design_scores_gemma":[0.000009925047,0.000048245387,0.0011384328,0.00027158528,0.000026993177,0.0004846668,0.00006925685,0.3839182,0.005163957,0.50055164,0.10826576,0.000051324732],"about_ca_topic_score_codex":0.00058527436,"about_ca_topic_score_gemma":0.0007872712,"teacher_disagreement_score":0.0075101764,"about_ca_system_score_codex":0.0007820235,"about_ca_system_score_gemma":0.0005704628,"threshold_uncertainty_score":0.025124073},"labels":[],"label_agreement":null},{"id":"W3151065226","doi":"10.22148/001c.21993","title":"Imaginative Networks: Tracing Connections Among Early Modern Book Dedications","year":2021,"lang":"en","type":"article","venue":"Journal of Cultural Analytics","topic":"Authorship Attribution and Profiling","field":"Computer Science","cited_by":6,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":true,"route_about_ca":false,"ca_institutions":"","funders":"","keywords":"Politics; Popularity; Centrality; Literature; History; Classics; Law; Art; Political science","score_opus":0.03109520831080825,"score_gpt":0.29509826779773196,"score_spread":0.2640030594869237,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W3151065226","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.889075,0.0020327945,0.065937586,0.0016819262,0.00007315283,0.00006272531,0.0016038304,0.00020669794,0.039326448],"genre_scores_gemma":[0.9817472,0.0004963222,0.014401285,0.00005269622,0.000028676272,0.00004709423,0.00073547446,0.00006168926,0.0024295214],"study_design_codex":"observational","study_design_gemma":"observational","domain_scores_codex":[0.9990563,0.00046054285,0.00003469797,0.00019868338,0.00017688733,0.00007295698],"domain_scores_gemma":[0.990807,0.005666559,0.0016678714,0.0007305156,0.00073582534,0.00039224763],"candidate_categories":["bibliometrics"],"consensus_categories":[],"category_scores_codex":[0.0012158742,0.00025774087,0.0001671458,0.0057099992,0.0011494566,0.0026024822,0.0006293782,0.0005477408,0.002328591],"category_scores_gemma":[0.0140093295,0.00022723417,0.0001763028,0.0053802845,0.0015822434,0.005635465,0.0020162219,0.00072615326,0.00047906977],"study_design_candidate":"observational","study_design_consensus":"observational","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.000279242,0.00012085651,0.30167836,0.0004081519,0.0001399127,0.0009949063,0.15244403,0.008270001,0.005643525,0.28359896,0.011908546,0.23451349],"study_design_scores_gemma":[0.000019668998,0.00009715411,0.30400446,0.0006073256,0.00012074155,0.0018340386,0.101573616,0.08661968,0.0058503156,0.26052594,0.23861712,0.0001298752],"about_ca_topic_score_codex":0.0047003618,"about_ca_topic_score_gemma":0.0084667,"teacher_disagreement_score":0.99429,"about_ca_system_score_codex":0.0013909043,"about_ca_system_score_gemma":0.00040898612,"threshold_uncertainty_score":0.010091782},"labels":[],"label_agreement":null},{"id":"W3156984408","doi":"10.1558/ijsll.41446","title":"Linguistic analysis of suspected child sexual offenders’ interactions in a dark web image exchange chatroom","year":2021,"lang":"en","type":"article","venue":"International Journal of Speech Language and the Law","topic":"Authorship Attribution and Profiling","field":"Computer Science","cited_by":13,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Hyperion Technologies (Canada)","funders":"Universiteit Utrecht","keywords":"Rhetorical question; Psychology; Law enforcement; Online forum; Social psychology; Internet privacy; Linguistics; Computer science; Law; Political science","score_opus":0.016775899723632602,"score_gpt":0.30349028105085535,"score_spread":0.28671438132722277,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W3156984408","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.99741346,0.000030194347,0.0010777016,0.00006327127,0.000003828449,0.000025884714,0.00013985125,0.000030843985,0.0012150981],"genre_scores_gemma":[0.9961125,0.000035569716,0.0020630048,0.000022398839,0.000005756186,0.000044191427,0.00027392816,0.000016613087,0.0014260998],"study_design_codex":"qualitative","study_design_gemma":"qualitative","domain_scores_codex":[0.99894446,0.0005952816,0.000054320873,0.00013134356,0.00018462026,0.000090042144],"domain_scores_gemma":[0.98930126,0.008510458,0.0008390594,0.00032453437,0.0005816375,0.0004429378],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0010025998,0.00022452573,0.00018952883,0.0017643917,0.0013744954,0.0010529592,0.00046172246,0.0005041077,0.0020114167],"category_scores_gemma":[0.008006895,0.00013798581,0.00016345753,0.00092846574,0.00096766383,0.0008160096,0.001057151,0.0006061225,0.00041228355],"study_design_candidate":"qualitative","study_design_consensus":"qualitative","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0015280952,0.00048659355,0.2219312,0.00076733396,0.00007066852,0.0066907895,0.6246851,0.003157354,0.04429232,0.005792625,0.0034073207,0.08719058],"study_design_scores_gemma":[0.000030646148,0.000484865,0.54243827,0.0003028868,0.00007387268,0.0026787005,0.36477298,0.053066935,0.011626588,0.0027789709,0.021538934,0.00020628853],"about_ca_topic_score_codex":0.007422613,"about_ca_topic_score_gemma":0.01868407,"teacher_disagreement_score":0.007422613,"about_ca_system_score_codex":0.0009055664,"about_ca_system_score_gemma":0.00045582355,"threshold_uncertainty_score":0.014758825},"labels":[],"label_agreement":null},{"id":"W3163823537","doi":"10.4018/ijban.2021070101","title":"A New Approach for Deception Detection in Open Domain Text","year":2021,"lang":"en","type":"article","venue":"International Journal of Business Analytics","topic":"Authorship Attribution and Profiling","field":"Computer Science","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Seneca Polytechnic","funders":"","keywords":"Deception; Computer science; Classifier (UML); Open domain; Artificial intelligence; Domain (mathematical analysis); The Internet; Feature (linguistics); Open research; Support vector machine; Machine learning; Natural language processing; World Wide Web; Psychology; Linguistics; Mathematics; Social psychology","score_opus":0.06034089764662857,"score_gpt":0.3360110331891855,"score_spread":0.2756701355425569,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W3163823537","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.11169217,0.0019550207,0.8712896,0.0010913748,0.0007471374,0.0008016172,0.0013028941,0.00392251,0.0071977177],"genre_scores_gemma":[0.57475203,0.00079326925,0.41223955,0.00026113828,0.00054704706,0.00040365872,0.0013613956,0.00013668131,0.009505247],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9955611,0.00088218803,0.00042642275,0.0009443052,0.0019379155,0.00024806877],"domain_scores_gemma":[0.99062437,0.0033758513,0.001329091,0.0013413061,0.0029980822,0.00033126186],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.001972226,0.0009499762,0.0011399937,0.0070057525,0.001117658,0.0025813202,0.001097182,0.0016171725,0.0017994728],"category_scores_gemma":[0.010264813,0.0003203572,0.00072787865,0.0030343784,0.0008561759,0.003451109,0.0012964674,0.002066771,0.0023987987],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00064218574,0.0007186216,0.01661357,0.00042129346,0.00017803813,0.00090872345,0.0012421315,0.005668823,0.07386996,0.008884999,0.0076089455,0.88324267],"study_design_scores_gemma":[0.000054665037,0.00056686794,0.02678099,0.00015375657,0.0001968102,0.0038121808,0.0012843414,0.83918405,0.08289489,0.018200833,0.026668841,0.0002017774],"about_ca_topic_score_codex":0.0011596096,"about_ca_topic_score_gemma":0.0011082429,"teacher_disagreement_score":0.0070057525,"about_ca_system_score_codex":0.00070067646,"about_ca_system_score_gemma":0.00083554833,"threshold_uncertainty_score":0.010430276},"labels":[],"label_agreement":null},{"id":"W3179438688","doi":"10.1109/access.2021.3095967","title":"Authorship Classification in a Resource Constraint Language Using Convolutional Neural Networks","year":2021,"lang":"en","type":"article","venue":"IEEE Access","topic":"Authorship Attribution and Profiling","field":"Computer Science","cited_by":26,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Athabasca University","funders":"Natural Sciences and Engineering Research Council of Canada","keywords":"Computer science; Word2vec; Artificial intelligence; Convolutional neural network; Embedding; Classifier (UML); Hyperparameter; Natural language processing; Pattern recognition (psychology); Document classification; Machine learning","score_opus":0.12276749618731427,"score_gpt":0.36692540856323186,"score_spread":0.2441579123759176,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W3179438688","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.90879977,0.0011759535,0.07497898,0.0006049458,0.0002149163,0.00013763685,0.0023841192,0.0033655232,0.008338202],"genre_scores_gemma":[0.9599831,0.00030503713,0.027388733,0.000101783575,0.00005275142,0.00006174388,0.004755624,0.000068673784,0.0072824187],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9994924,0.000118005955,0.000042410862,0.00015221961,0.00009923764,0.00009568907],"domain_scores_gemma":[0.9992009,0.00031030536,0.00011370591,0.00014454617,0.00018487911,0.00004569965],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.00058753655,0.0007675612,0.0003819389,0.001297009,0.00042533604,0.0010611886,0.0007357853,0.0005681217,0.001441185],"category_scores_gemma":[0.0018987284,0.00017256365,0.00049601373,0.0011137686,0.00037863012,0.002076214,0.00086320104,0.0008172106,0.0009714915],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0010233342,0.0005472793,0.031038634,0.00036698856,0.00016785866,0.00088240224,0.00067402946,0.07825371,0.045179475,0.0036577352,0.01657393,0.82163465],"study_design_scores_gemma":[0.000021915539,0.000120202356,0.011617935,0.000042360665,0.000039879564,0.00017974418,0.00040303118,0.95471084,0.023026485,0.0033611632,0.0064454256,0.000031021234],"about_ca_topic_score_codex":0.0092206765,"about_ca_topic_score_gemma":0.01558007,"teacher_disagreement_score":0.0092206765,"about_ca_system_score_codex":0.0011210814,"about_ca_system_score_gemma":0.0005582445,"threshold_uncertainty_score":0.018334031},"labels":[],"label_agreement":null},{"id":"W3190643984","doi":"10.5334/johd.42","title":"The Corpus for Idiolectal Research (CIDRE)","year":2021,"lang":"en","type":"article","venue":"Journal of Open Humanities Data","topic":"Authorship Attribution and Profiling","field":"Computer Science","cited_by":1,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":true,"ca_institutions":"","funders":"Agence Nationale de la Recherche","keywords":"Paratext; Scripting language; Metadata; License; Computer science; World Wide Web; Open source; Style (visual arts); Literature; Linguistics; Art; Programming language; Software; Philosophy","score_opus":0.6364291660620014,"score_gpt":0.5070253019086151,"score_spread":0.12940386415338634,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W3190643984","genre_codex":"dataset","genre_gemma":"dataset","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"dataset","genre_consensus":"dataset","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.041156333,0.009503007,0.007062937,0.0018288707,0.00067260856,0.0007479881,0.8390331,0.0016611293,0.09833395],"genre_scores_gemma":[0.12667193,0.0031677638,0.027033025,0.0007422514,0.00046259674,0.0024661794,0.8139523,0.0014672036,0.024036724],"study_design_codex":"not_applicable","study_design_gemma":"not_applicable","domain_scores_codex":[0.9968388,0.00089862675,0.000359894,0.00077070243,0.00070509745,0.00042679903],"domain_scores_gemma":[0.9928323,0.0023855255,0.0005535002,0.0014249182,0.0022917888,0.0005118435],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.002936705,0.00075399963,0.0010063526,0.017301084,0.0034197825,0.003865032,0.0011968144,0.0011564774,0.040657107],"category_scores_gemma":[0.010925295,0.00030452386,0.00035600306,0.017049959,0.001493519,0.0016901612,0.0027895374,0.0013051542,0.016703716],"study_design_candidate":"not_applicable","study_design_consensus":"not_applicable","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0002298049,0.00008764519,0.005919826,0.0028404624,0.000041399428,0.0007831931,0.011536741,0.00025217838,0.003825201,0.05141644,0.76156044,0.16150671],"study_design_scores_gemma":[0.000018404164,0.00000754861,0.008882189,0.00037882265,0.0000107100295,0.00029515233,0.001084762,0.00007215051,0.00044205977,0.0012974335,0.9874871,0.000023632088],"about_ca_topic_score_codex":0.07552463,"about_ca_topic_score_gemma":0.07976341,"teacher_disagreement_score":0.07552463,"about_ca_system_score_codex":0.0052000675,"about_ca_system_score_gemma":0.0060729617,"threshold_uncertainty_score":0.15017003},"labels":[],"label_agreement":null},{"id":"W3198774825","doi":"10.1109/ccece53047.2021.9569061","title":"Code Authorship Attribution using content-based and non-content-based features","year":2021,"lang":"en","type":"article","venue":"","topic":"Authorship Attribution and Profiling","field":"Computer Science","cited_by":6,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Lethbridge","funders":"","keywords":"Computer science; Identification (biology); Field (mathematics); Identity (music); Source code; Natural language processing; Artificial intelligence; Natural language; Code (set theory); Writing style; Focus (optics); Computational linguistics; Machine learning; Linguistics; Programming language","score_opus":0.16341738732624006,"score_gpt":0.3116797845410002,"score_spread":0.14826239721476014,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W3198774825","genre_codex":"empirical","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.9038424,0.000787454,0.08149878,0.0006130245,0.00027639378,0.00027674562,0.0037394897,0.0023112304,0.006654566],"genre_scores_gemma":[0.97764766,0.00012292068,0.017891867,0.000020276857,0.00007875316,0.000050588915,0.002489277,0.00004935763,0.0016493499],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.99815184,0.00047521477,0.00021066322,0.0003912456,0.00057877717,0.00019228614],"domain_scores_gemma":[0.9805172,0.01020281,0.0032440843,0.0019098653,0.0033454767,0.00078051793],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0022643565,0.0007775579,0.0005941732,0.010176692,0.0006274616,0.002273905,0.0005819025,0.0008658969,0.001331618],"category_scores_gemma":[0.020422485,0.00015854141,0.00062397856,0.004919907,0.00047452532,0.0024668798,0.0010209783,0.0007725772,0.0011317418],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0010357894,0.0008961143,0.43731505,0.00042498417,0.00025902293,0.0005789289,0.00068781513,0.028108215,0.008956268,0.003043864,0.010293744,0.5084002],"study_design_scores_gemma":[0.000037278962,0.00020024745,0.14650248,0.00010815662,0.0000917041,0.0007761987,0.00047876497,0.8246467,0.01327444,0.007841344,0.0059593953,0.000083227555],"about_ca_topic_score_codex":0.0015825033,"about_ca_topic_score_gemma":0.0020773357,"teacher_disagreement_score":0.010176692,"about_ca_system_score_codex":0.00082723843,"about_ca_system_score_gemma":0.00070844195,"threshold_uncertainty_score":0.011975169},"labels":[],"label_agreement":null},{"id":"W3203775901","doi":"","title":"Word Order in Chinese - A Text Analysis","year":2004,"lang":"en","type":"article","venue":"Papers from the Annual Meetings of the Atlantic Provinces Linguistic Association (PAMAPLA)","topic":"Authorship Attribution and Profiling","field":"Computer Science","cited_by":0,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Fredericton","funders":"","keywords":"Word (group theory); Word order; Linguistics; Order (exchange); Natural language processing; Computer science; Artificial intelligence; Business; Philosophy","score_opus":0.0058503204521989,"score_gpt":0.2323972426889054,"score_spread":0.2265469222367065,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W3203775901","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.9571004,0.0010876373,0.017821975,0.000750954,0.0001591155,0.0002798152,0.011385538,0.0004535672,0.010960992],"genre_scores_gemma":[0.96626294,0.00041808307,0.01777076,0.00005449808,0.00009759648,0.00015002897,0.008998171,0.00013286113,0.006115037],"study_design_codex":"design_other","study_design_gemma":"not_applicable","domain_scores_codex":[0.9994281,0.00014285443,0.00008934761,0.0001310611,0.00013599335,0.00007270681],"domain_scores_gemma":[0.9975319,0.0014246706,0.00017540451,0.00014239356,0.0006082685,0.00011731711],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.00050698326,0.00033521047,0.00027669818,0.0037913315,0.0010303289,0.0008880939,0.00028849943,0.00017904094,0.004281714],"category_scores_gemma":[0.0027029393,0.00013469935,0.00031295547,0.005067148,0.0005244091,0.0012561453,0.00050839,0.0003547959,0.0010491577],"study_design_candidate":"not_applicable","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0014619762,0.00031399852,0.2156288,0.0013887129,0.00013507414,0.0018148542,0.016954385,0.0033680429,0.05513045,0.020103842,0.033699267,0.65000063],"study_design_scores_gemma":[0.00015663875,0.00056261267,0.65539134,0.00021121227,0.00054056576,0.001870562,0.020860514,0.12675981,0.071929134,0.024724374,0.09680708,0.00018617407],"about_ca_topic_score_codex":0.012280607,"about_ca_topic_score_gemma":0.012960555,"teacher_disagreement_score":0.012280607,"about_ca_system_score_codex":0.0009791044,"about_ca_system_score_gemma":0.0017095528,"threshold_uncertainty_score":0.024418235},"labels":[],"label_agreement":null},{"id":"W3208120588","doi":"10.5281/zenodo.4026498","title":"A Novel Genre-Specific Feature Reduction Technique through Association Analysis","year":2020,"lang":"en","type":"article","venue":"DOAJ (DOAJ: Directory of Open Access Journals)","topic":"Authorship Attribution and Profiling","field":"Computer Science","cited_by":1,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Lethbridge","funders":"","keywords":"Reduction (mathematics); Feature (linguistics); Computer science; Association (psychology); Artificial intelligence; Psychology; Mathematics; Linguistics; Philosophy","score_opus":0.3281271387038738,"score_gpt":0.5305936074975177,"score_spread":0.20246646879364394,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W3208120588","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.016183147,0.00054877374,0.9789611,0.00019394595,0.000115637034,0.00011655733,0.0003376051,0.002058049,0.0014852048],"genre_scores_gemma":[0.11814549,0.00047271297,0.8750428,0.00017947656,0.00027323616,0.00025231633,0.0016935326,0.00023589362,0.0037046284],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9978509,0.00036744113,0.00014785904,0.00043130282,0.0010332611,0.00016932622],"domain_scores_gemma":[0.99771166,0.0006469923,0.00030839397,0.000559465,0.0006631993,0.00011023193],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0012353085,0.0010454471,0.0018410832,0.00485112,0.0010711991,0.001635346,0.0018609539,0.00086709484,0.0029920365],"category_scores_gemma":[0.0054566627,0.0004062767,0.0014579966,0.0060796337,0.00048595748,0.0018395494,0.0016654332,0.0019904966,0.0028831542],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00016520014,0.00036169417,0.004434696,0.00012711447,0.00012936642,0.00014987975,0.00020465278,0.008207437,0.024319664,0.0042801774,0.007937794,0.94968224],"study_design_scores_gemma":[0.000100777834,0.0005693435,0.013608656,0.000084011815,0.00034767907,0.0019768458,0.0004638363,0.87184036,0.037803408,0.02701512,0.046019282,0.00017068304],"about_ca_topic_score_codex":0.0017419619,"about_ca_topic_score_gemma":0.002192223,"teacher_disagreement_score":0.00485112,"about_ca_system_score_codex":0.00035369562,"about_ca_system_score_gemma":0.0009858819,"threshold_uncertainty_score":0.010009348},"labels":[],"label_agreement":null},{"id":"W3210937173","doi":"10.22148/001c.29802","title":"Audiobook Stylistics: Comparing print and audio in the bestselling segment","year":2021,"lang":"en","type":"article","venue":"Journal of Cultural Analytics","topic":"Authorship Attribution and Profiling","field":"Computer Science","cited_by":11,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":true,"route_about_ca":false,"ca_institutions":"","funders":"","keywords":"Stylistics; Depiction; Focus (optics); Point (geometry); Style (visual arts); Set (abstract data type); Plot (graphics); Computer science; Advertising; Art; Literature; Mathematics","score_opus":0.06872344227832917,"score_gpt":0.3059254956830484,"score_spread":0.23720205340471923,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W3210937173","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.98427564,0.00020419591,0.0009784608,0.00009139228,0.000018318698,0.000015820586,0.00029552702,0.0000224816,0.014098121],"genre_scores_gemma":[0.996739,0.000116277566,0.00059220486,0.000020351035,0.000018077262,0.0000120630875,0.00029895024,0.000035369805,0.0021677702],"study_design_codex":"observational","study_design_gemma":"observational","domain_scores_codex":[0.9989889,0.00035335074,0.00008847798,0.00014370572,0.00033791162,0.00008771538],"domain_scores_gemma":[0.99198806,0.0048310393,0.0015794344,0.0005945522,0.0006441296,0.00036277398],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.001162747,0.00021196376,0.00021010735,0.0030869597,0.0010366624,0.0035810054,0.00023749143,0.00026212735,0.005965314],"category_scores_gemma":[0.010329196,0.000119427634,0.00017571222,0.0027027542,0.001545712,0.0019011715,0.0013999162,0.0004306037,0.0011725874],"study_design_candidate":"observational","study_design_consensus":"observational","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0020866755,0.00021695385,0.47353926,0.00073574326,0.00013707028,0.0022868481,0.30421114,0.0011669934,0.027398637,0.021004649,0.0058536106,0.16136234],"study_design_scores_gemma":[0.000030871735,0.00032441807,0.6852593,0.00022118622,0.00009561953,0.0032047816,0.23134382,0.0034140854,0.010347302,0.0070678075,0.058553904,0.00013684371],"about_ca_topic_score_codex":0.0014678304,"about_ca_topic_score_gemma":0.0026625986,"teacher_disagreement_score":0.005965314,"about_ca_system_score_codex":0.0005756612,"about_ca_system_score_gemma":0.0002794133,"threshold_uncertainty_score":0.019955993},"labels":[],"label_agreement":null},{"id":"W4205216148","doi":"10.1109/access.2022.3144145","title":"Template Aging in Multi-Modal Social Behavioral Biometrics","year":2022,"lang":"en","type":"article","venue":"IEEE Access","topic":"Authorship Attribution and Profiling","field":"Computer Science","cited_by":8,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Calgary","funders":"Natural Sciences and Engineering Research Council of Canada; Canadian Network for Research and Innovation in Machining Technology, Natural Sciences and Engineering Research Council of Canada","keywords":"Computer science; Biometrics; Authentication (law); Modal; Feature (linguistics); Behavioral pattern; Identification (biology); Human–computer interaction; Data mining; Artificial intelligence; Machine learning; Computer security","score_opus":0.23695567520687388,"score_gpt":0.43306547538396944,"score_spread":0.19610980017709556,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4205216148","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.36024216,0.0014249884,0.6338349,0.00024219175,0.00019649231,0.00006470835,0.0001690542,0.0013284265,0.0024971345],"genre_scores_gemma":[0.9491712,0.000273707,0.049021374,0.00006495874,0.00003393507,0.000018845372,0.00008388748,0.000026618649,0.0013054295],"study_design_codex":"design_other","study_design_gemma":"bench_or_experimental","domain_scores_codex":[0.998725,0.00033073584,0.00006725127,0.00027572073,0.00049834576,0.00010292001],"domain_scores_gemma":[0.9986576,0.0003765193,0.00030920786,0.00033102653,0.00027375153,0.000051972223],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0013312821,0.0003396654,0.00053146965,0.00074063166,0.00025838602,0.00058904703,0.00046701208,0.0006440234,0.000704736],"category_scores_gemma":[0.003813034,0.0001749871,0.00034160755,0.0007022296,0.0003139874,0.0010882035,0.00071682443,0.00043659713,0.00053015514],"study_design_candidate":"bench_or_experimental","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0005153465,0.00019507048,0.018644346,0.00018489221,0.000094949166,0.0003797496,0.00035533836,0.052459266,0.18797222,0.0040771132,0.0013349426,0.7337867],"study_design_scores_gemma":[0.000009617,0.0005669917,0.031428654,0.00003441265,0.000071674185,0.001688353,0.00015033968,0.84435135,0.11361679,0.0036310782,0.0043814955,0.00006924392],"about_ca_topic_score_codex":0.0005451444,"about_ca_topic_score_gemma":0.0005188835,"teacher_disagreement_score":0.0013312821,"about_ca_system_score_codex":0.00027868434,"about_ca_system_score_gemma":0.0001716041,"threshold_uncertainty_score":0.00704062},"labels":[],"label_agreement":null},{"id":"W4205536472","doi":"10.54103/interfaces-08-01","title":"Astronomy and Literature | Canon and Stylometrics","year":2021,"lang":"en","type":"article","venue":"Interfaces A Journal of Medieval European Literatures","topic":"Authorship Attribution and Profiling","field":"Computer Science","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"","funders":"University of Toronto; Universiteit Leiden; Yale University; University of Cambridge; University of Oxford; Harvard University; University of Pennsylvania; Princeton University","keywords":"Canon; Literature; History; Art; Philosophy","score_opus":0.012453744120395495,"score_gpt":0.24732698619980562,"score_spread":0.23487324207941013,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4205536472","genre_codex":"other","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.018566977,0.12737653,0.005770049,0.06497756,0.015857,0.00015754237,0.015006844,0.0011093818,0.7511782],"genre_scores_gemma":[0.52535737,0.1472731,0.012205839,0.010769545,0.038657438,0.00049488957,0.020521428,0.0029103465,0.24181011],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"not_applicable","domain_scores_codex":[0.9897775,0.0031480643,0.001117525,0.0009096981,0.004529098,0.00051820086],"domain_scores_gemma":[0.95791686,0.025110718,0.0038293814,0.005853997,0.005442218,0.0018469214],"candidate_categories":["bibliometrics"],"consensus_categories":[],"category_scores_codex":[0.005644472,0.00080853805,0.0012694811,0.05103577,0.00429164,0.031778283,0.0010848277,0.0016632449,0.060393896],"category_scores_gemma":[0.053609733,0.00036237843,0.00045961427,0.09829136,0.007464878,0.015328923,0.007034745,0.002062876,0.010959878],"study_design_candidate":"not_applicable","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00006361293,0.000026866632,0.006249632,0.0013654253,0.00004747512,0.00007211426,0.008081941,0.0002304575,0.00017542944,0.40925574,0.35459796,0.21983334],"study_design_scores_gemma":[0.000004459512,0.000008070291,0.006877093,0.0008566511,0.00001141364,0.00007999447,0.003689627,0.0001497795,0.00007058309,0.04837082,0.93986267,0.000018904431],"about_ca_topic_score_codex":0.006640534,"about_ca_topic_score_gemma":0.010399344,"teacher_disagreement_score":0.94896424,"about_ca_system_score_codex":0.0049397126,"about_ca_system_score_gemma":0.004390848,"threshold_uncertainty_score":0.20203769},"labels":[],"label_agreement":null},{"id":"W4207019055","doi":"10.33137/rr.v44i3.37993","title":"De Doctrina Christiana and Milton’s Canonical Works: Revisiting the Authorship Question","year":2022,"lang":"en","type":"article","venue":"Renaissance and Reformation","topic":"Authorship Attribution and Profiling","field":"Computer Science","cited_by":4,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":true,"route_about_ca":false,"ca_institutions":"","funders":"","keywords":"Stylometry; Scholarship; Literature; Dissent; Philosophy; Art; Linguistics; Law; Political science","score_opus":0.02055069439425451,"score_gpt":0.27273891143805074,"score_spread":0.25218821704379624,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4207019055","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.65874976,0.008887232,0.048798714,0.03237299,0.0013292199,0.00017881142,0.0005049732,0.000101333084,0.24907702],"genre_scores_gemma":[0.9919783,0.00088597543,0.0037107181,0.0003763324,0.00033119522,0.00006567602,0.00008936359,0.000031687687,0.0025307143],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"not_applicable","domain_scores_codex":[0.9829427,0.008628712,0.0010465719,0.0019554542,0.004471806,0.000954742],"domain_scores_gemma":[0.89997077,0.07081052,0.011401699,0.0074484563,0.008511115,0.0018574476],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.016747577,0.000442314,0.0008611078,0.010906817,0.005984986,0.012370575,0.000999346,0.0018753445,0.0039722715],"category_scores_gemma":[0.12689883,0.00024384564,0.00025220378,0.02067473,0.016972218,0.012980109,0.0045788256,0.002341258,0.00072265114],"study_design_candidate":"not_applicable","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00013023391,0.0000333193,0.020188818,0.0001388598,0.000015251544,0.00011059262,0.024282139,0.00042274612,0.0002243208,0.9062881,0.0041578882,0.04400768],"study_design_scores_gemma":[0.00004081491,0.00007369468,0.025901765,0.0007729905,0.00003234772,0.00028521867,0.03832693,0.0047725476,0.0014398121,0.83915305,0.08914026,0.000060541777],"about_ca_topic_score_codex":0.0014170234,"about_ca_topic_score_gemma":0.0015667567,"teacher_disagreement_score":0.016747577,"about_ca_system_score_codex":0.003663778,"about_ca_system_score_gemma":0.002771622,"threshold_uncertainty_score":0.088570714},"labels":[],"label_agreement":null},{"id":"W4213077949","doi":"10.1037/cep0000273","title":"Bridging people and perspectives: General and language-specific social network structure predict mentalizing across diverse sociolinguistic contexts.","year":2022,"lang":"en","type":"article","venue":"Canadian Journal of Experimental Psychology/Revue canadienne de psychologie expérimentale","topic":"Authorship Attribution and Profiling","field":"Computer Science","cited_by":22,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"","funders":"Natural Sciences and Engineering Research Council of Canada; Canada Research Chairs","keywords":"Betweenness centrality; Mentalization; Psychology; Cognitive psychology; PsycINFO; Social cognition; Cognition; Bridging (networking); Context (archaeology); Developmental psychology; Computer science; Neuroscience; Biology; MEDLINE","score_opus":0.03936839491776121,"score_gpt":0.320760304366242,"score_spread":0.28139190944848075,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4213077949","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.9992717,0.000022612749,0.0000718074,0.000051234034,0.0000013947495,0.000003108021,0.000057389134,0.0000014738685,0.0005192965],"genre_scores_gemma":[0.99957865,0.0000333084,0.00010958524,0.000013187711,0.0000017911602,0.000005855422,0.000101160906,0.0000011542298,0.00015523806],"study_design_codex":"observational","study_design_gemma":"observational","domain_scores_codex":[0.9998016,0.00005424474,0.000014390956,0.000054181357,0.0000401468,0.000035448316],"domain_scores_gemma":[0.99740654,0.00081166864,0.0010893218,0.0002084278,0.00009429233,0.0003897388],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.00053277996,0.0002354656,0.00016108404,0.0006582785,0.0005345614,0.0011328302,0.00022155196,0.00042489535,0.003937795],"category_scores_gemma":[0.004670362,0.00015839,0.00019725441,0.0005965821,0.00085904426,0.0010627046,0.0010403987,0.00046846003,0.00025602864],"study_design_candidate":"observational","study_design_consensus":"observational","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00010714616,0.00011720015,0.9843376,0.000021220616,0.00003521414,0.00004498612,0.008295462,0.00008059275,0.000887474,0.00022125024,0.00020808536,0.005643797],"study_design_scores_gemma":[0.0000035977168,0.000038098402,0.9954543,0.000008869078,0.000009928416,0.000026711003,0.0036709947,0.00027640798,0.00012735707,0.0002500992,0.00012898433,0.0000046758378],"about_ca_topic_score_codex":0.013399826,"about_ca_topic_score_gemma":0.030073008,"teacher_disagreement_score":0.013399826,"about_ca_system_score_codex":0.00053717755,"about_ca_system_score_gemma":0.00030021137,"threshold_uncertainty_score":0.026643693},"labels":[],"label_agreement":null},{"id":"W4220816919","doi":"10.1126/sciadv.abm2463","title":"Based on billions of words on the internet, <scp>people</scp> = <scp>men</scp>","year":2022,"lang":"en","type":"article","venue":"Science Advances","topic":"Authorship Attribution and Profiling","field":"Computer Science","cited_by":53,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"","funders":"York University","keywords":"Similarity (geometry); Context (archaeology); Measure (data warehouse); The Internet; Linguistics; Computer science; Psychology; Similarity measure; Social psychology; Natural language processing; Sociology; World Wide Web; Artificial intelligence; History","score_opus":0.025119341235380573,"score_gpt":0.2815690368670433,"score_spread":0.25644969563166276,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4220816919","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.5711943,0.03906748,0.035823885,0.013593569,0.0042068423,0.0007260188,0.20510907,0.0023277744,0.12795103],"genre_scores_gemma":[0.8279544,0.015621089,0.052586526,0.0019914717,0.0015226543,0.00068050635,0.080121465,0.00069479697,0.018827064],"study_design_codex":"design_other","study_design_gemma":"observational","domain_scores_codex":[0.99855477,0.00031955997,0.00032207216,0.0002848404,0.0004631329,0.00005552548],"domain_scores_gemma":[0.9940262,0.0030270866,0.0014036027,0.0004415509,0.0008836435,0.0002179677],"candidate_categories":["metaresearch","bibliometrics"],"consensus_categories":[],"category_scores_codex":[0.0009531016,0.0008055745,0.00048013972,0.009848638,0.0012486005,0.0027822554,0.00037308983,0.00078816974,0.008189142],"category_scores_gemma":[0.008345485,0.00022228809,0.00031082792,0.017466879,0.0015999638,0.0055669807,0.0017033993,0.0008407736,0.0044226614],"study_design_candidate":"observational","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00078366144,0.00014829748,0.094012655,0.0077029113,0.00050745823,0.0027237884,0.028388767,0.0015772107,0.0190203,0.094883084,0.25220823,0.49804366],"study_design_scores_gemma":[0.000041496365,0.00013511302,0.18638353,0.0015959211,0.00019964144,0.0046585905,0.015286524,0.0037087917,0.004502331,0.02772379,0.755583,0.00018122724],"about_ca_topic_score_codex":0.0032118645,"about_ca_topic_score_gemma":0.005509136,"teacher_disagreement_score":0.9990469,"about_ca_system_score_codex":0.00076691917,"about_ca_system_score_gemma":0.00074922753,"threshold_uncertainty_score":0.027395427},"labels":[],"label_agreement":null},{"id":"W4225853051","doi":"10.5281/zenodo.6368376","title":"DP-VAE: Human-Readable Text Anonymization for Online Reviews with Differentially Private Variational Autoencoders","year":2022,"lang":"en","type":"article","venue":"Zenodo (CERN European Organization for Nuclear Research)","topic":"Authorship Attribution and Profiling","field":"Computer Science","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Waterloo","funders":"","keywords":"Computer science; Artificial intelligence; Private information retrieval; Data science; Information retrieval; Computer security","score_opus":0.06481148837151597,"score_gpt":0.2794793357719953,"score_spread":0.21466784740047934,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4225853051","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.008721227,0.0002019565,0.9891111,0.00025573748,0.0000512626,0.00004666952,0.000120130004,0.001007131,0.00048469193],"genre_scores_gemma":[0.4862112,0.000488697,0.4995037,0.00063351536,0.00024120118,0.00034294467,0.0012591194,0.00052763155,0.010791988],"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.997999,0.000976536,0.00008878061,0.0004155375,0.0003924457,0.00012769543],"domain_scores_gemma":[0.9968419,0.0016687248,0.00027173152,0.00074848236,0.00037967035,0.00008950368],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0025392615,0.0008451065,0.000990935,0.00048730266,0.000507342,0.0011870165,0.0013901236,0.0016166831,0.0015137728],"category_scores_gemma":[0.0098995585,0.0005358809,0.00088330545,0.00045484048,0.0013094054,0.0019592207,0.002097062,0.0022443924,0.001135212],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.000686283,0.00018654788,0.0015729961,0.00023052706,0.00023033972,0.00032610912,0.00056697946,0.5875479,0.028993746,0.038117424,0.0074311155,0.33411005],"study_design_scores_gemma":[0.000010616823,0.00003360109,0.00013637544,0.000007702718,0.000007902832,0.000040143386,0.00001667566,0.9833225,0.005252519,0.00980731,0.001354961,0.00000981507],"about_ca_topic_score_codex":0.0029857927,"about_ca_topic_score_gemma":0.003736318,"teacher_disagreement_score":0.0029857927,"about_ca_system_score_codex":0.0008971355,"about_ca_system_score_gemma":0.0011262461,"threshold_uncertainty_score":0.013429046},"labels":[],"label_agreement":null},{"id":"W4241326622","doi":"10.1007/978-3-030-61675-5_7","title":"Authorship Characterization","year":2020,"lang":"en","type":"book-chapter","venue":"International series on computer entertainment and media technology","topic":"Authorship Attribution and Profiling","field":"Computer Science","cited_by":0,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"McGill University; Concordia University","funders":"","keywords":"Authorship attribution; Characterization (materials science); Attribution; Ethnic group; Psychology; Linguistics; Computer science; Social psychology; Sociology; Natural language processing; Anthropology; Physics; Philosophy","score_opus":0.019555233497582827,"score_gpt":0.22791955570438727,"score_spread":0.20836432220680445,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4241326622","genre_codex":"other","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.06838765,0.005100395,0.28044266,0.0029349823,0.0031344013,0.0013002671,0.040771164,0.009846821,0.5880816],"genre_scores_gemma":[0.4208153,0.0033325243,0.20055442,0.0007681179,0.0015341092,0.0009557035,0.047469806,0.0019779797,0.32259205],"study_design_codex":"design_other","study_design_gemma":"not_applicable","domain_scores_codex":[0.99819535,0.00027179674,0.00024328064,0.00049258454,0.0006092201,0.00018778234],"domain_scores_gemma":[0.99452305,0.0013301937,0.00068202696,0.0012935569,0.001870231,0.00030092453],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0013804178,0.0007576235,0.0004900776,0.009998153,0.0015706127,0.0039086477,0.00063325366,0.000549749,0.041142065],"category_scores_gemma":[0.0073170927,0.00024159807,0.0004584855,0.007087668,0.00058571826,0.0034113505,0.0013950785,0.0009106597,0.024425726],"study_design_candidate":"not_applicable","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00012643923,0.000115058705,0.0069772694,0.00033246988,0.00002727572,0.00011781051,0.00067643943,0.00087474013,0.00697009,0.04507937,0.14000104,0.79870206],"study_design_scores_gemma":[0.000018526662,0.00013911612,0.016707363,0.000457836,0.000057807687,0.0015818828,0.0016348663,0.014415438,0.02912292,0.07406613,0.8617011,0.00009711703],"about_ca_topic_score_codex":0.00061198685,"about_ca_topic_score_gemma":0.00092437014,"teacher_disagreement_score":0.041142065,"about_ca_system_score_codex":0.0006437089,"about_ca_system_score_gemma":0.0010699721,"threshold_uncertainty_score":0.13763398},"labels":[],"label_agreement":null},{"id":"W4242898180","doi":"10.1007/978-3-030-61675-5_9","title":"Authorship Attribution Using Customized Associative Classification","year":2020,"lang":"en","type":"book-chapter","venue":"International series on computer entertainment and media technology","topic":"Authorship Attribution and Profiling","field":"Computer Science","cited_by":2,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"McGill University; Concordia University","funders":"","keywords":"Associative property; Authorship attribution; Attribution; Computer science; Artificial intelligence; Natural language processing; Psychology; Mathematics; Social psychology; Pure mathematics","score_opus":0.05527214099807664,"score_gpt":0.27617616764512515,"score_spread":0.2209040266470485,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4242898180","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.12090644,0.001051948,0.8448725,0.00067698647,0.0008257642,0.000504344,0.003350861,0.01229683,0.015514422],"genre_scores_gemma":[0.6532106,0.000430107,0.32485536,0.00020383733,0.0006499946,0.00031184868,0.005873487,0.0005116357,0.013953255],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9970686,0.0006791843,0.00035757135,0.00074049743,0.00083660125,0.00031762556],"domain_scores_gemma":[0.989145,0.003999528,0.00065394345,0.0034536286,0.002289052,0.00045878804],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.003839008,0.001013911,0.0012537194,0.007850212,0.0017400607,0.0034111203,0.0017752125,0.0013924562,0.01044414],"category_scores_gemma":[0.0127993,0.00041070604,0.001233976,0.0076040016,0.0006641001,0.004765083,0.002948856,0.0014158188,0.0052157347],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0004214483,0.0005678716,0.013864372,0.0001468439,0.0001546622,0.00019171115,0.00022083776,0.013796899,0.004588988,0.009301133,0.023587836,0.9331574],"study_design_scores_gemma":[0.00005166028,0.00011433125,0.0062669567,0.000065218075,0.00012970633,0.00048519028,0.00025698025,0.91357875,0.011435764,0.05704114,0.0105104735,0.00006389056],"about_ca_topic_score_codex":0.0016433821,"about_ca_topic_score_gemma":0.002891116,"teacher_disagreement_score":0.01044414,"about_ca_system_score_codex":0.00082446245,"about_ca_system_score_gemma":0.0013699993,"threshold_uncertainty_score":0.03493911},"labels":[],"label_agreement":null},{"id":"W4285152239","doi":"10.18653/v1/2022.findings-acl.225","title":"Extracting Person Names from User Generated Text: Named-Entity Recognition for Combating Human Trafficking","year":2022,"lang":"en","type":"article","venue":"Findings of the Association for Computational Linguistics: ACL 2022","topic":"Authorship Attribution and Profiling","field":"Computer Science","cited_by":8,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"","funders":"Samsung; Institut de Valorisation des Données; Canadian Institute for Advanced Research","keywords":"Computer science; Named-entity recognition; Punctuation; Natural language processing; Domain (mathematical analysis); Task (project management); Artificial intelligence; Grammar; Named entity; Information retrieval; Linguistics","score_opus":0.043147769997126245,"score_gpt":0.2892943644149413,"score_spread":0.24614659441781503,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4285152239","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.37594676,0.004301409,0.5652753,0.0026229264,0.0011438204,0.00051891693,0.013328119,0.025309065,0.011553624],"genre_scores_gemma":[0.608487,0.0017022827,0.3499383,0.0006134751,0.00033432714,0.00018592247,0.028475657,0.00046636513,0.009796586],"study_design_codex":"design_other","study_design_gemma":"bench_or_experimental","domain_scores_codex":[0.99898964,0.00035849298,0.00010600965,0.00028963204,0.0001985506,0.000057741363],"domain_scores_gemma":[0.9975261,0.0012457813,0.0003123847,0.00048039085,0.00036997674,0.000065389155],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0011954852,0.0007048884,0.00043148015,0.0019002715,0.0004867804,0.0007049469,0.00077037205,0.0011460476,0.0016213144],"category_scores_gemma":[0.003513259,0.00015565979,0.00046755216,0.0012269188,0.00051812764,0.0025512741,0.00097050756,0.00072638923,0.0034185234],"study_design_candidate":"bench_or_experimental","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0005261494,0.0003688666,0.01103248,0.0008043283,0.00011061259,0.0016795695,0.0007570369,0.017118024,0.046683125,0.0034318285,0.047974415,0.8695135],"study_design_scores_gemma":[0.000070349015,0.0003652453,0.021536881,0.00016998596,0.00018387806,0.0036339506,0.0016306229,0.6872189,0.17541632,0.011433456,0.09819223,0.00014813153],"about_ca_topic_score_codex":0.0011487112,"about_ca_topic_score_gemma":0.0018781663,"teacher_disagreement_score":0.0019002715,"about_ca_system_score_codex":0.00031013024,"about_ca_system_score_gemma":0.0004459386,"threshold_uncertainty_score":0.0063224435},"labels":[],"label_agreement":null},{"id":"W4285194931","doi":"10.1109/tse.2022.3177228","title":"SCS-Gan: Learning Functionality-Agnostic Stylometric Representations for Source Code Authorship Verification","year":2022,"lang":"en","type":"article","venue":"IEEE Transactions on Software Engineering","topic":"Authorship Attribution and Profiling","field":"Computer Science","cited_by":13,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Queen's University","funders":"Natural Sciences and Engineering Research Council of Canada","keywords":"Computer science; Source code; Code (set theory); Set (abstract data type); Task (project management); Benchmark (surveying); Malware; Artificial intelligence; Adversarial system; Representation (politics); Information retrieval; Machine learning; Natural language processing; Programming language; Computer security","score_opus":0.03621979625623392,"score_gpt":0.2699609822255617,"score_spread":0.23374118596932777,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4285194931","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.08863712,0.0013582802,0.8964856,0.0010159237,0.0002756255,0.00018341767,0.0008063173,0.0051563624,0.0060813],"genre_scores_gemma":[0.8904487,0.0004877955,0.09579516,0.0008220358,0.00017320979,0.00022468195,0.002022126,0.00029727852,0.009728984],"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9993262,0.000244231,0.00002856495,0.00017288061,0.00014901976,0.00007903993],"domain_scores_gemma":[0.9977843,0.0013205621,0.00019236607,0.00030197296,0.00031290957,0.00008790781],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.001365232,0.0010432021,0.00083879346,0.0012037198,0.0002726062,0.0006426117,0.0014338101,0.0011914734,0.0020826873],"category_scores_gemma":[0.005501262,0.0004116346,0.000807097,0.0006675985,0.0009346869,0.0011559047,0.00096324174,0.0016738671,0.000972315],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00035230495,0.0002048664,0.0068629635,0.00019029656,0.00014370614,0.0002699919,0.00020628147,0.63605237,0.008430443,0.0126525955,0.012358544,0.32227564],"study_design_scores_gemma":[0.000005720016,0.000015761329,0.0002603795,0.00000799721,0.0000062811064,0.000029592458,0.000005666822,0.9945485,0.0008261348,0.0038181022,0.00047056752,0.0000053158105],"about_ca_topic_score_codex":0.0026557914,"about_ca_topic_score_gemma":0.0035162352,"teacher_disagreement_score":0.0026557914,"about_ca_system_score_codex":0.0009865382,"about_ca_system_score_gemma":0.0007618335,"threshold_uncertainty_score":0.0072200894},"labels":[],"label_agreement":null},{"id":"W4289025518","doi":"","title":"The internal structure of a differentially marked DP in Romanian","year":2019,"lang":"en","type":"article","venue":"DOAJ (DOAJ: Directory of Open Access Journals)","topic":"Authorship Attribution and Profiling","field":"Computer Science","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of New Brunswick","funders":"","keywords":"Romanian; Linguistics; Philosophy","score_opus":0.1368609089821452,"score_gpt":0.5017522078815438,"score_spread":0.36489129889939864,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4289025518","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.7244102,0.00036658783,0.061530873,0.00059735484,0.000057016954,0.000047354675,0.0003560508,0.0004709416,0.21216372],"genre_scores_gemma":[0.9895111,0.000055696255,0.006155834,0.000028803493,0.000011503638,0.0000084824605,0.00008528815,0.00007865712,0.0040645907],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"not_applicable","domain_scores_codex":[0.99942976,0.00018133732,0.00003203704,0.00017241886,0.0000978066,0.00008654169],"domain_scores_gemma":[0.99963546,0.00012780921,0.000051185078,0.00010216276,0.000059653157,0.000023573231],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.00048515652,0.0001550721,0.00020674494,0.0008237569,0.0008466101,0.0019073326,0.00042369854,0.0004257198,0.005543657],"category_scores_gemma":[0.00158052,0.00032659454,0.00018801905,0.00085475564,0.0025375132,0.0020282008,0.0014728045,0.0010518337,0.00078894524],"study_design_candidate":"not_applicable","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00012905513,0.000024029127,0.004809248,0.00010281443,0.000015943031,0.0012269425,0.015219717,0.00068514136,0.023196278,0.91022736,0.00085413596,0.043509346],"study_design_scores_gemma":[0.00011239092,0.00031335617,0.082120486,0.00027684376,0.00014914488,0.006684781,0.021362716,0.021101907,0.05717851,0.5319037,0.278599,0.00019716361],"about_ca_topic_score_codex":0.0016523548,"about_ca_topic_score_gemma":0.0021608542,"teacher_disagreement_score":0.005543657,"about_ca_system_score_codex":0.0017615418,"about_ca_system_score_gemma":0.0004320718,"threshold_uncertainty_score":0.01854533},"labels":[],"label_agreement":null},{"id":"W4294203304","doi":"10.22148/001c.37588","title":"The Evolution of the Idiolect over the Lifetime: A Quantitative and Qualitative Study of French 19th Century Literature","year":2022,"lang":"en","type":"article","venue":"Journal of Cultural Analytics","topic":"Authorship Attribution and Profiling","field":"Computer Science","cited_by":5,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":true,"route_about_ca":false,"ca_institutions":"","funders":"Agence Nationale de la Recherche","keywords":"Selection (genetic algorithm); Computer science; Variance (accounting); Task (project management); Feature (linguistics); Linguistics; Monotonic function; Natural language processing; Artificial intelligence; Literature; Mathematics; Philosophy; Art","score_opus":0.02960532437119118,"score_gpt":0.335989065498779,"score_spread":0.3063837411275878,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4294203304","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.9942409,0.00067779503,0.0005424072,0.0003226105,0.0000074100176,0.000021003489,0.00029738445,0.0000120984305,0.0038784526],"genre_scores_gemma":[0.9984243,0.00022526243,0.0003253985,0.000032976634,0.000008062872,0.000024157349,0.00013381545,0.000009072821,0.0008169337],"study_design_codex":"qualitative","study_design_gemma":"observational","domain_scores_codex":[0.99713093,0.0016165347,0.00016389407,0.00029512044,0.0005563095,0.00023727192],"domain_scores_gemma":[0.9718484,0.020964693,0.0026809457,0.00055225816,0.0033325953,0.0006209732],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0050652847,0.0001923056,0.00030365642,0.010730323,0.0024339766,0.0032559962,0.0004417502,0.0006005384,0.0021869475],"category_scores_gemma":[0.017363887,0.0001638836,0.0001883756,0.0070663574,0.0037333695,0.0029473787,0.0012084692,0.0003984204,0.00021739014],"study_design_candidate":"observational","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0001831401,0.000045943056,0.116616875,0.0004894535,0.000046045607,0.0011179756,0.8352348,0.00022816076,0.0059507266,0.00563874,0.000913753,0.033534445],"study_design_scores_gemma":[0.000011188726,0.0001335038,0.42930523,0.00031243407,0.00002822605,0.0010437586,0.53711885,0.0008122694,0.0018791992,0.0010398689,0.028237483,0.00007803042],"about_ca_topic_score_codex":0.025429629,"about_ca_topic_score_gemma":0.03721688,"teacher_disagreement_score":0.025429629,"about_ca_system_score_codex":0.0059662927,"about_ca_system_score_gemma":0.0011996323,"threshold_uncertainty_score":0.050563216},"labels":[],"label_agreement":null},{"id":"W4297383039","doi":"10.1080/01639374.2022.2124473","title":"Tongue-Tied by Authorities: Library of Congress Vocabularies and the Shakespeare Authorship Question","year":2022,"lang":"en","type":"article","venue":"Cataloging & Classification Quarterly","topic":"Authorship Attribution and Profiling","field":"Computer Science","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Winnipeg","funders":"","keywords":"Library of congress; Subject (documents); Scholarship; Perspective (graphical); Cataloging; Controlled vocabulary; Sociology; Library science; Linguistics; Computer science; Law; Political science; Information retrieval; Philosophy; Artificial intelligence","score_opus":0.019212523519553888,"score_gpt":0.24812728504593187,"score_spread":0.228914761526378,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4297383039","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.47242603,0.0149888545,0.014334272,0.07059981,0.0012136716,0.000088608256,0.00040648814,0.00011473006,0.42582756],"genre_scores_gemma":[0.9941912,0.001106838,0.0009790123,0.0007337077,0.00022623508,0.000023956256,0.000094795825,0.000041654454,0.002602614],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"not_applicable","domain_scores_codex":[0.985165,0.008434887,0.0015641343,0.0011121656,0.0027122255,0.0010116538],"domain_scores_gemma":[0.92131567,0.054107394,0.009618322,0.006389665,0.006515003,0.0020539495],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.020990731,0.00027167035,0.0006675934,0.011277951,0.011919671,0.019251717,0.0017328796,0.0028838825,0.00441169],"category_scores_gemma":[0.08272549,0.00036982258,0.00026057148,0.017737163,0.02970338,0.029400928,0.008127138,0.0027725063,0.000630196],"study_design_candidate":"not_applicable","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00003358501,0.000015730608,0.0068118605,0.000087122695,0.000005582548,0.00012776356,0.13156591,0.00007563419,0.000099456636,0.8355242,0.0033489636,0.022304155],"study_design_scores_gemma":[0.000023361943,0.000025887148,0.014925309,0.0015875746,0.000024468001,0.00026641897,0.29333395,0.0009949376,0.0005661581,0.57924694,0.10891942,0.00008548997],"about_ca_topic_score_codex":0.020252017,"about_ca_topic_score_gemma":0.018703148,"teacher_disagreement_score":0.020990731,"about_ca_system_score_codex":0.007552619,"about_ca_system_score_gemma":0.008258778,"threshold_uncertainty_score":0.11101091},"labels":[],"label_agreement":null},{"id":"W4298151303","doi":"","title":"Distance intertextuelle et connexion lexicale : outils de catégorisation générique ou stylistique ? Approche expérimentale d'un corpus inédit : le corpus aragonien","year":2010,"lang":"en","type":"book-chapter","venue":"HAL (Le Centre pour la Communication Scientifique Directe)","topic":"Authorship Attribution and Profiling","field":"Computer Science","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Canadian Linguistic Association","funders":"","keywords":"Humanities; Art; Philosophy","score_opus":0.017446728253592524,"score_gpt":0.23661361568653988,"score_spread":0.21916688743294735,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4298151303","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.6054843,0.0022531347,0.32814223,0.0010768481,0.00057835574,0.004037676,0.0027549674,0.00094416505,0.054728314],"genre_scores_gemma":[0.8402009,0.0004862725,0.14487994,0.00026030652,0.0001291455,0.007263659,0.001589658,0.0005764422,0.0046136123],"study_design_codex":"design_other","study_design_gemma":"bench_or_experimental","domain_scores_codex":[0.90359545,0.07510659,0.0042454507,0.008354468,0.00782323,0.0008747458],"domain_scores_gemma":[0.60931003,0.35773912,0.0045016394,0.013602556,0.013906816,0.00093968265],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.051853135,0.0012786764,0.0014043347,0.006456096,0.0020835674,0.01106491,0.0021853787,0.0017887666,0.009559453],"category_scores_gemma":[0.22904184,0.0008105927,0.0009275356,0.006728552,0.0066386247,0.012808757,0.0062238635,0.0028845516,0.0015580619],"study_design_candidate":"bench_or_experimental","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0061193216,0.0021750075,0.08133208,0.005529039,0.0010878051,0.0004450328,0.09384037,0.009849109,0.03326068,0.124805644,0.009162405,0.63239354],"study_design_scores_gemma":[0.0025762767,0.0052997884,0.26801565,0.0023868217,0.0013812375,0.0015737001,0.12772194,0.18946245,0.07790488,0.22158855,0.10044841,0.0016403078],"about_ca_topic_score_codex":0.004590141,"about_ca_topic_score_gemma":0.0035111278,"teacher_disagreement_score":0.051853135,"about_ca_system_score_codex":0.0024367918,"about_ca_system_score_gemma":0.0012017722,"threshold_uncertainty_score":0.27422887},"labels":[],"label_agreement":null},{"id":"W4300362102","doi":"","title":"A Brief Evaluation on ISSI 2015","year":2015,"lang":"en","type":"article","venue":"DOAJ (DOAJ: Directory of Open Access Journals)","topic":"Authorship Attribution and Profiling","field":"Computer Science","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":true,"ca_institutions":"","funders":"","keywords":"Computer science","score_opus":0.575237404284129,"score_gpt":0.628551738235234,"score_spread":0.053314333951105075,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4300362102","genre_codex":"other","genre_gemma":"review","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"review","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.020801423,0.057589386,0.01863883,0.14155802,0.06380399,0.003944792,0.040223215,0.0038171313,0.6496232],"genre_scores_gemma":[0.25699213,0.09097543,0.0695791,0.114923425,0.024958953,0.01423359,0.16488922,0.004177769,0.25927034],"study_design_codex":"not_applicable","study_design_gemma":"not_applicable","domain_scores_codex":[0.8441499,0.025756337,0.015966985,0.0043076235,0.101575635,0.008243607],"domain_scores_gemma":[0.7955924,0.034216303,0.013054688,0.00825611,0.1369597,0.011920724],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.12355279,0.0018421857,0.0019149858,0.050025217,0.004645196,0.018741637,0.004756473,0.0048599374,0.02298032],"category_scores_gemma":[0.20464097,0.0009683602,0.0031029019,0.036147118,0.003062418,0.013034482,0.0089972615,0.0057635303,0.015697334],"study_design_candidate":"not_applicable","study_design_consensus":"not_applicable","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00045060014,0.0002233241,0.007953448,0.0040104697,0.0001660621,0.00014729456,0.0014425421,0.00064476737,0.0007085448,0.08003787,0.66520417,0.23901089],"study_design_scores_gemma":[0.000024120593,0.00018214027,0.020095214,0.0029222905,0.000072662275,0.00007310371,0.00091814756,0.00018707519,0.00051770936,0.0024689133,0.972455,0.000083514205],"about_ca_topic_score_codex":0.034966458,"about_ca_topic_score_gemma":0.026741847,"teacher_disagreement_score":0.12355279,"about_ca_system_score_codex":0.02229478,"about_ca_system_score_gemma":0.04126282,"threshold_uncertainty_score":0.65341747},"labels":[],"label_agreement":null},{"id":"W4313372033","doi":"10.1007/978-3-031-21112-6_14","title":"Alonzo Variants","year":2023,"lang":"en","type":"book-chapter","venue":"Computer science foundations and applied logic","topic":"Authorship Attribution and Profiling","field":"Computer Science","cited_by":0,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"McMaster University","funders":"","keywords":"Syntax; Semantics (computer science); Computer science; Operator (biology); Linguistics; Programming language; Philosophy; Natural language processing; Biology; Genetics","score_opus":0.07414908078309176,"score_gpt":0.28812107389262936,"score_spread":0.2139719931095376,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4313372033","genre_codex":"other","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0027119787,0.0052174926,0.04868693,0.0049562985,0.005187085,0.000092934715,0.0014307216,0.0020333326,0.9296833],"genre_scores_gemma":[0.03172251,0.003054321,0.032514736,0.001540354,0.001238746,0.000111980655,0.001706596,0.0021191326,0.9259916],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.9989994,0.00013348188,0.000042255575,0.00027445442,0.00042464936,0.00012565414],"domain_scores_gemma":[0.9991146,0.0001392671,0.000040573974,0.0002917762,0.00032931447,0.00008442176],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0008902853,0.0010321499,0.00065299356,0.0021701357,0.0018354546,0.003863211,0.001950098,0.0013738903,0.13223654],"category_scores_gemma":[0.002599277,0.0004163923,0.00073339534,0.002541684,0.0016088111,0.0042423625,0.002638056,0.0024467993,0.06278759],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00018082958,0.000033942768,0.00022358175,0.00021280654,0.000014454636,0.00009913038,0.00031412786,0.00051556755,0.0012559107,0.48297098,0.23155786,0.28262073],"study_design_scores_gemma":[0.000016069824,0.000010809202,0.00017705953,0.00007442234,0.0000114357745,0.00014940837,0.000055885976,0.00076373713,0.00071497523,0.08626681,0.9117436,0.000015915326],"about_ca_topic_score_codex":0.005481078,"about_ca_topic_score_gemma":0.012316578,"teacher_disagreement_score":0.13223654,"about_ca_system_score_codex":0.0022139477,"about_ca_system_score_gemma":0.0012751045,"threshold_uncertainty_score":0.4423753},"labels":[],"label_agreement":null},{"id":"W4319342416","doi":"10.1093/adaptation/apac020","title":"Digitizing the Epistolary: <i>Dracula Daily</i> and Embodied Contemporary Reading","year":2022,"lang":"en","type":"article","venue":"Adaptation","topic":"Authorship Attribution and Profiling","field":"Computer Science","cited_by":1,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Mount Royal University","funders":"","keywords":"Dracula; Context (archaeology); Reading (process); Appeal; Art; Literature; History; Political science; Law","score_opus":0.05085569959542968,"score_gpt":0.2530447894075294,"score_spread":0.2021890898120997,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4319342416","genre_codex":"other","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.18105327,0.07517494,0.017610705,0.0159071,0.0033023863,0.00007277621,0.00019006449,0.00038979587,0.70629895],"genre_scores_gemma":[0.93642986,0.028499609,0.004631783,0.0012207308,0.0014375784,0.00003589255,0.00011170419,0.00018185061,0.027450915],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"not_applicable","domain_scores_codex":[0.9987669,0.000687382,0.0000546257,0.00014787134,0.00025312707,0.0000901361],"domain_scores_gemma":[0.9958305,0.0025589238,0.00047224428,0.00056344416,0.00032760188,0.00024725313],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.001541639,0.00021966478,0.00020583424,0.001535404,0.0013743123,0.0075986674,0.00042321288,0.0007552566,0.0086360825],"category_scores_gemma":[0.0069629215,0.000108994354,0.00015912145,0.0016990338,0.008389592,0.0067103026,0.0025731814,0.0012911852,0.00090644526],"study_design_candidate":"not_applicable","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00007467234,0.000037528636,0.0025298975,0.0014615764,0.000028108429,0.0010552304,0.12874807,0.00029437846,0.0038527118,0.511662,0.022596993,0.3276588],"study_design_scores_gemma":[0.000010088603,0.000049358456,0.005649819,0.0012506163,0.000019029834,0.0014606023,0.04070633,0.00020558787,0.0020879467,0.07352327,0.8750003,0.000036927784],"about_ca_topic_score_codex":0.0008811044,"about_ca_topic_score_gemma":0.0015720789,"teacher_disagreement_score":0.0086360825,"about_ca_system_score_codex":0.0011222797,"about_ca_system_score_gemma":0.0010226293,"threshold_uncertainty_score":0.02889061},"labels":[],"label_agreement":null},{"id":"W4324107265","doi":"10.16995/dscn.9665","title":"Zesting Up Stylometry with MapLemon: A Corpus for Stylometric Demographic Identification","year":2023,"lang":"fr","type":"article","venue":"Digital Studies / Le champ numérique","topic":"Authorship Attribution and Profiling","field":"Computer Science","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":true,"route_about_ca":true,"ca_institutions":"","funders":"","keywords":"Humanities; Corpus linguistics; Style (visual arts); Art; Linguistics; History; Literature; Philosophy","score_opus":0.10626252205708228,"score_gpt":0.32474447775057447,"score_spread":0.21848195569349219,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4324107265","genre_codex":"dataset","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.2922014,0.0032001128,0.17831106,0.0025312526,0.001675176,0.0058572297,0.3558317,0.0069295825,0.15346245],"genre_scores_gemma":[0.32372156,0.0013391046,0.33535233,0.0005882874,0.0003738245,0.014029126,0.2751502,0.0032421714,0.046203367],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9965527,0.0012667859,0.00047231128,0.00075515267,0.00081981637,0.00013320247],"domain_scores_gemma":[0.9864,0.006045994,0.0007048527,0.0027941463,0.0036454445,0.00040953778],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0033994692,0.00065496436,0.0005520544,0.0100429915,0.0025230774,0.0026070955,0.001121632,0.00074429315,0.016600493],"category_scores_gemma":[0.017565746,0.00045921528,0.0003322354,0.009228521,0.0015950568,0.0024833798,0.004319855,0.001058802,0.006062399],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00038033264,0.00019878546,0.022220073,0.003481266,0.00007835354,0.0011147808,0.06624687,0.0016614147,0.02410161,0.050294638,0.32350907,0.50671285],"study_design_scores_gemma":[0.00004893674,0.000042338863,0.05450741,0.0004900317,0.000027163573,0.00057694415,0.009626678,0.0030945675,0.006719312,0.0063783624,0.91838884,0.00009934336],"about_ca_topic_score_codex":0.012282406,"about_ca_topic_score_gemma":0.02529176,"teacher_disagreement_score":0.016600493,"about_ca_system_score_codex":0.0016915214,"about_ca_system_score_gemma":0.003020323,"threshold_uncertainty_score":0.055534184},"labels":[],"label_agreement":null},{"id":"W4360765065","doi":"10.1109/asonam55673.2022.10068566","title":"Discovering Affinity Relationships between Personality Types","year":2022,"lang":"en","type":"article","venue":"","topic":"Authorship Attribution and Profiling","field":"Computer Science","cited_by":8,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Université de Sherbrooke","funders":"","keywords":"Personality; Psychology; Similarity (geometry); Friendship; Stability (learning theory); Big Five personality traits; Social psychology; Computer science; Artificial intelligence; Machine learning","score_opus":0.10929758412035641,"score_gpt":0.2916635548593675,"score_spread":0.18236597073901112,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4360765065","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.9851313,0.00044992034,0.00941026,0.00016072646,0.000029548495,0.000032219046,0.0017094623,0.00011186507,0.0029645832],"genre_scores_gemma":[0.9947747,0.00007132068,0.0034630597,0.000015789772,0.00001903437,0.000014975026,0.0011321782,0.000008918474,0.0004999567],"study_design_codex":"observational","study_design_gemma":"observational","domain_scores_codex":[0.9988745,0.00038486667,0.00009297347,0.00032344702,0.00018912725,0.00013507371],"domain_scores_gemma":[0.99303716,0.003662402,0.0012971725,0.00054723397,0.0009730088,0.00048297766],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0010123333,0.0005247947,0.00037075984,0.0035349773,0.00065206195,0.001081825,0.00024744842,0.00043678633,0.0017467478],"category_scores_gemma":[0.00869779,0.00018497725,0.00042164323,0.0017060628,0.0002190002,0.0009621195,0.0007440648,0.0005566096,0.0011192823],"study_design_candidate":"observational","study_design_consensus":"observational","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00024172952,0.00014509034,0.9225901,0.000119215874,0.00016226768,0.00024102487,0.001060819,0.0012893371,0.0046322145,0.0007815353,0.0025073572,0.06622928],"study_design_scores_gemma":[0.000022245626,0.00019286947,0.91517437,0.000051542804,0.00013614992,0.0009738253,0.0017990379,0.068546735,0.00319893,0.0039999858,0.0058563356,0.000047949386],"about_ca_topic_score_codex":0.0022675043,"about_ca_topic_score_gemma":0.0036427698,"teacher_disagreement_score":0.0035349773,"about_ca_system_score_codex":0.00030073445,"about_ca_system_score_gemma":0.00025419882,"threshold_uncertainty_score":0.0058434606},"labels":[],"label_agreement":null},{"id":"W4360989144","doi":"10.18280/ria.370117","title":"Authorship Attribution using Sequential Part-of-Speech Pattern Mining","year":2023,"lang":"en","type":"article","venue":"Revue d intelligence artificielle","topic":"Authorship Attribution and Profiling","field":"Computer Science","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":true,"route_about_ca":false,"ca_institutions":"","funders":"","keywords":"Attribution; Authorship attribution; Natural language processing; Computer science; Linguistics; Psychology; Artificial intelligence; Social psychology; Philosophy","score_opus":0.19165715531850153,"score_gpt":0.3505424910636251,"score_spread":0.1588853357451236,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4360989144","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.5309254,0.0017786145,0.4516159,0.00076628866,0.0003134659,0.00052542135,0.005223622,0.0043450217,0.004506304],"genre_scores_gemma":[0.77813274,0.00040617623,0.21351524,0.00006125365,0.00012540679,0.0001381036,0.0056507788,0.00007507746,0.0018951608],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9970927,0.0006616946,0.00042522515,0.00084852014,0.000784452,0.0001873593],"domain_scores_gemma":[0.99139905,0.004043085,0.0017402439,0.0011699678,0.0013579413,0.0002897042],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0019629446,0.0007771249,0.0009040724,0.009275836,0.0007247505,0.0015904565,0.0011700751,0.0010463973,0.000905799],"category_scores_gemma":[0.0087798145,0.00026444122,0.000908588,0.0072887116,0.00047760727,0.002051466,0.0008702853,0.0006614774,0.0012469176],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00074737525,0.00086423685,0.07732779,0.00045830713,0.00033369908,0.0012839267,0.0007408678,0.01823805,0.026589695,0.0026971432,0.0065882746,0.8641307],"study_design_scores_gemma":[0.00008692795,0.00039922347,0.045986664,0.00009076844,0.00020984298,0.002774905,0.0008223406,0.86535823,0.04211611,0.02809294,0.013952,0.000109945824],"about_ca_topic_score_codex":0.0012597998,"about_ca_topic_score_gemma":0.0016952979,"teacher_disagreement_score":0.009275836,"about_ca_system_score_codex":0.0003955318,"about_ca_system_score_gemma":0.0006863464,"threshold_uncertainty_score":0.010381162},"labels":[],"label_agreement":null},{"id":"W4364360636","doi":"10.1109/infoteh57020.2023.10094205","title":"Automated Authorship Attribution using CNG Distance on Blog Posts in the Serbian Language","year":2023,"lang":"en","type":"article","venue":"","topic":"Authorship Attribution and Profiling","field":"Computer Science","cited_by":1,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Dalhousie University","funders":"","keywords":"Computer science; Authorship attribution; Serbian; Attribution; Natural language processing; Task (project management); Artificial intelligence; Preprocessor; Character (mathematics); Benchmark (surveying); Normative; Language identification; Linguistics; Natural language; Psychology; Mathematics","score_opus":0.07232217415261268,"score_gpt":0.35429124026587777,"score_spread":0.2819690661132651,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4364360636","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.9468298,0.005215677,0.014828525,0.0005015167,0.000645405,0.00015490917,0.017229399,0.0032633487,0.0113314185],"genre_scores_gemma":[0.92610794,0.0009895983,0.030478014,0.000107682405,0.00027561068,0.00012364677,0.034291986,0.00017126967,0.007454391],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.99873453,0.00040798073,0.00012445508,0.00029830693,0.00028892528,0.00014576706],"domain_scores_gemma":[0.9959895,0.0016292335,0.00069290935,0.00060118624,0.00081083976,0.0002763038],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0012913051,0.0010577379,0.0006906083,0.009264235,0.0010602464,0.0011338703,0.00040072852,0.00094099453,0.0016505843],"category_scores_gemma":[0.0067940173,0.00012344753,0.0003605304,0.0045495676,0.00039934972,0.0011697849,0.0011107277,0.0004817765,0.0023388613],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0020083908,0.00059830665,0.16283348,0.0023454349,0.00028770763,0.0051769423,0.0049676774,0.01186481,0.027584882,0.0033181792,0.07460269,0.70441145],"study_design_scores_gemma":[0.00025318633,0.00077768666,0.32219124,0.0012289879,0.00023986245,0.0070501887,0.014711386,0.42270508,0.04131521,0.011042284,0.17816181,0.00032298116],"about_ca_topic_score_codex":0.0032187246,"about_ca_topic_score_gemma":0.009600697,"teacher_disagreement_score":0.009264235,"about_ca_system_score_codex":0.00048796364,"about_ca_system_score_gemma":0.0006456815,"threshold_uncertainty_score":0.0068291426},"labels":[],"label_agreement":null},{"id":"W4375865975","doi":"10.1177/14614448231173132","title":"Book Review: Code: From Information Theory to French Theory","year":2023,"lang":"en","type":"article","venue":"New Media & Society","topic":"Authorship Attribution and Profiling","field":"Computer Science","cited_by":0,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Simon Fraser University","funders":"","keywords":"Code (set theory); Computer science; Information theory; Epistemology; Sociology; Programming language; Philosophy; Mathematics; Statistics","score_opus":0.025707115577915194,"score_gpt":0.2818299069898713,"score_spread":0.2561227914119561,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4375865975","genre_codex":"review","genre_gemma":"review","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"review","genre_consensus":"review","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.006327961,0.41158974,0.027777217,0.27756885,0.058974404,0.00013887887,0.0026466737,0.0005127866,0.21446353],"genre_scores_gemma":[0.22422807,0.28159297,0.012920817,0.056931693,0.09406034,0.00043465616,0.0027785078,0.0013894545,0.32566342],"study_design_codex":"not_applicable","study_design_gemma":"not_applicable","domain_scores_codex":[0.99438345,0.0024022115,0.0002427425,0.0004811753,0.0022477703,0.00024266938],"domain_scores_gemma":[0.9460819,0.037582915,0.0021990882,0.002086979,0.010825659,0.0012234225],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0037518064,0.00056089007,0.0012775852,0.009626634,0.0021039334,0.008782923,0.00097472843,0.0031328904,0.026928617],"category_scores_gemma":[0.055211436,0.00033253198,0.0004191068,0.013253837,0.0039734263,0.0065441183,0.0011770255,0.0025486145,0.0063659106],"study_design_candidate":"not_applicable","study_design_consensus":"not_applicable","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.000019635507,0.000007633815,0.00034458772,0.00042896988,0.000021893879,0.000039155922,0.00026378362,0.00027935358,0.00009379358,0.082745716,0.8226309,0.09312462],"study_design_scores_gemma":[0.000011552965,0.000021406073,0.0010545335,0.0010712815,0.000025622281,0.00021837401,0.00025541979,0.00070976606,0.00025246668,0.07645519,0.91988945,0.000035015826],"about_ca_topic_score_codex":0.007899156,"about_ca_topic_score_gemma":0.010379421,"teacher_disagreement_score":0.026928617,"about_ca_system_score_codex":0.0055264025,"about_ca_system_score_gemma":0.005419086,"threshold_uncertainty_score":0.09008515},"labels":[],"label_agreement":null},{"id":"W4380986449","doi":"10.1016/j.eswa.2023.120745","title":"TDRLM: Stylometric learning for authorship verification by Topic-Debiasing","year":2023,"lang":"en","type":"article","venue":"Expert Systems with Applications","topic":"Authorship Attribution and Profiling","field":"Computer Science","cited_by":11,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Queen's University","funders":"","keywords":"Debiasing; Computer science; Artificial intelligence; Stylometry; Machine learning; Representation (politics); Natural language processing; Task (project management); Multi-task learning; Latent semantic analysis; Writing style; Information retrieval; Linguistics","score_opus":0.04554347233216235,"score_gpt":0.3100462451674291,"score_spread":0.2645027728352668,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4380986449","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.020174183,0.0008981007,0.8983823,0.00042511686,0.0004796718,0.0004055836,0.007953989,0.0687083,0.0025726834],"genre_scores_gemma":[0.21451691,0.00042098606,0.7550112,0.0001923487,0.00051727454,0.00070622284,0.01814436,0.0022899345,0.008200689],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.99383366,0.0017403497,0.000692834,0.0017502991,0.0015216474,0.00046113756],"domain_scores_gemma":[0.9864674,0.005910633,0.0011270295,0.004497906,0.0015459099,0.00045112794],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0075460193,0.0019156995,0.0023663728,0.01148317,0.0016013577,0.003915532,0.0030036971,0.0025773076,0.011438072],"category_scores_gemma":[0.0349763,0.0009487375,0.001837039,0.007061936,0.00088420603,0.0051103095,0.0044880714,0.0024777115,0.01680326],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00041428726,0.0003557044,0.008582203,0.0004118628,0.00026481153,0.00016185505,0.0003190521,0.0131488005,0.005832108,0.0063415305,0.05104347,0.9131244],"study_design_scores_gemma":[0.00012771304,0.00012453062,0.0034465988,0.000071256356,0.000072105526,0.00031754156,0.0001870159,0.93438303,0.012669657,0.02831921,0.020202331,0.000078966026],"about_ca_topic_score_codex":0.002284999,"about_ca_topic_score_gemma":0.0051645087,"teacher_disagreement_score":0.01148317,"about_ca_system_score_codex":0.00081576814,"about_ca_system_score_gemma":0.0022105763,"threshold_uncertainty_score":0.039907634},"labels":[],"label_agreement":null},{"id":"W4385388945","doi":"10.18280/ria.370323","title":"A Comprehensive Machine Learning Framework for Automated Book Genre Classifier","year":2023,"lang":"en","type":"article","venue":"Revue d intelligence artificielle","topic":"Authorship Attribution and Profiling","field":"Computer Science","cited_by":5,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":true,"route_about_ca":false,"ca_institutions":"","funders":"","keywords":"Computer science; Artificial intelligence; Classifier (UML); Machine learning; Natural language processing","score_opus":0.10307111065654433,"score_gpt":0.34409022564031433,"score_spread":0.24101911498377,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4385388945","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0024826457,0.00022677942,0.9938992,0.00013793474,0.000029636072,0.0001602259,0.00031466354,0.0016903825,0.0010583546],"genre_scores_gemma":[0.06859264,0.0003057623,0.9252242,0.00010790176,0.0001029274,0.0003639093,0.0019266552,0.00009337176,0.0032826888],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.99833196,0.00039727523,0.00014286647,0.00033108843,0.0006679196,0.0001290147],"domain_scores_gemma":[0.9981877,0.00043267652,0.00014458493,0.0002909301,0.00083385344,0.00011020767],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0024076677,0.00078498945,0.0010428842,0.0040352154,0.0011646765,0.0017695036,0.001855777,0.0010648394,0.0027588082],"category_scores_gemma":[0.005343218,0.00035942195,0.0010737507,0.002621249,0.0005407239,0.0021435062,0.001249866,0.0014297209,0.0027699617],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0001241343,0.00038427516,0.0050038076,0.00021402181,0.00007919903,0.00038168073,0.000309684,0.079405755,0.012073752,0.057260294,0.02095188,0.8238116],"study_design_scores_gemma":[0.000013889523,0.00006090426,0.001341122,0.000045166296,0.000023418519,0.00023207582,0.00007275161,0.9426205,0.0050543905,0.034700792,0.015798632,0.000036458376],"about_ca_topic_score_codex":0.005506166,"about_ca_topic_score_gemma":0.0081429975,"teacher_disagreement_score":0.005506166,"about_ca_system_score_codex":0.0011136142,"about_ca_system_score_gemma":0.0025291343,"threshold_uncertainty_score":0.012733102},"labels":[],"label_agreement":null},{"id":"W4385467269","doi":"10.1007/978-981-287-079-7_148-1","title":"Reframing and Broadening Adversarial Stylometry for Academic Integrity","year":2023,"lang":"en","type":"book-chapter","venue":"","topic":"Authorship Attribution and Profiling","field":"Computer Science","cited_by":2,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Carleton University","funders":"","keywords":"Stylometry; Cheating; Adversarial system; Academic integrity; Computer science; Computer security; Obfuscation; Artificial intelligence; Psychology; Social psychology","score_opus":0.08913382106859646,"score_gpt":0.32807894369797264,"score_spread":0.23894512262937617,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4385467269","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0060055032,0.0011969156,0.9419707,0.0044824425,0.00083586783,0.00007813985,0.00021530439,0.0011115952,0.044103548],"genre_scores_gemma":[0.6071432,0.002954724,0.30308545,0.0018730444,0.0019374458,0.00024446435,0.0005831312,0.001344136,0.08083436],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.9920189,0.0035174496,0.00035769102,0.0011497794,0.0025386233,0.00041749596],"domain_scores_gemma":[0.9775824,0.0104627665,0.00091512565,0.009042995,0.0015428689,0.0004539185],"candidate_categories":["research_integrity"],"consensus_categories":[],"category_scores_codex":[0.005977595,0.00112986,0.0009748483,0.001992524,0.0025787177,0.0066343783,0.0026788688,0.0027291118,0.01112951],"category_scores_gemma":[0.041086398,0.0008192202,0.00095107115,0.0023095356,0.007258454,0.011197443,0.008895769,0.005969017,0.0052700755],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.000046689744,0.000034345827,0.00058958895,0.00008236174,0.00002122428,0.00009130099,0.00081688806,0.025390925,0.0014487429,0.7927061,0.0181288,0.16064307],"study_design_scores_gemma":[0.000005597884,0.000019442921,0.00021627777,0.000091148475,0.0000119111355,0.00017132491,0.00019080077,0.113076195,0.0023684453,0.8427438,0.04106541,0.0000395496],"about_ca_topic_score_codex":0.001237516,"about_ca_topic_score_gemma":0.0016208206,"teacher_disagreement_score":0.9972709,"about_ca_system_score_codex":0.0020288648,"about_ca_system_score_gemma":0.0017676246,"threshold_uncertainty_score":0.037231863},"labels":[],"label_agreement":null},{"id":"W4385572805","doi":"10.18653/v1/2022.emnlp-main.153","title":"A Multifaceted Framework to Evaluate Evasion, Content Preservation, and Misattribution in Authorship Obfuscation Techniques","year":2022,"lang":"en","type":"article","venue":"","topic":"Authorship Attribution and Profiling","field":"Computer Science","cited_by":2,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"McGill University","funders":"Fonds de recherche du Québec – Nature et technologies; Natural Sciences and Engineering Research Council of Canada; Canada Research Chairs; Canadian Institute for Advanced Research","keywords":"Obfuscation; Misattribution of memory; Computer science; Automatic summarization; Evasion (ethics); Identification (biology); Harm; Key (lock); Information retrieval; Data science; Computer security; Psychology; Social psychology","score_opus":0.11827476534820144,"score_gpt":0.3349044381315374,"score_spread":0.21662967278333597,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4385572805","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.36575308,0.0052373535,0.60599583,0.0019817252,0.00036158322,0.00285007,0.0020028895,0.006588663,0.0092287585],"genre_scores_gemma":[0.75724864,0.0004722591,0.23835373,0.00023649611,0.00010926686,0.00080372446,0.0009640786,0.0002106188,0.001601205],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.970361,0.012677805,0.002021429,0.002742968,0.011189169,0.0010076573],"domain_scores_gemma":[0.9197761,0.048253242,0.010079754,0.013362078,0.007224177,0.0013047324],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.024606753,0.0023389638,0.0015442381,0.008721672,0.0014531757,0.0036512234,0.0021341518,0.0030060771,0.0022256095],"category_scores_gemma":[0.07001902,0.00047698783,0.0015178656,0.0034879013,0.0032698899,0.005816898,0.0040533966,0.0035104142,0.00079022354],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0031621791,0.0040071174,0.060784448,0.0029936854,0.0013263961,0.0004990287,0.0022061751,0.16166756,0.070774056,0.06544944,0.009161988,0.61796796],"study_design_scores_gemma":[0.00026560575,0.0054578343,0.029971007,0.00044075344,0.00057685975,0.0009691192,0.0008995444,0.81159693,0.070214696,0.070941724,0.008300735,0.00036530092],"about_ca_topic_score_codex":0.001229646,"about_ca_topic_score_gemma":0.0015329863,"teacher_disagreement_score":0.024606753,"about_ca_system_score_codex":0.0023722108,"about_ca_system_score_gemma":0.0016932011,"threshold_uncertainty_score":0.13013446},"labels":[],"label_agreement":null},{"id":"W4385572818","doi":"10.18653/v1/2022.emnlp-main.128","title":"AfroLID: A Neural Language Identification Tool for African Languages","year":2022,"lang":"en","type":"article","venue":"","topic":"Authorship Attribution and Profiling","field":"Computer Science","cited_by":15,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of British Columbia","funders":"Alliance de recherche numérique du Canada; Social Sciences and Humanities Research Council of Canada; Natural Sciences and Engineering Research Council of Canada; Canada Research Chairs; Advanced Micro Devices","keywords":"Computer science; Domain (mathematical analysis); Identification (biology); Natural language processing; Set (abstract data type); Cover (algebra); Artificial intelligence; Exploit; Language identification; Natural language; Programming language; Engineering","score_opus":0.022608016319741863,"score_gpt":0.3036981982625557,"score_spread":0.2810901819428138,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4385572818","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.14082009,0.002380594,0.50389296,0.001467874,0.0010407743,0.00081196864,0.047985096,0.26936677,0.032233838],"genre_scores_gemma":[0.3573421,0.00063891686,0.55093086,0.0007500783,0.00011684948,0.0010052484,0.06057357,0.0036780455,0.024964366],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9989303,0.00024114437,0.00012679429,0.00031882463,0.0002718379,0.0001110665],"domain_scores_gemma":[0.99782914,0.0010521275,0.00016719768,0.0004151531,0.00042802969,0.00010835773],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0018081401,0.0012162195,0.00057424157,0.0039867153,0.0009952963,0.0015541569,0.0014265113,0.0010608657,0.014333931],"category_scores_gemma":[0.0072199153,0.00040627556,0.0008179242,0.0015412383,0.00047467867,0.0031025212,0.0035832927,0.001461606,0.010441917],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00041630137,0.00024214658,0.013846281,0.0010586316,0.00014545742,0.0005007813,0.0011997973,0.0069828522,0.01833751,0.004469713,0.14012304,0.81267756],"study_design_scores_gemma":[0.00024442442,0.0004095107,0.02064799,0.000577952,0.00015826055,0.002955642,0.0031841232,0.54705656,0.0947416,0.028347766,0.30134264,0.0003335278],"about_ca_topic_score_codex":0.0053473073,"about_ca_topic_score_gemma":0.012222406,"teacher_disagreement_score":0.014333931,"about_ca_system_score_codex":0.000674888,"about_ca_system_score_gemma":0.0013891642,"threshold_uncertainty_score":0.047951758},"labels":[],"label_agreement":null},{"id":"W4385900898","doi":"10.3934/mbe.2023711","title":"Twitter-based gender recognition using transformers","year":2023,"lang":"en","type":"article","venue":"Mathematical Biosciences & Engineering","topic":"Authorship Attribution and Profiling","field":"Computer Science","cited_by":4,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Centre for Global Health Research; Response Biomedical (Canada); York University","funders":"","keywords":"Transformer; Computer science; Demographics; Artificial intelligence; Encoder; Social media; Machine learning; World Wide Web; Engineering","score_opus":0.13604176979913948,"score_gpt":0.30398903951138634,"score_spread":0.16794726971224685,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4385900898","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.5796447,0.0024697443,0.23423448,0.0013249053,0.0011436265,0.00088544824,0.10107735,0.03515346,0.044066224],"genre_scores_gemma":[0.8722808,0.0009382874,0.052618805,0.00025769754,0.00014329575,0.00026807166,0.049098928,0.00028447638,0.024109714],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.99984133,0.000015583048,0.000008826913,0.000049576032,0.00004688155,0.000037810063],"domain_scores_gemma":[0.99985015,0.000026384561,0.000020816902,0.000018871846,0.00006778511,0.00001594619],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.00019372988,0.0010550618,0.00037814135,0.0013565569,0.0001758879,0.00050766586,0.0005203499,0.00041471364,0.0056874705],"category_scores_gemma":[0.0007404551,0.00015442919,0.000573381,0.0005868099,0.00013697364,0.0008507298,0.00045050535,0.00028927007,0.004650078],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0019437695,0.0004335186,0.075314224,0.00046880843,0.00012434761,0.00072135165,0.0002595619,0.020686096,0.03955726,0.0032470701,0.07391944,0.78332466],"study_design_scores_gemma":[0.00008670671,0.0006336836,0.07925537,0.00011103831,0.000112918424,0.0012701156,0.00079396344,0.7812299,0.077049375,0.00500091,0.054344475,0.00011146898],"about_ca_topic_score_codex":0.007381479,"about_ca_topic_score_gemma":0.015597726,"teacher_disagreement_score":0.007381479,"about_ca_system_score_codex":0.00054514356,"about_ca_system_score_gemma":0.0003887856,"threshold_uncertainty_score":0.019026518},"labels":[],"label_agreement":null},{"id":"W4385967449","doi":"10.48550/arxiv.2308.01681","title":"NBIAS: A Natural Language Processing Framework for Bias Identification in Text","year":2023,"lang":"en","type":"preprint","venue":"arXiv (Cornell University)","topic":"Authorship Attribution and Profiling","field":"Computer Science","cited_by":5,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"","funders":"Government of Canada; Canadian Institute for Advanced Research","keywords":"Security token; Computer science; Transformer; Identification (biology); Data science; Natural language processing; Artificial intelligence; Variety (cybernetics); Social media; Machine learning; Data mining; World Wide Web; Computer security; Engineering","score_opus":0.199665017893937,"score_gpt":0.27325853897334546,"score_spread":0.07359352107940845,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4385967449","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0026264128,0.0003626311,0.9848209,0.00082384923,0.0001606674,0.00053212227,0.002305658,0.0072331093,0.0011346568],"genre_scores_gemma":[0.053922802,0.00046822522,0.9358917,0.0006881546,0.00033081434,0.0011820176,0.0053614466,0.00071973284,0.0014350042],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9800341,0.009486996,0.0021334812,0.0032790247,0.004564297,0.00050199725],"domain_scores_gemma":[0.94637954,0.035043035,0.006220388,0.005647453,0.0059606936,0.0007488766],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.023332186,0.0021625163,0.0016099848,0.007846926,0.002362236,0.005961976,0.0034295616,0.0025964256,0.006070636],"category_scores_gemma":[0.06431084,0.0012050046,0.0031219383,0.0043803523,0.0032699162,0.008156504,0.005819902,0.0053918944,0.005725771],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0005819128,0.0003763014,0.012706906,0.0029394592,0.00054002705,0.0011155121,0.0048473063,0.036356304,0.019978875,0.19326723,0.05842752,0.66886264],"study_design_scores_gemma":[0.000102221595,0.00015702756,0.0027194892,0.000678802,0.00015401843,0.0007006699,0.00094015757,0.54302746,0.01507508,0.35675514,0.0795073,0.00018270023],"about_ca_topic_score_codex":0.005729147,"about_ca_topic_score_gemma":0.009727158,"teacher_disagreement_score":0.023332186,"about_ca_system_score_codex":0.0033528637,"about_ca_system_score_gemma":0.0060234247,"threshold_uncertainty_score":0.12339389},"labels":[],"label_agreement":null},{"id":"W4389294515","doi":"10.1007/978-3-031-39989-3_148","title":"Reframing and Broadening Adversarial Stylometry for Academic Integrity","year":2023,"lang":"en","type":"book-chapter","venue":"","topic":"Authorship Attribution and Profiling","field":"Computer Science","cited_by":1,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Carleton University","funders":"","keywords":"Stylometry; Cheating; Adversarial system; Academic integrity; Computer science; Computer security; Exploit; Data science; Artificial intelligence; Psychology; Social psychology","score_opus":0.08913382106859646,"score_gpt":0.32807894369797264,"score_spread":0.23894512262937617,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4389294515","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0060055032,0.0011969156,0.9419707,0.0044824425,0.00083586783,0.00007813985,0.00021530439,0.0011115952,0.044103548],"genre_scores_gemma":[0.6071432,0.002954724,0.30308545,0.0018730444,0.0019374458,0.00024446435,0.0005831312,0.001344136,0.08083436],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.9920189,0.0035174496,0.00035769102,0.0011497794,0.0025386233,0.00041749596],"domain_scores_gemma":[0.9775824,0.0104627665,0.00091512565,0.009042995,0.0015428689,0.0004539185],"candidate_categories":["research_integrity"],"consensus_categories":[],"category_scores_codex":[0.005977595,0.00112986,0.0009748483,0.001992524,0.0025787177,0.0066343783,0.0026788688,0.0027291118,0.01112951],"category_scores_gemma":[0.041086398,0.0008192202,0.00095107115,0.0023095356,0.007258454,0.011197443,0.008895769,0.005969017,0.0052700755],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.000046689744,0.000034345827,0.00058958895,0.00008236174,0.00002122428,0.00009130099,0.00081688806,0.025390925,0.0014487429,0.7927061,0.0181288,0.16064307],"study_design_scores_gemma":[0.000005597884,0.000019442921,0.00021627777,0.000091148475,0.0000119111355,0.00017132491,0.00019080077,0.113076195,0.0023684453,0.8427438,0.04106541,0.0000395496],"about_ca_topic_score_codex":0.001237516,"about_ca_topic_score_gemma":0.0016208206,"teacher_disagreement_score":0.9972709,"about_ca_system_score_codex":0.0020288648,"about_ca_system_score_gemma":0.0017676246,"threshold_uncertainty_score":0.037231863},"labels":[],"label_agreement":null},{"id":"W4389520083","doi":"10.18653/v1/2023.findings-emnlp.387","title":"Investigating Online Community Engagement through Stancetaking","year":2023,"lang":"en","type":"article","venue":"","topic":"Authorship Attribution and Profiling","field":"Computer Science","cited_by":1,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"","funders":"Natural Sciences and Engineering Research Council of Canada; University of Toronto","keywords":"Identity (music); Context (archaeology); Variation (astronomy); Similarity (geometry); Online community; Community engagement; Computer science; Sociology; Data science; Psychology; World Wide Web; Public relations; Geography; Artificial intelligence; Political science","score_opus":0.3415336180240014,"score_gpt":0.3841021647632059,"score_spread":0.042568546739204516,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4389520083","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.9009902,0.0005763309,0.08141279,0.0004589318,0.000030854844,0.00009259982,0.0008342576,0.0002214127,0.0153827695],"genre_scores_gemma":[0.9879291,0.00008933063,0.011015816,0.0000289747,0.00000867559,0.000031882933,0.00024836222,0.000023947769,0.00062384445],"study_design_codex":"observational","study_design_gemma":"observational","domain_scores_codex":[0.99897027,0.00045317403,0.00005076642,0.00026822134,0.00016251326,0.000095088595],"domain_scores_gemma":[0.99347115,0.0034563257,0.001391618,0.00077376136,0.00047517367,0.00043211036],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0012610368,0.00026897708,0.0002769199,0.0023265025,0.00089557125,0.002290768,0.0004068447,0.0006408173,0.0027415142],"category_scores_gemma":[0.011170244,0.00017839731,0.00028563256,0.002461872,0.001160754,0.0040732645,0.0021337962,0.00069550023,0.00060102536],"study_design_candidate":"observational","study_design_consensus":"observational","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00091474975,0.0004629201,0.47983938,0.0007698152,0.00019582128,0.0008394528,0.052845057,0.013083775,0.040757548,0.0978474,0.0035541044,0.30888999],"study_design_scores_gemma":[0.000054083328,0.00035673386,0.37227055,0.00032871825,0.000121800455,0.0011675316,0.048748072,0.24675529,0.017838612,0.27738783,0.034788333,0.00018243256],"about_ca_topic_score_codex":0.0016204764,"about_ca_topic_score_gemma":0.002492212,"teacher_disagreement_score":0.0027415142,"about_ca_system_score_codex":0.0005433174,"about_ca_system_score_gemma":0.00027342173,"threshold_uncertainty_score":0.009171307},"labels":[],"label_agreement":null},{"id":"W4389629098","doi":"10.1109/icspis60075.2023.10343932","title":"ICSPIS 2023 Keynote Speakers","year":2023,"lang":"en","type":"article","venue":"","topic":"Authorship Attribution and Profiling","field":"Computer Science","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"McGill University","funders":"","keywords":"Computer science; Malware; Process (computing); Session (web analytics); Publishing; Reverse engineering; Code (set theory); Software; Computer security; Malware analysis; clone (Java method); Static analysis; Data science; World Wide Web; Software engineering; Programming language; Set (abstract data type)","score_opus":0.043818712537998704,"score_gpt":0.29274168983269866,"score_spread":0.24892297729469995,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4389629098","genre_codex":"other","genre_gemma":"other","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"other","genre_consensus":"other","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.00284215,0.007142739,0.0110481875,0.06604859,0.2089879,0.000480257,0.0040990217,0.0026138215,0.6967374],"genre_scores_gemma":[0.009947028,0.002268914,0.002303542,0.0035942956,0.015937684,0.00019235877,0.0019170289,0.00060620287,0.96323293],"study_design_codex":"not_applicable","study_design_gemma":"not_applicable","domain_scores_codex":[0.99897563,0.000114768605,0.00003964206,0.00023038211,0.00044814116,0.00019150252],"domain_scores_gemma":[0.99787605,0.00020866019,0.00005424467,0.000113582755,0.00093962974,0.0008078055],"candidate_categories":["insufficient_payload"],"consensus_categories":[],"category_scores_codex":[0.0022413405,0.001434499,0.00074456556,0.0012934383,0.0017917106,0.005551978,0.0010116406,0.0026915132,0.40617597],"category_scores_gemma":[0.0030497261,0.00030216225,0.0008384151,0.00089267764,0.00045607408,0.0023484721,0.0022978694,0.003499745,0.25144446],"study_design_candidate":"not_applicable","study_design_consensus":"not_applicable","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00006073841,0.000030892417,0.000114417075,0.000057209163,0.0000047026374,0.00009840518,0.000023618886,0.00011070483,0.0005164803,0.004163413,0.95597786,0.03884164],"study_design_scores_gemma":[0.000011952851,0.000032494907,0.00023557333,0.00005783658,0.000005018677,0.000068337926,0.00006773463,0.0004087764,0.00034206035,0.0018454347,0.9969175,0.0000073132123],"about_ca_topic_score_codex":0.0016079749,"about_ca_topic_score_gemma":0.0034651998,"teacher_disagreement_score":0.40617597,"about_ca_system_score_codex":0.001689836,"about_ca_system_score_gemma":0.0018666871,"threshold_uncertainty_score":0.8470179},"labels":[],"label_agreement":null},{"id":"W4389629106","doi":"10.1109/icspis60075.2023.10343731","title":"ICSPIS 2023 Full Program","year":2023,"lang":"en","type":"article","venue":"","topic":"Authorship Attribution and Profiling","field":"Computer Science","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"McGill University","funders":"","keywords":"Computer science; Malware; Process (computing); Session (web analytics); Reverse engineering; Code (set theory); Publishing; Software; clone (Java method); Static analysis; Computer security; Malware analysis; World Wide Web; Software engineering; Data science; Programming language; Set (abstract data type)","score_opus":0.05320985673677527,"score_gpt":0.3313712448480434,"score_spread":0.27816138811126817,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4389629106","genre_codex":"other","genre_gemma":"other","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"other","genre_consensus":"other","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0007753461,0.00087621296,0.0059845406,0.004827594,0.005836595,0.0002059523,0.004466403,0.0065136333,0.9705138],"genre_scores_gemma":[0.0033875436,0.00058666494,0.0020760524,0.0008690636,0.00093239936,0.000101425256,0.004132855,0.0011488928,0.98676515],"study_design_codex":"not_applicable","study_design_gemma":"not_applicable","domain_scores_codex":[0.99946696,0.000060959286,0.00001850867,0.00012513857,0.00024833003,0.000080232174],"domain_scores_gemma":[0.99896383,0.000089488465,0.0000363092,0.0001692161,0.00029705177,0.0004440988],"candidate_categories":["insufficient_payload"],"consensus_categories":[],"category_scores_codex":[0.0010312437,0.0012045623,0.0006785328,0.0013720917,0.0011225989,0.0048904642,0.0009874776,0.0018874911,0.8665914],"category_scores_gemma":[0.0015839594,0.00032259055,0.0006924444,0.0012024209,0.00045729632,0.0020448966,0.0022537776,0.0020416356,0.766663],"study_design_candidate":"not_applicable","study_design_consensus":"not_applicable","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.000058596215,0.000056683664,0.00013880503,0.00008577478,0.0000055856162,0.000047949787,0.000015242166,0.00015511955,0.00082503626,0.004700185,0.8724678,0.12144308],"study_design_scores_gemma":[0.00001338726,0.000025236803,0.00019565749,0.0000360823,0.000002258234,0.000038472976,0.000013275456,0.000395252,0.0003095065,0.0013292787,0.9976374,0.000004180747],"about_ca_topic_score_codex":0.0014389539,"about_ca_topic_score_gemma":0.0025432524,"teacher_disagreement_score":0.8665914,"about_ca_system_score_codex":0.00116899,"about_ca_system_score_gemma":0.0014851743,"threshold_uncertainty_score":0.19029117},"labels":[],"label_agreement":null},{"id":"W4390145251","doi":"10.18280/isi.280626","title":"Enhancing Identity Document Classification in KYC Processes: An Evaluation of the Bag-of-Visual-Words Model and Segmentation Impact","year":2023,"lang":"en","type":"article","venue":"Ingénierie des systèmes d information","topic":"Authorship Attribution and Profiling","field":"Computer Science","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":true,"route_about_ca":false,"ca_institutions":"","funders":"Binus University","keywords":"Identity (music); Segmentation; Artificial intelligence; Pattern recognition (psychology); Natural language processing; Computer science; Information retrieval; Art; Aesthetics","score_opus":0.05658156724440002,"score_gpt":0.361020012995824,"score_spread":0.304438445751424,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4390145251","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.85746926,0.004712677,0.11759851,0.0011096225,0.00071286585,0.0009005829,0.0019438394,0.009454765,0.00609786],"genre_scores_gemma":[0.83185464,0.0009206034,0.15738194,0.00032915233,0.00013141386,0.00022099505,0.005736094,0.0002844965,0.0031406123],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9973584,0.00067374477,0.00020498213,0.0007552498,0.0007212911,0.0002863217],"domain_scores_gemma":[0.9940959,0.0029354563,0.00038538585,0.00092284626,0.0012992815,0.00036114096],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0051918128,0.001930373,0.0016419127,0.0026159973,0.00086302386,0.0024340379,0.0019725778,0.0023319,0.0014307172],"category_scores_gemma":[0.009877728,0.00032438204,0.0013081036,0.001922696,0.00090123503,0.003440057,0.0014809149,0.0021288595,0.0018345604],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0041995374,0.0026848975,0.020883337,0.00081385387,0.0003727657,0.00021982074,0.00045141595,0.16978306,0.015543008,0.0014609921,0.01073751,0.77284986],"study_design_scores_gemma":[0.0000776633,0.0007916895,0.0053609204,0.000041504376,0.000081353355,0.00008893084,0.0002702577,0.97679454,0.013678189,0.00070479326,0.0020682998,0.0000418443],"about_ca_topic_score_codex":0.023110026,"about_ca_topic_score_gemma":0.014036822,"teacher_disagreement_score":0.023110026,"about_ca_system_score_codex":0.0023356436,"about_ca_system_score_gemma":0.0021013962,"threshold_uncertainty_score":0.04595101},"labels":[],"label_agreement":null},{"id":"W4391312751","doi":"10.33137/rr.v41i4.32451","title":"Exploring Verbal Relations between &lt;i&gt;Arden of Faversham&lt;/i&gt; and John Lyly’s &lt;i&gt;Endymion&lt;/i&gt;","year":2019,"lang":"en","type":"article","venue":"Renaissance and Reformation","topic":"Authorship Attribution and Profiling","field":"Computer Science","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":true,"route_about_ca":false,"ca_institutions":"","funders":"","keywords":"Psychology","score_opus":0.04570567797878732,"score_gpt":0.25107995563341445,"score_spread":0.20537427765462712,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4391312751","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.87767214,0.001566479,0.0031721368,0.0021461817,0.00025738613,0.000039384504,0.00019998164,0.00004014108,0.11490615],"genre_scores_gemma":[0.9905528,0.00033800816,0.0006519989,0.00012805629,0.000041826315,0.000021051217,0.0000731803,0.000039176273,0.008153937],"study_design_codex":"qualitative","study_design_gemma":"not_applicable","domain_scores_codex":[0.99680376,0.001683333,0.00013956065,0.00047887155,0.0006012297,0.00029330954],"domain_scores_gemma":[0.9796072,0.015721273,0.002319109,0.00090001104,0.0011039029,0.00034849576],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0026530179,0.00026094913,0.00022536112,0.0033349555,0.0066094664,0.0053654714,0.000576659,0.0009661447,0.005365069],"category_scores_gemma":[0.020403026,0.0002469923,0.00008819739,0.003607533,0.009246916,0.0047582383,0.0033292957,0.0018323697,0.00065638946],"study_design_candidate":"not_applicable","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.000042693955,0.000011208164,0.007995652,0.000067678,0.0000050395197,0.00041759713,0.93874377,0.000026321626,0.0009816722,0.03693054,0.0016365579,0.0131413],"study_design_scores_gemma":[0.0000056055333,0.00003123988,0.029698918,0.00032725756,0.000011216259,0.0008326922,0.8449068,0.00023828336,0.0019163577,0.0053967917,0.116597906,0.000037004073],"about_ca_topic_score_codex":0.02746268,"about_ca_topic_score_gemma":0.074749395,"teacher_disagreement_score":0.02746268,"about_ca_system_score_codex":0.005621961,"about_ca_system_score_gemma":0.0013784367,"threshold_uncertainty_score":0.054605663},"labels":[],"label_agreement":null},{"id":"W4391974074","doi":"10.1007/978-3-031-54144-5_148","title":"Reframing and Broadening Adversarial Stylometry for Academic Integrity","year":2024,"lang":"en","type":"book-chapter","venue":"Springer international handbooks of education","topic":"Authorship Attribution and Profiling","field":"Computer Science","cited_by":1,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Carleton University","funders":"","keywords":"Cognitive reframing; Adversarial system; Stylometry; Computer science; Psychology; Artificial intelligence; Social psychology","score_opus":0.044829302542030894,"score_gpt":0.34276942413735945,"score_spread":0.29794012159532857,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4391974074","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.006900724,0.0007262504,0.9646711,0.0030222624,0.00053845724,0.00006939581,0.00015826026,0.00075725146,0.023156324],"genre_scores_gemma":[0.7005123,0.0018747097,0.25356033,0.0014444945,0.0016182077,0.00024347604,0.00044535098,0.0009468944,0.039354287],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.98731923,0.006024532,0.00062497234,0.0018390666,0.0035490796,0.0006431231],"domain_scores_gemma":[0.9644729,0.015772605,0.001551223,0.015189967,0.0023007416,0.0007125836],"candidate_categories":["research_integrity"],"consensus_categories":[],"category_scores_codex":[0.00820227,0.0012074364,0.0012250638,0.0021817093,0.003064282,0.007912758,0.003267603,0.0033031506,0.012178182],"category_scores_gemma":[0.060849167,0.0009462188,0.0011557257,0.0023977049,0.009528685,0.01313956,0.013270184,0.006532008,0.0046512033],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00007001758,0.000039620794,0.0007526009,0.00008386523,0.00002466755,0.00010708742,0.0009198478,0.03190975,0.0015939241,0.8259118,0.010570737,0.12801608],"study_design_scores_gemma":[0.000008029707,0.00002765483,0.00021185532,0.000079992984,0.000012356804,0.00016798661,0.00021579514,0.14080401,0.0019247612,0.83358794,0.022918196,0.000041461168],"about_ca_topic_score_codex":0.0011550785,"about_ca_topic_score_gemma":0.0013166494,"teacher_disagreement_score":0.9966968,"about_ca_system_score_codex":0.0018679883,"about_ca_system_score_gemma":0.0021014991,"threshold_uncertainty_score":0.043378294},"labels":[],"label_agreement":null},{"id":"W4392089263","doi":"10.1017/9781846151231.009","title":"Stylometry and the Provenance of De doctrina christiana","year":2002,"lang":"en","type":"other","venue":"","topic":"Authorship Attribution and Profiling","field":"Computer Science","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":true,"ca_institutions":"","funders":"","keywords":"Provenance; Stylometry; Philosophy; Geology; Linguistics; Paleontology","score_opus":0.011173137565753992,"score_gpt":0.23192256387562757,"score_spread":0.22074942630987357,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4392089263","genre_codex":"other","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.18321116,0.00701288,0.019574672,0.023359219,0.0016262928,0.00011041133,0.0002198562,0.00016985314,0.7647155],"genre_scores_gemma":[0.9843001,0.00068785064,0.0017396226,0.00061607047,0.00023757295,0.000028588567,0.000045381912,0.000060665196,0.012284111],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9911032,0.005075768,0.0004802981,0.0009304763,0.001851392,0.0005589149],"domain_scores_gemma":[0.9821063,0.011613652,0.0017319109,0.0023178556,0.0019715107,0.0002587399],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0070657223,0.0003601034,0.00039375233,0.003414922,0.00739783,0.00904054,0.0008680769,0.0020618485,0.004728127],"category_scores_gemma":[0.03178284,0.00041422964,0.00022286172,0.0028649794,0.027302805,0.00631341,0.004500992,0.0036506527,0.00063929684],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.000021126976,0.0000040471627,0.00056196697,0.000037389273,0.0000024846165,0.00007590577,0.017645929,0.000062618055,0.0001852953,0.97456974,0.0020681883,0.0047653234],"study_design_scores_gemma":[0.000025829637,0.00004000069,0.0040098852,0.0005638839,0.000019702731,0.00039092696,0.014916607,0.0008730312,0.001423933,0.67768896,0.29999736,0.00004988184],"about_ca_topic_score_codex":0.0053374884,"about_ca_topic_score_gemma":0.0067082974,"teacher_disagreement_score":0.00904054,"about_ca_system_score_codex":0.005284737,"about_ca_system_score_gemma":0.0029903117,"threshold_uncertainty_score":0.038343668},"labels":[],"label_agreement":null},{"id":"W4392238204","doi":"10.3390/info15030131","title":"Authorship Attribution Methods, Challenges, and Future Research Directions: A Comprehensive Survey","year":2024,"lang":"en","type":"article","venue":"Information","topic":"Authorship Attribution and Profiling","field":"Computer Science","cited_by":29,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Toronto; York University","funders":"York University","keywords":"Attribution; Data science; Authorship attribution; Survey research; Computer science; Psychology; Applied psychology; Natural language processing; Social psychology","score_opus":0.255335490359698,"score_gpt":0.44398692601731843,"score_spread":0.18865143565762044,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4392238204","genre_codex":"review","genre_gemma":"review","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"review","genre_consensus":"review","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.07190178,0.43029377,0.3960884,0.0363596,0.0058245393,0.00095356914,0.011591125,0.004818629,0.042168636],"genre_scores_gemma":[0.5361188,0.23209907,0.18807577,0.0038551711,0.00945791,0.0011173828,0.017774602,0.0013355357,0.010165783],"study_design_codex":"design_other","study_design_gemma":"not_applicable","domain_scores_codex":[0.94926345,0.022901552,0.006420431,0.007009729,0.013250786,0.0011540647],"domain_scores_gemma":[0.6294324,0.2923003,0.017968982,0.029159816,0.028041814,0.0030966545],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.047432207,0.001919125,0.002627963,0.024166448,0.0033970822,0.01235876,0.003784343,0.0031117734,0.005698478],"category_scores_gemma":[0.23356967,0.00080360175,0.0013127658,0.030376531,0.003285546,0.02341585,0.0040062363,0.0030278782,0.0041958434],"study_design_candidate":"not_applicable","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00014115294,0.00014143859,0.03843274,0.004617826,0.00018040276,0.000082113744,0.0018622266,0.0030751014,0.00038566755,0.030378181,0.032604646,0.8880986],"study_design_scores_gemma":[0.00009473289,0.00023782052,0.051376875,0.013489205,0.00041634403,0.0031422246,0.010986881,0.07617706,0.0057323244,0.31283295,0.5249836,0.0005299714],"about_ca_topic_score_codex":0.001695486,"about_ca_topic_score_gemma":0.001433064,"teacher_disagreement_score":0.047432207,"about_ca_system_score_codex":0.0026345942,"about_ca_system_score_gemma":0.0038098542,"threshold_uncertainty_score":0.25084847},"labels":[],"label_agreement":null},{"id":"W4392429446","doi":"10.18280/ijsse.140116","title":"Evaluating Performances of Two Unsupervised Methods for Classification Crime Text","year":2024,"lang":"en","type":"article","venue":"International Journal of Safety and Security Engineering","topic":"Authorship Attribution and Profiling","field":"Computer Science","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":true,"route_about_ca":false,"ca_institutions":"","funders":"","keywords":"Computer science; Unsupervised learning; Artificial intelligence; Machine learning","score_opus":0.07175711281042822,"score_gpt":0.4285877179085139,"score_spread":0.3568306050980857,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4392429446","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.82916564,0.0031964313,0.14999674,0.00053232384,0.00087750715,0.00074551196,0.0026948242,0.007390744,0.0054003373],"genre_scores_gemma":[0.808189,0.0007278383,0.17481953,0.00018646107,0.00023449544,0.00050150993,0.010459165,0.00023733158,0.0046446086],"study_design_codex":"design_other","study_design_gemma":"bench_or_experimental","domain_scores_codex":[0.996894,0.0008404577,0.0003514884,0.00091476284,0.0006924488,0.00030670085],"domain_scores_gemma":[0.9930427,0.0036850239,0.00046192505,0.00054836913,0.0019627835,0.00029922696],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0038376863,0.0021645897,0.001302145,0.003974861,0.0009711675,0.0014257487,0.0014317278,0.0020241733,0.0008281738],"category_scores_gemma":[0.009391636,0.0002822326,0.0010989828,0.001744487,0.0005404874,0.0014551544,0.0010046962,0.0011024782,0.0010580372],"study_design_candidate":"bench_or_experimental","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.002702297,0.002296554,0.03223246,0.0008509279,0.00082655315,0.0003050503,0.00046349582,0.0707877,0.029393574,0.000928439,0.011528333,0.8476846],"study_design_scores_gemma":[0.000089865825,0.00069306605,0.024362748,0.000051009632,0.00017031368,0.00025668525,0.00044857728,0.9365178,0.034182206,0.00066667335,0.0024894876,0.00007155605],"about_ca_topic_score_codex":0.010668695,"about_ca_topic_score_gemma":0.012513286,"teacher_disagreement_score":0.010668695,"about_ca_system_score_codex":0.0010519259,"about_ca_system_score_gemma":0.0015751934,"threshold_uncertainty_score":0.021213174},"labels":[],"label_agreement":null},{"id":"W4399733006","doi":"10.22148/001c.116239","title":"Two translations of Mahfouz’s _Awlad Haratina_ (Children of our Alley): A computational-stylistic analysis","year":2024,"lang":"en","type":"article","venue":"Journal of Cultural Analytics","topic":"Authorship Attribution and Profiling","field":"Computer Science","cited_by":1,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":true,"route_about_ca":false,"ca_institutions":"","funders":"","keywords":"Variety (cybernetics); Readability; Linguistics; Style (visual arts); Context (archaeology); Alley; Computer science; Sentence; Natural language processing; Artificial intelligence; Literature; History; Art; Philosophy","score_opus":0.041846418159801196,"score_gpt":0.34727249025675117,"score_spread":0.30542607209694994,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4399733006","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.97146004,0.0004923243,0.002688946,0.0014002041,0.00008947903,0.000041071675,0.00039127417,0.000027473738,0.023409097],"genre_scores_gemma":[0.9927291,0.00022919344,0.0038864256,0.00008125593,0.000016990976,0.00003087285,0.00018414856,0.000026422413,0.002815535],"study_design_codex":"qualitative","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.99942386,0.00028430423,0.000031757907,0.00007778161,0.00014317913,0.00003901263],"domain_scores_gemma":[0.9985776,0.0009612567,0.00013805018,0.000101297446,0.00018084557,0.000040887688],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0008172679,0.00034175918,0.00023860106,0.0011320809,0.0016199304,0.0013527065,0.00029378542,0.0004677831,0.003403324],"category_scores_gemma":[0.003916213,0.00010740435,0.00014780971,0.000933256,0.0021485076,0.0009502088,0.0008557922,0.00075492414,0.0003380553],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0006840788,0.00014640238,0.022180028,0.0005017353,0.00005409213,0.0070449123,0.72949594,0.00072016165,0.016107501,0.11438994,0.008068297,0.10060701],"study_design_scores_gemma":[0.00009791217,0.00042027427,0.13255751,0.00044197505,0.000059961345,0.0074025365,0.529903,0.0033763403,0.01835722,0.020672323,0.28657416,0.00013686271],"about_ca_topic_score_codex":0.00432484,"about_ca_topic_score_gemma":0.009237122,"teacher_disagreement_score":0.00432484,"about_ca_system_score_codex":0.0019142622,"about_ca_system_score_gemma":0.00062609033,"threshold_uncertainty_score":0.013889015},"labels":[],"label_agreement":null},{"id":"W4400055409","doi":"10.5430/wjel.v14n6p111","title":"A Systematic Literature Review on Academic Title Studies in Genre Analysis","year":2024,"lang":"en","type":"article","venue":"World Journal of English Language","topic":"Authorship Attribution and Profiling","field":"Computer Science","cited_by":1,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":true,"route_about_ca":false,"ca_institutions":"","funders":"","keywords":"Computer science; Systematic review; Political science; MEDLINE","score_opus":0.0323986002709801,"score_gpt":0.35589722505311583,"score_spread":0.32349862478213576,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4400055409","genre_codex":"review","genre_gemma":"review","domain_codex":null,"domain_gemma":"reporting","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"review","genre_consensus":"review","domain_candidate":"reporting","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0022920342,0.99256176,0.0010455144,0.00082011224,0.0005116405,0.00069993513,0.00091208,0.000023629877,0.0011333431],"genre_scores_gemma":[0.021538831,0.969716,0.0038395773,0.0011683332,0.00034829395,0.0021611229,0.00089620694,0.000024335202,0.00030732274],"study_design_codex":"systematic_review","study_design_gemma":"systematic_review","domain_scores_codex":[0.96725386,0.012593443,0.012399966,0.001993992,0.0051798206,0.0005788495],"domain_scores_gemma":[0.8031534,0.15416904,0.020955568,0.0035013943,0.016413732,0.0018068114],"candidate_categories":["metaresearch","bibliometrics"],"consensus_categories":[],"category_scores_codex":[0.033026446,0.0015263938,0.0057206945,0.051742017,0.0016786787,0.005326367,0.0022907383,0.002311952,0.008287216],"category_scores_gemma":[0.18069471,0.0012612423,0.005237691,0.038267683,0.0023407359,0.007627325,0.003939301,0.001783943,0.0010154833],"study_design_candidate":"systematic_review","study_design_consensus":"systematic_review","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00012724943,0.000033090157,0.0013260681,0.8882088,0.0015338521,0.00014344882,0.0014662775,0.00007532681,0.0002483386,0.0008994048,0.0035540108,0.10238418],"study_design_scores_gemma":[0.000059765942,0.00010316284,0.002710975,0.9538257,0.0061710975,0.00025984575,0.0013367903,0.000042983385,0.00014536253,0.0006977904,0.034619156,0.000027386937],"about_ca_topic_score_codex":0.0052244808,"about_ca_topic_score_gemma":0.017085157,"teacher_disagreement_score":0.96697354,"about_ca_system_score_codex":0.005665074,"about_ca_system_score_gemma":0.026797038,"threshold_uncertainty_score":0.17466259},"labels":[],"label_agreement":null},{"id":"W4400221730","doi":"10.48550/arxiv.2406.19896","title":"AuthAttLyzer-V2: Unveiling Code Authorship Attribution using Enhanced Ensemble Learning Models &amp; Generating Benchmark Dataset","year":2024,"lang":"en","type":"preprint","venue":"arXiv (Cornell University)","topic":"Authorship Attribution and Profiling","field":"Computer Science","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"","funders":"Mitacs","keywords":"Benchmark (surveying); Ensemble learning; Code (set theory); Computer science; Artificial intelligence; Attribution; Authorship attribution; Natural language processing; Machine learning; Psychology; Programming language; Geography; Cartography","score_opus":0.2650517305723782,"score_gpt":0.26803202299511214,"score_spread":0.0029802924227339544,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4400221730","genre_codex":"empirical","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.68728495,0.003487567,0.07221731,0.0015383215,0.001578393,0.0011142768,0.16995648,0.05077553,0.012047147],"genre_scores_gemma":[0.41798073,0.00055833865,0.11281106,0.000373178,0.0002129023,0.0007774026,0.45609194,0.0014449838,0.009749456],"study_design_codex":"not_applicable","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9976162,0.00056330586,0.00018358715,0.00071836746,0.0006526675,0.00026585616],"domain_scores_gemma":[0.99422896,0.0017576877,0.0003506788,0.0018802366,0.0014798807,0.0003025183],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0035177679,0.002338056,0.00083167834,0.0058193803,0.0011873969,0.0015353697,0.0022888691,0.0019605397,0.0019406694],"category_scores_gemma":[0.008554515,0.00039067387,0.0014222594,0.0032197193,0.00078072224,0.0016852844,0.001978613,0.002147782,0.0028032789],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.001079588,0.0021208401,0.07938714,0.0012068774,0.0008016431,0.00094611244,0.0006324613,0.11422389,0.011307222,0.0033302873,0.39535138,0.38961253],"study_design_scores_gemma":[0.0003929101,0.00094889576,0.04500037,0.0001810818,0.00018315659,0.0009911063,0.00058179576,0.82146615,0.030398762,0.0062204357,0.093474224,0.00016120823],"about_ca_topic_score_codex":0.014997205,"about_ca_topic_score_gemma":0.028037436,"teacher_disagreement_score":0.014997205,"about_ca_system_score_codex":0.0012239517,"about_ca_system_score_gemma":0.0014438432,"threshold_uncertainty_score":0.029819846},"labels":[],"label_agreement":null},{"id":"W4400477472","doi":"10.2139/ssrn.4889071","title":"How to Tame Pre-Trained Transformers for Authorship Verification","year":2024,"lang":"en","type":"preprint","venue":"SSRN Electronic Journal","topic":"Authorship Attribution and Profiling","field":"Computer Science","cited_by":0,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"McGill University","funders":"","keywords":"Transformer; Computer science; Engineering; Electrical engineering","score_opus":0.027900667957119634,"score_gpt":0.3012856244737458,"score_spread":0.27338495651662614,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4400477472","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.02820032,0.000598426,0.9444496,0.002533901,0.0008277549,0.00031226827,0.00082195573,0.01827857,0.003977219],"genre_scores_gemma":[0.6750035,0.0004528268,0.31094897,0.00093184185,0.00037681643,0.0003507224,0.0014290939,0.0025063113,0.0079998495],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9836256,0.006006623,0.0013915006,0.0026443186,0.0045146835,0.0018173261],"domain_scores_gemma":[0.93418777,0.024347557,0.0028683136,0.03079296,0.006829961,0.00097350526],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.008204085,0.0013890887,0.0019346514,0.0024651003,0.0016633722,0.0057292418,0.0023383675,0.003001806,0.012317528],"category_scores_gemma":[0.08190966,0.0014592627,0.0018946041,0.0020506673,0.0026183522,0.01604772,0.0066753556,0.0049457983,0.011248013],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0014219913,0.0004405264,0.012706892,0.0009390716,0.0003657247,0.00069675985,0.0016131198,0.018620528,0.04586435,0.1784857,0.041153796,0.6976915],"study_design_scores_gemma":[0.00019084803,0.00035673237,0.0019465515,0.0002756422,0.00020584883,0.0012615368,0.0009738714,0.2199241,0.12637715,0.61731046,0.03094124,0.00023596013],"about_ca_topic_score_codex":0.0008740179,"about_ca_topic_score_gemma":0.0015206966,"teacher_disagreement_score":0.012317528,"about_ca_system_score_codex":0.0012132198,"about_ca_system_score_gemma":0.0038342443,"threshold_uncertainty_score":0.04338789},"labels":[],"label_agreement":null},{"id":"W4400678062","doi":"10.1162/tacl_a_00678","title":"Can Authorship Attribution Models Distinguish Speakers in Speech Transcripts?","year":2024,"lang":"en","type":"article","venue":"Transactions of the Association for Computational Linguistics","topic":"Authorship Attribution and Profiling","field":"Computer Science","cited_by":4,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Université du Québec à Montréal","funders":"","keywords":"Computer science; Conversation; Punctuation; Natural language processing; Benchmark (surveying); Attribution; Spurious relationship; Task (project management); Speech recognition; Artificial intelligence; Transcription (linguistics); Suite; Construct (python library); Linguistics; Psychology; Machine learning; Communication","score_opus":0.04126170943162795,"score_gpt":0.2890382353474506,"score_spread":0.24777652591582267,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4400678062","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.8448912,0.0016605292,0.13959296,0.0017312586,0.00065347424,0.0001889277,0.001261804,0.0032727038,0.0067471177],"genre_scores_gemma":[0.9809574,0.00014521628,0.01593953,0.00008231399,0.00009870767,0.00004732312,0.0010239439,0.00006876824,0.0016369201],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.996847,0.0018604875,0.00013944869,0.0007048766,0.00023607955,0.00021215098],"domain_scores_gemma":[0.98155826,0.012979657,0.001382747,0.0020802277,0.0014887119,0.00051039003],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0061521926,0.0009932863,0.0007322036,0.0011320016,0.0006508416,0.0021661506,0.0011947823,0.001494875,0.0024723292],"category_scores_gemma":[0.032604992,0.00030200556,0.0005922641,0.0007048139,0.0006858785,0.0026388804,0.0013314277,0.002200357,0.0022153796],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0027788193,0.0010152046,0.060067367,0.00053297443,0.00041975908,0.00041588445,0.0020830624,0.15149352,0.028828938,0.002285995,0.008552332,0.7415262],"study_design_scores_gemma":[0.000040422903,0.00017811928,0.0090336315,0.00006784711,0.00006738426,0.0001092492,0.00056220696,0.9691664,0.013128548,0.0064336974,0.001168805,0.00004370304],"about_ca_topic_score_codex":0.002441399,"about_ca_topic_score_gemma":0.002510987,"teacher_disagreement_score":0.0061521926,"about_ca_system_score_codex":0.0006568084,"about_ca_system_score_gemma":0.0007589965,"threshold_uncertainty_score":0.032536328},"labels":[],"label_agreement":null},{"id":"W4400853529","doi":"10.1145/3669901","title":"VeriBin: A Malware Authorship Verification Approach for APT Tracking through Explainable and Functionality-Debiasing Adversarial Representation Learning","year":2024,"lang":"en","type":"article","venue":"ACM Transactions on Privacy and Security","topic":"Authorship Attribution and Profiling","field":"Computer Science","cited_by":4,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Queen's University","funders":"","keywords":"Debiasing; Adversarial system; Computer science; Representation (politics); Malware; Artificial intelligence; Tracking (education); Machine learning; Computer security; Psychology; Cognitive science","score_opus":0.09003985377664396,"score_gpt":0.32869121276999214,"score_spread":0.23865135899334816,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4400853529","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.07489746,0.001468281,0.8898403,0.00096664816,0.00027210626,0.00031210584,0.0017026991,0.024148092,0.0063922266],"genre_scores_gemma":[0.7286291,0.0005370795,0.24931549,0.0010074271,0.00014419178,0.00030264579,0.005650228,0.00079253694,0.013621284],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9990466,0.00025055185,0.000047823996,0.00029086735,0.0002525177,0.00011153727],"domain_scores_gemma":[0.99708456,0.0013338983,0.00027293822,0.00088055135,0.00032154156,0.00010658336],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.001602707,0.0013863768,0.00076626905,0.0014469739,0.00054675626,0.001221596,0.0024712898,0.0018986751,0.004073974],"category_scores_gemma":[0.00667807,0.00045727973,0.001108275,0.0007668622,0.001051656,0.0028867384,0.002222086,0.0025881825,0.0017615309],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00043688292,0.00032519418,0.0063468935,0.0003169542,0.00017721842,0.00034661035,0.0002820821,0.2982826,0.011797774,0.013950394,0.020882893,0.6468546],"study_design_scores_gemma":[0.000014724733,0.00005051276,0.0003940804,0.00001821219,0.000011780988,0.00008328853,0.000019135949,0.9865043,0.0029194842,0.007983786,0.0019881148,0.000012643253],"about_ca_topic_score_codex":0.0032364908,"about_ca_topic_score_gemma":0.0055711213,"teacher_disagreement_score":0.004073974,"about_ca_system_score_codex":0.0015401028,"about_ca_system_score_gemma":0.0010824291,"threshold_uncertainty_score":0.01362884},"labels":[],"label_agreement":null},{"id":"W4404033128","doi":"10.1016/j.eswa.2024.125643","title":"AuthorNet: Leveraging attention-based early fusion of transformers for low-resource authorship attribution","year":2024,"lang":"en","type":"article","venue":"Expert Systems with Applications","topic":"Authorship Attribution and Profiling","field":"Computer Science","cited_by":8,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Athabasca University; York University","funders":"","keywords":"Computer science; Attribution; Transformer; Fusion; Resource (disambiguation); Artificial intelligence; Psychology; Linguistics; Electrical engineering; Engineering; Social psychology","score_opus":0.028416718557299034,"score_gpt":0.2835948748019529,"score_spread":0.25517815624465384,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4404033128","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.04453895,0.0028317494,0.9009433,0.00088636857,0.0011304729,0.00024390577,0.005784365,0.03668801,0.006952922],"genre_scores_gemma":[0.64920074,0.0014387639,0.319355,0.0004158846,0.0009743755,0.00022072998,0.014470157,0.0018945753,0.01202974],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.99637324,0.0007689222,0.0003756337,0.0010013374,0.0011112711,0.00036950334],"domain_scores_gemma":[0.986668,0.0063386816,0.00095779664,0.002767425,0.0025675225,0.00070056895],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.003507828,0.0018614702,0.001512113,0.009539934,0.0010014543,0.0030975991,0.0021535105,0.0017622396,0.0068068416],"category_scores_gemma":[0.021651115,0.0004975729,0.0010095331,0.0069446573,0.0005764983,0.006647848,0.0038501443,0.0017049033,0.006960374],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00087877404,0.00042764642,0.010011385,0.00043666817,0.00016584394,0.00036242206,0.00038813558,0.010219563,0.016177801,0.01014469,0.039817397,0.9109697],"study_design_scores_gemma":[0.0001004988,0.0002598178,0.0051415656,0.0001234719,0.00022477638,0.00068529753,0.00028047775,0.7962707,0.047457103,0.11892128,0.030403204,0.00013178721],"about_ca_topic_score_codex":0.002641688,"about_ca_topic_score_gemma":0.0075680204,"teacher_disagreement_score":0.009539934,"about_ca_system_score_codex":0.00087979564,"about_ca_system_score_gemma":0.0019806498,"threshold_uncertainty_score":0.02277118},"labels":[],"label_agreement":null},{"id":"W4409507688","doi":"10.1007/978-3-031-85856-7_13","title":"AuthAttLyzer-V2: Unveiling Code Authorship Attribution Using Enhanced Ensemble Learning Models and Generating Benchmark Dataset","year":2025,"lang":"en","type":"book-chapter","venue":"Communications in computer and information science","topic":"Authorship Attribution and Profiling","field":"Computer Science","cited_by":0,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"York University","funders":"","keywords":"Benchmark (surveying); Computer science; Attribution; Code (set theory); Artificial intelligence; Authorship attribution; Natural language processing; Ensemble learning; Information retrieval; Machine learning; Programming language; Psychology; Cartography; Geography","score_opus":0.12797304388066152,"score_gpt":0.34642177946470937,"score_spread":0.21844873558404784,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4409507688","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.3952427,0.0036781125,0.24665906,0.0021718037,0.004063913,0.0013596667,0.18530662,0.13528179,0.026236396],"genre_scores_gemma":[0.25577298,0.00058468536,0.27092105,0.00066214113,0.0002947273,0.0008921221,0.44325748,0.0047262735,0.022888564],"study_design_codex":"not_applicable","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9976922,0.0006301562,0.00012028381,0.0006613573,0.0006405477,0.0002554167],"domain_scores_gemma":[0.9954389,0.0012686834,0.00015452836,0.0017716107,0.0010998969,0.0002664905],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0029397965,0.002559097,0.0009941331,0.0038500456,0.0012495368,0.001868728,0.0025551172,0.0019749948,0.0052144607],"category_scores_gemma":[0.008833375,0.00051765743,0.0015376161,0.0026842824,0.00055189076,0.0019890366,0.0024151169,0.0023420702,0.0068986546],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0007257421,0.0012066902,0.016951578,0.00056510046,0.00038073174,0.0002941855,0.00023451359,0.051482704,0.008919076,0.0030507569,0.5566112,0.35957778],"study_design_scores_gemma":[0.00032299725,0.0005883594,0.012733191,0.00017061015,0.00018359232,0.0005677635,0.0004406377,0.8400486,0.037682727,0.0147708235,0.09233581,0.00015484546],"about_ca_topic_score_codex":0.010909122,"about_ca_topic_score_gemma":0.026220756,"teacher_disagreement_score":0.010909122,"about_ca_system_score_codex":0.001003523,"about_ca_system_score_gemma":0.0015659252,"threshold_uncertainty_score":0.021691203},"labels":[],"label_agreement":null},{"id":"W4409607517","doi":"10.1007/s11633-025-1544-6","title":"A Survey on Writing Style Change Detection: Current Literature and Future Directions","year":2025,"lang":"en","type":"article","venue":"Machine Intelligence Research","topic":"Authorship Attribution and Profiling","field":"Computer Science","cited_by":2,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Carleton University","funders":"","keywords":"Style (visual arts); Current (fluid); Computer science; Literature; Art; Engineering; Electrical engineering","score_opus":0.1434732038025608,"score_gpt":0.4419046323953721,"score_spread":0.2984314285928113,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4409607517","genre_codex":"review","genre_gemma":"review","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"review","genre_consensus":"review","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.15966989,0.70648,0.079306744,0.010085337,0.0036045697,0.0005217631,0.0073392685,0.0029323886,0.030060075],"genre_scores_gemma":[0.4286309,0.4462235,0.08978129,0.0033431875,0.00838235,0.00064356136,0.012673382,0.00051643647,0.009805491],"study_design_codex":"design_other","study_design_gemma":"not_applicable","domain_scores_codex":[0.9943076,0.0013605633,0.0010114937,0.0014689629,0.0016072962,0.00024405726],"domain_scores_gemma":[0.90615886,0.06856137,0.007733819,0.003769378,0.012255569,0.0015210212],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.006805053,0.001094029,0.002236415,0.01561525,0.00086813484,0.004702825,0.001797385,0.0010689512,0.0044234428],"category_scores_gemma":[0.0488706,0.0004618761,0.0009496409,0.013846025,0.0008073047,0.0060781445,0.0010780314,0.0011834804,0.0027049861],"study_design_candidate":"not_applicable","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.000118720054,0.00016447568,0.04398757,0.0043833884,0.00009268837,0.000049890645,0.0004294418,0.0002459899,0.0008718273,0.0011281627,0.009925342,0.9386025],"study_design_scores_gemma":[0.00013390332,0.0014772181,0.37655896,0.026001208,0.0019243106,0.0057710437,0.009577487,0.034392845,0.020825267,0.03843959,0.48424298,0.00065519405],"about_ca_topic_score_codex":0.00090974994,"about_ca_topic_score_gemma":0.0014696677,"teacher_disagreement_score":0.01561525,"about_ca_system_score_codex":0.0005274591,"about_ca_system_score_gemma":0.001510241,"threshold_uncertainty_score":0.035988986},"labels":[],"label_agreement":null},{"id":"W4410495496","doi":"10.12688/openreseurope.19346.3","title":"A phylogenetic classification of the Je language family","year":2025,"lang":"en","type":"article","venue":"Open Research Europe","topic":"Authorship Attribution and Profiling","field":"Computer Science","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Winnipeg","funders":"Horizon 2020 Framework Programme","keywords":"Phylogenetic tree; Natural language processing; Biology; Evolutionary biology; Linguistics; Artificial intelligence; Genealogy; Computer science; History; Genetics; Philosophy; Gene","score_opus":0.2000083223426046,"score_gpt":0.448017637829913,"score_spread":0.2480093154873084,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4410495496","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.93160236,0.0010603277,0.013768667,0.0009275238,0.00005227838,0.00017481107,0.022831256,0.00024963895,0.029333005],"genre_scores_gemma":[0.9577188,0.0003852764,0.018224876,0.00010088673,0.000017333767,0.00017631611,0.019307561,0.00011847502,0.0039504315],"study_design_codex":"observational","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.99941397,0.00016727966,0.00005877604,0.0001367228,0.00010842866,0.00011489915],"domain_scores_gemma":[0.9963792,0.0016423997,0.00042103906,0.000426586,0.0009106413,0.00022012606],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0013293821,0.000182384,0.00022429443,0.004846295,0.0012347802,0.0014530226,0.0004629093,0.0002785401,0.013642905],"category_scores_gemma":[0.0073319487,0.00011107401,0.00024865102,0.0048109028,0.00086803606,0.0010843028,0.0011686166,0.00046594825,0.0023565006],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00078245986,0.00010812605,0.57111067,0.0009015889,0.00011649022,0.0009781383,0.01961183,0.002459782,0.020280907,0.043728296,0.034375247,0.30554646],"study_design_scores_gemma":[0.00005373567,0.00012863033,0.76481014,0.00091018097,0.00009695471,0.002175145,0.03098293,0.016207783,0.003866034,0.026682938,0.15399584,0.000089723966],"about_ca_topic_score_codex":0.010800823,"about_ca_topic_score_gemma":0.014024545,"teacher_disagreement_score":0.013642905,"about_ca_system_score_codex":0.00074029894,"about_ca_system_score_gemma":0.0012846084,"threshold_uncertainty_score":0.04564005},"labels":[],"label_agreement":null},{"id":"W4410843495","doi":"10.31234/osf.io/fzhw3_v2","title":"What makes a novel timeless?","year":2025,"lang":"en","type":"preprint","venue":"","topic":"Authorship Attribution and Profiling","field":"Computer Science","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"","funders":"Social Sciences and Humanities Research Council of Canada; Natural Sciences and Engineering Research Council of Canada; York University","keywords":"Timeless; Computer science; Psychology; Neuroscience; Circadian rhythm","score_opus":0.05882943373229568,"score_gpt":0.32436641826445,"score_spread":0.26553698453215435,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4410843495","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.8889572,0.0042783567,0.01576059,0.009737089,0.0017531249,0.00006243753,0.0049672183,0.00046100124,0.07402297],"genre_scores_gemma":[0.97810113,0.0013743715,0.005819741,0.0005555161,0.00043670918,0.000024609406,0.0023211075,0.00015791341,0.011208947],"study_design_codex":"design_other","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.9991454,0.00016490629,0.000068779234,0.00032173478,0.00023840448,0.00006073649],"domain_scores_gemma":[0.99398994,0.0026120883,0.001573144,0.00088557357,0.00055810047,0.00038123148],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.001155368,0.0002637722,0.00028182412,0.0014745931,0.0014442661,0.0033826514,0.00060883304,0.00082604703,0.009378368],"category_scores_gemma":[0.014239128,0.00027248278,0.00027865087,0.001812444,0.0018896611,0.0075372616,0.00081518653,0.0010840208,0.0017799514],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0018577444,0.00032871292,0.2293632,0.0014368652,0.00024490524,0.0047518588,0.024007171,0.002686045,0.018330371,0.11515461,0.0814483,0.5203902],"study_design_scores_gemma":[0.00008063978,0.00027935643,0.24974923,0.0007754449,0.00020589773,0.009551581,0.020528011,0.019804776,0.017074129,0.105488874,0.5762599,0.00020218584],"about_ca_topic_score_codex":0.0013132046,"about_ca_topic_score_gemma":0.002283886,"teacher_disagreement_score":0.009378368,"about_ca_system_score_codex":0.0009406212,"about_ca_system_score_gemma":0.00045452322,"threshold_uncertainty_score":0.0313738},"labels":[],"label_agreement":null},{"id":"W4410843496","doi":"10.31234/osf.io/fzhw3_v1","title":"What makes a novel timeless?","year":2025,"lang":"en","type":"preprint","venue":"","topic":"Authorship Attribution and Profiling","field":"Computer Science","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"","funders":"Social Sciences and Humanities Research Council of Canada; Natural Sciences and Engineering Research Council of Canada; York University","keywords":"Timeless; Computer science; Neuroscience; Psychology; Circadian rhythm","score_opus":0.05882943373229568,"score_gpt":0.32436641826445,"score_spread":0.26553698453215435,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4410843496","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.9270927,0.0034479368,0.011180525,0.006784549,0.0015734134,0.0000432215,0.0034178372,0.0003582814,0.046101592],"genre_scores_gemma":[0.9843481,0.0013464973,0.0046243425,0.00048512447,0.0004244023,0.000021154163,0.0019207724,0.00016356581,0.006666017],"study_design_codex":"design_other","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.99907625,0.0001612417,0.0000840963,0.00038009102,0.00023995175,0.000058322068],"domain_scores_gemma":[0.99273974,0.0029487333,0.0021384798,0.00099593,0.0006575809,0.0005195242],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0012241785,0.00025551044,0.0003113164,0.0015396856,0.0014128052,0.003585624,0.0006130113,0.0007385697,0.0059647146],"category_scores_gemma":[0.015764683,0.00028524775,0.00030021768,0.0019134999,0.0021130333,0.0077512707,0.00086027425,0.0010619164,0.0014549881],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0019158511,0.00031501055,0.33062592,0.0013407107,0.000294321,0.006519444,0.025243195,0.0028700465,0.018775223,0.083845556,0.056295756,0.47195902],"study_design_scores_gemma":[0.000081229504,0.00036573084,0.3336699,0.0008375264,0.00025824422,0.01392151,0.023424294,0.019409979,0.01706035,0.11630135,0.47444698,0.00022288949],"about_ca_topic_score_codex":0.0012096668,"about_ca_topic_score_gemma":0.0018518849,"teacher_disagreement_score":0.0059647146,"about_ca_system_score_codex":0.00096779334,"about_ca_system_score_gemma":0.00049667445,"threshold_uncertainty_score":0.019954026},"labels":[],"label_agreement":null},{"id":"W4415117642","doi":"10.1075/cilt.370.11juo","title":"A comparative analysis of stylometry and authorship attribution in a creole and non-creole language","year":2025,"lang":"en","type":"book-chapter","venue":"Amsterdam studies in the theory and history of linguistic science. Series 4, Current issues in linguistic theory","topic":"Authorship Attribution and Profiling","field":"Computer Science","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":true,"ca_institutions":"","funders":"","keywords":"Stylometry; Authorship attribution; Creole language; Variety (cybernetics); Variation (astronomy); Corpus linguistics; Computational linguistics","score_opus":0.058842618422352444,"score_gpt":0.37148976058637057,"score_spread":0.3126471421640181,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4415117642","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.9923355,0.0002554203,0.0027499099,0.00006645078,0.000014239858,0.00001852759,0.0002846242,0.00006900306,0.0042064087],"genre_scores_gemma":[0.9961687,0.00007029866,0.0020877046,0.00001141005,0.000007994959,0.000009987306,0.00037547277,0.000017746559,0.0012507354],"study_design_codex":"observational","study_design_gemma":"observational","domain_scores_codex":[0.9986337,0.00080544193,0.00006124128,0.00020506053,0.00020519315,0.000089360656],"domain_scores_gemma":[0.98416024,0.012969697,0.0007865782,0.000650251,0.0011204075,0.00031287133],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0021286712,0.00022591832,0.0003043648,0.0037363837,0.00072153157,0.0016442391,0.00028630625,0.00031957112,0.002282661],"category_scores_gemma":[0.010845896,0.00008825856,0.00014455481,0.002817489,0.00075837475,0.0008949135,0.00071363966,0.00030036367,0.0005031166],"study_design_candidate":"observational","study_design_consensus":"observational","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00079434627,0.00025161577,0.530843,0.00044251658,0.00012885817,0.0010504703,0.06883395,0.0021744776,0.042993452,0.0076603102,0.0066009616,0.33822608],"study_design_scores_gemma":[0.000024512456,0.00023520412,0.9040548,0.00011510246,0.000044362325,0.0011338624,0.025280964,0.03632985,0.0131322965,0.0043633133,0.015189883,0.00009580654],"about_ca_topic_score_codex":0.004641837,"about_ca_topic_score_gemma":0.0101339165,"teacher_disagreement_score":0.004641837,"about_ca_system_score_codex":0.0006821387,"about_ca_system_score_gemma":0.00034093263,"threshold_uncertainty_score":0.0112576485},"labels":[],"label_agreement":null},{"id":"W4416034840","doi":"10.18653/v1/2025.findings-emnlp.609","title":"How Sampling Affects the Detectability of Machine-written texts: A Comprehensive Study","year":2025,"lang":"en","type":"article","venue":"","topic":"Authorship Attribution and Profiling","field":"Computer Science","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"","funders":"","keywords":"Sampling (signal processing); Noise (video); Measure (data warehouse)","score_opus":0.04284217487403143,"score_gpt":0.31601130455223037,"score_spread":0.27316912967819895,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4416034840","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.87514144,0.0061640977,0.08705365,0.0012327818,0.00056052726,0.00028677323,0.007707919,0.014198811,0.0076539805],"genre_scores_gemma":[0.94606096,0.00072740763,0.032561682,0.00032873117,0.0001935021,0.00013343059,0.016420094,0.0017750494,0.0017991223],"study_design_codex":"design_other","study_design_gemma":"not_applicable","domain_scores_codex":[0.9885139,0.0053937933,0.001014153,0.0024428063,0.0022274621,0.0004079383],"domain_scores_gemma":[0.88800704,0.08563604,0.0044462467,0.01298436,0.007698101,0.0012281633],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.01184742,0.0014849309,0.0011779122,0.0034928252,0.0013293404,0.0034922182,0.0012002713,0.0014559563,0.0015718365],"category_scores_gemma":[0.09533055,0.00047894943,0.0009576392,0.0021714289,0.0016209439,0.0051650302,0.0022418513,0.0021029788,0.0029369255],"study_design_candidate":"not_applicable","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0025600332,0.0007245722,0.20372218,0.002760239,0.00092634175,0.0013386651,0.00427149,0.043205366,0.0449326,0.0041557904,0.050446287,0.64095646],"study_design_scores_gemma":[0.00033842347,0.0017617047,0.16470742,0.0007300131,0.0007155377,0.0049879965,0.0034307183,0.57408816,0.16809015,0.028629238,0.05197115,0.00054954446],"about_ca_topic_score_codex":0.0030290126,"about_ca_topic_score_gemma":0.004122584,"teacher_disagreement_score":0.01184742,"about_ca_system_score_codex":0.0007796223,"about_ca_system_score_gemma":0.0009930701,"threshold_uncertainty_score":0.062655926},"labels":[],"label_agreement":null},{"id":"W4416338528","doi":"10.18280/isi.300914","title":"A Systematic Review of Machine Learning Methods for Movie Genre Classification and Age-Appropriateness Prediction","year":2025,"lang":"","type":"article","venue":"Ingénierie des systèmes d information","topic":"Authorship Attribution and Profiling","field":"Computer Science","cited_by":0,"is_retracted":false,"has_abstract":false,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":true,"route_about_ca":false,"ca_institutions":"","funders":"","keywords":"Support vector machine; Feature (linguistics); Decision tree; Key (lock); Training set","score_opus":0.036634835559959444,"score_gpt":0.3263685053034801,"score_spread":0.28973366974352066,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4416338528","genre_codex":"review","genre_gemma":"review","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"review","genre_consensus":"review","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0009627021,0.99556386,0.0012196767,0.0006831631,0.00019961533,0.00023615418,0.00086753117,0.000020633763,0.00024670418],"genre_scores_gemma":[0.016131554,0.9723184,0.0074158665,0.0013771559,0.00032849523,0.0009842736,0.0011936661,0.000023887498,0.00022669532],"study_design_codex":"systematic_review","study_design_gemma":"systematic_review","domain_scores_codex":[0.9801066,0.007982961,0.006815947,0.00200931,0.0028946344,0.0001904839],"domain_scores_gemma":[0.858908,0.12019914,0.01069972,0.0022783822,0.007247091,0.00066773355],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.02805375,0.0015160461,0.007627502,0.013790657,0.00086497446,0.0034043498,0.0026456823,0.0019692716,0.0034493348],"category_scores_gemma":[0.13663936,0.0009881359,0.008286573,0.010718252,0.0013571894,0.0034124497,0.0017914625,0.0018738046,0.0005745553],"study_design_candidate":"systematic_review","study_design_consensus":"systematic_review","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.000519281,0.00007039147,0.004321945,0.6221418,0.01849001,0.00008367057,0.00032014848,0.00035731719,0.00023384753,0.00080845534,0.00949903,0.3431541],"study_design_scores_gemma":[0.0005211509,0.0005575885,0.017360667,0.8256516,0.08214682,0.0005140721,0.0003996982,0.00098099,0.0004985568,0.0030045786,0.068218164,0.0001460292],"about_ca_topic_score_codex":0.010139156,"about_ca_topic_score_gemma":0.032615185,"teacher_disagreement_score":0.02805375,"about_ca_system_score_codex":0.0028255053,"about_ca_system_score_gemma":0.012744473,"threshold_uncertainty_score":0.14836419},"labels":[],"label_agreement":null},{"id":"W4416394486","doi":"10.48550/arxiv.2510.07500","title":"Black-Box Detection of LLM-Generated Text Using Generalized Jensen-Shannon Divergence","year":2025,"lang":"en","type":"preprint","venue":"ArXiv.org","topic":"Authorship Attribution and Profiling","field":"Computer Science","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"","funders":"Government of Canada; Canadian Institute for Advanced Research","keywords":"Divergence (linguistics); Detector; Asymptotic distribution; Discretization; Pattern recognition (psychology); Matrix (chemical analysis); Statistical hypothesis testing","score_opus":0.09692107733937994,"score_gpt":0.3169443602513833,"score_spread":0.22002328291200335,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4416394486","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.11858734,0.0007218606,0.8729765,0.0005798994,0.00010319286,0.00008228806,0.00086920644,0.003834711,0.0022450965],"genre_scores_gemma":[0.8231311,0.00019129644,0.17130949,0.0002566341,0.00012121034,0.00015161598,0.0021528243,0.0004960797,0.0021897543],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9949397,0.002164179,0.00031122222,0.0011422053,0.0011597462,0.00028301432],"domain_scores_gemma":[0.9644793,0.026823347,0.0023716537,0.0036427241,0.0020077494,0.0006751568],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.00705437,0.0009372825,0.0012371435,0.0030342182,0.0008885315,0.0029023655,0.0018321449,0.0019301928,0.0020093285],"category_scores_gemma":[0.043321807,0.00051060115,0.00062589825,0.001948355,0.0019249887,0.0038095724,0.0028365543,0.0020720214,0.0013033337],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0013367836,0.00031276938,0.0433296,0.0008370215,0.00023733074,0.0014821392,0.0021718172,0.32414985,0.03404444,0.0894168,0.013462286,0.4892192],"study_design_scores_gemma":[0.000018306666,0.00007038702,0.002561551,0.00003396207,0.00001015559,0.0001883259,0.00009043028,0.9436961,0.012013353,0.039736226,0.001541046,0.000040216997],"about_ca_topic_score_codex":0.0012926026,"about_ca_topic_score_gemma":0.0017872576,"teacher_disagreement_score":0.9929456,"about_ca_system_score_codex":0.0013166631,"about_ca_system_score_gemma":0.0012326709,"threshold_uncertainty_score":0.03730756},"labels":[],"label_agreement":null},{"id":"W4416841822","doi":"10.7203/scripta.25.32361","title":"The Manuscript Versions of Shakespeare’s Sonnet 2: A Reassessment","year":2025,"lang":"en","type":"article","venue":"SCRIPTA Revista Internacional de Literatura i Cultura Medieval i Moderna","topic":"Authorship Attribution and Profiling","field":"Computer Science","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":true,"ca_institutions":"","funders":"","keywords":"Sonnet; Spelling; Extant taxon; Context (archaeology); Quarter (Canadian coin)","score_opus":0.015182382881637995,"score_gpt":0.29100611493787093,"score_spread":0.27582373205623295,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4416841822","genre_codex":"other","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.197474,0.040363226,0.027276818,0.17981651,0.21504007,0.00018877088,0.0027621004,0.0009307609,0.33614781],"genre_scores_gemma":[0.677451,0.017150665,0.015195164,0.010307869,0.036631573,0.00014885177,0.0015520832,0.0028786748,0.23868407],"study_design_codex":"not_applicable","study_design_gemma":"not_applicable","domain_scores_codex":[0.99276733,0.0030257686,0.0006439815,0.0008151869,0.0024699373,0.00027789682],"domain_scores_gemma":[0.9628026,0.016217902,0.0020693052,0.005099302,0.012642892,0.0011680075],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0091632,0.00051580596,0.00039029436,0.003002457,0.004406411,0.010256272,0.00076778245,0.0011037388,0.009838891],"category_scores_gemma":[0.0450622,0.00032793553,0.00026326592,0.0027786277,0.007716113,0.0057110093,0.0022884216,0.0029277436,0.00313652],"study_design_candidate":"not_applicable","study_design_consensus":"not_applicable","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0003981097,0.00004698174,0.005836462,0.0012539646,0.00004611751,0.002260818,0.21065718,0.00027339754,0.0043745213,0.22435533,0.3616528,0.18884435],"study_design_scores_gemma":[0.0000037302973,0.000021693664,0.0014147613,0.00032728934,0.0000049257396,0.00037475504,0.010744544,0.00006994031,0.0008383886,0.0033994121,0.98278254,0.000017987872],"about_ca_topic_score_codex":0.003481531,"about_ca_topic_score_gemma":0.0061487127,"teacher_disagreement_score":0.010256272,"about_ca_system_score_codex":0.0032851854,"about_ca_system_score_gemma":0.0035700407,"threshold_uncertainty_score":0.048460245},"labels":[],"label_agreement":null},{"id":"W4417086205","doi":"10.48550/arxiv.2505.06107","title":"Differentiating Emigration from Return Migration of Scholars Using Name-Based Nationality Detection Models","year":2025,"lang":"en","type":"preprint","venue":"ArXiv.org","topic":"Authorship Attribution and Profiling","field":"Computer Science","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":true,"ca_institutions":"","funders":"","keywords":"Nationality; Emigration; Country of origin; Proxy (statistics); Immigration; TRACE (psycholinguistics)","score_opus":0.11636889442689233,"score_gpt":0.31891187978570157,"score_spread":0.20254298535880924,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4417086205","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.9333901,0.0008519666,0.05828356,0.0013758419,0.0002498691,0.000159152,0.0015747681,0.0009914042,0.003123343],"genre_scores_gemma":[0.97517675,0.00023102833,0.018877853,0.00020576637,0.000095396936,0.0000783421,0.0029566619,0.00006623094,0.0023119242],"study_design_codex":"observational","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9986136,0.0005066002,0.00013290276,0.00040862962,0.00012768245,0.0002106172],"domain_scores_gemma":[0.9932161,0.0033177366,0.0012323126,0.0007654222,0.0010301374,0.0004383018],"candidate_categories":["bibliometrics"],"consensus_categories":[],"category_scores_codex":[0.0055059,0.0009158961,0.00080044207,0.0040983837,0.0010324749,0.0025897264,0.0013739668,0.0014057973,0.001281048],"category_scores_gemma":[0.013065557,0.00025574685,0.0013666144,0.002129588,0.0007928952,0.003074104,0.0017348834,0.0015948921,0.0012996385],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0005543734,0.0006444098,0.76317894,0.00021221339,0.00027547253,0.0005865527,0.0015610885,0.062937796,0.0016831345,0.0034070036,0.010815938,0.15414305],"study_design_scores_gemma":[0.000043856133,0.00016556295,0.0809942,0.0001587497,0.00015278884,0.00045195984,0.0018730715,0.8977302,0.0031133287,0.008602877,0.0066438173,0.0000695206],"about_ca_topic_score_codex":0.010438662,"about_ca_topic_score_gemma":0.011603732,"teacher_disagreement_score":0.99590164,"about_ca_system_score_codex":0.00090662454,"about_ca_system_score_gemma":0.0011623706,"threshold_uncertainty_score":0.02911836},"labels":[],"label_agreement":null},{"id":"W4417515035","doi":"10.1088/2631-8695/ae2fac","title":"Spoken language identification system for detecting coastal karnataka languages using transfer learning and multi-view learning","year":2025,"lang":"","type":"article","venue":"Engineering Research Express","topic":"Authorship Attribution and Profiling","field":"Computer Science","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Impact","funders":"","keywords":"Spoken language; Transfer of learning; Support vector machine; Feature (linguistics); Identification (biology); Deep learning; Language model; Structured prediction","score_opus":0.05826977335289614,"score_gpt":0.3831180136541428,"score_spread":0.32484824030124665,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4417515035","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.3088782,0.0007045183,0.6574507,0.0003800774,0.0004250803,0.00028376197,0.00079693826,0.02031542,0.010765307],"genre_scores_gemma":[0.8568585,0.000152913,0.13056429,0.0002978186,0.00004739563,0.00015292321,0.0012320023,0.00015905261,0.0105350455],"study_design_codex":"design_other","study_design_gemma":"bench_or_experimental","domain_scores_codex":[0.99964833,0.00004954444,0.000021661463,0.00012904136,0.0000952939,0.000056068653],"domain_scores_gemma":[0.99975663,0.000048748545,0.000019990286,0.00002961854,0.00011885893,0.000026126183],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.00033838805,0.0005400579,0.00044169903,0.00038868867,0.00030678575,0.000644694,0.0006250979,0.00040899258,0.002680296],"category_scores_gemma":[0.0006663234,0.0001780812,0.00045687237,0.00018470864,0.00020175571,0.0007663702,0.0009147919,0.0007110108,0.0020978325],"study_design_candidate":"bench_or_experimental","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0007185492,0.00031490313,0.007435067,0.0002556382,0.00013387555,0.0009907789,0.0006216038,0.019731877,0.30756983,0.0015685199,0.007351954,0.6533074],"study_design_scores_gemma":[0.0000512997,0.0004355558,0.010826822,0.000040134903,0.00011520329,0.0006044159,0.00059355603,0.81547225,0.16275622,0.0013091483,0.0076791686,0.000116321404],"about_ca_topic_score_codex":0.0050553023,"about_ca_topic_score_gemma":0.006144792,"teacher_disagreement_score":0.0050553023,"about_ca_system_score_codex":0.00030782758,"about_ca_system_score_gemma":0.00057938194,"threshold_uncertainty_score":0.010051787},"labels":[],"label_agreement":null},{"id":"W59948950","doi":"10.5220/0001837706460653","title":"CLASSIFYING WEB PAGES BY GENRE - A Distance Function Approach","year":2009,"lang":"en","type":"article","venue":"","topic":"Authorship Attribution and Profiling","field":"Computer Science","cited_by":5,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Dalhousie University","funders":"","keywords":"Computer science; Web page; Similarity (geometry); Information retrieval; Centroid; Byte; Set (abstract data type); Preprocessor; Function (biology); World Wide Web; Artificial intelligence; Image (mathematics)","score_opus":0.03294272366160689,"score_gpt":0.2517075866206458,"score_spread":0.2187648629590389,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W59948950","genre_codex":"empirical","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.5446909,0.0014214896,0.43706986,0.0008668406,0.00032563176,0.0009431049,0.0030121475,0.002592305,0.009077623],"genre_scores_gemma":[0.691326,0.00049245276,0.298172,0.00011827062,0.0001477447,0.00037850172,0.003711555,0.00018709122,0.0054663382],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.99746966,0.0007518492,0.00030806081,0.00043556374,0.00088818185,0.0001466251],"domain_scores_gemma":[0.99054986,0.004565774,0.00075925625,0.0011740737,0.0024323326,0.0005186077],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0034814235,0.0010393462,0.0010748104,0.01029752,0.0008877596,0.003534628,0.0011765497,0.0015203708,0.0026671067],"category_scores_gemma":[0.015192944,0.00023213483,0.0012699208,0.006072009,0.0006311472,0.003526688,0.0012627894,0.001624759,0.003293227],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0008723377,0.0013022386,0.110624105,0.0003683878,0.00033379474,0.00019698415,0.0007710168,0.024164438,0.014876891,0.005441618,0.0067029246,0.83434534],"study_design_scores_gemma":[0.00005424732,0.0004755455,0.046472102,0.000073211435,0.000099258374,0.0005829061,0.0008242282,0.92527115,0.009713065,0.010758265,0.0055775074,0.00009849768],"about_ca_topic_score_codex":0.002761089,"about_ca_topic_score_gemma":0.002351373,"teacher_disagreement_score":0.01029752,"about_ca_system_score_codex":0.0013692172,"about_ca_system_score_gemma":0.0007975833,"threshold_uncertainty_score":0.018411696},"labels":[],"label_agreement":null},{"id":"W6910736779","doi":"10.48550/arxiv.2304.14044","title":"Large Scale Genealogical Information Extraction From Handwritten Quebec Parish Records","year":2023,"lang":"en","type":"preprint","venue":"arXiv (Cornell University)","topic":"Authorship Attribution and Profiling","field":"Computer Science","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":true,"ca_institutions":"","funders":"","keywords":"Workflow; Consistency (knowledge bases); Information extraction; Sample (material); Scale (ratio); Process (computing)","score_opus":0.10302905254060844,"score_gpt":0.22528515220900666,"score_spread":0.12225609966839822,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W6910736779","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.28301266,0.002960307,0.30449146,0.0018391951,0.00026588686,0.002197809,0.30012074,0.06302737,0.04208461],"genre_scores_gemma":[0.27658558,0.0012273614,0.41310388,0.00023275905,0.00009273638,0.0008065757,0.26205266,0.0016903552,0.04420803],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.99913317,0.00006126092,0.000059116956,0.00026261812,0.0003486419,0.00013528713],"domain_scores_gemma":[0.99667335,0.0006831813,0.0002527302,0.0005452677,0.0016738917,0.00017160995],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0005740687,0.0009122546,0.0005638513,0.009626466,0.0016266769,0.0024372914,0.00088552636,0.00056272733,0.0073234513],"category_scores_gemma":[0.0037542188,0.00032896257,0.0005092077,0.0065758303,0.0004749625,0.00067760615,0.00080765714,0.00047576884,0.004654624],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":true,"about_ca_topic_consensus":true,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00030992707,0.00012172645,0.037963394,0.00086662534,0.0001263238,0.002187217,0.0029546458,0.008017142,0.046030585,0.0033214274,0.116189,0.781912],"study_design_scores_gemma":[0.00006517132,0.00008718109,0.25624555,0.00059045316,0.00014630723,0.0014544838,0.0040362,0.10845793,0.08658358,0.0048776492,0.53717744,0.00027801513],"about_ca_topic_score_codex":0.54140306,"about_ca_topic_score_gemma":0.6405631,"teacher_disagreement_score":0.45859694,"about_ca_system_score_codex":0.0035992279,"about_ca_system_score_gemma":0.007433638,"threshold_uncertainty_score":0.92259544},"labels":[],"label_agreement":null},{"id":"W6912805630","doi":"10.5281/zenodo.7374811","title":"[[**LIVE@STREAM**]]\" Edmonton Oilers vs Florida Panthers Live Free Broadcast","year":2022,"lang":"en","type":"article","venue":"Zenodo (CERN European Organization for Nuclear Research)","topic":"Authorship Attribution and Profiling","field":"Computer Science","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":true,"ca_institutions":"","funders":"","keywords":"Population; Gloom; Pretext; Feature (linguistics); Identification (biology); Filter (signal processing)","score_opus":0.04017311466162575,"score_gpt":0.2436177698953339,"score_spread":0.20344465523370814,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W6912805630","genre_codex":"dataset","genre_gemma":"other","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"other","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0043132664,0.00042392113,0.0017318105,0.003063578,0.0039098514,0.0001801242,0.7590007,0.030277042,0.19709969],"genre_scores_gemma":[0.015578991,0.00064580573,0.0025962559,0.0016858001,0.0009046729,0.00023543998,0.7317775,0.0137232235,0.23285231],"study_design_codex":"not_applicable","study_design_gemma":"not_applicable","domain_scores_codex":[0.9996644,0.000040829495,0.000019541618,0.00008282775,0.000110176894,0.00008212316],"domain_scores_gemma":[0.99904746,0.00015443162,0.00006418132,0.0001864411,0.0003324433,0.00021503697],"candidate_categories":["insufficient_payload"],"consensus_categories":["insufficient_payload"],"category_scores_codex":[0.00038818875,0.0009859675,0.0005814692,0.0016059658,0.001578897,0.0035807502,0.0007912774,0.00064971216,0.35932964],"category_scores_gemma":[0.0025365418,0.00043699626,0.0004204257,0.0027789846,0.0002650263,0.0033482236,0.0024583824,0.0013031153,0.28753382],"study_design_candidate":"not_applicable","study_design_consensus":"not_applicable","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.000041575036,0.000004193455,0.00021799555,0.00003749056,0.0000024682208,0.000012381386,0.00003266681,0.000017714894,0.00007042297,0.00026649176,0.9942016,0.0050949734],"study_design_scores_gemma":[0.000022204695,0.000010289986,0.0021484413,0.000059411173,0.0000033699064,0.000023234976,0.00014352442,0.00025719055,0.0003263554,0.0003234268,0.99666625,0.000016264727],"about_ca_topic_score_codex":0.033414673,"about_ca_topic_score_gemma":0.062071405,"teacher_disagreement_score":0.64067036,"about_ca_system_score_codex":0.00074311346,"about_ca_system_score_gemma":0.00072256057,"threshold_uncertainty_score":0.9138385},"labels":[],"label_agreement":null},{"id":"W6929692455","doi":"10.5061/dryad.q83bk3jvp","title":"Morphological diversity of the cetacean mandibular symphysis coincides with novel modes of aquatic feeding","year":2025,"lang":"en","type":"dataset","venue":"DRYAD","topic":"Authorship Attribution and Profiling","field":"Computer Science","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Canadian Museum of Nature","funders":"","keywords":"Mandibular symphysis; Dentition; Cetacea; Symphysis; Convergent evolution; Masticatory force; Morphology (biology); Ecomorphology; Extant taxon; Macroevolution","score_opus":0.028898359748895982,"score_gpt":0.2512850401394509,"score_spread":0.22238668039055492,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W6929692455","genre_codex":"empirical","genre_gemma":"dataset","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"dataset","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.99868065,0.00023941796,0.0003132059,0.00001066955,0.0000012372261,0.0000023688422,0.00008475448,0.000008768852,0.00065893994],"genre_scores_gemma":[0.99886453,0.00015769046,0.0005047919,0.000008510945,0.0000038524104,0.000004182733,0.00024014217,0.000004453184,0.00021199668],"study_design_codex":"observational","study_design_gemma":"not_applicable","domain_scores_codex":[0.9998666,0.00001345713,0.000012689855,0.000060937502,0.00002750089,0.00001880615],"domain_scores_gemma":[0.9996518,0.00004316234,0.0001567223,0.00005210475,0.00004210266,0.000054225962],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.00020404723,0.0001450473,0.00023840871,0.0010818668,0.0004616798,0.0005019136,0.00020736839,0.0002773963,0.001273189],"category_scores_gemma":[0.00047450018,0.0001910994,0.00018252543,0.00062662404,0.0005553481,0.00034346155,0.0007430295,0.00031748213,0.0002736251],"study_design_candidate":"not_applicable","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00021491956,0.00003275518,0.66590923,0.000117275966,0.00011852945,0.00040523094,0.0013901448,0.00028370137,0.29065537,0.0004930052,0.00014255459,0.040237203],"study_design_scores_gemma":[0.0000012078746,0.000023113405,0.9985636,0.0000033258916,0.000005018418,0.0003218033,0.00012184423,0.000098482466,0.0005666226,0.000059417143,0.00023324286,0.0000024125063],"about_ca_topic_score_codex":0.0006866885,"about_ca_topic_score_gemma":0.0022817813,"teacher_disagreement_score":0.001273189,"about_ca_system_score_codex":0.00015737428,"about_ca_system_score_gemma":0.00010653346,"threshold_uncertainty_score":0.0042592287},"labels":[],"label_agreement":null},{"id":"W6930461564","doi":"10.5281/zenodo.12147172","title":"Tupper katalog pdf","year":2024,"lang":"en","type":"other","venue":"Zenodo (CERN European Organization for Nuclear Research)","topic":"Authorship Attribution and Profiling","field":"Computer Science","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":true,"ca_institutions":"","funders":"","keywords":"Value (mathematics); Credit card; Line (geometry); Dart; Trademark","score_opus":0.03878703975129317,"score_gpt":0.2630634045121742,"score_spread":0.22427636476088103,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W6930461564","genre_codex":"other","genre_gemma":"other","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"other","genre_consensus":"other","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.00034198575,0.00047919631,0.00032442296,0.00045568062,0.0009880202,0.00007950599,0.0024745043,0.0023793068,0.99247736],"genre_scores_gemma":[0.0009389919,0.000284302,0.00013029482,0.00018424875,0.00013108976,0.000027354916,0.0010936861,0.00071657,0.9964933],"study_design_codex":"not_applicable","study_design_gemma":"not_applicable","domain_scores_codex":[0.99958605,0.0000276745,0.000016750188,0.00007411817,0.0002159297,0.000079496036],"domain_scores_gemma":[0.9991598,0.00009139366,0.000039373732,0.00014594919,0.00033846326,0.00022492759],"candidate_categories":["insufficient_payload"],"consensus_categories":["insufficient_payload"],"category_scores_codex":[0.0003901264,0.0011775817,0.00067146146,0.0020774996,0.002305533,0.0050122174,0.0010465856,0.0017601866,0.92797774],"category_scores_gemma":[0.0017037189,0.00078650453,0.0005181457,0.0018582809,0.00042332165,0.004489691,0.0030077214,0.0021084112,0.8911117],"study_design_candidate":"not_applicable","study_design_consensus":"not_applicable","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.000020065454,0.000020181733,0.000048016005,0.00004850002,0.0000010721693,0.0000367036,0.000022372426,0.000020660724,0.00011874581,0.0009311968,0.96797544,0.030757057],"study_design_scores_gemma":[0.0000045455695,0.000007428521,0.0002096766,0.00003585895,9.287453e-7,0.000058067988,0.00004022739,0.000021747997,0.00012745977,0.0002482576,0.99924195,0.000003880878],"about_ca_topic_score_codex":0.0038364925,"about_ca_topic_score_gemma":0.0071338904,"teacher_disagreement_score":0.07202226,"about_ca_system_score_codex":0.0010101964,"about_ca_system_score_gemma":0.000880074,"threshold_uncertainty_score":0.10273099},"labels":[],"label_agreement":null},{"id":"W6931138341","doi":"10.5281/zenodo.5223069","title":"FIGURE 11. Perilampus yemenensis and P. houbaraensis. A‒E, P in The Perilampidae of the United Arab Emirates and Yemen (Hymenoptera: Chalcidoidea)","year":2021,"lang":"en","type":"other","venue":"Zenodo (CERN European Organization for Nuclear Research)","topic":"Authorship Attribution and Profiling","field":"Computer Science","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Royal Ontario Museum","funders":"","keywords":"Dorsum; Face (sociological concept); Sculpture; Population","score_opus":0.04010835429658585,"score_gpt":0.2536236183141751,"score_spread":0.21351526401758927,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W6931138341","genre_codex":"empirical","genre_gemma":"other","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"other","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.56635535,0.004382987,0.0028232592,0.001224613,0.00051731156,0.00042029607,0.0177913,0.00059335044,0.40589157],"genre_scores_gemma":[0.91012603,0.0010163325,0.0040850886,0.0001893749,0.00003433762,0.00017478141,0.009931922,0.000046560905,0.07439567],"study_design_codex":"design_other","study_design_gemma":"not_applicable","domain_scores_codex":[0.99995077,0.0000063466687,0.0000023792927,0.000013875361,0.000010932593,0.00001567486],"domain_scores_gemma":[0.99994814,0.0000069377975,0.000014905653,0.000004813492,0.000012834241,0.000012300103],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.000042664633,0.00036349564,0.0001230679,0.0008991324,0.0009247969,0.00031873013,0.00022950672,0.00034196564,0.041530322],"category_scores_gemma":[0.00014600575,0.0001101966,0.00012354387,0.0009092769,0.00041535398,0.00025795132,0.0005621414,0.0003002921,0.006001516],"study_design_candidate":"not_applicable","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0043117,0.00022284359,0.17561902,0.0022454674,0.00011557545,0.012398614,0.0095140925,0.00089341775,0.13635506,0.012806248,0.119077876,0.52644014],"study_design_scores_gemma":[0.00007244705,0.00018985482,0.63921934,0.0002677308,0.000043686887,0.0068749352,0.009086536,0.000401569,0.012725656,0.0011349675,0.32995412,0.00002923379],"about_ca_topic_score_codex":0.012324829,"about_ca_topic_score_gemma":0.027637132,"teacher_disagreement_score":0.041530322,"about_ca_system_score_codex":0.0004097844,"about_ca_system_score_gemma":0.0003237243,"threshold_uncertainty_score":0.1389327},"labels":[],"label_agreement":null},{"id":"W6939056096","doi":"10.60692/47z2e-ha706","title":"Assessing Code Authorship: The Case of the Linux Kernel","year":2017,"lang":"en","type":"article","venue":"Greater South Information System","topic":"Authorship Attribution and Profiling","field":"Computer Science","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Waterloo","funders":"","keywords":"Linux kernel; Code (set theory); Key (lock); Kernel (algebra); Source code; Division (mathematics); Work (physics)","score_opus":0.10755850572160061,"score_gpt":0.3022302739700021,"score_spread":0.19467176824840146,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W6939056096","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.9963257,0.00009448353,0.00156629,0.00031633727,0.0000072670787,0.000013465295,0.00007644551,0.000029896577,0.0015701951],"genre_scores_gemma":[0.9982924,0.00002683909,0.0013057733,0.000012601922,0.000006355084,0.0000050410063,0.0000846553,0.000013084582,0.0002532958],"study_design_codex":"observational","study_design_gemma":"observational","domain_scores_codex":[0.99329233,0.0038131562,0.0003768122,0.00083030545,0.0011753739,0.00051209424],"domain_scores_gemma":[0.85419255,0.11114096,0.012914044,0.0074111884,0.010694516,0.0036466715],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.008431088,0.00029573173,0.00034464532,0.004951208,0.0023874887,0.002363949,0.00082215556,0.0012045308,0.001342574],"category_scores_gemma":[0.07053777,0.00017594075,0.00024371987,0.0043735886,0.0016819976,0.0035590744,0.0021497726,0.0010004176,0.0004546218],"study_design_candidate":"observational","study_design_consensus":"observational","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0004886797,0.00036772466,0.90143055,0.00015129294,0.000051405073,0.0038630934,0.023182882,0.0064620646,0.0028918833,0.0043857405,0.0029103342,0.053814422],"study_design_scores_gemma":[0.000055485558,0.00037539026,0.74798054,0.0002632645,0.000076195865,0.0061477106,0.055845555,0.14205743,0.01154924,0.020673359,0.014817259,0.00015854389],"about_ca_topic_score_codex":0.0066062054,"about_ca_topic_score_gemma":0.006479877,"teacher_disagreement_score":0.008431088,"about_ca_system_score_codex":0.0014114965,"about_ca_system_score_gemma":0.0006137047,"threshold_uncertainty_score":0.044588387},"labels":[],"label_agreement":null},{"id":"W6939802477","doi":"10.6084/m9.figshare.26702290","title":"Additional file 1 of Acceptance and commitment therapy adapted for women with infertility: a pilot study of the Infertility ACTion program","year":2024,"lang":"en","type":"article","venue":"Figshare","topic":"Authorship Attribution and Profiling","field":"Computer Science","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Regina","funders":"","keywords":"Infertility; Intervention (counseling); Action (physics); Acceptance and commitment therapy; Qualitative research","score_opus":0.13556864333062366,"score_gpt":0.3279924424555212,"score_spread":0.19242379912489757,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W6939802477","genre_codex":"dataset","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0014933418,0.000051892617,0.00065242045,0.0006337902,0.000116033305,0.004562789,0.98518014,0.00040318444,0.0069064037],"genre_scores_gemma":[0.06312173,0.00072840205,0.02157828,0.0030082455,0.00039569233,0.18990129,0.6239306,0.0023846764,0.094951175],"study_design_codex":"not_applicable","study_design_gemma":"nonrandomized_trial","domain_scores_codex":[0.99866986,0.0005888492,0.00020357477,0.00013815446,0.000239414,0.00016020393],"domain_scores_gemma":[0.93185675,0.05617891,0.0021669485,0.0018620592,0.0064679654,0.001467387],"candidate_categories":["insufficient_payload"],"consensus_categories":[],"category_scores_codex":[0.0037829462,0.0009076967,0.0013023168,0.0016691319,0.0019725207,0.0013230898,0.0016398295,0.0010781458,0.91469157],"category_scores_gemma":[0.06482755,0.000614655,0.00088588335,0.0026638627,0.00037865507,0.0019941716,0.0011529196,0.0015194498,0.14833197],"study_design_candidate":"nonrandomized_trial","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.001188841,0.0005623383,0.001251195,0.0026074732,0.000022708831,0.00003638994,0.00033626662,0.0002205732,0.000029291803,0.0005418672,0.9706699,0.022533225],"study_design_scores_gemma":[0.054707807,0.0036865487,0.083528735,0.015573912,0.00049307087,0.0004700381,0.005112283,0.0030618254,0.0014763622,0.018671045,0.8127904,0.00042792354],"about_ca_topic_score_codex":0.011103028,"about_ca_topic_score_gemma":0.020920914,"teacher_disagreement_score":0.91469157,"about_ca_system_score_codex":0.0018013205,"about_ca_system_score_gemma":0.0034186144,"threshold_uncertainty_score":0.12168205},"labels":[],"label_agreement":null},{"id":"W6982231911","doi":"","title":"A History of ARLIS/NA MOQ = Un historique d'ARLIS/NA MOQ","year":2025,"lang":"en","type":"other","venue":"Spectrum Research Repository (Concordia University)","topic":"Authorship Attribution and Profiling","field":"Computer Science","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":true,"ca_institutions":"","funders":"","keywords":"Documentation; Reading (process); Resource (disambiguation); Academic community; Field (mathematics)","score_opus":0.035995798582604766,"score_gpt":0.2653648500788777,"score_spread":0.22936905149627296,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W6982231911","genre_codex":"other","genre_gemma":"other","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"other","genre_consensus":"other","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0062894654,0.15280741,0.002656442,0.04190394,0.008925087,0.00009595097,0.0010508131,0.00054514117,0.7857258],"genre_scores_gemma":[0.13102674,0.10010042,0.002672624,0.008794526,0.0034369165,0.0001413041,0.00089788676,0.0009969543,0.75193274],"study_design_codex":"not_applicable","study_design_gemma":"not_applicable","domain_scores_codex":[0.997291,0.00059776084,0.000088414745,0.00024375337,0.0013098562,0.0004691359],"domain_scores_gemma":[0.9982672,0.00037629175,0.00010248877,0.00011927586,0.0008885093,0.0002462809],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0022648284,0.00054086564,0.00039532376,0.0035205889,0.009844133,0.011750684,0.0010621374,0.0014257949,0.035526913],"category_scores_gemma":[0.0034252002,0.00038498474,0.00032577172,0.005299924,0.008594903,0.003954051,0.0032802364,0.0033542167,0.0060431613],"study_design_candidate":"not_applicable","study_design_consensus":"not_applicable","about_ca_topic_candidate":true,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00004711185,0.000027797956,0.0009563694,0.0004912113,0.000008823694,0.00029841074,0.02612577,0.00019609123,0.0003289695,0.30238265,0.5341412,0.13499561],"study_design_scores_gemma":[6.4769364e-7,0.0000013907746,0.00033095927,0.00007969922,4.189217e-7,0.000025050505,0.00065341353,0.000007931959,0.000021613221,0.0005288409,0.99834716,0.0000028836846],"about_ca_topic_score_codex":0.6174257,"about_ca_topic_score_gemma":0.62368286,"teacher_disagreement_score":0.6174257,"about_ca_system_score_codex":0.044170458,"about_ca_system_score_gemma":0.03026439,"threshold_uncertainty_score":0.76965475},"labels":[],"label_agreement":null},{"id":"W6986573819","doi":"","title":"Preliminary results of the lockout/tagout application and observation in the sawmills industries in Québec","year":2012,"lang":"en","type":"other","venue":"PolyPublie (École Polytechnique de Montréal)","topic":"Authorship Attribution and Profiling","field":"Computer Science","cited_by":0,"is_retracted":false,"has_abstract":false,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":true,"ca_institutions":"","funders":"","keywords":"Production (economics); Quality (philosophy); Work (physics); Product (mathematics); Process (computing)","score_opus":0.02128655370917045,"score_gpt":0.24285125883524636,"score_spread":0.2215647051260759,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W6986573819","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.94800884,0.00022917897,0.005185339,0.00065205974,0.00006195009,0.0005089654,0.022330187,0.00046967823,0.022553822],"genre_scores_gemma":[0.9176898,0.00023379827,0.0064865816,0.00015482151,0.00003097925,0.00016875626,0.01024461,0.000110390036,0.06488033],"study_design_codex":"observational","study_design_gemma":"observational","domain_scores_codex":[0.99887675,0.0001661382,0.00004605833,0.00018669409,0.00042109378,0.00030323822],"domain_scores_gemma":[0.9950041,0.0006460024,0.00036322323,0.00030671086,0.003068813,0.0006111823],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0011769588,0.00033484795,0.0001882833,0.0021904076,0.0020165672,0.00091077306,0.0006848175,0.0006032872,0.0048672045],"category_scores_gemma":[0.0029119428,0.00015935361,0.00023003994,0.0035335452,0.00048343994,0.0004777466,0.00079814566,0.0005172323,0.0012375925],"study_design_candidate":"observational","study_design_consensus":"observational","about_ca_topic_candidate":true,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0004441181,0.00047118406,0.8121086,0.0002287148,0.00006458486,0.0010411219,0.021181984,0.0028206657,0.015458688,0.0011685565,0.037025884,0.107985824],"study_design_scores_gemma":[0.000010416341,0.000052258278,0.9739885,0.000018988056,0.000012093127,0.000025590287,0.007130715,0.0026632755,0.001465334,0.00009254238,0.014520566,0.000019903639],"about_ca_topic_score_codex":0.94412434,"about_ca_topic_score_gemma":0.9822947,"teacher_disagreement_score":0.94412434,"about_ca_system_score_codex":0.008223546,"about_ca_system_score_gemma":0.009664577,"threshold_uncertainty_score":0.11240941},"labels":[],"label_agreement":null},{"id":"W6998833087","doi":"","title":"Automatic identification of words with novel but infrequent senses","year":2011,"lang":"en","type":"article","venue":"Waseda University Repository (Waseda University)","topic":"Authorship Attribution and Profiling","field":"Computer Science","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"","funders":"Mitacs","keywords":"Focus (optics); Identification (biology); Word (group theory); Contrast (vision); Word-sense disambiguation; Baseline (sea); Semantics (computer science); Pattern recognition (psychology)","score_opus":0.025077756120185497,"score_gpt":0.18455492299345708,"score_spread":0.15947716687327157,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W6998833087","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.55542755,0.00089883874,0.42854235,0.00042300194,0.00033457432,0.0007613907,0.0032171714,0.0040101223,0.0063849944],"genre_scores_gemma":[0.7665273,0.00022086015,0.22634928,0.0001015711,0.00007344603,0.00046252948,0.004490741,0.0004225302,0.0013517034],"study_design_codex":"design_other","study_design_gemma":"bench_or_experimental","domain_scores_codex":[0.99551976,0.0011173895,0.0005078547,0.0013370316,0.0013593591,0.0001587362],"domain_scores_gemma":[0.97966504,0.01006493,0.0028772773,0.0030538538,0.003896823,0.00044219638],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0032213863,0.0006431411,0.00084876065,0.0051136324,0.0010236362,0.002113545,0.0010861342,0.0009566626,0.0017036297],"category_scores_gemma":[0.026119232,0.00044726723,0.00067897915,0.0033144339,0.0010104693,0.003435597,0.0019798325,0.0009891283,0.0013713934],"study_design_candidate":"bench_or_experimental","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0010808768,0.00062896346,0.119236566,0.00131677,0.0003538208,0.0007678513,0.0028163842,0.011304604,0.13702141,0.012172519,0.010104941,0.7031953],"study_design_scores_gemma":[0.00033002876,0.0011295496,0.13086674,0.00033385347,0.0003660978,0.0059037316,0.004637075,0.55614614,0.19844192,0.057774805,0.043567657,0.0005024387],"about_ca_topic_score_codex":0.0009980415,"about_ca_topic_score_gemma":0.002570725,"teacher_disagreement_score":0.0051136324,"about_ca_system_score_codex":0.00035724486,"about_ca_system_score_gemma":0.0010312044,"threshold_uncertainty_score":0.017036557},"labels":[],"label_agreement":null},{"id":"W7000228838","doi":"","title":"Exploring Sentence Variations with Bilingual Corpora","year":2005,"lang":"en","type":"article","venue":"NPARC","topic":"Authorship Attribution and Profiling","field":"Computer Science","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":true,"route_about_ca":false,"ca_institutions":"","funders":"","keywords":"Sentence; Grammar; Context (archaeology); Machine translation; Parallel corpora; Translation (biology)","score_opus":0.1264075600395029,"score_gpt":0.2753025695211809,"score_spread":0.14889500948167797,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W7000228838","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.54284567,0.002102723,0.42618582,0.0008694409,0.0001267987,0.0004158378,0.0040218434,0.008161186,0.015270732],"genre_scores_gemma":[0.6747187,0.00053515966,0.3142374,0.00018171559,0.0000762697,0.00025220242,0.0068233414,0.00073089084,0.0024444484],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.998245,0.0006836308,0.00017785153,0.000507962,0.0003096129,0.000075886135],"domain_scores_gemma":[0.99606127,0.002574894,0.00029131264,0.00039780556,0.0005484405,0.00012626142],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0016383233,0.00068581937,0.0009056217,0.004171809,0.0013245594,0.0017945144,0.0007425188,0.0007531457,0.0036556982],"category_scores_gemma":[0.008533455,0.0005447465,0.0006780722,0.0045694485,0.0005730065,0.0035635468,0.0013720538,0.0006461026,0.00114399],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0011151838,0.0005472847,0.027997596,0.001427342,0.00025775103,0.0031228045,0.0096221445,0.015771698,0.15100239,0.015640598,0.015583674,0.7579115],"study_design_scores_gemma":[0.00034885388,0.0010786764,0.05787871,0.0003632086,0.0006126098,0.007540351,0.011097872,0.5328686,0.15817244,0.06674903,0.16287859,0.00041101107],"about_ca_topic_score_codex":0.0021605436,"about_ca_topic_score_gemma":0.0043327543,"teacher_disagreement_score":0.004171809,"about_ca_system_score_codex":0.00057014043,"about_ca_system_score_gemma":0.0008741645,"threshold_uncertainty_score":0.012229562},"labels":[],"label_agreement":null},{"id":"W7010440119","doi":"","title":"“Imponer la necesidad del trabajo”: Coacción laboral y modernización capitalista en Santiago del Estero a fines del siglo XIX","year":2024,"lang":"en","type":"article","venue":"Dialnet (Universidad de la Rioja)","topic":"Authorship Attribution and Profiling","field":"Computer Science","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":true,"ca_institutions":"","funders":"","keywords":"Modernization theory; Coercion (linguistics); State (computer science); Workforce; Normative; Quarter (Canadian coin)","score_opus":0.013866061771064527,"score_gpt":0.2745379778723712,"score_spread":0.2606719161013067,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W7010440119","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.62445766,0.010577346,0.0019277214,0.032286916,0.0004977639,0.00003927085,0.00014263499,0.00007687415,0.32999384],"genre_scores_gemma":[0.9790918,0.0022174008,0.00043284564,0.00029834377,0.000083276645,0.000009614072,0.000031923886,0.000011449028,0.017823366],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"observational","domain_scores_codex":[0.9996043,0.0001420694,0.000012350639,0.00004627271,0.00008758379,0.00010739436],"domain_scores_gemma":[0.9991066,0.00053571805,0.000108106244,0.00007880476,0.00009395909,0.000076761076],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0012574627,0.000090710484,0.00008388878,0.0007510486,0.002973528,0.0029907837,0.0002749528,0.000453699,0.0018508954],"category_scores_gemma":[0.0027667906,0.00007408577,0.000066427165,0.0014005156,0.0042311233,0.001185404,0.0014394062,0.0010782722,0.0001598383],"study_design_candidate":"observational","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.000062897285,0.00002542766,0.024590814,0.00030868678,0.0000062152267,0.0006917399,0.38800895,0.00015380325,0.0011820947,0.43422753,0.018034529,0.13270736],"study_design_scores_gemma":[0.000009915628,0.00003253427,0.051602382,0.00038486297,0.00001017242,0.0003665478,0.15921573,0.0002419918,0.00087587687,0.013846739,0.77339494,0.000018360855],"about_ca_topic_score_codex":0.03490249,"about_ca_topic_score_gemma":0.08858084,"teacher_disagreement_score":0.03490249,"about_ca_system_score_codex":0.004025886,"about_ca_system_score_gemma":0.004609778,"threshold_uncertainty_score":0.06939864},"labels":[],"label_agreement":null},{"id":"W7019729564","doi":"","title":"Impact of caricature-based datasets on demographic inference","year":2013,"lang":"en","type":"dissertation","venue":"eScholarship@McGill (McGill)","topic":"Authorship Attribution and Profiling","field":"Computer Science","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"","funders":"McGill University","keywords":"Inference; Focus (optics); Product (mathematics); Statistical inference; Politics; Work (physics); Order (exchange)","score_opus":0.02582788482659593,"score_gpt":0.30031848696835944,"score_spread":0.2744906021417635,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W7019729564","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.7333731,0.004100505,0.10889374,0.0145535385,0.0025332635,0.0013548956,0.111165136,0.007037209,0.016988713],"genre_scores_gemma":[0.76316965,0.00074939406,0.117933586,0.0016705845,0.00037712764,0.00065126154,0.11273552,0.00038548344,0.0023273379],"study_design_codex":"observational","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.95595276,0.02671697,0.0028571265,0.005793329,0.007817221,0.0008624986],"domain_scores_gemma":[0.7577215,0.16719441,0.009233731,0.0527299,0.011312832,0.001807682],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.04881547,0.0011234259,0.0009944907,0.003232858,0.0025338575,0.0045944243,0.0029406282,0.0028517586,0.0024042055],"category_scores_gemma":[0.18939283,0.00077072904,0.0017105525,0.004939813,0.0020346087,0.0049278694,0.0042534256,0.004107147,0.0015263429],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0026266638,0.0015919385,0.53942186,0.0014824263,0.0020302434,0.0004931704,0.0021528332,0.09468293,0.003391758,0.0321775,0.110943794,0.20900482],"study_design_scores_gemma":[0.00047884634,0.00066179055,0.22386435,0.0009839167,0.0005340333,0.001455683,0.003346534,0.59531003,0.016244922,0.04680656,0.10987959,0.0004337819],"about_ca_topic_score_codex":0.014416314,"about_ca_topic_score_gemma":0.0145919,"teacher_disagreement_score":0.04881547,"about_ca_system_score_codex":0.0025887783,"about_ca_system_score_gemma":0.0019395014,"threshold_uncertainty_score":0.258164},"labels":[],"label_agreement":null},{"id":"W7034854641","doi":"","title":"Without a penny in my pocket my bittersweet memories before and after World War II","year":2013,"lang":"en","type":"article","venue":"","topic":"Authorship Attribution and Profiling","field":"Computer Science","cited_by":0,"is_retracted":false,"has_abstract":false,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":true,"ca_institutions":"","funders":"","keywords":"World War II; First world war; Quarter (Canadian coin); Diplomacy","score_opus":0.01349051381378974,"score_gpt":0.24719821709012946,"score_spread":0.23370770327633972,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W7034854641","genre_codex":"empirical","genre_gemma":"other","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"other","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.5094992,0.009008292,0.037460264,0.07537456,0.016183408,0.0002196467,0.014352778,0.0017317608,0.33617005],"genre_scores_gemma":[0.8578911,0.002697986,0.012606032,0.004027714,0.0028899268,0.00014036917,0.0038813816,0.0006360562,0.11522953],"study_design_codex":"design_other","study_design_gemma":"not_applicable","domain_scores_codex":[0.9977884,0.0007062485,0.0002114567,0.0003184763,0.0005839943,0.0003912906],"domain_scores_gemma":[0.975869,0.006980455,0.0046044826,0.005349743,0.0038484314,0.0033479272],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0024085073,0.00037095996,0.00030390176,0.0042811404,0.0033248146,0.0065552285,0.00051873294,0.0008990925,0.02275854],"category_scores_gemma":[0.03769376,0.00026825207,0.00019950035,0.0061968737,0.0013139955,0.0071557453,0.0031345242,0.0021930805,0.010998866],"study_design_candidate":"not_applicable","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00056756765,0.00008243901,0.114512935,0.00031432338,0.00007633092,0.0010164216,0.033560738,0.00034108452,0.0044035744,0.061492108,0.3136173,0.4700151],"study_design_scores_gemma":[0.000017655244,0.0001080042,0.08180699,0.00079263345,0.000042612955,0.0018962007,0.04813693,0.0010714618,0.00646155,0.0760067,0.78349733,0.00016192104],"about_ca_topic_score_codex":0.0008683913,"about_ca_topic_score_gemma":0.0019017165,"teacher_disagreement_score":0.02275854,"about_ca_system_score_codex":0.00075694337,"about_ca_system_score_gemma":0.0009465714,"threshold_uncertainty_score":0.07613492},"labels":[],"label_agreement":null},{"id":"W7066188734","doi":"","title":"Harrastamisen Suomen malli, etsivän harrastustoiminnan kehittäminen Nousiaisten kunnassa","year":2022,"lang":"fi","type":"other","venue":"Theseus (Ammattikorkeakoulujen)","topic":"Authorship Attribution and Profiling","field":"Computer Science","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":true,"ca_institutions":"","funders":"","keywords":"Work (physics); Population; Power (physics); Quarter (Canadian coin)","score_opus":0.039501817827267534,"score_gpt":0.2730300344592209,"score_spread":0.2335282166319534,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W7066188734","genre_codex":"other","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.11654105,0.013220706,0.014268935,0.031490892,0.0044168355,0.00053713605,0.0061138477,0.0010954492,0.81231505],"genre_scores_gemma":[0.286535,0.009152846,0.014309255,0.005023685,0.0005307723,0.0005181018,0.005879133,0.00078348035,0.6772678],"study_design_codex":"design_other","study_design_gemma":"qualitative","domain_scores_codex":[0.9985322,0.00021132008,0.00006882144,0.00027861286,0.0005238135,0.0003851639],"domain_scores_gemma":[0.99823344,0.00020698791,0.0001537073,0.00011012394,0.0007700941,0.0005256601],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0018500286,0.0006196517,0.0004064065,0.00085214275,0.0026441289,0.0055779703,0.0009328439,0.0015974173,0.06877851],"category_scores_gemma":[0.0027078846,0.00036592718,0.000620984,0.0011083327,0.00095928024,0.0032884253,0.0035366123,0.0024146698,0.025712853],"study_design_candidate":"qualitative","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00094765757,0.00066919386,0.04584809,0.0027330995,0.00014050386,0.001701242,0.016820969,0.0012094859,0.026792878,0.10178902,0.28592524,0.5154225],"study_design_scores_gemma":[0.000015733116,0.00009011196,0.016528344,0.0003077648,0.000025675588,0.00015243063,0.0051397793,0.00022207922,0.0022773012,0.0033063686,0.9718946,0.000039923685],"about_ca_topic_score_codex":0.01907059,"about_ca_topic_score_gemma":0.05422989,"teacher_disagreement_score":0.06877851,"about_ca_system_score_codex":0.0032236148,"about_ca_system_score_gemma":0.009046924,"threshold_uncertainty_score":0.23008704},"labels":[],"label_agreement":null},{"id":"W7066242485","doi":"","title":"Hunter's hand book of Victoria Bridge, illustrated with wood-cuts. A brief history of that wonderful work, from the time that the first practical idea for its construction was submitted to the public in 1846, up to its completion in 1859. Also, a short sketch of the lives of the celebrated Stephensons ...","year":2014,"lang":"en","type":"article","venue":"QSpace (Queen's University Library)","topic":"Authorship Attribution and Profiling","field":"Computer Science","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":true,"ca_institutions":"","funders":"","keywords":"Bridge (graph theory); Great Depression; Period (music); Politics; Government (linguistics)","score_opus":0.026052766573958105,"score_gpt":0.20894264281873726,"score_spread":0.18288987624477915,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W7066242485","genre_codex":"other","genre_gemma":"other","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"other","genre_consensus":"other","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0011504658,0.08730754,0.0013421063,0.006664678,0.0072116773,0.00010990726,0.0022053348,0.0002595232,0.89374876],"genre_scores_gemma":[0.0036058486,0.012731982,0.0005412052,0.00119694,0.0003427855,0.000021351541,0.00054558885,0.00015546345,0.98085874],"study_design_codex":"not_applicable","study_design_gemma":"not_applicable","domain_scores_codex":[0.9996101,0.000038291546,0.000016622425,0.00007188805,0.00021183064,0.000051268784],"domain_scores_gemma":[0.99978274,0.00003157416,0.000013273803,0.000020458476,0.00009291576,0.000059016264],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.00020712672,0.0009631858,0.00036719695,0.0015436332,0.0029080028,0.0029785268,0.00091234944,0.001085977,0.13216585],"category_scores_gemma":[0.001078714,0.00056273164,0.00028807425,0.0028676647,0.0016365087,0.002398906,0.0014349157,0.0017571637,0.06618937],"study_design_candidate":"not_applicable","study_design_consensus":"not_applicable","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.000013775006,0.000011307025,0.00010247337,0.0001818222,0.0000017568475,0.00008981233,0.0006416144,0.000056517445,0.00030896862,0.010206784,0.9393709,0.049014222],"study_design_scores_gemma":[7.0320567e-7,0.0000021236287,0.00036460182,0.0000754798,4.388035e-7,0.000055454046,0.00013182417,0.000009843562,0.000019914585,0.0007156068,0.99862146,0.000002532319],"about_ca_topic_score_codex":0.18312864,"about_ca_topic_score_gemma":0.5200736,"teacher_disagreement_score":0.18312864,"about_ca_system_score_codex":0.0047643166,"about_ca_system_score_gemma":0.0072644656,"threshold_uncertainty_score":0.4421388},"labels":[],"label_agreement":null},{"id":"W7067361601","doi":"","title":"Mitsui Matsushima : Presentation of Financial Results for the Third Quarter Ended December 31, 2018 February 2019","year":2019,"lang":"en","type":"other","venue":"","topic":"Authorship Attribution and Profiling","field":"Computer Science","cited_by":0,"is_retracted":false,"has_abstract":false,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":true,"ca_institutions":"","funders":"","keywords":"Quarter (Canadian coin); Presentation (obstetrics); Year-ending","score_opus":0.03002609643005628,"score_gpt":0.29322583127408886,"score_spread":0.2631997348440326,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W7067361601","genre_codex":"other","genre_gemma":"other","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"other","genre_consensus":"other","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.011103495,0.0066558355,0.0038794759,0.25980434,0.14979233,0.00062158506,0.07278435,0.0030968292,0.4922617],"genre_scores_gemma":[0.04379288,0.0030522975,0.0012934124,0.013701416,0.019769574,0.00042451624,0.01721889,0.00112539,0.8996216],"study_design_codex":"not_applicable","study_design_gemma":"not_applicable","domain_scores_codex":[0.99689674,0.00045998892,0.0002584757,0.0003183422,0.0012767122,0.0007897138],"domain_scores_gemma":[0.9778672,0.0030080767,0.0017247561,0.0010976843,0.0124298185,0.0038724942],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.004156388,0.0008641013,0.0005883814,0.0037851988,0.0020739636,0.0058011706,0.00080339663,0.0023179606,0.286408],"category_scores_gemma":[0.042058494,0.00022330222,0.00037099194,0.0035897836,0.0004995384,0.002756264,0.002299993,0.0021118633,0.18481347],"study_design_candidate":"not_applicable","study_design_consensus":"not_applicable","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.000058641002,0.000011920097,0.0009228037,0.00003151364,0.000002423184,0.000045218807,0.0000363945,0.000017601782,0.00005128088,0.0007556695,0.98598796,0.012078559],"study_design_scores_gemma":[0.000025394293,0.000027020356,0.004185578,0.0002537339,0.000009240609,0.00012550574,0.00045592137,0.0002799788,0.00059620617,0.002066145,0.99194735,0.000027902624],"about_ca_topic_score_codex":0.0022612475,"about_ca_topic_score_gemma":0.0045041703,"teacher_disagreement_score":0.286408,"about_ca_system_score_codex":0.0018608883,"about_ca_system_score_gemma":0.0037041367,"threshold_uncertainty_score":0.95813024},"labels":[],"label_agreement":null},{"id":"W7084243447","doi":"","title":"Desafíos emocionales y sociales de los estudiantes migrantes y su relación con las políticas públicas en Quebec y Salamanca","year":2025,"lang":"es","type":"other","venue":"Institutional Repository of the National University Open and Distance UNAD (Universidad Nacional Abierta y a Distancia)","topic":"Authorship Attribution and Profiling","field":"Computer Science","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":true,"ca_institutions":"","funders":"","keywords":"Border Security; Discipline; Work (physics); Social group","score_opus":0.023254550836453888,"score_gpt":0.2815201591031492,"score_spread":0.2582656082666953,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W7084243447","genre_codex":"empirical","genre_gemma":"other","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"other","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.9624483,0.0034792665,0.00043631185,0.013654884,0.00010145527,0.000137033,0.00033891678,0.000017263084,0.019386673],"genre_scores_gemma":[0.9818412,0.0024779276,0.00033768188,0.0023523094,0.000028964352,0.00018304236,0.00011203847,0.000009212726,0.012657651],"study_design_codex":"qualitative","study_design_gemma":"not_applicable","domain_scores_codex":[0.99838984,0.000540927,0.000047119538,0.00013478806,0.00032367822,0.0005636389],"domain_scores_gemma":[0.9959353,0.0007679812,0.00048524508,0.00013072856,0.0016393649,0.0010413374],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0029929043,0.00034256376,0.00046954077,0.0011958925,0.011842051,0.0043837787,0.0010120156,0.00091676746,0.004631162],"category_scores_gemma":[0.004344054,0.00021754234,0.00026516532,0.0018334857,0.0039351755,0.0011387921,0.0029128762,0.0016843419,0.00028679695],"study_design_candidate":"not_applicable","study_design_consensus":null,"about_ca_topic_candidate":true,"about_ca_topic_consensus":true,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00009528243,0.00016615966,0.39940718,0.00035808774,0.000053428572,0.0011280855,0.535811,0.00015260701,0.0011997418,0.0031233581,0.009662595,0.04884254],"study_design_scores_gemma":[0.0000066659236,0.000044783486,0.3295397,0.00043019847,0.00003185367,0.0001000636,0.63774496,0.00008374648,0.00020683199,0.00024631905,0.031532995,0.000031956697],"about_ca_topic_score_codex":0.9636146,"about_ca_topic_score_gemma":0.9871536,"teacher_disagreement_score":0.036385417,"about_ca_system_score_codex":0.026808307,"about_ca_system_score_gemma":0.047646172,"threshold_uncertainty_score":0.19450879},"labels":[],"label_agreement":null},{"id":"W7096905226","doi":"","title":"Proceedings of COLING&amp;apos;98, Montreal, 1998 Multext-East: Parallel and Comparable Corpora and Lexicons for Six Central and Eastern European Languages","year":2008,"lang":"en","type":"article","venue":"","topic":"Authorship Attribution and Profiling","field":"Computer Science","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":true,"ca_institutions":"","funders":"","keywords":"Polish; Corpus linguistics; European union; Languages of Africa; Grammar","score_opus":0.13418161907964204,"score_gpt":0.3168255353526008,"score_spread":0.18264391627295873,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W7096905226","genre_codex":"other","genre_gemma":"other","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"other","genre_consensus":"other","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.031096943,0.030160172,0.32643756,0.023558998,0.009471405,0.0015703819,0.07467495,0.04007777,0.4629518],"genre_scores_gemma":[0.047939196,0.0111717675,0.10785276,0.001088682,0.0009187357,0.0005947449,0.084567815,0.019652016,0.72621423],"study_design_codex":"not_applicable","study_design_gemma":"not_applicable","domain_scores_codex":[0.9987669,0.00027513262,0.000079106816,0.00028596853,0.00046298394,0.00012997176],"domain_scores_gemma":[0.9956233,0.0012849312,0.00015440436,0.001029769,0.0012841208,0.00062348484],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0027636886,0.0016171788,0.0016755915,0.0036952642,0.0037279376,0.007407984,0.0019606638,0.0011881092,0.11730975],"category_scores_gemma":[0.008008114,0.0015014882,0.0005466468,0.0060070283,0.0022067935,0.0047213263,0.0020187132,0.0017717244,0.060537927],"study_design_candidate":"not_applicable","study_design_consensus":"not_applicable","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00020781592,0.000090707996,0.0008695814,0.00022166574,0.000021249583,0.0001486205,0.0006426847,0.00068194495,0.0016165809,0.006008896,0.7818468,0.20764342],"study_design_scores_gemma":[0.00003119038,0.0000133221665,0.0019497444,0.00013859502,0.00001945878,0.000093097646,0.00031952473,0.0021796084,0.0019587511,0.0041343053,0.9891311,0.000031428175],"about_ca_topic_score_codex":0.18907417,"about_ca_topic_score_gemma":0.315894,"teacher_disagreement_score":0.18907417,"about_ca_system_score_codex":0.003998576,"about_ca_system_score_gemma":0.0075330753,"threshold_uncertainty_score":0.3924402},"labels":[],"label_agreement":null},{"id":"W7097745075","doi":"","title":"Edmonton","year":2013,"lang":"en","type":"article","venue":"","topic":"Authorship Attribution and Profiling","field":"Computer Science","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":true,"ca_institutions":"","funders":"","keywords":"Focus (optics); Function (biology); Verb; Variable (mathematics); Style (visual arts)","score_opus":0.014905767243746608,"score_gpt":0.22874969407307805,"score_spread":0.21384392682933143,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W7097745075","genre_codex":"other","genre_gemma":"other","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"other","genre_consensus":"other","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.00413463,0.012171497,0.042320486,0.011206344,0.003567967,0.0001294835,0.01246584,0.007482704,0.9065211],"genre_scores_gemma":[0.029014284,0.010009482,0.04001432,0.0014864625,0.0005496048,0.00013431242,0.013191087,0.0027137613,0.90288675],"study_design_codex":"not_applicable","study_design_gemma":"not_applicable","domain_scores_codex":[0.99865735,0.0002495285,0.00008984987,0.0005326131,0.00038349585,0.00008716775],"domain_scores_gemma":[0.9973454,0.00084721926,0.00014792854,0.00091814797,0.00047511302,0.00026626932],"candidate_categories":["insufficient_payload"],"consensus_categories":[],"category_scores_codex":[0.0013548331,0.0011340848,0.00086732453,0.0026854516,0.0018794377,0.008304505,0.0014813825,0.0016193435,0.41939476],"category_scores_gemma":[0.005714641,0.0006999296,0.0011065761,0.0039633447,0.0014026152,0.006095389,0.0039053315,0.002162536,0.1699854],"study_design_candidate":"not_applicable","study_design_consensus":"not_applicable","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00012830389,0.000078729834,0.0016881434,0.0005042533,0.000048630485,0.00020103552,0.00045375744,0.0012506197,0.0008589237,0.25773975,0.3759433,0.36110452],"study_design_scores_gemma":[0.000015011956,0.000010852469,0.0009331307,0.00027737804,0.000016326638,0.00011567315,0.00014851947,0.001506658,0.0003356425,0.04851591,0.94810754,0.000017388647],"about_ca_topic_score_codex":0.018939784,"about_ca_topic_score_gemma":0.025551382,"teacher_disagreement_score":0.58060527,"about_ca_system_score_codex":0.0021038654,"about_ca_system_score_gemma":0.0032489363,"threshold_uncertainty_score":0},"labels":[],"label_agreement":null},{"id":"W7099414409","doi":"","title":"Correlation of Genotype and In Vitro Susceptibilities of Cryptococcus gattii Strains from the Pacific Northwest of the United States","year":2009,"lang":"en","type":"article","venue":"","topic":"Authorship Attribution and Profiling","field":"Computer Science","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":true,"ca_institutions":"","funders":"","keywords":"Cryptococcus gattii; Cryptococcus neoformans; Cryptococcosis; Genotype; Cryptococcus; Multilocus sequence typing; Typing; Pathogen","score_opus":0.02093940639171854,"score_gpt":0.24862281681772472,"score_spread":0.22768341042600618,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W7099414409","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.99928755,0.00011270833,0.000030246294,0.000020503448,0.0000030759584,0.0000029287082,0.00027860352,0.0000014576932,0.00026289854],"genre_scores_gemma":[0.99910873,0.00010224964,0.00008868882,0.000027292102,0.0000022207028,0.0000056152953,0.00053468713,0.0000024080384,0.00012807171],"study_design_codex":"observational","study_design_gemma":"observational","domain_scores_codex":[0.99975985,0.000047104215,0.000039358096,0.000047431484,0.000059476635,0.000046860652],"domain_scores_gemma":[0.998464,0.00042643922,0.0004319773,0.000095133626,0.0003570106,0.0002255517],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.00023545932,0.00020501256,0.00022020478,0.00056314823,0.0002896288,0.0004972988,0.00014220116,0.00023517731,0.0010968079],"category_scores_gemma":[0.002170336,0.00017682674,0.00011835392,0.0005319108,0.00016710772,0.0001740164,0.00016070159,0.00041100208,0.00018284892],"study_design_candidate":"observational","study_design_consensus":"observational","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00027873603,0.00005816795,0.99258924,0.000010565243,0.000031808635,0.00014667472,0.00013930922,0.00012558563,0.0033195294,0.000014204134,0.00019426037,0.0030918277],"study_design_scores_gemma":[0.000008575124,0.000105432635,0.9968617,0.000010931892,0.00002173436,0.0006841121,0.00040188234,0.00026729627,0.0012484511,0.000024344485,0.00036140397,0.000004140321],"about_ca_topic_score_codex":0.025174025,"about_ca_topic_score_gemma":0.03140146,"teacher_disagreement_score":0.025174025,"about_ca_system_score_codex":0.00030943827,"about_ca_system_score_gemma":0.00024609742,"threshold_uncertainty_score":0.050054967},"labels":[],"label_agreement":null},{"id":"W7099452346","doi":"","title":"The Changing Role of Women in Newfoundland and Labrador This Page Should Be","year":2003,"lang":"en","type":"article","venue":"","topic":"Authorship Attribution and Profiling","field":"Computer Science","cited_by":0,"is_retracted":false,"has_abstract":false,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":true,"ca_institutions":"","funders":"","keywords":"Ethnic group; Population; Government (linguistics); Agency (philosophy); Field (mathematics)","score_opus":0.02795702619447435,"score_gpt":0.266291807087432,"score_spread":0.23833478089295765,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W7099452346","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.91807014,0.0031205064,0.00024674795,0.03592616,0.00033045426,0.000021461654,0.00133261,0.000029673938,0.04092226],"genre_scores_gemma":[0.9608622,0.0015045828,0.00022033777,0.0022483552,0.000058046426,0.000024651103,0.00031281688,0.000030375613,0.034738496],"study_design_codex":"observational","study_design_gemma":"qualitative","domain_scores_codex":[0.997523,0.00043985035,0.00006292558,0.00015220157,0.00020659989,0.0016155039],"domain_scores_gemma":[0.9950412,0.0009113341,0.0009026881,0.0001208206,0.0006461128,0.0023779126],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0013249271,0.00016233238,0.00035792208,0.0022369449,0.009600947,0.0039098975,0.0013775438,0.0009329581,0.010108401],"category_scores_gemma":[0.0041214586,0.00023845963,0.000224696,0.0042180927,0.003354856,0.001984062,0.003247323,0.0014938,0.0006043792],"study_design_candidate":"qualitative","study_design_consensus":null,"about_ca_topic_candidate":true,"about_ca_topic_consensus":true,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00034962714,0.00007234966,0.522378,0.0002739817,0.000058635484,0.0016999124,0.26703346,0.00029541514,0.00097469246,0.019450925,0.08633604,0.10107698],"study_design_scores_gemma":[0.000008468664,0.000022352468,0.5961091,0.0002546619,0.00001810372,0.0001613393,0.33040416,0.00009415902,0.00019444241,0.00043330377,0.07226482,0.000035172074],"about_ca_topic_score_codex":0.92786825,"about_ca_topic_score_gemma":0.98334414,"teacher_disagreement_score":0.07213175,"about_ca_system_score_codex":0.021031573,"about_ca_system_score_gemma":0.01987451,"threshold_uncertainty_score":0.15259546},"labels":[],"label_agreement":null},{"id":"W7124454691","doi":"10.52975/llt.2025v96.012","title":"A CAAT-A Work-to-Rule Tweet Sequence (2021–2022)","year":2025,"lang":"en","type":"article","venue":"Labour / Le Travail","topic":"Authorship Attribution and Profiling","field":"Computer Science","cited_by":0,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":true,"route_about_ca":false,"ca_institutions":"Mohawk College","funders":"","keywords":"","score_opus":0.02427113487552756,"score_gpt":0.27826766156926225,"score_spread":0.2539965266937347,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W7124454691","genre_codex":"dataset","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.11808099,0.0007350184,0.20637965,0.0060239118,0.006851461,0.0031076472,0.5049153,0.037206113,0.11669994],"genre_scores_gemma":[0.31367022,0.0003886543,0.25629392,0.0010004584,0.0006485515,0.0012697404,0.3122136,0.0026526896,0.11186223],"study_design_codex":"not_applicable","study_design_gemma":"observational","domain_scores_codex":[0.99903655,0.00011614937,0.00008873698,0.0002636884,0.00038915762,0.000105664476],"domain_scores_gemma":[0.9960396,0.0012600957,0.00017486406,0.00072349445,0.0014463922,0.00035555396],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0007963474,0.00053681515,0.0003527796,0.0018516028,0.0012025686,0.0015157928,0.0006210477,0.0014720864,0.032158833],"category_scores_gemma":[0.007934308,0.00028894894,0.00042545283,0.0017369782,0.00033241976,0.0015557967,0.00085294,0.0012336592,0.027729055],"study_design_candidate":"observational","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0017713972,0.00038935296,0.023027683,0.0005505034,0.00007961504,0.0010599509,0.00082055986,0.009562106,0.019868392,0.027996318,0.61639917,0.298475],"study_design_scores_gemma":[0.00020783812,0.00037768195,0.0358195,0.00029997726,0.00005370316,0.0010472053,0.0009776586,0.16407138,0.023470277,0.034509677,0.7389731,0.0001919968],"about_ca_topic_score_codex":0.012956035,"about_ca_topic_score_gemma":0.02839436,"teacher_disagreement_score":0.032158833,"about_ca_system_score_codex":0.00050262077,"about_ca_system_score_gemma":0.0021001417,"threshold_uncertainty_score":0.10758197},"labels":[],"label_agreement":null},{"id":"W7125631796","doi":"10.1109/cascon66301.2025.00074","title":"Revisiting Thread Disentanglement in Technical Chat with Fine-Tuned LLMs and Graph-Based Clustering","year":2025,"lang":"","type":"article","venue":"","topic":"Authorship Attribution and Profiling","field":"Computer Science","cited_by":0,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Royal Military College of Canada; Queen's University","funders":"","keywords":"Cluster analysis; Thread (computing); Beijing","score_opus":0.023705734161899722,"score_gpt":0.2934075419077976,"score_spread":0.2697018077458979,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W7125631796","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.32692075,0.0018709525,0.63118654,0.0010062398,0.0007903175,0.000288972,0.002624951,0.029946493,0.005364752],"genre_scores_gemma":[0.85239625,0.00020885566,0.13986494,0.00014212163,0.00014370508,0.00013339588,0.002495213,0.0011323516,0.0034831197],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9964418,0.0010261369,0.00026639266,0.0011887107,0.00069543766,0.00038148984],"domain_scores_gemma":[0.98691314,0.0065181125,0.0012080367,0.0025794068,0.0017431466,0.0010382066],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0028211328,0.0010418564,0.0013421068,0.0042090993,0.0012502624,0.002708941,0.0016644765,0.0014542436,0.0029459822],"category_scores_gemma":[0.02535469,0.00058399135,0.0009027408,0.0027020038,0.0006761975,0.004624081,0.0034973742,0.002375879,0.0032552194],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0020315705,0.0010639539,0.06494402,0.0009816734,0.00041039777,0.0004208073,0.0031879481,0.040024646,0.06343962,0.008245363,0.019940529,0.79530954],"study_design_scores_gemma":[0.00008528872,0.00024493548,0.02112895,0.00012256127,0.00012311502,0.00018435475,0.0013888588,0.9262138,0.019364027,0.020999756,0.010052765,0.00009162168],"about_ca_topic_score_codex":0.005705848,"about_ca_topic_score_gemma":0.014025996,"teacher_disagreement_score":0.005705848,"about_ca_system_score_codex":0.00073256023,"about_ca_system_score_gemma":0.0019381294,"threshold_uncertainty_score":0.014919758},"labels":[],"label_agreement":null},{"id":"W7128601113","doi":"10.4000/15nmz","title":"Anglo-Saxon Microcosm vs. Latin Macrocosm: Shakespeare’s Defence of Poesy in Monosyllables in Love’s Labour’s Lost","year":2025,"lang":"en","type":"article","venue":"Revue de la Société française Shakespeare","topic":"Authorship Attribution and Profiling","field":"Computer Science","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Historical Studies in Education","funders":"","keywords":"Focus (optics); Power (physics); Poetry; Latin Americans; Literary criticism","score_opus":0.012683654536555023,"score_gpt":0.283753829688984,"score_spread":0.271070175152429,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W7128601113","genre_codex":"other","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.27019018,0.017223759,0.014885276,0.058381304,0.0013033523,0.000022002441,0.00005386726,0.00010490843,0.6378354],"genre_scores_gemma":[0.97887117,0.0012799684,0.0004292013,0.0011768189,0.00014498556,0.000009381262,0.000008481329,0.000033228833,0.01804674],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"not_applicable","domain_scores_codex":[0.9981623,0.001143541,0.0000424454,0.00018466635,0.00025516786,0.00021187816],"domain_scores_gemma":[0.997154,0.0019863336,0.0002080956,0.00018325709,0.00026854072,0.00019967329],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0028651839,0.000318519,0.0002321448,0.0017336344,0.0068978257,0.009424668,0.00037044875,0.0012684943,0.0023806093],"category_scores_gemma":[0.004825557,0.00013749838,0.000112138994,0.001529358,0.02976023,0.0061554303,0.002735767,0.0017491133,0.0005661673],"study_design_candidate":"not_applicable","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.000026406686,0.0000073806077,0.001272809,0.000025176058,0.0000028952202,0.00013643484,0.19038163,0.000051401978,0.00013552787,0.79104376,0.005691203,0.011225298],"study_design_scores_gemma":[0.000015464671,0.000031027615,0.0041958634,0.0003675368,0.000008441161,0.0004077405,0.1607991,0.00057742465,0.00073081744,0.2615795,0.5712582,0.000028871647],"about_ca_topic_score_codex":0.0105401855,"about_ca_topic_score_gemma":0.013812502,"teacher_disagreement_score":0.0105401855,"about_ca_system_score_codex":0.0041420776,"about_ca_system_score_gemma":0.0016369381,"threshold_uncertainty_score":0.03005302},"labels":[],"label_agreement":null},{"id":"W7132426893","doi":"","title":"Transfer learning improves french cross-domain dialect identification: NRC @ VarDial 2022","year":2022,"lang":"en","type":"article","venue":"NPARC","topic":"Authorship Attribution and Profiling","field":"Computer Science","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":true,"route_about_ca":true,"ca_institutions":"National Research Council Canada","funders":"","keywords":"Task (project management); Transfer of learning; Identification (biology); Probabilistic logic; Set (abstract data type); Transfer (computing); Test set; Training set","score_opus":0.017077558998287414,"score_gpt":0.2681413714949102,"score_spread":0.2510638124966228,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W7132426893","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.62554634,0.0030958103,0.14084266,0.002659578,0.0020656516,0.00043965227,0.02005385,0.1591555,0.04614103],"genre_scores_gemma":[0.85319215,0.00027471647,0.0878508,0.0009527712,0.00028906387,0.00018648333,0.032627836,0.002496145,0.022130137],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9962196,0.0013405974,0.00015757738,0.0011376375,0.0006652261,0.00047948537],"domain_scores_gemma":[0.9947773,0.0012175346,0.00016312436,0.0017067082,0.0017745096,0.0003607281],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.003789554,0.0012886273,0.000807908,0.0017198995,0.001111089,0.001989347,0.0009417753,0.0014235841,0.009023451],"category_scores_gemma":[0.010316209,0.00029887198,0.0006172654,0.0007815545,0.00039137766,0.0019598652,0.0031395839,0.0016179387,0.010662657],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.001540956,0.0011895248,0.019554716,0.00035442592,0.0002360281,0.00055988604,0.0009247411,0.012047816,0.042412885,0.0025972049,0.16443506,0.75414675],"study_design_scores_gemma":[0.0006966388,0.0016644455,0.07149926,0.00018541075,0.0002541361,0.0020168545,0.0018552124,0.5003975,0.20043036,0.0077883247,0.21271831,0.0004936156],"about_ca_topic_score_codex":0.021994196,"about_ca_topic_score_gemma":0.023697788,"teacher_disagreement_score":0.021994196,"about_ca_system_score_codex":0.0011503865,"about_ca_system_score_gemma":0.001231102,"threshold_uncertainty_score":0.043732345},"labels":[],"label_agreement":null},{"id":"W7132959475","doi":"","title":"Rethinking Clinical De-identification","year":2022,"lang":"","type":"dissertation","venue":"TSpace","topic":"Authorship Attribution and Profiling","field":"Computer Science","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"","funders":"Vector Institute","keywords":"Focus (optics); Confidentiality; Task (project management); Scope (computer science); Bottleneck; Identity (music); Recall; Identification (biology)","score_opus":0.1299195252492299,"score_gpt":0.46661957492507583,"score_spread":0.33670004967584594,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W7132959475","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.041220926,0.0020713075,0.92348164,0.014773787,0.002164032,0.00056831056,0.0010129715,0.0046001845,0.010106864],"genre_scores_gemma":[0.3951784,0.0019926953,0.57969236,0.004203458,0.0011713546,0.00055284007,0.0035407299,0.001105647,0.012562451],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.96007967,0.024014879,0.0032647138,0.006094616,0.0057640513,0.00078202557],"domain_scores_gemma":[0.8733442,0.06539729,0.009582327,0.034275755,0.016129326,0.0012710177],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.028989213,0.0009247798,0.0010584873,0.0033717074,0.0018645391,0.0068340516,0.003277134,0.0023692134,0.003971832],"category_scores_gemma":[0.12124671,0.00072244555,0.00080188335,0.002139572,0.003421504,0.011068961,0.008511098,0.005664123,0.004631874],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00023573684,0.00024999754,0.011376043,0.0008280941,0.00009718601,0.0004335513,0.0054573817,0.010025569,0.010279643,0.08564262,0.031788714,0.8435854],"study_design_scores_gemma":[0.00013862723,0.00030530413,0.009883993,0.001946658,0.000118184274,0.0027566545,0.0063189245,0.23771973,0.06417875,0.37727925,0.2990193,0.0003346334],"about_ca_topic_score_codex":0.0013094317,"about_ca_topic_score_gemma":0.0019338496,"teacher_disagreement_score":0.028989213,"about_ca_system_score_codex":0.0016235001,"about_ca_system_score_gemma":0.0049788407,"threshold_uncertainty_score":0.15331143},"labels":[],"label_agreement":null},{"id":"W7132965286","doi":"","title":"Shakespeare&apos;s Telling Words: Grammar, Linguistic Encounters, and the Risks of Speech","year":2008,"lang":"en","type":"dissertation","venue":"TSpace","topic":"Authorship Attribution and Profiling","field":"Computer Science","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Toronto","funders":"","keywords":"Deixis; Focus (optics); TRACE (psycholinguistics); Grammar; Presupposition; Selection (genetic algorithm); Linguistic description; Deep linguistic processing; Linguistic analysis; Interpersonal communication; Passive voice","score_opus":0.09417971592069944,"score_gpt":0.3999295770776604,"score_spread":0.30574986115696096,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W7132965286","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.68300164,0.012663273,0.017828777,0.019377694,0.0003854306,0.000054183016,0.000089471825,0.00018334195,0.26641616],"genre_scores_gemma":[0.98132575,0.0012622522,0.0015461197,0.00026140793,0.000056173623,0.00001920579,0.000018402197,0.00006223976,0.015448442],"study_design_codex":"qualitative","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.99740916,0.0014968956,0.000077246856,0.0002359729,0.0005514089,0.00022924866],"domain_scores_gemma":[0.9973755,0.0017400183,0.00029164806,0.00017545628,0.00023325079,0.00018409172],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0029434662,0.00045000124,0.00033364247,0.0012369025,0.0076042176,0.0072366437,0.000584302,0.001461304,0.0025711507],"category_scores_gemma":[0.0058562094,0.00034703998,0.00020604926,0.00076626835,0.024734758,0.005108269,0.0045605144,0.0021311704,0.0004723688],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0000141127375,0.0000073102397,0.0017923248,0.000045408822,0.0000038676794,0.000489549,0.6340588,0.00010494135,0.00043698214,0.35117227,0.0020700311,0.009804388],"study_design_scores_gemma":[0.000012542362,0.000056801797,0.0068301116,0.0003567438,0.000013198156,0.0014430775,0.4699802,0.00053399167,0.0012625239,0.21234374,0.30711105,0.00005601692],"about_ca_topic_score_codex":0.012875051,"about_ca_topic_score_gemma":0.013228106,"teacher_disagreement_score":0.012875051,"about_ca_system_score_codex":0.0039356053,"about_ca_system_score_gemma":0.002225873,"threshold_uncertainty_score":0.028554976},"labels":[],"label_agreement":null},{"id":"W7133357600","doi":"10.65521/mjret.v9i2.1156","title":"Online Matrimonial Portal","year":2022,"lang":"","type":"article","venue":"Multidisciplinary Journal of Research in Engineering and Technology","topic":"Authorship Attribution and Profiling","field":"Computer Science","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"WSP (Canada)","funders":"","keywords":"Service provider; Matching (statistics); Service (business); Variation (astronomy); Register (sociolinguistics); User profile","score_opus":0.053872985387168094,"score_gpt":0.36378262920120735,"score_spread":0.30990964381403924,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W7133357600","genre_codex":"other","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.007955928,0.0017245295,0.009153432,0.0020620853,0.0012042619,0.0005168265,0.081465885,0.097976536,0.79794055],"genre_scores_gemma":[0.06267035,0.0023712302,0.017441474,0.002670603,0.0017330925,0.0007049222,0.15551506,0.020383999,0.7365093],"study_design_codex":"not_applicable","study_design_gemma":"not_applicable","domain_scores_codex":[0.99931514,0.00016613741,0.000056035537,0.000084786174,0.00027211307,0.00010583838],"domain_scores_gemma":[0.99568033,0.0006846711,0.0003988848,0.0013225038,0.0008087797,0.0011047034],"candidate_categories":["insufficient_payload"],"consensus_categories":[],"category_scores_codex":[0.0011503334,0.00077482854,0.00051589793,0.0028813358,0.0010593523,0.0043734536,0.0014640836,0.0009947631,0.4513571],"category_scores_gemma":[0.006710487,0.0003190974,0.0003888295,0.0037628103,0.00024821353,0.004126664,0.0029323814,0.0009536334,0.39803696],"study_design_candidate":"not_applicable","study_design_consensus":"not_applicable","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00021652727,0.000114059854,0.0008803602,0.00036190532,0.0000069559314,0.00023419729,0.00025185486,0.00005249133,0.0010647951,0.0050579645,0.9159342,0.07582457],"study_design_scores_gemma":[0.000017341406,0.000023925368,0.0013958174,0.00006250946,0.000003381038,0.00021091654,0.00008666041,0.00021992883,0.0005960282,0.0014269266,0.9959403,0.000016161439],"about_ca_topic_score_codex":0.0008557302,"about_ca_topic_score_gemma":0.0014040525,"teacher_disagreement_score":0.4513571,"about_ca_system_score_codex":0.0004979529,"about_ca_system_score_gemma":0.0008775916,"threshold_uncertainty_score":0.7825725},"labels":[],"label_agreement":null},{"id":"W7133362845","doi":"10.65521/mjret.v9i3.1219","title":"Online Matrimonial Portal","year":2022,"lang":"","type":"article","venue":"Multidisciplinary Journal of Research in Engineering and Technology","topic":"Authorship Attribution and Profiling","field":"Computer Science","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"WSP (Canada)","funders":"","keywords":"Service provider; Matching (statistics); Service (business); Variation (astronomy); Register (sociolinguistics); User profile","score_opus":0.053872985387168094,"score_gpt":0.36378262920120735,"score_spread":0.30990964381403924,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W7133362845","genre_codex":"other","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.008403064,0.0018192796,0.009589495,0.0021713844,0.0012775292,0.0005438228,0.08176593,0.099274665,0.7951549],"genre_scores_gemma":[0.06561899,0.00253286,0.018225942,0.0027548368,0.0018339797,0.0007470801,0.15645961,0.020568473,0.73125833],"study_design_codex":"not_applicable","study_design_gemma":"not_applicable","domain_scores_codex":[0.99930286,0.00017153188,0.00005772885,0.000084689455,0.000274559,0.00010855483],"domain_scores_gemma":[0.99566805,0.00068972073,0.0004101617,0.001314445,0.000816874,0.0011007335],"candidate_categories":["insufficient_payload"],"consensus_categories":[],"category_scores_codex":[0.0011541381,0.0007611949,0.0005232697,0.0028585342,0.0010785995,0.004363944,0.001457115,0.0009995512,0.4373349],"category_scores_gemma":[0.0067779482,0.00031634068,0.00038875127,0.0038128905,0.00024881275,0.0041094045,0.0028997613,0.0009694061,0.38389516],"study_design_candidate":"not_applicable","study_design_consensus":"not_applicable","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0002139705,0.00011623905,0.0008941633,0.00037758585,0.0000068789886,0.00024240764,0.00026396365,0.000052506486,0.0010584962,0.0051413,0.91530085,0.0763316],"study_design_scores_gemma":[0.00001680159,0.000023787708,0.0014233377,0.00006502462,0.0000034239586,0.00022223422,0.00009020314,0.000221052,0.0006028012,0.0014663123,0.99584854,0.000016364043],"about_ca_topic_score_codex":0.0008343664,"about_ca_topic_score_gemma":0.0013522183,"teacher_disagreement_score":0.4373349,"about_ca_system_score_codex":0.0004895721,"about_ca_system_score_gemma":0.00089201704,"threshold_uncertainty_score":0.80257344},"labels":[],"label_agreement":null},{"id":"W7149886153","doi":"","title":"La questione del Fiore e del Detto d’Amore: aggiornamenti","year":2025,"lang":"it","type":"article","venue":"IRIS Research product catalog (Sapienza University of Rome)","topic":"Authorship Attribution and Profiling","field":"Computer Science","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":true,"ca_institutions":"","funders":"","keywords":"Reinterpretation; Key (lock); Interpretation (philosophy); Falsifiability; Statistical analysis","score_opus":0.05940269779055165,"score_gpt":0.33673847912654825,"score_spread":0.2773357813359966,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W7149886153","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.48097923,0.012643489,0.009174191,0.05585429,0.0019857388,0.00002868581,0.00016965767,0.00013917196,0.43902555],"genre_scores_gemma":[0.9780832,0.0011826011,0.00091914256,0.00092330854,0.0005506875,0.000010998722,0.0000414005,0.000042089134,0.018246563],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"not_applicable","domain_scores_codex":[0.9963648,0.0014998935,0.00011359227,0.0006545118,0.0009706485,0.00039665977],"domain_scores_gemma":[0.9896102,0.0058641545,0.0014016674,0.0013578535,0.0012254008,0.0005408478],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0031317766,0.0002962911,0.00026562382,0.002031514,0.0053351526,0.008035506,0.0005475766,0.0015614734,0.0042747445],"category_scores_gemma":[0.01928848,0.000121605524,0.00011943833,0.0026676739,0.010021973,0.0051170248,0.0021858322,0.0017967152,0.00092289783],"study_design_candidate":"not_applicable","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00008899166,0.000020741807,0.021447154,0.00013518921,0.000019923133,0.0003517915,0.14288895,0.00008766805,0.0006601097,0.7030147,0.022431798,0.10885302],"study_design_scores_gemma":[0.000011696263,0.00004792715,0.032690402,0.0005503846,0.000025598203,0.0016010347,0.066697925,0.00086880295,0.0012876926,0.12972935,0.76643646,0.00005268137],"about_ca_topic_score_codex":0.0036091171,"about_ca_topic_score_gemma":0.0063759834,"teacher_disagreement_score":0.008035506,"about_ca_system_score_codex":0.002874035,"about_ca_system_score_gemma":0.001308149,"threshold_uncertainty_score":0.020852685},"labels":[],"label_agreement":null},{"id":"W7160428348","doi":"10.1109/iccit68739.2025.11490395","title":"A Hybrid Deep Learning and Stylometric Feature-Based Framework for Authorship Attribution in Bangla Literature","year":2025,"lang":"","type":"article","venue":"","topic":"Authorship Attribution and Profiling","field":"Computer Science","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Regina","funders":"","keywords":"Authorship attribution; Deep learning; Bengali; Stylometry; Paraphrase; Taxonomy (biology)","score_opus":0.021238265338624843,"score_gpt":0.31352164389977266,"score_spread":0.29228337856114783,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W7160428348","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.3260085,0.002264439,0.6541677,0.0011239169,0.00023561412,0.00018750789,0.0021717707,0.0043862187,0.0094543435],"genre_scores_gemma":[0.8976972,0.0004952453,0.09171527,0.00013013049,0.0001114785,0.00009531433,0.002098725,0.00007575128,0.007580907],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.99965394,0.00007224475,0.000033626606,0.00010189347,0.00007669064,0.0000615385],"domain_scores_gemma":[0.9995277,0.00015469754,0.000076391916,0.00006338121,0.00014105656,0.000036790974],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.000636365,0.00056151353,0.00044705498,0.003056234,0.00039701723,0.000998372,0.0008374833,0.0005896532,0.0013878999],"category_scores_gemma":[0.0016279334,0.00017326108,0.000598174,0.0019407017,0.00037110655,0.0013644905,0.0007697029,0.00068088423,0.0007557829],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00027999922,0.00039625342,0.020785047,0.00014914149,0.00015071557,0.00042630092,0.00039665116,0.07865721,0.010754262,0.008556218,0.0078052455,0.871643],"study_design_scores_gemma":[0.000010447013,0.000040704068,0.004226062,0.000024572675,0.00003471816,0.0001043683,0.00009481189,0.981431,0.0031330683,0.008256166,0.0026263036,0.000017770119],"about_ca_topic_score_codex":0.004678455,"about_ca_topic_score_gemma":0.007269801,"teacher_disagreement_score":0.004678455,"about_ca_system_score_codex":0.0007831779,"about_ca_system_score_gemma":0.000853166,"threshold_uncertainty_score":0.009302437},"labels":[],"label_agreement":null},{"id":"W7160845154","doi":"10.1109/spicscon69221.2025.11504247","title":"Authorship Attribution in Bangla Literature: A Comparative Study of Word Embedding and Deep Learning Models","year":2025,"lang":"","type":"article","venue":"","topic":"Authorship Attribution and Profiling","field":"Computer Science","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Regina","funders":"","keywords":"Deep learning; Bengali; Authorship attribution; Word embedding; Word (group theory); Attribution","score_opus":0.08015275753887222,"score_gpt":0.350387735075677,"score_spread":0.2702349775368048,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W7160845154","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.88066113,0.00803152,0.09308603,0.0017310578,0.00038672885,0.000088147426,0.001345702,0.00083852734,0.013831051],"genre_scores_gemma":[0.9752549,0.0017373738,0.018229838,0.0000858925,0.00007994182,0.000027727983,0.0013256129,0.00005492828,0.0032037597],"study_design_codex":"design_other","study_design_gemma":"bench_or_experimental","domain_scores_codex":[0.9992067,0.00028378388,0.0000832418,0.00020205019,0.00016272329,0.00006147743],"domain_scores_gemma":[0.9956683,0.002912081,0.0003627589,0.00038816157,0.00054088305,0.00012781876],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0016705499,0.00073256897,0.0004282413,0.0021349073,0.00034387963,0.0016567839,0.000543983,0.0006397268,0.0012882664],"category_scores_gemma":[0.0069986205,0.00018003744,0.0005043054,0.0021319077,0.00043800633,0.003466005,0.0009119601,0.00094251084,0.0006854688],"study_design_candidate":"bench_or_experimental","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0005096684,0.00048399705,0.07247917,0.00068066793,0.00027160416,0.00032411914,0.0014079658,0.07065869,0.0044746553,0.008500957,0.0054898816,0.8347187],"study_design_scores_gemma":[0.000021518157,0.00025383194,0.030485656,0.0002198388,0.00012145724,0.00029498167,0.0013224417,0.9420804,0.0050555016,0.013238349,0.0068493523,0.00005664485],"about_ca_topic_score_codex":0.0029510427,"about_ca_topic_score_gemma":0.0037314473,"teacher_disagreement_score":0.0029510427,"about_ca_system_score_codex":0.00075236027,"about_ca_system_score_gemma":0.0004653776,"threshold_uncertainty_score":0.008834839},"labels":[],"label_agreement":null},{"id":"W8985453","doi":"10.1016/b0-08-044854-2/00980-9","title":"Computers in the Linguistic Humanities: Overview","year":2006,"lang":"en","type":"book-chapter","venue":"Elsevier eBooks","topic":"Authorship Attribution and Profiling","field":"Computer Science","cited_by":1,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Toronto","funders":"","keywords":"Narrative; Linguistics; Meaning (existential); Computer science; Semantics (computer science); Computational linguistics; Cybernetics; Artificial intelligence; Cognitive science; Humanities; Epistemology; Psychology; Philosophy","score_opus":0.056873613493160106,"score_gpt":0.2773240413553588,"score_spread":0.2204504278621987,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W8985453","genre_codex":"review","genre_gemma":"review","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"review","genre_consensus":"review","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0024298374,0.68256176,0.17269504,0.007114704,0.0023843597,0.00017685838,0.0006322599,0.0026250929,0.12938006],"genre_scores_gemma":[0.044075374,0.6581959,0.16355005,0.0020491849,0.005724389,0.0004435449,0.0014026766,0.00070672674,0.123852186],"study_design_codex":"design_other","study_design_gemma":"not_applicable","domain_scores_codex":[0.9991755,0.00022658872,0.0000731693,0.00018871321,0.00027405028,0.000062012405],"domain_scores_gemma":[0.9970561,0.0021295885,0.00008129015,0.00025467708,0.00036620483,0.0001121559],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0015057306,0.0010321233,0.0010558954,0.0055888384,0.0006910286,0.005786621,0.0013123689,0.0019033444,0.013883676],"category_scores_gemma":[0.003395462,0.0008577936,0.0004475144,0.009955177,0.0018621472,0.008373276,0.0017246291,0.0019118631,0.007375119],"study_design_candidate":"not_applicable","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.000015628693,0.000035411205,0.0003757829,0.0010276801,0.00001914831,0.00004749994,0.0003830411,0.001021422,0.0005649121,0.09047667,0.082864664,0.8231681],"study_design_scores_gemma":[0.0000045728107,0.000017089927,0.0008855411,0.0008353718,0.000015889631,0.00041908678,0.0002520733,0.0028174273,0.0005091055,0.113064595,0.8811539,0.000025325824],"about_ca_topic_score_codex":0.0014197322,"about_ca_topic_score_gemma":0.0021817486,"teacher_disagreement_score":0.013883676,"about_ca_system_score_codex":0.0010147643,"about_ca_system_score_gemma":0.0013286656,"threshold_uncertainty_score":0.04644555},"labels":[],"label_agreement":null},{"id":"W93917463","doi":"","title":"Authorship Attribution for Small Texts: Literary and Forensic Experiments.","year":2007,"lang":"en","type":"article","venue":"PAN","topic":"Authorship Attribution and Profiling","field":"Computer Science","cited_by":19,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Toronto","funders":"","keywords":"Attribution; Authorship attribution; Psychology; History; Computer science; Linguistics; Social psychology; Natural language processing; Philosophy","score_opus":0.06904991508512409,"score_gpt":0.319997208466426,"score_spread":0.2509472933813019,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W93917463","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.9789444,0.00033547566,0.013061437,0.00046348874,0.00021657562,0.0002996818,0.00078899483,0.00031229152,0.0055775954],"genre_scores_gemma":[0.9829966,0.00013639667,0.012696733,0.00008626075,0.000119027674,0.00017388661,0.0008666987,0.00007314964,0.002851297],"study_design_codex":"design_other","study_design_gemma":"bench_or_experimental","domain_scores_codex":[0.9912937,0.0051728743,0.00052452134,0.0011328169,0.001587919,0.0002881668],"domain_scores_gemma":[0.8066755,0.15300056,0.010069628,0.021854088,0.0062828013,0.00211736],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.010341296,0.0005769152,0.0005483904,0.0023358914,0.0021862357,0.0021258702,0.0011221167,0.0016906584,0.0046479567],"category_scores_gemma":[0.103124164,0.0003101622,0.00028926402,0.0023882622,0.0017827919,0.0032329164,0.0023567989,0.0015371492,0.0012601323],"study_design_candidate":"bench_or_experimental","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.022236029,0.024392249,0.077599525,0.0026801936,0.00062608795,0.0029811994,0.028389242,0.026285727,0.12971613,0.05639623,0.035606343,0.5930911],"study_design_scores_gemma":[0.0019789727,0.008831976,0.09181485,0.0006410611,0.0004977196,0.0069671697,0.015179163,0.48376116,0.23766994,0.11780504,0.03443926,0.0004137384],"about_ca_topic_score_codex":0.0003025742,"about_ca_topic_score_gemma":0.0003470231,"teacher_disagreement_score":0.010341296,"about_ca_system_score_codex":0.00053179346,"about_ca_system_score_gemma":0.000496336,"threshold_uncertainty_score":0.05469066},"labels":[],"label_agreement":null}]}