{"meta":{"query_hash":"c357e742c7f2","filters":{"venue":"Journal of Open Humanities Data"},"cohort_total":9,"direct_labels_cover":0,"predictions_cover":9,"exported":9,"export_cap":100000,"truncated":false,"label_status":"direct model label, unvalidated","prediction_status":"machine_predicted_unvalidated (Codex and Gemma teacher distillation)","score_status":"score_only:v0-immature-baseline","snapshot":{"source":"OpenAlex, pinned release, all 482 partitions","release":"2026-06-24","frame_built":"2026-07-12"},"permalink":"https://metacan.xera.ac/q/c357e742c7f2","api":"https://metacan.xera.ac/api/v1/cohort?venue=Journal+of+Open+Humanities+Data"},"results":[{"id":"W3190643984","doi":"10.5334/johd.42","title":"The Corpus for Idiolectal Research (CIDRE)","year":2021,"lang":"en","type":"article","venue":"Journal of Open Humanities Data","topic":"Authorship Attribution and Profiling","field":"Computer Science","cited_by":1,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":true,"ca_institutions":"","funders":"Agence Nationale de la Recherche","keywords":"Paratext; Scripting language; Metadata; License; Computer science; World Wide Web; Open source; Style (visual arts); Literature; Linguistics; Art; Programming language; Software; Philosophy","score_opus":0.6364291660620014,"score_gpt":0.5070253019086151,"score_spread":0.12940386415338634,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W3190643984","genre_codex":"dataset","genre_gemma":"dataset","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"dataset","genre_consensus":"dataset","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.041156333,0.009503007,0.007062937,0.0018288707,0.00067260856,0.0007479881,0.8390331,0.0016611293,0.09833395],"genre_scores_gemma":[0.12667193,0.0031677638,0.027033025,0.0007422514,0.00046259674,0.0024661794,0.8139523,0.0014672036,0.024036724],"study_design_codex":"not_applicable","study_design_gemma":"not_applicable","domain_scores_codex":[0.9968388,0.00089862675,0.000359894,0.00077070243,0.00070509745,0.00042679903],"domain_scores_gemma":[0.9928323,0.0023855255,0.0005535002,0.0014249182,0.0022917888,0.0005118435],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.002936705,0.00075399963,0.0010063526,0.017301084,0.0034197825,0.003865032,0.0011968144,0.0011564774,0.040657107],"category_scores_gemma":[0.010925295,0.00030452386,0.00035600306,0.017049959,0.001493519,0.0016901612,0.0027895374,0.0013051542,0.016703716],"study_design_candidate":"not_applicable","study_design_consensus":"not_applicable","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0002298049,0.00008764519,0.005919826,0.0028404624,0.000041399428,0.0007831931,0.011536741,0.00025217838,0.003825201,0.05141644,0.76156044,0.16150671],"study_design_scores_gemma":[0.000018404164,0.00000754861,0.008882189,0.00037882265,0.0000107100295,0.00029515233,0.001084762,0.00007215051,0.00044205977,0.0012974335,0.9874871,0.000023632088],"about_ca_topic_score_codex":0.07552463,"about_ca_topic_score_gemma":0.07976341,"teacher_disagreement_score":0.07552463,"about_ca_system_score_codex":0.0052000675,"about_ca_system_score_gemma":0.0060729617,"threshold_uncertainty_score":0.15017003},"labels":[],"label_agreement":null},{"id":"W4308571509","doi":"10.5334/johd.97","title":"CREMMA Medii Aevi: Literary Manuscript Text Recognition in Latin","year":2023,"lang":"en","type":"article","venue":"Journal of Open Humanities Data","topic":"Natural Language Processing Techniques","field":"Computer Science","cited_by":4,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Université de Montréal","funders":"","keywords":"Latin Americans; Computer science; Representation (politics); Natural language processing; Artificial intelligence; Segmentation; Medieval Latin; Information retrieval; Linguistics; History; Classics; Political science","score_opus":0.23807547872461002,"score_gpt":0.3631402314952308,"score_spread":0.12506475277062076,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4308571509","genre_codex":"dataset","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.34479994,0.013774905,0.04615871,0.0039389567,0.0039842306,0.0009403466,0.45280516,0.05229851,0.08129923],"genre_scores_gemma":[0.2153117,0.0019358837,0.07432689,0.0009791129,0.0006426053,0.00084281183,0.6760392,0.0013174431,0.02860445],"study_design_codex":"not_applicable","study_design_gemma":"bench_or_experimental","domain_scores_codex":[0.9993241,0.000116116564,0.000097228534,0.00023888412,0.00015988504,0.00006382694],"domain_scores_gemma":[0.9988243,0.00023327926,0.00010659789,0.0003107163,0.0004113583,0.000113755115],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.000636499,0.0011022341,0.0004920916,0.0035583205,0.0009871394,0.0018980344,0.0011778253,0.0011208731,0.008566272],"category_scores_gemma":[0.002731885,0.00016818239,0.00088205317,0.0022429319,0.0005243726,0.0014111586,0.0012719623,0.0007248707,0.011284828],"study_design_candidate":"bench_or_experimental","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0008196988,0.00042695802,0.018782612,0.0020980136,0.0001613163,0.0014578274,0.0013214715,0.004214742,0.029346272,0.00385063,0.48930684,0.44821364],"study_design_scores_gemma":[0.00013039625,0.00020976088,0.041115377,0.00045848425,0.00008157677,0.0025272656,0.0024872893,0.024165021,0.03960425,0.0029501948,0.88614553,0.00012477777],"about_ca_topic_score_codex":0.0073521296,"about_ca_topic_score_gemma":0.017526759,"teacher_disagreement_score":0.008566272,"about_ca_system_score_codex":0.00092796126,"about_ca_system_score_gemma":0.0009354121,"threshold_uncertainty_score":0.02865702},"labels":[],"label_agreement":null},{"id":"W4312215389","doi":"10.5334/johd.94","title":"The TRANSCOMP Dataset of Literary Translations from 120 Languages and a Parallel Collection of English-language Originals","year":2022,"lang":"en","type":"article","venue":"Journal of Open Humanities Data","topic":"Natural Language Processing Techniques","field":"Computer Science","cited_by":2,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"McGill University","funders":"","keywords":"Linguistics; Computer science; Word (group theory); Metadata; Literary translation; Natural language processing; Literature; History; Art; World Wide Web; Philosophy","score_opus":0.05700619531125964,"score_gpt":0.3531706120189455,"score_spread":0.2961644167076859,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4312215389","genre_codex":"dataset","genre_gemma":"dataset","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"dataset","genre_consensus":"dataset","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.01692666,0.0006954038,0.0012579839,0.00026831587,0.00030630655,0.00018185312,0.9729258,0.0012944535,0.0061432268],"genre_scores_gemma":[0.0042513204,0.00011949383,0.0017604561,0.00004961857,0.000054101736,0.00022814053,0.99156135,0.00014753577,0.0018280803],"study_design_codex":"not_applicable","study_design_gemma":"not_applicable","domain_scores_codex":[0.998027,0.0004092733,0.00034514855,0.00039999958,0.0006134851,0.00020507594],"domain_scores_gemma":[0.9951062,0.0013380281,0.00035271898,0.0012033127,0.0015288254,0.0004709347],"candidate_categories":["open_science"],"consensus_categories":[],"category_scores_codex":[0.0014093602,0.0015498238,0.001075152,0.009182373,0.0014801543,0.0021518185,0.0019239032,0.0016331566,0.025257546],"category_scores_gemma":[0.0070095584,0.00040697772,0.0010374532,0.010157584,0.0010114526,0.0018378086,0.0032282649,0.0015729871,0.03728485],"study_design_candidate":"not_applicable","study_design_consensus":"not_applicable","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00046369262,0.00038794233,0.005401305,0.0027172912,0.000089235706,0.0009803771,0.0011020616,0.0006481677,0.0042311256,0.0023725692,0.9373074,0.044298757],"study_design_scores_gemma":[0.00027945824,0.00011904451,0.022420362,0.00047261373,0.000050434846,0.0010682032,0.0018398586,0.0012739473,0.0034415692,0.001405845,0.967553,0.00007570979],"about_ca_topic_score_codex":0.005032044,"about_ca_topic_score_gemma":0.013128739,"teacher_disagreement_score":0.9980761,"about_ca_system_score_codex":0.0008320847,"about_ca_system_score_gemma":0.0017822395,"threshold_uncertainty_score":0.08449495},"labels":[],"label_agreement":null},{"id":"W4312706369","doi":"10.5334/johd.88","title":"The CONLIT Dataset of Contemporary Literature","year":2022,"lang":"en","type":"article","venue":"Journal of Open Humanities Data","topic":"Narrative Theory and Analysis","field":"Arts and Humanities","cited_by":4,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"McGill University","funders":"","keywords":"Elite; Biography; Literature; History; Art","score_opus":0.2284273115647129,"score_gpt":0.3408972242918083,"score_spread":0.11246991272709539,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4312706369","genre_codex":"dataset","genre_gemma":"dataset","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"dataset","genre_consensus":"dataset","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0022388652,0.0011249554,0.00021776187,0.00024845672,0.000056927845,0.000057790865,0.9924901,0.0002479977,0.003317005],"genre_scores_gemma":[0.0017611384,0.0003046152,0.0007418054,0.00008508625,0.00002769167,0.00018851698,0.9959629,0.000037120066,0.0008910757],"study_design_codex":"not_applicable","study_design_gemma":"not_applicable","domain_scores_codex":[0.9971751,0.00044549597,0.00057531043,0.0005957326,0.0009179002,0.00029042878],"domain_scores_gemma":[0.9887495,0.0041874303,0.0016871539,0.001471604,0.0028912113,0.0010131283],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0018381019,0.0012747967,0.0013581921,0.025075234,0.0016485647,0.0045230547,0.002536519,0.0022943693,0.039627124],"category_scores_gemma":[0.0146458,0.0004839173,0.0008549555,0.028885236,0.00062722183,0.0022418352,0.0033588428,0.0015869953,0.04487808],"study_design_candidate":"not_applicable","study_design_consensus":"not_applicable","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00012719497,0.000106017455,0.006906373,0.0031401662,0.000060843267,0.00025652617,0.0003044465,0.0003928451,0.00054327544,0.003224214,0.9661364,0.018801663],"study_design_scores_gemma":[0.000096572534,0.000023485103,0.009474726,0.0007281545,0.00003414193,0.00024932798,0.00047265366,0.0004517656,0.00034607018,0.000988518,0.98710465,0.000029881703],"about_ca_topic_score_codex":0.011106856,"about_ca_topic_score_gemma":0.032079577,"teacher_disagreement_score":0.039627124,"about_ca_system_score_codex":0.0021885608,"about_ca_system_score_gemma":0.004117466,"threshold_uncertainty_score":0.13256598},"labels":[],"label_agreement":null},{"id":"W4319597719","doi":"10.5334/johd.95","title":"MultiHATHI: A Complete Collection of Multilingual Prose Fiction in the HathiTrust Digital Library","year":2023,"lang":"en","type":"article","venue":"Journal of Open Humanities Data","topic":"Natural Language Processing Techniques","field":"Computer Science","cited_by":2,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"McGill University","funders":"","keywords":"Bespoke; Metadata; Computer science; Digital library; Classifier (UML); English language; World Wide Web; Information retrieval; Natural language processing; Artificial intelligence; Linguistics; Literature; Art; Poetry","score_opus":0.13862741170011722,"score_gpt":0.3461929316426599,"score_spread":0.2075655199425427,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4319597719","genre_codex":"dataset","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.03420883,0.0033760616,0.0011150219,0.00060794235,0.00033503523,0.00010473407,0.93176776,0.0020775096,0.026407147],"genre_scores_gemma":[0.018916339,0.0006375014,0.0026408422,0.00012636386,0.00012871233,0.00014126622,0.96943116,0.00031841607,0.007659328],"study_design_codex":"not_applicable","study_design_gemma":"not_applicable","domain_scores_codex":[0.99917006,0.00013802068,0.00010528737,0.00016874819,0.00029712613,0.00012068461],"domain_scores_gemma":[0.99735814,0.00070718717,0.00028033418,0.00053062744,0.0007534109,0.00037018655],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0006231831,0.0008974321,0.0006937363,0.012471175,0.001797711,0.0026166989,0.0010388914,0.0011156502,0.02161973],"category_scores_gemma":[0.004316409,0.00029395576,0.00059531425,0.013865233,0.0007140151,0.0029672186,0.0024306204,0.0009840286,0.02651446],"study_design_candidate":"not_applicable","study_design_consensus":"not_applicable","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00025627547,0.000107474174,0.011461786,0.0025616784,0.00006383966,0.0005822787,0.0024780063,0.00044023036,0.0022560398,0.0031025058,0.9140636,0.062626414],"study_design_scores_gemma":[0.000033990495,0.00003248051,0.029533774,0.00037159552,0.000034295954,0.00048719443,0.0017505964,0.00089329766,0.0018872044,0.0009480707,0.96397346,0.00005401648],"about_ca_topic_score_codex":0.016643526,"about_ca_topic_score_gemma":0.05296014,"teacher_disagreement_score":0.02161973,"about_ca_system_score_codex":0.0014397914,"about_ca_system_score_gemma":0.00199101,"threshold_uncertainty_score":0.07232523},"labels":[],"label_agreement":null},{"id":"W4382727197","doi":"10.5334/johd.109","title":"A Mixed Method Twitter Methodology and Anonymous Corpus","year":2023,"lang":"en","type":"article","venue":"Journal of Open Humanities Data","topic":"Misinformation and Its Impacts","field":"Social Sciences","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Brock University","funders":"","keywords":"Vetting; Anonymity; Computer science; Field (mathematics); Work (physics); Process (computing); World Wide Web; Simple (philosophy); Data science; Internet privacy; Information retrieval; Computer security; Engineering; Mathematics","score_opus":0.7209269913846231,"score_gpt":0.5227081836891851,"score_spread":0.19821880769543798,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4382727197","genre_codex":"dataset","genre_gemma":"methods","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":null,"domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.1936145,0.0018711704,0.09383463,0.005041266,0.0023698865,0.02948325,0.59299606,0.003594638,0.07719461],"genre_scores_gemma":[0.19049725,0.0005839791,0.17165938,0.0035118507,0.00096795574,0.08086894,0.49760452,0.0020997734,0.05220636],"study_design_codex":"not_applicable","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.99199426,0.003731006,0.00072050653,0.0014613653,0.0016253162,0.00046757463],"domain_scores_gemma":[0.977466,0.010418236,0.0018080455,0.0049147443,0.0047797114,0.00061328616],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.009382276,0.0008598697,0.00066815066,0.0040564104,0.0035978684,0.0026831897,0.0023337088,0.00277027,0.03182924],"category_scores_gemma":[0.026020141,0.0005943737,0.00065655896,0.004650998,0.001837903,0.0019197947,0.0042116106,0.0018855949,0.016518142],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.001463053,0.0022395996,0.032876372,0.0050645806,0.00019641929,0.002463165,0.018196438,0.0049275304,0.008354375,0.0503372,0.7113634,0.16251789],"study_design_scores_gemma":[0.0003137216,0.00032248252,0.026847048,0.0007979864,0.00008045335,0.0006648229,0.008547773,0.006547071,0.0044971835,0.013888942,0.9373196,0.00017283829],"about_ca_topic_score_codex":0.007475318,"about_ca_topic_score_gemma":0.018834312,"teacher_disagreement_score":0.99061775,"about_ca_system_score_codex":0.0017530217,"about_ca_system_score_gemma":0.0034471701,"threshold_uncertainty_score":0.10647941},"labels":[],"label_agreement":null},{"id":"W4389949574","doi":"10.5334/johd.169","title":"3D Modelling of Jerusalem’s Maghrebi Quarter","year":2023,"lang":"en","type":"article","venue":"Journal of Open Humanities Data","topic":"3D Surveying and Cultural Heritage","field":"Earth and Planetary Sciences","cited_by":1,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":true,"ca_institutions":"","funders":"Université Gustave Eiffel; Università Degli Studi di Modena e Reggio Emila","keywords":"Quarter (Canadian coin); Geology; Archaeology; History","score_opus":0.3692056332634672,"score_gpt":0.3160634521328087,"score_spread":0.05314218113065855,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4389949574","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.86886036,0.0032916314,0.022791443,0.00089518283,0.00031230188,0.00029904494,0.007440166,0.0010100417,0.09509983],"genre_scores_gemma":[0.97023576,0.0011607566,0.014788155,0.000052536114,0.000029469078,0.00006564222,0.0026496486,0.0001776364,0.010840501],"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.999869,0.000027168457,0.000005990094,0.000033386492,0.000038507074,0.000026006386],"domain_scores_gemma":[0.9999385,0.00002122237,0.0000056113363,0.000013651533,0.0000144351,0.000006603087],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0002582705,0.0004479826,0.0003174631,0.0015261765,0.0008749653,0.0025441078,0.0004978117,0.0007092174,0.0051075295],"category_scores_gemma":[0.0006006128,0.0003633496,0.00043405354,0.0014756598,0.000646009,0.00055583793,0.0008461056,0.00034410672,0.0011968086],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0009904858,0.00033639706,0.05751362,0.0022699519,0.00017545705,0.007933254,0.027669642,0.45272,0.024858544,0.045074966,0.04622883,0.33422896],"study_design_scores_gemma":[0.00011740434,0.0002453237,0.1498396,0.0012400482,0.00016109463,0.002842974,0.02734694,0.37978697,0.01212742,0.008093309,0.41793403,0.0002648944],"about_ca_topic_score_codex":0.022096848,"about_ca_topic_score_gemma":0.039341897,"teacher_disagreement_score":0.022096848,"about_ca_system_score_codex":0.00067848305,"about_ca_system_score_gemma":0.0004740703,"threshold_uncertainty_score":0.04393643},"labels":[],"label_agreement":null},{"id":"W4408373139","doi":"10.5334/johd.262","title":"Data from ARTiculating Canadian Identities: The Canada Council Art Bank’s Mycelial Presence and Influence in the Realm of Canadian Fine Art","year":2024,"lang":"en","type":"article","venue":"Journal of Open Humanities Data","topic":"Visual Culture and Art Theory","field":"Arts and Humanities","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":true,"ca_institutions":"","funders":"Social Sciences and Humanities Research Council of Canada","keywords":"Realm; Political science; Art; Public administration; Law","score_opus":0.22854600992274965,"score_gpt":0.30586384381278614,"score_spread":0.07731783389003649,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4408373139","genre_codex":"dataset","genre_gemma":"dataset","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"dataset","genre_consensus":"dataset","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.1344921,0.0017762652,0.0010570223,0.0020787914,0.0001431759,0.00034710122,0.7792645,0.00030052647,0.08054053],"genre_scores_gemma":[0.39066228,0.0017151783,0.0056803483,0.00066526537,0.00007714134,0.0007184109,0.56715095,0.0003070752,0.033023436],"study_design_codex":"not_applicable","study_design_gemma":"not_applicable","domain_scores_codex":[0.9969908,0.00014274695,0.00011439037,0.00033081556,0.0016341915,0.00078710774],"domain_scores_gemma":[0.98953027,0.0007758496,0.00075610017,0.0008921472,0.0065092356,0.0015364417],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0015263051,0.00071931496,0.0005438298,0.009395101,0.0066206874,0.0054159546,0.0021501766,0.0009617598,0.015188278],"category_scores_gemma":[0.010139673,0.0004388441,0.00048009993,0.022897456,0.0016391753,0.0016105643,0.00427033,0.0014449774,0.004271553],"study_design_candidate":"not_applicable","study_design_consensus":"not_applicable","about_ca_topic_candidate":true,"about_ca_topic_consensus":true,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00029572137,0.00013630674,0.13620842,0.00088927173,0.00010152039,0.00046476783,0.024668356,0.0009215358,0.0008385116,0.012931691,0.75348437,0.06905948],"study_design_scores_gemma":[0.000025741752,0.000013287543,0.36707023,0.0006476409,0.000051707513,0.00010015422,0.027441565,0.00080506766,0.00063486287,0.00089074037,0.60218954,0.00012947033],"about_ca_topic_score_codex":0.99484634,"about_ca_topic_score_gemma":0.9983121,"teacher_disagreement_score":0.038953554,"about_ca_system_score_codex":0.038953554,"about_ca_system_score_gemma":0.05502653,"threshold_uncertainty_score":0.2826292},"labels":[],"label_agreement":null},{"id":"W4416570569","doi":"10.5334/johd.383","title":"Digital Humanities Training and Workshops: Anonymized Survey Results","year":2025,"lang":"en","type":"article","venue":"Journal of Open Humanities Data","topic":"Digital Humanities and Scholarship","field":"Arts and Humanities","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":true,"ca_institutions":"","funders":"Social Sciences and Humanities Research Council of Canada; St. Francis Xavier University; University of Ottawa","keywords":"Certificate; Qualitative property; Digital humanities; Survey data collection; Digital media; Computer-assisted web interviewing; Qualitative research","score_opus":0.36401582024800605,"score_gpt":0.3469776897929208,"score_spread":0.017038130455085232,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4416570569","genre_codex":"dataset","genre_gemma":"empirical","domain_codex":null,"domain_gemma":"evaluation","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":"evaluation","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.28418788,0.0006260533,0.0129488455,0.007272162,0.00047728338,0.009131196,0.5796376,0.00040366876,0.10531533],"genre_scores_gemma":[0.71907234,0.0012595636,0.01586077,0.00521473,0.00024342143,0.046265356,0.18026713,0.0005602002,0.031256575],"study_design_codex":"not_applicable","study_design_gemma":"observational","domain_scores_codex":[0.939134,0.024381371,0.005446082,0.003944649,0.022779742,0.004314147],"domain_scores_gemma":[0.8998405,0.039243653,0.008717386,0.016307645,0.03431796,0.0015729679],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.03289508,0.00050106586,0.00046285568,0.0048547857,0.0025620428,0.0032051238,0.0013280875,0.0012414899,0.023350999],"category_scores_gemma":[0.1193235,0.0005017909,0.00037768384,0.012339249,0.0016768537,0.0018405118,0.0028753225,0.0010702892,0.0068043377],"study_design_candidate":"observational","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0005351299,0.00075455767,0.19123347,0.0023846338,0.00017758322,0.00036688556,0.05383369,0.0014677753,0.0013149903,0.018258765,0.62672406,0.10294841],"study_design_scores_gemma":[0.00009890856,0.00013973813,0.29254696,0.001757988,0.000065613596,0.00020935047,0.054109186,0.0014652282,0.0015794438,0.0043912935,0.64348215,0.00015412354],"about_ca_topic_score_codex":0.07159688,"about_ca_topic_score_gemma":0.06323,"teacher_disagreement_score":0.9671049,"about_ca_system_score_codex":0.0051321266,"about_ca_system_score_gemma":0.009884391,"threshold_uncertainty_score":0.17396784},"labels":[],"label_agreement":null}]}