{"id":"W4283792752","doi":"10.16995/dscn.8091","title":"Modelling of a Heterogeneous Corpus: The Example of Chapbook Literature","year":2022,"lang":"en","type":"article","venue":"Digital Studies / Le champ numérique","topic":"Digital Humanities and Scholarship","field":"Arts and Humanities","cited_by":1,"is_retracted":false,"has_abstract":true,"ca_institutions":"","funders":"Université de Genève","keywords":"Metadata; Library science; Panorama; Variety (cybernetics); Humanities; Sociology; Art; World Wide Web; Computer science; Visual arts; Artificial intelligence","routes":{"ca_aff":false,"ca_fund":false,"ca_venue":true,"about_ca":false,"invisible_to_affiliation_only":true},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.00187676,0.0005060847,0.0004875083,0.004598261,0.002016519,0.005478474,0.001458305,0.001644752,0.007695268],"category_scores_gemma":[0.009819632,0.000390241,0.001090088,0.006155903,0.002130918,0.004798987,0.003215925,0.0008383852,0.001164717],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.002774709,"about_ca_system_score_gemma":0.002232302,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.03584939,"about_ca_topic_score_gemma":0.0419476,"domain_scores_codex":[0.9985495,0.0007992841,0.00008451124,0.0002489767,0.000239723,0.000077985],"domain_scores_gemma":[0.9959211,0.003182414,0.0001431331,0.0003422188,0.0003066901,0.0001043528],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"simulation_or_modeling","study_design_scores_codex":[0.0003761455,0.0001396408,0.02119595,0.001484729,0.0001575732,0.006913616,0.04354146,0.1359535,0.002985541,0.6614141,0.01304345,0.1127942],"study_design_scores_gemma":[0.00008829265,0.0000861474,0.01108814,0.001219549,0.0001360396,0.001966508,0.02688648,0.2890489,0.002703679,0.2072674,0.4593797,0.000129084],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"genre_codex":"methods","genre_gemma":"empirical","genre_scores_codex":[0.3577767,0.006439477,0.4430184,0.006193966,0.000330316,0.0008000958,0.01094118,0.001760396,0.1727394],"genre_scores_gemma":[0.7128512,0.002240955,0.256438,0.0002946674,0.0000908174,0.0006276757,0.007619252,0.0006767746,0.01916071],"genre_candidate":"empirical","genre_consensus":null,"teacher_disagreement_score":0.03584939,"threshold_uncertainty_score":0.07128143,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.08833661599794151,"score_gpt":0.2303076609586839,"score_spread":0.1419710449607424,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}