{"id":"W4283792752","doi":"10.16995/dscn.8091","title":"Modelling of a Heterogeneous Corpus: The Example of Chapbook Literature","year":2022,"lang":"en","type":"article","venue":"Digital Studies / Le champ numérique","topic":"Digital Humanities and Scholarship","field":"Arts and Humanities","cited_by":1,"is_retracted":false,"has_abstract":true,"ca_institutions":"","funders":"Université de Genève","keywords":"Metadata; Library science; Panorama; Variety (cybernetics); Humanities; Sociology; Art; World Wide Web; Computer science; Visual arts; Artificial intelligence","routes":{"ca_aff":false,"ca_fund":false,"ca_venue":true,"about_ca":false,"invisible_to_affiliation_only":true},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"codex-gemma-dda1882f352a","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0002253165,0.0002116486,0.0003787356,0.00007561024,0.0006657724,0.0002804969,0.0003795908,0.00002359185,0.000113696],"category_scores_gemma":[0.00002789112,0.0001546341,0.0002327339,0.00007346637,0.0004993169,0.0004668611,0.0004460621,0.0002401747,0.000003032202],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.00004163718,"about_ca_system_score_gemma":0.00003484026,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.0002306014,"about_ca_topic_score_gemma":0.0001482812,"domain_scores_codex":[0.9986761,0.00005266113,0.0004260945,0.0002456741,0.0003372983,0.0002622335],"domain_scores_gemma":[0.9989556,0.0001865997,0.0002356333,0.0003127462,0.0002735394,0.00003588789],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"qualitative","study_design_gemma":"qualitative","study_design_scores_codex":[0.00007873774,0.0002130964,0.00003726204,0.0001441121,0.0002641796,0.00001986236,0.9061892,0.005437824,0.000007991205,0.08578406,0.0009061439,0.0009175161],"study_design_scores_gemma":[0.0003052638,0.0004335477,0.000001426012,0.0000924444,7.845788e-7,0.00002651168,0.5559735,0.0003977818,0.0001810369,0.03979122,0.4025291,0.0002674436],"study_design_candidate":"qualitative","study_design_consensus":"qualitative","genre_codex":"empirical","genre_gemma":"empirical","genre_scores_codex":[0.893773,0.01043195,0.00005934031,0.0001859883,0.0003786523,0.0003341103,0.0007922783,0.00005547733,0.09398927],"genre_scores_gemma":[0.9898744,0.0001597148,0.00000147441,0.0001602351,0.0001722308,0.00008863925,0.00005951449,0.00003129553,0.009452515],"genre_candidate":"empirical","genre_consensus":"empirical","teacher_disagreement_score":0.4016229,"threshold_uncertainty_score":0.6305794,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.08833661599794151,"score_gpt":0.2303076609586839,"score_spread":0.1419710449607424,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}