{"id":"W4410761886","doi":"10.1080/01615440.2025.2500309","title":"Unlocking the archives: Using large language models to transcribe handwritten historical documents","year":2025,"lang":"en","type":"article","venue":"Historical Methods A Journal of Quantitative and Interdisciplinary History","topic":"Handwritten Text Recognition Techniques","field":"Computer Science","cited_by":10,"is_retracted":false,"has_abstract":true,"ca_institutions":"Wilfrid Laurier University","funders":"","keywords":"Computer science; Natural language processing","routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.002416681,0.0009157495,0.0004490209,0.001058446,0.0006640327,0.001931436,0.001077663,0.0006865001,0.00514213],"category_scores_gemma":[0.0109381,0.0005414519,0.0005771618,0.0008739841,0.0009416766,0.002971398,0.00161912,0.001109726,0.00435559],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.0007377941,"about_ca_system_score_gemma":0.001156985,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.003727971,"about_ca_topic_score_gemma":0.008932148,"domain_scores_codex":[0.9985965,0.0005175403,0.00007908547,0.0004019295,0.0003569199,0.00004815862],"domain_scores_gemma":[0.9955971,0.002484001,0.0003118665,0.0009484079,0.0005691269,0.00008959701],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","study_design_scores_codex":[0.0003375035,0.00009289126,0.00566168,0.0004222298,0.00008100436,0.0004565898,0.004305477,0.02915579,0.04807096,0.005654608,0.008419659,0.8973415],"study_design_scores_gemma":[0.0001305319,0.0005363402,0.01404082,0.0005092268,0.0002680963,0.001682311,0.005267613,0.6123671,0.2008599,0.03259125,0.1314054,0.0003413324],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"genre_codex":"methods","genre_gemma":"empirical","genre_scores_codex":[0.08288371,0.0007607827,0.8939698,0.0006043853,0.0002428287,0.0001696337,0.0007345435,0.01259515,0.008039035],"genre_scores_gemma":[0.3468613,0.0005110261,0.6370152,0.0003234748,0.0001453937,0.0001993979,0.001529888,0.002180847,0.01123348],"genre_candidate":"empirical","genre_consensus":null,"teacher_disagreement_score":0.00514213,"threshold_uncertainty_score":0.01720214,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.08453474367525225,"score_gpt":0.4017216701108192,"score_spread":0.3171869264355669,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}