{"id":"W4386919265","doi":"10.1007/978-3-031-43849-3_5","title":"PreprintResolver: Improving Citation Quality by Resolving Published Versions of ArXiv Preprints Using Literature Databases","year":2023,"lang":"en","type":"book-chapter","venue":"Lecture notes in computer science","topic":"Academic Publishing and Open Access","field":"Decision Sciences","cited_by":1,"is_retracted":false,"has_abstract":false,"ca_institutions":"Artificial Intelligence in Medicine (Canada)","funders":"","keywords":"Preprint; Computer science; Field (mathematics); Citation; Information retrieval; Quality (philosophy); World Wide Web; Sample (material); Mathematics","routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":["metaresearch","scholarly_communication"],"consensus_categories":[],"category_scores_codex":[0.01721482,0.002026703,0.003188683,0.03133541,0.002539724,0.01882269,0.005075894,0.002434135,0.03615616],"category_scores_gemma":[0.06488474,0.001791831,0.001974846,0.03023901,0.0009664678,0.01292429,0.005176213,0.001887834,0.03932146],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.001406039,"about_ca_system_score_gemma":0.005011349,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.003083305,"about_ca_topic_score_gemma":0.003885338,"domain_scores_codex":[0.9858016,0.00266469,0.001774633,0.00164201,0.007739796,0.0003773093],"domain_scores_gemma":[0.9493266,0.01925762,0.003446417,0.0133128,0.01295023,0.001706255],"domain_codex":null,"domain_gemma":"reproducibility","domain_candidate":"reproducibility","domain_consensus":null,"study_design_codex":"design_other","study_design_gemma":"not_applicable","study_design_scores_codex":[0.0002717372,0.0002242265,0.003832177,0.001115202,0.0003481706,0.00009277483,0.0002194281,0.003581065,0.003711706,0.02317337,0.2416835,0.7217467],"study_design_scores_gemma":[0.0003968883,0.0002066318,0.006933489,0.0009519739,0.0008302828,0.0007881369,0.000739684,0.110605,0.03788729,0.1615673,0.6787435,0.0003497415],"study_design_candidate":"not_applicable","study_design_consensus":null,"genre_codex":"methods","genre_gemma":"software","genre_scores_codex":[0.03147172,0.02796807,0.6491241,0.01190806,0.01118744,0.0009530923,0.05514165,0.1305418,0.08170404],"genre_scores_gemma":[0.09518348,0.01501874,0.7115315,0.001144259,0.004141686,0.0004843191,0.08509804,0.02116005,0.06623802],"genre_candidate":"software","genre_consensus":null,"teacher_disagreement_score":0.9827852,"threshold_uncertainty_score":0.1209543,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.1402033635676231,"score_gpt":0.3910124678096511,"score_spread":0.2508091042420281,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}