{"id":"W3017370325","doi":"10.20944/preprints202004.0354.v1","title":"Comparative Analysis of Machine Learning Algorithms for Computer-Assisted Reporting Based on Fully Automated Cross-Lingual RadLex® Mappings","year":2020,"lang":"en","type":"preprint","venue":"Preprints.org","topic":"Radiomics and Machine Learning in Medical Imaging","field":"Medicine","cited_by":5,"is_retracted":false,"has_abstract":true,"ca_institutions":"","funders":"Bundesministerium für Wirtschaft und Energie; Bundesministerium für Bildung und Forschung","keywords":"Support vector machine; Machine learning; Random forest; Artificial intelligence; Brier score; Computer science; Confusion matrix; Cross-validation; F1 score; Algorithm; Classifier (UML); Context (archaeology); Natural language processing","routes":{"ca_aff":false,"ca_fund":false,"ca_venue":false,"about_ca":true,"invisible_to_affiliation_only":true},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"codex-gemma-dda1882f352a","candidate_categories":["metaepi_narrow","research_integrity"],"consensus_categories":[],"category_scores_codex":[0.002979266,0.0007078096,0.003101002,0.000930656,0.0002575853,0.00007371716,0.0005382705,0.0004556056,0.0002081836],"category_scores_gemma":[0.005321366,0.0006885416,0.001366562,0.001008074,0.0002986309,0.00004917383,0.0008453963,0.002914291,0.0000206276],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.0002812939,"about_ca_system_score_gemma":0.00051842,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.000413206,"about_ca_topic_score_gemma":0.000004746605,"domain_scores_codex":[0.9933674,0.0003447625,0.002946609,0.001812112,0.0009340567,0.0005950473],"domain_scores_gemma":[0.9922811,0.0007647666,0.004638698,0.001106342,0.0007611235,0.0004479365],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"observational","study_design_gemma":"simulation_or_modeling","study_design_scores_codex":[0.0008224393,0.0005528341,0.5759474,0.001439665,0.005269282,0.0002064039,0.002062071,0.4000567,0.01056143,0.00002187106,0.00007901737,0.002980908],"study_design_scores_gemma":[0.001548013,0.000195151,0.3311557,0.0006176162,0.001886228,0.00001456922,0.00004157419,0.6592008,0.004152973,0.00001841132,0.0008133394,0.0003556622],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"genre_codex":"empirical","genre_gemma":"empirical","genre_scores_codex":[0.9471645,0.00007370591,0.04671343,0.001566538,0.0005806046,0.001509842,0.000130008,0.001149458,0.001111893],"genre_scores_gemma":[0.9611711,0.00001267054,0.03468858,0.0006794359,0.0003765049,0.0001191311,0.002671844,0.00008712098,0.0001936059],"genre_candidate":"empirical","genre_consensus":"empirical","teacher_disagreement_score":0.2591442,"threshold_uncertainty_score":0.9995566,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.156915116390503,"score_gpt":0.4406204372489333,"score_spread":0.2837053208584303,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}