{"id":"W3150858046","doi":"10.2196/25714","title":"Using a Secure, Continually Updating, Web Source Processing Pipeline to Support the Real-Time Data Synthesis and Analysis of Scientific Literature: Development and Validation Study","year":2021,"lang":"en","type":"article","venue":"Journal of Medical Internet Research","topic":"Scientific Computing and Data Management","field":"Decision Sciences","cited_by":8,"is_retracted":false,"has_abstract":true,"ca_institutions":"","funders":"Defence and Security Accelerator; National Cancer Institute; NIHR Imperial Biomedical Research Centre; Queen's University; National Institutes of Health; Universidade de Coimbra; Assiut University; Università degli Studi di Sassari; Universiti Sains Malaysia; National Institute for Health and Care Research; King Abdulaziz University; Horizon 2020 Framework Programme; Queen's University Belfast; University of the Philippines; Queen Mary University of London","keywords":"Computer science; Pipeline (software); Web application; Data science; World Wide Web; Data mining","routes":{"ca_aff":false,"ca_fund":true,"ca_venue":false,"about_ca":false,"invisible_to_affiliation_only":true},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.07536197,0.001466131,0.0009638944,0.00674832,0.001660801,0.005499272,0.00317372,0.001388498,0.004920652],"category_scores_gemma":[0.124184,0.001298341,0.002168661,0.004808082,0.002095135,0.006862247,0.009521195,0.002254115,0.00620579],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.001940361,"about_ca_system_score_gemma":0.01626967,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.005737157,"about_ca_topic_score_gemma":0.005586125,"domain_scores_codex":[0.9548316,0.0193577,0.007104548,0.006564589,0.01116564,0.0009758368],"domain_scores_gemma":[0.8508554,0.05325805,0.01385203,0.04194403,0.03687274,0.003217705],"domain_codex":null,"domain_gemma":"methods","domain_candidate":"methods","domain_consensus":null,"study_design_codex":"design_other","study_design_gemma":"bench_or_experimental","study_design_scores_codex":[0.004656012,0.00214586,0.04663071,0.01045019,0.001361624,0.001401359,0.008616461,0.01079573,0.05837503,0.01336166,0.1179435,0.7242619],"study_design_scores_gemma":[0.003108904,0.004709783,0.07301491,0.004928641,0.001647845,0.002469427,0.004790886,0.1359318,0.1557566,0.02178914,0.5908789,0.0009732385],"study_design_candidate":"bench_or_experimental","study_design_consensus":null,"genre_codex":"methods","genre_gemma":"methods","genre_scores_codex":[0.08175611,0.001690617,0.7301534,0.004818692,0.00073115,0.0279681,0.03710711,0.1033473,0.01242764],"genre_scores_gemma":[0.08558423,0.000740835,0.8645046,0.0009861146,0.0001080032,0.01089202,0.03048905,0.003423781,0.003271361],"genre_candidate":"methods","genre_consensus":"methods","teacher_disagreement_score":0.924638,"threshold_uncertainty_score":0.3985569,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.2823102176679656,"score_gpt":0.5056290844031155,"score_spread":0.2233188667351499,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}