{"id":"W2990790246","doi":"10.1186/s12916-019-1436-0","title":"Accuracy in detecting inadequate research reporting by early career peer reviewers using an online CONSORT-based peer-review tool (COBPeer) versus the usual peer-review process: a cross-sectional diagnostic study","year":2019,"lang":"en","type":"article","venue":"BMC Medicine","topic":"Meta-analysis and systematic reviews","field":"Decision Sciences","cited_by":78,"is_retracted":false,"has_abstract":true,"ca_institutions":"Ottawa Public Health; Ottawa Hospital","funders":"Cancer Research UK","keywords":"Medicine; Peer review; Consolidated Standards of Reporting Trials; Randomized controlled trial; Family medicine; Cross-sectional study; MEDLINE; Internal medicine; Pathology","routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":["metaresearch","research_integrity"],"consensus_categories":["metaresearch"],"category_scores_codex":[0.5739708,0.000974015,0.002420131,0.007351872,0.001636521,0.005435291,0.002842333,0.002913501,0.0009127472],"category_scores_gemma":[0.8348563,0.001441983,0.004421009,0.005272451,0.004581633,0.007812451,0.005972458,0.002044683,0.0004939773],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.002540011,"about_ca_system_score_gemma":0.003595343,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.001149141,"about_ca_topic_score_gemma":0.001233341,"domain_scores_codex":[0.2424368,0.4912331,0.1863475,0.02194383,0.05519503,0.002843811],"domain_scores_gemma":[0.0515333,0.6593272,0.1916564,0.04368304,0.05215823,0.001641804],"domain_codex":"methods","domain_gemma":"evaluation","domain_candidate":"evaluation","domain_consensus":null,"study_design_codex":"observational","study_design_gemma":"observational","study_design_scores_codex":[0.002858818,0.0004239021,0.9396514,0.003286071,0.003502296,0.0001399713,0.0116219,0.0005936788,0.0005675841,0.0005123537,0.0008990549,0.03594301],"study_design_scores_gemma":[0.001012067,0.01023347,0.9386452,0.004632915,0.004696164,0.002466017,0.006192639,0.01435366,0.00744666,0.002204886,0.007577719,0.0005386068],"study_design_candidate":"observational","study_design_consensus":"observational","genre_codex":"empirical","genre_gemma":"empirical","genre_scores_codex":[0.9481884,0.008993231,0.03187986,0.001954837,0.0006586594,0.004741427,0.0009619341,0.0002194508,0.002402205],"genre_scores_gemma":[0.9808093,0.0006389253,0.01546689,0.0004596844,0.000181234,0.00181504,0.0004313725,0.00004584259,0.0001516464],"genre_candidate":"empirical","genre_consensus":"empirical","teacher_disagreement_score":0.9970865,"threshold_uncertainty_score":0.5253699,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.8886671091862027,"score_gpt":0.6380346204566281,"score_spread":0.2506324887295747,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}