{"id":"W4386570124","doi":"10.1016/j.ejrad.2023.111091","title":"Inter-reader variability and reproducibility of the PI-QUAL score in a multicentre setting","year":2023,"lang":"en","type":"article","venue":"European Journal of Radiology","topic":"Radiology practices and education","field":"Medicine","cited_by":8,"is_retracted":false,"has_abstract":false,"ca_institutions":"Princess Margaret Cancer Centre; Women's College Hospital; University of Toronto; University Health Network; Mount Sinai Hospital","funders":"","keywords":"Medicine; Reproducibility; Technician; Medical physics; Quality Score; Second opinion; Radiology; Nuclear medicine; Statistics; Pathology","routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.04049475,0.0006952951,0.001577561,0.001761941,0.0007877939,0.002597493,0.001347683,0.00160729,0.001154532],"category_scores_gemma":[0.1108227,0.0007105827,0.001746259,0.001881492,0.001187984,0.001527674,0.001600826,0.0008800791,0.0006152399],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.0008322206,"about_ca_system_score_gemma":0.0008122954,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.002123661,"about_ca_topic_score_gemma":0.002797276,"domain_scores_codex":[0.9403704,0.02791812,0.00739498,0.01124681,0.01191467,0.00115506],"domain_scores_gemma":[0.8545811,0.09088787,0.01785638,0.01820108,0.01721194,0.001261696],"domain_codex":null,"domain_gemma":"reproducibility","domain_candidate":"reproducibility","domain_consensus":null,"study_design_codex":"observational","study_design_gemma":"observational","study_design_scores_codex":[0.004252927,0.0002900224,0.9579964,0.0002706345,0.00320824,0.00020427,0.002536336,0.00172078,0.002886412,0.0002616543,0.001017826,0.02535453],"study_design_scores_gemma":[0.0001906949,0.001303903,0.9880377,0.00003759886,0.0009185344,0.0007384708,0.0004403374,0.004565018,0.002230263,0.00033088,0.001134888,0.00007166038],"study_design_candidate":"observational","study_design_consensus":"observational","genre_codex":"empirical","genre_gemma":"empirical","genre_scores_codex":[0.9886861,0.001514379,0.006973437,0.0001126535,0.0001721139,0.00009186293,0.000482123,0.0001588695,0.001808533],"genre_scores_gemma":[0.9976909,0.00005860291,0.001511023,0.00004784754,0.00005282419,0.00004649721,0.000266274,0.00005608431,0.0002698403],"genre_candidate":"empirical","genre_consensus":"empirical","teacher_disagreement_score":0.9595053,"threshold_uncertainty_score":0.2141593,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.04447527087974113,"score_gpt":0.3187611167516928,"score_spread":0.2742858458719517,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}