{"id":"W2102709672","doi":"10.1111/j.1752-7325.2011.00278.x","title":"Examiner training and reliability in two randomized clinical trials of adult dental caries","year":2011,"lang":"en","type":"article","venue":"Journal of Public Health Dentistry","topic":"Dental Health and Care Utilization","field":"Dentistry","cited_by":32,"is_retracted":false,"has_abstract":true,"ca_institutions":"Western University","funders":"National Institute of Dental and Craniofacial Research","keywords":"Cohen's kappa; Medicine; Dentistry; Standardization; Reliability (semiconductor); Kappa; Clinical trial; Orthodontics; Statistics","routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"codex-gemma-dda1882f352a","candidate_categories":["metaresearch"],"consensus_categories":["metaresearch"],"category_scores_codex":[0.054339,0.0001874157,0.002203367,0.0003266183,0.00007561787,0.00006379186,0.000263362,0.0001869299,0.000228245],"category_scores_gemma":[0.02645843,0.0001528376,0.0004554791,0.0003164229,0.0003828575,0.0005447396,0.00007191404,0.0006319977,0.000005314882],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.0001717786,"about_ca_system_score_gemma":0.001162221,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.001291482,"about_ca_topic_score_gemma":0.002259168,"domain_scores_codex":[0.9842888,0.007523886,0.006665562,0.0002903054,0.0007089286,0.000522493],"domain_scores_gemma":[0.9920841,0.002508549,0.003819421,0.0002524204,0.0006068216,0.0007286625],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"observational","study_design_gemma":"observational","study_design_scores_codex":[0.009820623,0.0009241792,0.8518534,0.001000632,0.0001322675,0.000344855,0.003413653,0.000001412199,0.00001887285,0.001932783,0.001364369,0.1291929],"study_design_scores_gemma":[0.1515463,0.0004630703,0.8306991,0.0005568067,0.0001156873,0.002444452,0.01127168,0.0002992987,0.00007865501,0.001580634,0.0006767605,0.0002674764],"study_design_candidate":"observational","study_design_consensus":"observational","genre_codex":"empirical","genre_gemma":"empirical","genre_scores_codex":[0.9899893,0.00149573,0.003847302,0.0001860153,0.003477719,0.0004923093,0.00004069516,0.00001306223,0.000457807],"genre_scores_gemma":[0.9968554,0.000614214,0.001629723,0.0004257263,0.0003160739,0.000009567859,0.00001502123,0.00001840071,0.0001158133],"genre_candidate":"empirical","genre_consensus":"empirical","teacher_disagreement_score":0.1417257,"threshold_uncertainty_score":0.9817421,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.2523087452801897,"score_gpt":0.4774273530933966,"score_spread":0.2251186078132069,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}