{"id":"W4213432010","doi":"10.1093/occmed/kqab154","title":"Evaluation of an occupational medicine patient consultation note assessment tool","year":2021,"lang":"en","type":"article","venue":"Occupational Medicine","topic":"Innovations in Medical Education","field":"Medicine","cited_by":2,"is_retracted":false,"has_abstract":true,"ca_institutions":"Canada Research Chairs; Public Health Ontario; University of Toronto; St. Michael's Hospital","funders":"","keywords":"Intraclass correlation; Summative assessment; Context (archaeology); Medical education; Medicine; Cohen's kappa; Rating scale; Operationalization; Family medicine; Psychology; Formative assessment; Psychometrics; Clinical psychology; Computer science; Pedagogy","routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":true,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"codex-gemma-dda1882f352a","candidate_categories":["metaresearch","insufficient_payload"],"consensus_categories":[],"category_scores_codex":[0.003780237,0.0002737741,0.0005617541,0.0004962026,0.000170252,0.000008918736,0.0001195716,0.0001945238,0.006637155],"category_scores_gemma":[0.01492747,0.0002291043,0.00006534511,0.001430578,0.0004939287,0.0002923024,0.00003636409,0.0003560311,0.00001871494],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.0007294544,"about_ca_system_score_gemma":0.003647991,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.00007590221,"about_ca_topic_score_gemma":0.00002112946,"domain_scores_codex":[0.9922329,0.0004467284,0.001435322,0.0005527007,0.005066756,0.0002655875],"domain_scores_gemma":[0.9870466,0.000417235,0.0006163987,0.000621694,0.0111426,0.0001554747],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"design_other","study_design_gemma":"observational","study_design_scores_codex":[0.001057416,0.002839293,0.03973064,0.0003978753,0.0004710672,0.00004712946,0.004877662,0.001338491,0.04499867,0.04081085,0.04079127,0.8226396],"study_design_scores_gemma":[0.01116482,0.001740201,0.8872245,0.001037491,0.001349759,0.0002387354,0.002453412,0.07480209,0.004005332,0.005361064,0.01027227,0.000350324],"study_design_candidate":"observational","study_design_consensus":null,"genre_codex":"empirical","genre_gemma":"empirical","genre_scores_codex":[0.9558829,0.0003623757,0.01637821,0.01304424,0.001850442,0.001197633,0.00004895966,0.00007692667,0.01115832],"genre_scores_gemma":[0.9546592,0.0000286836,0.03303162,0.00398973,0.001050708,0.0002050256,0.00684432,0.00003197045,0.0001587617],"genre_candidate":"empirical","genre_consensus":"empirical","teacher_disagreement_score":0.8474939,"threshold_uncertainty_score":0.9942709,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.06562885204194727,"score_gpt":0.4653875596544619,"score_spread":0.3997587076125146,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}