{"id":"W4286470750","doi":"10.1002/aet2.10781","title":"Does direct observation influence the quality of workplace‐based assessment documentation?","year":2022,"lang":"en","type":"article","venue":"AEM Education and Training","topic":"Innovations in Medical Education","field":"Medicine","cited_by":9,"is_retracted":false,"has_abstract":true,"ca_institutions":"University of Ottawa","funders":"","keywords":"Generalizability theory; Documentation; Reliability (semiconductor); Quality (philosophy); Psychology; Statistics; Medicine; Computer science; Mathematics","routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.03187095,0.0002304579,0.0004432001,0.0008653542,0.0005222923,0.001807385,0.0007074279,0.0005324175,0.001710609],"category_scores_gemma":[0.2232004,0.0003106152,0.000633885,0.0007970071,0.00138291,0.001203629,0.001768486,0.0007205802,0.0002835304],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.001300387,"about_ca_system_score_gemma":0.003010509,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.003318029,"about_ca_topic_score_gemma":0.005616581,"domain_scores_codex":[0.952228,0.02743677,0.004406483,0.00220353,0.01264407,0.001081125],"domain_scores_gemma":[0.5706424,0.302539,0.08210181,0.01342173,0.02567928,0.005615802],"domain_codex":null,"domain_gemma":"evaluation","domain_candidate":"evaluation","domain_consensus":null,"study_design_codex":"observational","study_design_gemma":"observational","study_design_scores_codex":[0.0005592681,0.0002529004,0.9180697,0.000444166,0.0002033794,0.00006907123,0.005490852,0.0002021899,0.0009672285,0.00006463511,0.0004671042,0.07320957],"study_design_scores_gemma":[0.00002985598,0.0008855527,0.9933363,0.0003346702,0.00009723987,0.0001660301,0.002681174,0.0005096181,0.0009396819,0.0001248825,0.0008694944,0.00002545644],"study_design_candidate":"observational","study_design_consensus":"observational","genre_codex":"empirical","genre_gemma":"empirical","genre_scores_codex":[0.9903488,0.001049959,0.004422759,0.0007449084,0.00007413422,0.0001673026,0.0001386865,0.00003777447,0.003015635],"genre_scores_gemma":[0.9968284,0.0003173281,0.002363053,0.0001151766,0.00003517102,0.00009574068,0.00005205068,0.00001347949,0.0001795121],"genre_candidate":"empirical","genre_consensus":"empirical","teacher_disagreement_score":0.968129,"threshold_uncertainty_score":0.1685517,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.05679538406070442,"score_gpt":0.4349977433329142,"score_spread":0.3782023592722098,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}