{"id":"W2073141549","doi":"10.1177/1098214007312630","title":"Using Self-Assessments to Detect Workshop Success","year":2008,"lang":"en","type":"article","venue":"American Journal of Evaluation","topic":"Communication in Education and Healthcare","field":"Psychology","cited_by":49,"is_retracted":false,"has_abstract":true,"ca_institutions":"Alberta Health Services; University of British Columbia; University of Calgary; University of Saskatchewan","funders":"","keywords":"Psychology; Reliability (semiconductor); Applied psychology; Program evaluation; Scale (ratio); Gold standard (test); Medical education; Medicine; Statistics","routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.01243692,0.0006488789,0.0005104873,0.002369971,0.0003709705,0.0009779796,0.0006853293,0.0004906459,0.00169484],"category_scores_gemma":[0.03933124,0.0002533481,0.0005235733,0.0008335364,0.0003641522,0.001006723,0.0009689453,0.0007218465,0.001211422],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.0002430842,"about_ca_system_score_gemma":0.0004481417,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.0005822537,"about_ca_topic_score_gemma":0.00105712,"domain_scores_codex":[0.9891512,0.004466258,0.001648005,0.0008204754,0.003627996,0.0002859251],"domain_scores_gemma":[0.9420525,0.02360508,0.01301971,0.003894336,0.01571169,0.001716791],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"observational","study_design_gemma":"observational","study_design_scores_codex":[0.0009081695,0.001385695,0.8139325,0.0004976636,0.000277138,0.000144865,0.003640969,0.0008537095,0.00731396,0.0002635134,0.002812169,0.1679697],"study_design_scores_gemma":[0.00009216472,0.004309395,0.9711244,0.0001777281,0.00010121,0.0003660049,0.002599628,0.005837168,0.01020288,0.000503251,0.004589289,0.00009699782],"study_design_candidate":"observational","study_design_consensus":"observational","genre_codex":"empirical","genre_gemma":"empirical","genre_scores_codex":[0.9656932,0.000363255,0.0216183,0.0001561879,0.00009625824,0.001319117,0.001050705,0.000398112,0.009304901],"genre_scores_gemma":[0.9675133,0.0003315375,0.02511181,0.0001079842,0.00007575933,0.001927357,0.001530332,0.00005711971,0.003344715],"genre_candidate":"empirical","genre_consensus":"empirical","teacher_disagreement_score":0.01243692,"threshold_uncertainty_score":0.06577349,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.2077316628935172,"score_gpt":0.5490251839928058,"score_spread":0.3412935210992886,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}