{"id":"W2611134987","doi":"10.25011/cim.v30i4.2812","title":"51. Structured assessment format for evaluating operative reports (SAFE-OR) in general surgery","year":2007,"lang":"en","type":"article","venue":"Clinical and investigative medicine","topic":"Digital Imaging in Medicine","field":"Medicine","cited_by":0,"is_retracted":false,"has_abstract":true,"ca_institutions":"","funders":"","keywords":"Cronbach's alpha; Construct validity; Medicine; Reliability (semiconductor); Internal consistency; Rating scale; Scale (ratio); Consistency (knowledge bases); Quality (philosophy); Inter-rater reliability; Curriculum; Physical therapy; Medical physics; Psychology; Psychometrics; Clinical psychology; Computer science","routes":{"ca_aff":false,"ca_fund":false,"ca_venue":true,"about_ca":true,"invisible_to_affiliation_only":true},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"codex-gemma-dda1882f352a","candidate_categories":["metaresearch","sts"],"consensus_categories":[],"category_scores_codex":[0.008304365,0.0003473671,0.001421446,0.0002750028,0.000102556,0.0000192429,0.00007821024,0.0001715816,0.000109566],"category_scores_gemma":[0.01690228,0.0002094758,0.0001257027,0.0004431098,0.00545659,0.0003189956,0.00008251475,0.0006545769,0.000001631952],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.0001042261,"about_ca_system_score_gemma":0.0005127639,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.00005191181,"about_ca_topic_score_gemma":0.00005729395,"domain_scores_codex":[0.9956557,0.0001625437,0.002351125,0.0006717407,0.0006198722,0.0005389861],"domain_scores_gemma":[0.9956511,0.00233125,0.000484505,0.0003623336,0.0004602271,0.0007106367],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"observational","study_design_gemma":"observational","study_design_scores_codex":[0.000941864,0.0002784679,0.880863,0.0005013234,0.0002061141,0.001050711,0.001477779,0.000006228112,0.005093224,0.002905897,0.03074369,0.07593171],"study_design_scores_gemma":[0.008062303,0.004646604,0.938725,0.003010905,0.0002888213,0.0006416179,0.001670708,0.004678989,0.001592974,0.02805906,0.008189477,0.0004335699],"study_design_candidate":"observational","study_design_consensus":"observational","genre_codex":"empirical","genre_gemma":"empirical","genre_scores_codex":[0.9608446,0.0004096679,0.003804289,0.02771523,0.001520915,0.001593893,0.000006535292,0.00006555669,0.004039345],"genre_scores_gemma":[0.9563187,0.0001592076,0.02798926,0.01184643,0.001539215,0.00006718261,0.0002051467,0.00004379787,0.001831021],"genre_candidate":"empirical","genre_consensus":"empirical","teacher_disagreement_score":0.07549813,"threshold_uncertainty_score":0.99725,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.3338574160106172,"score_gpt":0.5085952217265495,"score_spread":0.1747378057159323,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}