{"id":"W2947513773","doi":"10.1186/s12909-019-1572-4","title":"Reliability testing of a modified MISTELS score using a low-cost trainer box","year":2019,"lang":"en","type":"article","venue":"BMC Medical Education","topic":"Surgical Simulation and Training","field":"Medicine","cited_by":2,"is_retracted":false,"has_abstract":true,"ca_institutions":"","funders":"","keywords":"Trainer; Cronbach's alpha; Reliability (semiconductor); Intraclass correlation; Medicine; Test (biology); Medical physics; Medical education; Computer science; Psychometrics","routes":{"ca_aff":false,"ca_fund":false,"ca_venue":false,"about_ca":true,"invisible_to_affiliation_only":true},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.01436322,0.0005755781,0.0006715683,0.001640083,0.0003972678,0.0006039796,0.0006936415,0.0003956568,0.001840697],"category_scores_gemma":[0.02995965,0.0003006711,0.001163984,0.001022497,0.0007097286,0.0006272831,0.0008644492,0.0004798721,0.0005208086],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.0005236703,"about_ca_system_score_gemma":0.0007647073,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.0009160317,"about_ca_topic_score_gemma":0.001580163,"domain_scores_codex":[0.9854572,0.005257375,0.002598507,0.001340742,0.004979895,0.0003662346],"domain_scores_gemma":[0.9552118,0.01811993,0.006913881,0.002919662,0.01605448,0.000780264],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"observational","study_design_gemma":"observational","study_design_scores_codex":[0.002312132,0.000982002,0.8809014,0.0005552561,0.0005813178,0.0001616802,0.002611522,0.002306476,0.0088867,0.0006584986,0.002351691,0.09769134],"study_design_scores_gemma":[0.0001755745,0.005912234,0.9703298,0.0001865247,0.000218809,0.0003200096,0.001648336,0.009013056,0.007353734,0.0003397258,0.004426929,0.00007532312],"study_design_candidate":"observational","study_design_consensus":"observational","genre_codex":"empirical","genre_gemma":"empirical","genre_scores_codex":[0.9829631,0.000201953,0.01174614,0.00008974372,0.0001698306,0.00101057,0.0004359116,0.0001065333,0.003276191],"genre_scores_gemma":[0.9786633,0.0001117048,0.01860855,0.00003835439,0.00005537177,0.001205548,0.0004916608,0.00002688286,0.0007986142],"genre_candidate":"empirical","genre_consensus":"empirical","teacher_disagreement_score":0.01436322,"threshold_uncertainty_score":0.07596087,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.0991505865247056,"score_gpt":0.3700530635112426,"score_spread":0.270902476986537,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}