{"id":"W2185742531","doi":"10.1002/j.0022-0337.2002.66.9.tb03570.x","title":"A Measure of Agreement Between Clinicians and a Computer‐Based Decision Support System for Planning Dental Treatment","year":2002,"lang":"en","type":"article","venue":"Journal of Dental Education","topic":"Reliability and Agreement in Measurement","field":"Decision Sciences","cited_by":6,"is_retracted":false,"has_abstract":true,"ca_institutions":"University of British Columbia; TRIUMF","funders":"","keywords":"Measure (data warehouse); Decision support system; Medical physics; Medicine; Psychology; Computer science; Artificial intelligence; Data mining","routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"codex-gemma-dda1882f352a","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.003098689,0.0001541809,0.000475211,0.0003429557,0.0001259526,0.000119491,0.0003177212,0.00007227067,0.0001108492],"category_scores_gemma":[0.0003356937,0.0001068773,0.00027962,0.0002212063,0.0000515977,0.000251323,0.00002819568,0.00008488481,0.00001988559],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.000399029,"about_ca_system_score_gemma":0.0001850393,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.00001371208,"about_ca_topic_score_gemma":0.00001170869,"domain_scores_codex":[0.9962471,0.0001640025,0.001579395,0.0002494949,0.001597355,0.0001626258],"domain_scores_gemma":[0.9968887,0.000864247,0.001257451,0.0002396302,0.0005829292,0.0001670395],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"observational","study_design_gemma":"observational","study_design_scores_codex":[0.0002887353,0.001551314,0.5180686,0.0000753276,0.0001291502,0.000005455231,0.001776954,0.0004813481,0.0005796968,0.00004281153,0.01006777,0.4669329],"study_design_scores_gemma":[0.02399436,0.0290389,0.7651385,0.005896877,0.001745925,0.0006264652,0.07867026,0.03005867,0.02018914,0.002025191,0.04127331,0.001342425],"study_design_candidate":"observational","study_design_consensus":"observational","genre_codex":"empirical","genre_gemma":"empirical","genre_scores_codex":[0.9701573,0.0004972201,0.0266108,0.0002314486,0.001704722,0.0005173173,0.00002606563,0.00000473895,0.0002503642],"genre_scores_gemma":[0.9902132,0.00001430717,0.00914931,0.00005801303,0.0004282211,0.00001081311,0.000004382969,0.000007093026,0.0001147021],"genre_candidate":"empirical","genre_consensus":"empirical","teacher_disagreement_score":0.4655905,"threshold_uncertainty_score":0.435833,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.1954144651659834,"score_gpt":0.4167756403756122,"score_spread":0.2213611752096287,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}