{"id":"W2887806484","doi":"10.24908/pceea.v0i0.9687","title":"DEVELOPMENT AND VALIDATION OF DESCRIPTORS FOR UNIVERSAL PROBLEM-ANALYSIS RUBRIC","year":2018,"lang":"en","type":"article","venue":"Proceedings of the Canadian Engineering Education Association (CEEA)","topic":"Education and Critical Thinking Development","field":"Social Sciences","cited_by":1,"is_retracted":false,"has_abstract":true,"ca_institutions":"University of Toronto","funders":"University of Toronto","keywords":"Rubric; Consistency (knowledge bases); Benchmarking; Computer science; Resource (disambiguation); Reliability (semiconductor); Mathematics education; Artificial intelligence; Psychology","routes":{"ca_aff":true,"ca_fund":true,"ca_venue":true,"about_ca":false,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.09489307,0.001574145,0.001386514,0.01130685,0.00266378,0.004739787,0.003577991,0.001316284,0.005032041],"category_scores_gemma":[0.240355,0.001011444,0.001812403,0.00404217,0.002547717,0.004252236,0.005699678,0.00336856,0.00366129],"about_ca_system_candidate":true,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.005523266,"about_ca_system_score_gemma":0.01488398,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.002889832,"about_ca_topic_score_gemma":0.003839535,"domain_scores_codex":[0.9291928,0.03282505,0.01301492,0.002754738,0.02066145,0.001550972],"domain_scores_gemma":[0.7306178,0.06675239,0.01362426,0.03217687,0.153527,0.003301825],"domain_codex":null,"domain_gemma":"methods","domain_candidate":"methods","domain_consensus":null,"study_design_codex":"design_other","study_design_gemma":"bench_or_experimental","study_design_scores_codex":[0.0005230464,0.002114543,0.01954658,0.002822657,0.00008831298,0.0003843791,0.01553234,0.007804234,0.0286081,0.03073842,0.04936257,0.8424749],"study_design_scores_gemma":[0.0005807378,0.00391246,0.07274943,0.00579799,0.0002115768,0.00126155,0.01876759,0.06926384,0.1116155,0.02911785,0.6857087,0.001012851],"study_design_candidate":"bench_or_experimental","study_design_consensus":null,"genre_codex":"methods","genre_gemma":"empirical","genre_scores_codex":[0.131115,0.000736011,0.7690509,0.001668111,0.001718001,0.04439848,0.003617641,0.008408067,0.03928779],"genre_scores_gemma":[0.1002873,0.000363775,0.848167,0.0002874226,0.0001240693,0.03308855,0.006440328,0.002001007,0.0092406],"genre_candidate":"empirical","genre_consensus":null,"teacher_disagreement_score":0.9944767,"threshold_uncertainty_score":0.5018485,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.0136866948204051,"score_gpt":0.2467028568278387,"score_spread":0.2330161620074336,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}