{"id":"W4242612363","doi":"10.22541/au.163337333.33680452/v1","title":"Monitoring the integrity and usability of policy evaluation tools within an evolving socio-cultural context: A demonstration of reflexivity using the CFPC Family Medicine Longitudinal Survey","year":2021,"lang":"en","type":"preprint","venue":"","topic":"Primary Care and Health Outcomes","field":"Health Professions","cited_by":0,"is_retracted":false,"has_abstract":true,"ca_institutions":"University of Alberta","funders":"","keywords":"Reflexivity; Context (archaeology); Usability; Health care; Medicine; Inclusion (mineral); Medical education; Psychology; Political science; Sociology; Computer science; Social psychology","routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":true,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":["metaresearch"],"consensus_categories":["metaresearch"],"category_scores_codex":[0.6311972,0.0008598427,0.001122222,0.005413651,0.004341747,0.008681015,0.002645675,0.001509488,0.0009647365],"category_scores_gemma":[0.7282732,0.0008714532,0.001362399,0.004537613,0.009530859,0.006840288,0.007474363,0.003080485,0.0002477135],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.01159224,"about_ca_system_score_gemma":0.02334641,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.009580316,"about_ca_topic_score_gemma":0.007907628,"domain_scores_codex":[0.3086488,0.6321511,0.02441072,0.00761042,0.02432449,0.00285446],"domain_scores_gemma":[0.0874294,0.7890223,0.02198202,0.05631353,0.04421771,0.001034993],"domain_codex":"methods","domain_gemma":"evaluation","domain_candidate":"evaluation","domain_consensus":null,"study_design_codex":"qualitative","study_design_gemma":"qualitative","study_design_scores_codex":[0.0009300514,0.001569948,0.1378324,0.002164712,0.0006152558,0.0002965157,0.523591,0.003857509,0.003131267,0.01287001,0.00361217,0.3095291],"study_design_scores_gemma":[0.00175951,0.007920582,0.3558019,0.009660332,0.001136419,0.0007500728,0.3882686,0.06912991,0.04012225,0.04981334,0.0743793,0.001257828],"study_design_candidate":"qualitative","study_design_consensus":"qualitative","genre_codex":"empirical","genre_gemma":"empirical","genre_scores_codex":[0.8082532,0.0004434671,0.1568608,0.004556364,0.0002409898,0.01178213,0.0005858099,0.0007406581,0.01653659],"genre_scores_gemma":[0.9202362,0.0001265418,0.07127511,0.0004991343,0.00004215816,0.007118853,0.0001216449,0.0001187555,0.0004617189],"genre_candidate":"empirical","genre_consensus":"empirical","teacher_disagreement_score":0.3688028,"threshold_uncertainty_score":0.4547995,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.539766421344312,"score_gpt":0.5771415824526445,"score_spread":0.0373751611083325,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}