{"id":"W4366449610","doi":"10.3138/cjpe.22.001","title":"Methodological and Conceptual Challenges in Studying Evaluation Process Use","year":2007,"lang":"en","type":"article","venue":"Canadian Journal of Program Evaluation","topic":"Evaluation and Performance Assessment","field":"Decision Sciences","cited_by":6,"is_retracted":false,"has_abstract":true,"ca_institutions":"","funders":"","keywords":"Operationalization; Process (computing); Construct (python library); Context (archaeology); Exploratory research; Process management; Quality (philosophy); Knowledge management; Management science; Computer science; Qualitative research; Conceptual model; Scale (ratio); Psychology; Sociology; Epistemology; Business; Engineering","routes":{"ca_aff":false,"ca_fund":false,"ca_venue":true,"about_ca":false,"invisible_to_affiliation_only":true},"retraction":null,"screen":null,"direct_labels":[{"model":"gemma","categories":[],"domain":null,"study_design":"theoretical_or_conceptual","genre":"empirical","about_ca_system":false,"about_ca_topic":false,"confidence":"medium","status":"direct model label, unvalidated"},{"model":"gpt","categories":[],"domain":null,"study_design":"theoretical_or_conceptual","genre":"methods","about_ca_system":false,"about_ca_topic":false,"confidence":"low","status":"direct model label, unvalidated"}],"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":["metaresearch"],"consensus_categories":["metaresearch"],"category_scores_codex":[0.5136543,0.001556592,0.002606742,0.01114111,0.009070501,0.02476512,0.008456855,0.004912969,0.003241419],"category_scores_gemma":[0.6456859,0.00166217,0.0023951,0.0140557,0.0382844,0.02518011,0.01319439,0.007836842,0.0006163151],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.01614368,"about_ca_system_score_gemma":0.02811701,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.007767413,"about_ca_topic_score_gemma":0.004852144,"domain_scores_codex":[0.3220897,0.5761099,0.0382091,0.0136496,0.04654845,0.003393214],"domain_scores_gemma":[0.138873,0.7620833,0.02259743,0.03056415,0.0444712,0.001410993],"domain_codex":"methods","domain_gemma":"methods","domain_candidate":"methods","domain_consensus":"methods","study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","study_design_scores_codex":[0.000247302,0.0006942366,0.02691387,0.01467265,0.0006403093,0.000307789,0.1162852,0.003144177,0.001073537,0.6109487,0.003164774,0.2219073],"study_design_scores_gemma":[0.000357502,0.0009070359,0.0175525,0.01863962,0.0005801059,0.0007906003,0.1619056,0.01269951,0.005639967,0.7140875,0.06653776,0.0003023047],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","genre_codex":"methods","genre_gemma":"methods","genre_scores_codex":[0.09611199,0.03046787,0.7693117,0.05122063,0.001695518,0.008582356,0.0004927883,0.0003061302,0.04181104],"genre_scores_gemma":[0.6766781,0.005051388,0.2924297,0.00430367,0.00065958,0.01921132,0.0001867458,0.000213923,0.001265544],"genre_candidate":"methods","genre_consensus":"methods","teacher_disagreement_score":0.4863457,"threshold_uncertainty_score":0.5997509,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.9321012710267086,"score_gpt":0.6602703593788898,"score_spread":0.2718309116478188,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}