{"id":"W4416051775","doi":"10.1016/j.ijproman.2025.102788","title":"What Do We Really Know? A 40-Year Scientific Realist Examination of Theory Testing in Project Management","year":2025,"lang":"en","type":"article","venue":"International Journal of Project Management","topic":"Construction Project Management and Performance","field":"Decision Sciences","cited_by":0,"is_retracted":false,"has_abstract":true,"ca_institutions":"Athabasca University; University of Windsor","funders":"","keywords":"Scrutiny; Scholarship; Legitimacy; Empirical research; Project management; Conceptual framework; Development theory; Scientific theory","routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.1117735,0.0002772057,0.0005369523,0.01296955,0.004289839,0.009199803,0.00154419,0.001799509,0.002046717],"category_scores_gemma":[0.1566443,0.0004505255,0.0005122813,0.01411535,0.01245198,0.009734895,0.005237314,0.002552534,0.000236566],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.007732416,"about_ca_system_score_gemma":0.009439763,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.002574035,"about_ca_topic_score_gemma":0.004294869,"domain_scores_codex":[0.9716597,0.01683121,0.002052481,0.001328777,0.007052617,0.00107521],"domain_scores_gemma":[0.5536759,0.3937716,0.01942581,0.008199194,0.02240109,0.002526503],"domain_codex":null,"domain_gemma":"methods","domain_candidate":"methods","domain_consensus":null,"study_design_codex":"design_other","study_design_gemma":"observational","study_design_scores_codex":[0.0004268786,0.0007740365,0.1212477,0.002261457,0.000192305,0.002092032,0.2322624,0.001469301,0.001875552,0.1343018,0.006922352,0.4961742],"study_design_scores_gemma":[0.00013298,0.001198983,0.3344258,0.007832802,0.0002680367,0.001465903,0.28655,0.007871249,0.00793344,0.1771834,0.1749209,0.0002164372],"study_design_candidate":"observational","study_design_consensus":null,"genre_codex":"empirical","genre_gemma":"review","genre_scores_codex":[0.8935249,0.02494113,0.006205305,0.03961102,0.0003672027,0.0001766736,0.0002021908,0.0000329358,0.03493877],"genre_scores_gemma":[0.9910179,0.004543465,0.002447475,0.0008936018,0.0001894619,0.00009025944,0.0000684111,0.00001092296,0.0007384606],"genre_candidate":"review","genre_consensus":null,"teacher_disagreement_score":0.8882265,"threshold_uncertainty_score":0.5911218,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.07398197123150943,"score_gpt":0.3894116356311072,"score_spread":0.3154296643995977,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}