{"id":"W4415439014","doi":"10.1038/s41598-025-21398-4","title":"Generative artificial intelligence models outperform students on divergent and convergent thinking assessments","year":2025,"lang":"en","type":"article","venue":"Scientific Reports","topic":"Creativity in Education and Neuroscience","field":"Psychology","cited_by":4,"is_retracted":false,"has_abstract":true,"ca_institutions":"McMaster University; Impact","funders":"","keywords":"Originality; Creativity; Convergent thinking; Divergent thinking; Generative grammar; Task (project management); Generative model; Measure (data warehouse)","routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"codex-gemma-dda1882f352a","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.001460577,0.0001706038,0.0001749895,0.0002845319,0.0007880181,0.0005264105,0.000280995,0.00006206731,0.0004840141],"category_scores_gemma":[0.00008982154,0.0001531812,0.00005521948,0.0005487244,0.0003511375,0.0001954044,0.0002185743,0.0001709922,0.00005877409],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.0001013768,"about_ca_system_score_gemma":0.0001405148,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.0000381046,"about_ca_topic_score_gemma":0.00001817275,"domain_scores_codex":[0.9973099,0.0001070854,0.0004867031,0.00104525,0.0007337245,0.0003173982],"domain_scores_gemma":[0.9987676,0.00007516336,0.0002032642,0.0007008261,0.0001294902,0.0001236937],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","study_design_scores_codex":[0.0002433897,0.007266242,0.1735235,0.00007612321,0.0003187582,0.0006968371,0.04749664,0.002550974,0.01670413,0.5436569,0.06668673,0.1407798],"study_design_scores_gemma":[0.0004365902,0.0006191876,0.05771799,0.0003421209,0.0001787872,0.0001794312,0.0178951,0.01442511,0.1041039,0.7643933,0.03826773,0.00144079],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","genre_codex":"empirical","genre_gemma":"empirical","genre_scores_codex":[0.9343711,0.00006671381,0.01150092,0.0006135809,0.03841255,0.0004924903,0.000003723216,0.0000598739,0.01447907],"genre_scores_gemma":[0.9812933,0.00001070209,0.0002099523,0.0004363937,0.00004716626,0.00006104182,0.00001023217,0.000007103147,0.0179241],"genre_candidate":"empirical","genre_consensus":"empirical","teacher_disagreement_score":0.2207364,"threshold_uncertainty_score":0.6246548,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.09617892431486276,"score_gpt":0.4354647312296637,"score_spread":0.339285806914801,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}