{"id":"W4414105322","doi":"10.1016/j.jrp.2025.104666","title":"A discourse on the use of machine learning (ML) in personality psychology: Can we expect ML to predict questionnaire scores from idiographic text-based data?","year":2025,"lang":"en","type":"article","venue":"Journal of Research in Personality","topic":"Personality Traits and Psychology","field":"Psychology","cited_by":2,"is_retracted":false,"has_abstract":true,"ca_institutions":"Artificial Intelligence in Medicine (Canada)","funders":"Stiftung Suzanne und Hans Biäsch zur Förderung der Angewandten Psychologie","keywords":"Nomothetic and idiographic; Personality; Narrative; Relation (database); Big Five personality traits; Baseline (sea)","routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"codex-gemma-dda1882f352a","candidate_categories":["metaepi_narrow","research_integrity"],"consensus_categories":[],"category_scores_codex":[0.01214803,0.0003531348,0.0008479265,0.001868095,0.0002426186,0.00009887028,0.001833482,0.0003432839,0.0007956019],"category_scores_gemma":[0.001955319,0.0002571224,0.0003153032,0.002643628,0.001314492,0.000231693,0.0002128454,0.003716357,0.00001088405],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.0002551428,"about_ca_system_score_gemma":0.0006074252,"about_ca_topic_candidate":true,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.0212014,"about_ca_topic_score_gemma":0.01751809,"domain_scores_codex":[0.9879656,0.007521028,0.001255351,0.0009570307,0.001395263,0.0009057034],"domain_scores_gemma":[0.9939492,0.003511337,0.0004427258,0.001367078,0.0004231498,0.0003064714],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"observational","study_design_gemma":"observational","study_design_scores_codex":[0.005904277,0.002256832,0.9571083,0.0001061606,0.0004397251,0.000299049,0.006602188,0.0001544812,0.0004547992,0.002795071,0.01517427,0.008704799],"study_design_scores_gemma":[0.00279043,0.0009336501,0.9800983,0.00174563,0.00004799007,0.00002321612,0.002573531,0.0005501492,0.00001905051,0.002454632,0.008535891,0.0002275418],"study_design_candidate":"observational","study_design_consensus":"observational","genre_codex":"empirical","genre_gemma":"empirical","genre_scores_codex":[0.8991544,0.00239116,0.0002553015,0.0958325,0.0005385905,0.000518362,0.000713727,0.0000184269,0.0005774925],"genre_scores_gemma":[0.9964166,0.0002006828,0.0003155682,0.002482516,0.0002660767,0.00005137058,0.00005237105,0.00002898018,0.0001858169],"genre_candidate":"empirical","genre_consensus":"empirical","teacher_disagreement_score":0.09726218,"threshold_uncertainty_score":0.9999881,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.2815219462195009,"score_gpt":0.4982465580916528,"score_spread":0.2167246118721519,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}