{"id":"W4389520358","doi":"10.18653/v1/2023.emnlp-main.744","title":"When Language Models Fall in Love: Animacy Processing in Transformer Language Models","year":2023,"lang":"en","type":"article","venue":"","topic":"Language, Metaphor, and Cognition","field":"Psychology","cited_by":2,"is_retracted":false,"has_abstract":true,"ca_institutions":"","funders":"Azrieli Foundation; Open Philanthropy Project","keywords":"Animacy; Computer science; Cognition; Linguistics; Context (archaeology); Cognitive psychology; Psychology; Natural language processing; Artificial intelligence; History","routes":{"ca_aff":false,"ca_fund":true,"ca_venue":false,"about_ca":false,"invisible_to_affiliation_only":true},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"codex-gemma-dda1882f352a","candidate_categories":["insufficient_payload"],"consensus_categories":["insufficient_payload"],"category_scores_codex":[0.0004474823,0.0002334972,0.000307849,0.0005016659,0.0000254949,0.00005176148,0.0002276377,0.0001932246,0.00123154],"category_scores_gemma":[0.00001166564,0.0002057285,0.00008772275,0.0007228476,0.00003679466,0.0005585243,0.00002273204,0.0003158728,0.0008783242],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.00005494693,"about_ca_system_score_gemma":0.00004424779,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.004837858,"about_ca_topic_score_gemma":0.006480518,"domain_scores_codex":[0.998117,0.0001198692,0.0004068083,0.0004893902,0.0002495029,0.0006174521],"domain_scores_gemma":[0.9995186,0.00004465783,0.00005132813,0.000274263,0.00003081023,0.00008038268],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"qualitative","study_design_gemma":"qualitative","study_design_scores_codex":[0.0003448183,0.0005856076,0.0008181535,0.0002039847,0.00004508791,0.001253955,0.8164432,0.001250088,0.009421565,0.01147047,0.001973418,0.1561896],"study_design_scores_gemma":[0.01317375,0.0002885476,0.01081402,0.000499259,0.0001327518,0.00009899025,0.6628323,0.1920049,0.00453273,0.112784,0.0005282941,0.00231047],"study_design_candidate":"qualitative","study_design_consensus":"qualitative","genre_codex":"empirical","genre_gemma":"empirical","genre_scores_codex":[0.7128049,0.001327686,0.005176831,0.0003559764,0.00009749539,0.0003930823,0.0000252324,0.0002305789,0.2795883],"genre_scores_gemma":[0.9845348,0.00003790854,0.0003862083,0.0006901089,0.00008547912,0.00007427075,0.00009586014,0.00005489631,0.01404047],"genre_candidate":"empirical","genre_consensus":"empirical","teacher_disagreement_score":0.2717299,"threshold_uncertainty_score":0.9998996,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.03607328323719367,"score_gpt":0.3236108348304818,"score_spread":0.2875375515932881,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}