{"id":"W6982658776","doi":"","title":"Issues of Generalization from Unreliable or Unrepresentative Psycholinguistic Stimuli: A Case Study on Lexical Ambiguity","year":2024,"lang":"en","type":"article","venue":"eScholarship (California Digital Library)","topic":"Urban and spatial planning","field":"Environmental Science","cited_by":0,"is_retracted":false,"has_abstract":true,"ca_institutions":"","funders":"University of Toronto Scarborough; Natural Sciences and Engineering Research Council of Canada","keywords":"Ambiguity; Psycholinguistics; Generalizability theory; Generalization; Set (abstract data type); Unobservable; Word (group theory); Empirical research","routes":{"ca_aff":false,"ca_fund":true,"ca_venue":false,"about_ca":false,"invisible_to_affiliation_only":true},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.1085509,0.0008628478,0.001392064,0.004281689,0.004906435,0.004972146,0.002122226,0.003571434,0.001688666],"category_scores_gemma":[0.2889506,0.0008275771,0.001242479,0.00423632,0.01226221,0.008970461,0.007488784,0.003331985,0.000265133],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.002182934,"about_ca_system_score_gemma":0.001338791,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.001697065,"about_ca_topic_score_gemma":0.002287581,"domain_scores_codex":[0.8784211,0.0939386,0.008630721,0.005940798,0.01139743,0.001671378],"domain_scores_gemma":[0.52443,0.4158645,0.01628231,0.0336624,0.009106731,0.0006541226],"domain_codex":null,"domain_gemma":"methods","domain_candidate":"methods","domain_consensus":null,"study_design_codex":"qualitative","study_design_gemma":"observational","study_design_scores_codex":[0.00144976,0.0005904051,0.1440699,0.003527192,0.0004673264,0.02003524,0.6014502,0.003412967,0.03168641,0.06248007,0.002455086,0.1283755],"study_design_scores_gemma":[0.0003015777,0.001794242,0.1463742,0.005427017,0.0007399627,0.0523917,0.3515484,0.01401474,0.08654593,0.247213,0.09280164,0.0008475409],"study_design_candidate":"observational","study_design_consensus":null,"genre_codex":"empirical","genre_gemma":"empirical","genre_scores_codex":[0.9377252,0.001134509,0.05003862,0.002574527,0.00008513219,0.0006049686,0.0001785974,0.00007044621,0.007588003],"genre_scores_gemma":[0.9765736,0.0003278388,0.021478,0.000761832,0.00005684287,0.0003886269,0.00008268933,0.00007633698,0.0002542424],"genre_candidate":"empirical","genre_consensus":"empirical","teacher_disagreement_score":0.8914491,"threshold_uncertainty_score":0.574079,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.04567344384952107,"score_gpt":0.3083705470257598,"score_spread":0.2626971031762387,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}