{"id":"W4318929966","doi":"10.1037/cep0000303","title":"Text validation: Overlooking discrepancies in question constructions.","year":2023,"lang":"en","type":"article","venue":"Canadian Journal of Experimental Psychology/Revue canadienne de psychologie expérimentale","topic":"Text Readability and Simplification","field":"Computer Science","cited_by":0,"is_retracted":false,"has_abstract":true,"ca_institutions":"University of Manitoba","funders":"Natural Sciences and Engineering Research Council of Canada","keywords":"Interrogative; Interrogative word; Consistency (knowledge bases); Linguistics; Construct (python library); Verb; Psychology; Sentence; PsycINFO; Natural language processing; Computer science; Cognitive psychology; Artificial intelligence; Philosophy; MEDLINE","routes":{"ca_aff":true,"ca_fund":true,"ca_venue":false,"about_ca":false,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.0178443,0.0004440609,0.0004965407,0.000886869,0.0007261459,0.00235258,0.001325935,0.001302786,0.003599693],"category_scores_gemma":[0.1984283,0.0005313542,0.0003672454,0.0006330605,0.003798696,0.005571819,0.003801286,0.002148203,0.0005402788],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.0005996347,"about_ca_system_score_gemma":0.000606434,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.0004621296,"about_ca_topic_score_gemma":0.0006388924,"domain_scores_codex":[0.9829867,0.009930382,0.001004901,0.00220345,0.003590703,0.0002838924],"domain_scores_gemma":[0.7391171,0.1976797,0.02853207,0.028611,0.005104147,0.0009559732],"domain_codex":null,"domain_gemma":"methods","domain_candidate":"methods","domain_consensus":null,"study_design_codex":"design_other","study_design_gemma":"observational","study_design_scores_codex":[0.003837838,0.000960614,0.2035371,0.00275979,0.0004845816,0.002249332,0.2041387,0.00170739,0.2556607,0.04424034,0.003886743,0.2765368],"study_design_scores_gemma":[0.0004148509,0.002176594,0.5492384,0.001739864,0.0008077821,0.008026134,0.04453099,0.01920107,0.199676,0.1204839,0.05337406,0.0003302912],"study_design_candidate":"observational","study_design_consensus":null,"genre_codex":"empirical","genre_gemma":"empirical","genre_scores_codex":[0.9483387,0.0006138881,0.03375445,0.001045235,0.00008310267,0.0002084767,0.0002014714,0.0003300084,0.01542462],"genre_scores_gemma":[0.9917647,0.000101494,0.00643724,0.0003268517,0.00002125043,0.00008139816,0.0001944234,0.0001477213,0.0009249376],"genre_candidate":"empirical","genre_consensus":"empirical","teacher_disagreement_score":0.9821557,"threshold_uncertainty_score":0.09437084,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.03959266053740267,"score_gpt":0.3197643406229638,"score_spread":0.2801716800855611,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}