{"id":"W2090570025","doi":"10.1177/00131640021970330","title":"Number-Right, Item-Response, and Finite-State Scoring: Robustness with Respect to Lack of Equally Classifiable Options and Item Option Independence","year":2000,"lang":"en","type":"article","venue":"Educational and Psychological Measurement","topic":"Psychometric Methodologies and Testing","field":"Decision Sciences","cited_by":6,"is_retracted":false,"has_abstract":true,"ca_institutions":"University of Alberta","funders":"","keywords":"Robustness (evolution); Independence (probability theory); Mathematics; Statistics; Econometrics","routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.3059008,0.001690259,0.002752322,0.003889561,0.001826511,0.004826145,0.005090983,0.002733671,0.003025354],"category_scores_gemma":[0.6409774,0.001889883,0.00373122,0.00309538,0.009517221,0.008932685,0.008489493,0.005304048,0.001263547],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.00228868,"about_ca_system_score_gemma":0.001948438,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.004177005,"about_ca_topic_score_gemma":0.004292476,"domain_scores_codex":[0.6266091,0.2990401,0.01614802,0.02208618,0.0335278,0.002588789],"domain_scores_gemma":[0.2202973,0.6100158,0.03222367,0.1161088,0.01880526,0.002549292],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","study_design_scores_codex":[0.01407832,0.001430072,0.3563491,0.00114294,0.008234247,0.0006490977,0.009809849,0.1447848,0.007638257,0.08297089,0.005007856,0.3679045],"study_design_scores_gemma":[0.0007544223,0.002823461,0.2049958,0.00044332,0.0006600776,0.001166283,0.001071388,0.6557981,0.01198434,0.1156946,0.003700506,0.0009077776],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"genre_codex":"methods","genre_gemma":"empirical","genre_scores_codex":[0.4147103,0.0003462202,0.5738542,0.0007839217,0.0001905199,0.001333958,0.0005577445,0.001180637,0.00704258],"genre_scores_gemma":[0.8901656,0.00008753088,0.1062857,0.0003123015,0.00005123386,0.001163916,0.0007752833,0.0002105705,0.0009477975],"genre_candidate":"empirical","genre_consensus":null,"teacher_disagreement_score":0.3059008,"threshold_uncertainty_score":0.8559479,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.6325820280120732,"score_gpt":0.4842413224829055,"score_spread":0.1483407055291677,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}