{"id":"W2104009022","doi":"10.5539/ijel.v3n1p41","title":"An Overview of Studies on Diagnostic Testing and its Implications for the Development of Diagnostic Speaking Test","year":2013,"lang":"en","type":"article","venue":"International Journal of English Linguistics","topic":"Student Assessment and Feedback","field":"Social Sciences","cited_by":26,"is_retracted":false,"has_abstract":true,"ca_institutions":"","funders":"","keywords":"Diagnostic test; Test (biology); Empirical research; Psychology; Computer science; Medicine; Epistemology","routes":{"ca_aff":false,"ca_fund":false,"ca_venue":true,"about_ca":false,"invisible_to_affiliation_only":true},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"codex-gemma-dda1882f352a","candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.0007719118,0.00007320852,0.0001595407,0.00007661465,0.0001600836,0.00005583064,0.0003869424,0.00002663338,0.000009263547],"category_scores_gemma":[0.4994188,0.00005404635,0.00004123128,0.0000967868,0.00009505935,0.00007332364,0.00004766885,0.00008151405,5.77373e-7],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.00006279119,"about_ca_system_score_gemma":0.0001655852,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.00002156299,"about_ca_topic_score_gemma":0.00007356678,"domain_scores_codex":[0.9988686,0.00003445638,0.0005590841,0.00007397624,0.0003638796,0.00009998196],"domain_scores_gemma":[0.9326114,0.04162631,0.0009124465,0.00008323061,0.02469847,0.00006813306],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"observational","study_design_gemma":"observational","study_design_scores_codex":[0.00002750043,0.001026662,0.7386165,0.0001833116,0.0009905969,0.000002963678,0.07993235,0.0009781234,0.0002798534,0.1483905,0.00145044,0.02812129],"study_design_scores_gemma":[0.001092347,0.0005256745,0.9302127,0.001667605,0.0002859772,7.904278e-7,0.02674486,0.000324473,0.0008187317,0.01173695,0.02630494,0.0002849691],"study_design_candidate":"observational","study_design_consensus":"observational","genre_codex":"empirical","genre_gemma":"empirical","genre_scores_codex":[0.9646151,0.009868147,0.0005563364,0.0007206123,0.01377411,0.00121565,0.00006191726,0.00002863718,0.009159455],"genre_scores_gemma":[0.9915236,0.0009548713,0.004694279,0.00003791064,0.002757295,0.00001442425,0.000001079612,0.000006689347,0.00000986036],"genre_candidate":"empirical","genre_consensus":"empirical","teacher_disagreement_score":0.4986469,"threshold_uncertainty_score":0.5047978,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.1492934231738788,"score_gpt":0.4403462342302701,"score_spread":0.2910528110563914,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}