{"id":"W16439471","doi":"10.55016/ojs/ajer.v47i2.54855","title":"The Large-Scale, Authentic Assessment of Listening and Speaking as Interactive Communication: Issues in Reliability","year":2001,"lang":"en","type":"article","venue":"Alberta Journal of Educational Research","topic":"Communication in Education and Healthcare","field":"Psychology","cited_by":3,"is_retracted":false,"has_abstract":true,"ca_institutions":"","funders":"","keywords":"Active listening; Reliability (semiconductor); Psychology; Scale (ratio); Applied psychology; Speech communication; Rating scale; Social psychology; Mathematics education; Developmental psychology; Communication; Linguistics; Geography","routes":{"ca_aff":false,"ca_fund":false,"ca_venue":true,"about_ca":true,"invisible_to_affiliation_only":true},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.1655401,0.000982766,0.001292499,0.002265891,0.001465565,0.002599811,0.002045667,0.0009732043,0.001068128],"category_scores_gemma":[0.3371721,0.0005619333,0.0006940703,0.00249916,0.004792876,0.002382207,0.003236734,0.001915199,0.0009698083],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.001109389,"about_ca_system_score_gemma":0.002067277,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.005919787,"about_ca_topic_score_gemma":0.01082163,"domain_scores_codex":[0.79806,0.1512914,0.01143735,0.005974554,0.03214806,0.001088664],"domain_scores_gemma":[0.4911227,0.3873099,0.01604057,0.04731964,0.05604354,0.00216357],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"design_other","study_design_gemma":"observational","study_design_scores_codex":[0.002215923,0.0009479391,0.3320682,0.002325009,0.0008300606,0.0003520155,0.03290924,0.006089123,0.01256404,0.01535195,0.006724366,0.5876222],"study_design_scores_gemma":[0.0004616645,0.005281805,0.8453291,0.001513881,0.0005177606,0.001174316,0.01535563,0.04013817,0.02103185,0.03817997,0.03050985,0.0005060991],"study_design_candidate":"observational","study_design_consensus":null,"genre_codex":"empirical","genre_gemma":"empirical","genre_scores_codex":[0.4872262,0.00315718,0.4588676,0.003162811,0.001144999,0.005342334,0.0007562699,0.001211384,0.03913116],"genre_scores_gemma":[0.8595812,0.0006884292,0.1311325,0.0006354258,0.0003036383,0.004930767,0.0003594745,0.0002730956,0.002095442],"genre_candidate":"empirical","genre_consensus":"empirical","teacher_disagreement_score":0.1655401,"threshold_uncertainty_score":0.8754703,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.08915456738936146,"score_gpt":0.5516501538072045,"score_spread":0.4624955864178431,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}