{"id":"W2805898775","doi":"10.1249/01.mss.0000538190.02670.21","title":"Determining Consistency And Agreement Of Scores Across Two Measurements Of The Visual System","year":2018,"lang":"en","type":"article","venue":"Medicine & Science in Sports & Exercise","topic":"Radiation Dose and Imaging","field":"Medicine","cited_by":5,"is_retracted":false,"has_abstract":true,"ca_institutions":"McGill University","funders":"","keywords":"Intraclass correlation; Reliability (semiconductor); Binocular vision; Limits of agreement; Convergence insufficiency; Test (biology); Audiology; Consistency (knowledge bases); Visual acuity; Repeatability; Medicine; Psychology; Optometry; Reproducibility; Mathematics; Statistics; Ophthalmology; Artificial intelligence; Computer science; Nuclear medicine","routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"codex-gemma-dda1882f352a","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.002039599,0.0001113731,0.0003902005,0.0001813561,0.0001480573,0.000007996074,0.0001884421,0.00001942594,0.00003806583],"category_scores_gemma":[0.0003417493,0.00006790719,0.00002963393,0.0007358525,0.002413644,0.0001610367,0.0000925029,0.00007538284,0.000001009307],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.00007058987,"about_ca_system_score_gemma":0.0002309685,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.000244791,"about_ca_topic_score_gemma":0.00003289942,"domain_scores_codex":[0.9977579,0.00001860551,0.0005756479,0.0002709811,0.001108622,0.0002682864],"domain_scores_gemma":[0.9989576,0.00002649296,0.0003025655,0.0003259031,0.0002766466,0.0001108255],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"observational","study_design_gemma":"observational","study_design_scores_codex":[0.00002559424,0.00003384538,0.9372164,0.0001114903,6.450443e-7,0.000009216104,0.00375884,0.000001083077,0.01158315,0.000002510704,0.00002777409,0.04722945],"study_design_scores_gemma":[0.001207805,0.0001955624,0.9804857,0.003800547,0.00005064281,0.0000381575,0.003860854,0.0006873301,0.009589574,0.000006507636,0.00001729827,0.0000600276],"study_design_candidate":"observational","study_design_consensus":"observational","genre_codex":"empirical","genre_gemma":"empirical","genre_scores_codex":[0.9968706,0.0001355727,0.00001166093,0.0001622142,0.0005031246,0.0003793128,6.777927e-7,0.000009085184,0.001927691],"genre_scores_gemma":[0.9995744,0.0000255966,0.0001271172,0.0001040309,0.00008028301,0.000007378341,4.503311e-7,0.000005758806,0.00007497279],"genre_candidate":"empirical","genre_consensus":"empirical","teacher_disagreement_score":0.04716942,"threshold_uncertainty_score":0.8893174,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.03536051873423302,"score_gpt":0.3446856003995902,"score_spread":0.3093250816653572,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}