{"id":"W4407556803","doi":"10.1007/s00421-025-05720-6","title":"Discussion on the validity of commonly used reliability indices in sports medicine and exercise science: a critical review with data simulations","year":2025,"lang":"en","type":"review","venue":"European Journal of Applied Physiology","topic":"Sports Performance and Training","field":"Medicine","cited_by":25,"is_retracted":false,"has_abstract":true,"ca_institutions":"University of Toronto","funders":"Leuphana Universität Lüneburg","keywords":"Intraclass correlation; Reliability (semiconductor); Statistics; Standard error; Objectivity (philosophy); Random error; Standard deviation; Comparability; Protocol (science); Mathematics; Systematic error; Computer science; Medicine; Reproducibility; Pathology","routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":["metaresearch"],"consensus_categories":["metaresearch"],"category_scores_codex":[0.3097583,0.002319591,0.006133637,0.02250776,0.001849082,0.006315977,0.006403757,0.006066679,0.005767187],"category_scores_gemma":[0.6132346,0.001971572,0.01116703,0.01194553,0.005431668,0.007902546,0.003927799,0.005885559,0.001360302],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.009724283,"about_ca_system_score_gemma":0.0244388,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.004636608,"about_ca_topic_score_gemma":0.005896491,"domain_scores_codex":[0.7973328,0.1121239,0.05403709,0.006969966,0.02819701,0.001339289],"domain_scores_gemma":[0.1732287,0.7359692,0.02412571,0.009810802,0.05608844,0.0007771455],"domain_codex":null,"domain_gemma":"methods","domain_candidate":"methods","domain_consensus":null,"study_design_codex":"systematic_review","study_design_gemma":"simulation_or_modeling","study_design_scores_codex":[0.0008497057,0.0001091851,0.002783584,0.6197794,0.00682044,0.001053166,0.004812365,0.002774202,0.001118311,0.0288262,0.04566755,0.2854058],"study_design_scores_gemma":[0.0002392346,0.0004203526,0.003227766,0.7467461,0.01018784,0.0007433337,0.00166985,0.001643383,0.00137823,0.02095108,0.2125306,0.0002622236],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"genre_codex":"review","genre_gemma":"review","genre_scores_codex":[0.002053404,0.9133489,0.02811323,0.0416331,0.006980177,0.004178209,0.001413345,0.0002164528,0.002063175],"genre_scores_gemma":[0.06953166,0.7890943,0.06767992,0.03964062,0.006031333,0.02514761,0.001325769,0.0003515036,0.001197386],"genre_candidate":"review","genre_consensus":"review","teacher_disagreement_score":0.6902417,"threshold_uncertainty_score":0.8511909,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.1324778345447828,"score_gpt":0.3984671895579904,"score_spread":0.2659893550132075,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}