{"id":"W2058504046","doi":"10.1097/01.blo.0000093909.26658.96","title":"Classifying Failed Hip Arthroplasty: Generalizability of Reliability and Validity","year":2003,"lang":"en","type":"article","venue":"Clinical Orthopaedics and Related Research","topic":"Orthopaedic implants and arthroplasty","field":"Medicine","cited_by":15,"is_retracted":false,"has_abstract":true,"ca_institutions":"Toronto Rehabilitation Institute","funders":"","keywords":"Medicine; Inter-rater reliability; Kappa; Radiography; Generalizability theory; Arthroplasty; Orthopedic surgery; Acetabulum; Cohen's kappa; Femoral head; Physical therapy; Hip arthroplasty; Surgery; Orthodontics; Rating scale","routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.07278708,0.00057097,0.0009214762,0.003661229,0.0008072128,0.001728777,0.001076429,0.0008696193,0.0008449693],"category_scores_gemma":[0.1814271,0.0006788391,0.001846192,0.001613319,0.00313211,0.001831972,0.002606327,0.00083499,0.0004395606],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.001105801,"about_ca_system_score_gemma":0.0008860785,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.003482206,"about_ca_topic_score_gemma":0.004182514,"domain_scores_codex":[0.9488817,0.02727538,0.007178125,0.004449206,0.01096512,0.001250486],"domain_scores_gemma":[0.7865946,0.1400716,0.0186338,0.02375927,0.0294242,0.001516664],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"observational","study_design_gemma":"observational","study_design_scores_codex":[0.0003212509,0.00006028855,0.9662139,0.0001635708,0.0007592065,0.00007472638,0.00263098,0.0008286728,0.0007509875,0.0002644827,0.0004654659,0.02746658],"study_design_scores_gemma":[0.00007395291,0.0005374181,0.9791436,0.0001791406,0.0003873673,0.0006011334,0.002733899,0.01119205,0.001400225,0.002048259,0.001638757,0.0000642563],"study_design_candidate":"observational","study_design_consensus":"observational","genre_codex":"empirical","genre_gemma":"empirical","genre_scores_codex":[0.9813829,0.001081824,0.01146564,0.0002401367,0.0001634316,0.000380113,0.0002535775,0.00007756538,0.004954751],"genre_scores_gemma":[0.9970156,0.0001476785,0.002316609,0.0000470353,0.00004689403,0.00009170013,0.0001741001,0.00002459572,0.0001357376],"genre_candidate":"empirical","genre_consensus":"empirical","teacher_disagreement_score":0.07278708,"threshold_uncertainty_score":0.3849394,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.157616190588944,"score_gpt":0.4232675072644383,"score_spread":0.2656513166754943,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}