{"id":"W4412658976","doi":"10.1080/14992027.2025.2537693","title":"Validation of the clinical assistant for research and learning (CARL) for pure-tone audiometric procedures","year":2025,"lang":"en","type":"article","venue":"International Journal of Audiology","topic":"Surgical Simulation and Training","field":"Medicine","cited_by":2,"is_retracted":false,"has_abstract":true,"ca_institutions":"Process Simulations Limited (Canada); Western University","funders":"","keywords":"Audiology; Tone (literature); Pure tone; Audiometry; Psychology; Medicine; Speech recognition; Computer science; Hearing loss; Linguistics; Philosophy","routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.02850919,0.0006243376,0.0003233258,0.0008770282,0.0005482801,0.001130265,0.001062775,0.0008511474,0.002311081],"category_scores_gemma":[0.08980539,0.0003266285,0.0004855405,0.0002252975,0.0006510135,0.001089398,0.001959509,0.0006146401,0.001345444],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.000783257,"about_ca_system_score_gemma":0.004719648,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.0006126022,"about_ca_topic_score_gemma":0.002126704,"domain_scores_codex":[0.9801822,0.01207533,0.001868523,0.001087471,0.004269478,0.0005170995],"domain_scores_gemma":[0.9307932,0.03645452,0.00719278,0.004273876,0.01842301,0.002862612],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"observational","study_design_gemma":"observational","study_design_scores_codex":[0.004774789,0.005285001,0.6143547,0.001237176,0.0001333954,0.0006027076,0.009879549,0.002992766,0.04543616,0.0009675036,0.002382115,0.3119542],"study_design_scores_gemma":[0.001532404,0.06417704,0.7812551,0.001417167,0.0003643602,0.007173832,0.01460543,0.03074185,0.05431644,0.0009215099,0.04310362,0.0003911509],"study_design_candidate":"observational","study_design_consensus":"observational","genre_codex":"empirical","genre_gemma":"empirical","genre_scores_codex":[0.97668,0.0002286685,0.01463082,0.0003181018,0.0001003409,0.00398096,0.000228788,0.0002915533,0.003540766],"genre_scores_gemma":[0.9207857,0.0002228366,0.07344827,0.0001689396,0.00003600508,0.003009687,0.0003944699,0.0000351326,0.001899002],"genre_candidate":"empirical","genre_consensus":"empirical","teacher_disagreement_score":0.02850919,"threshold_uncertainty_score":0.1507728,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.1687758687450233,"score_gpt":0.5292294074968484,"score_spread":0.3604535387518252,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}