{"id":"W4322208105","doi":"10.1101/2023.02.25.23286117","title":"neuroGPT-X: Towards an Accountable Expert Opinion Tool for Vestibular Schwannoma","year":2023,"lang":"en","type":"preprint","venue":"medRxiv","topic":"Artificial Intelligence in Healthcare and Education","field":"Medicine","cited_by":12,"is_retracted":false,"has_abstract":true,"ca_institutions":"Dalhousie University; University of British Columbia; University of Calgary","funders":"","keywords":"Context (archaeology); Psychology; Medicine; Family medicine; Medical education; Geography","routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.009183488,0.001100116,0.000549662,0.002507305,0.000720758,0.002160591,0.002187935,0.002252623,0.01376192],"category_scores_gemma":[0.05518762,0.0002846072,0.0009222628,0.001052806,0.0006165201,0.003560404,0.005254475,0.001792888,0.008719777],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.001265788,"about_ca_system_score_gemma":0.002110109,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.003423786,"about_ca_topic_score_gemma":0.006996945,"domain_scores_codex":[0.9904649,0.006241736,0.0005343373,0.001325827,0.001183062,0.0002501753],"domain_scores_gemma":[0.9723097,0.01899276,0.00157017,0.00275927,0.002727062,0.001640979],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"not_applicable","study_design_gemma":"simulation_or_modeling","study_design_scores_codex":[0.002091804,0.000574503,0.02858916,0.002677421,0.000246271,0.001229505,0.003745616,0.01519438,0.009173377,0.009643525,0.5329827,0.3938518],"study_design_scores_gemma":[0.000775209,0.0009086991,0.02289477,0.001067399,0.0002144336,0.001288774,0.003376935,0.5125034,0.01281489,0.0762248,0.3675994,0.0003312653],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"genre_codex":"methods","genre_gemma":"empirical","genre_scores_codex":[0.140554,0.002523148,0.507871,0.02098148,0.002434886,0.002824662,0.08652061,0.2104857,0.02580474],"genre_scores_gemma":[0.409351,0.0006967441,0.4682495,0.004828922,0.001015913,0.00302062,0.0990549,0.003052978,0.01072937],"genre_candidate":"empirical","genre_consensus":null,"teacher_disagreement_score":0.01376192,"threshold_uncertainty_score":0.04856747,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.2848410309325434,"score_gpt":0.4709771573013682,"score_spread":0.1861361263688248,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}