{"id":"W4407547006","doi":"10.2196/65320","title":"Detecting Conversation Topics in Recruitment Calls of African American Participants to the All of Us Research Program Using Machine Learning: Model Development and Validation Study","year":2025,"lang":"en","type":"article","venue":"JMIR Formative Research","topic":"Artificial Intelligence in Healthcare and Education","field":"Medicine","cited_by":0,"is_retracted":false,"has_abstract":true,"ca_institutions":"","funders":"","keywords":"Conversation; Health equity; Underrepresented Minority; Diversity (politics); Medical education; Inclusion (mineral); Population; Psychology; Observational study; Research design; Medicine; Public relations; Political science; Sociology; Public health; Social psychology; Social science; Nursing; Environmental health","routes":{"ca_aff":false,"ca_fund":false,"ca_venue":true,"about_ca":false,"invisible_to_affiliation_only":true},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.03029311,0.001282172,0.001136424,0.001881167,0.001778227,0.002164056,0.001770806,0.001395518,0.002049536],"category_scores_gemma":[0.04907725,0.0005514149,0.00253678,0.001234045,0.00100446,0.001550651,0.00235027,0.003080737,0.0006934435],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.002292912,"about_ca_system_score_gemma":0.003013087,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.02465121,"about_ca_topic_score_gemma":0.01551553,"domain_scores_codex":[0.9914154,0.006383413,0.000337018,0.001094396,0.0003600789,0.0004095681],"domain_scores_gemma":[0.9189128,0.07219162,0.002155817,0.00197193,0.004044552,0.0007233128],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"observational","study_design_gemma":"simulation_or_modeling","study_design_scores_codex":[0.002423492,0.004197329,0.7095207,0.0005686388,0.001085825,0.0002630501,0.008457444,0.1077872,0.001571688,0.003295775,0.005228223,0.1556006],"study_design_scores_gemma":[0.00009633537,0.0003694159,0.04652833,0.000130623,0.0001983201,0.00005136157,0.00195077,0.9476058,0.0006219978,0.001554465,0.000844051,0.0000485618],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"genre_codex":"empirical","genre_gemma":"empirical","genre_scores_codex":[0.9684817,0.000365491,0.0282185,0.0004632958,0.00008918649,0.0007582147,0.0005893786,0.0001496768,0.0008846119],"genre_scores_gemma":[0.9758134,0.000135964,0.02039232,0.0001323954,0.00004158085,0.001046137,0.001748888,0.00002084418,0.0006685168],"genre_candidate":"empirical","genre_consensus":"empirical","teacher_disagreement_score":0.03029311,"threshold_uncertainty_score":0.1602072,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.6868058628098886,"score_gpt":0.628063233322933,"score_spread":0.05874262948695563,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}