{"id":"W4410776569","doi":"10.2196/70005","title":"Crowdsourcing a Training Dataset of Question-and-Answer Pairs for AI-Enabled Health Information Tools on Sexually Transmitted Infections: Protocol for a Cross-Sectional Exploratory Survey Study","year":2025,"lang":"en","type":"article","venue":"JMIR Research Protocols","topic":"Artificial Intelligence in Healthcare and Education","field":"Medicine","cited_by":0,"is_retracted":false,"has_abstract":true,"ca_institutions":"","funders":"International Development Research Centre","keywords":"Preprint; Protocol (science); Crowdsourcing; Data science; Computer science; Medical education; Psychology; Medicine; World Wide Web; Alternative medicine","routes":{"ca_aff":false,"ca_fund":true,"ca_venue":true,"about_ca":false,"invisible_to_affiliation_only":true},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.02838991,0.001316878,0.001298636,0.002331324,0.004197021,0.002525622,0.003008388,0.003467849,0.04426766],"category_scores_gemma":[0.05794033,0.00142752,0.001847623,0.002288062,0.002257538,0.001895319,0.00461184,0.003666132,0.01720693],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.004414992,"about_ca_system_score_gemma":0.01431622,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.009914569,"about_ca_topic_score_gemma":0.02263685,"domain_scores_codex":[0.9851058,0.007485942,0.001946539,0.002340753,0.002068725,0.001052226],"domain_scores_gemma":[0.9617913,0.01477382,0.002765859,0.00685283,0.01197628,0.001839983],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"not_applicable","study_design_gemma":"observational","study_design_scores_codex":[0.0146411,0.01235679,0.02812003,0.02873778,0.0005418368,0.001736482,0.03077465,0.0081602,0.01117965,0.0172648,0.6392292,0.2072576],"study_design_scores_gemma":[0.006957438,0.003039459,0.05763624,0.007126213,0.0002482721,0.0003323541,0.009747287,0.004899788,0.005227579,0.0122612,0.892018,0.0005062522],"study_design_candidate":"observational","study_design_consensus":null,"genre_codex":"protocol","genre_gemma":"protocol","genre_scores_codex":[0.0243589,0.0003585173,0.02120108,0.001624505,0.0005308891,0.8000643,0.1425301,0.0009231072,0.008408635],"genre_scores_gemma":[0.007724964,0.00009357187,0.01524605,0.0004984034,0.00004223777,0.9579847,0.01648848,0.00005716089,0.001864535],"genre_candidate":"protocol","genre_consensus":"protocol","teacher_disagreement_score":0.04426766,"threshold_uncertainty_score":0.150142,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.6608864635875452,"score_gpt":0.6675879835761843,"score_spread":0.006701519988639104,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}