{"id":"W4285382277","doi":"10.2196/32460","title":"Attention-Based Models for Classifying Small Data Sets Using Community-Engaged Research Protocols: Classification System Development and Validation Pilot Study","year":2022,"lang":"en","type":"article","venue":"JMIR Formative Research","topic":"Health Policy Implementation Science","field":"Health Professions","cited_by":7,"is_retracted":false,"has_abstract":true,"ca_institutions":"","funders":"National Center for Advancing Translational Sciences; National Institutes of Health; Georgia Clinical and Translational Science Alliance","keywords":"Overfitting; Computer science; Artificial intelligence; Machine learning; Data science; Transfer of learning; Encoder; Artificial neural network","routes":{"ca_aff":false,"ca_fund":false,"ca_venue":true,"about_ca":false,"invisible_to_affiliation_only":true},"retraction":null,"screen":null,"direct_labels":[{"model":"gemma","categories":[],"domain":null,"study_design":"simulation_or_modeling","genre":"empirical","about_ca_system":false,"about_ca_topic":false,"confidence":"low","status":"direct model label, unvalidated"},{"model":"gpt","categories":[],"domain":null,"study_design":"simulation_or_modeling","genre":"methods","about_ca_system":false,"about_ca_topic":false,"confidence":"low","status":"direct model label, unvalidated"}],"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.01940596,0.001656131,0.0009903286,0.0022109,0.0009420105,0.001816345,0.002815411,0.002092251,0.002309936],"category_scores_gemma":[0.03321569,0.0004307277,0.001474969,0.001392942,0.0009327182,0.002241388,0.002811772,0.003987753,0.001523189],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.003119194,"about_ca_system_score_gemma":0.002849262,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.01594784,"about_ca_topic_score_gemma":0.01552147,"domain_scores_codex":[0.9940231,0.003124232,0.000658459,0.001235546,0.0006462173,0.0003124029],"domain_scores_gemma":[0.9719753,0.01744993,0.001278323,0.003135314,0.005521973,0.0006391071],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","study_design_scores_codex":[0.002379254,0.00316209,0.06395039,0.0007402502,0.0007417951,0.00050477,0.001904731,0.1247548,0.008310334,0.002761523,0.0164037,0.7743864],"study_design_scores_gemma":[0.000142109,0.0005188663,0.007634293,0.0001238069,0.0001188412,0.00009169782,0.0005835348,0.979766,0.005446126,0.003176066,0.002349781,0.00004895109],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"genre_codex":"empirical","genre_gemma":"methods","genre_scores_codex":[0.7037791,0.001960874,0.2720041,0.001829869,0.0006576927,0.004710821,0.003928107,0.007003797,0.004125574],"genre_scores_gemma":[0.8123287,0.0003798231,0.1746973,0.0004635705,0.0001062644,0.002647882,0.006063442,0.0001287061,0.003184421],"genre_candidate":"methods","genre_consensus":null,"teacher_disagreement_score":0.01940596,"threshold_uncertainty_score":0.1026298,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.9780893934443408,"score_gpt":0.7629965699340081,"score_spread":0.2150928235103327,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}