{"id":"W4309657883","doi":"10.2196/40449","title":"Relative Validation of an Artificial Intelligence–Enhanced, Image-Assisted Mobile App for Dietary Assessment in Adults: Randomized Crossover Study","year":2022,"lang":"en","type":"article","venue":"Journal of Medical Internet Research","topic":"Nutritional Studies and Diet","field":"Medicine","cited_by":38,"is_retracted":false,"has_abstract":true,"ca_institutions":"McGill University; McGill University Health Centre","funders":"","keywords":"Wilcoxon signed-rank test; Crossover study; Medicine; Psychology; Statistics; Mathematics; Mann–Whitney U test","routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":true,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"codex-gemma-dda1882f352a","candidate_categories":["insufficient_payload"],"consensus_categories":[],"category_scores_codex":[0.01221498,0.0001093339,0.0007821917,0.000380627,0.0001030369,0.00002627341,0.0003301765,0.00007378117,0.00168539],"category_scores_gemma":[0.002800887,0.00007973389,0.0002615174,0.0004054829,0.0003695394,0.0001542974,0.0002714593,0.001432999,0.000001975559],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.0003796463,"about_ca_system_score_gemma":0.000412279,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.0003384326,"about_ca_topic_score_gemma":0.00006891613,"domain_scores_codex":[0.9937561,0.001098698,0.001326421,0.0002256279,0.003316766,0.0002763459],"domain_scores_gemma":[0.9962276,0.001977979,0.0003379958,0.0001410999,0.001098245,0.0002171272],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"randomized_trial","study_design_gemma":"randomized_trial","study_design_scores_codex":[0.8809047,0.0338542,0.001274863,0.0006072375,0.001562199,0.001040368,0.01285094,0.000186391,0.002452419,0.002407728,0.006973665,0.05588529],"study_design_scores_gemma":[0.5113618,0.09989217,0.01158262,0.004036392,0.0006172672,0.0004769786,0.2608494,0.04548774,0.0153392,0.04721609,0.002456115,0.0006842203],"study_design_candidate":"randomized_trial","study_design_consensus":"randomized_trial","genre_codex":"empirical","genre_gemma":"empirical","genre_scores_codex":[0.9906397,0.0003383952,0.004308511,0.002183232,0.0002609929,0.001902523,0.00002139367,0.000004866108,0.0003404099],"genre_scores_gemma":[0.99748,0.000154847,0.00142193,0.00005102665,0.0002721707,0.0004549155,0.00003166401,0.00001325087,0.0001201925],"genre_candidate":"empirical","genre_consensus":"empirical","teacher_disagreement_score":0.3695429,"threshold_uncertainty_score":0.9992272,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.0942484248655235,"score_gpt":0.4856996073756762,"score_spread":0.3914511825101528,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}