{"id":"W7125593338","doi":"10.1109/cascon66301.2025.00027","title":"Designing Large Language Models for Specific Domains: A Case Study on Live Microbe Foods for Precision Nutrition","year":2025,"lang":"","type":"article","venue":"","topic":"Topic Modeling","field":"Computer Science","cited_by":0,"is_retracted":false,"has_abstract":true,"ca_institutions":"St. Michael's Hospital; University of Toronto; Institute for Clinical Evaluative Sciences","funders":"Canadian Institutes of Health Research","keywords":"Variety (cybernetics); Generalization; Generative grammar; Function (biology); Process (computing); Domain (mathematical analysis)","routes":{"ca_aff":true,"ca_fund":true,"ca_venue":false,"about_ca":false,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"codex-gemma-dda1882f352a","candidate_categories":["metaepi_narrow"],"consensus_categories":[],"category_scores_codex":[0.001789344,0.0004623889,0.0005470925,0.0004707981,0.0008402856,0.0006264925,0.0008289146,0.0002292374,0.00001815597],"category_scores_gemma":[0.0001000846,0.0004602808,0.0003295801,0.0004899919,0.0000262044,0.0008160629,0.0004643302,0.0002501395,0.000009855108],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.000277689,"about_ca_system_score_gemma":0.0001537271,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.0000742509,"about_ca_topic_score_gemma":0.0001418758,"domain_scores_codex":[0.996065,0.0002480629,0.0009027654,0.00159213,0.0003380481,0.0008539963],"domain_scores_gemma":[0.9968197,0.001223172,0.0002017405,0.001262867,0.0003561524,0.0001363194],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","study_design_scores_codex":[0.002247867,0.02188799,0.00007397388,0.002561807,0.0006617364,0.002112675,0.1789996,0.02721684,0.01592358,0.1840899,0.008915721,0.5553083],"study_design_scores_gemma":[0.00835392,0.002108113,0.000001884072,0.0007018427,0.00009103633,0.00009284501,0.03228193,0.9311476,0.008039715,0.01563365,0.001049859,0.0004976486],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"genre_codex":"methods","genre_gemma":"empirical","genre_scores_codex":[0.0869471,0.002686292,0.8990871,0.000235309,0.001030372,0.009399825,0.00006465735,0.0001514535,0.00039794],"genre_scores_gemma":[0.6612692,0.00005468732,0.3365184,0.0002810686,0.0002252255,0.0008601192,0.0000065841,0.00002674832,0.0007579407],"genre_candidate":"methods","genre_consensus":null,"teacher_disagreement_score":0.9039307,"threshold_uncertainty_score":0.9997849,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.05672739262348838,"score_gpt":0.3248556440195887,"score_spread":0.2681282513961003,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}