{"id":"W4416716702","doi":"10.1101/2025.11.23.690073","title":"A Multi-Agent Approach to Generating Context-Rich Gene Sets","year":2025,"lang":"","type":"preprint","venue":"bioRxiv (Cold Spring Harbor Laboratory)","topic":"Biomedical Text Mining and Ontologies","field":"Biochemistry, Genetics and Molecular Biology","cited_by":0,"is_retracted":false,"has_abstract":true,"ca_institutions":"University of Calgary","funders":"","keywords":"Set (abstract data type); Relevance (law); Gene nomenclature; Pipeline (software); Gene; Selection (genetic algorithm); Gene prediction; Task (project management); Biological data","routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.001159975,0.0008459887,0.00078775,0.001129729,0.000811975,0.001164959,0.001611604,0.0009972474,0.002511999],"category_scores_gemma":[0.003767897,0.0005348527,0.001365414,0.0007422224,0.0007304306,0.001192603,0.001756643,0.001101101,0.000376293],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.00115111,"about_ca_system_score_gemma":0.001548698,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.006495817,"about_ca_topic_score_gemma":0.01043361,"domain_scores_codex":[0.999433,0.0001811783,0.00004322184,0.000174142,0.0001286926,0.00003974612],"domain_scores_gemma":[0.9985169,0.001064966,0.00009598035,0.0001184129,0.0001337466,0.00007001697],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","study_design_scores_codex":[0.0001905803,0.000151556,0.002235322,0.0002439976,0.0001319607,0.0005820043,0.0003798682,0.8855443,0.008770375,0.01740414,0.003420693,0.08094529],"study_design_scores_gemma":[0.00002434451,0.00001594366,0.00008953955,0.000007172443,0.00001686199,0.00002654934,0.00002960949,0.9887365,0.001542884,0.007838339,0.001664614,0.000007833801],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","genre_codex":"methods","genre_gemma":"empirical","genre_scores_codex":[0.03916074,0.0002294178,0.9535244,0.0006041034,0.00006092169,0.0002120297,0.0008464034,0.003889364,0.001472578],"genre_scores_gemma":[0.2833755,0.0001547637,0.7124833,0.0002833307,0.00002765348,0.00042729,0.001152223,0.000245617,0.001850192],"genre_candidate":"empirical","genre_consensus":null,"teacher_disagreement_score":0.006495817,"threshold_uncertainty_score":0.01291597,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.02660352993615315,"score_gpt":0.2584987157955012,"score_spread":0.2318951858593481,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}