{"id":"W4406361493","doi":"10.1101/2025.01.13.632824","title":"Repertoire-level generation of T-cell epitopes with a large-scale generative transformer","year":2025,"lang":"en","type":"preprint","venue":"bioRxiv (Cold Spring Harbor Laboratory)","topic":"vaccines and immunoinformatics approaches","field":"Biochemistry, Genetics and Molecular Biology","cited_by":2,"is_retracted":false,"has_abstract":true,"ca_institutions":"University of British Columbia","funders":"","keywords":"Epitope; T-cell receptor; Computational biology; Biology; CD8; T cell; Antigen; Genetics; Immune system","routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0003856621,0.0003758359,0.0005282908,0.0003451385,0.0002196845,0.0004778074,0.0014125,0.000677039,0.002120538],"category_scores_gemma":[0.001120942,0.0003974277,0.000941085,0.000287406,0.000504466,0.000760171,0.0008727908,0.0008727803,0.0004512908],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.0006701924,"about_ca_system_score_gemma":0.0006393779,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.001891237,"about_ca_topic_score_gemma":0.00259732,"domain_scores_codex":[0.9998906,0.00002416386,0.000004054699,0.00002706129,0.00003117615,0.00002292139],"domain_scores_gemma":[0.9996674,0.0001856106,0.00002784542,0.00004707327,0.00003789243,0.0000341514],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","study_design_scores_codex":[0.00012162,0.00005573571,0.001964617,0.00004219488,0.00003298187,0.0001152692,0.00004960391,0.9508719,0.01118809,0.009801298,0.0008939,0.02486276],"study_design_scores_gemma":[0.000005307995,0.000007650221,0.00004322695,8.448266e-7,0.000002829408,0.0000146656,0.000002212318,0.9970472,0.000829711,0.001929961,0.000114794,0.0000017007],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","genre_codex":"methods","genre_gemma":"empirical","genre_scores_codex":[0.1920089,0.0001192547,0.8021284,0.0002230743,0.00002747816,0.00008556282,0.0003294033,0.001506971,0.003570949],"genre_scores_gemma":[0.8997024,0.00008794157,0.09639893,0.0001983354,0.0000181875,0.000171982,0.0005679635,0.0001777002,0.002676363],"genre_candidate":"empirical","genre_consensus":null,"teacher_disagreement_score":0.002120538,"threshold_uncertainty_score":0.007093847,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.01764176149687263,"score_gpt":0.2133503253281071,"score_spread":0.1957085638312345,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}