{"id":"W4394419605","doi":"10.6084/m9.figshare.25067253","title":"Additional file 1 of Anchor Clustering for million-scale immune repertoire sequencing data","year":2024,"lang":"en","type":"dataset","venue":"Open MIND","topic":"Immune Cell Function and Interaction","field":"Immunology and Microbiology","cited_by":0,"is_retracted":false,"has_abstract":true,"ca_institutions":"University of Guelph","funders":"","keywords":"Repertoire; Cluster analysis; Scale (ratio); Computational biology; Computer science; Biology; Data mining; Geography; Artificial intelligence; Cartography","routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":["insufficient_payload"],"consensus_categories":[],"category_scores_codex":[0.002042468,0.001780008,0.001451045,0.002917905,0.0010478,0.002313738,0.002446771,0.0017167,0.3582129],"category_scores_gemma":[0.01193456,0.000695262,0.001309016,0.004252957,0.000506119,0.001261067,0.001554508,0.001962472,0.1387159],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.001179156,"about_ca_system_score_gemma":0.002226939,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.007525745,"about_ca_topic_score_gemma":0.02076482,"domain_scores_codex":[0.9989574,0.0001696434,0.0001200057,0.0004124892,0.0001871941,0.0001532191],"domain_scores_gemma":[0.9950179,0.003048646,0.0003166463,0.0006440583,0.0006891242,0.0002834647],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"not_applicable","study_design_gemma":"not_applicable","study_design_scores_codex":[0.0001654376,0.00006945355,0.002698876,0.001823795,0.00008575903,0.00004157125,0.000047841,0.0006763164,0.0003468549,0.0005717121,0.988965,0.004507399],"study_design_scores_gemma":[0.001060216,0.00009578187,0.01336814,0.000808658,0.0001822482,0.0002749962,0.0001644539,0.001569501,0.001206783,0.005435199,0.9757513,0.00008270572],"study_design_candidate":"not_applicable","study_design_consensus":"not_applicable","genre_codex":"dataset","genre_gemma":"dataset","genre_scores_codex":[0.0001036814,0.00002469633,0.0001309326,0.00001893911,0.000009808467,0.0000155164,0.9992672,0.0002129276,0.0002163823],"genre_scores_gemma":[0.000894475,0.00003493193,0.001016209,0.00006802717,0.000008511481,0.0002076227,0.9967957,0.0001980834,0.0007764592],"genre_candidate":"dataset","genre_consensus":"dataset","teacher_disagreement_score":0.3582129,"threshold_uncertainty_score":0.9154314,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.05142682818418753,"score_gpt":0.3000313451128491,"score_spread":0.2486045169286616,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}