{"id":"W2950099317","doi":"10.48550/arxiv.1811.01850","title":"End-to-End Sound Source Separation Conditioned On Instrument Labels","year":2018,"lang":"en","type":"preprint","venue":"RECERCAT (Consorci de Serveis Universitaris de Catalunya)","topic":"Speech and Audio Processing","field":"Computer Science","cited_by":0,"is_retracted":false,"has_abstract":true,"ca_institutions":"University of Waterloo","funders":"","keywords":"Monaural; Source separation; Bottleneck; Separation (statistics); Computer science; End-to-end principle; Acoustics; Speech recognition; Artificial intelligence; Physics; Machine learning","routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"codex-gemma-dda1882f352a","candidate_categories":["metaepi_narrow"],"consensus_categories":[],"category_scores_codex":[0.0007674277,0.0006551029,0.0005939181,0.000940433,0.0006729889,0.0007933959,0.002380288,0.0006670558,0.0003764686],"category_scores_gemma":[0.0001230891,0.0007782456,0.0002802368,0.0009146028,0.0002118154,0.0008146271,0.001860567,0.0009706118,0.0007591387],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.002544413,"about_ca_system_score_gemma":0.001542013,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.0006144681,"about_ca_topic_score_gemma":0.0002592207,"domain_scores_codex":[0.9960562,0.0002937424,0.0004888739,0.001500744,0.0006867812,0.0009736454],"domain_scores_gemma":[0.9967054,0.0002003942,0.0004645756,0.001589588,0.0004003969,0.0006396549],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"design_other","study_design_gemma":"bench_or_experimental","study_design_scores_codex":[0.002271966,0.004039783,0.05891757,0.004039107,0.005781282,0.002134227,0.07557745,0.1161131,0.04028953,0.04048515,0.263827,0.3865238],"study_design_scores_gemma":[0.006398326,0.002373262,0.02138815,0.003072749,0.0009437072,0.0006193992,0.002746806,0.02993468,0.6660582,0.06092209,0.1978592,0.007683469],"study_design_candidate":"bench_or_experimental","study_design_consensus":null,"genre_codex":"empirical","genre_gemma":"empirical","genre_scores_codex":[0.7647333,0.0002182345,0.2190167,0.004944755,0.0008558576,0.0007522617,0.0001822376,0.0006323805,0.008664311],"genre_scores_gemma":[0.9606118,0.00009195397,0.03345525,0.002151733,0.0003614873,0.00003175172,0.0005096676,0.00006668591,0.002719721],"genre_candidate":"empirical","genre_consensus":"empirical","teacher_disagreement_score":0.6257687,"threshold_uncertainty_score":0.9994668,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.02730211874635281,"score_gpt":0.2735831491650603,"score_spread":0.2462810304187075,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}