{"id":"W4410187366","doi":"10.63278/1425","title":"Generative AI-Powered Framework for Audio Analysis and Conversational Exploration","year":2025,"lang":"en","type":"article","venue":"Metallurgical and Materials Engineering","topic":"Music and Audio Processing","field":"Computer Science","cited_by":0,"is_retracted":false,"has_abstract":true,"ca_institutions":"Artificial Intelligence in Medicine (Canada)","funders":"","keywords":"Generative grammar; Materials science; Audio visual; Speech recognition; Computer science; Human–computer interaction; Artificial intelligence; Multimedia","routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"codex-gemma-dda1882f352a","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0001674056,0.00008710974,0.0002065217,0.00009456874,0.00008451389,0.0003489098,0.00007502297,0.00005255523,0.00002319536],"category_scores_gemma":[0.0000522041,0.00007907346,0.00003181219,0.000234298,0.00001714407,0.0003116419,0.00007238715,0.00003320844,5.925203e-7],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.000007772629,"about_ca_system_score_gemma":0.00001246483,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.000003946642,"about_ca_topic_score_gemma":7.791394e-7,"domain_scores_codex":[0.9994339,0.00001405036,0.0001538596,0.0002246558,0.00006333917,0.000110202],"domain_scores_gemma":[0.9997379,0.0000789946,0.00003300762,0.00007660257,0.00003570734,0.00003775938],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"simulation_or_modeling","study_design_scores_codex":[0.0000165381,0.00002066191,0.00001420734,0.0001755243,0.0004628909,0.000003599263,0.0004284244,0.004256187,0.04464583,0.9448726,0.0000703253,0.005033247],"study_design_scores_gemma":[0.0009268872,0.00006014456,0.003112572,0.0001342832,0.0004330004,0.000006809024,0.00003099858,0.7810075,0.1056864,0.09817117,0.009880116,0.0005500996],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"genre_codex":"methods","genre_gemma":"empirical","genre_scores_codex":[0.02852738,0.0001769648,0.9693252,0.001570726,0.0002305378,0.00008932394,0.000004235871,0.00005499606,0.00002067016],"genre_scores_gemma":[0.7851229,0.00003555766,0.21426,0.0003906118,0.00005803569,0.00004125429,0.00001014933,0.000003056579,0.00007839953],"genre_candidate":"methods","genre_consensus":null,"teacher_disagreement_score":0.8467014,"threshold_uncertainty_score":0.3364545,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.01359838011086381,"score_gpt":0.2508334981129763,"score_spread":0.2372351180021125,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}