{"id":"W2214033462","doi":"10.1007/978-3-642-30353-1_20","title":"Analysis of Important Factors for Measuring Similarity of Symbolic Music Using n-gram-Based, Bag-of-Words Approach","year":2012,"lang":"en","type":"book-chapter","venue":"Lecture notes in computer science","topic":"Music and Audio Processing","field":"Computer Science","cited_by":3,"is_retracted":false,"has_abstract":false,"ca_institutions":"Dalhousie University","funders":"","keywords":"Weighting; n-gram; Computer science; Similarity (geometry); Similarity measure; Measure (data warehouse); Gram; Artificial intelligence; Music information retrieval; Term (time); Feature (linguistics); Pattern recognition (psychology); Feature extraction; Data mining; Image (mathematics); Language model","routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"codex-gemma-dda1882f352a","candidate_categories":["metaepi_narrow"],"consensus_categories":[],"category_scores_codex":[0.001690835,0.0004952573,0.001385134,0.001882984,0.0001638896,0.0001001994,0.002347382,0.0003113495,0.000009097474],"category_scores_gemma":[0.0001457964,0.0004287611,0.0005339438,0.002068589,0.0007751255,0.0004390677,0.0006092241,0.0003869179,9.313077e-8],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.0001478718,"about_ca_system_score_gemma":0.000787747,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.00008020057,"about_ca_topic_score_gemma":0.00003141274,"domain_scores_codex":[0.9959874,0.00003838028,0.001144114,0.00106781,0.001147013,0.0006153497],"domain_scores_gemma":[0.9960635,0.0005732678,0.001472101,0.001238471,0.0005017741,0.0001508553],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","study_design_scores_codex":[0.00002626185,0.0003146965,0.01769349,0.001726723,0.0005153643,0.000005267174,0.006082562,0.6318411,0.005320205,0.00803915,0.000001888539,0.3284333],"study_design_scores_gemma":[0.0002025516,0.00007185252,0.0009882614,0.0003993362,0.0003208532,0.000002962561,0.000001056867,0.9733135,0.0193809,0.004832468,0.00002199719,0.000464244],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","genre_codex":"methods","genre_gemma":"empirical","genre_scores_codex":[0.01356244,0.0008193728,0.9845645,0.00002164054,0.0004547366,0.0003506352,0.00002654406,0.00003542873,0.0001646594],"genre_scores_gemma":[0.6368237,0.000005012649,0.36297,0.00009335644,0.00007825499,0.000002443213,0.000006915845,0.00001699257,0.000003259322],"genre_candidate":"methods","genre_consensus":null,"teacher_disagreement_score":0.6232613,"threshold_uncertainty_score":0.9998164,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.07157737518831658,"score_gpt":0.2709314573491997,"score_spread":0.1993540821608831,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}