{"id":"W568873395","doi":"","title":"Measures and adjustments of pattern frequency distributions","year":2010,"lang":"en","type":"dissertation","venue":"Spectrum Research Repository (Concordia University)","topic":"Data Mining Algorithms and Applications","field":"Computer Science","cited_by":0,"is_retracted":false,"has_abstract":true,"ca_institutions":"Concordia University","funders":"","keywords":"Overfitting; Set (abstract data type); Data mining; Computer science; Anomaly (physics); Measure (data warehouse); Raw data; Mode (computer interface); Anomaly detection; Artificial intelligence; Algorithm","routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.008716228,0.0006349355,0.000566809,0.002370508,0.0005904498,0.002745526,0.001788221,0.0009947063,0.002552779],"category_scores_gemma":[0.07037065,0.0005493679,0.0007839212,0.0021191,0.002108539,0.004878245,0.002018957,0.001768855,0.0006270506],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.001440417,"about_ca_system_score_gemma":0.0009530717,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.000936496,"about_ca_topic_score_gemma":0.0007508901,"domain_scores_codex":[0.9931629,0.002490403,0.0005204401,0.0015368,0.002040413,0.0002490388],"domain_scores_gemma":[0.9747877,0.01508195,0.003073081,0.004148508,0.002605039,0.0003036229],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"simulation_or_modeling","study_design_scores_codex":[0.0002039808,0.0001354017,0.02236555,0.0003414114,0.0001174119,0.0002303424,0.001734037,0.0773329,0.01336202,0.4561067,0.002166559,0.4259037],"study_design_scores_gemma":[0.00004932186,0.0003037156,0.0217279,0.0001939212,0.000067776,0.0008480265,0.001028787,0.4694262,0.01412323,0.4767196,0.0153685,0.0001428539],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"genre_codex":"methods","genre_gemma":"methods","genre_scores_codex":[0.04196223,0.0002465978,0.9521196,0.0004486696,0.00003805589,0.0001621241,0.0001764742,0.000363587,0.004482669],"genre_scores_gemma":[0.5653235,0.0003937986,0.4307517,0.0001798483,0.00008608355,0.0004663447,0.0003340392,0.0001461939,0.002318576],"genre_candidate":"methods","genre_consensus":"methods","teacher_disagreement_score":0.008716228,"threshold_uncertainty_score":0.04609638,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.02604712893116505,"score_gpt":0.2819933123888944,"score_spread":0.2559461834577293,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}