{"id":"W2006981561","doi":"10.1145/2351476.2351500","title":"Mining probabilistic datasets vertically","year":2012,"lang":"en","type":"article","venue":"","topic":"Data Mining Algorithms and Applications","field":"Computer Science","cited_by":19,"is_retracted":false,"has_abstract":true,"ca_institutions":"University of Manitoba","funders":"","keywords":"Computer science; Probabilistic logic; Data mining; Uncertain data; Set (abstract data type); Database transaction; Data set; Representation (politics); A priori and a posteriori; Artificial intelligence; Database","routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.002102529,0.0007529415,0.001089382,0.003046443,0.001076769,0.002912382,0.001795498,0.001226804,0.002261364],"category_scores_gemma":[0.01296042,0.001054763,0.002108203,0.006752178,0.0005152404,0.006254917,0.005523955,0.002145047,0.001091696],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.0005527968,"about_ca_system_score_gemma":0.001512429,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.002028807,"about_ca_topic_score_gemma":0.003099006,"domain_scores_codex":[0.9949253,0.0007566353,0.000648378,0.001356673,0.00199666,0.0003162945],"domain_scores_gemma":[0.9944146,0.001895535,0.0006479494,0.001517534,0.001386071,0.0001382109],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"design_other","study_design_gemma":"theoretical_or_conceptual","study_design_scores_codex":[0.0006803804,0.0003988441,0.04606729,0.000898492,0.000880191,0.002322011,0.001188745,0.1009588,0.03359787,0.1236276,0.02454182,0.664838],"study_design_scores_gemma":[0.00009463283,0.0002290708,0.01219743,0.000218608,0.0002645162,0.002167405,0.000989689,0.7037783,0.02056602,0.2018274,0.05756275,0.0001042512],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"genre_codex":"methods","genre_gemma":"methods","genre_scores_codex":[0.0390772,0.0004611075,0.9473745,0.001128704,0.0001234306,0.0003034062,0.006475172,0.00120536,0.00385104],"genre_scores_gemma":[0.2292772,0.0008446868,0.7468582,0.0006316007,0.0001972449,0.0005407669,0.01939754,0.0001908832,0.002061862],"genre_candidate":"methods","genre_consensus":"methods","teacher_disagreement_score":0.003046443,"threshold_uncertainty_score":0.01111937,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.02797830933118894,"score_gpt":0.2764063718074993,"score_spread":0.2484280624763104,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}