{"id":"W4308885220","doi":"10.1061/jtepbs.teeng-6985","title":"An Approach for Detecting Data Anomalies at Permanent Cycling Count Stations","year":2022,"lang":"en","type":"article","venue":"Journal of Transportation Engineering Part A Systems","topic":"Traffic Prediction and Management Techniques","field":"Engineering","cited_by":2,"is_retracted":false,"has_abstract":true,"ca_institutions":"","funders":"","keywords":"Flagging; Outlier; Count data; Computer science; Data set; Data mining; Anomaly detection; Set (abstract data type); Cycling; Statistics; Geography; Artificial intelligence; Mathematics; Cartography","routes":{"ca_aff":false,"ca_fund":false,"ca_venue":false,"about_ca":true,"invisible_to_affiliation_only":true},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.001295648,0.0008744269,0.0007392157,0.003971621,0.0006984533,0.001310291,0.001405121,0.000941642,0.0004128129],"category_scores_gemma":[0.003684361,0.0003808925,0.0009840605,0.002502063,0.0003892248,0.001123551,0.001095212,0.0009868433,0.000292591],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.0007364485,"about_ca_system_score_gemma":0.00171945,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.01672713,"about_ca_topic_score_gemma":0.01818351,"domain_scores_codex":[0.9988129,0.0001205741,0.0001212786,0.0004088989,0.0004072873,0.0001289943],"domain_scores_gemma":[0.9982163,0.0005137516,0.0003123285,0.0001907402,0.0006900367,0.00007676088],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","study_design_scores_codex":[0.0003363144,0.000460096,0.0789426,0.0002598932,0.0002485369,0.0006875098,0.001044604,0.1437129,0.02934729,0.006251224,0.004130375,0.7345786],"study_design_scores_gemma":[0.00001851264,0.0001333553,0.01599389,0.0000287729,0.00007523924,0.0003111515,0.000370171,0.963932,0.009889008,0.003770891,0.00542267,0.00005430303],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"genre_codex":"methods","genre_gemma":"empirical","genre_scores_codex":[0.06052507,0.0001989913,0.9358568,0.0001992629,0.00006754608,0.0001758346,0.0005120088,0.001667307,0.0007972606],"genre_scores_gemma":[0.5347209,0.0001918482,0.4620478,0.0001002584,0.00006983465,0.0001903072,0.0012137,0.00007035492,0.001394952],"genre_candidate":"empirical","genre_consensus":null,"teacher_disagreement_score":0.01672713,"threshold_uncertainty_score":0.03325957,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.02696523991095251,"score_gpt":0.2409727155396921,"score_spread":0.2140074756287396,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}