{"id":"W2765471337","doi":"10.5555/3107979.3107989","title":"Generating stochastic data to simulate a twitter user","year":2017,"lang":"en","type":"article","venue":"Communications and Networking Symposium","topic":"Data Management and Algorithms","field":"Computer Science","cited_by":0,"is_retracted":false,"has_abstract":true,"ca_institutions":"Toronto Metropolitan University","funders":"","keywords":"Computer science; Recommender system; Collaborative filtering; Similarity (geometry); Weibull distribution; Information retrieval; Cluster analysis; tf–idf; Data mining; Term (time); Machine learning; Artificial intelligence; Mathematics; Statistics","routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.001910276,0.0006224699,0.0005155464,0.0007323062,0.0005574416,0.000664479,0.001097474,0.001440116,0.002789725],"category_scores_gemma":[0.009983594,0.0003126257,0.0007382942,0.000946759,0.0005715447,0.0007733587,0.0007653685,0.001389319,0.0004213883],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.00105657,"about_ca_system_score_gemma":0.0007829805,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.0160277,"about_ca_topic_score_gemma":0.01241649,"domain_scores_codex":[0.9991259,0.0003810414,0.00006607686,0.0001395713,0.0001765733,0.000110768],"domain_scores_gemma":[0.9902388,0.007018991,0.0004374837,0.0007587411,0.001304936,0.000241002],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","study_design_scores_codex":[0.0003415977,0.0003321161,0.02026277,0.00009924803,0.00007665301,0.0002399853,0.0003212832,0.9528858,0.001953346,0.01457954,0.001931669,0.006976043],"study_design_scores_gemma":[0.00002835162,0.00006819022,0.001213985,0.000006312746,0.000009961508,0.00001847713,0.00006107927,0.9955779,0.0007402533,0.001712335,0.0005516558,0.00001153329],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","genre_codex":"empirical","genre_gemma":"empirical","genre_scores_codex":[0.9053534,0.0001159759,0.08472747,0.0006894008,0.0001518372,0.0004539775,0.003422683,0.0004728792,0.004612311],"genre_scores_gemma":[0.9631393,0.00009179388,0.03215152,0.000119253,0.00002553959,0.0004750963,0.002094927,0.00003584465,0.001866809],"genre_candidate":"empirical","genre_consensus":"empirical","teacher_disagreement_score":0.0160277,"threshold_uncertainty_score":0.03186882,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.1287545541099956,"score_gpt":0.3418526201569586,"score_spread":0.2130980660469629,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}