{"id":"W2571153042","doi":"10.1109/besc.2016.7804474","title":"Activity-based sampling of Twitter users for temporal prediction models","year":2016,"lang":"en","type":"article","venue":"","topic":"Complex Network Analysis Techniques","field":"Physics and Astronomy","cited_by":0,"is_retracted":false,"has_abstract":true,"ca_institutions":"Ontario Tech University","funders":"","keywords":"Computer science; Timeline; Sampling (signal processing); Predictability; Social media; Experience sampling method; Focus (optics); Data mining; Sample (material); Data modeling; Data science; Machine learning; World Wide Web; Statistics; Database","routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.002198108,0.0006722817,0.0005821835,0.0008151155,0.0004335187,0.0006417918,0.00120745,0.0006724204,0.001425661],"category_scores_gemma":[0.01151892,0.0003555301,0.0006406826,0.0008052978,0.0004391686,0.001424807,0.0005737238,0.0008856821,0.0003538847],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.0007024977,"about_ca_system_score_gemma":0.0005475557,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.01031536,"about_ca_topic_score_gemma":0.0114935,"domain_scores_codex":[0.9993321,0.0003329817,0.00003874529,0.0001361681,0.0001061649,0.00005388832],"domain_scores_gemma":[0.9958311,0.003006334,0.0003764271,0.0003717309,0.0002901112,0.0001243437],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","study_design_scores_codex":[0.0003226179,0.0001720265,0.02030214,0.00009157016,0.00009953801,0.0001505363,0.0002457842,0.9102774,0.002936278,0.0152694,0.001480055,0.04865257],"study_design_scores_gemma":[0.000002410848,0.000007773896,0.0004284476,0.000002992337,0.000003902498,0.000007532627,0.00001147912,0.9975539,0.0002387486,0.00158889,0.000151069,0.0000028046],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","genre_codex":"methods","genre_gemma":"empirical","genre_scores_codex":[0.1510611,0.0002107412,0.8457775,0.0003048255,0.00005753499,0.0001476665,0.000596061,0.000424879,0.001419732],"genre_scores_gemma":[0.9212251,0.0002599295,0.07516432,0.00007262111,0.0001025713,0.0002562594,0.001240217,0.00004997429,0.001629098],"genre_candidate":"empirical","genre_consensus":null,"teacher_disagreement_score":0.01031536,"threshold_uncertainty_score":0.02051061,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.06308703675090531,"score_gpt":0.3042007388990658,"score_spread":0.2411137021481605,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}