{"id":"W2035395173","doi":"10.1145/1774088.1774428","title":"e-mail authorship verification for forensic investigation","year":2010,"lang":"en","type":"article","venue":"","topic":"Authorship Attribution and Profiling","field":"Computer Science","cited_by":65,"is_retracted":false,"has_abstract":true,"ca_institutions":"Concordia University","funders":"","keywords":"Computer science; Suspect; Phishing; Spamming; NIST; Matching (statistics); Context (archaeology); The Internet; Plagiarism detection; Sample (material); Computer security; Data mining; Information retrieval; World Wide Web; Natural language processing; Statistics","routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":["research_integrity"],"consensus_categories":[],"category_scores_codex":[0.00442196,0.0005827644,0.000802446,0.003400527,0.000805009,0.001883062,0.001042887,0.001565357,0.002649853],"category_scores_gemma":[0.02214236,0.0002248301,0.0004106894,0.001463046,0.0006515865,0.002548552,0.001315224,0.0008934839,0.002412226],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.0005144682,"about_ca_system_score_gemma":0.001058756,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.000311104,"about_ca_topic_score_gemma":0.0005394816,"domain_scores_codex":[0.9951984,0.002795489,0.0002524371,0.0004509053,0.00113517,0.0001676227],"domain_scores_gemma":[0.9813387,0.007789937,0.0026749,0.004458705,0.003267242,0.0004704968],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","study_design_scores_codex":[0.0004782413,0.0004402598,0.01670294,0.0002792333,0.00006539181,0.0002608297,0.0002712753,0.0126973,0.03371095,0.01352623,0.006322636,0.9152448],"study_design_scores_gemma":[0.00007012601,0.0005068544,0.02700053,0.0002940086,0.0001459792,0.003336979,0.001002023,0.7586728,0.1403062,0.04390131,0.0246408,0.0001222739],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"genre_codex":"methods","genre_gemma":"empirical","genre_scores_codex":[0.1592423,0.001960182,0.8250788,0.001230604,0.0001848594,0.0003129296,0.0005731552,0.004161901,0.00725517],"genre_scores_gemma":[0.7575407,0.000628142,0.2389315,0.00007873555,0.0001235732,0.0001003664,0.0005887616,0.00005971747,0.001948535],"genre_candidate":"empirical","genre_consensus":null,"teacher_disagreement_score":0.9984347,"threshold_uncertainty_score":0.02338588,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.04174213818809263,"score_gpt":0.2857227118872353,"score_spread":0.2439805736991427,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}