{"id":"W7130717810","doi":"10.1109/swc65939.2025.00265","title":"A Novel Naive Bayes Classifier for Detecting AI-Generated Text in Digital Twin Systems Using Word Pair Probabilities","year":2025,"lang":"","type":"article","venue":"","topic":"Digital Transformation in Industry","field":"Engineering","cited_by":0,"is_retracted":false,"has_abstract":true,"ca_institutions":"University of Northern British Columbia","funders":"","keywords":"Naive Bayes classifier; Classifier (UML); Binary classification; Scalability; Word (group theory); Bayes classifier; Bayes' theorem; Bayesian probability","routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.004306994,0.001205842,0.001340513,0.004329216,0.001374904,0.002705619,0.002098227,0.002322558,0.002811017],"category_scores_gemma":[0.0218806,0.0003840086,0.0008266998,0.002007043,0.0008540415,0.003511119,0.001292437,0.00185229,0.003068706],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.001196817,"about_ca_system_score_gemma":0.002396566,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.00596021,"about_ca_topic_score_gemma":0.005074788,"domain_scores_codex":[0.9945433,0.000991698,0.0006675993,0.001372081,0.002091063,0.0003342072],"domain_scores_gemma":[0.9880245,0.007454355,0.0008512296,0.0005450483,0.002840768,0.0002840171],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"design_other","study_design_gemma":"not_applicable","study_design_scores_codex":[0.0007963671,0.0004136921,0.02826542,0.0004717518,0.0001271441,0.0007275557,0.0006906843,0.03286266,0.0216025,0.01082269,0.02150462,0.8817151],"study_design_scores_gemma":[0.00006633426,0.0001412667,0.003006234,0.0001183336,0.00007573241,0.0005669789,0.0002624867,0.9590344,0.01393242,0.01482038,0.007912105,0.00006334962],"study_design_candidate":"not_applicable","study_design_consensus":null,"genre_codex":"methods","genre_gemma":"empirical","genre_scores_codex":[0.07259979,0.0009264238,0.9149778,0.0008582784,0.0004678606,0.0005715045,0.001375364,0.003856307,0.004366698],"genre_scores_gemma":[0.4711317,0.000407267,0.5156419,0.0006876646,0.0004677667,0.0007042793,0.004191139,0.0002835839,0.006484742],"genre_candidate":"empirical","genre_consensus":null,"teacher_disagreement_score":0.00596021,"threshold_uncertainty_score":0.0227778,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.04026082602279392,"score_gpt":0.2561426212344654,"score_spread":0.2158817952116714,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}