{"id":"W4399371019","doi":"10.3138/jsp-2023-0079","title":"A Rapid Investigation of Artificial Intelligence Generated Content Footprints in Scholarly Publications","year":2024,"lang":"en","type":"article","venue":"Journal of Scholarly Publishing","topic":"Biomedical Text Mining and Ontologies","field":"Biochemistry, Genetics and Molecular Biology","cited_by":16,"is_retracted":false,"has_abstract":true,"ca_institutions":"University of Calgary","funders":"","keywords":"Content (measure theory); Computer science; Information retrieval; Data science; Artificial intelligence; Mathematics","routes":{"ca_aff":true,"ca_fund":false,"ca_venue":true,"about_ca":false,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":["metaresearch","research_integrity"],"consensus_categories":[],"category_scores_codex":[0.02144035,0.0003196988,0.0005110355,0.024948,0.001907129,0.008181472,0.0009391521,0.0008824542,0.00199173],"category_scores_gemma":[0.1384688,0.0003838309,0.0005006169,0.02558734,0.00270599,0.01004288,0.004872494,0.001291023,0.0006490131],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.001996504,"about_ca_system_score_gemma":0.002317155,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.001213338,"about_ca_topic_score_gemma":0.001731578,"domain_scores_codex":[0.9746055,0.006582176,0.003550609,0.002564059,0.01185087,0.0008466577],"domain_scores_gemma":[0.5973158,0.2540374,0.07597467,0.02185434,0.04734053,0.003477187],"domain_codex":null,"domain_gemma":"evaluation","domain_candidate":"evaluation","domain_consensus":null,"study_design_codex":"observational","study_design_gemma":"observational","study_design_scores_codex":[0.0004097401,0.0002219027,0.6074512,0.002433382,0.0002282128,0.002039021,0.1164279,0.0006043484,0.009650119,0.0233869,0.008249463,0.2288979],"study_design_scores_gemma":[0.00004283858,0.000276082,0.7691755,0.001767513,0.0002131817,0.003882864,0.09503992,0.005422775,0.008576312,0.0202312,0.09514975,0.0002220004],"study_design_candidate":"observational","study_design_consensus":"observational","genre_codex":"empirical","genre_gemma":"empirical","genre_scores_codex":[0.9570782,0.002725363,0.01434411,0.003351789,0.0002600067,0.0004532445,0.003181821,0.0005064715,0.01809894],"genre_scores_gemma":[0.9790471,0.0009311636,0.01516185,0.0003308929,0.0002156029,0.0002707647,0.00229361,0.000141308,0.001607657],"genre_candidate":"empirical","genre_consensus":"empirical","teacher_disagreement_score":0.9991176,"threshold_uncertainty_score":0.1133888,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.129285737070927,"score_gpt":0.3083854016389009,"score_spread":0.1790996645679739,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}