{"id":"W7039174724","doi":"","title":"Linguistic Markers of AI-Generated Text: A Comparative Analysis of Machine-Identified and Human-Inferred Predictors","year":2025,"lang":"en","type":"article","venue":"Journal of the Association for Information Systems","topic":"Insect behavior and control techniques","field":"Agricultural and Biological Sciences","cited_by":0,"is_retracted":false,"has_abstract":true,"ca_institutions":"","funders":"","keywords":"Perplexity; Lexical diversity; Lexical choice; Quality (philosophy); Computational linguistics; Word lists by frequency; Generative grammar; Ask price; Diversity (politics)","routes":{"ca_aff":false,"ca_fund":false,"ca_venue":false,"about_ca":true,"invisible_to_affiliation_only":true},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.005909839,0.0003874305,0.00037238,0.006726849,0.0004355847,0.002703996,0.0004831257,0.0005805372,0.001461084],"category_scores_gemma":[0.07080422,0.0001506484,0.0003974786,0.003720703,0.001015893,0.002456436,0.0008998588,0.0007150447,0.0009874527],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.0004985611,"about_ca_system_score_gemma":0.0005841985,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.0008855846,"about_ca_topic_score_gemma":0.0009066309,"domain_scores_codex":[0.9940352,0.003145792,0.0005243497,0.0007371658,0.001403792,0.0001535225],"domain_scores_gemma":[0.8020313,0.1642202,0.01830609,0.003513752,0.0102252,0.001703419],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"observational","study_design_gemma":"observational","study_design_scores_codex":[0.0009624825,0.0002178753,0.7834132,0.00177305,0.0003405423,0.001022916,0.009332363,0.003382454,0.008693925,0.001405583,0.003412779,0.1860428],"study_design_scores_gemma":[0.0000469006,0.0004532743,0.8961222,0.0005045224,0.0002205325,0.001612721,0.005955711,0.07148093,0.008384652,0.003643442,0.01141404,0.0001611384],"study_design_candidate":"observational","study_design_consensus":"observational","genre_codex":"empirical","genre_gemma":"empirical","genre_scores_codex":[0.9737929,0.002645623,0.01673712,0.0006123749,0.00007163663,0.00009156175,0.001895032,0.000440777,0.003713057],"genre_scores_gemma":[0.9926801,0.0004948464,0.004471578,0.00005625124,0.00008061076,0.00005898515,0.00157569,0.00005400176,0.0005279897],"genre_candidate":"empirical","genre_consensus":"empirical","teacher_disagreement_score":0.006726849,"threshold_uncertainty_score":0.03125465,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.0148876258615229,"score_gpt":0.2786338573205616,"score_spread":0.2637462314590387,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}