{"id":"W4398231281","doi":"10.1103/physreve.109.054313","title":"Robustness of the random language model","year":2024,"lang":"en","type":"article","venue":"Physical review. E","topic":"Natural Language Processing Techniques","field":"Computer Science","cited_by":0,"is_retracted":false,"has_abstract":true,"ca_institutions":"Toronto Metropolitan University","funders":"Natural Sciences and Engineering Research Council of Canada","keywords":"Robustness (evolution); Computer science; Natural language processing; Chemistry","routes":{"ca_aff":true,"ca_fund":true,"ca_venue":false,"about_ca":false,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"codex-gemma-dda1882f352a","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0001925886,0.0000873794,0.0001994342,0.00001771453,0.00002551413,0.00004432505,0.0009213055,0.00001505041,0.000002437525],"category_scores_gemma":[0.0001141247,0.00004589439,0.000164339,0.0004484006,0.00003797084,0.0002086456,0.0002679953,0.0001682327,0.000006354106],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.00001401146,"about_ca_system_score_gemma":0.00004830262,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.000003416251,"about_ca_topic_score_gemma":4.096606e-7,"domain_scores_codex":[0.9992859,0.00005040067,0.0001299013,0.0001921224,0.0002312954,0.0001103846],"domain_scores_gemma":[0.9993287,0.00009051509,0.00004172261,0.0004773242,0.00003698778,0.00002475914],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"simulation_or_modeling","study_design_scores_codex":[0.000005072967,0.0001192967,0.000002885623,0.005572954,0.00003350606,0.00001400007,0.001066288,0.001105298,0.03508804,0.574396,0.01435162,0.368245],"study_design_scores_gemma":[0.00005382382,0.000007165446,0.000001271994,0.002130807,0.00002337941,0.000004600083,0.000001054908,0.9280617,0.02910614,0.04010483,0.0004149216,0.00009037246],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"genre_codex":"methods","genre_gemma":"empirical","genre_scores_codex":[0.002628535,0.1342457,0.8597139,0.002153463,0.0001379524,0.0002339661,0.000002389594,0.000335714,0.0005484277],"genre_scores_gemma":[0.9323947,0.0009680922,0.06566337,0.000583033,0.000133182,0.0000333587,7.975812e-7,0.00001197461,0.0002114413],"genre_candidate":"empirical","genre_consensus":null,"teacher_disagreement_score":0.9297662,"threshold_uncertainty_score":0.1871519,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.01280901743020402,"score_gpt":0.3342693704923282,"score_spread":0.3214603530621242,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}