{"id":"W4401104224","doi":"10.48550/arxiv.2402.18551","title":"Implicit Optimization Bias of Next-Token Prediction in Linear Models","year":2024,"lang":"en","type":"preprint","venue":"arXiv (Cornell University)","topic":"Intelligent Tutoring Systems and Adaptive Learning","field":"Computer Science","cited_by":1,"is_retracted":false,"has_abstract":true,"ca_institutions":"","funders":"Natural Sciences and Engineering Research Council of Canada; Canadian Institute for Advanced Research","keywords":"Security token; Computer science; Psychology; Computer security","routes":{"ca_aff":false,"ca_fund":true,"ca_venue":false,"about_ca":false,"invisible_to_affiliation_only":true},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.006017523,0.0007900639,0.001514144,0.0005128451,0.000473258,0.001493741,0.001777644,0.001407744,0.001958756],"category_scores_gemma":[0.03045012,0.0006223037,0.0006479303,0.0005784368,0.002240741,0.003868612,0.002281701,0.002991782,0.000406996],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.001420968,"about_ca_system_score_gemma":0.001200578,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.001994092,"about_ca_topic_score_gemma":0.002496211,"domain_scores_codex":[0.9975286,0.001357921,0.00009946045,0.0005343781,0.0002864397,0.0001932535],"domain_scores_gemma":[0.9853585,0.01213778,0.0007887668,0.0009740593,0.0005008426,0.0002400987],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","study_design_scores_codex":[0.0004095566,0.0001245515,0.008063437,0.000222722,0.0001382998,0.000181731,0.0003349601,0.8196588,0.003677716,0.1132605,0.001886152,0.05204173],"study_design_scores_gemma":[0.00001003382,0.00002969087,0.0003841807,0.00001306481,0.000006126092,0.00001899152,0.00001199403,0.9495363,0.0007483317,0.04907141,0.0001603557,0.000009531393],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","genre_codex":"methods","genre_gemma":"empirical","genre_scores_codex":[0.1584038,0.0004847699,0.8363681,0.001840447,0.00005190364,0.00004660632,0.0001509498,0.0004790198,0.002174359],"genre_scores_gemma":[0.9159322,0.0002746797,0.08005759,0.0004283696,0.0001053584,0.0001371156,0.000260056,0.0002635954,0.002541033],"genre_candidate":"empirical","genre_consensus":null,"teacher_disagreement_score":0.006017523,"threshold_uncertainty_score":0.03182405,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.1304284785535108,"score_gpt":0.2063121845599387,"score_spread":0.07588370600642794,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}