{"id":"W6948012755","doi":"10.48448/a4hj-gx54","title":"LM-CPPF: Paraphrasing-Guided Data Augmentation for Contrastive Prompt-Based Few-Shot Fine-Tuning","year":2022,"lang":"en","type":"other","venue":"Underline Science Inc.","topic":"","field":"","cited_by":0,"is_retracted":false,"has_abstract":true,"ca_institutions":"University of British Columbia","funders":"","keywords":"Generative grammar; Language model; Contrastive analysis; Language acquisition; Natural language; Generative model; Training set","routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"codex-gemma-dda1882f352a","candidate_categories":["metaepi_narrow","insufficient_payload"],"consensus_categories":[],"category_scores_codex":[0.003774005,0.0007641796,0.0007654027,0.001925852,0.001030783,0.0004326425,0.003573166,0.0002134018,0.005179056],"category_scores_gemma":[0.001617173,0.0007514131,0.000115608,0.002516507,0.001724982,0.0006909664,0.0008054145,0.0005247508,0.0003839358],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.001067827,"about_ca_system_score_gemma":0.002843196,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.000557704,"about_ca_topic_score_gemma":0.001551128,"domain_scores_codex":[0.9932941,0.0002465163,0.0007732678,0.002384848,0.002072123,0.001229112],"domain_scores_gemma":[0.9953978,0.0005614931,0.001244905,0.002164735,0.0003102845,0.0003207616],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"not_applicable","study_design_gemma":"not_applicable","study_design_scores_codex":[0.0002728352,0.0004044405,0.0006507886,0.0002294187,0.00017101,0.00002998911,0.0002486032,0.001988953,0.01790304,0.001179627,0.9713266,0.00559468],"study_design_scores_gemma":[0.007325449,0.0007924141,0.0001638,0.0005186407,0.0005578544,0.00002750984,0.0008617614,0.4708056,0.002497978,0.0003743313,0.5140433,0.0020314],"study_design_candidate":"not_applicable","study_design_consensus":"not_applicable","genre_codex":"other","genre_gemma":"methods","genre_scores_codex":[0.005121795,0.003435336,0.3103294,0.004969513,0.01237774,0.04539416,0.1037682,0.01064134,0.5039625],"genre_scores_gemma":[0.1417389,0.000049558,0.3599898,0.004149481,0.00464323,0.004481332,0.1591667,0.009924117,0.3158569],"genre_candidate":"other","genre_consensus":null,"teacher_disagreement_score":0.4688167,"threshold_uncertainty_score":0.9994937,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.1788397733972532,"score_gpt":0.4059518617108703,"score_spread":0.2271120883136171,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}