{"id":"W6891691587","doi":"10.48448/gyd1-w707","title":"Controllable Dialogue Simulation with In-context Learning","year":2022,"lang":"en","type":"other","venue":"Underline Science Inc.","topic":"","field":"","cited_by":0,"is_retracted":false,"has_abstract":true,"ca_institutions":"University of Waterloo","funders":"","keywords":"Fluency; Annotation; Set (abstract data type); Training set; Code (set theory); Language model","routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.002297894,0.001998166,0.000958373,0.0006547538,0.000743214,0.001410732,0.00309458,0.001389952,0.005562738],"category_scores_gemma":[0.01087244,0.0007619674,0.001290068,0.0003359878,0.001096594,0.002546081,0.003767602,0.002415919,0.002626609],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.0009601374,"about_ca_system_score_gemma":0.001380294,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.003701269,"about_ca_topic_score_gemma":0.006549499,"domain_scores_codex":[0.9967945,0.001776381,0.0001107473,0.0009313576,0.0002432026,0.0001437539],"domain_scores_gemma":[0.9964031,0.002285743,0.0001293054,0.0006715763,0.0002748338,0.0002353499],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","study_design_scores_codex":[0.001518727,0.001138787,0.006922197,0.001133377,0.0002945589,0.00066687,0.00232458,0.5682658,0.04905789,0.01603079,0.02294368,0.3297027],"study_design_scores_gemma":[0.00007538973,0.0001051511,0.0003249228,0.00002774335,0.00001974904,0.00006862167,0.0001353125,0.9749917,0.009149908,0.008404559,0.00666609,0.00003086665],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","genre_codex":"methods","genre_gemma":"empirical","genre_scores_codex":[0.04875026,0.0005458815,0.9176469,0.0004186395,0.0001963639,0.0004605722,0.001106483,0.02528965,0.005585241],"genre_scores_gemma":[0.5696737,0.0001811585,0.418295,0.0005344218,0.00007437722,0.001460713,0.003339385,0.00127881,0.005162381],"genre_candidate":"empirical","genre_consensus":null,"teacher_disagreement_score":0.005562738,"threshold_uncertainty_score":0.01860929,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.0168143610667692,"score_gpt":0.2777211271516795,"score_spread":0.2609067660849103,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}