{"id":"W6912902715","doi":"10.5281/zenodo.7749794","title":"On Codex Prompt Engineering for OCL Generation: An Empirical Study","year":2023,"lang":"en","type":"article","venue":"PolyPublie (École Polytechnique de Montréal)","topic":"Organic Light-Emitting Diodes Research","field":"Engineering","cited_by":0,"is_retracted":false,"has_abstract":true,"ca_institutions":"Polytechnique Montréal","funders":"","keywords":"Empirical research; Natural (archaeology); Natural language; Directory; Unified Modeling Language; Data modeling","routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.01360973,0.001619028,0.0005970178,0.003715926,0.00155485,0.00383376,0.002792418,0.002153777,0.0117201],"category_scores_gemma":[0.1715692,0.0007936558,0.001043333,0.005125569,0.001385715,0.006699156,0.003097918,0.003261088,0.009025604],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.00305234,"about_ca_system_score_gemma":0.002106192,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.0242692,"about_ca_topic_score_gemma":0.02091516,"domain_scores_codex":[0.9813623,0.008845679,0.001597072,0.003049625,0.004611745,0.000533395],"domain_scores_gemma":[0.7707635,0.1701089,0.009133989,0.02449632,0.02330794,0.002189251],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"not_applicable","study_design_gemma":"observational","study_design_scores_codex":[0.002476875,0.005664818,0.1473759,0.004354058,0.0002692777,0.001174505,0.008430417,0.01614522,0.005335439,0.00823788,0.465153,0.3353826],"study_design_scores_gemma":[0.001113691,0.001950378,0.2413805,0.002713845,0.0004338212,0.002394866,0.0123797,0.1581845,0.0163611,0.009642746,0.5530118,0.0004330156],"study_design_candidate":"observational","study_design_consensus":null,"genre_codex":"empirical","genre_gemma":"empirical","genre_scores_codex":[0.7623235,0.003058478,0.02615836,0.004118716,0.0006573224,0.002385735,0.1312524,0.0258798,0.04416565],"genre_scores_gemma":[0.6524876,0.001176772,0.04673279,0.001666157,0.0001755482,0.001888848,0.2804178,0.005262097,0.01019241],"genre_candidate":"empirical","genre_consensus":"empirical","teacher_disagreement_score":0.0242692,"threshold_uncertainty_score":0.07197595,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.02710099236668351,"score_gpt":0.2885671468994449,"score_spread":0.2614661545327614,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}