{"id":"W6925486270","doi":"10.17615/1tt9-6558","title":"Appendices of the Conference Paper Titiled \"An Empirical Study Evaluating ChatGPT’s Performance in Generating Search Strategies for Systematic Reviews\"","year":2024,"lang":"en","type":"article","venue":"UNC Libraries","topic":"Chemical and Physical Properties in Aqueous Solutions","field":"Chemical Engineering","cited_by":0,"is_retracted":false,"has_abstract":true,"ca_institutions":"","funders":"","keywords":"Empirical research; Presentation (obstetrics); Systematic review; Association (psychology)","routes":{"ca_aff":false,"ca_fund":false,"ca_venue":false,"about_ca":true,"invisible_to_affiliation_only":true},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"codex-gemma-dda1882f352a","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0004739024,0.0001574935,0.0003802943,0.00003080956,0.0001180253,0.0001831451,0.0003367624,0.00005683029,0.00008743494],"category_scores_gemma":[0.0003323174,0.00008930897,0.00009280298,0.0002519608,0.0001194284,0.0006221571,0.0001503695,0.0002758414,0.000009009972],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.00003338887,"about_ca_system_score_gemma":0.0001396426,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.00002401644,"about_ca_topic_score_gemma":0.00001508669,"domain_scores_codex":[0.998579,0.0001654792,0.0005320926,0.0002417663,0.0002519061,0.0002297321],"domain_scores_gemma":[0.9990225,0.0005567065,0.00005250996,0.0002802272,0.00004699603,0.00004108483],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"bench_or_experimental","study_design_gemma":"simulation_or_modeling","study_design_scores_codex":[0.000133245,0.0009878833,0.003064344,0.1665336,0.0002844307,0.000004369801,0.08071051,0.02599098,0.4245712,0.293107,0.0005252836,0.004087203],"study_design_scores_gemma":[0.0002200686,0.0002069243,0.00007849406,0.006889696,0.0000536951,0.000001658463,0.003837874,0.9720811,0.0102314,0.00609504,0.00009623128,0.0002077877],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"genre_codex":"empirical","genre_gemma":"empirical","genre_scores_codex":[0.9920132,0.002090506,0.002087021,0.0001694634,0.0001588805,0.001988197,0.00001283468,0.0001186312,0.001361235],"genre_scores_gemma":[0.9973604,0.000006129946,0.001732116,0.00004706987,0.0001346367,0.0003784505,0.000007557303,0.00001950833,0.0003141134],"genre_candidate":"empirical","genre_consensus":"empirical","teacher_disagreement_score":0.9460902,"threshold_uncertainty_score":0.3641914,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.1256230589761242,"score_gpt":0.3534634812365293,"score_spread":0.227840422260405,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}