{"id":"W7066720474","doi":"","title":"An Investigation of Human Annotators' AI Teammate Selection and Compliance Behaviours","year":2024,"lang":"en","type":"dissertation","venue":"UWSpace (University of Waterloo)","topic":"Ethics and Social Impacts of AI","field":"Social Sciences","cited_by":0,"is_retracted":false,"has_abstract":true,"ca_institutions":"Blackberry (Canada)","funders":"","keywords":"Selection (genetic algorithm); Context (archaeology); Annotation; Compliance (psychology); Set (abstract data type); Exploratory research; Empirical research; Strengths and weaknesses","routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.04022494,0.0005479018,0.0005889938,0.00178274,0.003909793,0.004312697,0.001477838,0.001554718,0.00264939],"category_scores_gemma":[0.1365261,0.0006111926,0.0004341599,0.001339143,0.002161564,0.00344625,0.003665081,0.001322618,0.001256056],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.001346635,"about_ca_system_score_gemma":0.002652591,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.002691763,"about_ca_topic_score_gemma":0.005187269,"domain_scores_codex":[0.9649727,0.02492264,0.001853504,0.003959293,0.00347513,0.0008166273],"domain_scores_gemma":[0.8086287,0.1481976,0.01015793,0.01294062,0.01792778,0.002147351],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"qualitative","study_design_gemma":"observational","study_design_scores_codex":[0.0009745246,0.0006514164,0.118726,0.0009809461,0.0000996631,0.000595071,0.6477359,0.001138625,0.05693062,0.006690085,0.00377513,0.1617021],"study_design_scores_gemma":[0.0003434467,0.00239039,0.1696081,0.001194837,0.0003408492,0.001490956,0.5301492,0.0591249,0.08632657,0.01990511,0.1281705,0.0009551552],"study_design_candidate":"observational","study_design_consensus":null,"genre_codex":"empirical","genre_gemma":"empirical","genre_scores_codex":[0.9258639,0.0001517903,0.06109961,0.0007980306,0.00008757344,0.0005757441,0.0001838827,0.0006804881,0.01055906],"genre_scores_gemma":[0.9378855,0.00009956904,0.05605664,0.0003547286,0.0000275944,0.001124728,0.0002114005,0.0002117362,0.004028094],"genre_candidate":"empirical","genre_consensus":"empirical","teacher_disagreement_score":0.04022494,"threshold_uncertainty_score":0.2127324,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.02846564558626989,"score_gpt":0.3150281795660585,"score_spread":0.2865625339797886,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}