{"id":"W3204086316","doi":"10.5281/zenodo.5834073","title":"Mapping Urban Linguistic Diversity in New York City: Motives, Methods, Tools, and Outcomes","year":2021,"lang":"en","type":"article","venue":"ScholarSpace (University of Hawaii at Manoa)","topic":"Multilingual Education and Policy","field":"Social Sciences","cited_by":4,"is_retracted":false,"has_abstract":true,"ca_institutions":"University of British Columbia","funders":"","keywords":"Linguistic diversity; Diversity (politics); Linguistics; Geography; Sociology; Natural language processing; Computer science; Anthropology; Philosophy","routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"codex-gemma-dda1882f352a","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0008107865,0.0001187382,0.0002825116,0.0002045312,0.001028546,0.00006502667,0.0002983371,0.000136924,0.0005740442],"category_scores_gemma":[0.001350774,0.0001628685,0.0000938418,0.0005684478,0.0002354086,0.0003163711,0.0005904356,0.0002620032,0.00002207022],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.0002349514,"about_ca_system_score_gemma":0.0005780782,"about_ca_topic_candidate":true,"about_ca_topic_consensus":true,"about_ca_topic_score_codex":0.0174327,"about_ca_topic_score_gemma":0.02724837,"domain_scores_codex":[0.9985249,0.0004915606,0.00009359359,0.0003285081,0.0002712397,0.0002901806],"domain_scores_gemma":[0.9989141,0.0003285609,0.0001207985,0.0002224461,0.000139142,0.0002749205],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"observational","study_design_gemma":"observational","study_design_scores_codex":[0.00002053056,0.00007924871,0.7215118,0.00003366884,0.00005043156,0.00004158508,0.2364833,0.000002691344,0.0001460095,0.02504193,0.003142278,0.01344652],"study_design_scores_gemma":[0.0005856184,0.000008777411,0.5377179,0.00004269582,0.00002456283,0.000001150797,0.1289895,0.000009042325,0.00003352334,0.0005754974,0.3318295,0.0001822006],"study_design_candidate":"observational","study_design_consensus":"observational","genre_codex":"empirical","genre_gemma":"empirical","genre_scores_codex":[0.907144,0.0009331801,0.0004853492,0.01236951,0.0004239423,0.0001956271,0.00002182099,0.00006335006,0.0783632],"genre_scores_gemma":[0.8525009,0.0003678103,0.02931543,0.0003552084,0.0001113615,9.492458e-8,0.00001317605,0.000009663263,0.1173264],"genre_candidate":"empirical","genre_consensus":"empirical","teacher_disagreement_score":0.3286873,"threshold_uncertainty_score":0.9905018,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.1486847986639782,"score_gpt":0.3993537129267046,"score_spread":0.2506689142627264,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}