"Hälle suoritin siinä puhalluskokkeen" : Pronominien hän ja se käyttö Poliisit-sarjassa
Bibliographic record
Abstract
Tässä tutkimuksessa selvitetään, millaiset tekijät vaikuttavat pronominien hän ja se vaihteluun Poliisit-sarjan kahdennellatoista kaudella. Tutkielman aineisto koostuu sarjan kahdesta jaksosta, jotka on kuvattu kesällä 2019 ja käsitelty ja litteroitu syyskuussa 2020. Aineisto on jaettu kolmeen kategoriaan sarjassa esiintyvien puhetilanteiden perusteella. Ensin käsitellään poliisiparin keskinäistä puhetta olevia kohtauksia, sitten poliisien haastatteluja ja viimeiseksi kentällä käytävää keskustelua. Tutkimuskysymykset ovat seuraavat: 1) Miten henkilöviitteisten hän- ja se-pronominien käyttö vaihtelee puhetilanteen mukaan? 2) Millainen merkitys puhujalla on pronominin valintaan? Lisäksi tutkimuksen on tarkoitus selvittää, noudattako pronominien vaihtelu aiemmissa tutkimuksissa havaittuja pronominin valintaan vaikuttavia tekijöitä. \n \nPronominien hän ja se vaihtelua on tutkittu jo vuosikymmenten ajan useista eri näkökulmista, joten vaihteluun vaikuttavista seikoista on suomen kielen tutkimuksen alalla hyvä käsitys. Tutkimusta pronominien käytöstä tietyissä ammattikunnissa, medioissa tai tosi-tv:ssä ei kuitenkaan ole tehty paljoa, joten tämä tutkimus valottaa pronominien käyttöön liittyviä tekijöitä näissä tilanteissa. \n \nTutkimuksen tulokset osoittavat, että Poliisien kolmen puhetilannekategorian välillä on eroja pronominien käytön suhteen. Keskinäisen puheen kohtauksissa on todennäköisempää käyttää pronominia se kuin pronominia hän, kun taas haastatteluissa pronomini hän on yleisempi. Kentällä käytetään tasaisesti molempia pronomineja, mutta vaihtelua esiintyy sen mukaan, onko puhuja poliisi vai asiakas. Lisäksi pronominien vaihteluun vaikuttavat aiemmissa tutkimuksissa havaitut tekijät, kuten logoforisuus ja virittyminen. Analyysi osoittaa myös, että pronominia se käytetään pronominia hän useammin murteellisessa puheessa, mutta ero ei ole suuri. \n \nTutkimuksen analyysissa on huomioitava, että aineisto on peräisin televisiosarjasta. Vaikka kohtaukset ovatkin todellisia, ovat puhujat tietoisia kameran läsnäolosta, mikä voi vaikuttaa heidän puhetapaansa. Tämän lisäksi jaksoihin on jätetty vain mielenkiintoisimmat kohtaukset, mikä voi vaikuttaa siihen, millaista kieltä kuvattujen henkilöiden nähdään käyttävän. Näiden seikkojen vuoksi tutkimus toimiikin ensisijaisesti katsauksena pronominien hän ja se käyttöön nimenomaan Poliisit-sarjassa.
Fetched live from OpenAlex and de-inverted. Abstracts are not stored in this database: the inverted indexes are 8.6 GB of the frame’s 9.3 GB of text, and the host has 13 GB free.
How this classification was reachedexpand
Full frame machine prediction
Teacher imitationNot calibrated prevalence, not ground truth. Human validation pending. The Gemma side is a direct model label for every work in the frame, read from the title-only record. The Codex side is a classifier learned from the 10,348 direct Codex labels and calibrated to design-weighted sample rates; fields without enough sample support carry no Codex call. Candidate is the union of the two sides; consensus is their intersection. These outputs are machine_predicted_unvalidated and are not human labels.
Distilled classifier scores by category (both heads)
| Category | Codex | Gemma |
|---|---|---|
| Metaresearch | 0.002 | 0.003 |
| Meta-epidemiology (narrow) | 0.000 | 0.000 |
| Meta-epidemiology (broad) | 0.000 | 0.000 |
| Bibliometrics | 0.000 | 0.001 |
| Science and technology studies | 0.007 | 0.005 |
| Scholarly communication | 0.007 | 0.005 |
| Open science | 0.001 | 0.005 |
| Research integrity | 0.002 | 0.004 |
| Insufficient payload (model declined to judge) | 0.031 | 0.008 |
Machine scores (provisional)
The two teacher heads of the student model, read on this work. A score orders the frame for review; it never asserts a category, and the validation status ships verbatim with every row.
Baseline scores from an immature model (maturity gate not passed, 7 training rounds). Scores rank; they never assert a category.
score_only:v0-immature-baseline · verbatim from the scoring run: score_only means the number may rank works, and no category label ships from itClassification
machine, unvalidatedMachine predicted; a candidate call from one source (direct Gemma or distilled Codex), not a consensus.
How this classification was reached, model by model and score by score, is at the end of the page under "How this classification was reached".