Wie Schlagzeilen zum Schlüssel für das Verständnis von Texten werden
Bibliographic record
Abstract
WAS SCHLAGZEILEN VON ÜBERSCHRIFTEN UNTERSCHEIDETEs gehört nicht zu den Aufgaben von Journalisten, ihren Texten eine Überschrift zu geben.Ihre Aufgabe ist es vielmehr, einen Titel zu finden, der das Format einer Schlagzeile hat.Dass dieser Schlagzeilen-Titel in Presse und Internet in der Regel als Überschrift erscheint, ist lediglich ein textarchitektonisches Zusatzmerkmal und auf die Schlagzeilen in den anderen journalistischen Medien (Hörfunk und Fernsehen) ohnehin nicht übertragbar.Zudem gibt es in der Presse, der ursprünglichen Heimat von Schlagzeilen, Überschriften ganz anderer Art: » » Zeitungs-und Zeitschriften-Titel (z.B. "Berliner Morgenpost", "Der Spiegel", "Men's Health"); » » Seiten-Titel (z.B. "Politik", "Kultur", "Sport"); » » Serien-Titel (z.B. "Wettkampf des Tages", "Mein Lieblingssport") 1 , wozu auch Kolumnen-Titel gehören; » » Rubrik-Titel (z.B. "Nachrichten", "Kulturnotizen"); » » Anzeigen-Titel (z.B. "Stellenanzeigen", "Kontaktanzeigen").Von diesen Titel-Typen unterscheiden sich Schlagzeilen durch Unikalität.Sie sind für einen einzigen Beitrag in einer einzigen Ausgabe gemacht.Und bei einem anderen Schlagzeilen-Typ, den Werbeschlagzeilen (in Anzeigen und auf Plakaten), ist die Position auf der Textfläche von vornherein nicht als Überschrift angelegt.Sie werden zwischen Bild und Haupt-bzw.Fließtext platziert, in ein Bild hineingeschrieben oder über die Textfläche verteilt (vgl.Janich 2010, S. 55).Vergleichbares wird längst auch journalistisch genutzt -auffällig besonders in der Boulevard-Presse.Die Ausdrücke Überschrift und Titel erfassen folglich weder das kommunikative Wesen von Schlagzeilen noch deren kommunikative Wirklichkeit in ihrer ganzen Vielfalt.Es ist auch nicht plausibel, ja unlogisch, wenn es bei Kurz (2010, S. 299) heißt: "[…] wir verwenden die Termini Titel und Überschrift aus logischen Gründen synonym."
Fetched live from OpenAlex and de-inverted. Abstracts are not stored in this database: the inverted indexes are 8.6 GB of the frame’s 9.3 GB of text, and the host has 13 GB free.
How this classification was reachedexpand
Full frame machine prediction
Teacher imitationNot calibrated prevalence, not ground truth. Human validation pending. The Gemma side is a direct model label for every work in the frame, read from the title-only record. The Codex side is a classifier learned from the 10,348 direct Codex labels and calibrated to design-weighted sample rates; fields without enough sample support carry no Codex call. Candidate is the union of the two sides; consensus is their intersection. These outputs are machine_predicted_unvalidated and are not human labels.
Distilled classifier scores by category (both heads)
| Category | Codex | Gemma |
|---|---|---|
| Metaresearch | 0.011 | 0.083 |
| Meta-epidemiology (narrow) | 0.002 | 0.002 |
| Meta-epidemiology (broad) | 0.002 | 0.001 |
| Bibliometrics | 0.008 | 0.008 |
| Science and technology studies | 0.003 | 0.005 |
| Scholarly communication | 0.018 | 0.026 |
| Open science | 0.002 | 0.007 |
| Research integrity | 0.003 | 0.007 |
| Insufficient payload (model declined to judge) | 0.356 | 0.535 |
Machine scores (provisional)
The two teacher heads of the student model, read on this work. A score orders the frame for review; it never asserts a category, and the validation status ships verbatim with every row.
Baseline scores from an immature model (maturity gate not passed, 7 training rounds). Scores rank; they never assert a category.
score_only:v0-immature-baseline · verbatim from the scoring run: score_only means the number may rank works, and no category label ships from itClassification
machine, unvalidatedMachine predicted; a candidate call from one source (direct Gemma or distilled Codex), not a consensus.
How this classification was reached, model by model and score by score, is at the end of the page under "How this classification was reached".