EXPLORING WAYS TO VISUALIZE NEWS OVER GEOGRAPHICAL MAPS
Notice bibliographique
Résumé
Online news sites are some of the most useful and popular information retrieval systems in use today. Thousands of articles in different languages and on a variety of subjects are posted every day and updated every hour. Most articles are uninteresting and unimportant to a particular individual, and individuals may not want to review entire websites for stories of interest. Systems have been developed that provide summaries from online news websites but finding a means to rapidly scan stories of potential interest remains an open problem. In this thesis, we introduce a novel visualization system that uses geographical location combined with image collages and tag clouds to provide a tool for rapidly reviewing news stories. Tag clouds are arrangements of tags with the most important tags allocated a bigger font size or otherwise more prominent visual properties; and image collages provide a compact, effective and attractive representation for photos on one page. Bringing these media representations together over a geographic map offers a new style of interaction for online news browsing.\nThe usability of our application was evaluated with two user studies. We aimed to determine how best to configure our visualization to communicate more information in less time to users than traditional feed-based news aggregators. We were particularly interested in knowing whether users interpret text/image size and placement as indications of a news item’s prominence. We also wanted to establish whether users understand the semantic relationship between zoom level on the map and the regional relevance (municipal, provincial, national) of news items displayed at that zoom level. The results of user feedback and data analysis (e.g., eye tracking logs) were examined to improve the usability of the system. Data analysis from the second user study suggests that, in general, the system is highly effective in helping users achieve an immediate and effortless bird’s-eye-view of news summaries within a large geographic region. However, users had varying opinions about the level of detail in the user interface (e.g., the number of images).
Récupéré en direct depuis OpenAlex et désinversé. Les résumés ne sont pas conservés dans cette base de données : les index inversés représentent 8,6 Go des 9,3 Go de texte de la base, et le serveur dispose de 13 Go libres.
Comment cette classification a été obtenuedéplier
Prédiction machine sur la base complète
Imitation des enseignantsNi prévalence calibrée, ni vérité terrain. Validation humaine à venir. Le volet Gemma est une étiquette directe du modèle pour chaque travail de la base, lue sur la notice réduite au titre. Le volet Codex est un classifieur appris des 10 348 étiquettes directes de Codex et calibré sur les taux pondérés de l'échantillon; les champs sans appui suffisant ne portent aucun appel Codex. Le mode candidate est l'union des deux volets; le consensus est leur intersection. Ces sorties portent le statut machine_predicted_unvalidated et ne sont pas des étiquettes humaines.
Scores du classifieur distillé par catégorie (deux têtes)
| Catégorie | Codex | Gemma |
|---|---|---|
| Métarecherche | 0,002 | 0,006 |
| Méta-épidémiologie (sens strict) | 0,001 | 0,001 |
| Méta-épidémiologie (sens large) | 0,000 | 0,001 |
| Bibliométrie | 0,003 | 0,002 |
| Études des sciences et des technologies | 0,001 | 0,001 |
| Communication savante | 0,004 | 0,004 |
| Science ouverte | 0,001 | 0,002 |
| Intégrité de la recherche | 0,001 | 0,001 |
| Charge utile insuffisante (le modèle a refusé de juger) | 0,007 | 0,002 |
Scores machine (provisoires)
Les deux têtes enseignantes du modèle étudiant, lues sur ce travail. Un score ordonne la base pour la relecture; il n'affirme jamais une catégorie, et le statut de validation accompagne chaque rangée tel quel.
Scores de référence d'un modèle non mature (critères de maturité non atteints, 7 itérations). Un score ordonne; il n'affirme jamais une catégorie.
score_only:v0-immature-baseline · tel quel depuis la passe de notation : score_only signifie que le nombre peut ordonner les travaux, et qu'aucune étiquette de catégorie n'en découleClassification
machine, non validéePrédiction automatique; un appel candidat d’une seule source (Gemma direct ou Codex distillé), pas un consensus.
Le détail, modèle par modèle et score par score, se trouve en fin de page sous « Comment cette classification a été obtenue ».