ROBIS: un nuovo strumento sviluppato per valutare i rischi di distorsione nelle revisioni sistematiche
Bibliographic record
Abstract
Obiettivo. Sviluppare ROBIS, un nuovo strumento per valutare i rischi di distorsione (bias) nelle revisioni sistematiche (piuttosto che negli studi primari). Disegno di studio e setting. Per sviluppare ROBIS abbiamo utilizzato un approccio in quattro stadi: definire l’obiettivo, ricercare le prove disponibili, organizzare incontri faccia a faccia, perfezionare lo strumento attraverso uno studio pilota. Risultati. ROBIS è stato sviluppato allo scopo di valutare le revisioni sistematiche in ambito sanitario su: effetti degli interventi sanitari, diagnosi, prognosi ed eziologia. Lo strumento è destinato principalmente a coloro che sviluppano linee-guida, autori di overview di revisioni sistematiche (revisioni di revisioni) e autori di revisioni che potrebbero voler valutare o evitare rischi di bias nelle loro revisioni. Lo strumento si completa in tre fasi: 1) valutare la rilevanza del quesito di ricerca (opzionale); 2) identificare i punti critici del processo di revisione; 3) valutare il rischio complessivo di bias (distorsione sistematica). La fase 2 considera quattro domini attraverso i quali possono essere introdotti rischi di bias nelle revisioni sistematiche: 1) criteri di eleggibilità degli studi; 2) identificazione e selezione degli studi; 3) raccolta dei dati; 3) sintesi e risultati. La fase 3 valuta il rischio complessivo di bias nell’interpretazione dei risultati della revisione e se l’interpretazione ha tenuto conto degli eventuali limiti identificati in uno qualsiasi dei domini della fase 2. Sono inoltre inserite domande chiave di supporto alla valutazione di eventuali dubbi relativi al processo di conduzione della revisione (fase 2) e al complessivo rischio di bias della revisione stessa (fase 3); queste domande mirano a individuare i possibili bias che possono verificarsi durante tutto il processo di stesura di una revisione sistematica, dalla progettazione alla conduzione, alla sintesi dei risultati fino alla scrittura delle conclusioni. Conclusioni. ROBIS è il primo strumento rigorosamente disegnato e sviluppato per la valutazione del rischio di bias nelle revisioni sistematiche.
Fetched live from OpenAlex and de-inverted. Abstracts are not stored in this database: the inverted indexes are 8.6 GB of the frame’s 9.3 GB of text, and the host has 13 GB free.
How this classification was reachedexpand
Full frame machine prediction
Teacher imitationNot calibrated prevalence, not ground truth. Human validation pending. The Gemma side is a direct model label for every work in the frame, read from the title-only record. The Codex side is a classifier learned from the 10,348 direct Codex labels and calibrated to design-weighted sample rates; fields without enough sample support carry no Codex call. Candidate is the union of the two sides; consensus is their intersection. These outputs are machine_predicted_unvalidated and are not human labels.
Distilled classifier scores by category (both heads)
| Category | Codex | Gemma |
|---|---|---|
| Metaresearch | 0.061 | 0.159 |
| Meta-epidemiology (narrow) | 0.001 | 0.001 |
| Meta-epidemiology (broad) | 0.002 | 0.003 |
| Bibliometrics | 0.004 | 0.003 |
| Science and technology studies | 0.002 | 0.003 |
| Scholarly communication | 0.010 | 0.007 |
| Open science | 0.003 | 0.005 |
| Research integrity | 0.003 | 0.005 |
| Insufficient payload (model declined to judge) | 0.026 | 0.008 |
Machine scores (provisional)
The two teacher heads of the student model, read on this work. A score orders the frame for review; it never asserts a category, and the validation status ships verbatim with every row.
Baseline scores from an immature model (maturity gate not passed, 7 training rounds). Scores rank; they never assert a category.
score_only:v0-immature-baseline · verbatim from the scoring run: score_only means the number may rank works, and no category label ships from itClassification
machine, unvalidatedMachine predicted; a candidate call from one source (direct Gemma or distilled Codex), not a consensus.
How this classification was reached, model by model and score by score, is at the end of the page under "How this classification was reached".