Metodología de la investigación y comunicación científica: otros temas para recordar…
Bibliographic record
Abstract
Metodología de la investigación y comunicación científica: otros temas para recordar…Al Director He leído con sumo interés el artículo publicado en el número anterior de la Revista Argentina de Cardiología por el Dr. Ricardo Esper, (1) por quien siento un profundo respeto.En esta breve nota no quiero polemizar sobre la importancia de un examen físico completo, el valor imprescindible de una correcta semiología y anamnesis ni sus implicaciones en la toma de decisiones médicas.Recibo con agrado que profesionales de la envergadura del Dr. Esper se esmeren en recordar(nos) a los más jóvenes cuán importante es la semiología en la práctica diaria.Sin embargo, me llamó la atención que en este provocativo manuscrito que tiene la válida intención de recordarnos cómo y por qué debemos realizar un examen físico correcto se deslicen errores y omisiones respecto de cómo ejecutar un trabajo clínico correcto, cómo formular una pregunta científica adecuada y comunicar sus resultados.Es nuestra obligación enseñar a realizar un examen físico completo y minucioso y es también nuestra obligación enseñar cómo formular, ejecutar y comunicar los resultados de nuestras investigaciones.El trabajo del Dr. Esper parte de una breve introducción acerca de cuál es la problemática, la que no está validada por ninguna referencia de la bibliografía (el trabajo aparece sin referencias), y uno se pregunta: ¿Se ha evaluado esto antes?¿Se ha detectado esta problemática en el pasado?¿Alguien intentó previamente responder a estas dudas?De acuerdo con lo referido en Material y métodos, se preguntó a los pacientes entrevistados si les habían revisado los pulsos, luego se hizo el examen y se repreguntó.Se aclara que los pacientes no presentaban trastornos de la memoria.No se aclara mediante qué método se confirmó este hecho, como tampoco el tiempo medio transcurrido entre el examen original (posiblemente realizado en otro consultorio por otro médico) y el examen actual.En esta sección tampoco se plantea cuántos pacientes deberíamos incorporar al estudio para detectar una diferencia significativa entre "previamente revisados" y "no previamente revisados"; de nuevo, sin datos de bibliografía previa, se hace difícil saber si esta diferencia, a priori, se podría cuantificar.En Resultados se pone de manifiesto que cuando se pregunta si los pulsos fueron revisados, un número importante de pacientes responde que no, pero luego de realizarse el examen, un número significativo de pacientes dice que sí.Uno se queda con la duda, porque no hay referencias en la Discusión sobre la validez de la repregunta y el efecto placebo de ella.Al tratarse de un solo operador, con interés en demostrar que el examen se realiza poco, uno podría sospechar que existe un sesgo en la forma de repreguntar, y que esto influya en la respuesta final.No pretendo decir que esto sucedió, sino que debería abrirse una subsección del manuscrito llamada Limitaciones del estudio donde aparezcan estas especulaciones.La discusión del manuscrito empieza con una reflexión sobre los aspectos administrativos de nuestra consulta diaria y cómo ello impacta en nuestra práctica médica.Estoy en un ciento por ciento de acuerdo con lo manifestado conceptualmente por el Dr. Esper; sin embargo, su estudio (referido como "encuesta" cuando en realidad se trata de un estudio prospectivo) no tuvo la intención de evaluar dicho impacto, sino el porcentaje de pacientes en los cuales no se examinaron los pulsos periféricos.Lo mismo sucede con la segunda reflexión sobre el impacto de la industria sobre las decisiones del médico joven.Esto podría ser motivo de un editorial de la Revista, que uno leería con sumo agrado, pero estos aspectos no fueron analizados en el estudio del Dr. Esper y, asociados con el trabajo, aparecen como meramente especulativos.El objetivo del Dr. Esper, creo yo, está plenamente cumplido: ha logrado llamar mi atención (y calculo que la de muchos otros) en un tema que no es mi especialidad; sin embargo, me atrevo a usar su método de "provocación" para señalar que el mismo énfasis debe ponerse para enseñar Metodología de la Investigación.Como reflexión final, las conclusiones de un estudio deben contestar las preguntas formuladas.En este caso se detecta que las dos conclusiones provistas son más bien reflexiones (válidas y ciertas) que conclusiones, y claramente no responden la pregunta original formulada.Me sumo al llamado del Dr. Esper (1) para ejercer presión sobre los sistemas formativos de pregrado y posgrado en estos temas de fundamental importancia: precisión en la enseñanza del examen físico y, por qué no, precisión en la ejecución y comunicación de trabajos científicos.
Fetched live from OpenAlex and de-inverted. Abstracts are not stored in this database: the inverted indexes are 8.6 GB of the frame’s 9.3 GB of text, and the host has 13 GB free.
How this classification was reachedexpand
Full frame machine prediction
Teacher imitationNot calibrated prevalence, not ground truth. Human validation pending. The Gemma side is a direct model label for every work in the frame, read from the title-only record. The Codex side is a classifier learned from the 10,348 direct Codex labels and calibrated to design-weighted sample rates; fields without enough sample support carry no Codex call. Candidate is the union of the two sides; consensus is their intersection. These outputs are machine_predicted_unvalidated and are not human labels.
Distilled classifier scores by category (both heads)
| Category | Codex | Gemma |
|---|---|---|
| Metaresearch | 0.023 | 0.056 |
| Meta-epidemiology (narrow) | 0.000 | 0.000 |
| Meta-epidemiology (broad) | 0.001 | 0.000 |
| Bibliometrics | 0.009 | 0.019 |
| Science and technology studies | 0.002 | 0.001 |
| Scholarly communication | 0.008 | 0.003 |
| Open science | 0.001 | 0.002 |
| Research integrity | 0.001 | 0.001 |
| Insufficient payload (model declined to judge) | 0.006 | 0.001 |
Machine scores (provisional)
The two teacher heads of the student model, read on this work. A score orders the frame for review; it never asserts a category, and the validation status ships verbatim with every row.
Baseline scores from an immature model (maturity gate not passed, 7 training rounds). Scores rank; they never assert a category.
score_only:v0-immature-baseline · verbatim from the scoring run: score_only means the number may rank works, and no category label ships from itClassification
machine, unvalidatedMachine predicted; a candidate call from one source (direct Gemma or distilled Codex), not a consensus.
How this classification was reached, model by model and score by score, is at the end of the page under "How this classification was reached".