Copias una pregunta sobre sueño, cansancio o un laboratorio y la respuesta llega en segundos. Ordenada, con términos médicos, y coincide con lo que ya pensabas. Esa apariencia baja las ganas de comprobarla. La pieza anterior fue no entregarle el razonamiento. Esta es la más incómoda: el error no se ve porque el texto está bien armado.
Bien escrito no es lo mismo que bien fundado
El modelo arma la frase más probable. Puede mezclar un dato cierto con una conclusión que no se sigue, sin una señal de aviso. Un metaanálisis de respuestas médicas de un chatbot comercial, con estudios hasta mediados de 2023, encontró una precisión integrada del 56 %, entre 51 % y 60 %. La heterogeneidad era alta: no rinde igual en todas las preguntas. Sirve como límite, no como nota de hoy. Aceptarla porque suena clínica es sesgo de automatización: dejas de ver el error que habrías visto solo.
Tres señales de que hay que verificar
- Conclusión demasiado específica. Con pocos datos ya hay causa o diagnóstico. Falta historia, examen y lo que no midió: horas de sueño, y si los tienes, pulso o presión.
- Cita que no se puede abrir. Si nombra estudio, cifra o autor, comprueba que existan y que digan eso. Si no, la frase no entra.
- Encaja perfecto con lo que esperabas. Vuelve a la alternativa que quedó fuera. Si no hay ninguna, no estás verificando.
Una respuesta generada es ayuda para pensar. No es el juicio que cierra la decisión
Comprobar también es cuidar la decisión
Puede ordenar preguntas y preparar la visita. No reemplaza el contexto. Esos tres datos no diagnostican: separan la impresión de algo que se puede contrastar. Si el texto influye en una conducta, la supervisión humana es el paso, no un extra. En RedSana se usa para llegar con mejores preguntas. La Medicina Integrativa no toma la fluidez como prueba. La última pieza junta todo en un método para observar tu propia mente.
Referencias científicas:
1. Wei Q, Yao Z, Cui Y, Wei B, Jin Z, Xu X. Evaluation of ChatGPT-generated medical responses: a systematic review and meta-analysis. J Biomed Inform. 2024;151:104620. doi:10.1016/j.jbi.2024.104620. PMID: 38462064.
2. Khera R, Simon MA, Ross JS. Automation bias and assistive AI: risk of harm from AI-driven clinical decision support. JAMA. 2023;330(23):2255-2257. doi:10.1001/jama.2023.22557. PMID: 38112824.
3. Wang DY, Ding J, Sun AL, et al. Artificial intelligence suppression as a strategy to mitigate artificial intelligence automation bias. J Am Med Inform Assoc. 2023;30(10):1684-1692. doi:10.1093/jamia/ocad118. PMID: 37561535.
4. Haltaufderheide J, Ranisch R. The ethics of ChatGPT in medicine and healthcare: a systematic review on large language models. npj Digit Med. 2024;7:183. doi:10.1038/s41746-024-01157-x. PMID: 38971877.
5. Dratsch T, Chen X, Rezazade Mehrizi M, et al. Automation bias in mammography: the impact of artificial intelligence BI-RADS suggestions on reader performance. Radiology. 2023;307(4):e222176. doi:10.1148/radiol.222176. PMID: 37129490.