Dentista Live › Últimas noticias
Los chatbots acertaron en prótesis sobre implantes, pero la seguridad que declaran engaña
Un estudio comparó las respuestas de ChatGPT y Gemini con las conclusiones de 74 revisiones sistemáticas; el alineamiento fue bueno, y los autores avisan de que el grado de certeza declarado no mide la calidad de la evidencia.

Un equipo comparó lo que ChatGPT y Google Gemini responden sobre prótesis sobre implantes con lo que dicen 74 revisiones sistemáticas publicadas entre 2023 y 2025. El trabajo salió en el Journal of Prosthetic Dentistry el 2 de junio de 2026.
El diseño cubrió cinco dominios clínicos: diseño de prótesis, componentes del implante, complicaciones, protocolos y retención protésica. Las preguntas se formularon a partir de los objetivos de cada revisión, y dos evaluadores ciegos juzgaron las respuestas de forma independiente.
En los cinco dominios, los dos chatbots generaron respuestas que se alineaban bastante con las conclusiones de las revisiones sistemáticas. No hubo diferencia estadísticamente significativa entre las plataformas. Las diferencias aparecieron en los niveles de confianza que cada una declaraba.
Y ahí está el aviso de los autores: los niveles de confianza no deben interpretarse como una medida de la calidad de la evidencia. Los modelos de lenguaje pueden generar respuestas plausibles y, aun así, imprecisas.
Por qué importa: el problema no es que el chatbot se equivoque, sino que se equivoca con la misma seguridad con la que acierta. Quien lo use para estudiar tiene que comprobar la fuente, no el tono.
Qué revisar: el artículo en el Journal of Prosthetic Dentistry y las revisiones sistemáticas que usó como referencia.