Dentista Live › Últimas notícias
GPT-4o e Gemini passaram num exame simulado de endodontia, mas não diagnosticam
Dois endodontistas certificados avaliaram as respostas dos modelos a três casos clínicos do board americano; o desempenho foi bom, com a ressalva de que trabalharam só com texto.

Um estudo publicado no Journal of Endodontics em 26 de fevereiro de 2026 avaliou dois modelos de linguagem em um exame oral simulado do American Board of Endodontics.
O desenho usou três casos clínicos. Para cada um, os modelos receberam perfis detalhados de pacientes e vinte perguntas abertas. Dois endodontistas certificados avaliaram as respostas quanto à validade clínica, à precisão e à relevância das referências citadas.
Os dois foram bem. O Gemini 2.5 Pro obteve média de 2,83 numa escala de 0 a 3, e o GPT-4o, 2,73. A maioria das respostas foi classificada entre aceitável e excelente. Não houve diferença significativa entre os modelos, embora o Gemini tenha sido mais consistente de um caso para outro.
A limitação é a que importa: os modelos responderam apenas a perguntas escritas, com as descrições radiográficas já fornecidas por quem conduzia o teste. Os autores são explícitos — esses sistemas não conseguem diagnosticar nem planejar tratamento de forma independente, e não realizam testes clínicos nem interpretam radiografias.
Por que importa: serve como apoio de estudo para quem prepara prova de especialização. Não serve para decidir se o dente é tratável.
O que conferir: o artigo no Journal of Endodontics.