A inteligência artificial médica está a melhorar no diagnóstico, mas a comprovação dos resultados para os doentes ainda está longe de ser alcançada

- A inteligência artificial médica está a melhorar o desempenho diagnóstico e de tomada de decisões clínicas, mas os estudos ainda fornecem evidências limitadas de melhores resultados para os doentes.
- Um estudo randomizado no Quénia constatou uma melhor documentação e decisões de tratamento com o apoio de profissionais de saúde mental, mas nenhuma redução significativa na falha do tratamento em 14 dias.
- A FDA está agora a analisar como os dispositivos médicos de IA generativa devem ser avaliados antes do lançamento e monitorizados após serem implantados em ambientes clínicos reais.
Uma série de estudos realizados em 2026 demonstra uma lacuna persistente na IA médica: os sistemas podem influenciar as decisões dos médicos e alcançar resultados de diagnóstico impressionantes sem comprovar que os doentes se tornam realmente mais saudáveis.
Isto é importante para os hospitais que adquirem estes sistemas, para as empresas que tentam demonstrar a sua utilidade e para as autoridades que determinam que provas devem ser consideradas quando a IA é adotada em clínicas médicas.
O problema das provas que os reguladores começam a analisar minuciosamente
A disparidade entre o desempenho notável da IA e a eficácia comprovada para os doentes parece estar a tornar-se demasiado grande para ser ignorada. O Financial Times resumiu esta situação na sua manchete:
“A IA médica tem um problema de comprovação.”
Esta questão deixou agora o âmbito das discussões académicas. A FDA está a colocar muitas das mesmas questões ao analisar como avaliar estes dispositivos médicos com inteligência artificial antes e depois da sua utilização. O documento de discussão de 18 de agosto, aberto a contribuições públicas até 19 de outubro, aborda temas como a avaliação de risco, a avaliação pré-mercado e a monitorização pós-mercado.
A FDA faz questão de esclarecer que este documento é puramente um documento de discussão e não uma minuta de diretiva, uma proposta de alteração de política ou qualquer indicação de expectativas regulamentares futuras.
Uma investigação anterior da FDA sobre o desempenho no mundo real também trouxe à tona a questão da deriva do modelo e as limitações da utilização de métricas estáticas. Isto levanta uma questão mais ampla que já não pode ser ignorada: como é que medimos a segurança e a eficiência de uma solução de IA depois de esta sair do laboratório?
No Quénia, o apoio da IA não reduziu a taxa de falha do tratamento
Num estudo publicado na revista Nature Medicine, divulgado a 26 de junho, 103 profissionais clínicos de 16 unidades da Penda Health dos Nairobi e Kiambu trataram doentes com ou sem o auxílio de um modelo de linguagem abrangente (LLM, na sigla em inglês) para a tomada de decisões. Dos 9.691 doentes inscritos, 9.347 foram considerados para a análise primária.
A taxa de falhas no tratamento após 14 dias foi de 2,2% no grupo IA e de 2% no grupo controlo, pelo que a razão de probabilidades ajustada foi de 0,77, embora a diferença não seja estatisticamente significativa (P=0,13). Nenhum evento adverso grave foi associado à intervenção.
O grupo que utilizou a IA apresentou melhor documentação e diagnósticos e planos de tratamento mais adequados. A relevância do resultado reside no facto de a melhoria das medidas de processo não ter resultado em qualquer melhoria do resultado para os doentes.
A tendência é semelhante à do estudo RAPIDx AI de 2024. Na análise primária de 3029 doentes, o desfecho composto aos seis meses de morte cardiovascular, enfarte do miocárdio ou reinternamento cardiovascular não planeado foi de 26% com o uso de IA e de 26,4% com o tratamento padrão. No entanto, dentro do grupo com enfarte do miocárdio não tipo 1, a angiografia coronária invasiva foi realizada com menos 47% de frequência no grupo com suporte de IA.
As pontuações continuam a subir; a comprovação no mundo real, porém, está atrasada.
Um estudo randomizado multicêntrico sob a orientação de Nicholas Rounding descobriu que o GPT-4o melhorou o desempenho de 249 médicos em 18% no Quénia, 10,7% na Indonésia e 7,2% na Holanda na resolução de casos clínicos simulados (P < 0,001).
No entanto, estes eram casos simulados e não situações do mundo real, e os participantes do grupo de controlo não podiam utilizar a internet ou os protocolos clínicos, nem foram avaliados os danos. A investigação confirma que a IA aumenta o desempenho em ambientes controlados, mas não diz nada sobre os resultados para os doentes.
Os resultados de um outro estudo publicado na Nature Medicine, conduzido por Li Zhang, Jakob Nikolas Kather e os seus colegas, indicaram uma precisão de 90,04% para um conjunto de sete doenças como referência. Neste estudo, ao introduzir um limiar de consistência, o agente local manteve um total de 49,4% dos casos com um nível de precisão de 98,9%, enquanto os restantes tiveram de ser revistos por profissionais humanos. No entanto, os autores indicaram a necessidade de confirmação adicional através de ensaios realizados em ambientes clínicos reais.

Porque é que um médico "a par da situação" não resolve o problema?
De acordo com um mapa de evidências elaborado por Joy Xu, Justin Ko e Joseph Kvedar, a IA agente está agora presente não só na administração, mas também no diagnóstico, gestão e outras tarefas na área da saúde, resultando na crescente importância de se poder governar e auditar tais sistemas.
Outro comentário da npj Digital Medicine refere que a simples presença de um médico não garante a supervisão e a governação adequadas. O viés da automatização pode tornar as pessoas mais propensas a aceitar uma recomendação falhada, enquanto a supervisão eficaz requer conhecimento, tempo e autoridade suficientes para questionar o sistema e intervir.
Sem estas condições, alertam os autores, a supervisão humana pode tornar-se pouco mais do que uma medida de proteção contra responsabilidades:
A responsabilidade pode recair sobre os médicos, que devem detetar erros para os quais não estão bem posicionados para identificar ou corrigir... uma zona de colapso moral.
Isto muda o foco do debate, deixando de ser se um ser humano está tecnicamente "no circuito" e passando a ser se essa pessoa está realmente capacitada para questionar, anular e interromper o sistema quando necessário.
Os interesses comerciais por detrás da cautela
A MarketsandMarkets prevê que o mercado de IA na área da saúde cresça de 36,67 mil milhões de dólares em 2026 para 194,79 mil milhões de dólares em 2031, uma taxa de crescimento anual composta de 39,7%. Se este crescimento se concretizar, os hospitais tomarão mais decisões de compra de IA, enquanto as evidências sobre os resultados para os doentes ainda são inconsistentes.
Isto poderá deslocar a pressão competitiva para algo mais difícil de comercializar, mas mais valioso para os fornecedores: validação prospetiva, monitorização do desempenho local e supervisão que possa ser efetivamente auditada.
Não se limite a ler notícias sobre criptomoedas. Compreenda-as. Assine nossa newsletter. É grátis.
Perguntas frequentes
O ensaio clínico com IA no Quénia melhorou os resultados para os doentes?
Não. O estudo da Penda Health, publicado na Nature Medicine a 26 de junho, apurou uma taxa de falha do tratamento de 2,2% com ajuda de IA, contra 2,0% sem ajuda. Esta diferença não foi estatisticamente significativa, embora a ferramenta tenha sido considerada segura.
Em que medida a IA melhorou as pontuações dos médicos no estudo multicêntrico?
No estudo de Rounding et al., os médicos com acesso ao GPT-4o obtiveram uma pontuação 18 pontos percentuais superior no Quénia, 10,7 na Indonésia e 7,2 nos Países Baixos. Contudo, estes ganhos foram obtidos a partir de simulações clínicas em condições controladas, e não com doentes reais.
O que está a FDA a propor para dispositivos médicos com IA?
O documento de discussão da FDA de 18 de agosto sobre dispositivos médicos habilitados por IA generativa aponta para uma regulamentação do ciclo de vida que abrange a avaliação pré-mercado, a monitorização pós-mercado e o desempenho no mundo real, com comentários públicos abertos até 19 de outubro.
Aviso Legal. As informações fornecidas não constituem aconselhamento de investimento. CryptopolitanO não se responsabiliza por quaisquer investimentos realizados com base nas informações fornecidas nesta página. Recomendamostrona realização de pesquisas independentesdent /ou a consulta a um profissional qualificado antes de tomar qualquer decisão de investimento.

Ibiam Wayas
Ibiam Wayas cobre notícias sobre criptomoedas desde 2019. Ele estudou Ciência da Computação na Universidade Nacional Aberta da Nigéria. Seus trabalhos foram publicados em diversas plataformas de notícias sobre criptomoedas, incluindo Coinfomania, Crypto News Australia e AltcoinBuzz. Com base em sua formação em Ciência da Computação, ele agora se concentra em notícias sobre criptomoedas, robótica e longevidade.
















