Inteligência artificial, sem ruído.
Pesquisa e Ciência3 min

Google testa AMIE em consultas médicas por vídeo e se aproxima de médicos de atenção primária

Sistema de IA médica do Google usa arquitetura de três agentes em consultas por vídeo e iguala médicos em várias medidas.

Google testa AMIE em consultas médicas por vídeo e se aproxima de médicos de atenção primária

O que a pesquisa revelou

O sistema de IA médica de pesquisa do Google, o AMIE, na versão com vídeo, realizou consultas síncronas por vídeo com atores profissionais representando pacientes e recebeu avaliações de especialistas clínicos no mesmo nível de médicos de atenção primária em várias medidas centrais. Quinze atores treinados simularam condições cardiopulmonares, abdominais, de cabeça e pescoço, neurológicas/psiquiátricas e musculoesqueléticas. O Google reforça que estudos com pacientes reais ainda precisam acontecer antes de qualquer conclusão sobre uso clínico.

Arquitetura multiagente

O AMIE divide a consulta por vídeo entre três agentes, em vez de atribuir diálogo, raciocínio clínico e percepção a um único processo. Segundo o Google, um agente único não consegue hoje sustentar tempos de resposta conversacionais naturais enquanto conduz raciocínio detalhado e processa continuamente entrada audiovisual.

  • Agente falante: conduz a interação falada com o paciente, mantendo o fluxo da conversa com base nas informações dos demais agentes.
  • Agente planejador: roda em segundo plano, atualizando diagnósticos diferenciais e planos de manejo conforme a consulta avança, identificando informações faltantes e repriorizando objetivos clínicos.
  • Agente de percepção: revisa os fluxos de vídeo e áudio continuamente, buscando sinais não verbais, achados físicos e sinais auditivos, inserindo essas observações no contexto clínico da conversa.

A latência é central: raciocínio clínico profundo leva tempo, e pausas longas podem prejudicar a relação durante a consulta. A separação entre o diálogo voltado ao paciente e o trabalho mais lento de raciocínio e percepção permite que o agente falante responda sem esperar todos os processos de fundo terminarem.

Como o estudo foi conduzido

O Google estruturou a avaliação como um estudo randomizado multi-braço: o AMIE fez consultas em vídeo em tempo real, uma versão só de texto serviu de base comparativa de modalidade, e dez médicos de atenção primária certificados usaram a mesma interface. Um painel independente de 20 médicos avaliou cada consulta com rubricas clínicas estabelecidas. Os avaliadores classificaram o AMIE no mesmo nível do grupo de médicos em completude da anamnese, precisão diagnóstica, adequação do manejo e qualidade de comunicação — e o AMIE (vídeo) igualou ou superou o AMIE (texto) nessas medidas. Os atores também preferiram o vídeo ao chat de texto, classificando-o como mais fácil e mais eficaz para comunicar preocupações de saúde.

Limites importantes

O Google lista limites claros: atores não reproduzem toda a variabilidade de encontros reais com pacientes; cenários que atores não conseguem retratar fielmente foram excluídos; e houve erros ocasionais de percepção e raciocínio nas avaliações automatizadas. As evidências de produção ainda se limitam a trabalhos baseados em texto — como o estudo de viabilidade com o Beth Israel Deaconess Medical Center e um ensaio randomizado em andamento com a Included Health. Ou seja: a pesquisa fornece evidência controlada sobre comportamento em vídeo, mas ainda não prova que o AMIE pode diagnosticar ou manejar pacientes reais com segurança em produção.


Descubra mais sobre noticiAI

Assine para receber nossas notícias mais recentes por e-mail.

R
Sobre o autorRedação Noticiai

Equipe editorial dedicada a explicar inteligência artificial com clareza, independência e contexto.