Classificação de Estudos sobre Testes Diagnósticos
A classificação de estudos sobre testes diagnósticos é o primeiro passo para avaliar criticamente um artigo científico dessa área. Antes de discutir sensibilidade, especificidade ou valor preditivo, você precisa saber que tipo de desenho de pesquisa está lendo. Entender essa classificação evita conclusões equivocadas na prática clínica.
Por que classificar estudos de teste diagnóstico
Nem todo estudo que avalia um exame tem o mesmo peso de evidência. Um estudo pode medir apenas a acurácia de um teste (o quanto ele acerta o diagnóstico), enquanto outro pode medir o impacto clínico de usar aquele teste, ou seja, se o paciente teve desfechos melhores por causa do exame. São perguntas diferentes, que exigem desenhos diferentes.
Reconhecer o tipo de estudo antes de ler os resultados ajuda você a saber o que cobrar do texto: amostra representativa, comparação com padrão de referência, cegamento dos avaliadores, entre outros critérios.
Estudos de acurácia diagnóstica
São os mais comuns na literatura de testes diagnósticos. Nesse desenho, o teste índice (o exame que está sendo avaliado) é aplicado a uma série de pacientes e comparado a um padrão ouro (o método considerado referência para confirmar ou excluir a doença). O objetivo é calcular sensibilidade, especificidade e outras medidas de desempenho do teste.
Esses estudos respondem à pergunta: "esse exame identifica corretamente quem tem e quem não tem a doença?"
Estudos de impacto clínico
Vão além da acurácia. Avaliam se o uso do teste diagnóstico muda a conduta médica e, principalmente, se melhora desfechos relevantes para o paciente, como mortalidade, tempo de internação ou qualidade de vida. Costumam ter desenho de ensaio clínico randomizado, comparando um grupo que usa o novo teste com outro que usa a estratégia diagnóstica tradicional.
Esse tipo de estudo responde a uma pergunta mais ambiciosa: "usar esse exame realmente traz benefício para o paciente?"
Hierarquia de evidência em testes diagnósticos
Assim como existe uma hierarquia de evidência para tratamentos, existe uma lógica semelhante para diagnóstico:
- Estudos de acurácia diagnóstica (transversais, comparando teste índice ao padrão ouro).
- Estudos de impacto no raciocínio clínico, avaliando se o resultado do exame muda a decisão do médico.
- Estudos de impacto em desfechos do paciente, o nível mais alto, avaliando benefício clínico real.
Desenho transversal versus caso-controle
Outra forma de classificação diz respeito à seleção dos pacientes. No desenho transversal, uma coorte de pacientes com suspeita da doença é testada tanto pelo teste índice quanto pelo padrão ouro. Esse formato reflete melhor o cenário clínico real.
Já no desenho caso-controle, pesquisadores selecionam separadamente pacientes já sabidamente doentes e pacientes sabidamente saudáveis, aplicando o teste em ambos os grupos. Esse formato tende a superestimar o desempenho do exame, porque exagera o contraste entre os grupos extremos, um viés conhecido como viés de espectro.
Como usar essa classificação na prática
Ao ler um artigo sobre um novo exame, pergunte primeiro: isso é um estudo de acurácia ou de impacto clínico? Depois, verifique se a amostra foi transversal (mais próxima da realidade) ou caso-controle (mais sujeita a viés). Essa checagem inicial já filtra boa parte dos problemas metodológicos antes mesmo de você analisar os números de sensibilidade e especificidade.
Essa classificação inicial é a base para todas as próximas aulas do módulo, nas quais você vai aprender a calcular e interpretar cada uma dessas medidas de desempenho de um teste diagnóstico.
Assista a aula completa acima para ver exemplos práticos e continue para a próxima aula do módulo.