Calculadora de teste t

Execute um teste t de Welch para duas amostras com médias, desvios padrão e tamanhos amostrais, obtendo na hora o valor p bilateral.

Teste t para duas amostras independentes
Compare duas médias independentes sem pressupor variâncias populacionais iguais.

Sobre o teste t para duas amostras

Um teste t para duas amostras independentes avalia se as médias de dois grupos não relacionados diferem além do que a variação da amostragem aleatória costuma produzir. Esta calculadora usa o teste t de Welch, que não exige variâncias iguais nas duas populações. Ela trabalha com estatísticas resumidas: média, desvio padrão amostral e tamanho de cada grupo. Isso é útil quando as observações originais não estão disponíveis, mas existem resumos confiáveis. A estatística do teste é a diferença entre as médias dividida pelo seu erro padrão. No método de Welch, o erro padrão é √(s₁²/n₁ + s₂²/n₂). Uma estatística positiva indica que a primeira média é maior; uma negativa indica que a segunda é maior. Inverter a ordem dos grupos muda o sinal, mas não o valor p bilateral. O valor absoluto expressa a diferença observada em unidades de erro padrão estimado. Os graus de liberdade de Welch–Satterthwaite consideram as variâncias e os tamanhos dos dois grupos. É comum e esperado que sejam fracionários. Quando os tamanhos e os desvios padrão são iguais, os graus de liberdade se reduzem a n₁ + n₂ − 2, como no teste clássico com variância combinada. Quando a variabilidade ou os tamanhos diferem, o ajuste de Welch costuma controlar o erro do tipo I com mais confiabilidade do que combinar as variâncias automaticamente. O valor p informado é bilateral. Sob a hipótese nula de médias populacionais iguais e os pressupostos do modelo, ele é a probabilidade de obter uma estatística t pelo menos tão extrema em qualquer direção. Um valor p pequeno indica incompatibilidade com o modelo nulo; não mede a probabilidade de a hipótese nula ser verdadeira. Compare-o com um nível de significância escolhido antes da análise e não trate um limite arbitrário como medida de importância prática. O procedimento pressupõe observações independentes dentro dos grupos e entre eles, um desfecho quantitativo e amostras que representem adequadamente suas populações-alvo. Em amostras pequenas, assimetria acentuada ou valores atípicos influentes podem prejudicar o teste. Amostras maiores tornam a inferência mais robusta à não normalidade moderada, mas independência e boa amostragem continuam essenciais. Se as observações forem pareadas, como medidas antes e depois nas mesmas pessoas, o teste independente é inadequado: use um teste t pareado sobre as diferenças de cada par. A significância estatística deve ser apresentada com a diferença real entre médias, a incerteza e o contexto. Um intervalo de confiança comunica diferenças populacionais plausíveis, enquanto um tamanho de efeito, como o d de Cohen, ajuda a expressar a magnitude. Esta calculadora fornece uma estatística de Welch e um valor p precisos para análises rápidas ou conferência de contas. As decisões também devem considerar o desenho do estudo, comparações múltiplas, qualidade da medição e relevância da diferença na área estudada.

Exemplos de teste t

Resumos dos gruposResultadoInterpretação
G1: 10, DP 2, n 25; G2: 8, DP 2, n 25t = 3.5355; df = 48Variabilidade e tamanhos amostrais iguais produzem os conhecidos graus de liberdade inteiros.
G1: 5, DP 1, n 10; G2: 4, DP 1, n 10t = 2.2361; df = 18A diferença observada equivale a cerca de 2.24 erros padrão.
G1: 20, DP 5, n 12; G2: 20, DP 3, n 18t = 0; p = 1Médias amostrais iguais não fornecem evidência de diferença entre médias.

Como executar um teste t para duas amostras

  1. Informe a média, o desvio padrão amostral e o tamanho da amostra do grupo 1.
  2. Informe as três estatísticas correspondentes do grupo independente 2.
  3. Clique em Executar teste t para calcular a estatística de Welch, os graus de liberdade e o valor p bilateral.
  4. Interprete o valor p com um alfa previamente escolhido e considere o tamanho e a direção da diferença entre médias.

Perguntas frequentes sobre o teste t

Por que esta calculadora usa o teste t de Welch?

O teste de Welch continua válido quando variâncias ou tamanhos dos grupos diferem. Ele também se aproxima do teste de variância combinada quando essas quantidades são iguais.

O que o valor p bilateral testa?

Ele testa uma diferença em qualquer direção entre médias populacionais. Inclui resultados pelo menos tão extremos quanto a estatística observada nas duas caudas.

Por que os graus de liberdade às vezes são decimais?

A aproximação de Welch ajusta os graus de liberdade para variâncias e tamanhos desiguais. Valores fracionários são matematicamente válidos e não devem ser arredondados antes de calcular o valor p.

Posso usar este teste em observações pareadas?

Não. Observações pareadas não são independentes e exigem analisar as diferenças dentro dos pares. Use um teste t pareado para medidas repetidas ou participantes pareados.

Um valor p pequeno significa que a diferença é importante?

Não. Evidência estatística e importância prática são conceitos diferentes. Avalie a diferença entre médias, um intervalo de confiança e um tamanho de efeito no contexto.