Blog
Estatística de dados

Calculadora de teste t de duas amostras online

Dois grupos produziram duas médias diferentes. O teste t responde se essa diferença é maior do que a variação aleatória dentro dos grupos produziria casualmente — e o tamanho do efeito responde ao que o valor p não consegue: se a diferença é grande o bastante para importar.

Seus dados não saem deste dispositivo

Seus dados

Cole uma tabela direto do Excel ou do Planilhas Google, ou solte um arquivo CSV. Nada é enviado: todo o cálculo acontece dentro desta aba do navegador.

CSV, TSV ou texto simples. Arquivos salvos em windows-1251 são detectados e relidos automaticamente, então os cabeçalhos não viram caracteres estranhos.

Opções de leitura

Colunas

Resultado

A biblioteca de desenho é baixada apenas ao pressionar o botão e apenas nesta página.

Esta página não tem lado servidor nenhum. A tabela colada é processada por JavaScript dentro do seu próprio navegador, o gráfico é desenhado num elemento canvas da sua máquina e o arquivo de exportação é montado localmente. Nada é enviado, armazenado ou gravado em qualquer log. Você pode desconectar a rede depois que a página carregar e tudo continuará funcionando — é a forma mais simples de verificar você mesmo.

Fatos e limites do método

Teste usado Teste t de Welch — não pressupõe variâncias iguais
Por que Welch A versão clássica de Student exagera a significância quando tamanhos ou dispersões diferem
Graus de liberdade Aproximação de Welch–Satterthwaite, geralmente fracionária
Valor p Exato, da distribuição t pela função beta incompleta regularizada
Tamanho do efeito d de Cohen, calculado com o desvio padrão combinado
Linhas mínimas 2 por grupo; com sentido a partir de cerca de 15 cada

Quando induz ao erro

Como é calculado

O estatístico do teste é a diferença entre as duas médias dividida pelo erro padrão dessa diferença. Quanto maior a diferença e menor a variação interna, maior fica o t e menos plausível é que os grupos compartilhem uma média.

A versão de Welch é usada em vez do teste clássico de Student. O de Student pressupõe que os dois grupos têm variâncias iguais, e quando não têm — o caso normal com dados reais de tamanhos desiguais — ele produz valores p pequenos demais e declara significativas diferenças que não são.

Os graus de liberdade vêm da equação de Welch–Satterthwaite e geralmente não são um número inteiro, o que é uma característica e não um erro: a correção ajusta a forma da distribuição de referência ao desequilíbrio entre os grupos.

O d de Cohen divide a diferença de médias pelo desvio padrão combinado, dando uma medida sem unidades de quão separados os grupos estão em relação à dispersão interna deles. Por convenção 0,2 é pequeno, 0,5 médio e 0,8 grande, e ele não muda quando você coleta mais dados — ao contrário do valor p, que encolhe indefinidamente.

Perguntas e respostas

O que p < 0,05 significa de fato?

Que uma diferença pelo menos deste tamanho ocorreria em menos de 5 % das vezes se os dois grupos realmente tivessem a mesma média. É uma afirmação sobre os dados sob uma suposição, não sobre a probabilidade de sua conclusão estar certa.

Por que Welch em vez do teste t padrão?

Porque Welch não pressupõe variâncias iguais e quase nada perde quando elas por acaso são iguais. A prática estatística moderna o recomenda como padrão, e é ele que esta página executa.

Meu p é significativo mas a diferença parece minúscula.

Olhe o d de Cohen. Um d de 0,1 com p significativo significa que você tem muitos dados e uma diferença pequena demais para agir. Significância e importância são perguntas separadas.

Minhas duas colunas são pareadas?

Este é o teste não pareado, que trata as colunas como grupos independentes. Se cada linha for o mesmo sujeito medido duas vezes — antes e depois — o teste pareado é o correto, e esta página vai subestimar o efeito.

Meus dados são enviados?

Não. O estatístico, os graus de liberdade e o valor p são todos calculados localmente.

Ferramentas relacionadas

Todas as ferramentas