Blog
Estatística de dados

Teste qui-quadrado de independência online

Contagens numa tabela, não medições: quantas pessoas de cada canal compraram e quantas não. O teste qui-quadrado pergunta se essa divisão difere entre as linhas mais do que uma atribuição aleatória produziria — ou seja, se o canal e o resultado estão relacionados de alguma forma.

Seus dados não saem deste dispositivo

Seus dados

Cole uma tabela direto do Excel ou do Planilhas Google, ou solte um arquivo CSV. Nada é enviado: todo o cálculo acontece dentro desta aba do navegador.

CSV, TSV ou texto simples. Arquivos salvos em windows-1251 são detectados e relidos automaticamente, então os cabeçalhos não viram caracteres estranhos.

Opções de leitura

Resultado

A biblioteca de desenho é baixada apenas ao pressionar o botão e apenas nesta página.

Esta página não tem lado servidor nenhum. A tabela colada é processada por JavaScript dentro do seu próprio navegador, o gráfico é desenhado num elemento canvas da sua máquina e o arquivo de exportação é montado localmente. Nada é enviado, armazenado ou gravado em qualquer log. Você pode desconectar a rede depois que a página carregar e tudo continuará funcionando — é a forma mais simples de verificar você mesmo.

Fatos e limites do método

Entrada Uma tabela de contingência: categorias nas linhas, contagens de resultado nas colunas
Estatística χ² = Σ (observado − esperado)² / esperado
Frequências esperadas Total da linha × total da coluna ÷ total geral, exibidas por completo
Graus de liberdade (linhas − 1) × (colunas − 1)
Valor p Cauda direita exata da distribuição qui-quadrado via função gama incompleta
Tamanho do efeito V de Cramér, de 0 a 1

Quando induz ao erro

Como é calculado

A frequência esperada de cada célula é a que ela teria se as variáveis de linha e coluna não estivessem relacionadas: o total da linha vezes o total da coluna, dividido pelo total geral. A estatística soma as diferenças ao quadrado entre observado e esperado, cada uma dividida pelo esperado, o que pondera um desvio pelo quanto ele é surpreendente naquela escala.

O valor p é a cauda direita da distribuição qui-quadrado com (linhas−1)×(colunas−1) graus de liberdade, avaliada pela função gama incompleta regularizada. Ele é exato e não interpolado de tabela, o que importa para os graus de liberdade inconvenientes que tabelas impressas arredondam.

A tabela completa de frequências esperadas é exibida, não apenas o veredito. Compará-la célula a célula com sua tabela observada é como se descobre onde a relação realmente mora: a estatística agrega todas as células e não diz qual delas a impulsionou.

O V de Cramér reescala a estatística para a faixa 0–1 dividindo pelo tamanho da amostra e pelas dimensões da tabela. Diferente do próprio χ², ele pode ser comparado entre tabelas de tamanhos diferentes, e é isso que o torna o número a reportar junto ao valor p.

Perguntas e respostas

Como minha tabela deve ser?

Categorias nas linhas e contagens de resultado nas colunas, com as contagens como números. Os dados de exemplo têm três canais nas linhas e duas colunas de resultado, formando uma tabela 3×2.

Algumas frequências esperadas estão abaixo de 5. O resultado está errado?

Ele é pouco confiável mais do que errado. A aproximação qui-quadrado pressupõe frequências esperadas razoavelmente grandes. Junte categorias escassas num grupo maior ou colete mais dados.

Posso usar porcentagens em vez de contagens?

Não. O teste depende do número real de observações, e porcentagens descartam exatamente isso. Uma divisão 60/40 de dez pessoas e de dez mil são evidências muito diferentes.

O que é um V de Cramér alto?

Como guia grosseiro: 0,1 fraco, 0,3 moderado, 0,5 forte. Diferente do χ², ele não cresce só porque você coletou mais linhas, o que o torna a medida honesta de força.

Alguma coisa é enviada?

Não. As frequências esperadas, a estatística e o valor p são todos calculados no seu navegador.

Ferramentas relacionadas

Todas as ferramentas