Margem de erro é o número que transforma um único resultado de pesquisa em uma gama honesta de possibilidades. Sempre que você vê uma enquete, um estudo ou uma pesquisa relatando uma porcentagem ou uma média, a margem de erro indica o quanto esse número poderia estar realisticamente errado – e até que ponto levar a sério pequenas diferenças entre resultados concorrentes.
Como a margem de erro é calculada
Para uma proporção de pesquisa, a margem de erro é z × √(p(1−p)/n) — um valor crítico (z) multiplicado pelo erro padrão da proporção. Para uma média, é z × SD/√n, o mesmo z multiplicado pelo erro padrão da média. Em ambos os casos, o erro padrão diminui à medida que o tamanho da amostra n aumenta, mas apenas pela raiz quadrada de n: para reduzir sua margem de erro pela metade, você precisa de aproximadamente quatro vezes a amostra, não o dobro.
O escore z vem da distribuição normal padrão e depende apenas do nível de confiança escolhido: 1,645 para 90%, 1,96 para 95% e 2,576 para 99%. Como é fixo para um determinado nível de confiança, o tamanho da amostra e a variabilidade (p ou desvio padrão) são o que realmente determinam o resultado.
Entradas e o que elas significam
Tamanho da amostra (n) é a contagem de pessoas ou observações pesquisadas – amostras maiores proporcionam margens mais estreitas, com retornos decrescentes. Proporção (p) é a sua melhor estimativa da parcela que se enquadra em uma categoria, de 0 a 1; se não tivermos uma estimativa prévia, 0,5 dá a margem de erro mais conservadora (mais ampla), razão pela qual a maioria das sondagens nacionais publicadas assumem-na implicitamente. O desvio padrão mede a distribuição dos seus dados em torno da média – um agrupamento mais restrito de valores (DP baixo) fornece uma margem de erro menor para o mesmo tamanho de amostra. O tamanho da população opcional só importa quando sua amostra é uma grande parcela de um grupo pequeno e finito; para pesquisas nacionais ou enquetes na web, é efetivamente infinito e pode ser deixado em branco.
Limites e casos extremos
Esta calculadora pressupõe uma amostragem aleatória simples – cada membro da população tem uma chance igual e independente de ser selecionado. As pesquisas do mundo real geralmente usam amostragem estratificada, agrupada ou ponderada, o que altera a margem de erro efetiva (geralmente ampliando-a por meio de um "efeito de design"). Ele também pressupõe que a distribuição amostral é aproximadamente normal, o que se aplica à maioria dos tamanhos de amostra acima de 30, mas pode falhar em amostras muito pequenas ou proporções extremas (p muito próximo de 0 ou 1).
A margem de erro leva em conta apenas a variabilidade da amostragem aleatória — ela não diz nada sobre viés de não resposta, perguntas mal formuladas ou uma amostra que não representa a população de seu interesse. Uma pesquisa pode ter uma pequena margem de erro e ainda assim estar sistematicamente errada se as pessoas que responderam não forem representativas.