SPSS
Aula
SUMÁRIO
O Programa de Análise Estatística SPSS
Análise Inferencial Comparativa Simples
T-test e Anova One-Way
As normas de apresentação de resultados da APA
Tabelas para as análises comparativas
Apresentação no texto dos resultados
Introdução à
Informática
I N T R O D U Ç Ã O À I N F O R M Á T I C A
Objectivos
Conhecer como se realizam os testes comparativos: teste t para
amostras independentes (t de student) e ANOVA no SPSS
Como apresentar esses resultados num relatório científico segundo as
normas da APA
1 Introdução
Nesta aula vamos indicar como se realizam os procedimentos de análise inferencial
comparativa t-test e ANOVA. Estes testes frequentemente utilizados para inferir a
existência de diferenças entre dois (t-test) ou mais (ANOVA) grupos
independentes, desde que os pressupostos para a utilização de técnicas
paramétricas estejam cumpridos (para saber mais sobre estes pressupostos
aconselhamos a leitura do livro de Morgan & Griego, 1998).
Na próxima aula iremos experimentar a técnica t-pares que permite a inferência da
existência de diferenças significativas na evolução de uma variável dentro do
mesmo grupo. As correlações ficam igualmente para a próxima aula.
A aplicação destas técnicas permitirá ainda o treino e familiarização com o SPSS,
uma aprendizagem da leitura dos outputs e da criação de tabelas para apresentação
dos resultados segundo o formato APA.
2 Análises Comparativas Simples
Escolhemos estas análises por serem as mais comuns. Chamamos a atenção para a
necessidade da previsão da técnica a aplicar antes da elaboração da recolha dos
dados, pois podemos desta forma resolver grande parte das “dores de cabeça” que
estão tradicionalmente ligadas aos procedimentos estatísticos.
No texto da aula 8 e 9 já demos algumas pistas sobre como fazer esta recolha e
conduzir o vosso estudo (embora não seja esse o âmbito desta cadeira). Outras
pistas são as de, para aplicação dos testes paramétricos procurem ter 30 medições
(casos) por nível de estudo, isto é, se forem estudar as diferenças entre os géneros,
terão de ter 30 homens e 30 mulheres, se quiserem estudar as diferenças entre os
géneros e dentro destes o serem obesos ou não já precisam de 120 elementos, isto
é 30 homens obesos, 30 mulheres obesas, 30 homens não obesos e 30 mulheres
não obesas e ai por diante. Estes são números mínimos para termos uma garantia
de que os pressupostos estarão cumpridos, mas vale sempre a pena jogar pelo
seguro e avançar para populações mais numerosas.
Para a análise destes procedimentos estatísticos iremos para o cenário clube
desportivo. Numa primeira tarefa iremos procurar saber se os jogadores das
equipas dos clubes que são treinados por licenciados em educação física têm
ULHT Aula SPSS. Página 2
I N T R O D U Ç Ã O À I N F O R M Á T I C A
melhores desempenhos dos que os que são treinados por não licenciados nesta
área. A variável desempenho foi medida através da estatística dos jogos, criando-se
uma fórmula do jogador mais valioso onde os valores mais altos representam
melhores desempenhos.
Teríamos assim, o seguinte dicionário de variáveis:
Name Type Width Label Values
Atleta Numeric 8 Número do Atleta
Treinado Numeric 8 Treinador Licenciado ou não 1 – Não
2 – Sim
Desemp Numeric 8 Desempenho do Atleta
Se os dados fossem introduzidos no Excel deveria ser criada uma tabela do tipo:
Atleta Treinado Desemp
1 2 75
2 1 50
3 1 60
4 2 65
... ... ...
O que reforça a importância da criação do dicionário de variáveis, pois ele servirá
de apoio à introdução dos dados (saberão mais facilmente que o 1 é o treinador
não licenciado, o 2 o licenciado, etc.).
Pensemos então na nossa hipótese de estudo:
Os atletas dos treinadores não licenciados têm piores desempenhos dos que
os dos treinadores licenciados.
A nossa variável independente é o treinado (tipo de treinador) e a dependente o
desemp (desempenho).
É uma hipótese que requer um estudo comparativo de dois grupos. Considerando
que a normalidade dos dados está cumprida (vejam a aula 9 que vos explica como é
que se analisa a normalidade), devemos utilizar o t-teste para amostras
independentes.
Vamos então comparar estes dois grupos de treinadores.
Exercício A. Inicie o SPSS
B. Faça Open an Existing Data Source e escolha o ficheiro apoio
aula X; ou File | Open |Data e localize o ficheiro no seu
ambiente de trabalho (desktop).
a. Verifique se as variáveis estão bem definidas no
Variable View (com os values e as labels bem definidos)
ULHT Aula SPSS. Página 3
I N T R O D U Ç Ã O À I N F O R M Á T I C A
C. Faça Analyse | Compare Means | Independent Samples T-
Test
D. Coloque a variável desemp na caixa Test Variables
E. Coloque a variável treinado na caixa Grouping variable
a. Clique em define groups e faça group 1: 1 e group 2:2
F. Faça OK e verifique se o output é semelhante ao que está nas
tabelas seguintes
Group Statistics
Std. Error
TREINADO N Mean Std. Deviation Mean
DESEMP Não Licenciado 33 43,33 24,36 4,24
Licenciado 54 58,26 25,69 3,50
Independent Samples Test
Levene's Test for
Equality of Variances t-test for Equality of Means
95% Confidence
Interval of the
Mean Std. Error Difference
F Sig. t df Sig. (2-tailed) Difference Difference Lower Upper
DESEMP Equal variances
,130 ,719 -2,681 85 ,009 -14,93 5,57 -26,00 -3,86
assumed
Equal variances
-2,716 70,596 ,008 -14,93 5,50 -25,89 -3,97
not assumed
Este valor assinala o resultado do O t é o valor do teste, o df os graus Diz-nos que em 95% das vezes a
teste do pressuposto que as de liberdade e o Sig. (2-tailed) o diferença média está entre valores.
variâncias dos dois grupos são valor da significância do teste. Quer dizer que os atletas treinados
iguais. Se for <.05 este pressuposto Neste caso o teste foi significativo, pelo não licenciados têm, em 95%
não está cumprido e devemos representando que os grupos são das vezes, desempenhos entre –26
utilizar a linha de baixo, relativa a diferentes no que respeita ao a –3.86 pontos abaixo dos atletas
equal variances not assumed para desempenho. dos licenciados.
ler os resultados do teste.
A primeira tabela mostra-nos uma análise descritiva da população, tendo como
elemento diferenciador o tipo de treinador. A segunda apresenta os resultados
do t-teste que estão explicados nas legendas.
Apresentação dos A apresentação dos dados dentro do texto seria do tipo: os atletas dos
resultados no texto
treinadores não licenciados têm desempenhos significativamente inferiores aos
dos atletas dos treinadores licenciados (t(85)=-2.68, p=.009). Isto é t significa
ULHT Aula SPSS. Página 4
I N T R O D U Ç Ã O À I N F O R M Á T I C A
que foi um teste t; (85) são os graus de liberdade, os df na tabela; o –2.68 é o
valor do teste t; e o p=.009 o valor da significância.
Apresentação dos Caso desejasse incluir uma tabela com estes dados no texto, deveria utilizar o
resultados em tabela
seguinte modelo:
Tabela X. Diferenças no desempenho entre os atletas dos treinadores não
licenciados e licenciados.
Não Licenciado Licenciado
Variável M DP M DP t (85)
Desempenho 43.33 24.36 58.26 25.69 -2.68 **
Nota: **p<.01
Atenção As “estrelinhas” são a forma que a APA propõe para diferenciar os resultados
significativos nas tabelas. Assim temos * para p<.05; ** para p<.01 e *** para
p<.001.
Agora imagine que quer comparar um terceiro grupo de treinadores: aqueles que,
não sendo licenciados, têm o nível superior da formação de treinadores. O t-test já
não dá resposta a este tipo de análise, pois só permite a comparação de dois grupos.
Teremos de avançar para a Análise da Variância (ANOVA, para os amigos...).
A nossa hipótese de estudo evoluía então para a seguinte:
Os atletas dos treinadores não licenciados têm piores desempenhos dos que
os dos treinadores com formação superior na federação e estes do que os dos
treinadores licenciados.
A nossa variável independente, a que agora o SPSS chama factor, continua a ser o
treinado (tipo de treinador) e a dependente o desemp (desempenho).
O dicionário de variáveis seria actualizado para:
Name Type Width Label Values
Treinado Numeric 8 Formação 1 – Não Licenciado
do 2 – Treinador Licenciado
treinador
3 - Formação Superior Federação
Para realizar esta análise iremos recordar como é que se importa um ficheiro do
Excel.
Exercício A. Faça File | Open | Data e localize o ficheiro Excel apoio aula X
ANOVA (não se esqueça de pedir para localizar os ficheiros *.xls)
a. Verifique que a caixa Read variables names from first
row of data está checada e que a Worksheet refere-se à
Sheet1.
b. Faça OK
B. Verifique se as variáveis estão bem definidas no Variable View
C. Grave o ficheiro com o nome apoio aula 17 ANOVA
D. Faça Analyse | Compare Means | One-Way ANOVA
ULHT Aula SPSS. Página 5
I N T R O D U Ç Ã O À I N F O R M Á T I C A
a. Coloque a variável desemp na caixa Dependent List
b. Coloque a variável treinado na caixa Factor
c. Clique em Options e cheque a caixa Descriptives para
obtermos uma análise descritiva dos dados
E. Faça OK e verifique se o output é semelhante ao que está na
figura seguinte
Descriptives
DESEMP
95% Confidence Interval for
Mean
N Mean Std. Deviation Std. Error Lower Bound Upper Bound Minimum Maximum
Não Licenciado 33 43,33 24,36 4,24 34,70 51,97 1 90
Licenciado 54 58,26 25,69 3,50 51,25 65,27 7 98
Form. Superior
33 51,12 12,50 2,18 46,69 55,55 10 65
Federação
Total 120 52,19 23,12 2,11 48,01 56,37 1 98
ANOVA
DESEMP
Sum of
Squares df Mean Square F Sig.
Between Groups 4615,373 2 2307,686 4,579 ,012
Within Groups 58967,219 117 503,993
Total 63582,592 119
Iremos usar estes graus de O valor F é o valor do teste da
liberdade para a apresentação dos ANOVA, o valor Sig. É a
resultados significância do teste. Quando é
<.05 considerasse que existem
diferenças significativas
Novamente a primeira tabela apresenta uma análise descritiva simples dos grupos
em estudo. Podemos perceber através dela quais serão os grupos com maiores ou
menores valores, mas sem fazer inferências, para isso precisamos de olhar para a
segunda tabela e para as legendas que nela colocámos.
Apresentação dos A apresentação dos dados dentro do texto seria do tipo: existem diferenças
resultados no texto
significativas entre os grupos em estudo (F(2,117)=4.58, p=.012). Isto é F
significa que foi um teste F; (2 e 117) são os graus de liberdade, os df na tabela;
o 4.58 é o valor do teste F (sempre só com duas casas decimais); e o p=.012 o
valor da significância.
ULHT Aula SPSS. Página 6
I N T R O D U Ç Ã O À I N F O R M Á T I C A
Apresentação dos Caso desejasse incluir uma tabela com estes dados no texto, deveria utilizar o
resultados em tabela seguinte modelo:
Não Licenciado Licenciado Form. Sup Fed.
Variável M DP M DP M DP F (2,117)
Desempenho 43.33 24.36 58.26 25.69 51.12 12.50 4.58 *
Nota: * p<.05. Form. Sup. Fed – Formação Superior da Federação
Reparem que todas as siglas que aparecem devem ser incluídas na legenda, excepto
aquelas como o M e o DP, que são standard para Média e Desvio Padrão.
O problema que se põe agora é o de saber quem é que é tem desempenhos
significativamente melhores.. Terão os atletas dos não licenciados piores
desempenhos dos de com formação desportiva superior? E terão estes piores
desempenhos dos dos treinadores licenciados?
Para responder a esta questão existem os testes post-hoc, que permitem aferir qual
a origem das diferenças significativas.
A escolha dos post-hoc da ANOVA depende da chamada homogeneidade da
variância, que é avaliada pelo teste de Levene que está incluído no SPSS. Se o teste
der significativo, i.e. valor abaixo de .05, dever-se-á utilizar o post-hoc Dunnet’s C,
se não for significativo deve-se utilizar o Tukey HSD.
O exercício seguinte treina estes procedimentos.
Exercício A. Mantendo o mesmo ficheiro do exercício anterior. Faça Analyse
| Compare Means | One-way ANOVA
a. Quando estamos a repetir procedimentos podemos clicar
no botão denominado Dialog Recall, que apresenta
os últimos procedimentos que realizámos
B. Com as variáveis nas caixas de forma idêntica ao exercício
anterior, clique em Options e cheque a caixa Homogeneity-
of-Variance. Faça Continue.
C. Na caixa de diálogo da One-Way ANOVA faça OK.
D. Agora temos de procurar no Output a tabela Test of
Homogeneity of Variances.
E. Como o teste foi
Test of Homogeneity of Variances
significativo, teremos
de repetir o DESEMP
Levene
Statistic df1 df2 Sig.
8,523 2 117 ,000
ULHT Se este valor for <.05Aula
a variância
SPSS. Página 7
não é homogénea e teremos de
usar um post-hoc adequado
(Dunnet’s C)
I N T R O D U Ç Ã O À I N F O R M Á T I C A
procedimento e pedir o teste Dunnet’s C.
F. Para isso vá ao botão Dialog Recall e escolha a One-Way
Anova.
G. Clique no botão Post-Hoc e escolha a caixa Dunnet’s C. Faça
Continue.
H. Na caixa de diálogo da One-Way ANOVA faça OK.
I. Analise o Ouput.
Multiple Comparisons
Dependent Variable: DESEMP
Dunnett C
Mean
Difference 95% Confidence Interval
(I) TREINADO (J) TREINADO (I-J) Std. Error Lower Bound Upper Bound
Não Licenciado Licenciado -14,93* 4,96 -28,33 -1,52
Form. Superior
-7,79 5,53 -19,50 3,92
Federação
Licenciado Não Licenciado 14,93* 4,96 1,52 28,33
Form. Superior
7,14 4,96 -2,84 17,12
Federação
Form. Superior Não Licenciado 7,79 5,53 -3,92 19,50
Federação Licenciado -7,14 4,96 -17,12 2,84
*. The mean difference is significant at the .05 level.
Os atletas dos
treinadores
Como este valor tem uma O que não sabíamos é que os licenciados não
“estrelinha” e tem um sinal atletas dos treinadores não têm desempenhos
negativo, diz-nos que os atletas dos licenciados não tinham significativamente
treinadores não licenciados têm desempenhos significativamente melhores do que
desempenhos significativamente diferentes (não há “estrelinha”) os da formação
menores. Mas isto já sabíamos do t- superior da
test. federação
Os testes post-hoc não são normalmente apresentados em tabela e no texto
referem-se as médias dos grupos para indicar o sentido da diferença. Assim, por
exemplo, diríamos que os atletas dos treinadores não licenciados têm desempenhos
significativamente piores (M=43.33) do que os atletas dos licenciados (M=58.26),
mas não são significativamente piores do que os dos treinadores de formação
ULHT Aula SPSS. Página 8
Apresentação dos
resultados no texto
I N T R O D U Ç Ã O À I N F O R M Á T I C A
superior da federação (51.69), os quais não são significativamente diferentes dos
atletas dos licenciados.
Reparem que podemos, e devemos, quando já estamos rotinados neste tipo de
análise, realizar logo o teste de homogeneidade da variância, pois poupa-nos um
dos passos destes exercícios. Nós escolhemos discriminá-los para que possam
acompanhar com maior cuidado as nossas opções e para que possam repetir os
procedimentos de forma a se recordarem deles no futuro.
Na próxima aula
Veremos o t de pares e as correlações
Iremos preparar o trabalho do clube.
3 Referências Bibliográficas
Essenciais
Páginas 172-199
Morgan, G., & Griego, O. (1998). Easy Use and Interpretation of SPSS for
Windows. Answering Research Questions with Statistics. Mahwah, NJ: Lawrence-
Earlbaum
15-38 e 145-148
Nicol, A. & Pexman, P. (1999) Presenting your findings – A Pratical Guide for
Creating Tables. Washington DC: APA
Complementar
Pestana, M., & Gageiro, J. (1998). Análise de Dados em Ciências Sociais. A
Complementaridade do SPSS. Lisboa: Edições Sílabo.
Ntoumanis, N. (2001). A Step-by-Step Guide to SPSS for Sport and Exercise
Studies. London & New York: Routledge
Web/Online
Ajuda do SPSS
[Link]
ULHT Aula SPSS. Página 9