IBM SPSS Statistics Base 25

Statistics, Software Documentation · notes

Voir tous les documents en mathématiques

IBM SPSS Statistics Base 25

IBM

Important

Avant d'utiliser le présent document et le produit associé, prenez connaissance des informations générales figurant à la section «Remarques», à la page 175.

La présente édition s'applique à la version 25.0.0 d'IBM SPSS Statistics et à toutes les éditions et modifications ultérieures sauf mention contraire dans les nouvelles éditions.

LE PRESENT DOCUMENT EST LIVRE EN L'ETAT SANS AUCUNE GARANTIE EXPLICITE OU IMPLICITE. IBM DECLINE NOTAMMENT TOUTE RESPONSABILITE RELATIVE A CES INFORMATIONS EN CAS DE CONTREFACON AINSI QU'EN CAS DE DEFAUT D'APTITUDE A L'EXECUTION D'UN TRAVAIL DONNE.

Ce document est mis à jour périodiquement. Chaque nouvelle édition inclut les mises à jour. Les informations qui y sont fournies sont susceptibles d'être modifiées avant que les produits décrits ne deviennent eux-mêmes disponibles. En outre, il peut contenir des informations ou des références concernant certains produits, logiciels ou services non annoncés dans ce pays. Cela ne signifie cependant pas qu'ils y seront annoncés.

Pour plus de détails, pour toute demande d'ordre technique, ou pour obtenir des exemplaires de documents IBM, référez-vous aux documents d'annonce disponibles dans votre pays, ou adressez-vous à votre partenaire commercial.

Vous pouvez également consulter les serveurs Internet suivants : v http://www.fr.ibm.com (serveur IBM en France) v http://www.ibm.com/ca/fr (serveur IBM au Canada) v http://www.ibm.com (serveur IBM aux Etats-Unis)

Compagnie IBM France Direction Qualité 17, avenue de l'Europe 92275 Bois-Colombes Cedex

© Copyright IBM France 2017. Tous droits réservés.

Table des matières

Avis aux lecteurs canadiens .

.

.

.

.

.

.

.

.

.

.

.

.

Fonctions de base . Livre de codes .

Effectifs .

descriptives.

. . . . . . . . .

. . .

. . . . . . . . .

. . .

. .

.

.

.

.

.

.

.

.

.

. . . Onglet Sortie du livre de codes . Onglet Statistiques du livre de codes . . . . . . .

. . Statistiques des effectifs. Graphiques des effectifs . Format des effectifs . . . Options Descriptives. . Fonctions supplémentaires de la commande . DESCRIPTIVES . . . .

. . . . . . . . .

. . . . . . . . .

. . . . . .

. . . . . .

. . . . . .

.

.

.

.

.

.

.

.

.

.

.

.

.

.

.

.

.

.

.

.

.

. .

. .

. .

. .

. .

. .

. .

. .

. .

. .

. .

. .

. .

. .

. . .

. . .

. . .

. . .

. . .

. . .

. . .

. . .

. . .

. . .

. . .

. . . . . . .

Explorer .

Moyennes .

Récapitulatif .

. . Options de Moyennes . .

. . . Statistiques d'Explorer . . . Tracés d'Explorer . Options d'Explorer . . . Fonctions supplémentaires de la commande . EXAMINE . . . Tableaux croisés . .

. . . . . . . . Statistiques des Cubes OLAP . . Différences des Cubes OLAP . . Titre des Cubes OLAP . . . . . . . . .

. . Couches de tableaux croisés . Graphiques à barres en cluster de tableaux croisés . Tableaux croisés affichant les variables de couche . dans des couches de tableau. . Statistiques de tableaux croisés . . Affichage de cellules (cases) de tableaux croisés . Format de tableau croisé . . . . . . Options de Récapituler . . Statistiques de Récapituler . . . . . . . . . . . . . . .

. . . . . . . . . . . . . . . . . . . . . . . . . Tests T . . . . Test T pour échantillons indépendants . . Test T pour échantillons appariés . Test T pour échantillon unique . . . . Fonctions supplémentaires de la commande . . T-TEST . . . . . . . . Contrastes ANOVA à 1 facteur . . . Tests Post Hoc ANOVA à 1 facteur Options ANOVA à 1 facteur . . . Fonctions supplémentaires de la commande . . ONEWAY . . Analyse GLM – Univarié . . . Modèle GLM . . . Contrastes GLM . . . Tracés de profil GLM .

. ANOVA à 1 facteur .

Cubes OLAP .

. . . . . . . . . . . . . . .

Tests T .

. . . . . . . . . . . .

. . . . .

. . . . .

. . . . .

. . . . .

. . . . .

. . . . .

. . . . .

. . . . .

. . . . .

. . . . .

. . .

. .

. .

. .

. .

. .

. .

.

.

.

.

.

.

.

.

. v

. 1 . 1 . 1 . 3 . 4 . 5 . 6 . 6 . 6 . 7

. 8 . 8 . 9 . 10 . 10

. 11 . 11 . 12

. 12

. 12 . 13 15 . 16 . 16 . 17 . 17 . 18 . 19 . 21 . 22 . 24 . 24 . 24 . 24 . 24 . 26 . 27

. 28 . 28 . 29 . 29 . 31

. 32 . 32 . 34 . 35 . 36

.

.

.

.

.

.

.

.

.

.

.

.

.

. .

. .

. .

. .

. .

. .

. .

. .

. . .

. . .

. . .

. . . .

. . . .

. . . .

Distances .

Corrélations partielles .

. corrélations bivariées .

. . Comparaisons post hoc GLM . . Enregistrement GLM . . . . Moyenne marginale estimée GLM . Options GLM. . . . . Fonctions supplémentaires de la commande . . UNIANOVA . . . .

. . Options de corrélations bivariées . Fonctions supplémentaires des commandes CORRELATIONS et NONPAR CORR. . .

. . . Options Corrélations partielles . . Fonctions supplémentaires de la commande . . PARTIAL CORR . . . . . . . . . Distances : Mesures de dissimilarité . Indices : Mesures de similarité . . . Fonctions supplémentaires de la commande . . PROXIMITIES . . Modèles linéaires . . . . . . . . . .

. . . . . . . Obtention d'un modèle linéaire . . . . . . Objectifs . . . . Bases . . . . . . Choix du modèle . . . . . Ensembles . . . . Avancé . . . . . . Options de modèle . . Récapitulatif de modèle . . . Préparation automatique des données Importance des prédicteurs . . Valeurs prévues en fonction des valeurs . . . observées . . . . . Résidus. . . Valeurs extrêmes . . . Effets . . . Coefficients . . Moyennes estimées . . Récapitulatif de génération de modèle . .

Régression linéaire .

. . . . . . . . . . . .

. . . . . . . . . .

. . . . . . . .

. . . . . . . .

. . . . . . .

. . . . . .

. . . . . .

. . . . . .

. . . . . .

. . . . . .

. . . . . .

. .

Publicité

. .

. .

. .

. .

. .

. .

. .

.

.

.

.

.

.

.

.

.

.

.

.

.

.

.

.

.

.

.

. . .

. . .

. . .

. Méthodes de sélection des variables de régression linéaire . . . . Régression linéaire : Définir la règle . Tracés de régression linéaire . . Régression linéaire : Enregistrement des nouvelles variables . . . Statistiques de régression linéaire . . . . Régression linéaire : Options. Fonctions supplémentaires de la commande . . REGRESSION . . . . . Régression ordinale. . . . . Régression ordinale : Options . Régression ordinale : Sortie . . . Régression ordinale : Emplacement Régression ordinale : Echelle . . Fonctions supplémentaires de la commande . . PLUM .

. . . . . .

. . . . . .

. . . . . .

. . . .

. . .

. . .

. . .

. .

. .

.

.

.

.

.

.

.

.

.

.

.

.

.

. . . .

. . .

. . .

. . . .

. . . . . . . . . . . .

. 39 . 41 . 42 . 43

. 44 . 45 . 45

. 46 . 46 . 47

. 47 . 48 . 48 . 49

. 49 . 49 . 50 . 50 . 51 . 51 . 52 . 52 . 52 . 53 . 53 . 53

. . . . . . . .

. 54 . 54 . 54 . 54 . 55 . 55 . 56 . 56

. 57 . 58 . 58

. 58 . 60 . 61

. 61 . 62 . 63 . 63 . 64 . 65

. 65

iii

.

.

.

. .

. .

. .

. .

. .

. .

. .

. .

. . . . . . . .

. . . . . . . .

. . . . . . . . . . .

. . . . . . . . . . . . . . .

. . . . . . . . . . . . . . .

Modèle . Options.

estimation de courbe .

. . . . Analyse du voisin le plus proche . . . . . Voisins . . . . . . Fonctions . . . . Partitions . . . . . Enregistrement . . . . Sortie . . . Options. . . . Vue du modèle . . . analyse discriminante .

Régression des moindres carrés partiels . . . . . . . . . . . . . .

. . . Modèles d'estimation de courbe Enregistrement de l'estimation de courbe . . . . . . . . . . . .

. 66 . 67 . 67 . 68 . 70 . 70 . 71 . 73 . . 74 . . 74 . . 75 . . 76 . . 76 . . 76 . . 79 . Définition de plages pour l'analyse discriminante 80 Sélection des observations pour l'analyse . discriminante . . . Statistiques de l'analyse discriminante . Méthode détaillée étape par étape de l'analyse . discriminante . . . . Classement de l'analyse discriminante . Enregistrement de l'analyse discriminante . Fonctions supplémentaires de la commande . . DISCRIMINANT . . Analyse factorielle .

. 81 . 82 . 83

. 83 . 83

. 80 . 81

. . .

. .

. .

. .

. .

. .

. .

. .

. .

.

.

.

.

.

.

.

.

.

.

.

.

.

.

.

.

.

.

.

.

.

.

.

.

.

.

.

.

.

.

.

.

.

.

.

. .

. . .

. . .

. . . .

. . . . . .

. Analyse de cluster hiérarchique.

. . Choix d'une procédure de classification . . Analyse de cluster TwoStep .

. . . . Sélection des observations pour l'analyse . . factorielle . . . . . Caractéristiques d'analyse factorielle . . . . Extraction d'analyse factorielle . . . . . Rotation d'analyse factorielle . . . . Scores d'analyse factorielle . Options d'analyse factorielle . . . . . Fonctions supplémentaires de la commande . . FACTOR . . . Options de la procédure d'analyse de cluster . . . . TwoStep . . . Sortie de l'analyse de cluster TwoStep . . . Visualiseur de clusters . . . . . Méthode d'analyse de cluster hiérarchique . Statistiques de l'analyse de cluster hiérarchique Tracés (graphiques) de l'analyse de cluster hiérarchique . . . . Sauvegarde des nouvelles variables de l'analyse . . de cluster hiérarchique Fonctions supplémentaires de la syntaxe de . commande CLUSTER . .

. Analyse de cluster des nuées dynamiques . Efficacité de l'analyse de cluster de nuées dynamiques . . Itération de l'analyse de cluster de nuées dynamiques . . . Enregistrement des analyses de cluster de nuées . . dynamiques . Options d'analyses de cluster de nuées dynamiques . . . . Fonctions supplémentaires de la commande . . QUICK CLUSTER .

. . . .

. .

. .

. .

.

.

.

.

.

.

.

.

.

.

.

.

.

.

.

.

.

.

.

.

.

.

.

.

.

.

.

.

.

.

.

.

.

.

.

.

.

.

Publicité

.

.

.

.

.

.

.

.

.

.

.

.

.

.

.

.

.

.

.

.

.

.

.

.

. 84 . 85 . 85 . 86 . 87 . 87

. 87 . 88 . 88

. 90 . 91 . 92 . 97 . 98 98

. 98

. 98

. 99 . 99

. 100

. 100

. 101

. 101

. 101

iv IBM SPSS Statistics Base 25

Tests non paramétriques .

Analyse des réponses multiples .

.

.

.

.

.

.

.

.

.

.

.

.

.

.

.

.

.

.

.

.

.

.

.

.

.

.

.

. .

. . . .

. Tests non paramétriques à un échantillon . Tests non paramétriques pour échantillons indépendants . . . Tests non paramétriques pour échantillons liés Vue du modèle . . . . Fonctions supplémentaires de la commande . NPTESTS . . . . . Boîtes de dialogue ancienne version . . . . . . Analyse des réponses multiples . Définition de jeux de réponses multiples . Tableaux d'effectifs des réponses multiples . Tableaux croisés des réponses multiples . . . . . Rapports de Résultats . . rapport en lignes . . rapport en colonnes . . . Fonctions supplémentaires de la commande . . REPORT . . . . . . . Statistiques de l'analyse de fiabilité . . Fonctions supplémentaires de la commande . . RELIABILITY . .

. . . . . . . . . . .

. . . .

. . . .

. . . .

. . . .

. . . .

. . .

. . .

. .

. .

. .

. .

. .

. .

. .

. .

.

. Positionnement multidimensionnel

.

.

. Analyse de fiabilité

.

Rapports de Résultats

.

.

.

.

.

.

.

.

.

.

.

.

.

.

.

.

.

.

.

.

.

.

.

.

.

.

.

. . . .

Courbes ROC .

Forme des données du positionnement multidimensionnel . Positionnement multidimensionnel : créer une . mesure Modèle de positionnement multidimensionnel Positionnement multidimensionnel : Options Fonctions supplémentaires de la commande . . ALSCAL . . . . Statistiques de rapport . . . .

. . . . Options de la courbe ROC . . .

. . . . . .

. . . . . .

. . . . . .

. . . . . .

. . . . . .

. Statistiques de rapport

Simulation .

. Conception d'une simulation basée sur un fichier de modèle . . Pour concevoir une simulation basée sur des équations personnalisées . Pour concevoir une simulation sans modèle prédictif . . . . Exécution d'une simulation à partir d'un plan . . de simulation . . . Générateur de simulation . . . . Boîte de dialogue Exécuter la simulation . Utilisation de la sortie graphique créée par la . . . simulation . . . Modélisation géospatiale . . . Sélection de cartes . . Sources de données . . . Règles d'association géospatiales . . . Prévision spatio-temporelle . . . . . Terminer .

. . . . . . .

. . . . . . .

. . . . . . .

. . . .

. . . .

. . . .

. .

. .

. .

. .

. .

.

.

.

.

.

.

.

.

.

.

.

.

.

.

.

.

.

.

.

.

.

.

.

.

.

.

.

.

.

.

.

. 101 . 102

. 105 107 . 110

. 115 . 115 . 125 . 125 . 126 . 127 . 128 . 130 . 130 . 130 . 133

. 135 . 135 . 136

. 137 . 138

. 139

. 139 139 140

. 140 . 140 . 141 . 142 . 143 . 143

. 144

. 144

. 145

. 145 . 146 . 158

. 160 . 162 . 163 . 164 . 166 . 170 . 173

Remarques . Marques .

.

.

Index .

Publicité

.

.

.

.

.

.

.

.

.

.

.

.

.

.

.

.

.

.

.

.

.

.

.

.

.

.

.

.

.

.

.

.

.

. 175 . 177

.

. 179

Avis aux lecteurs canadiens

Le présent document a été traduit en France. Voici les principales différences et particularités dont vous devez tenir compte.

Illustrations

Les illustrations sont fournies à titre d'exemple. Certaines peuvent contenir des données propres à la France.

Terminologie

La terminologie des titres IBM peut différer d'un pays à l'autre. Reportez-vous au tableau ci-dessous, au besoin.

IBM France

ingénieur commercial

agence commerciale

ingénieur technico-commercial

inspecteur

Claviers

IBM Canada

représentant

succursale

informaticien

technicien du matériel

Les lettres sont disposées différemment : le clavier français est de type AZERTY, et le clavier français-canadien de type QWERTY.

OS/2 et Windows - Paramètres canadiens

Au Canada, on utilise : v

les pages de codes 850 (multilingue) et 863 (français-canadien),

v

v

le code pays 002,

le code clavier CF.

Nomenclature

Les touches présentées dans le tableau d'équivalence suivant sont libellées différemment selon qu'il s'agit du clavier de la France, du clavier du Canada ou du clavier des États-Unis. Reportez-vous à ce tableau pour faire correspondre les touches françaises figurant dans le présent document aux touches de votre clavier.

v

Brevets

Il est possible qu'IBM détienne des brevets ou qu'elle ait déposé des demandes de brevets portant sur certains sujets abordés dans ce document. Le fait qu'IBM vous fournisse le présent document ne signifie pas qu'elle vous accorde un permis d'utilisation de ces brevets. Vous pouvez envoyer, par écrit, vos demandes de renseignements relatives aux permis d'utilisation au directeur général des relations commerciales d'IBM, 3600 Steeles Avenue East, Markham, Ontario, L3R 9Z7.

Assistance téléphonique

Si vous avez besoin d'assistance ou si vous voulez commander du matériel, des logiciels et des publications IBM, contactez IBM direct au 1 800 465-1234.

vi

IBM SPSS Statistics Base 25

Fonctions de base

Les fonctions fondamentales suivantes sont incluses dans IBM® SPSS Statistics Base Edition.

Livre de codes

Le livre de codes indique les informations du dictionnaire, telles que les noms de variables, les libellés de variables, les libellés de valeurs, les valeurs manquantes, ainsi que les statistiques récapitulatives de toutes les variables (ou celles spécifiées) et les jeux de réponses multiples dans le jeu de données actif. Pour les variables ordinales et nominales ainsi que pour les jeux de réponses multiples, les statistiques récapitulatives comprennent les effectifs et les pourcentages. Pour les variables d'échelle, les statistiques récapitulatives comprennent la moyenne, l'écart type et les quartiles.

Remarque : Le livre de codes ignore le statut de fichier scindé. Ceci comprend les groupes de fichiers scindés crées pour l'imputation multiple de valeurs manquantes (disponible dans SPSS Statistics Professional Edition ou l'option Valeurs manquantes).

Pour obtenir un livre de codes 1. A partir des menus, sélectionnez :

Analyse > Rapports > Livre de codes

2. Cliquez sur l'onglet Variables. 3. Sélectionnez une ou plusieurs variables et/ou des jeux de réponses multiples.

Sinon, vous pouvez : v Contrôler les informations de variables affichées. v Contrôler les statistiques affichées (ou exclure toutes les statistiques récapitulatives). v Contrôler l'ordre d'affichage des variables et des jeux de réponses multiples. v Modifier le niveau de mesure de toute variable dans la liste source afin de modifier les statistiques récapitulatives affichées. Pour plus d'informations, voir «Onglet Statistiques du livre de codes», à la page 3.

Modification des niveaux de mesure

Vous pouvez modifier temporairement le niveau de mesure des variables. (Vous ne pouvez pas modifier celui des jeux de réponses multiples. Ils sont toujours traités comme nominaux.) 1. Cliquez avec le bouton droit de la souris sur une variable de la liste source. 2. Sélectionnez un niveau de mesure dans le menu contextuel.

Ceci permet de modifier temporairement le niveau de mesure. Concrètement, cela n'est utile que pour les variables numériques. Le niveau de mesure des variables de chaîne est limité aux variables nominales ou ordinales qui sont traitées de la même façon par la procédure du livre de codes.

Onglet Sortie du livre de codes L'onglet Sortie contrôle les informations de variables disponibles pour chaque variable et jeu de réponses multiples, leur ordre d'affichage et le contenu de la table d'informations des fichiers en option.

Informations sur les variables

Ceci permet de contrôler les informations du dictionnaire affichées pour chaque variable.

© Copyright IBM Corp. 1989, 2017

1

Position : Nombre entier qui représente la position de la variable dans l'ordre des fichiers. Non disponible pour les jeux de réponses multiples.

Libellé : Libellé descriptif associé à la variable ou au jeu de réponses multiples.

Type : Type de données fondamental. Les valeurs admises sont Numérique, Chaîne ou Jeu de réponses multiples.

Format : Format d'affichage de la variable, tel que A4, F8.2 ou DATE11. Non disponible pour les jeux de réponses multiples.

Niveau de mesure : Les valeurs possibles sont Nominale, Ordinale, Echelle et Inconnue. La valeur affichée est le niveau de mesure stocké dans le dictionnaire et elle n'est pas affectée par tout remplacement de niveau de mesure temporaire spécifié en changeant le niveau de mesure dans la liste de variable source de l'onglet Variables. Non disponible pour les jeux de réponses multiples.

Remarque : Le niveau de mesure des variables numériques peut être "inconnu" avant le premier passage de données lorsque le niveau de mesure n'a pas été explicitement défini, par exemple pour la lecture de données à partir d'une source externe ou des variables récemment créées. Pour plus d'informations, voir .

Rôle : Certaines boîtes de dialogue prennent en charge la fonction de présélection de variables pour une analyse basée sur des rôles définis.

Libellés de valeurs : Libellés descriptifs associés à des valeurs de données spécifiques. v Si l'option Effectif ou Pourcentage est sélectionnée dans l'onglet Statistiques, les libellés de valeurs

définis sont compris dans les sorties même si vous ne sélectionnez pas Libellés de valeur ici. v Pour les jeux de dichotomies multiples, les "libellés de valeur" sont les libellés des variables

élémentaires du jeu ou les libellés des valeurs comptées, selon la définition du jeu. Pour plus d'informations, voir .

Valeurs manquantes : Valeurs manquantes définies par l'utilisateur. Si l'option Effectif ou Pourcentage est sélectionnée dans l'onglet Statistiques, les libellés de valeurs définis sont compris dans les sorties même si vous ne sélectionnez pas Valeurs manquantes ici. Non disponible pour les jeux de réponses multiples.

Attributs personnalisés : Attributs de variable personnalisés. Les sorties comprennent à la fois les noms et les valeurs pour tout attribut de variables personnalisé associé à chaque variable. Pour plus d'informations, voir . Non disponible pour les jeux de réponses multiples.

Attributs réservés : Attributs de variables système réservés. Vous pouvez afficher les attributs système, mais vous ne devez pas les modifier. Les noms des attributs système commencent par un signe dollar ($). Les attributs hors affichage, avec les noms qui commencent par "@" ou "$@", ne sont pas inclus. Les sorties comprennent à la fois les noms et les valeurs pour tout attribut système associé à chaque variable. Non disponible pour les jeux de réponses multiples.

Informations sur les fichiers

La table d'informations de fichiers en option peut comprendre l'un des attributs de fichiers suivants :

Nom de fichier : Nom du fichier de données IBM SPSS Statistics. Si le jeu de données n'a jamais été enregistré au format IBM SPSS Statistics, aucun nom de fichier de données n'est disponible. (Si aucun nom de fichier n'est affiché dans la barre de titre de la fenêtre Editeur de données, le jeu de données actif ne comporte pas de nom de fichier.)

Emplacement : Emplacement du répertoire (dossier) du fichier de données IBM SPSS Statistics. Si le jeu de données n'a jamais été enregistré au format IBM SPSS Statistics, aucun n'emplacement n'est disponible.

2

IBM SPSS Statistics Base 25

Nombre d'observations : Nombre d'observations dans le jeu de données actif. Ceci est le nombre total d'observations, y compris celles qui peuvent être exclues des statistiques récapitulatives en raison des conditions de filtrage.

Libellé : Fichier de libellé (si disponible) défini par la commande FILE LABEL.

Documents : Texte de document de fichier de données.

Statut de la pondération : Si la pondération est activée, le nom de la variable de pondération est affiché. Pour plus d'informations, voir .

Attributs personnalisés : Attributs de fichiers de données personnalisés définis par l'utilisateur. Les attributs de fichiers de données sont définis avec la commande DATAFILE ATTRIBUTE.

Attributs réservés : Attributs de fichiers de données système réservés. Vous pouvez afficher les attributs système, mais vous ne devez pas les modifier. Les noms des attributs système commencent par un signe dollar ($). Les attributs hors affichage, avec les noms qui commencent par "@" ou "$@", ne sont pas inclus. Les sorties incluent les noms et les valeurs pour tout attribut de fichiers de données système.

Ordre d'affichage des variables

Les alternatives suivantes sont disponibles pour contrôler l'ordre d'affichage des variables et des jeux de réponses multiples :

Alphabétique : Ordre alphabétique par nom de variable.

Fichier : Ordre d'affichage des variables dans le jeu de données (leur ordre d'affichage dans l'Editeur de données). Dans l'ordre croissant, les jeux de réponses multiples sont affichés en dernier, après toutes les variables sélectionnées.

Niveau de mesure : Tri par niveau de mesure. Ceci crée quatre groupes de tri (nominal, ordinal, échelle et inconnu). Les jeux de réponses multiples sont traités comme nominaux.

Remarque : Le niveau de mesure des variables numériques peut être "inconnu" avant le premier passage de données lorsque le niveau de mesure n'a pas été explicitement défini, par exemple pour la lecture de données à partir d'une source externe ou des variables récemment créées.

Liste des variables : Ordre d'affichage des variables et des jeux de réponses multiples dans la liste des variables sélectionnées de l'onglet Variables.

Nom d'attribut personnalisé : La liste des options d'ordre de tri comprend aussi le nom des attributs de variables personnalisés définis par l'utilisateur. Dans l'ordre croissant, les variables dont le tri des attributs ne figure pas en haut, puis celles dont la valeur n'est pas définie pour l'attribut, puis celles avec des valeurs définies pour l'attribut dans l'ordre alphabétique des valeurs.

Nombre maximal de catégories

Si les sorties comprennent les libellés de valeurs, les effectifs, ou les pourcentages pour chaque valeur unique, vous pouvez supprimer ces informations de la table si le nombre de valeurs dépasse la valeur indiquée. Par défaut, ces informations sont supprimées si le nombre de valeurs uniques de la variable dépasse 200.

Onglet Statistiques du livre de codes L'onglet Statistiques permet de contrôler les statistiques récapitulatives comprises dans les sorties, ou de supprimer entièrement l'affichage des statistiques récapitulatives.

Fonctions de base

3

Nombres et pourcentages

Pour les variables nominales et ordinales, les jeux de réponses multiples et les valeurs de libellé des variables d'échelle, les statistiques disponibles sont :

Effectif. Effectif ou nombre d'observations possédant chaque valeur (ou plage de valeurs) d'une variable.

Pourcentage. Pourcentage d'observations ayant une valeur particulière.

Tendance et dispersion centrales

Pour les variables d'échelle, les statistiques disponibles sont :

Moyenne. Mesure de la tendance centrale. Moyenne arithmétique ; somme divisée par le nombre d'observations.

Ecart type. Mesure de la dispersion des valeurs autour de la moyenne. Dans le cas d'une distribution normale, 68 % des observations se situent à l'intérieur d'un écart type de la moyenne et 95 % se situent à l'intérieur de deux écarts types. Par exemple, si la moyenne d'âge est de 45 avec un écart type égal à 10, une distribution normale verra 95 % des observations se situer entre 25 et 65.

Quartiles. Indique les valeurs correspondant au 25e, 50e et 75e percentiles.

Remarque : Vous pouvez modifier temporairement le niveau de mesure associé à une variable (et par conséquent modifier les statistiques récapitulatives affichées pour cette variable) dans la liste de variables source de l'onglet Variables.

Effectifs

La procédure Effectifs permet d'obtenir des affichages statistiques et graphiques qui servent à décrire de nombreux types de variables. Elle peut jouer un rôle lorsque vous prenez connaissance de vos données.

Pour obtenir un rapport de fréquences et un graphique à barres, vous pouvez trier les différentes valeurs par ordre croissant ou décroissant, ou bien classer les catégories en fonction de leurs fréquences. Le rapport de fréquences peut être supprimé lorsqu'une variable a plusieurs valeurs distinctes. Vous pouvez libeller les graphiques avec des fréquences (par défaut) ou des pourcentages.

Exemple : Quelle est la répartition de la clientèle d'une société selon le type d'industrie dont elle fait partie ? La sortie pourrait vous apprendre que votre clientèle est composée à 37,5 % d'organismes d'état, à 24,9 % de sociétés commerciales, à 28,1 % d'établissements universitaires et à 9,4 % du secteur de la santé. Pour des données continues et quantitatives, comme par exemple les revenus des ventes, vous pourriez constater que la moyenne de vente par produit est de 3 576 € avec un écart type de 1 078 €.

Tracés et statistiques : Effectifs de fréquences, pourcentages, pourcentages cumulés, moyenne, médiane, mode, somme, écart type, variance, plage, valeurs minimale et maximale, erreur standard de la moyenne, asymétrie et kurtosis (avec leurs erreurs standard), quartiles, percentiles choisis par l'utilisateur, graphiques à barres, graphiques circulaires et histogrammes.

Remarques sur les données de fréquences

Données : Utilisez des codes numériques ou alphanumériques pour coder les variables catégorielles (mesures de niveau nominal ou ordinal).

Hypothèses : Les tabulations et les pourcentages fournissent une description utile sur les données de n'importe quelle distribution, particulièrement pour les variables disposant de catégories triées ou non. Certaines des statistiques récapitulatives facultatives, telles que la moyenne et l'écart type, sont fondées

4

IBM SPSS Statistics Base 25

sur la théorie de normalité et sont appropriées pour des variables quantitatives avec une distribution symétrique. Les statistiques de base, telles que la médiane, les quartiles et les percentiles, sont appropriées pour les variables quantitatives, qu'elles répondent ou non au critère de normalité.

Pour obtenir des tables de fréquences 1. A partir des menus, sélectionnez :

Analyse > Statistiques descriptives > Effectifs...

2. Sélectionnez une ou plusieurs variables catégorielles ou quantitatives.

Sinon, vous pouvez : v Cliquer sur Statistiques pour obtenir des statistiques descriptives pour des variables quantitatives. v Cliquer sur Graphiques pour obtenir des graphiques à barres, des graphiques circulaires ou des

histogrammes.

v Cliquer sur Format pour définir l'ordre de présentation des résultats.

Statistiques des effectifs Percentiles : Valeurs d'une variable quantitative qui divisent les données triées en groupes par centième. Les quartiles (25e, 50e et 75e percentiles) divisent les observations en quatre groupes de taille égale. Si vous souhaitez un nombre égal de groupes différent de quatre, sélectionnez Partition en n groupes égaux. Vous pouvez également spécifier des percentiles particuliers (par exemple, le 95e percentile, valeur au-dessus de 95 % des observations).

Tendance centrale : Les statistiques décrivant la position de la distribution comprennent la Moyenne, la Médiane, le Mode et la Somme de toutes les valeurs. v Moyenne. Mesure de la tendance centrale. Moyenne arithmétique ; somme divisée par le nombre

d'observations.

v Médiane. Valeur au-dessus et au-dessous de laquelle se trouve la moitié des observations (50e

percentile). Si le nombre d'observations est pair, la médiane correspond à la moyenne des deux observations du milieu lorsqu'elles sont triées dans l'ordre croissant ou décroissant. La médiane est une mesure de tendance centrale et elle n'est pas, à l'inverse de la moyenne, sensible aux valeurs éloignées. v Mode. Valeur qui revient le plus fréquemment. Si plusieurs valeurs partagent la plus grande fréquence d'occurrence, chacune d'elles constitue un mode. La procédure Effectifs ne rend compte que du plus petit mode.

v Somme. Somme ou total des valeurs, pour toutes les observations n'ayant pas de valeur manquante.

Dispersion : Les statistiques mesurant la variance ou la dispersion dans les données, comprennent l'écart type, la variance, la plage, le minimum, le maximum et l'erreur standard (ES) de la moyenne. v Ecart type . Mesure de la dispersion des valeurs autour de la moyenne. Dans le cas d'une distribution

normale, 68 % des observations se situent à l'intérieur d'un écart type de la moyenne et 95 % se situent à l'intérieur de deux écarts types. Par exemple, si la moyenne d'âge est de 45 avec un écart type égal à 10, une distribution normale verra 95 % des observations se situer entre 25 et 65.

v Variance. Mesure de la dispersion des valeurs autour de la moyenne, égale à la somme des carrés des

écarts par rapport à la moyenne, divisée par le nombre d'observations moins un. La variance se mesure en unités, qui sont égales au carré des unités de la variable.

v Plage. Différence entre la valeur maximale et la valeur minimale d'une variable numérique (maximum

- minimum).

v Minimum. Plus petite valeur d'une variable numérique. v Maximum. Plus grande valeur d'une variable numérique. v Erreur standard de la moyenne. Mesure du taux de variation de la valeur de la moyenne sur des

échantillons provenant de la même distribution. Cette mesure permet de comparer approximativement

Fonctions de base

5

la moyenne observée avec une valeur hypothétique (autrement dit, vous pouvez conclure que ces deux valeurs sont différentes si le rapport de la différence avec l'erreur standard est inférieur à -2 ou supérieur à +2).

Distribution : L'asymétrie et kurtosis sont des statistiques qui décrivent la forme et la symétrie de la distribution. Ces statistiques sont présentées avec leurs erreurs standard. v Asymétrie. Mesure de l'asymétrie d'une distribution. La distribution normale est symétrique et a une valeur d'asymétrie égale à 0. Une distribution caractérisée par une importante asymétrie positive présente une partie droite plus allongée. Une distribution caractérisée par une importante asymétrie négative présente une extrémité gauche plus allongée. Pour simplifier, une valeur d'asymétrie deux fois supérieure à l'erreur standard correspond à une absence de symétrie.

v Kurtosis. Mesure de l'étendue de la présence de valeurs extrêmes. Dans le cas d'une distribution

normale, la valeur de la statistique kurtosis est égale à zéro. Un kurtosis positif indique qu'on observe dans les données plus de valeurs extrêmes que dans une distribution normale. Un kurtosis négatif indique qu'on y observe moins de valeurs extrêmes que dans une distribution normale.

Valeurs sont des centres de groupes : Si les valeurs dans vos données représentent des centres de groupes (par exemple, les âges des individus trentenaires sont représentés par le code 35), sélectionnez cette option pour estimer la médiane et les percentiles des données originales, non regroupées.

Graphiques des effectifs Type de graphique : Un graphique circulaire montre la participation de chaque partie à l'ensemble. Chaque tranche du graphique circulaire correspond à un groupe défini par une simple variable de regroupement. Un graphique à barres montre l'effectif de chaque valeur ou de chaque catégorie sous la forme d'une barre distincte, ce qui vous permet de comparer les catégories visuellement. Un histogramme est également constitué de barres mais ils sont répartis à intervalles égaux. La hauteur de chaque barre représente l'effectif des valeurs d'une variable quantitative appartenant à l'intervalle. Un histogramme montre la forme, le centre et la dispersion de la distribution. Si vous superposez une courbe normale sur l'histogramme, vous pouvez déterminer si les données sont distribuées normalement.

Valeurs du graphique : Dans les graphiques à barres, l'axe peut être libellé par effectifs ou pourcentages de fréquences.

Format des effectifs Ordre d'affichage : La table de fréquences peut être affichée en fonction des valeurs réelles des données ou de l'effectif (fréquence d'occurrence) de ces valeurs, et organisée par valeurs croissantes ou décroissantes. Cependant, si vous demandez un histogramme ou des percentiles, le format des effectifs part du principe que la variable est quantitative et affiche ses valeurs par ordre croissant.

Variables multiples : Si vous créez des tableaux statistiques pour des variables multiples, vous pouvez afficher toutes les variables dans un tableau unique (Comparer variables) ou bien afficher un tableau statistique séparé pour chaque variable (Séparer la sortie par variables).

Supprimer les tableaux comportant plusieurs catégories : Cette option évite l'affichage des tableaux ayant plus que le nombre spécifié de valeurs.

descriptives

La procédure Descriptives affiche les statistiques récapitulatives univariées pour plusieurs variables en un seul tableau et calcule les valeurs standardisées (scores z). Les variables peuvent être ordonnées en fonction de la taille de leurs moyennes (en ordre ascendant ou descendant), alphabétiquement ou selon l'ordre dans lequel vous avez sélectionné les variables (par défaut).

6

IBM SPSS Statistics Base 25

Lorsque les scores z sont enregistrés, ils sont ajoutés aux données dans l'éditeur de données et sont disponibles pour les graphiques, les listes de données et les analyses. Lorsque les variables sont enregistrées avec des unités différentes (par exemple, produit domestique brut par personne et pourcentage de la population sachant lire et écrire), une transformation en score z place les variables sur une échelle commune pour que la comparaison soit plus facile.

Exemple : Si chaque observation dans vos données contient les totaux des ventes quotidiennes pour chacun des membres du personnel commercial (par exemple, une entrée pour Bob, une pour Kim et une pour Brian) rapportés chaque jour pendant plusieurs mois, la procédure Descriptives peut calculer les ventes quotidiennes moyennes pour chacun des membres du personnel et ordonner les résultats de la moyenne des ventes la plus élevée à la plus basse.

Statistiques : Taille de l'échantillon, moyenne, minimum, maximum, écart type, variance, plage, somme, erreur standard de la moyenne, et kurtosis et asymétrie avec leurs erreurs standard (ES).

Remarques sur les données de Descriptives

Données : Utilisez des variables numériques après les avoir visualisées graphiquement en cherchant des erreurs d'enregistrement, les valeurs extrêmes et les anomalies de distribution. La procédure Descriptives est très efficace pour les gros fichiers (milliers d'observations).

Hypothèses : La plupart des statistiques disponibles (y compris le