Devoir Surveillé

Machine Learning · exam

Browse all intelligence artificielle et données documents

Devoir Surveillé

Matière : Machine Learning

Enseignant(es)

Filière / Classe

: W.Barhoumi

: MP BADS

Date

Durée

: 19/04/2020

Advertisement

: 1h

Exercice 1

Estimation du profit d’une entreprise informatique. Source: Thompson, B. & Thompson, W. "Finding

Rules in Data", BYTE, 11, 1986, p. 149 - 158.

Voici les données dont vous disposez pour construire l’arbre de décision (la variable « à expliquer »

est « Profil »).

1. Décrire l’algorithme de l’arbre de décision.

2. Construire l’arbre de décision en utilisant le critère de choix de variables : CART

(Classification And Regression Tree : Indice de Gini ) ou bien Entropie.

Advertisement

3. Donner les avantages et les inconvénients de cette méthode prédictive.

4. Evaluer la qualité du l’estimation du profil produite par l’arbre obtenu.

Exercice 2

On s’intéresse à expliquer l’investissement des entreprises (Y) en fonction de la variable stock de

capital (X), à partir des données statistiques relatives à 27 entreprises industrielles pour une année

donnée. On se propose en premier lieu d’étudier la liaison entre l’investissement et le stock de capital

en mettant en œuvre une régression linéaire simple.

Voici les principales sorties obtenus par un logiciel de data science :

Coefficients:

Advertisement

Estimate Std. Error

-261.0362 52.3780

3.5588 0.5197

Residual standard error: 6.401 on 25 degrees of freedom

Multiple R-Squared: 0.7227, Adjusted R-squared: 0.7072

.

1. Donner les formules et les valeurs des deux paramètres

et

2. Donner les hypothèses relatives aux erreurs de spécification.

Advertisement

3. Evaluer la qualité de la régression estimée.

. Interpréter.

…Bon travail.

01*1YX0101