Module 1 : Introduction à la biostatistique

Concepts fondamentaux et statistiques descriptives

Objectifs du module

A l’issue de ce module, vous serez capables de :

  1. Définir la biostatistique et son rôle
  2. Classifier les types de données
  3. Calculer les mesures de tendance centrale
  4. Calculer les mesures de dispersion
  5. Utiliser R et SPSS pour ces calculs

Qu’est-ce que la biostatistique ?

Application des méthodes statistiques aux données issues des sciences biologiques, médicales et de la santé publique.

Rôle : transformer des données brutes en connaissances exploitables pour la prise de décision en santé.

Les deux grandes familles

Descriptive

  • Résumer les données
  • Tableaux, graphiques
  • Moyennes, proportions
  • “42% des patients sont hypertendus”

Inférentielle

  • Généraliser à la population
  • Tests d’hypothèses
  • Intervalles de confiance
  • “Le traitement A est significativement plus efficace (p < 0.05)”

Types de variables

Type Exemple Mesure adaptée
Continue Poids, glycémie Moyenne, écart-type
Discrète Nb consultations Moyenne, médiane
Nominale Groupe sanguin Mode, proportions
Ordinale Stade cancer Médiane, mode

Mesures de tendance centrale

Moyenne

\[\bar{x} = \frac{1}{n} \sum_{i=1}^{n} x_i\]

Médiane

Valeur centrale de la série ordonnée

Mode

Valeur la plus fréquente

Exemple : poids de 5 patients

Données : 62, 70, 68, 75, 65 kg

Calcul

  • Moyenne = 68 kg
  • Médiane = 68 kg
  • Étendue = 13 kg

Code R

poids <- c(62, 70, 68, 75, 65)
mean(poids)    # 68
median(poids)  # 68
range(poids)   # 62 75

Mesures de dispersion

Mesure Formule Interprétation
Étendue \(x_{max} - x_{min}\) Sensible aux extrêmes
Variance \(s^2 = \frac{\sum(x_i-\bar{x})^2}{n-1}\) Unité au carré
Écart-type \(s = \sqrt{s^2}\) Même unité que les données
CV \(\frac{s}{\bar{x}} \times 100\) Sans unité, comparable

Coefficient de variation

Interprétation du CV :

  • CV < 15% : données homogènes
  • 15% ≤ CV ≤ 30% : dispersion modérée
  • CV > 30% : données hétérogènes

Le CV permet de comparer la variabilité entre des variables d’unités différentes.

Dans SPSS

Via les menus

  1. Analyse > Statistiques descriptives > Descriptives…
  2. Sélectionner les variables
  3. Options : cocher les statistiques souhaitées
  4. OK

Syntaxe

DESCRIPTIVES
  VARIABLES=poids taille
  /STATISTICS=MEAN STDDEV
    MIN MAX VARIANCE.

Quartiles et boxplot

poids <- c(62, 70, 68, 75, 65)
summary(poids)
boxplot(poids, main = "Distribution du poids",
        ylab = "Poids (kg)")
  • Q1 : 25% des valeurs en dessous
  • Q2 (médiane) : 50% des valeurs
  • Q3 : 75% des valeurs en dessous
  • IQR = Q3 - Q1

Résumé

Concept Ce qu’il faut retenir
Biostatistique Statistiques appliquées aux sciences de la santé
Types de données Quantitatives (continues/discrètes) vs Qualitatives (nominales/ordinales)
Tendance centrale Moyenne (symétrique), Médiane (robuste), Mode (qualitatives)
Dispersion Écart-type (même unité), CV (comparaison entre variables)

Prochaine étape

Module 2 : Concepts de probabilités

  • Lois de probabilités
  • Distributions binomiale, normale, Poisson
  • Applications biomédicales