Définition
Technique appliquée à un point de sortie (hôte, routeur ou équipement de bord) qui met en tampon et planifie l’émission de paquets pour appliquer un profil de trafic spécifié (débit, rafale ou chronologie), généralement implémentée par token bucket, leaky bucket ou pacing, afin de réduire la rafale et d’aider la gestion des files en aval.
Principe
Principe
En contraignant le schéma temporel d’émission des paquets à un profil configuré, le modelage transforme des arrivées rafales en un flux de sortie plus lisse, diminuant les pics instantanés de file en aval et améliorant la perte de paquets et la latence en situation de contention.
Démonstration
Démonstration
Scénario illustratif → Un équipement de bord applique un shapeur token‑bucket avec débit long terme R et rafale B ; lors d’une montée de trafic, les paquets excédentaires sont mis en tampon et relâchés au débit R (dans l’allocation B) ou retardés ; conséquence → les files en aval subissent moins de pics, réduisant les pertes aux sauts congestionnés mais ajoutant un retard contrôlé.
Mauvaise application
Mauvaise application
Confondre modelage et policing : croire qu’ils sont équivalents (le policing impose des limites en supprimant ou en re‑marquant les paquets non conformes immédiatement, tandis que le modelage les retarde pour qu’ils respectent le profil), ou supposer que le seul modelage élimine la congestion indépendamment de la demande agrégée.
Conséquence
Conséquence
Un modelage adéquat réduit la perte de paquets et le jitter en aval, améliore l’équité d’ordonnancement et peut aider à respecter des SLA ; toutefois, il introduit du buffering et du retard qui peuvent nuire au trafic sensible à la latence si mal réglés, et un modelage excessif peut provoquer une accumulation de délai en tête de file.
Inversion
Inversion
Dans des environnements à latence ultra‑basse (p. ex. certaines boucles de contrôle temps réel), le buffering induit peut être inacceptable et la suppression de paquets ou l’ordonnancement prioritaire peut être préférable ; lorsque la charge agrégée dépasse la capacité de façon soutenue, le modelage ne peut empêcher la congestion — il ne fait que redistribuer le retard et peut déplacer la congestion en amont.
Limite
Limite
Dans la définition : modelage en sortie au niveau provider/customer, implémentations token‑bucket/pacing par flux ou agrégat. Cas limite : modelage par utilisateur vs modelage agrégé par service où des rafales utilisateur sont tolérées. Hors définition : policing qui impose un débit par suppression immédiate ou limites administratives sans buffering.
Tension sémantique
Tension sémantique
Tension entre lissage (qui exige du buffering et augmente la latence) et latence faible bout‑à‑bout : un lissage plus fort réduit la rafale mais augmente le retard et la mémoire tampon ; un lissage moindre préserve la latence mais laisse passer des pics en aval.
Synthèse
Synthèse
Le modelage du trafic est un mécanisme de conformité temporelle : il échange capacité de tampon et retard contrôlé à la sortie contre une réduction des rafales et un meilleur comportement en aval, et doit être équilibré avec les exigences de latence et les contraintes de capacité agrégée.