Définition
L'intervalle de temps écoulé entre le moment où une unité de données spécifique (paquet, trame ou message) est émise par un émetteur et le moment où cette même unité est reçue et disponible à la destination ; généralement mesuré en sens unique et distinct du débit ou de la perte.
Principe
Principe
La latence est une propriété temporelle additive : la latence aller‑simple de bout en bout est la somme des délais composants (propagation, transmission, traitement, mise en file) sur le chemin choisi et limite ainsi directement la réactivité interactive.
Démonstration
Démonstration
Scénario illustratif → Un paquet voix en temps réel est horodaté à l'émetteur et observé au récepteur (mesure illustrée avec horloges synchronisées). Reconnaissance → Le délai aller‑simple mesuré est de 80 ms. Action → L'opérateur identifie une file d'attente congestionnée sur un routeur intermédiaire et priorise le trafic voix pour réduire la mise en file. Conséquence → La latence aller‑simple observée passe à 40–50 ms et l'interactivité perçue s'améliore.
Mauvaise application
Mauvaise application
Confondre latence et bande passante ou supposer qu'une faible bande entraîne une forte latence ; ou supposer que la latence aller‑simple est la moitié du RTT sans vérifier la symétrie du chemin ou la synchronisation des horloges.
Conséquence
Conséquence
Une latence plus élevée augmente le temps de réponse, dégrade l'interactivité des applications temps réel (voix, commande distante, interfaces interactives) et influence les performances des protocoles (par ex. le produit bande passante–latence requiert des fenêtres d'émission plus larges pour un débit efficace).
Inversion
Inversion
Quand l'objectif est le transfert massif de données, le débit disponible gouverne davantage le temps de transfert que de petites réductions de latence ; inversement, certaines applications acceptent plus de latence si cela améliore la robustesse ou l'efficacité spectrale.
Limite
Limite
Clairement dans : temps mesuré aller‑simple pour un paquet de TX à RX. Cas limite : la latence au niveau applicatif « requête–réponse » qui incorpore le temps de traitement aux points terminaux en plus du délai réseau. Clairement hors : mesures de capacité de canal (bits/s), taux de perte de paquets ou occupation spectrale.
Tension sémantique
Tension sémantique
Latence ↔ Débit/Bande passante — réduire la latence peut contrarier des techniques (p. ex. intercalage profond, codage lourd) qui augmentent le débit ou la robustesse, imposant des compromis.
Synthèse
Synthèse
La latence est le coût temporel par trame qui détermine la réactivité ; elle se compose à travers les éléments du réseau et doit être gérée conjointement au débit et à la fiabilité pour satisfaire les exigences applicatives.