Définition
Processus qui transforme une source d'information stochastique en une suite de symboles de code pour réduire le nombre moyen de bits nécessaires à la représentation de la source en identifiant et en supprimant les redondances statistiques ou structurelles à la source ; comprend des mappages sans perte et avec perte, et se définit par un modèle de source, un critère de distorsion (le cas échéant) et des contraintes d'implémentation.

Principe

Principe
Le coût de représentation peut être réduit dans la mesure où la source présente une structure prévisible ; la longueur moyenne optimale de description est bornée inférieurement par l'entropie de la source (pour le codage sans perte) ou par les limites taux–distorsion (pour le codage avec perte).

Démonstration

Démonstration
Situation : Un capteur produit la plupart du temps la même valeur répétée. Reconnaissance : la distribution de sortie est fortement biaisée. Action : concevoir un codage à longueur variable ou une chaîne transformée-plus-quantifiée qui attribue des mots de code courts aux valeurs fréquentes (ou sparsifie puis quantifie les composantes dominantes). Conséquence : moins de bits par relevé en moyenne ; en codage avec perte, on échange de la fidélité contre le débit selon le critère de distorsion choisi.

Mauvaise application

Mauvaise application
Considérer le codage source comme une méthode de correction d'erreurs de canal (confondre compression et correction d'erreurs). L'erreur sémantique est de confondre la réduction représentative (suppression de redondance) avec l'ajout de redondance pour la fiabilité ; les deux poursuivent des objectifs opérationnels opposés.

Conséquence

Conséquence
Bien appliqué, le codage source réduit l'utilisation des ressources de stockage et de transmission mais peut augmenter les coûts de calcul, la latence et la sensibilité au décalage du modèle de source ; en codage avec perte, il modifie aussi la fidélité du signal selon la métrique de distorsion.

Inversion

Inversion
Si les statistiques de la source sont inconnues, non stationnaires ou disponibles seulement en un exemplaire, les schémas universels ou en ligne peuvent être nettement moins performants que les codages basés sur un modèle ; de même, lors d'une transmission sur un canal bruité sans protection adéquate, les gains de compression peuvent accroître le taux d'erreur effectif et exiger une conception source–canal conjointe.

Limite

Limite
Clairement dans : compression sans perte de type Huffman ou Lempel–Ziv appliquée à une source discrète modélisée. Cas limite : codage par transformée (p. ex. transformée par blocs + quantification) où le choix de la transformée et la quantification interagissent avec le codage entropique ultérieur. Claire­ment hors : codage de canal et modulation, dont l'objectif est la fiabilité et l'adaptation au milieu physique plutôt que la minimisation représentative.

Tension sémantique

Tension sémantique
Efficacité de compression ↔ complexité de calcul et latence ; pour le codage avec perte : débit (taux) ↔ fidélité (distorsion).

Synthèse

Synthèse
Le codage source convertit la structure prévisible de la source d'information en un nombre réduit de symboles ; sa valeur pratique dépend de l'adéquation entre le modèle de source, les critères de distorsion et les contraintes système choisis.