Codificación y compresión de contenidos. Algoritmos

El más conocido de los «Algoritmos de diccionario adaptables» se emplea en varios de los  formatos de fichero de imágenes más habituales como GIF, TIFF o PDF -> Lempel-Ziv Welch

El algoritmo LZW (Lempel-Ziv-Welch) es un algoritmo de compresión sin pérdida basado en un diccionario adaptable.

Se utiliza (o se ha utilizado históricamente) en formatos como:

  • ✅ GIF
  • ✅ TIFF
  • ✅ PDF (como una de las opciones de compresión)
  • UNIX compress

La idea fundamental es que va construyendo dinámicamente un diccionario de secuencias repetidas a medida que procesa los datos.

Run Length Encoding (RLE) -> También es un algoritmo de compresión sin pérdida, pero:

  • no utiliza un diccionario;
  • codifica secuencias repetidas (AAAAAA → A6).

Se usa en:

  • Algunos TIFF.
  • BMP.
  • PCX.

La Transformada de Fourier sirve para:

  • análisis de frecuencias;
  • procesado de señales;
  • visión artificial.

Esquema muy útil para estudiar

Compresión sin pérdida

LZW

  • Diccionario adaptable.
  • GIF.
  • TIFF.
  • PDF.

RLE

  • Cuenta repeticiones.
  • Muy simple.

Ejemplo:

AAAAABBBBCCCC

↓

A5 B4 C4

Compresión con pérdida

Ejemplos:

  • JPEG.
  • MP3.
  • MPEG.

No confundir

AlgoritmoTipoUso
LZWSin pérdidaGIF, TIFF, PDF
RLESin pérdidaBMP, TIFF
HuffmanSin pérdidaJPEG (una fase), ZIP
JPEGCon pérdidaFotografías
PNGSin pérdidaImágenes web

Truco para recordar

LZW

Libro (diccionario)

Va guardando palabras (secuencias) para reutilizarlas.