Compresión multimedia (JPEG, MP3, vídeo)

Nivel AvanzadoDificultad ★★★★★Aplicación⌖ Ver en el mapa

¿Qué es?

Transformar la señal a una base en la que la mayoría de coeficientes son diminutos (transformadas del coseno, wavelets), cuantizarlos con brusquedad donde el ojo o el oído no lo notarán y codificar el resto por entropía. El vídeo añade compensación de movimiento entre fotogramas.

Fórmulas

Xk=∑n=0N−1xncos⁡[πN(n+12)k]X_k = \sum_{n=0}^{N-1}x_n\cos\Big[\frac{\pi}{N}\Big(n + \frac12\Big)k\Big]
DCT-II, la transformada de JPEG (en bloques de 8×8)

Las matemáticas que hay detrás

  • Series de Fourier★★★★★frecuente

    JPEG y MP3 usan transformadas del coseno (DCT/MDCT), parientes cercanas de las series de Fourier, y descartan los coeficientes pequeños.

  • Wavelets (ondículas)★★★★★frecuente

    JPEG 2000 y muchos formatos de imagen médica y científica usan transformadas wavelet.

  • Fractales★★★★★histórica

    La compresión fractal de imágenes (años 90) codificaba imágenes como aplicaciones autosemejantes; se abandonó en favor de la codificación por transformada.

Esta página tiene lo esencial. Un desarrollo más completo (intuición, definición formal, ejemplo resuelto) está en camino.

↑ ↓ para navegar · ↵ · Esc