miércoles, 10 de junio de 2009
Sistemas de compresion. Mp3 y OGG
MPEG-1 Audio Layer 3, más conocido como MP3, es un formato de audio digital comprimido CON PERDIDAdesarrollado por el MOVING PICTURE EXPRETS GROUP (MPEG) para formar parte de la versión 1 (y posteriormente ampliado en la versión 2) del formato de vídeo MPEG.
El mp3 estándar es de 44 KHz y tiene un bitrate de 128 kbps por la relación de calidad/tamaño.
MP3 fue el primer formato de compresión de audio popularizado gracias a Internet, ya que hizo posible el intercambio de archivos de audio. Tras el desarrollo de reproductores autónomos, portátiles o integrados en cadenas musicales (estéreos), el formato MP3 llega más allá del mundo de la informática.
El formato MP3 se convirtió en el estándar utilizado para streaming de audio y compresión de audio de alta calidad (con pérdida en equipos de alta fidelidad) gracias a la posibilidad de
ajustar la calidad de la compresión, proporcional al tamaño por segundo (bitrate), y por tanto el tamaño final del archivo, que podía llegar a ocupar 12 e incluso 15 veces menos que el archivo
original sin comprimir.
Esta caracteristica del archivo comprimido (cantidad de bits por segundo) es la determina su calidad y se denomina BITRATE
A principios de 2002 otros formatos de audio comprimido como Windows Media Audio y Ogg Vorbis empiezan a ser masivamente incluidos en programas, sistemas operativos y reproductores autónomos, lo que hizo prever que el MP3 fuera paulatinamente
cayendo en desuso, en favor de otros formatos, como los mencionados, de mucha mejor calidad.
Uno de los factores que influye en el declive del MP3 es que tiene patente. Técnicamente no significa que su calidad sea inferior ni superior, pero impide que la comunidad pueda seguir mejorándolo y puede obligar a pagar por la utilización de algún códec, esto es
lo que ocurre con los reproductores de MP3.
Nuevos formatos, como OGG Vorbis, no tienen licencia, sino que son SOFTWARE libre. Por eso pueden ser utilizados y mejorados sin condiciones. Aun así, a inicios del 2008, el formato mp3
continua siendo el más usado y el que goza de más éxito.
Mp3 - El modelo psicoacuitivo y umbral de enmascaramiento
La compresión se basa en la reducción del margen dinámico irrelevante, es decir, en la incapacidad del sistema auditivo para detectar los errores de cuantificación en condiciones de
enmascaramiento.
Como vimos en clase, el oido humano tiene por sus caracteristicas, un umbral de enmascaramiento perceptivo. Si un avion pasara cerca nuestro mientras hablamos, el sonido que produce es capas de ¨tapar¨ nuestra voz. Los mismo pasa si una nota DO fortisimo, en trompeta, suena al mismo tiempo que una nota DO pianisimo en un violin: el DO de la trompeta, enmascara al DO del violin, que no se escucha.
Esto se debe a la anatomia del sistema auditivo humano: si dos sonidos de frecuencia igual son emitidos, uno con mayor amplitud (volumen) que el otro, el sonido de mayor amplitud emascara al de amplitud (volumen) que el otro.
El modelo psicoacustico, es un estándar promedio que divide la señal en bandas de frecuencia que se aproximan,y luego cuantifica cada subbanda en función del umbral de detección del ruido dentro de esa banda. Este modelo, analiza la señal de audio y calcula la cantidad de ruido que se puede introducir en función de la frecuencia, es decir, calcula la “cantidad de enmascaramiento” o
umbral de enmascaramiento en función de la frecuencia. Luego, el codificador usa esta información para decidir la mejor manera de gastar los bits disponibles.
Los estudios demuestran que la distorsión generada es imperceptible para el oído experimentado en un ambiente óptimo desde los 256 kbps y en condiciones normales. Para el oído no experimentado, o común, con 128 kbps o hasta 96 kbps basta para que se oiga "bien" (a menos que se posea un equipo de audio de alta calidad donde se nota excesivamente la falta de graves y se destaca el sonido de "fritura" en los agudos).
En personas que escuchan mucha música o que tienen experiencia en la parte auditiva, desde 192 o 256 kbps basta para oír bien. La música que circula por Internet, en su mayoría, está codificada entre 128 y 192 kbps.
Sistema de compresion con y sin perdida
APE y FLAC: audio comprimido sin pérdidas
Como vimos anteriormente, los sistemas compresion como MP3, y OGG comprimen nuestros archivos de audio, pero con perdida de información. Nuestro archivo nuevo, no se escucha igual que el archivo original. Depende de nuestro nivel de educacion auditiva, y de la fidelidad de nuestro equipo que podamos percibir esas diferencias
Existen ademas, otros tipos de compresion LOSSLESS, o sin perdida. En estos casos, el archivo pesa menos que el original y no hay modificaciones, no se pierde informacion. Los dos formatos mas conocidos son FLAC y APE.
Flac (o Free Lossless Audio Codec) es, como su nombre en inglés lo indica, un códec de audio de compresión sin pérdida que es libre, lo que significa que, a diferencia de MP3, AAC, Ogg u otros, no existe pérdida de información desde la fuente de audio, lo que lo convierte en un formato ideal para colecciones de muy alta calidad o para respaldar aquellos tus discos más valiosos, ya que permite reconstruir el audio original en su totalidad.
Las canciones comprimidas en este formato pesan alrededor de 70% a 50% del original, bastante más eficiente que utilizar un formato de compresión general (como ZIP) aunque menos que lo que se puede lograr con códecs de compresión con pérdida.
Los archivos FLAC son reproducibles en una gran cantidad de reproductores para PC (Windows y Linux) y Mac, además de varios dispositivos portátiles gracias a Rockbox (entre ellos, el iPod). En el caso de los archivos APE, necesitamos instalar un codec no libre (monkey´s ape)