Mostrando entradas con la etiqueta download. Mostrar todas las entradas
Mostrando entradas con la etiqueta download. Mostrar todas las entradas

jueves, julio 12, 2007

Ingenieria inversa para la web 2.0 (II)

Esta es la segunda parte de mi reciente post Ingeniería inversa para la web 2.0, y es debido a que shinchandmc me dijo en un comentario que mi script fallaba, me dejo una url con la que mi script no funcionaba bien, y llevaba razón, nada mas ver la url lo supe. Mi respuesta la podéis leer en los comments de ese post, pero de todas formas voy a explicar un poco mas despacio porque falla, que falla y como lo he arreglado.

Mirar estas dos urls, la primera es la que puso sinchandmc y la segunda la que yo use en mi ejemplo y la que use durante la elaboración del script:

http://mp3tube.net/musics/Black-eyed-peace-Pump-it/45/
http://www.mp3tube.net/es/musics/Camaron-Como-el-agua/4844/

Mi script lo que fallaba en mi script es la parte donde obtiene el nombre de la canción, mirar esta línea:

NOMBRE=$(echo $1 | cut -f6 -d"/")

Lo que hace es dividir la url (el argumento 1, $1) según los símbolos "/", y se queda con la sexta parte, tomemos mi ejemplo:

http:, , www.mp3tube.net, es, musics, Camaron-Como-el-agua, 4844

Si contamos, "Camaron-Como-el-agua" es el número seis, y es con el que se queda el comando cut y lo que se almacena en la variable $NOMBRE. Sin embargo, tomemos ahora la url de shinchandmc:

http:, , mp3tube.net, musics, Black-eyed-peace-Pump-it, 45

Si contamos, el trozo número seis es "45" y no el nombre de la canción, esto es debido a que en la primera url había un trozo más, el "es" y en esta no lo hay, por lo que al haberme basado en la url que si incluye ese dato el script no funcionará bien con los que no tengan dicho dato.

Antes de ponerme a pensar una solución debía comprobar cuantos tipos de url hay en esa web, porque yo quiero que mi script sea universal, no que solo valga para algunas versiones de la web. Nada mas entrar en la web le di a una canción de la lista last music para comprobar como era la url, esta url no tenía ni "es" ni nada parecido. Luego probé eligiendo la versión en español de la web, ahora todas las canciones llevaban el "es" y por último probé la versión brasileña, en esta ocasión lo que se incluía era "br". La versión en inglés, la internacional, no incluye nada de ese estilo. Quedaba hacer una comprobación mas si yo tomo una url con el "es" o con "br" y se lo quito qué pasaría, lo hice y siguió funcionando bien, podía oir la canción tranquilamente, lo mismo pasa a la inversa, si yo tomo una url "internacional" sigue funcionando si le añado "br" o "es". Podéis comprobarlo entrar en estas tres páginas:

http://www.mp3tube.net/musics/Camaron-Como-el-agua/4844/
http://www.mp3tube.net/es/musics/Camaron-Como-el-agua/4844/
http://www.mp3tube.net/br/musics/Camaron-Como-el-agua/4844/

Entonces, la solución es de lo mas obvia, hay que identificar de alguna manera las url y ver cuales llevan "es" o "br" y cuales no, después mediante cut se usará -f6 para las primeras y -f5 para las segundas. La forma de hacerlo que a mi se me ha ocurrido es coger con cut el trozo número 4, el que corresponde a "es" y "br", pero en las url que no llevan ese parámetro sería "musics" en lugar de "es" o "br". Esta es la teoría, el pseudocódigo. Ahora vamos a programarlo de verdad.

Primero creamos una variable, en la que se almacenará el valor del trozo número 4, es decir o "es" o "br" o "musics", será la variable $TYPE:

TYPE=$(echo $1 | cut -f4 -d"/")

A continuación un simple if nos solucionará el problema:

Si $TYPE es igual a "es" -> cut va con -f6
Si $TYPE es igual a "br" -> cut va con -f6
Si $TYPE es igual a otra cosa -> cut va con -f5

if [ $TYPE = "es" ] ; then
 NOMBRE=$(echo $1 | cut -f6 -d"/")

elif [ $TYPE = "br" ] ; then

 NOMBRE=$(echo $1 | cut -f6 -d"/")

else

 NOMBRE=$(echo $1 | cut -f5 -d"/")
fi

Y por último, con la variable nombre elegida de forma correcta se cambia el nombre del archivo descargado:

mv $CANCION.tube $NOMBRE.mp3

Y para acabar sale un mensaje diciendo que el archivo $NOMBRE.mp3 ha sido guardado:

echo "El archivo $NOMBRE.mp3 ha sido guardado"

Esa es la solución que he programado, sin embargo se me ocurrieron otras dos mal útiles y elegantes, os pongo pseudocódigo porque no se programarlo así que no puedo poner otra cosa:

Otra forma de haberlo hecho hubiera sido poner solo un if/else y no un if/elif/else, así:

-Si $TYPE es igual a "es" o a "br" -> cut va con -f6
-Si $TYPE es igual a otra cosa -> cut va con -f5

El problema es que no sabía como poner ese parámetro lógico "o", así que esta no he podido hacerla.

Y la última solución, y para mi la mejor, sería usando comodines:

-Si $TYPE es igual a dos caracteres cualesquiera -> cut va con -f6
-Si $TYPE es igual a otra cosa -> cut va con -f5

Pero claro el problema es que tampoco se como ponerle el comodín necesario, ésta solución es la mejor por una razón básicamente: vale para siempre, si para las url "internacionales" sirve y también vale para las url de cualquier nuevo país que se añada a la lista, por ejemplo si ahora sacan una versión en francés ese parámetro sería "fr", mi script actualmente no funcionaría bien con eso, solo entiende de "es" y de "br". Sin embargo esta última solución es compatible con cualquiera porque solo comprueba que $TYPE es igual a dos caracteres, los que sean, y como todos los países se pueden representar con 2 letras pues ya estaría todo solucionado.

Si averiguo como solucionar ese pequeño problema lo haré y todos contentos :D

Para acabar comunicar una cosa, el nuevo script se puede descargar de aquí:

http://neobiusnet.googlepages.com/mp3tube.sh

Y cada vez que haya alguna actualización se podrá descargar desde ahí, porque las nuevas versiones siempre las voy a subir como mp3tube.sh, las antiguas tendrán un número adecuado, la primera versión todavía puede descargarse desde aquí:

http://neobiusnet.googlepages.com/mp3tube0.1.sh

Aunque no os lo recomiendo porque no funciona bien.

martes, julio 10, 2007

Ingenieria inversa para la web 2.0

Ayer, buscando en google una canción en mp3, llegué a una curiosa página, mp3tube.net, que es web estilo estilo youtube pero para alojar mp3s, tiene un reproductor flash para reproducir las canciones y no permite descargar las canciones, pero claro yo aunque quizás hubiera sido mejor descargar la canción mediante p2p ya que me había encontrado con esto no quería dejarlo así, quería averiguar donde estaban guardados los mp3s para poder descargarmelo.

Lo primero que hice fue echarle un vistazo al código fuente, quizás estuviera la url del mp3 en él y me ahorraría tener que descompilar el reproductor flash y buscar en su código ActionScript. Busqué pero no encontré nada útil, excepto un detalle importante, el "id" del archivo, cada archivo tiene uno diferente, así que deduje que me sería útil para descargar las canciones una vez averiguara donde estaban alojadas. Esto fue lo único interesante que vi en el código fuente:

http://www.mp3tube.net/play.swf?id=772691db234dc0b62844eac87f3d21d5

Se ve perfectamente el id, y el nombre del reproductor flash. Luego intenté una tontería, pero a lo mejor funcionaba, puse mp3tube.net/id_del_archivo.mp3 pero no funciono, error 404, tras probar varias posibilidades mas pare probar, no sirvió ninguna de mis intuiciones. Próximo paso? descargar el reproductor flash, descompilarlo y ver que hace. Así que nada wget mp3tube.net/play.swf, apt-cache search swf decompiler, apt-get install flasm, flasm, flasm -d play.swf. Explico: descargo el archivo, busco un descompilador de archivos swf, instalo el que he encontrado (flasm), lo ejecuto sin argumentos para ver la sintaxis, y luego lo ejecuto con -d (descompilar) como parámetro y play.swf (archivo swf) como argumento. Tras mirar un poco veo que hay llama a otro archivo, a fmp3.swf, así que lo descargo igualmente y miro un poco el código de este archivo, no veo nada útil, así que me voy de nuevo al primero y repasándolo veo una cosa cuanto menos curiosa:

'mp3', 'http://matrix.mp3tube.net/tube/', 'id', '.tube'

Lo que me hace pensar que los archivos mp3 se pueden sacar de matrix.mp3tube.net/tube/id_del_archivo.tube, así que hago la prueba poniendo como id el de la canción que puse antes como ejemplo, Como el agua, de Camarón, y descargo mediante wget (si ya que se puede con firefox, pero a mi me gusta el terminal):

wget http://matrix.mp3tube.net/tube/772691db234dc0b62844eac87f3d21d5.tube

Vaya, son 3.5 MB tiene toda la pinta de ser una canción en mp3, cuando termino de descargarlo para ver que es ejecuto:

file 772691db234dc0b62844eac87f3d21d5.tube

Y efectivamente es un fichero mp3, así que intento reproducirlo:

mplayer 772691db234dc0b62844eac87f3d21d5.tube

Suena!! ya sabemos donde están los archivos, pero trabajo acabado?

No... es mucho trabajo hacer todo eso a mano, así que, se me ocurre que puedo hacer un script que haga el solo todo el trabajo, y de paso practico un poco shell scripting.

Blogger deforma un poco (en realidad mucho) es script, así que lo he colgado, podeis verlo aquí: http://neobiusnet.googlepages.com/mp3tube.sh

Voy a comentaros un poco el script, se que algunos lo entenderéis perfectamente, pero a alguien le interesará saber como funciona, así que lo explico un poco:

La primera línea: #!/bin/bash simplemente indica que es un script bash.

Después hay una comprobación mediante un if, si no se le ha puesto ningún argumento muestra en la pantalla mediante varios echo, para que sirve el script y como se usa, lo he puesto en inglés para que lo pueda usar mas gente aunque realmente dudo de la calidad de la pagina mp3tube.net, y de si tiene mucha audiencia o no, pero bueno, lo he puesto en inglés de todas formas.

En caso de que si se le haya pasado la url como argumento comienza descargando la pagina html (linea 17), y lo guarda como index.html.

La línea 18 asigna a la variable CANCION, el id de la canción, imprimiendo el archivo index.html, mediante grep se selecciona una línea y luego mediante cut se corta el id.

En condiciones normales cuando se descarga el archivo tiene un nombre absurdo, [id].tube, es imposible saber que canción es, así que para solucionar esto la línea 19 se encarga de tomar el nombre de la propia url:

http://www.mp3tube.net/es/musics/Camaron-Como-el-agua/4844/

En este caso sería Camaron-Como-el-agua.mp3. La forma de hacerlo es dividiendo con cut la url en partes usando como límites las "/" de la url, con -f6 se selecciona la parte que queremos, este es el dato que se asigna a $NOMBRE.

Por último se descarga el archivo, le cambia el nombre a $NOMBRE.mp3 y termina diciendo "El archivo $NOMBRE.mp3 ha sido guardado".

Una cosa que se me había olvidado, gracias a Castigador por su ayuda con el script, ya que tuve unos problemillas con cut.