miércoles, 30 de septiembre de 2015
Proyecto OKG: Dia 21. Fin del capítulo 10 y de la serie
Lo primero de todo, quería pedir disculpas por el retraso. Ayer hubo problemas con la página de D-Addicts durante todo el dia y, aunque pude bajar los subtitulos para verlos en la tablet, no pude bajarlos en el PC para traducir y por tanto llevo 24 horas de retraso sobre lo planeado, lo que además ha afectado a mi otro proyecto activo.
Para despedir la serie, os tenía previsto un fast-release del décimo capítulo y quería haberlo sacado ayer, pero no ha sido posible, así que he hecho el esfuerzo hoy para tenerlo listo. Aqui teneis el enlace:
He retocado un par de palabras para que encajase mejor, asi como las letras de las canciones, pero son cambios minimos en algún adjetivo.
Vamos a sacar unas estadísticas, que ya sabeis que me gusta. Me falló el boton del cronometro y no me di cuenta hasta la linea 75, con lo que solo tengo la medición de las 550 lineas siguientes, que hice en una hora y 35 minutos. La media sale a 5.79 lineas por minuto. Si usamos ese valor y calculamos como sería para las 625 lineas, equivaldría a que hubiera tardado 108 minutos, lo que es una hora y 48 minutos. Sacando las cifras completas de la serie, han sido 6865 lineas. Como tengo algunos errores de cuantificación en los archivos de estadisticas, dejo para otro momento lo de realizar el calculo.
Ha sido un reto, ya es la segunda serie de estudiantes que hago, y la primera con contenido musical (que ha sido una pequeña pesadilla), pero creedme cuando os digo que la he disfrutado.
Con esto ya doy por finalizada la serie. Espero que os haya gustado tanto como a mi, Recordad que tengo el proyecto de "Aprendiendo informática: OCR" activo (me faltan dos entregas como minimo) y que podeis seguirme en Twitter en la cuenta @acerswap, mediante Google+, usar el RSS o visitar el blog para conocer mis proyectos. Tambien algunos aparecen anunciados en Asia-Team. Como ya sabeis no suelo avisarlos con anterioridad sino que aparecen de repente, segun se me ocurren, asi que no os puedo adelantar nada porque, directamente, no tengo planes preparados.
Si es la primera serie que seguís en este blog, os recomiendo que veais alguna de las que he traducido anteriormente, que podeis encontrar en la barra lateral derecha.
Y para terminar, os pido que me dejeis algún comentario sobre la serie, sobre los subtítulos, sobre los gazapos que se me hayan colado (que serán muchos) o, simplemente, un saludo para que sepa que os gusta mi trabajo.
Etiquetas:
distribucion,
estadisticas globales,
estadisticas por capitulo,
Fin de proyecto,
lanzamiento,
Omotesando Koukou Gasshoubu!,
Proyecto de traduccion serie,
release,
series,
subtitulos,
traduccion
lunes, 28 de septiembre de 2015
Proyecto OKG: Magnet definitivo
Como prometi, aqui teneis el magnet correspondiente a la serie completa:
magnet:?xt=urn:btih:A6909D62498FBFA6ECACFF3574D4976FBB30CBBB&dn=Omotesando%20Koukou%20Gasshoubu%21&tr=udp%3a%2f%2ffr33domtracker.h33t.com%3a3310%2fannounce&tr=http%3a%2f%2ftracker.ex.ua%2fannounce&tr=udp%3a%2f%2ftracker.publicbt.com%3a80%2fannounce&tr=udp%3a%2f%2fwww.h33t.com%3a3310%2fannounce&tr=udp%3a%2f%2ftracker.istole.it%3a80%2fannounce&tr=udp%3a%2f%2ftracker.openbittorrent.com%3a80%2fannounce&tr=udp%3a%2f%2f9.rarbg.com%3a2710%2fannounce
No deberia haber problemas para descargarla.
magnet:?xt=urn:btih:A6909D62498FBFA6ECACFF3574D4976FBB30CBBB&dn=Omotesando%20Koukou%20Gasshoubu%21&tr=udp%3a%2f%2ffr33domtracker.h33t.com%3a3310%2fannounce&tr=http%3a%2f%2ftracker.ex.ua%2fannounce&tr=udp%3a%2f%2ftracker.publicbt.com%3a80%2fannounce&tr=udp%3a%2f%2fwww.h33t.com%3a3310%2fannounce&tr=udp%3a%2f%2ftracker.istole.it%3a80%2fannounce&tr=udp%3a%2f%2ftracker.openbittorrent.com%3a80%2fannounce&tr=udp%3a%2f%2f9.rarbg.com%3a2710%2fannounce
No deberia haber problemas para descargarla.
Aprendiendo informática: OCR - Resultados SubRip
Realizadas las pruebas de SubRip, esto es lo que ha ocurrido.
Lo primero, he decidido reducir el numero que figura en "Update every" a 1. Esto hace que aumente el numero de frames que se examinan, asi que los resultados son (supuestamente) correctos frame a frame. Digo "supuestamente" porque en realidad ni una sola de las lineas coincide 100% en cuanto a la temporización, aunque son bastante similares.
Tuve un pequeño contratiempo, marqué erroneamente una b como una d, con lo que tuve que modificar la matriz y volver a empezar, pero afortunadamente lo detecte pronto y como ya tenía la matriz iniciada fue cosa de unos segundos continuar con el proceso. Resuelto el tema, seguí con el analisis.
Otro fallo que tuve fue a la hora de crear el recuadro. Me quedé corto en las lineas de los pangramas, con lo que quedaron fuera un par de letras. Dado que es un fallo achacable a mi y no al programa, las he agregado a mano como si el programa las hubiera localizado correctamente.
El tiempo que he tardado es de aproximadamente 30-40 minutos, con lo que estoy bastante satisfecho. Obviamente, que el tiempo sea 10 veces el tiempo real es incómodo. ¡Serían 10 horas para transcribir un video de 1 hora!
La calidad de la transcripción es muy buena, tanto que me ha sorprendido. No ha fallado en ninguna de las trampas que he puesto. De hecho, tampoco me ha pedido que se las corrigiera, ni siquiera ha dudado.
Lo que si he detectado han sido lineas omitidas por completo y alguna duplicada, pero no se aleja demasiado de lo aceptable. Como os digo, pensaba que sería peor.
Ahora, los resultados "oficiales":
Lo primero, los subtítulos "tal cual" salen del programa: https://app.box.com/s/jptxl263lbymavegtff3rlif77mofcgi
Ahora, una combinación de ambos subtítulos, el original en la parte superior de la pantalla y la versión resultante en la parte inferior. Eso os permitirá comprobarlo por vosotros mismos: https://app.box.com/s/kghpl7opjueuas6bm6fr2v2mc55omgcx
Por último, la matriz de caracteres resultante, por si quereis ver como funciona sin tener que pasar los 40 minutos: https://app.box.com/s/txf163wjg93pffce9fgec90bdwhbk6av
La siguiente entrega, con AviSubDetector. Un saludo.
Lo primero, he decidido reducir el numero que figura en "Update every" a 1. Esto hace que aumente el numero de frames que se examinan, asi que los resultados son (supuestamente) correctos frame a frame. Digo "supuestamente" porque en realidad ni una sola de las lineas coincide 100% en cuanto a la temporización, aunque son bastante similares.
Tuve un pequeño contratiempo, marqué erroneamente una b como una d, con lo que tuve que modificar la matriz y volver a empezar, pero afortunadamente lo detecte pronto y como ya tenía la matriz iniciada fue cosa de unos segundos continuar con el proceso. Resuelto el tema, seguí con el analisis.
Otro fallo que tuve fue a la hora de crear el recuadro. Me quedé corto en las lineas de los pangramas, con lo que quedaron fuera un par de letras. Dado que es un fallo achacable a mi y no al programa, las he agregado a mano como si el programa las hubiera localizado correctamente.
El tiempo que he tardado es de aproximadamente 30-40 minutos, con lo que estoy bastante satisfecho. Obviamente, que el tiempo sea 10 veces el tiempo real es incómodo. ¡Serían 10 horas para transcribir un video de 1 hora!
La calidad de la transcripción es muy buena, tanto que me ha sorprendido. No ha fallado en ninguna de las trampas que he puesto. De hecho, tampoco me ha pedido que se las corrigiera, ni siquiera ha dudado.
Lo que si he detectado han sido lineas omitidas por completo y alguna duplicada, pero no se aleja demasiado de lo aceptable. Como os digo, pensaba que sería peor.
Ahora, los resultados "oficiales":
Lo primero, los subtítulos "tal cual" salen del programa: https://app.box.com/s/jptxl263lbymavegtff3rlif77mofcgi
Ahora, una combinación de ambos subtítulos, el original en la parte superior de la pantalla y la versión resultante en la parte inferior. Eso os permitirá comprobarlo por vosotros mismos: https://app.box.com/s/kghpl7opjueuas6bm6fr2v2mc55omgcx
Por último, la matriz de caracteres resultante, por si quereis ver como funciona sin tener que pasar los 40 minutos: https://app.box.com/s/txf163wjg93pffce9fgec90bdwhbk6av
La siguiente entrega, con AviSubDetector. Un saludo.
Etiquetas:
aprendiendo informatica,
caso practico,
OCR,
SubRip,
subtitulos
domingo, 27 de septiembre de 2015
Aprendiendo informática: OCR - Introducción a SubRip
Hoy quiero enseñaros los primeros elementos de SubRip. Empezaremos por la pantalla inicial:
Esta pantalla nos permite cargar el video, asi como acceder a las ventanas de la "matriz de caracteres", la del texto que ha sido transcrito.
Cargamos nuestro video mediante el menú "File -> Open hard subbed video files" y nos aparece una ventana con el video. Esta tamaño de esta ventana es identico al del video, lo que la hace inmanejable en muchos casos.
De esta ventana si que hay muchas cosas que contar. Ire configurandolo y comentandoos lo que voy haciendo. ¿Veis ese recuadro que hay en la parte inferior de la imagen? El programa intentará transcribir lo que encuentre en el interior de ese recuadro, pero ¿que pasa si cargo mi video?
El recuadro es, por así decirlo, "generoso" en cuanto a sus dimensiones. Si reducimos el tamaño del recuadro el programa deberá analizar menos superficie, lo que hará que termine mas rápidamente. Buscamos un "frame" (una imagen) que contenga varias lineas de subtítulos y que sean bastante largas y arrastramos usando el boton derecho para crear un recuadro que contenga esa superficie. Como se supone que ya habremos mirado aunque sea por encima el video, sabremos si tiene dos o mas lineas fisicas en pantalla. A la hora de reducir el recuadro, podemos reducirlo mas verticalmente que horizontalmente. Es mas facil que aparezcan lineas largas que no que aparezcan imagenes con cuatro lineas.
El siguiente paso es seleccionar el color de la letra, del borde y de la sombra. Existen dos formas de hacerlo, con precisión o "a pulso". El programa necesita saber de que color son las letras. Existen tres elementos a utilizar. El primero es el color de la letra en si. En mi ejemplo, la letra tiene color blanco. El segundo, es el borde de la letra. En mi caso, color negro. El tercero, la "sombra". Mi ejemplo no tiene sombra, asi que por eso no me preocupo.
Si nos fijamos en la barra inferior, pondrá "Click inside a letter to set color". Si clicamos sobre la letra, asociaremos que la letra tiene el color blanco. Después nos pedirá hacer lo mismo con el "outline", el borde. Es util usar el boton "x2" que hay en la parte superior, ya que muestra el video al doble de su tamaño normal.
En mi caso, que se los colores que he usado haré algo mas sencillo. En la parte superior, en el centro, podremos seleccionar el color que nos interese. A veces cambia en pantalla, a veces no, asi que no hay que preocuparse si no vemos el cambio.
El resto de opciones no hay necesidad de tocarlas, en un principio, con la unica excepcion de la que pone "Skip first". Esa opcion dice que ignore los primeros frames y está ideada para subtítulos que aparecen de forma gradual. La ponemos a cero.
Ahora presionamos en "Rew" para que vuelva al principio y en "Run" para que comience a funcionar.
Acostumbraos a ver esta ventana porque la vais a ver muchas veces. En esta ventana vemos lo que está intentando reconocer. Como veis lo ha convertido a blanco y negro puro, no escala de grises. En color azul vemos lo que se denomina "SubPicture". Es el "simbolo que ha reconocido, y lo pone rodeado por un recuadro rojo.
Donde pone "Best Guess" nos aparecería la letra (o conjunto de ellas) que detecta como "mas probables". Tenemos varias opciones ahora. Podemos escribir el texto al que corresponde y presionar OK, o pegarlo desde el portapapeles, o desde el mapa de caracteres.
Pero también es posible ignorar los SubPictures, o las lineas completas. En mi caso, se trata de un logotipo previo al video, asi que seleccionaré "Skip this line".
Ahora ya empiezan a salir letras. En la imagen superior no reconoce la H, aún está aprendiendo como son los caracteres y tendremos que irselo enseñando. Vemos que lo reconoce con precisión. A la derecha nos ha aparecido una sección en la que podremos indicar si está en negrita, cursiva o subtitulado. Vamos a marcar un par de letras mas para ir generando la matriz.
Veremos que en "Best guess" algunas veces acierta y otras no. Podemos presionar en "Use" si ha acertado.
Tras varios reconocimientos, nos encontramos con un problema. Observad esta imagen:
Si os fijais ha reconocido una de las dos comillas del simbolo de "comillas dobles" como SubPicture. Nos enfrentamos ahora a las siguientes opciones. Podemos marcarlo con un caracter incorrecto y sustituirlo a mano mas tarde, podemos presionar en "Temporary junk char" (que lo que haría es no incluirlo en la matriz) o ignorar el SubPicture. En este caso hare lo siguiente: lo transcribiré como una comilla simple, y luego buscaré con un editor de textos normal todas las comillas simples repetidas y las sustituire con comillas dobles.
Podemos observar en la ventana del texto transcrito como va avanzando la transcripción.
Los tiempos son inexactos, y aparecen lineas duplicadas, principalmente en los cambios de escena, pero respeta bastante bien el texto.
Tambien podemos revisar la matriz, y comprobar que las letras están bien marcadas.
En principio no hay mas secretos, simplemente paciencia.
En el siguiente post, publicaré los resultados. Un saludo.
Esta pantalla nos permite cargar el video, asi como acceder a las ventanas de la "matriz de caracteres", la del texto que ha sido transcrito.
Cargamos nuestro video mediante el menú "File -> Open hard subbed video files" y nos aparece una ventana con el video. Esta tamaño de esta ventana es identico al del video, lo que la hace inmanejable en muchos casos.
De esta ventana si que hay muchas cosas que contar. Ire configurandolo y comentandoos lo que voy haciendo. ¿Veis ese recuadro que hay en la parte inferior de la imagen? El programa intentará transcribir lo que encuentre en el interior de ese recuadro, pero ¿que pasa si cargo mi video?
El recuadro es, por así decirlo, "generoso" en cuanto a sus dimensiones. Si reducimos el tamaño del recuadro el programa deberá analizar menos superficie, lo que hará que termine mas rápidamente. Buscamos un "frame" (una imagen) que contenga varias lineas de subtítulos y que sean bastante largas y arrastramos usando el boton derecho para crear un recuadro que contenga esa superficie. Como se supone que ya habremos mirado aunque sea por encima el video, sabremos si tiene dos o mas lineas fisicas en pantalla. A la hora de reducir el recuadro, podemos reducirlo mas verticalmente que horizontalmente. Es mas facil que aparezcan lineas largas que no que aparezcan imagenes con cuatro lineas.
El siguiente paso es seleccionar el color de la letra, del borde y de la sombra. Existen dos formas de hacerlo, con precisión o "a pulso". El programa necesita saber de que color son las letras. Existen tres elementos a utilizar. El primero es el color de la letra en si. En mi ejemplo, la letra tiene color blanco. El segundo, es el borde de la letra. En mi caso, color negro. El tercero, la "sombra". Mi ejemplo no tiene sombra, asi que por eso no me preocupo.
Si nos fijamos en la barra inferior, pondrá "Click inside a letter to set color". Si clicamos sobre la letra, asociaremos que la letra tiene el color blanco. Después nos pedirá hacer lo mismo con el "outline", el borde. Es util usar el boton "x2" que hay en la parte superior, ya que muestra el video al doble de su tamaño normal.
En mi caso, que se los colores que he usado haré algo mas sencillo. En la parte superior, en el centro, podremos seleccionar el color que nos interese. A veces cambia en pantalla, a veces no, asi que no hay que preocuparse si no vemos el cambio.
El resto de opciones no hay necesidad de tocarlas, en un principio, con la unica excepcion de la que pone "Skip first". Esa opcion dice que ignore los primeros frames y está ideada para subtítulos que aparecen de forma gradual. La ponemos a cero.
Ahora presionamos en "Rew" para que vuelva al principio y en "Run" para que comience a funcionar.
Acostumbraos a ver esta ventana porque la vais a ver muchas veces. En esta ventana vemos lo que está intentando reconocer. Como veis lo ha convertido a blanco y negro puro, no escala de grises. En color azul vemos lo que se denomina "SubPicture". Es el "simbolo que ha reconocido, y lo pone rodeado por un recuadro rojo.
Donde pone "Best Guess" nos aparecería la letra (o conjunto de ellas) que detecta como "mas probables". Tenemos varias opciones ahora. Podemos escribir el texto al que corresponde y presionar OK, o pegarlo desde el portapapeles, o desde el mapa de caracteres.
Pero también es posible ignorar los SubPictures, o las lineas completas. En mi caso, se trata de un logotipo previo al video, asi que seleccionaré "Skip this line".
Ahora ya empiezan a salir letras. En la imagen superior no reconoce la H, aún está aprendiendo como son los caracteres y tendremos que irselo enseñando. Vemos que lo reconoce con precisión. A la derecha nos ha aparecido una sección en la que podremos indicar si está en negrita, cursiva o subtitulado. Vamos a marcar un par de letras mas para ir generando la matriz.
Veremos que en "Best guess" algunas veces acierta y otras no. Podemos presionar en "Use" si ha acertado.
Tras varios reconocimientos, nos encontramos con un problema. Observad esta imagen:
Si os fijais ha reconocido una de las dos comillas del simbolo de "comillas dobles" como SubPicture. Nos enfrentamos ahora a las siguientes opciones. Podemos marcarlo con un caracter incorrecto y sustituirlo a mano mas tarde, podemos presionar en "Temporary junk char" (que lo que haría es no incluirlo en la matriz) o ignorar el SubPicture. En este caso hare lo siguiente: lo transcribiré como una comilla simple, y luego buscaré con un editor de textos normal todas las comillas simples repetidas y las sustituire con comillas dobles.
Podemos observar en la ventana del texto transcrito como va avanzando la transcripción.
Los tiempos son inexactos, y aparecen lineas duplicadas, principalmente en los cambios de escena, pero respeta bastante bien el texto.
Tambien podemos revisar la matriz, y comprobar que las letras están bien marcadas.
En principio no hay mas secretos, simplemente paciencia.
En el siguiente post, publicaré los resultados. Un saludo.
Etiquetas:
aprendiendo informatica,
OCR,
SubRip,
subtitulos
viernes, 25 de septiembre de 2015
Proyecto OKG: Dia 20. Fin del noveno episodio.
¡Ya esta el noveno! ¡Y es muy bueno! A mi me ha encantado, vamos, y estoy seguro de que a vosotros también. También me ha gustado muchisimo la segunda canción, que por su letra me ha permitido jugar con la traducción y darle un sentido de continuidad mucho mayor.
Si, hoy he disfrutado traduciendo.
Las estadísticas del día: lineas 369 a 674, 53 minutos, 5.75 lineas por minuto. Las del capítulo: 122 minutos, 5.52 lineas por minuto.
Y ahora os dejo el enlace. Ya sabeis, si encontrais fallos me los dejais en los comentarios. Un saludo.
Etiquetas:
balance,
distribucion,
estadisticas,
estadisticas por capitulo,
lanzamiento,
Omotesando Koukou Gasshoubu!,
Proyecto de traduccion serie,
release,
series,
subtitulos,
traduccion
jueves, 24 de septiembre de 2015
Proyecto OKG: Dia 19
Este capítulo que empiezo hoy (el noveno) está muy pero que muy bien. Hay DOS canciones, la famosa canción de amor y una actuación estilo "flashmob" muy divertida.
He hecho las lineas 1 a 368 en una hora y 9 minutos (mas o menos, porque he tenido varios cuelgues y demás). El capítulo tiene pocas lineas, creo que unas 665 o así, asi que mañana es posible que esté listo. Yo me esforzaré, que vale la pena.
Sobre el otro proyecto, el del OCR, he descargado el nuevo video y he empezado con las pruebas pero ¡me he pasado de detalle! He usado un video con un tamaño y una calidad tan grande que el programa se ve desbordado. Tengo que reducirle la calidad, pero eso será cuando termine con este capítulo, que es proyecto prioritario.
Un saludo
He hecho las lineas 1 a 368 en una hora y 9 minutos (mas o menos, porque he tenido varios cuelgues y demás). El capítulo tiene pocas lineas, creo que unas 665 o así, asi que mañana es posible que esté listo. Yo me esforzaré, que vale la pena.
Sobre el otro proyecto, el del OCR, he descargado el nuevo video y he empezado con las pruebas pero ¡me he pasado de detalle! He usado un video con un tamaño y una calidad tan grande que el programa se ve desbordado. Tengo que reducirle la calidad, pero eso será cuando termine con este capítulo, que es proyecto prioritario.
Un saludo
domingo, 20 de septiembre de 2015
Donaciones en PayPal
Hola
He comprobado que la gente no acostumbra a usar los enlaces de afiliados, asi que he decidido agregar un nuevo enlace para donaciones, en este caso a través de PayPal, que os permite enviarme la cantidad que querais. Si lo haceis desde Europa no pagais ningún tipo de comisión, ni tampoco la pago yo. En caso de enviarlo desde fuera de Europa, se cobra 0.35 euros + 3.4% del total, con lo que si el pago es inferior a 35 centimos no recibo absolutamente nada.
Por supuesto, sigo manteniendo la misma politica. Nadie está obligado a pagar nada por lo que ponga a vuestra disposición en el blog, si bien doy la opción de que me recompenseis mediante donaciones, enlaces de afiliados o enlaces con publicidad. Eso es decisión vuestra.
Un saludo.
He comprobado que la gente no acostumbra a usar los enlaces de afiliados, asi que he decidido agregar un nuevo enlace para donaciones, en este caso a través de PayPal, que os permite enviarme la cantidad que querais. Si lo haceis desde Europa no pagais ningún tipo de comisión, ni tampoco la pago yo. En caso de enviarlo desde fuera de Europa, se cobra 0.35 euros + 3.4% del total, con lo que si el pago es inferior a 35 centimos no recibo absolutamente nada.
Por supuesto, sigo manteniendo la misma politica. Nadie está obligado a pagar nada por lo que ponga a vuestra disposición en el blog, si bien doy la opción de que me recompenseis mediante donaciones, enlaces de afiliados o enlaces con publicidad. Eso es decisión vuestra.
Un saludo.
Suscribirse a:
Entradas (Atom)









