jueves, 22 de noviembre de 2012

Omega T : caso práctico



En esta entrada se analizará la herramienta Omega T

Antes de comenzar con la práctica, en su propia página web http://www.omegat.org/es/omegat.html podemos encontrar gran información de interés: de qué trata esta herramienta, con qué tipo de sistemas informáticos es compatible, características, así como los creadores de dicha herramienta.

Pasos para el funcionamiento de Omega T:


Descargar el programa en su página web







                                                   Si no estamos familiarizados con el programa podemos leer su manual de uso





Seleccionamos un documento y los guardamos, en este caso en formato odt







Proyecto /Nuevo. Guardamos el proyecto en la ubicación que queramos  


 Seleccionamos los idiomas con los que queremos trabajar





 Obtenemos el texto en el programa con el que vamos a trabajar: El segmento activo se resalta en verde, mostrando una copia del texto original justo debajo de este en el "campo destino". Debes escribir su traducción antes de la etiqueta <segmento 0001>.




Vamos traduciendo cada segmento (segmentos que van apareciendo en verde)






 Se puede cambiar el color para los segmentos que ya están traducidos y de este modo para que quede más claro ( en este caso amarillo)






 Como se ha comentado en la entrada anterior esta herramienta posee una gran variedad de funciones. Una vez que tenemos nuestra traducción realizada podemos acudir a la segmentación, la corrección, los diccionarios, la segmentación o el etiquetado.

     Etiquetado: antes de entregar el documento a tu cliente, siempre debes comprobar los errores de etiquetas. Selecciona HerramientasValidar etiquetas en el menú. Te mostrará una tabla que muestra los segmentos en los que las etiquetas fuente y destino no se corresponden. Haz clic en el número de segmento. Para que te lleve automáticamente al Editor en segmento cuestionable, donde podrás corregir el etiquetado.


Memorias de traducción: Omega-T




Como se ha visto en clase, una memoria de traducción es una base de datos en la que se almacenan segmentos del texto original asociados a su traducción para el reaprovechamiento en otras traducciones. Esta memoria de traducción ayuda a facilitar el proceso de la traducción disponiendo de varias herramientas que se explicarán a continuación.

Algunas de las funciones además de la de almacenamiento de la información de las que disponemos en estas memorias son las siguientes:

-     Segmentación: compara los nuevos segmentos con los que están almacenados en la base de datos del ordenador. Aunque la oración sea la unidad básica de almacenamiento, el traductor puede incorporar otros criterios a través de comas, puntos (expresiones, palabras aisladas, etc.), cambiando la configuración según sus necesidades.
-        Compactación
-         Desfragmentación
-         Diccionarios, glosarios, correcciones, etc.

Un término que considero fundamental en estas memorias de traducción es el de fuzzy matching. Se trata de coincidencias parciales o aproximadas que podemos encontrar y que nos pueden ayudar en nuestro trabajo.

Estas memorias también nos permiten la alineación de segmentos, concepto del que ya hablé en entradas anteriores. No obstante, como con todas estas herramientas informáticas es preciso estar muy atento al formato de exportación con el que vamos a trabajar (normalmente TMX) puesto que esto puede darnos muchos problemas y nos puede hacer perder mucho tiempo.

Existe un gran número de memorias y gratuitas. De entre las memorias de traducción de pago las más conocidas son Déjà Vu y Trados, que se tratarán en entradas posteriores y de las gratuitas analizaremos en profundidad Omega-T, para que aquellos que solo quieran probar y que no quieran gastarse el dinero en una de pago.

Tras los análisis prácticos de cada una de las herramientas, procederé a sacar una conclusión al respecto, así como las ventajas y los inconvenientes de cada una de ellas.



jueves, 15 de noviembre de 2012

Ilustraciones sobre el temario


A continuación mostraré varias imágenes sobre los últimos temas que he tratado en este blog para que
de este modo resulte más fácil hacernos una idea de las herramientas de las que puede disponer
un traductor. Se trata de programas bastante intuitivos, que permiten al profesional defenderse.

No obstante, como se trata de algo nuevo para un estudiante de Traducción, considero que es
importante compartirlo aquí con los demás.

1. Visualización de la herramienta Trados




2. Artconc. Nos permite visualizar las concordancias de los textos con los que estamos trabajando, así como otras herramientas de interés para el traductor.



3. Obtención de textos paralelos. No solo se pueden obtener textos sino que también es posible alienar por expresiones, colocaciones o palabras. Podemos modificar la alineación según nuestras necesidades.




4. Proceso de alineación de un corpus a través de TRADOS.



Espero que estas ilustraciones hayan servido para tener una idea más clara de todas las herramientas
que estamos trabajando puesto que de una manera más visual podemos comprender muchas cosas
que con palabras son difíciles de explicar.


jueves, 8 de noviembre de 2012

Lecturas sobre corpus de traducción




En esta entrada se analizarán tres lecturas de las propuestas en el tema de corpus de traducción.

Corpas Pastor, Gloria. Determinación del umbral de representatividad de un corpus mediante el algoritmo N-Cor1

Se presenta la problemática del volumen que tiene que tener un glosario para que sea eficiente. Así, proponen un método que consiste en calcular el tamaño mínimo de un corpus mediante el análisis de la densidad léxica(d) en relación al corpus (c) mediante una fórmula matemática. Para ello, analizan de forma práctica un gran número de archivos tanto por orden alfabético como de forma aleatoria utilizando el programa ReCor, que estima la representatividad de los corpus en función de su tamaño.

Desde mi punto de vista, aunque sacan a la luz una posible solución que permite determinar si un corpus es representativo o no, es preciso que cada caso se trate aisladamente, puesto que no todos los archivos tienen las mismas características. Cada uno deberá determinar si le compensa o no realizar un corpus para llevar a cabo un trabajo específico.

Paraconc: concordance software for multilingual paralell corpora

En este artículo, a modo de repaso, se explican claramente los pasos que debemos seguir a la hora de utilizar el programa Paraconc. Paraconc es una herramienta diseñada para trabajar con traducciones que puede ser utilizada no solo por traductores, sino también por lingüistas o profesores, entre otros.

Algunos de los conceptos que se tratan son:

·        Alineación: nos permite trabajar con los dos textos de manera que visualizamos de forma alineada a partir de segmentos obteniendo de este modo textos paralelos.

·    Hotwords: esta opción nos muestra la recurrencia que obtenemos de las palabras del texto, lo que nos permite analizar en profundidad la terminología con la que queremos trabajar.

Como se puede comprobar, en este artículo el principal objetivo que se persigue es el tratamiento de la terminología para poder obtener traducciones de calidad (hotwords, colocaciones…)

Se trata de un repaso muy útil de lo que ya se ha estudiado como práctica durante una de las clases, que nos permite analizar de forma mucho más detallada cada uno de los pasos que hay que seguir, así como la utilidad de estos.

Zanettin, Federico. Corpora in Translation Practice

En este artículo se resalta la importancia de la utilización de corpus, principalmente en el caso de textos especializados, así como de las nuevas tecnologías de las que dispone un traductor. No obstante, lo importante no es encontrar información, sino que esta sea la adecuada.

También se realiza una distinción entre corpus monolingües y corpus multilingües, así como “Comparable corpora”, que trabaja de forma similar a un corpus pero sin traducciones y “Parallel o Translation Corpora”, textos en una lengua alineados con su respectiva traducción.

Por otro lado, también se explican las memorias de traducción como un tipo específico de corpus paralelo:

-       Creadas de forma individual o en grupo para proyectos de traducción específicos. Muy útiles para traducción o localización de programas, pero no lo son tanto a la hora de comenzar un proyecto nuevo con una terminología totalmente distinta.
-        Estandarizan y restringen la variedad de cada opción lingüística. Esto es una ventaja desde el punto de vista terminológico, así como de coste para los clientes, pero puede impedir la fluidez del texto si es demasiado repetitivo.

La principal ventaja que ofrecen estas herramientas con respecto a los diccionarios, es que permiten un enfoque analítico a través del contexto y no una definición sacada de contexto como es el caso de la consulta de diccionarios. De este modo, analizamos la función del término en la oración, su recurrencia, con qué palabras va combinando, etc.
Lo que es cierto es que igual que no todos los diccionarios son iguales, no todos los corpus lo son.

Algunos ejemplos de corpus importantes son:

-          British National Corpus (BCN) : para inglés británico
-          Dynamic corpus or Written Italian (CORIS/CODIS): para el italiano

Para concluir se exponen las principales ventajas de un corpus: son fáciles de realizar, son una gran fuente de información a la hora de trabajar con terminología y fraseología en temas específicos, etc.

·         “Robust corpora”: deberían ser más accesibles y menos caros
·         “Virtual corpora”: deberían extenderse más entre los traductores (son compatibles con HTML y XML)
·         Corpus bilingües y paralelos: se deberían crear corpus de este tipo para mejorar la eficacia y los recursos que un traductor tiene a su disposición.

En definitiva, estos tres textos nos han permitido tener una visión más completa de la realidad actual de los corpus de traducción. No obstante, la mejor manera de aplicar todos estos conocimientos es llevarlos a la práctica mediante cualquiera de los corpus que nos interesen.

Como he comentado antes, es importante que antes de comenzar este trabajo, cada uno analice si le compensa o no llevarlo a cabo puesto que, sobre todo al principio, es algo laborioso y requiere de mucho tiempo. Sin embargo, en casos de grandes volúmenes de traducción es una herramienta que puede resultar muy útil.

Finalmente, considero que no es difícil aprender a hacerse con los corpus puesto que se trata de un aprendizaje muy intuitivo en el que, si seguimos los pasos y recomendaciones no tiene por qué crearnos ningún problema.

Alineación de corpus paralelos para crear una memoria de traducción



Dentro del apasionante mundo de los corpus, hoy intentaré explicar y analizar la alineación de un corpus para crear una memoria de traducción puesto que, el corpus paralelo es la base de la memoria de traducción.

Antes de todo conviene saber qué es una alineación. Se trata del proceso de comparar un texto original con su traducción haciendo coincidir los segmentos correspondientes. Los va uniendo en unidades de traducción, que pueden ser una palabra, una frase o un párrafo. Así, se van asociando en pares (original y su traducción).

Para alinear a través de dos procedimientos, mediante el procedimiento manual, mediante excel (como si fuera un glosario pero de segmentos) o a través de las herramientas que se encuentran en los paquetes de los programas de traducción (en déjà vu, Trados; Lf aligner, Bitext, etc.)

Una vez que el programa ha hecho la alineación tenemos que comprobar que estas son correctas y si no es así modificarlo según creamos conveniente, cortando, uniendo, separando, insertar  los segmentos. Con estas pautas se hace toda la alineación.

Para mejorar la labor de alineación, antes de empezar esta alineación podemos anticiparnos y trabajar con textos que nos permitan una mayor participación (ej. Word). Hay que ver si el formato es similar, para evitar grandes errores, especificar la lengua de origen y de entrada,etc.

El principal beneficio de esta alineación es alimentar la memoria de traducción. No obstante, también resulta útil para comprobar el peso terminológico de un determinado texto o  como sustituto de un diccionario terminológico: busca un término en una lengua para ver cómo se ha traducido en otra y además acceder a su contexto.

Después de alinear un texto completo, he podido comprobar que se trata de un trabajo muy costoso puesto que en la mayor parte de los casos no lo realiza el ordenador todo correctamente, sino que hay que ir comprobando que la alineación se ha hecho correctamente. Por eso, antes de comenzar esta tarea debemos saber para qué vamos a realizarla e intentar analizar si nos va a servir en un futuro.

Dentro de la gran variedad de conocimientos informáticos que necesita tener un traductor, la alineación es una de las técnicas más fáciles a las que me he enfrentado hasta entonces. No  obstante, como ya he dicho requiere mucho tiempo y esfuerzo para que el resultado sea favorable.

lunes, 5 de noviembre de 2012

Corpus de traducción




Otra de las herramientas informáticas que un traductor profesional tiene que manejar son los corpus de traducción.

Un corpus de traducción sirve para añadir muestras del uso de la lengua de ejemplos reales de textos en los idiomas en los que estamos trabajando para elaborar nuestra traducción y analizar ciertos aspectos terminológicos que nos puedan ser útiles.

El hecho de realizar un corpus de traducción me ha parecido, desde mi punto de vista, algo complicado. No obstante, estoy segura de que probablemente estas dificultades solo aparecen al principio. Una vez que se han repetido los mismos pasos una y otra vez y nos vamos familiarizando con las nuevas herramientas con las que tenemos que trabajar, solo nos parecerá parte del proceso de traducción.

La principal ventaja de tener un corpus de traducción es que, en casos en los que las traducciones sean muy largas, como en un gran proyecto de traducción, nos permite trabajar con un gran volumen de textos así como analizar la terminología propia del campo que se está tratando. Esto facilitará en gran medida la tarea del traductor.

Para elaborar dicho corpus, es necesario seguir unos pasos específicos. 

-        Elegir los textos y las lenguas de trabajo. El programa Paraconc puede trabajar hasta con 4 lenguas. También existen otros como Wordsmith.

-      Obtenemos los textos alineados: seleccionar los textos de ambos lados. Los alineadores de corpus extraen la lista de todas las palabras y la frecuencia con la que aparecen en cada texto: sirve para ver la carga terminológica. Si tiene mucha terminología será un texto que necesite una búsqueda terminológica exhaustiva. Podremos ver los términos y palabras clave del texto. A partir de ahí podremos analizar la fraseología y el contexto en que aparecen cada una de las palabras. 

·                Frequency order: aquí podemos ver la frencuencia de las palabras

·         Stopwords: listas de palabras vacías. Son las que queremos eliminar de nuestro análisis porque no nos aportan nada en nuestro trabajo de traducción.

-          Analizar una palabra en concreto: en Search se pone la palabra que queramos analizar. Ej: dopamina. El resultado es una serie de colocaciones que se resaltan en rojo con esta palabra. De este modo se podrán extraer estas combinaciones con la palabra dopamina. Si se quiere analizar más en contexto la frase se hace doble clic y se puede leer la frase al completo. Solamente aparece alineado en relación con la palabra.

-          Seleccionar la misma palabra en inglés: se acude a la parte inferior (Search Query: /dopamine /kwic) y aparece señalada la palabra en ambas partes. En la opción Hot Words aparecen las palabras que aparecen combinadas con dopamine.

Como desconocedora de todas estas herramientas, esta información básica, así como las exposiciones y las prácticas en clase me han permitido adentrarme poco a poco en el mundo de los corpus de traducción. Esto me permite ir adquiriendo técnicas que en un futuro podrán serme útiles a la hora de traducir de manera profesional.
En las siguientes entradas se seguirá ampliando la información que considere más útil de este tema, así como mis reflexiones personales acerca del proceso de aprendizaje de cada una de las lecturas y del temario visto en clase.