jueves, 8 de noviembre de 2012

Lecturas sobre corpus de traducción




En esta entrada se analizarán tres lecturas de las propuestas en el tema de corpus de traducción.

Corpas Pastor, Gloria. Determinación del umbral de representatividad de un corpus mediante el algoritmo N-Cor1

Se presenta la problemática del volumen que tiene que tener un glosario para que sea eficiente. Así, proponen un método que consiste en calcular el tamaño mínimo de un corpus mediante el análisis de la densidad léxica(d) en relación al corpus (c) mediante una fórmula matemática. Para ello, analizan de forma práctica un gran número de archivos tanto por orden alfabético como de forma aleatoria utilizando el programa ReCor, que estima la representatividad de los corpus en función de su tamaño.

Desde mi punto de vista, aunque sacan a la luz una posible solución que permite determinar si un corpus es representativo o no, es preciso que cada caso se trate aisladamente, puesto que no todos los archivos tienen las mismas características. Cada uno deberá determinar si le compensa o no realizar un corpus para llevar a cabo un trabajo específico.

Paraconc: concordance software for multilingual paralell corpora

En este artículo, a modo de repaso, se explican claramente los pasos que debemos seguir a la hora de utilizar el programa Paraconc. Paraconc es una herramienta diseñada para trabajar con traducciones que puede ser utilizada no solo por traductores, sino también por lingüistas o profesores, entre otros.

Algunos de los conceptos que se tratan son:

·        Alineación: nos permite trabajar con los dos textos de manera que visualizamos de forma alineada a partir de segmentos obteniendo de este modo textos paralelos.

·    Hotwords: esta opción nos muestra la recurrencia que obtenemos de las palabras del texto, lo que nos permite analizar en profundidad la terminología con la que queremos trabajar.

Como se puede comprobar, en este artículo el principal objetivo que se persigue es el tratamiento de la terminología para poder obtener traducciones de calidad (hotwords, colocaciones…)

Se trata de un repaso muy útil de lo que ya se ha estudiado como práctica durante una de las clases, que nos permite analizar de forma mucho más detallada cada uno de los pasos que hay que seguir, así como la utilidad de estos.

Zanettin, Federico. Corpora in Translation Practice

En este artículo se resalta la importancia de la utilización de corpus, principalmente en el caso de textos especializados, así como de las nuevas tecnologías de las que dispone un traductor. No obstante, lo importante no es encontrar información, sino que esta sea la adecuada.

También se realiza una distinción entre corpus monolingües y corpus multilingües, así como “Comparable corpora”, que trabaja de forma similar a un corpus pero sin traducciones y “Parallel o Translation Corpora”, textos en una lengua alineados con su respectiva traducción.

Por otro lado, también se explican las memorias de traducción como un tipo específico de corpus paralelo:

-       Creadas de forma individual o en grupo para proyectos de traducción específicos. Muy útiles para traducción o localización de programas, pero no lo son tanto a la hora de comenzar un proyecto nuevo con una terminología totalmente distinta.
-        Estandarizan y restringen la variedad de cada opción lingüística. Esto es una ventaja desde el punto de vista terminológico, así como de coste para los clientes, pero puede impedir la fluidez del texto si es demasiado repetitivo.

La principal ventaja que ofrecen estas herramientas con respecto a los diccionarios, es que permiten un enfoque analítico a través del contexto y no una definición sacada de contexto como es el caso de la consulta de diccionarios. De este modo, analizamos la función del término en la oración, su recurrencia, con qué palabras va combinando, etc.
Lo que es cierto es que igual que no todos los diccionarios son iguales, no todos los corpus lo son.

Algunos ejemplos de corpus importantes son:

-          British National Corpus (BCN) : para inglés británico
-          Dynamic corpus or Written Italian (CORIS/CODIS): para el italiano

Para concluir se exponen las principales ventajas de un corpus: son fáciles de realizar, son una gran fuente de información a la hora de trabajar con terminología y fraseología en temas específicos, etc.

·         “Robust corpora”: deberían ser más accesibles y menos caros
·         “Virtual corpora”: deberían extenderse más entre los traductores (son compatibles con HTML y XML)
·         Corpus bilingües y paralelos: se deberían crear corpus de este tipo para mejorar la eficacia y los recursos que un traductor tiene a su disposición.

En definitiva, estos tres textos nos han permitido tener una visión más completa de la realidad actual de los corpus de traducción. No obstante, la mejor manera de aplicar todos estos conocimientos es llevarlos a la práctica mediante cualquiera de los corpus que nos interesen.

Como he comentado antes, es importante que antes de comenzar este trabajo, cada uno analice si le compensa o no llevarlo a cabo puesto que, sobre todo al principio, es algo laborioso y requiere de mucho tiempo. Sin embargo, en casos de grandes volúmenes de traducción es una herramienta que puede resultar muy útil.

Finalmente, considero que no es difícil aprender a hacerse con los corpus puesto que se trata de un aprendizaje muy intuitivo en el que, si seguimos los pasos y recomendaciones no tiene por qué crearnos ningún problema.

No hay comentarios:

Publicar un comentario