En esta entrada se
analizarán tres lecturas de las propuestas en el tema de corpus de traducción.
Corpas
Pastor, Gloria. Determinación del umbral de representatividad de un corpus
mediante el algoritmo N-Cor1
Se presenta la
problemática del volumen que tiene que tener un glosario para que sea
eficiente. Así, proponen un método que consiste en calcular el tamaño mínimo de
un corpus mediante el análisis de la densidad léxica(d) en relación al corpus
(c) mediante una fórmula matemática. Para ello, analizan de forma práctica un
gran número de archivos tanto por orden alfabético como de forma aleatoria
utilizando el programa ReCor, que estima la representatividad de los corpus en
función de su tamaño.
Desde mi punto de
vista, aunque sacan a la luz una posible solución que permite determinar si un
corpus es representativo o no, es preciso que cada caso se trate aisladamente,
puesto que no todos los archivos tienen las mismas características. Cada uno
deberá determinar si le compensa o no realizar un corpus para llevar a cabo un
trabajo específico.
Paraconc:
concordance software for multilingual paralell corpora
En este artículo, a
modo de repaso, se explican claramente los pasos que debemos seguir a la hora
de utilizar el programa Paraconc. Paraconc es una
herramienta diseñada para trabajar con traducciones que puede ser utilizada no
solo por traductores, sino también por lingüistas o profesores, entre otros.
Algunos de los
conceptos que se tratan son:
· Alineación: nos permite trabajar con los
dos textos de manera que visualizamos de forma alineada a partir de segmentos
obteniendo de este modo textos paralelos.
· Hotwords: esta opción nos muestra la
recurrencia que obtenemos de las palabras del texto, lo que nos permite analizar
en profundidad la terminología con la que queremos trabajar.
Como se puede
comprobar, en este artículo el principal objetivo que se persigue es el
tratamiento de la terminología para poder obtener traducciones de calidad
(hotwords, colocaciones…)
Se trata de un repaso
muy útil de lo que ya se ha estudiado como práctica durante una de las clases,
que nos permite analizar de forma mucho más detallada cada uno de los pasos que
hay que seguir, así como la utilidad de estos.
Zanettin, Federico. Corpora
in Translation Practice
En este artículo se
resalta la importancia de la utilización de corpus, principalmente en el caso
de textos especializados, así como de las nuevas tecnologías de las que dispone
un traductor. No obstante, lo importante no es encontrar información, sino que
esta sea la adecuada.
También se realiza una
distinción entre corpus monolingües y corpus multilingües, así como “Comparable
corpora”, que trabaja de forma similar a un corpus pero sin traducciones y
“Parallel o Translation Corpora”, textos en una lengua alineados con su
respectiva traducción.
Por otro lado, también
se explican las memorias de traducción como un tipo específico de corpus
paralelo:
- Creadas de forma individual o en grupo
para proyectos de traducción específicos. Muy útiles para traducción o
localización de programas, pero no lo son tanto a la hora de comenzar un
proyecto nuevo con una terminología totalmente distinta.
- Estandarizan y restringen la variedad de
cada opción lingüística. Esto es una ventaja desde el punto de vista
terminológico, así como de coste para los clientes, pero puede impedir la
fluidez del texto si es demasiado repetitivo.
La principal ventaja
que ofrecen estas herramientas con respecto a los diccionarios, es que permiten
un enfoque analítico a través del contexto y no una definición sacada de
contexto como es el caso de la consulta de diccionarios. De este modo,
analizamos la función del término en la oración, su recurrencia, con qué
palabras va combinando, etc.
Lo que es cierto es que
igual que no todos los diccionarios son iguales, no todos los corpus lo son.
Algunos ejemplos de
corpus importantes son:
-
British
National Corpus (BCN) : para inglés británico
-
Dynamic corpus or Written Italian (CORIS/CODIS): para el italiano
Para concluir se
exponen las principales ventajas de un corpus: son fáciles de realizar, son una
gran fuente de información a la hora de trabajar con terminología y fraseología
en temas específicos, etc.
·
“Robust corpora”: deberían ser más
accesibles y menos caros
·
“Virtual corpora”: deberían extenderse
más entre los traductores (son compatibles con HTML y XML)
·
Corpus bilingües y paralelos: se
deberían crear corpus de este tipo para mejorar la eficacia y los recursos que
un traductor tiene a su disposición.
En definitiva, estos
tres textos nos han permitido tener una visión más completa de la realidad
actual de los corpus de traducción. No obstante, la mejor manera de aplicar
todos estos conocimientos es llevarlos a la práctica mediante cualquiera de los
corpus que nos interesen.
Como he comentado
antes, es importante que antes de comenzar este trabajo, cada uno analice si le
compensa o no llevarlo a cabo puesto que, sobre todo al principio, es algo
laborioso y requiere de mucho tiempo. Sin embargo, en casos de grandes
volúmenes de traducción es una herramienta que puede resultar muy útil.
Finalmente, considero
que no es difícil aprender a hacerse con los corpus puesto que se trata de un
aprendizaje muy intuitivo en el que, si seguimos los pasos y recomendaciones no
tiene por qué crearnos ningún problema.
No hay comentarios:
Publicar un comentario