Métodos d'evaluació per a la traducció automàtica
Una volta realisada la traducció automàtica d'un text, és necessari evaluar la seua calitat. Depenent de la finalitat a la que està dirigida la traducció, serà necessari un nivell de calitat distint. Per eixemple, en un sistema que traduïxca frases a varis idiomes dins d'un programa de chat multilingüe, serà suficient en una traducció que permeta entendre el text resultant. En atres casos, com en la traducció de texts dins d'una empresa, la calitat deurà ser molt major.
No existix una mida perfecta per a evaluar una traducció, per lo que s'utilisen distints métodos, cada u en les seues ventages i desventages.
Métodos objectius
[editar | editar còdic]Pertanyen a esta classe els métodos en la que no siga necessària la valoració de la traducció per un ser humà.
- WER (word error rate)
- mínim número de substitucions, insercions i borrats que es deuen realisar per a corregir la frase generada.
- PER (position-independent word error rate)
- millora de WER per a que siga independent de la posició de les paraules dins de la frase.
- mWER (multi-reference word error rate)
- es calcula WER entre la frase generada i la més similar d'entre un conjunt de frases de referència. Esta mida resulta més fiable que WER. Si s'utilisa una sola frase de referència, esta pot diferir molt de la traducció del nostre sistema per les llibertats a l'hora de traduir pròpies d'un traductor humà. Per això, en triar entre vàries traduccions de referència, es milloren els resultats obtinguts.
- BLEU
- medix la precisió dels ngramas (unigramas, bigramas, trigramas i cuatrigramas) sobre un conjunt de traduccions de referència.
- NIST
- variació de BLEU en el que se li otorga un major pes als ngramas poc freqüents.
Métodos subjectius
[editar | editar còdic]En estos métodos, els humans intervenen en la valoració de la traducció.
- SSER (subjective sentence error rate)
- un humà califica la traducció d'una frase de 0 a 1. Una calificació de 0 se li dona una traducció perfecta, mentres que una d'1 es correspon una traducció sintàctica i semánticamente incorrecta.
- IER (information item error rate)
- les frases de prova es dividixen en ítems. Un humà examina si l'informació de cada u dels ítems es troba present en la traducció. D'esta manera, es pot comprovar si sent la traducció de la frase incorrecta, existixen parts d'esta que en canvi sí són correctes.
Vore també
[editar | editar còdic]- inteligència artificial
- llingüística
- traducció assistida
- traducció automàtica per mig de llenguage intermig
- traducció automàtica per mig de transferència
- traducció automàtica basada en el context
- traducció automàtica estadística
- Este artícul conté una traducció derivada de «Métodos de evaluación para la traducción automática» de Wikipedia en castellà publicada baix la Llicència de documentació lliure de GNU i la Llicència Creative Commons Reconeiximent-CompartirIgual 4.0 Internacional.