Por qué el contenido aprobado por traductores es el mejor dato de entrenamiento
La carrera por el mayor conjunto de datos en la traducción con IA ha alcanzado un punto de rendimientos decrecientes. El desarrollo inicial del aprendizaje automático se centró en extraer la mayor cantidad posible de texto bilingüe de la web abierta. Sin embargo, el cambio hacia los grandes modelos de lenguaje (LLM) como Lara ha puesto de manifiesto una realidad…