Waarom door vertalers goedgekeurde inhoud de beste trainingsgegevens oplevert
De race naar de grootste dataset in AI-vertaling heeft een punt van afnemend rendement bereikt. De initiële ontwikkeling van ‘machine learning’ was gericht op het verzamelen van zoveel mogelijk tweetalige tekst van het open web. De verschuiving naar ‘Large Language Models’ (LLM’s) zoals Lara heeft echter een cruciale realiteit aan het licht gebracht. Volume is niet langer de primaire onderscheidende…