Translations:Parallel Monolingual Corpora/2/nl
Het DAESO Corpus is een parallelle eentalige treebank van Nederlandse teksten. Het corpus bevat ruim 2,1 miljoen woorden parallelle en vergelijkbare tekst. Ongeveer 678.000 woorden werden handmatig uitgelijnd en ongeveer 1,5 miljoen woorden werden automatisch uitgelijnd. Er is een semantische relatie toegevoegd aan de gealigneerde woorden/zinnen.