Q&A/nl: Revision history

Jump to navigation Jump to search

Diff selection: Mark the radio buttons of the revisions to compare and hit enter or the button at the bottom.
Legend: (cur) = difference with latest revision, (prev) = difference with preceding revision, m = minor edit.

(newest | oldest) View (newer 50 | ) (20 | 50 | 100 | 250 | 500)

5 July 2024

  • curprev 14:3214:32, 5 July 2024Vincent talk contribs 19,555 bytes +57 Created page with "Er zijn momenteel geen parallelle corpora beschikbaar waarin gewoon Nederlands is gesimplificeerd, wat het onmogelijk maakt om dit eenvoudigweg te behandelen als een machinevertaalprobleem."
  • curprev 14:3214:32, 5 July 2024Vincent talk contribs 19,498 bytes +49 No edit summary
  • curprev 14:3114:31, 5 July 2024Vincent talk contribs 19,449 bytes +68 Created page with "Op de [https://kdutch.ivdnt.org/wiki/K-Dutch#Corpora hoofdpagina] vindt u een lijst met verschillende soorten corpora die wij hebben. Domeinspecifieke corpora zijn de Parlementaire corpora en de Corpora van academische teksten. Onder de Parallele corpora bevinden zich ook domeinspecifieke corpora."
  • curprev 14:2914:29, 5 July 2024Vincent talk contribs 19,381 bytes +33 Created page with "Het verzoek is of er enige gebruiksvriendelijke en gratis beschikbare hulpmiddelen zijn waarmee docenten het lexicale profiel van een tekst kunnen vaststellen (tot welke frequentieniveaus de woorden behoren, hoeveel van de meest frequente woorden de lezer zou moeten kennen om 95% te begrijpen etc.)"
  • curprev 14:2814:28, 5 July 2024Vincent talk contribs 19,348 bytes +8 Created page with "Er zijn een aantal dialoogonderdelen in het CGN (Corpus Gesproken Nederlands). * a. Spontane conversaties ('face-to-face') * c. Telefoondialogen opgenomen m.b.v. platform * d. Telefoondialogen opgenomen m.b.v. minidiskrecorder * e. Zakelijke onderhandelingen"
  • curprev 14:2714:27, 5 July 2024Vincent talk contribs 19,340 bytes +3 Created page with "Zie de Eenvoudige_Taalverwerking pagina."
  • curprev 14:2514:25, 5 July 2024Vincent talk contribs 19,337 bytes +3 Created page with "Er is een hulpmiddel genaamd [https://tscan.hum.uu.nl/tscan/ T-scan] dat wellicht nuttig is daarvoor."
  • curprev 14:2414:24, 5 July 2024Vincent talk contribs 19,334 bytes −510 Created page with "De formule voor Flesch-Douma vereist twee dingen die geteld moeten worden: het aantal woorden in een zin en het aantal lettergrepen per woord. Terwijl het aantal woorden in een zin gemakkelijk te tellen is met elke scripttaal, lijkt het aantal lettergrepen moeilijker te tellen. Het [http://hdl.handle.net/10032/tm-a2-h2 e-Lex]-lexicon bevat woordafbrekingstekens en daarmee het aantal lettergrepen per woord. Een alternatief is om het aantal klinkerclusters in elk woord te..."
  • curprev 14:2414:24, 5 July 2024Vincent talk contribs 19,844 bytes −4,183 Created page with "We hebben de Treebanks pagina toegevoegd aan deze wiki om antwoord te geven op deze vraag."
  • curprev 14:2114:21, 5 July 2024Vincent talk contribs 24,027 bytes −4,568 Created page with "We onderzoeken of het mogelijk is om dit te laten financieren door de [https://www.clarin.eu/content/clarin-resource-families-project-funding CLARIN Resource Families Projectfinanciering]. Deze site geeft aan dat het het beste is om het idee eerst informeel in te sturen naar het CLARIN-kantoor, zodat zij erover kunnen adviseren ('Gezien de flexibele aard van dit telefoongesprek worden aanvragers bemoedigd om een projectidee op voorhand in te sturen, om het CLARIN-kantoor..."
  • curprev 14:1914:19, 5 July 2024Vincent talk contribs 28,595 bytes +11,999 Created page with "Het is mogelijk om een account aan te vragen via de [https://idm.clarin.eu/unitygw/pub#!registration-CLARIN%20Identity%20Registration CLARIN-accountregistratiepagina]."

27 May 2024

18 April 2024

  • curprev 12:5912:59, 18 April 2024Floyd talk contribs 16,555 bytes −939 Created page with "<code>}</code>"
  • curprev 12:5512:55, 18 April 2024Floyd talk contribs 17,494 bytes −30 Created page with "== Is er een woordenlijst van moeilijke woorden voor het Nederlands? == Terwijl deze vraag over 'moeilijke' woorden gaat, hebben wij alleen woordenlijsten van eenvoudige woorden tot onze beschikking:"
  • curprev 12:5212:52, 18 April 2024Floyd talk contribs 17,524 bytes −22 Created page with "Als een woord niet voorkomt in een lijst van eenvoudige woorden, dan kan dat worden gebruikt als een maatstaf voor de moeilijkheidsgraad van woorden. Maar, moeilijkheid wordt bepaald door meer dan alleen woorden, d.w.z. er is ook syntactische complexiteit."
  • curprev 12:4712:47, 18 April 2024Floyd talk contribs 17,546 bytes −83 Created page with "Er zijn ook een aantal hulpmiddelen die kunnen worden gevonden op [https://ilt.kuleuven.be/aanbod/index.php Instituut voor Levende Talen]"
  • curprev 12:4112:41, 18 April 2024Floyd talk contribs 17,629 bytes −10 Created page with "==Zijn er lexicale profileringshulpmiddelen voor het Nederlands?== Het verzoek is of er enige gebruiksvriendelijke en gratis beschikbare hulpmiddelen zijn waarmee docenten het lexicale profiel van een tekst kunnen vaststellen (tot welke frequentieniveaus de woorden behoren, hoeveel van de meest frequente woorden de lezer zou moeten kennen om 95% te begrijpen etc.)"
  • curprev 12:3812:38, 18 April 2024Floyd talk contribs 17,639 bytes −43 Created page with "==Wat zijn goede POS-taggers voor non-standaard Nederlands?== Zie de Eenvoudige_Taalverwerking pagina."
  • curprev 12:3412:34, 18 April 2024Floyd talk contribs 17,682 bytes −31 Created page with "==Is er een gebruiksvriendelijke interface voor het werken met het EMEA-onderdeel van de Lassy Groot-treebank?== Lassy Groot is extreem groot en daarom niet geheel beschikbaar met behulp van online zoekhulpmiddelen zoals GrETEL en PaQu, alhoewel deze laatste toegang biedt tot het krantenonderdeel. Een suggestie is om de data te downloaden en dan te importeren naar een xml-databasemachine, zoals [https://basex.org/ Basex] die het toestaat om erin te zoeken met Xpath en Xq..."
  • curprev 12:1712:17, 18 April 2024Floyd talk contribs 17,713 bytes −143 Created page with "==Kan je advies geven over het opzetten van een transcriptieproces voor een gesproken taal corpus?== We hebben een overleg gehad waarin we het gebruik van spraakherkenning, segmentatie, sprekersdiarisatie en post-editing van spraakherkenning hebben besproken. We hebben het advies gegeven om K-Dutch te betrekken in het projectvoorstel zodat K-Dutch de ASR-output kan converteren naar ELAN-niveaus, ELAN-niveaus kan samenvoegen etc."
  • curprev 12:0412:04, 18 April 2024Floyd talk contribs 17,856 bytes −110 Created page with "Het Corpus Gesproken Nederlands (CGN) heeft een sectie van spontane spraak met time-stamped transcripties, gratis beschikbaar."
  • curprev 11:5111:51, 18 April 2024Floyd talk contribs 17,966 bytes −46 Created page with "==Weet u of er degelijke sentimentanalyse-algoritmes/methodes bestaan voor het Nederlands?== We hebben nu een pagina over sentimentanalyse toegevoegd aan deze wiki."
  • curprev 11:4511:45, 18 April 2024Floyd talk contribs 18,012 bytes +8 Created page with "Wij zouden u ook verwijzen naar OPUS, daar kunt u parallelle txt-bestanden vinden als u het Moses-formaat downloadt -- dan krijgt u een zip dat een .nl en een .tr bestand bevat en deze zijn uitgelijnd op basis van zinnen. Dat betekent dat hetzelfde lijnnummer in de twee bestanden de vertalingen van elkaar zouden moeten zijn."
  • curprev 11:3711:37, 18 April 2024Floyd talk contribs 18,004 bytes −8 Created page with "==Hoe kan ik Flesch-Douma berekenen voor het Nederlands?== De formule voor Flesch-Douma vereist twee dingen die geteld moeten worden: het aantal woorden in een zin en het aantal lettergrepen per woord. Terwijl het aantal woorden in een zin gemakkelijk te tellen is met elke scripttaal, lijkt het aantal lettergrepen moeilijker te tellen. Het [http://hdl.handle.net/10032/tm-a2-h2 e-Lex]-lexicon bevat woordafbrekingstekens en daarmee het aantal lettergrepen per woord. Een al..."
  • curprev 11:2811:28, 18 April 2024Floyd talk contribs 18,012 bytes −59 Created page with "==Hoe kan ik de leesbaarheid van een Nederlandse tekst berekenen?== Er is een hulpmiddel genaamd [https://tscan.hum.uu.nl/tscan/ T-scan] dat wellicht nuttig is daarvoor."
  • curprev 11:2111:21, 18 April 2024Floyd talk contribs 18,071 bytes −35 Created page with "==Welke treebanks zijn er beschikbaar voor het Nederlands?== We hebben deTreebanks pagina toegevoegd aan deze wiki om antwoord te geven op deze vraag."
  • curprev 11:1711:17, 18 April 2024Floyd talk contribs 18,106 bytes −21 Created page with "==Ik wil CGN wave-bestanden gebruiken, maar vond een dode link op de originele website== Er is een permanente link voor de CGN wave-bestand download pagina: is a permanent link for the CGN wave file download page: [http://hdl.handle.net/10032/tm-a2-k6 http://hdl.handle.net/10032/tm-a2-k6]"
  • curprev 11:1511:15, 18 April 2024Floyd talk contribs 18,127 bytes −45 No edit summary
  • curprev 10:3810:38, 18 April 2024Floyd talk contribs 18,172 bytes −125 Created page with "<pre> (ing)[N|V.](s)[N|N.N] 9344 (heid)[N|A.](s)[N|N.N] 1470 (er)[N|V.](s)[N|N.N] 1230 (ig)[A|N.](heid)[N|A.] 937 (atie)[N|V.](ief)[A|N.] 769 (iseer)[V|N.](atie)[N|V.] 603 ... </pre>"
  • curprev 10:2710:27, 18 April 2024Floyd talk contribs 18,297 bytes +12 Created page with "==Ik zoek gesproken en geschreven corpora voor een contrastief onderzoek Duits-Nederlands waarin ik daadwerkelijk woordvormen kan vinden== Wij verwijzen u naar [http://opensonar.ivdnt.org/ OpenSonar] dat de enige zoekmachine is voor zowel het Corpus Gesproken Nederlands (CGN) als ook het SoNaR-referentiecorpus. Deze zoekmachine is beschikbaar via CLARIN-login. Een alternatief kan het [http://chn.ivdnt.org/ Corpus Hedendaags Nederlands (CHN)] zijn, dat de enige zoekmachin..."
  • curprev 10:1110:11, 18 April 2024Floyd talk contribs 18,285 bytes +6 No edit summary
  • curprev 10:0810:08, 18 April 2024Floyd talk contribs 18,279 bytes +16 Created page with "==Is het mogelijk om het vinden van woordconversies voor specifieke corpora te automatiseren?== Denk je dat het mogelijk is om een lijst samen te stellen van conversieparen van het Nederlands, d.w.z. woorden die kunnen worden gebruikt in meer dan 1 spraakonderdeel, gebaseerd op corpora (of mogelijk ook treebanks)? Ik ben met name geïnteresseerd in de volgende onderdelen van spraak: naamwoorden, adjectieven en werkwoorden. Dus, bijvoorbeeld, het zoekalgoritme zou in staa..."
  • curprev 10:0410:04, 18 April 2024Floyd talk contribs 18,263 bytes −9 Created page with "We zouden een aantal potentiële databronnen moeten identificeren en er zeker van moeten zijn dat dat we de verzamelde data openbaar beschikbaar zouden kunnen stellen zonder GDPR of IP-problemen."
  • curprev 09:4809:48, 18 April 2024Floyd talk contribs 18,272 bytes −10 Created page with "We zouden rekening moeten houden met het [https://opus.nlpl.eu/EMEA.php EMEA-corpus in OPUS]"
  • curprev 09:3209:32, 18 April 2024Floyd talk contribs 18,282 bytes −9 Created page with "Een verzameling van geannoteerde video-opnames van vriendelijke face-to-face dialogen. Het is gemodelleerd naar de face-to-face dialogen in het Corpus Gesproken Nederlands (CGN). De procedures en het ontwerp van het corpus zijn aangepast om dit corpus bruikbaar te maken voor andere onderzoekers van Nederlandse spraak. Voor dit corpus zijn 20 dialoogconversaties van 15 minuten opgenomen en geannoteerd, in totaal 5 uur aan spraak. * Download: https://taalmaterialen.ivdnt.o..."
  • curprev 09:2409:24, 18 April 2024Floyd talk contribs 18,291 bytes −54 Created page with "Daarnaast is er het [https://www.fon.hum.uva.nl/IFA-SpokenLanguageCorpora/IFADVcorpus/ IFA Dialoog Videocorpus]."
  • curprev 09:1909:19, 18 April 2024Floyd talk contribs 18,345 bytes −56 Created page with "* Download: https://taalmaterialen.ivdnt.org/download/tstc-corpus-gesproken-nederlands/ * Online zoeken: https://portal.clarin.inl.nl/opensonar_frontend/opensonar/search"
  • curprev 09:1809:18, 18 April 2024Floyd talk contribs 18,401 bytes −71 Created page with "Als u het zou overwegen om een vorm van onbeheerde simplificatie te ontwikkelen, dan zijn er echter meerdere corpora beschikbaar die zijn samengesteld in een vorm van eenvoudig Nederlands. Deze corpora zijn het [http://hdl.handle.net/10032/tm-a2-q6 Wablieft-corpus] (Eenvoudig Belgisch-Nederlands), het [http://hdl.handle.net/10032/tm-a2-n4 Basilex-corpus] (Teksten voor kinderen in Nederlandse basisscholen), en [http://hdl.handle.net/10032/tm-a2-t9 WAI-NOT] (Zeer eenvoudig..."
  • curprev 09:0709:07, 18 April 2024Floyd talk contribs 18,472 bytes −37 Created page with "==Welke corpora zijn er beschikbaar voor automatische simplificatie van het Nederlands?== Er zijn momenteel geen paralelle corpora beschikbaar waarin gewoon Nederlands is gesimplificeerd, wat het onmogelijk maakt om dit eenvoudigweg te behandelen als een machinevertaalprobleem."
  • curprev 09:0109:01, 18 April 2024Floyd talk contribs 18,509 bytes −71 Created page with "==Is er een spraakherkenningsmachine beschikbaar voor Belgisch-Nederlands?== Sinds april 2022 is er een nieuwe ASR-machine beschikbaar, die specifiek geschikt is voor spraakherkenning van Belgisch-Nederlands.. *[https://www.spraak.org/webservice/dutch_asr/ Online webservice] TIJDELIJK ONBESCHIKBAAR *[https://clinjournal.org/clinj/article/view/119 Wetenschappelijke publicatie over de spraakherkenningsmachine.]"
  • curprev 08:5508:55, 18 April 2024Floyd talk contribs 18,580 bytes −42 Created page with "==Zijn er literaire teksten beschikbaar?== Op de [https://kdutch.ivdnt.org/wiki/Historical_corpora#Public_Domain_Data_.40_DBNL Publiek Domein Pagina] kunt u een link vinden naar de downloadbare publieke domein bestanden van DBNL."
(newest | oldest) View (newer 50 | ) (20 | 50 | 100 | 250 | 500)