Zoeken
Vragen en antwoorden over GPT-NL
Er wordt vaak gezegd dat taalmodellen een statistische voorspelling maken van welke woorden elkaar zouden moeten opvolgen. Dit kunnen ze inschatten doordat ze zijn getraind op gigantisch veel tokens: een stukje van een woord, een heel woord, of een leesteken. In deze post vertellen we over de GPT-NL tokenizer en leggen we uit waarom we voor een eigen tokenizer hebben gekozen. En je kan de tokenizer zelf uitproberen!
We ontwikkelen een taalmodel voor Nederland. Transparant, inclusief, en volgens Nederlandse en Europese waarden, met een platform waarop we open over de data en ontwikkeling communiceren.
Heeft u een vraag over het delen van data, of heeft u een voorstel voor een samenwerking? Neem contact met ons op.
Deze maand zijn we gestart met een nieuwe feasibility study in samenwerking met de KB nationale bibliotheek. De KB is een van onze launching partners en heeft rechtenvrije data beschikbaar gesteld voor de doorontwikkeling ervan. Vanaf 1 juni 2026 startten beide partijen een onderzoek dat onder meer inzage moet geven in mogelijke gebruikstoepassingen van GPT-NL voor de KB.
- vorige pagina
- 1
- ...
- 5
- 6
- 7
- volgende pagina