# Leesavontuur — AI-haalbaarheid en spraakproef

8 september 2026 · Technisch voorstel bij het productplan · Geen spraakdienst geïntegreerd of getest; geen kinderaudio verzameld.

## Besluit

**Bouw eerst een complete oefenervaring; behandel automatische beoordeling van hardop lezen als een afzonderlijke proef.** Nederlandstalige spraakherkenning en Vlaamse voorleesstemmen zijn beschikbaar. Dat bewijst nog geen betrouwbare leesfeedback voor Vlaamse kinderen van 6–9 jaar. Een transcript kan het bedoelde woord weergeven terwijl het kind aarzelde, een klank veranderde of zichzelf verbeterde.

Dit sluit aan op het productplan en de afstemming met de agents voor leerontwerp en prototype: ongeveer tien inhoudelijk beoordeelde sessies vormen de eerste oefenbank. Het klikprototype registreert geprobeerd, hulp en overslaan. Alleen een vaste begripsvraag krijgt feedback op het gekozen antwoord. Articulatieoefeningen blijven een later, apart traject.

## Kandidaten en beperkingen

| Onderdeel | Onderbouwde mogelijkheid | Besluit voor Leesavontuur |
|---|---|---|
| Spraak naar tekst | Azure Speech vermeldt `nl-BE` voor spraakherkenning. | Eerste kandidaat voor een afgebakende proef met Vlaamse kinderstemmen. Nog geen leverancierskeuze of kwaliteitsclaim. |
| Gecontroleerd voorlezen | Azure TTS biedt onder meer `nl-BE-DenaNeural` en `nl-BE-ArnaudNeural`. | Geschikt om vaste voorbeeldwoorden en zinnen vooraf te produceren en door een Vlaamse deskundige te laten beluisteren. Losse letterklanken apart inspreken of beoordelen. |
| Uitspraakbeoordeling | Azure vermeldt Nederlands (`nl-NL`) maar geen Belgisch Nederlands (`nl-BE`) bij pronunciation assessment. | Niet rechtstreeks gebruiken als Vlaamse uitspraaknorm. Eerst afzonderlijk onderzoeken welke varianten en fouten het systeem onderscheidt. |

De taal- en stemvermeldingen komen uit de [officiële Azure-taaltabel](https://learn.microsoft.com/en-us/azure/ai-services/speech-service/language-support). Azure beschrijft bovendien dat uitspraakbeoordeling een ander model gebruikt dan gewone transcriptie. Een tekstvergelijking is dus geen vervanging voor klankanalyse. [Azure — uitspraakbeoordeling](https://learn.microsoft.com/en-us/azure/ai-services/speech-service/how-to-pronunciation-assessment).

Een tweede leverancier is pas nuttig als de eerste kandidaat op de testset tekortschiet. Google vermeldt `nl-BE` in Speech-to-Text V2, maar in de geraadpleegde EU-tabel bij de modellen `telephony` en `telephony_short`; `nl-NL` heeft andere modelopties. Een taalcode alleen bepaalt daarom niet de geschiktheid voor kindlezen op een tablet. [Google — ondersteunde talen en modellen](https://docs.cloud.google.com/speech-to-text/docs/speech-to-text-supported-languages).

Onderzoek van Gao en collega's testte verschillende herkenners op voorgelezen Nederlands van 71 kinderen van 6–13 jaar. De beste woordtranscriptie betekende niet de beste leesfoutdetectie; modellen konden foutieve of gedeeltelijke pogingen weglaten of veranderen. Dit ondersteunt een afzonderlijke evaluatie van feedback. Het onderzoek valideert deze app, de huidige clouddiensten of Vlaamse kinderen van 6–9 niet. [Gao et al., Interspeech 2024](https://www.isca-archive.org/interspeech_2024/gao24d_interspeech.pdf).

## Wat de demo werkelijk kan tonen

- Eén korte sessie met grote tekst, woorden, een zin, hulp en een begripsvraag.
- Een terugblik met aangeboden/bekeken opdrachten, als geprobeerd gemarkeerde opdrachten, hulp en overgeslagen onderdelen. Een tik is geen bewijs dat iets correct gelezen is. Onderscheid hulp aangevraagd van audio daadwerkelijk afgespeeld; ook afgerond afspelen bewijst niet dat het kind luisterde.
- Optioneel voorbeelden voorlezen met een beschikbare lokale Nederlandse browserstem. Selecteer alleen stemmen waarvoor `localService === true` en de taal Nederlands is; geef `nl-BE` voorkeur. Zonder geschikte stem toont de demo hulptekst. Geen automatische overstap naar een externe of anderstalige stem.
- Geen microfoonopname, spraakscore, automatische leesniveaubepaling of permanente kindvoortgang.

De Web Speech-specificatie onderscheidt lokale en externe stemmen via `localService`. Beschikbaarheid en uitspraak moeten op de echte doelapparaten worden gecontroleerd. De voorleesfunctie rechtvaardigt geen algemene claim dat een gehoste website helemaal geen gegevens verwerkt. [Web Speech API — stemkenmerken](https://webaudio.github.io/web-speech-api/#dom-speechsynthesisvoice-localservice).

AI kan later gecontroleerde oefenvarianten voorbereiden. Laat een deskundige woordenschat, toegestane letters, zinsbouw en inhoud vóór publicatie controleren. Eenvoudige regels kunnen de volgende oefening kiezen; een open gesprek met een taalmodel is voor deze eerste versie niet nodig.

## Concrete testmatrix voor de latere spraakproef

Dit is een testvoorstel, geen uitgevoerde evaluatie. Gebruik alleen rechtmatig verkregen, voor dit doel toegestane audio. De eerste proef draait zonder automatische correcties naar kinderen. Twee beoordelaars beoordelen dezelfde fragmenten onafhankelijk; verschillen worden besproken. Een Vlaamse logopedist/leesexpert legt vooraf vast wat als toegestane taalvariant, leesfout, zelfcorrectie en onduidelijk fragment geldt.

| Testgroep of situatie | In de set opnemen | Wat beslissend is |
|---|---|---|
| Leeftijd en beginniveau | Kinderen van 6, 7, 8 en 9; verschillende aangeleerde letters en leesniveaus | Resultaten per kind en niveau, zodat een gemiddelde zwakke prestaties niet verbergt |
| Taalvariatie | Verschillende Vlaamse tongvallen en kinderen met andere thuistalen | Toegestane varianten niet als lees- of uitspraakfout behandelen; onzekerheid per groep rapporteren |
| Verklanken | Letter voor letter, losse klanken, hakken en daarna samennemen | Alle pogingen behouden; niet alleen het laatste volledige woord beoordelen |
| Leesstrategie | Aarzelingen, herhalingen, teruglezen en zelfcorrectie | Strategie onderscheiden van een fout die na de poging blijft bestaan |
| Woordfouten | Weglaten, toevoegen en vervangen, inclusief een plausibel ander woord | Fout én locatie vergelijken met menselijke beoordeling |
| Getoonde tekst als context | Dezelfde audio met en zonder extra tekstcontext | Nagaan of context fouten stilzwijgend naar de bedoelde tekst herstelt |
| Hulp | Eerste poging, luisteren, samen lezen en opnieuw proberen | Prestatie na hulp niet als zelfstandige beheersing boeken |
| Geluid | Zacht spreken, fluisteren, stilte, achtergrondspraak en overlappende ouderstem | Onduidelijke of andere stemmen niet als prestatie van het kind scoren |
| Apparaten | Beoogde tablets/telefoons/computers, browser en microfoon; afstand variëren | Fouten en wachttijd per echte combinatie meten |
| Storingen | Geweigerde microfoon, verbroken verbinding, time-out, dubbele tik, stoppen | Microfoon stopt; geen fictieve score of automatische niveaudaling; oefening blijft overslaanbaar |
| Voorbeeldaudio | Elk woord en elke zin op normaal en trager tempo | Deskundige controle op klank, klemtoon, verstaanbaarheid en betekenis |
| Frustratie en hulp | Geobserveerde sessies met een volwassene beschikbaar | Nodige ouderhulp, herhaalde onterechte correcties, afhaken en herstelmogelijkheid |

Houd kinderen uit de ontwikkelset gescheiden van kinderen in de definitieve evaluatie. Voeg nieuwe woorden en zinnen toe om onthouden opdrachten niet met generalisatie te verwarren. Leg modelversie, taalinstelling, tekstcontext en beslisregels vast.

Meet naast woordfouten in het transcript vooral **onterechte correcties**, **gemiste leesfouten** en **het aandeel onzekere uitkomsten**. Vergelijk transcripties met een letterlijk menselijk transcript, niet uitsluitend met de opdrachttekst. Rapporteer aantallen, definities en onzekerheidsmarges per kind, sessie en relevante groep. Leveranciersscores zijn niet vanzelf gekalibreerde kansen.

Spreek vóór de definitieve test met de deskundigen concrete acceptatiegrenzen af. Zonder voldoende gegevens en gehaalde grenzen blijft automatische feedback uit. Een bruikbaarheidspilot met tien tot twintig gezinnen kan praktische problemen tonen; die omvang bewijst op zichzelf geen betrouwbaarheid of leerwinst.

## Minimale gegevensstroom voor een latere versie

Voorstel: **ouderinstelling → korte, bewuste opname → eigen beveiligde server → gekozen spraakdienst → beperkte oefenuitkomst → kind en ouder**. De oefenbank en voorbeeldgeluiden kunnen vooraf klaarstaan. API-sleutels blijven op de server. Start audio alleen voor een antwoord; bied steeds een duidelijke stopknop.

Stuur geen naam, geboortedatum of diagnose met de audio mee. Verwerk de opname tijdelijk; bewaar standaard geen ruwe audio of volledige transcripties. Bewaar alleen noodzakelijke voortgang, bijvoorbeeld oefening, poging, hulp en onzekerheid, met een pseudoniem. Voorkom dat audio en transcripties alsnog in foutlogs, analytics of back-ups terechtkomen. Onderzoeksopnamen vragen een afzonderlijke keuze, toegangslijst en bewaartermijn.

Microsoft beschrijft verwerking van realtime audio in servergeheugen zonder opslag in rust en vermeldt geen bewaring voor onder meer realtime herkenning en uitspraakbeoordeling. Controleer vóór implementatie de gekozen dienst, regio, logging, contracten en eigen serverinstellingen; deze productdocumentatie maakt de hele app niet automatisch privacyconform. [Azure — gegevensverwerking](https://learn.microsoft.com/en-us/azure/ai-foundry/responsible-ai/speech-service/speech-to-text/data-privacy-security?view=foundry-classic).

Wanneer de rechtstreeks aan kinderen aangeboden dienst op toestemming steunt, vereist België voor kinderen onder 13 toestemming van de ouderlijk verantwoordelijke. De gekozen rechtsgrond en gegevensverwerking moeten voor de concrete dienst worden vastgesteld. [Gegevensbeschermingsautoriteit — toestemming](https://www.gegevensbeschermingsautoriteit.be/professioneel/avg/rechtsgronden/toestemming).

## Eerlijke pitchtekst

**Nu:** “Ontdek Leesavontuur: een concept voor korte, speelse leesoefeningen. Probeer woorden, luister naar voorbeelden en beantwoord een vraag over de zin.”

**Ambitie:** “We willen AI gebruiken om oefenmateriaal beter te laten aansluiten en hardop lezen te ondersteunen. We onderzoeken dit samen met leesexperts en gezinnen.”

**Bij de demo:** “Deze demo luistert niet mee en beoordeelt je stem niet. De terugblik toont wat je hebt geprobeerd en welke hulp je gebruikte.”

Claims over bewezen leeswinst, foutloze uitspraakbeoordeling, volledig zelfstandig leren of vervanging van logopedie zijn nog niet onderbouwd. Bereken betaalbaarheid later uit gemeten audiominuten, hosting, inhoudelijke controle en ondersteuning; vermeld nu geen onbeproefde prijsbelofte.
