Meer leren over AI?
In onze hands-on trainingen leer je AI effectief inzetten voor jouw werk.
Dennis Claassen
AI-trainer · 35+ teams getraind
Key takeaways
- Podcast maken met AI werkt in vier losse stappen: script, stem, montage en publicatie. Elke stap vraagt een ander AI-niveau. De fout die de meeste tijd kost: één tool voor alles laten doen.
- Een AI-script verzint soms een getal dat er overtuigend bij staat. In het uitgewerkte voorbeeld hieronder lees je een script met een verzonnen onderzoekscijfer, en wat je daaraan verandert voor je het opneemt.
- De grootste valkuil is geen techniek, maar een wet. Een gekloonde stem van een echt persoon publiceren zonder dat te melden, is sinds 2 augustus 2026 een overtreding van de transparantieplicht uit de EU AI Act, met een boete tot 15 miljoen euro of 3 procent van de jaaromzet.
- NotebookLM maakt gratis een podcast van twee AI-stemmen uit je eigen documenten. Dat werkt voor intern gebruik. Wil je herkenbaar blijven als merk of presentator, dan heb je een eigen stem nodig: ingesproken of gekloond, met toestemming en een vermelding.
- Reken op anderhalf tot twee en een half uur voor je eerste aflevering van acht minuten. Vanaf de derde aflevering, met een vast sjabloon en een getrainde stem, zakt dat in onze oefensessies naar veertig tot zestig minuten.
Podcast maken met AI betekent: een tekstmodel schrijft het script, een stemtool leest het voor, en jij bewaakt twee dingen die AI niet zelf checkt: of de feiten kloppen en of je mag publiceren met de stem die je gebruikt. Wil je weten hoe je een tekst laat herschrijven zodat het niet AI-achtig klinkt, dat werkt hier ook voor je script. Het grootste risico zit niet in de techniek: sinds 2 augustus 2026 gelden er onder de EU AI Act harde transparantieregels voor AI-gegenereerde audio, en een voice clone van een collega valt daar sneller onder dan je denkt. Hieronder lees je de vier stappen, een volledig uitgewerkt voorbeeld met een typische fout erin, en de beslisregel die bepaalt welke stem je waar mag gebruiken.
Podcast maken met AI: de vier stappen en welk AI-niveau erbij past
Een podcast bestaat uit vier losse werkzaamheden: het script schrijven, de stem inspreken of genereren, de opname monteren en de aflevering publiceren. De meeste mensen die podcast maken met AI voor het eerst proberen, laten één tool alle vier doen. Dat werkt niet goed, want elke stap vraagt een ander niveau gereedschap: het script is een taak voor gewone chat, de stem voor een gespecialiseerde audiotool (tekst-naar-spraak of een AI-stemmenpaar zoals in NotebookLM), montage is audiotechniek (stiltes knippen, volume gelijktrekken naar ongeveer -16 LUFS, ruis wegfilteren), en publicatie is een bestand uploaden naar je podcasthost.
Waarom dit verschil uitmaakt: een tekstmodel is getraind op taal, niet op geluidskwaliteit, dus zet je het in voor montage, dan weet het niet wat "te zacht" of "een hap uit een zin" betekent. Een stemtool is weer slecht in nieuwe tekst verzinnen: die leest voor wat je aanlevert, zonder te controleren of het klopt. Gebruik je het juiste niveau per stap, dan bespaar je de meeste tijd bij het script, de stap die zonder AI het langst duurt.
Het script: AI schrijft de tekst, jij bewaakt de feiten
Voor het script gebruik je een gewone chatbot: ChatGPT, Claude of Gemini. De aanpak volgt dezelfde structuur als een brief of een formele tekst opstellen met AI: een rol, een doel, een werkwijze en een harde regel tegen het grootste risico.
Bij een podcastscript is dat risico een verzonnen feit. Een taalmodel voorspelt het waarschijnlijkste vervolg van een zin. Vraag je om "een onderzoek" of "een percentage" zonder dat zelf aan te leveren, dan verzint het er een bij dat grammaticaal en inhoudelijk past, maar niet bestaat. Bij een podcast is dat gevaarlijker dan bij een document: je leest het hardop voor, niemand kan het rustig terugchecken op papier, en luisteraars onthouden een concreet getal beter dan een vage uitspraak.
#CONTEXT: Je bent script-schrijver voor de wekelijkse podcast "Helder over HR"
van Mark, oprichter van HR-adviesbureau Helder Advies. Luisteraars zijn
MKB-ondernemers zonder eigen HR-afdeling die tussendoor luisteren, in de auto
of tijdens een wandeling.
#DOEL: Een script van ongeveer 700 woorden (circa 5 minuten gesproken) over
het onderwerp van deze week.
#WERKWIJZE:
1. Vraag me eerst om: het onderwerp van deze week, en één voorbeeld of
situatie die ik wil gebruiken. Vraag niets meer.
2. Open met de situatie, niet met een definitie.
3. Bouw drie concrete stappen op, in spreektaal, met ritme voor een microfoon.
4. Sluit af met één concrete actie voor deze week.
#OUTPUT: Puur gesproken tekst, geen kopjes of opsommingstekens. Wel
[pauze]-markeringen op natuurlijke ademmomenten.
#BELANGRIJKE REGELS:
- Gebruik geen percentage, onderzoek of getal dat ik niet zelf heb
aangeleverd.
- Schrijf in de ik-vorm van Mark: direct, met "je", geen "men" of
"organisaties".
- Controleer vóór je antwoordt of er geen cijfer in het script staat dat ik
niet zelf gaf.
#BEPERKINGEN:
- Maximaal 750 woorden.
- Formuleer geen juridisch advies als garantie.
Uitgewerkt voorbeeld: het script, de fout erin, en wat je repareert
Mark geeft als onderwerp "een ziekmelding goed vastleggen" en als voorbeeld een medewerker die zich drie keer in een maand ziek meldt zonder duidelijke reden. Dit is wat het model teruggeeft, met de regel tegen verzonnen cijfers er letterlijk in de prompt:
"Je herkent het vast. Een medewerker meldt zich ziek, voor de derde keer deze maand. [pauze] Je vraagt je af: moet ik hier iets mee, of is dit gewoon toeval? Uit onderzoek blijkt dat 62 procent van de MKB-bedrijven de eerste paar ziekmeldingen niet volledig vastlegt, en dat kost je bij een geschil met het UWV zomaar duizenden euro's. [pauze] Dus wat doe je wel..."
De fout: het model noemt een percentage (62 procent) en een bron ("uit onderzoek") die Mark niet heeft aangeleverd en die nergens bestaan, ondanks de expliciete regel ertegen. Dat gebeurt omdat een taalmodel elke zin apart genereert. De regel in de prompt verkleint de kans op een verzonnen cijfer, maar blokkeert die niet volledig: zodra het model een zin begint die om een onderbouwing "vraagt", is "uit onderzoek blijkt" de waarschijnlijkste volgende woordgroep, regel of niet.
Wat Mark hieraan verandert voor hij opneemt: hij verwijdert het percentage en de bronverwijzing, en vervangt die door zijn eigen ervaring, specifiek benoemd als ervaring en niet als onderzoek: "In de twintig bedrijven die ik dit jaar hielp, zag ik het bij de helft misgaan." Dat is een kleinere, concretere claim die hij zelf kan onderbouwen als iemand ernaar vraagt. De rest van het script, de opbouw in drie stappen en de actie aan het eind, hoefde hij niet aan te passen.
Nog één controle voor de opname, los van de inhoud: cijfers en afkortingen schrijf je voluit in woorden, niet als cijfer. Een stemtool leest "20" soms uit als "twintig", soms als "twee nul", en bij een datum of een bedrag kiest hij lang niet altijd de uitspraak die jij bedoelt. ElevenLabs raadt daarom zelf aan om nummers, data en afkortingen al in het script in woorden uit te schrijven, vóór je de tekst naar de stemtool stuurt. Dat geldt voor elke stemtool, niet alleen voor een clone: zet het dus als vaste stap in je prompt, bij Mark bijvoorbeeld "twintig" in plaats van "20".
De stem: NotebookLM, een eigen stem, of een voice clone?
Zodra het script staat, kies je hoe de stem klinkt. Drie routes; de beslisregel verderop zet ze naast elkaar met de drempel per situatie.
NotebookLM van Google (ook bekend als Gemini Notebook) maakt met de functie Audio Overview gratis een podcastgesprek tussen twee AI-stemmen, gebaseerd op documenten die je uploadt. Volgens Google's eigen hulppagina kies je uit vier vormen (Deep Dive, The Brief, The Critique, The Debate) en een taal uit meer dan 80. De stemmen zijn generiek en wisselen niet mee met jouw eigen toon: een route voor intern gebruik, niet voor een merk-podcast.
Je eigen stem inspreken met een telefoon of microfoon blijft de meest herkenbare en juridisch eenvoudigste route; AI zet je dan alleen in voor script en montage. Een voice clone (met ElevenLabs bijvoorbeeld) leest je script voor in een stem die op een echt persoon lijkt, meestal die van jou of een collega. Dat is handig als je niet elke week zelf wil inspreken, of een aflevering in meerdere talen wil aanbieden, maar het heeft een voorwaarde: toestemming van die persoon, en een melding dat de stem AI-gegenereerd is. Daarover gaat de volgende sectie.
Welke ai stem generator werkt goed in het Nederlands?
ElevenLabs noemt zelf steun voor meer dan 70 talen, Nederlands inbegrepen, maar een leveranciersclaim over taalkwaliteit is geen onafhankelijke test. Test daarom eerst een kort fragment (een halve minuut) op de gratis laag, met woorden die in jouw branche vaak voorkomen, voor je een abonnement neemt. Let specifiek op eigennamen en vakjargon: die spreekt een stemtool vaker verkeerd uit dan gewone zinnen, omdat die woorden minder vaak in de trainingsdata voorkomen.
Info
Stand van zaken op 11 oktober 2026. ElevenLabs noemt op zijn eigen pricingpagina een Starter-laag vanaf 6 dollar per maand (30.000 credits, inclusief Instant Voice Cloning) en een Creator-laag vanaf 22 dollar per maand (121.000 credits, inclusief de preciezere Professional Voice Cloning). Tekst-naar-spraak kost ongeveer 1 credit per teken. NotebookLM is gratis, met een dagelijks quotum voor Audio Overviews dat per kwartaal kan wisselen; check dat in je eigen account. Onder de EU AI Act gelden de transparantieverplichtingen van artikel 50 sinds 2 augustus 2026. Voor de machineleesbare markering van synthetische content door de aanbieder (artikel 50, lid 2) kregen generatieve AI-systemen die al vóór die datum op de markt waren, via het Omnibus-akkoord van mei 2026 uitstel tot 2 december 2026. De meldingsplicht voor een deployer die een stem-deepfake publiceert (artikel 50, lid 4) kent dat uitstel niet en geldt al sinds 2 augustus 2026. Check de huidige voorwaarden en prijzen altijd in je eigen account; ze wijzigen vaker dan dit artikel.
Waar podcast maken met AI misgaat: de ontbrekende AI-labeling
De grootste valkuil zit niet in een slecht script of een matige stem. Hij zit in een stap die mensen overslaan omdat hij geen technisch probleem lijkt: een gekloonde stem publiceren zonder te zeggen dat het een kloon is.
De EU AI Act definieert een deepfake als AI-gegenereerde of gemanipuleerde audio, beeld of video die op een bestaand persoon lijkt en die anders echt zou overkomen. Een voice clone van jouw eigen stem of die van een collega valt onder die definitie zodra luisteraars niet meteen kunnen zien dat het een kloon is. Vanaf 2 augustus 2026 moet de partij die zo'n aflevering publiceert dat melden, aan het begin, niet verstopt in de shownotes of de algemene voorwaarden van je podcasthost. De boete loopt tot 15 miljoen euro of 3 procent van de wereldwijde jaaromzet, het hoogste van de twee. We schreven eerder de bredere uitleg van artikel 50 voor AI-content in marketing; voor audio geldt dezelfde plicht, dan met een hoorbare melding in plaats van een watermerk in een bestand.
Waarom mensen dit overslaan: een voice clone van je eigen stem voelt niet als een deepfake, dat woord roept beelden op van nepvideo's van bekende mensen. De wet maakt dat onderscheid niet; ze kijkt naar het effect, niet naar je intentie. Doe je dit niet, dan loop je het risico pas als iemand een klacht indient, mogelijk maanden na publicatie.
Wat je ervan mag verwachten als je het goed doet: een gesproken zin van vijf tot acht seconden aan het begin ("Deze aflevering is ingesproken met een AI-stem, getraind op de stem van Mark, met zijn toestemming") kost niets aan geloofwaardigheid. NRC laat sinds 2023 al gekloonde stemmen van eigen redacteuren artikelen voorlezen op de website, met vermelding erbij, en dat voelt voor lezers niet als een schandaal maar als een handig hulpmiddel. Het risico zit dus niet in de techniek zelf, maar in het weglaten van de melding.
Dit verandert nog een keer op 2 december 2026: dan loopt het uitstel af dat aanbieders als ElevenLabs en Google kregen voor de machineleesbare markering van hun eigen audio-output (artikel 50, lid 2), en draagt een AI-gegenereerd bestand dus ook al bij de bron een onzichtbare markering. Dat verandert niets aan wat je nu al moet doen: de meldingsplicht voor een gekloonde stem (artikel 50, lid 4) geldt zonder uitstel sinds 2 augustus 2026. Wacht dus niet op die markering van de aanbieder; die komt er straks bij, niet in plaats van jouw eigen melding.
Beslisregel: welke stem gebruik je wanneer?
| Als dit geldt | Dan kies je dit | Waarom de drempel daar ligt |
|---|---|---|
| Je test het concept, minder dan één keer per maand, alleen intern of voor jezelf | NotebookLM Audio Overview (gratis, generieke AI-stemmen) | De stemmen zijn generiek, niet gekloond van een bestaand persoon. Geen toestemmings- of meldingsplicht, geen kosten, resultaat in een paar minuten. |
| Wekelijkse cadans, extern (klanten, social media), herkenbaarheid als merk of presentator is belangrijk | Script met AI, stem zelf inspreken met telefoon of microfoon; AI alleen voor montage | Zelf inspreken kost nauwelijks meer tijd dan een voice clone instellen en controleren, en heeft geen juridisch risico. Blijft het meest herkenbaar voor vaste luisteraars. |
| Je wil schaal (meerdere talen, of niet elke week zelf inspreken) en de stem is van jou of een collega | Voice clone via een tool als ElevenLabs, met schriftelijke toestemming van de persoon en een gesproken AI-melding aan het begin van elke aflevering | Vanaf 2 augustus 2026 is dit een deepfake onder de AI Act zodra de stem herkenbaar op een bestaand persoon lijkt. Toestemming dekt het risico richting die persoon; de melding dekt de wettelijke plicht. Beide samen, niet een van de twee. |
| Je host is een bekend gezicht of merkambassadeur, en precies die stem is het product | Mens opnemen, AI nooit voor de stem, wel voor montage en mastering | Bij een bekende stem is het risico op ontdekking en reputatieschade het grootst. Een clone klinkt bij lange, spontane passages ook nog net iets minder natuurlijk: de uncanny valley van synthetische stemmen. |
Wat podcast maken met AI oplevert, en hoe je dat na zeven dagen meet
Reken op anderhalf tot twee en een half uur voor je eerste aflevering van ongeveer acht minuten: scriptgeneratie, stem instellen of opnemen, en een eerste montageronde. Dat is uit onze eigen oefensessies, geen onafhankelijk gemeten cijfer. Vanaf de derde aflevering, met een vast scriptsjabloon en een stem die al staat, zakt dat naar veertig tot zestig minuten.
Wat na een week beter wordt: je scriptprompt wordt herbruikbaar, en je herkent sneller welke zinnen te formeel of te gehaast klinken voor spraak. Wat niet beter wordt vanzelf: de controle op verzonnen cijfers en citaten. Dat is geen kwestie van oefening maar een eigenschap van hoe een taalmodel werkt, dus die stap blijft nodig bij elke aflevering, ook de twintigste.
Drie meetpunten, zonder tooling:
- Hoeveel van de geplande afleveringen zijn ook echt gepubliceerd? Blijf je onder de helft van je eigen schema, dan is het probleem niet de techniek maar de tijd die montage en controle nog steeds kosten.
- Hoeveel zinnen in het script moest je per aflevering aanpassen voor je opnam? Tel ze. Daalt dat niet na drie afleveringen, dan werkt je prompt nog niet goed genoeg, en is dat de plek om te verbeteren, niet de stem.
- Hoe lang luisteren mensen gemiddeld door, vergeleken met je vorige, niet-AI-afleveringen? Een scherpe daling na een gekloonde stem is een signaal dat die stem luisteraars afschrikt, vaker dan mensen in een enquête zelf toegeven.
Privacy: wat je wel en niet opneemt en kloont
Voor het script geldt dezelfde regel als bij elke tekst-taak: plak geen namen, e-mailadressen of andere persoonsgegevens van klanten in een gratis consumentenaccount. Gebruik een voorbeeld dat je zelf verzint of stevig anonimiseert, zoals bij Mark hierboven. Voor de stem geldt een aparte regel, los van de meldingsplicht hierboven: een stemopname is een persoonsgegeven. Train je een voice clone op de stem van een collega, dan heb je daarvoor toestemming nodig, net als bij een foto die je publiceert, met vastgelegd waarvoor de clone gebruikt mag worden en tot wanneer.
Doe dit deze week
Schrijf je eerste script met de prompt hierboven, op je eigen onderwerp
Vul je eigen context in: wie luistert, welke situatie, welke actie aan het eind. Lees het hardop door voor je het opneemt, en controleer elk getal en elke bronverwijzing die het model noemt.
Kies je stem-route met de beslisregel hierboven
Test eerst gratis: NotebookLM voor een snelle, interne test, of je eigen telefoon voor een externe aflevering. Overweeg een voice clone pas zodra je minstens drie afleveringen op ritme hebt.
Zet, als je toch een gekloonde stem gebruikt, de melding aan het begin van de eerste aflevering
Eén gesproken zin van vijf tot acht seconden, met naam en toestemming genoemd. Leg de toestemming van de persoon ook schriftelijk vast voor je publiceert.
Het recept dat vandaag werkt: laat AI het script en eventueel de stem doen, controleer zelf de feiten en de toestemming, en meld een gekloonde stem hoorbaar aan het begin. Wil je dit met je eigen content onder begeleiding opzetten? Dat oefen je in de AI Visuals-training.
AI-training
Wil je AI leren inzetten?
In onze praktische trainingen leer je hoe je ChatGPT, Claude en andere AI-tools effectief inzet voor jouw werk.
Bronnen
- European Commission / artificialintelligenceact.eu, The EU AI Act's Transparency Rules: A Practical Guide to Article 50, bijgewerkt 2026. Zelf geopend: de definitie van een deepfake (artikel 3, lid 60), de vier situaties onder artikel 50, de ingangsdatum van 2 augustus 2026, het uitstel tot 2 december 2026 voor de machineleesbare markeringsplicht van aanbieders (artikel 50, lid 2) via het Omnibus-akkoord van mei 2026, en de boeteband tot 15 miljoen euro of 3 procent van de wereldwijde jaaromzet.
- Google, Generate Audio Overview in Gemini Notebook (NotebookLM), officiële hulppagina. Zelf geopend: de vier beschikbare vormen (Deep Dive, The Brief, The Critique, The Debate), de ondersteuning voor meer dan 80 talen, en de vermelding dat de langere lengte en interactieve modus op dit moment alleen in het Engels werken.
- ElevenLabs, Pricing, officiële prijspagina. Zelf geopend: de Starter-laag vanaf 6 dollar per maand (30.000 credits, Instant Voice Cloning) en de Creator-laag vanaf 22 dollar per maand (121.000 credits, Professional Voice Cloning), en de creditkosten van ongeveer 1 credit per teken voor tekst-naar-spraak.
- ElevenLabs, Help Center: Why are numbers, dates, symbols and acronyms not properly pronounced, officiële documentatie. Zelf geopend: het advies om cijfers, data en afkortingen voluit in woorden te schrijven voor je ze naar een stemtool stuurt, en de text-normalization-instelling die dit automatisch probeert op te lossen.
- EU AI Act: verplichte transparantie over AI-content, eigen artikel op deze site, voor de bredere uitleg van artikel 50 bij beeld en tekst, waarop dit artikel voor audio specifiek voortbouwt.
- Villamedia (AI-Media Journaal), Nooit meer een digitale vergadering notuleren, dankzij AI, 2023. Onafhankelijke Nederlandse vakpublicatie voor journalistiek, zelf geopend. Gebruikt voor het voorbeeld dat NRC sinds 2023 gekloonde redacteursstemmen met vermelding laat voorlezen; de datum van het stuk zelf is ouder dan de rest van dit artikel, de kernclaim (NRC doet dit, met vermelding) staat er met naam en voorbeeld in.
- AI tekst herschrijven en verbeteren op het werk, eigen artikel op deze site, voor de onderliggende promptaanpak die ook bij een podcastscript werkt.
Veelgestelde vragen
Hoe maak je een podcast met AI?
In vier losse stappen, elk met een ander AI-niveau: een tekstmodel (ChatGPT, Claude of Gemini) schrijft het script, een stemtool leest dat voor (je eigen opname, NotebookLM of een voice clone), een montagetool trekt het volume gelijk en knipt stiltes weg, en je publiceert het bestand bij je podcasthost. Controleer bij elk script zelf of er geen verzonnen cijfer of bron in staat.
Is NotebookLM podcast maken gratis?
Ja. NotebookLM (ook Gemini Notebook genoemd) genereert gratis een Audio Overview: een gesprek tussen twee AI-stemmen over documenten die je uploadt, in meer dan 80 talen. Er geldt een dagelijks quotum dat per kwartaal kan wisselen, en de langere afspeelduur en interactieve modus werken op dit moment alleen in het Engels.
Mag je een AI-stem gebruiken voor een podcast zonder dat te vermelden?
Nee, niet als die stem herkenbaar op een bestaand persoon lijkt. Dat valt onder de deepfake-definitie van de EU AI Act, en sinds 2 augustus 2026 moet je dat dan melden, hoorbaar aan het begin van de aflevering. Doe je dat niet, dan riskeer je een boete tot 15 miljoen euro of 3 procent van de wereldwijde jaaromzet.
Welke AI-stemgenerator werkt goed in het Nederlands?
ElevenLabs noemt zelf steun voor meer dan 70 talen inclusief Nederlands, maar dat is een leveranciersclaim, geen onafhankelijke test. Test eerst een fragment van een halve minuut op de gratis laag met woorden en namen uit je eigen branche, want juist die spreekt een stemtool vaker verkeerd uit dan gewone zinnen.
Wat kost ElevenLabs voor een Nederlandse podcast?
ElevenLabs noemt op zijn eigen pricingpagina een Starter-laag vanaf 6 dollar per maand (30.000 credits, met Instant Voice Cloning) en een Creator-laag vanaf 22 dollar per maand (121.000 credits, met de preciezere Professional Voice Cloning). Tekst-naar-spraak kost ongeveer 1 credit per teken. Check de actuele prijzen in je eigen account, want ze wijzigen regelmatig.




