Wat het doet
Upload een audiobestand, MP3, WAV, M4A, FLAC, of druk op opnemen in de browser. Je krijgt gestructureerde notities terug: sprekers gelabeld, kernpunten eruit gehaald, tijdstempels overal. Geen ruwe transcriptie.
Draait in de browser, niets te installeren, geen bot die deelneemt aan een gesprek. Voor videobestanden of YouTube-links, gebruik de video naar notities converter.
Wat zit er in de notities:
- Spreker-gelabelde secties (tot 10 stemmen)
- Kernpunten en actie-items, geen ruwe transcriptie
- Tijdstempels die teruglinken naar de audio
- 99 talen, automatisch gedetecteerd
Het woordfoutpercentage bedraagt ongeveer 2-3% op schone audio en 8-12% op rumoerige opnames met meerdere sprekers (volledige benchmarks). Een opname van 60 minuten is klaar in een paar minuten. Bestanden zijn versleuteld en worden nooit gebruikt om modellen te trainen (SOC 2 Type II).
Hoe het werkt
- Uploaden of opnemen: MP3, WAV, M4A, FLAC, OGG, of tik op opnemen in de browser.
- AI transcribeert en labelt: Sprekerdiarisatie draait automatisch. Kernpunten en actie-items worden geëxtraheerd.
- Bekijken en exporteren: PDF, Word, platte tekst of Markdown. Tijdstempels blijven klikbaar.
Context blijft behouden bij lange opnames, zodat een interview van 2 uur coherent blijft in plaats van het spoor bijster te raken over wie er praat.
Audio notities instellen per vergaderplatform
Elk groot vergaderplatform slaat opnames op een iets andere plaats en in een ander formaat op. De onderstaande handleiding is wat werkt in mei 2026.
Zoom
Nadat de oproep is beëindigd, verwerkt Zoom de opname gedurende enkele minuten en plaatst vervolgens een .m4a audiobestand (plus de .mp4 video) in je Zoom cloud of lokale Documents/Zoom/<vergadering>/ map. Upload de M4A direct: sprekerdiarisatie werkt het beste op Zoom audio, omdat Zoom elke deelnemer in een aparte audiotrack scheidt wanneer lokaal wordt opgenomen met “Neem een apart audiobestand op voor elke deelnemer” ingeschakeld. De output zijn gestructureerde notities met actie-items per deelnemer.
Google Meet
Google Meet opnames worden opgeslagen in de Google Drive van de host als MP4. De audio is gemultiplext in de video, dus upload de MP4 direct of gebruik eerst de audio extractor. De gratis Meet-tier bevat geen cloudopname, dus een opname met een telefoon- of laptopmicrofoon is de terugvaloptie. De output is een op onderwerp gegroepeerde notitie met tijdstempels die teruglinken naar het moment in de opname.
Microsoft Teams
Teams-opnames komen terecht in OneDrive (1:1 gesprekken) of de SharePoint-site van het kanaal (kanaalvergaderingen) als MP4. Live transcripties van Teams kunnen ook worden gedownload als VTT, die je kunt plakken voor een snellere verwerking die hertranscriptie overslaat. De output respecteert Teams-sprekerlabels wanneer een VTT-transcriptie naast de audio wordt geleverd.
Fysieke opname
Telefoonmemo’s (iPhone neemt op in M4A, de meeste Android-telefoons nemen op in M4A of AAC), USB-reversmicrofoons of een speciale handheld recorder werken allemaal. Sleep het bestand erin. Voor fysieke opnames met meerdere personen verbetert een 360-graden microfoon (zoals de Logitech BCC950 of een Jabra Speak) de diarizatie aanzienlijk, omdat elke stem met een andere “ruimte-signatuur” binnenkomt. De output is hetzelfde gestructureerde notitieformaat dat wordt gebruikt voor de externe platforms.
Ingebouwde stemrecorder
De browserrecorder legt audio vast zonder een aparte app. Druk op opnemen op je telefoon tijdens een wandeling, op een laptop tijdens een lezing, of op een desktop voor een podcastinterview. Wanneer je stopt, verwerkt de AI het automatisch.
- Opnemen in de browser op elk apparaat
- Detectie van meerdere sprekers
- Zoekbare tijdstempels
- Mobiele opname met cloud-synchronisatie
- Verwerkt achtergrondgeluid en overlappende spraak
Bekijk echte notities van een audio-opname van 32 minuten
Hieronder een echt voorbeeld van hoe de notities van ScreenApp eruitzien wanneer de invoer audio is. De bron was een podcastopname van 32 minuten. De notulist detecteerde negen verschillende onderwerpen, splitste elk op in 2-3 kernpunten met opsommingstekens en produceerde een document van 3 pagina’s dat leest als notities die een slimme assistent zou schrijven. Geen muur van transcriptie, geen noodzaak om door 15 pagina’s letterlijke tekst te speuren naar de momenten die ertoe doen.
Notities exporteren naar de bestemmingen die notulisten daadwerkelijk gebruiken: Markdown voor Notion of Obsidian, platte tekst voor Slack of HubSpot, DOCX voor Word als je workflow via Office loopt, of PDF voor archivering. Spraakmemo’s, conferentieopnames, collegeaudio en podcastbestanden produceren allemaal notities in dit formaat.
Audio naar notities versus andere apps
- Otter.ai heeft een grotere gratis versie, maar vereist een bot in je vergaderingen en beperkt gratis bestandsimports tot 3 levenslang.
- NoteGPT geeft ruwe transcriptie - geen onderwerpsgroepering of geëxtraheerde actiepunten.
- meetergo vereist een desktopinstallatie en heeft de kleinste gratis versie.
Wie gebruikt het
Studenten nemen colleges op hun telefoon op en krijgen na de les studieklaar notities, gegroepeerd op onderwerp met tijdstempels.
Zakelijke professionals uploaden opgenomen gesprekken en spraakmemo’s. Gebruik voor live Zoom-, Teams- of Meet-gesprekken de AI-vergadering notulist, geen bot vereist.
Onderzoekers voeren interviewopnames erdoorheen. Sprekerlabels en citeerbare tijdstempels maken het ophalen van citaten snel.
Contentmakers en podcasters hergebruiken afleveringen in shownotities, blogposts en halen citaten eruit. Ook geschikt voor spraakmemo’s en veldopnames. Als je alleen een samenvatting nodig hebt en geen volledige notities, is de audiosamenvatter de zelfstandige samenvatter voor ingekorte afleveringsoverzichten, en de audio samenvatting API beheert programmatische samenvattingen over een backcatalogus.
Journalisten documenteren interviews en persconferenties, en zoeken vervolgens door opnames op trefwoord.
Notities van een opname met overlappende sprekers
De moeilijkste audio voor elke notulist is een gesprek waarin mensen over elkaar heen praten, en het is de moeite waard om verwachtingen te managen. Wanneer twee stemmen overlappen, vangt het transcript de dominante op en vervaagt de andere, dus notities van een verhitte groepsdiscussie zijn minder betrouwbaar dan notities van een één-voor-één vergadering. Dat is een beperking van de audio, niet van het model; geen enkel hulpmiddel scheidt ware crosstalk netjes.
Wat helpt, zijn sprekerlabels, die vereisen dat elke persoon minstens één keer iets op zichzelf heeft gezegd, zodat het systeem een stemafdruk heeft om te koppelen. Een ronde namen aan het begin betaalt zich uit over de hele opname. Voor een panel of een debat kun je verwachten enkele toeschrijvingen handmatig te corrigeren; voor een normale vergadering waarin mensen om de beurt spreken, zijn de labels meestal correct.


