Plak een videolink en ontvang een MP3 of audiobestand terug, tot 320kbps, zonder iets te downloaden en zonder iets te installeren. Kopieer een YouTube, Vimeo, TikTok, Facebook of Twitter URL, of een directe videolink, en de audio wordt rechtstreeks van de link gehaald en gecodeerd naar MP3. Dezelfde tool werkt als een URL naar MP3-converter, zet een videolink om naar audio, en accepteert ook een audiobestand dat je al op je machine hebt staan (MP3, WAV, M4A, AAC, OGG of FLAC, tot 2GB). Geüploade of geconverteerde audio komt terug met een transcript met tijdstempels in 99 talen, een bewerkbare AI-samenvatting, een deelbare afspeellink en een AI-chat getraind op de audio. Alleen transcriptie nodig? Zie de transcriptietool.
Uploads lopen via AES-256-encryptie op GDPR-conforme servers. Elk bestand is standaard privé, met optionele wachtwoordbeveiliging en automatische malware-scanning.
Converteer een link naar MP3
Plak een video-URL en ontvang een MP3 terug. Je downloadt de video niet eerst, en er is niets te installeren. De audio wordt van de link gehaald en direct gecodeerd naar MP3 met maximaal 320kbps.
Hoe een link naar MP3-conversie werkt:
- Kopieer de video-URL uit de adresbalk van je browser
- Plak deze in de converter op deze pagina
- Kies de bitrate en download vervolgens de MP3
Het werkt ook breder als een link naar audioconverter: plak een videolink om audio, kies MP3 of WAV en download. Dus een URL naar MP3-converter, een videolink naar audioconverter en een gewone link naar MP3 lopen allemaal via hetzelfde vak.
Dit werkt met YouTube, Vimeo, Facebook, TikTok, Twitter en directe video-URL’s. Voor YouTube alleen is de YouTube naar MP3-converter afgestemd op die ene bron. Als je de video wilt in plaats van de audio, gebruik dan de URL naar MP4-converter. En als het bestand al op je machine is opgeslagen, verwerkt audio extraheren uit video’s MP3-, WAV- en AAC-uitvoer.
Het gratis plan omvat 3 uploads en 2 transcripties, zonder kaart. Daarna ga je verder met Pro voor $19/maand bij jaarlijkse facturering.
Audiobestand Upload Service - Invoer en Uitvoer
Upload een audiobestand en de service retourneert vier artefacten: een streaminglink, een volledig transcript, een door AI gegenereerde samenvatting en een privéchatvenster waar je vragen over de opname kunt stellen (“Wat zei de tweede spreker over het budget?”).
Hoe de audio-uploadstroom werkt:
- Sleep een bestand naar de dropzone, klik om te bladeren, of plak vanuit het klembord
- Het bestand wordt geüpload naar de audiobestand upload service terwijl de transcriptie parallel begint
- Een transcript, samenvatting en deelbare link verschijnen in het dashboard, meestal binnen een minuut voor een opname van één uur
Audiobestandsinvoeren die de uploadservice accepteert:
- MP3 (elke bitrate)
- WAV (PCM, 16/24-bit)
- M4A (AAC binnen MP4-container)
- AAC (ruw)
- OGG (Vorbis en Opus)
- FLAC (verliesvrij)
- Bestanden tot 2 GB in de gratis online tool, geen vaste limiet in de app
De audio-uploadservice behoudt de bronbitrate tijdens het streamen en herzampt een aparte kopie voor transcriptie. Geen van beide bewerkingen overschrijft het origineel dat je hebt geüpload.
Upload een MP3 online gratis. Geen kaart, geen aanmelding voor het eerste bestand. Sleep een audiobestand naar de pagina en het transcript verschijnt binnen enkele seconden.
Wat je krijgt na het uploaden van een audiobestand
Elke upload produceert één verwerkte record waarnaar je later kunt terugkeren. De record bevat vier dingen tegelijk: het originele bestand (downloadbaar), een transcript met sprekerslabels en tijdstempels, een samenvatting die je kunt regenereren of bewerken, en een chatthread gekoppeld aan de audio-inhoud.
De gehoste afspeellink is een neveneffect, niet de hoofdzaak. Het werkt op telefoons en desktops zonder account, maar de belangrijkste waarde van een audio-uploadservice is dat de audio nu doorzoekbare tekst is, bevraagbaar via chat, en exporteerbaar als TXT, SRT, VTT, DOCX of JSON.
Wat een geüpload audiobestand je geeft:
- Transcript in 99 talen met tijdstempels
- AI-samenvatting die verwijst naar de tijdstempels die het aanhaalt
- Chat die vragen over de opname beantwoordt
- Sprekerslabels (wanneer de audio meer dan één spreker heeft)
- SRT- en VTT-ondertitelbestanden voor ondertiteling
- Deelbare afspeellink met optioneel wachtwoord
- Per-bestand-analyse: afspeeltijden, geografische locatie, voltooiingspercentage
De audiobestand upload service verwerkt een enkele drop, een klembordplaksel, of een batch bestanden (tot 50 tegelijk op betaalde abonnementen). Als je in plaats daarvan de bronvideo wilt overdragen, de video naar link converter dekt MP4/MOV, en audio extraheren uit video’s haalt de audio eruit voor afzonderlijke verwerking.
Hoe een Audio Upload Werkt Van Browser naar Transcript
Drie dingen gebeuren op het moment dat je een MP3 op de pagina sleept: de browser begint met een gechunkte upload, de back-end registreert een transcriptietaak, en een tijdelijke record wordt geopend zodat je de voortgang kunt volgen. Typische tijden voor een één uur durende MP3 op een 50 Mbps verbinding zijn 10 seconden uploaden en 60 seconden transcriptie, die grotendeels parallel lopen.
De stappen die een audiobestand doorloopt:
- De dropzone accepteert het bestand (slepen, klikken om te bladeren, of plakken vanuit het klembord)
- Bytes streamen in 5MB-chunks omhoog met hervattingsondersteuning als de verbinding wegvalt
- Transcriptie begint op de eerste chunk en eindigt kort nadat de laatste chunk is geland
- Het transcript, de samenvatting en de chat worden allemaal aan dezelfde record gekoppeld
Batch-uploads laten betaalde gebruikers tot 50 audiobestanden in de wachtrij plaatsen. De wachtrij verwerkt parallel, niet serieel, dus een map met 20 college-opnamen is ongeveer klaar in de tijd die de langzaamste nodig heeft.
Instellingen die je per upload kunt aanpassen:
- Vanity-URL voor de deelbare link (betaald)
- Wachtwoordbeveiliging op de afspeelpagina
- Transcriptietaal (autodetectie of kies één van 99)
- Sprekerslabels aan of uit
- Openbaar, niet-vermeld, of privé zichtbaarheid
- Insluitbaar spelerfragment voor blogposts
De gratis online tool accepteert bestanden tot 2 GB; de ScreenApp-app heeft geen vaste limiet voor de bestandsgrootte.
Probeer de audiobestand upload flow nu. Geen kaart, geen aanmelding voor het eerste bestand. Sleep er een in.
Waarom een audiobestand uploaden in plaats van het aan een e-mail te koppelen?
Mailservers weigeren bijlagen boven 25MB en veel bedrijfsgateways blokkeren gecomprimeerde audio volledig. Een audio-uploadservice geeft je een gehoste link die de ontvanger vanuit elke browser kan afspelen, plus een transcript dat ze kunnen skimmen voordat ze luisteren - e-mailbijlagen geven ze een pictogram dat ze moeten downloaden, opslaan en in iets anders moeten openen.
Wat onderscheidt een goede audiobestand upload service van een generieke bestandsgastheer?
Een goede audiobestand upload service doet drie dingen die een generieke gastheer niet doet: het transcribeert het bestand, het labelt de sprekers in het transcript, en het geeft je een doorzoekbare chat over de audio-inhoud. Dropbox of Google Drive slaan het bestand op; een audio-uploadservice verandert het bestand in tekst die je kunt lezen, zoeken en vragen over kunt beantwoorden.
Audioservice voor bestanden vergeleken met Otter, Notta, Sonix, Trint, Descript
Waar elke optie het beste past:
- vs Otter.ai: Otter heeft zijn product gebouwd rond het live vastleggen van vergaderingen en Engelstalige gesprekken; geüploade audiobestanden worden achteraan de wachtrij omgezet en Otter Chat is vergrendeld achter het Pro-abonnement. De audio-uploadservice hier behandelt het geüploade bestand als een eersteklas burger en biedt AI-chat gratis aan in 99 talen.
- vs Notta: Notta accepteert een vergelijkbaar scala aan formaten en vermeldt 58 talen, maar gratis uploads zijn beperkt tot 5 minuten per bestand met een maandelijks maximum van 120 minuten. Het gratis plan van ScreenApp telt 3 uploads en 2 transcripties voor altijd, geen maandelijks minutenbudget.
- vs Sonix: Sonix is een pay-as-you-go transcriptie-engine voor $10/uur zonder een terugkerende gratis laag - je krijgt eenmalig 30 minuten. Sonix heeft geen AI-chat en geen ingebouwde afspeellink; de uploadservice hier retourneert chat, samenvatting en een gehoste link vanuit dezelfde upload.
- vs Trint: Trint richt zich op nieuwsroomworkflows met EDL-export en verbatim-modus, maar er is geen gratis laag en de prijzen beginnen bij $80/maand. Voor journalisten die af en toe interviewaudio uploaden in plaats van een redactie te runnen, zijn de kosten per minuut hier merkbaar lager.
- vs Descript: Descript zet geüploade audio om in een bewerkbaar transcript dat je kunt knippen om de golfvorm te splitsen - krachtig, maar de leercurve is steil. De upload-en-verwerkingsstroom hier is meer “bestand neerzetten, transcript lezen” met optionele bewerking.
Verwerkingstijden voor het uploaden van audiobestanden per formaat
De verwerkingstijd hangt af van de codec, de duur en of het bestand mono of stereo is. Geschatte cijfers voor een opname van één uur in de standaard verwerkingswachtrij:
| Formaat | Typische bitrate | Uploadtijd (50 Mbps) | Transcriptie tijd (kloktijd) |
|---|---|---|---|
| MP3 | 128-320 kbps | 5-15 seconden | 45-70 seconden |
| WAV (PCM 16-bit) | ~1411 kbps | 60-90 seconden | 45-70 seconden |
| M4A | 96-256 kbps | 5-15 seconden | 45-70 seconden |
| AAC | 96-256 kbps | 5-15 seconden | 45-70 seconden |
| OGG (Opus) | 64-128 kbps | 3-10 seconden | 45-70 seconden |
| FLAC | ~900 kbps (verliesvrij) | 40-60 seconden | 45-70 seconden |
Een grote WAV-upload van 2GB duurt een paar minuten op een typische thuisverbinding - de transcriptie zelf loopt parallel terwijl de bytes binnenkomen, dus het transcript is meestal binnen een minuut na het landen van de laatste byte klaar.
Beslissingsmatrix bestandsformaat
De verwerkingstijdtabel hierboven vertelt je hoe lang elk formaat duurt om te uploaden en te transcriberen. De matrix hieronder beantwoordt een andere vraag: welk formaat moet je in de eerste plaats gebruiken? De keuze van het formaat hangt af van waarmee je hebt opgenomen en wat je daarna met het bestand van plan bent.
| Formaat | Beste voor | Compressie | Maximaal aanbevolen lengte | Opmerkingen |
|---|---|---|---|---|
| MP3 (320 kbps) | Algemene audio, podcasts | Lossy, hoge kwaliteit | Tot 4 uur | Universeel ondersteund |
| WAV | Professionele audio, masters | Ongecomprimeerd | 1-2 uur | Grote bestanden, beste kwaliteit |
| M4A, AAC | iPhone spraakmemo’s, moderne apps | Lossy, efficiënt | 4+ uur | Standaard op Apple apparaten |
| FLAC | Archiveren, audiofiel | Lossless | 4+ uur | Kleiner dan WAV, zelfde kwaliteit |
| OGG, Opus | Streaming, voicechat | Lossy, zeer efficiënt | Variabel | Veelvoorkomend op webplatforms |
| WebM audio | Van het web geëxtraheerde audio | Lossy | 2-3 uur | Uit videobestanden |
| 3GP | Oudere mobiele opnames | Lossy | 1 uur | Converteer voor upload voor de beste resultaten |
Vuistregel: als het bestand van een telefoon kwam, heb je M4A. Als het van een podcast DAW kwam, heb je waarschijnlijk WAV of MP3. Als het uit de cloudopname van een vergaderplatform kwam, heb je waarschijnlijk M4A (Zoom) of geëxtraheerde audio van MP4 (Meet, Teams). Al deze bestanden kunnen direct ingevoerd worden. De transcriptiepipeline normaliseert alles naar een interne 16 kHz mono PCM-representatie voordat het naar het spraakmodel wordt gestuurd, dus het bronformaat verandert de resulterende transcriptienauwkeurigheid niet (volgens de WER-hertest van april 2026).
Na het uploaden kun je het resultaat naar de transcriptietool leiden voor bewerking, of de uitvoer aan de AI-videosamenvatter geven als je audio de soundtrack is van een opgenomen sessie.
Wie gebruikt een audiobestand uploadservice
Podcasters die opnames verwerken. Een afgewerkte podcastaflevering belandt als een stereo WAV of MP3 op een harde schijf. Upload deze naar de uploadservice om het transcript voor shownotes, de samenvatting voor de afleveringsbeschrijving en een gehoste previewlink te ontvangen voordat het bestand Apple Podcasts of Spotify ooit bereikt.
Journalisten die interviewaudio uploaden. Verslaggevers die een recorder meenemen van een persbriefing kunnen de M4A rechtstreeks vanaf het apparaat uploaden en citaten uit een doorzoekbaar transcript halen terwijl de audio nog vers is. Sprekerlabels en tijdstempels zorgen ervoor dat een interview van 90 minuten binnen enkele minuten scanbaar wordt.
Studenten die college-opnames uploaden. Telefoons, dicteerapparaten en Zoom-opnames produceren M4A- of MP3-bestanden. Het uploaden van het audiobestand produceert een transcript dat een student kan doorzoeken (“wanneer noemde de docent enthalpie?”), markeren en plakken in studienotities.
Transcriptionisten die bestanden in een pijplijn invoeren. Freelance transcribenten en bureaus gebruiken het online MP3-uploadpunt als een voorbewerking: het AI-concepttranscript arriveert binnen een minuut, en de menselijke transcribent corrigeert in plaats van helemaal opnieuw te typen. JSON-uitvoer met tijdstempels op woordniveau past in bestaande editors.
Toegankelijkheidsteams die bijschriften genereren uit alleen-audiobronnen. Archieven van openbare radio, mondelinge geschiedenissen en callcenteropnames bestaan vaak alleen als audio. De uploadservice genereert SRT- en VTT-bestanden uit die alleen-audiobronnen, zodat ze kunnen worden gekoppeld aan een statische golfvorm of kunnen worden gepubliceerd als een tekstalternatief onder WCAG 1.2.1.
De audiobestand uploadservice verwerkt ook spraakmemo’s van clinici, demotracks van muzikanten die op zoek zijn naar een label, en trainingsaudio waarvoor compliance-teams een papieren spoor nodig hebben hebben.
Een schoon transcript krijgen van een ruwe opname
Het transcript is slechts zo goed als de audio die je uploadt, en een paar dingen helpen meer dan ze zouden moeten. Als de opname één luide spreker en één stille spreker heeft, dan is de stille spreker waar fouten zich clusteren, dus egaliseer de niveaus vóór het uploaden als je kunt. Achtergrondmuziek onder spraak is de andere boosdoener; het model hoort de songteksten als woorden.
Je hebt echter geen studio-audio nodig. Een spraakmemo van een telefoon in een normale kamer wordt goed getranscribeerd. Waar het moeite mee heeft, is veel overspraak, drie mensen die tegelijk praten, en dikke echo uit een harde, lege kamer. Als je bestand een van deze bevat, verwacht dan dat je achteraf handmatig een paar sprekerlabels moet corrigeren. Het uploaden van een WAV in plaats van een gecomprimeerde MP3 helpt een beetje bij marginale audio, aangezien er eerst niets is weggegooid bij de compressie.


