On-device AI · WebGPU

Transcribeer audio rechtstreeks in je browser.

Whisper spraak-naar-tekst, volledig on-device. Upload audiobestanden of neem live op — geen servers, geen limieten.

GPU detecteren…
Uploaden of opnemen
100% privé
Waarom Speech-to-Text

Transcripties in Whisper-kwaliteit. Nul uploads.

Het Whisper-model van OpenAI draait lokaal in je browser via Transformers.js.

100% privé

Je audio verlaat nooit je apparaat. Alle transcriptie gebeurt lokaal.

WebGPU-versneld

De inferentie draait op je GPU indien beschikbaar, met WASM-fallback.

Whisper-model

Meertalige spraakherkenning met automatische taaldetectie.

Uploaden of opnemen

Sleep audiobestanden (MP3, WAV, M4A) of neem live op via je microfoon.

Hoe het werkt

Drie stappen. Nul servers.

  1. 01

    Uploaden of opnemen

    Sleep een audiobestand of neem live op. MP3, WAV, M4A en meer.

  2. 02

    AI transcribeert

    Whisper draait lokaal en transcribeert je audio naar tekst met tijdstempels.

  3. 03

    Kopiëren of downloaden

    Kopieer het transcript of download het als tekstbestand. Het model wordt gecached voor hergebruik.

Complete guide

About the speech-to-text tool

A free speech-to-text tool that transcribes audio and video locally in your browser, powered by a Whisper model running on your device. It is intended for meetings, interviews, lectures, podcasts, and voice memos — including sensitive recordings that should not be uploaded to a cloud transcription service.

How it works

Audio is decoded in the browser with the Web Audio API, then a Whisper model (transformer-based speech recognition) runs through Transformers.js. On WebGPU-enabled Chrome or Edge the model executes on your GPU and a one-hour file transcribes in a fraction of real time; on other browsers a WebAssembly path keeps the same features available. The model files download once and are cached, so you can transcribe offline afterward. Finished transcripts can be copied as plain text or exported with timestamps.

Limits & requirements

The browser ships the lightweight Whisper tier for fast, free inference; it is excellent for clear speech but less forgiving on heavy accents or noisy multi-speaker recordings than paid large-model APIs. Long multi-hour files may hit browser memory limits on low-RAM devices; splitting long recordings is the workaround.

Privacy

This is the key difference from cloud services: your recordings are never uploaded. Interviews, confidential calls, and personal memos are processed and stay on your machine, with no per-minute billing.

Ondersteuning

Vragen, beantwoord.

Nee. Alles draait in je browser. Het Whisper-model wordt één keer van Hugging Face gedownload en lokaal gecachet — daarna gebeurt de transcriptie 100% op het apparaat.