Französisch-Audio kostenlos transkribieren — direkt im Browser
VoxScriber Nano versteht Französisch (Français) und verarbeitet lokal auf Ihrem Gerät. Limit von 10 Min. im Gratis-Modus.
Führt VoxScriber Nano (Open-Source) in Ihrem Browser aus — lokale KI, bis zu 10 Min. pro Datei, Basisgenauigkeit (~85%). Für professionelle Nutzung: Premium.
Transkription läuft lokal in Ihrem Browser. Sie können das Ergebnis optional mit uns teilen (mit Einwilligung), um den Dienst zu verbessern. Limit: 10 Min. pro Datei, ~85% Genauigkeit.
Gratis vs. Premium — die Unterschiede
| Gratis (Browser) | Premium (Cloud) | |
|---|---|---|
| Limit pro Datei | 10 min | 10 horas |
| Genauigkeit | ~85% | >95% |
| Sprecher-Diarisierung | ❌ | ✅ |
| Zeitstempel pro Wort | ❌ | ✅ |
| Video-Support (MP4/MOV) | ❌ | ✅ |
| Export-Formate | TXT, SRT, VTT | DOCX, PDF, JSON… |
| Geschwindigkeit (1h Audio) | ~2 min / 1h | ~2 min / 1h |
| Datenschutz | 100% local | ☁️ + 🔒 |
Lokale KI
Transkription läuft in Ihrem Browser. Das Teilen mit unseren Servern ist optional (erfordert Einwilligung).
Schnell und lokal
KI-Verarbeitung direkt im Browser — keine Warteschlangen.
99 Sprachen
Erkennt die Sprache Ihrer Audiodatei automatisch.
Keine Anmeldung
Sofort loslegen, ohne Konto zu erstellen.
So funktioniert es
Audio hochladen oder aufnehmen
Ziehen Sie eine MP3-, WAV-, M4A- oder OGG-Datei per Drag & Drop, oder nutzen Sie das Mikrofon.
KI läuft auf Ihrem Gerät
Whisper AI wird einmalig heruntergeladen und bleibt im Cache. Kein Warten beim nächsten Besuch.
Text kopieren oder herunterladen
Ergebnis erscheint in Sekunden. Als .txt herunterladen oder mit einem Klick kopieren.
Wie gut verarbeitet Whisper Französisch?
Whisper schneidet bei Französisch sehr gut ab und kommt gut mit den stummen Endungen und Liaisons der Sprache zurecht, indem es aus dem Kontext korrekte schriftliche Formen erzeugt. Quebecer und afrikanische französische Akzente verringern die Genauigkeit beim Nano-Modell etwas; Mini schließt die Lücke weitgehend.
Woher Französisch-Audio normalerweise stammt
Team-Besprechungsaufnahmen, Universitätsvorlesungen, Radio- und Podcast-Clips, Interviews für Memoiren und Forschung sowie Sprachnachrichten auf WhatsApp oder Telegram.
Wie genau ist die Browser-Transkription?
Die Browser-Transkription führt OpenAI's Whisper-Modell direkt auf Ihrem Gerät über WebAssembly aus. Wir bieten drei Modellgrößen, und die Genauigkeit hängt davon ab, welche Sie wählen:
- Nano (~40MB) — Der Standard. Etwa 85 % Genauigkeit bei klarer Sprache. Am besten für schnelle Notizen, Sprachnachrichten und Entwürfe. Das einzige Modell, das auf iOS läuft.
- Mini (~150MB) — Etwa 90 % Genauigkeit. Ein guter Mittelweg, wenn Ihr Gerät 4GB+ RAM hat und Sie sauberere Ausgabe benötigen.
- Plus (~500MB) — Die genaueste lokale Option, die bei klarem Audio nahezu 93 % erreicht. Längere Lade- und Laufzeit; am besten auf Desktop-Rechnern mit 8GB+ RAM.
Was die Genauigkeit bei jedem lokalen Modell verringert: Hintergrundgeräusche, mehrere Personen, die durcheinander sprechen, starke Akzente und Aufnahmen mit niedriger Bitrate wie komprimierte Sprachnotizen. Wenn Sie professionelle Genauigkeit über 95 %, Wortzeitstempel oder Sprecherkennung benötigen, sind Cloud-Modelle erforderlich – siehe Vergleich oben.
Browser- vs. Cloud-Transkription: Welche brauchen Sie?
Die Browser-Transkription ist das richtige Werkzeug, wenn der Datenschutz am wichtigsten ist oder das Audio kurz ist: Es wird nichts hochgeladen, es gibt nichts zu löschen und es kostet nichts. Der Kompromiss sind Geschwindigkeit und Präzision – Ihre CPU verarbeitet etwa eine Stunde Audio in zwanzig Minuten, und das lokale Modell überspringt Sprecherkennung und Wortzeitstempel.
Die Cloud-Transkription ist das richtige Werkzeug, wenn Sie arbeiten: Meetings, Interviews, Vorlesungen, rechtliche Aufnahmen. Dedizierte GPUs verwandeln eine Stunde Audio in etwa zwei Minuten mit über 95 % Genauigkeit, kennzeichnen bis zu 30 verschiedene Sprecher, akzeptieren Dateien bis zu 10 Stunden Länge und exportieren in DOCX, PDF und JSON zusätzlich zu den Untertitelformaten.
Eine praktische Faustregel: Wenn Sie die Aufnahme in einem Café vorlesen würden, gewinnen die Geschwindigkeit und Genauigkeit der Cloud. Wenn das Audio sensibel ist – eine medizinische Konsultation, ein vertrauliches Meeting, eine private Sprachnotiz – bleibt das Browser-Tool alles auf Ihrem Gerät und liefert dennoch in Minuten ein brauchbares Transkript. Viele unserer Nutzer kombinieren beides: schnelle private Notizen im Browser, professionelle Arbeit in der Cloud.
Premium-Pläne ansehen →Unterstützte Audioformate
Laden Sie MP3, WAV, M4A, OGG, OPUS, FLAC oder WEBM hoch – alles, was Ihr Browser dekodieren kann. Gängige Quellen funktionieren sofort: WhatsApp-Sprachnotizen (OPUS), iPhone-Sprachmemos (M4A), Android-Recorder-Dateien, Zoom-Aufnahmen (M4A/MP4), Telegram-Sprachnachrichten (OGG) und Podcast-Dateien (MP3). Video-Container wie MP4 und MOV werden für ihre Tonspur dekodiert, wenn der Browser den Codec unterstützt. Wenn eine Datei nicht geladen wird, liegt die Ursache meist in einem ungewöhnlichen Codec in einem gängigen Container – eine Konvertierung in MP3 löst das Problem in fast allen Fällen.
Benötigen Sie zuerst ein anderes Format? Nutzen Sie unsere kostenlosen Konverter: kostenloser MP3 / WAV / OGG / AAC Audio-Konverter
Mehr benötigt? Premium entdecken
Für den professionellen Einsatz — Sprecher-Diarisierung, lange Dateien, KI-Analyse und alle Exportformate.
Sprecher-Diarisierung
Erkennt automatisch, wer in jedem Abschnitt spricht. Perfekt für Meetings, Interviews und Podcasts.
Dateien bis 10 Stunden
Das lokale Modell unterstützt bis zu 10 Min. Premium verarbeitet Dateien bis zu 10 Stunden.
Zusammenfassung, Sentiment & Themen
KI analysiert den Inhalt und erstellt Zusammenfassungen, Sentiment-Analysen und Themen-Extraktion.
Vollständiger Export
Export als SRT, VTT, DOCX, JSON und PDF — ideal für Untertitel, Dokumente und Automatisierungen.
Häufige Fragen
Wird meine Audiodatei auf einen Server hochgeladen?
Die Transkription läuft 100% lokal in Ihrem Browser. Danach können Sie optional Audio und Transkript mit uns teilen (Einwilligungs-Checkbox), um den Dienst zu verbessern — vollständig freiwillig.
Welche Audioformate werden unterstützt?
MP3, WAV, M4A, OGG, FLAC, WEBM, MP4, MOV und alle Formate, die Ihr Browser dekodieren kann.
Wie lang darf meine Audiodatei sein?
Im Gratis-Modus bis zu 10 Minuten pro Datei. Für längere Aufnahmen unterstützt Premium bis zu 10 Stunden.
Welche Sprachen werden unterstützt?
Das Whisper-Modell unterstützt 99 Sprachen: Deutsch, Englisch, Portugiesisch, Spanisch, Französisch, Japanisch, Arabisch und viele mehr.
Muss ich etwas installieren?
Nein. Alles läuft direkt im Browser. Das KI-Modell (~40MB) wird einmalig heruntergeladen und bleibt im Cache.
Wird die Transkription gespeichert?
Standardmäßig nein — das Ergebnis bleibt nur in Ihrem Browser. Wenn Sie die Einwilligungs-Checkbox markieren, werden Audio und Transkript an unsere Server gesendet und nach 7 Tagen gelöscht. Sie können die Einwilligung jederzeit widerrufen.
Was ist der Unterschied zu Premium?
Der Gratis-Modus nutzt VoxScriber Nano (4-Bit-Quantisierung, q4) lokal: 10-Min.-Limit, ~85% Genauigkeit, keine Sprecher-Diarisierung, Zeitstempel nur auf Segment-Ebene (~30s). Premium nutzt Cloud-Modelle (AssemblyAI + Whisper Large float32): >95% Genauigkeit, Diarisierung bis 30 Sprecher, Zeitstempel pro Wort, Dateien bis 10h, MP4/MOV/MKV-Support und DOCX/PDF/JSON-Export. Geschwindigkeit: 1h Audio dauert ~20Min. auf Ihrer lokalen CPU vs. ~2Min. auf Premiums dedizierter GPU.
Funktioniert es auf dem Handy?
Ja, aber die Leistung hängt vom Gerät ab. Auf Smartphones mit wenig RAM kann die Transkription langsamer sein.
Ist es wirklich kostenlos?
Ja. Der Browser-Transkriptor ist wirklich kostenlos, ohne Testversion, ohne Wasserzeichen und ohne Anmeldung. Wir verdienen Geld mit den Premium-Cloud-Plänen, nicht mit dem kostenlosen Tool.
Verlässt mein Audio mein Gerät?
Nein – die Transkription erfolgt lokal über WebAssembly. Die einzige Ausnahme ist, wenn Sie explizit das optionale Einverständniskästchen aktivieren, um eine Aufnahme mit uns zu teilen.
Gibt es eine Dateigrößenbeschränkung?
Die praktische Grenze ist die Dauer (10 Minuten pro Datei) und der Arbeitsspeicher Ihres Geräts, nicht die Megabyte. Eine 10-minütige MP3-Datei ist typischerweise 10-20 MB groß und funktioniert auf den meisten Geräten einwandfrei.
Wie lange dauert die Transkription?
Mit dem Nano-Modell rechnen Sie auf einem modernen Laptop mit etwa der 1- bis 2-fachen Audiodauer – eine 5-minütige Datei dauert etwa 5-10 Minuten. Der erste Durchlauf fügt einen einmaligen Modell-Download von etwa 40 MB hinzu.
Kann ich Untertitel (SRT) exportieren?
Ja – zu den kostenlosen Exporten gehören .txt, .srt und .vtt mit Segment-Zeitstempeln. Für Wortzeitstempel-Präzision und DOCX/PDF/JSON-Exporte siehe Premium.
Kann ich mehrere Dateien gleichzeitig transkribieren?
Ja – Sie können bis zu 5 Dateien in die Warteschlange stellen, die nacheinander in Ihrem Browser verarbeitet werden. Premium entfernt die Warteschlangenbeschränkung und verarbeitet Dateien parallel in der Cloud.
Warum dauert die erste Transkription länger?
Bei Ihrem ersten Besuch wird das KI-Modell von Ihrem Browser heruntergeladen und kompiliert. Es wird dann zwischengespeichert, sodass jede spätere Transkription sofort beginnt.
Funktioniert es offline?
Teilweise – sobald das Modell zwischengespeichert ist, benötigt die Transkription selbst keine Verbindung. Sie müssen jedoch online sein, um die Seite selbst zu laden.
Funktioniert es mit Quebecer oder afrikanischem Französisch?
Ja, allerdings mit etwas geringerer Genauigkeit als beim metropolitanen Französisch – verwenden Sie für beste Ergebnisse das Mini-Modell.
Schreibt es Apostrophe und Akzente korrekt?
Ja – Apostroph und é, è, ê, ç werden nativ erzeugt.
Unterscheidet es formelle und informelle Sprache?
Es transkribiert genau das Gesagte, einschließlich der Unterscheidung von tu/vous.