VoxScriber
100% kostenlos · Keine Anmeldung · 99 Sprachen

Polnisch-Audio kostenlos transkribieren — direkt im Browser

VoxScriber Nano versteht Polnisch (Polski) und verarbeitet lokal auf Ihrem Gerät. Limit von 10 Min. im Gratis-Modus.

Führt VoxScriber Nano (Open-Source) in Ihrem Browser aus — lokale KI, bis zu 10 Min. pro Datei, Basisgenauigkeit (~85%). Für professionelle Nutzung: Premium.

🔒 Lokale KI💰 100% kostenlos📝 10 Min. pro Datei

Transkription läuft lokal in Ihrem Browser. Sie können das Ergebnis optional mit uns teilen (mit Einwilligung), um den Dienst zu verbessern. Limit: 10 Min. pro Datei, ~85% Genauigkeit.

Premium entdecken →

Gratis vs. Premium — die Unterschiede

Gratis (Browser) Premium (Cloud)
Limit pro Datei 10 min 10 horas
Genauigkeit ~85% >95%
Sprecher-Diarisierung
Zeitstempel pro Wort
Video-Support (MP4/MOV)
Export-Formate TXT, SRT, VTT DOCX, PDF, JSON…
Geschwindigkeit (1h Audio) ~2 min / 1h ~2 min / 1h
Datenschutz 100% local ☁️ + 🔒
🔒

Lokale KI

Transkription läuft in Ihrem Browser. Das Teilen mit unseren Servern ist optional (erfordert Einwilligung).

Schnell und lokal

KI-Verarbeitung direkt im Browser — keine Warteschlangen.

🌍

99 Sprachen

Erkennt die Sprache Ihrer Audiodatei automatisch.

💻

Keine Anmeldung

Sofort loslegen, ohne Konto zu erstellen.

So funktioniert es

1

Audio hochladen oder aufnehmen

Ziehen Sie eine MP3-, WAV-, M4A- oder OGG-Datei per Drag & Drop, oder nutzen Sie das Mikrofon.

2

KI läuft auf Ihrem Gerät

Whisper AI wird einmalig heruntergeladen und bleibt im Cache. Kein Warten beim nächsten Besuch.

3

Text kopieren oder herunterladen

Ergebnis erscheint in Sekunden. Als .txt herunterladen oder mit einem Klick kopieren.

Wie gut verarbeitet Whisper Polnisch?

Whisper verarbeitet polnische Konsonantencluster und das siebenkasusige Flexionssystem gut und erzeugt korrekte Diakritika wie ą, ę, ł und ś. Die Genauigkeit bei deutlicher Sprache ist hoch; schnelle informelle Sprache mit verschluckten Endungen profitiert vom Mini-Modell.

Woher Polnisch-Audio normalerweise stammt

Universitätsvorlesungen, Geschäftstreffen, Interviewaufnahmen, Predigten sowie Messenger- oder WhatsApp-Sprachnotizen.

Verwandte Sprachen, die Sie ebenfalls kostenlos transkribieren können: Russisch · Deutsch · Schwedisch · Alle 20 kostenlosen Transkriptionssprachen

Wie genau ist die Browser-Transkription?

Die Browser-Transkription führt OpenAI's Whisper-Modell direkt auf Ihrem Gerät über WebAssembly aus. Wir bieten drei Modellgrößen, und die Genauigkeit hängt davon ab, welche Sie wählen:

  • Nano (~40MB) — Der Standard. Etwa 85 % Genauigkeit bei klarer Sprache. Am besten für schnelle Notizen, Sprachnachrichten und Entwürfe. Das einzige Modell, das auf iOS läuft.
  • Mini (~150MB) — Etwa 90 % Genauigkeit. Ein guter Mittelweg, wenn Ihr Gerät 4GB+ RAM hat und Sie sauberere Ausgabe benötigen.
  • Plus (~500MB) — Die genaueste lokale Option, die bei klarem Audio nahezu 93 % erreicht. Längere Lade- und Laufzeit; am besten auf Desktop-Rechnern mit 8GB+ RAM.

Was die Genauigkeit bei jedem lokalen Modell verringert: Hintergrundgeräusche, mehrere Personen, die durcheinander sprechen, starke Akzente und Aufnahmen mit niedriger Bitrate wie komprimierte Sprachnotizen. Wenn Sie professionelle Genauigkeit über 95 %, Wortzeitstempel oder Sprecherkennung benötigen, sind Cloud-Modelle erforderlich – siehe Vergleich oben.

Browser- vs. Cloud-Transkription: Welche brauchen Sie?

Die Browser-Transkription ist das richtige Werkzeug, wenn der Datenschutz am wichtigsten ist oder das Audio kurz ist: Es wird nichts hochgeladen, es gibt nichts zu löschen und es kostet nichts. Der Kompromiss sind Geschwindigkeit und Präzision – Ihre CPU verarbeitet etwa eine Stunde Audio in zwanzig Minuten, und das lokale Modell überspringt Sprecherkennung und Wortzeitstempel.

Die Cloud-Transkription ist das richtige Werkzeug, wenn Sie arbeiten: Meetings, Interviews, Vorlesungen, rechtliche Aufnahmen. Dedizierte GPUs verwandeln eine Stunde Audio in etwa zwei Minuten mit über 95 % Genauigkeit, kennzeichnen bis zu 30 verschiedene Sprecher, akzeptieren Dateien bis zu 10 Stunden Länge und exportieren in DOCX, PDF und JSON zusätzlich zu den Untertitelformaten.

Eine praktische Faustregel: Wenn Sie die Aufnahme in einem Café vorlesen würden, gewinnen die Geschwindigkeit und Genauigkeit der Cloud. Wenn das Audio sensibel ist – eine medizinische Konsultation, ein vertrauliches Meeting, eine private Sprachnotiz – bleibt das Browser-Tool alles auf Ihrem Gerät und liefert dennoch in Minuten ein brauchbares Transkript. Viele unserer Nutzer kombinieren beides: schnelle private Notizen im Browser, professionelle Arbeit in der Cloud.

Premium-Pläne ansehen →

Unterstützte Audioformate

Laden Sie MP3, WAV, M4A, OGG, OPUS, FLAC oder WEBM hoch – alles, was Ihr Browser dekodieren kann. Gängige Quellen funktionieren sofort: WhatsApp-Sprachnotizen (OPUS), iPhone-Sprachmemos (M4A), Android-Recorder-Dateien, Zoom-Aufnahmen (M4A/MP4), Telegram-Sprachnachrichten (OGG) und Podcast-Dateien (MP3). Video-Container wie MP4 und MOV werden für ihre Tonspur dekodiert, wenn der Browser den Codec unterstützt. Wenn eine Datei nicht geladen wird, liegt die Ursache meist in einem ungewöhnlichen Codec in einem gängigen Container – eine Konvertierung in MP3 löst das Problem in fast allen Fällen.

Benötigen Sie zuerst ein anderes Format? Nutzen Sie unsere kostenlosen Konverter: kostenloser MP3 / WAV / OGG / AAC Audio-Konverter

🚀 Premium

Mehr benötigt? Premium entdecken

Für den professionellen Einsatz — Sprecher-Diarisierung, lange Dateien, KI-Analyse und alle Exportformate.

🎭

Sprecher-Diarisierung

Erkennt automatisch, wer in jedem Abschnitt spricht. Perfekt für Meetings, Interviews und Podcasts.

⏱️

Dateien bis 10 Stunden

Das lokale Modell unterstützt bis zu 10 Min. Premium verarbeitet Dateien bis zu 10 Stunden.

🧠

Zusammenfassung, Sentiment & Themen

KI analysiert den Inhalt und erstellt Zusammenfassungen, Sentiment-Analysen und Themen-Extraktion.

📄

Vollständiger Export

Export als SRT, VTT, DOCX, JSON und PDF — ideal für Untertitel, Dokumente und Automatisierungen.

Premium-Pläne ansehen →

Häufige Fragen

Wird meine Audiodatei auf einen Server hochgeladen?

Die Transkription läuft 100% lokal in Ihrem Browser. Danach können Sie optional Audio und Transkript mit uns teilen (Einwilligungs-Checkbox), um den Dienst zu verbessern — vollständig freiwillig.

Welche Audioformate werden unterstützt?

MP3, WAV, M4A, OGG, FLAC, WEBM, MP4, MOV und alle Formate, die Ihr Browser dekodieren kann.

Wie lang darf meine Audiodatei sein?

Im Gratis-Modus bis zu 10 Minuten pro Datei. Für längere Aufnahmen unterstützt Premium bis zu 10 Stunden.

Welche Sprachen werden unterstützt?

Das Whisper-Modell unterstützt 99 Sprachen: Deutsch, Englisch, Portugiesisch, Spanisch, Französisch, Japanisch, Arabisch und viele mehr.

Muss ich etwas installieren?

Nein. Alles läuft direkt im Browser. Das KI-Modell (~40MB) wird einmalig heruntergeladen und bleibt im Cache.

Wird die Transkription gespeichert?

Standardmäßig nein — das Ergebnis bleibt nur in Ihrem Browser. Wenn Sie die Einwilligungs-Checkbox markieren, werden Audio und Transkript an unsere Server gesendet und nach 7 Tagen gelöscht. Sie können die Einwilligung jederzeit widerrufen.

Was ist der Unterschied zu Premium?

Der Gratis-Modus nutzt VoxScriber Nano (4-Bit-Quantisierung, q4) lokal: 10-Min.-Limit, ~85% Genauigkeit, keine Sprecher-Diarisierung, Zeitstempel nur auf Segment-Ebene (~30s). Premium nutzt Cloud-Modelle (AssemblyAI + Whisper Large float32): >95% Genauigkeit, Diarisierung bis 30 Sprecher, Zeitstempel pro Wort, Dateien bis 10h, MP4/MOV/MKV-Support und DOCX/PDF/JSON-Export. Geschwindigkeit: 1h Audio dauert ~20Min. auf Ihrer lokalen CPU vs. ~2Min. auf Premiums dedizierter GPU.

Funktioniert es auf dem Handy?

Ja, aber die Leistung hängt vom Gerät ab. Auf Smartphones mit wenig RAM kann die Transkription langsamer sein.

Ist es wirklich kostenlos?

Ja. Der Browser-Transkriptor ist wirklich kostenlos, ohne Testversion, ohne Wasserzeichen und ohne Anmeldung. Wir verdienen Geld mit den Premium-Cloud-Plänen, nicht mit dem kostenlosen Tool.

Verlässt mein Audio mein Gerät?

Nein – die Transkription erfolgt lokal über WebAssembly. Die einzige Ausnahme ist, wenn Sie explizit das optionale Einverständniskästchen aktivieren, um eine Aufnahme mit uns zu teilen.

Gibt es eine Dateigrößenbeschränkung?

Die praktische Grenze ist die Dauer (10 Minuten pro Datei) und der Arbeitsspeicher Ihres Geräts, nicht die Megabyte. Eine 10-minütige MP3-Datei ist typischerweise 10-20 MB groß und funktioniert auf den meisten Geräten einwandfrei.

Wie lange dauert die Transkription?

Mit dem Nano-Modell rechnen Sie auf einem modernen Laptop mit etwa der 1- bis 2-fachen Audiodauer – eine 5-minütige Datei dauert etwa 5-10 Minuten. Der erste Durchlauf fügt einen einmaligen Modell-Download von etwa 40 MB hinzu.

Kann ich Untertitel (SRT) exportieren?

Ja – zu den kostenlosen Exporten gehören .txt, .srt und .vtt mit Segment-Zeitstempeln. Für Wortzeitstempel-Präzision und DOCX/PDF/JSON-Exporte siehe Premium.

Kann ich mehrere Dateien gleichzeitig transkribieren?

Ja – Sie können bis zu 5 Dateien in die Warteschlange stellen, die nacheinander in Ihrem Browser verarbeitet werden. Premium entfernt die Warteschlangenbeschränkung und verarbeitet Dateien parallel in der Cloud.

Warum dauert die erste Transkription länger?

Bei Ihrem ersten Besuch wird das KI-Modell von Ihrem Browser heruntergeladen und kompiliert. Es wird dann zwischengespeichert, sodass jede spätere Transkription sofort beginnt.

Funktioniert es offline?

Teilweise – sobald das Modell zwischengespeichert ist, benötigt die Transkription selbst keine Verbindung. Sie müssen jedoch online sein, um die Seite selbst zu laden.

Werden polnische Diakritika korrekt geschrieben?

Ja — ą, ę, ć, ł, ń, ó, ś, ź und ż sind alle native Ausgabe.

Verarbeitet es Kasusendungen korrekt?

Ja — das Modell schreibt die flektierten Formen genau wie gesprochen.

Funktioniert schnelles umgangssprachliches Polnisch?

Ja, allerdings ist das Mini-Modell für schnelle informelle Sprache deutlich besser.