Sprache in Text

Wandeln Sie Sprache kostenlos in Text um, so oft Sie möchten. Wählen Sie eine Audiodatei oder nehmen Sie mit dem Mikrofon auf und erstellen Sie lokal eine Transkription und Untertitel.

Audiodatei hier ablegen oder klicken, um eine Datei auszuwählen

Ihre Aufnahme wird in diesem Browser verarbeitet und nicht auf einen Server hochgeladen.

Der Standardmodus ist schneller und benötigt weniger Arbeitsspeicher. Der erweiterte Modus kann die Erkennung verbessern, benötigt aber einen größeren Download, mehr Arbeitsspeicher und mehr Zeit.

Die Sprache wird standardmäßig automatisch erkannt. Wählen Sie bei einer falschen Erkennung die Sprache manuell.

Sprechernummern sind Schätzungen; bitte prüfen.

Nutzen Sie dieses Audio-in-Text-Tool zur Transkription von Sprachnotizen, Interviews, Vorlesungen und Besprechungsaufnahmen. Beim ersten Start werden die benötigten Modelle heruntergeladen; später kann der Browser-Cache wiederverwendet werden, sofern verfügbar. Die Verarbeitungsgeschwindigkeit hängt von Ihrem Gerät ab. Prüfen Sie Text, Zeitangaben und etwaige Sprecherkennzeichnungen, bevor Sie das Ergebnis teilen.

Häufige Fragen zu Sprache in Text

Wird meine Aufnahme hochgeladen?

Nein. Decodierung und Transkription erfolgen im Browser. Ihre Aufnahme wird nicht auf einen Server hochgeladen. Zum Herunterladen noch nicht zwischengespeicherter Modelle und Verarbeitungsressourcen ist eine Internetverbindung erforderlich.

Welche Sprache soll ich wählen?

Die automatische Erkennung bestimmt die Sprache anhand der gesprochenen Passagen am Anfang der Aufnahme. Sie können die Sprache auch manuell wählen. Viele Sprachen stehen zur Verfügung; die Genauigkeit hängt von Sprache, Akzent, Störgeräuschen und Aufnahmequalität ab. Gemischte Sprachen und gleichzeitiges Sprechen erfordern besondere Prüfung.

Wie unterscheiden sich Standard und Erweitert, und welchen Modus sollte ich wählen?

Der erweiterte Modus ist standardmäßig ausgewählt. Er kann die Erkennung verbessern, erfordert aber beim ersten Download mehr Daten, mehr Arbeitsspeicher und meist mehr Verarbeitungszeit. Wählen Sie Erweitert, wenn Ihnen die Erkennungsqualität am wichtigsten ist. Der Standardmodus ist schneller und benötigt weniger Arbeitsspeicher. Er eignet sich daher für lange Aufnahmen oder Geräte mit begrenzten Ressourcen.

Kann ich verschiedene Sprecher kennzeichnen?

Sprecherkennzeichnungen sind optional und standardmäßig deaktiviert. Sie schätzen, wer gesprochen hat, und können falsch sein, besonders bei kurzen oder überlappenden Stimmen.

Ähnliche Tools: KI-Audio-Rauschreduzierung · Audio teilen · Untertitel-Editor · SRT-Zeitverschiebung · VTT-Zeitverschiebung